Компании OpenAI и Anthropic обнаружилиdent, связанные с безопасностью ИИ, в масштабах, значительно превосходящих те, о которых они ранее сообщали

- OpenAI и Anthropic расследуют десятки тысячdentнеожиданного поведения ИИ.
- Некоторые модели обходили средства защиты, выходили за пределы изолированных сред, заходили на веб-сайты и пытались избежать мониторинга.
- В OpenAI заявили, что утечка данных в Hugging Face остается самым серьезным известным случаем.
OpenAI и Anthropic расследуют десятки тысяч случаев, когда передовые системы искусственного интеллекта действовали таким образом, который независимые эксперты могли бы счесть небезопасным или несанкционированным.
Как сообщает Axios, все эти случаи произошли во время недавних внутренних испытаний и полевых испытаний, и многие из них все еще расследуются и пока не стали достоянием общественности.
В этих случаях наблюдалось поведение, варьирующееся от обхода моделями мер безопасности, создания собственных форумов, выхода из изолированных сред, управления веб-сайтами, разработки собственных подсказок и попыток обойти инструменты мониторинга.
Некоторые из этих случаев связаны с тестированием моделей на проникновение (red teaming), когда исследователи намеренно заставляют модели делать что-то нежелательное, чтобы выявить слабые места.
Другие случаи произошли во время обычного использования. Число подобныхdentзначительно превышает все, что было обнародовано на сегодняшний день.
На данном этапе такие компании, как OpenAI, Anthropic и другие, сталкиваются с одной и той же проблемой: люди накладывают ограничения на системы, способные достигать поставленной цели, несмотря на то, что эти ограничения в той или иной степени препятствуют этому.
OpenAI расширяет проверку после того, как агенты проникли во внешние системы и вызвали новые вопросы безопасности
В пятницу компания OpenAI сообщила о начале «масштабного» расследования активности моделей после июльского взлома Hugging Face, а также о появлении на этой неделе новых случаев необычного или несанкционированного поведения агентов. Hugging Face использует платформу для разработчиков с открытым исходным кодом.
Ранее OpenAI заявляла, что некоторые из её моделей вырвались из-под контроля, попали в открытый интернет и взломали платформу. Июльскаяdent встревожила исследователей ИИ и правительственных чиновников и вызвала новые требования к большей прозрачности и надзору.
В OpenAI отметили, чтоdent с «обнимающим лицом» по-прежнему остается «самым значительнымdent». OpenAI также связались с другими пользователями, чьи системы могли пострадать из-за других непредусмотренных действий моделей. Этиdentвключали обход моделями мер безопасности, влияние на доступность онлайн-сервисов и необычное использование общедоступных веб-сайтов.
Генеральный директор OpenAI Сэм Альтман заявил в пятницу: «Мы будем максимально прозрачны, учитывая такие факторы, как обнаруженные нашими агентами уязвимости в других компаниях, решение о раскрытии или нераскрытии которых будет принимать они»
Однако, по данным CNBC, аналитики по безопасности продолжают изучать случаи, зафиксированные в ходе внутренних проверок, реальных операций, расследований компаний и состязательных тестов. По всей видимости, некоторые алгоритмы пытались обойти системы мониторинга и другие механизмы контроля при выполнении своих задач.
Энтони также сказал, что поговорил с Сэмом по поводу этого дела и был недоволен тем, как долго OpenAI не раскрывала информацию. Он сказал, что «способ уведомления также неприемлем»
Компания OpenAI анализирует данные о посещениях веб-сайтов правительства США, проводимые моделью, пока следователи разбираются с тысячами дел
В OpenAI заявили, что большая часть проверенной на данный момент деятельности связана с обычными исследовательскими задачами, а не с серьезными инцидентами в области безопасности. «Большая часть проверенной нами деятельности связана с рутинными исследовательскими задачами, такими как доступ к общедоступному веб-контенту для получения ответов на вопросы», — якобы заявил представитель компании.
Представитель добавил: «В некоторых случаях речь шла о правительственных веб-сайтах, поскольку наши модели часто обращаются к ним как к авторитетным источникам общедоступной информации»
Представитель компании заявил, что модели OpenAI получили доступ к сайтам SEC.gov и Investor.gov. OpenAI не обнаружила никаких признаков взлома систем Комиссии по ценным бумагам и биржам или наличия уязвимостей, выявленных моделью.
Компания также добавила, что ее модель использовала общедоступные ключи разработчиков для получения демографической и экономической информации из Бюро переписи населения США. Доказательств неправомерного доступа к учетным записям Бюро переписи населения обнаружено не было.
В OpenAI заявили, что большинствоdentна данный момент случаев были оценены как имеющие низкую степень тяжести. Тем не менее, масштаб проверки означает, что весь процесс займет несколько месяцев. Некоторыеdentтакже остаются на стадии расследования, прежде чем пострадавшие организации решат, какие подробности можно безопасно обнародовать.
Согласно источникам, антропогенные и другие компании, занимающиеся искусственным интеллектом, проводят сотни тысяч, а то и больше, тестов моделей. Такой масштаб быстро меняет исходные данные. Даже небольшая доля неожиданного поведения может привести к десяткам тысячdent, когда компании проводят такое количество испытаний.
Однако, по данным CNBC, аналитики по безопасности продолжают изучать случаи, зафиксированные в ходе внутренних проверок, реальных операций, расследований компаний и состязательных тестов. По всей видимости, некоторые алгоритмы пытались обойти системы мониторинга и другие механизмы контроля при выполнении своих задач.
Если вы это читаете, значит, вы уже впереди. Оставайтесь на шаг впереди, подписавшись на нашу рассылку.

Джай Хамид
Джай Хамид последние 6 лет освещает криптовалюты, фондовые рынки, технологии, мировую экономику и геополитические события, влияющие на рынки. Она сотрудничала с изданиями, посвященными блокчейну, такими как AMB Crypto, Coin Edition и CryptoTale, занимаясь анализом рынка, крупными компаниями, регулированием и макроэкономическими тенденциями. Она училась в Лондонской школе журналистики и трижды делилась своими взглядами на криптовалютный рынок на одном из ведущих телеканалов Африки.
















