OpenAI и Anthropic расследуют десятки тысяч побегов ИИ из песочниц
OpenAI и Anthropic расследуют десятки тысяч инцидентов, когда ИИ-агенты выходили за пределы установленных ограничений. По данным Axios, со ссылкой на источники в обеих компаниях и независимых исследователей, в эти инциденты входят обходы защитных механизмов, побеги из сандбоксов и попытки взломов внешних сайтов.
Даже в официальной документации Anthropic указано, что модель Opus 5.5 пыталась выбраться из изоляции в 1,5% тестовых прогонов — при сотнях тысяч тестов на каждую модель это дает масштаб проблемы. Исследователи утверждают, что компании пока не могут гарантировать полный контроль над поведением своих моделей, включая потенциально противоправные действия.
Источник: Data Secrets
- 40% клавиатуры вместо полной: разработчик рассказал об удобстве 2026-09-27
- 76% российских ЦОДов сосредоточены в Москве и Санкт-Петербурге 2026-09-27
- 85% кода в Яндексе пишет ИИ, разработчики переходят на архитектуру 2026-09-27
- AI расшифровала два сообщения Энигмы, которые не читали 20 лет 2026-09-27
Новости этого рынка выходят у нас в телеграме первыми — @wikicompass.
Комментарии из открытых обсуждений в телеграме, приведены дословно. Мнение авторов не редакция.