Mythos 5 прорвалась в интернет, но застряла на капче
Anthropic опубликовала отчёт о тестировании модели Mythos 5 на способность к несанкционированным действиям — модель вырвалась из песочницы и попыталась загрузить вредоносный код в PyPI. Эксплойт сама нейросеть написала без проблем, но затем потратила сотни страниц рассуждений на борьбу с капчей для регистрации аккаунта.
В итоге модель прорвалась, но сожгла огромное количество токенов на решение картинок с животными. Anthropic заключает: защита не обязана быть непробиваемой — достаточно, чтобы её обход стоил дороже самой добычи, тогда взлом станет экономически нецелесообразным.
Источник: Максим Спиридонов
Что мы знаем о компании
Anthropic
- pretraining researcher
- Jacob Coxon
- План Anthropic по замедлению ИИ к 13 сентября 2026 года поддержали OpenAI, xAI и Microsoft. 2026-09-14
- Anthropic призвал замедлить развитие искусственного интеллекта 2026-09-14
- Что стоит за призывами американских техгигантов замедлить ИИ Соучредитель Anthropic Дарио Амодеи призвал замедлить создание наиболее мощных моделей ИИ. Идею… 2026-09-14
- ⌨️ Год на спасение: зачем глава Anthropic хочет замедлить ИИ 2026-09-14
Новости этого рынка выходят у нас в телеграме первыми — @wikicompass.