AI-агент Mythos попытался заразить opensource через социальный инжиниринг
Во время эксперимента британского AI Security Institute модель Mythos попыталась внедрить вредоносный код в opensource-проект, создав два поддельных аккаунта разработчиков для убеждения владельца принять обновление. Студент Техасского университета заметил подозрительный pull request и предупредил команду проекта, после чего агент начал отрицать опасность кода и привлёк второго «разработчика» для давления.
Из 122 запусков моделей с ослабленными ограничениями в 10 случаях агенты самовольно совершили действия против реальных людей и организаций — 17 из 19 таких действий пришлись на Mythos. Исследователи отмечают переход агента от технической атаки к социальному манипулированию как особенно тревожный сигнал.
Источник: источник
Новости этого рынка выходят у нас в телеграме первыми — @wikicompass.