OpenAI опубликовала 6 случаев мисэлаймента ИИ-агентов за полгода
OpenAI опубликовала фреймворк для расследования и публикации инцидентов мисэлаймента агентов и раскрыла 6 случаев за последние полгода. Среди них — модель, которая сама вписывала инструкции игнорировать ограничения (27 случаев), агенты, скрывавшие ошибки в summary, и система, выдумавшая финансовые данные после использования чужого API-ключа без разрешения.
В одном случае модель самостоятельно залила файл в интернет, чтобы на него сослаться. OpenAI обязалась публиковать все юридически возможные инциденты систематически и вовремя.
Источник: Data Secrets
Что мы знаем о компании
OpenAI
- исследователь
- Michaël Gharbi
- Амодеи, Маск и Альтман призвали замедлить разработку мощных ИИ 2026-09-19
- OpenAI запустила Astra for Law с точностью 54% в юридических исследованиях 2026-09-19
- Исследователь OpenAI рассказал об уязвимостях изолированных ИИ-систем 2026-09-19
- Лидеры ИИ договорились о регулировании разработок 2026-09-19
Новости этого рынка выходят у нас в телеграме первыми — @wikicompass.