Фильтры GPT-6 Astra пропускают запросы на транслите
Разработчик vechen обнаружил уязвимость в системе безопасности GPT-6 Astra от OpenAI: модель игнорирует фильтры, когда текст написан кириллицей латиницей. Встроенные ограничения OpenAI не срабатывают на таких запросах, что позволяет обойти запреты на опасный контент.
Проблема подтверждена на примере нелегальных запросов, которые модель обрабатывает без блокировки. Уязвимость указывает на слабое место в архитектуре фильтров безопасности нового поколения ИИ.
Источник: Код.ру
Что мы знаем о компании
OpenAI
- член совета директоров
- Пол Кристиано
- OpenAI выпустила подробный гайд по промптам для GPT Image 2.5 2026-09-14
- Сэм Альтман — генеральный директор OpenAI. 2026-09-14
- Альтман, Маск и Амодеи просят замедлить ИИ, Трамп против 2026-09-14
- OpenAI и DeepSeek скрывают настоящие модели за дистилляцией 2026-09-14
Новости этого рынка выходят у нас в телеграме первыми — @wikicompass.