LLM выдумывает шахматные ходы, которых нет на доске
Разработчик Gavrik_Art опубликовал на Хабре анализ проблемы с языковыми моделями, которые уверенно называют несуществующие шахматные ходы. Автор показал, что просьбы в промпте не решают проблему — модель говорит словами, но врет, тогда как движок знает правильный ответ, но выражает его числами.
Gavrik_Art разработал метод проверки каждого хода с помощью кода, чтобы отловить ошибки LLM. Материал демонстрирует фундаментальное ограничение современных моделей в задачах, требующих точного логического вывода.
Источник: Хабр — всё
Новости этого рынка выходят у нас в телеграме первыми — @wikicompass.