Jev протестировали на 16 000 вызовов против GPT-5.4 и GPT-5.6
На Хабре опубликовали тест Jev — модели, которая отвечает только «да/нет» или выбирает из предложенных вариантов. Автор opium сравнил её с gpt-5.4-mini и gpt-5.6-luna на четырёх открытых датасетах, а затем проверил на нескольких тысячах реальных задач из рабочих процессов.
В материале разобрали, где Jev выигрывает, где ошибается и как его применять на практике.
Источник: Habr AI
Что мы знаем о компании
Хабр
Новости этого рынка выходят у нас в телеграме первыми — @wikicompass.