NullPilot сравнил Jev с обычными LLM на трёх задачах
Разработчик NullPilot опубликовал на Хабре обзор, где сравнил специализированную модель Jev с обычными LLM на задачах определения спама, классификации комментариев и оценки негатива. Тестирование проводилось на русском и английском языках с проверкой качества ответов, скорости обработки и стоимости.
Отдельно автор проверил, как модели распознают повторные вопросы в длинной истории комментариев. Результаты показывают, какие решения эффективнее для обработки текстов на естественном языке в реальных сценариях.
Источник: Хабр — всё
Новости этого рынка выходят у нас в телеграме первыми — @wikicompass.