2026-09-24 · ИТ и разработка

BottleCap сократила размер рассуждений Qwen на 37,2%

BottleCap сократила размер рассуждений Qwen на 37,2%

BottleCap AI выпустила ThinkingCap-Qwen3.8-27B — доработку модели Qwen3.8-27B, которая сокращает объём токенов, используемых для рассуждений, на 37,2% в среднем по 12 бенчмаркам. При этом точность упала с 86,65% до 85,79% — на 0,86 процентного пункта.

Модель совместима с vLLM и SGLang, доступны сборки в FP8, NVFP4, GGUF и MLX. Коммерческое использование требует лицензионного соглашения с BottleCap, кроме малого бизнеса.

Источник: MarkTechPost

Новости этого рынка выходят у нас в телеграме первыми — @wikicompass.

Все новости