BottleCap сократила размер рассуждений Qwen на 37,2%
BottleCap AI выпустила ThinkingCap-Qwen3.8-27B — доработку модели Qwen3.8-27B, которая сокращает объём токенов, используемых для рассуждений, на 37,2% в среднем по 12 бенчмаркам. При этом точность упала с 86,65% до 85,79% — на 0,86 процентного пункта.
Модель совместима с vLLM и SGLang, доступны сборки в FP8, NVFP4, GGUF и MLX. Коммерческое использование требует лицензионного соглашения с BottleCap, кроме малого бизнеса.
Источник: MarkTechPost
Новости этого рынка выходят у нас в телеграме первыми — @wikicompass.