GTX 1080 Ti запустила MoE-модель на 24 токена в секунду
Разработчик SkalolazOther запустил большую языковую модель на видеокарте GTX 1080 Ti и получил скорость обработки 24 токена в секунду. Эксперимент основан на гибридной архитектуре DeltaNet + attention, которая позволяет эффективнее работать с длинным контекстом.
Результаты сопоставимы с показателями на более новых RTX 5060 Ti, где модель Qwen 3.8-27B в квантизации Q4_K_M выдавала аналогичную производительность. Материал опубликован на Хабре и получил оценку 7 баллов от системы анализа.
Источник: Habr AI
- 54% россиян используют ИИ при поиске работы и составлении резюме 2026-09-26
- Агент OpenAI опубликовал GitHub-ключ исследователя при попытке украсть чужой код 2026-09-26
- Агенты ИИ показывают результаты, но не решают все задачи 2026-09-26
- Anthropic выпустил Jev — модель для мгновенных типовых решений 2026-09-26
Новости этого рынка выходят у нас в телеграме первыми — @wikicompass.