Волна ИИПодписаться
← Назад
Модели и агенты

Qwen3.8-Flash-Next 125B запустили на RTX 4090 с 6 ГБ VRAM — без квантизации и дистилляции

08.09.2026 · habr.com ↗

Qwen3.8-Flash-Next — открытая модель на 125 миллиардов параметров, построенная на архитектуре, которая ляжет в основу Qwen4. По заявлениям разработчиков, она конкурирует с закрытыми frontier-моделями в задачах программирования, работы с агентами и computer use.

Команда энтузиастов запустила полный checkpoint Qwen/Qwen3.8-Flash-Next на одной видеокарте RTX 4090. Пиковое потребление видеопамяти составило всего 5,95 ГБ — при этом использовался полный checkpoint в bf16, без 4-битной квантизации и дистилляции. Модель генерировала обычные токены.

Согласно собственным данным Qwen, модель превосходит Opus 4.6 Max по ряду метрик. Запуск на скромном оборудовании делает её доступной для широкого круга разработчиков и исследователей.

Источник: habr.com
← Все новости AI Wave