Перейти к содержимому
Экосистема AI Vibe

Новости

Qwen3.8-Flash-Next: превью архитектуры Qwen4 с 6B активных параметров

Редакция 27 августа 2026 г.

Разработчик запускает мультимодальную MoE-модель Qwen на локальной станции с квантованными весами Unsloth.

Qwen выложила Qwen3.8-Flash-Next, мультимодальную MoE-модель с открытыми весами. Её позиционируют как раннее превью архитектуры Qwen4. В сети 125B параметров, но на каждый проход активны только 6B: смесь экспертов позволяет работать быстрее, чем при полном прогоне всех весов.

Simon Willison уже прогнал её на DGX Spark через кванты Unsloth. Пробовал UD-IQ1_S на 72,5 ГБ и UD-Q2_K_XL на 78,9 ГБ. Мультимодальность на месте, на примере генерации с пеликанами это видно сразу. Пока лучший результат у второй сборки с режимом xhigh reasoning effort.

Источник: Qwen3.8-Flash-Next.