Перейти к содержимому
Экосистема AI Vibe
← Назад к AI Vibe News

Редакция 14 августа 2026 г.

Новости

Летний отчёт HF: Qwen обогнал Llama в GGUF, downloads ≠ лайки

Сравнение скачиваний GGUF-сборок Qwen, Llama и Gemma на Hugging Face Hub на фоне роста открытых моделей в 2026 году.

Hugging Face опубликовала летний отчёт State of Open Models за январь–август 2026: на Hub уже 2,96 млн публичных моделей, а Qwen стал главной базой для файнтюна (151 448 дериватов, в 4,7 раза больше репозиториев Llama). Отчёт полезен тем, кто выбирает семейство под доработку или GGUF под локальный запуск: лайки и скачивания там расходятся сильнее, чем кажется из ленты.

Распределение на Hub остаётся экстремальным: 85,6% моделей имеют меньше 200 lifetime downloads, а 1,5% репозиториев дают 99,2% всех скачиваний. За семь месяцев датасеты выросли с 711 000 до 1 млн, Spaces с 1,00 до 1,44 млн.

Лайки и downloads: разные метрики

В топ-25 репозиториев по скачиваниям 2026 года и топ-25 по лайкам совпал только один. Ни одна модель, опубликованная в 2026-м, не попала в download-топ; тринадцать из двадцати пяти в этом списке датируются 2022 годом.

  • all-MiniLM-L6-v2: 1,55 млрд pulls за семь месяцев при 5 156 лайков
  • Kimi-K3: около 60 downloads на каждый лайк

Лайк отмечает свежий frontier-релиз, download копится на маленьких стабильных моделях в пайплайнах. Moonshot за год набрал 37M downloads, Qwen 2 045M, примерно в 55 раз больше: у Moonshot почти всё выше 70B, у Google, Microsoft и IBM Granite downloads в этом диапазоне практически нулевые.

Что реально крутится локально

Модели до 1B параметров берут 83% всех downloads за всё время; всё выше 100B, всего 1%. В 2026 только 3% объёма скачиваний ушло на модели больше 70B. Маленькие веса по-прежнему то, что помещается на железе большинства разработчиков.

В феврале команду ggml присоединили к Hugging Face: llama.cpp остался open-source, но получил стабильные ресурсы. July-снимок Hub уже несёт GGUF-сборки DeepSeek-V4-Flash (~284B) и Kimi-K3 (~2,8 трлн). Локальный inference перестал означать только 8B на ноутбуке.

GGUF-трафик смещён к Qwen: 39,6 млн downloads в месяц, почти вдвое больше Gemma (20,8 млн) и более чем в пять раз больше Llama (7,5 млн), хотя репозиториев Llama-GGUF на Hub даже чуть больше. Репозитории с библиотекой gguf выросли на 464% за период, быстрее transformers и peft (16%).

Qwen как семейство по умолчанию

151 448 дериватов Qwen: это работа комьюнити, не релизы Alibaba. Из 28 531 GGUF-конвертаций сам Qwen опубликовал только 54. Новые репозитории на базе Qwen появляются со скоростью 180–210 в день в первые семь месяцев 2026.

Apache 2.0 снижает friction для коммерческого файнтюна. У китайских frontier-релизов выше 20B в 2026 году 59% под Apache 2.0 и 22% под MIT, ни одного non-commercial. На американской стороне в том же размерном банде только 29% Apache или MIT, 41% custom terms.

Источник: State of Open Models: Summer 2026 Observations.