Летний отчёт HF: Qwen обогнал Llama в GGUF, downloads ≠ лайки

Hugging Face опубликовала летний отчёт State of Open Models за январь–август 2026: на Hub уже 2,96 млн публичных моделей, а Qwen стал главной базой для файнтюна (151 448 дериватов, в 4,7 раза больше репозиториев Llama). Отчёт полезен тем, кто выбирает семейство под доработку или GGUF под локальный запуск: лайки и скачивания там расходятся сильнее, чем кажется из ленты.
Распределение на Hub остаётся экстремальным: 85,6% моделей имеют меньше 200 lifetime downloads, а 1,5% репозиториев дают 99,2% всех скачиваний. За семь месяцев датасеты выросли с 711 000 до 1 млн, Spaces с 1,00 до 1,44 млн.
Лайки и downloads: разные метрики
В топ-25 репозиториев по скачиваниям 2026 года и топ-25 по лайкам совпал только один. Ни одна модель, опубликованная в 2026-м, не попала в download-топ; тринадцать из двадцати пяти в этом списке датируются 2022 годом.
all-MiniLM-L6-v2: 1,55 млрд pulls за семь месяцев при 5 156 лайков- Kimi-K3: около 60 downloads на каждый лайк
Лайк отмечает свежий frontier-релиз, download копится на маленьких стабильных моделях в пайплайнах. Moonshot за год набрал 37M downloads, Qwen 2 045M, примерно в 55 раз больше: у Moonshot почти всё выше 70B, у Google, Microsoft и IBM Granite downloads в этом диапазоне практически нулевые.
Что реально крутится локально
Модели до 1B параметров берут 83% всех downloads за всё время; всё выше 100B, всего 1%. В 2026 только 3% объёма скачиваний ушло на модели больше 70B. Маленькие веса по-прежнему то, что помещается на железе большинства разработчиков.
В феврале команду ggml присоединили к Hugging Face: llama.cpp остался open-source, но получил стабильные ресурсы. July-снимок Hub уже несёт GGUF-сборки DeepSeek-V4-Flash (~284B) и Kimi-K3 (~2,8 трлн). Локальный inference перестал означать только 8B на ноутбуке.
GGUF-трафик смещён к Qwen: 39,6 млн downloads в месяц, почти вдвое больше Gemma (20,8 млн) и более чем в пять раз больше Llama (7,5 млн), хотя репозиториев Llama-GGUF на Hub даже чуть больше. Репозитории с библиотекой gguf выросли на 464% за период, быстрее transformers и peft (16%).
Qwen как семейство по умолчанию
151 448 дериватов Qwen: это работа комьюнити, не релизы Alibaba. Из 28 531 GGUF-конвертаций сам Qwen опубликовал только 54. Новые репозитории на базе Qwen появляются со скоростью 180–210 в день в первые семь месяцев 2026.
Apache 2.0 снижает friction для коммерческого файнтюна. У китайских frontier-релизов выше 20B в 2026 году 59% под Apache 2.0 и 22% под MIT, ни одного non-commercial. На американской стороне в том же размерном банде только 29% Apache или MIT, 41% custom terms.
Источник: State of Open Models: Summer 2026 Observations.