Остаётся ли open source AI открытым в 2026

Формально веса под MIT, а фактически ваш локальный стек с Ollama или LiteLLM может зависеть от сделки на маршрутизации провайдеров. В эссе Mithilesh Gaurihar называет парадокс 2026 года: открытый ИИ «ещё открыт по лицензии и консолидируется по владению». Для соло-разработчика без корпоративного бюджета вопрос не абстрактный: сколько независимых компаний должны согласиться, прежде чем изменится доступ к модели в вашей цепочке вызовов.
Лицензия на весах не равна переносимому AI-стеку
Лицензия на файле весов — единственный слой, который «объявляет о себе» сам. MIT остаётся MIT, даже когда вокруг меняются владельцы хабов, рантаймов и шлюзов. Но открытые веса не гарантируют ни доступ к файлу, ни дешёвое железо, ни нейтральный маршрут между провайдерами.
Одна неделя августа 2026 это показала наглядно. GLM-5.3-Flash (Z.ai) вышел с unmodified MIT 26 августа. В тот же день Qwen3.8-Flash-Next (Alibaba) получил Qwen Community License, а не MIT. Более крупный GLM-5.3 — bespoke licence с revenue gate: операторам с совокупной выручкой свыше $10 млрд нужен security review, scope и метод определяет Z.ai. Три релиза, три режима «открытости», и ни один не отвечает на вопрос, кто завтра решит, откуда вы качаете файл и куда уходит запрос из оркестратора.
Открытость в 2026 — не про лицензию на весах, а про то, сколько компаний должны согласиться, прежде чем изменится ваш доступ.
Контраст с «классическим» open source тоже показательный. AWS закрыл сделку по DuckLabs (DuckDB) 31 августа: проект остаётся у nonprofit DuckDB Foundation, лицензия MIT, создатели ведут техническое направление. Governance пережил смену владельца людей. Не факт, что AI-стек с тем же количеством слоёв пройдёт тот же тест.
Пять слоёв аудита: от файла до оркестрации
Gaurihar предлагает не спорить об определениях, а пройти пятислойный аудит. На каждом слое один вопрос: если владелец завтра поменяет условия, что сломается и сколько займёт переезд?
| Слой | Что проверяется | Практический фокус для AI-стека |
|---|---|---|
| licence | Условия на весах | Единственный явный слой; MIT не спасает от остальных |
| distribution | Откуда берёте веса | Hugging Face как хаб; риск концентрации при сделках |
| runtime | Что грузит и сервит модель | vLLM, SGLang, llama.cpp, Transformers, KTransformers |
| compute | Железо и ценообразование GPU | Cloud gates, рост цен на AI-серверы |
| orchestration | Кто вызывает модель и роутит провайдеров | Pipelines, provider routing, конфиг vs захардкоженный путь |
Счётчик простой: сколько слоёв отвечают «одна компания решает». Самостоятельный хостинг закрывает два из пяти: свой сервер инференса и свой оркестратор. Это отдельные решения. Он не снимает вопросы производства чипов, цен на серверы и размещённой дистрибуции весов.
Для разработчика с агентным конвейером или циклом генерации кода на локальных эндпоинтах (Together, Groq, vLLM, LM Studio, Ollama) это карта рисков, а не чеклист лицензий.
Сделки 2026 года: распространение, маршрутизация и вычисления
Автор связывает консолидацию по владению с цепочкой событий июль — сентябрь 2026 на слоях распространения, маршрутизации и вычислений. При этом в 2026, по его тезису, ни одна модель не была relicensed: сжимается не текст лицензии, а число независимых точек контроля.
Маршрутизация и оркестрация. Stripe согласился приобрести OpenRouter. Стороны подтвердили сделку; продукт и дорожная карта сохраняются под тем же именем. OpenRouter маршрутизирует более 400 моделей и более 80 провайдеров. Сумма сделки в прессе — более $7 млрд; это пресс-отчёты, не независимый аудит. Для цепочки, где base_url смотрит на OpenRouter, нейтральный шлюз превращается в продукт платёжного гиганта.
Распространение и локальный рантайм. О сделке Nvidia → Hugging Face (~$12.9 млрд) писали TechCrunch и The Information; стороны не подтвердили. В феврале 2026 команда ggml / llama.cpp присоединилась к Hugging Face. Если распространение и доминирующий локальный рантайм окажутся под одним владельцем с производителем чипов, это бьёт по соло-стеку на llama.cpp и Ollama, не только по облачному API.
Вычисления. 1 июля Nvidia запустила compute partnership programme: базовая почасовая ставка плюс 50% revenue above, vet customers через approval. Автор называет это «gate». В августе по пресс-отчётам была пауза; Nvidia отрицала pause. Fortune писала о росте цен на AI-серверы более 15% на уровне системы; у производителей серверов — около 17% на чипах. Разные метрики, обе из пресс-отчётов.
Цифры сделок и процентов — фон. Механизм один: каждый новый владелец на слое — ещё одно «да» до смены вашего рабочего процесса.
Оркестрация — слой, который не проверяют
Слой оркестрации — тот, что консолидировался последним и который мало кто аудирует. Именно здесь сходятся агентные конвейеры, нейтральная маршрутизация провайдеров и выбор модели в конфигурации, а не в коде.
Тест инструмента звучит жёстко: если эту компанию завтра купят, сможем ли мы продолжить работу на своей инфраструктуре, из исходников, без чьего-либо разрешения?
В эссе — скрытая зависимость на примере RocketRide (open-source orchestration runtime; автор материала работает над проектом). В кодовой базе встречается modelSource: "openrouter" — 346 раз в 13 файлах:
modelSource: "openrouter"
Это provenance для context-window numbers, не routing path, но иллюстрация того, как шлюз просачивается в метаданные после сделки Stripe/OpenRouter.
Портативность здесь — выбор модели в конфигурации, а не в коде: переключение провайдера как смена настроек, не рефакторинг. LiteLLM (MIT, можно поднять у себя) и RocketRide (MIT, base_url + model на узле, совместимом с OpenAI) проходят да/нет-тест. RocketRide не заменяет vLLM/SGLang/llama.cpp — только оркестрацию; управление слабее модели DuckDB Foundation (компания-лидер, два согласования мейнтейнеров).
Кейс AT&T через LiteLLM — форма заявления, не доказательство рынка: около 40% employee AI usage на open models сегодня, намерение 60–70%, coding costs −56% при около 2% decline quality, около 45B tokens/day. Всё по собственным данным AT&T, без независимого аудита.
Четыре шага к стеку, который можно перенести
Материал закрывается четырьмя рекомендациями и одним первым действием. Для соло-workflow с локальным инференсом и самохостным оркестратором они читаются как практика против привязки к вендору, а не манифест.
- Держите свою копию весов — зеркало, не скачивание при каждом деплое. Самый дешёвый слой, который часто пропускают.
- Заменяемый путь подачи модели — предпочитайте модели с более чем одним независимым рантаймом на карточке (SGLang, vLLM, Transformers для GLM-5.3-Flash; vLLM, SGLang, Transformers для Qwen3.8-Flash-Next).
- Выбор модели в конфигурации, не в коде — форма заявления AT&T, не универсальная норма.
- Оркестрация, которую можете поднять сами — да/нет-тест выше; LiteLLM и RocketRide как примеры, проходящие тест по автору.
Первое действие: пройти пятислойный счёт, отрепетировать переезд в staging на дедлайне, начать со слоя, где восстановление дольше всего. Для большинства команд это оркестрация.
Debian 29 августа провёл GR по responsible use of generative AI: голосование не запрещает и не одобряет LLM; стандарты качества те же; disclosure encouraged, not required. Это governance сообщества, не лицензия на модели, но напоминание, что «открытость» AI в 2026 живёт на нескольких уровнях одновременно.
Лицензия открыта. Владение — нет. Проверяйте не ярлык OSS на карточке модели, а пять слоёв между файлом весов и вашим следующим запросом к API.
Источники
- Mithilesh Gaurihar — Is Open Source AI Still Open in 2026? (Dev.to)
- Stripe — Stripe agrees to acquire OpenRouter
- TechCrunch — Stripe will reportedly acquire OpenRouter for $7B
- TechCrunch — Nvidia closes in on Hugging Face acquisition (сделка не подтверждена сторонами)
- Hugging Face — ggml and llama.cpp join Hugging Face
- AWS — AWS and DuckLabs
- The Register — AWS buys DuckLabs
- Hugging Face — GLM-5.3-Flash (MIT)
- The New Stack — Z.ai GLM weights license
- Hugging Face — Qwen3.8-Flash-Next (Qwen Community License)
- Debian — Vote 2026-002 on generative AI
- Fortune — Nvidia AI server price hikes
- Yahoo Finance — Nvidia pauses AI cloud revenue initiative (reporting)
- Tom's Hardware — Nvidia denies pausing
- AT&T — The tokenomics equation (self-reported)
- RocketRide — rocketride-server (MIT orchestration; автор эссе работает над проектом)
- RocketRide — GOVERNANCE.md