OpenAI урезала GPT-5.6 и признала: в Codex почти весь вывод — агенты

OpenAI снизила цены на GPT-5.6 Luna и Terra — на 80% и 20%. Для разработчика с API или агентным пайплайном это расширяет зону, где модель можно держать в проде без постоянного пересчёта бюджета.
Luna теперь $0,20 за миллион входных токенов и $1,20 за выходные; Terra — $2 и $12. У GPT-5.6 Sol режим Fast ускоряет ответ до 2,5 раз при удвоенной цене — качество модели не меняется.
Не токены, а закрытая задача
Sarah Friar в «Building abundant intelligence» ставит другой счёт: клиенты хотят закрытый тикет, выкатанный софт или проверенный контракт. Дорогая модель, которая доводит работу с первого раза, может обойтись дешевле дешёвой, если та тянет повторы и ручную правку. В одном workflow баланс между моделью, скоростью и ценой может меняться несколько раз.
Обвязка вокруг модели
GPT-5.6 Sol помог оптимизировать софт, через который отдаются модели — serving подешевил на 20%. На ARC-AGI-3 улучшения удержания рассуждений и управления контекстом подняли результат Sol с 13,3% до 38,3% при в шесть раз меньшем числе выходных токенов. Модель та же — менялись роутинг, контекст и инструменты вокруг неё.
Codex: почти всё через агенты
Агентная работа через Codex внутри OpenAI даёт 99,8% недельных выходных токенов; Finance — одна из команд, где агентные тулы стали основным способом работы. ChatGPT Work сдвигает сценарий от «спросил» к «сделал»: через полгода после регистрации люди шлют примерно на 50% больше сообщений в день и используют чат для примерно вдвое большего числа видов задач.
Источник: Building abundant intelligence.