Перейти к содержимому
Экосистема AI Vibe
← Назад к AI Vibe News

Редакция 5 августа 2026 г.

Разборы

Ваш AI-ассистент съедает деньги, которых вы не видите — вот математика

Ваш AI-ассистент съедает деньги, которых вы не видите — вот математика

Соло-разработчик, который каждый день вставляет куски кода в чат Claude Code, Copilot или ChatGPT, часто не замечает, как растёт счёт за токены: один длинный paste и цепочка уточняющих вопросов легко превращаются в сотни долларов в месяц — без «enterprise-бюджета» и без ощущения, что вы что-то покупали. В разборе Sarvar Shakhboyev (AWS Builders) на Dev.to эта «невидимая» статья расходов разложена по шагам: от цены одного запроса до привычек, которые на его рабочем процессе сократили дневной расход с 138 000 до ~40 000 токенов.

Когда вставка кода в чат ассистента обходится дороже, чем кажется

Токены — не абстракция биллинга, а единица, за которую платят и за вход, и за выход; у крупных провайдеров ответ в 2–5 раз дороже входа. Один токен — примерно четыре символа; сто строк Python — около 1 000 токенов только на входе, пятьсот строк — уже около 5 000.

Код плотнее прозы: разница в 1,5–2,5 раза — скобки, CamelCase, отступы считаются отдельно. Главная ловушка не в первой вставке, а в продолжении диалога: блок уходит в контекст каждого следующего сообщения. Двести строк (~2 000 токенов) на пятом вопросе дают 10 000 накопленного входа; в десятисообщенной сессии — около 20 000 токенов только из одной вставки.

Практическое правило из поста: до 30 строк — можно вставить; 30–200 — один раз и короткая сессия; от 200 строк — загрузка файла или инструмент с доступом к файловой системе, а не бесконечное копирование в чат.

Сколько стоит «обычный» день с coding-ассистентом

На примере Claude Sonnet 4 ($3 за миллион входных токенов, $15 за миллион выходных) Shakhboyev считает типичный запрос в Claude Code в режиме по умолчанию — 108 000–117 000 токенов на задачу поиска; один такой запрос — $0,32–$1,75. Пятьдесят запросов в день — $16–87 на разработчика; на команду из ста инженеров — $48 000–261 000 в месяц.

Отсюда формула из заголовка: средний расход на разработчика с AI coding tools — $500–2 000 в месяц до любой оптимизации. Для сравнения: коллега автора получил счёт $1 200 за одну двухчасовую сессию — «просто дебажил, вставлял блоки кода, задавал уточнения».

На макроуровне — рост корпоративных расходов на ИИ на 483% между 2025 и 2026 годами (среднее $1,2M → $7M в год), хотя цена за токен за три года упала примерно в тысячу раз: потребление выросло быстрее, чем подешевела единица.

Девять привычек, которые режут расход на ассистенте

Shakhboyev обещает сократить лишний расход на 60%+ девятью привычками. В его процессе 68% токенов уходило на повторную отправку контекста из длинных тредов — после смены привычек и работы с Kiro дневной расход упал с 138 000 до ~40 000 токенов (71% меньше) при той же, по его словам, качестве вывода.

Кратко — что в списке:

  1. Загрузить контекст заранее — один развёрнутый запрос вместо серии уточнений.
  2. Новая сессия под новую задачу (в Kiro — /compact или чистая сессия).
  3. Ограничивать длину ответа — выход дороже входа в разы.
  4. Меньшая модель для простых задач (Nano/Flash против mid и frontier).
  5. Не копить «а ещё можешь…» — каждое уточнение перечитывает всю историю.
  6. Сжимать историю перед продолжением (20 000 токенов → ~200 в кратком пересказе).
  7. Ссылаться, а не повторять код и ошибки из прошлых сообщений.
  8. Оставлять только релевантные строки (пример: 500 → 45–60 строк, 5 000 → 300 токенов на входе).
  9. Инструменты с чтением файлов вместо копирования в чат.

Многоуровневая оптимизация — кэш, маршрутизация моделей, дисциплина промптов, сжатие истории — в материале связывается с сокращением расходов на 60–80% (ссылка на «research» без отдельного URL в посте). Один только осознанный подход, по опыту автора, режет лишний расход на 20–30%.

Что происходит, когда ассистентов выдают без лимитов

В разделе про enterprise — три кейса без внешних пресс-релизов, только нарратив в посте.

Uber: в декабре 2025 unlimited Claude Code получили 5 000 инженеров; к апрелю 2026 годовой AI-бюджет исчерпали за четыре месяца; тяжёлые пользователи — $500–2 000 в месяц; лимит — $1 500 на инженера.

Meta: за один месяц сотрудники потребили 73,7 трлн токенов; внутренний лидерборд «Claudeonomics» поощрял объём; CTO Andrew Bosworth публично заметил, что «all motion is not progress and token usage alone is not a measure of impact» — компания строит централизованные шлюзы ИИ с формальными бюджетами на токены.

Microsoft: отозвала лицензии Claude Code у целого инженерного подразделения — постоянное использование «сломало budget math».

Для соло-разработчика вывод не в масштабе корпорации, а в дисциплине: бесплатный tier ChatGPT или Claude «на работе» не отменяет математику вставки кода и длинных сессий.

Практический чеклист: соло-workflow без сюрпризов в счёте

Таблица цен mid-2026 (за 1M токенов) из поста — ориентир, какой ассистент во что обходится на входе и выходе:

Модель Input Output
GPT-4o $2,50 $10,00
Claude Sonnet 4 $3,00 $15,00
GPT-5.2 $1,75 $14,00
Gemini 2.5 Flash $0,15 $0,60
GPT-4.1 Nano $0,10 $0,40

Для команд предлагаются ступенчатые бюджеты: junior $200–400, mid $400–800, senior $800–1 500, ML $1 500–3 000 в месяц.

Соло-разработчику из материала следует вынести три действия:

  • Считать не запросы, а токены — особенно при вставке кода и длинных тредах.
  • Резать контекст до задачи — убрать лишний код, сжать историю, начать новую сессию.
  • Предпочитать инструменты с чтением файлов вместо бесконечного копирования в чат — Kiro в материале как пример: /context show, skills on-demand, knowledge bases со snippets, /compact для истории.

ИИ-ассистент экономит время только пока вы управляете его контекстом так же осознанно, как веткой в git. Иначе «бесплатный» чат тихо превращается в самую дорогую строку в вашем dev-бюджете.

Источники

  • Sarvar Shakhboyev (AWS Builders), «Your AI Assistant is Eating Money You Can't See. Here's the Math» — Dev.to (доступ: 2026-08-05 UTC)
  • Метаданные карточки Dev.to: опубликовано 2026-08-04; оценка времени чтения API — 13 мин; автор @sarvar_04