Simon Willison: как 2026 год переломил coding agents и vibe-код

Для Simon Willison год начался в ноябре 2025: Claude Opus 4.5 и GPT-5.1 в связке с Claude Code и Codex перешли от «часто косячат» к «можно жить каждый день». На closing keynote WeAreDevelopers в San Jose (27 сентября 2026) он связал эту точку с остальной хронологией , от первого коммита Warelay до корпоративных лимитов на токены. Годами Willison гоняет один и тот же абсурдный тест , SVG с пеликаном на велосипеде. В ноябре у Opus 4.5 и GPT-5.1 рама всё ещё «ломалась»; к февралю Gemini 3.1 Pro уже рисовала цепь и ноги по обе стороны рамы. В подкасте Oxide and friends Bryan Cantrill и Adam Leventhal назвали Deep Blue то ощущение, когда инженеру кажется, что модель умеет всё и пропадает азарт , на конференции к этому возвращались несколько спикеров. От Warelay до OpenClaw Первый коммит в Warelay , 24 ноября 2025. К концу января репозиторий успел побыть CLAWDIS, CLAWDBOT, Moltbot и стал OpenClaw: меньше чем за два месяца Willison насчитал 8 330 коммитов, на момент доклада , больше 100 000. Он зовёт это самым vibe-coded продуктом в индустрии и вводит жаргон Claw , персональный агент с тем же паттерном, что у coding agent: пишет код на вашей машине и сразу исполняет. В Bay Area разобрали Mac mini «как аквариум для Claw»; в марте в Китае не-технари стояли в очереди на install-party. Фабрики, Moltbook и токены StrongDM Software Factory (февраль): код не пишут люди , только через агента; люди не ревьюят код, качество проверяют иначе. Dan Shapiro называет это Dark Factory. Moltbook , соцсеть для AI-агентов: запуск в четверг, профиль NYT в понедельник, ко вторнику тонула в спаме; через месяц купила Meta. Tokenmaxxing : Meta вшила AI в performance review, Microsoft требовала AI почти от всех, Uber , 90% инженеров с AI-workflow; потом лимиты и откат. Willison: год назад сложно было потратить больше $50 на токены, с агентами , $1 000 за день реальной работы; product-market fit 2026 он связывает с coding agents. В январе Willison описывает «AI mania»: сон режется, пока агент не собирает очередной проект , интерпретатор JavaScript на Python, runtime WebAssembly на Python, плейграунд с Pyodide в браузере. После сборки он сам спросил, нужен ли миру медленный полуготовый интерпретатор. Из прогнозов на подкасте: около 40 из 277 сессий конференции касались sandboxing или безопасности агентов; катастрофу уровня «Challenger» для agent security он ждал в начале года , пока скорее шум, чем экономический удар. Источник: 2026 in LLMs (so far) .