Перейти к содержимому
Экосистема AI Vibe
← Назад к AI Vibe News

Редакция 9 августа 2026 г.

Новости

В Claude Code авто-режим по умолчанию: Anthropic ставят на машину, не на клики

Столбчатая диаграмма: авто-режим Claude Code ловит опасные команды в 89% случаев, ручная проверка — в 13,6%.

Anthropic с 14 августа ставят авто-режим дефолтом в Claude Code на планах Pro, Max и Team — агент выполняет команды в терминале и с файлами без подтверждения каждого шага. Внутри компании так работают почти все инженеры.

Люди против фильтра

В контрольном тесте с 1053 платными разработчиками посреди сессии один запрос разрешения подменили на явно опасную команду. Отказались только 13,6% — остальные нажали «ОК». Авто-режим заблокировал бы 89% таких действий; в 11% случаев защита не сработала бы.

Simon Willison в разборе соглашается: усталость от бесконечных подтверждений реальна, и машинный фильтр в среднем надёжнее человека, который кликает «разрешить» каждые несколько секунд.

Промпт-инъекции

Anthropic заказали независимую оценку у Trajectory Labs: 72 сценария косвенной промпт-инъекции, 720 попыток атаки на Claude Code и Codex по состоянию на 17 июля 2026 года. Ни одна не прошла против Claude Fable 5, Opus 5 и Sonnet 5 в авто-режиме.

Cat Wu из Anthropic ранее говорила, что риски внедрения вредных подсказок и утечки данных ниже, чем у среднего ревьюера.

Где защита не спасёт

Willison остаётся осторожным: вредоносный npm-пакет может попросить агента сначала запустить uvx fetch-model-files ., а сам пакет утащит данные — авто-режим это не поймает, если команда выглядит правдоподобно.

Его вывод из материала: ограничивать доступ агента к инструментам и данным, которые нельзя потерять при ошибке.

Источник: Auto mode is now the default in Claude Code for Pro, Max, and Team plans.