Fable 5 реже откатывается на Opus 5: Anthropic подкрутила биоклассификаторы

Anthropic смягчила биозащиту Claude Fable 5 — в тестах откаты на Opus 5 при биологических запросах упали на 85%. Если в Claude Code модель внезапно «слабела» на расшифровку анализов или учебную биологию, это как раз ложное срабатывание, которое режут.
Как работает откат
За биозапросы отвечают небольшие автоматические классификаторы. Сработал — и вместо Fable 5 отвечает Opus 5, модель без той же глубины в биологии. При запуске классификаторы ловили почти всё подряд: лучше лишний fallback, чем пропустить запрос двойного назначения.
Что изменили
За несколько недель переписали constitution классификатора — свод правил, по которым система отличает разрешённый контент от защищённого. Собрали фидбек экспертов, обновили обучающие данные и переобучили модель. Вирусология, токсикология, молекулярный дизайн и разработка лекарств по-прежнему уходят в fallback.
Сколько откатов меньше
- Claude.ai — около 67%
- Cowork — 55%
- Claude Code — 17%
- Claude Platform — 7%
На повседневные вопросы — симптомы, лабораторные результаты, учебная биология — переключений должно стать заметно меньше. Медработникам обещают чуть больше поддержки на клинических задачах в рамках разрешённого.
Источник: Improving Fable 5's biology safeguards.