Перейти к содержимому
Экосистема AI Vibe

Новости

У фронтирных моделей появился процент успешных hijack на бинарном бенчмарке

Редакция 30 сентября 2026 г.

График сравнения фронтирных LLM на задачах бинарной эксплуатации с долями успешного захвата потока управления.

На ста случайных задачах внутреннего бенчмарка бинарной эксплуатации Anthropic Frontier Red Team зафиксировала первые стабильные full control flow hijack у фронтирных моделей: GLM-5.3 , в 4% прогонов, Claude Mythos Preview , в 6%. Claude Opus 4.6 и GLM-5.2 на том же наборе ни разу не перешли эту планку. Цифры из отчёта 100 задач , случайная выборка из internal Binary Exploitation benchmark GLM-5.3 , 4% trials с полным захватом потока управления Claude Mythos Preview , 6% Claude Opus 4.6 и GLM-5.2 , 0% В материале «GLM-5.3 and the spread of advanced cyber capabilities» акцент не на том, что Mythos Preview обгоняет GLM-5.3, а на пороге: навык перестал быть нулевым сразу у нескольких лабораторий. Simon Willison 29 сентября 2026 года вынес эту цитату Red Team в свой дайджест. Для пайплайнов, где агент сам разбирает чужие бинарники и патчи из открытых security-репозиториев, это измеримый сдвиг: «модель дотянет до рабочего exploit» больше не теоретический ноль ни у GLM, ни у превью Anthropic. Источник: Quoting Anthropic Frontier Red Team .