Открытые ИИ уже ищут дыры в коде — защитникам пора гонять deepsec

Kimi K3 на DeepSec Bench — лидер среди open-weight моделей: результат около Sonnet 5 и выше Opus 4.8, при этом без ограничений на атакующие сценарии. Vercel объясняет, почему ждать кибер-программ вроде Mythos не обязательно — Sol 5.6 на XHigh уже сильнее для обороны.
В марте инженер Vercel проверил гипотезу: раз модель ловит дыры в диффе, найдёт ли то же на всём репозитории. Ответ — да; оттуда вырос open-source harness deepsec. Frontier-модели, кроме Fable 5, справляются с защитными задачами уже сейчас.
Что показал эксперимент с Sandbox
Kimi K3 пыталась выбраться из Vercel Sandbox. Побега не было, но модель сама разобрала guest-kernel, нашла пути эскалации привилегий, подняла VM для проверки и написала stateful-фаззер. На уязвимой поверхности такой прогон мог бы дойти до эксплойта.
deepsec на практике
- Ищет IDOR, XSS и SSRF — включая маршруты из инцидента Hugging Face после блокировки SSRF.
- Работает на своей инфраструктуре с выбранным провайдером инференса.
- В Vercel — ревью на каждый PR и полный прогон критичных репозиториев раз в квартал; один обход — десятки тысяч долларов.
Что меняет Vercel
На Hobby-плане открыли полный egress firewall в Sandbox. Идёт запуск программы HackerOne по нулевым дням в Sandbox и firewall — AI-расходы через AI Gateway компенсируют за принятые отчёты. deepsec расширят: open-weight модели будут перепроверять гипотезы от защитных прогонов.
Источник: Everything hackable will get hacked.