
Кодинг-агенты на основе больших языковых моделей больше не просто помогают писать код — они научились превращать любой намёк на уязвимость в готовый эксплоит за считанные минуты. Два независимых свидетельства от мейнтейнеров крупных open-source проектов подтверждают: старая модель «обсудили баг, подождали релиза, закрыли CVE» перестала работать.
Anil Madhavapeddy, профессор компьютерных наук Кембриджского университета и один из ключевых мейнтейнеров компилятора OCaml, опубликовал тревожный пост. Он сообщает, что после того, как команда выложила патч для обсуждения в публичный репозиторий, на сайт проекта начали поступать автоматические зондирующие запросы. «Обычно на это уходят дни, а релиз можно выпустить через неделю-две. Здесь же прошло около десяти минут, и сайт уже получал probes с percent-encoded traversal sequences. Это значит, что автоматические watchers следят за публичными репозиториями», — пишет Madhavapeddy.
Он провёл собственный эксперимент: попросил кодинг-агента найти уязвимость по одному лишь заголовку обсуждения. Когда Claude Fable отказался выполнять задачу, он переключился на DeepSeek V4 Pro — и агент успешно нашёл баг и сгенерировал доказательство эксплуатации. «Современные кодинг-агенты стали настолько эффективны в поиске уязвимостей, что малейший намёк на новый баг даёт им достаточно информации, чтобы его найти», — заключает профессор.
Масштаб проблемы подтверждается и со стороны популярных проектов. Nick Craig-Wood, мейнтейнер утилиты для синхронизации файлов rclone, оставил развёрнутый комментарий на Hacker News. «За первые 10 лет проекта мы получили около 20 security-disclosure через GitHub. За последний месяц нам пришлось разбирать больше 40!» — пишет он. По его словам, около 75% этих уведомлений содержат как минимум что-то, что требует внимания. При этом GitHub, который раньше назначал CVE за 2–3 дня, теперь вынужден обрабатывать запросы 3–4 недели. «Мне приходится выпускать point-релизы с пометкой CVE-PENDING в changelog — это далеко от идеала», — добавляет Craig-Wood.
Ключевые факты
| Сущность | Данные | Источник |
|---|---|---|
| OCaml | Первые probes через 10 минут после публикации патча | Anil Madhavapeddy, личный пост |
| rclone | 20 disclosure за 10 лет → 40+ за последний месяц | Nick Craig-Wood, комментарий на Hacker News |
| GitHub CVE assignment | Задержка выросла с 2–3 дней до 3–4 недель | Nick Craig-Wood, там же |
| DeepSeek V4 Pro | Успешно нашёл баг по намёку, когда Claude Fable отказался | Anil Madhavapeddy, личный пост |
Почему это происходит именно сейчас
Ключевой фактор — доступность сильных кодинг-агентов (Claude Fable, DeepSeek V4 Pro и аналоги) и автоматических скриптов, которые мониторят коммиты, issues и pull request-ы. Раньше, чтобы найти уязвимость, требовалось вручную читать код и понимать контекст. Теперь достаточно ключевых слов в описании патча: агент сам достраивает недостающие детали, идентифицирует уязвимый участок и генерирует эксплоит.
Madhavapeddy подчёркивает, что текущая практика embargo в open-source — когда информация о баге держится в секрете до выхода патча — несовместима с таким темпом. Если атакующие могут запустить эксплуатацию через минуты после публикации, то традиционные процессы (ожидание подтверждения, выпуск CVE, координация с дистрибьюторами) теряют смысл. Нужны новые механизмы, возможно, более быстрые автоматические патчи или изменение политики disclosure.
Что это значит для разработчиков и пользователей
Для мейнтейнеров open-source проектов ситуация означает резкий рост нагрузки: вместо единичных disclosure — десятки в месяц, причём с высокой точностью (75% требуют внимания). Это вынуждает либо тратить огромное время на триаж, либо внедрять собственные AI-инструменты для автоматизации анализа. Craig-Wood уже использует AI для сортировки и подготовки исправлений, но это не решает проблему с CVE.
Для пользователей, которые полагаются на open-source компоненты, это означает, что время между обнаружением уязвимости и её эксплуатацией может составлять минуты, а не дни. Обновления безопасности нужно применять максимально быстро, а при отсутствии CVE в changelog — полагаться на оперативную информацию из репозиториев.
Пока что это явление описано на примере OCaml и rclone, но нет оснований считать, что оно ограничено этими проектами. Вероятно, аналогичная ситуация складывается во многих популярных open-source репозиториях, особенно тех, где активно обсуждаются патчи в публичных issue и PR.
Источник: Simon Willison, «Just a rumour of a bug is enough to find a security exploit these days» — https://simonwillison.net/2026/Aug/28/just-a-rumour-of-a-bug/
