Anthropic 8 октября 2026 года запустила новый сервис OSS Scanner. Это добровольный бесплатный сервис поиска уязвимостей для проектов с открытым кодом: зарегистрированные проекты регулярно сканируют самые мощные большие языковые модели компании, включая Claude Mythos. Анонс вышел в официальном блоге Anthropic, новость осветила The Verge.

Причина появления сервиса

Появление сканера неслучайно. За последние полгода модели Anthropic выявили более 29 тысяч кандидатов в потенциальные уязвимости в крупных программных проектах. Проблема в том, что компания не успевала разбирать этот объём вручную — лишь около 6 тысяч находок прошли проверку и отбор специалистами. То есть большинство найденных уязвимостей так и осталось без человеческого взгляда, и ценные находки могли быть утеряны.

За этот же период наблюдался ещё один случай: сопровождающим проектов (мейнтейнерам), попросившим «присылайте все отчёты», было передано напрямую почти 5 тысяч непроверенных отчётов. Эта практика легла в основу OSS Scanner: то, что нашла модель, передаётся напрямую, без вмешательства человека. Теперь этот процесс работает как официальный сервис на основе открытого согласия владельцев проектов — кто не хочет получать отчёты, тот не регистрируется и ничего не получает.

Как работает сервис

Проекты с открытым кодом, зарегистрированные в OSS Scanner, получают периодическое сканирование самыми мощными моделями Anthropic. Отчёты полностью генерирует модель — человек их заранее не просматривает и не отбирает. Такой подход позволяет сканировать быстрее и чаще, но у него есть и обратная сторона: некоторые отчёты могут быть неверными или непригодными.

Anthropic сообщила, что ожидает показатель точного обнаружения (true-positive rate) выше 90%. То есть ожидается, что более девяти из десяти отчётов будут настоящими уязвимостями — оставшаяся часть может оказаться ошибочной, и владельцы проектов заранее это принимают. Сервис добровольный и бесплатный: владельцы проектов регистрируются, дают согласие на получение результатов сканирования и получают отчёты напрямую.

Тест точности: 97 находок прошли независимую проверку

Чтобы оценить надёжность сканера, Anthropic привлекла независимых экспертов — специалистов по тестированию на проникновение. Они по одному проверили 97 критических и высокоуровневых находок в 48 проектах. Результаты распределились так: 85 (88%) признаны достаточно значимыми для процесса координированного раскрытия уязвимостей (coordinated vulnerability disclosure) компании — то есть их серьёзность позволяла передать их владельцам проектов через официальную процедуру раскрытия. Ещё 11, хотя и были настоящими уязвимостями, оказались повторением уже известных проблем. Лишь одна была ложноположительной (false positive).

«Отчёты полностью генерирует модель, проверки и отбора человеком нет — это позволяет сканировать быстрее и чаще, но некоторые отчёты могут быть неверными или непригодными», — говорится в официальном анонсе Anthropic. Компания ожидает показатель точного обнаружения выше 90%.

Этот результат теста поддерживает главное утверждение сервиса: даже без человеческой проверки большая часть отчётов модели имеет практическую ценность и достойна официального процесса раскрытия.

Что в каждом отчёте и что говорят первые пользователи

По данным Anthropic, каждый отчёт состоит из нескольких обязательных частей: независимого воспроизводителя (reproducer) или доказательства концепции (proof of concept), комментария с bisection-анализом, показывающим, когда была внесена ошибка (где это возможно), и — при наличии — кандидата в исправление (patch). Такая структура позволяет сопровождающему проекта воспроизвести проблему, понять её происхождение и оценить исправление. Отмечено, что некоторые ошибки, найденные в ходе первоначальных сканирований, можно было связать в цепочку и превратить в эксплойт для удалённого выполнения кода без аутентификации (unauthenticated remote code execution) — то есть среди находок есть и серьёзные угрозы безопасности.

Проекты, первыми опробовавшие сервис, выразили удовлетворение результатами. Представитель wolfSSL Тодд Оска (Todd Ouska) сообщил, что из полученных 74 отчётов все, кроме двух, оказались пригодными, а пять из них получили статус CVE. Ноа Миш (Noah Misch) из PostgreSQL отметил, что несколько отчётов пришли с почти готовыми исправлениями — его команда смогла применить их почти без изменений. Антон Арапов (Anton Arapov) из OpenSSL подчеркнул, что сырой вывод модели — на уровне отчётов, написанных людьми, а иногда и лучше.

OSS Scanner сейчас работает на добровольной основе и предоставляется проектам с открытым кодом бесплатно. Anthropic представляет его как свой вклад в безопасность open-source-экосистемы — практический пример направления мощных моделей на пользу широкого сообщества.