Anthropic расширила доступ экспертов по кибербезопасности к своим самым сложным моделям искусственного интеллекта (ИИ). Это расширение позволяет предварительно верифицированным группам работать с меньшими ограничениями в отношении определенных видов цифровой безопасности.
Это изменение интегрирует пересмотренную версию Программы киберверификации (Cyber Verification Program - CVP). Цель CVP — дать возможность специализированным организациям использовать мощные модели Anthropic для обнаружения уязвимостей, управления инцидентами и проведения тестов безопасности.
Это решение было мотивировано предыдущей инициативой компании под названием Project Glasswing. Этот проект помог партнерам обнаружить не менее 129 тысяч проверенных программных ошибок в период с апреля по июль 2026 года. Из этих открытий более 33 тысяч были классифицированы как критические или высокоприоритетные.
Однако Anthropic подчеркивает, что эти цифры, вероятно, представляют лишь малую часть от общего объема, предполагая, что реальное воздействие может быть как минимум в пять раз больше, поскольку данные были собраны только от части участников программы.
Уровни доступа и области применения
Первый уровень, названный Defense, предназначен для задач оборонительного характера. Сюда входят анализ вредоносного ПО, исследование уязвимостей и реагирование на инциденты. Кандидатами на этот уровень могут быть группы безопасности, операторы критически важной инфраструктуры, разработчики проектов с открытым исходным кодом и исследователи с подтвержденным опытом выявления и раскрытия уязвимостей.
Red Team
Второй уровень, известный как Red Team, расширяет возможности, позволяя проводить авторизованные тесты на проникновение и упражнения по командно-штабным учениям (red teaming). Для участия на этом уровне требуется статус организации.
Третий уровень, Specialized, будет иметь наименьшие ограничения и предназначен для ограниченной группы организаций, уполномоченных тестировать системы, считающиеся жизненно важными для безопасности, такие как электросети, авиационные системы и инфраструктура, используемая для банковских переводов между учреждениями.
Все члены каждой категории проходят строгие процессы проверки. Anthropic сообщает, что проводит эту оценку в сотрудничестве с правительством США.
Результаты, достигнутые в рамках Project Glasswing, послужили основанием для расширения программы. В период с апреля по июль партнеры инициативы выявили минимум 129 тысяч подтвержденных уязвимостей. Кроме того, сама Anthropic обнаружила еще 5,5 тысяч в ходе сканирования открытого кода, проведенного с апреля по октябрь, что в сумме составило более 134 тысяч проверенных уязвимостей. Из них более 33 тысяч уже были классифицированы как серьезные или критические.
Компания подчеркивает, что фактический объем уязвимостей может быть значительно выше, поскольку данные Glasswing зависят от информации, предоставленной ограниченным числом партнеров.
Это решение также демонстрирует центральную дилемму в использовании передовых моделей ИИ в кибербезопасности. Те же возможности, которые позволяют системе найти уязвимость и помочь специалисту в ее исправлении, могут быть использованы для эксплуатации этой уязвимости.
Anthropic уже сталкивалась с подобными опасениями при выпуске Claude Mythos в апреле. Тогда существовали опасения, что системы ИИ могут взломать программное обеспечение до того, как будут исправлены его уязвимости.
По этой причине компания не просто отключает все защиты своих моделей для любого пользователя. Доступ с меньшими ограничениями будет предоставлен только тем организациям и специалистам, которые прошли процесс проверки, при этом они будут находиться под различными уровнями контроля. Цель состоит в том, чтобы предоставить более продвинутые возможности тем, кто активно работает над поиском и устранением уязвимостей до того, как их используют преступники.
