К содержанию
Умно. Полезно. Иногда несерьёзно.
Anthropic разделила доступ к кибер-ИИ на три уровня

Anthropic разделила доступ к кибер-ИИ на три уровня

Партнёры компании уже нашли с помощью её моделей 129 тысяч подтверждённых уязвимостей, из них больше 33 тысяч критических или высокой опасности.

Иллюстрация: Anthropic

Anthropic 6 октября расширила Cyber Verification Program. Через эту программу проверенные специалисты по кибербезопасности получают модели Claude с ослабленными защитными ограничениями. Компания объединила её с Project Glasswing и разделила доступ на три уровня, от защиты собственных систем до тестов энергосетей и банковской инфраструктуры.

Обычные версии Claude отказываются выполнять многие задачи из области взлома. Это защищает от злоумышленников, но мешает тем, кто ищет дыры ради защиты. Новая схема решает, кому и насколько можно снять эти ограничения.

Три уровня

  • Defense Access — для защитной работы: мониторинга атак, реагирования на инциденты, разбора вредоносных программ и анализа уязвимостей. Подать заявку могут службы безопасности компаний, НКО, университеты, госорганы, операторы критической инфраструктуры, небольшие ИБ-фирмы, авторы открытого кода и отдельные исследователи с историей раскрытия уязвимостей. Заявку рассматривают несколько дней.
  • Red Team Access — добавляет разрешённые тесты на проникновение и имитацию атак. Уровень доступен только организациям: внутренним и государственным «красным командам» и пентест-компаниям. Проверка занимает несколько недель, и на это время заявитель получает Defense Access.
  • Specialized Access — меньше всего ограничений. Он нужен проверенным организациям, которые тестируют критически важные системы: авиационное ПО, энергосети, телеком-сети, межбанковскую инфраструктуру и сети госуправления. Доступ согласуют с правительством США.

Участники получают Claude Opus 5.5, Claude Sonnet 5.5, Claude Mythos 5.1 и будущие модели. Члены Project Glasswing переходят на высший уровень автоматически.

Что показали тесты

Anthropic проверила уровни на собственном наборе задач CyScenarioBench из 50 сценариев. На уровне Defense Access защита заблокировала 46 задач из 50. На уровне Red Team блокировок не было, и Claude Opus 5.5 выполнил 34 задачи. При этом ограничения на действия, которые могут причинить физический вред или массовый сбой, например запуск вымогателя, остаются в реальном времени.

Компания также раскрыла результаты Project Glasswing. С апреля по июль 2026 года партнёры нашли с помощью её моделей 129 тысяч подтверждённых уязвимостей, больше 33 тысяч из них критические или высокой опасности. Сама Anthropic с апреля по октябрь нашла в открытом коде 5500 подтверждённых уязвимостей. Реальный эффект, по оценке компании, как минимум впятеро выше, потому что партнёры сообщают о находках не полностью.

Программа работает через Claude Platform, Google Cloud Vertex AI и Microsoft Foundry, на Amazon Bedrock доступ ограничен. Участники должны соглашаться на хранение данных, чтобы компания могла отслеживать злоупотребления. Вариант без хранения данных появится с запуском Enterprise Frontier Safeguards этой осенью.

Решение вышло на фоне тревоги из-за ИИ в руках атакующих. В Южной Корее власти проверяют, не помог ли ИИ-инструмент взломать четыре банка. Подробнее о самой компании — в досье Anthropic на Rizz.

Источники: Anthropic — расширение Cyber Verification Program