К содержанию
Ақылды. Пайдалы. Кейде байыпсыз.
Anthropic кибер-ЖИ-ге қолжетімділікті үш деңгейге бөлді

Anthropic кибер-ЖИ-ге қолжетімділікті үш деңгейге бөлді

Серіктестер компания модельдерінің көмегімен 129 мың расталған осалдық тапқан, оның 33 мыңнан астамы сыни немесе жоғары қауіпті.

Иллюстрация: Anthropic

Anthropic 6 қазанда Cyber Verification Program бағдарламасын кеңейтті. Ол арқылы тексеруден өткен киберқауіпсіздік мамандары қорғаныс шектеулері әлсіретілген Claude модельдерін алады. Компания бағдарламаны Project Glasswing жобасымен біріктіріп, қолжетімділікті үш деңгейге бөлді. Ең төменгісі өз жүйесін қорғауға арналса, ең жоғарғысы энергожүйе мен банк инфрақұрылымын тексеруге мүмкіндік береді.

Claude-тың әдеттегі нұсқалары бұзуға қатысты көп тапсырманы орындамайды. Бұл шабуылдаушылардан қорғайды, алайда қорғаныс үшін осалдық іздейтін мамандарға кедергі келтіреді. Жаңа схема бұл шектеулерді кімге және қаншалықты алып тастауға болатынын анықтайды.

Үш деңгей

  • Defense Access — қорғаныс жұмысына арналған: шабуылдарды бақылау, инциденттерге әрекет ету, зиянды бағдарламаларды талдау және осалдықтарды зерттеу. Өтінімді компаниялардың қауіпсіздік қызметтері, ҮЕҰ, университеттер, мемлекеттік органдар, сыни инфрақұрылым операторлары, шағын ақпараттық қауіпсіздік фирмалары, ашық код авторлары және осалдықтарды ашқан тарихы бар жеке зерттеушілер бере алады. Өтінім бірнеше күнде қаралады.
  • Red Team Access — рұқсат етілген енуге тестілеу мен шабуылды имитациялауды қосады. Бұл деңгей тек ұйымдарға ашық: ішкі және мемлекеттік «қызыл командаларға», пентест компанияларына. Тексеру бірнеше аптаға созылады, ал осы уақытта өтініш беруші Defense Access алады.
  • Specialized Access — шектеуі ең аз деңгей. Ол аса маңызды жүйелерді тексеретін ұйымдарға керек: авиациялық бағдарламалық жасақтама, энергожүйелер, телеком желілері, банкаралық инфрақұрылым және мемлекеттік басқару желілері. Қолжетімділік АҚШ үкіметімен келісіледі.

Қатысушылар Claude Opus 5.5, Claude Sonnet 5.5, Claude Mythos 5.1 және болашақ модельдерді алады. Project Glasswing мүшелері ең жоғары деңгейге автоматты түрде көшеді.

Тест не көрсетті

Anthropic деңгейлерді 50 сценарийден тұратын өзінің CyScenarioBench жинағында тексерді. Defense Access деңгейінде қорғаныс 50 тапсырманың 46-сын бұғаттады. Red Team деңгейінде бұғаттау болмады, ал Claude Opus 5.5 34 тапсырманы орындады. Дегенмен физикалық зиян немесе жаппай іркіліс тудыруы мүмкін әрекеттерге, мысалы бопсалаушы бағдарламаны іске қосуға, шектеу нақты уақытта сақталады.

Компания Project Glasswing нәтижелерін де жариялады. 2026 жылдың сәуірі мен шілдесі аралығында серіктестер оның модельдері арқылы 129 мың расталған осалдық тапты. Оның 33 мыңнан астамы сыни немесе жоғары қауіпті. Anthropic өзі сәуірден қазанға дейін ашық кодтан 5500 расталған осалдық анықтады. Компанияның бағалауынша, нақты әсер кемінде бес есе жоғары, себебі серіктестер табылған осалдықтар туралы толық хабарламайды.

Бағдарлама Claude Platform, Google Cloud Vertex AI және Microsoft Foundry арқылы жұмыс істейді, Amazon Bedrock-та қолжетімділік шектеулі. Қатысушылар деректерді сақтауға келісуі керек, сонда компания теріс пайдалануды бақылай алады. Деректерді сақтамайтын нұсқа осы күзде Enterprise Frontier Safeguards іске қосылғанда пайда болады.

Шешім ЖИ шабуылдаушылардың қолына түседі деген алаңдаушылық күшейген кезде шықты. Компанияның өзі туралы толығырақ — Rizz-тегі Anthropic досьесінде.

Дереккөздер: Anthropic — Cyber Verification Program бағдарламасын кеңейту