
Anthropic deschide accesul la modele AI avansate pentru echipele de securitate cibernetică
Compania Anthropic a lansat un program pentru profesioniști și organizații de securitate cibernetică, denumit Cyber Verification Program, care permite accesul controlat la modele de inteligență artificială de ultimă generație. Inițiativa vizează sprijinirea activităților de identificare și verificare a vulnerabilităților în mediul digital, într-un cadru sigur și restricționat.
Structura și nivelurile programului
Cyber Verification Program include trei niveluri de acces, în funcție de tipul de activitate autorizată. Primul, Defense Access, este dedicat analizelor defensive precum răspunsul la incidente, analiza malware-ului, reverse engineering și verificarea vulnerabilităților.
Al doilea, Red Team Access, permite efectuarea de teste de penetrare și operațiuni de tip red team, dar numai cu autorizare explicită. Nivelul cel mai restrictiv, Specialized Access, este rezervat unui număr limitat de organizații verificate, fiind destinat testării sistemelor de siguranță ale modelelor AI.
Participanții pot accesa modelele Claude Opus 5.5, Claude Sonnet 5.5, Claude Mythos 5.1 și alte modele ce vor fi lansate ulterior în cadrul programului.
Identificarea vulnerabilităților și extinderea pe termen lung
Prin activitatea programului, compania a raportat identificarea a cel puțin 129.000 de vulnerabilități verificate între aprilie și iulie 2026. În plus, până în octombrie, au fost descoperite 5.500 de vulnerabilități în proiecte open-source analizate de Project Glasswing.
Din totalul vulnerabilităților, peste 33.000 au fost evaluate ca critice sau cu severitate ridicată. Autorii precizează că aceste cifre nu reprezintă o evaluare completă a tuturor vulnerabilităților, deoarece datele provin doar de la o parte dintre partenerii programului.
Estimările indică faptul că numărul real de vulnerabilități ar putea fi de cel puțin cinci ori mai mare, iar aceste cifre evidențiază potențialul modelelor AI pentru activități de securitate cibernetică. Existența vulnerabilităților descoperite nu înseamnă însă automat că acestea pot fi exploatate în mediile reale de atac.
Eficiența măsurilor de protecție în diferite niveluri
Anthropic a evaluat funcționarea măsurilor de protecție ale modelelor în trei scenarii de testare, în cadrul CyScenarioBench. În cazul modelului Claude Opus 5.5 cu Defense Access, acesta a blocat 46 din 50 de sarcini testate.
În același test, versiunea cu Red Team Access nu a blocat niciuna dintre cele 50 de sarcini, finalizând 34 dintre ele. În absența programului și a măsurilor de protecție, toate sarcinile au fost rezolvate, fără restricții.
Rezultatele au demonstrat că, prin controlul asupra nivelului de acces, compania poate oferi specialiștilor capacități AI avansate, menținând controlul asupra utilizării.
Diferențe între vulnerabilități și exploatarea lor reală
Analizele indică că doar o minoritate dintre vulnerabilitățile descoperite devin subiectul tentativelor de exploatare în practică. O evaluare a cercetătorului Patrick Garrity a arătat că doar 0,67% dintre cele 300 vulnerabilități analizate au fost exploatate în mediul real.
Dintre vulnerabilitățile critice și cu severitate ridicată, cele identificate ca fiind exploatabile au fost cele din Ghost CMS și Rejetto HTTP File Server, corespunzând CVE-2026-26980 și CVE-2026-61500.
Rezultatele subliniază diferența între vulnerabilitățile descoperite și cele exploatate efectiv, evidențiind că nu toate problemele pot fi folosite pentru atacuri reale, chiar dacă au fost identificate în faza de cercetare.
