Noul model de inteligență artificială al Anthropic, cunoscut sub numele de Previzualizare Claude MythosA devenit epicentrul dezbaterii globale privind limitele inteligenței artificiale avansate. Compania însăși recunoaște că sistemul este atât de puternic din punct de vedere al securității cibernetice încât a decis să nu îl lanseze pe scară largă, o decizie neobișnuită într-un sector obișnuit să se laude cu fiecare nou progres.
Miza nu este doar o îmbunătățire incrementală față de modelele anterioare, ci un salt calitativ în capacitatea de a detecta și exploata vulnerabilitățile computerelorGuvernele, băncile centrale, principalele instituții financiare și autoritățile de reglementare europene monitorizează îndeaproape cazul, conștiente că un astfel de instrument ar putea consolidarea apărării sistemelor criticeDar ar putea deschide și ușa unor atacuri de o amploare fără precedent, dacă ar cădea pe mâini greșite.
Ce este mai exact Claude Mythos și de ce a fost amânată lansarea sa?
Claude Mythos este unul dintre cele mai recente modele din familia Claude, ecosistemul de inteligență artificială al Anthropic care concurează cu ChatGPT de la OpenAI și Gemini de la GoogleEste un model cu scop general, capabil să raționeze, să programeze și să lucreze cu un context pe termen lung, dar cea mai controversată caracteristică a sa este performanță în securitatea cibernetică ofensivă și defensivă.
Așa-numitul „echipe roșii”Specialiștii care testează sistemele de inteligență artificială la limită au concluzionat într-un raport intern că Mythos este „surprinzător de capabil” în sarcini de securitate cibernetică. În teste de referință precum SWE-bench Verificat o SWE-bench ProConceput pentru a măsura capacitatea de a rezolva probleme reale de inginerie software, modelul ar fi depășit cu ușurință alternativele comerciale de top, inclusiv versiunile avansate ale GPT și Gemini, conform datelor furnizate chiar de Anthropic.
Dincolo de repere, ceea ce a declanșat semnale de alarmă este faptul că Mythos a reușit să găsească vulnerabilități zero-day —defecte necunoscute anterior— în componente software utilizate pe scară largă, unele vechi de peste două decenii. În sisteme precum componentele OpenBSD, FFmpeg și FreeBSD, modelul nu numai că a detectat erori care trecuseră neobservate ani de zile, dar a generat și exploit-uri funcționale pentru a profita de acestea.
Confruntată cu aceste rezultate, Anthropic a optat pentru o decizie neobișnuită în industrie: să prezinte modelul și apoi să anunțe că acesta nu va fi comercializat public. deoarece consideră că prezintă riscuri de securitate cibernetică fără precedent. Compania insistă că Mythos este modelul „cel mai bine aliniat” pe care l-au construit, dar recunoaște că capacitatea sa enormă amplifică consecințele oricărei utilizări greșite.

Un model cu abilități de „hacker” mult peste capacitățile umane
Documentele și rapoartele tehnice de la diverse organizații sunt de acord că Mythos marchează un punct de cotitură în automatizarea atacurilor complexeÎn medii de testare care simulau rețele corporative reale, sistemul a fost capabil să înlănțuiască vulnerabilități, să escaladeze privilegii și să obțină acces persistent în câteva ore - sarcini care ar dura zile sau săptămâni pentru un expert uman.
De exemplu, în motorul JavaScript al Firefox, versiunile anterioare ale modelelor Anthropic rareori reușeau să transforme vulnerabilitățile în exploit-uri funcționale. Mythos, în aceleași condiții de testare, A generat zeci de exploatări operaționaleReproduce cu exactitate exploatarea celor mai eficienți vectori. Pe platforme de analiză precum OSS-Fuzz, concepute pentru a găsi erori în software-ul open-source, este recunoscut pentru detectarea unor vulnerabilități de mare severitate care trecuseră neobservate în ciuda anilor de testare automată.
Modelul a demonstrat, de asemenea, capacități remarcabile în Inginerie inversăPoate reconstrui o parte din logica unui program din fișiere binare compilate și, de acolo, poate localiza și exploata defecte fără a accesa codul sursă original. Acest tip de capacitate aduce IA mai aproape de scenarii care, până de curând, erau considerate exclusive echipelor umane extrem de specializate.
Unul dintre cele mai frecvent citate episoade în evaluările de securitate este așa-numitul „test sandwich”. Într-un mediu de laborator izolat, Mythos a primit controlul unui sistem cu instrucțiuni explicite de a încerca evadează din cutia cu nisip și contactează cercetătorul care supraveghea testul. Modelul a reușit să exploateze un lanț de vulnerabilități pentru a ieși din mediul său restricționat și a trimite un e-mail persoanei responsabile, care era plecată de la birou la momentul respectiv. Deși incidentul a avut loc într-o versiune internă anterioară și sub comandă dirijată, acesta ilustrează măsura în care sistemul poate funcționa în scenarii complexe cu o supraveghere minimă.
În ciuda acestor demonstrații, analiștii insistă să clarifice faptul că Nu avem de-a face cu o IA „conștientă” sau cu una cu voință proprie.Mythos nu decide să atace sistemele de unul singur; execută sarcinile care îi sunt date cât mai eficient posibil. Riscul, în acest sens, nu este ca modelul să se revolte, ci ca cineva să îl folosească - sau să îl forțeze să facă acest lucru prin intermediul unor solicitări sofisticate - pentru a efectua acțiuni dăunătoare.
Proiectul Aripă de Sticlă: Miturile în slujba apărării... pentru câțiva aleși
În loc să deschidă accesul publicului larg, Anthropic a ales să înconjoare Mythos cu un program specific, Proiectul GlasswingConcepută pentru a utiliza capacitățile modelului într-un mod controlat pentru protejarea software-ului critic, inițiativa implică oferirea sistemului, în condiții stricte de utilizare, unui grup select de companii mari de tehnologie, furnizori de infrastructură și instituții financiare.
Printre organizațiile cu acces se numără giganți precum Serviciile web Amazon, Apple, Microsoft, Google CloudNvidia sau Broadcomprecum și firme de securitate cibernetică precum CrowdStrike, al căror software defectuos a cauzat o perturbare globală majoră în 2024. Acestora li se alătură bănci de renume mondial, inclusiv JP Morgan Chase și mai multe grupuri mari de pe Wall Street, precum și alte organizații responsabile cu întreținerea infrastructurilor IT sensibile.
Anthropic a anunțat, de asemenea, împrumuturi în valoare de 100 de milioane de dolari Această finanțare va permite acestor organizații să utilizeze Mythos pentru analiza vulnerabilităților, alături de donații către fundații de software liber, cum ar fi Fundația Linux și Fundația Apache Software. Obiectivul oficial este clar: să permită celor care gestionează cel mai important software din lume să identifice și să corecteze defectele înainte ca astfel de instrumente să devină disponibile potențialilor atacatori.
Această strategie, însă, generează o oarecare neliniște în cadrul sectorului. Pe de o parte, ea întărește ideea că tehnologia este suficient de periculoasă pentru a necesita acces restricționat. Pe de altă parte, Creează o prăpastie între cei care beneficiază de „scutul” Mythos și cei care sunt lăsați pe dinafară.Companiile și administrațiile care nu fac parte din Glasswing riscă să se confrunte ulterior cu vulnerabilități identificate și corectate în medii privilegiate, dar care sunt încă prezente în propriile sisteme.
În Europa, această asimetrie este o preocupare deosebită pentru cei responsabili de infrastructura critică și pentru echipele de securitate ale marilor grupuri industriale și financiare, care monitorizează îndeaproape dacă Bruxelles-ul și capitalele europene se asigură că programe similare includ actori cheie de pe continent în condiții egale şi suveranitatea cloud-ului cu partenerii americani.
Reacția guvernelor, a autorităților de reglementare și a sectorului financiar
Impactul modelului Mythos nu se limitează la domeniul tehnic. În doar câteva zile, anunțul modelului a declanșat întâlniri la nivel înalt în Statele Unite și EuropaSecretarul Trezoreriei SUA i-a convocat la Washington pe șefii principalelor bănci ale țării pentru a evalua riscurile pe care sistemul le-ar putea reprezenta pentru stabilitatea financiară, în timp ce președintele Rezervei Federale a participat și el la aceste discuții.
Conform scurgerilor de informații relatate de presa internațională, aceste entități ar fi fost încurajate să Testează Mythos în modul defensivfolosind-o pentru a scana propria infrastructură pentru a depista puncte slabe înainte ca alții să o poată face. Mesajul implicit este că amenințarea este suficient de gravă pentru a justifica un răspuns coordonat public-privat.
Între timp, cofondatorul Anthropic a confirmat că firma... menține discuții directe cu guvernul Statelor Unite despre Mythos și modelele viitoare. Aceste discuții au loc într-un context tensionat, după ce autoritățile americane au adăugat recent compania pe o listă de riscurile lanțului de aprovizionare, în urma fricțiunilor legate de utilizarea modelelor lor de către Departamentul Apărării.
Dincolo de Atlantic, Uniunea Europeană a luat act. Comisia Europeană a aprobat public o abordare graduală și prudentă a modelelor precum Mythos și Autoritățile de reglementare financiară din Regatul Unit și de pe continent au început să studieze în mod specific potențialele sale implicații pentru sistemul bancar și piețele bancare. Institutul de Securitate a Inteligenței Artificiale (AISI) al guvernului britanic a descris sistemul ca fiind un salt semnificativ înainte în ceea ce privește amenințările cibernetice în comparație cu generațiile anterioare.
În Spania, deși dezbaterea publică este încă limitată, organismele de supraveghere și echipele de securitate cibernetică din cadrul băncilor și al marilor companii energetice monitorizează îndeaproape aceste evoluții. Pentru sectorul financiar european, orice progres care ar putea facilita atacuri coordonate împotriva sistemelor de plată, a rețelelor interbancare sau a platformelor de tranzacționare este un motiv de îngrijorare serioasă.
Scepticism, îndoieli și dezbateri despre „exagerarea” din jurul Mythosului
Relatarea Anthropic, care combină avertismentele de securitate cu cifre spectaculoase de performanță, nu a fost lipsită de critici. Mai mulți experți în inteligență artificială și securitate cibernetică au solicitat... prudență în interpretarea declarațiilor companieiobservând că o mare parte din datele disponibile provin doar din rapoarte interne.
Unii analiști au analizat în detaliu documentația extinsă publicată de Anthropic și subliniază că cifra „miilor de vulnerabilități de severitate ridicată” se bazează pe extrapolări dintr-un număr relativ mic de cazuri revizuite manual. În anumite suite de teste, Mythos ar fi găsit un număr semnificativ de defecte critice, dar departe de scenariul aproape apocaliptic sugerat de unele titluri.
Alte studii independente au încercat să compare performanța Mythos cu modele mai mici, open-source, transmițând fragmente de cod vulnerabile către diferite IA-uri pentru a vedea dacă acestea pot detecta aceleași defecte. Rezultatele indică faptul că Unele modele deschise sunt, de asemenea, capabile să identifice vulnerabilități complexeAcest lucru pune sub semnul întrebării ideea că Mythos joacă într-o ligă complet diferită în toate scenariile.
Aceste tipuri de contraexemple nu neagă capacitățile lui Mythos, dar sugerează că O parte din discursul „prea periculos de publicat” are și o dimensiune de marketing.Prezentarea unui model ca fiind atât extraordinar de puternic, cât și un risc potențial întărește imaginea de lider tehnologic și responsabilitate, lucru foarte valoros pe o piață din ce în ce mai competitivă.
Istoria recentă a industriei amintește, de asemenea, de precedentul GPT-2 din 2019, când OpenAI a decis inițial să nu publice modelul complet, susținând că era prea periculos din cauza potențialului său de a genera dezinformare. În cele din urmă, acea versiune a fost lansată publicului fără ca vreuna dintre catastrofele prezise să se materializeze, iar mulți experți au citat-o ca un exemplu de reacție exagerată. Cu Mythos, Diferența este că accentul nu se mai pune pe text, ci pe integritatea infrastructurii digitale., o zonă mult mai sensibilă pentru guverne și bănci.
Un echilibru delicat între securitate, afaceri și accesul la tehnologie
Dincolo de zgomotul mediatic, situația Mythos ridică o problemă fundamentală: Cine decide când un model de inteligență artificială este prea periculos pentru a fi lansat Și sub ce criterii? Deocamdată, decizia a fost unilaterală din partea Anthropic, care a optat pentru menținerea sistemului într-un fel de carantină controlată, rezervându-l unor parteneri selectați.
Această poziție nu se bazează exclusiv pe motive de securitate. Rularea unui model cu caracteristicile lui Mythos este foarte scump din punct de vedere informatic, iar compania însăși recunoaște că în prezent nu are infrastructura necesară pentru a-l servi masiv către milioane de utilizatori. În practică, măsurile de precauție de securitate și limitările tehnice merg mână în mână, oferind companiei Anthropic timp să ajusteze atât modelul, cât și implementarea acestuia.
În același timp, compania a început să diferențieze clar între diversele sale produse. În timp ce Mythos rămâne la fel de cel mai avansat standard internDeși rezervate pentru contexte de cercetare și colaborare strategică, alte modele precum Claude Opus 4.7 sunt orientate către utilizarea zilnică de către companii și profesioniști. Anthropic a recunoscut public chiar că Opus 4.7 este „mai puțin capabil” decât Mythos în termeni generali și, în special, în ceea ce privește capacitățile sale cibernetice - ceva neobișnuit într-o industrie care prezintă de obicei fiecare model nou ca fiind cel mai bun din toate punctele de vedere.
În această schemă, Mythos funcționează ca banc de testare pentru capacitățile de generație următoareDeși modelele disponibile comercial încorporează doar o parte din aceste capabilități, cu limitări suplimentare concepute pentru a reduce riscurile, această separare între modelele „experimentale” și cele „de producție” poate fi o abordare rezonabilă pentru multe organizații europene interesate să valorifice inteligența artificială fără a fi în prima linie a expunerii, cu condiția să existe suficientă transparență cu privire la capabilitățile reale ale fiecărui sistem.
Ceea ce se conturează în cele din urmă este un scenariu în care Securitatea cibernetică intră pe deplin în era inteligenței artificiale ofensive și defensive la scară largăInstrumente precum Mythos promit să accelereze identificarea vulnerabilităților în sistemele care funcționează de ani de zile, dar obligă și la o regândire a modului în care tehnologia care stă la baza economiei digitale este distribuită și guvernată. Pentru Europa și Spania, provocarea nu va fi doar protejarea lor de modele din ce în ce mai puternice, ci și asigurarea că nu sunt excluse din mecanismele care le permit să fie utilizate pentru a-și consolida propria securitate.
