Când un model AI poate fi retras peste noapte, dependența de un singur furnizor devine un risc de business.
Guvernul american invocă motive de securitate națională. Mai exact, autoritățile cred că a fost descoperită o metodă de a ocoli mecanismele de siguranță ale modelului Fable 5 (ceea ce se numește „jailbreak"). Metoda ar fi permis modelului să analizeze cod sursă și să identifice vulnerabilități de securitate.
Anthropic contestă gravitatea situației. Compania spune că a revizuit demonstrația și că vulnerabilitățile identificate erau deja cunoscute, relativ simple și accesibile prin alte modele AI disponibile public, inclusiv GPT-5.5 de la OpenAI. Mai mult, Anthropic subliniază că nu s-a demonstrat niciun jailbreak universal (adică o metodă care ar putea ocoli complet și pe scară largă protecțiile modelului).
Înainte de lansarea Fable 5, Anthropic a lucrat cu mai mulți parteneri pentru testarea securității modelului: guvernul SUA, agenția britanică de siguranță AI (UK AISI), organizații terțe private și echipe interne. Testarea a durat mii de ore.
Compania a implementat o strategie numită „apărare în profunzime" (defense in depth): mecanismele de protecție sunt proiectate astfel încât orice încercare de bypass să fie fie foarte limitată ca efect, fie foarte costisitoare de produs. În plus, Anthropic a introdus o politică de retenție a datelor de 30 de zile pentru modelele din clasa Mythos, tocmai pentru a putea detecta și mitiga rapid orice tentativă de jailbreak.
Anthropic afirmă că aceste protecții sunt cele mai puternice implementate vreodată pe un model comercial.
E prima dată când un guvern retrage un model AI comercial de la sute de milioane de utilizatori pe baza unui singur raport de securitate. Decizia a fost luată fără un proces statutar transparent, fără audiere publică și fără detalii concrete comunicate companiei.
Anthropic respectă directiva, dar a criticat public procesul, argumentând că dacă un jailbreak limitat ar fi suficient pentru a retrage un model, niciun furnizor de AI din lume nu ar mai putea lansa produse noi.
Pentru companiile care folosesc inteligență artificială, sunt câteva lecții practice:
Anthropic a promis că va publica mai multe detalii în următoarele 24 de ore. Celelalte modele ale companiei (inclusiv cele din gamele Opus, Sonnet și Haiku) nu sunt afectate.
Situația e încă în desfășurare. Merită urmărit ce fac alte guverne, cum reacționează Comisia Europeană (care lucrează la implementarea AI Act) și ce impact are asta asupra companiilor care și-au construit procese pe aceste modele.
Dacă folosești AI în compania ta și nu ai încă o strategie de guvernanță, acum e momentul.
Înseamnă că un instrument pe care l-ai integrat în procese poate deveni indisponibil peste noapte, din motive în afara controlului tău. Dacă fluxuri de lucru, produse sau decizii depind de un singur model, suspendarea lui poate afecta continuitatea operațională. De aceea merită evaluat din timp cât de dependentă este compania de un singur furnizor și ce alternative are pregătite.
Este riscul ca afacerea ta să fie expusă atunci când te bazezi pe un singur model sau furnizor de AI, fără alternative. Dacă acel furnizor ridică prețurile, schimbă termenii, are o pană sau modelul este retras de o autoritate, nu ai un plan B imediat. O abordare prudentă presupune să poți, în principiu, comuta între furnizori și să nu legi procese critice de un singur model.
Guvernanța AI înseamnă reguli interne clare despre ce instrumente AI sunt folosite, pentru ce scopuri, cu ce date și cu ce responsabili. Pe măsură ce reglementarea crește — de exemplu prin AI Act-ul european — companiile fără o politică internă de utilizare a AI riscă să fie prinse nepregătite. O politică de guvernanță ajută și la gestionarea incidentelor și a deciziilor externe neașteptate, precum o suspendare.
Câteva direcții utile: evită dependența de un singur furnizor, documentează ce procese folosesc AI și cât de critice sunt, tratează securitatea AI ca subiect de conducere, nu doar de IT, și pregătește planuri de continuitate pentru situația în care un model devine indisponibil. Acestea sunt măsuri prudente, orientate spre viitor, nu garanții — situația de reglementare se poate schimba rapid.
Te ajutăm să pui ordine în utilizarea AI înainte ca un incident sau o decizie externă să o facă în locul tău.