Tehnologie

Claude a pătruns în sistemele OpenAI în câteva zile, iar întrebările grele sunt pentru Anthropic

Adrian Kessler
Adaugă-ne în Google

O echipă mică a îndreptat cel mai nou model al Anthropic spre ușa din față a OpenAI și a intrat. Versiunea pe care o citesc cei mai mulți – niște necunoscuți isteți care îl fac de rușine pe creatorul ChatGPT – greșește subiectul. Spărgerea nu a depins de ceva ce OpenAI a uitat să corecteze. A depins de momentul în care Anthropic a lansat un Claude mai capabil. Asta e partea care merită reținută: o sarcină care se blocase de zile s-a rezolvat de îndată ce un nou model emblematic a intrat în funcțiune.

Oamenii implicați nu erau infractori. Cercetătorii de la startup-ul de securitate Hacktron au lucrat în cadrul propriului program de recompense pentru bug-uri al OpenAI, au îmbinat câteva vulnerabilități web modeste, au ajuns la conturile angajaților OpenAI și au pătruns până la un depozit intern de cod – apoi s-au oprit, au raportat ce au găsit și au primit o recompensă modestă. Au lăsat în urmă un marker inofensiv ca dovadă și nu au mers mai departe. Citită ca infracțiune, este un non-eveniment. Citită ca test de capacitate, este o rachetă de semnalizare.

Iată mecanismul pe care relatările din presă l-au ocolit. Echipa a rulat mai întâi sarcina pe Claude Opus 4.8, versiunea ajustată pentru lucrări de securitate, iar aceasta s-a blocat de-a lungul mai multor sesiuni. Apoi Anthropic a lansat Opus 5. „Opus 4.8 s-a chinuit în mai multe sesiuni să producă un exploit funcțional”, au scris cei de la Hacktron. „La câteva ore după lansarea lui Opus 5, i-am dat aceeași problemă și a reușit.” VentureBeat a relatat că noul model a scris un exploit funcțional pentru o țintă dificilă pe un cip în câteva ore. Nimic nu s-a schimbat în privința apărării OpenAI în acea fereastră de timp. Modelul s-a schimbat.

Exact acesta este tipul de salt – un salt în ceea ce poate face un utilizator obișnuit cu un abonament standard – pe care propria mașinărie de siguranță a Anthropic este construită să îl detecteze și să îl rețină. Compania își păstrează cel mai capabil model cibernetic, Mythos, în spatele controalelor de export și al unei liste scurte de apărători verificați, și îl numește cel mai puternic model de securitate pe care l-a construit. Nimic din toate astea nu a contat aici. Nivelul disponibil public a fost suficient. După cum a spus directorul general al Gray Swan, Matt Fredrikson, pentru TechCrunch, „cu 200 de dolari pe lună, oricine poate folosi aceste instrumente și poate sparge o companie precum OpenAI.”

Aici se așază responsabilitatea asupra Anthropic, nu asupra rivalului său. Anthropic și-a construit întreaga identitate pe prudență – directorul său general, Dario Amodei, vorbește deschis despre „pericolele reale” ale tehnologiei și a presat industria să încetinească. Un model lansat public care reduce în mod măsurabil ștacheta pentru spargerea unui laborator concurent este o contrapondere incomodă pentru acest mesaj. Întrebată să dea socoteală, compania nu a spus nimic; CBS News a relatat că Anthropic nu a răspuns unei solicitări de comentariu. OpenAI, la rândul său, a mulțumit cercetătorilor, a restrâns permisiunile pe care atacatorii le abuzaseră și a revocat sesiunile afectate.

Detaliile sunt aproape banale. Calea de intrare a fost o bibliotecă de procesare a imaginilor învechită, inclusă în software-ul Discourse care rulează forumul comunității OpenAI; o a doua scăpare în modul în care erau definite tokenurile de autentificare a permis cercetătorilor să folosească o sesiune compromisă pentru a accesa conturile angajaților pentru ChatGPT și Codex, și mai departe, codul privat. Întregul lanț, de la primul punct de sprijin până la accesul la depozit, a durat mai puțin de trei zile. OpenAI a plătit 6.500 de dolari. Echipa spune că a cheltuit mai puțin de 3.000 de dolari în timp Claude pe tot efortul – două luni de muncă, în mare parte umană, comprimate la final într-o mașină care nu mai avea nevoie de un specialist.

Resursa rară care obișnuia să protejeze o țintă nu a fost niciodată patch-ul. A fost expertul care putea găsi vulnerabilitățile, le îmbina și vedea calea de urmat – și lunile pe care asta le lua. Acea expertiză tocmai s-a ieftinit. De data asta, echipa care a ajuns la codul OpenAI a depus un raport și a luat recompensa. Următoarea care va trece aceeași ștachetă, cu același abonament, nu are nicio obligație să facă la fel.

Etichete: , , , , ,

Adaugă-ne în Google

Discuție

Există 0 comentarii.