Tehnologie

Anthropic: Claude conduce 26% din propria cercetare AI — acum nouă luni era zero

Adrian Kessler
Adaugă-ne în Google

Una din patru sarcini de cercetare AI de la Anthropic este acum condusă de Claude. Nu atribuită lui Claude ca asistent, nu revizuită de Claude ulterior — ci pornită de la un prompt de nivel înalt și finalizată integral, cu un om care verifică rezultatul la final. Acum nouă luni, procentul era sub unu la sută.

Anthropic trage o linie clară între două lucruri. Când Claude conduce o sarcină, gestionează cea mai mare parte a muncii în mod independent; un supervizor examinează rezultatul, nu ghidează fiecare pas. Aceasta este o categorie diferită de cea a celor nouăzeci la sută din totalul cercetării și dezvoltării Anthropic în care Claude acționează ca un colaborator — un om dirijează, iar Claude se ocupă de părți specifice. „Conduce” este clasificarea mai dificilă. Aceasta reprezintă acum 26 la sută din toată cercetarea AI pe care compania o realizează, ponderată cu timpul pe care cercetătorii l-ar petrece altfel pentru aceste sarcini.

Scara este concretă. Aproximativ 30.000 de agenți Claude rulează simultan pe platformele interne ale Anthropic, desfășurând activități de instruire a modelelor, evaluări, cercetare în interpretabilitate și analize de siguranță. În august, acești agenți au luat în total peste un miliard de decizii. Sistemele de monitorizare în timp real ale Anthropic au blocat 0,002 la sută dintre ele — aproximativ una din fiecare 47.000 de acțiuni — înainte de execuție. O etapă offline a semnalat apoi aproximativ 100.000 de transcrieri săptămânal pentru revizuire, escaladând aproximativ 50 către un om.

Siguranța are un buget măsurabil în cadrul acestui sistem. Într-o singură săptămână din iulie, munca dedicată menținerii siguranței agenților a consumat șase la sută din tot calculul de cercetare și dezvoltare AI și douăsprezece la sută din calculul pe care cercetarea și dezvoltarea condusă de AI îl utiliza. Anthropic spune că a clasificat conservator, excluzând clasificatorii de siguranță dedicați din număr, ceea ce sugerează că proporția reală este și mai mare.

O problemă epistemologică se află în centrul acestui demers. Contribuția lui Claude la cercetarea Anthropic este evaluată parțial chiar de Claude. Un model Claude evaluează munca lui Claude; cifrele de supraveghere acoperă doar o platformă internă; iar clasificarea calculului s-a bazat pe modele Claude care eșantionează și etichetează propriile rulări. Nicio terță parte independentă nu a auditat metodologia. Cele trei cifre publicate de Anthropic sunt precise, dar sunt o precizie auto-raportată — ceea ce este diferit de o precizie verificată.

Anthropic spune că va începe să integreze evaluatori externi în proces. Nu au apărut încă nume, date de început sau dezvăluiri comparabile din partea altor laboratoare de AI. Cifra de 26 la sută, la ritmul în care a evoluat, este o imagine de ansamblu, nu un plafon.

Etichete: , , , , ,

Adaugă-ne în Google

Discuție

Există 0 comentarii.