Tehnologie

Fei-Fei Li, după vânzarea World Labs către AMD: „Universul nu e făcut din cuvinte, ci din lucruri reale…”

Anunțând vânzarea World Labs către AMD, Fei-Fei Li a reluat ideea pe care și-a clădit laboratorul. Spusă de viitoarea șefă științifică a unui producător de cipuri, sună mai puțin a filozofie și mai mult a pariu pe hardware.
Adrian Kessler
Adaugă-ne în Google

Fei-Fei Li este cercetătoarea ale cărei realizări au învățat mașinile să vadă, iar acum tocmai și-a vândut laboratorul pe care l-a înființat pentru a duce inteligența artificială dincolo de limbaj. Anunțând că World Labs va intra în componența AMD, producătorul de cipuri condus de Lisa Su, una dintre susținătoarele sale timpurii, Li a reafirmat într-o singură frază convingerea pe care s-a clădit compania — o replică ce sună și ca un pariu împotriva erei AI centrate pe cuvinte.

„Universul nu e făcut din cuvinte, ci din lucruri reale. Multe dintre cele mai importante probleme pe care AI trebuie să le rezolve — de la știință și divertisment până la robotică — cer modele capabile să raționeze asupra structurii și comportamentului lumii fizice.”

Li a scris aceste cuvinte în „World Labs to AMD”, o postare pe blogul ei de pe Substack, iar The Register le-a citat în articolul despre tranzacție. Fraza care le precedă stabilește termenii: compania a fost „călăuzită de convingerea fundamentală că limbajul, de unul singur, nu este suficient pentru dezvoltarea modelelor”.

AMD a convenit să achiziționeze World Labs printr-o tranzacție exclusiv în acțiuni, evaluată la aproximativ 8,2 miliarde de dolari, care ar urma să se încheie până la sfârșitul lui 2026, dacă primește aprobarea autorităților de reglementare. Li va deveni vicepreședintă executivă și cercetătoare-șefă la AMD și îi va raporta direct lui Su. Laboratorul din San Francisco, pe care l-a fondat la începutul lui 2024 împreună cu Ben Mildenhall și Justin Johnson, dezvoltă ceea ce industria numește „modele ale lumii”: sisteme care generează, reconstruiesc și simulează medii tridimensionale pornind de la text, imagini și video. Dacă un model lingvistic de mari dimensiuni prezice următorul cuvânt, un model al lumii, după cum a explicat The Register, își imaginează mediul și apoi încearcă să rezolve problema în acel cadru.

La prima vedere, fraza o plasează alături de Yann LeCun, fostul cercetător-șef în domeniul AI al Meta, care a sugerat că modelele lingvistice de mari dimensiuni s-ar putea dovedi o fundătură. Poziția lui Li este mai nuanțată; The Register a avut grijă să precizeze că ea nu se opune modelelor lingvistice de mari dimensiuni. Cel mai nou model al laboratorului împrumută din abordarea acestora: Atlas, scrie ea, prezice următoarea perspectivă pornind de la un set de imagini 2D, la fel cum un model lingvistic prezice următorul token. Nu metoda o deranjează, ci materia primă. Textul este o consemnare a lumii, scrisă de oameni; argumentul ei este că problemele care merită rezolvate — de la știință și divertisment până la robotică — țin de lucrurile pe care textul le descrie.

Fraza capătă greutate prin prisma celui care a plătit pentru ea. Un producător de cipuri nu investește miliarde în acțiuni pentru o idee filozofică. În anunțul AMD, achiziția este prezentată în jurul nevoii de putere de calcul: pe măsură ce AI se extinde în robotică, simulare și AI fizică, „cerințele privind infrastructura de calcul devin mai diverse”. Formularea aleasă de Su spune totul: „Construirea platformelor de calcul pentru următoarea generație de AI cere o înțelegere profundă a felului în care evoluează modelele.” Pe scurt, AMD vrea să vadă care va fi următoarea sarcină de calcul înainte să proiecteze cipurile care o vor executa. În comparație cu Nvidia, observă The Register, echipa AMD de inginerie software este minusculă; World Labs îi aduce o echipă de cercetare internă, la doar câteva săptămâni după ce compania a convenit să cumpere Taalas, un startup care integrează direct în cipuri ponderile modelelor.

Li descrie același mecanism din perspectiva cealaltă. „Fără un efort dedicat dezvoltării hardware-ului, AI este limitată în privința eficienței. Și a extinderii la scară. Iar pentru ceea ce ne propunem, rămâne captivă în lumea digitală”, scrie ea. Acesta este miezul practic al afirmației. Un model care raționează despre spațiul fizic este util doar în măsura în care mașina pe care rulează îl poate executa suficient de repede pentru a ghida un robot, iar Li a decis că drumul cel mai scurt către o asemenea mașină trece prin mutarea în interiorul companiei care o produce.

Fraza are greutate și datorită parcursului profesional care stă în spatele ei. Li a intrat în domeniu în 2000, urmărind să înțeleagă inteligența vizuală, atât în mașini, cât și în creier. Cercetările din laboratorul ei pentru ImageNet au contribuit la declanșarea erei moderne a AI; mai târziu, a fondat divizia AI a Google Cloud și i-a fost cercetătoare-șefă, apoi a devenit directoarea fondatoare a institutului Human-Centered AI de la Stanford. După un sfert de secol, argumentul ei a rămas același. Miza, însă, s-a schimbat. Odată încheiată tranzacția, profesoara care a susținut acest punct de vedere îi va raporta lui Su.

Dacă are dreptate, AMD a cumpărat o perspectivă timpurie asupra sarcinilor de calcul care vor defini următoarea generație de hardware pentru AI. Dacă se înșală, iar limbajul continuă să absoarbă totul, compania a cumpărat o plasă de siguranță costisitoare — exact așa a interpretat The Register tranzacția: o asigurare în cazul în care modelele lingvistice de mari dimensiuni se dovedesc o fundătură.

Fraza lui Li pornește de la o afirmație despre univers. Până la încheierea tranzacției, va deveni o fișă tehnică.

Etichete: , , , ,

Adaugă-ne în Google

Discuție

Există 0 comentarii.