Tehnologie

Meta lansează Muse Glimmer: agent AI de 30B parametri care rulează pe GPU-ul tău

Adrian Kessler

Meta a construit un agent AI de 30 de miliarde de parametri care rulează integral pe hardware de consum — și a publicat codul sursă gratuit. Modelul, numit Muse Glimmer, nu îți trimite sarcinile prin serverele Meta. Rulează local pe propriul tău GPU, iar cu un consum de memorie cuantizat de 18 până la 20 de gigaocteți, încape în limitele plăcilor grafice high-end actuale pentru consumatori.

Acest lucru contează pentru că generația anterioară de modele locale — variantele de 7 și 13 miliarde de parametri care au umplut biblioteca Ollama în ultimii doi ani — erau generatoare de text capabile, dar agenți autonomi slabi. Se luptau cu raționamentul în mai mulți pași, apelurile de funcții care eșuau la jumătate și sarcinile care necesitau să-și amintească ce s-a întâmplat acum trei pași. Muse Glimmer este conceput special pentru aceste fluxuri de lucru: programare, apeluri de funcții, gestionarea programului, organizarea fișierelor și secvențe de sarcini în mai mulți pași care se recuperează automat atunci când un apel de funcție se strică.

Arhitectura de bază este o distilare a lui Muse Spark, modelul comercial pentru care Meta a început să vândă acces API luna trecută. Prin distilare logit și învățare prin consolidare, compania și-a comprimat flagship-ul închis într-o formă care încape pe un GPU de 24 de gigaocteți — RTX 5090, Apple M5 Max sau M4 Max. Decodarea speculativă împinge randamentul și mai departe: RTX 5090 rulează modelul de 3,1 ori mai rapid decât fără ea, M5 Max de 1,8 ori, M4 Max de 1,5 ori. În practică, această diferență este linia dintre un agent care se simte receptiv și unul care necesită răbdare.

Modelul procesează text și imagini intercalate — capturi de ecran, documente, intrări cu conținut mixt — și funcționează în peste 100 de limbi. Se conectează nativ la framework-urile pe care utilizatorii de AI local le folosesc deja: Ollama, LM Studio, llama.cpp, MLX. Dacă deja tragi modele de pe Hugging Face și le rulezi pe propriul hardware, Muse Glimmer se integrează în acel flux de lucru fără unelte suplimentare.

Licența este Apache 2.0, ceea ce înseamnă că nu există restricții comerciale. Persoane fizice, companii și cercetători îl pot folosi fără a plăti Meta. Acest lucru îl plasează într-o categorie diferită față de modelele OpenAI și Anthropic, care necesită plata per token chiar și pentru lucrări de dezvoltare. În comparație cu Google Gemma4-31B și Alibaba Qwen3.6-27B — cei mai apropiați competitori open-weight ca scară — Meta poziționează Muse Glimmer ca fiind puternic pentru dimensiunea sa pe benchmark-uri agentice și de limbaj general, fără a face afirmații mai specifice despre care sarcini le câștigă.

Pragul hardware rămâne selectiv. Să încapă 18 gigaocteți de greutăți ale modelului pe un GPU sună accesibil până când calculezi ce GPU este necesar. Un RTX 5090 costă în prezent peste două mii de dolari. Mașinile cu Apple M5 Max încep de la aproape trei mii. Acesta este AI local pentru o anumită categorie de venit, nu o înlocuire a cloud-ului pentru majoritatea utilizatorilor. Versiunea cuantizată este, de asemenea, un frate cu fidelitate redusă al lui Muse Spark: moștenește semnalul de antrenament de la modelul comercial, dar nu este modelul comercial. Meta continuă să vândă acces la versiunea cu capacități superioare.

Ceea ce se schimbă odată cu această lansare este nivelul agenților capabili al modelelor locale. Să rulezi un model de 30 de miliarde de parametri antrenat pentru finalizarea autonomă a sarcinilor este diferit de a rula un model de chat la același număr de parametri. Distincția constă în modul în care modelul gestionează eșecurile uneltelor și secvențele în mai mulți pași — nu în cât de bine completează o singură propoziție.

Greutățile sunt disponibile pe Hugging Face din 10 august, sub licență Apache 2.0. Meta a confirmat parteneriate de optimizare la nivel de dispozitiv cu AMD, Arm, Dell, Intel și Nvidia, urmând să urmeze versiuni optimizate suplimentare pentru configurații hardware specifice. Comunitatea locală de AI va testa modelul în câteva zile, așa cum face cu fiecare lansare semnificativă — rezultatele benchmark-urilor acelei comunități vor oferi o imagine mai clară a locului unde se situează de fapt Muse Glimmer în termen de două săptămâni de astăzi.

Etichete: , , , , ,

Discuție

Există 0 comentarii.