
SpaceXAI a lui Elon Musk a lansat Grok 4.5 miercuri, primul său model public de la încheierea fuziunii SpaceX-xAI în februarie și de la înțelegerea de 60 de miliarde de dolari a SpaceX pentru achiziția Cursor. Acesta vizează programatori, ingineri și ceea ce compania numește „lucrători ai cunoașterii” — o categorie care, aparent, include pe oricine, de la dezvoltatori de software la avocați care revizuiesc contracte și echipe financiare care construiesc modele Excel.
Prezentarea companiei nu este că ar fi cel mai bun model. Este că este ieftin, cel puțin pentru un model occidental. Grok 4.5 costă 2 dolari per milion de tokenuri de intrare și 6 dolari per milion de tokenuri de ieșire. Claude Opus 4.8, principalul model emblematic al Anthropic, costă 5 dolari la intrare și 25 de dolari la ieșire. GPT 5.6 Sol, noul model de top al OpenAI, lansat tot miercuri, este cotat la 5 dolari la intrare și 30 de dolari la ieșire.
Musk a postat pe X și a clarificat unde se poziționează de fapt noul său model. El l-a numit „aproximativ comparabil cu Opus 4.7, dar mult mai rapid.” Opus 4.7 este anteriorul model emblematic al Anthropic; Opus 4.8 l-a succedat de atunci. Claude Fable 5 este acum oferta de top a Anthropic.
El a încadrat aceasta ca pe un compromis deliberat: viteză și cost în detrimentul capacității brute, cu ingineri de la Tesla și SpaceX ca dovadă a utilității în lumea reală.
SpaceXAI a publicat patru rezultate de benchmark la lansare, iar situația este mixtă. DeepSWE 1.1 măsoară cât de fiabil poate o IA să rezolve bug-uri software reale trimise de dezvoltatori, utilizând o configurație de testare standardizată, astfel încât modelele să poată fi comparate în mod echitabil, punctate după procentul de probleme rezolvate. Grok 4.5 a obținut 53%, în urma lui Claude Opus 4.8 cu 59% și GPT 5.5 cu 67%. Claude Fable 5, modelul de frontieră al Anthropic, a ocupat primul loc cu 70%.
La SWE Bench Pro, un alt benchmark care măsoară o colecție de probleme de inginerie software, punctate după rata de rezolvare, Grok 4.5 a înregistrat 64,7%, suficient pentru a depăși 58,6% al GPT 5.5 la acel test. Opus 4.8 rămâne lider cu 69,2%, iar Fable 5 se situează la 80,4%.
Benchmark-urile companiei compară cu GPT 5.5, nu cu GPT 5.6, deoarece acesta din urmă a fost lansat tot miercuri, la câteva ore după anunțul Grok 4.5.
SpaceXAI a antrenat Grok 4.5 în colaborare cu recent achiziționatul Cursor AI pe zeci de mii de GPU-uri Nvidia GB300 în interiorul Colossus, supercomputerul din Memphis cu o capacitate totală de peste 200.000 de GPU-uri. Laboratoarele ale căror modele se situează deasupra acestuia în aceleași benchmark-uri nu dețin nimic similar ca hardware. Modelul rezultat este competitiv, doar că nu este primul.
Acest tipar a urmat Grok în multiple lansări. SpaceXAI a apărut constant cu o putere de calcul enormă și scoruri pe locul trei. Ceea ce s-a schimbat la Grok 4.5 sunt prețurile și semnalul de antrenament.
Argumentul mai bun nu este performanța brută; este matematica eficienței. Pentru sarcinile SWE Bench Pro, Grok 4.5 a folosit o medie de 15.954 de tokenuri de ieșire pentru a finaliza fiecare lucrare. Opus 4.8 a consumat 67.020 de tokenuri pentru aceeași muncă, un decalaj de 4,2 ori.
Pentru echipele care utilizează AI la volum mare, această diferență se traduce în economii reale pe lângă prețul deja mai mic per token. Chiar și cu Grok 4.5 obținând scoruri atât de scăzute în benchmark-urile de calitate, tokenurile mai ieftine și o eficiență mai mare în utilizare permit mai multe iterații fără a cheltui atât de mult.
Modelul rulează, de asemenea, la 80 de tokenuri pe secundă, ceea ce îl plasează în teritoriul modelelor rapide. Grok 4.5 a fost antrenat pe date de sesiune ale dezvoltatorilor de la Cursor, incluzând urme de depanare și editări de cod reale, mai degrabă decât depozite statice. Așa cum Musk a recunoscut în instanță, practicile de antrenament ale xAI au atras deja atenția în trecut; de data aceasta, procesul se derulează printr-o platformă pe care SpaceX este pe cale să o cumpere în întregime.
Pentru dezvoltatorii care execută sarcini de codare de volum mare, matematica funcționează: aproximativ capabilitatea Opus 4.7 la un preț cu 60% mai mic per token de intrare. Pentru oricine urmărește frontiera, Claude Fable 5 conduce fiecare categorie pe care SpaceXAI a ales să o publice. Testul nostru rapid folosind Grok build pe Hermes a fost dezamăgitor pentru scrierea creativă și acceptabil pentru o sarcină simplă de codare.
Modelul este disponibil prin API, pe Hermes și Grok build cu jumătate de milion de tokenuri de context (puțin mai puțin de 400.000 de cuvinte). Utilizatorii europeni vor trebui să aștepte înainte de a-l folosi; SpaceXAI afirmă că Grok 4.5 va ajunge în UE la mijlocul lunii iulie.








