PangunaLBank News Center
Ang Bagong Grok 4.5 ay Inilabas Na. Ayon kay Elon Musk, Kakumpitensya Ito ng Claude Opus ng Nakaraang Taon.
grok-4-5-elon-musk-claude-opus
Ang Bagong Grok 4.5 ay Inilabas Na. Ayon kay Elon Musk, Kakumpitensya Ito ng Claude Opus ng Nakaraang Taon.
Ang bagong modelo ng coding ng SpaceXAI ay mas mura at mas mabilis kaysa sa mga pangunahing modelo ng Anthropic at OpenAI—at ayon mismo kay Musk, huli ito ng kahit isang henerasyon sa kanila.
2026-07-08 Pinagmulan:decrypt.co

Sa maikli

  • Inilabas ng SpaceXAI ang Grok 4.5 noong Hulyo 8 sa halagang $2 bawat milyong input token at $6 bawat milyong output, mas mababa sa kalahati ng presyo ng mga katulad na modelo mula sa Anthropic at OpenAI.
  • Nag-post si Elon Musk sa X na ang modelo ay "halos maihahambing sa Opus 4.7," ang nakaraang flagship ng Anthropic, na ngayon ay napalitan na ng Opus 4.8, habang ipinagmamalaki ang bilis at halaga kaysa sa pagganap sa benchmark.
  • Hindi pa available ang Grok 4.5 sa EU; sinabi ng SpaceXAI na inaasahan ang pag-access sa Europa sa kalagitnaan ng Hulyo.

Inilabas ng SpaceXAI ni Elon Musk ang Grok 4.5 nitong Miyerkules, ang una nitong pampublikong modelo mula nang matapos ang pagsasanib ng SpaceX-xAI noong Pebrero at ang nakabinbing $60 bilyong kasunduan ng SpaceX upang bilhin ang Cursor. Target nito ang mga coder, inhinyero, at ang tinatawag ng kumpanya na "knowledge workers"—isang kategorya na tila sumasaklaw sa lahat mula sa mga software developer hanggang sa mga abogado na nagsusuri ng mga kontrata at mga finance team na gumagawa ng Excel models.

Ang ipinagmamalaki ng kumpanya ay hindi ito ang pinakamahusay na modelo. Ito ay mura, para sa isang modelo sa kanluranin man lang. Ang Grok 4.5 ay nagkakahalaga ng $2 bawat milyong input token at $6 bawat milyong output. Ang Claude Opus 4.8, ang pangunahing flagship ng Anthropic, ay nagkakahalaga ng $5 input at $25 output. Ang GPT 5.6 Sol, ang bagong top-tier na modelo ng OpenAI na inilunsad din nitong Miyerkules, ay nagkakahalaga ng $5 input at $30 output.

Nag-post si Musk sa X at nilinaw kung nasaan talaga ang kanyang bagong modelo. Tinawag niya itong "halos maihahambing sa Opus 4.7, ngunit mas mabilis." Ang Opus 4.7 ang nakaraang flagship ng Anthropic; napalitan na ito ng Opus 4.8. Ang Claude Fable 5 na ngayon ang pinakamataas na handog ng Anthropic.

Ipinaliwanag niya iyon bilang isang sadyang kompromiso: bilis at halaga higit sa raw na kakayahan, na ang mga inhinyero sa Tesla at SpaceX ang patunay ng kapakinabangan sa totoong mundo.

Ano ang tunay na ipinapakita ng mga benchmark

Naglimbag ang SpaceXAI ng apat na resulta ng benchmark sa paglulunsad, at magkahalo ang larawan. Sinusukat ng DeepSWE 1.1 kung gaano kapagkatiwalaan ng isang AI ang pag-aayos ng mga tunay na software bug na isinumite ng mga developer, gamit ang isang standardized na setup ng pagsubok upang ang mga modelo ay maihambing nang patas, na sinasalin sa porsyento ng mga naayos na isyu. Nakakuha ang Grok 4.5 ng 53%, mas mababa sa Claude Opus 4.8 na may 59% at GPT 5.5 na may 67%. Nanguna ang Claude Fable 5, ang frontier model ng Anthropic, sa tsart na may 70%.

Sa SWE Bench Pro, isa pang benchmark na sumusukat sa koleksyon ng mga problema sa software engineering na sinasalin sa rate ng resolusyon, nag-post ang Grok 4.5 ng 64.7%, sapat upang talunin ang 58.6% ng GPT 5.5 sa partikular na pagsubok na iyon. Nangunguna pa rin ang Opus 4.8 sa 69.2%, at ang Fable 5 ay nasa 80.4%.

Ang mga benchmark ng kumpanya ay inihambing laban sa GPT 5.5, hindi sa GPT 5.6, dahil ang huli ay inilunsad din nitong Miyerkules, ilang oras pagkatapos ng anunsyo ng Grok 4.5.

Sinasanay ng SpaceXAI ang Grok 4.5 sa pakikipagtulungan sa bagong-acquire na Cursor AI sa sampu-sampung libong Nvidia GB300 GPU sa loob ng Colossus, ang supercomputer ng Memphis na may kabuuang kapasidad na mahigit 200,000 GPU. Ang mga lab na ang mga modelo ay mas mataas sa parehong mga benchmark ay walang pagmamay-ari na halos kasing dami ng hardware na iyon. Ang modelong lumabas ay mapagkumpitensya, ngunit hindi lang nangunguna.

Sinundan ng pattern na iyon ang Grok sa maraming paglabas. Patuloy na nagtatampok ang SpaceXAI ng napakalaking compute at mga third-place na score. Ang nagbago sa Grok 4.5 ay ang pagpepresyo at ang signal ng pagsasanay.

Kung saan talagang matatag ang argumento para dito

Ang mas magandang argumento ay hindi raw na pagganap; ito ay matematika ng kahusayan. Sa mga gawain ng SWE Bench Pro, gumamit ang Grok 4.5 ng average na 15,954 output token upang makumpleto ang bawat trabaho. Ang Opus 4.8 naman ay umubos ng 67,020 token para sa parehong trabaho, isang 4.2x na agwat.

Para sa mga team na nagpapatakbo ng AI sa malaking volume, ang pagkakaibang iyon ay nagdudulot ng tunay na matitipid bukod pa sa mas mababa nang presyo bawat token. Kahit na mababa ang score ng Grok 4.5 sa mga quality benchmark, ang mas murang token at mas mahusay na paggamit ay nagbibigay-daan para sa mas maraming pag-ulit nang hindi masyadong gumagastos.

Tumatakbo rin ang modelo sa 80 token bawat segundo, na teritoryo ng mabilis na modelo. Sinasanay ang Grok 4.5 sa data ng sesyon ng developer mula sa Cursor, kasama ang mga debugging trace at tunay na pag-edit ng code sa halip na mga static na repositoryo. Tulad ng inamin ni Musk sa korte, ang mga kasanayan sa pagsasanay ng xAI ay napuna na dati; sa pagkakataong ito, ang pipeline ay tumatakbo sa isang platform na binibili ng SpaceX nang buo.

Para sa mga developer na nagpapatakbo ng high-volume coding tasks, gumagana ang matematika: humigit-kumulang Opus 4.7 na kakayahan sa 60% na mas mababa bawat input token. Para sa sinumang naghahabol sa frontier, nangunguna ang Claude Fable 5 sa bawat kategorya na pinili ng SpaceXAI na ilathala. Ang aming mabilis na pagsubok gamit ang Grok build sa Hermes ay hindi nakakagulat para sa malikhaing pagsulat at katanggap-tanggap sa isang simpleng coding task.

Available ang modelo sa pamamagitan ng API, sa Hermes at Grok build na may kalahating milyong token ng konteksto (kaunti mas mababa sa 400,000 salita). Kailangang maghintay ang mga user sa Europa bago ito gamitin; sinabi ng SpaceXAI na darating ang Grok 4.5 sa EU sa kalagitnaan ng Hulyo.