InícioCentro de Notícias da LBank
xAI Lança o Grok 4.7. É Maior, Mas Chega Tarde à Festa da Fronteira da IA
xai-launches-grok-4-7
xAI Lança o Grok 4.7. É Maior, Mas Chega Tarde à Festa da Fronteira da IA
xAI diz que o novo modelo é uma "melhoria notável" em relação ao Grok 4.6 pelo mesmo preço. Os benchmarks dizem que ele ainda está em segundo lugar.
2026-09-21 Fonte:decrypt.co

Em resumo

  • A xAI lançou o Grok 4.7 na segunda-feira, após pelo menos cinco adiamentos desde o fim de julho.
  • O modelo ficou em segundo lugar atrás do Claude Fable 5.1 no GDPval e no AA-Briefcase, e em segundo atrás do GPT-6 Astra no EEBench, um benchmark de engenharia elétrica.
  • O Grok 4.7 já está disponível no app Grok, Cursor, Grok Build e na API da xAI, operando com 2,1 trilhões de parâmetros e treinamento suplementar com dados de engenharia da SpaceX.

A xAI, de Elon Musk, lançou o Grok 4.7 na tarde de segunda-feira, seu melhor modelo até agora, classificando-o como "uma melhora notável em relação ao Grok 4.6 pelo mesmo preço e velocidade".

O lançamento ocorre após vários atrasos aparentes. Musk adiou o cronograma pelo menos cinco vezes desde o fim de julho: "daqui a quatro semanas", depois "daqui a algumas semanas", depois "3 a 4 semanas", depois "10 dias" em 1º de setembro, e então "precisa de mais alguns dias para ficar pronto" em 11 de setembro.

Myriad: Quanto valerá Elon Musk? Clique para fazer sua previsão.

A xAI afirma que o modelo passa mais tempo resolvendo problemas difíceis e confere suas próprias respostas com mais frequência do que o Grok 4.6, além de contar com o que a empresa chama de seus guardrails de segurança mais robustos até agora.

Musk reforçou a mensagem no X, chamando o Grok 4.7 de "uma forte combinação de inteligência, velocidade e baixo custo". Desta vez não há lista de espera — ele já está disponível no app Grok, Cursor, Grok Build e na API da xAI.

O Grok 4.7 chegou.

É uma melhora notável em relação ao Grok 4.6 pelo mesmo preço e velocidade. pic.twitter.com/H3OTBbXyvO

— SpaceXAI (@SpaceXAI) 21 de setembro de 2026

O Grok 4.7 reúne 2,1 trilhões de parâmetros, alta de 40% em relação aos 1,5 trilhão do Grok 4.6, que por sua vez já era um refinamento do Grok 4.5. Os custos são de US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de tokens de saída. Parâmetros são os ajustes internos que um modelo calibra durante o treinamento, e uma quantidade maior deles geralmente significa mais capacidade de aprender padrões, enquanto tokens são a unidade básica de informação que um modelo de IA pode processar ou gerar.

A xAI também incorporou dados suplementares de treinamento obtidos da SpaceX, a empresa de foguetes de Musk: telemetria de satélites Starlink, registros de manufatura e logs de falhas de engenharia. A proposta é um modelo que raciocina melhor sobre hardware e sistemas físicos do que qualquer outro treinado apenas com texto da internet.

Dito isso, as pontuações nos benchmarks contam uma história familiar. O GDPval mede como um modelo se sai em trabalho de conhecimento real e economicamente valioso — memorandos jurídicos, planilhas, apresentações — usando tarefas validadas por profissionais em atividade em cada área, e atribui uma nota no formato Elo, o mesmo sistema de ranking head-to-head usado no xadrez.

O Grok 4.7 atingiu 1695 no GDPval. O Claude Fable 5.1 liderou o ranking com 1735.

O AA-Briefcase, criado pela Artificial Analysis, testa trabalho de escritório de várias horas que encadeia pesquisa, análise e produção de documentos em uma única tarefa longa, também avaliada na escala Elo. O Grok 4.7 registrou 1657, contra 1678 do Fable 5.1. Mesmo resultado, teste diferente.

O CursorBench 4.0, benchmark da Cursor para tarefas reais de programação dentro de seu editor, cruza precisão com o custo e a quantidade de tokens consumidos por cada tarefa. O Grok 4.7 fica no meio do caminho: mais caro por tarefa do que o GPT-6 Astra, sucessor do GPT-5.6 Sol, e o Claude Sonnet 5, mas ainda abaixo do Fable 5.1, que vence em todas as faixas de preço no gráfico.

Esse não é um padrão novo para a xAI. O Grok 4.5 foi lançado em julho com o maior cluster de treinamento do setor e pontuações de terceiro lugar, atrás dos modelos da Claude e da OpenAI. Antes dele, o Grok 4.20 trocava confiabilidade por velocidade e personalidade. O Grok 4.6 também ficou atrás do pelotão de fronteira em autonomia de programação.

Nada disso faz do Grok 4.7 um produto ruim para os milhões de pessoas que interagem com ele pelo X, pelo app independente ou pelo painel de seus Teslas. Isso significa que o modelo com maior probabilidade de responder às suas perguntas, ou de alimentar o assistente de voz do seu carro, está rodando em um sistema que os próprios benchmarks de sua fabricante colocam um degrau abaixo do topo.

Essa diferença explica por que o preço importa mais do que a posição no ranking para a maioria das pessoas. A xAI tem consistentemente praticado preços abaixo de Anthropic e OpenAI em custo por token, mesmo ficando atrás delas em capacidade bruta, apostando que "bom o suficiente, barato e em todo lugar" supera "o melhor, porém mais caro" na maior parte dos usos cotidianos.

Musk já havia reduzido as expectativas dias antes do lançamento, escrevendo que o Grok 4.7 deveria ficar "aproximadamente no mesmo nível" do Claude Opus 5.0, da Anthropic, e não do mais novo Opus 5.1, com o desempenho multimodal ainda precisando de trabalho.

Na mesma publicação, ele esboçou os próximos três modelos: o Grok 4.8 como um avanço significativo, o Grok 4.9 na "classe Astra/Fable" e o Grok 5 como um possível líder de fronteira. Essas atualizações ainda não têm data de lançamento. "Veremos", escreveu ele.