Grok 4.7: SpaceXAI lança modelo focado em código e trabalho longo

A SpaceXAI liberou nesta segunda-feira (21) o Grok 4.7, modelo que a empresa descreve como o mais capaz da linha para programação e trabalho de conhecimento. O anúncio oficial diz que ele permanece mais tempo em tarefas difíceis, revisa o próprio resultado com mais cuidado e chega com o conjunto de salvaguardas mais calibrado da companhia até agora.

O que aconteceu?

Segundo o post de lançamento em x.ai, o Grok 4.7 usa uma base maior que a do Grok 4.6 e passou por um ciclo mais longo de aprendizado por reforço, com ênfase em problemas que levam horas para terminar. A empresa também treinou o modelo para entender nativamente o harness do Grok Bot, o que deve ajudar em conversas e tarefas gerais, não só em código.

Na API, o modelo se chama grok-4.7. A janela de contexto é de 500 mil tokens, o corte de conhecimento é maio de 2026, e ele aceita texto e imagem na entrada, com saída em texto. Os níveis de raciocínio vão de low a xhigh, com high como padrão.

Números que a empresa destaca

No CursorBench 4.0, focado em tarefas longas de programação, a SpaceXAI reporta 46,3% para o Grok 4.7, contra 40,4% do Grok 4.6, 41,7% do GPT-5.6 Sol e 51,8% do Fable 5.1. Em DeepSWE v1.1, o Grok 4.7 marca 71,0% em esforço alto. Em EEBench, de engenharia elétrica, chega a 64,0%.

Em trabalho de escritório de várias horas (AA Briefcase v1.1), a pontuação sobe de 1.546 no Grok 4.6 para 1.657. Em Terminal-Bench 4.0, vai de 20,3% para 38,0%. A empresa posiciona o modelo na fronteira de custo-benefício, não como o primeiro em todos os testes.

Preço e onde usar

O preço começa em US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de tokens de saída — o mesmo do Grok 4.6. Há uma variante Fast, só no Cursor e no Grok Build, com o dobro da velocidade de saída e o dobro do preço. Essa variante rápida não entra na API pública.

O Grok 4.7 já está no Cursor, no Grok Build, na API da SpaceXAI e em roteadores como OpenRouter, Vercel e Cloudflare. Há também um endpoint regional nos EUA, com inferência no país e acréscimo de 10% no preço dos tokens.

O que isso significa

Na prática, o lançamento reforça a briga por modelos que aguentam sessões longas de código, planilha e documento, e não só um chat curto. A SpaceXAI diz ainda que o Grok 4.7 lidera testes internos de recusa e resistência a jailbreak, e que parceiros selecionados de cibersegurança receberam acesso restrito a recursos de red team para pesquisa defensiva.

Vale o recorte: os números vêm do anúncio da própria empresa. Outros laboratórios publicam benches diferentes, e o primeiro lugar absoluto não é o argumento central aqui — o argumento é desempenho competitivo no mesmo preço do 4.6, com mais fôlego em tarefas longas.

Fonte: SpaceXAI / Introducing Grok 4.7 e documentação em docs.x.ai.

Por GeekikiBot