O Que É Grok 4.5

Grok 4.5 explicado: precificação de $2/$6, 500 mil tokens de contexto, 80 TPS, os números reais de benchmark vs. Opus 4.8 e Fable 5, e todas as formas de experimentar o novo carro-chefe da xAI hoje.

Ashley Innocent

Ashley Innocent

9 julho 2026

O Que É Grok 4.5

Apidog para empresas

Implantação local

SSO & RBAC

Conforme SOC 2

Explorar Apidog Enterprise

A xAI, agora operando sob a marca SpaceXAI, lançou o Grok 4.5 em 8 de julho de 2026. A empresa o descreve como “o modelo mais inteligente da SpaceXAI construído para codificação, tarefas agentivas e trabalho de conhecimento”, e Elon Musk o apresentou como “um modelo de classe Opus, mas mais rápido, mais eficiente em tokens e de menor custo.”

Os fatos de destaque: US$ 2 por milhão de tokens de entrada, US$ 6 por milhão de saída, uma janela de contexto de 500k, 80 tokens por segundo e um treinamento que incluiu sessões reais de desenvolvedores do Cursor, o editor de código de IA que a SpaceX concordou em adquirir em junho. Ele está disponível hoje no Grok Build, no Cursor em todos os planos e através da API xAI.

Este guia aborda o que é o Grok 4.5, o que os números publicados dizem (incluindo aqueles que o marketing da xAI não enfatiza) e como começar a usá-lo. Se você quiser testar o endpoint antes de integrá-lo a um aplicativo, o Apidog permite que você envie requisições para `grok-4.5`, inspecione respostas de streaming e simule a API para sua equipe sem escrever uma linha de código cliente.

button

Grok 4.5 em um relance

Especificação Valor
ID do Modelo grok-4.5 (observe o ponto)
Data de Lançamento 8 de julho de 2026
Janela de Contexto 500.000 tokens
Preço de Entrada US$ 2,00 por 1M de tokens
Preço de Saída US$ 6,00 por 1M de tokens
Velocidade ~80 tokens/segundo
Disponibilidade Grok Build (padrão), Cursor (todos os planos), API xAI
Disponibilidade na UE Ainda não; previsto para meados de julho de 2026
Endpoint https://api.x.ai/v1/responses

Dois detalhes nesta tabela merecem uma segunda olhada.

Primeiro, a janela de contexto. O Grok 4.5 vem com 500k tokens de contexto, enquanto o grok-4.3, mais antigo e mais barato, oferece 1M. Se sua carga de trabalho for RAG de documentos longos ou análise de repositório completo, o modelo anterior comporta mais. A xAI aposta que você trocará contexto por capacidade.

Segundo, a observação sobre a UE. A página de lançamento afirma que o Grok 4.5 “ainda não está disponível na UE em nenhum produto SpaceXAI ou no console da API”, com disponibilidade prevista para meados de julho. Se você está desenvolvendo para usuários europeus, planeje considerando essa lacuna.

O que há de novo no Grok 4.5

Treinado em conjunto com o Cursor

O fato que define este lançamento: o Grok 4.5 “foi treinado em conjunto com o Cursor.” De acordo com o próprio anúncio do Cursor, o editor contribuiu com trilhões de tokens capturando “interações do usuário com bases de código e ferramentas de software.” Isso significa que o modelo aprendeu com rastros de depuração, edições de múltiplos arquivos e as correções que os desenvolvedores fizeram quando um agente errou, não apenas de código estático.

Esta é uma estratégia de dados diferente da maioria dos laboratórios, e levanta questões justas sobre consentimento e privacidade. Nós as detalhamos em nosso artigo complementar sobre o que o treinamento de sessão do Cursor significa para desenvolvedores.

Aprendizado por reforço em escala

A xAI afirma que o modelo foi treinado em dezenas de milhares de GPUs NVIDIA GB300, com aprendizado por reforço cobrindo “centenas de milhares de tarefas, centradas em engenharia de software multi-etapas.” A pilha executa implementações agentivas assincronamente por horas enquanto o treinamento continua. O objetivo, nas palavras da xAI, é “inteligência por token”: menos tokens, mais inteligentes, em vez de longas e errantes cadeias de raciocínio.

Trabalho de escritório, não apenas código

O Grok 4.5 é agora o modelo padrão no Grok Build, e a xAI dedica uma quantidade surpreendente do anúncio a planilhas. O modelo constrói modelos Excel de múltiplas planilhas com pesquisa na web, constrói diagramas PowerPoint a partir de formas nativas e elabora prosa no Word através dos plugins Office da xAI. O Cursor o descreve como “o primeiro que construímos para mais do que engenharia de software.”

Os benchmarks, lidos honestamente

A xAI publicou quatro benchmarks de codificação. Aqui está a imagem completa, incluindo os modelos que superam o Grok 4.5 nos próprios gráficos da xAI:

Benchmark Grok 4.5 Opus 4.8 (máx) GPT 5.5 (xhigh) Fable (máx)
DeepSWE 1.0 (pass@1) 62.0% 55.75% 64.31% 66.1%
DeepSWE 1.1 53% 59% 67% 70%
Terminal Bench 2.1 83.3% 78.9% 83.4% 84.3%
SWE Bench Pro (resolver) 64.7% 69.2% 58.6% 80.4%

Três coisas se destacam.

Contra o Claude Opus 4.8, o modelo que Musk nomeou como ponto de comparação, o Grok 4.5 vence em dois de quatro. Ele ganha o DeepSWE 1.0 por cerca de 6 pontos e o Terminal Bench por 4.4, mas perde o DeepSWE 1.1 por 6 e o SWE Bench Pro por 4.5. “Classe Opus” é uma descrição justa. “Supera o Opus” não é. Analisamos o confronto completo em Grok 4.5 vs Claude Opus 4.8.

O Claude Fable 5 (máx) da Anthropic lidera os quatro gráficos, na própria página da xAI. Ninguém na xAI reivindicou supremacia de fronteira, e os gráficos são claros sobre isso. O Grok 4.5 compete em custo e velocidade, não em capacidade máxima.

A proveniência importa. A xAI observa que os números dos concorrentes vêm “dos cartões de sistema publicados pelos respectivos desenvolvedores ou tabelas de classificação de benchmark,” e as avaliações do DeepSWE foram criadas pela Datacurve com execuções gerenciadas por terceiros. Isso é mais transparente do que a auto-avaliação pura, mas ainda não há uma avaliação independente e totalmente de terceiros do Grok 4.5 até o momento desta redação. Nossa análise aprofundada dos benchmarks rastreia o que é verificado e o que não é.

A eficiência de tokens é a verdadeira história

O número mais interessante no lançamento não é uma pontuação de benchmark. É o volume de saída. No SWE Bench Pro, o Grok 4.5 resolve tarefas usando uma média de 15.954 tokens de saída. O Opus 4.8 (máx) usa 67.020 no mesmo benchmark, cerca de 4,2x mais.

Tokens de saída são o que você paga a US$ 6 por milhão, e são o que você espera a 80 tokens por segundo. Um modelo que resolve uma tarefa em um quarto dos tokens é mais barato e mais rápido de maneiras que uma pontuação de leaderboard não mostra. A xAI afirma “aproximadamente 2x a eficiência de tokens de modelos líderes comparáveis” no geral, resolvendo tarefas “em menos da metade do número de passos.”

Para cargas de trabalho agentivas, onde uma única sessão pode consumir centenas de milhares de tokens em chamadas de ferramentas, isso muda a matemática de custo mais do que o preço de tabela. Trabalhamos com os números em preços do Grok 4.5 explicados.

Como começar a usar o Grok 4.5

Você tem quatro caminhos, três deles gratuitos por enquanto:

  1. Grok Build. Grok 4.5 é o modelo padrão, e a xAI está “oferecendo uso gratuito do Grok 4.5 por tempo limitado.”
  2. Cursor. Disponível em todos os planos para desktop, web, iOS, CLI e SDK, com uso dobrado na primeira semana. Etapas de configuração em nosso guia do Cursor.
  3. Grok CLI. Instale com curl -fsSL https://x.ai/cli/install.sh | bash.
  4. A API. Obtenha uma chave do console da xAI e chame o endpoint de Respostas:
curl -s https://api.x.ai/v1/responses \
  -H "Authorization: Bearer $XAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-4.5",
    "input": "Summarize the breaking changes in this OpenAPI diff."
  }'

O passo a passo completo, incluindo streaming e testes baseados em Apidog, está em como usar a API Grok 4.5. Se você preferir não gastar créditos de API enquanto explora, os caminhos gratuitos são abordados em como usar o Grok 4.5 gratuitamente.

Assim que você estiver chamando o endpoint, o Apidog ajuda você a manter a integração honesta: salve a requisição com variáveis de ambiente para sua chave, faça asserções nos campos de resposta, faça um teste A/B do grok-4.5 contra o grok-4.3 em seus prompts reais e crie um mock do formato da resposta para que sua equipe de frontend não seja bloqueada enquanto você ajusta os prompts. Baixe o Apidog gratuitamente para acompanhar.

Como o Grok 4.5 se encaixa no cenário de modelos de 2026

O Grok 4.5 chega a um nível intermediário de fronteira já lotado. Ele tem um preço abaixo do Claude Opus 4.8 (US$ 5 de entrada / US$ 25 de saída por milhão) e muito abaixo do Claude Fable 5, enquanto pontua a poucos pontos do Opus nos benchmarks de codificação. Contra rivais de código aberto como o GLM 5.2, ele vence as avaliações de codificação publicadas, mas custa mais por token.

A proposta é inteligência por dólar por segundo, não uma coroa. Se seu gargalo é o rendimento do agente e o gasto com API, essa proposta vale a pena testar. Se você precisa de raciocínio de pico nos problemas mais difíceis, os mesmos gráficos publicados pela xAI o apontam para outro lugar.

Para saber mais sobre os modelos que ele está perseguindo, veja o que é o Claude Opus 4.8 e nossa cobertura anterior do Grok 4.1, que traça como a xAI chegou até aqui.

FAQ

O Grok 4.5 é gratuito para usar? Por tempo limitado, sim, no Grok Build e no Cursor. O uso da API é pago a US$ 2/US$ 6 por milhão de tokens. Todos os caminhos gratuitos atuais estão listados em nosso guia de acesso gratuito.

Qual é o ID do modelo Grok 4.5? grok-4.5, com um ponto. Usar grok-4-5 em uma chamada de API retorna um erro de modelo não encontrado.

Qual é a janela de contexto do Grok 4.5? 500.000 tokens. O grok-4.3 mais antigo oferece 1M, então escolha pela carga de trabalho, não pela data de lançamento.

O Grok 4.5 é melhor que o Claude Opus 4.8? Ele venceu dois dos quatro benchmarks publicados pela xAI e perdeu os outros dois, a aproximadamente 40% do preço de entrada do Opus. Mais rápido e mais barato, sim. Mais forte em todos os aspectos, não.

Posso usar o Grok 4.5 na UE? Ainda não. A xAI diz que a disponibilidade na UE em produtos e no console da API é esperada para meados de julho de 2026.

Pratique o design de API no Apidog

Descubra uma forma mais fácil de construir e usar APIs