Na API pública da xAI, com um prompt de menos de 200 mil tokens, o Grok 4.7 custa $2 por milhão de tokens de entrada, $0,50 por milhão de entrada em cache e $6 por milhão de saída. A linha de contexto longo é $4 / $1 / $12. Na página de preços da API, aberta em 22 de setembro de 2026, esses três números e a linha longa coincidem com o Grok 4.6. O preço de tabela não se moveu. A conta ainda pode se mover.
Na mesma nota de lançamento, o gráfico CursorBench 4.0 da xAI coloca uma tarefa do Grok 4.7 em $1,58 no Low e $6,01 no Extra High. É um salto de cerca de 3,8 vezes sem mexer na tabela por token. Um usuário do Cursor Ultra, em extra high e com o fast mode desligado, resumiu assim: “Grok 4.7 is about 2.5 times as expensive as 4.6.” (r/cursor, 21 de setembro de 2026). Depois, o Tabbit é um lugar para testar um caminho quando o orçamento já está claro. Primeiro, a tabela.
O que vale guardar
O rótulo coincide com o Grok 4.6. O contexto curto é $2 / $0,50 / $6 por milhão de tokens. Aos 200 mil tokens de entrada, o pedido inteiro passa para $4 / $1 / $12.
O esforço é o número que se move. Os pontos do CursorBench da xAI mostram $1,58, $3,49, $4,69 e $6,01 por tarefa, do Low ao Extra High. O esforço de raciocínio padrão na API é high.
Fast é uma segunda tabela, não um slogan. As tarifas Fast impressas são $4 / $1 / $12 abaixo de 200 mil e $6 / $1,50 / $18 acima. O Fast é só Cursor e Grok Build, e está fora da API pública.
O corte do Cursor é 256 mil, não 200 mil. A página do modelo no Cursor dobra as tarifas padrão sob demanda depois de 256 mil tokens de entrada e coloca o Fast de 500 mil em $6 / $1,50 / $18. A coluna de escrita em cache é um traço, não uma tarifa separada.
Não há desconto Batch no grok-4.7. A página do modelo diz que a Batch API não é suportada. Chamadas de ferramenta, os 10% do endpoint dos EUA e a taxa de $0,05 por violação antes da geração ficam fora do título.
Preços de relance
Os valores abaixo são dólares por milhão de tokens, tirados da página de preços da xAI em 22 de setembro de 2026. A visão geral do Grok 4.6 cobre o modelo anterior. Esta tabela é só o dinheiro.
| Modelo | Contexto | Entrada curta | Cache curto | Saída curta | Entrada longa | Cache longo | Saída longa | Limite de contexto longo |
|---|---|---|---|---|---|---|---|---|
| grok-4.7 | 500k | $2,00 | $0,50 | $6,00 | $4,00 | $1,00 | $12,00 | ≥ 200 mil tokens |
| grok-4.6 | 500k | $2,00 | $0,50 | $6,00 | $4,00 | $1,00 | $12,00 | ≥ 200 mil tokens |
| grok-4.5 | 500k | $2,00 | $0,30 | $6,00 | $4,00 | $0,60 | $12,00 | ≥ 200 mil tokens |
| grok-build-0.1 | 256k | $1,00 | $0,20 | $2,00 | $2,00 | $0,40 | $4,00 | ≥ 200 mil tokens |

Os quatro números de contexto curto do grok-4.7 são iguais aos do grok-4.6. A página explica a regra que torna a segunda linha importante: modelos com preço de contexto longo cobram essas tarifas por todos os tokens de um pedido quando o prompt chega ao limite. Cruzar 200 mil não reprecifica só o excesso.
A página de detalhe do modelo repete a tabela curta — entrada $2,00, cache $0,50, saída $6,00 — e um interruptor chamado “Higher context pricing” troca esses valores por $4,00, $1,00 e $12,00. A janela é de 500 mil. Os esforços são low, medium, high e xhigh, com high como padrão. A Batch API aparece como não suportada. A região conferida era us-east-1, com 150 pedidos por segundo e 50.000.000 de tokens por minuto nessa página.
O número que importa: de $1,58 a $6,01 por tarefa
Se ficar com um só número, fique com o intervalo, não com os $2. A nota de lançamento do Grok 4.7 diz que o modelo está “priced starting at $2 per million input tokens and $6 per million output tokens” e que uma variante rápida tem “twice the output speed at twice the price”. A visão de custo do CursorBench 4.0 nessa mesma página, lida nos controles do gráfico em 22 de setembro de 2026, é esta:
| Esforço do Grok 4.7 | Pontuação CursorBench 4.0 | Custo médio por tarefa |
|---|---|---|
| Extra High | 46,3% | $6,01 |
| High | 43,9% | $4,69 |
| Medium | 41,6% | $3,49 |
| Low | 33,1% | $1,58 |
Extra High custa 3,8 vezes o Low por 13,2 pontos percentuais de pontuação neste gráfico do fornecedor. O tamanho da amostra, o harness e quais tokens compõem o dólar não aparecem nesses controles. São custos de tarefa informados pela xAI, não uma fatura do console da API, e não se comparam a uma tarifa crua por milhão de tokens.
Por isso um “mesmo preço do 4.6” ainda pode parecer caro. O esforço padrão é high. Neste gráfico, high já está em $4,69, contra $1,58 no Low. O guia de raciocínio agêntico serve para decidir quando um laço deve parar; a lição de preço é mais estreita: fixe o orçamento por tarefa concluída, incluindo o esforço que você deixa ligado.
O que “2,5 vezes mais caro” mediu

Dynamix86 manteve a mesma tarefa por dois dias no Cursor Ultra, trocou do Grok 4.6 para o Grok 4.7 às 22:00, horário da Europa Central, e mediu quanto durava cada ponto percentual do plano. As duas passagens foram extra high e sem fast mode. Os trechos do 4.7 foram 34, 55 e 38 minutos por ponto. Os do 4.6, mais cedo nesse dia, foram 133 e 101 minutos. A partir disso, o autor estimou cerca de 2,5 vezes. A publicação também lê um gráfico da Artificial Analysis como $8,82 contra $3,53 por tarefa. Trate esses dois valores como a leitura que o autor faz de uma captura. Este artigo não mediu de novo esse gráfico, e uma porcentagem de cota do Cursor não é uma linha da API da xAI.
Duas respostas continuam na pergunta do custo:

Vegetable-Piano-5313 escreveu: “so using standard grok 4.7 pretty much equals grok 4.6 in fast mode cost-wise i think”. Dynamix86 respondeu: “25% more expensive than 4.6 fast mode even.” Nenhum dos dois publica o registro de tokens. Eles avisam sobre o consumo do plano, não publicam uma segunda tabela oficial.

“Yep what an awful model release. Obviously benchmarks mean nothing anymore but the cost is clearly too high.” Essa frase é a leitura do susto com o preço. Ela não nomeia esforço, fast mode nem contagem de tokens. O gráfico de lançamento acima é a parte que dá para conferir sem tomar a conclusão do comentário como fato.
As linhas que não estão no título de $2
O corte de 200 mil vale para o pedido inteiro. Um prompt de 199 mil tokens fica em $2 / $0,50 / $6. Um de 200 mil move cada token, saída incluída, para $4 / $1 / $12. Na página de preços não há uma linha de “só o excesso”.
A linha Fast impressa de contexto longo não é o dobro da linha padrão longa. A página diz que o Grok 4.7 Fast é o mesmo modelo em infraestrutura mais rápida, “at twice the standard token rates”, só no Cursor e no Grok Build, não na API pública, e não dentro da cota gratuita do Grok Build. A tabela sob essa frase é:
| Tamanho do prompt | Entrada Fast | Entrada em cache Fast | Saída Fast |
|---|---|---|---|
| Abaixo de 200 mil | $4,00 | $1,00 | $12,00 |
| A partir de 200 mil | $6,00 | $1,50 | $18,00 |
Abaixo de 200 mil, $4 / $1 / $12 é exatamente 2 vezes a tabela curta. Acima, 2 vezes a tabela longa seria $8 / $2 / $24. A linha impressa é $6 / $1,50 / $18: 1,5 vez as tarifas padrão de contexto longo e 3 vezes as de contexto curto. Orce a linha impressa. Não multiplique por dois a linha padrão longa e chame isso de Fast.
O Cursor usa 256 mil, e o Fast é a velocidade padrão no Pro e acima. A documentação do Grok 4.7 no Cursor, aberta em 22 de setembro de 2026, põe o uso padrão sob demanda em $2 de entrada, $0,50 de entrada em cache e $6 de saída por milhão. O Fast é $4 / $1 / $12. Depois de 256 mil tokens de entrada, pedidos padrão são 2 vezes essas tarifas padrão e pedidos Fast são 3 vezes, até 500 mil. As linhas da tabela são Grok 4.7 a $2 / — / $0,50 / $6, Fast a $4 / — / $1 / $12, 500k a $4 / — / $1 / $12 e 500k Fast a $6 / — / $1,50 / $18. A coluna de escrita em cache é um traço. O Cursor também diz que o Fast é o nível de velocidade padrão no Pro e planos superiores, enquanto o plano Start (só Índia) trava o Grok 4.7 em esforço medium e velocidade padrão. Um prompt de 220 mil tokens pode ser contexto longo na API da xAI e ainda ser padrão dentro do Cursor.
Batch não é a alavanca de desconto. A página de preços dá 20% só ao grok-4.3 e às variantes grok-4.20, e diz que modelos não listados não têm desconto em lote. A própria página do grok-4.7 diz que a Batch API não é suportada. Deixar o trabalho para a noite não reduz este modelo pela metade.
Ferramentas são um segundo medidor. Pedidos que usam ferramentas de servidor da xAI pagam tokens mais invocações. A busca na web (web_search) e a execução de código custam $5 por 1.000 chamadas. A busca em coleções custa $2,50 por 1.000. Anexos (attachment_search) custam $10 por 1.000. Desde 21 de setembro de 2026 às 12:00 PT, o X Search custa $5 por 1.000 publicações obtidas e $10 por 1.000 perfis de usuário, no lugar de $5 por 1.000 chamadas. view_image, view_x_video e ferramentas MCP remotas não têm taxa de invocação; cobram tokens. A busca de imagens faz parte da busca na web.
O endpoint dos EUA é 1,1 vez. Pedidos para https://us.api.x.ai/v1 são cobrados a 1,1 vez as tarifas globais de tokens. Para o grok-4.7, a página imprime $2,20 / $0,55 / $6,60 abaixo de 200 mil e $4,40 / $1,10 / $13,20 acima. O cache é aplicado antes do multiplicador. A página diz que este endpoint cobre agora grok-4.7 e grok-4.6.
O processamento prioritário é outro 2 vezes, e só se a resposta disser isso. Priority é cobrado a 2 vezes as tarifas padrão em tokens de entrada, saída, cache e raciocínio, com o cache aplicado antes do multiplicador. Você paga a tarifa prioritária só quando a resposta confirma "service_tier": "priority". Não está disponível para Batch, e o Fast é um produto distinto desta flag da API.
A escada da família, e a linha que de fato é mais barata
A linha contraintuitiva não é um desconto novo do Grok 4.7. A entrada em cache do Grok 4.5 é $0,30, contra $0,50 no 4.6 e no 4.7, com a mesma entrada de $2 e a mesma saída de $6 abaixo de 200 mil. Se o seu laço depende muito de cache e o 4.5 basta, a tabela nova é um aumento da leitura em cache, não um corte. O grok-build-0.1 vale metade do 4.7 em cada número de contexto curto ($1 / $0,20 / $2) e a janela dele é de 256 mil, não de 500 mil. É outro id de modelo, não um nível de raciocínio do 4.7.
O outro ponto contraintuitivo é o esforço. Extra High não tem preço próprio de entrada. Ele gasta mais tokens de saída ao mesmo $6. A documentação do Cursor diz que as distâncias entre xhigh, high, medium e low são mais largas do que no Grok 4.6, e que tarefas mais difíceis pensam por mais tempo. Deixar o padrão em high é uma decisão de compra.
O que você ainda paga quando o modelo recusa
Uma recusa não é uma linha grátis nesta tabela.
Se o sistema pega uma violação das regras de uso antes da geração na Responses API, a xAI cobra $0,05 por pedido.
Se o pedido é julgado como violação e a geração já rodou, essa geração também é cobrada.
A entrada em cache é um desconto ($0,50 em vez de $2,00 abaixo de 200 mil). A tabela de texto não tem um preço separado de escrita em cache. A coluna de escrita do Cursor é um traço. A entrada sem cache vai à tarifa cheia de entrada.
Novas tentativas e falhas que produziram tokens continuam sendo uso de tokens. A tabela não as perdoa.
Uma assinatura de chat do Grok, a cota de um plano do Cursor e uma fatura de API são três objetos diferentes. Este artigo não converte o preço mensal de um plano de consumo em dólares de API; esse preço de assinatura não foi reconferido como valor de checkout ao vivo em 22 de setembro de 2026.

Um comentário no Hacker News cita uma página que afirma que o Grok 4.7 (xhigh) custa “$0.00 per 1M input tokens” e “$0.00 per 1M output tokens”, e depois diz que o domínio é “appropriately descriptive”. Um zero num widget de terceiros não é um corte de preço. A tabela de API acima é a que se deve orçar.
Onde o modelo realmente roda
A documentação do Grok 4.7 lista a API pública (grok-4.7), o endpoint regional dos EUA, o Grok Build como modelo padrão do agente de código, o Cursor em todos os planos e os gateways OpenRouter, Vercel e Cloudflare. Os preços de tabela dos gateways não foram reauditados para este artigo; um trecho de busca que não bata com $2 / $6 não é motivo para abandonar a tabela oficial.
O grupo do Cursor para planos pessoais e de equipe inclui Grok 4.7, Grok 4.6, Grok 4.5 e Composer 2.5. Esse grupo é uma cota, não uma pilha pré-paga de tokens de API. Fast como padrão no Pro e acima significa que um plano pode queimar a linha Fast sem uma opção separada a cada turno.
O nível gratuito do Grok Build não inclui Fast. A nota de lançamento também diz que dá para experimentar o Grok Build em x.ai/build. “Try for free” nessa página não afirma que os tokens da API do grok-4.7 são grátis.
Dois orçamentos de API já calculados
Eles usam só a tabela da xAI: sem ferramentas, sem os 10% dos EUA, sem a flag de prioridade e sem novas tentativas. São aritmética, não uma previsão.
Uma resposta curta na tabela padrão, abaixo do corte. 10 mil tokens de entrada sem cache e 2 mil de saída:
(10,000 × $2 + 2,000 × $6) / 1,000,000 = $0.032A mesma forma no Fast curto impresso é $0,064. A saída vale 3 vezes a entrada, então um raciocínio longo domina mesmo quando o prompt é pequeno.
Um prompt de agente a frio que cruza 200 mil. 250 mil tokens de entrada sem cache e 8 mil de saída. As tarifas de contexto longo valem para tudo:
(250,000 × $4 + 8,000 × $12) / 1,000,000 = $1.096As mesmas contagens, se fossem cobradas como contexto curto, seriam $0,548. O corte é a diferença. Com 90% de entrada em cache, ainda na linha longa:
(25,000 × $4 + 225,000 × $1 + 8,000 × $12) / 1,000,000 = $0.421O Fast impresso acima de 200 mil, a frio, é (250,000 × $6 + 8,000 × $18) / 1,000,000 = $1.644. Dobrar a linha padrão longa inventaria $2,192. Use $1,644.
Cálculo local
Estime a fatura mensal da API
Tarifas oficiais da xAI verificadas em 22 de setembro de 2026. A saída é cobrada uma vez e inclui o raciocínio. O que você digita fica nesta página.
A partir de 200.000 tokens de entrada, o pedido inteiro usa a linha de contexto longo. Fast usa a tabela impressa, que não é o dobro simples dessa linha. Exclui ferramentas, os 10% do endpoint dos EUA, prioridade, novas tentativas e o limite de 256 mil do Cursor. Verificar a tarifa
A calculadora fica no navegador. Ela muda o pedido inteiro para as tarifas de contexto longo a partir de 200 mil tokens de entrada, e a opção Fast usa a tabela Fast impressa só para o grok-4.7. grok-4.6 e grok-4.5 ficam nas linhas padrão para a diferença de cache do 4.5 continuar visível. Ela não modela taxas de ferramenta, os 10% dos EUA, prioridade, novas tentativas nem o limite de 256 mil do Cursor. Reabra a página oficial de preços antes de fechar um orçamento.
Depois da tabela, um lugar para rodar o modelo
Conhecer a tabela não liga o modelo às páginas e aos arquivos que você já tem abertos. O Tabbit Browser é o cliente desse passo: o seletor de modelos, a página ativa e os arquivos locais ficam na mesma superfície, então comparar um caminho é uma seleção, não uma integração nova de cobrança.
O limite é o sentido desta seção. O Tabbit não substitui a fatura da xAI e não muda a regra de 256 mil do Cursor. A página do modelo Grok 4.7 (English) lista o modelo e diz que a disponibilidade no Tabbit depende do seletor ao vivo da conta. As notas de prompts (English) e as notas de avaliação (English) são o rastro de como a API é chamada e de como os benchmarks públicos foram lidos. Não são uma conta medida do Tabbit. Este artigo não rodou uma tarefa cronometrada no Tabbit, então não afirma custo, latência nem taxa de sucesso do Tabbit.
Se o trabalho é a própria sessão do navegador, comece pelo guia do navegador de IA, a visão geral de navegadores agênticos, o que é um navegador agêntico e o guia de automação do navegador. A comparação de navegadores de 2026 e as notas de uso do Tabbit separam a escolha do cliente da tabela de tokens.
Qual conta você está escolhendo
| Carga | O que domina a conta | Comece aqui | Observe |
|---|---|---|---|
| Chamadas curtas de API | Tokens de saída a $6 / 1M | grok-4.7, esforço low ou medium | O esforço padrão é high |
| Prompts repetidos abaixo de 200 mil | Leituras em cache a $0,50 | API padrão com uma chave de cache estável | As leituras em cache do 4.5 são $0,30 se a qualidade bastar |
| Prompts de 200 mil ou mais na API | O corte do pedido inteiro | Reestruture, ou orce $4 / $12 | Não é “só o excesso” |
| O mesmo prompt dentro do Cursor | A linha de 256 mil e o Fast padrão | Velocidade padrão, salvo se a latência exigir Fast | Pro e acima usam Fast por padrão |
| Latência acima do custo | Tabela Fast impressa | Fast do Cursor ou do Grok Build | Não está na API pública; sem cota gratuita do Grok Build |
| Agentes com muitas ferramentas | $5 / 1.000 chamadas mais tokens | Limite busca e execução de código | A cobrança do X Search mudou em 21 de setembro de 2026 |
Veredito
Compre o Grok 4.7 quando a tarefa for longa o bastante para o esforço extra merecer os tokens, e compre de propósito o esforço e a superfície. A tabela da API continua sendo a do Grok 4.6. Nesse gráfico, Low é $1,58 por tarefa e Extra High é $6,01. Mantenha os prompts abaixo de 200 mil tokens na API, salvo se você já precificou $4 / $12 para o pedido inteiro. Trate o Fast como a tabela impressa de $4 / $1 / $12 e $6 / $1,50 / $18, e lembre que o Cursor vira em 256 mil, não em 200 mil. Use grok-4.5 ou grok-build-0.1 quando o cache mais barato ou a linha pela metade bastar. Não espere um desconto Batch que a página do modelo diz que não existe.
Os artigos de visão geral, avaliação e alternativas deste modelo ainda não foram publicados. Até lá, o artigo do Grok 4.6, as notas do modelo (English) e as páginas oficiais abaixo são o rastro. Confira a tabela de novo antes de um compromisso mensal; a mudança do X Search nesta mesma página de preços tem data de 21 de setembro de 2026.
Fontes
Preços da API da xAI: tarifas de texto, tabela Fast, ferramentas, lista Batch, endpoint dos EUA, prioridade e taxa de violação; conferido em 22 de setembro de 2026
Página do modelo grok-4.7: $2 / $0,50 / $6, interruptor de contexto alto, Batch não suportado, esforço padrão high
Documentação do Grok 4.7: id do modelo, disponibilidade do Fast, 10% dos EUA e onde ele roda; última atualização em 21 de setembro de 2026
Introducing Grok 4.7: preço inicial, frase da variante rápida e pontos de custo do CursorBench
Documentação do Grok 4.7 no Cursor: limite de 256 mil, Fast padrão e linhas de tarifa; aberta em 22 de setembro de 2026
Registros da comunidade, com condições nas legendas: r/cursor 1wmswj9, HN 49789558
Perguntas frequentes
Quanto custa o Grok 4.7?
Na API da xAI, conferida em 22 de setembro de 2026, o grok-4.7 custa $2 por milhão de tokens de entrada, $0,50 por milhão de entrada em cache e $6 por milhão de tokens de saída quando o prompt fica abaixo de 200 mil tokens. A partir desse limite, o pedido inteiro passa para $4, $1 e $12. O id público do modelo é grok-4.7.
O Grok 4.7 tem o mesmo preço do Grok 4.6?
As linhas de contexto curto e longo coincidem com o Grok 4.6: $2/$0,50/$6 abaixo de 200 mil tokens de entrada e $4/$1/$12 a partir daí. Esse é o preço de tabela. O gráfico CursorBench da xAI ainda mostra o Grok 4.7 Extra High a $6,01 por tarefa e o Low a $1,58, então o esforço muda a conta sem mudar a tabela. Um usuário do Cursor Ultra que cronometrou uma tarefa também estimou cerca de 2,5 vezes o consumo de cota em relação ao Grok 4.6, em extra high e com o fast mode desligado.
Qual é o preço de contexto longo do Grok 4.7?
Na API da xAI, quando um prompt chega a 200 mil tokens, cada token desse pedido é cobrado a $4 de entrada, $1 de entrada em cache e $12 de saída por milhão. O Cursor documenta outro limite: o uso padrão sob demanda dobra só depois de 256 mil tokens de entrada, até uma janela de 500 mil. Não misture os dois cortes.
Quanto custa o Grok 4.7 Fast?
A página de preços da xAI lista o Fast, disponível só no Cursor e no Grok Build, a $4/$1/$12 por milhão abaixo de 200 mil tokens de prompt e a $6/$1,50/$18 a partir dessa linha. O texto também diz o dobro das tarifas padrão. A linha Fast impressa de contexto longo é 1,5 vez a linha padrão de contexto longo, não o dobro. O Fast não está na API pública da xAI e fica fora da cota gratuita do Grok Build.
A API Batch desconta o Grok 4.7?
Não. A página do modelo grok-4.7 marca a Batch API como não suportada. A página de preços dá 20% de desconto em lote só a modelos anteriores, como grok-4.3 e as variantes grok-4.20, e diz que modelos fora dessa lista não têm desconto em lote.
Chamadas de ferramenta e recusas custam à parte?
Ferramentas do lado do servidor são cobradas além dos tokens. Busca na web e execução de código custam $5 por 1.000 chamadas. Desde 21 de setembro de 2026 às 12:00 PT, o X Search custa $5 por 1.000 publicações obtidas e $10 por 1.000 perfis de usuário. Um pedido da Responses API marcado como violação das regras antes da geração é cobrado a $0,05. Se a geração termina e depois viola, os tokens continuam cobrados.