En la API pública de xAI, con un prompt de menos de 200.000 tokens, Grok 4.7 cuesta $2 por millón de tokens de entrada, $0.50 por millón de entrada en caché y $6 por millón de salida. La fila de contexto largo es $4 / $1 / $12. En la página de precios de la API, abierta el 22 de septiembre de 2026, esas tres cifras y la fila larga coinciden con Grok 4.6. La tarifa de lista no se movió. La factura sí puede moverse.
En la misma nota de lanzamiento, el gráfico CursorBench 4.0 de xAI pone una tarea de Grok 4.7 en $1.58 en Low y $6.01 en Extra High. Es un salto de unas 3.8 veces sin tocar la tarjeta por token. Un usuario de Cursor Ultra, en extra high y con fast mode apagado, lo resumió así: “Grok 4.7 is about 2.5 times as expensive as 4.6.” (r/cursor, 21 de septiembre de 2026). Más adelante, Tabbit es un sitio para probar una ruta cuando el presupuesto ya está claro. Primero, la tarjeta.
Qué conviene retener
La etiqueta coincide con Grok 4.6. El contexto corto es $2 / $0.50 / $6 por millón de tokens. A los 200.000 tokens de entrada, toda la solicitud pasa a $4 / $1 / $12.
El esfuerzo es la cifra que se mueve. Los puntos de CursorBench de xAI muestran $1.58, $3.49, $4.69 y $6.01 por tarea, de Low a Extra High. El esfuerzo de razonamiento por defecto en la API es high.
Fast es una segunda tarjeta, no un eslogan. Las tarifas impresas de Fast son $4 / $1 / $12 por debajo de 200.000 y $6 / $1.50 / $18 por encima. Fast es solo Cursor y Grok Build, y está fuera de la API pública.
El corte de Cursor es 256.000, no 200.000. La página del modelo en Cursor duplica las tarifas estándar bajo demanda después de 256.000 tokens de entrada y pone Fast de 500.000 en $6 / $1.50 / $18. La columna de escritura en caché es un guion, no una tarifa aparte.
No hay descuento Batch en grok-4.7. La página del modelo dice que Batch API no está disponible. Las llamadas a herramientas, el 10% del endpoint de EE. UU. y la tarifa de $0.05 por infracción antes de generar quedan fuera del titular.
Precios de un vistazo
Las cifras de abajo son dólares por millón de tokens, tomadas de la página de precios de xAI el 22 de septiembre de 2026. La visión general de Grok 4.6 cubre el modelo anterior. Esta tabla es solo el dinero.
| Modelo | Contexto | Entrada corta | Caché corta | Salida corta | Entrada larga | Caché larga | Salida larga | Umbral de contexto largo |
|---|---|---|---|---|---|---|---|---|
| grok-4.7 | 500k | $2.00 | $0.50 | $6.00 | $4.00 | $1.00 | $12.00 | ≥ 200.000 tokens |
| grok-4.6 | 500k | $2.00 | $0.50 | $6.00 | $4.00 | $1.00 | $12.00 | ≥ 200.000 tokens |
| grok-4.5 | 500k | $2.00 | $0.30 | $6.00 | $4.00 | $0.60 | $12.00 | ≥ 200.000 tokens |
| grok-build-0.1 | 256k | $1.00 | $0.20 | $2.00 | $2.00 | $0.40 | $4.00 | ≥ 200.000 tokens |

Los cuatro números de contexto corto de grok-4.7 son idénticos a los de grok-4.6. La página explica la regla que hace importante la segunda fila: los modelos con precio de contexto largo cobran esas tarifas por todos los tokens de una solicitud cuando el prompt llega al umbral. Cruzar 200.000 no revaloriza solo el exceso.
La página de detalle del modelo repite la tarjeta corta —entrada $2.00, caché $0.50, salida $6.00— y un interruptor llamado “Higher context pricing” sustituye esas cifras por $4.00, $1.00 y $12.00. La ventana es de 500.000. Los esfuerzos son low, medium, high y xhigh, con high por defecto. Batch API aparece como no compatible. La región comprobada era us-east-1, con 150 solicitudes por segundo y 50.000.000 de tokens por minuto en esa página.
El número que importa: de $1.58 a $6.01 por tarea
Si te quedas con una sola cifra, quédate con el intervalo, no con los $2. La nota de lanzamiento de Grok 4.7 dice que el modelo está “priced starting at $2 per million input tokens and $6 per million output tokens” y que una variante rápida tiene “twice the output speed at twice the price”. La vista de coste de CursorBench 4.0 en esa misma página, leída en los controles del gráfico el 22 de septiembre de 2026, es esta:
| Esfuerzo de Grok 4.7 | Puntuación CursorBench 4.0 | Coste medio por tarea |
|---|---|---|
| Extra High | 46.3% | $6.01 |
| High | 43.9% | $4.69 |
| Medium | 41.6% | $3.49 |
| Low | 33.1% | $1.58 |
Extra High cuesta 3.8 veces Low por 13.2 puntos porcentuales de puntuación en este gráfico del proveedor. El tamaño de la muestra, el arnés y qué tokens componen el dólar no aparecen en esos controles. Son costes de tarea informados por xAI, no una factura de la consola de la API, y no se comparan con una tarifa cruda por millón de tokens.
Por eso un “mismo precio que 4.6” puede seguir pareciendo caro. El esfuerzo por defecto es high. En este gráfico, high ya está en $4.69, frente a $1.58 en Low. La guía de razonamiento agéntico sirve para decidir cuándo debe parar un bucle; la lección de precio es más estrecha: fija el presupuesto por tarea terminada, incluido el esfuerzo que dejas activo.
Qué midió “2.5 veces más caro”

Dynamix86 mantuvo una misma tarea durante dos días en Cursor Ultra, pasó de Grok 4.6 a Grok 4.7 a las 22:00, hora de Europa Central, y midió cuánto duraba cada punto porcentual del plan. Ambas pasadas fueron extra high y sin fast mode. Los tramos de 4.7 fueron 34, 55 y 38 minutos por punto. Los de 4.6, más temprano ese día, fueron 133 y 101 minutos. A partir de eso, el autor estimó unas 2.5 veces. La publicación también lee un gráfico de Artificial Analysis como $8.82 frente a $3.53 por tarea. Trata esas dos cifras como la lectura que el autor hace de una captura. Este artículo no volvió a medir ese gráfico, y un porcentaje de cuota de Cursor no es una línea de la API de xAI.
Dos respuestas siguen en la pregunta del coste:

Vegetable-Piano-5313 escribió: “so using standard grok 4.7 pretty much equals grok 4.6 in fast mode cost-wise i think”. Dynamix86 respondió: “25% more expensive than 4.6 fast mode even.” Ninguno publica el registro de tokens. Avisan del consumo del plan, no publican una segunda tarjeta oficial.

“Yep what an awful model release. Obviously benchmarks mean nothing anymore but the cost is clearly too high.” Esa frase es la lectura del susto por el precio. No nombra esfuerzo, fast mode ni recuento de tokens. El gráfico de lanzamiento de arriba es la parte que se puede comprobar sin tomar la conclusión del comentario como un hecho.
Las líneas que no están en el titular de $2
El corte de 200.000 se aplica a toda la solicitud. Un prompt de 199.000 tokens se queda en $2 / $0.50 / $6. Uno de 200.000 mueve cada token, salida incluida, a $4 / $1 / $12. En la página de precios no hay una línea de “solo el exceso”.
La fila impresa de Fast en contexto largo no es el doble de la fila estándar larga. La página dice que Grok 4.7 Fast es el mismo modelo en infraestructura más rápida, “at twice the standard token rates”, solo en Cursor y Grok Build, no en la API pública, y no dentro de la cuota gratuita de Grok Build. La tabla bajo esa frase es:
| Tamaño del prompt | Entrada Fast | Entrada en caché Fast | Salida Fast |
|---|---|---|---|
| Por debajo de 200.000 | $4.00 | $1.00 | $12.00 |
| A partir de 200.000 | $6.00 | $1.50 | $18.00 |
Por debajo de 200.000, $4 / $1 / $12 es exactamente 2 veces la tarjeta corta. Por encima, 2 veces la tarjeta larga sería $8 / $2 / $24. La fila impresa es $6 / $1.50 / $18: 1.5 veces las tarifas estándar de contexto largo y 3 veces las de contexto corto. Presupuesta la fila impresa. No multipliques por dos la fila estándar larga y la llames Fast.
Cursor usa 256.000, y Fast es la velocidad por defecto en Pro y superiores. La documentación de Grok 4.7 en Cursor, abierta el 22 de septiembre de 2026, pone el uso estándar bajo demanda en $2 de entrada, $0.50 de entrada en caché y $6 de salida por millón. Fast es $4 / $1 / $12. Después de 256.000 tokens de entrada, las solicitudes estándar son 2 veces esas tarifas estándar y las de Fast son 3 veces, hasta 500.000. Las filas de la tabla son Grok 4.7 a $2 / — / $0.50 / $6, Fast a $4 / — / $1 / $12, 500k a $4 / — / $1 / $12 y 500k Fast a $6 / — / $1.50 / $18. La columna de escritura en caché es un guion. Cursor también dice que Fast es el nivel de velocidad por defecto en Pro y planes superiores, mientras que el plan Start (solo India) fija Grok 4.7 en esfuerzo medium y velocidad estándar. Un prompt de 220.000 tokens puede ser contexto largo en la API de xAI y seguir siendo estándar dentro de Cursor.
Batch no es la palanca de descuento. La página de precios da un 20% solo a grok-4.3 y a las variantes grok-4.20, y dice que los modelos no listados no tienen descuento por lotes. La propia página de grok-4.7 dice que Batch API no está disponible. Dejar el trabajo para la noche no reduce este modelo a la mitad.
Las herramientas son un segundo contador. Las solicitudes que usan herramientas de servidor de xAI pagan tokens más invocaciones. La búsqueda web (web_search) y la ejecución de código cuestan $5 por 1.000 llamadas. La búsqueda en colecciones cuesta $2.50 por 1.000. Los adjuntos (attachment_search) cuestan $10 por 1.000. Desde el 21 de septiembre de 2026 a las 12:00 PT, X Search cuesta $5 por 1.000 publicaciones obtenidas y $10 por 1.000 perfiles de usuario, en lugar de $5 por 1.000 llamadas. view_image, view_x_video y las herramientas MCP remotas no tienen tarifa de invocación; cobran tokens. La búsqueda de imágenes forma parte de la búsqueda web.
El endpoint de EE. UU. es 1.1 veces. Las solicitudes a https://us.api.x.ai/v1 se cobran a 1.1 veces las tarifas globales de tokens. Para grok-4.7, la página imprime $2.20 / $0.55 / $6.60 por debajo de 200.000 y $4.40 / $1.10 / $13.20 por encima. La caché se aplica antes del multiplicador. La página dice que este endpoint cubre ahora grok-4.7 y grok-4.6.
El procesamiento prioritario es otro 2 veces, y solo si la respuesta lo dice. Priority se cobra a 2 veces las tarifas estándar en tokens de entrada, salida, caché y razonamiento, con la caché aplicada antes del multiplicador. Pagas la tarifa prioritaria solo cuando la respuesta confirma "service_tier": "priority". No está disponible para Batch, y Fast es un producto distinto de esta bandera de la API.
La escalera de la familia, y la fila que sí es más barata
La fila contraintuitiva no es un descuento nuevo de Grok 4.7. La entrada en caché de Grok 4.5 es $0.30, frente a $0.50 en 4.6 y 4.7, con la misma entrada de $2 y la misma salida de $6 por debajo de 200.000. Si tu bucle depende mucho de la caché y 4.5 basta, la tarjeta nueva es una subida de la lectura en caché, no un recorte. grok-build-0.1 vale la mitad de 4.7 en cada número de contexto corto ($1 / $0.20 / $2) y su ventana es de 256.000, no de 500.000. Es otro id de modelo, no un nivel de razonamiento de 4.7.
El otro punto contraintuitivo es el esfuerzo. Extra High no tiene su propio precio de entrada. Gasta más tokens de salida al mismo $6. La documentación de Cursor dice que las distancias entre xhigh, high, medium y low son más amplias que en Grok 4.6, y que las tareas más difíciles piensan más tiempo. Dejar el valor por defecto en high es una decisión de compra.
Lo que sigues pagando cuando el modelo rechaza
Un rechazo no es una línea gratis en esta tarjeta.
Si el sistema detecta una infracción de las normas de uso antes de generar en la Responses API, xAI cobra $0.05 por solicitud.
Si la solicitud se considera infracción y la generación ya se ejecutó, esa generación también se cobra.
La entrada en caché es un descuento ($0.50 en lugar de $2.00 por debajo de 200.000). La tarjeta de texto no tiene un precio aparte de escritura en caché. La columna de escritura de Cursor es un guion. La entrada sin caché va a la tarifa completa de entrada.
Los reintentos y los intentos fallidos que produjeron tokens siguen siendo uso de tokens. La tarjeta no los condona.
Una suscripción de chat de Grok, la cuota de un plan de Cursor y una factura de API son tres objetos distintos. Este artículo no convierte el precio mensual de un plan de consumo en dólares de API; ese precio de suscripción no se volvió a comprobar como cifra de pago en vivo el 22 de septiembre de 2026.

Un comentario de Hacker News cita una página que afirma que Grok 4.7 (xhigh) cuesta “$0.00 per 1M input tokens” y “$0.00 per 1M output tokens”, y luego dice que el dominio es “appropriately descriptive”. Un cero en un widget de terceros no es una bajada de precio. La tarjeta de API de arriba es la que hay que presupuestar.
Dónde se ejecuta de verdad el modelo
La documentación de Grok 4.7 lista la API pública (grok-4.7), el endpoint regional de EE. UU., Grok Build como modelo predeterminado del agente de código, Cursor en todos los planes y las pasarelas OpenRouter, Vercel y Cloudflare. Los precios de lista de las pasarelas no se volvieron a auditar para este artículo; un fragmento de búsqueda que no coincida con $2 / $6 no es motivo para abandonar la tarjeta oficial.
El grupo de Cursor para planes personales y de equipo incluye Grok 4.7, Grok 4.6, Grok 4.5 y Composer 2.5. Ese grupo es una cuota, no una pila prepago de tokens de API. Que Fast sea el valor por defecto en Pro y superiores significa que un plan puede consumir la fila Fast sin una opción aparte en cada turno.
El nivel gratuito de Grok Build no incluye Fast. La nota de lanzamiento también dice que puedes probar Grok Build en x.ai/build. “Try for free” en esa página no afirma que los tokens de la API de grok-4.7 sean gratis.
Dos presupuestos de API ya calculados
Usan solo la tarjeta de xAI: sin herramientas, sin el 10% de EE. UU., sin la bandera de prioridad y sin reintentos. Son aritmética, no un pronóstico.
Una respuesta corta en la tarjeta por defecto, por debajo del corte. 10.000 tokens de entrada sin caché y 2.000 de salida:
(10,000 × $2 + 2,000 × $6) / 1,000,000 = $0.032La misma forma en el Fast corto impreso es $0.064. La salida vale 3 veces la entrada, así que un razonamiento largo domina aunque el prompt sea pequeño.
Un prompt de agente en frío que cruza 200.000. 250.000 tokens de entrada sin caché y 8.000 de salida. Las tarifas de contexto largo se aplican a todo:
(250,000 × $4 + 8,000 × $12) / 1,000,000 = $1.096Los mismos recuentos, si se cobraran como contexto corto, serían $0.548. El corte es la diferencia. Con un 90% de entrada en caché, todavía en la fila larga:
(25,000 × $4 + 225,000 × $1 + 8,000 × $12) / 1,000,000 = $0.421El Fast impreso por encima de 200.000, en frío, es (250,000 × $6 + 8,000 × $18) / 1,000,000 = $1.644. Duplicar la fila estándar larga inventaría $2.192. Usa $1.644.
Cálculo local
Estima la factura mensual de la API
Tarifas oficiales de xAI revisadas el 22 de septiembre de 2026. La salida se cobra una vez e incluye el razonamiento. Lo que escribes no sale de esta página.
A partir de 200.000 tokens de entrada se usa la fila de contexto largo para todo el pedido. Fast usa la tabla impresa, que no es el doble plano de esa fila. Excluye herramientas, el 10% del endpoint de EE. UU., prioridad, reintentos y el umbral de 256.000 de Cursor. Verificar la tarifa
La calculadora se queda en el navegador. Cambia toda la solicitud a las tarifas de contexto largo a partir de 200.000 tokens de entrada, y la opción Fast usa la tabla impresa de Fast solo para grok-4.7. grok-4.6 y grok-4.5 se quedan en sus filas estándar para que siga visible la diferencia de caché de 4.5. No modela tarifas de herramientas, el 10% de EE. UU., la prioridad, los reintentos ni el umbral de 256.000 de Cursor. Vuelve a abrir la página oficial de precios antes de cerrar un presupuesto.
Después de la tarjeta, un sitio donde ejecutar el modelo
Conocer la tarjeta no engancha el modelo a las páginas y los archivos que ya tienes abiertos. Tabbit Browser es el cliente para ese paso: el selector de modelos, la página activa y los archivos locales están en la misma superficie, así que comparar una ruta es una selección y no una integración de facturación nueva.
El límite es el sentido de esta sección. Tabbit no sustituye la factura de xAI y no cambia la regla de 256.000 de Cursor. La página del modelo Grok 4.7 (English) lista el modelo y dice que su disponibilidad en Tabbit depende del selector en vivo de la cuenta. Las notas de prompts (English) y las notas de reseñas (English) son el rastro de cómo se llama a la API y de cómo se leyeron los benchmarks públicos. No son una factura medida de Tabbit. Este artículo no ejecutó una tarea cronometrada en Tabbit, así que no afirma un coste, una latencia ni una tasa de éxito de Tabbit.
Si el trabajo es la propia sesión del navegador, empieza por la guía del navegador de IA, la visión general de navegadores agénticos, qué es un navegador agéntico y la guía de automatización del navegador. La comparación de navegadores de 2026 y las notas de uso de Tabbit separan la elección del cliente de la tarjeta de tokens.
Qué factura estás eligiendo
| Carga | Qué domina la factura | Empieza aquí | Vigila |
|---|---|---|---|
| Llamadas cortas a la API | Tokens de salida a $6 / 1M | grok-4.7, esfuerzo low o medium | El esfuerzo por defecto es high |
| Prompts repetidos bajo 200.000 | Lecturas en caché a $0.50 | API estándar con una clave de caché estable | Las lecturas en caché de 4.5 son $0.30 si la calidad basta |
| Prompts de 200.000 o más en la API | El corte de toda la solicitud | Reestructura, o presupuesta $4 / $12 | No es “solo el exceso” |
| El mismo prompt dentro de Cursor | La línea de 256.000 y Fast por defecto | Velocidad estándar salvo que la latencia exija Fast | Pro y superiores usan Fast por defecto |
| Latencia por encima del coste | Tarjeta Fast impresa | Fast de Cursor o de Grok Build | No está en la API pública; sin cuota gratuita de Grok Build |
| Agentes con muchas herramientas | $5 / 1.000 llamadas más tokens | Limita búsqueda y ejecución de código | La facturación de X Search cambió el 21 de septiembre de 2026 |
Veredicto
Compra Grok 4.7 cuando la tarea sea lo bastante larga como para que el esfuerzo extra se gane sus tokens, y compra a propósito el esfuerzo y la superficie. La tarjeta de la API sigue siendo la de Grok 4.6. En ese gráfico, Low es $1.58 por tarea y Extra High es $6.01. Mantén los prompts por debajo de 200.000 tokens en la API, salvo que ya hayas puesto precio a $4 / $12 para toda la solicitud. Trata Fast como la tabla impresa de $4 / $1 / $12 y $6 / $1.50 / $18, y recuerda que Cursor cambia en 256.000, no en 200.000. Usa grok-4.5 o grok-build-0.1 cuando baste la caché más barata o la fila a mitad de precio. No esperes un descuento Batch que la página del modelo dice que no existe.
Los artículos de visión general, reseña y alternativas de este modelo aún no están publicados. Hasta entonces, el artículo de Grok 4.6, las notas del modelo (English) y las páginas oficiales de abajo son el rastro. Vuelve a mirar la tarjeta antes de un compromiso mensual; el cambio de X Search en esta misma página de precios lleva fecha del 21 de septiembre de 2026.
Fuentes
Precios de la API de xAI: tarifas de texto, tabla Fast, herramientas, lista Batch, endpoint de EE. UU., prioridad y tarifa por infracción; revisado el 22 de septiembre de 2026
Página del modelo grok-4.7: $2 / $0.50 / $6, interruptor de contexto alto, Batch no compatible, esfuerzo por defecto high
Documentación de Grok 4.7: id del modelo, disponibilidad de Fast, 10% de EE. UU. y dónde se ejecuta; última actualización el 21 de septiembre de 2026
Introducing Grok 4.7: precio de partida, frase de la variante rápida y puntos de coste de CursorBench
Documentación de Grok 4.7 en Cursor: umbral de 256.000, Fast por defecto y filas de tarifas; abierta el 22 de septiembre de 2026
Registros de la comunidad, con condiciones en los pies de foto: r/cursor 1wmswj9, HN 49789558
Preguntas frecuentes
¿Cuánto cuesta Grok 4.7?
En la API de xAI, revisada el 22 de septiembre de 2026, grok-4.7 cuesta $2 por millón de tokens de entrada, $0.50 por millón de entrada en caché y $6 por millón de tokens de salida cuando el prompt tiene menos de 200.000 tokens. A partir de ese umbral, toda la solicitud pasa a $4, $1 y $12. El id público del modelo es grok-4.7.
¿Grok 4.7 tiene el mismo precio que Grok 4.6?
Las filas de contexto corto y largo coinciden con Grok 4.6: $2/$0.50/$6 por debajo de 200.000 tokens de entrada y $4/$1/$12 a partir de ahí. Eso es la tarifa de lista. El gráfico CursorBench de xAI sigue mostrando Grok 4.7 Extra High a $6.01 por tarea y Low a $1.58, así que el esfuerzo cambia la factura sin cambiar la tarjeta. Un usuario de Cursor Ultra que cronometró una tarea también calculó unas 2.5 veces el consumo de cuota frente a Grok 4.6, en extra high y con fast mode apagado.
¿Cuál es el precio de contexto largo de Grok 4.7?
En la API de xAI, cuando un prompt llega a 200.000 tokens, cada token de esa solicitud se cobra a $4 de entrada, $1 de entrada en caché y $12 de salida por millón. Cursor documenta otro umbral: el uso estándar bajo demanda se duplica solo después de 256.000 tokens de entrada, hasta una ventana de 500.000. No mezcles los dos cortes.
¿Cuánto cuesta Grok 4.7 Fast?
La página de precios de xAI lista Fast, disponible solo en Cursor y Grok Build, a $4/$1/$12 por millón por debajo de 200.000 tokens de prompt y a $6/$1.50/$18 a partir de esa línea. El texto también dice el doble de las tarifas estándar. La fila impresa de Fast en contexto largo es 1.5 veces la fila estándar de contexto largo, no el doble. Fast no está en la API pública de xAI y queda fuera de la cuota gratuita de Grok Build.
¿La API Batch descuenta Grok 4.7?
No. La página del modelo grok-4.7 marca Batch API como no compatible. La página de precios da un 20% de descuento por lotes solo a modelos anteriores, como grok-4.3 y las variantes grok-4.20, y dice que los modelos que no están en esa lista no tienen descuento por lotes.
¿Las herramientas y los rechazos cuestan aparte?
Las herramientas del lado del servidor se cobran además de los tokens. La búsqueda web y la ejecución de código cuestan $5 por 1.000 llamadas. Desde el 21 de septiembre de 2026 a las 12:00 PT, X Search cuesta $5 por 1.000 publicaciones obtenidas y $10 por 1.000 perfiles de usuario. Una solicitud de la Responses API marcada como infracción de las normas antes de generar se cobra a $0.05. Si la generación termina y luego infringe, los tokens se cobran igual.