Sale Grok 4.6: agentes, precios y qué hacer con él
SpaceXAI lanzó Grok 4.6 el 12 de agosto de 2026. La empresa lo coloca como el valor por defecto para código, chat y trabajo de agentes: un entrenamiento suplementario más largo que Grok 4.5, más auto-verificación en trayectorias largas y un primer pase más fuerte en proyectos visuales e interactivos. El corte de conocimiento es el 1 de febrero de 2026. La ventana de contexto es de 500K tokens, la mitad del 1M de DeepSeek V4.
Está hoy en Cursor y Grok Build, y en la API (más OpenRouter, Vercel y Cloudflare). SpaceXAI ofrece el doble de uso incluido en Grok Build y Cursor durante la primera semana. Después, al contador.
Precios oficiales
Por millón de tokens, según la documentación de modelos de xAI:
| Tamaño del prompt | Entrada | Entrada en caché | Salida |
| --- | --- | --- | --- |
| Menos de 200K tokens | $2.00 | $0.50 | $6.00 |
| 200K tokens o más | $4.00 | $1.00 | $12.00 |
Dos detalles que van a salir en la factura.
El precio de contexto largo aplica a toda la petición. En cuanto el prompt cruza 200K tokens, cada token de esa petición (entrada y salida) se cobra a la tarifa alta. Un prompt de 199K y uno de 201K no son "casi la misma factura." Son dos productos distintos.
La variante rápida cuesta el doble. Lo dice la nota de lanzamiento de SpaceXAI. No la pongas en un camino de alto volumen porque el gráfico de latencia quedó bonito en una demo.
La entrada en caché es $0.50 por millón por debajo de 200K, un 75% de descuento, no el 90% que anuncian otros. Sigue mereciendo diseñarlo. Los límites de la API son 150 peticiones por segundo y 50 millones de tokens por minuto.
Lo que reclaman los benchmarks
SpaceXAI dice que Grok 4.6 High empata con GPT-5.6 Sol en el Artificial Analysis Intelligence Index en 61, y lidera o se sienta cerca de lo alto en varios tableros de agentes y código que publicaron (GDPVal-AA, CursorBench 3.2, FrontierCode 1.1, APEX-Agents). Esas cifras salen del propio anuncio, mezclando puntuaciones propias y públicas de la competencia. Úsalas como filtro de criba, no como prueba de aceptación.
Lo que importa para decidir un build es el trabajo para el que lo entrenaron: agentes de larga duración que se quedan en una tarea durante muchos pasos, más un mejor primer pase en apps interactivas. Si tu carga es clasificación y extracción a volumen, este no es el modelo. DeepSeek V4 Flash es un orden de magnitud más barato en esa mezcla.
Cómo queda junto a DeepSeek V4
En una petición de 6.000 de entrada y 800 de salida, Grok 4.6 cuesta unos $0.0168. Flash cuesta unos $0.00106. Pro cuesta unos $0.00331. Grok es la opción a precio frontera de este lote, Flash es la de volumen, Pro es la de razonamiento más pesado y barato.
Esa es la tabla de enrutado, no un test de lealtad. Fija `grok-4.6` solo en los pasos donde la capacidad extra aparece en tu conjunto de evaluación: agentes de código de varios pasos, trazas largas de investigación, primeros borradores de apps visuales. Manda la fontanería a Flash. Escala el 10% difícil a Pro o a Grok, y mide cuál gana de verdad en tus casos.
Grok 4.6 también tiene un producto alrededor. Grok Bot, lanzado un día antes en x.ai/bot, es la apuesta de SpaceXAI de que el modelo debe llegar como un compañero con su propio ordenador, no como otra compleción de chat.
Qué hacer esta semana
Si ya usas Cursor o Grok Build, gasta la semana de uso doble en una tarea interna de verdad, detrás de un conjunto de evaluación, y guarda las trazas. Una demo de la semana de lanzamiento no es una migración.
Si estás en la API, fija el nombre fechado del modelo, registra tokens y coste por paso desde el día uno, y no dejes que un prompt de 200K tokens ocurra por accidente. La tarifa doble es el tipo de bug que parece una ejecución de agente exitosa hasta que finanzas pregunta por qué.
Si no tienes un conjunto de evaluación, ese es el proyecto. Grok 4.6, DeepSeek V4 y lo que salga en septiembre van a seguir llegando. Los equipos que los absorben son los que ya construyeron la capa fina de intercambio y las pruebas de aceptación. Una auditoría DX acotada es cómo ponemos esa capa.
---
Fuentes: Introducing Grok 4.6 · Docs de Grok 4.6 en xAI · Precios de DeepSeek