Análisis de Grok 4.7
Grok 4.7 es una actualización al mismo precio que merece una prueba prioritaria en agentes de programación y conocimiento de larga duración, pero los resultados de xAI no sustituyen una evaluación propia.
Este análisis de Grok 4.7 llega a una conclusión más precisa que los titulares del lanzamiento. Conviene evaluarlo primero para programación de larga duración, uso de herramientas y trabajo profesional del conocimiento: mejora las siete filas de Grok 4.6 publicadas por xAI y mantiene tanto el precio estándar como el contexto de 500K. No es un ganador universal demostrado. La tabla oficial mezcla niveles de reasoning effort y no ejecutamos un benchmark propio con solicitudes facturables.
SpaceXAI lanzó grok-4.7 el 21 de septiembre de 2026. La API pública de xAI ya lo ofrece, pero OmniaKey no lo mostraba en su catálogo público al comprobarlo el día 22. Hasta que cambie el catálogo en vivo, usa Grok 4.6 en OmniaKey o un proveedor que exponga expresamente el ID exacto de 4.7.
Datos verificados el 22 de septiembre de 2026. Las especificaciones y puntuaciones de lanzamiento proceden del anuncio y la documentación para desarrolladores de SpaceXAI. Artificial Analysis ya mostraba un Intelligence Index temprano para xhigh, pero sus campos de velocidad y precio por proveedor estaban incompletos. No usamos una preview privada, credenciales de xAI ni una medición directa de latencia. Separamos resultados del fabricante, evidencia independiente y recomendación editorial.
Veredicto del análisis de Grok 4.7
Para agentes nuevos de larga duración, prueba 4.7 antes que 4.6. La señal más útil es el cambio generacional: xAI comunica un resultado superior para 4.7 en las siete comparaciones directas, con mejoras grandes en Terminal-Bench 4.0 y EEBench sin subir la tarifa estándar por token.
No migres solo por el titular. La tabla usa Grok 4.7 en xhigh, Grok 4.6 en high y los otros modelos frontier en max; el resultado DeepSWE de 4.7 lleva además una nota de high effort. El nivel puede cambiar consumo, latencia y comportamiento.
Conserva 4.6 como rollback hasta superar tus tareas. Ambas generaciones ofrecen contexto de 500K y las mismas tarifas directas. Una evaluación gradual cuesta menos que descubrir en producción una regresión de tool calls, negativas, verbosidad o formato.
Lanzamiento y especificaciones clave
| Dato | Contrato de Grok 4.7 |
|---|---|
| Fecha de lanzamiento | 21 de septiembre de 2026 |
| ID del modelo API | grok-4.7 |
| Entrada / salida | Texto e imagen / texto |
| Ventana de contexto | 500,000 tokens |
| Corte de conocimiento | Mayo de 2026 |
| Reasoning effort | low, medium, high (predeterminado), xhigh |
| API | Responses API y Chat Completions |
| Capacidades | Function calling, structured outputs, web search, X search, code execution |
| Batch API | No compatible |
| Precio global directo con prompt inferior a 200K | $2 entrada / $0.50 caché / $6 salida por 1M |
| Precio global directo con prompt de 200K o más | $4 entrada / $1 caché / $12 salida por 1M |
Los 500K son capacidad, no una cuota gratuita. Cuando el prompt alcanza 200K tokens, xAI aplica la tarifa superior a todos los tokens de la solicitud. La guía no fija un límite de salida de texto, pero los rate limits, la latencia, el presupuesto y el endpoint siguen limitando un flujo real.
Qué cambia frente a Grok 4.6
SpaceXAI describe un modelo base nuevo y mayor, más tiempo de reinforcement learning con tareas difíciles de varias horas, mejor self-verification y gestión de contexto largo, comprensión nativa del harness Grok Bot y una nueva capa de safeguards.
Son afirmaciones de lanzamiento, no resultados de arquitectura auditados de forma independiente. La empresa no publica el número de parámetros en el anuncio ni en el contrato actual del modelo.
| Decisión | Grok 4.7 | Grok 4.6 | Consecuencia |
|---|---|---|---|
| Base / entrenamiento | Base nueva y mayor; RL más largo en tareas difíciles | Generación anterior | Motivo razonable para repetir pruebas de agentes largos |
| Precio estándar directo | $2 / $0.50 / $6 | $2 / $0.50 / $6 | Sin prima de lista al actualizar |
| Precio de contexto largo | $4 / $1 / $12 | $4 / $1 / $12 | Misma economía desde 200K |
| Contexto | 500K | 500K | No aumenta la capacidad |
| Reasoning | De low a xhigh; high predeterminado | De low a xhigh; high predeterminado | Fija el mismo effort al comparar |
| Batch | No compatible | No compatible | No presupuestes un descuento Batch supuesto |
| Enfoque | Código, agentes, conocimiento, autocontrol | Código y agentes de larga duración | Busca fiabilidad, no una modalidad nueva |
La mejora práctica es rendimiento declarado al mismo precio de lista, no más contexto ni tokens más baratos. La guía de precios API de Grok 4.6 conserva el cálculo detallado para la ruta disponible actualmente en OmniaKey.
Benchmarks de Grok 4.7: qué dicen realmente
Estos resultados son publicados por SpaceXAI y OmniaKey no los reprodujo. El fabricante muestra 4.7 en xhigh, 4.6 en high, GPT-5.6 Sol en max y Fable 5.1 en max; el asterisco indica que DeepSWE de 4.7 usó high effort.
| Evaluación | Grok 4.7 | Grok 4.6 | GPT-5.6 Sol | Fable 5.1 | 4.7 frente a 4.6 |
|---|---|---|---|---|---|
| CursorBench 4.0 | 46.3% | 40.4% | 41.7% | 51.8% | +5.9 pp |
| DeepSWE v1.1 | 71.0%* | 65.2% | 72.7% | 70.0% | +5.8 pp |
| EEBench | 64.0% | 53.0% | 39.4% | 56.4% | +11.0 pp |
| AA Briefcase v1.1 | 1,657 | 1,546 | 1,487 | 1,678 | +111 Elo |
| Terminal-Bench 4.0 | 38.0% | 20.3% | 37.3% | 57.9% | +17.7 pp |
| Harvey Legal Agent Benchmark | 19.6% | 15.8% | 2.5% | 6.7% | +3.8 pp |
| HealthBench Professional | 56.7% | 48.5% | 60.5% | 62.1% | +8.2 pp |
La tabla sostiene una afirmación sólida: en la configuración de xAI, 4.7 mejora a 4.6 en todas las familias mostradas. No sostiene que “Grok 4.7 supera a todos los modelos”. Fable lidera CursorBench, AA Briefcase, Terminal-Bench y HealthBench; GPT-5.6 Sol lidera DeepSWE. También cambian precio, effort, harness, tokens y criterio de aceptación.
Para programación, Terminal-Bench es una señal interesante porque mide trabajo de terminal de varias horas. También es donde Fable conserva la mayor ventaja. Compara el criterio de éxito y las categorías de fallo, no solo el porcentaje agregado.
Evidencia independiente disponible
Artificial Analysis ya había añadido Grok 4.7 en xhigh al verificar los datos. Su página mostraba un Intelligence Index de 46 y un uso alto de salida: 240M tokens en el índice frente a una mediana de 92M en la página.
Es una captura temprana. La velocidad de salida figuraba como N/A y los precios por proveedor no estaban completos de forma fiable. Por eso no valida la afirmación de “misma velocidad”, la variante Fast ni un coste por tarea. La puntuación puede cambiar cuando termine la ejecución o evolucione el conjunto.
- la evidencia oficial muestra una mejora consistente de 4.6 a 4.7;
- una suite independiente ya coloca xhigh en el rango frontier;
- no había velocidad independiente estable, p95 ni coste emparejado con 4.6;
- tu carga de trabajo sigue siendo la prueba decisiva.
Precio de la API de Grok 4.7 y contexto largo
Grok 4.7 mantiene la misma tarifa global directa que Grok 4.6. El límite actual es menos de 200K frente a 200K o más. No trates exactamente 200K como tarifa estándar.
| Ruta | Rango del prompt | Entrada | Entrada en caché | Salida |
|---|---|---|---|---|
| xAI global | Menos de 200K | $2.00 | $0.50 | $6.00 |
| xAI global | 200K o más | $4.00 | $1.00 | $12.00 |
| xAI regional EE. UU. | Menos de 200K | $2.20 | $0.55 | $6.60 |
| xAI regional EE. UU. | 200K o más | $4.40 | $1.10 | $13.20 |
Las cifras son USD por un millón de tokens. El endpoint de EE. UU. mantiene la inferencia dentro del país y añade un 10% al precio. Tool calls, almacenamiento, impuestos, conversión y la cotización de una plataforma externa son conceptos aparte.
| Carga | Cálculo | Coste de tokens del modelo |
|---|---|---|
| 100K entrada sin caché + 20K salida | 0.10 x $2 + 0.02 x $6 | $0.32 |
| 250K entrada sin caché + 20K salida | 0.25 x $4 + 0.02 x $12 | $1.24 |
| 50K sin caché + 200K caché + 20K salida | 0.05 x $4 + 0.20 x $1 + 0.02 x $12 | $0.64 |
El precio de caché solo se aplica si el proveedor informa un cache hit. xAI recomienda prompt_cache_key en Responses o x-grok-conv-id en Chat Completions para que turnos relacionados lleguen al mismo servidor. Compactar el contexto importa en bucles largos: repetir un prompt de 200K o más duplica las tres tarifas.
La variante Fast exige leer la tabla
Grok 4.7 Fast es el mismo modelo servido en infraestructura más rápida. Solo está disponible en Cursor y Grok Build, no en la API pública de xAI ni en el nivel gratuito de Grok Build.
La página de precios dice “dos veces la tarifa estándar”, pero su tabla muestra $4 / $1 / $12 por debajo de 200K y $6 / $1.50 / $18 desde 200K. La segunda fila es 1.5 veces la tarifa pública de contexto largo, no 2 veces. Cita la tabla y revisa la factura real antes de un lote grande. Cursor factura su variante mediante su propio plan.
“El doble de velocidad de salida” también es una afirmación del proveedor, no una garantía de latencia. El throughput de decodificación no incluye cola, prefill, primer token, herramientas, red ni reintentos.
Detalles de API importantes para un agente
La Responses API devuelve reasoning.encrypted_content con grok-4.7 aunque include no lo solicite. Devuelve esos elementos sin cambios en el siguiente turno para conservar el estado de razonamiento. Chat Completions mantiene su comportamiento.
Antes de migrar, verifica:
- el ID devuelto y el endpoint exactos;
- el mismo
reasoning_efforten ambas generaciones; - validez del schema de tool calls y reintentos;
- tokens de prompt, caché, reasoning y salida visible;
- primer token, tiempo total y coste por tarea aceptada;
- longitud de salida, porque xhigh puede gastar más tokens;
- rollback a
grok-4.6sin cambiar el harness.
Solicitud directa a xAI Responses:
curl https://api.x.ai/v1/responses \
-H "Authorization: Bearer $XAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-4.7",
"prompt_cache_key": "repo-review-v1",
"input": "Review this patch, run the acceptance criteria, and report any remaining failure."
}'
Usa una clave de caché estable y no secreta; no incluyas API keys, correo, secretos del repositorio ni IDs de clientes. Esta URL y credential son para xAI directo, no una configuración de OmniaKey.
Dónde está disponible Grok 4.7
| Plataforma | Estado el 22 de septiembre de 2026 | Límite importante |
|---|---|---|
| xAI API | Disponible como grok-4.7 | Variante estándar; Fast no es API pública |
| Grok Build | Modelo predeterminado | Fast es de pago y no entra en el nivel gratuito |
| Cursor | Disponible en todos los planes según xAI | Fast se factura según el plan de Cursor |
| GitHub Copilot | Despliegue gradual anunciado | Pro, Pro+, Max, Business, Enterprise; una policy puede desactivarlo |
| OpenRouter, Vercel, Cloudflare | xAI los enumera como gateways | Cada uno controla ruta, precio y disponibilidad |
| OmniaKey | No listado al verificar | Consulta el catálogo de modelos en vivo; no inventes una ruta |
GitHub incluye VS Code, Visual Studio, Copilot CLI, cloud agent, Copilot app, JetBrains, Xcode y Eclipse. Un despliegue gradual no implica que todos los usuarios lo vean inmediatamente.
Prueba reproducible de Grok 4.6 frente a 4.7
Elige entre 20 y 50 tareas de tu distribución real de fallos, no solo prompts fáciles. Congela revisión del repositorio, system prompt, herramientas, permisos, effort, timeout y comandos de aceptación.
- aceptada sin reparación, tras reintento o fallida;
- errores de schema, ediciones incorrectas, tests fallidos, negativas y bucles;
- tokens de entrada, caché, reasoning y salida;
- latencia de primer token y total en p50 y p95;
- ID reportado y total facturado;
- minutos de revisión o reparación humana.
Elige 4.7 si mejora el coste por tarea aceptada o reduce fallos importantes. Conserva 4.6 si empatan y su ruta es operativamente más simple. Para comparar familias, consulta la guía de modelos para agentes de programación.
Errores frecuentes al analizar Grok 4.7
Llamar independientes a los resultados del fabricante
La tabla es útil, pero SpaceXAI seleccionó y ejecutó las pruebas. Atribuye el origen y muestra los niveles de effort.
Afirmar que tiene 2.1T parámetros
La cifra circuló antes del lanzamiento, pero el anuncio y el contrato actual no publican un número. Solo está confirmado “un modelo base nuevo y mayor”.
Tratar 500K de contexto como gratis
Es capacidad máxima. Al llegar a 200K tokens, toda la solicitud entra en el nivel de precio superior.
Suponer que Fast es un ID de API pública
Es una opción de serving en Cursor y Grok Build. La API pública documenta grok-4.7, no un slug Fast.
Suponer que lanzamiento equivale a disponibilidad en OmniaKey
El lanzamiento del proveedor y el alta en un gateway son eventos distintos. No había una ruta pública 4.7 en OmniaKey en la fecha de revisión.
Preguntas frecuentes
¿Cuándo salió Grok 4.7?
SpaceXAI lo lanzó el 21 de septiembre de 2026. El ID directo de API es grok-4.7.
¿Es Grok 4.7 mejor que Grok 4.6?
Es el candidato más fuerte para probar primero. xAI publica mejores resultados en todas sus comparaciones con 4.6 al mismo precio directo. Aun así, effort, tokens, herramientas y fallos obligan a una prueba emparejada.
¿Cuánto cuesta la API de Grok 4.7?
En el endpoint global, menos de 200K cuesta $2 de entrada, $0.50 de caché y $6 de salida por millón. Desde 200K cuesta $4, $1 y $12.
¿Cuál es la ventana de contexto de Grok 4.7?
500,000 tokens. La guía actual no fija un límite de salida de texto, aunque siguen existiendo límites de tasa, tiempo y presupuesto.
¿Cuántos parámetros tiene Grok 4.7?
SpaceXAI no publica una cifra en el anuncio ni en la página del modelo. Solo confirma una base nueva y mayor que la de 4.6.
¿Admite imágenes y herramientas?
Sí. Acepta texto e imágenes, genera texto y documenta function calling, structured output, web search, X search y code execution.
¿Está Grok 4.7 disponible en OmniaKey?
No al verificar el 22 de septiembre. El catálogo público mostraba Grok 4.6 y 4.5, no grok-4.7. Consulta el catálogo en vivo.
Fuentes consultadas
- SpaceXAI: presentación de Grok 4.7
- SpaceXAI: guía de inicio de Grok 4.7
- SpaceXAI: página del modelo Grok 4.7
- SpaceXAI: precios API
- SpaceXAI: notas de versión
- Artificial Analysis: Grok 4.7 xhigh
- GitHub: Grok 4.7 en Copilot
- OpenRouter: ruta de Grok 4.7
- Catálogo en vivo de OmniaKey
Datos verificados el 22 de septiembre de 2026. Disponibilidad, resultados dinámicos, precios y despliegues pueden cambiar; revisa las fuentes primarias y el catálogo antes de migrar producción.