El modelo Jev ya está integrado y disponible · Te damos la bienvenida
Blog
Guía

Análisis de Grok 4.7

Grok 4.7 es una actualización al mismo precio que merece una prueba prioritaria en agentes de programación y conocimiento de larga duración, pero los resultados de xAI no sustituyen una evaluación propia.

13 min de lecturaOmniaKey
Grok 4.7Grok 4.6precio APIbenchmark de programaciónanálisis de modelos

Este análisis de Grok 4.7 llega a una conclusión más precisa que los titulares del lanzamiento. Conviene evaluarlo primero para programación de larga duración, uso de herramientas y trabajo profesional del conocimiento: mejora las siete filas de Grok 4.6 publicadas por xAI y mantiene tanto el precio estándar como el contexto de 500K. No es un ganador universal demostrado. La tabla oficial mezcla niveles de reasoning effort y no ejecutamos un benchmark propio con solicitudes facturables.

SpaceXAI lanzó grok-4.7 el 21 de septiembre de 2026. La API pública de xAI ya lo ofrece, pero OmniaKey no lo mostraba en su catálogo público al comprobarlo el día 22. Hasta que cambie el catálogo en vivo, usa Grok 4.6 en OmniaKey o un proveedor que exponga expresamente el ID exacto de 4.7.

Datos verificados el 22 de septiembre de 2026. Las especificaciones y puntuaciones de lanzamiento proceden del anuncio y la documentación para desarrolladores de SpaceXAI. Artificial Analysis ya mostraba un Intelligence Index temprano para xhigh, pero sus campos de velocidad y precio por proveedor estaban incompletos. No usamos una preview privada, credenciales de xAI ni una medición directa de latencia. Separamos resultados del fabricante, evidencia independiente y recomendación editorial.

Veredicto del análisis de Grok 4.7

Para agentes nuevos de larga duración, prueba 4.7 antes que 4.6. La señal más útil es el cambio generacional: xAI comunica un resultado superior para 4.7 en las siete comparaciones directas, con mejoras grandes en Terminal-Bench 4.0 y EEBench sin subir la tarifa estándar por token.

No migres solo por el titular. La tabla usa Grok 4.7 en xhigh, Grok 4.6 en high y los otros modelos frontier en max; el resultado DeepSWE de 4.7 lleva además una nota de high effort. El nivel puede cambiar consumo, latencia y comportamiento.

Conserva 4.6 como rollback hasta superar tus tareas. Ambas generaciones ofrecen contexto de 500K y las mismas tarifas directas. Una evaluación gradual cuesta menos que descubrir en producción una regresión de tool calls, negativas, verbosidad o formato.

Lanzamiento y especificaciones clave

DatoContrato de Grok 4.7
Fecha de lanzamiento21 de septiembre de 2026
ID del modelo APIgrok-4.7
Entrada / salidaTexto e imagen / texto
Ventana de contexto500,000 tokens
Corte de conocimientoMayo de 2026
Reasoning effortlow, medium, high (predeterminado), xhigh
APIResponses API y Chat Completions
CapacidadesFunction calling, structured outputs, web search, X search, code execution
Batch APINo compatible
Precio global directo con prompt inferior a 200K$2 entrada / $0.50 caché / $6 salida por 1M
Precio global directo con prompt de 200K o más$4 entrada / $1 caché / $12 salida por 1M

Los 500K son capacidad, no una cuota gratuita. Cuando el prompt alcanza 200K tokens, xAI aplica la tarifa superior a todos los tokens de la solicitud. La guía no fija un límite de salida de texto, pero los rate limits, la latencia, el presupuesto y el endpoint siguen limitando un flujo real.

Qué cambia frente a Grok 4.6

SpaceXAI describe un modelo base nuevo y mayor, más tiempo de reinforcement learning con tareas difíciles de varias horas, mejor self-verification y gestión de contexto largo, comprensión nativa del harness Grok Bot y una nueva capa de safeguards.

Son afirmaciones de lanzamiento, no resultados de arquitectura auditados de forma independiente. La empresa no publica el número de parámetros en el anuncio ni en el contrato actual del modelo.

DecisiónGrok 4.7Grok 4.6Consecuencia
Base / entrenamientoBase nueva y mayor; RL más largo en tareas difícilesGeneración anteriorMotivo razonable para repetir pruebas de agentes largos
Precio estándar directo$2 / $0.50 / $6$2 / $0.50 / $6Sin prima de lista al actualizar
Precio de contexto largo$4 / $1 / $12$4 / $1 / $12Misma economía desde 200K
Contexto500K500KNo aumenta la capacidad
ReasoningDe low a xhigh; high predeterminadoDe low a xhigh; high predeterminadoFija el mismo effort al comparar
BatchNo compatibleNo compatibleNo presupuestes un descuento Batch supuesto
EnfoqueCódigo, agentes, conocimiento, autocontrolCódigo y agentes de larga duraciónBusca fiabilidad, no una modalidad nueva

La mejora práctica es rendimiento declarado al mismo precio de lista, no más contexto ni tokens más baratos. La guía de precios API de Grok 4.6 conserva el cálculo detallado para la ruta disponible actualmente en OmniaKey.

Benchmarks de Grok 4.7: qué dicen realmente

Estos resultados son publicados por SpaceXAI y OmniaKey no los reprodujo. El fabricante muestra 4.7 en xhigh, 4.6 en high, GPT-5.6 Sol en max y Fable 5.1 en max; el asterisco indica que DeepSWE de 4.7 usó high effort.

EvaluaciónGrok 4.7Grok 4.6GPT-5.6 SolFable 5.14.7 frente a 4.6
CursorBench 4.046.3%40.4%41.7%51.8%+5.9 pp
DeepSWE v1.171.0%*65.2%72.7%70.0%+5.8 pp
EEBench64.0%53.0%39.4%56.4%+11.0 pp
AA Briefcase v1.11,6571,5461,4871,678+111 Elo
Terminal-Bench 4.038.0%20.3%37.3%57.9%+17.7 pp
Harvey Legal Agent Benchmark19.6%15.8%2.5%6.7%+3.8 pp
HealthBench Professional56.7%48.5%60.5%62.1%+8.2 pp

La tabla sostiene una afirmación sólida: en la configuración de xAI, 4.7 mejora a 4.6 en todas las familias mostradas. No sostiene que “Grok 4.7 supera a todos los modelos”. Fable lidera CursorBench, AA Briefcase, Terminal-Bench y HealthBench; GPT-5.6 Sol lidera DeepSWE. También cambian precio, effort, harness, tokens y criterio de aceptación.

Para programación, Terminal-Bench es una señal interesante porque mide trabajo de terminal de varias horas. También es donde Fable conserva la mayor ventaja. Compara el criterio de éxito y las categorías de fallo, no solo el porcentaje agregado.

Evidencia independiente disponible

Artificial Analysis ya había añadido Grok 4.7 en xhigh al verificar los datos. Su página mostraba un Intelligence Index de 46 y un uso alto de salida: 240M tokens en el índice frente a una mediana de 92M en la página.

Es una captura temprana. La velocidad de salida figuraba como N/A y los precios por proveedor no estaban completos de forma fiable. Por eso no valida la afirmación de “misma velocidad”, la variante Fast ni un coste por tarea. La puntuación puede cambiar cuando termine la ejecución o evolucione el conjunto.

  • la evidencia oficial muestra una mejora consistente de 4.6 a 4.7;
  • una suite independiente ya coloca xhigh en el rango frontier;
  • no había velocidad independiente estable, p95 ni coste emparejado con 4.6;
  • tu carga de trabajo sigue siendo la prueba decisiva.

Precio de la API de Grok 4.7 y contexto largo

Grok 4.7 mantiene la misma tarifa global directa que Grok 4.6. El límite actual es menos de 200K frente a 200K o más. No trates exactamente 200K como tarifa estándar.

RutaRango del promptEntradaEntrada en cachéSalida
xAI globalMenos de 200K$2.00$0.50$6.00
xAI global200K o más$4.00$1.00$12.00
xAI regional EE. UU.Menos de 200K$2.20$0.55$6.60
xAI regional EE. UU.200K o más$4.40$1.10$13.20

Las cifras son USD por un millón de tokens. El endpoint de EE. UU. mantiene la inferencia dentro del país y añade un 10% al precio. Tool calls, almacenamiento, impuestos, conversión y la cotización de una plataforma externa son conceptos aparte.

CargaCálculoCoste de tokens del modelo
100K entrada sin caché + 20K salida0.10 x $2 + 0.02 x $6$0.32
250K entrada sin caché + 20K salida0.25 x $4 + 0.02 x $12$1.24
50K sin caché + 200K caché + 20K salida0.05 x $4 + 0.20 x $1 + 0.02 x $12$0.64

El precio de caché solo se aplica si el proveedor informa un cache hit. xAI recomienda prompt_cache_key en Responses o x-grok-conv-id en Chat Completions para que turnos relacionados lleguen al mismo servidor. Compactar el contexto importa en bucles largos: repetir un prompt de 200K o más duplica las tres tarifas.

La variante Fast exige leer la tabla

Grok 4.7 Fast es el mismo modelo servido en infraestructura más rápida. Solo está disponible en Cursor y Grok Build, no en la API pública de xAI ni en el nivel gratuito de Grok Build.

La página de precios dice “dos veces la tarifa estándar”, pero su tabla muestra $4 / $1 / $12 por debajo de 200K y $6 / $1.50 / $18 desde 200K. La segunda fila es 1.5 veces la tarifa pública de contexto largo, no 2 veces. Cita la tabla y revisa la factura real antes de un lote grande. Cursor factura su variante mediante su propio plan.

“El doble de velocidad de salida” también es una afirmación del proveedor, no una garantía de latencia. El throughput de decodificación no incluye cola, prefill, primer token, herramientas, red ni reintentos.

Detalles de API importantes para un agente

La Responses API devuelve reasoning.encrypted_content con grok-4.7 aunque include no lo solicite. Devuelve esos elementos sin cambios en el siguiente turno para conservar el estado de razonamiento. Chat Completions mantiene su comportamiento.

Antes de migrar, verifica:

  1. el ID devuelto y el endpoint exactos;
  2. el mismo reasoning_effort en ambas generaciones;
  3. validez del schema de tool calls y reintentos;
  4. tokens de prompt, caché, reasoning y salida visible;
  5. primer token, tiempo total y coste por tarea aceptada;
  6. longitud de salida, porque xhigh puede gastar más tokens;
  7. rollback a grok-4.6 sin cambiar el harness.

Solicitud directa a xAI Responses:

bash
curl https://api.x.ai/v1/responses \
  -H "Authorization: Bearer $XAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-4.7",
    "prompt_cache_key": "repo-review-v1",
    "input": "Review this patch, run the acceptance criteria, and report any remaining failure."
  }'

Usa una clave de caché estable y no secreta; no incluyas API keys, correo, secretos del repositorio ni IDs de clientes. Esta URL y credential son para xAI directo, no una configuración de OmniaKey.

Dónde está disponible Grok 4.7

PlataformaEstado el 22 de septiembre de 2026Límite importante
xAI APIDisponible como grok-4.7Variante estándar; Fast no es API pública
Grok BuildModelo predeterminadoFast es de pago y no entra en el nivel gratuito
CursorDisponible en todos los planes según xAIFast se factura según el plan de Cursor
GitHub CopilotDespliegue gradual anunciadoPro, Pro+, Max, Business, Enterprise; una policy puede desactivarlo
OpenRouter, Vercel, CloudflarexAI los enumera como gatewaysCada uno controla ruta, precio y disponibilidad
OmniaKeyNo listado al verificarConsulta el catálogo de modelos en vivo; no inventes una ruta

GitHub incluye VS Code, Visual Studio, Copilot CLI, cloud agent, Copilot app, JetBrains, Xcode y Eclipse. Un despliegue gradual no implica que todos los usuarios lo vean inmediatamente.

Prueba reproducible de Grok 4.6 frente a 4.7

Elige entre 20 y 50 tareas de tu distribución real de fallos, no solo prompts fáciles. Congela revisión del repositorio, system prompt, herramientas, permisos, effort, timeout y comandos de aceptación.

  • aceptada sin reparación, tras reintento o fallida;
  • errores de schema, ediciones incorrectas, tests fallidos, negativas y bucles;
  • tokens de entrada, caché, reasoning y salida;
  • latencia de primer token y total en p50 y p95;
  • ID reportado y total facturado;
  • minutos de revisión o reparación humana.

Elige 4.7 si mejora el coste por tarea aceptada o reduce fallos importantes. Conserva 4.6 si empatan y su ruta es operativamente más simple. Para comparar familias, consulta la guía de modelos para agentes de programación.

Errores frecuentes al analizar Grok 4.7

Llamar independientes a los resultados del fabricante

La tabla es útil, pero SpaceXAI seleccionó y ejecutó las pruebas. Atribuye el origen y muestra los niveles de effort.

Afirmar que tiene 2.1T parámetros

La cifra circuló antes del lanzamiento, pero el anuncio y el contrato actual no publican un número. Solo está confirmado “un modelo base nuevo y mayor”.

Tratar 500K de contexto como gratis

Es capacidad máxima. Al llegar a 200K tokens, toda la solicitud entra en el nivel de precio superior.

Suponer que Fast es un ID de API pública

Es una opción de serving en Cursor y Grok Build. La API pública documenta grok-4.7, no un slug Fast.

Suponer que lanzamiento equivale a disponibilidad en OmniaKey

El lanzamiento del proveedor y el alta en un gateway son eventos distintos. No había una ruta pública 4.7 en OmniaKey en la fecha de revisión.

Preguntas frecuentes

¿Cuándo salió Grok 4.7?

SpaceXAI lo lanzó el 21 de septiembre de 2026. El ID directo de API es grok-4.7.

¿Es Grok 4.7 mejor que Grok 4.6?

Es el candidato más fuerte para probar primero. xAI publica mejores resultados en todas sus comparaciones con 4.6 al mismo precio directo. Aun así, effort, tokens, herramientas y fallos obligan a una prueba emparejada.

¿Cuánto cuesta la API de Grok 4.7?

En el endpoint global, menos de 200K cuesta $2 de entrada, $0.50 de caché y $6 de salida por millón. Desde 200K cuesta $4, $1 y $12.

¿Cuál es la ventana de contexto de Grok 4.7?

500,000 tokens. La guía actual no fija un límite de salida de texto, aunque siguen existiendo límites de tasa, tiempo y presupuesto.

¿Cuántos parámetros tiene Grok 4.7?

SpaceXAI no publica una cifra en el anuncio ni en la página del modelo. Solo confirma una base nueva y mayor que la de 4.6.

¿Admite imágenes y herramientas?

Sí. Acepta texto e imágenes, genera texto y documenta function calling, structured output, web search, X search y code execution.

¿Está Grok 4.7 disponible en OmniaKey?

No al verificar el 22 de septiembre. El catálogo público mostraba Grok 4.6 y 4.5, no grok-4.7. Consulta el catálogo en vivo.

Fuentes consultadas

Datos verificados el 22 de septiembre de 2026. Disponibilidad, resultados dinámicos, precios y despliegues pueden cambiar; revisa las fuentes primarias y el catálogo antes de migrar producción.