SpaceXAI (la marca bajo la cual actualmente opera xAI tras su adquisición por SpaceX) ha lanzado Grok 4.5, su modelo más avanzado hasta la fecha. Diseñado expresamente para coding de nivel de producción, flujos de trabajo agentic y tareas de conocimiento profesional. El anuncio destaca la utilidad en tareas reales de ingeniería, la velocidad de inferencia y la eficiencia de tokens.
El modelo fue entrenado en colaboración directa con Cursor y se ha convertido en el modelo por defecto de Grok Build, el agente de coding de SpaceXAI. Según el anuncio oficial, se trata del modelo más fuerte de la compañía, con un enfoque deliberado en resultados prácticos de ingeniería.
Fuente primaria: Introducing Grok 4.5 | SpaceXAI
Por qué importa Grok 4.5
En el panorama actual de modelos frontier (julio 2026), frente a modelos premium como Opus 4.8, Grok 4.5 ofrece tarifas de API considerablemente más bajas y una velocidad de generación declarada de aproximadamente 80 tokens por segundo.
- Combina rendimiento competitivo en coding y tareas agentic con velocidades de modelo “flash”.
- Logra aproximadamente el doble de eficiencia de tokens que los modelos líderes comparables.
- Según SpaceXAI, también resuelve tareas en menos de la mitad de los pasos.
- Ofrece un precio base significativamente más bajo ($2 / $6 por millón de tokens) con descuentos agresivos por cache.
Para equipos de desarrollo, consultoras tecnológicas y startups que priorizan el costo de API y la velocidad de generación, estas características representan una ventaja práctica importante.
Especificaciones técnicas oficiales
| Propiedad | Valor oficial |
|---|---|
| Nombre del modelo | grok-4.5 (aliases: grok-4.5-latest, grok-build-latest) |
| Modalidades | Entrada: texto e imagen · Salida: texto |
| Ventana de contexto | 500,000 tokens |
| Knowledge cutoff | 1 de febrero de 2026 |
| Reasoning effort | Low / Medium / High (por defecto: High) |
| Velocidad de servicio | Aproximadamente 80 tokens por segundo (TPS) |
| Tools nativos | Function calling, web search, X search, code execution |
| Rate limits | 150 requests/segundo · 50,000,000 tokens/minuto |
| Regiones | us-east-1, us-west-2 |
Fuentes:
Capacidades principales
1. Coding y ingeniería de software de producción
Grok 4.5 destaca especialmente en:
- Tareas complejas en Rust, C/C++ y otros lenguajes de sistemas.
- Generación de aplicaciones completas de extremo a extremo a partir de un solo prompt (incluyendo UI, lógica y estructura de proyecto).
- Manejo de codebases grandes y flujos agentic de larga duración.
El entrenamiento conjunto con Cursor aportó datos de interacciones reales de desarrolladores. Según Cursor, estos datos permiten que el modelo aprenda tanto del software existente como de la forma en que desarrolladores y agentes trabajan dentro de un codebase.
2. Flujos agentic
El modelo fue entrenado con reinforcement learning a gran escala sobre cientos de miles de tareas multi-paso de ingeniería de software. El stack de entrenamiento asíncrono permite rollouts agentic de muchas horas mientras el aprendizaje continúa a través de decenas de miles de GPUs. El resultado es un modelo capaz de resolver tareas más grandes y difíciles manteniendo al usuario en control, y logrando resultados con aproximadamente la mitad de los pasos que otros modelos frontier.
3. Trabajo de oficina y conocimiento profesional
Grok 4.5 es el modelo por defecto en Grok Build. SpaceXAI destaca sus capacidades en herramientas de productividad:
- Excel: Modelos complejos con investigación web, fórmulas multi-hoja y notas/stickies para referencia futura.
- PowerPoint: Uso de formas nativas para diagramas complejos y diseño intuitivo de diapositivas.
- Word: Prosa clara y estructurada.
Plugins oficiales disponibles en el Microsoft Marketplace:
Entrenamiento y arquitectura
Grok 4.5 se entrenó en los data centers de SpaceXAI en Memphis utilizando decenas de miles de GPUs NVIDIA GB300. Las inversiones prioritarias fueron:
- Filtrado y curación rigurosa de datos (deduplicación, scoring de calidad y selección por dominio).
- Reinforcement learning escalado enfocado en inteligencia por token.
- Stack de entrenamiento altamente asíncrono que soporta rollouts agentic de larga duración.
El anuncio presenta la utilidad en tareas reales de ingeniería y la eficiencia por token como elementos centrales de Grok 4.5.
Velocidad y eficiencia de tokens (el verdadero diferencial)
- Servido a aproximadamente 80 TPS.
- Aproximadamente el doble de eficiencia de tokens que los modelos líderes en las mismas tareas.
- En SWE-Bench Pro: 15,954 tokens de output en promedio frente a 67,020 de Opus 4.8 (max), es decir, 4.2 veces menos tokens.
Esta combinación de velocidad y eficiencia es lo que permite a Grok 4.5 entregar “la mayor inteligencia por unidad de tiempo y costo”, según el propio anuncio oficial.
Benchmarks oficiales (datos publicados por SpaceXAI)
SpaceXAI indica que las cifras de los competidores proceden de system cards o leaderboards publicados por sus respectivos proveedores.
DeepSWE 1.0
| Modelo | Score |
|---|---|
| Fable (max) | 66.1% |
| GPT 5.5 (xhigh) | 64.31% |
| Grok 4.5 | 62.0% |
| Opus 4.8 (max) | 55.75% |
| Opus 4.7 (max) | 40.12% |
DeepSWE 1.1
| Modelo | Score |
|---|---|
| Fable (max) | 70% |
| GPT 5.5 (xhigh) | 67% |
| Opus 4.8 (max) | 59% |
| Grok 4.5 | 53% |
| GLM 5.2 | 44% |
Terminal Bench 2.1
| Modelo | Score |
|---|---|
| Fable (max) | 84.3% |
| GPT 5.5 (xhigh) | 83.4% |
| Grok 4.5 | 83.3% |
| Opus 4.8 (max) | 78.9% |
SWE-Bench Pro (resolve rate)
| Modelo | Score |
|---|---|
| Fable (max) | 80.4% |
| Opus 4.8 (max) | 69.2% |
| Grok 4.5 | 64.7% |
| Opus 4.7 (max) | 64.3% |
| GLM 5.2 | 62.1% |
| GPT 5.5 (xhigh) | 58.6% |
SWE Marathon (pass@1)
| Modelo | Score |
|---|---|
| Grok 4.5 | 29.0% |
| Opus 4.8 (max) | 26.0% |
| Fable (max) | 24.0% |
| Opus 4.7 (max) | 16.0% |
Lectura técnica: Grok 4.5 supera a Opus 4.8 en varios de los benchmarks publicados y, específicamente en SWE-Bench Pro, utiliza una fracción de sus tokens de output. Esto sugiere una ventaja potencial de costo por tarea, aunque el resultado real dependerá del workload y del harness utilizado.
Fuente de todos los benchmarks: x.ai/news/grok-4-5
Precios oficiales y consideraciones de costo
Tarifas base (por millón de tokens)
| Tipo de token | Contexto corto (< 200,000) | Contexto largo (≥ 200,000) |
|---|---|---|
| Input | $2.00 | $4.00 |
| Cached input | $0.30 | $0.60 |
| Output | $6.00 | $12.00 |
Regla crítica de facturación: Una vez que el prompt alcanza o supera los 200,000 tokens, toda la request (incluyendo los tokens anteriores) se factura a las tarifas de long context.
Costos adicionales de tools (por 1,000 invocaciones)
- Web Search: $5
- X Search: $5
- Code Execution: $5
- Collections Search: $2.50
Estos costos son relevantes en workflows agentic intensivos.
Recomendaciones oficiales de optimización de costo
- Siempre establecer
prompt_cache_key(Responses API) o el headerx-grok-conv-id(Chat Completions) para maximizar cache hits. - Para loops agentic largos, utilizar context compaction.
- Evitar requests que crucen el umbral de 200,000 de forma accidental.
Fuentes:
Disponibilidad y plataformas
Grok 4.5 está disponible de forma inmediata en:
- xAI API (modelo:
grok-4.5) → Crear API key - Grok Build (modelo por defecto) → x.ai/cli
- Cursor: disponible en todos los planes, sujeto a disponibilidad regional (Cursor todavía excluye la Unión Europea al 22 de julio de 2026)
- Plugins de Microsoft Office (Word, PowerPoint, Excel)
- Gateways de terceros: OpenRouter, Vercel, Cloudflare, Snowflake, Databricks Mosaic
Conclusión y recomendaciones prácticas
Grok 4.5 no pretende ser el modelo con la puntuación absoluta más alta en todos los leaderboards. Su propuesta de valor es más pragmática y, para muchos equipos de ingeniería, más relevante:
- Rendimiento competitivo en coding y agentic
- Velocidad de generación de clase flash
- Eficiencia de tokens excepcional (hasta 4.2 veces menos tokens en benchmarks de coding)
- Precio base significativamente más bajo que los modelos de clase Opus actuales
Para desarrolladores, equipos de producto y consultoras tecnológicas, especialmente aquellos que operan con presupuestos de API sensibles o que ejecutan workflows agentic intensivos, Grok 4.5 se perfila como una opción competitiva en la relación entre rendimiento, costo y velocidad de generación disponible en el mercado a julio de 2026.
Fuentes oficiales utilizadas:
- Introducing Grok 4.5 (16 de julio de 2026)
- Documentación del modelo
- Detalle técnico del modelo
- Página de precios
- Introducing Grok 4.5 · Cursor
- Plugins Microsoft Marketplace (Word, PowerPoint, Excel)
- Consola de desarrolladores: console.x.ai
