El 12 de agosto de 2026 (día civil en Europe/Madrid que resume este digest) SpaceXAI —la división antes conocida como xAI— publicó Grok 4.6, un modelo frontera pensado para agentes de larga duración, trabajo visual e interactivo y sesiones de código. El modelo quedó disponible el mismo día en Cursor, Grok Build, la API de SpaceXAI y socios como OpenRouter, Vercel y Cloudflare. No hubo, en las fichas primarias consultadas, un lanzamiento equivalente de OpenAI, Anthropic, Google DeepMind, Meta, Microsoft o NVIDIA. 0146,0246
Este resumen cierra con fuentes consultadas el 13 de agosto de 2026. Distingue lo anunciado el 12 de lo que había salido el 10–11 y seguía condicionando la agenda.
Artificial Analysis Intelligence Index
Grok 4.6 High, publicado el 12 ago.; empata con GPT-5.6 Sol Max y queda un punto por debajo de Fable 5 Max (62), según SpaceXAI y Artificial Analysis.
precio API de partida (entrada / salida)
Dólares por millón de tokens; la variante rápida cuesta el doble. El tramo de contexto largo sube esas tarifas.
uso incluido la primera semana
En Cursor y Grok Build, según los anuncios de SpaceXAI y Cursor del 12 de agosto.
retraso interno del Gemini bandera
Fuentes de Reuters el 12 ago.: pruebas internas mostraron retraso frente a rivales, sobre todo en programación. No es un comunicado de Google.
Grok 4.6: el lanzamiento frontera del 12
SpaceXAI describe Grok 4.6 como una continuación de Grok 4.5 con más énfasis en agentes que no sueltan una tarea larga: investigar, analizar, recorrer un repositorio o convertir una idea en una aplicación pulida. Cursor publicó el mismo día un anuncio conjunto y ofreció el modelo de inmediato dentro del producto, con el doble de uso incluido la primera semana. 0146,0246
En la tabla que publica SpaceXAI, Grok 4.6 High marca 61 en el Artificial Analysis Intelligence Index —un compuesto de nueve pruebas—, igual que GPT‑5.6 Sol Max y un punto por debajo de Fable 5 Max (62). Grok 4.5 High estaba en 56. Artificial Analysis, en su ficha del modelo, sitúa el mismo 61 y fecha el lanzamiento el 12 de agosto. Esas cifras miden un índice de terceros, no un veredicto de superioridad en producción. 0146,0446
En las evaluaciones de código y agentes que lista SpaceXAI, el salto respecto a Grok 4.5 es claro y el liderazgo frente a Sol y Fable no lo es. CursorBench v3.2: 69,9% (Grok 4.5: 66,7%; Fable 5 Max: 70,5%). DeepSWE v1.1: 65,9% frente a 73% de Sol Max. FrontierCode v1.1 Extended: 61,3%, por encima de Sol Max (60,6%) y por debajo de Fable (63,6%). En Terminal-Bench v3.0 el hueco es mayor: 26% frente a ~34% de Sol y Fable. SpaceXAI advierte que las cifras de rivales son el mejor resultado autoinformado o público disponible, no un experimento controlado a cuatro bandas. 0146,0346
La API parte de 2 / 6 dólares por millón de tokens (entrada / salida); hay una variante rápida al doble de precio. VentureBeat, citando documentación de la API, añade un matiz de coste: por debajo de 200.000 tokens de prompt rigen esas tarifas; a partir de ese umbral suben a 4 / 12, aplicadas a todos los tokens de la petición. El contexto anunciado llega a 500.000 tokens. No conviene extrapolar el precio de portada a una sesión larga. 0246,0346
OpenAI publica estudios, no un modelo
El 12, OpenAI difundió dos piezas complementarias sobre el uso empresarial: Enterprise Signals y el working paper How Organizations Use AI: Evidence from ChatGPT. El marco que propone la compañía es el paso de la asistencia (responder preguntas) a la ejecución (agentes que usan herramientas, crean archivos y entregan trabajo para revisión). Define «empresas frontera» como el decil superior de uso y plantea el reto de extender esos flujos más allá de unos pocos equipos. Son hallazgos del propio OpenAI sobre su base de clientes, no un censo independiente. 05
Reuters reconstruye el reajuste de Gemini
El hecho organizativo es del 5 de agosto: Demis Hassabis dejó el día a día de Google DeepMind y pasó a presidencia (y científico jefe de Alphabet); Koray Kavukcuoglu asumió la operación. El 12, Reuters —reproducido por CNA— añadió el interior: Sergey Brin habría urgido a ir «a por todas» con Gemini; pruebas internas habrían retrasado dos meses la versión bandera porque seguía por detrás en áreas como programación; el 6, en una asamblea, se comunicó que algunos equipos salían de DeepMind hacia Google corporativo. Google declinó responder a Reuters sobre la implicación de Brin, los cambios estructurales y las inquietudes de plantilla. Un portavoz sí dijo la semana previa que Kavukcuoglu tendrá la última palabra en decisiones mayores del laboratorio. 06
La pieza de Reuters se basa en siete personas familiarizadas con el desarrollo de Gemini. No es un comunicado de retraso de producto. Conviene leer el «+2 meses» como afirmación de fuentes anónimas, no como fecha de lanzamiento nueva. 06
Lo que el 11 dejó y el 12 no sustituyó
El 11, NVIDIA amplió la familia Nemotron 3 con Nemotron 3.5 Lightning, un modelo abierto orientado a agentes de baja latencia, y la biblioteca NeMo Switchyard para enrutar tareas entre modelos. Sigue siendo el último lanzamiento de producto de NVIDIA en esta ventana, no un anuncio del 12. 07
Anthropic, por su parte, ya había documentado marcas de agua embebidas en el texto de Claude y metadatos C2PA en archivos, en línea con el código de transparencia del artículo 50 del AI Act de la UE (aplicable desde el 2 de agosto). El 12, TechCrunch cubrió la reacción de usuarios que temen que esas marcas delaten el uso de Claude en el trabajo o en clase. Anthropic advierte que una marca detectada indica que Claude pudo haber procesado el texto —no que lo haya escrito entero— y que su ausencia no prueba lo contrario. 08,09
Qué no rompió el 12 — y qué queda abierto
No hubo, en las fuentes primarias consultadas para este digest, un modelo nuevo de OpenAI, Anthropic, Google, Meta o Microsoft el 12 de agosto. El día fue denso en un lanzamiento frontera de SpaceXAI, investigación empresarial de OpenAI y reconstrucción periodística del organigrama de Gemini, no en un cambio de reglas públicas.
En conjunto, el 12 de agosto dejó una señal de producto y otra de organización: SpaceXAI volvió a pelear el pelotón frontera con un modelo barato de desplegar en Cursor, y Google —según el relato de Reuters— sigue reordenando DeepMind para recuperar terreno en Gemini sin haber publicado aún esa versión retrasada.
Fuentes
Priorizamos fuentes institucionales y enlazamos la página exacta que sustenta cada afirmación.
- 01Introducing Grok 4.6 ↗
SpaceXAI · primaria · Consultada el 2026-08-13
- 02Introducing Grok 4.6 ↗
Cursor · primaria · Consultada el 2026-08-13
- 03SpaceXAI debuts Grok 4.6, overtaking Kimi K3's performance and matching GPT-5.6 Sol for world's third best on Artificial Analysis ↗
VentureBeat · periodística · Consultada el 2026-08-13
- 04Grok 4.6 (high) - Intelligence, Performance & Price Analysis ↗
Artificial Analysis · institucional · Consultada el 2026-08-13
- 05From assistance to execution: How enterprises put AI to work ↗
OpenAI · primaria · Consultada el 2026-08-13
- 06Exclusive-Inside the Google executive moves that led to its big AI reshuffle ↗
Reuters / CNA · periodística · Consultada el 2026-08-13
- 07NVIDIA Nemotron 3.5 Lightning and NeMo Switchyard Deliver Faster, Smarter, More Efficient Agentic AI ↗
NVIDIA · primaria · Consultada el 2026-08-13
- 08How Claude marks AI-generated content ↗
Anthropic · primaria · Consultada el 2026-08-13
- 09Some Claude users are mad that Anthropic's new watermarks will catch them using it at their jobs, classes ↗
TechCrunch · periodística · Consultada el 2026-08-13