El 25 de agosto de 2026 (día civil en Europe/Madrid que resume este digest) OpenAI no sacó un modelo. Sacó un cuaderno. En un post fechado ese martes, y en Hot Chips, escribió que Jalapeño, el ASIC de inferencia que diseña con Broadcom, ya tiene resultados medidos en InferenceX, el banco público de SemiAnalysis. Sobre GPT-OSS 120B, DeepSeek R1 y Kimi K2.5 1T dice 1,5 a 1,9 veces más trabajo de IA por vatio en el pico y 1,7 a 3,6 veces menos latencia de extremo a extremo que los sistemas comerciales de comparación, NVIDIA GB200 o GB300. Richard Ho, vicepresidente de hardware, habló a la prensa de «lo mejor de ambos mundos»: menos latencia y más caudal. No es un GPT-5.7. 01,02
Este resumen cierra con fuentes consultadas el 30 de agosto de 2026. Distingue el martes de Kiro. El Mac mini con M6 y Jetson Orin Nano 2 van en el digest de Tecnología. La respuesta iraní a Outcast va en el digest de Mundo.
más trabajo por vatio que OpenAI atribuye a Jalapeño
InferenceX, pico de caudal, GPT-OSS 120B, DeepSeek R1 y Kimi K2.5 1T frente a GB200 o GB300. Medición de OpenAI. No es un censo de tokens servidos a ChatGPT.
potencia de ficha de Jalapeño
OpenAI dice que el sostenido medido quedó en 550 W o menos. GB200: 1.200 W; GB300: 1.400 W. No se comparó en público con Vera Rubin.
modelo frontera nuevo el 25
En canales primarios de OpenAI, Anthropic, Google DeepMind, Meta, Microsoft y SpaceXAI/Cursor no hubo un sistema comparable al Grok 4.6 del 12.
Tres modelos ajenos, un banco del vendedor
OpenAI eligió tres pesos abiertos para no medir solo sus propias redes. En Kimi, el más grande del trío, se atribuye 1,5 veces más pico por vatio y 3,4 veces menos latencia. En cargas «muy interactivas» habla de 2,1 a 4,1 veces más rendimiento. Sarah Friar, directora financiera, presenta el chip como una pieza del «sistema integrado»: centros, silicio, modelos, plataforma y dispositivos. El post dice que modelos viejos ayudaron a diseñar el ASIC y que los nuevos aceleran el software. SemiAnalysis, invitado al laboratorio el mismo día, escribió que el primer token de producción «llega pronto» y que el siguiente hito es 100 MW. Eso es hoja de ruta, no un rack contado. 01,03
Volumen pequeño este año, Rubin fuera del recuadro
Ho dijo que OpenAI no espera sustituir su flota de socios. The Verge recoge «pequeños volúmenes» a finales de 2026 y una rampa en 2027, sin cifra. El diseño, según OpenAI, tardó unos 16 meses hasta el tape-out y nueve desde el primer plano hasta la fábrica. Eso no prueba que el chip ya sirva a ChatGPT. Prueba que el laboratorio publicó un banco. 02
Martes de silicio, no de frontera
Kiro es del lunes. El 25 no reabre Sol, Terra ni Luna. NVIDIA sí fechó un ordenador de borde; eso no es un Nemotron y no se cuenta aquí como modelo.
Qué no rompió el 25, y qué queda abierto
El martes no cambió el pelotón frontera. Dejó a OpenAI publicando un acelerador que aún no tiene recuento de unidades.
En conjunto, el 25 de agosto dejó a OpenAI midiendo su primer ASIC contra Blackwell, y al resto de laboratorios sin un sistema nuevo que anunciar.
Fuentes
Priorizamos fuentes institucionales y enlazamos la página exacta que sustenta cada afirmación.
- 01Jalapeño’s first results show industry-leading speed and efficiency in AI inference ↗
OpenAI · primaria · Consultada el 2026-08-30
- 02OpenAI says its Jalapeño chip can power faster AI responses than the competition ↗
The Verge · periodística · Consultada el 2026-08-30
- 03OpenAI Jalapeño: Better Than Nvidia Blackwell ↗
SemiAnalysis · periodística · Consultada el 2026-08-30