Noticias · IA · 25 ago. 2026

IA del día: OpenAI publica los primeros bancos de Jalapeño; no hay modelo frontera

El 25 de agosto de 2026 OpenAI publicó en Hot Chips los primeros resultados medidos de Jalapeño, su acelerador de inferencia con Broadcom. Dice 1,5–1,9 veces más trabajo por vatio y 1,7–3,6 veces menos latencia que sistemas Blackwell. No hubo un Claude, un Gemini, un Llama ni un Grok nuevo.

Hecho
25 de agosto de 2026
Lectura
7 minutos
Fuentes
3 verificables

El 25 de agosto de 2026 (día civil en Europe/Madrid que resume este digest) OpenAI no sacó un modelo. Sacó un cuaderno. En un post fechado ese martes, y en Hot Chips, escribió que Jalapeño, el ASIC de inferencia que diseña con Broadcom, ya tiene resultados medidos en InferenceX, el banco público de SemiAnalysis. Sobre GPT-OSS 120B, DeepSeek R1 y Kimi K2.5 1T dice 1,5 a 1,9 veces más trabajo de IA por vatio en el pico y 1,7 a 3,6 veces menos latencia de extremo a extremo que los sistemas comerciales de comparación, NVIDIA GB200 o GB300. Richard Ho, vicepresidente de hardware, habló a la prensa de «lo mejor de ambos mundos»: menos latencia y más caudal. No es un GPT-5.7. 01,02

Este resumen cierra con fuentes consultadas el 30 de agosto de 2026. Distingue el martes de Kiro. El Mac mini con M6 y Jetson Orin Nano 2 van en el digest de Tecnología. La respuesta iraní a Outcast va en el digest de Mundo.

registrado1,5–1,9×

más trabajo por vatio que OpenAI atribuye a Jalapeño

InferenceX, pico de caudal, GPT-OSS 120B, DeepSeek R1 y Kimi K2.5 1T frente a GB200 o GB300. Medición de OpenAI. No es un censo de tokens servidos a ChatGPT.

registrado700 W

potencia de ficha de Jalapeño

OpenAI dice que el sostenido medido quedó en 550 W o menos. GB200: 1.200 W; GB300: 1.400 W. No se comparó en público con Vera Rubin.

verificado0

modelo frontera nuevo el 25

En canales primarios de OpenAI, Anthropic, Google DeepMind, Meta, Microsoft y SpaceXAI/Cursor no hubo un sistema comparable al Grok 4.6 del 12.

Tres modelos ajenos, un banco del vendedor

OpenAI eligió tres pesos abiertos para no medir solo sus propias redes. En Kimi, el más grande del trío, se atribuye 1,5 veces más pico por vatio y 3,4 veces menos latencia. En cargas «muy interactivas» habla de 2,1 a 4,1 veces más rendimiento. Sarah Friar, directora financiera, presenta el chip como una pieza del «sistema integrado»: centros, silicio, modelos, plataforma y dispositivos. El post dice que modelos viejos ayudaron a diseñar el ASIC y que los nuevos aceleran el software. SemiAnalysis, invitado al laboratorio el mismo día, escribió que el primer token de producción «llega pronto» y que el siguiente hito es 100 MW. Eso es hoja de ruta, no un rack contado. 01,03

Volumen pequeño este año, Rubin fuera del recuadro

Ho dijo que OpenAI no espera sustituir su flota de socios. The Verge recoge «pequeños volúmenes» a finales de 2026 y una rampa en 2027, sin cifra. El diseño, según OpenAI, tardó unos 16 meses hasta el tape-out y nueve desde el primer plano hasta la fábrica. Eso no prueba que el chip ya sirva a ChatGPT. Prueba que el laboratorio publicó un banco. 02

Martes de silicio, no de frontera

Kiro es del lunes. El 25 no reabre Sol, Terra ni Luna. NVIDIA sí fechó un ordenador de borde; eso no es un Nemotron y no se cuenta aquí como modelo.

Qué no rompió el 25, y qué queda abierto

El martes no cambió el pelotón frontera. Dejó a OpenAI publicando un acelerador que aún no tiene recuento de unidades.

En conjunto, el 25 de agosto dejó a OpenAI midiendo su primer ASIC contra Blackwell, y al resto de laboratorios sin un sistema nuevo que anunciar.

Fuentes

Priorizamos fuentes institucionales y enlazamos la página exacta que sustenta cada afirmación.

  1. 01
  2. 02
  3. 03
    OpenAI Jalapeño: Better Than Nvidia Blackwell

    SemiAnalysis · periodística · Consultada el 2026-08-30

Publicado el 30 de agosto de 2026 · Actualizado el 30 de agosto de 2026 · Sin correcciones registradas