El 4 de septiembre de 2026 (día civil en Europe/Madrid que resume este digest) Anthropic no sacó un Claude nuevo. Sacó una formalización. En un post de investigación fechado ese viernes escribió que Claude produjo «la primera prueba completa comprobada por ordenador» del último teorema de Fermat: 11 días de trabajo «en gran parte autónomo», el lenguaje Lean, 13 millones de líneas y 29.500 teoremas intermedios en la prueba final. Tianyi Peng, investigador de Anthropic con un grupo en Columbia, quería ver si Claude avanzaba; el resultado, dice la empresa, fue más lejos. No es una demostración nueva del teorema: es una versión que un asistente de pruebas puede verificar. El primer argumento aceptado por la comunidad es el de Andrew Wiles, publicado en 1995 con Richard Taylor. 01,02,03
El mismo viernes, Google escribió que Lyria 3.5 —«nuestro modelo de generación musical con mejor sonido», dice— está disponible en la aplicación Gemini y en la API. Android Authority precisa que el modelo había salido más de un mes atrás en Flow Music; el viernes es el mostrador de Gemini, no el debut del sistema. Este resumen cierra con fuentes consultadas el 5 de septiembre de 2026. Distingue el viernes de GPT-6 Astra, de Gemini 3.8 Flash y Muse Spark 1.3 y de Fable 5.1. El pacto NVIDIA–Hugging Face va en el digest de Tecnología del jueves; IFA y el Galaxy S26 FE, en el de hoy. Kyiv y los enviados, en el de Mundo.
duración que Anthropic atribuye a la formalización
Trabajo «en gran parte autónomo» de agentes Claude sobre Prove2Me. Anthropic, 4 sep. No es el tiempo de Wiles en los años noventa.
líneas de Lean que Anthropic asigna a la prueba
Buzzard, tras compilar, habla de más de 13,4 millones. Anthropic avisa de que Mathlib es conciso y que esta prueba es probablemente más larga de lo necesario. No es un recuento de Mathlib.
tokens de salida que Anthropic dice haber consumido
Modelo interno de investigación «más o menos comparable» a Claude Fable 5.1. Cifra del laboratorio, no una factura pública.
Una formalización, no un teorema nuevo
Anthropic distingue este trabajo de la reciente actividad de IA sobre la hipótesis de Riemann: allí, dice, hubo matemáticas nuevas; aquí lo nuevo es la verificación. Lean exige cada paso; una prueba para humanos salta los obvios. La comunidad de Kevin Buzzard, en Imperial College London, había arrancado en 2024 un esfuerzo de varios años. Anthropic escribe que Claude terminó una prueba de extremo a extremo en 11 días, con decenas de agentes, 30.300 teoremas verificables por el camino y 29.500 en la versión final. El modelo interno consumió unos 6.000 millones de tokens de salida. La prueba, dice, usa solo los tres axiomas estándar de Lean; un comparador confirmó que el enunciado coincide con el de Mathlib. Los primeros intentos fallaron; el giro llegó con Prove2Me, plataforma de Peng y colaboradores en Columbia. Las instrucciones humanas de Peng fueron, según el post, de alto nivel: prioridades, no cada lema. 01,03
Este extraordinario logro de autoformalización […] demuestra el último teorema de Fermat sin supuestos distintos de los axiomas de las matemáticas.
Kevin Buzzard, citado por Anthropic el 4 de septiembre de 2026
En su bitácora Xena, el mismo viernes, Buzzard fue más preciso. Compiló el código y el comparador «encaja». La prueba es «gigantesca»: más de 13,4 millones de líneas y casi 20 veces el tiempo de compilación de la biblioteca matemática de Lean, en una máquina de 96 núcleos. No es el argumento moderno (Khare, Taylor y otros) que él formaliza con financiación del EPSRC: es la exposición de 1995. Escribe que, combinada con la formalización previa de los primos impares regulares —el menor primo irregular es 37—, el conjunto cubre el teorema. También escribe que el trabajo «nos dice esencialmente nada» en el plano matemático: él ya estaba «99,9 % seguro» de que la prueba de FLT está bien. Lo que sí muestra, dice, es lo que ya puede la autoformalización. SiliconANGLE resume el mismo marco: no es un paper nuevo de Wiles; es Lean. 02,03
Música en Gemini, no un modelo frontera
Google fechó el viernes la llegada de Lyria 3.5 a la aplicación Gemini y a la API: género a elegir o describir, voz o instrumental, plantillas y pistas cortas o más largas. Lo ofrece «a todos los usuarios» en la web y en el móvil, y también en Flow Music, Google AI Studio y Google Vids. «Best-sounding» es la etiqueta de Google, no un banco independiente. Android Authority, el mismo 4, sitúa el anuncio del modelo «hace algo más de un mes», entonces solo en Flow Music; el viernes abre Gemini y la API. No hay, en ese post, un Gemini 3.9 ni un Flash nuevo. 04,05
Qué no se sabe aún
El viernes no abrió Astra a Plus. Dejó una formalización, un modelo de audio en Gemini y un incidente regional de OpenAI.
La página de estado de OpenAI registró el viernes un incidente de «rendimiento degradado» para usuarios de Asia-Pacífico: más errores en ChatGPT, Work, generación de imágenes, carga de archivos, Voice y Codex Cloud. Lo abrió a las 03:00 y lo marcó como resuelto a las 06:46, según esa página. No publicó una causa raíz. No es el apagón más amplio del jueves, que la misma página dio por cerrado el 3. 06
En conjunto, el 4 de septiembre dejó a Anthropic con Fermat en Lean y a Google con un generador de música en el mostrador de Gemini, sin un modelo frontera nuevo.
Fuentes
Priorizamos fuentes institucionales y enlazamos la página exacta que sustenta cada afirmación.
- 01Formalizing Fermat's Last Theorem ↗
Anthropic · primaria · Consultada el 2026-09-05
- 02FLT: Anthropic has beaten me to it ↗
Kevin Buzzard / The Xena Project · académica · Consultada el 2026-09-05
- 03Anthropic uses Claude to formalize proof of Fermat’s Last Theorem ↗
SiliconANGLE · periodística · Consultada el 2026-09-05
- 04Create your best tracks yet with Lyria 3.5 in Gemini ↗
Google · primaria · Consultada el 2026-09-05
- 06Users in APAC region may face increased error in ChatGPT, Work, image generation, file upload, Voice, and Codex Cloud ↗
OpenAI Status · primaria · Consultada el 2026-09-05