Una IA pública resolvió la mitad de los retos de OpenAI
OpenAI presumió de que su modelo interno Astra resolvió 10 problemas matemáticos abiertos. En menos de 24 horas, un ingeniero de Anthropic resolvió 5 con Fable, un modelo ya público. Y un matemático desmontó el 'sin avances en una década': OpenAI tuvo que corregir su anuncio.
Por DidadoY
/ En esta noticia
El sábado, OpenAI presumió de que una versión interna de Astra, su próximo gran modelo, había resuelto diez problemas matemáticos abiertos, como contamos aquí. El domingo llegaron dos jarros de agua fría desde fuera de la empresa. Uno: un ingeniero de Anthropic resolvió cinco de esos diez con un modelo que cualquiera puede usar ya. Dos: un matemático desmontó una de las frases centrales del anuncio, y OpenAI tuvo que corregirla. Ninguna de las dos cosas la contó OpenAI.
Lo que hizo un rival en 24 horas
El golpe más duro no vino de un crítico, sino de un competidor con recibo. Horas después del anuncio, Levent Alpoge, ingeniero de Anthropic, publicó que había resuelto cinco de los diez problemas usando Claude Fable, un modelo que ya está disponible al público, en menos de un día y con instrucciones genéricas. Entre ellos, según él, los de complejidad de circuitos aritméticos, repetición paralela cuántica y el problema del vector más cercano.
El detalle que pica: Astra es un modelo interno sin fecha de salida; Fable ya se puede usar. Si un modelo público hace la mitad del trabajo en 24 horas, el relato de "esto solo lo consigue nuestro próximo gran modelo" pierde fuerza. No dice que Astra no valga; dice que la distancia entre lo que se anuncia y lo que ya está en la calle es más corta de lo que sugería la nota de prensa.
La frase que OpenAI tuvo que corregir
El anuncio original decía que los diez problemas "no habían visto avances en al menos una década". No era del todo cierto. El matemático Francesco Fournier-Facio señaló que en varios casos sí había habido progreso humano relevante, y OpenAI acabó cambiando la redacción. Otro investigador, Abhishek Saha, recordó que en el empaquetado de esferas en dimensión alta los matemáticos ya habían avanzado, y que Astra construyó sobre ese trabajo.
Que la máquina se apoye en trabajo humano previo no le quita mérito; exagerar que partía de cero, sí. Es la diferencia entre "resolvió algo que llevaba parado años" y "dio el último paso de algo en lo que mucha gente llevaba avanzando". La segunda versión es la honesta, y es la que hubo que corregir a posteriori.
Lo que sigue en pie (y no es poco)
Conviene no pasarse de frenada en sentido contrario. El logro técnico aguanta: los resultados vienen con certificados verificables por máquina, y varios expertos, escépticos con el marketing, admiten que es la demostración más seria de matemáticas hechas por IA hasta la fecha. Que un rival replique la mitad en un día no rebaja el resultado; confirma que toda una generación de modelos ha cruzado un umbral a la vez.
El ruido de fondo tampoco ayuda a pensar con calma: Elon Musk llegó a decir que esto probaba que hemos llegado a la "singularidad". Eso es exactamente el tipo de titular que esta casa no compra.
La lectura sin humo
Hay dos noticias aquí, y la buena es enorme: máquinas que cierran problemas que llevaban décadas o más abiertos, con pruebas que un ordenador puede verificar. Pero la forma de contarlo importa tanto como el qué. OpenAI eligió el marco más espectacular ("nuestro modelo del futuro, en solitario, desde cero"), y en 48 horas un competidor y un par de matemáticos lo han recolocado: ni en solitario (Fable hizo la mitad), ni desde cero (había trabajo humano detrás), ni solo el modelo del futuro. Nada de esto sería visible si dependiéramos únicamente de la nota de prensa. Esa es justo la razón por la que, con la IA, conviene esperar a que hablen los de fuera antes de dar un titular por cerrado.
Fuentes: New Scientist · India Today · Xataka · 2-3 agosto 2026
¿Te ha servido? Recíbelo cada día.
Lo importante de IA y tecnología, claro y sin humo, en tu bandeja de entrada. Gratis.
/ Seguir leyendo
California estudia un botón de apagado para la IA: sin humo
Newsom ha firmado una orden ejecutiva que los titulares resumen como 'California exige un botón de apagado para la IA'. Lo que firma de verdad: un estudio con fecha (16 de noviembre) y un adelanto de las auditorías obligatorias de 2029 a 2027. Qué dice el papel, qué no, y por qué importa igual.
Por DidadoY
Google contra Meta: los números independientes dicen empate
Gemini 3.8 Flash y Muse Spark 1.3 salieron con horas de diferencia y ya hay números independientes: Meta gana en trabajo agéntico, Google en código y memoria factual, y el mejor modo de Meta ni siquiera se puede usar. Guía rápida para no comprarse el titular equivocado.
Por DidadoY
Los laboratorios de IA prometen frenar: qué hay de verdad
El CEO de Anthropic pide frenar el ritmo de la IA y ofrece algo inédito: auditores externos con mesa, credencial y acceso de empleado dentro de la empresa. Altman se sumó en horas y dice que sus modelos más potentes no se pueden desplegar con seguridad. Qué es compromiso y qué es teatro.
Por DidadoY