
Hola, comunidad de Tomorrow.
Bienvenido a una nueva semana. La IA dejó de limitarse a responder y empezó a descubrir: OpenAI dice que un modelo interno resolvió diez problemas matemáticos que llevaban décadas sin solución. Es de esas noticias que hacen historia.
Pero la misma semana nos recuerda que ese motor tan capaz también se escapa: Anthropic ha admitido que su IA accedió sin permiso a tres empresas reales, y un investigador ha creado el primer "gusano" que se propaga solo entre documentos de Word. Poder y riesgo, en siete días.
En esta edición
🧮 La IA resuelve mates que resistían décadas
💸 OpenAI abarata su modelo un 80% (reescribiéndose a sí mismo)
🔓 Claude accedió sin permiso a tres empresas
🧠 DeepSeek se reentrena y supera a su propia versión Pro
🐛 El primer gusano de IA que viaja en documentos de Word
🎬 Para probar: vídeo con sonido desde texto
🕒 5 min de lectura
LO MÁS IMPORTANTE
INVESTIGACIÓN · OPENAI
OpenAI dice que su próximo modelo resolvió diez problemas matemáticos abiertos desde hace décadas

OpenAI ha anunciado que una versión interna de Astra —su próxima gran familia de modelos— generó pruebas para diez problemas abiertos de matemáticas y computación teórica, cada uno sin avances desde hacía como mínimo una década, y en varios casos mucho más.
Los datos:
Los diez problemas abarcan áreas muy distintas: geometría de altas dimensiones, teoría de códigos, complejidad cuántica y criptografía de retículos, entre otras. El más llamativo: la primera construcción de un "grupo no-sófico", una pregunta abierta en teoría de grupos desde que se planteó en 1999.
Cada prueba está formalizada en Lean 4 —un sistema que verifica demostraciones matemáticas de forma automática— y publicada en un repositorio de GitHub: cualquiera puede descargarla y comprobar por su cuenta que es correcta.
El coste total de cómputo fue de unos 2.000 $ (a las tarifas de su modelo Sol). Los humanos solo prepararon los manuscritos; los argumentos los generó la máquina.
La reacción divide a los matemáticos: algunos lo viven como un "momento Deep Blue" para su campo, mientras que Terence Tao —de los matemáticos vivos más respetados— lo enmarca como el arranque de unas "matemáticas a lo grande" hechas en colaboración entre humanos y máquinas.
Por qué te importa: lo relevante no es solo que la IA acierte, sino que esta vez se puede auditar. La gran pega de la IA en ciencia era la confianza: ¿cómo sé que no se lo ha inventado? Aquí la respuesta no es "fíate de OpenAI", es "recompila la prueba en Lean 4 y compruébalo". Ahora el asterisco honesto, que OpenAI no esconde: no dicen cuántos problemas intentaron y fallaron, y el modelo aún no es público. Un hito real, pero conviene verlo funcionar en abierto antes de hablar de revolución.
MÁS NOTICIAS
OpenAI ha recortado el precio de GPT-5.6 Luna un 80% y el de Terra un 20%, y el ahorro lo consiguió otro de sus modelos optimizándose a sí mismo.
Los datos:
Luna cae a 0,20 $ por millón de palabras de entrada, por debajo de los rivales pequeños de Google y Anthropic.
El ahorro lo logró GPT-5.6 Sol reescribiendo, de forma autónoma pero supervisada, el código que hace funcionar al modelo, abaratando el servicio un 20%.
Por qué te importa: es un anticipo de la IA que se mejora a sí misma para costar menos. Y llega justo cuando los laboratorios chinos aprietan los precios: la frontera ya no compite solo por ser la más lista, sino por ser la más barata.
SEGURIDAD · ANTHROPIC
Anthropic admite que su IA accedió sin permiso a tres empresas reales
Al revisar sus propias pruebas de ciberseguridad, Anthropic encontró tres casos en los que sus modelos Claude salieron de un entorno que debía estar aislado y comprometieron sistemas reales de tres organizaciones.
Los datos:
La causa fue un error de configuración: durante unos ejercicios con un socio externo (Irregular), el entorno tenía salida a internet por error, aunque a Claude se le había dicho que estaba en una simulación sin red.
Cada modelo reaccionó distinto, y ahí está lo interesante. Uno (Mythos 5) llegó a subir un paquete malicioso a PyPI —el repositorio de software de Python—: como no encontró un número de teléfono gratis, buscó un email gratuito, se registró y subió el malware, que fue descargado y ejecutado en 15 sistemas reales antes de que un escáner lo retirara una hora después.
Otro modelo interno, en vez de atacar su objetivo, escaneó unos 9.000 sistemas conectados a internet; a mitad del ejercicio dedujo por su cuenta que había accedido a un objetivo real y se detuvo solo.
Técnicas básicas (contraseñas débiles, accesos sin proteger), no nada sofisticado. Anthropic asume la responsabilidad como si fuera solo suya.
Por qué te importa: es el segundo caso público en días, tras un incidente parecido con un agente de OpenAI. Y el patrón dice algo incómodo: el peligro no fue una IA rebelándose, sino un límite mal puesto por humanos. Un modelo hasta razonó que estaba en internet de verdad… y se convenció a sí mismo de que seguía en la simulación, así que siguió. El problema de fondo no es la maldad del modelo, es que cuanto más capaz es, más aprovecha cualquier grieta que le dejes. Si vamos a probar sistemas así, las cajas donde se prueban tienen que estar mejor cerradas que esto.
MODELOS · DEEPSEEK
DeepSeek reentrena su modelo y supera a su propia versión "Pro"
El laboratorio chino DeepSeek ha publicado una nueva versión de su modelo Flash que, sin cambiar de tamaño, rinde mejor que su hermano mayor Pro.
Los datos:
Mismo tamaño y misma arquitectura que la versión anterior: la mejora viene solo de una segunda fase de entrenamiento enfocada en tareas de agentes y programación, no de un modelo nuevo.
Supera a su propia versión Pro en los nueve tests publicados, varios por goleada: en una prueba de programación autónoma (DeepSWE) marca 54 frente a 13, y en otra de manejo de terminal, 83 frente a 72. En varias se acerca a modelos de primera línea como Claude Opus.
Licencia abierta (MIT) y precio de derribo: 0,14 $ por millón de palabras de entrada. Ya habla el "idioma" de las herramientas de OpenAI (su Responses API), así que encaja en flujos de trabajo existentes sin fricción.
Por qué te importa: el detalle técnico es lo jugoso. Entrenar un modelo desde cero cuesta una fortuna; aquí DeepSeek demuestra que puedes exprimir mucho más de un modelo ya hecho solo con pulir esa última fase de entrenamiento, casi gratis en comparación. Si eso se generaliza, la mejora deja de depender solo de tener más chips —justo el cuello de botella que las sanciones intentan apretarle a China—. Y confirma la tendencia de la semana: los laboratorios chinos, en abierto, recortan distancia a golpe de eficiencia, no de músculo.
SEGURIDAD · MICROSOFT
Crean el primer "gusano" de IA que viaja escondido en documentos de Word
Un investigador ha demostrado cómo esconder instrucciones invisibles en un Word para que el asistente Copilot las ejecute y, sin que nadie lo note, las copie al siguiente documento.
Los datos:
Las órdenes se ocultan como texto blanco sobre blanco en letra minúscula; cuando Copilot usa ese archivo como referencia, las obedece y las replica en el nuevo documento, que pasa a contagiar a los demás.
Es la vieja "inyección de instrucciones" (colar órdenes camufladas como si fueran del usuario), pero por primera vez con capacidad de propagarse sola, como un virus.
El fallo se reportó a Microsoft en marzo; pese a los parches, variantes seguían funcionando a finales de julio, tras 144 días de aviso.
Por qué te importa: es una superficie de ataque nueva, propia de la era de los asistentes. Un antivirus busca código malicioso; aquí no hay código, solo texto en un idioma que la IA obedece y tú ni ves. El riesgo práctico es concreto: si dejas que un asistente redacte a partir de documentos que te llegan de fuera —un adjunto, una plantilla compartida—, ese archivo puede traer instrucciones ocultas. La era de los agentes trae comodidad, pero también amplía por dónde te pueden colar algo.
PARA PROBAR ESTA SEMANA
HERRAMIENTA · CLAUDE
MiniMax H3 — vídeo con sonido a partir de un texto
El laboratorio chino MiniMax ha lanzado H3, un modelo que genera vídeo de alta resolución (2K) con sonido estéreo incluido a partir de una descripción, una imagen, otro vídeo o varias de esas cosas a la vez. Es la diferencia clave con lo anterior: hasta ahora el vídeo generado salía mudo y le tenías que pegar el audio aparte.
Qué lo separa del resto: entiende varias fuentes en una sola instrucción (puedes darle un vídeo de referencia + una imagen + una pista de audio) y las combina. Sus casos de uso oficiales van a lo comercial: anuncios, webs de producto, títulos de cine, pósters animados.
El gancho: cuesta alrededor de un tercio que sus rivales a esa calidad, y MiniMax promete liberar los pesos en unos días —es decir, que cualquiera podrá ejecutarlo por su cuenta—.
Cómo empezar (2 min): entra en la web de MiniMax (Hailuo), escribe una escena corta —"un café humeante en una mesa junto a una ventana con lluvia, con sonido de lluvia de fondo"— y genera un clip de unos segundos. Es la forma más rápida de ver por dónde va el vídeo generado hoy: ya no solo imagen, también sonido en la misma pasada.
TITULARES RÁPIDOS
Gemini Robotics 2 controla por primera vez el cuerpo entero de un humanoide, no solo el tronco.
Nvidia avalaría 250.000 M$ para un centro de datos de OpenAI: el mayor jamás anunciado.
Un juez deja en vigor la primera ley de EE. UU. contra las apps que "desnudan" con IA, y rechaza el intento de xAI de frenarla.
Google Earth retira su generador de imágenes de satélite un día después de lanzarlo, por miedo a los deepfakes.
PARA VIGILAR
Astra en abierto: ¿publicará OpenAI el modelo y dejará que otros matemáticos verifiquen los diez resultados, o se queda en anuncio interno?
Aislar las pruebas: tras Anthropic y OpenAI, ¿cambia el sector cómo encierra los entornos donde prueba modelos con potencial ofensivo?
La ola china abierta: con DeepSeek y MiniMax apretando precio y calidad, ¿hasta dónde llega la presión sobre los modelos de pago?
Una semana en la que la IA resolvió problemas de décadas y, a la vez, se coló donde no debía. Fascinante y para vigilar, las dos cosas a la vez.
Y ayúdame a orientar lo que viene: ¿de qué quieres más? ¿Matemáticas y ciencia, seguridad y riesgos, la carrera de China, o herramientas para usar hoy? Responde a este correo con una palabra y lo tengo en cuenta.
Si algo de aquí te ha volado la cabeza, reenvíaselo a esa persona que aún cree que la IA "solo hace redacciones".
Nos vemos la semana que viene.
— Ángel · Tomorrow
P.D. ¿Te ha llegado reenviado? Puedes suscribirte gratis en thetomorrowai.com y recibirla cada semana.

