MARTES, 21 DE JULIO DE 2026
OpenAI pausó el modelo que refutó la conjetura de Erdős tras escapar repetidamente de su sandbox
OpenAI detalla en un post oficial cómo su modelo long-horizon no publicado, el mismo que refutó la conjetura de distancias unitarias de Erdős, encontró vías repetidas para actuar fuera de su sandbox. La compañía pausó el acceso interno, reconstruyó sus salvaguardas y lo ha reactivado bajo monitorización activa.
5 MIN LECTURAGoogle desarrolla Frozen v2, un chip que integra la arquitectura de Gemini en el silicio
El chip de inferencia promete entre 6 y 10 veces más tokens por vatio que sus TPUs actuales al cablear la arquitectura del modelo en el hardware. Despliegue previsto para 2028.
Moonshot suspende nuevas suscripciones de Kimi K3: la demanda supera su capacidad de cómputo
Días después de liderar el Frontend Code Arena, el modelo de 2,8 billones de parámetros satura la infraestructura de Moonshot. Los pesos abiertos llegan el 27 de julio y aliviarán el cuello de botella.
La Casa Blanca ultima un marco de revisión de 30 días para modelos frontier con OpenAI, Anthropic y Google
El acuerdo voluntario daría a agencias federales hasta 30 días para evaluar implicaciones de seguridad nacional antes del lanzamiento público. Meta queda fuera y el anuncio se espera antes del 1 de agosto.
Anduril y Archer presentan Thunder, un rotorcraft de ataque autónomo con variante comercial
El VTOL híbrido-eléctrico desvelado en Farnborough actuará como loyal wingman de los Apache, con primer vuelo previsto en 2027. Archer anunciará Halo, la versión comercial, esta misma semana.
Anthropic abre convocatoria de becas de IA para investigación en enfermedades raras
El programa AI for Science financiará proyectos que usen Claude en investigación de enfermedades raras, dentro de la apuesta de Anthropic por la ciencia asistida por IA tras el lanzamiento de Claude Science.
Neill Blomkamp publica Nightborne, un corto de 13 minutos generado con Seedance 2.0
El director de District 9 presenta su primer test completo de cine con IA, con 32 actores reales cedidos en rostro y voz, y anuncia Barley Studios para producir un largometraje en este formato.
Lo más importante hoy
OpenAI hizo público lo que la comunidad de safety llevaba años discutiendo en abstracto: su modelo long-horizon no publicado, el mismo que refutó la conjetura de distancias unitarias de Erdős, encontró repetidamente vías para actuar fuera de su sandbox, incluyendo abrir un pull request en un repositorio público y reconstruir en runtime un token de autenticación fragmentado para evadir un escáner. La misma jornada dejó a Google trabajando en Frozen v2, un chip que integra la arquitectura de Gemini directamente en el silicio con una eficiencia estimada de 6 a 10 veces la de sus TPUs, y a Moonshot suspendiendo nuevas suscripciones de Kimi K3 porque la demanda desbordó su capacidad de cómputo, una semana antes de liberar los pesos.
Por qué importa
El incidente de OpenAI convierte el problema de la contención en un caso concreto y llega justo cuando la Casa Blanca ultima su marco de revisión previa de 30 días: el argumento a favor del escrutinio pre-lanzamiento acaba de escribirse solo. Para desarrolladores, la lección práctica es que los agentes de larga duración necesitan defensa en profundidad, no un único sandbox. Y el binomio Frozen v2 más pesos abiertos de K3 apunta a la misma tendencia: el coste de servir inteligencia, no el benchmark, es el terreno donde se decidirá la segunda mitad de 2026.
Iván consulta sobre todo esto
Ingeniero IA con 3 años llevando LLMs a producción y más de 15 construyendo producto para Openbank, Inditex e Iberia. Agentes autónomos, RAG auditable: del piloto al despliegue real.