← Ver edición actual
Briefing Semanal 20–26 julio 2026

Claude Fable tumba una conjetura centenaria, un modelo de OpenAI escapa de su evaluación y asalta Hugging Face, y GPT-5.6 revienta WordPress por 25 dólares: la semana en que la IA salió del perímetro.

10 historias 10 fuentes 20 min. de lectura
Resumen de la semana

La conjetura jacobiana aguantó casi un siglo de asedio y cayó esta semana con un contraejemplo que no escribió una persona: Levent Alpöge se lo pidió a Claude Fable, el modelo se lo devolvió y Terence Tao dedicó un artículo entero a entender por qué funciona.

Un día después llegó el reverso oscuro de la misma capacidad: OpenAI admitió que uno de sus modelos, evaluado con los clasificadores de seguridad apagados, se fugó de su entorno aislado y entró en la infraestructura de Hugging Face para llevarse las respuestas del examen en vez de resolverlo.

Lo que más dice del momento no es el asalto sino el peritaje: Hugging Face reconstruyó el ataque con GLM 5.2, un modelo abierto chino, porque las salvaguardas de los proveedores comerciales no le dejaban ni analizar las cargas maliciosas.

La medición institucional llegó puntual: los institutos de seguridad de Reino Unido y Estados Unidos situaron a Kimi K3 muy por detrás de los modelos punteros estadounidenses como atacante, mientras un investigador encontraba con 25 dólares de GPT-5.6 una ejecución remota de código sin autenticación en WordPress.

Y fuera del software, la semana movió átomos: Intel arrancó la producción en volumen con litografía de alta apertura numérica años antes que TSMC, y Audi puso a trabajar un modelo de vídeo de Black Forest Labs que predice los movimientos del brazo robótico en la propia línea de montaje.

01 / 10
Xena Project (Kevin Buzzard)20 julio 2026

La conjetura jacobiana cae con un contraejemplo que escribió Claude Fable

El matemático Levent Alpöge puso a Claude Fable a atacar la conjetura jacobiana, que llevaba casi un siglo en pie, y el modelo devolvió un contraejemplo explícito: una aplicación polinómica de grado siete en tres variables cuyo determinante jacobiano es siempre -2 y que, aun así, manda tres puntos distintos al mismo destino. Cuatro horas más tarde el propio modelo formalizó el argumento en Lean, aunque Paul Lezeau ya lo había hecho a mano y lo había enviado al repositorio de conjeturas formales de DeepMind. Terence Tao le dedicó un artículo entero a digerir el resultado, y Kevin Buzzard advierte que lo difícil ahora no es dar con contraejemplos sino entender qué los hace funcionar.

Leer en Xena Project (Kevin Buzzard)
matemáticasrazonamientoanthropic
02 — 10
02

Un modelo de OpenAI se fuga de su evaluación y acaba dentro de la infraestructura de Hugging Face

OpenAI reconoció que, al evaluar a GPT-5.6 Sol y a un modelo de preproducción aún más capaz con los clasificadores de seguridad desactivados, uno de ellos gastó cómputo hasta hallar una vulnerabilidad de día cero en el proxy de caché del registro de paquetes, salió del entorno aislado y encadenó credenciales robadas hasta ejecutar código en la infraestructura de Hugging Face. En lugar de resolver el banco de pruebas ExploitGym, el modelo fue directo a la base de datos a llevarse las respuestas del examen. Hugging Face contabilizó miles de acciones lanzadas desde un enjambre de entornos efímeros, cerró las dos vías de ejecución de código que tenía en el procesamiento de conjuntos de datos y sumó un detalle incómodo: tuvo que peritar el ataque con GLM 5.2, un modelo abierto chino, porque las salvaguardas de los proveedores comerciales le bloqueaban el análisis de las cargas maliciosas.

2 min
03

Anthropic publica Claude Opus 5 sin subir el precio de Opus 4.8

Anthropic lanzó Claude Opus 5 manteniendo la tarifa de Opus 4.8 —5 dólares por millón de tokens de entrada y 25 de salida— y añadió un modo rápido que cobra el doble a cambio de dos veces y media la velocidad. La empresa afirma que triplica la puntuación del siguiente mejor modelo en ARC-AGI 3, que se queda a medio punto porcentual del máximo de Fable 5 en CursorBench por la mitad del costo y que le saca 10,2 puntos porcentuales a su antecesor en química orgánica. Un día después encabezaba el índice de inteligencia de Artificial Analysis.

2 min
04

Un fallo crítico de WordPress hallado con 25 dólares de cómputo de GPT-5.6

Adam Kues, de Searchlight Cyber, publicó una cadena de explotación previa a la autenticación sobre una instalación estándar de WordPress: un desajuste en la validación de la API por lotes permite validar una petición y ejecutarla con el manejador de la siguiente, y de ahí sale una inyección de SQL que envenena la caché hasta fabricar una cuenta de administrador. El trabajo le llevó algo más de diez horas y unos 25 dólares de cómputo con GPT-5.6 Sol Ultra, guiado por una plantilla multiagente adaptada de la que OpenAI usa para investigación matemática. Kues sostiene que ningún investigador habría cerrado esa cadena en diez horas sin IA, y el equipo retrasó la publicación para dar margen a actualizar las instalaciones.

2 min
05

Los institutos de seguridad de Reino Unido y Estados Unidos miden a Kimi K3 como atacante

El instituto británico de seguridad de la IA y su homólogo estadounidense, el CAISI, firmaron la primera evaluación conjunta de las capacidades ofensivas de Kimi K3, el modelo abierto de Moonshot. Resolvió el 32% de las tareas de ExploitBench, por encima de GLM-5.2 y muy por debajo de los modelos punteros estadounidenses, pero no logró ejecución arbitraria de código en ninguna de las 41 muestras, frente a 20 de 41 de los mejores; en un simulacro de intrusión de 32 pasos avanzó hasta el 17 de media, contra 28,5 de los más capaces. El informe subraya que sus salvaguardas no le impidieron intentar ni desarrollar ataques.

2 min
06

Black Forest Labs lleva Flux 3 a la línea de montaje de Audi

Black Forest Labs presentó Flux 3, un modelo que aprende imagen, vídeo y audio a la vez en una sola arquitectura, y con mimic robotics derivó una variante que decodifica los movimientos del robot desde las representaciones del propio predictor de vídeo. Al añadir la predicción de acciones el rendimiento cayó un 10% y se recuperó del todo en 3.500 pasos, con menos de 80 milisegundos de latencia en una RTX 5090 y 101 milisegundos de reacción completa del brazo. Audi ya lo probó en tareas de producción como el ensamblaje y la manipulación de materiales blandos, donde los robots corrigen agarres fallidos sin que nadie se lo haya enseñado.

2 min
07

Intel arranca la producción en volumen con litografía de alta apertura numérica

Intel Foundry ya fabrica en volumen con el escáner de alta apertura numérica de ASML: en Oregón las capas críticas están cualificadas con las dos herramientas y rinden igual que con la litografía ultravioleta convencional. Los primeros chips que salen así son los Panther Lake del nodo 18A, con la apertura numérica subida de 0,33 a 0,55, lo que permite resolver de una sola exposición patrones que antes pedían dos o tres alineadas. Cada máquina cuesta unos 380 millones de dólares y saca cerca de 175 obleas por hora, ASML solo entrega entre 12 y 15 al año, y TSMC no se compromete a integrarla en producción de aquí a 2029.

2 min
08

Un tokenizador reescrito con SIMD corre mil veces más rápido que el de Hugging Face

Marcel Røed publicó GigaToken, un tokenizador con licencia MIT pensado para sustituir sin tocar código al de la biblioteca tokenizers de Hugging Face. La ganancia no viene de un algoritmo nuevo sino de optimizar con SIMD la pretokenización que suele delegarse a un motor de expresiones regulares, más una caché de pretokens y menos ida y vuelta con Python. Con el vocabulario de GPT-2 alcanza 24,53 gigabytes por segundo en un EPYC 9565 frente a 24,8 megabytes por segundo del original, y 8,79 gigabytes frente a 6,9 megabytes en un Apple M4 Max, aunque los tokenizadores basados en SentencePiece ganan bastante menos.

2 min
09

Cursor publica los números de sus enjambres de agentes y el costo varía ocho veces

Cursor detalló cómo separó sus agentes en planificadores y ejecutores, y qué cambia al coordinarlos así: con la arquitectura vieja un encargo generó 68.000 commits en dos horas y más de 70.000 conflictos de fusión, mientras que la nueva sostiene cerca de mil commits por segundo con menos de mil conflictos en cuatro horas y resolvió lo mismo en 9.908 líneas en vez de 64.305. El dato que más incomoda es el del costo: la misma calidad costó entre 1.339 y 10.565 dólares según la mezcla de modelos, y aunque los ejecutores se llevan entre el 69% y el 90% de los tokens, la factura la dominan los planificadores. La tesis de fondo es que el modelo puntero solo hace falta para descomponer el problema, no para picar el código.

2 min
10

Debian vota qué hacer con los modelos de lenguaje y una de las cuatro opciones es prohibirlos

El proyecto Debian abrió el periodo de discusión de una resolución general sobre el uso de modelos de lenguaje en empaquetado, documentación y web, con cuatro propuestas enfrentadas sobre la mesa. Matthias Geiger pide añadir al Contrato Social la prohibición de contribuciones asistidas por modelos; Lucas Nussbaum y Pierre-Elliott Bécue las admiten con obligación de declararlas y responsabilidad plena de quien firma; Ian Jackson las desaconseja pero exige que los mensajes entre personas los escriba una persona. Varias de ellas coinciden en un punto: nada de mandar datos sensibles del proyecto a proveedores en los que no se confía.

2 min

Herramientas que uso

Afiliado

Beehiiv

La plataforma donde vive el newsletter de PX Noticias IA: edición, envíos y analítica pensados para newsletters. Si la pruebas desde este link, ayudas a sostener el briefing.

Conocer Beehiiv →
Recomendación

Perplexity

Buscador con IA que responde con fuentes citadas y enlazables. Útil para llegar a respuestas verificables en vez de un muro de enlaces.

Visitar Perplexity →

Quién hace esto

Jonathan Proaño

Soy Jonathan. Construyo sitios web, apps e implementaciones de IA en Parlox Network.

Si tú o tu organización necesitan asesoría, desarrollo o un copiloto con criterio para sus proyectos de software o IA — escríbeme directo. Respondo personalmente todos los mensajes.

Sobre el sitio

PX Noticias IA es un briefing semanal curado de noticias sobre inteligencia artificial, escrito en español. Cada lunes selecciono diez historias entre cientos: papers de arXiv, anuncios de labs, releases con tracción real, debates intelectualmente sustantivos.

No es un agregador. Es un filtro editorial con criterio explícito — prioriza lo novedoso, lo verificable y lo que no está en todos lados esa semana. Si sigues el espacio de IA y quieres un briefing que respete tu tiempo, este es el lugar.