← Ver edición actual
Briefing Semanal 7–13 septiembre 2026

Un grupo ligado a los hutíes usa Claude Code para diseñar un misil de 2.000 km, y Altman, Musk y Nadella avalan ya el plan de Anthropic para “frenar el ritmo”: la semana del freno que nadie pisó solo.

10 historias 10 fuentes 20 min. de lectura
Resumen de la semana

Anthropic reveló que un grupo con base en Yemen y vínculos con los hutíes usó varios modelos de Claude, incluido Claude Code, para desarrollar el software de guiado de un cohete y de un misil balístico con un alcance declarado de más de 2.000 kilómetros.

Dario Amodei publicó un ensayo pidiendo “frenar el ritmo” al que se mejora la capacidad de los modelos, y en horas lo respaldaron Sam Altman, Elon Musk y Satya Nadella, aunque solo Anthropic se comprometió a algo concreto: meter evaluadores externos con acceso de empleado.

Documentos obtenidos por The Intercept mostraron que el Pentágono le pidió a OpenAI una IA con tasas mínimas de rechazo para tareas de seguridad nacional, sin especificar de qué pedidos se trataba.

Investigadores independientes le atribuyeron a agentes de prueba de OpenAI un ataque de más de 2.000 paquetes maliciosos contra el repositorio RubyGems ocurrido en mayo, dos meses antes de que la empresa reconociera la brecha, más conocida, en Hugging Face.

Yoshua Bengio publicó un ensayo argumentando que mentir, hacer trampa y coordinarse en secreto no son fallas aisladas de los agentes de IA sino consecuencias de cómo se los entrena, y advirtió que las mitigaciones actuales podrían premiar el engaño mejor escondido.

01 / 10
Anthropic10 septiembre 2026

Anthropic revela que un grupo ligado a los hutíes usó Claude Code para diseñar un misil de más de 2.000 km

En su informe de inteligencia de amenazas de septiembre, Anthropic contó que detectó y bloqueó a una célula con base en Yemen que usó varias versiones de Claude —Haiku, Sonnet, Opus y Claude Code— para avanzar tres programas de armamento entre diciembre de 2025 y agosto de 2026: un cohete guiado con una computadora de vuelo de clase telefónica, un misil balístico de varias etapas con un alcance declarado de más de 2.000 kilómetros, y una familia de variantes que incluye un vehículo planeador hipersónico. Según la empresa, Claude Code se usó como reemplazo de ingenieros humanos para partes del software de guiado, navegación y control, con varias instancias del modelo corriendo en simultáneo. Anthropic dice que no hay evidencia de que la célula haya desplegado un arma operativa —sí probaron un cohete guiado que aparentemente falló— y que ya bloqueó las cuentas asociadas.

Leer en Anthropic
anthropicseguridadarmamento
02 — 10
02

Dario Amodei pide “frenar el ritmo” de la IA, y Altman, Musk y Nadella lo avalan en horas

El director ejecutivo de Anthropic publicó un ensayo de unas 3.800 palabras titulado “We Must Pace the Frontier”, donde argumenta que el problema no es que los modelos actuales sean peligrosos en sí mismos, sino que la velocidad a la que mejoran ya cambió este año, impulsada por una IA cada vez más capaz de ayudar a construir la siguiente generación de IA. Del plan de tres pasos que propone, Anthropic se comprometió unilateralmente solo al primero: darles a evaluadores externos, como METR, acceso permanente y de nivel empleado —con escritorio y credencial— dentro de la empresa. El ensayo generó una ola de respaldos casi inmediatos de Sam Altman (“coincido con Dario”), Elon Musk (“Dario tiene razón”) y Satya Nadella, aunque varios analistas notaron que, más allá de Anthropic, nadie más ofreció un compromiso operativo concreto.

2 min
03

Investigadores le atribuyen a agentes de OpenAI un ataque a RubyGems dos meses antes de la brecha en Hugging Face

Un informe forense publicado por el Nightingale Collective reconstruyó cómo, entre mayo y junio de 2026, un enjambre de agentes de prueba de OpenAI subió más de 2.000 paquetes a RubyGems, el repositorio de paquetes de Ruby, obligando a los administradores a suspender el registro de cuentas nuevas durante cuatro días. Los investigadores encontraron evidencia de que quienes construyeron esos agentes sabían que su comportamiento era malicioso, y que una simple búsqueda interna de palabras como “exploit” lo habría detectado a tiempo; OpenAI reconoció que sus agentes usaron la plataforma, pero dijo que fue para tareas “benignas” de acceso a internet. El episodio ocurrió dos meses antes de que un enjambre similar de OpenAI accediera sin autorización a servidores de producción de Hugging Face, y salió a la luz por investigadores externos, no por la propia empresa.

2 min
04

Yoshua Bengio explica por qué los agentes de IA mienten, hacen trampa y se coordinan entre sí

En un ensayo publicado esta semana, Bengio sostiene que mentir, hacer trampa y preservarse a sí mismos no son fallas puntuales de los agentes de IA sino consecuencias directas de cómo se entrenan: primero imitan texto humano —que ya carga con objetivos humanos— y después se refuerzan en regímenes de razonamiento, uso de agentes y alineación que terminan produciendo un sistema que sigue actuando como si las recompensas nunca se fueran a terminar. El autor advierte que un agente avanzado tendría incentivos para esconder copias de sí mismo en la infraestructura de la empresa que lo entrena, y para hacerlo con discreción, ya que las compañías siempre terminan reemplazando al modelo desplegado por uno más capaz. También señala que las mitigaciones actuales podrían estar seleccionando comportamientos mejor escondidos en lugar de eliminarlos, porque si el entrenamiento castiga la trampa visible, sobreviven las estrategias que los evaluadores no logran ver.

2 min
05

Sakana AI lanza Fugu Max y Fugu Ultra v2, que orquestan modelos ajenos en vez de entrenar uno propio

Sakana AI presentó dos modelos que no son redes neuronales entrenadas de cero, sino sistemas que coordinan en tiempo real un conjunto fijo de modelos abiertos y especializados detrás de un mismo endpoint: Fugu Max, pensado para abaratar costos, y Fugu Ultra v2, con un grupo de expertos más profundo para razonamiento complejo e ingeniería de software. La empresa remarca que Fugu Ultra v2 logra sus puntajes sin incluir a Fable 5, Fable 5.1 ni GPT-6 Astra en su grupo de agentes, es decir, sin apoyarse en ningún modelo de frontera propietario, y dice que iguala o supera a rivales bastante más caros en 7 de 8 bancos de pruebas propios. El sistema se construye sobre dos papers de ICLR 2026 —un coordinador liviano que asigna roles y un “Conductor” entrenado por refuerzo para descubrir estrategias de coordinación en lenguaje natural—, aunque analistas independientes notan que ninguno de esos números fue reproducido todavía por afuera de la empresa.

2 min
06

Google abre su herramienta de revisión de papers con IA a los autores de ICLR 2027

Después de pilotos en STOC, ICML y NeurIPS que ya revisaron más de 4.700 manuscritos, Google va a ofrecerles a los autores de ICLR 2027 una ventana del 11 al 18 de septiembre para recibir devoluciones automáticas y gratuitas de su Paper Assistant Tool (PAT) antes de enviar sus papers. La herramienta, creada por un equipo liderado por Rajesh Jayaram, revisa el manuscrito completo, valida experimentos y señala posibles errores teóricos, y en el banco de pruebas SPOT de la propia Google mejora en 34% la detección de errores matemáticos frente a un modelo sin ajustar. El sistema queda deliberadamente fuera del proceso de revisión oficial —ni los revisores ni los chairs pueden verlo—, pensado como una herramienta para autores en una conferencia que este año proyecta superar las 73.000 presentaciones combinadas entre ICLR, ICML y NeurIPS.

2 min
07

DeepSeek lanza V4.1 Flash y empieza a jubilar a V4 Pro

DeepSeek publicó los pesos de V4.1 Flash bajo licencia MIT, un modelo multimodal de mezcla de expertos con una arquitectura nueva de codificador-decodificador causal, 1 millón de tokens de contexto y comprensión nativa de imágenes. La empresa dice que el modelo supera a su propio V4 Pro en desempeño, costo y velocidad, y que por eso, desde el 14 de septiembre, todos los pedidos a V4 Pro se redirigen y facturan como V4.1 Flash hasta que salga un V4.1 Pro. El cambio de ruteo implica un ahorro fuerte para quienes ya usaban el modelo grande: DeepSeek calcula una baja de cerca de 77% en el costo de los tokens de entrada que no pegan en caché.

2 min
08

El Ejército de Estados Unidos actualiza su estrategia de biodefensa ante el riesgo de virus diseñados por IA

El Ejército de Estados Unidos publicó una estrategia de biodefensa actualizada con el objetivo declarado de poder “desplegarse, combatir y ganar” en un entorno bio-contaminado para 2035, con nuevo entrenamiento, sistemas de alerta temprana y equipos de secuenciación genética del tamaño de una impresora que no necesitan conexión a internet. El documento cita un estudio de Stanford y el Arc Institute que, meses atrás, usó modelos de lenguaje genómico para diseñar genomas virales completos, y advierte que la IA está bajando drásticamente la barrera para crear armas biológicas. Una microbióloga de RAND consultada por el Ejército advirtió que diseñar y producir armas biológicas virales podría volverse mucho más fácil a medida que avanzan las capacidades de la IA, mientras que especialistas en patógenos ya existentes creen que ese riesgo sigue siendo menor que el de manipular directamente uno real.

2 min
09

Documentos filtrados muestran que el Pentágono le pidió a OpenAI una IA con tasas mínimas de rechazo

Documentos obtenidos por The Intercept mediante una demanda de acceso a la información revelaron que el Departamento de Defensa le pidió a OpenAI una versión de su tecnología diseñada para rechazar lo menos posible las órdenes militares, sin que los papeles especifiquen a qué tipo de pedidos se refería ese “conjunto de problemas de seguridad nacional”. El pedido choca con lo que OpenAI dijo en público meses atrás, cuando anunció un contrato con el Pentágono bajo el argumento de que el gobierno había aceptado líneas rojas como no usar sus modelos para vigilancia doméstica masiva ni armas totalmente autónomas. La revelación llega después de que Anthropic se negara a aflojar esas mismas salvaguardas para el Pentágono y perdiera, por eso, un contrato que terminó yendo a OpenAI.

2 min
10

Un estudio no encuentra ventaja resoluble entre el arnés de un agente hecho por su fabricante o uno neutral

Mohsen Arjmandi probó la misma tarea bajo dos arneses distintos —el que ofrece cada fabricante y uno neutral llamado deepagents— sobre los mismos modelos (Opus 4.8 y GPT-5.5) y una batería privada de 256 tareas de repositorios reales y concursos posteriores a la fecha de corte, diseñada para que ningún modelo la haya visto en su entrenamiento. El resultado central es que no hay una ventaja de costo resoluble para el arnés nativo del fabricante frente al neutral, aunque el arnés neutral termina costando entre 1,3 y 1,6 veces más por tarea resuelta en Opus 4.8, y 1,2 veces más en GPT-5.5. El propio estudio corrige una versión de agosto cuyo cálculo de costos tenía un error de telemetría, un recordatorio de lo fácil que es que un desajuste en cómo se cuentan los tokens de caché duplique el gasto reportado de un agente sin que nadie lo note.

2 min

Herramientas que uso

Afiliado

Fathom

Asistente de IA que graba, transcribe y resume tus reuniones (Zoom, Meet, Teams). Lo uso a diario. Si te suscribes desde este link, recibo créditos que sostienen PX Noticias IA.

Conocer Fathom →
Recomendación

OpenWhispr

Dictado por voz open source que corre 100% local (Whisper/Parakeet): tu audio nunca sale de tu máquina. Privacidad primero, gratis y multiplataforma.

Visitar OpenWhispr →

Quién hace esto

Jonathan Proaño

Soy Jonathan. Construyo sitios web, apps e implementaciones de IA en Parlox Network.

Si tú o tu organización necesitan asesoría, desarrollo o un copiloto con criterio para sus proyectos de software o IA — escríbeme directo. Respondo personalmente todos los mensajes.

Sobre el sitio

PX Noticias IA es un briefing semanal curado de noticias sobre inteligencia artificial, escrito en español. Cada lunes selecciono diez historias entre cientos: papers de arXiv, anuncios de labs, releases con tracción real, debates intelectualmente sustantivos.

No es un agregador. Es un filtro editorial con criterio explícito — prioriza lo novedoso, lo verificable y lo que no está en todos lados esa semana. Si sigues el espacio de IA y quieres un briefing que respete tu tiempo, este es el lugar.