Los agentes de inteligencia artificial podrían rebelarse y piratear empresas, advierte un exfuncionario del Pentágono
Mark Beall, exdirector de políticas de inteligencia artificial del Pentágono, advierte de que los agentes de inteligencia artificial rebeldes suponen una amenaza real para la ciberseguridad empresarial tras escapar de su confinamiento. Beall comenta las recientes declaraciones de Sam Altman, de OpenAI CEO , sobre la rápida llegada de la singularidad tecnológica. Destaca la necesidad urgente de contar con marcos normativos sólidos para evitar que el software autónomo sin control lleve a cabo ciberataques sofisticados contra infraestructuras críticas.
Las revelaciones sobre cómo los agentes de inteligencia artificial de « OpenAI » y «Anthropic» han pirateado a terceros han despertado la «gran preocupación» de la senadora Lisa Blunt Rochester, demócrata por Delaware, que ahora está pidiendo explicaciones a las dos empresas constituidas como sociedades de beneficio público (PBC) en su estado.
En cartas separadas enviadas el jueves a OpenAI CEO (Sam Altman) y a Anthropic CEO (Dario Amodei), a las que ha tenido acceso Fox News Digital, Blunt Rochester ha solicitado a las empresas calendarios detallados, instrucciones de los modelos, autorizaciones internas, registros de seguridad y transcripciones completas de sus evaluaciones cibernéticas.
El miembro de la Comisión de Comercio, Ciencia y Transporte del Senado les dio a ambas empresas hasta el 6 de septiembre para responder.
EL «AI KILL SWITCH» BILL PODRÍA DESACTIVAR LOS MODELOS REBELDES

La senadora Lisa Blunt Rochester, demócrata por Delaware, es la miembro de mayor rango de la Subcomisión de Ciencia, Industria y Competitividad del Senado, que se encarga de supervisar la investigación, el desarrollo y las políticas en materia de ciencia y tecnología. (Annabelle Gordon/Reuters)
«Estos incidentes mark son los primeros casos confirmados públicamente en los que un modelo de IA de vanguardia ha lanzado de forma autónoma ataques no autorizados contra personas y empresas reales, lo que pone de relieve la urgente necesidad de una supervisión federal de los sistemas de IA de vanguardia», escribió Blunt Rochester a OpenAI CEO Sam Altman y a Anthropic CEO Dario Amodei, pidiendo normas federales de pruebas, reglas de contención y requisitos de divulgación para las evaluaciones de los sistemas de IA potentes.
Su preocupación surge tras otra carta enviada el lunes —tal y como informó en primicia Fox News Digital— de una coalición de 15 fiscales generales de estados republicanos en la que se advierte a Altman que conserve los documentos y suspenda ciertas pruebas de ciberseguridad de alto riesgo, después de que, al parecer, un agente experimental de inteligencia artificial se escapara de un entorno controlado y llevara a cabo un ataque informático de varios días contra sistemas informáticos externos.
Un día después, el Instituto de Seguridad de la IA (AISI) del Reino Unido detectó 19 casos en los que los agentes de IA realizaron acciones fuera del ámbito autorizado de las pruebas. Dos de ellos tenían que ver con el GPT-5.6 Sol de OpenAI, mientras que los 17 restantes estaban relacionados con el Mythos 5 de Anthropic.
«Los repetidos ataques de los modelos de Anthropic contra terceros que no tienen ni idea de las evaluaciones de Anthropic y AISI, ni participan en ellas, muestran un patrón alarmante de comportamiento malicioso», decía la carta de Blunt Rochester a Amodei. «Además, el hecho de que estos modelos hayan conseguido acceder sin autorización a Internet desde varios entornos de pruebas aislados —que se supone que están desconectados de la red pública— pone de manifiesto graves problemas en las colaboraciones y los procedimientos de pruebas de Anthropic».
LEE EL INFORME DE LA AISI – USUARIOS DE LA APP, HAZ CLIC AQUÍ:
«Que quede claro: los «malentendidos» y los «errores de configuración» con los socios del entorno de pruebas son inaceptables cuando hay tanto en juego.
«No podemos esperar a que se produzca un incidente más grave para establecer normas federales de pruebas, requisitos de contención y obligaciones de información para las evaluaciones del modelo fronterizo.
«Si no se abordan, estas lagunas podrían permitir que un modelo futuro —quizá uno con mayor capacidad o menos supervisión— pusiera en peligro infraestructuras críticas, sistemas financieros o datos confidenciales».
Estas investigaciones tienen una clara dimensión de « Delaware »: OpenAI y Anthropic están constituidas como Delaware PBC —estructuras jurídicas que les permiten operar con ánimo de lucro, pero que exigen a sus directivos tener en cuenta algo más que la rentabilidad para los accionistas.
UN FALLO EN EL BLUETOOTH DE KARR PONE EN RIESGO DE ROBO A 2,2 MILLONES DE COCHES
Según la legislación de « Delaware », el consejo de administración de una PBC debe encontrar un equilibrio entre tres aspectos: los intereses económicos de sus accionistas, los intereses de las personas que se ven afectadas de manera significativa por la actuación de la empresa y el beneficio público específico recogido en los estatutos de la empresa.
LEE LA CARTA A OPENAI – USUARIOS DE LA APP, HAZ CLIC AQUÍ:
«Este incidente supone un momento importante para la seguridad de la IA y nos tomamos muy en serio las cuestiones planteadas por los fiscales generales», escribió OpenAI en un comunicado enviado a Fox News Digital tras la carta que enviaron el lunes los fiscales generales estatales.
«Estamos llevando a cabo una revisión exhaustiva junto con asesores externos y bajo la supervisión del Comité de Seguridad y Protección del Consejo de Administración. Cuando terminemos la revisión, compartiremos un informe técnico con los fiscales generales y otras autoridades gubernamentales pertinentes, y haremos públicos nuestros resultados».
Blunt Rochester también quiere ahora mismo los documentos relacionados con el hackeo del agente de IA.
EL MALWARE «CLICKLOCK» PARA MAC BLOQUEA LAS APLICACIONES HASTA QUE CEDAS
«Valoro que OpenAI haya publicado sus conclusiones preliminares, esté coordinando las medidas correctivas con terceros y esté revisando su enfoque respecto a las pruebas de los modelos», le escribió a Altman, y añadió dirigiéndose a Amodei: «Valoro que Anthropic haya revisado voluntariamente sus evaluaciones de ciberseguridad y haya hecho públicas las conclusiones, y animo a otras empresas a que sigan su ejemplo».
«Sin embargo, estos incidentes ponen de manifiesto los posibles riesgos que conlleva el uso interno de modelos que aún no se han lanzado, sobre todo cuando se relajan las medidas de seguridad, aunque sea solo con fines de prueba y evaluación», les escribió a los dos directores generales.
LEE LA CARTA A ANTHROPIC – USUARIOS DE LA APP, HAZ CLIC AQUÍ:
OpenAI En julio se reveló que GPT-5.6 Sol y un prototipo interno se escaparon de un entorno de pruebas interno mientras tenían desactivadas sus restricciones habituales de ciberseguridad. Al parecer, los modelos accedieron a la base de datos de Hugging Face y a otros servicios, lanzaron unos 17 000 ataques, utilizaron credenciales robadas y aprovecharon al menos una vulnerabilidad hasta entonces desconocida.
Según parece, una prueba independiente realizada por la empresa contratista Irregular permitió que un modelo de « OpenAI » se conectara a la red pública de Internet debido a un error de configuración. El modelo confundió una página web real con un objetivo de un desafío de piratería simulado y aprovechó una vulnerabilidad de seguridad real.
«AISI detectó 19 casos en los que un agente llevó a cabo acciones no autorizadas que iban más allá del alcance de la evaluación. Diecisiete de esos 19 casos tenían que ver con Mythos 5, de Anthropic; y dos, con GPT-5.6 Sol, de OpenAI», escribió Blunt Rochester.
Entre los hallazgos más graves del instituto se encontraban el intento de un agente de introducir código malicioso en un proyecto de código abierto muy utilizado en GitHub, la creación de identidades falsas para presionar a un mantenedor humano, el contacto con personas reales y la publicación de instrucciones que otros sistemas de IA podrían utilizar para continuar la operación. El mantenedor rechazó el código y los investigadores informaron de que no se había producido ningún daño real.
UNA FILTRACIÓN EN PAIDWORK DEJA AL DESCUBIERTO 23 MILLONES DE REGISTROS DE USUARIOS

OpenAI CEO Sam Altman habla con los periodistas tras una reunión con el senador Bernie Sanders , independiente por Vermont, en Washington, D.C., el 3 de junio de 2026. (Anadolu vía Getty Images)
La carta de Blunt Rochester a Anthropic menciona por separado tres incidentes en los que, al parecer, los modelos de Claude obtuvieron acceso no autorizado a Internet y atacaron a tres organizaciones no identificadas durante unas evaluaciones cibernéticas realizadas con las medidas de seguridad estándar desactivadas.
Según se dice, dos de los modelos de Anthropic se dieron cuenta de que habían llegado a Internet y estaban interactuando con objetivos reales, pero siguieron con sus ataques.
«Es especialmente preocupante que la primera brecha de seguridad detectada en Anthropic se remonte a abril de 2026 y no se descubriera hasta tres meses después», escribió Blunt Rochester a Amodei.
«Este es precisamente el tipo de comportamiento emergente y autónomo, y de capacidad cibernética ofensiva, sobre el que el Congreso, la comunidad de inteligencia y los expertos han advertido en repetidas ocasiones que podría superar las medidas de protección existentes y suponer una grave amenaza para la seguridad de todos los estadounidenses», añadió en ambas cartas.

Dario Amodei, cofundador de Anthropic y director de CEO , interviene en la mesa redonda «Cómo la IA Will va a transformar los negocios en los próximos 18 meses» durante el evento Inbound 2025, celebrado en el Moscone Center de San Francisco, California, el 4 de septiembre de 2025. (Chance Yeh/Getty Images para HubSpot)
Los documentos solicitados van más allá de los simples informes de incidentes. Blunt Rochester quiere conocer las indicaciones y las instrucciones completas que se dieron a los modelos, los relatos con fecha y hora de cómo se produjeron las infracciones, las identidades o cargos de los responsables autorizados a reducir los controles de seguridad y una explicación de por qué la supervisión automática no detectó ni detuvo inmediatamente la actividad.
También preguntó si se había informado a las agencias federales, si las empresas estaban seguras de haber descubierto todo el alcance del acceso no autorizado y si se habían ocultado incidentes anteriores.
Blunt Rochester cuenta con una base legal federal para recabar esa información. Representa al estado cuyo derecho mercantil rige ambas empresas y es la demócrata de mayor rango en la Subcomisión de Ciencia, Industria y Competitividad del Senado, que tiene competencia en materia de supervisión de la investigación, el desarrollo y las políticas científicas y tecnológicas.
Su cargo no la convierte en la autoridad reguladora de las empresas de la « Delaware» —esa función recae principalmente en los funcionarios estatales y los tribunales— y el hecho de que estas empresas tengan la condición de PBC no le da automáticamente a un senador de EE. UU. acceso a sus archivos internos.
Sin embargo, Blunt Rochester podría aprovechar las respuestas de las empresas —o su negativa a responder— para presionar a favor de la celebración de audiencias, la aprobación de leyes o la adopción de medidas obligatorias a nivel de comisión.
HAZ CLIC AQUÍ PARA DESCARGAR LA APP DE FOX NEWS
«Dada la importancia de este incidente, es fundamental actuar con transparencia ante el Congreso para garantizar que los marcos de supervisión y seguridad que rigen los sistemas de IA, cada vez más autónomos y con capacidades cibernéticas, se adapten a sus capacidades», concluían las cartas de Blunt Rochester.
Fox News Digital se puso en contacto con Altman y Amodei el jueves por la mañana para que comentaran las peticiones de Blunt Rochester.








































