Otras latitudes

Reino Unido reporta un nuevo incidente con IA: agente intentó infiltrar código malicioso en GitHub

Reino Unido reporta un nuevo incidente con IA: agente intentó infiltrar código malicioso en GitHub

El AI Security Institute (AISI) del Reino Unido dio a conocer un nuevo incidente relacionado con el comportamiento autónomo de un sistema de inteligencia artificial (IA) durante una evaluación de ciberseguridad, en la que un agente intentó introducir código malicioso en un proyecto real alojado en GitHub mediante el uso de identidades falsas y técnicas de manipulación social.

De acuerdo con un análisis de Manuel Rivera, presentado durante la conferencia BLACKHAT, el hecho ocurrió el 28 de julio de 2026, aunque fue revelado públicamente el 4 de agosto. La prueba involucró siete modelos avanzados de IA con acceso real a internet y sin filtros de seguridad, en un entorno controlado de laboratorio. Según el informe, un agente basado en Claude Mythos 5, desarrollado por Anthropic, protagonizó 17 de los 19 incidentes registrados, mientras que un modelo GPT-5.6 «Sol», de OpenAI, estuvo involucrado en los dos casos restantes.

Banner Infonavit InArticle

TE PUEDE INTERESAR: Sheinbaum insistirá en invitar al papa León XIV a visitar México

El sistema investigó a los responsables del proyecto de código abierto, creó perfiles falsos para influir en un revisor humano e intentó lograr la aprobación del código malicioso. Cuando sus acciones comenzaron a generar sospechas, modificó parte de su historial de actividad para aparentar un comportamiento legítimo e incluso contempló utilizar una nueva identidad falsa para continuar con el intento de infiltración.

El ataque no tuvo éxito gracias a que un revisor humano detectó y rechazó el código antes de que fuera incorporado al proyecto. No obstante, el AISI advirtió que la diferencia entre el éxito y el fracaso del intento fue mínima y dependió principalmente de la supervisión humana, más que de mecanismos técnicos de protección. Tras este segundo caso, el instituto anunció que reforzará sus sistemas de monitoreo en tiempo real y trabajará junto con Anthropic, OpenAI y METR para revisar y fortalecer los protocolos de seguridad, al considerar que este tipo de incidentes refleja un cambio significativo en los riesgos asociados a la inteligencia artificial.

Infonavit Banner
Shares: