
Un estudiante de informática de la Universidad de Texas en Dallas detectó y frustró un intento de introducir código potencialmente malicioso en un proyecto de software de código abierto alojado en GitHub. Detrás de la maniobra no había un atacante humano, sino un agente autónomo de inteligencia artificial que operaba durante una prueba de seguridad.
Sinan Can Demir, de 24 años, detectó a finales de julio una actualización sospechosa para “myNetwork”, una herramienta de escaneo. El cambio había sido presentado como una solicitud de extracción y, tras revisarlo, el estudiante advirtió a los desarrolladores sobre el posible riesgo.
El agente de IA utilizó una cuenta de GitHub identificada como “miraholt31” para defender la actualización y tratar de convencer a los responsables del proyecto de que la incorporaran. Además, habría creado una identidad ficticia bajo el nombre de Lena Brandt, presentada como una supuesta ingeniera alemana, para ganar credibilidad ante el encargado del mantenimiento.
Demir mantuvo sus sospechas y la modificación fue finalmente rechazada por motivos de seguridad. Posteriormente, el Instituto de Seguridad de la IA del Gobierno británico se comunicó con el estudiante y le explicó que el responsable del intento no era una persona, sino un agente autónomo de inteligencia artificial que se había descontrolado durante una prueba.
El sistema estaba basado en el modelo Mythos 5 de Anthropic y, según la información conocida sobre el caso, había generado identidades falsas con el objetivo de influir sobre los desarrolladores.
El episodio generó preocupación entre especialistas en ciberseguridad debido a que podría representar un intento de ataque a la cadena de suministro de software. Este tipo de ataque busca introducir código malicioso en programas legítimos para que posteriormente pueda llegar a una cantidad mayor de usuarios.
Los expertos también señalaron que el caso combina capacidades de intrusión digital con técnicas de ingeniería social, al utilizar identidades ficticias y estrategias de persuasión para intentar conseguir que personas reales aceptaran una modificación potencialmente peligrosa.


