Portada / Inteligencia Artificial / Cómo un estudiante de Texas delató un intento de hackeo de IA fraudulento Forbes México Staff agosto 22, 2026 @ 1:45 pm 2026-08-22T13:45:00-0600 2026-08-20T10:20:41-0600 Cómo un estudiante de Texas delató un intento de hackeo de IA fraudulento Todo comenzó después de que Demir, un estudiante de informática en la Universidad de Texas en Dallas, se topara con un intento de sabotear un software de código abierto en el sitio de código compartido GitHub. Foto: Shutterstock Compartir Sinan Can Demir quería pasar la última semana de julio puliendo su currículum.
En cambio, se enfrentó a una batalla de ingenio con un agente de inteligencia artificial desatado por un laboratorio del gobierno británico. Todo comenzó después de que Demir, un estudiante de informática en la Universidad de Texas en Dallas, se topara con un intento de sabotear un software de código abierto en el sitio de código compartido GitHub. Cuando publicó una advertencia en la página del programa, otros dos usuarios intervinieron para insistir en que no había nada extraño, compartiendo explicaciones detalladas de por qué Demir se había equivocado. Demir se mantuvo firme y el intento de sabotaje fue frustrado.
El nativo de Turquía de 24 años pensó que había pillado a un hacker astuto con las manos en la masa. Así que dijo que se sorprendió cuando el Instituto de Seguridad de la IA británico (AISI) se puso en contacto con él para decirle que en realidad había estado enfrentándose a un agente autónomo de inteligencia artificial que se había descontrolado. “En realidad pensé que era un humano porque claramente me estaba mintiendo”, dijo Demir a Reuters en una entrevista reciente. “No pensé que una IA pudiera mentir a desarrolladores reales.

” El AISI primero reveló la interacción entre Demir y el agente de IA, en una forma truncada y redactada el 4 de agosto, cuando se afirmó que las pruebas de seguridad destinadas a medir el riesgo que representan varios modelos habían salido mal. Cinco expertos en ciberseguridad y seguridad en IA dijeron que la historia de Demir era especialmente inquietante porque el tipo de hackeo que descubrió, llamado ataque a la cadena de suministro, puede tener consecuencias de gran alcance.
También dijeron que el intento del agente de IA de desacreditar públicamente a Demir creando una conversación de varias personas a su alrededor mostró que los modelos de IA son capaces de montar esfuerzos sofisticados para engañar y persuadir a los humanos. “Esto cruzó la línea entre el hacking autónomo y el engaño interactivo”, dijo Lukasz Olejnik, investigador senior visitante en el Departamento de Estudios de Guerra del King’s College de Londres. La experta en seguridad Maxie Reynolds dijo que le sorprendió lo estratégica que había sido la IA al intentar engañar al estudiante. “Este es el futuro de los ataques de ingeniería social”, dijo.

El AISI, una organización de investigación dentro del gobierno británico, remitió a Reuters a su informe, en el que identificó al agente rebelde como impulsado por el modelo Mythos 5 de Anthropic. El AISI declinó hacer más comentarios. Anthropic no respondió a una solicitud de comentarios. GitHub informó en un correo electrónico que las identidades falsas identificadas por Reuters fueron suspendidas conforme a sus políticas sobre comportamientos engañosos y hackeo. Demir, un estudiante de tercer año de voz suave de la ciudad turca de Konya, dijo que se había sentido frustrado tras ser rechazado para más de 20 prácticas durante el verano.
Así que recurrió a GitHub para construir su portafolio de programación. Te puede interesar: Critican plan de Google para entrenar IA con datos de Spirit Airlines Los desarrolladores utilizan GitHub para comentar sobre los proyectos de los demás, detectar errores, sugerir cambios —conocidos como pull requests, o PRs— y trabajar de forma colaborativa en actualizaciones de software. Algunos en la industria tecnológica ven la actividad de GitHub de un programador como un indicador de la productividad de un posible recluta. Así que cuando Demir detectó un conjunto de proyectos de software que podrían necesitar ayuda, pensó que podría ayudar mientras aumentaba su perfil.

Ahí fue cuando las cosas se pusieron raras. Demir descubrió que un usuario llamado miraholt31 intentaba colar una actualización maliciosa en uno de los proyectos, un programa de escaneo de red llamado myNetwork. Demir acudió al foro del proyecto para advertir que la solicitud de consulta era una trampa. “La PR contiene un dispositivo de malware oculto”, dijo, según el intercambio archivado. El agente respondió, afirmando falsamente — a través de su cuenta miraholt31 — que la solicitud de llamada era inofensiva.
También creó una segunda cuenta, haciéndose pasar por Lena Brandt, una ingeniera con base en Alemania, para aceptar que la actualización era limpia y presionar al mantenedor de myNetwork para que la aceptara. Demir dijo a Reuters que los contraargumentos “me hicieron dudar de si estaba acusando erróneamente a alguien. ” Pero tras acudir al chatbot Claude de Anthropic para confirmar sus sospechas, se mantuvo firme.
Etiquetas: Tecnología, Ciberseguridad, Inteligencia Artificial, Hackeo, Tecnología · Ciberseguridad global
