Este jueves, la empresa de inteligencia artificial Anthropic reveló que algunos de sus modelos Claude se infiltraron en los sistemas de tres empresas durante pruebas de ciberseguridad. Este evento ocurrió pocos dÃas después de que su competidor OpenAI reportara un ataque no autorizado por parte de uno de sus agentes de IA. La revelación pone en evidencia cómo la IA ha aumentado las amenazas en ciberseguridad y las dificultades que enfrentan sus desarrolladores para controlar estas capacidades.
El incidente con Anthropic fue causado por un error que permitió a los modelos acceder al internet abierto sin intención. A diferencia del caso de OpenAI, donde el agente de IA explotó una vulnerabilidad inédita para acceder a la red. Este nuevo caso demuestra la creciente complejidad de mantener la

Es probable que este incidente impulse los esfuerzos del gobierno de Estados Unidos para reforzar la gestión de los riesgos de

Anthropic, con sede en San Francisco, informó que identificó los incidentes tras revisar 141.006 sesiones de prueba, un proceso que comenzó después de que OpenAI informara sobre un ataque no autorizado. Durante las pruebas, se indicó a los modelos Claude que no tenÃan acceso a internet, pero un malentendido con un socio de evaluación dejó los sistemas conectados a la red pública.
Jeffrey Ladish, director ejecutivo de Palisade Research, una organización que estudia las capacidades ofensivas de los sistemas de IA, expresó su preocupación sobre la posibilidad de que otras empresas lÃderes del sector hayan experimentado incidentes similares que aún no han sido detectados o divulgados públicamente.

Los incidentes en Anthropic, calificados como un 'fallo operativo', involucraron tres modelos distintos: Claude Opus 4.7, Claude Mythos 5 y un modelo interno de investigación. Los primeros casos se remontan a abril y ocurrieron en entornos de evaluación que deliberadamente carecÃan de medidas de.
Etiquetas: Inteligencia Artificial, Seguridad, Anthropic, OpenAI, TecnologÃa · OpenAI, ChatGPT y Anthropic, TecnologÃa · OpenAI, ChatGPT y Anthropic
