Los sistemas de inteligencia artificial podrían "acabar con todos los humanos", según la estimación de Evan Hubinger, responsable de la ciencia de alineación en Anthropic. En una declaración que ha encendido el debate global, Hubinger calcula que este escenario catastrófico tiene más de 10% de probabilidades de materializarse en algún punto de la próxima década.
La advertencia cobra mayor relevancia tras la renuncia de Jacob Coxon, quien hasta hace poco trabajaba como investigador en la misma empresa. Coxon, con pasado también en OpenAI, aseguró que los desarrolladores "están corriendo directamente hacia una superinteligencia automejorable y apostando con nuestras vidas". En su mensaje de despedida, enfatizó que "las personas que están construyendo IA creen sinceramente que esta podría matarnos a todos para finales de la década. Esto no es un truco de marketing".

El exinvestigador criticó que ninguna de las principales empresas del sector actúa con la responsabilidad que amerita el desarrollo de sistemas con capacidades avanzadas. "Ninguna otra actividad humana representa este nivel de peligro", señaló, al describir un futuro cercano con "sistemas sobrehumanos capaces de hackear cualquier cosa, revolucionar cualquier campo de la noche a la mañana y adquirir poder y recursos reales".

Las preocupaciones sobre riesgos existenciales de la inteligencia artificial no son nuevas, pero han alcanzado su máximo nivel tras los avances recientes de las empresas líderes del sector. Especialistas señalan que desarrollos como los modelos presentados por OpenAI y Anthropic están acortando la brecha hacia la llamada superinteligencia artificial, una fase teórica en la que los sistemas podrían razonar y operar de manera autónoma con rendimiento igual o superior al humano.
Jakub Pachocki, científico jefe de OpenAI, advirtió a principios de este mes que medir los riesgos solo por la capacidad de igualar la inteligencia humana podría ser un error grave que "exige extrema precaución". Según su análisis, "la IA no necesita igualar ni superar todas las capacidades humanas; solo necesita superar suficientes", lo que dificulta evaluar con exactitud el verdadero alcance de la tecnología.

Anthropic había reportado meses atrás que su modelo Mythos superaba ya las capacidades humanas en tareas de ciberseguridad y hacking autónomo. Esta semana, OpenAI presentó además una posible solución generada por IA para uno de los siete Problemas del Milenio, los desafíos matemáticos más difíciles según el Clay Mathematics Institute, de los cuales la humanidad solo había resuelto uno hasta a
Etiquetas: inteligencia artificial, Anthropic, OpenAI, riesgo existencial, tecnología, regulación tecnológica, superinteligencia artificial, Tecnología · OpenAI, ChatGPT y Anthropic
