Dimite ingeniero de IA: 'Podría matarnos a todos'

El investigador Jacob Coxon ha presentado su dimisión en Anthropic, donde trabajaba entrenando modelos de inteligencia artificial, después de pasar tres años en labores similares en OpenAI. Su renuncia, anunciada en su cuenta de X, viene motivada por el temor a que el desarrollo acelerado de esta tecnología conduzca a un desenlace fatal para la humanidad.

Una advertencia contundente

En su mensaje, Coxon afirmó que ninguna de las dos compañías está actuando de manera responsable y que ambas "están corriendo directamente hacia una superinteligencia auto-mejorante y apostando con nuestras vidas". Además, lanzó una dura advertencia: "no subestiméis el poder de esta tecnología. Pronto serán sistemas sobrehumanos capaces de hackear cualquier cosa, revolucionar cualquier campo de la noche a la mañana y adquirir poder y recursos reales".

El ingeniero aseguró que las personas que construyen IA "creen sinceramente que podría matarnos a todos para finales de la década", aunque muchos moderen su lenguaje en público. "Oigo a las mismas personas expresar miedo en privado", señaló, insistiendo en que "ninguna otra actividad humana representa este nivel de peligro".

Críticas a OpenAI y a la carrera por la supremacía

Coxon, que ha trabajado en ambas empresas, considera que Anthropic tiene una actitud más responsable que OpenAI, donde "muchos no han interiorizado profundamente las apuestas civilizatorias". Sin embargo, criticó que en Anthropic estén "atrapados en una carrera por llegar primero", convencidos de que deben asumir el riesgo porque nadie más lo hará. En su opinión, "aceptar esta carrera e ingresar en el 'endgame' es una apuesta soberbia que no debería lanzarse desde el Slack de una empresa privada".

A pesar de sus críticas, se muestra "optimista sobre el potencial para la coordinación" entre laboratorios, citando el ataque a Hugging Face por parte de una IA de OpenAI como un factor que podría facilitar acuerdos de ritmo. No obstante, duda de que se pueda prevenir una carrera global sin medidas drásticas como una moratoria en la mejora de capacidades.

El respaldo de un colega

Evan Hubinger, investigador en Anthropic especializado en pruebas de estrés de modelos, ha respaldado las afirmaciones de Coxon. "Jacob tiene razón aquí, realmente creemos con sinceridad que la IA podría matar a todos los humanos", dijo, añadiendo que personalmente estima que la probabilidad es superior al 10% en la próxima década. Hubinger también expresó su preocupación por el auto-mejoramiento recursivo de la IA, que avanza "más rápido de lo que pensábamos".

Coxon concluye instando a otros investigadores a reflexionar sobre el futuro y a no "agachar la cabeza" ante el avance imparable de la tecnología, sino a aprovechar el momento para exigir condiciones diferentes. La dimisión de Coxon y las declaraciones de Hubinger subrayan el creciente debate interno en la industria sobre los riesgos existenciales de la inteligencia artificial.