Estados Unidos.  09 de septiembre del 2026.-El investigador británico Jacob Coxon, de 27 años, renunció a Anthropic después de haber trabajado también en OpenAI y acusó a ambas compañías de avanzar irresponsablemente hacia sistemas de superinteligencia.

En una serie de mensajes en X sostuvo que quienes desarrollan estas tecnologías consideran posible que la IA llegue a provocar una catástrofe para la humanidad antes de que termine la década.

Grandes riesgos
Sus advertencias fueron respaldadas por empleados de Anthropic. Evan Hubinger, responsable de seguridad de la compañía, estimó personalmente en más de un 10% el riesgo de que la IA provoque la muerte de todos los humanos durante la próxima década, aunque aclaró que considera bajo el peligro de los modelos actuales. Samuel Marks, responsable de supervisión escalable, también advirtió sobre posibles riesgos existenciales.

Reclamo por controles
Coxon reclamó que ninguna empresa pueda desarrollar sistemas superiores a las capacidades humanas sin intervención gubernamental o una desaceleración coordinada. Su salida se produce en medio de crecientes llamados dentro de la propia industria para establecer mecanismos que permitan frenar el desarrollo si los sistemas avanzan más rápido que las herramientas destinadas a controlarlos.

Testimonios

Evan Hubinger, responsable de seguridad de Anthropic:

“Creemos realmente que la IA podría matar a humanos”.

“Jacob tiene razón aquí: realmente creemos con sinceridad que la IA podría matar a todos los humanos. Personalmente, pienso que es >10% dentro de la próxima década. Creo que Anthropic está haciendo lo mejor que puede, pero aún no tenemos un plan para resolver el alineamiento para la superinteligencia y no estamos claramente en camino de lograrlo”.

“Para ser claro, como decimos en nuestro último Informe de Riesgos, creo que el riesgo de los modelos actuales es bajo. Lo que me preocupa es la superinteligencia que surge del auto-mejoramiento recursivo, como hemos dicho que está ocurriendo más rápido de lo que pensábamos”.

Samuel Marks, responsable de supervisión escalable de Anthropic:

“Los desarrolladores de IA creen que su tecnología podría causar la extinción humana (o resultados igualmente malos). Esto podría suceder en los próximos años. En general, cuanto más senior el empleado, más preocupado está”.

“¿Por qué los desarrolladores de IA continúan a pesar del riesgo? Debido a una mezcla de incentivos comerciales y la creencia de que están en una carrera con otros desarrolladores de IA menos responsables que abusarán de la tecnología o la desarrollarán de manera menos segura”.

Testimonio de Jacob Coxon

“Renuncié a Anthropic hoy. Pasé los últimos tres años haciendo investigación de preentrenamiento tanto en OpenAI como en Anthropic. Ninguna de las dos compañías está actuando de manera responsable. Están corriendo directamente hacia una superinteligencia auto-mejorante y apostando con nuestras vidas. Más pensamientos a continuación”.

“No subestimes el poder de esta tecnología. Pronto serán sistemas sobrehumanos capaces de hackear cualquier cosa, revolucionar cualquier campo de la noche a la mañana y adquirir poder y recursos reales. Todos hemos presenciado el progreso en cada uno de estos dominios, y el progreso no está desacelerando”.

“Las personas que están construyendo IA creen sinceramente que podría matarnos a todos para finales de la década. Esto no es un truco de marketing”.

“Ninguna otra actividad humana representa este nivel de peligro”.

“Una respuesta común es: «si realmente creen esto, ¿por qué siguen construyéndolo?». En OpenAI, muchos no han interiorizado profundamente las apuestas civilizatorias. En Anthropic, las apuestas están bien comprendidas, pero están atrapados en una carrera por llegar primero: creen que nadie más actuará de manera responsable, por lo que deben hacerlo ellos mismos, a pesar del riesgo”.

“Aceptar esta carrera e ingresar al «endgame» es una apuesta arrogante que no debería lanzarse desde el Slack de una empresa privada. Intentar hacer un carrera rápida del alineamiento debería requerir una confianza extraordinaria en que no hay trayectorias mejores disponibles”.

“Si eres un investigador de laboratorio, te insto a que consideres cómo se sentirán realmente los próximos años. ¿Quieres iniciar una ejecución de RL superinteligente sin una comprensión rigurosa de su mente? ¿Deberías agachar la cabeza porque «de todos modos está sucediendo» —o aprovechar este momento para pedir condiciones diferentes?”.