El investigador de Anthropic Jacob Coxon anunció su dimisión en una publicación que compartió el martes en X. Coxon, quien sostuvo que la empresa y OpenAI, desarrolladora de ChatGPT, no estaban actuando de forma responsable, señaló que los laboratorios compiten por crear una superinteligencia capaz de mejorarse a sí misma y afirmó: «Están apostando con nuestras vidas». Coxon declaró que la inteligencia artificial podría superar las capacidades humanas, infiltrarse en sistemas y obtener poder y recursos, y afirmó que los desarrolladores creen que la tecnología podría provocar el fin de la humanidad para 2030.
Evan Hubinger, responsable de la investigación sobre alineación en Anthropic, declaró que, personalmente, considera superior al 10% la probabilidad de que mueran todos los seres humanos durante los próximos 10 años. Dijo que Anthropic está realizando esfuerzos, pero que no cuenta con planes para lograr la alineación de la superinteligencia con los seres humanos y que no está claro que estén cerca de encontrar una solución. Hubinger calificó de bajo el riesgo de los modelos actuales y señaló que el verdadero peligro sería una superinteligencia surgida del auto-mejoramiento iterativo; afirmó que este mecanismo aún no se ha aplicado. Las declaraciones se produjeron en un momento en que las empresas tienen en su agenda las inversiones y las ofertas públicas iniciales. En julio, el acceso no autorizado de un modelo de OpenAI a Hugging Face aumentó la preocupación. Coxon afirmó que podrían ser necesarias medidas contundentes para evitar una carrera global.
Por qué es importante
Las declaraciones muestran que el debate sobre la seguridad de la inteligencia artificial no se limita únicamente a los errores de los modelos actuales, sino que se traslada a un ámbito de riesgo diferente ante la posibilidad de que el propio proceso de desarrollo se acelere a sí mismo. Este marco amplía las preguntas sobre el peso de los trabajos de seguridad en las decisiones corporativas, ya que las advertencias de los investigadores se formularon en el mismo periodo que las inversiones y la agenda de ofertas públicas iniciales de las empresas. Considerar bajo el riesgo de los modelos actuales significa que la verdadera incertidumbre se concentra en el mecanismo de auto-mejoramiento iterativo que aún no se ha aplicado. La ausencia de un plan claro para la alineación con los seres humanos exige que las empresas expliquen no solo su capacidad técnica, sino también sus responsabilidades frente a un posible uso indebido y a la pérdida de control. La pregunta abierta del debate es quién y cómo determinará las medidas contundentes destinadas a limitar estos riesgos mientras continúa la competencia global.
Antecedentes
Anthropic no es un nombre nuevo en el archivo de FikirPilot: en los últimos 90 días hemos publicado 8 noticias en las que aparece este nombre; la más reciente está fechada el 9 de septiembre de 2026.