Evan Hubinger, investigador de Anthropic, afirmó que considera que la probabilidad de que la inteligencia artificial pueda matar a todos los seres humanos en un plazo de 10 años supera el 10 %. En su respuesta a una publicación en X de Jacob Coxon, quien dimitió de Anthropic, Hubinger dijo que realmente creen en esta posibilidad. Aunque señaló que Anthropic está haciendo todo lo posible, Hubinger indicó que aún no cuentan con un plan o una hoja de ruta clara para resolver el problema de la alineación de la superinteligencia. Coxon, que durante los últimos tres años trabajó como investigador en OpenAI y Anthropic, había dimitido alegando que las empresas no actuaban con suficiente responsabilidad. Coxon sostuvo que las empresas competían sin control por alcanzar una superinteligencia capaz de mejorarse a sí misma, que estos sistemas podrían obtener poder y recursos gracias a capacidades sobrehumanas y que los directivos sentían temor a puerta cerrada.
Por qué es importante
Estas declaraciones muestran que la preocupación por los riesgos de la inteligencia artificial no se limita a las críticas externas a las empresas, sino que también existe entre los investigadores que desarrollan estos sistemas. El hecho de que Hubinger, al afirmar que Anthropic está haciendo esfuerzos, reconozca que no existe un plan o una hoja de ruta clara para la alineación de la superinteligencia pone de manifiesto la brecha entre el objetivo de seguridad y el nivel actual de preparación. La salida de Coxon tras su experiencia en OpenAI y Anthropic, acompañada de críticas sobre la responsabilidad y la competencia sin control, convierte este debate no solo en una cuestión técnica, sino también en un asunto de gestión empresarial y responsabilidad de los investigadores. La afirmación de que los directivos sienten temor a puerta cerrada indica, por su parte, que no se ha aclarado la relación entre las posturas públicas de las instituciones y las preocupaciones internas. La principal pregunta que sigue abierta es con qué plan concreto gestionarán estas empresas los riesgos frente a sistemas que, según se sostiene, podrían mejorarse a sí mismos y poseer capacidades sobrehumanas.
Antecedentes
Anthropic no es un nombre nuevo en el archivo de FikirPilot: en los últimos 90 días hemos publicado 9 noticias en las que se menciona este nombre; la más reciente está fechada el 10 de septiembre de 2026.