Joe Benton, quien trabajó en investigación de seguridad de inteligencia artificial en Anthropic, reveló que dejó la compañía y lanzó una advertencia sobre los riesgos que, a su juicio, representa la carrera por desarrollar sistemas cada vez más inteligentes. Su salida ocurre apenas días después de la renuncia del investigador Jacob Coxon, quien también manifestó preocupaciones sobre el rumbo de la IA.
TAMBIÉN LEE: IA podría matar a todos los humanos antes de 2030, advierte ingeniero de OpenAI y Anthropic tras renunciar
Benton anunció en su cuenta de X que dejó el equipo de seguridad de Anthropic, compañía desarrolladora de Claude, hace aproximadamente dos semanas y que ahora trabajará desde fuera de los grandes laboratorios de inteligencia artificial para impulsar evaluaciones independientes y una mayor transparencia.
Su mensaje contiene una advertencia particularmente contundente. Benton sostiene que las compañías compiten por desarrollar máquinas “mucho más inteligentes que cualquier humano” y considera que existe la posibilidad de consecuencias catastróficas.
“Es posible que no sobrevivamos a esto”, escribió.
I left Anthropic's safety team two weeks ago. Now feels like a good moment to explain why. AI companies are racing to build machines that are much smarter than any human, and we may not survive this. I want to work from the outside to ensure the public is informed about these…— Joe Benton (@JoeJBenton) September 11, 2026
Benton no era un observador externo de la compañía. Anthropic lo ha identificado públicamente entre sus investigadores y mentores en áreas relacionadas con la seguridad de inteligencia artificial, incluida la denominada “scalable oversight”, que estudia cómo supervisar sistemas que eventualmente podrían superar las capacidades humanas en determinadas tareas.
Reuters lo describe como antiguo líder de un equipo de investigación de seguridad de Anthropic. Tras abandonar la empresa, Benton anunció su incorporación a METR, organización que realiza evaluaciones independientes sobre las capacidades y riesgos de sistemas avanzados de IA.
En su mensaje, Benton aseguró que considera que las empresas de inteligencia artificial están invirtiendo menos de lo necesario en seguridad.
También reclamó mayor transparencia sobre incidentes y avances potencialmente peligrosos. Entre las medidas que propone están reportar incidentes y situaciones que estuvieron cerca de convertirse en ellos, establecer estándares mínimos de seguridad y permitir verificaciones independientes sobre su cumplimiento.
Su preocupación central es que el desarrollo tecnológico pueda avanzar más rápidamente que los mecanismos disponibles para supervisarlo.
El anuncio de Benton adquiere especial relevancia porque ocurre prácticamente al mismo tiempo que otra salida de alto perfil de Anthropic.
El investigador Jacob Coxon anunció esta semana que abandonaba la compañía por sus preocupaciones sobre la carrera para desarrollar sistemas de inteligencia artificial cada vez más poderosos.
Coxon había trabajado durante aproximadamente tres años en investigación entre OpenAI y Anthropic. Al anunciar su salida sostuvo que las compañías estaban avanzando hacia sistemas capaces de mejorarse a sí mismos sin haber resuelto suficientemente cómo mantenerlos bajo control.
Su mensaje se volvió extraordinariamente viral. Axios reportó que la publicación superó los 100 millones de visualizaciones y que Coxon incluso abandonó Anthropic antes de que se consolidara parte de su compensación accionaria.
Coxon lanzó otra advertencia especialmente severa: aseguró que personas que trabajan en el desarrollo de IA creen genuinamente que sistemas futuros podrían representar un riesgo existencial para la humanidad antes de que termine la década.