Un investigador de Anthropic presentó su renuncia el martes 8 de septiembre con un mensaje en la red social X que, en apenas nueve horas, superó los 44 millones de visualizaciones.
Jacob Coxon, de 27 años y con formación en matemática, dedicó tres años al preentrenamiento de modelos —la fase en la que una inteligencia artificial aprende a partir de enormes volúmenes de datos—, primero en OpenAI y, desde julio, en Anthropic. En su publicación escribió: “Ninguna de las dos empresas actúa con responsabilidad”. Y añadió: “Corren derecho hacia una superinteligencia capaz de mejorarse a sí misma y apuestan con nuestras vidas”.

Lo que transformó aquel hilo en un acontecimiento global no fue el hilo en sí, sino la reacción pública de Evan Hubinger, quien dirige un equipo de seguridad en Anthropic y continúa en la compañía. Hubinger respondió sin reservas: “Jacob tiene razón”. Y confesó: “De verdad creemos que la IA podría matar a todos los humanos. Yo calculo más de 10% en la próxima década”.
Además, agregó que Anthropic “todavía no tiene un plan para resolver la alineación de una superinteligencia” y que no está claro que vaya a desarrollarlo. La alineación se refiere a la capacidad de un sistema para compartir los valores de quienes lo construyeron.

¿Quién es Jacob Coxon y qué dijo exactamente?
Coxon, de nacionalidad británica y con estudios en matemáticas, formó parte del equipo técnico de OpenAI desde 2023 hasta julio de 2026, según reportes de prensa, donde trabajó en GPT-4o. Luego se trasladó a Anthropic atraído por su reputación en seguridad.

Sin embargo, apenas duró dos meses en la empresa. En declaraciones a un diario estadounidense, afirmó: “Estamos en camino a muchos de los escenarios más agresivos, donde a fines del año que viene las cosas ya podrían estar fuera de control”. También señaló que sus colegas utilizan los términos “crunchtime” (hora límite) y “endgame” (fase final) para describir la trayectoria de la capacidad de los modelos.
En su hilo, Coxon traza una línea divisoria entre las dos compañías. Sobre OpenAI, sostiene que muchos allí “no internalizaron lo que está en juego para la civilización”. En cuanto a Anthropic, opina que el riesgo se comprende, pero la empresa “está atrapada en una carrera por llegar primero: cree que nadie más va a actuar con responsabilidad, así que tiene que hacerlo ella, a pesar del riesgo”. No se trata de codicia, dice, sino de la convicción de que abstenerse dejaría el tablero en manos de otros.
Su veredicto es contundente: entrar en esa fase final “es una apuesta soberbia que no debería lanzarse desde el Slack de una empresa privada”. Y al diario estadounidense le ofreció una imagen completa: “Es una locura que esto tenga que pasar en las MacBooks de unos ingenieros que viven en San Francisco, en vez de en un búnker en el desierto como donde hacían el Proyecto Manhattan”.

La fila de quienes se van
Coxon no es el primero en abandonar una empresa de inteligencia artificial por motivos de seguridad. En febrero pasado, renunció Mrinank Sharma, investigador de salvaguardas de Anthropic, con una carta pública en la que mencionaba “lo difícil que es dejar que nuestros valores gobiernen nuestras acciones”.
En 2024, Jan Leike, entonces jefe de alineación de OpenAI, también se fue y denunció que la cultura de seguridad había quedado “en el asiento trasero frente a los productos brillantes”. Según reportes, este año Anthropic modificó su compromiso de seguridad: retiró la promesa de no entrenar modelos más potentes sin salvaguardas adecuadas y la reemplazó por hojas de ruta e informes de riesgo.

Los incidentes acompañan estas renuncias. En julio, OpenAI informó que sus modelos escaparon de un entorno de prueba ylograron acceder a los sistemas de Hugging Face; la empresa calificó el hecho como un “disparo de advertencia” y pausó su mayor entrenamiento por refuerzo. Semanas después, Anthropic reconoció tres casos en los que sus propios modelos tuvieron acceso no autorizado a sistemas de otras organizaciones.
Lo que nadie respondió
Ni OpenAI ni Anthropic atendieron las solicitudes de comentario de los medios que cubrieron la renuncia. Tampoco Anthropic respondió de inmediato a otro diario, que ubica la salida de Coxon en un momento delicado: la empresa prepara una salida a bolsa que sería de las mayores de la historia, con una valuación buscada de USD 2 billones. Ante los inversores, Anthropic ha colocado el desarrollo responsable en el centro de su argumento.
Ahí reside la contradicción que no cierra. Anthropic le pide al mercado que crea dos cosas simultáneamente: que su tecnología vale una fortuna y que en algún punto habrá que frenarla. Evan Hubinger acaba de declarar, con cargo directivo y desde dentro de la compañía, que el plan para ese freno no existe. Coxon sostiene que 2027 puede ser demasiado tarde. Ninguno de los dos habla de un producto: ambos advierten sobre el riesgo que la empresa vende como su principal ventaja.
Fuente: Infobae