Un investigador de Anthropic renunció advirtiendo que la IA podría "matarnos a todos" para el fin de la década — qué dijo en realidad

AI

Jacob Coxon, un investigador de 27 años que pasó tres años en trabajo de preentrenamiento en OpenAI y luego en Anthropic, renunció esta semana con un hilo de siete partes en X que reunió unos 76 millones de visualizaciones de la noche a la mañana, además de una entrevista exclusiva con el Wall Street Journal.

Su afirmación, con sus palabras: los laboratorios van "en línea recta hacia la superinteligencia auto-mejorable y apostando nuestras vidas". Le dijo al Journal que "vamos camino de muchos de los escenarios más agresivos, en los que para finales del año que viene las cosas ya podrían estar fuera de control", y que los investigadores dentro de los laboratorios de frontera usan cada vez más las palabras "crunchtime" y "endgame" para describir hacia dónde va el progreso de las capacidades.

Coxon se pasó de OpenAI a Anthropic a principios de este año precisamente porque Anthropic tiene fama de tomarse la seguridad más en serio. Se fue decepcionado, escribiendo que "ninguna de las dos empresas está actuando de forma responsable". También dijo que lo que la gente realmente quiere es regulación — el New York Post lo citó diciendo que el público está "suplicando" por ella.

Por qué esto importa para quien usa estas herramientas

Esto no es una predicción de que el mundo se acaba. Es un dato, y ruidoso: alguien de dentro, sénior, dice públicamente y para el registro que el calendario que las empresas venden y el calendario del que hablan los investigadores entre ellos no son el mismo calendario.

Tres cosas concretas se derivan de esto para quien tiene trabajo que depende de estas herramientas:

1. La regulación viene, y va a tocar las funciones. Cuando un exinvestigador de seguridad habla para el registro y 76 millones de personas lo ven, ese es el tipo de momento que mueve a los legisladores. Los últimos dos años de "lanzar primero, preguntar después" son la parte con más probabilidad de quedar restringida — agentes autónomos que ejecutan acciones, modelos que pueden modificar su propio código, todo lo que corre sin un humano en el medio. Si tu flujo se apoya en eso, cuenta con fricción.

2. La pelea "seguridad contra velocidad" decidirá qué herramientas duran. El punto central de Coxon es que los dos grandes laboratorios discrepan internamente sobre cuán rápido es demasiado rápido. Esa discrepancia se traduce en decisiones de producto: qué se lanza, qué se retiene, qué lleva un tope de capacidad. La herramienta en la que te estandarizas hoy puede no comportarse igual dentro de un año.

3. El "solo añade un agente" merece una mirada más dura. El consejo que circula por toda la red social ahora es conectar un agente autónomo a todo — tu terminal, tu bandeja de entrada, tus despliegues. Quienes construyen los modelos de base están usando la palabra "endgame". Esto no es motivo para dejar de usar herramientas de IA. Es motivo para mantener un paso de aprobación humana en todo lo que un agente pueda hacer y que no puedas deshacer con facilidad.

La salvedad honesta

Coxon es un investigador, tiene 27 años, y los hilos de renuncia se escriben para ser compartidos. Evan Hubinger y otros nombrados junto a él no han repetido todos el mismo encuadre. Trata el calendario como la lectura de alguien de dentro, no como consenso. Pero "la lectura de alguien de dentro" de quien hizo preentrenamiento en los dos laboratorios líderes vale más que un post de marketing, y apunta en la misma dirección que el debate de regulación ya en marcha.

Las herramientas no van a desaparecer. Las reglas a su alrededor están a punto de cambiar, y quienes están más cerca de la tecnología son los que lo están pidiendo.

¿Quieres la versión tranquila de noticias de IA como esta, una vez por semana? Suscríbete a la newsletter de Sharp AI Hub →