Um investigador da Anthropic demitiu-se a avisar que a IA pode "matar-nos a todos" até ao fim da década — o que ele disse mesmo

AI

Jacob Coxon, um investigador de 27 anos que passou três anos em trabalho de pré-treino na OpenAI e depois na Anthropic, demitiu-se esta semana com uma thread de sete partes no X que teve cerca de 76 milhões de visualizações da noite para o dia, além de uma entrevista exclusiva ao Wall Street Journal.

A afirmação dele, nas suas palavras: os laboratórios estão "a correr em linha reta para a superinteligência auto-melhorável e a apostar as nossas vidas". Disse ao Journal que "estamos no caminho de muitos dos cenários mais agressivos, em que já no fim do próximo ano as coisas podem estar fora de controlo", e que os investigadores dentro dos laboratórios de fronteira usam cada vez mais as palavras "crunchtime" e "endgame" para descrever para onde vai o progresso das capacidades.

Coxon mudou-se da OpenAI para a Anthropic no início deste ano precisamente porque a Anthropic tem fama de levar a segurança mais a sério. Saiu desiludido, escrevendo que "nenhuma das duas empresas está a agir de forma responsável". Disse também que o que as pessoas realmente querem é regulação — o New York Post citou-o a dizer que o público está a "implorar" por ela.

Por que isto importa para quem usa estas ferramentas

Isto não é uma previsão de que o mundo acaba. É um dado, e um dado barulhento: alguém de dentro, sénior, está a dizer publicamente e para o registo que o calendário que as empresas vendem e o calendário de que os investigadores falam entre si não são o mesmo calendário.

Três coisas concretas resultam disto para quem tem trabalho dependente destas ferramentas:

1. A regulação vem aí, e vai tocar nas funcionalidades. Quando um ex-investigador de segurança fala para o registo e 76 milhões de pessoas veem, esse é o tipo de momento que move legisladores. Os últimos dois anos de "lançar primeiro, perguntar depois" são a parte com mais probabilidade de ser travada — agentes autónomos que executam ações, modelos que podem modificar o próprio código, tudo o que corre sem um humano no meio. Se o teu fluxo assenta nisso, conta com atrito.

2. A luta "segurança contra velocidade" vai decidir que ferramentas sobrevivem. O ponto central de Coxon é que os dois grandes laboratórios discordam internamente sobre quão rápido é rápido demais. Essa discordância traduz-se em decisões de produto: o que é lançado, o que é retido, o que leva um limite de capacidade. A ferramenta em que estandardizas hoje pode não se comportar da mesma forma daqui a um ano.

3. O "é só pôr um agente" merece um olhar mais duro. O conselho que anda por toda a rede social agora é ligar um agente autónomo a tudo — o teu terminal, a tua caixa de entrada, os teus deploys. Quem constrói os modelos por baixo está a usar a palavra "endgame". Isto não é motivo para parar de usar ferramentas de IA. É motivo para manter um passo de aprovação humana em tudo o que um agente possa fazer e que não consigas desfazer com facilidade.

A ressalva honesta

Coxon é um investigador, tem 27 anos, e threads de demissão são escritas para serem partilhadas. Evan Hubinger e outros nomeados ao lado dele não repetiram todos o mesmo enquadramento. Trata o calendário como a leitura de alguém de dentro, não como consenso. Mas "a leitura de alguém de dentro" de quem fez pré-treino nos dois laboratórios líderes vale mais do que um post de marketing, e aponta na mesma direção do debate de regulação já em curso.

As ferramentas não vão desaparecer. As regras à volta delas estão prestes a mudar, e quem está mais perto da tecnologia é quem está a pedi-lo.

Queres a versão calma de notícias de IA como esta, uma vez por semana? Subscreve a newsletter do Sharp AI Hub →