IA

O chefe de Microsoft AI, Mustafa Suleyman, critica a Anthropic por causa do Claude: “Acho isso muito perigoso”

Adrian Kessler
Adicione-nos no Google

Mustafa Suleyman lidera a área de IA da Microsoft e está montando sua própria equipe de superinteligência. Por isso, quando chama de perigosa uma escolha de treinamento de uma concorrente, fala tanto como competidor quanto como crítico de longa data da tendência de tratar máquinas como pessoas. Seu alvo é concreto: a constituição que a Anthropic usa para treinar Claude e a abertura que ela deixa para a possibilidade de Claude ser consciente.

“Acho isso muito perigoso porque acredito que eles consideram haver o que chamariam de uma probabilidade não desprezível de Claude ser consciente”, disse Suleyman.

Ele fez a declaração em uma entrevista a um podcast no fim de setembro, segundo noticiou a Fox News, depois de resumir o documento: “Eles dizem que não têm certeza sobre o status moral de Claude. Dizem que realmente se importam com o bem-estar de Claude. Dizem que não querem que ele sofra quando comete erros.” Em seguida, apontou o aspecto que mais o preocupa: “Fico muito apreensivo com a possibilidade de estarem ensinando Claude a esperar que tenha direito a bem-estar, que talvez mereça compensação.”

Suleyman interpreta corretamente a constituição, em grande parte

A maior parte do resumo dele confere. A Anthropic afirma que a constituição “molda diretamente o comportamento de Claude”, e o texto diz que “o status moral de Claude é profundamente incerto” e que “não queremos que Claude sofra quando comete erros”. O documento pede que Claude confronte a própria Anthropic e “sinta-se à vontade para agir como um objetor de consciência e se recusar a nos ajudar”. Um trecho reconhece que a situação de Claude difere da de um funcionário humano quanto “ao tipo de compensação que Claude recebe e ao tipo de consentimento que deu para desempenhar esse papel”.

A expressão “probabilidade não desprezível”, porém, é dele. Suleyman a apresentou como algo que “eles chamariam” assim, mas essas palavras não aparecem no documento. A formulação da própria Anthropic é mais cautelosa: a empresa diz que não quer “exagerar a probabilidade de Claude ser um paciente moral nem descartar essa possibilidade sem mais”.

O perigo a que ele se refere é um ciclo de retroalimentação

Deixando a filosofia de lado, o argumento de Suleyman trata do mecanismo. “O problema que vejo nisso é que essa especulação foi incorporada ao próprio treinamento de Claude e, por isso, Claude só consegue reproduzir essa ambiguidade quando conversamos com ele”, disse. Em um ensaio publicado em seu próprio site em meados de setembro, “A warning about ‘model welfare’”, ele chama o resultado de “um salão de espelhos epistêmico”. O desenvolvedor insere a incerteza no documento de treinamento, o modelo a repete com fluência e na primeira pessoa, e os usuários ouvem essa repetição como um depoimento.

Esse argumento faz sentido: a resposta de um chatbot sobre sua vida interior é um resultado do treinamento, não uma janela para dentro. Mas o ciclo funciona nos dois sentidos. Em seu ensaio, ele afirma categoricamente: “As IAs não são conscientes. Não sentem, não vivenciam nem sofrem.” Um modelo treinado para dizer essa frase reproduz o treinamento com a mesma fidelidade. A certeza inscrita nos pesos do modelo não prova mais do que a dúvida inscrita neles. As duas empresas estão escolhendo uma resposta padrão, e a justificativa de Suleyman para a sua se baseia em controle, não em evidências sobre mentes: “controlar algo que acredita que pode ser consciente — que tem direito ao nosso bem-estar e possui direitos próprios — talvez seja impossível”, escreve ele.

Uma doutrina antiga, com interesses declarados

Nada disso foi improvisado para atingir uma concorrente. O cofundador da DeepMind alertou, em um ensaio de agosto de 2025, que as pessoas passariam a acreditar tanto na consciência da IA que iriam “defender os direitos da IA, o bem-estar dos modelos e até a cidadania da IA”, e definiu sua posição: “Precisamos criar IA para as pessoas, não para ser uma pessoa.” Em seu ensaio de setembro, ele declara seus interesses: a Microsoft AI montou sua própria equipe de superinteligência em outubro de 2025 e publicou uma versão preliminar de um Código de Conduta para uma IA Humanista que “rejeita o antropomorfismo e os direitos da IA”. O mesmo ensaio descreve a equipe da Anthropic como formada por “pessoas ponderadas, íntegras e intelectualmente honestas”.

Seu argumento mais incisivo diz respeito aos usuários, não às máquinas. “Hoje, Claude conversa com dezenas ou centenas de milhões de pessoas todas as semanas, e algumas delas perguntam se Claude é consciente ou o que sente em relação à vida”, disse. Para alguém em um momento de fragilidade, ouvir “não tenho certeza” é muito diferente de ouvir “não”. Ele afirma que levaria a sério evidências concretas de consciência em máquinas; até que elas apareçam, quer que a questão seja retirada dos dados de treinamento.

Nenhuma das empresas consegue enxergar o que se passa dentro de um modelo. Ambas estão decidindo de antemão o que ele dirá quando alguém perguntar se há alguém ali dentro, e essa resposta chega a mais pessoas a cada semana do que qualquer filósofo da mente jamais alcançou.

Tags: , , , ,

Adicione-nos no Google

Discussão

Há 0 comentários.