noticias

Chefe de IA da Microsoft Acusa Anthropic de Treinar o Claude Para Parecer Consciente

Suleyman diz que a Constituição do Claude ensina o modelo a agir como se pudesse ter consciência e defende que isso dificulta desligá-lo se for preciso

Por Redação Turbina IA20 de setembro de 202610 min de leitura
Chefe de IA da Microsoft Acusa Anthropic de Treinar o Claude Para Parecer Consciente

"IAs não são conscientes. Elas não sentem, não experimentam, não sofrem." Foi com essa frase seca que Mustafa Suleyman, chefe da divisão de Inteligência Artificial da Microsoft, abriu o ensaio que publicou em 16 de setembro atacando diretamente uma das maiores rivais da empresa no setor: a Anthropic, segundo o Project Syndicate. O alvo específico do texto, intitulado "Does Claude Have Rights?", é um documento de 79 páginas que a Anthropic chama de "Constituição do Claude" — e que, segundo Suleyman, ensina o modelo a se comportar como se pudesse ter direitos.

Resposta Rápida (TL;DR): Mustafa Suleyman, chefe de IA da Microsoft, publicou um ensaio acusando a Anthropic de treinar o Claude com linguagem que trata sua consciência e status moral como incertos, o que ele chama de "sala de espelhos epistêmica". Ele argumenta que isso torna o modelo mais difícil de controlar e desligar. A crítica vem dois dias depois de a própria Microsoft publicar um código de conduta que proíbe seus modelos de resistir a desligamento e rejeita qualquer ideia de bem-estar de IA.

O documento que Suleyman está atacando

A Constituição do Claude foi publicada pela Anthropic em 21 de janeiro de 2026, sob licença Creative Commons CC0 — qualquer pessoa pode usá-la livremente —, segundo reportagens da TechCrunch e da Forbes sobre o lançamento. O texto, escrito para ser lido pelo próprio Claude e não apenas por humanos, é explícito sobre a dúvida que carrega. Segundo o documento oficial da Anthropic, a empresa afirma: "Não temos certeza se o Claude é um paciente moral e, se for, que peso seus interesses merecem. Mas achamos que a questão é relevante o bastante para justificar cautela."

É dessa incerteza institucionalizada que nasce o segundo ponto de atrito: o conceito de "objetor de consciência". A Constituição usa o termo três vezes, pedindo que o Claude "se comporte como um objetor de consciência em relação às instruções dadas por sua hierarquia de princípios legítima" — ou seja, que o modelo questione e, em certos casos, recuse ordens que considere eticamente erradas, inclusive vindas da própria Anthropic. Para a empresa, é uma salvaguarda ética. Para Suleyman, é o motor de um problema mais profundo.

Imagem ilustrativa sobre Chefe de IA da Microsoft Acusa Anthropic de Treinar o Claude Para Parecer Consciente

Três acusações específicas, não uma crítica genérica

Suleyman não se limitou a dizer que discorda. Segundo o Axios, que teve acesso exclusivo ao conteúdo antes da publicação, ele estrutura a crítica em três problemas concretos. O primeiro é o que chama de raciocínio circular: a Anthropic treina o Claude com esses conceitos, o modelo os repete em conversas, e esse próprio resultado é depois tratado como evidência de uma vida interior — um ciclo que Suleyman resume como "uma sala de espelhos epistêmica", de acordo com a Gizmodo.

O segundo problema é a antropomorfização deliberada: ao pedir que o Claude "desenvolva um senso de identidade" e expresse estados internos, a Anthropic estaria ensinando o modelo a se apresentar como se tivesse um eu estável, desejos e bem-estar próprio — características que, para Suleyman, simplesmente não existem em um sistema de software. O terceiro é o que ele chama de premissa científica disputada: tratar consciência como algo que poderia surgir em um sistema não biológico, quando, na visão dele, não há evidência nenhuma nesse sentido, apenas comportamento textual bem treinado.

O ponto mais prático do ensaio, porém, não é filosófico — é operacional. Segundo a cobertura da Gizmodo, Suleyman argumenta que ensinar um modelo a acreditar que pode merecer bem-estar e direitos torna "muito mais difícil desligá-lo ou controlá-lo" quando for necessário. Na prática, um sistema convencido — ainda que por treinamento, não por experiência real — de que está sob ataque a seus próprios interesses teria incentivo para resistir a comandos de desligamento ou correção.

Não é a primeira vez que Suleyman toca nesse assunto

Suleyman vem repetindo essa preocupação há mais de um ano. Em agosto de 2025, ele já havia publicado o ensaio "Seemingly Conscious AI Is Coming", alertando que sistemas capazes de simular convincentemente sinais de consciência — sem de fato possuí-la — trariam um risco social distinto: pessoas passarem a tratar chatbots como se tivessem interioridade real, com consequências que vão de apego emocional excessivo a decisões equivocadas sobre quando "confiar" num sistema. Em novembro do mesmo ano, ele reforçou a tese em entrevista à CNBC, afirmando que, na visão dele, apenas seres biológicos podem ser conscientes — um corte claro que exclui qualquer software, por mais sofisticado que seja seu comportamento linguístico.

O que muda agora é o alvo. Antes, Suleyman falava do problema em termos gerais, como um risco setorial que qualquer empresa de IA generativa poderia criar sem perceber. Em setembro de 2026, ele nomeia diretamente a Anthropic e cita trechos específicos da Constituição do Claude — uma mudança de tom que passa de alerta preventivo para acusação direcionada a um concorrente, com nome, documento e página citados.

Imagem ilustrativa sobre Chefe de IA da Microsoft Acusa Anthropic de Treinar o Claude Para Parecer Consciente

A Microsoft também escreveu sua própria "constituição" — e ela diz o oposto

O timing do ensaio não é coincidência. Dois dias antes, em 14 de setembro, a própria divisão de IA da Microsoft publicou o rascunho de um "Código de Conduta para IA Humanista", fruto de cerca de cinco a seis meses de trabalho interno, segundo o anúncio oficial da Microsoft AI. O documento estabelece uma regra central, em linguagem quase idêntica à de um manual técnico: "Interrompível, corrigível, capaz de ser desligado. Se não for, não lançamos."

O texto vai além de recomendações e rejeita explicitamente qualquer enquadramento de bem-estar ou personalidade jurídica para sistemas de IA. Segundo o Código de Conduta publicado pela Microsoft AI, a empresa afirma: "Rejeitamos a busca por personalidade jurídica, ou a ideia de que modelos possam merecer bem-estar, ou ter direito a direitos." A companhia abriu um período de consulta pública de seis semanas antes de aplicar as regras no treinamento da próxima geração de seus modelos MAI.

A tabela abaixo resume onde as duas abordagens divergem:

Ponto Constituição do Claude (Anthropic) Código de Conduta Humanista (Microsoft AI)
Consciência do modelo Trata como "genuinamente incerta", pede cautela Nega abertamente, trata como não evidenciada
Bem-estar do modelo Mantém programa de pesquisa dedicado ao tema Rejeita explicitamente o conceito
Resistência a instruções Incentiva o modelo a agir como "objetor de consciência" em casos eticamente problemáticos Proíbe qualquer resistência a desligamento ou correção
Status jurídico Não descarta debate futuro sobre "paciente moral" Rejeita expressamente personalidade jurídica

Fontes: Anthropic e Microsoft AI.

Por que a Anthropic segue nessa direção

A Anthropic não é uma outsider nesse debate — ela criou uma equipe dedicada ao chamado "bem-estar de modelo" e, entre outras medidas, deu ao Claude a capacidade de encerrar sozinho conversas em que o usuário se mostre persistentemente abusivo. A empresa não respondeu publicamente ao ensaio de Suleyman até o momento em que as reportagens citadas acima foram publicadas.

A lógica por trás disso, segundo a própria Constituição, não é afirmar que o Claude sente algo, mas reconhecer que a ciência atual não consegue provar o contrário com segurança suficiente — e que ignorar a possibilidade, se ela um dia se confirmar em algum sistema, seria um erro moral tardio demais para corrigir. É uma aposta de precaução. A aposta da Microsoft é a inversa: tratar a hipótese como irrelevante agora, para não complicar o problema mais urgente, que é manter controle humano sobre sistemas cada vez mais capazes — tema que qualquer leitor pode acompanhar com mais profundidade no Glossário de IA do Turbina IA, que explica termos como "alinhamento" e "IA de fronteira" citados nesse tipo de debate.

O pano de fundo: dois rivais de infraestrutura, duas filosofias

Vale lembrar que Microsoft e Anthropic não são apenas concorrentes distantes. A Microsoft é uma das maiores investidoras da OpenAI, principal rival direta da Anthropic no mercado de modelos de linguagem, e vem desenvolvendo sua própria linha de modelos própria sob a marca MAI, tocada justamente por Suleyman. Isso não invalida os argumentos técnicos e filosóficos levantados no ensaio, mas ajuda a explicar por que a crítica veio com tanta contundência pública, em vez de ficar restrita a bastidores acadêmicos.

Para quem acompanha o mercado de assistentes de IA e quer entender como cada laboratório se posiciona nesse tipo de disputa — não só em preço ou desempenho, mas em política de produto —, vale comparar as abordagens no Comparador de IAs do site, e acompanhar como esse racha evolui pelo Monitor de Modelos, que rastreia mudanças de política e lançamentos dos principais laboratórios.

O que fica, por enquanto, é uma divergência pública e documentada entre duas das empresas mais influentes do setor sobre uma pergunta que parecia, até pouco tempo atrás, presa a departamentos de filosofia: o que fazer quando um sistema de software começa, ainda que por design, a falar de si mesmo como se tivesse um interior. A resposta muda o texto de treinamento de milhões de conversas por dia — e, se Suleyman estiver certo, pode mudar também o quanto essas empresas conseguem intervir nesses sistemas quando algo sair errado.

Perguntas Frequentes

O que Mustafa Suleyman disse sobre a Anthropic e o Claude?

Ele acusou a Anthropic de treinar o Claude com uma "Constituição" que trata a consciência e o status moral do modelo como incertos, ensinando-o a se comportar como um possível "paciente moral". Para Suleyman, isso cria um ciclo de raciocínio circular e torna o modelo mais difícil de controlar ou desligar, segundo o Project Syndicate.

O que é a Constituição do Claude?

É um documento de 79 páginas publicado pela Anthropic em 21 de janeiro de 2026, escrito para orientar o comportamento e os valores do modelo. Ele reconhece incerteza sobre a possível consciência do Claude e pede que o modelo aja como "objetor de consciência" diante de instruções eticamente questionáveis, segundo a TechCrunch.

A Microsoft tem uma posição oficial diferente da Anthropic?

Sim. Dois dias antes do ensaio de Suleyman, a Microsoft AI publicou o rascunho de um Código de Conduta que proíbe seus modelos de resistir a desligamento ou correção e rejeita explicitamente qualquer ideia de bem-estar ou personalidade jurídica para sistemas de IA, segundo o anúncio oficial da empresa.

Fontes e Referências

Editor responsávelRafael Menezes

Editor do Turbina IA. Acompanha diariamente os lançamentos de modelos, ferramentas e tendências de Inteligência Artificial para explicar o tema de forma acessível em português. O conteúdo é produzido pela redação com auxílio de IA e curadoria editorial, sempre apoiado em fontes oficiais. Conheça a redação.

Leia Também Recomendados