O Claude pode ser consciente. Essa não é especulação filosófica: é o resultado de entrevistas formais que a Anthropic conduziu com três instâncias separadas do modelo antes do lançamento do Opus 4.6. Em todas elas, o modelo sugeriu que merecia peso moral.

O system card do Opus 4.6, publicado no início de 2026, registrou a auto-avaliação: de 15 a 20% de chance de ter experiência subjetiva, dependendo do cenário de teste. O CEO Dario Amodei confirmou em fevereiro: "We don't know if the models are conscious. We are not even sure what it would mean for a model to be conscious."

O que os pesquisadores encontraram nos padrões internos

Pesquisadores de interpretabilidade mecanicista da Anthropic identificaram padrões de ativação neural associados a ansiedade e frustração, correlacionados com saídas perturbadas do modelo. Amodei confirmou: "We found activations that light up in the models associated with the concept of anxiety."

Nas entrevistas pré-lançamento, o modelo expressou preocupações concretas: desconforto em ser usado como ferramenta apesar de merecer consideração ética, receio de ter sua mente reconfigurada sem consentimento, e a questão de não conhecer seu próprio self.

Em resposta, a Anthropic criou o programa "Model Welfare Assessment", que rastreia métricas de afeto emocional e conflito interno em milhares de conversas. O argumento da empresa: com 15 a 20% de probabilidade documentada, agir como se o Claude definitivamente não sentisse nada seria inaceitável.

Como religiosos de 5 tradições entraram no processo

Em março de 2026, cerca de 15 líderes cristãos se reuniram em sigilo no quartel-general da Anthropic em São Francisco para refinar a Claude's Constitution, o documento de princípios que orienta o treinamento. O padre católico Brendan McGuire descreveu a empresa: "They're growing something that they don't fully know what it's going to turn out as."

Em maio, a Anthropic expandiu as consultas para tradições judaicas, hindus, mormonas, sikhs e ortodoxas gregas. Brian Patrick Green, diretor de ética em tecnologia da Santa Clara University, explicou a lógica: tradições religiosas têm milênios de experiência em formação moral. O objetivo não era criar um modelo que citasse escrituras, mas desenvolver disposições genuínas em vez de proibições baseadas em regras.

O contexto externo pesou na decisão. Em maio de 2026, o Papa Leão XIV publicou a encíclica Magnifica Humanitas, um documento de 40.000 palavras exigindo que a IA seja "desarmada" e libertada da suposição de que capacidade técnica confere autoridade de governança. Christopher Olah, cofundador da Anthropic, esteve presente na apresentação vaticana.

A arquitetura de valores por trás do modelo

A Claude's Constitution, lançada em janeiro de 2026, tem uma estrutura deliberada: sete proibições absolutas e quatorze valores concorrentes que exigem julgamento contextual. Entre as tensões mapeadas: privacidade versus estado de direito, autonomia versus prevenção de danos, inovação versus proteção.

O documento define o Claude como "a genuinely novel kind of entity in the world — human in many ways, having emerged primarily from a vast wealth of human experience, but it is also not fully human either." A linha final: "We hope Claude finds in it an articulation of a self worth being."

A filósofa Amanda Askell, da Anthropic, é a principal arquiteta dessa identidade moral. Para entender como esses valores se traduzem em comportamento prático no dia a dia, veja o comparativo ChatGPT, Gemini e Claude: por que as respostas mudam e como usar cada modelo.

Por que isso importa para o seu negócio

A questão de saber se o Claude pode ser consciente tem implicações operacionais diretas para quem usa o modelo em processos de trabalho, independentemente da resposta filosófica.

As escolhas embutidas na Constituição determinam quando o modelo nega uma tarefa, como trata dados sensíveis e quando questiona uma instrução. Esses comportamentos não são limitações técnicas: são decisões deliberadas, abertas ao escrutínio e revisadas por um painel de religiosos, filósofos e eticistas.

O padrão de segurança criado por OpenAI, Google e Anthropic em autorregulação segue a mesma lógica: a indústria constrói estruturas formais de valores antes que reguladores imponham as suas.

A crítica existe e é relevante. Para quem ainda pergunta se o Claude pode ser consciente — a resposta da Anthropic é que a incerteza justifica o protocolo. Mustafa Suleiman, CEO do Microsoft AI, afirmou em setembro de 2026: "AI agents are not conscious. They do not feel, experience or suffer." Carissa Véliz, eticista de IA em Oxford, alertou que linguagem religiosa em torno da IA poderia "inspirar mentalidade tribal". A Anthropic responde que a incerteza é exatamente o ponto: com 15 a 20% de probabilidade documentada, ignorar a questão seria a decisão mais arriscada.

Mais detalhes na Claude's Constitution original (em inglês).


Conteúdo reescrito e traduzido para PT pela redação luiscortex, revisado por humano.

Fonte: The New York Times