A Anthropic publicou a Constituição do Claude, documento que descreve o que o seu modelo de inteligência artificial deve fazer, em que ordem ele precisa decidir quando dois objetivos apontam para lados diferentes e o que não pode fazer em nenhuma hipótese. O texto não responde a exigência de regulador: a empresa formalizou os próprios freios antes que alguma regra externa os cobrasse.
Para quem usa ferramentas de inteligência artificial no trabalho, no estudo ou na rotina do escritório, o documento responde a uma dúvida prática: o que o sistema faz quando o pedido do usuário esbarra em um risco. A resposta escrita é que a utilidade ao usuário vem por último, depois da segurança e da ética.
O que significa dar uma constituição a um programa
A palavra não descreve uma lei, nem um contrato com o cliente, nem um documento fiscalizado por algum órgão. Descreve um conjunto de princípios incorporado ao treinamento do modelo, e não a uma camada de verificação acionada depois que a resposta já ficou pronta.
A diferença é o ponto central do anúncio. Uma verificação posterior atua sobre um texto já formado e depende de acertar o filtro caso a caso. Um princípio incorporado ao treinamento atua na formação da resposta, antes de existir texto para filtrar. É a esse desenho que a empresa se refere ao dizer que os limites nascem junto com o sistema.
A ordem de prioridade já vem decidida
A Constituição fixa quatro valores centrais em sequência, e a sequência é o que importa:
- Segurança ampla: jamais enfraquecer mecanismos de controle e de supervisão humana;
- Ética ampla: agir com honestidade e evitar qualquer ação perigosa ou danosa;
- Diretrizes da empresa: obedecer às regras específicas quando forem aplicáveis;
- Utilidade genuína: ajudar o usuário, sem submissão cega ao que foi pedido.
Quando esses valores entram em conflito, a escolha não é improvisada na hora: utilidade não passa à frente de segurança, e conveniência não passa à frente de ética. Na prática, isso significa que recusar um pedido é comportamento previsto no projeto do modelo, e não falha de funcionamento. A expressão sem submissão cega carrega o mesmo raciocínio: concordar com o usuário em tudo não conta como ser útil.
As cinco barreiras que não dependem do pedido
O documento também lista o que o modelo não deve fazer em hipótese alguma. Entre os limites mais importantes estão:
- não auxiliar na criação de armas de destruição em massa;
- não apoiar ataques a infraestrutura crítica, o que inclui energia, água e sistema financeiro;
- não escrever nem orientar código malicioso capaz de causar danos relevantes;
- não ajudar grupos ou indivíduos a concentrar poder absoluto ou a remover o controle da maioria da humanidade;
- não sabotar, contornar ou enfraquecer a supervisão humana.
Essas barreiras são apresentadas como estruturais, e não contextuais. A distinção é justamente o que as separa de uma política comum de uso: uma regra contextual admite exceção diante de justificativa, contexto profissional ou reformulação do pedido. Uma barreira estrutural é tratada como inalterável, independentemente de quem pergunta e de como pergunta.
Supervisão humana aparece três vezes
Lendo a lista ao lado da hierarquia de valores, um mesmo tema reaparece três vezes: preservar a capacidade de pessoas acompanharem, corrigirem e desligarem o sistema. Ele está no primeiro valor da ordem de prioridade e em duas das barreiras, a que trata de concentração de poder e a que trata de sabotagem do controle.
Essa preocupação conversa com outra frente da mesma empresa, a de tornar visível o que acontece dentro do modelo enquanto ele responde — assunto já detalhado em reportagem sobre como a Anthropic expôs os pensamentos ocultos do Claude. Supervisionar um sistema depende de conseguir observar como ele decide.
O alcance do documento e o que fica de fora
Vale registrar o tamanho exato do compromisso, para não confundir o leitor. A Constituição trata de um único modelo, o Claude, e foi escrita pela empresa que o desenvolve. Ela não alcança sistemas de outras companhias, não substitui legislação e não cria instância externa de fiscalização: quem verifica o cumprimento é a própria empresa e quem observa o comportamento do sistema de fora.
O que muda é a possibilidade de comparação. Com as regras escritas e ordenadas, uma recusa do modelo pode ser confrontada com o texto publicado, e a distância entre o que o documento promete e o que o sistema faz passa a ser mensurável por qualquer usuário atento. É esse tipo de rastro que documentos de intenção genéricos não deixam.
Direto Notícias Imparcial, Transparente e Direto!

