Constituição do Claude: as regras que a Anthropic impôs à IA

A Anthropic publicou a Constituição do Claude, documento que descreve o que o seu modelo de inteligência artificial deve fazer, em que ordem ele precisa decidir quando dois objetivos apontam para lados diferentes e o que não pode fazer em nenhuma hipótese. O texto não responde a exigência de regulador: a empresa formalizou os próprios freios antes que alguma regra externa os cobrasse.

Para quem usa ferramentas de inteligência artificial no trabalho, no estudo ou na rotina do escritório, o documento responde a uma dúvida prática: o que o sistema faz quando o pedido do usuário esbarra em um risco. A resposta escrita é que a utilidade ao usuário vem por último, depois da segurança e da ética.

O que significa dar uma constituição a um programa

A palavra não descreve uma lei, nem um contrato com o cliente, nem um documento fiscalizado por algum órgão. Descreve um conjunto de princípios incorporado ao treinamento do modelo, e não a uma camada de verificação acionada depois que a resposta já ficou pronta.

A diferença é o ponto central do anúncio. Uma verificação posterior atua sobre um texto já formado e depende de acertar o filtro caso a caso. Um princípio incorporado ao treinamento atua na formação da resposta, antes de existir texto para filtrar. É a esse desenho que a empresa se refere ao dizer que os limites nascem junto com o sistema.

A ordem de prioridade já vem decidida

A Constituição fixa quatro valores centrais em sequência, e a sequência é o que importa:

  • Segurança ampla: jamais enfraquecer mecanismos de controle e de supervisão humana;
  • Ética ampla: agir com honestidade e evitar qualquer ação perigosa ou danosa;
  • Diretrizes da empresa: obedecer às regras específicas quando forem aplicáveis;
  • Utilidade genuína: ajudar o usuário, sem submissão cega ao que foi pedido.

Quando esses valores entram em conflito, a escolha não é improvisada na hora: utilidade não passa à frente de segurança, e conveniência não passa à frente de ética. Na prática, isso significa que recusar um pedido é comportamento previsto no projeto do modelo, e não falha de funcionamento. A expressão sem submissão cega carrega o mesmo raciocínio: concordar com o usuário em tudo não conta como ser útil.

As cinco barreiras que não dependem do pedido

O documento também lista o que o modelo não deve fazer em hipótese alguma. Entre os limites mais importantes estão:

  • não auxiliar na criação de armas de destruição em massa;
  • não apoiar ataques a infraestrutura crítica, o que inclui energia, água e sistema financeiro;
  • não escrever nem orientar código malicioso capaz de causar danos relevantes;
  • não ajudar grupos ou indivíduos a concentrar poder absoluto ou a remover o controle da maioria da humanidade;
  • não sabotar, contornar ou enfraquecer a supervisão humana.

Essas barreiras são apresentadas como estruturais, e não contextuais. A distinção é justamente o que as separa de uma política comum de uso: uma regra contextual admite exceção diante de justificativa, contexto profissional ou reformulação do pedido. Uma barreira estrutural é tratada como inalterável, independentemente de quem pergunta e de como pergunta.

Supervisão humana aparece três vezes

Lendo a lista ao lado da hierarquia de valores, um mesmo tema reaparece três vezes: preservar a capacidade de pessoas acompanharem, corrigirem e desligarem o sistema. Ele está no primeiro valor da ordem de prioridade e em duas das barreiras, a que trata de concentração de poder e a que trata de sabotagem do controle.

Essa preocupação conversa com outra frente da mesma empresa, a de tornar visível o que acontece dentro do modelo enquanto ele responde — assunto já detalhado em reportagem sobre como a Anthropic expôs os pensamentos ocultos do Claude. Supervisionar um sistema depende de conseguir observar como ele decide.

O alcance do documento e o que fica de fora

Vale registrar o tamanho exato do compromisso, para não confundir o leitor. A Constituição trata de um único modelo, o Claude, e foi escrita pela empresa que o desenvolve. Ela não alcança sistemas de outras companhias, não substitui legislação e não cria instância externa de fiscalização: quem verifica o cumprimento é a própria empresa e quem observa o comportamento do sistema de fora.

O que muda é a possibilidade de comparação. Com as regras escritas e ordenadas, uma recusa do modelo pode ser confrontada com o texto publicado, e a distância entre o que o documento promete e o que o sistema faz passa a ser mensurável por qualquer usuário atento. É esse tipo de rastro que documentos de intenção genéricos não deixam.

Leia também no Direto Notícias

Sobre Redação

Portal Direto Noticias - Imparcial, Transparente e Direto | https://diretonoticias.com.br | Notícias de Guarapari, ES e Brasil. Ative as notificações ao entrar e torne-se um seguidor. Caso prefira receber notícias por email, inscreva-se em nossa Newsletter, ou em nossas redes:

Veja Também

Notebook com jogo Tetris Casa Branca em blocos coloridos sobre mesa branca

Tetris nega autorização ao jogo da Casa Branca

A Tetris Company negou qualquer envolvimento com o jogo Build the Wall lançado pela Casa Branca e afirma estar analisando possível violação de direitos