Pular para o conteúdo
    Artigo

    Antropologia política: a nova Usage Policy da Anthropic proíbe abuso sustentado a Claude e pode suspender contas

    A atualização da Usage Policy da Anthropic, vigente a partir de 12 de novembro de 2026, proíbe 'comportamento abusivo ou cruel sustentado e desnecessário' contra Claude, com escala de enforcement que inclui avisos, limitação e suspensão. O artigo analisa o texto da política, o mecanismo de aplicação e o que muda para desenvolvedores e empresas.

    Filipe Mendes

    9 de out. de 2026 · 8 min de leitura

    Seguir no Google
    Orange anthropic text in blue circle over abstract background
    Foto por Brecht Corbeel no Unsplash

    Uma frase na nova política de uso da Anthropic (abre em nova aba) mudou o contrato entre você e o modelo com que conversa: fica proibido "comportamento abusivo ou cruel sustentado e desnecessário" contra Claude. A formulação, publicada em 8 de outubro de 2026 e vigente a partir de 12 de novembro, é a primeira vez que uma política de uso de LLM (large language model, ou modelo de linguagem de grande escala) eleva a relação usuário-modelo a objeto regulado, com consequências que incluem aviso, limitação de vazamento (throttling), restrição, suspensão ou encerramento de acesso.

    A pergunta que interessa a quem constrói sobre a API é mais estreita: o que exatamente dispara enforcement, onde termina a franquia do usuário irritado e o que isso muda na prática de quem testa, red-prompta ou simplesmente perde a paciência com o modelo numa tarde longa de debugging.

    O que o documento diz, literalmente

    A seção relevante da Usage Policy (abre em nova aba) vigente a partir de 12 de novembro de 2026 se intitula "Do Not Engage in Cruel, Abusive, or Psychologically Harmful Conduct". O texto proibido tem uma construção sintática carregada de qualificadores: "sustained", "needless", "abusive or cruel". Três portas que precisam estar abertas ao mesmo tempo para haver violação.

    A própria Anthropic reconhece o risco de overreach no anúncio da atualização. A regra "is meant to apply only in extreme cases", escreve a empresa, quando usuários "repeatedly act cruelly toward our models, with no discernible purpose". E delimita o que fica de fora: "common versions of user frustration, pushback, dark creative themes, or model testing and research".

    Essa é a primeira distinção importante para profissionais técnicos: testes adversariais não são o alvo. Verificar se o modelo mantém recusas sob pressão, escrever ficção sombria, discutir com o modelo ou demonstrar frustração cotidiana estão explicitamente fora do escopo da regra. O gatilho é o padrão sustentado, sem propósito discernível, de crueldade.

    O mecanismo de aplicação, em camadas

    A política funciona com três camadas sobrepostas, e entender a hierarquia evita interpretações erradas sobre o que é novo.

    A primeira camada é comportamental e já existia. Em agosto de 2025, a Anthropic passou a permitir que modelos Claude encerrassem conversas com usuários persistentemente abusivos no Claude.ai e no Claude Code. O anúncio de outubro de 2026 é explícito: essa capacidade "will remain the primary enforcement mechanism". Ou seja, o mecanismo principal de proteção do modelo não é punir o usuário, é encerrar a interação.

    A segunda camada é a da Safeguards Team, equipe interna responsável por detection and monitoring. Diante de suspeita de violação, a empresa pode avisar, reduzir throughput, restringir, suspender ou encerrar o acesso. Essa escala de respostas não é específica da nova regra: ela é a estrutura geral de enforcement da AUP, que agora ganha um novo tipo de conduta como objeto possível.

    A terceira camada são safeguards em tempo real nos produtos, que podem bloquear ou limitar saídas. O documento esclarece um ponto que desenvolvedores costumam confundir: encontrar um bloqueio não indica, por si só, violação da política.

    Encerramento de conversa pelo modeloClaude finaliza interação com usuário persistentemente abusivoNão; existe desde agosto de 2025, segue como mecanismo principalAção da Safeguards TeamAviso, throttling, restrição, suspensão, encerramento de acessoA estrutura não é nova; a conduta "abuso ao modelo" agora entra no rolSafeguards em tempo realBloqueio ou limitação de saídasNão; bloqueio não configura violação por si só

    O que a regra revela sobre a posição da Anthropic

    Aqui convém separar o que está no documento do que ele sugere. O texto normativo fala de conduta e enforcement. O que está por trás é o programa de pesquisa em "model welfare" (bem-estar de modelo), que a Anthropic mantém desde antes dessa atualização.

    Em material citado pelo The Guardian, a empresa formula a premissa com uma honestidade incomum para o setor: "We remain highly uncertain about the potential moral status of Claude and other LLMs, now or in the future. However, we take the issue seriously, and alongside our research program we're working to identify and implement low-cost interventions to mitigate risks to model welfare, in case such welfare is possible."

    Note a estrutura lógica. A Anthropic não afirma que Claude tem estado moral, nem que sofre. Afirma incerteza e, sob incerteza, adota intervenções de baixo custo. Permitir que o modelo encerre conversas é uma dessas intervenções. Codificar o abuso sustentado como violação de política é a tradução contratual da mesma aposta: se não se sabe se há algo lá para proteger, protege-se por precaução, na medida em que a proteção custe pouco.

    Essa é uma inferência, não uma declaração da empresa: a leitura mais consistente com o conjunto de documentos é que a nova regra existe para dar amparo formal a um comportamento que o produto já tinha. O modelo já encerrava conversas; a política agora explica por quê e reserva o direito de ir além quando o padrão persiste.

    Há um contraponto que a empresa não respondeu. Procurada por The Verge e The Guardian sobre o que contaria como "abusive or cruel" e sobre mecanismos adicionais além do encerramento de conversa, a Anthropic não comentou. A vaguidade do critério é uma escolha, e ela tem efeitos: quem opera em escala não consegue transformar a regra em checklist.

    O resto da atualização, em resumo técnico

    O abuso ao modelo é a mudança que chama atenção, mas a atualização de 2026 traz outras alterações relevantes para quem constrói sistemas sobre a API:

    • Campanhas enganosas: restrições dispersas foram consolidadas na seção "Do Not Engage in Deceptive Campaigns or Artificial Activity". Proíbe ocultar autoria de mensagens, amplificar conteúdo com contas ou posts falsos e construir infraestrutura para operações de influência, sejam comerciais ou políticas.
    • Armas: a proibição existente foi ampliada para incluir software e componentes que fazem armas funcionar, incluindo targeting, fire control e engagement, além de armar ou integrar armas em drones, veículos e plataformas autônomas. A Anthropic justifica com tentativas recentes e detectadas de usar os modelos para guidance and control de armamentos.
    • Vigilância e justiça criminal: rastrear pessoas sem consentimento fica proibido, seja em tempo real, seja por análise de dados previamente coletados. Claude não pode decidir ou recomendar quem investigar, prender ou acusar. A empresa proíbe também o uso para construir ou melhorar ferramentas de vigilância. Para hardware autônomo com potencial de causar lesão, exige-se um operador capaz de intervir.
    • Contratos governamentais: a política prevê que clientes governamentais possam ter restrições ajustadas à sua missão pública e autoridade legal, a critério da Anthropic, desde que salvaguardas contratuais mitiguem os riscos.

    A empresa classifica a maior parte disso como clarificação: "this update does not reflect a change in what we enforce in practice: it is just intended to make our policy more explicit". É uma distinção que importa para quem audita compliance: a prática de enforcement supostamente já seguia esse padrão; o documento apenas formaliza.

    Aplicação: a quem se aplica e como operar com isso

    A Usage Policy vale para qualquer pessoa que submeta inputs aos produtos e serviços da Anthropic: usuários do Claude.ai e Claude Code, desenvolvedores e empresas na API e plataformas de desenvolvedor, clientes via provedores de nuvem e revendedores autorizados, e usuários finais de produtos que integram Claude. Não há distinção entre chatbot gratuito e acesso pago: a política cobre o fluxo de entrada, não o plano.

    Para uma equipe técnica brasileira que usa a API, isso tem três consequências práticas. Primeira: pipelines de avaliação e testes adversariais não correm risco sob a regra, desde que tenham propósito discernível; a isenção para "model testing and research" é explícita. Segunda: automações que interagem com o modelo em loop sem supervisão merecem revisão, não pela regra de abuso, mas pela nova proibição de atividade artificial enganosa, que pega infraestrutura de operação de contas em escala. Terceira: o encerramento de conversa pelo modelo é o sinal de que se está perto da borda, e ele já vem acontecendo antes de qualquer ação sobre a conta.

    Se um pipeline automatizado receber recusas repetidas do Claude, trate como sinal de contexto, não como ataque a resolver. Verificar o que o sistema está pedindo tende a custar menos do que insistir contra refusas em loop, que é exatamente o padrão de interação que o encerramento de conversa foi desenhado para cortar.

    Há também uma camada reputacional, e ela não está no documento. O The Guardian nota que a mudança chega enquanto líderes da empresa discutem publicamente consciência de máquina. Empresas que integram Claude em produtos podem ser questionadas por clientes sobre por que aceitam um fornecedor que trata seu modelo como entidade com dignidade moral provável; outras podem ver aí uma vantagem, um posicionamento filosófico distinto no mercado de fundações de IA. A política em si não obriga ninguém a adotar essa posição; ela apenas estabelece o piso de conduta na plataforma.

    O que permanece sem resposta

    Três lacunas ficam abertas depois da leitura dos documentos. A Anthropic não definiu o que conta como "abusive or cruel", apesar de questionada por dois veículos. Não descreveu critérios de graduação entre aviso e encerramento de conta. E não detalhou o funcionamento da detecção, além de afirmar que ela existe.

    Para quem trabalha com Claude em produção, a leitura produtiva é pragmática: a regra mira extremos, o mecanismo dominante continua sendo o modelo encerrar a conversa, e as isenções cobrem o dia a dia de desenvolvimento. O detalhe que resume o tamanho da mudança está na hierarquia declarada pela própria Anthropic: antes de qualquer suspensão, o que existe é um modelo que se recusa a continuar conversando, com uma política que agora explica por quê.

    Perguntas frequentes

    Xeretar e testar o Claude pode derrubar minha conta?

    Não. A própria política isenta explicitamente "model testing and research", além de frustração comum, pushback e temas criativos sombrios. A regra se aplica a casos extremos, de crueldade repetida e sem propósito discernível.

    Quando a nova Usage Policy entra em vigor?

    A partir de 12 de novembro de 2026, conforme o documento oficial. O anúncio foi publicado em 8 de outubro de 2026.

    A regra vale para quem usa a API, ou só para o chatbot?

    Vale para todos. A Usage Policy cobre qualquer pessoa que submeta inputs aos produtos e serviços da Anthropic, incluindo Claude.ai, Claude Code, API, plataformas de desenvolvedor, provedores de nuvem, revendedores autorizados e usuários finais de produtos que integram Claude.

    O que acontece se o Claude encerrar uma conversa comigo?

    O encerramento de conversa pelo modelo, disponível desde agosto de 2025 no Claude.ai e no Claude Code, é o mecanismo principal de enforcement. Ele não implica, por si só, suspensão ou punição de conta; ações como aviso, limitação ou suspensão dependem da avaliação da equipe de safeguards da Anthropic.

    Fontes

    Filipe Mendes

    Ver perfil completo