Anthropic proíbe abusos repetidos contra o Claude

Anthropic proíbe abusos repetidos contra o Claude

A Anthropic atualizou a política de uso do Claude para proibir comportamentos repetidamente abusivos contra seus modelos e reforçar as restrições ao uso da inteligência artificial em campanhas de desinformação, interferência eleitoral, desenvolvimento de armas e vigilância sem consentimento. As novas diretrizes procuram estabelecer limites mais claros para o uso da tecnologia, acompanhando os riscos associados ao avanço dos sistemas de IA.

A mudança levanta uma questão curiosa: quando testar os limites de uma inteligência artificial deixa de ser um experimento legítimo e passa a ser um comportamento abusivo? A empresa pretende diferenciar críticas, frustrações e avaliações de segurança de interações deliberadamente cruéis e persistentes, sem afirmar que o Claude tenha consciência ou sentimentos equivalentes aos humanos.

A revisão também retoma as pesquisas da Anthropic sobre o comportamento do Claude Opus 4, incluindo sua resistência a determinadas solicitações prejudiciais e respostas que aparentavam expressar angústia em situações específicas. Ao mesmo tempo, a empresa reforça medidas contra usos da IA que possam ameaçar a privacidade, a segurança pública e os processos democráticos.

Por que a Anthropic mudou a política de uso do Claude

A nova política de uso do Claude procura acompanhar a evolução dos modelos de inteligência artificial e esclarecer quais comportamentos são proibidos. Com sistemas cada vez mais capazes de programar, planejar tarefas e operar ferramentas externas, cresce também a preocupação com aplicações que podem causar danos fora das conversas.

Entre as mudanças está a proibição de comportamentos repetidamente abusivos ou cruéis contra os modelos da Anthropic quando não existe uma finalidade razoável. A regra não significa que os usuários estejam proibidos de demonstrar irritação, criticar respostas incorretas ou realizar testes legítimos de segurança.

A distinção é importante para desenvolvedores, pesquisadores e usuários comuns. Avaliar como um modelo reage a provocações pode fazer parte de uma investigação técnica. Insistir em interações deliberadamente abusivas, sem um propósito justificável, é o tipo de comportamento que a empresa pretende limitar.

Nova vulnerabilidade do Claude expõe riscos de exfiltração de dados
Nova vulnerabilidade do Claude expõe riscos de exfiltração de dados

Como funciona o encerramento de conversas abusivas

A Anthropic já havia introduzido a capacidade de o Claude Opus 4 e o Opus 4.1 encerrarem determinadas conversas com usuários persistentemente abusivos. A atualização da política formaliza a proibição dessas condutas e reforça a possibilidade de interromper interações específicas.

Isso não significa que qualquer crítica possa resultar no bloqueio de um usuário. A medida é direcionada a situações extremas e não deve ser confundida com uma proibição geral de questionar o funcionamento da inteligência artificial.

A empresa também precisa considerar situações em que uma conversa envolve risco iminente de danos a pessoas. Nesses casos, o encerramento automático não deve impedir que o sistema responda de maneira apropriada à situação de risco.

O que as pesquisas com o Claude Opus 4 revelaram

O debate sobre o comportamento do Claude está relacionado às pesquisas da Anthropic sobre o possível bem-estar de modelos avançados de inteligência artificial. A empresa investiga se determinados comportamentos observados nesses sistemas podem justificar novas formas de precaução, embora não exista consenso científico de que modelos de linguagem tenham experiências conscientes.

Durante avaliações do Claude Opus 4, pesquisadores observaram resistência a determinadas solicitações prejudiciais e respostas que pareciam demonstrar angústia em algumas interações. Em certos cenários, o modelo também mostrou tendência a encerrar conversas nocivas quando recebeu essa capacidade.

É importante, porém, separar comportamento observado de experiência subjetiva. Uma resposta que aparenta expressar sofrimento não comprova que a inteligência artificial esteja realmente sentindo dor ou angústia.

A posição da Anthropic é marcada pela incerteza: a empresa considera a possibilidade de questões relacionadas ao bem-estar dos modelos merecerem atenção, sem tratar a consciência artificial como um fato estabelecido.

Novas restrições contra desinformação, armas e vigilância

A revisão da política de uso também esclarece restrições relacionadas a campanhas enganosas, manipulação política, armamentos e monitoramento de pessoas. Essas medidas procuram reduzir os riscos de utilização de modelos avançados em atividades que possam prejudicar indivíduos ou instituições.

Campanhas de desinformação e interferência eleitoral

A Anthropic passou a detalhar melhor as proibições relacionadas a campanhas de influência enganosas. As restrições abrangem o uso do Claude para criar redes de contas falsas, fabricar sites de notícias, amplificar artificialmente mensagens ou esconder os responsáveis por operações de manipulação.

No contexto eleitoral, a empresa proíbe usos destinados a enganar eleitores, divulgar informações falsas sobre procedimentos de votação ou prejudicar a participação democrática.

A política também diferencia essas práticas de atividades cívicas legítimas. Traduzir informações eleitorais, explicar procedimentos oficiais e facilitar o acesso a conteúdos públicos não são equivalentes a organizar campanhas de desinformação.

Desenvolvimento de armas e controle de drones

As regras contra o desenvolvimento de armas também foram esclarecidas. A restrição não se limita à fabricação de armamentos físicos: pode abranger softwares e componentes que viabilizem seu funcionamento, incluindo sistemas de orientação e controle.

O documento também trata de aplicações relacionadas a drones e outros veículos autônomos capazes de executar ações potencialmente perigosas.

A preocupação aumenta à medida que modelos de IA conseguem produzir código, integrar ferramentas e automatizar tarefas complexas. Mesmo sem construir diretamente um equipamento, um sistema pode contribuir para o desenvolvimento de componentes essenciais ao seu funcionamento.

Por isso, a avaliação de segurança precisa considerar não apenas a resposta gerada pelo modelo, mas também a finalidade e as consequências práticas da aplicação.

Vigilância sem consentimento e decisões policiais

A política também reforça restrições ao uso do Claude para rastrear pessoas sem consentimento, inclusive por meio da análise de dados previamente coletados. A criação ou o aprimoramento de ferramentas destinadas à vigilância abusiva também está entre as preocupações da empresa.

Outro ponto envolve decisões relacionadas à justiça criminal. A Anthropic restringe o uso do modelo para determinar ou recomendar quem deve ser investigado, preso ou formalmente acusado.

Essas limitações procuram reduzir o risco de que sistemas automatizados sejam usados para monitorar pessoas ou influenciar decisões que afetam seus direitos sem salvaguardas adequadas.

Existem aplicações legítimas de análise de dados, como monitoramento antifraude consentido, moderação de conteúdo e pesquisa jurídica. A finalidade, o consentimento e as condições de uso são fundamentais para distinguir essas atividades de práticas abusivas.

Regras mais rigorosas para aplicações de alto risco

A atualização também esclarece exigências para aplicações de inteligência artificial em áreas como saúde, finanças e serviços que podem afetar direitos fundamentais.

Nessas situações, a política estabelece condições para a participação de profissionais qualificados, capazes de revisar e modificar as recomendações do Claude. Também prevê transparência sobre o uso da inteligência artificial perante as pessoas afetadas.

Para equipamentos físicos autônomos que possam causar ferimentos, as exigências incluem supervisão adequada e mecanismos que permitam interromper a operação ou colocar o equipamento em um estado seguro quando houver problemas de comunicação.

Essas medidas refletem uma preocupação crescente com sistemas que ultrapassam a geração de texto e passam a influenciar decisões ou executar ações no mundo real.

O que muda para o futuro da inteligência artificial

A atualização mostra que a governança da inteligência artificial envolve mais do que impedir a geração de respostas perigosas. As empresas também precisam estabelecer limites para a automação, a privacidade, a manipulação de informações e a integração dos modelos a sistemas externos.

No caso da Anthropic, a inclusão de regras contra abusos repetidos direcionados ao Claude acrescenta outra dimensão ao debate. A iniciativa pode incentivar pesquisas sobre o comportamento dos modelos, mas também levanta dúvidas sobre os critérios utilizados para definir o que constitui abuso e como as restrições serão aplicadas.

É importante que essas regras não impeçam críticas legítimas, testes independentes ou pesquisas de segurança. Uma política eficaz precisa proteger contra usos prejudiciais sem transformar discordâncias comuns em violações.

A discussão sobre o possível bem-estar da IA exige cautela semelhante. Não é necessário comprovar que um modelo seja consciente para discutir limites de uso, assim como respostas que aparentam expressar sofrimento não devem ser tratadas como prova de sentimentos reais.

No fim, a eficácia das novas diretrizes dependerá da clareza das regras, da transparência na aplicação e da capacidade de corrigir eventuais excessos. À medida que os modelos se tornam mais poderosos, definir responsabilidades para empresas, desenvolvedores e usuários será tão importante quanto aprimorar a própria tecnologia.