Anthropic vai banir quem xingar o Claude a partir de novembro

Anthropic vai banir quem xingar o Claude a partir de novembro

A Anthropic, criadora do Claude, atualizou suas regras para permitir punições a usuários que adotem comportamentos abusivos ou cruéis de forma persistente e desnecessária. A medida reacendeu o debate sobre os limites da relação entre humanos e inteligência artificial.

As sanções podem ir de advertências à suspensão ou ao encerramento de contas. Enquanto alguns especialistas veem a mudança como uma precaução, outros temem que ela reforce a ideia de que máquinas têm características humanas.

Ilustração estilo colagem sobre discurso de ódio com boca gigante no lugar da cabeça de uma pessoa
A decisão de proibir agressões contra robôs reacende o debate sobre a humanização excessiva das redes de inteligência artificial. – Imagem: Roman Samborskyi/Shutterstock

Quando a frustração vira abuso?

A nova regra, prevista para entrar em vigor em 12 de novembro, mira casos extremos de hostilidade deliberada e repetida. Segundo a Anthropic, manifestações comuns de frustração, discordâncias com as respostas do Claude, criações artísticas com temas sombrios e atividades de pesquisa não serão alvo da proibição.

Leia mais:

A dúvida está na definição de comportamento abusivo. A empresa poderá advertir usuários, limitar o acesso, suspender contas ou encerrá-las se suspeitar de violações. A política também proíbe o uso do Claude em campanhas enganosas e em tentativas de enganar eleitores ou prejudicar eleições.

Foi a restrição à hostilidade contra os chatbots, porém, que concentrou a atenção pública e dividiu especialistas.

Máquinas precisam ser tratadas com educação?

Aaron Levie, presidente-executivo da Box, considera a medida uma precaução razoável, embora não acredite que a IA seja consciente. Para ele, a exposição de modelos a interações hostis pode ter consequências para o desenvolvimento de sistemas futuros.

Mesmo que você não acredite que a IA seja consciente — eu não acredito —, faz sentido não querer que modelos futuros sejam treinados com quantidades intermináveis de conteúdo em que humanos são grosseiros com modelos.

Aaron Levie, presidente-executivo da Box, em post no X.

Michael Shellenberger discorda dessa abordagem por considerar que ela atribui características humanas às máquinas. Em crítica semelhante, o advogado Barry Scannell afirmou que não se pode ser cruel com números e matemática. Já Scott Stevenson, presidente-executivo da Spellbook, argumentou que atribuir empatia humana à IA pode ampliar sua capacidade de influenciar pessoas, sem que haja comprovação de consciência.

A discussão envolve ainda a privacidade. O investidor Bill Gurley perguntou se a nova regra indicaria que a Anthropic usa mensagens dos clientes para treinar seus modelos. A política, no entanto, não confirma essa hipótese: a empresa justifica a mudança como parte de seus esforços para prevenir danos e promover o uso responsável.

robô humano coração
Ser educado com um algoritmo é questão de bom senso ou um gasto inútil de processamento e recursos da máquina? Imagem: FeelGoodLuck – Shutterstock

O que muda na relação com a IA?

A decisão também provocou reações fora da Anthropic. Mustafa Suleyman, diretor de IA da Microsoft, respondeu ao anúncio com um emoji de rosto derretendo. No ano anterior, Sam Altman, presidente-executivo da OpenAI, havia defendido os custos de processamento de mensagens educadas, como “por favor” e “obrigado”, dizendo que eram recursos “muito bem investidos”.

O debate vai além da etiqueta digital e reúne questões ainda sem respostas definitivas:

  • Treinamento de modelos: não está confirmado que a nova regra tenha como objetivo filtrar mensagens usadas no treinamento.
  • Critérios de aplicação: a interpretação de expressões como “crueldade desnecessária” pode gerar dúvidas entre os usuários.
  • Liberdade de expressão: a política reacende a discussão sobre até onde uma empresa pode controlar a interação com seus produtos.
  • Convivência social: alguns especialistas temem que a agressividade contra chatbots influencie a maneira como as pessoas se tratam.

O empreendedor Lachlan Phillips propôs uma alternativa à punição: fazer com que o Claude ignore insultos e execute a tarefa solicitada, em vez de penalizar o usuário.

A forma como a Anthropic aplicará as novas regras será decisiva para esclarecer seus limites. Por enquanto, a empresa afirma que pretende agir apenas em casos extremos, mas a falta de critérios mais detalhados mantém aberta a discussão sobre como distinguir abuso de simples frustração.

O post Anthropic vai banir quem xingar o Claude a partir de novembro apareceu primeiro em Olhar Digital.