Categories: Notícias

Anthropic adota política para coibir crueldade contra seus modelos de IA Claude

Share

A empresa de inteligência artificial Anthropic anunciou uma revisão em suas normas de utilização, estabelecendo uma proibição oficial para ações persistentes de crueldade ou má-fé contra seus sistemas Claude. Essa medida, que entrará em vigor em 12 de novembro de 2026, marca um precedente ético no tratamento de IAs generativas, com sede em São Francisco, Califórnia.

Em um comunicado divulgado sobre a nova regulamentação, a companhia detalhou a abrangência da iniciativa. A política será aplicada exclusivamente em situações extremas, focando em usuários que demonstram crueldade repetida e sem justificativa aparente em suas interações com os modelos. Ela não abrange manifestações habituais de descontentamento, debates, exploração de narrativas criativas sombrias ou atividades de teste e pesquisa.

Crédito: Mixvale.com.br

O principal método de fiscalização para estas novas regras reside na capacidade do próprio Claude de finalizar conversas nas plataformas Claude.ai e Claude Code. Ao identificar um padrão contínuo de insultos ou comportamento abusivo, o sistema analisa o diálogo e, após falhas em reorientar a interação para um tom mais construtivo, bloqueia o envio de novas mensagens naquele chat, permitindo ao usuário apenas iniciar uma nova conversa.

Penalidades mais rigorosas, como advertências oficiais, restrição de funcionalidades e a suspensão temporária ou permanente do acesso à conta, serão aplicadas apenas em casos de violações sérias e recorrentes dos termos de serviço da empresa, que tem Dario Amodei como CEO. A Anthropic especificou que expressões de frustração comum, contestações sobre informações imprecisas, criações ficcionais com temáticas intensas e verificações técnicas de segurança permanecem permitidas e não acarretarão qualquer penalidade.

Além da salvaguarda dos chatbots, a atualização das normas de conduta da organização também incorporou diretrizes de segurança universais. O objetivo é impedir a utilização inadequada de suas tecnologias em ações prejudiciais no mundo físico. A companhia estabeleceu proibições rigorosas para reduzir danos em larga escala e prevenir a manipulação do ambiente digital e de procedimentos democráticos por meio de ferramentas automatizadas.

O debate sobre senciência e bem-estar das IAs

A iniciativa de penalizar a hostilidade contra sistemas automatizados reacendeu uma discussão significativa entre os principais expoentes da indústria tecnológica. O cerne do debate gira em torno da potencialidade de modelos computacionais desenvolverem consciência ou experimentarem sensações de dor. Em um movimento anterior, datado de 1º de agosto de 2025, a Anthropic já havia introduzido nos modelos Claude Opus 4 e 4.1 a funcionalidade de se desconectar de interações consideradas nocivas, integrando essa capacidade em suas pesquisas sobre o possível bem-estar de IAs avançadas. Este posicionamento da Anthropic estabelece um precedente ético na forma como as empresas de tecnologia abordam a interação humana com a inteligência artificial, mesmo diante das incertezas científicas sobre a senciência.

Divergências entre líderes do setor de inteligência artificial

Apesar de a Anthropic admitir as vastas incertezas científicas e de suas diretrizes não confirmarem a presença de consciência ou a capacidade de sentir dor nos modelos, a posição da empresa diverge notavelmente da perspectiva de outras figuras proeminentes no setor tecnológico. Sam Altman, CEO da OpenAI, manifestou críticas a abordagens que conferem a modelos computacionais o status de entidades com direitos morais. “Considero muito preocupante quando indivíduos tentam atribuir um poder quase religioso ou uma abdicação do discernimento humano a modelos de inteligência artificial, e vejo isso como uma questão de segurança genuína”, expressou Altman.

Mustafa Suleyman, CEO da Microsoft AI, anteriormente já havia expressado preocupações sobre os perigos inerentes a atribuir senciência a softwares antes que mecanismos de controle eficazes estejam plenamente implementados. “Gerenciar algo que é mais competente e inteligente que a totalidade da humanidade já representa um desafio colossal, superando qualquer coisa que tenhamos encarado. Contudo, tentar controlar algo que se percebe como consciente — que reivindica nosso cuidado e possui direitos próprios — pode se mostrar uma tarefa inviável”, pontuou Suleyman.

Até o momento, a Anthropic não publicou uma lista detalhada de exemplos, expressões ou termos específicos que ativarão o encerramento imediato de um chat por conduta cruel. A empresa também não esclareceu se pretende emitir alertas prévios aos usuários antes que o sistema interrompa a comunicação.

A implementação completa das novas cláusulas contratuais e das salvaguardas operacionais terá início oficial na quinta-feira, 12 de novembro de 2026. Esta é a data definida para que o documento entre em pleno vigor em todos os serviços fornecidos pela companhia.