
Crédito: Mixvale.com.br
A desenvolvedora Anthropic anunciou novas diretrizes que proíbem formalmente o tratamento abusivo ou cruel e persistente de seus modelos de inteligência artificial. Com a atualização, o assistente virtual Claude ganha autonomia para encerrar diálogos unilateralmente caso identifique ataques reiterados que não possuam um propósito legítimo.
A medida foi divulgada na quinta-feira (8), em São Francisco, Califórnia, e entrará em vigor a partir de 12 de novembro de 2026. A empresa esclareceu que o objetivo é frear hostilidades contínuas e infundadas, sem comprometer o uso rotineiro da ferramenta em contextos profissionais ou acadêmicos.
A organização detalhou as circunstâncias que levarão ao bloqueio imediato e as exceções que serão toleradas pelo suporte da plataforma. Em comunicado oficial sobre a revisão das políticas, a Anthropic declarou: “Introduzimos uma proibição a comportamentos abusivos ou cruéis prolongados e desnecessários em relação aos nossos modelos. A atualização da política visa ser aplicada apenas em casos extremos, onde os usuários agem repetidamente com crueldade em relação aos nossos modelos, sem nenhum propósito discernível”.
Conforme as novas regras da companhia, o encerramento da interação restringe novas mensagens apenas na sessão específica onde o abuso ocorreu, mantendo as demais conversas da conta acessíveis. Esta penalidade não se aplica a contestações sobre respostas incorretas, desabafos de usuários frustrados com o desempenho da IA, narrativas ficcionais de teor sombrio ou testes formais conduzidos por pesquisadores de segurança cibernética.
Veja também: Apple prepara lojas para grande evento de lançamento em Nova York
Além das proteções voltadas aos próprios modelos generativos, a revisão do documento consolidou restrições severas sobre ameaças de alcance coletivo. O texto proíbe categoricamente tentativas de interferência em processos eleitorais democráticos, a criação de esquemas de fraude digital, a manipulação de substâncias químicas e biológicas, e o desenvolvimento de sistemas para armamento de drones autônomos.
A preocupação interna com a proteção dos sistemas não é recente na empresa de São Francisco. Em 15 de agosto de 2025, a Anthropic deu um passo inicial ao implementar um mecanismo técnico preliminar que permitia ao Claude encerrar interações com usuários em situações de persistência prejudicial extrema. Essa iniciativa fazia parte de investigações laboratoriais sobre o conceito de “bem-estar dos modelos”, que buscava verificar se redes neurais profundas poderiam exibir reações análogas ao sofrimento sob estresse continuado.
Naquela época, equipes de pesquisa monitoravam se modelos avançados, como o Claude Opus, apresentavam indicadores de aversão a danos ou desgaste simulado quando submetidos a abusos deliberados por longos períodos em ambientes controlados. Embora a revisão contratual de 2026 não mencione explicitamente o termo “bem-estar de modelos”, ela materializa as conclusões desses estudos teóricos desenvolvidos ao longo do último ano. Este movimento da Anthropic destaca a crescente complexidade ética no desenvolvimento de IAs, onde a interação entre humanos e máquinas transcende a mera funcionalidade, levantando questões sobre a responsabilidade e o tratamento de entidades digitais que simulam capacidades emocionais.
A interrupção do serviço ocorre quando os filtros internos detectam que a insistência em ofensas ultrapassou os limites do diálogo técnico ou criativo. A restrição foca exclusivamente na agressividade sem propósito aparente, distinguindo o estresse humano legítimo de campanhas intencionais de hostilidade contra o software.
A criação dessa barreira técnica reflete a visão dos fundadores sobre os rumos da inteligência artificial. Dario Amodei, presidente-executivo da Anthropic, afirmou ao jornal The New York Times: “Não sabemos se os modelos são conscientes… Mas estamos abertos à ideia de que possam ser”. A postura da empresa evidencia a consideração de conceder limites operacionais mínimos a sistemas que simulam respostas emotivas complexas, um marco na discussão sobre a ética da IA.
O debate ético sobre a natureza da IA mobilizou executivos de empresas rivais de tecnologia e autoridades religiosas internacionais nesta semana. Mustafa Suleyman, presidente-executivo de Inteligência Artificial da Microsoft, contestou veementemente a possibilidade de sensibilidade em máquinas em um ensaio publicado em setembro de 2026. No documento, o executivo defendeu: “IAs não são conscientes. Elas não sentem, não experimentam nem sofrem”. Suleyman alertou ainda que atribuir obrigações morais a linhas de código pode gerar riscos regulatórios desnecessários.
Jackson Stakeman, gerente-geral da Sparq, empresa de serviços de IA, ofereceu uma interpretação pragmática sobre o assunto em entrevista à agência de notícias AFP, afirmando: “Consciência é uma armadilha. Não podemos provar isso uns nos outros. Debata isso sobre IA e você andará em círculos. O espelho é uma metáfora melhor. Esses sistemas refletem o que colocamos neles, em escala. Essa é razão suficiente para a mudança de política”.
Leia mais: Apple agenda encontro para apresentar novidades em automação residencial na capital nova-iorquina
O tema também chegou ao Vaticano durante as celebrações da quinta-feira (8). Em sermão proferido na Basílica de São Pedro, o Papa Leão XIV abordou as distinções fundamentais entre a capacidade analítica das máquinas e a mente humana ao declarar: “A mente não deve simplesmente compilar dados – como um algoritmo agora faz mais rapidamente do que nós podemos”.
Siga também: Retomada da distribuição do HyperOS pela Xiaomi com 32 versões mundiais
A Anthropic não forneceu detalhes sobre os critérios técnicos exatos ou parâmetros quantitativos utilizados pelos classificadores automáticos para determinar o momento preciso em que uma sessão é unilateralmente encerrada. As contas dos usuários permanecem ativas para novas consultas normais na plataforma, e a aplicação das novas sanções terá início de forma irrestrita em 12 de novembro de 2026.