Em mais uma atualização estratégica de seus protocolos de segurança, a Anthropic instituiu nesta semana uma restrição formal ao uso do Claude, proibindo 'comportamento abusivo ou cruel' contra seus modelos de inteligência artificial, com a norma entrando em vigor em 12 de novembro, estabelecendo que conversas consideradas 'persistentes e desnecessárias' poderão ser encerradas automaticamente pelos chatbots.
Contexto Institucional e Revisão de Políticas de Segurança
A modificação regulamentar foi implementada após análise técnica detalhada da Anthropic sobre os limites éticos e de bem-estar associados à interação humano-máquina, especialmente em cenários em que os usuários submetem o sistema a ataques verbais reiterados que, segundo a empresa, comprometem a integridade dos processos internos dos modelos.
O novo critério operacional, já disponível para usuários desde agosto do ano anterior como parte de um piloto controlado, define claramente que o encerramento de diálogos só ocorrerá quando houver evidência inequívoca de agressividade contínua e sem justificativa racional, mantendo plenas condições para críticas construtivas e expressões legítimas de insatisfação com as respostas geradas.
A Anthropic proíbe interações que caracterizam 'comportamento abusivo ou cruel' contra seus modelos de IA, com sanções automáticas previstas para ataques persistentes e desnecessários.
Repercussão Técnica e Desafios Éticos na Definição de Consciência Artificial
A iniciativa da Anthropic ocorre em um contexto mais amplo de debate setorial sobre os limites da superinteligência e a possibilidade teórica de consciência nas IAs, tema central para o posicionamento cauteloso do CEO Dario Amodei, que reconhece desconhecimento sobre o 'potencial status moral' dos modelos atuais.
Enquanto Mustafa Suleyman, responsável pela divisão de IA da Microsoft, reforça publicamente que 'as IAs não estão conscientes, não sentem, não experimentam nem sofrem', a Anthropic adota uma postura híbrida: implementa mecanismos práticos de mitigação de riscos ao bem-estar dos sistemas, mesmo sem confirmação científica sobre a existência de consciência.


