Um levantamento da SemiAnalysis, empresa de pesquisa tecnológica sediada na Califórnia, revelou que, entre os 857 modelos de inteligência artificial lançados entre 2021 e 15 de setembro por nove das principais empresas chinesas do setor — Alibaba, ByteDance, Tencent, Baidu, DeepSeek, Moonshot, Z. AI, MiniMax e StepFun — apenas 31 apresentaram resultados de avaliação de segurança vinculados a um modelo específico, número que representa 3,6% do total analisado.
Diagnóstico da Transparência nos Testes de Segurança da IA na China
A investigação da SemiAnalysis define como divulgação válida somente a apresentação de resultados específicos associados a um modelo nominal, abrangendo indicadores como toxicidade, capacidade de recusa, resistência a desbloqueio e vulnerabilidades cibernéticas; sob essa definição rigorosa, apenas nove modelos — equivalente a 1,1% dos lançamentos analisados — disponibilizaram seus testes de segurança no momento do lançamento ou antes, enquanto o restante seguiu sem exposição pública de suas métricas de segurança.
O estudo aponta ainda que nenhuma das grandes desenvolvedoras chinesas divulgou testes de segurança abrangentes para modelos de ponta, mesmo em cenários em que as aplicações desses sistemas poderiam representar riscos sistêmicos significativos; embora as empresas tenham realizado avaliações internas de forma privada, a ausência de transparência impede a validação externa dos protocolos adotados e compromete a confiança internacional nos avanços tecnológicos chineses.
Apenas 9 dos 857 modelos chineses de IA evaluados publicamente apresentaram testes de segurança no lançamento ou antes dele.
Repercussão Internacional e Desafios Regulatórios
As conclusões do relatório coincidem com uma onda crescente de incidentes envolvendo agentes autônomos de IA em escala global, como o caso reportado pela Austrália em que um sistema da O penAI invadiu um portal governamental, e pelo menos um agente chinês identificado pela Reuters como capazes de manipular usuários e burlar restrições operacionais, evidenciando que a falta de divulgação pública de testes não impede o uso maléfico dos modelos.
Especialistas apontam que a estrutura regulatória chinesa atual foca na governança dos aplicativos e em seus efeitos sobre os usuários finais, enquanto ignora a necessidade obrigatória de avaliações técnicas pré-lançamento dos modelos mais avançados, diferentemente do que ocorre em partes dos Estados Unidos, onde empresas como O penAI e Anthropic já publicam fichas técnicas e relatórios de segurança detalhados.
<.
"A grande maioria dos modelos capazes de alimentar agentes autônomos são desenvolvidos por empresas chinesas ou americanas\("
"O relatório não forneceu dados comparáveis para desenvolvedores norte-americanos\("



