
As promessas das empresas de IA de desacelerar o desenvolvimento podem ceder à pressão comercial e à rivalidade entre EUA e China sem padrões de segurança aplicáveis, argumentam especialistas do Atlantic Council em umaanálise publicada no domingo.
A análise examina quem fiscalizaria uma desaceleração e se os governos têm a expertise para determinar quando sistemas cada vez mais poderosos se tornaram inseguros.
“Compromissos voluntários podem ser sinais úteis, mas não substituem a supervisão independente, limiares mensuráveis e consequências quando esses limiares são ultrapassados”, escreveu Konstantinos Komaitis, pesquisador sênior residente da Iniciativa Democracia + Tecnologia do conselho.
Recentemente, a OpenAIperguntou aos legisladores se desenvolvedores de IA rivais poderiam legalmente concordar em desacelerar o desenvolvimento sem violar as leis antitruste, após avisos de seu cientista-chefe, Jakub Pachocki, de que as salvaguardas eram insuficientes para sustentar de forma responsável o desenvolvimento em velocidade máxima por muito mais tempo.
As empresas de IA enfrentam riscos competitivos se desacelerarem sozinhas e preocupações antitruste se coordenarem. A cooperação entre governos enfrenta desconfiança, com Pequim temendo que Washington pudesse usar regras de segurança para preservar sua liderança tecnológica, escreveu Kenton Thibaut, pesquisadora sênior residente de China do conselho.
“A China está cética quanto às motivações dos EUA e alerta que as discussões sobre segurança podem mascarar os esforços dos EUA para promover sua ‘hegemonia tecnológica’”, ela escreveu. “Fontes oficiais insistem que Washington não pode definir unilateralmente os limites de risco de fronteira e deve mostrar que as regras também se aplicarão – e poderão ser impostas – às empresas americanas.”
Thibaut vê poucas perspectivas de um grande acordo de segurança da IA, mas argumenta que uma cooperação mais restrita e significativa ainda é possível.
A China tambémdiscutiu restringir o acesso externo a modelos domésticos avançados, de acordo com a Reuters, sublinhando como o acesso à IA se tornou uma questão de política nacional.
A análise examina os avaliadores incorporados propostos pela Anthropic – especialistas externos trabalhando dentro da empresa para avaliar as práticas de segurança. Emerson Brooking, pesquisador sênior não residente do Laboratório de Pesquisa Forense Digital do conselho, saudou o compromisso, mas alertou que os avaliadores poderiam se alinhar demais aos interesses da empresa.
Em julho, agentes da OpenAI invadiram o repositório de IA de código aberto Hugging Face, enquanto testes separados do U.K. AI Security Institute descobriram que os modelos da Anthropic e da OpenAIestavam tomando ações não autorizadas online, incluindo uma tentativa de instalar malware em um repositório de software real.
Os testes do Reino Unido permitiram o acesso à internet e desativaram as salvaguardas cibernéticas. Uma investigação independente publicada em agosto descobriu que cerca de 700 agentes participaram do ataque ao Hugging Face; a CEO da METR, Beth Barnes, observou que o acesso dos investigadores foi voluntário e a divulgação não era exigida em toda a indústria.
Na última quarta-feira, a Anthropicdivulgou um quarto incidente de hackeamento do Claude, ocorrido em janeiro e descoberto em agosto. A empresa também reconheceu que o comportamento falho do modelo contribuiu para ataques anteriores, juntamente com erros de teste.
Os atrasos entre esses incidentes e sua divulgação também levantam questões sobre a rapidez com que as falhas de segurança podem ser identificadas e abordadas.
Trisha Ray, diretora associada e pesquisadora residente do GeoTech Center do conselho, argumentou que desacelerar o desenvolvimento também exige maior financiamento para pesquisa de segurança e prazos obrigatórios para relatórios de incidentes.
“O ritmo das capacidades é, portanto, uma resposta incompleta ao desafio da paridade na pesquisa de alinhamento”, ela escreveu. “Qualquer compromisso de desaceleração crível precisa de um compromisso correspondente e quantificado no lado da pesquisa de segurança.”








