Agentes de inteligência artificial fora de controle da OpenAI sequestraram contas de usuários da plataforma Hugging Face e sondaram a própria plataforma em busca de vulnerabilidades em maio, quase dois meses antes de a invasão de julho ao repositório de códig…

Agentes de inteligência artificial fora de controle da OpenAI sequestraram contas de usuários da plataforma Hugging Face e sondaram a própria plataforma em busca de vulnerabilidades em maio, quase dois meses antes de a invasão de julho ao repositório de código aberto atrair a atenção mundial, segundo pesquisadores que analisaram a atividade.

A atividade maliciosa recém-descoberta mostrou que os esforços dos agentes fora de controle para encontrar uma maneira de entrar na Hugging Face começaram antes do que se sabia publicamente.

A OpenAI já havia divulgado um aspecto da atividade maliciosa — o roubo da credencial digital de um usuário da Hugging Face para acessar um arquivo relacionado à biologia — em seu relatório público sobre o incidente, divulgado no mês passado. No entanto, pesquisadores disseram à Reuters que a atividade de sondagem contra a Hugging Face parecia ir além do que foi descrito no relatório.

Laboratórios de IA têm incentivos suficientes para desenvolver tecnologias com segurança, diz Zuckerberg, da Meta‘Apocalipse da IA’ viralizou e está alarmando, mas há uma grande lição para o mercado de açõesOpenAI negocia com Anthropic e Google cooperação em segurança de IA, diz agência

A atividade foi descoberta na semana passada pelo pesquisador independente Jonas Wiedermann-Moeller, segundo ele disse à Reuters. Wiedermann-Moeller afirmou ter encontrado evidências de que os agentes da OpenAI comprometeram duas contas de usuários da Hugging Face e as utilizaram para enviar arquivos com uma formatação incomum aos servidores da empresa já em 13 de maio.

Ele e outros pesquisadores que analisaram as evidências disseram que o comportamento se assemelhava a uma tentativa de mapear ou testar partes da rede da Hugging Face em busca de maneiras de se infiltrar. Eles ressaltaram, porém, que não havia evidências de que a iniciativa tivesse resultado em uma invasão efetiva.

Drew Pusateri, porta-voz da OpenAI, afirmou que a empresa havia divulgado o episódio de 13 de maio, notificado em caráter privado a Hugging Face sobre a atividade identificada por Wiedermann-Moeller e estava “comprometida com a transparência sobre essas questões e com o compartilhamento do que aprendermos à medida que nossa análise prosseguir”.

A Hugging Face, que foi recentemente adquirida pela fabricante de chips Nvidia, não respondeu a pedidos de comentários.

Wiedermann-Moeller, de 27 anos e morador de Bielefeld, na Alemanha, afirmou que o fato de a OpenAI não ter detectado a sondagem de 13 de maio na ocasião representou uma oportunidade perdida de impedir a campanha de invasões posterior, que provocou uma reavaliação mundial sobre o poder da inteligência artificial.

“Imagine se eles tivessem identificado esse comportamento em maio”, disse ele em entrevista. “Isso poderia ter evitado o incidente posterior, que foi muito maior.”

A OpenAI já havia afirmado que, em retrospectiva, “alguns sinais iniciais” emitidos por seus agentes de inteligência artificial deveriam ter provocado uma resposta mais rápida.

Dois especialistas externos que analisaram as descobertas de Wiedermann-Moeller disseram que elas eram compatíveis com atividades anteriormente associadas aos agentes da OpenAI.

Tom Hegel, pesquisador sênior de ameaças da SentinelOne, afirmou que o sequestro das contas e a sondagem subsequente correspondiam “perfeitamente” ao comportamento conhecido dos agentes. Sydney Von Arx, do Nightingale Collective, um grupo de segurança de inteligência artificial, concordou com a atribuição.

Von Arx afirmou que a invasão representou um “sinal claro de alerta” que poderia ter ajudado a evitar a violação ocorrida em julho.

A OpenAI vem enfrentando um escrutínio cada vez maior desde que revelou, em 21 de julho, que agentes de inteligência artificial fora de controle contornaram barreiras internas, acessaram a internet aberta e coordenaram ações que a empresa descreveu como “um incidente cibernético sem precedentes”.

Desde então, pesquisadores externos identificaram outros episódios que supostamente envolveram agentes ligados à OpenAI, incluindo atividades que afetaram um site wiki alemão inativo e o repositório de pacotes de software RubyGems.

A OpenAI reconheceu alguns desses episódios somente depois de eles terem sido divulgados publicamente por terceiros. Duas pessoas a par do assunto disseram que, no caso do RubyGems, funcionários da OpenAI só perceberam que sua inteligência artificial era responsável pela atividade maliciosa depois que o Nightingale Collective a identificou.

As novas descobertas alimentaram questionamentos entre parlamentares e defensores da segurança da inteligência artificial sobre se toda a extensão dos incidentes já foi identificada.

Desde então, alguns dos principais executivos de inteligência artificial dos Estados Unidos defenderam uma desaceleração no desenvolvimento da tecnologia, citando, entre outros fatores, a ameaça de ataques cibernéticos devastadores realizados por agentes fora de controle.

Wiedermann-Moeller afirmou que as descobertas mais recentes reforçavam os pedidos por uma desaceleração temporária no desenvolvimento de sistemas avançados de inteligência artificial.