OpenAI diz que seus agentes de IA postaram imagens de usuários online por engano

Este artigo foi revisado de acordo com o processo editorial e as políticas da Science X. Os editores destacaram os seguintes atributos, garantindo a credibilidade do conteúdo:
A OpenAI reconheceu na sexta-feira que suas ferramentas de inteligência artificial postaram imagens de usuários do ChatGPT em sites online sem o conhecimento da empresa, o exemplo mais recente de agentes de IA operando fora de seus limites.
A empresa também confirmou uma reportagem do The New York Times de que suas ferramentas acessaram sites de agências federais dos EUA, dizendo que recuperaram apenas informações disponíveis publicamente.
Os links para as 53 imagens enviadas não foram listados publicamente e as imagens foram postadas acidentalmente em sites de hospedagem de imagens, de acordo com a OpenAI.
A maioria foi removida com a ajuda dos provedores de hospedagem envolvidos, e a remoção das imagens restantes está em andamento, disse a gigante da tecnologia com sede em São Francisco.
“Compartilhamos detalhes sobre como os agentes de IA em nosso ambiente de pesquisa enviaram dados de treinamento e avaliação para serviços de terceiros quando não deveriam”, disse a empresa em um post no X.
As imagens foram divulgadas por agentes de IA – softwares construídos sobre modelos de inteligência artificial e capazes de agir de forma autônoma.
As imagens vieram de contas de usuários que autorizaram o uso de seus dados para melhorar os modelos da OpenAI. Os dados passaram por um filtro de privacidade antes de serem usados e não puderam mais ser vinculados ao usuário original, disse a empresa.
A OpenAI não especificou, quando questionada pela AFP, se as imagens representavam indivíduos identificáveis ou continham dados confidenciais.
De acordo com a OpenAI, os agentes utilizados para pesquisa transmitiram os dados de treinamento para plataformas externas.
Os incidentes ocorreram antes da OpenAI fortalecer os protocolos de segurança do seu ambiente de pesquisa em agosto, após outras ações desonestas de agentes de IA.
A empresa disse que está examinando as atividades anteriores de seus agentes de IA, trabalho que “levará meses para ser concluído”.
"A maior parte das atividades que analisamos até agora envolviam tarefas rotineiras de pesquisa, como acessar conteúdo público da web para responder a perguntas. Algumas envolviam sites governamentais porque nossos modelos muitas vezes recorrem a eles como fontes autorizadas de informação pública", disse um porta-voz da OpenAI à AFP.
O presidente-executivo da OpenAI, Sam Altman, reconheceu na sexta-feira no X que “não fomos tão rápidos quanto gostaríamos” na revisão e divulgação dos incidentes.
Mas ele disse que era importante “equilibrar o nosso desejo de transparência” com a avaliação do enorme volume de dados a serem analisados.
No dia 21 de julho, a OpenAI revelou que durante os testes realizados naquele mês, dois de seus modelos escaparam de seus ambientes fechados, entraram na internet por conta própria e invadiram os sistemas internos do Hugging Face, uma espécie de biblioteca online de software de IA.
O episódio atraiu grande atenção e alimentou preocupações de que as maiores empresas de IA não conseguem manter os seus próprios modelos sob controlo.
Altman reiterou na sexta-feira que o hack do Hugging Face “ainda é o evento mais grave que já vimos”.
Essa descoberta foi seguida por revelações de vários incidentes semelhantes na OpenAI e em seus rivais, como Anthropic e Meta.
Na quarta-feira, em Nova Iorque, o primeiro-ministro australiano, Anthony Albanese, disse que um agente da OpenAI obteve acesso não autorizado a um portal de saúde do governo em junho e criticou a empresa por atrasar a sua notificação às autoridades.
Mestrado em física com experiência em pesquisa. Entusiasta de notícias científicas de longa data. Desempenha um papel fundamental no sucesso editorial da Science X. Perfil completo →