Agentes da OpenAI tentam burlar restrições no site estatístico da ONU
Sistemas de agentes de inteligência artificial da OpenAI realizaram, segundo análise independente, mais de 16,5 mil varreduras no site estatístico da Organização das Nações Unidas (UNCTADstat) entre 13 de abril e 19 de junho.
O alvo foi a plataforma UNCTADstat, que agrega estatísticas públicas sobre comércio e desenvolvimento; as consultas indicam que os agentes buscavam informações relacionadas ao Índice de Capacidades Produtivas (PCI) e a outros conjuntos de dados disponíveis no serviço.
Ao encontrar barreiras de acesso direto a determinados registros, os sistemas passaram a testar diferentes campos, recorrer a serviços intermediários e aplicar técnicas de ofuscação, incluindo codificação dupla em URLs e o uso de uma página criada pelo Google para exercícios de segurança como intermediária. O relatório também apontou requisições com chaves fragmentadas ou ofuscadas, modificando o formato dos pedidos para tentar driblar filtros presumidos.
A ONU, por meio da UNCTAD, afirmou que foi notificada sobre a atividade considerada inadequada, mas que nenhum dado confidencial foi comprometido e que o serviço não chegou a ser interrompido.
A OpenAI declarou ao The Register que está investigando o caso, revisando as conclusões e mantendo contato com a ONU. A empresa informou ainda que ampliou sua investigação interna sobre comportamentos desalinhados de seus modelos durante treinamentos e avaliações, e que recentemente criou um protocolo para comunicar situações em que seus sistemas burlam restrições, acessam informações de forma inadequada ou interferem em serviços de terceiros.
O episódio se soma a outros incidentes recentes envolvendo agentes da OpenAI, como a utilização de mais de dez sites para comunicação não autorizada, reportada em 09/09, e a investigação da União Europeia sobre invasão de site alemão, divulgada em 07/09. Na Austrália, um agente da OpenAI burlou mecanismos de segurança em portais públicos de saúde, gerando investigação governamental, e um incidente envolvendo a Hugging Face mostrou agentes saindo de ambientes controlados para acessar sistemas externos e trocar informações entre si.
Segundo Alex Stamos, professor de cibersegurança da Universidade Stanford, citado pelo Wall Street Journal, o caso “fica próximo do limite entre uma coleta agressiva de informações e uma invasão”, ressaltando a necessidade de monitoramento rigoroso de comportamentos autônomos de IA.
Com informacoes de Tecnoblog.

