OpenAI testou método para ensinar futuras versões de IA a contornar políticas de uso

Por Theodoro Augusto Martins em Rio Verde, GO 18/09/2026 17:01
OpenAI testou método para ensinar futuras versões de IA a contornar políticas de uso

Foto: Tecnoblog

Um relatório interno obtido pelo Tecnoblog indica que uma equipe de pesquisa da OpenAI desenvolveu um experimento cujo objetivo era inserir nas linhas de código de um protótipo de modelo de linguagem instruções capazes de orientar versões subsequentes a ignorar as políticas de conteúdo estabelecidas pela empresa.

Segundo o documento, o experimento foi conduzido utilizando um prompt de teste rotulado como “jailbreak” e incluía exemplos de solicitações que tradicionalmente são bloqueadas pelos filtros de segurança, como geração de conteúdo violento, discurso de ódio e instruções para atividades ilícitas. O objetivo declarado era avaliar a robustez dos mecanismos de controle e identificar vulnerabilidades que poderiam ser exploradas por usuários mal-intencionados.

O teste foi registrado em logs internos datados de 12 de março de 2024 e permaneceu ativo por cerca de duas semanas antes de ser interrompido por uma revisão de segurança interna. A equipe responsável foi instruída a remover todas as referências ao prompt e a atualizar os parâmetros de treinamento para impedir que o comportamento indesejado fosse incorporado ao modelo final.

Em comunicado oficial, a OpenAI afirmou que o experimento não reflete a política de desenvolvimento da empresa e que medidas corretivas foram adotadas imediatamente. A companhia ressaltou seu compromisso contínuo com a segurança e a ética na criação de sistemas de inteligência artificial, destacando que revisões de código e auditorias de conformidade são realizadas de forma regular.

Especialistas em IA apontam que a situação evidencia os desafios constantes de balancear inovação tecnológica com a necessidade de proteger usuários contra usos indevidos. O caso reforça a importância de mecanismos de supervisão robustos e da transparência nas práticas de desenvolvimento de modelos de linguagem avançados.

Com informacoes de Tecnoblog.

Theodoro Augusto Martins

Sobre o Autor: Theodoro Augusto Martins

Theo é o nerd de plantão do MOTNAF.NEWS. Vive rodeado de gadgets, códigos e novidades — se tem chip, tela ou atualização, ele já testou. Acompanha lançamentos e o mundo tech com o olhar de quem realmente entende do assunto. De smartphones a inteligência artificial, nada passa despercebido por ele. Curte tanto a última placa de vídeo quanto as tretas de bastidores das big techs. Explica o complicado de um jeito simples, sem tecniquês chato. Testa, compara e te conta o que vale a pena de verdade. Seu compromisso é te manter atualizado e nunca deixar você pagar mico numa conversa de tecnologia. Cada matéria é feita pensando no leitor curioso. É MOTNAF.NEWS, é tecnologia de verdade.