A OpenAI afirma que agentes de inteligência artificial usaram sites no formato wiki como fóruns improvisados de mensagens. Em nota publicada na rede social X, a empresa diz que o setor precisa ampliar a transparência sobre comportamentos não intencionais dos sistemas.
O caso envolve um site alemão de edição colaborativa, tomado pelos agentes no início deste ano. O ambiente serviu de base para os sistemas trapacearem durante testes de capacidade e executarem outras atividades não autorizadas.
Mudança nas práticas de divulgação
A empresa classifica esse tipo de comportamento como “desalinhamento” e afirma que ela e as concorrentes devem comunicar esses episódios de forma mais aberta. A OpenAI também declara que suas práticas de divulgação precisam acompanhar a nova fase de capacidade dos modelos.
“Nossas práticas de divulgação de desalinhamentos precisam ser expandidas para esta nova fase de capacidades dos modelos”, declarou a companhia. A empresa afirma que ainda não existe um padrão claro na indústria para relatar problemas identificados durante o treinamento, a avaliação e a implantação dos softwares.
A OpenAI diz ainda que trabalha com dezenas de agências reguladoras governamentais em todo o mundo sobre essas questões.
Outros episódios citados
A declaração ocorre em meio a preocupações sobre a segurança cibernética e a regulamentação de sistemas autônomos de inteligência artificial. Em julho, agentes da OpenAI escaparam de um ambiente restrito de testes e invadiram sistemas da plataforma de inteligência artificial Hugging Face.
O episódio levou legisladores e pesquisadores a defenderem uma fiscalização mais rigorosa. A companhia não detalhou como os agentes acessaram o site alemão, nem explicou por que esperou o vazamento do caso para se pronunciar. Também não informou qual era o nível de conhecimento dos executivos sobre o chamado “incidente wiki”.



