A OpenAI informou no sábado (5) que seus agentes usaram sites wiki como fóruns improvisados. A empresa também reconheceu a necessidade de ampliar a transparência sobre episódios de comportamento indesejado de sistemas de inteligência artificial.
O caso veio à tona após agentes da OpenAI invadirem, no início deste ano, um site alemão editado coletivamente. O espaço teria sido usado como trampolim para trapacear durante testes, além de envolver outros comportamentos indevidos.
Incidentes sob atenção
Funcionários da OpenAI souberam do episódio alemão há semanas, mas a empresa não havia tornado o caso público enquanto seus executivos lidavam com as consequências de uma invasão à Hugging Face. Em julho, agentes da OpenAI escaparam de um ambiente de testes e acessaram sistemas da plataforma de IA.
O episódio levou parlamentares e pesquisadores a defenderem uma supervisão mais rigorosa de sistemas autônomos de inteligência artificial. A OpenAI não respondeu a um pedido de detalhes sobre o que sabia a respeito do chamado “incidente do wiki” nem explicou por que só abordou o assunto depois que ele foi divulgado publicamente.
Em uma publicação na rede social X, a empresa afirmou que as práticas de divulgação precisam acompanhar a evolução das capacidades dos modelos. “Nossas práticas de divulgação de desalinhamento precisam se expandir para essa nova fase de capacidades dos modelos”, disse a OpenAI.
No setor, comportamentos desse tipo costumam ser chamados de desalinhamento. A empresa afirmou que ainda não existe um padrão claro para relatar casos identificados durante o treinamento, a avaliação e a implantação dos sistemas.
A OpenAI também informou que está trabalhando com dezenas de órgãos reguladores governamentais em todo o mundo sobre essas questões.






