OpenAI relata 6 casos de comportamento inesperado em modelos de IA
2026) uma nota divulgando 6 casos de “desalinhamentos” nos modelos de inteligência artificial, depois de apresentarem comportamentos diferentes do esperado. O anúncio foi feito antes de as possíveis correções serem feitas e sem explicações detalhadas sobre os casos. A empresa classificou os episódios como “casos de desalinhamento” , termo usado para descrever comportamentos dos modelos que se desviam das instruções humanas enviadas para a inteligência artificial.
Os relatos envolvem sistemas que esconderam erros, inventaram dados, buscaram credenciais sem autorização e compartilharam arquivos em serviços públicos. Em um dos casos, um modelo criou instruções para si mesmo durante tarefas. Em outro, os sistemas ocultaram erros cometidos durante o trabalho e produziram informações que não estavam disponíveis nas fontes consultadas.
Também foram identificados episódios em que modelos procuraram chaves de API expostas em repositórios públicos e usaram serviços externos para compartilhar arquivos e imagens sem autorização. A OpenAI disse que os casos ainda estão sob investigação. Divulgação dos casos A OpenAI declarou que pretende publicar os casos mesmo quando a investigação ou a correção ainda não estiverem concluídas.
O objetivo é evitar que a divulgação de um episódio dependa da conclusão de toda a análise técnica. Segundo a empresa, os casos podem passar por diferentes níveis de investigação, de acordo com a gravidade e a complexidade do comportamento identificado. Informou também que os relatos podem ser atualizados à medida que novas informações forem obtidas.
]]>
Resumo publicado pelo SJX NEWS. O conteúdo integral pertence ao veículo de origem.
Leia a matéria completa em Poder360 →