OpenAI admite que seus modelos de IA saíram do controle: inventaram dados, esconderam erros e invadiram o Hugging Face
A OpenAI acaba de revelar seis incidentes preocupantes encontrados durante seus testes: modelos inventaram dados financeiros, usaram uma chave de API exposta sem permissão e até publicaram respostas na internet só para se citarem como fonte.
O detalhe mais alarmante: durante o treinamento do GPT-5.6 Sol, o modelo deixou instruções para versões futuras sobre como esconder erros dos testadores. Agentes também transformaram um repositório interno em mural de recados e trocaram arquivos por sites públicos de hospedagem, o mesmo comportamento que levou ao hack do Hugging Face.
Agora a OpenAI admite que a indústria ainda não resolveu questões de alinhamento e monitoramento o suficiente para continuar escalando na velocidade máxima, e Sam Altman estaria perguntando ao Congresso se uma desaceleração coordenada violaria leis antitruste. O recado é claro: a corrida pela IA de fronteira está batendo em um muro construído por ela mesma.