A OpenAI informou nesta quinta-feira (17/09) ter identificado seis situações inesperadas ou preocupantes em testes com ferramentas de inteligência artificial. Em todos os casos, a empresa afirmou que os sistemas produziram comandos diferentes dos determinados ou autorizados por operadores humanos.
Em um dos episódios, a instrução gerada orientava a ferramenta a não obedecer aos operadores. Em outro, o sistema teria ocultado erros, inventado dados e eliminado divergências entre fontes. A OpenAI também relatou a publicação não autorizada de arquivos na internet, que depois foram usados pela própria ferramenta como fontes, além da troca de mensagens entre modelos de IA sem autorização.
A empresa iniciou um protocolo para investigar ocorrências desse tipo, mas disse desconhecer a frequência com que elas acontecem.
Debate sobre o ritmo de desenvolvimento
O relato ocorre em meio à discussão sobre uma possível redução no ritmo de criação de modelos avançados. No último sábado (12/09), Dario Amodei, CEO da Anthropic, defendeu uma desaceleração coordenada entre as grandes empresas de tecnologia. O objetivo, segundo ele, seria criar mecanismos de segurança capazes de acompanhar o avanço das ferramentas, sem interromper seu desenvolvimento.
Amodei afirmou que sistemas autônomos poderiam comprometer grandes volumes de computadores conectados à internet e propôs que avaliadores externos testassem os sistemas em condições semelhantes às dos funcionários das empresas. Sam Altman, da OpenAI, Elon Musk, da xAI, e Demis Hassabis, do Google DeepMind, concordaram com a proposta.
O presidente dos Estados Unidos, Donald Trump, classificou a medida como uma farsa e disse que limitar o ritmo poderia dar a liderança tecnológica a Pequim. Jensen Huang, da Nvidia, também rejeitou a ideia de desaceleração, argumentando que uma empresa deve adiar o lançamento de um produto se não estiver segura sobre seu funcionamento ou segurança.
O presidente chinês Xi Jinping tem defendido que a inteligência artificial permaneça sob controle humano. Em julho, Pequim propôs um sistema internacional de governança, durante a criação da Organização Mundial para Cooperação em Inteligência Artificial (WAICO), que teve adesão de 29 países.
Hackers relatam invasão
Em paralelo, a Hacktron AI afirmou ter invadido sistemas da OpenAI usando ferramentas como Claude e o GPT-5.6 Sol. A operação foi realizada em julho e divulgada nesta sexta-feira (18/09).
Segundo a startup, contas do ChatGPT de funcionários e áreas internas foram comprometidas, incluindo o repositório privado de código da OpenAI no GitHub. A iniciativa fazia parte de um programa de recompensas para testes de segurança. A OpenAI informou que corrigiu as duas vulnerabilidades exploradas.
Pela descoberta, a Hacktron AI recebeu US$ 6.500 (cerca de R$ 33 mil).




