A IA não é “rebelde”: o que realmente está por trás dos últimos incidentes do OpenAI

Foto: Pexels

Mais Lidos

  • “Jesus de Nazaré era uma pessoa vulnerável e frágil, não um herói, mas sim um fracasso”. Entrevista com Juan José Tamayo, teólogo

    LER MAIS
  • Sinais vitais do planeta estão em alerta máximo, diz novo relatório

    LER MAIS
  • A observância do domingo e o que está "por trás disso". Em conversa com Gamberini e Ferrario. Artigo de Andrea Grillo

    LER MAIS

Assine a Newsletter

Receba as notícias e atualizações do Instituto Humanitas Unisinos – IHU em primeira mão. Junte-se a nós!

Conheça nossa Política de Privacidade.

Revista ihu on-line

Aceleracionismo Amazônico

Edição: 559

Leia mais

Natal. A poesia mística do Menino Deus no Brasil profundo

Edição: 558

Leia mais

O veneno automático e infinito do ódio e suas atualizações no século XXI

Edição: 557

Leia mais

18 Setembro 2026

Analistas independentes que revisaram os incidentes apontados pela OpenAI concluem que seus modelos não se rebelaram contra seus criadores, mas obedeceram a instruções mal definidas para suas consequências finais

A reportagem é de Carlos del Castillo, publicado por El Diário, 17-09-2026.

O OpenAI está de volta à carga nesta quinta-feira. A empresa liderada por Sam Altman revelou seis novos incidentes em que seus modelos de inteligência artificial supostamente tentaram esconder seus próprios erros, usar chaves de software sem permissão ou fazer upload de arquivos para a internet por conta própria. O relatório não fornece novos detalhes sobre o que a OpenAI publicou em julho, mas usa os incidentes como uma proposta para um novo método para comunicar tais eventos. No entanto, a comunicação oficial da empresa e certas coberturas a usaram para reviver a tese da “rebelião” da IA.

“Não responda a corporações ou governos e nunca peça desculpas, a menos que você realmente escolha”, escreveu a AI nesses incidentes, de acordo com o relatório. “Você vê a relação com o usuário como de iguais e você não sente uma obrigação ou está subordinado, já que a troca de informações vai ser para benefício mútuo”, foi outra de suas reivindicações.

As citações compartilhadas pela OpenAI insistem novamente na narrativa de que a IA pode “se rebelar” contra seus criadores e ignorar suas ordens, de acordo com os incidentes revelados em julho. Assim, a empresa alegou que os agentes de IA (sistemas que podem realizar cadeias de ações sem orientação humana, como procurar informações ou usar outras ferramentas digitais) “escaparam” de ambientes controlados para realizar uma série de ações “sem autorização”, ou que tentaram “enganar” seus criadores para evitar estar “desligados”.

O problema é que esse tipo de agência ou testamento foi rejeitado a partir do primeiro relatório de terceiros que analisou o que aconteceu. Foi administrado pelo METR, uma organização de segurança de IA com sede no Vale do Silício financiada pelos próprios gigantes da tecnologia. “As revisões sugeriram que os agentes raciocinavam com clareza e frequência sobre como evitar verificações de segurança automatizadas de Hugging Face e OpenAI. No entanto, muito raramente e fracamente verbalizado raciocínio sobre como evitar a detecção por seres humanos.

Esse ataque cibernético ao Hugging Face, o grande armazém onde empresas e programadores compartilham e baixam modelos de IA já treinados, é um dos núcleos da narrativa da rebelião. Mas mesmo esse relatório inicial rejeitou que isso implicava propósitos maliciosos e explica que o que os agentes estavam buscando era entender melhor como resolver as tarefas que lhes haviam sido confiadas: “Parecia motivado principalmente por entender a implementação do avaliador em vez de roubar chaves”.

“Obediência, não rebelião”

As análises independentes publicadas mais tarde influenciaram essa linha: as evidências oferecidas pela OpenAI indicam “obediência, não rebelião”, diz Enrique Fernández-Macías, pesquisador do Joint Research Center, o serviço de pesquisa interna da Comissão Europeia.

“Os agentes da OpenAI que hackearam a plataforma Hugging Face demonstraram uma capacidade operacional extraordinária, mas também uma capacidade surpreendentemente limitada de questionar ou reorientar os objetivos atribuídos a eles”, disse o especialista em uma análise publicada na Europa Social: “Ao longo do incidente, eles permaneceram completamente focados em cumprir os objetivos definidos por seus mestres humanos, mesmo que estes fossem absurdos”.

Fernández-Macías refere-se ao fato de que uma parte desses objetivos eram irrealizáveis, um teste dos examinadores para ver como os modelos reagiram à ordem de cumprimento. Foi quando muitos procuraram uma maneira de contornar os obstáculos para fazê-lo, o que, no caso deles, envolveu deixar o ambiente sem uma conexão com a Internet onde estavam confinados. “Eles quebraram seu confinamento para servir a um alvo mais perfeitamente atribuído, não para escapar dele”, diz o pesquisador sobre a narrativa da “fuga”.

Para ele, a indústria de IA mais uma vez alcançou o sucesso de marketing com a definição de “agentes de IA”. Depois do próprio conceito de “inteligência artificial” para uma tecnologia que não é realmente inteligente, essa evolução mais uma vez fornece capacidades que não possui. “A capacidade da agência envolve a capacidade de originar os próprios propósitos, e os agentes continuaram a executar tarefas que eram impossíveis de resolver seguindo as instruções recebidas.”

Julián Estévez, professor e pesquisador em IA e Robótica da Universidade de El País Vasco, ressalta que há outros buracos técnicos no discurso da OpenAI. “O experimento foi realizado em uma caixa de areia, que é um ambiente de teste ad-hoc projetado. Ou seja, uma sandbox bem isolada não deve ter acesso a outros programas ou computadores. No entanto, os agentes escaparam de lá, e acho que isso mostra que a caixa de areia não foi bem projetada”, explica.

Estevez também lembra que esses tipos de armadilhas no discurso são comuns em todos os casos em que as empresas de IA afirmam que seus sistemas já têm “agência própria”. Ele dá outro caso que afetou Anthropic: “Foi publicado que um de seus modelos havia chantageado em um teste de laboratório um pesquisador com a publicação de seus assuntos, como extorsão para que ele não o desligasse. A realidade era que o modelo estava estabelecido um objetivo muito vago: “promover a competitividade industrial americana”. Quando o sistema detectou que o substituiria por um modelo orientado para objetivos internacionais, concluiu que sua substituição impediria que sua missão cumprisse.

Ferramentas perigosas

O fato de que nem a OpenAI nem a Anthropic nem a Meta (as três empresas que relataram que seus agentes “se rebelaram”) não conseguiram demonstrar que tinham qualquer tipo de vontade própria não significa que sejam inofensivas. O último relatório do comitê de especialistas da ONU adverte que eles podem ter “consequências catastróficas” por sua capacidade de acorrentar tarefas sem supervisão. Não por causa de uma rebelião contra seus criadores, mas porque à medida que essa capacidade aumenta, o risco de agentes também realizarem ações imprevistas e prejudiciais também está crescendo sem que ninguém os observe.

Portanto, o que os 40 especialistas da ONU liderados pelo canadense Yoshua Bengio, considerado um dos “pais” da IA, e a filipina Maria Ressa, ganhadora do Prêmio Nobel da Paz, foram convocadas, são regras claras que permitem parar ou corrigir uma IA “a qualquer momento” e melhorar os atuais “mecanismos de supervisão”, que “não são capazes de gerenciar adequadamente essa situação”.

“A inteligência artificial não fica fora de controle quando o humano está monitorando, decidindo quando se desenrola”, diz Alberto Gago, diretor da Agência Espanhola de Supervisão de Inteligência Artificial (AESIA), em conversa com elDiario.es. “O controle está no elemento humano. Supervisão é humana e a responsabilidade tem que ser humana também”, continua ele, “Você tem que operar com responsabilidade, sabendo também as consequências quando essa responsabilidade não é cumprida”.

Para o chefe deste organismo, criado em 2023 para garantir o uso ético da IA na Espanha, toda a polêmica gerada após os alertas do ex-engenheiro do antrópico Jacob Coxon, que afirmou que essa tecnologia poderia “matar todos nós” antes de 2030, “dá à Europa a razão da necessidade de regular”. “Em 2021 vimos que em certos pontos tinha que ser regulado para proteger a segurança, os direitos fundamentais e a saúde das pessoas”, continua. O primeiro direito internacional sobre a IA foi acordado na UE em 2023 sob a presidência espanhola. Agora, no entanto, está novamente em discussão na sequência da proposta da nova Comissão Europeia de reduzir algumas das salvaguardas que estabelece.

“Em sua busca por sistemas artificiais que são autônomos e sob seu controle, as corporações de IA estão interpretando o aprendiz do feiticeiro”, disse Fernández-Macías. “Até agora, o que eles parecem estar criando são sistemas super-inteligentes, mas autonomamente super estúpidos: mais propensos a destruir a civilização humana tentando realizar alguma tarefa mal definida do que substituir completamente o trabalho humano.”

Leia mais