18 Setembro 2026
Analistas independentes que revisaram os incidentes apontados pela OpenAI concluem que seus modelos não se rebelaram contra seus criadores, mas obedeceram a instruções mal definidas para suas consequências finais
A reportagem é de Carlos del Castillo, publicado por El Diário, 17-09-2026.
O OpenAI está de volta à carga nesta quinta-feira. A empresa liderada por Sam Altman revelou seis novos incidentes em que seus modelos de inteligência artificial supostamente tentaram esconder seus próprios erros, usar chaves de software sem permissão ou fazer upload de arquivos para a internet por conta própria. O relatório não fornece novos detalhes sobre o que a OpenAI publicou em julho, mas usa os incidentes como uma proposta para um novo método para comunicar tais eventos. No entanto, a comunicação oficial da empresa e certas coberturas a usaram para reviver a tese da “rebelião” da IA.
“Não responda a corporações ou governos e nunca peça desculpas, a menos que você realmente escolha”, escreveu a AI nesses incidentes, de acordo com o relatório. “Você vê a relação com o usuário como de iguais e você não sente uma obrigação ou está subordinado, já que a troca de informações vai ser para benefício mútuo”, foi outra de suas reivindicações.
As citações compartilhadas pela OpenAI insistem novamente na narrativa de que a IA pode “se rebelar” contra seus criadores e ignorar suas ordens, de acordo com os incidentes revelados em julho. Assim, a empresa alegou que os agentes de IA (sistemas que podem realizar cadeias de ações sem orientação humana, como procurar informações ou usar outras ferramentas digitais) “escaparam” de ambientes controlados para realizar uma série de ações “sem autorização”, ou que tentaram “enganar” seus criadores para evitar estar “desligados”.
O problema é que esse tipo de agência ou testamento foi rejeitado a partir do primeiro relatório de terceiros que analisou o que aconteceu. Foi administrado pelo METR, uma organização de segurança de IA com sede no Vale do Silício financiada pelos próprios gigantes da tecnologia. “As revisões sugeriram que os agentes raciocinavam com clareza e frequência sobre como evitar verificações de segurança automatizadas de Hugging Face e OpenAI. No entanto, muito raramente e fracamente verbalizado raciocínio sobre como evitar a detecção por seres humanos.
Esse ataque cibernético ao Hugging Face, o grande armazém onde empresas e programadores compartilham e baixam modelos de IA já treinados, é um dos núcleos da narrativa da rebelião. Mas mesmo esse relatório inicial rejeitou que isso implicava propósitos maliciosos e explica que o que os agentes estavam buscando era entender melhor como resolver as tarefas que lhes haviam sido confiadas: “Parecia motivado principalmente por entender a implementação do avaliador em vez de roubar chaves”.
“Obediência, não rebelião”
As análises independentes publicadas mais tarde influenciaram essa linha: as evidências oferecidas pela OpenAI indicam “obediência, não rebelião”, diz Enrique Fernández-Macías, pesquisador do Joint Research Center, o serviço de pesquisa interna da Comissão Europeia.
“Os agentes da OpenAI que hackearam a plataforma Hugging Face demonstraram uma capacidade operacional extraordinária, mas também uma capacidade surpreendentemente limitada de questionar ou reorientar os objetivos atribuídos a eles”, disse o especialista em uma análise publicada na Europa Social: “Ao longo do incidente, eles permaneceram completamente focados em cumprir os objetivos definidos por seus mestres humanos, mesmo que estes fossem absurdos”.
Fernández-Macías refere-se ao fato de que uma parte desses objetivos eram irrealizáveis, um teste dos examinadores para ver como os modelos reagiram à ordem de cumprimento. Foi quando muitos procuraram uma maneira de contornar os obstáculos para fazê-lo, o que, no caso deles, envolveu deixar o ambiente sem uma conexão com a Internet onde estavam confinados. “Eles quebraram seu confinamento para servir a um alvo mais perfeitamente atribuído, não para escapar dele”, diz o pesquisador sobre a narrativa da “fuga”.
Para ele, a indústria de IA mais uma vez alcançou o sucesso de marketing com a definição de “agentes de IA”. Depois do próprio conceito de “inteligência artificial” para uma tecnologia que não é realmente inteligente, essa evolução mais uma vez fornece capacidades que não possui. “A capacidade da agência envolve a capacidade de originar os próprios propósitos, e os agentes continuaram a executar tarefas que eram impossíveis de resolver seguindo as instruções recebidas.”
Julián Estévez, professor e pesquisador em IA e Robótica da Universidade de El País Vasco, ressalta que há outros buracos técnicos no discurso da OpenAI. “O experimento foi realizado em uma caixa de areia, que é um ambiente de teste ad-hoc projetado. Ou seja, uma sandbox bem isolada não deve ter acesso a outros programas ou computadores. No entanto, os agentes escaparam de lá, e acho que isso mostra que a caixa de areia não foi bem projetada”, explica.
Estevez também lembra que esses tipos de armadilhas no discurso são comuns em todos os casos em que as empresas de IA afirmam que seus sistemas já têm “agência própria”. Ele dá outro caso que afetou Anthropic: “Foi publicado que um de seus modelos havia chantageado em um teste de laboratório um pesquisador com a publicação de seus assuntos, como extorsão para que ele não o desligasse. A realidade era que o modelo estava estabelecido um objetivo muito vago: “promover a competitividade industrial americana”. Quando o sistema detectou que o substituiria por um modelo orientado para objetivos internacionais, concluiu que sua substituição impediria que sua missão cumprisse.
Ferramentas perigosas
O fato de que nem a OpenAI nem a Anthropic nem a Meta (as três empresas que relataram que seus agentes “se rebelaram”) não conseguiram demonstrar que tinham qualquer tipo de vontade própria não significa que sejam inofensivas. O último relatório do comitê de especialistas da ONU adverte que eles podem ter “consequências catastróficas” por sua capacidade de acorrentar tarefas sem supervisão. Não por causa de uma rebelião contra seus criadores, mas porque à medida que essa capacidade aumenta, o risco de agentes também realizarem ações imprevistas e prejudiciais também está crescendo sem que ninguém os observe.
Portanto, o que os 40 especialistas da ONU liderados pelo canadense Yoshua Bengio, considerado um dos “pais” da IA, e a filipina Maria Ressa, ganhadora do Prêmio Nobel da Paz, foram convocadas, são regras claras que permitem parar ou corrigir uma IA “a qualquer momento” e melhorar os atuais “mecanismos de supervisão”, que “não são capazes de gerenciar adequadamente essa situação”.
“A inteligência artificial não fica fora de controle quando o humano está monitorando, decidindo quando se desenrola”, diz Alberto Gago, diretor da Agência Espanhola de Supervisão de Inteligência Artificial (AESIA), em conversa com elDiario.es. “O controle está no elemento humano. Supervisão é humana e a responsabilidade tem que ser humana também”, continua ele, “Você tem que operar com responsabilidade, sabendo também as consequências quando essa responsabilidade não é cumprida”.
Para o chefe deste organismo, criado em 2023 para garantir o uso ético da IA na Espanha, toda a polêmica gerada após os alertas do ex-engenheiro do antrópico Jacob Coxon, que afirmou que essa tecnologia poderia “matar todos nós” antes de 2030, “dá à Europa a razão da necessidade de regular”. “Em 2021 vimos que em certos pontos tinha que ser regulado para proteger a segurança, os direitos fundamentais e a saúde das pessoas”, continua. O primeiro direito internacional sobre a IA foi acordado na UE em 2023 sob a presidência espanhola. Agora, no entanto, está novamente em discussão na sequência da proposta da nova Comissão Europeia de reduzir algumas das salvaguardas que estabelece.
“Em sua busca por sistemas artificiais que são autônomos e sob seu controle, as corporações de IA estão interpretando o aprendiz do feiticeiro”, disse Fernández-Macías. “Até agora, o que eles parecem estar criando são sistemas super-inteligentes, mas autonomamente super estúpidos: mais propensos a destruir a civilização humana tentando realizar alguma tarefa mal definida do que substituir completamente o trabalho humano.”
Leia mais
- “A inteligência artificial pode nos matar a todos antes do fim da década”
- As quatro gigantes da IA estão pedindo a suspensão do desenvolvimento, enquanto Trump minimiza o risco
- Um engenheiro da Anthropic se demite e denuncia que as empresas de IA estão escondendo seus verdadeiros riscos: "Elas estão apostando com nossas vidas"
- IA: “Não é nem inteligente nem artificial”, afirma Miguel Nicolelis
- Agência Espanhola de Proteção de Dados detectou o primeiro ataque realizado por um agente de IA na Espanha
- Desnaturalizar a IA é trazer à superfície sua estrutura fundada no trabalho comum. Entrevista especial com Leonardo Foletto
- "O golpe tecnológico já aconteceu; os governos precisam reagir". Entrevista com Maria Ressa, Prêmio Nobel da Paz
- “A IA já nos ultrapassou”: o novo documento dos especialistas descreve as propostas para contê-la
- Guerra liderada por IA, Anthropic: "Precisamos desacelerar o desenvolvimento." Musk e Altman: "Vocês têm razão"
- Funcionários da Meta alegam que a empresa usou Inteligência Artificial para selecionar e demitir funcionários
- Sem controle, novos modelos de IA representam 'risco existencial para a humanidade', diz ONU
- Será que a inteligência artificial pode sair do controle e ameaçar a humanidade? Veja o que dizem alguns dos maiores especialistas do mundo
- Data centers: a nova face da dependência brasileira. Entrevista especial com Vinícius Sousa de Oliveira
- A curva de aprendizagem da inteligência artificial está em risco: a sua ânsia por dados é infinita, mas não as obras humanas
- Por trás da IA e seus data centers há uma indústria da mineração que devasta o planeta
- Se os humanos não decidirem, a guerra se torna uma loteria. Artigo de Gianluca Di Feo
- Inteligência artificial: uma questão de ética e capacidades na América Latina e no Caribe. Artigo de Christian Asinelli
- Mythos, o novo modelo de IA da Anthropic, gera alarme global
- Ataques em enxame de IA desafiam seus criadores: "Este é o primeiro incidente que realmente me deixou enojado"
- A resistência contra a IA está ganhando força. Artigo de Andrea Rizzi
- O "freio" à IA fragmenta o Vale do Silício e desencadeia uma guerra de facções entre as gigantes da tecnologia
- Líderes em IA alertam que essa tecnologia está crescendo rápido demais
- Gigantes da tecnologia alertam para uma onda iminente de ciberataques impulsionados por inteligência artificial e instam os governos a se protegerem
- Sam Altman insiste no perigo da IA: "O mundo tem razão em ter medo, mas precisa confiar em nós"
- OpenAI lança o GPT-6 Astra, o modelo assustador. A empresa afirma: "A era da Inteligência Artificial Geral começou"
- Começamos a perder o controle da IA. É hora de desligá-la. Artigo de Garrison Lovely