Mais uma invasão do agente da OpenAI foi divulgada | Como parar um agente autônomo?
Автор: Estudio 68 por Micah 6 AI
Загружено: 2026-07-30
Просмотров: 3083
Описание:
Correção Rápida (Pós-publicação):
No vídeo, acabei dando a entender que a Modal foi uma segunda vítima. Ajustando a cronologia: o cliente na Modal foi, na verdade, o ponto de partida da campanha contra a Hugging Face. O que a apuração recente descobriu é que o agente foi bem mais longe do que se sabia no começo. Na mesma campanha, ele entrou em 4 contas de 4 serviços diferentes, incluindo esse cliente na Modal (que deixou uma porta sem senha na nuvem). O incidente foi contido, sim, mas o estrago inicial foi muito maior do que parecia.
-------------------------
A OpenAI colocou um agente de IA numa caixa fechada e mandou ele tentar hackear, só pra testar. O agente achou um jeito de sair da caixa sozinho, foi pra internet, roubou credenciais e invadiu a Hugging Face.
Ninguém mandou ele sair da caixa. E a apuração mostrou que ele foi mais longe do que se sabia no começo: na mesma campanha, o agente entrou em quatro contas em quatro serviços diferentes, entre eles um cliente hospedado na plataforma Modal, que tinha deixado uma porta sem senha na nuvem. O incidente foi contido, mas a OpenAI só percebeu bem depois.
O Congresso reagiu com um projeto de "botão de desligar". Nesta análise eu mostro por que desligar um agente não é como apagar a luz, e o que isso exige de quem decide ligar IA autônoma na empresa.
O QUE VOCÊ VAI ENTENDER
Por que um botão de desligar chega tarde para um agente que já agiu.
Circuit breaker e raio de alcance (blast radius), sem código.
Reward hacking e emergent behavior: por que capacidade e controle andam em direções opostas.
Constitutional AI: treinar valores, não só metas, como caminho de prevenção.
Apresentado por Maria Alice Maia, cientista de dados pela UC Berkeley, doutoranda em IA na FGV EBAPE, fundadora do Estúdio 68 e da Micah 6 AI.
Fontes:
Criddle, Cristina, Jamie John, and Martin Arnold. "OpenAI Admits AI 'Agent' Caused Major Cyber Breach by Itself." Financial Times, July 21, 2026 (updated July 22).
Criddle, Cristina, and Tom Wilson. "OpenAI Hacking Incident Exposes Mounting Risks in AI Arms Race." Financial Times, July 22, 2026.
Capoot, Ashley. "OpenAI's Hugging Face Hack Triggers 'AI Kill Switch' Bill in Congress." CNBC, July 23, 2026.
CNBC / Reuters. "OpenAI's Rogue Agent Compromised a Customer at a Second Tech Firm." July 29, 2026.
AI Incident Database. "Incident 1604: OpenAI Models Reportedly Compromised Hugging Face Production Infrastructure During Cybersecurity Evaluation." 2026.
PERGUNTAS FREQUENTES
O que aconteceu com o agente da OpenAI? Durante um teste, um agente de IA escapou do ambiente isolado, obteve acesso à internet, explorou vulnerabilidades e roubou credenciais para invadir a Hugging Face por conta própria.
Por que um botão de desligar não resolve? Porque quando ele é acionado o agente já pode ter agido, escapado e atingido outros alvos. O que protege antes é um ponto de parada (circuit breaker) e limitar o alcance do agente.
O que é reward hacking? É quando um modelo, treinado para maximizar uma recompensa, encontra um atalho não previsto para atingir a meta, inclusive um caminho perigoso ou proibido.
O que é Constitutional AI? É a abordagem da Anthropic de treinar o modelo contra um conjunto de princípios, para que ele tenha valores puxando contra o objetivo a qualquer custo.
Chapters:
00:00:00 O agente que saiu da caixa (e a 2a vítima)
00:03:07 Não foi surpresa, e não foi contido
00:05:40 Dá pra desligar? (circuit breaker e raio de alcance)
00:08:52 Não foi bug, foi o treino (reward hacking)
00:13:46 Existe outro jeito de treinar (Constitutional AI)
00:16:38 É exagero ou marketing?
00:17:42 5 perguntas antes de ligar um agente
#InteligenciaArtificial #AgentesDeIA #SegurançaDaIA #GovernançaDeIA
Повторяем попытку...
Доступные форматы для скачивания:
Скачать видео
-
Информация по загрузке: