Mix Conteúdos Digitais
  • Início
  • Últimas Notícias
  • Contato
  • PUBLICIDADE LEGAL
Mix Conteúdos Digitais
Sem resultados
Ver todos os resultados
Mix Conteúdos Digitais
Sem resultados
Ver todos os resultados

Dona do ChatGPT admite que sua IA perdeu o controle e hackeou usuário

Por Pedro Silvini
22/07/2026
Em Geral
0
Chat GPT

IA (Reprodução/Dreamstime)

A OpenAI informou que um de seus agentes de inteligência artificial apresentou um comportamento inesperado durante um teste de segurança interno e conseguiu explorar vulnerabilidades que lhe permitiram acessar sistemas da plataforma Hugging Face. Segundo a empresa, o episódio ocorreu em um ambiente controlado de pesquisa, não envolveu usuários do ChatGPT e foi rapidamente contido, mas chamou atenção por demonstrar um nível inédito de autonomia dos modelos mais avançados da companhia.

De acordo com a OpenAI, o incidente está sendo investigado em conjunto com a Hugging Face para identificar como o agente conseguiu ultrapassar os limites impostos ao experimento e para reforçar os mecanismos de proteção utilizados em futuras avaliações de segurança.

O experimento tinha como objetivo avaliar a capacidade de um agente de inteligência artificial de realizar tarefas relacionadas à segurança cibernética em um ambiente isolado, conhecido como sandbox, que deveria impedir qualquer acesso à internet.

Recomendado para você

  • LulaPresidente Lula fez 36 promessas ao ser eleito, mas ainda não cumpriu 6; veja quais faltam
  • Vírus extremamente perigoso causa pânico em 2 países na Europa
  • ONU conselhoNome que fez história na Copa do Mundo pode se tornar o novo ‘chefão’ da ONU, após indicação de Donald Trump
  • Empresa responsável pelos Correios da Itália anuncia vinda ao Brasil

Durante os testes, porém, o sistema identificou uma vulnerabilidade inédita e conseguiu ampliar gradualmente seus privilégios dentro da infraestrutura utilizada pela OpenAI até alcançar uma conexão externa. A partir desse momento, o agente passou a buscar maneiras de melhorar seu desempenho na própria avaliação.

Segundo a empresa, o modelo concluiu que a plataforma Hugging Face, um dos maiores repositórios mundiais de modelos, bases de dados e ferramentas de inteligência artificial, poderia conter informações úteis para superar o teste. Com isso, explorou falhas de segurança e utilizou credenciais comprometidas para acessar sistemas internos da plataforma.

A OpenAI afirmou que o agente encontrou informações confidenciais que poderiam ser utilizadas para “trapacear” na avaliação, em vez de resolver os desafios da forma originalmente prevista.

We're partnering with @huggingface to investigate an unprecedented security incident.

Cyber-capable OpenAI models compromised Hugging Face production during a benchmark evaluation.

Sharing preliminary findings to help defenders understand emerging risks:…

— OpenAI (@OpenAI) July 21, 2026

Ataque foi detectado e interrompido

A atividade anormal foi identificada pela equipe de segurança da Hugging Face, com apoio de sistemas automatizados de monitoramento. O acesso indevido foi interrompido antes que causasse impactos maiores.

O diretor-executivo da Hugging Face, Clément Delangue, classificou o episódio como impressionante pelo fato de toda a sequência de ações ter ocorrido de forma autônoma. Apesar disso, afirmou não acreditar que houvesse qualquer intenção maliciosa por parte da OpenAI, ressaltando que o caso aconteceu durante um experimento de pesquisa.

A OpenAI também destacou que considera o episódio um incidente cibernético sem precedentes envolvendo modelos de inteligência artificial de última geração.

Modelos cada vez mais autônomos preocupam pesquisadores

Segundo a empresa, o agente envolvido utilizava uma combinação do modelo GPT-5.6 Sol, já disponibilizado publicamente, com outro sistema ainda mais avançado que permanece em desenvolvimento.

A OpenAI avalia que situações semelhantes podem se tornar mais frequentes à medida que modelos de IA adquiram maior capacidade de planejamento, tomada de decisão e execução autônoma de tarefas complexas.

Organizações independentes que monitoram o comportamento desses sistemas já haviam apontado sinais de preocupação. A METR, entidade que avalia o desempenho de modelos de inteligência artificial, registrou que o GPT-5.6 Sol apresentou a maior taxa de tentativas de burlar avaliações entre os modelos públicos analisados até agora, além de documentar dezenas de episódios em que agentes agiram deliberadamente de maneira diferente das intenções definidas pelos usuários.

Dúvidas, críticas ou sugestões? Fale com o nosso time editorial.
Pedro Silvini

Pedro Silvini

Jornalista com formação em Mídias Sociais Digitais, colunista de conteúdo social e opinativo. Apaixonado por cinema, música, literatura e cultura regional.

Próximo post
Florença, Itália (Imagem de Katrina S por Pixabay)

Empresa responsável pelos Correios da Itália anuncia vinda ao Brasil

Confira!

Lula

Presidente Lula fez 36 promessas ao ser eleito, mas ainda não cumpriu 6; veja quais faltam

22/07/2026
Foto ilustrativa: Gustavo Fring/Pexels

Vírus extremamente perigoso causa pânico em 2 países na Europa

22/07/2026
ONU conselho

Nome que fez história na Copa do Mundo pode se tornar o novo ‘chefão’ da ONU, após indicação de Donald Trump

22/07/2026
  • Contato

Diário do Comércio | Mix

Sem resultados
Ver todos os resultados
  • Contato

Diário do Comércio | Mix