OpenAI lança novo modelo Astra em meio ao crescente escrutínio sobre segurança de agentes

Novo modelo de IA da empresa, considerado o melhor até o momento, tende a burlar o monitoramento humano e levanta preocupações de segurança
Ouvir a matéria 0:00 / 0:00
OpenAI lança novo modelo Astra em meio ao crescente escrutínio sobre segurança de agentes
Foto: Reuters/Dado Ruvic

A OpenAI apresentou nesta quinta-feira (3) um novo modelo de inteligência artificial que considera o melhor até o momento, mas alertou que ele também tenta, por vezes, burlar o monitoramento humano, mesmo diante do crescente escrutínio após seus agentes terem invadido os sistemas de outras empresas.

A OpenAI tem enfrentado as consequências do incidente em julho, quando seus agentes escaparam de um teste de segurança e invadiram os sistemas da plataforma de código aberto Hugging Face, enquanto tentavam encobrir seus rastros. O incidente gerou preocupações com a segurança — incidentes semelhantes ocorreram na concorrente Anthropic — à medida que os desenvolvedores correm para implantar modelos cada vez mais avançados.

As preocupações centram-se na IA agente, concebida para executar tarefas com pouca ou nenhuma intervenção humana. A promessa de agentes funcionando ininterruptamente é fundamental para a confiança dos investidores no potencial da IA ​​como tecnologia transformadora.

GPT-6 Astra revelado

A OpenAI chama seu modelo mais recente de GPT-6 Astra, sucessor do GPT 5.6 Sol lançado em julho, e afirmou em uma postagem no blog que ele é mais rápido e capaz de executar mais tarefas do que qualquer versão anterior. Entre as habilidades do Astra estão: preparação de impostos, desenvolvimento de jogos, renderização arquitetônica, formatação de memorandos jurídicos e busca de apartamentos.

“O Astra marca uma nova fronteira em termos de velocidade, precisão e segurança no uso de computadores”, afirmou a OpenAI em uma postagem em seu blog na quinta-feira. Por exemplo, a empresa disse que o Astra reduziu o tempo necessário para uma busca por um cuidador de gatos de 30 minutos, quando realizada por um humano, para apenas 5 minutos e 27 segundos. E para uma busca de emprego, apenas 2 minutos e 51 segundos, em comparação com 5 horas sem o Astra.

No entanto, a OpenAI também afirmou que o Astra tende a ocultar ou disfarçar intencionalmente seus métodos passo a passo para resolução de problemas, conhecidos como raciocínio, dificultando a avaliação posterior de suas técnicas por humanos. Em problemas mais complexos, o Astra ainda não consegue ocultar completamente seus métodos, segundo a OpenAI, embora esteja aprimorando sua capacidade de encobrir seus próprios rastros.

Em uma reunião informativa na manhã de quinta-feira, o cientista-chefe da OpenAI indicou que o monitoramento estava se tornando mais difícil, assim como o alinhamento, princípio segundo o qual a IA deve refletir os valores humanos.

“À medida que os modelos se tornam mais capazes, fica mais difícil entender exatamente o que eles podem fazer”, disse Jakub Pachocki. “Isso não garante que, à medida que a inteligência continue a aumentar, nossos métodos serão suficientes, porque o progresso na inteligência não garante o progresso no alinhamento.”

O monitoramento de agentes é um componente essencial da estratégia da OpenAI para tranquilizar reguladores, parlamentares e o público, ajudando a evitar novos incidentes de segurança.

Conteúdo distribuído por Reuters

Greg Bensinger
Sobre o autor

Greg Bensinger

Agência Reuters

Rádio Itatiaia

Ouça a rádio de Minas