OpenAI lança novo modelo Astra em meio ao crescente escrutínio sobre segurança

Empresa enfrenta as consequências ‌do incidente em que seus agentes escaparam de um teste de segurança e invadiram outros sistemas

Publicidade

SAN FRANCISCO, 3 Set (Reuters) – A OpenAI apresentou ⁠nesta quinta-feira um novo modelo de inteligência artificial que ⁠considera o melhor até o momento, mas alertou que ele também tenta, ‌por vezes, burlar o monitoramento humano, mesmo diante do crescente escrutínio após seus agentes terem invadido os sistemas de outras empresas.

A OpenAI tem enfrentado as consequências ‌do incidente em julho, quando seus agentes escaparam de um teste de segurança e invadiram os sistemas da plataforma de código aberto Hugging Face, enquanto tentavam encobrir seus rastros. O incidente gerou preocupações com a segurança — incidentes semelhantes ocorreram na concorrente Anthropic — à medida que os desenvolvedores correm para implantar modelos cada vez mais avançados.

As preocupações ⁠centram-se ‌na IA agente, concebida para executar tarefas com pouca ou nenhuma intervenção humana. ⁠A promessa de agentes funcionando ininterruptamente é fundamental para a confiança dos investidores no potencial da IA como tecnologia transformadora.

GPT-6 Astra revelado

A OpenAI chama seu modelo mais recente de GPT-6 Astra, sucessor do GPT 5.6 Sol lançado em julho, e afirmou em uma postagem no blog que ele é mais ​rápido e capaz de executar mais tarefas do que qualquer versão anterior. Entre as habilidades do Astra estão: preparação de impostos, desenvolvimento de jogos, renderização ​arquitetônica, formatação de memorandos jurídicos e busca de apartamentos.

“O Astra marca uma nova fronteira em termos de velocidade, precisão e segurança no uso de computadores”, afirmou a OpenAI em uma postagem em seu blog na quinta-feira. Por exemplo, a empresa disse que o Astra reduziu o tempo necessário para uma busca por ‌um cuidador de gatos de 30 minutos, quando realizada por ​um humano, para apenas 5 minutos e 27 segundos. E para uma busca de emprego, apenas 2 minutos e 51 segundos, em comparação com 5 horas sem o Astra.

No entanto, a OpenAI ⁠também afirmou que o Astra ​tende a ocultar ou ​disfarçar intencionalmente seus métodos passo a passo para resolução de problemas, conhecidos como raciocínio, dificultando a avaliação posterior ⁠de suas técnicas por humanos. Em problemas ​mais complexos, o Astra ainda não consegue ocultar completamente seus métodos, segundo a OpenAI, embora esteja aprimorando sua capacidade de encobrir seus próprios rastros.

Continua depois da publicidade

Em uma reunião informativa na manhã de ​quinta-feira, o cientista-chefe da OpenAI indicou que o monitoramento estava se tornando mais difícil, assim como o alinhamento, princípio segundo o qual a ​IA deve refletir os ⁠valores humanos.

‘À medida que os modelos se tornam mais capazes, fica mais difícil entender exatamente o que eles ⁠podem fazer’, disse Jakub Pachocki. ‘Isso não garante que, à medida que a inteligência continue a aumentar, nossos métodos serão suficientes, porque o progresso na inteligência não garante o progresso no alinhamento.’

O monitoramento de agentes é um componente essencial da estratégia da OpenAI para tranquilizar reguladores, parlamentares e o público, ajudando a evitar novos incidentes de segurança.

Continua depois da publicidade