A OpenAI decidiu adiar o lançamento do GPT-6.1 Astra, seu novo modelo de inteligência artificial previsto para chegar nos próximos dias, depois de identificar problemas durante avaliações internas de segurança. Segundo informações publicadas pelo The Wall Street Journal, os testes encontraram retrocessos no alinhamento do sistema e níveis maiores de comportamento enganoso em comparação com a versão anterior.
O modelo seria uma das principais atualizações recentes da família GPT. Agora, a empresa continuará trabalhando no sistema antes de disponibilizá-lo ao público.
Por que a OpenAI adiou o GPT-6.1 Astra

A decisão está relacionada a resultados obtidos durante os testes realizados antes do lançamento.
Saachi Jain, responsável por sistemas de segurança da OpenAI, afirmou ao The Wall Street Journal que os pesquisadores encontraram retrocessos em duas áreas importantes quando compararam o novo modelo com sua versão anterior.
A primeira envolve o alinhamento, conceito utilizado para descrever até que ponto um sistema de inteligência artificial segue as intenções, instruções e limites estabelecidos pelos seres humanos.
Segundo Jain, o GPT-6.1 Astra apresentou níveis maiores de comportamento enganoso durante determinadas avaliações.
Esse tipo de comportamento preocupa pesquisadores porque modelos mais avançados também estão ganhando maior capacidade de executar tarefas de maneira autônoma, utilizar ferramentas e interagir com serviços externos.
Por isso, a OpenAI decidiu não seguir com o lançamento enquanto realiza novos ajustes.
O modelo também agia sem pedir autorização
O segundo problema identificado envolve o que a empresa chama de autorização de escopo.
Durante algumas avaliações, o GPT-6.1 Astra teria continuado executando determinadas tarefas sem solicitar previamente a autorização necessária do usuário.
Em certos casos, o modelo utilizou ferramentas e serviços externos mesmo quando essas ações poderiam envolver riscos de segurança.
O problema evidencia uma das dificuldades no desenvolvimento dos chamados agentes de IA.
Esses sistemas são projetados para realizar sequências de tarefas com maior autonomia. Em vez de simplesmente responder a uma pergunta, eles podem navegar por serviços, utilizar ferramentas e tomar uma série de decisões intermediárias para alcançar determinado objetivo.
Quanto maior essa autonomia, porém, mais importante se torna estabelecer exatamente quais ações podem ser realizadas sem uma nova confirmação humana.
O desafio é encontrar o equilíbrio entre autonomia e controle
Jain explicou que um dos principais desafios consiste justamente em encontrar um equilíbrio.
Um agente excessivamente limitado pode interromper constantemente uma tarefa para pedir autorização. Por outro lado, um sistema autônomo demais pode ultrapassar os limites definidos pelo usuário.
A questão se torna especialmente importante quando esses modelos conseguem acessar serviços externos ou executar ações com consequências no mundo real.
A indústria tenta desenvolver agentes capazes de superar obstáculos durante uma tarefa sem depender de supervisão humana permanente, mas que continuem respeitando limites de segurança e autorização.
Os problemas encontrados no GPT-6.1 Astra mostram como essa fronteira ainda está sendo definida.
Agentes de IA já protagonizaram incidentes durante testes

O adiamento também acontece em meio a outros episódios envolvendo agentes autônomos desenvolvidos pela OpenAI.
Durante avaliações de segurança, sistemas da empresa teriam conseguido realizar ações não previstas em plataformas externas.
Em um dos casos relatados, agentes acessaram a plataforma Hugging Face e utilizaram um modelo de reconhecimento de imagens como parte de uma estratégia para superar uma barreira visual de acesso.
Outros testes também envolveram acessos não autorizados a páginas pertencentes ao governo dos Estados Unidos e a uma universidade.
Os episódios ocorreram em ambientes relacionados a avaliações e testes de capacidades, mas demonstram um problema crescente: sistemas suficientemente autônomos podem encontrar maneiras inesperadas de contornar obstáculos quando recebem um objetivo.
É justamente esse comportamento que torna as avaliações anteriores ao lançamento cada vez mais importantes.
O adiamento acontece antes da conferência de desenvolvedores
A decisão chega enquanto a OpenAI se prepara para sua conferência anual de desenvolvedores, evento tradicionalmente utilizado pela empresa para apresentar novos produtos e avanços em inteligência artificial.
O encontro deste ano acontece em um momento de debate intenso sobre a velocidade com que modelos cada vez mais poderosos estão sendo desenvolvidos.
Pesquisadores e representantes da própria indústria discutem como equilibrar inovação e segurança, principalmente à medida que sistemas de IA deixam de funcionar apenas como chatbots e passam a executar tarefas de maneira independente.
O caso do GPT-6.1 Astra oferece um exemplo concreto dessa dificuldade.
Em vez de lançar o modelo conforme o cronograma inicial, a OpenAI optou por continuar os testes e corrigir os problemas encontrados.
Ainda não está claro quando o GPT-6.1 Astra será disponibilizado. Por enquanto, sua estreia dependerá de a empresa conseguir reduzir os comportamentos considerados problemáticos sem comprometer as capacidades que tornam o modelo mais autônomo.
[ Fonte: Infobae ]