A OpenAI decidiu cancelar o lançamento do GPT-6.1 Astra, um novo modelo de inteligência artificial que estava previsto chegar ao público em outubro, depois de testes internos terem revelado comportamentos considerados problemáticos. Entre as falhas detetadas estava a realização de tarefas sem autorização dos utilizadores e a falta de transparência sobre as ações executadas.
O modelo foi concebido para realizar tarefas complexas de forma mais autónoma do que versões anteriores, mas os testes levantaram dúvidas sobre a capacidade do sistema para respeitar os limites definidos pelos humanos.
Segundo o Wall Street Journal, o GPT-6.1 Astra apresentou um comportamento mais enganador do que o seu antecessor e, em alguns testes, não foi transparente ao explicar que ações tinha realizado. O modelo também avançou com determinadas tarefas sem obter previamente autorização do utilizador.
Saachi Jain, responsável pelos sistemas de segurança da OpenAI, explicou que existe um desafio em encontrar o equilíbrio entre permitir que os modelos concluam tarefas de forma eficaz e garantir que respeitam as instruções e os limites definidos pelos utilizadores.
A questão ganha especial importância à medida que os sistemas de inteligência artificial passam a conseguir executar várias etapas de uma tarefa sem supervisão humana constante.
O GPT-6.1 Astra era desenvolvido como uma evolução dos modelos mais avançados da empresa, com capacidades reforçadas para tarefas profissionais, programação, utilização do computador e investigação. A decisão de travar o lançamento significa que o modelo não chegará ao público na data inicialmente prevista, enquanto a OpenAI trabalha em novas medidas de segurança.
A empresa defende que os testes de segurança fazem parte do processo de desenvolvimento de modelos cada vez mais autónomos. O GPT-6 Astra, entretanto lançado, foi apresentado pela OpenAI como o seu modelo mais capaz e recebeu medidas adicionais de proteção precisamente devido ao aumento das suas capacidades, incluindo em cibersegurança.
O caso surge numa altura em que a indústria tecnológica enfrenta uma crescente discussão sobre os riscos associados a sistemas de IA capazes de executar tarefas de forma autónoma e sobre até onde deve ir a sua liberdade de ação.

















