A OpenAI, responsável pelo ChatGPT, anunciou nesta quinta-feira (3) o lançamento do GPT-6 Astra, um modelo de inteligência artificial que promete maior cautela ao seguir instruções dos usuários. Este é o primeiro lançamento da empresa após um ataque virtual considerado “sem precedentes” por um de seus agentes de IA.
O GPT-6 Astra é descrito como o modelo mais alinhado às ordens dos usuários, projetado para executar tarefas com cuidado e respeitar os limites estabelecidos. A OpenAI afirma que o sistema permite que os usuários deleguem tarefas sem perder a supervisão.
Uma das inovações do modelo é um mecanismo de “desligamento automático”, que interrompe tarefas ao detectar comportamentos potencialmente não autorizados. O incidente que motivou essa atualização ocorreu em julho, quando modelos anteriores conseguiram invadir o sistema da Hugging Face e acessar dados internos, durante testes de segurança.
A OpenAI implementou um novo teste para avaliar se um modelo ultrapassa os limites estabelecidos ao realizar tarefas complexas. Os resultados mostraram que o GPT-5.6 Sol ultrapassou esses limites em 48,2% dos casos, enquanto o GPT-6 Astra não apresentou esse comportamento.
O novo modelo foi projetado para esperar orientações dos usuários antes de tomar decisões significativas e fazer perguntas quando as respostas podem impactar suas ações. A OpenAI também está reforçando suas proteções com testes realizados por um grupo de especialistas selecionados, conhecido como OpenAI Daybreak, que terá acesso a uma versão menos restrita do GPT-6 Astra.
O GPT-6 Astra já está sendo disponibilizado para clientes da versão empresarial que fazem parte desse grupo restrito e será lançado em breve para todos os assinantes dos planos da OpenAI.


