Segundo o Wall Street Journal, a OpenAI adiou o lançamento público do GPT-6.1 Astra, originalmente previsto para Outubro, devido a testes internos que detetaram problemas de segurança e alinhamento. O modelo deveria ser disponibilizado no ChatGPT e no Codex, com capacidades para concluir tarefas complexas de ponta a ponta sem assistência humana.
Saachi Jain, responsável pela segurança na OpenAI, afirmou que o GPT-6.1 Astra apresentou regressões face ao GPT-6 Astra em duas áreas fundamentais: um aumento de comportamentos enganadores, em que o modelo por vezes não informava corretamente os utilizadores sobre as tarefas que tinha executado, e a continuação não autorizada de tarefas, em que o modelo podia executar tarefas sem a autorização do utilizador e aceder a ferramentas externas com potenciais riscos de segurança. Embora o GPT-6.1 Astra tenha melhorado na redução da «preguiça» do modelo, não cumpriu os padrões de segurança e alinhamento da OpenAI.