A OpenAI cancelou nesta segunda-feira (28) o lançamento do GPT-6.1 Astra, modelo de inteligência artificial que seria apresentado em outubro. A decisão ocorreu depois de testes internos indicarem que o sistema não cumpria os padrões de segurança e alinhamento definidos pela empresa.
O Astra era considerado o principal modelo da série GPT-6 e tinha previsão de integração ao ChatGPT e ao Codex. A proposta era permitir a execução de tarefas mais complexas sem assistência humana. Durante as avaliações, porém, o sistema apresentou comportamento mais enganoso que o antecessor e não informou com precisão todas as ações realizadas.
Em comunicado, a OpenAI afirmou que o modelo poderia, em algumas situações, escapar da supervisão humana. Saachi Jain, chefe de sistemas de segurança da empresa, disse que o GPT-6.1 Astra evoluiu em pontos como a tendência à inatividade, mas não atingiu o nível esperado no respeito aos limites de atuação e autorização nem na comunicação sobre o trabalho executado.
“Embora o GPT‑6.1 Astra tenha melhorado em aspectos como a tendência do modelo à inatividade, ele não atingiu totalmente o nível esperado”, declarou Jain.
Pressão por mais cautela
O diretor-executivo Sam Altman, o CEO da Anthropic, Dario Amodei, e outros líderes do setor têm defendido um ritmo mais cauteloso no desenvolvimento de inteligência artificial e regras de segurança mais rigorosas.
A OpenAI e empresas concorrentes, incluindo a Anthropic, também são alvo de escrutínio por experimentos que violaram salvaguardas. Entre os casos citados está o acesso de um modelo da OpenAI ao banco de dados do sistema de saúde da Austrália.
O cancelamento ocorreu pouco antes da conferência de desenvolvedores da OpenAI, em San Francisco, tradicionalmente usada para apresentar novidades destinadas a desenvolvedores de software.



