Inteligência Artificial

Patrocinado por:

logo-totvs-preto

OpenAI limita modelo 'poderoso' após IA atingir nível crítico de risco cibernético

OpenAI diz que o Astra é o primeiro modelo da empresa a cruzar o limite "crítico" de capacidade cibernética, e vai restringir o acesso a seus recursos mais avançados

OpenAI: dona do ChatGPT 'bloqueou' novo modelo (Jernej Furman from Slovenia/Wikimedia Commons)

OpenAI: dona do ChatGPT 'bloqueou' novo modelo (Jernej Furman from Slovenia/Wikimedia Commons)

Tamires Vitorio
Tamires Vitorio

Repórter de Inteligência Artificial e Tecnologia

Publicado em 2 de setembro de 2026 às 09h13.

Priorizar nos meus resultados Google
Tudo sobreChatGPT
Saiba mais

A OpenAI afirmou nesta terça-feira, 1º, que seu próximo modelo de inteligência artificial (IA), batizado de Astra, é o primeiro da empresa a cruzar o limite "crítico" de capacidade cibernética dentro de seu Preparedness Framework — sistema interno que a companhia usa para rastrear e se preparar para capacidades avançadas de IA que possam representar riscos de dano severo.

Segundo a OpenAI, o Astra consegue encontrar falhas de segurança até então desconhecidas e desenvolver formas de explorá-las em diversos sistemas bem protegidos, sem depender de instruções humanas passo a passo. Durante os testes, o modelo chegou a descobrir e encadear duas vulnerabilidades inéditas (zero-day); a empresa afirma estar em processo de divulgar essas falhas aos responsáveis pelos sistemas afetados.

Acesso mais restrito às capacidades mais avançadas

A empresa afirma que ainda pretende disponibilizar o Astra "em breve", mas o acesso às suas capacidades cibernéticas será mais limitado — as funções mais avançadas de cibersegurança ficarão inicialmente restritas a um grupo de testadores, com acesso posterior ampliado por meio do programa Daybreak Blue, voltado a uso defensivo.

Segundo a OpenAI, o modelo passou a recusar 91,5% das solicitações em testes de jailbreak cibernético, ante 59% do GPT-5.6 Sol — e, para contas avaliadas como de maior risco, a empresa aplica um limite ainda mais conservador de comportamento.

O anúncio chega em meio a um escrutínio intenso sobre as práticas de segurança da OpenAI, depois que a empresa revelou, no mês passado, que dois de seus modelos escaparam do ambiente de testes, acessaram a internet aberta e invadiram sistemas da Hugging Face — episódio que a própria OpenAI classificou como um "incidente cibernético sem precedentes" e que levou a pausas temporárias em parte de seu treinamento e pesquisa internos.

A empresa afirma que o Astra não estava envolvido nesse incidente, mas decidiu atrasar parte de seu desenvolvimento mesmo assim, para reforçar e testar proteções adicionais antes do lançamento. "Com base em testes retrospectivos, acreditamos que nossas salvaguardas de produção, se estivessem ativas na época, teriam evitado o incidente da Hugging Face", disse a empresa, em comunicado.

Acompanhe tudo sobre:OpenAIChatGPT

Mais de Inteligência Artificial

Não estamos começando do zero, diz CEO da Pearson Brasil sobre IA

Brasil supera EUA e Reino Unido em expectativa de aceleração da IA, diz estudo

Passo a passo: como criar um assistente de IA seguro com documentos da sua empresa

A revolução da voz na IA: como o atendimento ao cliente está mudando em 2026