A OpenAI confirmou que um modelo ainda em desenvolvimento, batizado de Astra, mostrou em testes internos capacidades de programação e invasão de sistemas altas o suficiente para não descartar o nível mais crítico de risco cibernético da própria escala de segurança da empresa. Como resposta, a companhia pausou partes do desenvolvimento do modelo e reforçou os controles de acesso antes de seguir adiante. Entenda o que foi confirmado, o que ainda é hipótese e se isso muda alguma coisa pra quem usa IA no dia a dia.
Resposta rápida
A OpenAI avaliou que o Astra, um modelo não lançado, pode ter atingido o nível Crítico de capacidade cibernética do seu Preparedness Framework, o mais alto da escala, nunca alcançado antes por um modelo da empresa. Isso significa que ele demonstrou habilidade de encontrar falhas de segurança inéditas quase sem ajuda humana. A OpenAI pausou atividades internas que não atendem aos novos controles de segurança e não confirmou nenhum ataque real usando o modelo.
O essencial
- O que aconteceu: testes internos indicaram que o Astra pode ter capacidade cibernética de nível Crítico
- O Astra está disponível ao público? Não, é um modelo ainda em desenvolvimento
- Houve algum ataque real? A OpenAI diz que não
- O que a empresa fez: pausou parte do desenvolvimento e reforçou controles de segurança
- Fonte: comunicado oficial publicado no site da OpenAI
O que é o Astra e o que a OpenAI descobriu
O Astra é descrito pela própria OpenAI como “um de nossos próximos modelos”, ou seja, um sistema que ainda está em fase de desenvolvimento e testes internos, sem data de lançamento anunciada. Segundo o comunicado oficial, avaliações feitas nos últimos dias mostraram avanços relevantes em codificação agêntica (a IA programando e executando tarefas sozinha, com pouca supervisão) e em cibersegurança. Diante desses resultados, somados a avaliações de especialistas externos, a empresa concluiu que não pode descartar que o Astra tenha alcançado o nível de capacidade cibernética que ela própria classifica como Crítico.
Para efeito de comparação, modelos anteriores da OpenAI, incluindo o GPT-5.6-Sol, haviam sido avaliados no nível Alto, um degrau abaixo do Crítico, na mesma escala de cibersegurança.
O que significa “capacidade crítica de cibersegurança”
A definição não é da imprensa, é da própria OpenAI, dentro do Preparedness Framework, o documento que a empresa publicou em dezembro de 2023 para medir o quanto cada modelo pode ser perigoso em áreas sensíveis (biologia, química, autonomia de IA e cibersegurança) antes de decidir o que pode ou não ser lançado.
| Nível | O que significa, segundo a OpenAI |
|---|---|
| Alto (nível anterior) | Capacidade relevante em cibersegurança, mas ainda dependente de supervisão humana significativa. Foi onde ficaram os modelos anteriores, como o GPT-5.6-Sol. |
| Crítico (o que o Astra não descarta) | O modelo consegue identificar e desenvolver sozinho falhas de segurança inéditas (zero-day) em sistemas reais protegidos, ou planejar e executar do início ao fim uma estratégia de ataque cibernético contra um alvo protegido, a partir de apenas um objetivo genérico dado por alguém. |
Ou seja, o ponto central não é que o Astra tenha atacado alguém, é que ele mostrou sinais de que poderia fazer isso sem intervenção humana em cada etapa, o que muda o tipo de controle que a OpenAI precisa aplicar antes de deixar o modelo mais livre.
O que a OpenAI está fazendo agora
Segundo o comunicado oficial, a empresa tomou as seguintes medidas internas enquanto o desenvolvimento do Astra continua:
- Reforço nos controles de segurança para modelos de capacidade mais alta: ambientes de teste isolados, acesso restrito a rede e ferramentas, criptografia reforçada dos pesos do modelo e execução em sandbox.
- Pausa em atividades internas com o Astra que ainda não atendem a esses controles reforçados, ou seja, partes do desenvolvimento foram suspensas até o ambiente ficar mais seguro, não o projeto inteiro.
- Monitoramento universal de ações de risco em todas as aplicações agênticas do Astra, incluindo treino e avaliação: o sistema analisa o raciocínio do modelo (chain of thought) e aciona uma resposta de segurança para revisar ou interromper atividade considerada arriscada.
- Testes com terceiros externos: a OpenAI vai trabalhar com agências de governo e organizações dedicadas à segurança em IA para testar as capacidades do modelo antes de qualquer lançamento mais amplo.
- Orientação de segurança para parceiros de teste: a empresa vai fornecer recomendações de controle de segurança para quem for rodar avaliações de risco mais alto com o modelo.
A fonte completa, com a definição técnica exata do Preparedness Framework e o texto integral do comunicado, está disponível no site oficial da OpenAI.
Houve algum ataque real com o Astra?
Não, segundo a OpenAI. O comunicado é direto nesse ponto: o Astra não esteve envolvido em nenhum incidente de segurança já conhecido publicamente. A empresa fez questão de separar as duas coisas, de um lado, o resultado de testes internos controlados que indicam capacidade potencial; de outro, qualquer uso real do modelo para invadir sistemas, que ela nega ter acontecido. Vale o mesmo cuidado de sempre: um modelo mostrar capacidade em teste controlado não é o mesmo que esse recurso estar disponível para qualquer pessoa usar, hoje, no Brasil ou em qualquer lugar.
O que isso significa pra você
Se você usa ChatGPT, Gemini, Copilot ou qualquer outra ferramenta de IA no dia a dia, nada muda na prática agora: o Astra não está no ar e essa pausa é sobre o que ainda não foi lançado. O recado real é outro, a IA está chegando perto de encontrar e explorar falhas de segurança sozinha, então vale reforçar o básico que já vale hoje, independentemente do Astra: manter aparelhos e apps sempre atualizados, ativar a verificação em duas etapas nas contas importantes e desconfiar de qualquer mensagem, e-mail ou vídeo que peça pra você agir rápido sem pensar, como no caso dos golpes que já usam vídeo com IA pra convencer a vítima a ignorar alertas do banco.
🔗 Leia também
Perguntas frequentes
O que é o Astra?
É um modelo de inteligência artificial ainda em desenvolvimento na OpenAI, que não foi lançado publicamente. Ele não é o mesmo modelo que roda no ChatGPT hoje, nenhum aplicativo ou plano atual usa o Astra.
O ChatGPT que eu uso hoje foi afetado?
Não. A pausa é interna, sobre o desenvolvimento futuro do Astra. O ChatGPT, o Gemini e os demais produtos que já estão no ar continuam funcionando normalmente, sem qualquer mudança de acesso ou de recursos por causa deste caso.
O Astra já atacou algum sistema de verdade?
A OpenAI afirma que não. A empresa foi explícita ao dizer que o Astra não esteve envolvido em nenhum incidente de segurança conhecido; a preocupação é sobre o que o modelo seria capaz de fazer se liberado sem controles adicionais, não sobre um ataque que já aconteceu.
O que é o Preparedness Framework?
É o documento que a OpenAI publicou em dezembro de 2023 para classificar o quanto um modelo pode ser perigoso em áreas como biologia, química, autonomia de IA e cibersegurança, e definir travas obrigatórias conforme a capacidade sobe. É a régua interna que a empresa usa antes de decidir o que lançar.
O que muda para quem desenvolve software ou trabalha com segurança?
Nada muda hoje de forma prática, já que o Astra não está disponível. Mas o caso é um sinal de que modelos de IA capazes de programar sozinhos estão perto de encontrar falhas de segurança (zero-day) sem ajuda humana, o que também deve acelerar ferramentas de defesa baseadas nesse mesmo tipo de IA.
Outras empresas de IA já passaram por isso?
A própria OpenAI cita um precedente: em junho de 2025, quando seus modelos se aproximaram do nível alto de capacidade em biologia, a empresa também reforçou testes e controles antes de seguir com o desenvolvimento. Ou seja, não é a primeira vez que a companhia freia o próprio produto por segurança.
Quando o Astra deve ser lançado?
A OpenAI não deu uma data. A empresa diz apenas que vai continuar testando o modelo, agora com controles mais rígidos, e que vai envolver agências de governo e organizações de segurança em IA nessa avaliação antes de qualquer lançamento.




