A OpenAI confirmou, a 1 de setembro, algo que marca uma viragem no mundo da inteligência artificial: o seu futuro modelo, chamado Astra, é o primeiro da empresa a atingir o nível “crítico” de capacidade cibernética. Por outras palavras, é uma IA capaz de descobrir e explorar falhas de segurança sozinha e essa constatação levou a própria OpenAI a abrandar o desenvolvimento e a reforçar as proteções antes de o disponibilizar.
O que significa “capacidade crítica”
A OpenAI classifica os riscos dos seus modelos através de um documento interno, o Preparedness Framework. O nível “crítico”, o mais elevado, aplica-se a um modelo que consiga identificar e criar exploits funcionais de vulnerabilidades desconhecidas (as chamadas zero-day) em sistemas reais e protegidos, sem intervenção humana, ou que consiga planear e executar um ciberataque completo a partir apenas de um objetivo genérico.

É a primeira vez que um modelo da empresa cruza esta linha. Até agora, os modelos de IA ajudavam sobretudo a explicar ataques já conhecidos; o Astra representa o salto para os executar de forma autónoma.
O que o Astra conseguiu fazer nos testes
Os números divulgados pela OpenAI, e reportados por vários meios internacionais, são impressionantes e inquietantes. O Astra alcançou uma pontuação de 100% num teste de referência de criação de exploits a partir de vulnerabilidades conhecidas. Num teste interno com 20 vulnerabilidades recentes de gravidade elevada, teve taxas de execução muito superiores às do modelo anterior (o GPT-5.6 Sol) e chegou a encontrar duas falhas zero-day e a encadeá-las numa cadeia de ataque.
Noutras avaliações, comprometeu um navegador protegido, escapou do seu ambiente isolado (sandbox) e executou comandos no sistema anfitrião. Também descobriu várias falhas num sistema operativo e combinou-as para obter privilégios de administrador. A OpenAI diz estar a comunicar estas vulnerabilidades aos responsáveis pelo software afetado.
Por isso a OpenAI “travou”
Perante estes resultados, a empresa atrasou partes do desenvolvimento e do lançamento enquanto reforçava as proteções. O Astra deverá ser disponibilizado “em breve”, mas o acesso às suas capacidades cibernéticas mais avançadas ficará, numa fase inicial, limitado a um pequeno grupo de especialistas. Não há ainda data exata, preço nem lista de planos compatíveis.
Um esclarecimento importante que a OpenAI faz questão de sublinhar: o Astra não esteve envolvido no incidente recente com a plataforma Hugging Face, esse episódio envolveu outros modelos.
Porque é que isto te importa
Entretanto esta notícia tem duas faces. Do lado bom, um modelo assim pode ajudar equipas de segurança, incluindo em Portugal, a descobrir e corrigir falhas antes de os criminosos as explorarem. Do lado mau, demonstra que a IA está a acelerar drasticamente a criação de ataques. Uma vulnerabilidade descoberta por um modelo pode ser transformada num ataque funcional muito mais depressa do que através de investigação humana. Para empresas, hospitais, organismos públicos e infraestruturas críticas, a velocidade passa a ser o problema central.

Há ainda um impacto direto para quem usa estas ferramentas no dia a dia: a OpenAI avisa que as novas proteções podem causar interrupções adicionais. Determinadas tarefas legítimas no ChatGPT, no Codex ou na API poderão ser atrasadas ou bloqueadas por engano. No ChatGPT poderás ser chamado a rever uma ação; na API, a tarefa poderá simplesmente terminar.
No fundo, o caso do Astra é mais um sinal a par do aviso do organismo do G20 sobre ataques com IA e dos incidentes nos testes da Anthropic de que a IA autónoma em cibersegurança deixou de ser uma hipótese futura. É o presente, e traz tanto ferramentas de defesa poderosas como riscos que o mundo ainda está a aprender a conter.






