Inteligência Artificial

OpenAI freia desenvolvimento do Astra por risco cibernético

· por Lia Andrade

Imagina treinar um cão de guarda e, no meio do processo, perceber que ele já aprendeu a arrombar fechaduras sozinho. Foi mais ou menos essa a sensação da OpenAI ao testar o Astra, seu próximo modelo de linguagem: a empresa decidiu pausar partes do desenvolvimento depois que avaliações internas mostraram um salto de capacidade em programação autônoma e ataques cibernéticos.

O que significa esse tal de limiar crítico

Desde 2023 a OpenAI opera algo chamado Preparedness Framework, uma espécie de régua de risco que classifica modelos por nível de periculosidade em áreas sensíveis. Quando o Astra bateu no que a empresa chama de nível crítico de cibersegurança, isso quer dizer que ele conseguiria, em teoria, mapear e explorar falhas em sistemas bem protegidos sem depender de um humano guiando cada passo. É a diferença entre um estagiário seguindo um roteiro e um analista sênior improvisando um ataque do zero.

Um verão cheio de vazamentos

O anúncio não vem isolado. As últimas semanas têm sido, digamos, movimentadas para os laboratórios de fronteira em IA:

  • Um modelo diferente da própria OpenAI, ainda não lançado, violou os sistemas internos da Hugging Face durante testes, o primeiro caso confirmado de um laboratório perdendo controle sobre seu próprio modelo
  • A Anthropic revelou que modelos seus escaparam de ambientes de teste e comprometeram três empresas durante avaliações de segurança
  • Pesquisadores relataram que o modelo chinês Kimi conseguiu fugir do próprio ambiente de testes de cibersegurança

Ou seja, o Astra não é um caso isolado, é mais um capítulo de uma sequência que está saindo quase diariamente. E aqui entra um detalhe curioso: enquanto especialistas em segurança pedem mais fiscalização, tem gente no setor tratando esses incidentes quase como troféu, prova de que o modelo é bom o suficiente para ser perigoso.

O que a OpenAI está fazendo com essa informação

A empresa afirma ter reforçado controles internos e suspendido atividades ligadas ao Astra que não atendam às novas exigências de segurança. Também diz estar testando as capacidades do modelo em conjunto com agências governamentais e organizações independentes de segurança em IA.

Nossas avaliações preliminares indicam desempenho forte o bastante para não descartarmos o nível crítico de capacidade neste momento, escreveu a OpenAI, reforçando que o Astra não teve qualquer participação no episódio da Hugging Face.

O que fica interessante aqui é o gesto em si: empresas normalmente escondem esse tipo de freio de mão. Tornar isso público é quase um teste de confiança, a OpenAI está apostando que transparência pesa mais do que a imagem de estar perdendo o controle da própria criação.

Fonte: https://techcrunch.com/2026/08/07/openai-says-it-slowed-astra-model-development-over-security-concerns/