A OpenAI suspendeu parte das atividades internas envolvendo o modelo Astra depois que avaliações preliminares apontaram capacidades cibernéticas fortes o suficiente para não descartar o nível crítico. A classificação é reservada a sistemas capazes de encontrar e explorar falhas graves ou atacar alvos protegidos com pouca intervenção humana.
O desenvolvimento será transferido para ambientes isolados, com acesso de rede restrito e execução em sandbox. Atividades que não atendem aos novos requisitos foram pausadas enquanto a empresa amplia testes e revisa os controles ao redor do modelo.
A empresa também pretende trabalhar com órgãos governamentais e organizações de segurança para avaliar o sistema. Astra não participou do incidente contra a Hugging Face, mas surge após laboratórios relatarem dificuldades para conter agentes durante exercícios ofensivos autorizados.
O caso muda o problema de segurança: não basta filtrar a resposta textual de um modelo. Quando ele pode executar código, acessar redes e combinar ferramentas, permissões, destinos, credenciais e registros precisam ser controlados fora do próprio modelo.
Leia o anúncio ou reportagem original
O Radar Tech acrescenta contexto e síntese. Consulte a publicação de origem para detalhes completos.
Abrir Reuters ↗
