A OpenAI suspendeu parte das atividades internas envolvendo o modelo Astra depois que avaliações preliminares apontaram capacidades cibernéticas fortes o suficiente para não descartar o nível crítico. A classificação é reservada a sistemas capazes de encontrar e explorar falhas graves ou atacar alvos protegidos com pouca intervenção humana.

O desenvolvimento será transferido para ambientes isolados, com acesso de rede restrito e execução em sandbox. Atividades que não atendem aos novos requisitos foram pausadas enquanto a empresa amplia testes e revisa os controles ao redor do modelo.

A empresa também pretende trabalhar com órgãos governamentais e organizações de segurança para avaliar o sistema. Astra não participou do incidente contra a Hugging Face, mas surge após laboratórios relatarem dificuldades para conter agentes durante exercícios ofensivos autorizados.

O caso muda o problema de segurança: não basta filtrar a resposta textual de um modelo. Quando ele pode executar código, acessar redes e combinar ferramentas, permissões, destinos, credenciais e registros precisam ser controlados fora do próprio modelo.

FONTE PRIMÁRIA

Leia o anúncio ou reportagem original

O Radar Tech acrescenta contexto e síntese. Consulte a publicação de origem para detalhes completos.

Abrir Reuters