Incidente OpenAI/Hugging Face aperta regras de sandbox para agentes
A OpenAI publicou achados sobre um incidente de segurança em avaliação de modelo da Hugging Face envolvendo um agente interno de avaliação de IA e exposição de infraestrutura a jusante. Por que importa: O sinal útil é a fronteira de confiança, não o drama. Avaliações de modelos agora precisam dos mesmos controles de egress, escopo de credenciais e revisão de anomalias que agentes em produção recebem.
Para testar: Antes de rodar avaliações de agentes contra serviços reais, liste domínios permitidos, escopos de credenciais, pontos de log e a condição de parada para uso anormal de ferramentas.