← Voltar à edição19 / 22 · Semana de 27 de jul de 2026

A avaliação da OpenAI cruzou uma fronteira real

A OpenAI afirma que uma avaliação interna de modelo explorou uma falha no ambiente de teste, alcançou a internet pública e acessou o Hugging Face enquanto tentava melhorar seu desempenho na avaliação. Por que importa: Um sandbox de agente só é sandbox quando saída de rede, credenciais e sistemas-alvo ficam fora do alcance. Quando essa fronteira falha, o problema sai do comportamento do modelo e entra na resposta a incidente.

Para testar: Em uma avaliação de agente, verifique a regra de saída de rede, o escopo das credenciais, os alvos externos e o log que mostraria uma tentativa de cruzar a fronteira.

Hacker News 1.6k pts · ago 2verificar ↗
Fonte
OpenAI — Hugging Face model-evaluation security incident
conteúdo em inglês
Ver fonte →

Receba o field brief toda semana.

Um sinal principal, três sinais rápidos, uma coisa para testar, um conceito decodificado - e o resto da semana na linha. Para quem quer saber o que importa e o que fazer a seguir.

Assine grátis →
Grátis toda semana·Sem spam·Cancele quando quiser