Retenção de cache de prompts da OpenAI
O changelog da plataforma da OpenAI lista um comportamento padrão de retenção de cache de prompts por 24 horas para organizações que não usam retenção zero de dados. Por que importa: As premissas de custo e latência dos agentes dependem cada vez mais do comportamento de cache, das ferramentas hospedadas e das configurações de retenção de dados, e não apenas do preço por token do modelo.
Para testar: Antes de escalar uma tarefa de agente repetida, verifique se os prompts são cacheáveis, qual política de retenção se aplica e se o fluxo de trabalho exige uma configuração de dados mais rígida.