← Voltar à edição11 / 22 · Semana de 20 de jul de 2026

Opus 5 transforma agente em problema de roteamento

A Artificial Analysis coloca o Claude Opus 5 no topo do AA-Briefcase, benchmark proprietário para trabalho agentic de conhecimento com arquivos privados e entregáveis como relatórios, apresentações e planilhas. No esforço máximo, Opus 5 marca 1720 Elo, 146 pontos acima do Claude Fable 5, com custo por tarefa caindo de US$22,30 para US$17,79. Por que importa: O sinal útil não é só a vitória no ranking. O Opus 5 mostra o novo painel de operação para agentes de conhecimento: esforço, taxa de rubrica, qualidade analítica, qualidade de apresentação, custo por tarefa, número de turnos e tempo de parede. As configurações de topo lideram, mas passam de 25 minutos por tarefa.

Para testar: Antes de mandar todo agente de conhecimento para o modelo do topo, rode a mesma tarefa em dois níveis de esforço e compare recibos: rubrica, custo por tarefa, minutos, turnos e quanto polimento de apresentação ainda sobra para uma pessoa.

Fonte
Artificial Analysis on Claude Opus 5 AA-Briefcase
conteúdo em inglês
Ver fonte →

Receba o field brief toda semana.

Um sinal principal, três sinais rápidos, uma coisa para testar, um conceito decodificado - e o resto da semana na linha. Para quem quer saber o que importa e o que fazer a seguir.

Assine grátis →
Grátis toda semana·Sem spam·Cancele quando quiser