Avaliação de agentes em .NET ganha toolkit dedicado
AgentEval é um toolkit .NET com licença MIT para avaliação de agentes de IA, incluindo validação de uso de ferramentas, métricas de qualidade de RAG, avaliação estocástica e comparação de modelos para workflows com Microsoft Agent Framework e Microsoft.Extensions.AI. Por que importa: A avaliação de agentes está saindo de experimentos apenas em Python e chegando a ferramentas nativas de frameworks de aplicação. Equipes que criam agentes em .NET podem medir comportamento de ferramentas e qualidade de RAG mais perto da stack de produção.
Para testar: Se um workflow de agentes em .NET estiver no escopo, execute o AgentEval em uma tarefa estreita de chamada de ferramenta ou RAG e compare suas checagens com a cobertura de testes existente para a mesma tarefa.