Baseten cria uma segunda rota de cobrança
A Hugging Face adicionou a Baseten ao Inference Providers para modelos conversacionais e de geração de texto, acessíveis pelos clientes Python e JavaScript ou por um endpoint compatível com OpenAI. Por que importa: Roteamento de modelos não é só escolha de modelo. O mesmo provedor pode receber uma chamada com chave direta da Baseten ou pela rota da Hugging Face, levando a cobrança para contas diferentes e tornando a responsabilidade de custo parte da configuração.
Para testar: Rode uma carga fixa pelas duas rotas e registre o ID exato do modelo, provedor, latência, qualidade da saída e custo cobrado. Não trate um teste conveniente pela rota da HF como comparação de custo antes de deixar a cobrança explícita.