LiteRT.js leva inferência de IA para o navegador
O Google apresentou o LiteRT.js para inferência de IA no navegador usando WebGPU, WebNN e WebAssembly, com exemplos para executar modelos compatíveis sem uma chamada ao servidor. Por que importa: Inferência no cliente pode reduzir latência, custo de hospedagem e exposição de dados em recursos leves de IA, mas o valor em produção depende do modelo e do suporte dos navegadores.
Para testar: Prototipe um pequeno recurso de classificação, extração ou assistência rodando localmente no navegador e compare tempo de carregamento, latência e tradeoffs de privacidade contra uma chamada de API hospedada.