Nunchaku leva difusão 4-bit ao Diffusers
O blog do Diffusers, da Hugging Face, descreve a integração do Nunchaku para inferência 4-bit em diffusion transformers, com foco em reduzir a VRAM exigida por modelos grandes de imagem. Por que importa: Workflows locais de imagem muitas vezes travam na memória antes da qualidade do modelo. Inferência de difusão quantizada pode levar experimentos de GPUs alugadas com muita memória para hardware mais acessível.
Para testar: Se um workflow de imagem está limitado por VRAM, teste um pipeline do Diffusers com Nunchaku e compare uso de memória, tempo de geração e artefatos visuais antes de mudar a stack padrão.