aiexpert
§ Resposta sintética

Flash-dLLM cuts diffusion LLM inference latency 11× with fused kernels

Procurando nas fontes…

Resposta sintetizada por Claude Sonnet 4.6 sobre artigos editados pela nossa redação. Cada [N] vincula direto à fonte.