3 artykuły z tym tagiem
Google przekształcił Gemma 4 w szybszy model dyfuzyjny, używając zaledwie 10% pierwotnego budżetu tokenów i osiągając 1500 tokenów na sekundę.
DiffusionGemma generuje tekst blokami zamiast słowo po słowie, osiągając 4x lepszą wydajność na GPU NVIDIA. Model działa lokalnie bez kosztów chmury.
Google DeepMind udostępnił DiffusionGemma — eksperymentalny model wykorzystujący dyfuzję tekstową do 4x szybszego generowania treści niż tradycyjne LLM.