3 artykuły z tym tagiem
Programiści testują lokalne alternatywy dla komercyjnych modeli AI. Modele 30B+ osiągają przyzwoitą jakość, ale wymagają dużo cierpliwości i zasobów.
Google DeepMind udostępnił DiffusionGemma — eksperymentalny model wykorzystujący dyfuzję tekstową do 4x szybszego generowania treści niż tradycyjne LLM.
Niewielki model Gemma 2B uzyskał wynik 8,0 w MT-Bench, wyprzedzając GPT-3.5 Turbo (7,94), działając tylko na CPU bez GPU.