Bro… seseorang baru saja membuat klon Mario secara lokal dengan Qwen 3.8 27b dalam satu kesempatan
Link:
Gemini 3.8 Flash Upaya tinggi Vs Qwen 3.8 27B Upaya maksimal
Model MoE 125B Mencapai 25 token/detik pada satu RTX 4090 di rumah.
Qwen 3.8 Flash Next + decoding spekulatif MTP di - konteks 80k. - Dekode 25,35 t/dtk - 471 t/dtk pengisian awal Menjalankan model Mixture-of-Experts 125B pada satu GPU konsumen
Butuh waktu 15 menit untuk membuatnya dengan Qwen 3.8 27B yang berjalan secara lokal di Laptop RTX saya dan disajikan ke Macbook saya.
Selamat datang di Dunia Nyata, MATRIKS!!!
Sudah sampai ujung arsip
Semua qwen38