Harness perusahaan saya untuk Qwen 3.8-27B, Muse Glimmer 30B dan Gemma 4:31B.
LLM Laptop Lokal
Bro… seseorang baru saja membuat klon Mario secara lokal dengan Qwen 3.8 27b dalam satu kesempatan
Link:
Gemini 3.8 Flash Upaya tinggi Vs Qwen 3.8 27B Upaya maksimal
Model MoE 125B Mencapai 25 token/detik pada satu RTX 4090 di rumah.
Qwen 3.8 Flash Next + decoding spekulatif MTP di - konteks 80k. - Dekode 25,35 t/dtk - 471 t/dtk pengisian awal Menjalankan model Mixture-of-Experts 125B pada satu GPU konsumen
Sudah sampai ujung arsip
Semua qwen38