Qwen 3.8 Flash Next 180B (80gb) di ponsel android RAM 12gb ($400 telepon)...
Qwen 3.8 Flash Next BF16 di 4x Nvidia DGX Sparks juga jago membuat diorama
Model AI dengan parameter 27 miliar yang berjalan pada GPU seharga $300 dan hanya memiliki memori 8 GB.
Itulah yang dicapai kuantisasi baru Unsloth dengan Qwen 3.8 27B — langsung ke PC, tanpa cloud, tanpa berlangganan.
Qwen 3.8 flash next hanya membuat parameter 125B terlihat murahan.
Bagian yang liar bukanlah ukurannya. Betapa kecilnya ukuran yang dibutuhkannya setiap kali ia berpikir. Arsitektur: → 125B parameter utama → Hanya 6B yang diaktifkan per token → Parameter 51B lainnya dalam penyematan Engramnya
Sudah sampai ujung arsip
Semua qwen38