Model AI dengan parameter 27 miliar yang berjalan pada GPU seharga $300 dan hanya memiliki memori 8 GB.
Itulah yang dicapai kuantisasi baru Unsloth dengan Qwen 3.8 27B — langsung ke PC, tanpa cloud, tanpa berlangganan.
Qwen 3.8 flash next hanya membuat parameter 125B terlihat murahan.
Bagian yang liar bukanlah ukurannya. Betapa kecilnya ukuran yang dibutuhkannya setiap kali ia berpikir. Arsitektur: → 125B parameter utama → Hanya 6B yang diaktifkan per token → Parameter 51B lainnya dalam penyematan Engramnya
Saya menguji GLM 5.3 Flash dan Qwen 3.8 Flash pada dua DGX Sparks.
Salah satu model merangkak. Yang lain membuat game yang bisa dimainkan. Inilah jawaban jujurnya tentang apakah pengkodean AI lokal sepadan dengan perangkat kerasnya.
Perbandingan lokal Qwen 3.8-Flash-Next.
Sudah sampai ujung arsip
Semua qwen38