Qwen-3.8-27B digunakan dalam Claudecode M2Max. Karena bandwidth memori hanya 400GB/s
Qwen-3.8-27B digunakan dalam Claudecode M2Max. Karena bandwidth memori hanya 400GB/s, setelah upaya tak henti-hentinya, untuk saat ini hanya dapat mencapai kecepatan 16token/s. Dengan cache, mesin lokal masih terlalu lambat. Dibutuhkan setengah hari untuk memproses 20.000 token sekaligus.
Qwen 3.8-27B baru saja menyamai model terbaik di dunia 6 bulan lalu.
And it runs on your laptop. 27 billion parameters. Tiny by AI standards. It keeps pace with Claude Opus 4.6 on coding, agent work, and reading images. Here's the crazy part: → Apache 2.0 license.
Jika Anda penasaran seperti apa ~48 tok/s.
Menjalankan MTPLX Qwen 3.8 4 bit quant -- sepenuhnya secara lokal pada 128gb MBP M5 dari
Bagus! Menurut pengujian sebenarnya, model besar dengan skala 100 miliar berhasil diterapkan di DGX Spark!
! 100 miliar per mesin, kecepatan melonjak! (Lihat rekaman layar👇🏻) Namun, SGLang (sgl_project) dikatakan lebih cepat! Saya harus mengatakan bahwa ekosistem open source dalam negeri kini semakin kuat! Sangat disarankan agar semua orang mempelajari penerapan model lokal: instal Ling-3.0, Qwen 3.8 27B, Minimax…
Sudah sampai ujung arsip
Semua qwen38