Gemini 3.7 Flash Tinggi vs Claude Opus 5 Tinggi vs Grok 4.6 Tinggi vs Qwen 3.8 27B
Qwen 3.8 27B mungkin merupakan rilis AI lokal paling menarik yang pernah saya uji bulan ini.
parameter 27,78B. konteks 262K. Apache 2.0. Dan itu mengalahkan Claude Opus 4.6 Max pada benchmark peluncuran 15/19. Tapi saya ingin melihat apa yang terjadi di luar benchmark.
“Tidak peduli, itu hanya melakukan sesuatu.”
Pemandangan yang cukup luar biasa tentang apa yang dilakukan qwen 3.8 tanpa sensor
Dflash 2 di M2 Max memberi saya sekitar 22 tok/s untuk Qwen 3.8 27B 4Bit dari komunitas mlx
Apakah ini jumlah maksimal yang saya harapkan pada M2 Max atau pengaturannya memerlukan penyempurnaan? berjalan di oMLX adakah yang menjalankan M2 Max memiliki hasil yang serupa atau mungkin sedikit lebih tinggi? betapa baiknya hal itu bagi Anda
Sudah sampai ujung arsip
Semua qwen38