Qwen-3.8-Flash-Next dan GLM keren, mana yang lebih kuat?
Saya tidak akan menjalankan benchmark hari ini. Saya akan membuat cyber review: biarkan saja mereka berkelahi. Keduanya sebenarnya mewakili dua rute yang sangat berbeda. Qwen-3.8-Flash-Next telah mulai memasuki cakupan di mana orang biasa dapat menerapkan, mengukur, dan membuang runtime secara lokal. GLM Niulai adalah jenis monster yang sangat berbeda:
Saya baru saja menjalankan flash Qwen 3.8 selanjutnya melalui benchmark saya....
Terrible. Use GLM 5.3 flash instead
Qwen 3.8 Flash Next (125B-A6B) sekarang berjalan secara native di mlx-serve di Apple Silicon.
No Python, Zig + Metal. (Preview Release) M4 Max, 4-bit pack (~75 GB resident): - ~70 tok/s serial, ~98 tok/s with MTP when tested using `npx llmprobe` - prefill ~700 tok/s, sparse attention past 2k
Qwen 3.8 27b dengan prompt persis seperti Anda melalui Hermes.
The darker hue is the first attempt/pass The more vibrant hue is the second pass mentioning the sharp lines
Sudah sampai ujung arsip
Semua qwen38