Mainkan bersama dengan 0-shot ini dari Alibaba_Qwen Qwen 3.8 27B di FP16 di vllm_project yang terhubung ke NousResearch Hermes Agent👇
Saya menghabiskan waktu menguji Qwen 3.8 27B.
Kesan pertama: - 47 token/detik dengan MTP. - Ini merupakan peningkatan nyata atas kualitas 3,6 pada pengujian voxel. Semua elemen dibumikan dengan benar, tidak ada yang terbalik, dan pergerakan yang bagus di dalam air. - Ia berpikir BANYAK. Hampir tidak dapat digunakan…
Dan inilah website Qwen 3.8 27b Q8 yang pasti lebih baik dari NVFP4.
Juga mendapatkan generasi game yang sangat bagus dengan Q8. Q8 adalah kemenangan.
Inilah Qwen 3.8 27B 4-bit yang berjalan pada Asus GX10 (= DGX Spark).
Tentu, ini bukan soal kecepatan GPU tetapi cukup oke dengan prediksi multi-token yang diaktifkan. Ditambah lagi, banyak alur kerja saya yang 'merencanakan dulu selama satu jam, lalu menekan tombol, kembali dalam x jam', dan untuk itu kecepatannya lebih dari cukup.
Sudah sampai ujung arsip
Semua qwen38