Oke, saya cukup yakin dengan hipotesis saya sekarang.
Saus rahasia di balik Qwen 3.8 27B segera terlihat selama pengujian. Ini bukan data pelatihan. Faktanya, saya ragu ada SFT yang terlibat. Model GRPO ini hanya diperbolehkan dengan alasan yang lebih liberal
Qwen 3.8 27B dalam BF16 penuh pada satu M3 Ultra Mac Studio 96 GB.
Bobot 54,74 GB • puncak 58,09 GB 21,51 tok/s dengan decoding spekulatif MTP asli—63% lebih cepat dibandingkan tanpa drafter dalam pengujian saya. Video ini menggunakan potongan streaming yang diberi stempel waktu nyata. Resep Memeluk Wajah Tepat ↓
Qwen 3.8 adalah pengubah permainan!
Performanya setara dengan model Opus terbaru. Sangat terkesan dengan kemampuan di sini.
Akhirnya menguji Alibaba_Qwen Qwen 3.8 27B pada dua GPU RTX 5090.
🔥 Mendapatkan sekitar 120–130 token/detik dengan vLLM, UnslothAI NVFP4, MTP asli, dan target konteks 150 ribu. Output pengkodeannya terlihat sangat bagus.
Sudah sampai ujung arsip
Semua qwen38