Di sini Qwen 3.8 27b zero menembakkan prompt yang sama, dan dengan UD-Q4_K_XL jumlahnya bahkan tidak presisi penuh
Itu tidak berhasil untuk Anda mungkin karena tali pengaman yang Anda gunakan
Ini keren! Qwen 3.8 di Mac Anda 🔥🔥🔥
Soalnya rahasia di balik Qwen 3.8 27B semua karena metode distilasi GRPO, mereka menggunakan keluaran Qwen 3.8 Max sebagai target RL,...
Soalnya, rahasia dibalik Qwen 3.8 27B adalah karena metode distilasi GRPO, mereka menggunakan output Qwen 3.8 Max sebagai target RL, dan ini membuat model yang lebih kecil berpikir sebanyak yang mereka butuhkan untuk mengejar model yang lebih besar. 🧠
22,5 jam iterasi.
Salah satu model lokal. Qwen 3.8 27B dijalankan melalui iterasi 90 × 15 menit pada DGX Spark (Asus Ascent GX10). Hasilnya? Cakrawala LEGO New York City yang lengkap, dibangun melalui iterasi tanpa henti.
Sudah sampai ujung arsip
Semua qwen38