Soalnya rahasia di balik Qwen 3.8 27B semua karena metode distilasi GRPO, mereka menggunakan keluaran Qwen 3.8 Max sebagai target RL,...
Soalnya, rahasia dibalik Qwen 3.8 27B adalah karena metode distilasi GRPO, mereka menggunakan output Qwen 3.8 Max sebagai target RL, dan ini membuat model yang lebih kecil berpikir sebanyak yang mereka butuhkan untuk mengejar model yang lebih besar. 🧠
22,5 jam iterasi.
Salah satu model lokal. Qwen 3.8 27B dijalankan melalui iterasi 90 × 15 menit pada DGX Spark (Asus Ascent GX10). Hasilnya? Cakrawala LEGO New York City yang lengkap, dibangun melalui iterasi tanpa henti.
Qwen 3.8 27B Q4_K_M - 90 token/detik pada satu NVIDIA RTX 4090 (VRAM 24 GB) dengan Dflash2!
(MTP 60 tps -> 90 tps Dflash2!!!!) AI lokal bergerak sangat cepat (secara harfiah!) hingga menakutkan. Z lab baru saja merilis DFlash 2 untuk Qwen 3.8 27b dan Muse Glimmer. Saya menambal llama.cpp (PR #27342) dan
Saya meminta Qwen 3.8 Uncensored untuk membuat Silicon Valley Show tetapi untuk tahun 2026 dengan Bytedance Seedance 2.5 / Google Omni.
AI Slop besar-besaran.
Sudah sampai ujung arsip
Semua qwen38