GLM 5.3 Max vs Fabel 5 vs Qwen 3.8 Max vs Grok 4.6
Gemini 3.7 Flash vs Qwen 3.8 vs
DeepSeek V4 Pro vs GLM 5.3
Beginilah tampilan Qwen 3.8 27B pada sekitar 30 tok/s di mtplx
Saya akan mencoba jumlah yang lebih kecil karena 8bit dan penggunaan ramnya meningkat menjadi sekitar 35 gb
Berhenti membayar pajak konteks visual API ke kartel cloud.
Saya baru saja menempatkan Qwen3.8 27B dengan visi pada satu NVIDIA RTX 4090 (24GB). Saya memberinya muatan 30.000 token yang sangat besar (28,5 ribu teks + 1 gambar resolusi tinggi) untuk melihat di mana VRAM fisik dan batas throughput berada dengan dan tanpa
Sudah sampai ujung arsip
Semua qwen38