Gemini 3.7 Flash vs Qwen 3.8 vs
DeepSeek V4 Pro vs GLM 5.3
Beginilah tampilan Qwen 3.8 27B pada sekitar 30 tok/s di mtplx
Saya akan mencoba jumlah yang lebih kecil karena 8bit dan penggunaan ramnya meningkat menjadi sekitar 35 gb
Berhenti membayar pajak konteks visual API ke kartel cloud.
Saya baru saja menempatkan Qwen3.8 27B dengan visi pada satu NVIDIA RTX 4090 (24GB). Saya memberinya muatan 30.000 token yang sangat besar (28,5 ribu teks + 1 gambar resolusi tinggi) untuk melihat di mana VRAM fisik dan batas throughput berada dengan dan tanpa
Qwen 3.8 27b
Anjuran: beri saya esai tentang ontologi sekarang buatlah situs web yang akan menjelaskan hal ini dalam animasi threeejs Berjalan secara lokal: Qwen3.8-27B UD-Q8_K_XL konteks 220K 2×RTX3090 Dekode hingga 42,26 tok/s (rata-rata ~39,3) Hermes Resep: Terima kasih
Sudah sampai ujung arsip
Semua qwen38