Menemukan titik terbaik antara kualitas dan kecepatan untuk Qwen 3.8 Flash pada 2x3090s @ 3.5bpw, menjalankan beberapa tes
Backend adalah exlllamav3, berjalan cukup baik @ rata-rata sekitar 105 tk/s (92 tk/s prosa/penalaran, 105 tk/s coding dan 120 tk/s pengeditan file) dan 1635 tk/s prefill
Qwen 3.8 Flash Berikutnya di RTX 3060
net58264Sep 21
DeepSeek V4 Flash, Qwen 3.8 27B, GLM 5.2, Nemotron 3 Ultra, Laguna S 2.1, dan Jev untuk perutean agen.
All FREE: OpenRouter: DeepSeek paths, Qwen 3.8 27B, GLM 5.2, Ling 3.0 Flash VL, Laguna S 2.1, Nemotron 3.5 Lightning / 3 Ultra: OpenCode Zen:
Qwen 3.8 Max KURSUS Penuh 1 JAM (Membangun & Mengotomatiskan Apa Pun)
Want the SOP? DM me. 💬
Sudah sampai ujung arsip
Semua qwen38