Berbicara tentang Benchmaxxing Lokal - inilah mesin Intel i9 64 GB saya yang berusia 2 tahun dengan…
Berbicara tentang Benchmaxxing Lokal - inilah mesin Intel i9 64 GB saya yang berusia 2 tahun dengan Nvidia RTX 4090 yang menjalankan Qwen 3.8 Flash berikutnya dengan kecepatan 30 t/s. Dengan senang hati menggunakan kode terbuka di Macbook Pro saya menggunakan Mesin Intel Lama saya sebagai titik akhir API. Jumlah : AD-3.84bpw-IQ4_XS-M64…
Menemukan titik terbaik antara kualitas dan kecepatan untuk Qwen 3.8 Flash pada 2x3090s @ 3.5bpw, menjalankan beberapa tes
Backend adalah exlllamav3, berjalan cukup baik @ rata-rata sekitar 105 tk/s (92 tk/s prosa/penalaran, 105 tk/s coding dan 120 tk/s pengeditan file) dan 1635 tk/s prefill
Qwen 3.8 Flash Berikutnya di RTX 3060
net58264Sep 21
DeepSeek V4 Flash, Qwen 3.8 27B, GLM 5.2, Nemotron 3 Ultra, Laguna S 2.1, dan Jev untuk perutean agen.
All FREE: OpenRouter: DeepSeek paths, Qwen 3.8 27B, GLM 5.2, Ling 3.0 Flash VL, Laguna S 2.1, Nemotron 3.5 Lightning / 3 Ultra: OpenCode Zen:
Sudah sampai ujung arsip
Semua qwen38