FRAMEWIREEnglishDiperbarui Sep 2Kabel langsung
0:00 / 0:00

Baru saja menjatuhkan MTP untuk Qwen 3.7 Flash Next (125B A6B)!

25 token/detik pada satu RTX 4090! Saya mengambil pengaturan 125B (6B aktif) dari bawah, menyambungkan drafter MTP Q8_0 bersama yang baru, dan mendorong throughput dekode ke 25,35 token/detik pada jendela konteks 80k dalam satu

AlokSep 212
0:00 / 0:00

Jadi aku sudah membenturkan kepalaku melawan ini sepanjang hari

Qwen 3.8 Flash Next Q8 Inferensi aktif GGUF GPU tidak akan merusak pemanfaatan 200W terlihat malas sekali meminta Fable 5.1 menjalankan penelitian otomatis selama 8+ jam untuk membuat seluruh resep khusus dari awal dan saya MASIH belum memaksimalkan kartu-kartu ini adalah…

0xNeoArchSep 21
0:00 / 0:00

Qwen 3.8 27B cukup mengagumkan

Jadi saya pikir saya akan membagikan pemikiran saya tentang model lokal dan kekuatan yang Anda dapatkan dengan memasangkannya dengan tali pengaman di lingkungan Anda sendiri.

Billy Boozer 🇺🇸/accSep 24
0:00 / 0:00

Qwen 3.8 Max KURSUS Penuh 1 JAM (Membangun & Mengotomatiskan Apa Pun)

Julian Goldie SEOSep 21