Saya meminta Qwen3.8 (q4) untuk membuat sesuatu yang menarik.
Inilah yang terjadi sebelum saya kehabisan memori untuk ukuran konteks (49,25 GB untuk 166k). Detail di balasan.
6 bulan yang lalu, model terpintar di dunia hidup di balik paywall di cloud.
Saat ini sesuatu di liga yang sama berjalan di laptop. Gratis. Pada tanggal 14 Agustus, tim Qwen Alibaba menjatuhkan Qwen 3,8-27B. 27 miliar parameter. Kecil menurut standar perbatasan. Tapi tolak ukurnya mereka
Menjalankan 133 tok/dtk dengan QWEN 3.8 27b RTX 4090
Konteks 32K adalah yang dapat ditampung dalam VRAM 24GB Tumpukan HyperInference: • Q4_K_M + pembongkaran GPU penuh • Penguraian kode spekulatif MTP • Perhatian Flash + cache Q8 KV • konteks 32K • Tok langsung Bisa mencoba mendapatkan Konteks 200K dari ini,
Buka kekuatan AI tanpa label harga yang mahal.
Qwen 3.8 menawarkan keunggulan hemat biaya dibandingkan OpenAI & Claude, terutama untuk debugging C++. Pemeliharaan konteks Python unggul dalam pengkodean, sementara perdagangan frekuensi tinggi membutuhkan modal yang besar.
Sudah sampai ujung arsip
Semua qwen38