FRAMEWIREEnglishDiperbarui Aug 16Kabel langsung
0:00 / 0:00

Saya meminta Qwen3.8 (q4) untuk membuat sesuatu yang menarik.

Inilah yang terjadi sebelum saya kehabisan memori untuk ukuran konteks (49,25 GB untuk 166k). Detail di balasan.

Florian HerrengtAug 161
0:00 / 0:00

6 bulan yang lalu, model terpintar di dunia hidup di balik paywall di cloud.

Saat ini sesuatu di liga yang sama berjalan di laptop. Gratis. Pada tanggal 14 Agustus, tim Qwen Alibaba menjatuhkan Qwen 3,8-27B. 27 miliar parameter. Kecil menurut standar perbatasan. Tapi tolak ukurnya mereka

Julian Goldie SEOAug 163
0:00 / 0:00

Menjalankan 133 tok/dtk dengan QWEN 3.8 27b RTX 4090

Konteks 32K adalah yang dapat ditampung dalam VRAM 24GB Tumpukan HyperInference: • Q4_K_M + pembongkaran GPU penuh • Penguraian kode spekulatif MTP • Perhatian Flash + cache Q8 KV • konteks 32K • Tok langsung Bisa mencoba mendapatkan Konteks 200K dari ini,

Rob McElvennyAug 161
0:00 / 0:00

Buka kekuatan AI tanpa label harga yang mahal.

Qwen 3.8 menawarkan keunggulan hemat biaya dibandingkan OpenAI & Claude, terutama untuk debugging C++. Pemeliharaan konteks Python unggul dalam pengkodean, sementara perdagangan frekuensi tinggi membutuhkan modal yang besar.

Bryan DowningAug 16