Qwen 3.8 27B (padat) berjalan pada satu RTX 4090 (VRAM 24GB) dengan kecepatan 65 token/detik decode dengan MTP!
260.000 jendela konteks atau 65 token/detik dekode dengan MTP asli. Kartel API seharusnya ketakutan. Kami secara resmi menjalankan AI agen tingkat depan (tolok ukur yang sebanding dengan
Qwen 3.6-27B 14x lebih kecil dari produk andalan Alibaba dan MENGALAHKANnya dalam coding.
Model 27B mengungguli model 397B. Dan itu berjalan di komputer Anda sendiri. 🤯 Angka-angka: → 77,2% di bangku SWE. Ini memperbaiki GitHub yang sebenarnya
Qwen 3.8 Max mendapat diskon 50% di Venesia untuk waktu terbatas, bekerja sama dengan Alibaba_Qwen.
Qwen 3.8 27b (keluaran melalui obrolan Lmstudio)
Singleton Dari 'Tolong buatkan game dinosaurus Google.' Video yang dihasilkan. Keuntungan: Performa luar biasa yang tidak terlihat pada model yang lebih kecil dari 30B lokal. Kerugian: Gelembung inferensi sangat besar dan mengakibatkan peningkatan waktu pengoperasian. (Token 61408 digunakan, 37,9Tok/dtk: 3090, 21 menit 29 detik) Alibaba_Qwen QwenDevs…
Sudah sampai ujung arsip
Semua qwen38