Saya mendapat peningkatan 20% dalam token/detik dengan Qwen 3.8 Flash Next.
Caviat itu garpu khusus saya. Saya menambahkan dukungan mtp tetapi saya mencoba meningkatkan vanilla terlebih dahulu.
Qwen 3.8 27B
Berpikir vs Kode Ada yang bilang model ini banyak mikir... 🤣
Qwen 3.8 27B berjalan secara lokal pada RTX 5090 mengalahkan Opus 4.8 dalam benchmark pribadi hingga 200 token…
Qwen 3.8 27B berjalan secara lokal pada RTX 5090 mengalahkan Opus 4.8 dalam tolok ukur pribadi hingga 200 token per detik tanpa memerlukan internet, berlangganan, atau API dan sekarang mendukung agen Hermes yang bekerja 24/7 secara gratis.
Ini adalah hasil Flash Next Qwen 3.8 lokal pertama saya.
Saya kecewa mengetahui bahwa rilis terkini yang dapat berjalan di Mac saya tidak memiliki vision sehingga gambar saya akhirnya dibuang ke SVG yang hampir tidak pernah saya sukai. Menggunakan kuantitas ini: 25.3
Sudah sampai ujung arsip
Semua qwen38