Saya harus menarik kembali apa yang saya posting sebagai kecepatan tercepat Qwen 3.8 Flash pada satu DGX Spark.
Cruz mengirimkan garpu ExLlamaV3 khusus dan jalur mesin asli. Saya menjalankan model yang sama pada Spark yang sama: maks 102,6, kode 80 tok/dtk, prosa 70 tok/dtk. Patokan saya sebelumnya dan
Ada banyak hype tentang Ternary Bonsai2 tetapi tidak ada demonstrasi tentang bagaimana sebenarnya dibandingkan dengan Qwen 3.8 27B versi 16 bit penuh.
Karena saya memiliki versi terkuantisasi model yang saya uji, ukuran file ~12gb, saya memutuskan untuk memasukkan Bonsai2 ke sana juga untuk mendapatkan
Sekarang saya menguji perbedaan antara Qwen 3.8 27B lokal vs GLM 5.3 keduanya di Droid
Ada perbedaan dalam kualitas dan kemampuan mengikuti gambar serta memperhatikan detail lebih dekat. Jelas sekali bahwa GLM 5.3 lebih unggul dalam hal kualitas, meskipun butuh waktu lebih lama untuk membangun gamenya.
Qwen 3.8 Omni Flash dapat MENONTON video Anda, tidak hanya membaca transkripnya.
That means AI can finally understand what was said AND what happened on screen at the same time. Here’s how I’d test it: → Open the Qwen chat app. → Pick Qwen 3.8 Omni Flash. → Upload a video. →
Sudah sampai ujung arsip
Semua qwen38