Saya menguji MCDMA hari ini dan menguji Qwen 3.8 Flash Next pada cluster dual Spark / Mac Studio saya.
Tes pertama saya adalah pra-pengisian terpilah di dua Sparks saya, lalu didekodekan ke Studio saya. PP 2.100 tok/dtk Decode 80 tok/s pada konteks 20k, lebih tinggi pada balasan singkat. Itu
Ini adalah operasi sebenarnya dari Qwen-3.8-Flash-Next yang berjalan di DGX Spark dengan dukungan MTP + konfigurasi langsung llama.cpp.
Apa yang saya ingin Anda lihat dalam video ini bukanlah kecepatan pembuatannya sendiri, namun kecepatan dari saat tugas dilemparkan hingga tugas tersebut mulai dipindahkan. Setelah Anda mengirimkannya, Penalaran masuk ke Penalaran tanpa perlu menunggu, dan teks langsung mengalir.
Menguji qwen 3.8 27B pada cerebras melakukan wiki speedrun dengan ego lite
Penalaran tinggi: 4 klik, 20,9 detik tanpa alasan: 10 klik, 15,8 detik + gagal menang sekali orang idiot yang bergerak akan melangkah lebih jauh daripada orang jenius yang diam
MiniMax H3, DaVinci Resolve, dan Qwen 3.8 27B untuk animasi “Words” bergaya.
Bagian yang menarik bukan hanya tampilannya—tetapi seberapa cepat tumpukan alat kecil dapat mengubah ide yang tidak masuk akal menjadi rangkaian yang lengkap.
Sudah sampai ujung arsip
Semua qwen38