FRAMEWIREEnglishDiperbarui Sep 16Kabel langsung
0:00 / 0:00

Inilah Qwen 3.8 27b yang beraksi menggunakan harness DeepSeek.

Ini dihosting sendiri dari fasilitas kami. 55-65 token per detik. Teks menjadi woosh. Ini adalah visi konteks 262k presisi FP16 yang diaktifkan. Kami akan segera menambahkan lebih banyak model bobot terbuka, selanjutnya adalah Qwen 3.8 Flash Next

QtumSep 153
0:00 / 0:00

Saya menguji MCDMA hari ini dan menguji Qwen 3.8 Flash Next pada cluster dual Spark / Mac Studio saya.

Tes pertama saya adalah pra-pengisian terpilah di dua Sparks saya, lalu didekodekan ke Studio saya. PP 2.100 tok/dtk Decode 80 tok/s pada konteks 20k, lebih tinggi pada balasan singkat. Itu

Ash HartSep 1556
0:00 / 0:00

Ini adalah operasi sebenarnya dari Qwen-3.8-Flash-Next yang berjalan di DGX Spark dengan dukungan MTP + konfigurasi langsung llama.cpp.

Apa yang saya ingin Anda lihat dalam video ini bukanlah kecepatan pembuatannya sendiri, namun kecepatan dari saat tugas dilemparkan hingga tugas tersebut mulai dipindahkan. Setelah Anda mengirimkannya, Penalaran masuk ke Penalaran tanpa perlu menunggu, dan teks langsung mengalir.

Nobu-Kobayashi : Generative AI TechnologySep 1520
0:00 / 0:00

Menguji qwen 3.8 27B pada cerebras melakukan wiki speedrun dengan ego lite

Penalaran tinggi: 4 klik, 20,9 detik tanpa alasan: 10 klik, 15,8 detik + gagal menang sekali orang idiot yang bergerak akan melangkah lebih jauh daripada orang jenius yang diam

AugustSep 155