Terinspirasi oleh perbandingan ini, saya memutuskan untuk melakukan hal yang sama tetapi menggunakan Harness yang berbeda dan Qwen 3.8 27B lokal saya.
Sangat terkejut dengan kemampuan model tersebut dengan begitu sedikit. Dan jelas sekali bahwa tali pengaman sangat penting. Saya pikir droid, opencode, omp dan hermes memberikannya
Ini adalah korsleting dengan qwen 3.8 max Alibaba_Qwen
Inilah Qwen 3.8 27b yang beraksi menggunakan harness DeepSeek.
Ini dihosting sendiri dari fasilitas kami. 55-65 token per detik. Teks menjadi woosh. Ini adalah visi konteks 262k presisi FP16 yang diaktifkan. Kami akan segera menambahkan lebih banyak model bobot terbuka, selanjutnya adalah Qwen 3.8 Flash Next
Saya menguji MCDMA hari ini dan menguji Qwen 3.8 Flash Next pada cluster dual Spark / Mac Studio saya.
Tes pertama saya adalah pra-pengisian terpilah di dua Sparks saya, lalu didekodekan ke Studio saya. PP 2.100 tok/dtk Decode 80 tok/s pada konteks 20k, lebih tinggi pada balasan singkat. Itu
Sudah sampai ujung arsip
Semua qwen38