Versi Qwen3.8-27B tanpa sensor pada 5090
Saya ingin menjalankannya di NVFP4 dengan konteks 200K. Pra-pengisiannya tampak cepat dan mudah digunakan. Tidak ada yang siap, jadi saya memanggangnya sendiri. ▫️ 2 tipe dalam versi NVFP4 Semua 4 bit, MLP adalah 4 bit dan lapisan perhatian dan keluaran adalah 8 bit.
Qwen 3.8 max baru saja mengalahkan GPT-5.6 sol max dalam penggunaan komputer.
Dan tolok ukurnya bukanlah bagian yang paling menarik. Angka-angka: → 2,4 triliun parameter model Mixture-of-Experts → Hanya ~95B parameter yang diaktifkan per token → Jendela konteks 1 juta token di seluruh teks,
Mendesain dengan Qwen 3.8 27B, saya sedikit terkejut.
Ini masalah besar. Desain one-shot ini sedikit berbeda dari Opus, masih ada nuansa yang sejujurnya, tapi sangat mirip. Sekali cerebra menjalankan model ini ke utara 1000 tps 👉we
Qwen 3.8 27b membangun kembali fisika air dengan keterampilan analisis video.
Itu masih berjalan juga. Ini adalah hasil antara lainnya. Tidak nyata!
Sudah sampai ujung arsip
Semua qwen38