MoE baru untuk 3060 12GB hari ini?
Jatuhkan sekarang.Qwen3.8-35B-A3B masih no. 3.8 memberikan 27B padat + Flash-Berikutnya 125B-A6B. A3B kecil hilang. Komit ModelScope mengatakan mungkin bersembunyi di gua. Sampai saat itu Qwen3.6-35B-A3B masih menjadi raja 12GB. Alibaba_Qwen
Saya menggunakan qwen 3.8 q8. Saya telah menggunakan dua 3090 dan konteks 260k. Kecepatannya terasa cukup bagus.
Minggu yang gila di AI!
🚀 Sapi Alfa GLM 5.3 Qwen 3.8 Flash Berikutnya Tencent Hy4 Minimax CepatH3 Game Humanoid Dunia Gemini 3.5 Transkrip Gemini Omni 1.1 Flash Blokir 3D Satu Video Satu Dunia Perbaiki Apa Pun Google APD Model Dunia Kode Mem Suara Orbit++ DifusiOPSD &
Model di bawahnya adalah Qwen 3.8 Max.
Alibaba mengatakan mereka memiliki: 2,4T total parameter ~95B parameter aktif per tugas konteks 1 juta token Idenya sederhana: Kapasitas model yang besar tanpa mengaktifkan seluruh model untuk setiap pekerjaan.
Sudah sampai ujung arsip
Semua qwen38