FRAMEWIREEnglishDiperbarui Aug 30Kabel langsung
0:00 / 0:00

Saya menggunakan qwen 3.8 q8. Saya telah menggunakan dua 3090 dan konteks 260k. Kecepatannya terasa cukup bagus.

biantaishabi5Aug 307
0:00 / 0:00

Minggu yang gila di AI!

🚀 Sapi Alfa GLM 5.3 Qwen 3.8 Flash Berikutnya Tencent Hy4 Minimax CepatH3 Game Humanoid Dunia Gemini 3.5 Transkrip Gemini Omni 1.1 Flash Blokir 3D Satu Video Satu Dunia Perbaiki Apa Pun Google APD Model Dunia Kode Mem Suara Orbit++ DifusiOPSD &

AI SearchAug 3034
0:00 / 0:00

Model di bawahnya adalah Qwen 3.8 Max.

Alibaba mengatakan mereka memiliki: 2,4T total parameter ~95B parameter aktif per tugas konteks 1 juta token Idenya sederhana: Kapasitas model yang besar tanpa mengaktifkan seluruh model untuk setiap pekerjaan.

Julian Goldie SEOAug 30
0:00 / 0:00

Flash Qwen 3.8 selanjutnya dibuat berbeda.

parameter 125B. Hanya 6 miliar yang aktif per token. Dan Alibaba mengatakan mereka berlatih dengan biaya sekitar 1/10 dari biaya andalan mereka sebelumnya. Arsitektur: → 125 miliar parameter utama dengan hanya 6 miliar yang diaktifkan per token → Parameter 51B lainnya melalui Engram…

Julian Goldie SEOAug 30