MTP hampir dua kali lipat Qwen 3,8 27B pada 4090 saya.
Itu juga mengisi kartu hingga 112 MB terakhir. Qwen 3.8 dirilis hari ini dengan lapisan draft yang dimasukkan ke dalam beban. Idenya sederhana: kepala kecil yang menempel menebak beberapa token berikutnya, model utama memeriksa semua tebakan menjadi satu
Qwen 3.8:27b (via Ollama) Ini berfungsi dengan baik, tetapi tidak pada kecepatan praktis...lol
LFG! satu tembakan. harness yang diperbarui + qwen 3.8 + minimax-music3 + ltx 2.5.
Full music video. not perfect. not bad.
Selamat pagi. Ini adalah AI edisi pagi tanggal 15 Agustus. ① Alibaba “Qwen 3.8” 27 miliar parameter dirilis dengan Apache 2.0
②GPT-5.6 Sol Ultrafastモード、Cerebras提携で最大750トークン/秒 ③Google、AI生成コンテンツの可視ウォーターマークをオフに 影響度と背景も、動画4分で追いつけます。 (YouTubeリンク)
Sudah sampai ujung arsip
Semua qwen38