Model MoE 125B Mencapai 25 token/detik pada satu RTX 4090 di rumah.
Qwen 3.8 Flash Next + decoding spekulatif MTP di - konteks 80k. - Dekode 25,35 t/dtk - 471 t/dtk pengisian awal Menjalankan model Mixture-of-Experts 125B pada satu GPU konsumen
Butuh waktu 15 menit untuk membuatnya dengan Qwen 3.8 27B yang berjalan secara lokal di Laptop RTX saya dan disajikan ke Macbook saya.
Selamat datang di Dunia Nyata, MATRIKS!!!
Gemini 3.8 Flash membuat tiruan Minecraft.
Itu kotor. Saya menjalankan tes yang sama dengan yang saya jalankan pada setiap model. Satu kesempatan, satu perintah: buat klon Minecraft dalam satu file HTML. Ini sebenarnya terlihat cukup bagus pada awalnya. Teksturnya padat dan menambahkan banyak hal yang tidak saya minta,…
Gemini 3.7 Flash Tinggi vs Claude Opus 5 Tinggi vs Grok 4.6 Tinggi vs Qwen 3.8 27B
Sudah sampai ujung arsip
Semua qwen38