Saya memiliki dua model lokal terbaik yang membangun pohon terapung yang sama
Glm 5.3 flash pada 320b dan qwen 3.8 flash berikutnya pada 125b, dan meskipun ada perbedaan ukuran, keduanya terlihat mendarat glm 5.3 kilat: 320b moe dengan 18b aktif, bobot nvfp4 nvidia terbagi menjadi 2x dgx spark, disajikan dengan vllm
Qwen 3.8 27B + TensorFold membuat game untuk tantangan Hardball 3D saya dalam waktu 3 jam 14 menit.
Dari ketiga build tersebut, build ini adalah yang paling dapat dimainkan, bahkan lebih banyak daripada build dasar GPT-6 Luna. Dekode · persentil ke-90: 42,37 tok/s Isi awal · rata-rata: 160,55 tok/s Detail jalankan:
Paris Nocturne - oleh Qwen 3.8 Flash Berikutnya pada 3bpw tanpa berpikir loop tanpa istirahat satu tembakan cepat 3 jam bekerja...
This complexity, the thinking process almost same as intelligent with Opus 5.5 or Fable 5.. look at the shading sky, the horizon, the baloon, ferrieswheel, the river, the
[AI News] 5 Oktober 2026 Berita utama pagi hari ・Jalankan Qwen 3.8 Flash Next (125B) pada perangkat keras konsumen (RTX 4090) dengan kecepatan 100T/s
Sudah sampai ujung arsip
Semua qwen38