Saya masih belum bisa melupakan seberapa dekat qwen 3.8 125b mendarat dengan glm 5.3 flash 320b yang membangun pohon terapung yang sama.
Jadi perhatikan! di sini adalah setiap nomor dari kedua proses di satu tempat, termasuk pengaturan penyajian, simpan jika Anda memilih model lokal untuk pembuatan agen glm 5.3 flash
Saya memiliki dua model lokal terbaik yang membangun pohon terapung yang sama
Glm 5.3 flash pada 320b dan qwen 3.8 flash berikutnya pada 125b, dan meskipun ada perbedaan ukuran, keduanya terlihat mendarat glm 5.3 kilat: 320b moe dengan 18b aktif, bobot nvfp4 nvidia terbagi menjadi 2x dgx spark, disajikan dengan vllm
Qwen 3.8 27B + TensorFold membuat game untuk tantangan Hardball 3D saya dalam waktu 3 jam 14 menit.
Dari ketiga build tersebut, build ini adalah yang paling dapat dimainkan, bahkan lebih banyak daripada build dasar GPT-6 Luna. Dekode · persentil ke-90: 42,37 tok/s Isi awal · rata-rata: 160,55 tok/s Detail jalankan:
Paris Nocturne - oleh Qwen 3.8 Flash Berikutnya pada 3bpw tanpa berpikir loop tanpa istirahat satu tembakan cepat 3 jam bekerja...
This complexity, the thinking process almost same as intelligent with Opus 5.5 or Fable 5.. look at the shading sky, the horizon, the baloon, ferrieswheel, the river, the
Sudah sampai ujung arsip
Semua qwen38