Saya menjalankan Qwen 3.8 27B pada satu GPU 8GB.
Cache IQ4_XS + Q4 KV pada konteks 70k. Kecepatan token berkisar sekitar 4-5 t/s. Lambat tapi tetap menakjubkan bahwa Anda bisa mendapatkan hasil yang bahkan bisa mengungguli Claude Opus 4.6 pada beberapa pengujian saya. Semuanya dalam satu kesempatan tanpa perulangan agen.
GLM 5.3 saat ini gratis, dan mencetak angka tertinggi yang pernah tercatat pada benchmark coding independen.
91,25% di Kingbench 3. Mengalahkan Fable 5. Mengalahkan Opus 5. Mengalahkan Kimi K3. Pengguna baru mendapatkannya di tingkat gratis di dalam Zcode. Tidak ada kartu. Tidak ada langganan. 5 juta
Sudah sampai ujung arsip
Semua Claude Opus 5