API GLM 5.3 baru saja diluncurkan, dan sangat baik dalam menemukan titik lemah dalam kode sehingga pembuatnya menghentikan pengunduhan.
Inilah bagian yang aneh. Ia menggunakan model dasar yang sama persis dengan GLM 5.2. Tidak sedikit pun lebih pintar di balik terpal. Yang mereka lakukan hanyalah lebih banyak pasca pelatihan. Lebih banyak latihan.
Saya menjalankan Qwen 3.8 27B pada satu GPU 8GB.
Cache IQ4_XS + Q4 KV pada konteks 70k. Kecepatan token berkisar sekitar 4-5 t/s. Lambat tapi tetap menakjubkan bahwa Anda bisa mendapatkan hasil yang bahkan bisa mengungguli Claude Opus 4.6 pada beberapa pengujian saya. Semuanya dalam satu kesempatan tanpa perulangan agen.
GLM 5.3 saat ini gratis, dan mencetak angka tertinggi yang pernah tercatat pada benchmark coding independen.
91,25% di Kingbench 3. Mengalahkan Fable 5. Mengalahkan Opus 5. Mengalahkan Kimi K3. Pengguna baru mendapatkannya di tingkat gratis di dalam Zcode. Tidak ada kartu. Tidak ada langganan. 5 juta
Sudah sampai ujung arsip
Semua Claude Opus 5