Claude membuat satu-satunya game yang membuatku peduli pada kucing.
Perintah yang sama. Satu tembakan. Tidak ada perbaikan. Claude Opus 5 xtinggi: ~28 juta · ~170 ribu token · ~$4,60 Qwen 3.8 Maks: ~35m · ~50K · ~$0,60 GPT-5.6 Sol: ~19m · ~22.5K · ~$0.68 Grok 4,6xtinggi: 23:48 · 113K · $0,68 Keempatnya dibuat dapat dimainkan
Inilah perbandingan yang ditunggu-tunggu semua orang, empat model kuat saling berhadapan 👀
1. Qwen 3.8 hadir dengan kuat 2. GLM 5.3 akan mengambil posisi 3. Grok 4.6 mempunyai orang-orang tersendiri yang mengikutinya 4. Gemini 3.7 Tidak mengherankan jika dilarang Apa ekspektasi Anda, siapa yang akan tampil terkuat?
Ox Alpha jelas BUKAN GLM 5.5, sejujurnya ini jauh lebih buruk daripada GLM 5.3
Jalankan saja benchmarknya: Qwen 3.8 27B tersedak. Opus 5 masih bertepuk tangan dengan mudah
Prompt yang sama, empat model.
Dua di antaranya berbobot terbuka. Bisakah Anda membedakan yang mana? Gemini 3.7 Flash, Qwen 3.8, Grok 4.6, GLM 5.3. Satu pengujian bukanlah tolok ukur, namun menunjukkan mengapa model terbuka termasuk dalam campuran tersebut. Papan peringkat memberi Anda daftar pilihan. Perintah Anda sendiri akan memberi tahu Anda mana yang benar-benar cocok.
Sudah sampai ujung arsip
Semua qwen38