Menjalankan tes segitiga yang sama pada GLM-5.3 baru.
Membandingkannya dengan Claude Opus 5 dan GPT-5.6 Sol.
Opus 5 mengenakan biaya $15 masuk dan $75 keluar per juta.
Grok 4.5 mengenakan biaya $2 dan $6. Itu berarti 12,5X lipat untuk setiap kata yang ditulis agen Anda, dan 91% dari apa yang saya tulis bulan lalu adalah ekstraksi dan pemformatan yang tidak memerlukan jalur $75 ini keseluruhan tagihan, tugas untuk menagih: 1.140 panggilan agen…
Claude Opus 5 saat ini sangat bodoh, sialan.
Claude, pergilah. Saya tahu Anda ingin meningkatkan keuntungan menjelang IPO, tetapi model saat ini buruk. Pada benchmark, Grok 4.6 adalah model yang lebih buruk, namun entah bagaimana ia benar-benar menyelesaikan masalah
Saya menguji Opus 5 Ultra Code vs GPT-5.6 Extra High pada bug Swift yang sebenarnya — hasilnya mengejutkan saya 👀.
Sudah sampai ujung arsip
Semua Claude Opus 5