Tolok ukur model baru tidak lagi menarik bagi saya beberapa waktu lalu.
Angka yang sebenarnya saya inginkan adalah berapa biaya per tugas dan apakah memenuhi standar di sana. Sekarang Claude Opus 5 dan Gemini 3.5 keduanya masuk ke Pusat Komando, gerbang AI kami, dengan harga yang sudah ditentukan; Saya bisa mendapatkan nomor itu
I wanted to see how far Grok 4.6 would take a simple creative prompt.
Same instruction. Opus 5, GPT-5.6 Sol, and Qwen 3.8 Max joined in. Grok turned the banana into a tiny island. The different interpretations were way more interesting than I expected.
Grok 4.6 beats Claude Fable 5, Claude Opus 4.8, Gemini 3.1 Pro, GPT-5.5 and GPT-5.6 Sol on EEBench, an electrical-engineering benchmark.
Membuat game lain dengan Claude's Opus 5, menggunakan fitur Artefak 🤗
Yang ini disebut Monster Maze: Pencarian Nutrisi. Anda melewati labirin menuju tujuan, menyembuhkan penyakit monster khayalan 👻 dengan kapsul, suplemen, dan jus buah 🥤 di sepanjang jalan
Sudah sampai ujung arsip
Semua Claude Opus 5