3/ Apa yang diukur oleh penguji awal, seperti dikutip oleh Anthropic.
Base44, 118 build aplikasi: 3,6 iterasi per build. Opus 5 mengambil 7,7 - Balyasny, 2.441 tugas keuangan: sekitar 121 ribu token per jawaban. Soneta 5 menggunakan 497K - Kotak: 2,4x lebih cepat dari Sonnet 5, token 12% lebih sedikit - Zendesk: dukungan
2/ Harga sama dengan Soneta 5.
Lebih sedikit per tugas. - $2 per juta token masukan, $10 keluaran, $0,20 pembacaan cache - Opus 5.5 berharga $4 dan $20 - Antropis: hingga 30% lebih sedikit per tugas dibandingkan Soneta 5, karena menggunakan lebih sedikit token - 30%+ keluaran lebih cepat - Pada upaya sedang, ini mengalahkan yang terbaik Soneta 5…
1/ Skornya, dari halaman Anthropic sendiri.
Soneta 5.5 melawan Opus 5.5. - Pengkodean terminal: 70,6% hingga 66,4% - CursorBench: 55,5% hingga 57,8% - Penggunaan komputer: 80,1% hingga 81,8% - Karya pengetahuan, GDPval-AA: 1844 hingga 1846. GPT-6 Sol: 1487 - Membaca grafik: 61,6% hingga 64,4%. Soneta 5 mencetak gol…
Claude Sonnet 5.5 sudah keluar.
Harganya sama dengan GPT-6 Sol dan setengah dari Opus 5.5. Pada tes pengkodean terminal Anthropic, skornya 70,6%. Opus 5.5 mendapat skor 66,4%. Soneta 5 mencetak 10,3%. Kamis saya menelepon Sol sebagai kesepakatan yang lebih baik. Ia memiliki penantang dengan harga yang sama.
Sudah sampai ujung arsip
Semua Claude Opus 5