GPT-6.1 Sol OpenAI mengklaim skor mendekati Astra dengan harga 1/5.
π DeepSWE 75,2% (Astra 74,8%) π₯οΈ OSWorld 71,4% dengan biaya ~1/7 π° $5,47/tugas vs ~$23 (Astra, Opus 5.5) β Kehilangan AutomationBench karena Claude Sonnet 5.5 Tangkapan: evaluasi OpenAI sendiri. DeepSWE Independen: 71,9%. Juga sebuah
OpenAI membatalkan model barunya yang paling kuat sehari sebelum DevDay.
Then shipped GPT-6.1 Sol instead: β Near-Astra performance at 1/5 the price β Matches Astra on real-world coding β Beats Claude Opus 5.5 on complex PDFs β ~$5 per science task vs $23+ Safety over speed, or
Sudah sampai ujung arsip
Semua Claude Opus 5