FRAMEWIREEnglishDiperbarui Sep 4Kabel langsung
0:00 / 0:00

Model yang sama. Tolok ukur yang sama.

Hari yang sama. Skornya melonjak dari 62,7% menjadi 99,9% — dan modelnya tidak berubah. GPT-6 Astra baru saja menyelesaikan ARC-AGI-3, dan semua orang memuji modelnya. Kisah sebenarnya adalah memanfaatkan di sekitarnya. 5:50 – garis dasar: GPT-5.5 <1%, GPT-5.6 Sol 7.8%,…

NikSep 41
0:00 / 0:00

Perbandingan Flash Gemini 3.8 dengan ChatGPT SOL, Opus 5 dan Kimi K3

Dalam pengujian ini, Gemini 3.8 Flash tidak bekerja dengan baik dalam produksi konten 3D. Model ini memberikan keluaran yang sangat lemah dalam waktu sekitar 2 menit; Menariknya, dalam Goal Mode, pelaksanaan tugas yang sama memakan waktu sekitar 30 menit

ProductCastXSep 4
0:00 / 0:00

Claude Opus 5 GILA

Lihat apa yang baru saja saya buat.

Dzianis KravchuSep 4
0:00 / 0:00

Kami membandingkan model teratas pada tugas pengkodean kami sendiri.

Hasilnya: - GPT 5.6 Sol (tinggi) menang dalam hal kinerja - Grok 4.6 (tinggi) menjadi runner-up - GLM 5.3 Flash menang dalam hal biaya dengan kualitas yang sebanding Semuanya 50%+ lebih murah dari default kami sebelumnya (Opus 5)

Zach LloydSep 458