FRAMEWIREEnglishDiperbarui Aug 15Kabel langsung
0:00 / 0:00

Model yang tidak dibicarakan siapa pun baru saja menutup celah pada Claude.

Itu terjadi dengan tenang pada tanggal 12 Agustus, dan kebanyakan orang tertidur pada saat itu. 😳 DeepSeek V4 Pro vs Claude Fable 5: → Terminal Bench 2.1: 87.9 vs 88.0 (pada dasarnya seri) → AutomationBench: 31,8 vs 29,1 (DeepSeek menang) →

Julian Goldie SEOAug 154
0:00 / 0:00

Deepseek Harness masih segar dan baru tapi saya punya harapan besar!

Hatsu 🧪Aug 152
0:00 / 0:00

Flash Deepseek V4 baru saja mengalahkan model pro miliknya di seluruh 9 tolok ukur agen.

Dan peningkatan terbesar datang tanpa menambahkan lebih banyak parameter. Apa yang berubah: → DeepSWE melonjak dari 7,3 menjadi 54,4 setelah pelatihan ulang → Terminal Bench 2.1: Flash mendapat skor 82,7 vs Pro di 72,1 → Sama

Julian Goldie SEOAug 15
0:00 / 0:00

Kimi K3 semakin konyol di generasi 3D.

Dibandingkan dengan Gemini 3.7, Grok 4.6, DeepSeek V4, dan GPT-5.6; Kimi K3 lebih murah. Satu prompt berubah menjadi gudang senjata militer lengkap dengan alat peraga terperinci, rak senjata, monitor animasi, dan pencahayaan dinamis.

FHILY👑Aug 154