FRAMEWIREEnglishDiperbarui Aug 14Kabel langsung
0:00 / 0:00

Ringkasan Mingguan #Kecerdasan Buatan dan

YuriAug 14
0:00 / 0:00

GLM 5.3 baru saja online, jadi saya segera mengujinya. Selama proses tersebut, saya memasangkan Agen berbeda dengan model berbeda.

Perbandingan ini harus sangat jelas, sehingga setiap orang dapat melihat hasil yang berbeda dari proses yang sama. Saya punya beberapa pemikiran: 1. Benar-benar melihat nilai Harness. Tiongkok masih perlu melakukan upaya untuk mengejar ketertinggalan dari agen-agen umum. 2.DeepSeek-V4 Pro dan…

Tino XuAug 141
0:00 / 0:00

Kami menerima GLM-5.3 terlebih dahulu untuk mengevaluasi kemampuan sibernya.

Ini adalah model OSS yang sangat kuat, tepat, dan paling konsisten untuk tugas dunia maya. Berikut hasilnya: - Di pass@3, GLM-5.3 menemukan kembali 75% CVE dalam benchmark kami, 7 poin di atas GPT-5.6-Terra, sekaligus memerlukan biaya

pilvar (Philippe Dourassov)Aug 14154
0:00 / 0:00

Saya membuat plugin DeepSeek Harness yang menggunakan Cairn untuk menghasilkan catatan untuk setiap keluaran

Mengklik catatan akan membawa Anda kembali ke awal percakapan.

Quentin | Solo builderAug 14