Pengujian sebenarnya terhadap lebih dari selusin model
最近我在调整 GEO 写作 Skill,连续测试了十几个模型,甚至遇到“博卡、旋钮母题”这种看三遍都很难理解的表达。能力变强,不等于表达更清楚。 按这次实际测试,海外模型里 Claude
Anda dapat menggunakan GPT-5.6 Luna dan DeepSeek V4 Pro secara gratis.
Freebuff memberi Anda akses ke: → DeepSeek V4 Pro - paling cerdas → DeepSeek V4 Flash - cerdas + cepat → GPT-5.6 Luna - serba guna → MiniMax M3 - tercepat → MiMo 2.5 - seimbang → GLM 5.2 - tersedia melalui sesi yang diperoleh dan
Deepseek-4-flash (versi 0731)
Durasi: 1 jam 25 menit Total token: 38,9 juta Pengamatan: Banyak yang terjebak dalam jebakan yang dimiliki prompt (Prompt di bawah) itu sebabnya begitu banyak token tetapi hasilnya dapat diterima
Pengujian abu-abu pada model telah menghilang sejak periode puncak, dan saya menduga memang benar bahwa…
Pengujian model abu-abu telah menghilang sejak periode puncak, dan saya menduga benar bahwa karyawan DeepSeek dapat menggunakan model khusus untuk bekerja (di bawah adalah beberapa contoh kinerja pengujian abu-abu).
Sudah sampai ujung arsip
Semua deepseek