DeepSeek V4 Pro sudah sangat besar
1,6T total parameter. 49B aktif per token. konteks 1 juta token. Dan ia menggunakan kompresi berbasis token + sedikit perhatian sehingga tidak perlu membaca ulang semuanya terus-menerus. Namun tugas agen yang lama masih bisa melayang.
Deepseek merilis model multi-modal eksperimental, apa efek sebenarnya yang diukur?
我使用完全相同的 Prompt,要求 deepseek-v4-flash-vision-exp 与 gemini-3.7-flash 使用 Three.js 独立构建一个具有完整发光粒子与材质效果的《深海生物发光观察舱》。最终效果见视频。 值得注意的是,相较于gemini-3.7-flash, DeepSeek
Masalah terbesar DeepSeek V4 bukanlah modelnya.
It was the harness. A GitHub dev built JSpace, a wrapper that changes ZERO weights. It just manages how the model works. Same model. Same brain. Scores jumped across every benchmark. → DeepSWE: 62.7 to 72.0 → NL2Repo: 61.5
NVIDIA telah mempermudah pengujian beberapa model AI terkuat di Tiongkok.
Pencarian Mendalam. GLM. Kimi. Mini Maks. Ambil kunci API NVIDIA, sambungkan model yang didukung ke Agen Hermes, dan Anda akan mendapatkan alur kerja AI yang sangat kuat. 🤖 Bangun proyek 🔎 Penelitian
Sudah sampai ujung arsip
Semua deepseek