Deepseek v4.1 Flash di Macbook 24GB.
Saya rasa saya telah mencapai batas saya, 1,36 tok/s. Ini masih jauh dari dapat digunakan tetapi perasaan memiliki model SOTA di mesin konsumen saya sungguh luar biasa. Saya memulai dari 0,74 tok/s dan hampir dua kali lipatnya. Itu adalah perjalanan yang luar biasa.
Saya menggunakan Codex sebagai orkestrator di Herdr, menugaskan implementasi ke DS dan Agy, dan meninjau tanggapannya tanpa izin.
Model 510 GB. mesin 128 GB.
Konteks 256k, pikirkan. DeepSeek-V4.1-Flash pada satu DGX Spark, tanpa model yang lebih kecil, tanpa cloud. Caranya: model hanya menggunakan 6 dari 384 pakar per token. Jadi saya memberi tahu kotak tersebut apa yang harus dilakukan dengan baik, dan hanya para ahli yang benar-benar dapat melakukan pekerjaan tersebut…
Mana yang lebih baik, DeepSeek V4.1 Flash atau GLM 5.3 Flash?
性价比更高? 我做了测试,帮助大家更好决策选哪个模型。
Sudah sampai ujung arsip
Semua deepseek