FRAMEWIREEnglishDiperbarui Sep 14Kabel langsung
0:00 / 0:00

Deepseek v4.1 Flash di Macbook 24GB.

Saya rasa saya telah mencapai batas saya, 1,36 tok/s. Ini masih jauh dari dapat digunakan tetapi perasaan memiliki model SOTA di mesin konsumen saya sungguh luar biasa. Saya memulai dari 0,74 tok/s dan hampir dua kali lipatnya. Itu adalah perjalanan yang luar biasa.

Marco FranzonSep 1471
0:00 / 0:00

Saya menggunakan Codex sebagai orkestrator di Herdr, menugaskan implementasi ke DS dan Agy, dan meninjau tanggapannya tanpa izin.

メリ男Sep 14
0:00 / 0:00

Model 510 GB. mesin 128 GB.

Konteks 256k, pikirkan. DeepSeek-V4.1-Flash pada satu DGX Spark, tanpa model yang lebih kecil, tanpa cloud. Caranya: model hanya menggunakan 6 dari 384 pakar per token. Jadi saya memberi tahu kotak tersebut apa yang harus dilakukan dengan baik, dan hanya para ahli yang benar-benar dapat melakukan pekerjaan tersebut…

0xBakeerSep 14117
0:00 / 0:00

Mana yang lebih baik, DeepSeek V4.1 Flash atau GLM 5.3 Flash?

性价比更高? 我做了测试,帮助大家更好决策选哪个模型。

塔斯海TasihiSep 141