DeepSeek V4 Flash berhasil berjalan secara lokal di AMD Strix Halo (Ryzen AI Max+ 395/128GB)
UI chatnya sekitar 15 t/s, dan saat saya ngobrol butuh waktu lebih dari satu menit (👇 bagian itu terpotong di video) Agen Atom Ringan saat menggunakan agen
Dalam pengujian sebenarnya, GLM-5.3 mengungguli DeepSeek V4 Pro.
Dalam pengujian sebenarnya, GLM-5.3 mengungguli DeepSeek V4 Pro. Model GLM generasi ini memiliki kemampuan yang sangat unik dan sangat layak untuk digunakan. Rasanya setiap pabrik model mulai menemukan jalur uniknya sendiri.
DeepSeek-SSD ada di GitHub
Mesin streaming SSD untuk menjalankan DeepSeek V4 Flash di Windows
Apakah DeepSeek V4 Pro dibatalkan? Banyak orang mulai mengutuk.
Namun ketika saya membaca laporan teknis DeepSeek hari ini, saya menemukan mengapa memori video tidak meledak ketika 1 juta token dimasukkan ke dalam konteksnya. Laporan ini memiliki total 58 halaman, dan saya hanya fokus pada dua angka: jumlah perhitungan inferensi token tunggal dan cache KV. Ketika V4 Pro memiliki 1 juta token, jumlah penghitungan inferensi token tunggal adalah sekitar 27% dari V3, KV…
Sudah sampai ujung arsip
Semua deepseek