Pembaruan: Saya sekarang telah mengirimkan 5 MILYAR token melalui DeepSeek V4.1 Flash.
Saya masih belum perlu menggunakan Astra atau Fable karena DeepSeek tidak dapat menangani suatu tugas. Saya menggunakan Hermes dengan tiga kunci API di CommandCodeAI, ollama, dan opencode. Pengaturan super sederhana, dan
Saya menggunakan GLM 5.3-Flash pada dua mesin yang kompatibel dengan DGX Spark (September 2026).
Untuk tujuan saya, di mana prosa lebih penting daripada coding, model ini mungkin lebih cocok daripada flash DeepSeek v4. DeepSeek Hermes
Flash DeepSeek V4.1: EXL3 2.9bpw, TP2, 2 DGX Sparks ❌
Total waktu: 9 menit 46 detik (8 menit 47 detik berpikir) - Output: 24.883 token — 22.025 alasan + 2.858 terlihat - Kecepatan : 42,4 tok/s - Mesh: 54 tabung (harus 30), 843 simpul sangkar di dalam benda padat, penetrasi hingga 0,17 - Ini
DeepSeek-v4.1 TP4 vs GLM-5.3-Flash Blender Pertempuran
Dodecahedron terperangkap di dalam dodecahedron. Satu kesempatan, pikirkan lagi, suhu 0,6, tanpa batas token, tanpa percobaan ulang. Skrip berjalan tanpa kepala di Blender 5.2. Saya memeriksa jala secara mandiri. Flash DeepSeek V4.1: FP8, vLLM TP4, 4 Percikan DGX •
Sudah sampai ujung arsip
Semua deepseek