Qwen 3.8 27B Q4_K_M - 90 token/detik pada satu NVIDIA RTX 4090 (VRAM 24 GB) dengan Dflash2!
(MTP 60 tps -> 90 tps Dflash2!!!!) AI lokal bergerak sangat cepat (secara harfiah!) hingga menakutkan. Z lab baru saja merilis DFlash 2 untuk Qwen 3.8 27b dan Muse Glimmer. Saya menambal llama.cpp (PR #27342) dan
Plug-in Dsh sumber terbuka, Liang Wenfeng vs. Liang Wengu.
YA AMPUN! DeepSeek benar-benar membuat berita palsu, bisakah Anda bayangkan?
Sudah sampai ujung arsip
Semua deepseek