Qwen 3.8 Max KURSUS Penuh 1 JAM (Membangun & Mengotomatiskan Apa Pun)
Qwen 3.8 Flash Next dengan llama.cpp di Macbook M5 24 GB.
3/4 tok/dtk - alasan tidak masuk akal - konteks 2k Dengan angka tersebut sudah pasti tidak bisa digunakan apalagi untuk tahap prefilling. Dalam konteks yang lebih luas, hal ini akan memakan waktu berjam-jam. Saya rasa saya juga mencapai batasnya dengan model ini.
Qwen 3.8 Flash Next hadir di MacBook saya.
Itulah suara AI lokal ketika Anda mencoba memaksakan salah satu model AI terbaik untuk dipasang pada mesin kecil dengan RAM 24 GB
Hari ini saya menerapkan versi kuantitatif Qwen 3.8 27b secara lokal.
Apa pendapat Anda tentang kecepatan ini? Bisakah itu digunakan? 😂
Sudah sampai ujung arsip
Semua qwen38