FRAMEWIREEnglishDiperbarui Sep 15Kabel langsung
0:00 / 0:00

Qwen 3.8 Flash Next dengan llama.cpp di Macbook M5 24 GB.

3/4 tok/dtk - alasan tidak masuk akal - konteks 2k Dengan angka tersebut sudah pasti tidak bisa digunakan apalagi untuk tahap prefilling. Dalam konteks yang lebih luas, hal ini akan memakan waktu berjam-jam. Saya rasa saya juga mencapai batasnya dengan model ini.

Marco FranzonSep 1517
0:00 / 0:00

Qwen 3.8 Flash Next hadir di MacBook saya.

Itulah suara AI lokal ketika Anda mencoba memaksakan salah satu model AI terbaik untuk dipasang pada mesin kecil dengan RAM 24 GB

Marco FranzonSep 1521
0:00 / 0:00

Hari ini saya menerapkan versi kuantitatif Qwen 3.8 27b secara lokal.

Apa pendapat Anda tentang kecepatan ini? Bisakah itu digunakan? 😂

王小波Sep 1522
0:00 / 0:00

PERPLEXITY: Komputer Portabel sekarang berjalan di Windows, agen dan model bekerja secara lokal pada kartu RTX-nya sendiri.

Prasyaratnya adalah VRAM 24 GB, PPLX 27B menghitung secara lokal berdasarkan Qwen 3.8 27B. Ada juga server MCP lokal dan tugas terjadwal. Siapa data klien sejauh ini

KI BubbleSep 154