Saya telah mencoba mencari solusi yang bagus untuk AI lokal.
Saya mencoba menggunakan Qwen 3.8 27B pada M5 Max saya dengan 128GB dan itu bukan pengalaman yang baik. Saya memiliki komputer desktop yang menjalankan Ubuntu dengan 5090 dan sejujurnya pengalaman itu jauh lebih baik, tetapi ini adalah koneksi jarak jauh
Ingin Melihat Kecepatan Maksimum 6 Mesin Virtual Qwen 3.8 27B dengan 2 x 3090 NVLINK dan DFLASH 2
Qwen3.8-27B • 6 agen pengkodean paralel • Total: 8.352 token dalam 10 detik • Agregat: 330,6 tok/dtk puncak · 812,0 tok/dtk berkelanjutan • Per-streaming: 147,8 tinggi / 145,7 rendah / 147,1 rata-rata tok/dtk • TTFT
Qwen 3.8 menghemat $20/bulan untuk Claude.
Yang diperlukan hanyalah peningkatan Mac Studio/DGX Spark senilai $5.000. Sekarang, berapa lama sampai kita mencapai titik impas?
Kebanyakan orang membandingkan Gemini 3.7 Flash vs Qwen 3.8.
Mereka menanyakan pertanyaan yang salah. Pertanyaan sebenarnya: Bagaimana Anda menggabungkannya ke dalam sistem bisnis? → Gemini 3.7 Flash = strategi + perencanaan + orkestrasi. → Qwen 3.8 27B = produksi + penerapan + dapat diulang
Sudah sampai ujung arsip
Semua qwen38