SAYA MEMAKSIMALKAN kemampuan TUNGGAL 3090 dan mampu menghasilkan 90-100 tok/s dengan Qwen 3.8 27b bahkan dengan jendela konteks besar 196k.
Kuantitas IQ4 - sangat cerdas, dan BUKAN nuklir! Kernel khusus dan llama.cpp ftw!!
Saya menyambungkan API Qwen-3.8-Max-0902 langsung ke alur kerja pengkodean saya.
Jangan khawatir... Tidak ada pengaturan yang mewah. Karena Anda dapat menggunakannya dengan Agen Pengodean AI apa pun Ini pengaturan saya 👇 Kode VS + Cline + Qwen. Karena saya sudah menggunakan VS Code dari awal 😅 Saya memberinya tugas pengkodean yang nyata…
Anda dapat menjalankan Qwen 3.8 Max milik Alibaba secara gratis, selamanya.
🤯 Dengan 2,4 triliun parameter dan jendela konteks 1 juta token, ini adalah salah satu model AI paling kuat di dunia. Tidak perlu kartu kredit - cukup masuk dan mulai membangun. Perhatikan cara mengakses dan menggunakannya
Baru saja mengirimkan model terbaik yang dapat Anda jalankan pada satu DGX Spark dan hasilnya mengesankan.
Qwen 3.8 Flash-Berikutnya, NVFP4, satu GB10, 128GB. Saya mengukurnya hari ini. Saya membandingkan 1 DGX Spark vs 2 DGX Spark pada model ini jadi Anda tidak perlu melakukannya. Aliran tunggal 27,3 tok/dtk
Sudah sampai ujung arsip
Semua qwen38