Tidak ada judul streaming tunggal saat ini, jadi inilah bagian yang sebenarnya diperdebatkan oleh pembuatnya
Dua kotak menjalankan Gemma 4 12B IT QAT yang sama pada 4-bit, dan spread di antara keduanya adalah 3%. 29 tok/dtk di Strix Halo (Q4_K_XL). 28 tok/dtk di DGX Spark (Q4_K_M). Model yang sama, mesin yang berbeda, dan
Mendapatkan banyak rasa hormat untuk Zuck belakangan ini.
Muse dan Qwen 3.8 27B sekarang menjadi driver harian. Sangat terkesan dengan perkembangan AI terbaru mereka.
Qwen 3.8 27B melakukan tugas agen dengan subagen pada ~120 tok/s pada M5 Max MacBook Pro di lmstudio Bionic menggunakan mesin inco_ai Splash
Saat diluncurkan lebih dari sebulan yang lalu, model tersebut berjalan sekitar ~20tk/s Sekarang 6x lebih cepat, AI lokal berkembang secepat kilat!
Seperti model sulingan lainnya, Ternary Bonsai 2 27B mewarisi penolakan dan sensor dari model gurunya: Qwen 3.8 27B.
Untungnya, ada cara yang sangat sederhana dan elegan untuk mengurangi atau bahkan menghilangkannya sepenuhnya. 🧵
Sudah sampai ujung arsip
Semua qwen38