FRAMEWIREEnglishDiperbarui Sep 22Kabel langsung
0:00 / 0:00

Tidak ada judul streaming tunggal saat ini, jadi inilah bagian yang sebenarnya diperdebatkan oleh pembuatnya

Dua kotak menjalankan Gemma 4 12B IT QAT yang sama pada 4-bit, dan spread di antara keduanya adalah 3%. 29 tok/dtk di Strix Halo (Q4_K_XL). 28 tok/dtk di DGX Spark (Q4_K_M). Model yang sama, mesin yang berbeda, dan

Zach ASep 22
0:00 / 0:00

Mendapatkan banyak rasa hormat untuk Zuck belakangan ini.

Muse dan Qwen 3.8 27B sekarang menjadi driver harian. Sangat terkesan dengan perkembangan AI terbaru mereka.

StartupHakkSep 21
0:00 / 0:00

Qwen 3.8 27B melakukan tugas agen dengan subagen pada ~120 tok/s pada M5 Max MacBook Pro di lmstudio Bionic menggunakan mesin inco_ai Splash

Saat diluncurkan lebih dari sebulan yang lalu, model tersebut berjalan sekitar ~20tk/s Sekarang 6x lebih cepat, AI lokal berkembang secepat kilat!

Adrien GrondinSep 21201
0:00 / 0:00

Seperti model sulingan lainnya, Ternary Bonsai 2 27B mewarisi penolakan dan sensor dari model gurunya: Qwen 3.8 27B.

Untungnya, ada cara yang sangat sederhana dan elegan untuk mengurangi atau bahkan menghilangkannya sepenuhnya. 🧵

Private LLMSep 2128