FRAMEWIREEnglishDiperbarui Sep 22Kabel langsung
0:00 / 0:00

Kami menjalankan Gemini 3.7 Flash, Gemini 3.8 Flash

Kami menjalankan Gemini 3.7 Flash, Gemini 3.8 Flash, dan Qwen3.8-27B yang dihosting sendiri melalui pipeline QA video ground yang sama pada 300 pertanyaan Tes Persepsi. Gemini menang secara menyeluruh, Qwen mendapatkan 84% HOTA-nya. Pengungkit terbesar bukanlah modelnya sama sekali. Penulisan:

Anton SlesarevSep 22
0:00 / 0:00

Qwen 3.8 27b melalui Server Tesseract

Sungguh model fenomenal yang bisa dijalankan di Mac

SpokSep 22
0:00 / 0:00

Cobalah cache-to-cache di sini

SATU Percikan DGX Bekerja dengan resep MiaAI_lab dari flash Qwen 3.8 berikutnya, tetapi Anda dapat menggunakan model apa pun Tes sederhana esai tentang makalah penelitian:

droveSep 22
0:00 / 0:00

Tidak ada judul streaming tunggal saat ini, jadi inilah bagian yang sebenarnya diperdebatkan oleh pembuatnya

Dua kotak menjalankan Gemma 4 12B IT QAT yang sama pada 4-bit, dan spread di antara keduanya adalah 3%. 29 tok/dtk di Strix Halo (Q4_K_XL). 28 tok/dtk di DGX Spark (Q4_K_M). Model yang sama, mesin yang berbeda, dan

Zach ASep 22