Qwen 3.8 27B sangat kuat.
Saya telah menjalankannya secara lokal di PC saya dan saya harus mengatakan bahwa ini setidaknya sama bagusnya dengan Opus 4.6 max dan saya dapat menjalankannya 100% gratis tanpa batas, batasan, dan sepenuhnya pribadi. AI open source mengejar model SOTA dengan cepat.
Kimi K3, Opus 5, Grok 4.6, Qwen 3.8 27B, GPT 5.6 SOL: Menciptakan Kembali Hantu Tsushima
Saya menempatkan 5 AI satu sama lain untuk melihat mana yang dapat membangun pengalaman tercantik seorang samurai yang menjelajahi pulau kuno Jepang (semuanya ditembak kecuali satu model) Kimi K3 - berlari selama 6+ jam dan
448 GB/dtk dibagi 4,22 GB adalah 106 tok/dtk.
Itu adalah plafon hard decode pada 8GB 3070 saya, dan kemarin saya mengukur 203. Itu tidak curang. Saya pergi dan memeriksa di mana garis itu sebenarnya. LocalMaxxing menandai otomatis setiap pengiriman yang berjalan lebih cepat dari 10x dekode paling dermawan
Saya menguji resep 0xWhiteMage: Qwen3.8-27B Kearuga pada satu DGX Spark.
Salah satu bangunan paling menarik yang saya jalankan tahun ini. Mengapa ini menarik Sebagian besar pekerjaan kuantitas adalah rekayasa kompresi: mengecilkan model, menjaganya tetap cepat, menerima kerugian. Kearuga menangani masalah yang sama seperti
Sudah sampai ujung arsip
Semua qwen38