Kimi K3, Opus 5, Grok 4.6, Qwen 3.8 27B, GPT 5.6 SOL: Menciptakan Kembali Hantu Tsushima
Saya menempatkan 5 AI satu sama lain untuk melihat mana yang dapat membangun pengalaman tercantik seorang samurai yang menjelajahi pulau kuno Jepang (semuanya ditembak kecuali satu model) Kimi K3 - berlari selama 6+ jam dan
448 GB/dtk dibagi 4,22 GB adalah 106 tok/dtk.
Itu adalah plafon hard decode pada 8GB 3070 saya, dan kemarin saya mengukur 203. Itu tidak curang. Saya pergi dan memeriksa di mana garis itu sebenarnya. LocalMaxxing menandai otomatis setiap pengiriman yang berjalan lebih cepat dari 10x dekode paling dermawan
Saya menguji resep 0xWhiteMage: Qwen3.8-27B Kearuga pada satu DGX Spark.
Salah satu bangunan paling menarik yang saya jalankan tahun ini. Mengapa ini menarik Sebagian besar pekerjaan kuantitas adalah rekayasa kompresi: mengecilkan model, menjaganya tetap cepat, menerima kerugian. Kearuga menangani masalah yang sama seperti
Video Baru - Seberapa jauh manfaat coding dengan kecerdasan buatan tanpa membayar sepeser pun?
Saya menginstal OpenCode dan menghubungkan tiga hal ke dalamnya: model gratis, kunci API saya sendiri, dan Qwen 3.8, yang saya unduh ke komputer saya dengan LM Studio Bionic. Lalu saya memberikan petunjuk yang sama kepada sebelas model, satu
Sudah sampai ujung arsip
Semua qwen38