Saya akan menguji model Qwen 3.8 Flash Next baru dari Alibaba, yang merupakan pratinjau eksperimental arsitektur Qwen 4 yang akan datang.
Ini adalah model MoE dengan 125 miliar parameter yang hanya mengaktifkan 6 miliar parameter per token, menjadikannya sangat murah dan efisien, namun tetap menawarkan
Anda sekarang dapat menjalankan model parameter 27B yang sah sepenuhnya secara offline di PC konsumen biasa🚀
Qwen 3.8 27B. Unduh LM Studio (gratis) → cari “Qwen 3.8” → versi resmi dari tim Qwen di Hugging Face. Mereka memiliki kuantisasi 4-bit, 5-bit, 6-bit dan 8-bit. Bit lebih tinggi =
Menggunakan Qwen 3.8 27b untuk semuanya (lokal) dengan OMP.
Saya suka membuat hal-hal konyol seperti ini, dan AI memungkinkan saya bergerak lebih cepat (dan dengan karya seni yang lebih baik). Tautan di bawah.
Qwen 3.8 27B bekerja lebih baik daripada 3.8 Flash Next, namun masih belum mendekati.
Saya perlu mencoba Grok dan Codex untuk melihat apakah ini benar-benar permainan yang sulit untuk dibuat ulang. Saya mencoba 3.8 Flash Next untuk terakhir kalinya menggunakan DeepSeek Harness karena saya sangat beruntung.
Sudah sampai ujung arsip
Semua qwen38