Qwen 3.8 membutuhkan waktu lebih lama untuk memikirkan semuanya...
Also Qwen 3.8:
Ini adalah contoh karya yang dibuat oleh Agen Kreatif lokal di Qwen-3.8-Next-Flash, dimulai dari satu gambar.
参照させた絵は1フレーム目にはいっていて、最後にそこに戻るループ構成になっている。展開も含めた演出にはあえて口を出していない。
Flash DeepSeek V4 • Flash Qwen 3.8
GLM 5.3 Flash • Gemini 3.7 Flash
konteks 262K. Pada RTX 5070 Ti 16GB.
🤯 Qwen 3.8 27B Q3 hits ~25 tok/s while an adaptive llama.cpp fork streams KV cache between RAM ↔ VRAM. Stock llama.cpp starts thrashing around ~120K context. Same consumer GPU. 2x+ the usable context. This could be huge for local LLMs.
Sudah sampai ujung arsip
Semua qwen38