FRAMEWIREEnglishDiperbarui Aug 17Kabel langsung
0:00 / 0:00

Berhenti membayar pajak konteks visual API ke kartel cloud.

Saya baru saja menempatkan Qwen3.8 27B dengan visi pada satu NVIDIA RTX 4090 (24GB). Saya memberinya muatan 30.000 token yang sangat besar (28,5 ribu teks + 1 gambar resolusi tinggi) untuk melihat di mana VRAM fisik dan batas throughput berada dengan dan tanpa

AlokAug 1715
0:00 / 0:00

Qwen 3.8 27b

Anjuran: beri saya esai tentang ontologi sekarang buatlah situs web yang akan menjelaskan hal ini dalam animasi threeejs Berjalan secara lokal: Qwen3.8-27B UD-Q8_K_XL konteks 220K 2×RTX3090 Dekode hingga 42,26 tok/s (rata-rata ~39,3) Hermes Resep: Terima kasih

lazybutaiAug 17
0:00 / 0:00

Qwen3.8-27B benar-benar berada di level Opus 4.6 Max!

Saya baru saja membuat tes ini dengan satu perintah sederhana. Qwen berjalan sekitar satu menit di MacBook saya. Bahkan lebih cepat dari Claude. Sisi kiri adalah Opus 4.6 Max. Sisi kanan adalah Qwen 3.8. Sangat mengesankan untuk 18GB!

Tobias WupperfeldAug 173
0:00 / 0:00

Saya menguji lagi Gemini 3.7 Flash vs Qwen 3.8 vs Grok 4.6 vs GLM 5.3

Perintah yang sama: sebuah keluarga sedang makan siang dalam 3D. Qwen 3.8 menang lagi bagi saya dalam hal kualitas. tapi Gemini selesai dalam waktu kurang dari 2 menit, yang lain mengambil 6+. Manakah yang menang untuk Anda?

Tauhid IQAug 173