Hari ke 35 pengujian DGX Spark dengan DeepSeek Harness & Qwen 3.8.
Mengalami masalah penyiapan, kehilangan daya, dan kecepatan token yang lambat (10-12 token/detik vs. yang diharapkan 60). Penggunaan memori tinggi (90GB). Waktu pemrosesan yang lama (88 menit) menunjukkan potensi masalah. Akan mengunjungi kembali besok.
Alibaba baru saja mengubah AI dari chatbot menjadi tenaga kerja.
Dan peningkatan terbesar bukanlah 2,4 triliun parameter. Itulah yang terjadi setelah Anda memberinya pekerjaan. Apa yang sebenarnya bisa dilakukan Qwenwork: → Teliti suatu topik, tulis dokumen, hasilkan gambar, buat halaman web, buat
Qwen 3.8 27B pada 56tps; pada GPU berusia 9 tahun btw
Nvidia V100 32GB ~$650 di eBay sekarang! Menggunakan Dflash 2; menonaktifkan ECC juga menambah kecepatan! Berpikir dan prosa sedikit lebih lambat, tetapi 56-63 tps dalam kode gen! MTP berjalan lebih cepat untuk prosa vs DFlash2 tetapi kode berkelanjutan lebih lambat
Lowk terkesan saya memberikan Qwen 3.8 lokal repo nix saya
Memintanya untuk menyederhanakan apa pun yang bisa ini hasilnya setelah 2 jam
Sudah sampai ujung arsip
Semua qwen38