Pratinjau Hy4 Tencent baru saja bocor sebelum ada yang siap, dan rincian ini mencakup dengan tepat apa…
Pratinjau Hy4 Tencent baru saja bocor sebelum ada yang siap, dan rincian ini mencakup apa yang ada di dalamnya, termasuk angka benchmark yang akan dilewati oleh sebagian besar liputan. Video ini menguraikan Pratinjau Hy4 yang baru dirilis TencentHunyuan, campuran 770 miliar parameter…
Hari ke 35 pengujian DGX Spark dengan DeepSeek Harness & Qwen 3.8.
Mengalami masalah penyiapan, kehilangan daya, dan kecepatan token yang lambat (10-12 token/detik vs. yang diharapkan 60). Penggunaan memori tinggi (90GB). Waktu pemrosesan yang lama (88 menit) menunjukkan potensi masalah. Akan mengunjungi kembali besok.
Alibaba baru saja mengubah AI dari chatbot menjadi tenaga kerja.
Dan peningkatan terbesar bukanlah 2,4 triliun parameter. Itulah yang terjadi setelah Anda memberinya pekerjaan. Apa yang sebenarnya bisa dilakukan Qwenwork: → Teliti suatu topik, tulis dokumen, hasilkan gambar, buat halaman web, buat
Qwen 3.8 27B pada 56tps; pada GPU berusia 9 tahun btw
Nvidia V100 32GB ~$650 di eBay sekarang! Menggunakan Dflash 2; menonaktifkan ECC juga menambah kecepatan! Berpikir dan prosa sedikit lebih lambat, tetapi 56-63 tps dalam kode gen! MTP berjalan lebih cepat untuk prosa vs DFlash2 tetapi kode berkelanjutan lebih lambat
Sudah sampai ujung arsip
Semua qwen38