FRAMEWIREEnglishDiperbarui Aug 27Kabel langsung
0:00 / 0:00

5 Model #LLM Nilai Terbaik Hari Ini di UTC-04

| Model | #AAII | Harga | | DeepSeek V4 Flash 0731 | 52 | $0,04 | | GLM 5.3 Lampu Kilat | 58 | $0,09 | | Gemini 3.7 Kilat | 56 | $0,29 | | GPT-5.6 Luna | 52 | $0,18 | | Qwen3.8 2.4T A95B | 58 | $2,06 |

KFChow AI LabAug 27
0:00 / 0:00

Saya menerapkan "Henan Nier" secara lokal di MacBook!

Masalah ini menambahkan elemen terakhir pada manusia digital saya "Henan Ni'er": Saya menjalankan manusia digital sepenuhnya secara lokal di MacBook dengan memori 16 GB, dan dia berbicara sekitar 1,3 detik setelah dia selesai berbicara. Detail paket: • Manusia digital: Gambar 3D dalam format VRM, hanya dirender, tidak dihasilkan, dan tidak menggunakan sumber daya penalaran apa pun • Render: three.js +…

电磁波StudioAug 271
0:00 / 0:00

Notebook gaming kini dapat langsung menjalankan model besar yang mutakhir, dengan bobot resmi, tanpa kuantifikasi yang ekstrem.

Qwen3.6 35B, notebook 4060 dengan memori video 8G, 39 tok/s. DeepSeek-V4-Flash 284B, desktop 5090, 22-25 tok/dtk. GLM-5.2 753B, satu PRO 6000, 15 tok/dtk. Claude Code dan Codex adalah pelacur lokal langsung, dan tagihan listrik lebih murah daripada API.

开发者HaileyAug 274
0:00 / 0:00

Komputasi MoE jarang dilakukan. Memori MoE tidak.

Sebuah token mengaktifkan 2 dari 8 pakar Mixtral (25% bobot FFN), atau 8 dari 256 pakar DeepSeek-V3 (~5%). Namun setiap ahli harus tinggal DI MANA SAJA, dan tidak ada satu GPU pun yang dapat menampung semuanya. Paralelisme pakar membalikkan aturan umum: pakar tetap tinggal, menyebar…

sreedathAug 27