BigMoeOnEdge: streaming inferensi MoE di Android, dibangun di llama.cpp (ggml_org).
DeepSeek V4 Flash IQ2_M (92 GB) berjalan pada ponsel kelas menengah 12 GB dengan kecepatan ~1 tok/s. Qwen3.6-35B-A3B hingga 7-8 tok/s, Gemma 26B dan Qwen3-30B dalam rentang tok/s yang sama. hanya CPU. Aliran ahli dari UFS
Xianyu adalah hotspot AI terbesar di Tiongkok dan platform media mandiri paling menguntungkan di Tiongkok🙃 Yang sebelumnya adalah MiniMax H3
Kali ini DeepSeek Harness Ps: Masih ada yang pakai Mac mini M4? 🙂
DeepSeek Harness menyelesaikan tugas pengkodean yang sama hampir 3× lebih cepat dari Claude Code.
But Claude still produced the better result. Julian Goldie and Kasra gave both systems the same one-shot prompt: build an animated accounting website and a working Tetris game. The results: 00:41
Lagi nyobain Deepseek Harness Beta sangat diluar dugaan
Agent herness yang dibuat deepseek, tidak ada privileged core yang harus dipatch semua (model adapter, tool registry, session log, bahkan agent loop itu sendiri) bisa diganti dari konfigurasi Kemampuan utama:
Sudah sampai ujung arsip
Semua deepseek