Sorotan AI Minggu Ini: GLM-5.3 diluncurkan di Zhipu, DeepSeek V4 Pro diperbarui secara besar-besaran, dan Google meluncurkan Gemini 3.7 Flash
BigMoeOnEdge: streaming inferensi MoE di Android, dibangun di llama.cpp (ggml_org).
DeepSeek V4 Flash IQ2_M (92 GB) berjalan pada ponsel kelas menengah 12 GB dengan kecepatan ~1 tok/s. Qwen3.6-35B-A3B hingga 7-8 tok/s, Gemma 26B dan Qwen3-30B dalam rentang tok/s yang sama. hanya CPU. Aliran ahli dari UFS
Xianyu adalah hotspot AI terbesar di Tiongkok dan platform media mandiri paling menguntungkan di Tiongkok🙃 Yang sebelumnya adalah MiniMax H3
Kali ini DeepSeek Harness Ps: Masih ada yang pakai Mac mini M4? 🙂
DeepSeek Harness menyelesaikan tugas pengkodean yang sama hampir 3× lebih cepat dari Claude Code.
But Claude still produced the better result. Julian Goldie and Kasra gave both systems the same one-shot prompt: build an animated accounting website and a working Tetris game. The results: 00:41
Sudah sampai ujung arsip
Semua deepseek