Sudah seperti ini hari ini.
Saya tahu ini bukan kecepatan DeepSeek tetapi masih lebih cepat dari biasanya
Qwen 3.8 27B
Harness Pencarian Dalam Waktu untuk menyelesaikan: 13 1/2 menit Rata-rata token per detik: 369 RTX5090
OpenAI secara resmi meluncurkan chip inferensi pertama yang dikembangkan sendiri, Jalapeño.
Dalam pengujian inferensi tertentu seperti GPT‑OSS 120B, DeepSeek R1, dan Kimi K2.5, throughput puncak per watt Jalapeño meningkat 1,5–1,9 kali lipat, dan latensi end-to-end berkurang 1,7–3,6 kali lipat, dengan beberapa indikator melebihi NVIDIA GB300.
DeepSeek-V4-Flash-Vision-Exp dengan harness DS membuat pemandangan isometrik kamar saya menggunakan Blender
Sudah sampai ujung arsip
Semua deepseek