Apple meluncurkan mac mini dengan M6
Chip 2NM pertama mereka mulai dari $899, dan model dasarnya menjalankan qwen 3.6 27B dan deepseek R1 32B dengan pemrosesan LLM 13,5X lebih cepat daripada M1 sementara mac studio M5 ultra menangani model skala perbatasan sepenuhnya dalam memori lokal. Bisnis Mac Apple
Sudah seperti ini hari ini.
Saya tahu ini bukan kecepatan DeepSeek tetapi masih lebih cepat dari biasanya
Qwen 3.8 27B
Harness Pencarian Dalam Waktu untuk menyelesaikan: 13 1/2 menit Rata-rata token per detik: 369 RTX5090
OpenAI secara resmi meluncurkan chip inferensi pertama yang dikembangkan sendiri, Jalapeño.
Dalam pengujian inferensi tertentu seperti GPT‑OSS 120B, DeepSeek R1, dan Kimi K2.5, throughput puncak per watt Jalapeño meningkat 1,5–1,9 kali lipat, dan latensi end-to-end berkurang 1,7–3,6 kali lipat, dengan beberapa indikator melebihi NVIDIA GB300.
Sudah sampai ujung arsip
Semua deepseek