Selesaikan lebih banyak pekerjaan dengan memberikan pekerjaan berbeda kepada 2 agen AI.
Saya menjalankan keduanya di dalam Agen OS: DeepSeek Harness → pengkodean + pembangunan yang berat Hermes → memori + pekerjaan latar belakang terjadwal Satu dasbor. Setiap agen melakukan yang terbaik. Mau SOPnya? DM saya.
Saya tahu Astra dan Fable itu hebat, tapi itu hanyalah permainan yang bisa ditoleransi oleh orang-orang kaya yang bekerja di bidang minyak.
Dengan DeepSeek V4.1 Flash, Anda dapat memainkan Mario hanya dengan $2. 230 juta token digunakan, $1,78 untuk 870 permintaan API
Wah, saya bisa menikmati Astra 6x lebih lama!
Dengan menggunakan harness oh-my-hermes, saya berhasil menghemat token 6x dan mendapatkan hasil 4x lebih cepat. Ya ampun-Hermes: Muncul dengan keterampilan prompt khusus dan perutean sub-agen, jadi daripada membuang-buang Astra yang mahal
DeepSeek-V4.1-Flash adalah model multimodal parameter 552B baru yang mendefinisikan ulang apa yang mungkin dilakukan agen konteks panjang.
Ini memangkas ukuran cache KV menjadi hanya 890 byte per token (4× lebih kecil dari sebelumnya) menggunakan perpaduan berbagi lintas lapisan dan caching FP4 dengan presisi sangat rendah. Hasilnya?
Sudah sampai ujung arsip
Semua deepseek