deepseek
DeepSeek adalah keluarga model bahasa besar open-source yang dikenal dengan nilai yang luar biasa, penalaran yang kuat, dan konteks panjang 1M. DeepSeek menawarkan beberapa tingkatan—V3 / V4 Pro / V4 Flash—dan mendukung caching konteks berbasis disk, di mana kecocokan cache hanya memakan biaya sekitar 26% dari harga input, memberikan keunggulan biaya yang signifikan dalam skenario konteks panjang.
Jendela konteks 1M token; cache disk (cache_hit ~26% dari cache_miss); pemahaman visual; Function Calling; mode JSON; pelengkapan FIM; kompatibel dengan antarmuka OpenAI Chat Completions; diskon Batch API.
Tugas penalaran bernilai tinggi; generasi dan penyelesaian kode; analisis dokumen panjang; pemahaman bahasa Mandarin; alur kerja agen; pemrosesan data batch; penelitian dan pendidikan akademis.
Tidak ada pembuatan gambar; caching bergantung pada keberhasilan pencarian (tidak dijamin); konkurensi tinggi memerlukan kontak ke tim penjualan; beberapa fitur enterprise memerlukan pengaktifan terpisah; versi terkuantisasi FP8 lebih murah tetapi dengan akurasi yang sedikit berkurang.
| Model | Input / 1M | Output / 1M | Baca cache / 1M | Per 1M |
|---|---|---|---|---|
| 1M | ||||
| 1M | ||||
| - | 1M | |||
| 1M | ||||
| - | 1M | |||
| 1M |