DeepSeekは、優れたコストパフォーマンス、強力な推論能力、および100万トークンの長いコンテキストで知られるオープンソースの大規模言語モデルファミリーです。複数の階層(V3 / V4 Pro / V4 Flash)を提供しており、ディスクベースのコンテキストキャッシングをサポートしています。ここでは、キャッシュヒットのコストは入力価格の約26%で済み、長いコンテキストのシナリオで大きなコストメリットをもたらします。
1Mトークンのコンテキストウィンドウ;ディスクキャッシュ(キャッシュヒット率はキャッシュミスの約26%);視覚理解;Function Calling;JSON mode;FIM completion;OpenAI Chat Completions interfaceに互換;Batch APIの割引。
高価値な推論タスク;コード生成と補完;長文書分析;中国語理解;エージェントワークフロー;バッチデータ処理;学術研究と教育。
画像生成なし。キャッシュはヒットに依存(保証なし)。高同時実行性の場合は営業担当者への連絡が必要。一部のエンタープライズ機能は個別の有効化が必要。FP8量子化版は安価だが、精度はわずかに低下。
| モデル | 入力 / 1M | 出力 / 1M | キャッシュ読み取り / 1M | 1M あたり |
|---|---|---|---|---|
| 1M | ||||
| 1M | ||||
| - | 1M | |||
| 1M | ||||
| - | 1M | |||
| 1M |