DeepSeek는 우수한 가성비, 강력한 추론 능력, 그리고 1M 긴 컨텍스트를 자랑하는 오픈소스 대규모 언어 모델(LLM) 계열입니다. V3 / V4 Pro / V4 Flash 등 다양한 등급을 제공하며, 디스크 기반 컨텍스트 캐싱을 지원합니다. 캐시 히트 비용은 입력 가격의 약 26%에 불과하며, 긴 컨텍스트 상황에서 큰 비용 우위를 제공합니다.
1M 토큰 컨텍스트 윈도우; 디스크 캐시 (캐시 히트 ~26% of 캐시 미스); 시각 이해; Function Calling; JSON mode; FIM completion; OpenAI Chat Completions 인터페이스 호환; 배치 API 할인.
고가치 추론 작업; 코드 생성 및 완성; 장문 문서 분석; 중국어 이해; agent workflows; 배치 데이터 처리; 학술 연구 및 교육.
이미지 생성은 불가능하며, 캐싱은 히트 여부에 따라 달라지며(보장되지 않음); 고 동시성 요구 시 영업 담당자와 연락해야 함; 일부 엔터프라이즈 기능은 별도의 활성화가 필요함; FP8 양자화 버전은 가격이 저렴하지만 정확도는 약간 저하됨.
| 모델 | 입력 / 1M | 출력 / 1M | 캐시 읽기 / 1M | 1M당 |
|---|---|---|---|---|
| 1M | ||||
| 1M | ||||
| - | 1M | |||
| 1M | ||||
| - | 1M | |||
| 1M |