deepseek
DeepSeek es una familia de modelos de lenguaje grandes de código abierto conocida por su excelente relación calidad-precio, razonamiento sólido y contexto de 1M. Ofrece múltiples niveles—V3 / V4 Pro / V4 Flash—y admite el almacenamiento en caché de contexto basado en disco, donde las coincidencias de caché solo cuestan alrededor del 26% del precio de entrada, lo que proporciona una gran ventaja de costos en escenarios de contexto largo.
Ventana de contexto de 1M tokens; caché en disco (cache_hit ~26% de cache_miss); comprensión visual; Function Calling; modo JSON; finalización FIM; compatible con la interfaz de Chat Completions de OpenAI; descuentos en la API por lotes.
Tareas de razonamiento de alto valor; generación y finalización de código; análisis de documentos largos; comprensión del idioma chino; flujos de trabajo de agentes; procesamiento por lotes de datos; investigación y educación académica.
Sin generación de imágenes; la caché depende de los aciertos (no está garantizada); la alta concurrencia requiere contactar a ventas; algunas funciones empresariales requieren una habilitación separada; las versiones cuantizadas en FP8 son más baratas pero con una precisión ligeramente reducida.
| Modelo | Entrada / 1M | Salida / 1M | Lectura caché / 1M | Por 1M |
|---|---|---|---|---|
| 1M | ||||
| 1M | ||||
| - | 1M | |||
| 1M | ||||
| - | 1M | |||
| 1M |