doubao-embedding-vision · Doubao · embedding
ByteDance Doubao Embedding Vision, modelo de incrustación multimodal que admite tanto entrada de imagen como de texto.
Embedding multimodal (imagen + texto); búsqueda semántica; recuperación RAG; agrupamiento; clasificación.
RAG multimodal; búsqueda visual; agrupamiento de documentos; emparejamiento de similitud imagen-texto.
Sin generación de texto; sin Function Calling; dimensión de salida fija; la entrada de imagen cuesta más.
Agente de codificación CLI oficial de Anthropic. Ediciones multiarchivo, uso de herramientas y razonamiento de contexto largo.
export ANTHROPIC_AUTH_TOKEN="YOUR_API_KEY"
export ANTHROPIC_BASE_URL="https://api.robovai.com"
export ANTHROPIC_MODEL="doubao-embedding-vision"
claude