全模态模型 × Harness 升级,开启 Agent 场景全新体验
OpenAI · 文本
GPT-5.6 Terra,5.6 系列中端模型,272K 上下文 + 128K 输出,综合能力均衡,适合通用生产任务。
OpenAI · 文本
GPT-5.6 Sol,OpenAI 5.6 系列旗舰模型,272K 上下文 + 128K 输出,顶级推理、多模态理解与编码能力。
OpenAI · 文本
GPT-5.6 Luna,5.6 系列极速经济型,272K 上下文 + 128K 输出,适合高并发与成本敏感场景。
OpenAI · 文本
OpenAI GPT-5.5 Pro,GPT-5.5 高算力 Pro 档位,适合最前沿推理。
OpenAI · 文本
OpenAI 最新旗舰 GPT-5.5,272K 上下文 + 128K 输出,多模态理解、推理与编码能力全面领先。
OpenAI · 文本
OpenAI GPT-5.4 Mini,GPT-5.4 紧凑变体,成本与能力均衡,适合日常任务。
OpenAI · 文本
GPT-5.4,272K 上下文 + 128K 输出,GPT-5.5 的前代版本,综合能力均衡,适合通用生产任务。
OpenAI · 文本
OpenAI GPT-5.4 Pro,GPT-5.4 高算力 Pro 档位,适合严苛推理负载。
OpenAI · 文本
OpenAI GPT-5.4 Nano,GPT-5.4 最小变体,适合低成本高并发轻量任务。
OpenAI · 文本
GPT-5.3 Instant,272K 上下文 + 128K 输出,极速响应版本,兼顾质量与速度,成本敏感场景的理想选择。
Zhipu · 文本
智谱最新旗舰 GLM-5.3,复杂软件工程与 Agent 任务全面进阶。与 GLM-5.2 同基础模型、全部提升来自后训练,编程能力提升 50%,网络安全/漏洞发现能力涌现。1M 上下文、128K 输出,思考始终开启(reasoning_effort low/high/max 三档)。
OpenAI · 文本
GPT-5.3 Codex,专为编程任务优化,长上下文代码生成与多文件协同修改能力突出。
OpenAI · 文本
GPT-5.2,272K 上下文 + 128K 输出,上代旗舰,日常问答、内容创作与轻量编码的通用之选。
Zhipu · 文本
智谱 GLM-5.2 最新旗舰模型,1M 上下文 + 128K 输出,长程任务效果突出,多项权威评测榜单成绩稳居前列。可将 model name 替换为 glm-latest 访问最新版本。
OpenAI · 文本
OpenAI GPT-5.2 Pro,GPT-5.2 高算力 Pro 档位,适合进阶推理与研究。
OpenAI · 文本
OpenAI GPT-5.2 Codex,GPT-5.2 编程优化变体,多文件代码生成能力强。
OpenAI · 文本
OpenAI GPT-5.1,272K 上下文 + 128K 输出,上一代通用模型,适合日常生产任务。
Zhipu · 文本
智谱 GLM-5.1,200K 上下文 + 128K 输出,GLM-5.2 的前代版本,推理与编码能力均衡。
Anthropic · 文本
Claude Opus 5,Anthropic 最新旗舰模型,1M 上下文 + 128K 输出,新一代深度推理、编码与 Agent 能力。默认 thinking,可关闭。
Anthropic · 文本
Claude Sonnet 5,1M 上下文 + 128K 输出,编码与日常 Agent 任务的最佳平衡之选。默认 thinking,可关闭。
OpenAI · 文本
OpenAI GPT-5 Codex,专为编程优化,多语言代码生成与 Agent 编码能力突出。
Anthropic · 文本
Claude Fable 5,1M 上下文 + 128K 输出,中等定位平衡能力与成本,默认 thinking。
Zhipu · 文本
智谱 GLM-5 Code,专为编程任务优化,多语言代码生成与调试能力突出。
Doubao · 图像
豆包 Seedream 5.0 Pro,高质量文生图与图像编辑模型,中文场景理解强。
OpenAI · 文本
OpenAI GPT-5 Pro,GPT-5 高算力 Pro 档位,适合最严苛的推理与研究任务。
Doubao · 图像
Volcano Engine image generation model
OpenAI · 文本
OpenAI GPT-5 Nano,272K 上下文,最小最低成本,适合轻量分类与路由。
OpenAI · 文本
OpenAI GPT-5 Mini,272K 上下文,紧凑经济,适合高并发日常任务。
OpenAI · 文本
OpenAI GPT-5,272K 上下文 + 128K 输出,上一代旗舰,多模态、推理与编码能力强劲。
Anthropic · 文本
Anthropic 旗舰模型 Opus 4.8,1M 上下文 + 128K 输出,深度推理与长链路 Agent 任务首选。默认 thinking,可关闭。
Zhipu · 文本
智谱 GLM-4.7 Flash,200K 上下文 + 128K 输出,极速响应与低成本,适合高并发场景。
Anthropic · 文本
Anthropic Claude Opus 4.7,200K 上下文,深度推理与编码,适合复杂 Agent 任务,支持思考模式切换。
Zhipu · 文本
智谱 GLM-4.7,200K 上下文 + 128K 输出,通用生产级模型,平衡能力与成本。
Anthropic · 文本
Anthropic most capable model for coding and complex reasoning
Anthropic · 文本
Most powerful model for highly complex tasks
Anthropic · 文本
Anthropic Claude Opus 4.5,200K 上下文,上一代旗舰,适合高复杂度任务。
Anthropic · 文本
Claude Haiku 4.5,200K 上下文,极致速度与性价比,适合高并发轻量任务。
Anthropic · 文本
Anthropic Claude Sonnet 4.5,200K 上下文,编码与日常推理均衡,上一代模型。
Grok · 文本
xAI Grok 4.5,256K 上下文,最新 Grok 旗舰,推理、编码与实时数据访问领先。
Doubao · 图像
字节跳动豆包 Seedream 4.5,上一代文生图与图像编辑模型,按张计费。
Grok · 文本
xAI Grok 4.3 最新旗舰,1M 上下文 + 1M 输出,集成 X 平台实时数据,推理与编码能力突出。
Grok · 文本
Grok 4.20 多智能体推理版,2M 超长上下文 + 2M 输出,多步推理与长链路 Agent 首选。默认 thinking。
Grok · 文本
xAI Grok 4.1,256K 上下文,通用模型,推理、编码与多模态理解能力强。
OpenAI · 文本
OpenAI GPT-4.1 Nano,GPT-4.1 最小变体,适合低成本高并发轻量任务。
Grok · 文本
Grok 4.1 Fast,2M 上下文,极速响应与低成本,适合高并发生产任务。
OpenAI · 文本
OpenAI GPT-4.1,1M 上下文 + 32K 输出,上一代模型,编码与指令遵循能力强。
OpenAI · 文本
OpenAI GPT-4.1 Mini,GPT-4.1 紧凑变体,速度与成本均衡,适合日常任务。
DeepSeek · 文本
DeepSeek-V4-Pro 旗舰模型,1M 上下文 + 384K 输出,Agent 能力显著增强,世界知识丰富。默认 thinking,可关闭。
Grok · 文本
Grok Code Fast,专为编程任务优化的快速版本,代码生成与补全速度突出。
Grok · 文本
xAI Grok 4 Fast,Grok 4 更快更低成本变体,适合高并发生产任务。
DeepSeek · 文本
DeepSeek-V4-Flash,1M 上下文 + 384K 输出,提供更快捷经济的 API 服务。默认 thinking,可关闭。
Grok · 文本
Grok 4,256K 上下文,深度推理与多模态理解,适合复杂 Agent 任务。
OpenAI · 文本
Affordable and intelligent small model
OpenAI · 视觉
OpenAI multimodal flagship model with vision support
Qwen · 文本
通义 Qwen3.8 最新旗舰模型,992K 上下文 + 64K 输出,推理与多语言能力领先,适合复杂任务。
Qwen · 多模态
通义千问 Qwen3.7 Plus,高性价比多模态智能体模型,视觉-语言能力全面升级,支持 GUI 操作与视觉参考代码生成,1M 上下文 + 64K 输出,默认深度思考。
Qwen · 多模态
通义千问 Qwen3.7 Flash,原生视觉语言 Flash 模型,1M 上下文 + 64K 输出,相较 3.6 Flash 多模态理解与 Agent 执行全面升级。
Qwen · 文本
通义千问 Qwen3.7 Max,面向智能体时代的新一代旗舰模型,编程、办公与生产力、长周期自主执行能力突出,1M 上下文 + 64K 输出,默认深度思考。
Qwen · 文本
通义千问 Qwen3.6 Max Preview,Qwen3.6 系列最强模型,vibe coding 与 coding agent 能力突出,256K 上下文 + 64K 输出。⚠️ 即将于 10 月 10 日下线。
Gemini · 文本
Gemini 3.6 Flash,Google 最新 Flash 模型,1M 上下文 + 64K 输出,速度与质量平衡,适合通用生产任务。
Qwen · 多模态
通义千问 Qwen3.6 Plus,原生视觉语言 Plus 模型,agentic coding、前端编程、多模态识别与 OCR 显著增强,1M 上下文 + 64K 输出,支持深度思考。
Qwen · 多模态
通义千问 Qwen3.6 Flash,原生视觉语言 Flash 模型,agentic coding、数学推理与空间智能显著增强,1M 上下文 + 64K 输出,极速经济。
Qwen · 文本
Qwen3.5 Flash,992K 上下文 + 64K 输出,极速低成本,适合高并发生产任务。
Gemini · 文本
Gemini 3.5 Flash,1M 上下文 + 64K 输出,速度与质量平衡,适合通用生产任务。
Gemini · 文本
Google Gemini 3.5 Flash Lite,1M 上下文,极致轻量低成本,适合高并发场景。
Qwen · 文本
Qwen3.5 Plus,992K 上下文 + 64K 输出,通用生产级模型,平衡能力与成本。
DeepSeek · 文本
DeepSeek V3.2,128K 上下文,平衡推理能力与输出效率,适合日常及生产级应用。
DeepSeek · 文本
DeepSeek V3.1,128K 上下文,推理与输出效率均衡,适合日常与生产任务。
Gemini · 视频
Google Veo 3.1,高质量文生视频与视频生视频,带音频,适合电影级片段。
Gemini · 图像
Gemini 3.1 Flash 图像生成模型,文生图与图像编辑能力强,适合营销素材与设计辅助。
Gemini · 文本
Gemini 3.1 Pro 预览版,1M 上下文 + 64K 输出,Google DeepMind 旗舰模型,多模态理解与长上下文推理领先。
Gemini · 文本
Gemini 3.1 Flash Lite,1M 上下文 + 64K 输出,极致轻量低成本,适合高并发场景。
Grok · 文本
xAI Grok 3,128K 上下文,上一代旗舰,推理强,集成 X 平台实时数据。
Qwen · 文本
Qwen3 235B,256K 上下文,旗舰开源 MoE 模型,通用推理与多语言能力强。
Qwen · 文本
Qwen3 Coder 480B,256K 上下文,旗舰开源编程模型,多语言生成与长上下文代码理解能力强。
DeepSeek · 文本
DeepSeek OCR,文档理解模型,从图像与扫描件中提取文本与结构。
Moonshot · 文本
Kimi K3,月之暗面最新旗舰模型,1M 上下文 + 128K 输出,顶尖推理、长上下文处理与编码能力。默认 thinking,可关闭。
Qwen · 视觉
Qwen3 VL 235B,128K 上下文,开源多模态模型,图像、文档与 OCR 理解能力强。
MiniMax · 文本
MiniMax M3 新一代旗舰语言模型,1M 上下文 + 128K 输出,编码与智能体评测达行业顶尖水平,适合 Agent 推理与工具调用。
Qwen · 文本
Qwen3 Coder Plus,998K 上下文 + 64K 输出,专为编程任务优化,多语言代码生成与长上下文代码理解突出。
Qwen · 视觉
Qwen3 VL Plus 视觉理解模型,260K 上下文,支持图像、文档理解与多模态推理。
Gemini · 文本
Google Gemini 3 Flash,1M 上下文 + 64K 输出,上一代快速模型,适合通用生产任务。
Qwen · 文本
Qwen3 Coder Flash,998K 上下文 + 64K 输出,极速版编程模型,适合高并发代码补全与生成。
DeepSeek · 文本
Cost-effective model with strong coding ability
Gemini · 图像
Gemini 3 Pro 图像生成旗舰版,高质量文生图与复杂指令解析,适合专业视觉创作。
Grok · 文本
xAI Grok 3 Fast,Grok 3 更快更低成本变体,适合高并发生产任务。
MiniMax · 文本
MiniMax M2.7,1M 上下文,上一代通用模型,能力与成本均衡,适合生产。
Moonshot · 多模态
月之暗面新一代旗舰模型 Kimi K2.7,多模态多语言 256K 上下文,长上下文与编程能力突出。默认 thinking,可关闭。
Moonshot · 文本
月之暗面新一代智能模型 Kimi K2.6,262K 上下文,长上下文与编程能力突出。默认 thinking,可关闭。
MiniMax · 文本
MiniMax M2.5,1M 上下文,通用生产级模型,平衡能力与成本。
Moonshot · 文本
Kimi K2.5,262K 上下文,平衡推理能力与输出速度,适合通用 Agent 任务。默认 thinking,可关闭。
Gemini · 向量化
Gemini Embedding 2,8K 输入,将文本转为高维向量,适用于语义检索与 RAG 场景。
google · 文本
Fast and versatile model with long context
google · 视觉
Google most capable model with 1M context window
Gemini · 文本
Google Gemini 2.5 Flash Lite,1M 上下文,最低成本 Flash 变体,适合轻量高并发任务。
OpenAI · 视频
OpenAI 视频生成专业版。
OpenAI · 视频
OpenAI 视频生成,文生/图生视频。
wan · 视频
单图+音频驱动,生成说话/唱歌/表演数字人视频。
wan · 视频
通过指令对视频进行编辑,支持局部/整体编辑、视频重塑、视频复刻等
wan · 视频
参考视频中的人或物,精准保持形象和声音,支持多参考合拍
wan · 视频
图片生成视频内容,稳定保持图像主体、风格和文字等细节信息
wan · 视频
文字生成视频内容,丝滑动态能力,电影美学控制,精准指令遵循
MiniMax · 文本
MiniMax M2.1,1M 上下文,旧版通用模型,适合成本敏感的高并发生产任务。
Doubao · 文本
豆包 Seed 2.1 Turbo,平衡速度与质量,256K 上下文,性价比高。
Doubao · 文本
豆包 Seed Evolving,快速迭代型号,256K 上下文,持续更新最新能力。
Doubao · 文本
豆包 Seed 2.1 Pro,更强能力旗舰,256K 上下文,推理与智能体能力显著提升。
wan · 视频
多模态全能参考,灵活可控生成视频内容,轻松实现故事创作、创意表达、营销物料制作等
happyhorse · 视频
HappyHorse-Video-Edit支持视频编辑,自然语言指令编辑视频,可参考最多5张图片局部或全局编辑视频元素,能够精准复刻视频动态过程,实现更强表现能力。
Qwen · 语音合成
千问音频 3.0 语音合成 Plus,高质量自然人声。
Doubao · 文本
字节跳动豆包 Seed Character,面向角色扮演的模型,人设一致性与角色交互能力强,256K 上下文。
Doubao · 视频
字节跳动豆包视频生成模型 Seedance 2.0 Mini,支持视频生成与编辑,适合短视频与动效场景。
Doubao · 视频
字节跳动豆包 Seedance 2.0 Fast,Seedance 2.0 快速变体,更低成本快速生成视频。
happyhorse · 视频
HappyHorse-R2V支持参考生视频,更加稳定的主体与场景参考,支持最多9张图片参考,能够精准保持创作意图,实现更强表现能力。
Doubao · 文本
豆包 Seed 2.0 Lite,兼顾生成质量与响应速度,适合非结构化信息处理、内容创作、数据分析等生产型工作。默认 thinking,可关闭。
Doubao · 文本
豆包 Seed 2.0 Mini,面向低时延、高并发与成本敏感场景,极致推理速度。默认 thinking,可关闭。
Doubao · 3D
字节跳动豆包 3D 生成模型 Seed3D 2.0,图生 3D,适合 3D 资产与游戏场景建模。
Doubao · 视频
字节跳动豆包 Seedance 2.0,高质量文生视频与视频生视频,适合短视频。
Qwen · 图像
通义千问图像生成 3.0 Pro,支持 1K/2K 分辨率文生图与图像编辑,输入图像与输出分别计价,适合高质量营销素材与设计创作。
Qwen · 图像
通义千问图像生成 3.0,支持 1K/2K 分辨率文生图与图像编辑,高性价比之选。
Doubao · 视频
新一代视频创作模型,单次 30 秒长叙事、全模态参考、视频编辑与延长。
Doubao · 3D
影眸科技 Hyper3D Gen2,图生 3D,火山引擎 Ark 托管,适合 3D 资产与游戏场景建模。
fun · music
通义音乐生成,按输出音频秒数计费。
Qwen · 语音识别
千问语音识别 Flash,录音文件转写。
Qwen · 语音识别
千问音频 3.0 语音识别 Flash,录音文件转写。
fun · 语音合成
CosyVoice 3.5 Plus 语音合成,多语种高质量人声。
fun · 语音合成
CosyVoice 3.5 Flash 语音合成,高性价比。
Qwen · 向量化
千问最新文本向量模型,适用检索与语义匹配。
Qwen · 文本
通义千问 3.8 开源旗舰,2.4T 参数 MoE 架构(激活 95B),支持非思考与思考模式。
wan · 视频
万相视频换人:替换视频中的人物形象,标准/专业两档。
Qwen · 文本
通义千问 3.8 开源 27B 稠密模型,均衡性价比之选。
Qwen · 文本
千问长文本模型,超长上下文场景专用。
Qwen · 文本
千问深度研究模型,自动多步检索、分析与报告生成。
Qwen · 语音合成
千问音频 3.0 语音合成 Flash,低延迟高性价比。
Qwen · 视觉
千问 OCR 视觉模型,图文识别与结构化信息提取。
kling · 图像
可灵 V3 图像生成,1K/2K/4K 分辨率。
kling · 视频
可灵 V3 视频生成,支持无声/有声与 720P/1080P/4K 分辨率。
wan · 视频
万相图生动作:以参考动作驱动人像生成视频,标准/专业两档。
Doubao · 3D
数美万物 Hitem3D 2.0,图生 3D,火山引擎 Ark 托管,适合 3D 资产与场景建模。
Doubao · 文本
字节跳动豆包 Seed Code,编程优化模型,多语言代码生成与调试能力强,256K 上下文。
Qwen · 图像
通义万相 Qwen Image 2.0 Pro 图像生成模型,高质量文生图与图像编辑,适合营销素材与设计创作。
happyhorse · 视频
HappyHorse系列最新文生视频模型,具备高度还原的动态画面生成能力,能够精准理解文本语义,输出流畅自然、细节丰富的高质量视频。
happyhorse · 视频
HappyHorse系列最新图生视频模型,具备高度还原的动态画面生成能力,能够稳定保持与图像一致性,输出流畅自然、细节丰富的高质量视频。
Doubao · 文本
字节跳动豆包 Seed Translation,翻译专用模型,高质量多语言翻译,256K 上下文。
Doubao · 文本
豆包 Seed 2.0 Pro 旗舰全能通用模型,强化多模态理解、长上下文推理、结构化生成与工具执行。默认 thinking,可关闭。
Doubao · 文本
豆包 Seed 2.0 Code,依托 Seed 2.0 Agent 与 VLM 能力强化代码能力,前端出众、多语言适配。默认 non-thinking,可开启深度思考。
Doubao · 文本
豆包 Seed 1.8,轻量经济型号,256K 上下文,适合高并发低成本场景。
Doubao · 视觉
字节跳动豆包 Seed 1.6 Vision,上一代多模态视觉模型,256K 上下文,图像与文档理解。
Doubao · 文本
字节跳动豆包 Seed 1.6 Flash,1.6 极速轻量变体,256K 上下文,适合高并发场景。
Doubao · 文本
字节跳动豆包 Seed 1.6,上一代通用模型,256K 上下文,适合日常高性价比任务。
Doubao · 视觉
字节跳动豆包 1.5 Vision Lite,旧版轻量多模态视觉模型,256K 上下文,高性价比图像理解。
Doubao · 视频
字节跳动豆包 Seedance 1.5 Pro,上一代视频生成模型,支持有声与无声视频输出。
Qwen · 语音合成
通义千问语音合成 Instruct Flash 版。
Qwen · 语音合成
通义千问语音合成 Flash 版。
Doubao · 向量化
豆包大规模向量化模型,将文本转为高维向量表示,适用于语义检索与 RAG 场景。
Qwen · 向量化
Qwen3 Reranker 8B,开源重排模型,按相关性对检索文档重排,提升 RAG 质量。
Doubao · 向量化
豆包多模态向量化模型,支持图像和文本双模态输入。
Qwen · 文本
Qwen Turbo,1M 上下文 + 16K 输出,极致轻量低成本,适合高并发简单任务。
Qwen · 向量化
Qwen3 Embedding 8B,开源文本向量化模型,为语义搜索与 RAG 生成高质量向量。
Doubao · 语音合成
High-quality text-to-speech model.
Doubao · 向量化
豆包标准文本向量化模型,高维向量表示,适用于语义检索与 RAG 场景。
Doubao · 语音识别
豆包流式语音识别模型 2.0,火山引擎语音团队基于大模型语音识别能力全新升级,依托业界领先的自研语音识别技术和海量的语音行业大数据优势,语音识别大模型拥有更加灵敏的耳朵+更加聪明的大脑。
Auto · 文本
智能调度模型,基于「效果 + 速度」双维度智能匹配算力与模型组合,支持优先尝鲜字节跳动及生态的新模型能力。