전체 모달 모델 × Harness 업그레이드, 새로운 Agent 경험을 잠금 해제하세요
OpenAI · 텍스트
GPT-5.6 Terra, 5.6 시리즈의 중급 모델로, 272K 컨텍스트 윈도우와 128K 출력을 제공합니다. 일반적인 생산 작업에 적합한 균형 잡힌 성능을 갖추고 있습니다.
OpenAI · 텍스트
GPT-5.6 Sol, OpenAI의 5.6 시리즈의 핵심 모델로, 272K 컨텍스트 윈도우와 128K 출력을 지원합니다. 최상위 수준의 추론, 멀티모달 이해, 코딩 능력을 갖추고 있습니다.
OpenAI · 텍스트
GPT-5.6 Luna, 5.6 시리즈의 빠르고 비용 효율적인 모델로, 272K 컨텍스트 윈도우와 128K 출력을 제공합니다. 높은 동시성과 비용 민감한 시나리오에 적합합니다.
OpenAI · 텍스트
OpenAI GPT-5.5 Pro, GPT-5.5의 고성능 프로 티어로, 가장 까다로운 프론티어 추론을 위해 설계되었습니다.
OpenAI · 텍스트
OpenAI의 최신 프리미엄 모델인 GPT-5.5는 272K 컨텍스트 윈도우와 128K 출력을 지원하며, 멀티모달 이해, 추론, 코딩 분야에서 선도적입니다.
OpenAI · 텍스트
OpenAI GPT-5.4 Mini, GPT-5.4의 컴팩트한 변형으로, 일상적인 작업을 위한 비용과 성능을 균형시킵니다.
OpenAI · 텍스트
GPT-5.4, 272K 컨텍스트 윈도우 및 128K 출력. GPT-5.5의 전신으로, 일반적인 프로덕션 작업에 다재다능한 성능을 제공합니다.
OpenAI · 텍스트
OpenAI GPT-5.4 Pro, the high-compute pro tier of GPT-5.4 for demanding reasoning workloads.
OpenAI · 텍스트
OpenAI GPT-5.4 Nano, GPT-5.4의 가장 작은 변형으로, 저비용, 대량 처리를 위한 가벼운 작업에 최적화되어 있습니다.
OpenAI · 텍스트
GPT-5.3 Instant, 272K 컨텍스트 윈도우 및 128K 출력. 품질과 속도를 균형 맞춘 초고속 버전으로, 비용 민감한 시나리오에 최적화되어 있습니다.
Zhipu · 텍스트
Zhipu's latest flagship GLM-5.3, with major advances in complex software engineering and agent tasks. Same base model as GLM-5.2, all gains from post-training: 50% coding improvement and emergent cybersecurity / vulnerability-discovery capability. 1M context, 128K output, always-on thinking (reasoning_effort: low/high/max).
OpenAI · 텍스트
GPT-5.3 Codex는 프로그래밍 작업에 특화되어 있으며, 독보적인 긴 컨텍스트 코드 생성과 멀티 파일 협업 편집 기능을 갖추고 있습니다.
OpenAI · 텍스트
GPT-5.2, 272K 컨텍스트 윈도우 및 128K 출력. 이전 세대 플래그십, 일상적인 질의응답, 콘텐츠 생성, 가벼운 코딩에 다재다능한 선택지.
Zhipu · 텍스트
지푸의 최신 플래그십 GLM-5.2는 1M 컨텍스트 윈도우와 128K 출력을 지원합니다. 장기 작업에 뛰어나며 여러 권위 있는 벤치마크에서 상위권을 유지합니다. 최신 버전에 액세스하려면 모델 이름 'glm-latest'를 사용하세요.
OpenAI · 텍스트
OpenAI GPT-5.2 Pro, GPT-5.2의 고사양 프로 티어로 고급 추론 및 연구를 위한 모델입니다.
OpenAI · 텍스트
OpenAI GPT-5.2 Codex, GPT-5.2의 코드 최적화 변형으로서 강력한 다중 파일 코드 생성 기능을 갖추고 있습니다.
OpenAI · 텍스트
OpenAI GPT-5.1, 272K 컨텍스트 + 128K 출력. 일상적인 실무 작업을 위한 전 세대 범용 모델입니다.
Zhipu · 텍스트
Zhipu GLM-5.1은 200K 컨텍스트 윈도우와 128K 출력을 제공합니다. GLM-5.2의 전신으로, 균형 잡힌 추론과 코딩 능력을 갖추고 있습니다.
Anthropic · 텍스트
Claude Opus 5, Anthropic의 최신 프리미엄 모델로 1M 컨텍스트 윈도우와 128K 출력을 지원합니다. 차세대 심층 추론, 코딩 및 에이전트 기능을 갖추고 있습니다. Thinking은 기본적으로 켜져 있으며 끌 수 있습니다.
Anthropic · 텍스트
Claude Sonnet 5, 1M 컨텍스트 윈도우 및 128K 출력. 코딩과 일상적인 에이전트 작업을 위한 최적의 균형. 기본적으로 Thinking이 켜져 있으며 끌 수 있습니다.
OpenAI · 텍스트
OpenAI GPT-5 Codex, programming에 최적화되었으며 독보적인 다국어 코드 생성 및 에이전트 코딩 기능을 갖추고 있습니다.
Anthropic · 텍스트
Claude Fable 5, 1M 컨텍스트 창과 128K 출력. 능력과 비용을 균형 있게 맞춘 중급 옵션으로, 기본적으로 Thinking이 켜져 있습니다.
Zhipu · 텍스트
Zhipu GLM-5 Code는 프로그래밍 작업에 특화되어 있으며, 뛰어난 다국어 코드 생성 및 디버깅 기능을 갖추고 있습니다.
Doubao · 이미지
ByteDance Doubao Seedream 5.0 Pro, 고품질 텍스트-이미지 생성 및 이미지 편집 모델, 중국 장면 이해력이 뛰어남.
OpenAI · 텍스트
OpenAI GPT-5 Pro, GPT-5의 고성능 프로 티어로, 가장 까다로운 추론 및 연구 작업에 최적화되어 있습니다.
Doubao · 이미지
Volcano Engine image generation model
OpenAI · 텍스트
OpenAI GPT-5 나노, 272K 컨텍스트. 경량 분류 및 라우팅을 위한 가장 작고 저렴한 모델입니다.
OpenAI · 텍스트
OpenAI GPT-5 Mini, 272K 컨텍스트. 고용량 일상 작업을 위한 컴팩트하고 저렴한 모델입니다.
OpenAI · 텍스트
OpenAI GPT-5, 272K 컨텍스트 + 128K 출력. 전 세대 플래그십 모델로 강력한 멀티모달, 추론 및 코딩 기능을 갖추고 있습니다.
Anthropic · 텍스트
Anthropic의 프리미엄 모델 Opus 4.8, 1M 컨텍스트 윈도우와 128K 출력을 지원합니다. 깊은 추론과 장기 에이전트 작업을 위한 최상의 선택입니다. Thinking 기능은 기본적으로 켜져 있으며 끌 수 있습니다.
Zhipu · 텍스트
Zhipu GLM-4.7 Flash, 200K 컨텍스트 윈도우 및 128K 출력. 저렴한 비용으로 초고속 응답, 고 동시성 시나리오에 최적화.
Anthropic · 텍스트
Anthropic Claude Opus 4.7, 200K 컨텍스트, 복잡한 에이전트 작업을 위한 깊은 추론 및 코딩 기능. 사고 과정 토글 가능.
Zhipu · 텍스트
Zhipu GLM-4.7, 컨텍스트 윈도우 200K 및 출력 128K. 성능과 비용의 균형을 맞춘 범용 프로덕션급 모델입니다.
Anthropic · 텍스트
Anthropic most capable model for coding and complex reasoning
Anthropic · 텍스트
Most powerful model for highly complex tasks
Anthropic · 텍스트
Anthropic Claude Opus 4.5, 200K context, a previous-generation flagship for highly complex tasks.
Anthropic · 텍스트
Claude Haiku 4.5, 200K 컨텍스트, 극도의 속도와 비용 효율성, 고 동시성 경량 작업에 이상적입니다.
Anthropic · 텍스트
Anthropic Claude Sonnet 4.5, 200K 컨텍스트, 코딩과 일상적인 추론의 균형, 이전 세대 모델입니다.
Grok · 텍스트
xAI Grok 4.5, 256K 컨텍스트. Grok의 최신 플래그십 모델로, 뛰어난 추론, 코딩 및 실시간 데이터 액세스 기능을 갖추고 있습니다.
Doubao · 이미지
ByteDance Doubao Seedream 4.5, 이전 세대의 텍스트-이미지 및 이미지 편집 모델, 이미지당 결제.
Grok · 텍스트
xAI의 최신 플래그십 모델 Grok 4.3은 100만 컨텍스트 윈도우와 100만 출력을 제공합니다. X 플랫폼의 실시간 데이터를 통합하며, 뛰어난 추론 및 코딩 기능을 자랑합니다.
Grok · 텍스트
Grok 4.20 멀티 에이전트 추론 에디션, 초장문 2M 컨텍스트 윈도우와 2M 출력을 갖추고 있습니다. 다단계 추론과 장기 에이전트의 최상의 선택입니다. 추론 기능은 기본적으로 켜져 있습니다.
Grok · 텍스트
xAI Grok 4.1, 256K 컨텍스트. 강력한 추론, 코딩 및 멀티모달 이해 능력을 갖춘 범용 모델입니다.
OpenAI · 텍스트
OpenAI GPT-4.1 Nano, GPT-4.1의 가장 작은 변형으로, 저비용, 대량의 가벼운 작업용입니다.
Grok · 텍스트
Grok 4.1, 2M 컨텍스트 윈도우. 낮은 비용으로 초고속 응답, 고동시성 프로덕션 작업에 이상적입니다.
OpenAI · 텍스트
OpenAI GPT-4.1, 1M 컨텍스트 + 32K 출력. 코딩과 지시 따르기에 강한 이전 세대 모델입니다.
OpenAI · 텍스트
OpenAI GPT-4.1 Mini, GPT-4.1의 컴팩트한 변형으로, 일상적인 작업을 위해 속도와 비용을 균형 있게 조절합니다.
DeepSeek · 텍스트
DeepSeek-V4-Pro 플래그십 모델로, 1M 컨텍스트 윈도우와 384K 출력을 갖추고 있습니다. 현저히 향상된 에이전트 기능과 풍부한 세계 지식을 갖추고 있습니다. 생각 기능은 기본적으로 켜져 있으며 끌 수 있습니다.
Grok · 텍스트
Grok Code Fast, 프로그래밍 작업에 특화된 최적화된 빠른 버전으로, 뛰어난 코드 생성 및 완성 속도를 자랑합니다.
Grok · 텍스트
xAI Grok 4 Fast, Grok 4의 더 빠르고 저렴한 변형으로, 고동시성 프로덕션 작업용입니다.
DeepSeek · 텍스트
DeepSeek-V4-Flash는 1M 컨텍스트 윈도우와 384K 출력을 제공합니다. 더 빠르고 경제적인 API 서비스를 제공합니다. Thinking 기능은 기본적으로 켜져 있으며 끌 수 있습니다.
Grok · 텍스트
Grok 4, with a 256K context window. Offers deep reasoning and multimodal understanding, well suited for complex agent tasks.
OpenAI · 텍스트
Affordable and intelligent small model
OpenAI · 비전
OpenAI multimodal flagship model with vision support
Qwen · 텍스트
Tongyi의 최신 플래그십인 Qwen3.8은 992K 컨텍스트 윈도우와 64K 출력을 제공합니다. 추론 및 다국어 기능에서 선도적이며, 복잡한 작업에 적합합니다.
Qwen · 멀티모달
알리바바 Qwen3.7 Plus, 업그레이드된 시각-언어 기능을 갖춘 비용 효율적인 멀티모달 에이전트 모델입니다. GUI 조작 및 시각 참조 코드 생성을 지원합니다. 1M 컨텍스트 + 64K 출력. 기본적으로 Thinking 기능이 켜져 있습니다.
Qwen · 멀티모달
Qwen3.7 Flash는 100만 컨텍스트와 64K 출력을 지원하는 네이티브 비전-언어 Flash 모델입니다. 3.6 Flash에 비해 멀티모달 이해 및 에이전트 실행 기능이 업그레이드되었습니다.
Qwen · 텍스트
알리바바 Qwen3.7 Max, 에이전트 시대를 위한 차세대 플래그십 모델. 프로그래밍, 사무 생산성, 그리고 장기 자율 실행에서 돋보입니다. 1M 컨텍스트 + 64K 출력. 기본적으로 Thinking 기능 활성화.
Qwen · 텍스트
알리바바 Qwen3.6 Max Preview, Qwen3.6 시리즈 중 가장 뛰어난 모델입니다. 강력한 코딩 및 코딩 에이전트 기능을 자랑합니다. 256K 컨텍스트 + 64K 출력. ⚠️ 10월 10일에 종료됩니다.
Gemini · 텍스트
Gemini 3.6 Flash, Google의 최신 Flash 모델로 1M 컨텍스트 윈도우와 64K 출력을 제공합니다. 속도와 품질의 균형을 잡고 있어 일반적인 프로덕션 작업에 적합합니다.
Qwen · 멀티모달
Alibaba Qwen3.6 Plus, native vision-language Plus 모델. 업그레이드된 에이전트 코딩, 프론트엔드 프로그래밍, 멀티모달 인식 및 OCR 기능. 1M 컨텍스트 + 64K 출력 지원. Thinking 기능 지원.
Qwen · 멀티모달
Alibaba Qwen3.6 Flash, native vision-language Flash 모델. 에이전트 코딩, 수학 추론 및 공간 지능이 업그레이드되었습니다. 1M 컨텍스트 + 64K 출력. 빠르고 비용 효율적입니다.
Qwen · 텍스트
Qwen3.5 Flash, 992K 컨텍스트 + 64K 출력. 고-동시성 프로덕션 작업을 위한 초고속, 저비용 모델입니다.
Gemini · 텍스트
Gemini 3.5 Flash, with a 1M context window and 64K output. Balances speed and quality, well suited for general production tasks.
Gemini · 텍스트
Google Gemini 3.5 Flash Lite, 1M 컨텍스트. 매우 가볍고 저렴하며, 고동시성 시나리오에 최적화되어 있습니다.
Qwen · 텍스트
Qwen3.5 Plus, 992K 컨텍스트 윈도우 및 64K 출력. 성능과 비용을 균형 잡은 범용 프로덕션급 모델입니다.
DeepSeek · 텍스트
DeepSeek V3.2, 128K 컨텍스트, 균형 잡힌 추론 및 출력 효율성, 일상 및 프로덕션 작업에 적합합니다.
DeepSeek · 텍스트
DeepSeek V3.1, 128K 컨텍스트. 일상 및 생산 작업에 강력한 추론 능력과 출력 효율을 갖춘 균형 잡힌 모델입니다.
Gemini · 비디오
Google Veo 3.1, 오디오가 포함된 고품질 텍스트-비디오 및 비디오-비디오 생성, 영화 같은 클립에 이상적입니다.
Gemini · 이미지
Gemini 3.1 Flash 이미지 생성 모델로, 강력한 텍스트-이미지 및 이미지 편집 기능을 갖추고 있습니다. 마케팅 자산과 디자인 보조에 이상적입니다.
Gemini · 텍스트
Gemini 3.1 Pro Preview, 1M 컨텍스트 윈도우 및 64K 출력. Google DeepMind의 플래그십 모델로, 멀티모달 이해와 긴 컨텍스트 추론에서 선도하고 있습니다.
Gemini · 텍스트
Gemini 3.1 Flash Lite, 1M 컨텍스트 윈도우 및 64K 출력. 매우 가볍고 저렴하여 고동시성 시나리오에 적합합니다.
Grok · 텍스트
xAI Grok 3, 128K 컨텍스트. 이전 세대의 플래그십 모델로, 강력한 추론 능력과 실시간 X 플랫폼 데이터를 갖추고 있습니다.
Qwen · 텍스트
Qwen3 235B, 256K 컨텍스트. 강력한 일반적 추론 및 다국어 기능을 갖춘 프리미엄 오픈 가중치 MoE 모델입니다.
Qwen · 텍스트
Qwen3 Coder 480B, 256K 컨텍스트. 강력한 다국어 생성과 긴 컨텍스트 코드 이해를 갖춘 프리미엄 오픈 가중치 코딩 모델입니다.
DeepSeek · 텍스트
DeepSeek OCR, 이미지와 스캔된 문서에서 텍스트와 구조를 추출하는 문서 이해 모델입니다.
Moonshot · 텍스트
Kimi K3, Moonshot AI의 최신 플래그십 모델로, 1M 토큰 컨텍스트 윈도우와 128K 출력을 갖추고 있습니다. 최첨단 추론, 긴 컨텍스트 처리, 그리고 코딩 능력을 제공합니다. 기본적으로 '생각' 기능이 켜져 있으며, 끌 수 있습니다.
Qwen · 비전
Qwen3 VL 235B, 128K 컨텍스트. 이미지, 문서 및 OCR 이해력이 뛰어난 오픈 가중치 멀티모달 모델.
MiniMax · 텍스트
MiniMax M3, a next-generation flagship language model with a 1M context window and 128K output. Achieves industry-leading results in coding and agent benchmarks, well suited for agent reasoning and tool calling.
Qwen · 텍스트
Qwen3 Coder Plus, 998K 컨텍스트 윈도우 및 64K 출력. 프로그래밍 작업에 특화되었으며, 독보적인 다국어 코드 생성 및 긴 컨텍스트 코드 이해 기능을 갖추고 있습니다.
Qwen · 비전
Qwen3 VL Plus 시각 이해 모델로, 컨텍스트 윈도우가 260K입니다. 이미지 및 문서 이해와 멀티모달 추론을 지원합니다.
Gemini · 텍스트
구글 제미니 3 플래시, 100만 컨텍스트 + 64K 출력. 일반적인 프로덕션 작업을 위한 이전 세대의 빠른 모델입니다.
Qwen · 텍스트
Qwen3 Coder Flash는 998K 컨텍스트 윈도우와 64K 출력을 제공합니다. 초고속 코딩 모델로, 고동시성 코드 완성 및 생성에 적합합니다.
DeepSeek · 텍스트
Cost-effective model with strong coding ability
Gemini · 이미지
Gemini 3 Pro 이미지 생성 플래그십으로, 고품질 텍스트-이미지 생성 및 복잡한 명령어 파싱을 제공합니다. 전문적인 시각 창작에 이상적입니다.
Grok · 텍스트
xAI Grok 3 Fast, Grok 3의 더 빠르고 저렴한 변형으로, 고 동시성 프로덕션 작업에 최적화되어 있습니다.
MiniMax · 텍스트
MiniMax M2.7, 1M 컨텍스트. 이전 세대의 범용 모델로, 실무 운영을 위한 성능과 비용의 균형을 맞춘 모델입니다.
Moonshot · 멀티모달
Moonshot AI의 차세대 프리미엄 모델 Kimi K2.7, 멀티모달 멀티언어 256K 컨텍스트. 독보적인 긴 컨텍스트 및 코딩 기능. Thinking 기능은 기본적으로 켜져 있으며 끌 수 있습니다.
Moonshot · 텍스트
Moonshot AI의 차세대 모델인 Kimi K2.6. 262K 컨텍스트 윈도우를 갖추고 있으며, 뛰어난 긴 컨텍스트 및 코딩 기능을 자랑합니다. Thinking은 기본적으로 켜져 있으며 끌 수 있습니다.
MiniMax · 텍스트
MiniMax M2.5, with a 1M context window. A general-purpose production-grade model that balances capability and cost.
Moonshot · 텍스트
Kimi K2.5, 262K 컨텍스트 윈도우를 갖추고 있습니다. 추론 능력과 출력 속도를 균형 있게 조절하며, 일반 에이전트 작업에 적합합니다. Thinking 기능은 기본적으로 켜져 있으며 끌 수 있습니다.
Gemini · 임베딩
Gemini Embedding 2, 8K 입력. 텍스트를 고차원 벡터로 변환하여 의미 검색 및 RAG 시나리오에 사용합니다.
google · 텍스트
Fast and versatile model with long context
google · 비전
Google most capable model with 1M context window
Gemini · 텍스트
Google Gemini 2.5 Flash Lite, 1M 컨텍스트. 가벼운 대량 작업을 위한 가장 저렴한 Flash 변형입니다.
OpenAI · 비디오
OpenAI 视频生成专业版。
OpenAI · 비디오
OpenAI 视频生成,文生/图生视频。
wan · 비디오
单图+音频驱动,生成说话/唱歌/表演数字人视频。
wan · 비디오
通过指令对视频进行编辑,支持局部/整体编辑、视频重塑、视频复刻等
wan · 비디오
参考视频中的人或物,精准保持形象和声音,支持多参考合拍
wan · 비디오
图片生成视频内容,稳定保持图像主体、风格和文字等细节信息
wan · 비디오
文字生成视频内容,丝滑动态能力,电影美学控制,精准指令遵循
MiniMax · 텍스트
MiniMax M2.1, 1M 컨텍스트. 비용 민감하고 대량 생산 작업에 최적화된 레거시 범용 모델입니다.
Doubao · 텍스트
ByteDance Doubao Seed 2.1 Turbo, 균형 잡힌 속도와 품질, 256K 컨텍스트, 프로덕션 작업에 비용 효율적.
Doubao · 텍스트
ByteDance Doubao Seed Evolving, 빠른 반복 모델, 256K 컨텍스트, 최신 기능으로 지속적으로 업데이트됩니다.
Doubao · 텍스트
ByteDance Doubao Seed 2.1 Pro, 향상된 성능 플래그십, 256K 컨텍스트, 강력한 추론 및 에이전트 기능.
wan · 비디오
多模态全能参考,灵活可控生成视频内容,轻松实现故事创作、创意表达、营销物料制作等
happyhorse · 비디오
HappyHorse-Video-Edit支持视频编辑,自然语言指令编辑视频,可参考最多5张图片局部或全局编辑视频元素,能够精准复刻视频动态过程,实现更强表现能力。
Qwen · TTS
Qwen Audio 3.0 음성 합성 Plus, 고품질 자연스러운 목소리.
Doubao · 텍스트
ByteDance Doubao Seed Character, 강력한 페르소나 일관성과 캐릭터 상호작용을 갖춘 롤플레잉 지향 모델, 256K 컨텍스트.
Doubao · 비디오
ByteDance Doubao 비디오 생성 모델 Seedance 2.0 Mini는 비디오 생성 및 편집을 지원하며, 짧은 비디오 및 모션 그래픽에 적합합니다.
Doubao · 비디오
ByteDance Doubao Seedance 2.0 Fast, Seedance 2.0의 더 빠른 변형으로, 낮은 비용으로 빠른 비디오 생성이 가능합니다.
happyhorse · 비디오
Alibaba HappyHorse 1.1 R2V, reference-to-video generation supporting up to 9 reference images, with stronger subject/scene/style consistency. Per-second billing.
Doubao · 텍스트
Doubao Seed 2.0 Lite는 생성 품질과 응답 속도를 균형 있게 조절하며, 비구조화된 정보 처리, 콘텐츠 생성, 데이터 분석과 같은 생산 환경 작업에 적합합니다. Thinking 기능은 기본적으로 켜져 있으며 끌 수 있습니다.
Doubao · 텍스트
Doubao Seed 2.0 Mini은 매우 빠른 추론을 통해 낮은 지연 시간, 높은 동시성, 비용 민감한 시나리오를 지원합니다. 생각은 기본적으로 켜져 있으며 끌 수 있습니다.
Doubao · 3D
바이드댄스(ByteDance) 두바오(Doubao) 3D 생성 모델 Seed3D 2.0, 이미지-3D, 3D 자산 및 게임 장면 모델링에 적합합니다.
Doubao · 비디오
ByteDance Doubao Seedance 2.0, 고품질 텍스트-비디오 및 비디오-비디오 생성, 짧은 영화 같은 비디오 제작에 적합합니다.
Qwen · 이미지
Tongyi Qwen 이미지 생성 3.0 Pro로, 1K/2K 해상도 텍스트-이미지 생성 및 이미지 편집을 지원하며 입력 이미지와 출력이 각각 과금됩니다. 고품질 마케팅 자산 및 디자인 창작에 적합합니다.
Qwen · 이미지
Tongyi Qwen 이미지 생성 3.0으로, 1K/2K 해상도 텍스트-이미지 생성 및 이미지 편집을 지원하는 경제적인 선택입니다.
Doubao · 비디오
新一代视频创作模型,单次 30 秒长叙事、全模态参考、视频编辑与延长。
Doubao · 3D
Volcengine Ark에서 호스팅되는 Yingmou (影眸科技)의 Hyper3D Gen2, 이미지를 3D로 변환하는 기술입니다. 3D 자산 및 게임 씬 모델링에 적합합니다.
fun · music
Tongyi 음악 생성, 출력 오디오 초 단위 과금.
Qwen · ASR
Qwen 음성 인식 Flash, 녹음 파일 전사.
Qwen · ASR
Qwen Audio 3.0 음성 인식 Flash, 녹음 파일 전사.
fun · TTS
CosyVoice 3.5 Plus 음성 합성, 다국어 고품질 목소리.
fun · TTS
CosyVoice 3.5 Flash 음성 합성, 고가성비.
Qwen · 임베딩
최신 Qwen 텍스트 임베딩 모델, 검색 및 의미 매칭에 적합.
Qwen · 텍스트
Tongyi Qwen 3.8 오픈소스 플래그십, 2.4T 파라미터 MoE(95B 활성), 사고/비사고 모드 지원.
wan · 비디오
완 영상 얼굴 교체: 영상 속 인물을 교체, 표준/프로 모드.
Qwen · 텍스트
Tongyi Qwen 3.8 오픈소스 27B 밀집 모델, 균형 잡힌 가성비 선택.
Qwen · 텍스트
Qwen 롱 컨텍스트 모델, 초장문 맥락 시나리오 전용.
Qwen · 텍스트
Qwen 딥 리서치 모델, 자동 다단계 검색·분석·보고서 생성.
Qwen · TTS
Qwen Audio 3.0 음성 합성 Flash, 저지연 고가성비.
Qwen · 비전
Qwen OCR 비전 모델, 문서 인식 및 구조화된 정보 추출.
kling · 이미지
클링 V3 이미지 생성, 1K/2K/4K 해상도.
kling · 비디오
클링 V3 영상 생성, 무음/유음 및 720P/1080P/4K 해상도 지원.
wan · 비디오
완 이미지-투-모션: 참조 동작으로 인물 영상 생성, 표준/프로 모드.
Doubao · 3D
Hitem3D 2.0 by Shumei (数美万物), Volcengine Ark에서 호스팅되는 이미지-3D 생성 모델입니다. 3D 자산 및 장면 모델링에 이상적입니다.
Doubao · 텍스트
ByteDance Doubao Seed Code, 코딩 최적화 모델로서 강력한 다국어 생성 및 디버깅 기능을 갖추고 있으며, 256K 컨텍스트를 지원합니다.
Qwen · 이미지
Tongyi Wanxiang Qwen Image 2.0 Pro 이미지 생성 모델로, 고품질의 텍스트-이미지 생성 및 이미지 편집을 제공합니다. 마케팅 자산 및 디자인 창작에 적합합니다.
happyhorse · 비디오
Alibaba Cloud HappyHorse 1.1 T2V 비디오 생성 모델. 업그레이드된 역동성, 질감 및 오디오를 갖춘 텍스트-비디오(Text-to-video). 더 부드럽고 자연스러운 캐릭터 움직임과 장면 분위기.
happyhorse · 비디오
Alibaba HappyHorse 1.1 I2V, image-to-video generation with improved texture, motion and cross-clip consistency. Per-second billing.
Doubao · 텍스트
ByteDance Doubao Seed Translation, a translation-specialized model for high-quality multilingual translation, 256K context.
Doubao · 텍스트
Doubao Seed 2.0 Pro, a flagship all-around general-purpose model with enhanced multimodal understanding, long-context reasoning, structured generation, and tool execution. Thinking is on by default and can be turned off.
Doubao · 텍스트
Doubao Seed 2.0 Code는 Seed 2.0의 에이전트 및 VLM 기능을 기반으로 코딩 기능을 강화하여 뛰어난 프론트엔드 작업과 다국어 지원을 제공합니다. 기본적으로 비사고 모드이며, 필요에 따라 딥 사고 모드를 사용할 수 있습니다.
Doubao · 텍스트
ByteDance Doubao Seed 1.8, 가볍고 비용 효율적인 모델, 256K 컨텍스트, 고동시나리오에 적합합니다.
Doubao · 비전
ByteDance Doubao Seed 1.6 Vision, 이전 세대의 멀티모달 비전 모델, 256K 컨텍스트, 이미지 및 문서 이해.
Doubao · 텍스트
ByteDance Doubao Seed 1.6 Flash, 1.6의 초경량 변형으로, 256K 컨텍스트를 지원하며 고동시나리오에 적합합니다.
Doubao · 텍스트
ByteDance Doubao Seed 1.6, 이전 세대 범용 모델, 256K 컨텍스트, 일상적인 작업에 비용 효율적입니다.
Doubao · 비전
ByteDance Doubao 1.5 Vision Lite, a legacy lightweight multimodal vision model, 256K context, cost-effective image understanding.
Doubao · 비디오
ByteDance Doubao Seedance 1.5 Pro, 이전 세대의 오디오 및 무음 비디오 출력을 지원하는 비디오 생성 모델입니다.
Qwen · TTS
通义千问语音合成 Instruct Flash 版。
Qwen · TTS
通义千问语音合成 Flash 版。
Doubao · 임베딩
Doubao의 대규모 임베딩 모델은 텍스트를 고차원 벡터 표현으로 변환하여 의미 검색 및 RAG 시나리오에 사용합니다.
Qwen · 임베딩
Qwen3 Reranker 8B는 더 높은 품질의 RAG를 위해 검색된 문서의 관련성에 따라 재정렬하는 개방형 가중치 리랭커입니다.
Doubao · 임베딩
바이트댄스 두바오 임베딩 비전, 이미지와 텍스트 입력을 모두 지원하는 멀티모달 임베딩 모델입니다.
Qwen · 텍스트
Qwen Turbo는 1M 컨텍스트 윈도우와 16K 출력을 갖추고 있습니다. 매우 가볍고 저렴하여 고 동시성 단순 작업에 이상적입니다.
Qwen · 임베딩
Qwen3 Embedding 8B는 의미 검색과 RAG에 고품질의 벡터를 생성하는 개방형 가중치 텍스트 임베딩 모델입니다.
Doubao · TTS
High-quality text-to-speech model.
Doubao · 임베딩
ByteDance Doubao Embedding, 표준 텍스트 임베딩 모델, 의미 검색 및 RAG를 위한 고품질 벡터 표현.
Doubao · ASR
豆包流式语音识别模型 2.0,火山引擎语音团队基于大模型语音识别能力全新升级,依托业界领先的自研语音识别技术和海量的语音行业大数据优势,语音识别大模型拥有更加灵敏的耳朵+更加聪明的大脑。
Auto · 텍스트
최신 모델과 생태계의 초기 액세스를 받을 수 있는 품질과 속도 모두를 고려하여 계산 및 모델 조합을 지능적으로 매칭하는 스마트 라우팅 모델입니다.