Mô hình đa phương thức × nâng cấp Harness, mở khóa trải nghiệm Agent mới
OpenAI · Văn bản
GPT-5.6 Terra, một mô hình tầm trung trong loạt 5.6, với cửa sổ ngữ cảnh 272K và đầu ra 128K. Hiệu suất toàn diện cho các tác vụ sản xuất chung.
OpenAI · Văn bản
GPT-5.6 Sol, mẫu hình chủ lực của OpenAI trong loạt 5.6, với cửa sổ ngữ cảnh 272K và kích thước đầu ra 128K. Tư duy đỉnh cao, khả năng hiểu đa phương thức và lập trình.
OpenAI · Văn bản
GPT-5.6 Luna, một mô hình nhanh và tiết kiệm chi phí thuộc loạt 5.6, với cửa sổ ngữ cảnh 272K và đầu ra 128K. Phù hợp cho các kịch bản cao đồng thời và nhạy cảm về chi phí.
OpenAI · Văn bản
OpenAI GPT-5.5 Pro, tầng chuyên nghiệp có tính toán cao của GPT-5.5 dành cho lập luận tiên phong đòi hỏi cao nhất.
OpenAI · Văn bản
Mô hình flagship mới nhất của OpenAI, GPT-5.5, với cửa sổ ngữ cảnh 272K và 128K đầu ra. Tiên phong trong hiểu biết đa phương tiện, lập luận và lập trình.
OpenAI · Văn bản
OpenAI GPT-5.4 Mini, một biến thể nhỏ gọn của GPT-5.4 cân bằng chi phí và khả năng cho các tác vụ hàng ngày.
OpenAI · Văn bản
GPT-5.4, với cửa sổ ngữ cảnh 272K và kết xuất 128K. Tiền nhiệm của GPT-5.5, cung cấp hiệu suất toàn diện cho các tác vụ sản xuất chung.
OpenAI · Văn bản
OpenAI GPT-5.4 Pro, tầng chuyên nghiệp GPT-5.4 có khả năng tính toán cao dành cho các tác vụ suy luận đòi hỏi cao.
OpenAI · Văn bản
OpenAI GPT-5.4 Nano, biến thể nhỏ nhất của GPT-5.4 dành cho các tác vụ nhẹ nhàng chi phí thấp, khối lượng lớn.
OpenAI · Văn bản
GPT-5.3 Instant, với cửa sổ ngữ cảnh 272K và 128K đầu ra. Phiên bản siêu nhanh cân bằng chất lượng và tốc độ, phù hợp nhất cho các kịch bản nhạy cảm về chi phí.
Zhipu · Văn bản
Zhipu's latest flagship GLM-5.3, with major advances in complex software engineering and agent tasks. Same base model as GLM-5.2, all gains from post-training: 50% coding improvement and emergent cybersecurity / vulnerability-discovery capability. 1M context, 128K output, always-on thinking (reasoning_effort: low/high/max).
OpenAI · Văn bản
GPT-5.3 Codex, được tối ưu hóa cụ thể cho các tác vụ lập trình, với khả năng tạo mã dài ngữ cảnh xuất sắc và chỉnh sửa đa tệp đồng bộ.
OpenAI · Văn bản
GPT-5.2, với cửa sổ ngữ cảnh 272K và 128K đầu ra. Một flagship đời trước, một lựa chọn đa năng cho các câu hỏi và câu trả lời hàng ngày, tạo nội dung và lập trình nhẹ.
Zhipu · Văn bản
Đối thủ hàng đầu mới nhất của Zhipu, GLM-5.2, với cửa sổ ngữ cảnh 1M và đầu ra 128K. Xuất sắc trong các tác vụ tầm xa và luôn nằm trong top đầu nhiều bảng xếp hạng uy tín. Sử dụng tên mô hình glm-latest để truy cập phiên bản mới nhất.
OpenAI · Văn bản
OpenAI GPT-5.2 Pro, tầng chuyên nghiệp cao cấp của GPT-5.2 dành cho suy luận và nghiên cứu nâng cao.
OpenAI · Văn bản
OpenAI GPT-5.2 Codex, một biến thể tối ưu hóa cho lập trình của GPT-5.2 với khả năng tạo mã đa tệp mạnh mẽ.
OpenAI · Văn bản
OpenAI GPT-5.1, 272K ngữ cảnh + 128K đầu ra. Một mô hình tổng quát thế hệ trước dành cho các tác vụ sản xuất hàng ngày.
Zhipu · Văn bản
Zhipu GLM-5.1, với cửa sổ ngữ cảnh 200K và đầu ra 128K. Tiền nhiệm của GLM-5.2, với khả năng suy luận và lập trình cân bằng tốt.
Anthropic · Văn bản
Claude Opus 5, flagship mô hình mới nhất của Anthropic với cửa sổ ngữ cảnh 1M và đầu ra 128K. Năng lượng suy luận sâu, lập trình và khả năng tác nhân thế hệ tiếp theo. Tính năng Thinking được bật mặc định và có thể tắt.
Anthropic · Văn bản
Claude Sonnet 5, với cửa sổ ngữ cảnh 1M và đầu ra 128K. Sự cân bằng tốt nhất cho lập trình và các tác vụ đại lý hàng ngày. Tư duy được bật mặc định và có thể tắt.
OpenAI · Văn bản
OpenAI GPT-5 Codex, tối ưu hóa cho lập trình với khả năng tạo mã đa ngôn ngữ nổi bật và agentic coding.
Anthropic · Văn bản
Claude Fable 5, với cửa sổ ngữ cảnh 1M và đầu ra 128K. Một lựa chọn tầm trung cân bằng giữa khả năng và chi phí, với tính năng suy nghĩ được bật mặc định.
Zhipu · Văn bản
Zhipu GLM-5 Code, được tối ưu hóa đặc biệt cho các tác vụ lập trình, với khả năng tạo mã đa ngôn ngữ và gỡ lỗi xuất sắc.
Doubao · Hình ảnh
ByteDance Doubao Seedream 5.0 Pro, mô hình văn bản sang hình ảnh và chỉnh sửa hình ảnh chất lượng cao, khả năng hiểu biết về cảnh Trung Quốc mạnh mẽ.
OpenAI · Văn bản
OpenAI GPT-5 Pro, tầng chuyên nghiệp có tính toán cao của GPT-5 dành cho các tác vụ suy luận và nghiên cứu đòi hỏi cao nhất.
Doubao · Hình ảnh
Volcano Engine image generation model
OpenAI · Văn bản
OpenAI GPT-5 Nano, 272K ngữ cảnh. Mô hình nhỏ nhất, chi phí thấp nhất cho phân loại và định tuyến nhẹ.
OpenAI · Văn bản
OpenAI GPT-5 Mini, 272K ngữ cảnh. Một mô hình nhỏ gọn, tiết kiệm chi phí cho các tác vụ hàng ngày với khối lượng lớn.
OpenAI · Văn bản
OpenAI GPT-5, 272K ngữ cảnh + 128K đầu ra. Một flagship thế hệ trước với khả năng đa phương tiện, tư duy và lập trình mạnh mẽ.
Anthropic · Văn bản
Flagship Opus 4.8 của Anthropic, với cửa sổ ngữ cảnh 1M và đầu ra 128K. Lựa chọn hàng đầu cho suy luận sâu và các tác vụ tác nhân tầm xa. Tính năng Tư duy được bật mặc định và có thể tắt.
Zhipu · Văn bản
Zhipu GLM-4.7 Flash, với cửa sổ ngữ cảnh 200K và đầu ra 128K. Phản hồi siêu nhanh với chi phí thấp, phù hợp cho các tình huống cao đồng thời.
Anthropic · Văn bản
Anthropic Claude Opus 4.7, 200K ngữ cảnh, tư duy sâu và lập trình cho các tác vụ tác nhân phức tạp. Tùy chọn bật/tắt chế độ suy nghĩ.
Zhipu · Văn bản
Zhipu GLM-4.7, với cửa sổ ngữ cảnh 200K và đầu ra 128K. Một mô hình tổng quát cấp sản xuất cân bằng khả năng và chi phí.
Anthropic · Văn bản
Anthropic most capable model for coding and complex reasoning
Anthropic · Văn bản
Most powerful model for highly complex tasks
Anthropic · Văn bản
Anthropic Claude Opus 4.5, 200K ngữ cảnh, một flagship thế hệ trước dành cho các tác vụ phức tạp cao.
Anthropic · Văn bản
Claude Haiku 4.5, 200K ngữ cảnh, tốc độ cực nhanh và hiệu quả chi phí, phù hợp cho các tác vụ nhẹ với cường độ xử lý cao.
Anthropic · Văn bản
Anthropic Claude Sonnet 4.5, 200K context, cân bằng lập trình và tư duy hàng ngày, một mô hình thế hệ trước.
Grok · Văn bản
xAI Grok 4.5, 256K ngữ cảnh. Phiên bản flagship mới nhất của Grok với khả năng suy luận hàng đầu, lập trình và truy cập dữ liệu thời gian thực.
Doubao · Hình ảnh
ByteDance Doubao Seedream 4.5, một mô hình thế hệ trước về text-to-image và chỉnh sửa hình ảnh, tính phí theo từng hình ảnh.
Grok · Văn bản
Mô hình flagship mới nhất của xAI, Grok 4.3, với cửa sổ ngữ cảnh 1M và đầu ra 1M. Tích hợp dữ liệu thời gian thực từ nền tảng X, với khả năng tư duy và lập trình nổi bật.
Grok · Văn bản
Phiên bản suy luận đa tác nhân Grok 4.20, với cửa sổ ngữ cảnh siêu dài 2M và 2M đầu ra. Lựa chọn hàng đầu cho suy luận nhiều bước và các tác nhân dài hạn. Tư duy được bật mặc định.
Grok · Văn bản
xAI Grok 4.1, 256K ngữ cảnh. Một mô hình tổng quát có khả năng suy luận, lập trình và hiểu biết đa phương tiện mạnh mẽ.
OpenAI · Văn bản
OpenAI GPT-4.1 Nano, biến thể nhỏ nhất của GPT-4.1 dành cho các tác vụ nhẹ nhàng chi phí thấp, số lượng lớn.
Grok · Văn bản
Grok 4.1 Nhanh, với cửa sổ ngữ cảnh 2M. Phản hồi siêu nhanh với chi phí thấp, lý tưởng cho các tác vụ sản xuất có độ đồng thời cao.
OpenAI · Văn bản
OpenAI GPT-4.1, 1M ngữ cảnh + 32K đầu ra. Một mô hình thế hệ trước mạnh về lập trình và tuân thủ hướng dẫn.
OpenAI · Văn bản
GPT-4.1 Mini, phiên bản nhỏ gọn của GPT-4.1 cân bằng tốc độ và chi phí cho các tác vụ hàng ngày.
DeepSeek · Văn bản
DeepSeek-V4-Pro flagship model, with a 1M context window and 384K output. Nâng cao đáng kể agent capabilities và kiến thức thế giới phong phú. Tư duy được bật mặc định và có thể tắt.
Grok · Văn bản
Grok Code Fast, phiên bản nhanh được tối ưu hóa đặc biệt cho các tác vụ lập trình, với tốc độ tạo mã và hoàn thành mã xuất sắc.
Grok · Văn bản
xAI Grok 4 Fast, một biến thể nhanh hơn và chi phí thấp hơn của Grok 4 dành cho các tác vụ sản xuất có độ đồng thời cao.
DeepSeek · Văn bản
DeepSeek-V4-Flash, với cửa sổ ngữ cảnh 1M và đầu ra 384K. Cung cấp dịch vụ API nhanh hơn và tiết kiệm hơn. Tư duy được bật mặc định và có thể tắt.
Grok · Văn bản
Grok 4, với cửa sổ ngữ cảnh 256K. Cung cấp khả năng suy luận sâu và hiểu biết đa phương thức, phù hợp cho các tác vụ tác nhân phức tạp.
OpenAI · Văn bản
Affordable and intelligent small model
OpenAI · Thị giác
OpenAI multimodal flagship model with vision support
Qwen · Văn bản
Tongyi flagship mới nhất, Qwen3.8, với cửa sổ ngữ cảnh 992K và đầu ra 64K. Nổi bật về khả năng suy luận và đa ngôn ngữ, phù hợp cho các tác vụ phức tạp.
Qwen · Đa phương thức
Alibaba Qwen3.7 Plus, mô hình tác nhân đa phương thức tiết kiệm chi phí với khả năng thị giác-ngôn ngữ được nâng cấp. Hỗ trợ thao tác GUI và tạo mã tham chiếu thị giác. 1M ngữ cảnh + 64K đầu ra. Tư duy mặc định bật.
Qwen · Đa phương thức
Qwen3.7 Flash, một mô hình Flash thị giác-ngôn ngữ bản địa với ngữ cảnh 1M và đầu ra 64K. Nâng cấp khả năng hiểu biết đa phương thức và thực thi tác nhân so với 3.6 Flash.
Qwen · Văn bản
Alibaba Qwen3.7 Max, mô hình flagship thế hệ tiếp theo dành cho kỷ nguyên agent. Xuất sắc về lập trình, năng suất văn phòng và thực thi tự động tầm nhìn xa. 1M ngữ cảnh + 64K đầu ra. Thinking được bật mặc định.
Qwen · Văn bản
Alibaba Qwen3.6 Max Preview, mô hình mạnh nhất trong dòng Qwen3.6. Nổi bật với khả năng vibe coding và coding agent. 256K ngữ cảnh + 64K đầu ra. ⚠️ Ngừng hoạt động ngày 10 tháng 10.
Gemini · Văn bản
Gemini 3.6 Flash, mô hình Flash mới nhất của Google có cửa sổ ngữ cảnh 1M và đầu ra 64K. Cân bằng tốc độ và chất lượng, phù hợp tốt cho các tác vụ sản xuất chung.
Qwen · Đa phương thức
Alibaba Qwen3.6 Plus, mô hình vision-language Plus nguyên bản. Nâng cấp agentic coding, lập trình giao diện người dùng, nhận dạng đa phương tiện và OCR. 1M ngữ cảnh + 64K đầu ra. Hỗ trợ tư duy.
Qwen · Đa phương thức
Alibaba Qwen3.6 Flash, mô hình Flash thị giác-ngôn ngữ tự nhiên. Nâng cấp lập trình có tính chủ động, suy luận toán học và trí tuệ không gian. 1M ngữ cảnh + 64K đầu ra. Nhanh và hiệu quả về chi phí.
Qwen · Văn bản
Qwen3.5 Flash, 992K ngữ cảnh + 64K đầu ra. Một mô hình siêu nhanh, chi phí thấp cho các tác vụ sản xuất có độ đồng thời cao.
Gemini · Văn bản
Gemini 3.5 Flash, với cửa sổ ngữ cảnh 1M và đầu ra 64K. Cân bằng giữa tốc độ và chất lượng, phù hợp cho các tác vụ sản xuất chung.
Gemini · Văn bản
Google Gemini 3.5 Flash Lite, 1M ngữ cảnh. Siêu nhẹ và chi phí thấp, phù hợp cho các kịch bản xử lý song song cao.
Qwen · Văn bản
Qwen3.5 Plus, với cửa sổ ngữ cảnh 992K và đầu ra 64K. Một mô hình tổng quát cấp sản xuất cân bằng giữa khả năng và chi phí.
DeepSeek · Văn bản
DeepSeek V3.2, 128K ngữ cảnh, cân bằng lập luận và hiệu suất đầu ra, phù hợp cho các tác vụ hàng ngày và thực tế.
DeepSeek · Văn bản
DeepSeek V3.1, 128K ngữ cảnh. Một mô hình cân bằng với khả năng suy luận mạnh mẽ và hiệu suất đầu ra tốt cho các tác vụ hàng ngày và sản xuất.
Gemini · Video
Google Veo 3.1, tạo video từ văn bản và video từ video chất lượng cao có âm thanh, lý tưởng cho các đoạn phim điện ảnh.
Gemini · Hình ảnh
Mô hình tạo hình ảnh Gemini 3.1 Flash, với khả năng tạo hình từ văn bản và chỉnh sửa hình ảnh mạnh mẽ. Phù hợp cho tài sản marketing và hỗ trợ thiết kế.
Gemini · Văn bản
Gemini 3.1 Pro Preview, với cửa sổ ngữ cảnh 1M và 64K đầu ra. Mô hình flagship của Google DeepMind, dẫn đầu trong việc hiểu đa phương thức và suy luận ngữ cảnh dài.
Gemini · Văn bản
Gemini 3.1 Flash Lite, với cửa sổ ngữ cảnh 1M và đầu ra 64K. Rất nhẹ và chi phí thấp, phù hợp cho các kịch bản cao độ đồng thời.
Grok · Văn bản
xAI Grok 3, 128K ngữ cảnh. Một flagship đời trước với tư duy sắc bén và dữ liệu nền tảng X thời gian thực.
Qwen · Văn bản
Qwen3 235B, 256K ngữ cảnh. Mô hình flagship open-weight MoE có khả năng suy luận tổng quát mạnh mẽ và khả năng đa ngôn ngữ.
Qwen · Văn bản
Qwen3 Coder 480B, 256K ngữ cảnh. Mô hình code flagship open-weight có khả năng sinh đa ngôn ngữ mạnh mẽ và hiểu code có ngữ cảnh dài.
DeepSeek · Văn bản
DeepSeek OCR, một mô hình hiểu tài liệu trích xuất văn bản và cấu trúc từ hình ảnh và tài liệu quét.
Moonshot · Văn bản
Kimi K3, mô hình flagship mới nhất của Moonshot AI với cửa sổ ngữ cảnh 1M token và khả năng xuất 128K. Tư duy tiên tiến, xử lý ngữ cảnh dài và khả năng lập trình. Tính năng suy nghĩ được bật mặc định và có thể tắt.
Qwen · Thị giác
Qwen3 VL 235B, 128K ngữ cảnh. Mô hình đa phương tiện có trọng số mở với khả năng hiểu hình ảnh, tài liệu và OCR tốt.
MiniMax · Văn bản
MiniMax M3, một mô hình ngôn ngữ flagship thế hệ mới với cửa sổ ngữ cảnh 1M và độ dài đầu ra 128K. Đạt được kết quả dẫn đầu ngành trong các chỉ số đánh giá mã và tác nhân, rất phù hợp cho tư duy tác nhân và gọi công cụ.
Qwen · Văn bản
Qwen3 Coder Plus, với cửa sổ ngữ cảnh 998K và đầu ra 64K. Tối ưu hóa cụ thể cho các tác vụ lập trình, với khả năng tạo mã đa ngôn ngữ xuất sắc và hiểu mã có ngữ cảnh dài.
Qwen · Thị giác
Mô hình Qwen3 VL Plus có khả năng hiểu thị giác, với cửa sổ ngữ cảnh 260K. Hỗ trợ hiểu hình ảnh và tài liệu cũng như tư duy đa phương thức.
Gemini · Văn bản
Google Gemini 3 Flash, 1M ngữ cảnh + 64K đầu ra. Một mô hình nhanh thế hệ trước dành cho các tác vụ sản xuất chung.
Qwen · Văn bản
Qwen3 Coder Flash, với cửa sổ ngữ cảnh 998K và đầu ra 64K. Một mô hình mã hóa siêu nhanh phù hợp hoàn hảo với việc hoàn thành và tạo mã có độ đồng thời cao.
DeepSeek · Văn bản
Cost-effective model with strong coding ability
Gemini · Hình ảnh
Gemini 3 Pro là flagship tạo hình ảnh, cung cấp hình ảnh văn bản sang trọng và phân tích lệnh phức tạp. Phù hợp cho sáng tạo thị giác chuyên nghiệp.
Grok · Văn bản
xAI Grok 3 Fast, một biến thể nhanh hơn và chi phí thấp hơn của Grok 3 dành cho các tác vụ sản xuất có độ đồng thời cao.
MiniMax · Văn bản
MiniMax M2.7, 1M ngữ cảnh. Một mô hình tổng quát thế hệ trước cân bằng khả năng và chi phí cho sản xuất.
Moonshot · Đa phương thức
Mô hình flagship thế hệ tiếp theo của Moonshot AI, Kimi K2.7, đa phương thức đa ngôn ngữ, bối cảnh 256K. Nổi bật về khả năng bối cảnh dài và lập trình. Tính năng suy nghĩ được bật mặc định và có thể tắt.
Moonshot · Văn bản
Mô hình thế hệ tiếp theo của Moonshot AI, Kimi K2.6, với cửa sổ ngữ cảnh 262K. Nổi bật với khả năng xử lý ngữ cảnh dài và lập trình. Tính năng Thinking được bật mặc định và có thể tắt.
MiniMax · Văn bản
MiniMax M2.5, với cửa sổ ngữ cảnh 1M. Một mô hình tổng quát cấp sản xuất cân bằng giữa khả năng và chi phí.
Moonshot · Văn bản
Kimi K2.5, với cửa sổ ngữ cảnh 262K. Cân bằng khả năng suy luận với tốc độ xuất, rất phù hợp cho các tác vụ agent tổng quát. Tư duy mặc định được bật và có thể tắt.
Gemini · Embedding
Gemini Embedding 2, với 8K input. Chuyển đổi văn bản thành các vector chiều cao cho các kịch bản tìm kiếm ngữ nghĩa và RAG.
google · Văn bản
Fast and versatile model with long context
google · Thị giác
Google most capable model with 1M context window
Gemini · Văn bản
Google Gemini 2.5 Flash Lite, 1M ngữ cảnh. Phiên bản Flash rẻ nhất cho các tác vụ nhẹ và số lượng lớn.
OpenAI · Video
OpenAI 视频生成专业版。
OpenAI · Video
OpenAI 视频生成,文生/图生视频。
wan · Video
单图+音频驱动,生成说话/唱歌/表演数字人视频。
wan · Video
通过指令对视频进行编辑,支持局部/整体编辑、视频重塑、视频复刻等
wan · Video
参考视频中的人或物,精准保持形象和声音,支持多参考合拍
wan · Video
图片生成视频内容,稳定保持图像主体、风格和文字等细节信息
wan · Video
文字生成视频内容,丝滑动态能力,电影美学控制,精准指令遵循
MiniMax · Văn bản
MiniMax M2.1, 1M ngữ cảnh. Một mô hình tổng quát thế hệ trước dành cho các tác vụ sản xuất nhạy cảm về chi phí, quy mô lớn.
Doubao · Văn bản
ByteDance Doubao Seed 2.1 Turbo, cân bằng giữa tốc độ và chất lượng, ngữ cảnh 256K, tiết kiệm chi phí cho các tác vụ sản xuất.
Doubao · Văn bản
ByteDance Doubao Seed Evolving, mô hình cập nhật nhanh, ngữ cảnh 256K, liên tục được cập nhật với các khả năng mới nhất.
Doubao · Văn bản
ByteDance Doubao Seed 2.1 Pro, flagship có khả năng nâng cao, ngữ cảnh 256K, khả năng suy luận và tác nhân mạnh mẽ.
wan · Video
多模态全能参考,灵活可控生成视频内容,轻松实现故事创作、创意表达、营销物料制作等
happyhorse · Video
HappyHorse-Video-Edit支持视频编辑,自然语言指令编辑视频,可参考最多5张图片局部或全局编辑视频元素,能够精准复刻视频动态过程,实现更强表现能力。
Qwen · TTS
Tổng hợp giọng nói Qwen Audio 3.0 Plus, giọng tự nhiên chất lượng cao.
Doubao · Văn bản
ByteDance Doubao Seed Character, một mô hình tập trung vào vai (roleplay) với tính nhất quán về nhân vật và tương tác giữa các nhân vật mạnh mẽ, ngữ cảnh 256K.
Doubao · Video
Mô hình tạo video ByteDance Doubao Seedance 2.0 Mini, hỗ trợ tạo và chỉnh sửa video, phù hợp cho video ngắn và đồ họa chuyển động.
Doubao · Video
ByteDance Doubao Seedance 2.0 Fast, một biến thể nhanh hơn của Seedance 2.0 dành cho việc tạo video nhanh với chi phí thấp hơn.
happyhorse · Video
Alibaba HappyHorse 1.1 R2V, reference-to-video generation hỗ trợ tối đa 9 hình ảnh tham chiếu, với tính nhất quán chủ thể/cảnh/phong cách mạnh mẽ hơn. Tính phí theo giây.
Doubao · Văn bản
Doubao Seed 2.0 Lite cân bằng chất lượng tạo nội dung với tốc độ phản hồi, rất phù hợp cho công việc thực tế như xử lý thông tin không cấu trúc, sáng tạo nội dung và phân tích dữ liệu. Tư duy được bật mặc định và có thể tắt.
Doubao · Văn bản
Doubao Seed 2.0 Mini hướng tới các kịch bản độ trễ thấp, độ đồng thời cao và nhạy cảm về chi phí với suy luận cực nhanh. Tính năng tư duy mặc định được bật và có thể tắt.
Doubao · 3D
ByteDance Doubao mô hình tạo 3D Seed3D 2.0, chuyển đổi hình ảnh sang 3D, lý tưởng cho tài sản 3D và mô hình cảnh trò chơi.
Doubao · Video
ByteDance Doubao Seedance 2.0, tạo video từ văn bản và video từ video chất lượng cao, lý tưởng cho các video điện ảnh ngắn.
Qwen · Hình ảnh
Mô hình tạo hình Tongyi Qwen 3.0 Pro, hỗ trợ tạo hình từ văn bản và chỉnh sửa hình ảnh độ phân giải 1K/2K, tính phí riêng cho đầu vào và đầu ra. Phù hợp cho tài nguyên marketing chất lượng cao và sáng tạo thiết kế.
Qwen · Hình ảnh
Mô hình tạo hình Tongyi Qwen 3.0, hỗ trợ tạo hình từ văn bản và chỉnh sửa hình ảnh độ phân giải 1K/2K. Lựa chọn hiệu quả về chi phí.
Doubao · Video
新一代视频创作模型,单次 30 秒长叙事、全模态参考、视频编辑与延长。
Doubao · 3D
Hyper3D Gen2 bởi Yingmou (影眸科技), tạo 3D từ hình ảnh được lưu trữ trên Volcengine Ark. Phù hợp cho tài sản 3D và mô hình hóa cảnh game.
fun · music
Tạo nhạc Tongyi, tính phí theo số giây âm thanh xuất ra.
Qwen · ASR
Nhận diện giọng nói Qwen Flash, chuyển ngữ tệp ghi âm.
Qwen · ASR
Nhận diện giọng nói Qwen Audio 3.0 Flash, chuyển ngữ tệp ghi âm.
fun · TTS
Tổng hợp giọng nói CosyVoice 3.5 Plus, giọng đa ngôn ngữ chất lượng cao.
fun · TTS
Tổng hợp giọng nói CosyVoice 3.5 Flash, hiệu quả chi phí.
Qwen · Embedding
Mô hình embedding văn bản Qwen mới nhất, phù hợp cho truy xuất và so khớp ngữ nghĩa.
Qwen · Văn bản
Mô hình mã nguồn mở hàng đầu Tongyi Qwen 3.8, kiến trúc MoE 2.4T tham số (kích hoạt 95B), hỗ trợ chế độ suy nghĩ và không suy nghĩ.
wan · Video
Wan hoán đổi gương mặt video: thay nhân vật trong video, chế độ tiêu chuẩn/pro.
Qwen · Văn bản
Mô hình thẳng 27B mã nguồn mở Tongyi Qwen 3.8, lựa chọn cân bằng chi phí.
Qwen · Văn bản
Mô hình ngữ cảnh dài Qwen, chuyên cho kịch bản ngữ cảnh siêu dài.
Qwen · Văn bản
Mô hình nghiên cứu sâu Qwen, tự động truy xuất nhiều bước, phân tích và tạo báo cáo.
Qwen · TTS
Tổng hợp giọng nói Qwen Audio 3.0 Flash, độ trễ thấp và hiệu quả chi phí.
Qwen · Thị giác
Mô hình thị giác Qwen OCR, nhận diện văn bản và trích xuất thông tin có cấu trúc.
kling · Hình ảnh
Tạo hình Kling V3, độ phân giải 1K/2K/4K.
kling · Video
Sinh video Kling V3, hỗ trợ không tiếng/tiếng và độ phân giải 720P/1080P/4K.
wan · Video
Wan ảnh sang chuyển động: tạo video nhân vật bằng động tác tham chiếu, chế độ tiêu chuẩn/pro.
Doubao · 3D
Hitem3D 2.0 bởi Shumei (数美万物), tạo hình 3D từ ảnh được lưu trữ trên Volcengine Ark. Phù hợp cho tài sản 3D và mô hình hóa cảnh.
Doubao · Văn bản
ByteDance Doubao Seed Code, một mô hình tối ưu hóa mã nguồn với khả năng tạo và gỡ lỗi đa ngôn ngữ mạnh mẽ, ngữ cảnh 256K.
Qwen · Hình ảnh
Mô hình tạo hình Tongyi Wanxiang Qwen Image 2.0 Pro, cung cấp khả năng tạo hình từ văn bản và chỉnh sửa hình ảnh chất lượng cao. Phù hợp cho tài nguyên marketing và sáng tạo thiết kế.
happyhorse · Video
Mô hình tạo video Alibaba Cloud HappyHorse 1.1 T2V. Text-to-video với động lực, bề mặt và âm thanh được nâng cấp. Di chuyển của nhân vật và bầu không khí cảnh mượt mà và tự nhiên hơn.
happyhorse · Video
Alibaba HappyHorse 1.1 I2V, tạo video từ ảnh với cải thiện về kết cấu, chuyển động và tính nhất quán xuyên clip. Tính phí theo giây.
Doubao · Văn bản
ByteDance Doubao Seed Translation, một mô hình dịch chuyên biệt cho dịch đa ngôn ngữ chất lượng cao, bối cảnh 256K.
Doubao · Văn bản
Doubao Seed 2.0 Pro, một mẫu flagship tổng quát đa năng với khả năng hiểu biết đa phương thức được nâng cao, suy luận ngữ cảnh dài, tạo cấu trúc và thực thi công cụ. Tư duy mặc định là bật và có thể tắt.
Doubao · Văn bản
Doubao Seed 2.0 Code dựa trên các khả năng agent và VLM của Seed 2.0 để tăng cường khả năng lập trình, với khả năng làm việc giao diện (front-end) xuất sắc và hỗ trợ đa ngôn ngữ. Mặc định không suy nghĩ, có thể bật suy nghĩ sâu khi cần.
Doubao · Văn bản
ByteDance Doubao Seed 1.8, mô hình nhẹ, tiết kiệm chi phí, 256K ngữ cảnh, phù hợp cho các kịch bản xử lý đồng thời cao.
Doubao · Thị giác
ByteDance Doubao Seed 1.6 Vision, một mô hình thị giác đa phương thức thế hệ trước, ngữ cảnh 256K, hiểu biết về hình ảnh và tài liệu.
Doubao · Văn bản
ByteDance Doubao Seed 1.6 Flash, một biến thể siêu nhanh và nhẹ của 1.6, hỗ trợ ngữ cảnh 256K, phù hợp cho các kịch bản cao độ đồng thời.
Doubao · Văn bản
ByteDance Doubao Seed 1.6, một mô hình tổng quát thế hệ trước, 256K ngữ cảnh, tiết kiệm chi phí cho các tác vụ hàng ngày.
Doubao · Thị giác
ByteDance Doubao 1.5 Vision Lite, một mô hình thị giác đa phương thức nhẹ và được kế thừa, 256K ngữ cảnh, khả năng hiểu hình ảnh hiệu quả về chi phí.
Doubao · Video
ByteDance Doubao Seedance 1.5 Pro, một mô hình tạo video thế hệ trước hỗ trợ âm thanh và đầu ra video không âm thanh.
Qwen · TTS
通义千问语音合成 Instruct Flash 版。
Qwen · TTS
通义千问语音合成 Flash 版。
Doubao · Embedding
Doubao's large-scale embedding model chuyển đổi văn bản thành các biểu diễn vector chiều cao cho các kịch bản tìm kiếm ngữ nghĩa và RAG.
Qwen · Embedding
Qwen3 Reranker 8B, một reranker có trọng số mở sắp xếp lại các tài liệu đã truy xuất theo độ liên quan để tạo ra RAG chất lượng cao hơn.
Doubao · Embedding
ByteDance Doubao Embedding Vision, mô hình nhúng đa phương thức hỗ trợ cả đầu vào hình ảnh và văn bản.
Qwen · Văn bản
Qwen Turbo, với cửa sổ ngữ cảnh 1M và đầu ra 16K. Rất nhẹ và chi phí thấp, thích hợp cho các tác vụ đơn giản có tính đồng thời cao.
Qwen · Embedding
Qwen3 Embedding 8B, một mô hình nhúng văn bản có trọng số mở tạo ra các vector chất lượng cao cho tìm kiếm ngữ nghĩa và RAG.
Doubao · TTS
High-quality text-to-speech model.
Doubao · Embedding
ByteDance Doubao Embedding, mô hình nhúng văn bản tiêu chuẩn, biểu diễn vector chất lượng cao cho tìm kiếm ngữ nghĩa và RAG.
Doubao · ASR
豆包流式语音识别模型 2.0,火山引擎语音团队基于大模型语音识别能力全新升级,依托业界领先的自研语音识别技术和海量的语音行业大数据优势,语音识别大模型拥有更加灵敏的耳朵+更加聪明的大脑。
Auto · Văn bản
Mô hình định tuyến thông minh khớp chính xác các kết hợp tính toán và mô hình về cả chất lượng và tốc độ. Nhận quyền truy cập sớm vào các mô hình mới nhất từ ByteDance và hệ sinh thái của họ.