フルモーダルモデル × Harnessアップグレードで、新しいAgent体験を解放
OpenAI · テキスト
GPT-5.6 Terraは、5.6シリーズの中堅モデルであり、272Kのコンテキストウィンドウと128Kの出力を備えています。汎用的な本番タスク向けにバランスの取れたパフォーマンスを提供します。
OpenAI · テキスト
GPT-5.6 Sol、OpenAIの5.6シリーズのフラッグシップモデル。272Kコンテキストウィンドウと128Kの出力。トップクラスの推論、マルチモーダル理解、およびコーディング能力。
OpenAI · テキスト
GPT-5.6 Luna、5.6シリーズの高速かつコスト効率の高いモデル。コンテキストウィンドウは272K、出力は128K。高同時実行性とコスト重視のシナリオに最適。
OpenAI · テキスト
OpenAI GPT-5.5 Pro、最も要求の厳しいフロンティア推論向けのGPT-5.5の高計算プロティア。
OpenAI · テキスト
OpenAIの最新フラッグシップ、GPT-5.5は、272Kのコンテキストウィンドウと128Kの出力を備えています。マルチモーダルな理解、推論、コーディングにおいてリードしています。
OpenAI · テキスト
OpenAI GPT-5.4 Mini、コストと能力をバランスさせた日常タスク向けのコンパクトな GPT-5.4 バリアント。
OpenAI · テキスト
GPT-5.4は、272Kのコンテキストウィンドウと128Kの出力を備えています。GPT-5.5の先行モデルであり、汎用的な本番タスクに適したバランスの取れたパフォーマンスを提供します。
OpenAI · テキスト
OpenAI GPT-5.4 Pro、GPT-5.4の高計算プロフェッショナル層。高負荷な推論ワークロード向け。
OpenAI · テキスト
OpenAI GPT-5.4 Nano, the smallest variant of GPT-5.4 for low-cost, high-volume lightweight tasks.
OpenAI · テキスト
GPT-5.3 Instant、コンテキストウィンドウ272K、出力128K。品質と速度のバランスを取った超高速版で、コスト重視のシナリオに最適です。
Zhipu · テキスト
Zhipu's latest flagship GLM-5.3, with major advances in complex software engineering and agent tasks. Same base model as GLM-5.2, all gains from post-training: 50% coding improvement and emergent cybersecurity / vulnerability-discovery capability. 1M context, 128K output, always-on thinking (reasoning_effort: low/high/max).
OpenAI · テキスト
プログラミングタスクに特化して最適化されたGPT-5.3 Codexは、際立ったロングコンテキストコード生成とマルチファイル連携編集を備えています。
OpenAI · テキスト
GPT-5.2、コンテキストウィンドウ272K、出力128K。前世代のフラッグシップモデル。日常的なQ&A、コンテンツ作成、軽量なコーディングに幅広く対応できる汎用性の高い選択肢。
Zhipu · テキスト
Zhipuの最新フラッグシップ、GLM-5.2は、1Mコンテキストウィンドウと128Kの出力を備えています。長期タスクに優れ、複数の権威あるベンチマークで常にトップクラスの評価を獲得しています。最新バージョンにアクセスするには、モデル名「glm-latest」を使用してください。
OpenAI · テキスト
OpenAI GPT-5.2 Pro、高度な推論と研究のための GPT-5.2 の高計算プロティア。
OpenAI · テキスト
OpenAI GPT-5.2 Codex、GPT-5.2のコーディング最適化バリアントで、強力なマルチファイルコード生成を備えています。
OpenAI · テキスト
OpenAI GPT-5.1、272Kコンテキスト + 128K出力。日常的な本番タスク向けの以前の世代の汎用モデル。
Zhipu · テキスト
Zhipu GLM-5.1は、200Kのコンテキストウィンドウと128Kの出力を備えています。GLM-5.2の前身であり、推論とコーディングの能力がバランスよく調整されています。
Anthropic · テキスト
Claude Opus 5は、1Mコンテキストウィンドウと128K出力を備えたAnthropicの最新フラッグシップモデルです。次世代の深層推論、コーディング、エージェント機能を備えています。思考機能はデフォルトでオンになっており、オフにすることができます。
Anthropic · テキスト
Claude Sonnet 5、コンテキストウィンドウ1M、出力128K。コーディングと日常的なエージェントタスクの最適なバランス。思考機能はデフォルトでオンになっており、オフにすることも可能です。
OpenAI · テキスト
OpenAI GPT-5 Codexは、プログラミングに最適化され、卓越した多言語コード生成とエージェントコーディングを備えています。
Anthropic · テキスト
Claude Fable 5、コンテキストウィンドウ1M、出力128K。能力とコストのバランスを取った中堅クラスのオプションで、デフォルトで思考が有効になっています。
Zhipu · テキスト
Zhipu GLM-5 Codeは、プログラミングタスクに特化して最適化されており、優れた多言語コード生成とデバッグ機能を備えています。
Doubao · 画像
ByteDance Doubao Seedream 5.0 Pro、高品質なテキストから画像への生成および画像編集モデル、強力な中国のシーン理解能力。
OpenAI · テキスト
OpenAI GPT-5 Pro、GPT-5の高計算プロティアで、最も要求の厳しい推論と研究タスク向け。
Doubao · 画像
Volcano Engine image generation model
OpenAI · テキスト
OpenAI GPT-5 Nano、272Kコンテキスト。軽量な分類とルーティング向けの最小規模、最安価なモデル。
OpenAI · テキスト
OpenAI GPT-5 Mini、272Kコンテキスト。高ボリュームな日常タスク向けのコンパクトで手頃な価格のモデル。
OpenAI · テキスト
OpenAI GPT-5、272K 上下文 + 128K 出力。旧世代のフラッグシップで、強力なマルチモーダル、推論、コーディングを備えています。
Anthropic · テキスト
Anthropicのフラッグシップモデル Opus 4.8。コンテキストウィンドウは1M、出力は128K。深い推論と長期エージェントタスクに最適。思考機能はデフォルトでオンになっており、オフにすることも可能。
Zhipu · テキスト
智谱 GLM-4.7 Flashは、200Kコンテキストと128K出力を備えています。低コストで超高速の応答が可能で、高同時実行シナリオに最適です。
Anthropic · テキスト
Anthropic Claude Opus 4.7、200Kコンテキスト、複雑なエージェントタスク向けの深い推論とコーディング。思考機能はオンオフ可能。
Zhipu · テキスト
Zhipu GLM-4.7は、200Kの上下文ウィンドウと128Kの出力を備えています。能力とコストのバランスに優れた汎用の本番品質モデルです。
Anthropic · テキスト
Anthropic most capable model for coding and complex reasoning
Anthropic · テキスト
Most powerful model for highly complex tasks
Anthropic · テキスト
Anthropic Claude Opus 4.5, 200K context, a previous-generation flagship for highly complex tasks.
Anthropic · テキスト
Claude Haiku 4.5、200Kコンテキスト、極めて高速かつコスト効率が高く、高並行性の軽量タスクに最適。
Anthropic · テキスト
Anthropic Claude Sonnet 4.5、200K コンテキスト、コーディングと日常的な推論のバランスが取れた、以前の世代のモデル。
Grok · テキスト
xAI Grok 4.5、256Kコンテキスト。最新のGrokフラッグシップモデルで、最先端の推論、コーディング、リアルタイムデータアクセスを備えています。
Doubao · 画像
ByteDance Doubao Seedream 4.5、以前の世代のテキストから画像への変換および画像編集モデル、1枚ごとの課金。
Grok · テキスト
xAIの最新フラッグシップである1Mコンテキストウィンドウと1M出力を備えたGrok 4.3。Xプラットフォームからのリアルタイムデータを統合し、卓越した推論およびコーディング能力を備えています。
Grok · テキスト
Grok 4.20 multi-agent reasoning edition、2M context windowと2M outputを搭載した超長尺モデル。multi-step reasoningとlong-horizon agentsのトップチョイス。Thinkingはデフォルトでオンです。
Grok · テキスト
xAI Grok 4.1、256Kコンテキスト。強力な推論、コーディング、マルチモーダル理解を備えた汎用モデル。
OpenAI · テキスト
OpenAI GPT-4.1 Nano、コストを抑えつつ大量の軽量タスクを実行するための GPT-4.1 の最も小さいバリアント。
Grok · テキスト
Grok 4.1 Fast、コンテキストウィンドウは200万トークン。低コストで超高速応答。高並列の本番タスクに最適。
OpenAI · テキスト
OpenAI GPT-4.1, 1M context + 32K output. A previous-generation model strong at coding and instruction following.
OpenAI · テキスト
OpenAI GPT-4.1 Mini、日常タスクのスピードとコストのバランスを取る GPT-4.1 のコンパクトなバリアント。
DeepSeek · テキスト
DeepSeek-V4-Pro flagship model、1Mコンテキストウィンドウと384K出力を搭載。エージェント機能が大幅に強化され、豊富な世界知識を備えています。思考機能はデフォルトでオンになっており、オフにすることも可能です。
Grok · テキスト
Grok Code Fast は、プログラミングタスクに特化して最適化された高速版で、優れたコード生成および補完のスピードを誇ります。
Grok · テキスト
xAI Grok 4 Fast、高同時実行生産タスク向けの、より高速で低コストなGrok 4の変種。
DeepSeek · テキスト
DeepSeek-V4-Flashは、1Mコンテキストウィンドウと384Kの出力を備えています。より高速で経済的なAPIサービスを提供します。思考はデフォルトでオンになっており、オフにすることも可能です。
Grok · テキスト
Grok 4、256Kのコンテキストウィンドウを搭載。深い推論能力とマルチモーダルな理解力を提供し、複雑なエージェントタスクに適しています。
OpenAI · テキスト
Affordable and intelligent small model
OpenAI · ビジョン
OpenAI multimodal flagship model with vision support
Qwen · テキスト
Tongyiの最新フラッグシップモデルであるQwen3.8は、992Kのコンテキストウィンドウと64Kの出力を備えています。推論能力と多言語能力において優れており、複雑なタスクに適しています。
Qwen · マルチモーダル
Alibaba Qwen3.7 Plus、コストパフォーマンスに優れたマルチモーダルエージェントモデル。ビジョン言語機能が強化されています。GUI操作とビジュアル参照コード生成をサポート。コンテキスト長1M、出力長64K。デフォルトで思考機能有効。
Qwen · マルチモーダル
Qwen3.7 Flashは、1Mコンテキストと64K出力を備えたネイティブなマルチモーダル・フラッシュモデルです。3.6 Flashよりもマルチモーダル理解とエージェント実行が強化されています。
Qwen · テキスト
Alibaba Qwen3.7 Max、エージェント時代の次世代フラッグシップモデル。プログラミング、オフィス生産性、長期自律実行において優れた性能を発揮。1Mコンテキスト + 64K出力。デフォルトで思考機能有効。
Qwen · テキスト
Alibaba Qwen3.6 Max Preview、Qwen3.6シリーズの中で最も能力の高いモデル。コーディングとコーディングエージェントの能力が際立っています。256Kコンテキスト + 64K出力。⚠️ 10月10日に終了します。
Gemini · テキスト
Gemini 3.6 Flashは、Googleの最新のFlashモデルで、100万トークンのコンテキストウィンドウと64Kの出力を備えています。速度と品質のバランスに優れており、一般的な本番タスクに適しています。
Qwen · マルチモーダル
Alibaba Qwen3.6 Plus、ネイティブなビジョン言語 Plus モデル。エージェント型コーディング、フロントエンドプログラミング、マルチモーダル認識、OCR を強化。1M コンテキスト + 64K 出力。思考機能をサポート。
Qwen · マルチモーダル
Alibaba Qwen3.6 Flash、ネイティブなマルチモーダル Flashモデル。エージェント型コーディング、数学的推論、空間知能が強化されています。1Mコンテキスト + 64K出力。高速でコストパフォーマンスに優れています。
Qwen · テキスト
Qwen3.5 Flash、992Kコンテキスト + 64K出力。高並行性の本番タスク向けの超高速、低コストモデル。
Gemini · テキスト
Gemini 3.5 Flashは、1Mコンテキストウィンドウと64K出力を備えており、速度と品質のバランスに優れ、一般的な本番タスクに適しています。
Gemini · テキスト
Google Gemini 3.5 Flash Lite、1Mコンテキスト。極めて軽量で低コスト、高同時実行シナリオに最適。
Qwen · テキスト
Qwen3.5 Plusは、992Kのコンテキストウィンドウと64Kの出力を備えた汎用の本番稼働モデルです。性能とコストのバランスに優れています。
DeepSeek · テキスト
DeepSeek V3.2、128Kコンテキスト、推論と出力効率のバランスが取れており、日常業務や本番タスクに適しています。
DeepSeek · テキスト
DeepSeek V3.1、128Kコンテキスト。日常および本番タスク向けの、強力な推論と出力効率を兼ね備えたバランスの取れたモデル。
Gemini · 動画
Google Veo 3.1、高品質なテキストから動画への生成および動画から動画への生成(音声付き)、シネマティックな映像クリップに最適。
Gemini · 画像
Gemini 3.1 Flash 画像生成モデルは、強力なテキストから画像への生成および画像編集機能を備えています。マーケティング素材やデザイン支援に最適です。
Gemini · テキスト
Gemini 3.1 Pro Preview、コンテキストウィンドウは1M、出力は64K。Google DeepMindのフラッグシップモデルで、マルチモーダル理解と長コンテキスト推論においてリードしています。
Gemini · テキスト
Gemini 3.1 Flash Lite、コンテキストウィンドウ1M、出力64K。極めて軽量で低コスト、高同時接続シナリオに最適。
Grok · テキスト
xAI Grok 3, 128Kコンテキスト。前世代のフラッグシップで、強力な推論とリアルタイムのXプラットフォームデータを備えている。
Qwen · テキスト
Qwen3 235B、256Kコンテキスト。強力な汎用推論能力と多言語対応を備えた、フラッグシップなオープンウェイトMoEモデル。
Qwen · テキスト
Qwen3 Coder 480B、256Kコンテキスト。強力な多言語生成と長文コンテキストのコード理解を備えた、フラッグシップのオープンウェイトコーディングモデル。
DeepSeek · テキスト
DeepSeek OCR、画像およびスキャンされたドキュメントからテキストと構造を抽出するドキュメント理解モデルです。
Moonshot · テキスト
Kimi K3は、100万トークンのコンテキストウィンドウと128Kの出力を備えた、Moonshot AIの最新フラッグシップモデルです。先進的な推論、長文処理、コーディング能力を搭載しています。思考モードはデフォルトでオンになっており、オフにすることも可能です。
Qwen · ビジョン
Qwen3 VL 235B、128K コンテキスト。強力な画像、ドキュメント、OCR理解を備えたオープンウェイトマルチモーダルモデル。
MiniMax · テキスト
MiniMax M3は、100万トークンのコンテキストウィンドウと128K出力を備えた次世代のフラッグシップ言語モデルです。コーディングおよびエージェントベンチマークで業界をリードする結果を達成し、エージェント推論やツール呼び出しに最適化されています。
Qwen · テキスト
Qwen3 Coder Plusは、998Kのコンテキストウィンドウと64Kの出力を備えています。プログラミングタスクに特化して最適化されており、卓越した多言語コード生成と長文コード理解が可能です。
Qwen · ビジョン
Qwen3 VL Plus ビジョン理解モデル。260K コンテキストウィンドウをサポート。画像やドキュメントの理解、マルチモーダル推論を可能にします。
Gemini · テキスト
Google Gemini 3 Flash、1Mコンテキスト + 64K出力。汎用の本番タスク向けの、以前の世代の高速モデル。
Qwen · テキスト
Qwen3 Coder Flashは、998Kコンテキストウィンドウと64K出力を備えた、高並列なコード補完と生成に最適化された超高速コーディングモデルです。
DeepSeek · テキスト
Cost-effective model with strong coding ability
Gemini · 画像
Gemini 3 Pro 画像生成フラッグシップとして、高品質なテキスト生成画像と複雑な指示解析を提供します。プロフェッショナルなビジュアル制作に最適です。
Grok · テキスト
xAI Grok 3 Fast、高同時実行生産タスク向けの、より高速で低コストなGrok 3の変種。
MiniMax · テキスト
MiniMax M2.7、1Mコンテキスト。以前の世代の汎用モデルで、生産環境における能力とコストのバランスを重視したものです。
Moonshot · マルチモーダル
モーンショットAIの次世代フラッグシップモデル「Kimi K2.7」。マルチモーダル・マルチリンガル、256Kコンテキスト対応。長文処理とコーディング能力が傑出しています。思考機能はデフォルトでオンになっており、オフにすることも可能です。
Moonshot · テキスト
Moonshot AIの次世代モデル、Kimi K2.6は262Kコンテキストウィンドウを搭載しています。長文コンテキストとコーディング能力に優れています。思考機能はデフォルトでオンになっており、オフにすることも可能です。
MiniMax · テキスト
MiniMax M2.5、コンテキストウィンドウは1M。能力とコストのバランスを重視した汎用の本番運用向けモデル。
Moonshot · テキスト
Kimi K2.5、コンテキストウィンドウ262K。推論能力と出力速度のバランスに優れ、汎用的なエージェントタスクに適しています。思考モードはデフォルトでオンになっており、オフにすることも可能です。
Gemini · 埋め込み
Gemini Embedding 2、8K入力。テキストを高次元ベクトルに変換し、セマンティック検索およびRAGシナリオで使用します。
google · テキスト
Fast and versatile model with long context
google · ビジョン
Google most capable model with 1M context window
Gemini · テキスト
Google Gemini 2.5 Flash Lite、1Mコンテキスト。軽量な高ボリュームタスク向け、最も低コストなFlashバリアント。
OpenAI · 動画
OpenAI 视频生成专业版。
OpenAI · 動画
OpenAI 视频生成,文生/图生视频。
wan · 動画
单图+音频驱动,生成说话/唱歌/表演数字人视频。
wan · 動画
通过指令对视频进行编辑,支持局部/整体编辑、视频重塑、视频复刻等
wan · 動画
参考视频中的人或物,精准保持形象和声音,支持多参考合拍
wan · 動画
图片生成视频内容,稳定保持图像主体、风格和文字等细节信息
wan · 動画
文字生成视频内容,丝滑动态能力,电影美学控制,精准指令遵循
MiniMax · テキスト
MiniMax M2.1, 1Mコンテキスト。コスト効率を重視した大量の生産タスク向けの既存汎用モデル。
Doubao · テキスト
ByteDance Doubao Seed 2.1 Turbo、速度と品質のバランスに優れ、256Kコンテキスト、プロダクションタスクにコストパフォーマンスに優れています。
Doubao · テキスト
ByteDance Doubao Seed Evolving, rapid iteration model, 256K コンテキスト, 最新機能を継続的に更新。
Doubao · テキスト
ByteDance Doubao Seed 2.1 Pro、強化された能力を備えたフラッグシップモデル、256Kコンテキスト、強力な推論およびエージェント機能。
wan · 動画
多模态全能参考,灵活可控生成视频内容,轻松实现故事创作、创意表达、营销物料制作等
happyhorse · 動画
HappyHorse-Video-Edit支持视频编辑,自然语言指令编辑视频,可参考最多5张图片局部或全局编辑视频元素,能够精准复刻视频动态过程,实现更强表现能力。
Qwen · TTS
Qwen Audio 3.0 音声合成 Plus。高品質で自然な声。
Doubao · テキスト
ByteDance Doubao Seed Character、パーソナティの一貫性とキャラクターとの対話が強力なロールプレイ重視のモデル、256Kコンテキスト。
Doubao · 動画
ByteDance Doubao ビデオ生成モデル Seedance 2.0 Miniは、ビデオ生成と編集をサポートしており、ショート動画やモーショングラフィックスに最適です。
Doubao · 動画
ByteDance Doubao Seedance 2.0 Fast、Seedance 2.0の高速版で、低コストでの迅速な動画生成に対応。
happyhorse · 動画
Alibaba HappyHorse 1.1 R2V、最大9枚の参照画像をサポートする参照動画生成機能。より強い主題/シーン/スタイルの一貫性を備えています。秒単位課金。
Doubao · テキスト
Doubao Seed 2.0 Liteは、生成品質と応答速度のバランスを重視しており、非構造化情報処理、コンテンツ作成、データ分析などの本番業務に適しています。思考機能はデフォルトでオンになっており、オフにすることも可能です。
Doubao · テキスト
Doubao Seed 2.0 Miniは、超高速推論で、低レイテンシ、高同時実行、コスト重視のシナリオをターゲットにしています。思考機能はデフォルトでオンになっており、オフにすることも可能です。
Doubao · 3D
ByteDance Doubao 3D生成モデル Seed3D 2.0、画像から3Dへの生成、3Dアセットやゲームシーンのモデリングに最適です。
Doubao · 動画
ByteDance Doubao Seedance 2.0、高品質なテキストから動画への生成および動画から動画への生成、ショートシネマティック動画に最適。
Qwen · 画像
Tongyi Qwen 画像生成 3.0 Pro は、1K/2K 解像度のテキストから画像への生成と画像編集に対応し、入力画像と出力がそれぞれ課金されます。高品質なマーケティング資産やデザイン制作に最適です。
Qwen · 画像
Tongyi Qwen 画像生成 3.0 は、1K/2K 解像度のテキストから画像への生成と画像編集に対応したコストパフォーマンスに優れた選択肢です。
Doubao · 動画
新一代视频创作模型,单次 30 秒长叙事、全模态参考、视频编辑与延长。
Doubao · 3D
Hyper3D Gen2 by Yingmou (影眸科技)、Volcengine Ark でホストされている画像から3D生成。3Dアセットやゲームシーンのモデリングに最適。
fun · music
Tongyi 音楽生成。出力音声の秒数で課金。
Qwen · ASR
Qwen 音声認識 Flash。録音ファイルの文字起こし。
Qwen · ASR
Qwen Audio 3.0 音声認識 Flash。録音ファイルの文字起こし。
fun · TTS
CosyVoice 3.5 Plus 音声合成。多言語の高品質な声。
fun · TTS
CosyVoice 3.5 Flash 音声合成。高コストパフォーマンス。
Qwen · 埋め込み
最新の Qwen テキスト埋め込みモデル。検索と意味マッチングに適しています。
Qwen · テキスト
Tongyi Qwen 3.8 オープンソースフラッグシップ。2.4T パラメータの MoE(アクティブ 95B)、思考/非思考モード対応。
wan · 動画
Wan 動画顔交換:動画内の人物を置き換える、標準/プロモード。
Qwen · テキスト
Tongyi Qwen 3.8 オープンソース 27B Dense モデル、バランスの取れたコストパフォーマンス。
Qwen · テキスト
Qwen ロングコンテキストモデル、超長文コンテキスト向け。
Qwen · テキスト
Qwen 深層リサーチモデル。自動マルチステップ検索・分析・レポート生成。
Qwen · TTS
Qwen Audio 3.0 音声合成 Flash。低レイテンシで高コストパフォーマンス。
Qwen · ビジョン
Qwen OCR ビジョンモデル。文書認識と構造化情報抽出。
kling · 画像
Kling V3 画像生成。1K/2K/4K 解像度対応。
kling · 動画
Kling V3 動画生成。無音/音声ありと 720P/1080P/4K 解像度に対応。
wan · 動画
Wan 画像からモーション:参照モーションで人物動画を生成、標準/プロモード。
Doubao · 3D
Hitem3D 2.0 by Shumei (数美万物)、Volcengine Ark でホストされている画像から 3D を生成するモデルです。3D アセットやシーンのモデリングに最適です。
Doubao · テキスト
ByteDance Doubao Seed Code、コーディングに特化した強力な多言語生成とデバッグ機能を備えたモデル、256Kコンテキスト。
Qwen · 画像
Tongyi Wanxiang Qwen Image 2.0 Pro 画像生成モデルは、高品質なテキストから画像への生成と画像編集を提供します。マーケティング資産やデザイン制作に最適です。
happyhorse · 動画
Alibaba Cloud HappyHorse 1.1 T2V ビデオ生成モデル。ダイナミクス、テクスチャ、オーディオがアップグレードされたテキストから動画への生成機能。よりスムーズで自然なキャラクターの動きとシーンの雰囲気を実現。
happyhorse · 動画
Alibaba HappyHorse 1.1 I2V、テクスチャー、モーション、クロスクリップの一貫性が改善された画像から動画への生成。秒単位の課金。
Doubao · テキスト
ByteDance Doubao Seed Translation、高品質な多言語翻訳のための翻訳特化モデル、256Kコンテキスト。
Doubao · テキスト
Doubao Seed 2.0 Proは、強化されたマルチモーダル理解、長文コンテキスト推論、構造化生成、ツール実行を備えたフラッグシップ・オールラウンド汎用モデルです。思考機能はデフォルトでオンになっており、オフにすることも可能です。
Doubao · テキスト
Doubao Seed 2.0 Codeは、Seed 2.0のエージェントおよびVLMの能力を活かし、コーディング能力を強化しています。優れたフロントエンド開発と多言語対応を備えています。デフォルトで「思考なし」、オンデマンドで「深層思考」が利用可能です。
Doubao · テキスト
ByteDance Doubao Seed 1.8、軽量でコストパフォーマンスに優れたモデル、256Kコンテキスト、高並行シナリオに適しています。
Doubao · ビジョン
ByteDance Doubao Seed 1.6 Vision、旧世代のマルチモーダルビジョンモデル、256Kコンテキスト、画像とドキュメントの理解。
Doubao · テキスト
ByteDance Doubao Seed 1.6 Flash、1.6の超高速軽量バリアント、256Kコンテキスト、高同時実行シナリオに最適。
Doubao · テキスト
ByteDance Doubao Seed 1.6、以前の世代の汎用モデル、256Kコンテキスト、日常的なタスクにはコストパフォーマンスに優れています。
Doubao · ビジョン
ByteDance Doubao 1.5 Vision Lite、レガシー軽量マルチモーダルビジョンモデル、256Kコンテキスト、コストパフォーマンスに優れた画像理解。
Doubao · 動画
ByteDance Doubao Seedance 1.5 Pro、以前の世代のビデオ生成モデルで、音声と無音ビデオの出力をサポートしています。
Qwen · TTS
通义千问语音合成 Instruct Flash 版。
Qwen · TTS
通义千问语音合成 Flash 版。
Doubao · 埋め込み
Doubaoの大規模埋め込みモデルは、テキストを高次元ベクトル表現に変換し、意味検索やRAGシナリオに使用します。
Qwen · 埋め込み
Qwen3 Reranker 8Bは、品質の高いRAGを実現するために、検索されたドキュメントを関連性に基づいて再順序付けするオープンウェイトのリランキングモデルです。
Doubao · 埋め込み
画像とテキストの両方の入力をサポートするマルチモーダル埋め込みモデル、ByteDance Doubao Embedding Vision。
Qwen · テキスト
Qwen Turbo、1Mコンテキストウィンドウ、16K出力。極めて軽量で低コスト、高並列性のシンプルなタスクに最適。
Qwen · 埋め込み
Qwen3 Embedding 8Bは、セマンティック検索とRAGに高品質なベクトルを生成するオープンウェイトのテキスト埋め込みモデルです。
Doubao · TTS
High-quality text-to-speech model.
Doubao · 埋め込み
ByteDance Doubao Embedding、標準的なテキスト埋め込みモデル、セマンティック検索とRAG向けの高品質なベクトル表現。
Doubao · ASR
豆包流式语音识别模型 2.0,火山引擎语音团队基于大模型语音识别能力全新升级,依托业界领先的自研语音识别技术和海量的语音行业大数据优势,语音识别大模型拥有更加灵敏的耳朵+更加聪明的大脑。
Auto · テキスト
計算とモデルの組み合わせを品質と速度の両面でインテリジェントにマッチングするスマートルーティングモデル。ByteDanceおよびそのエコシステムから最新モデルへの早期アクセスを提供します。