Model modalitas penuh × peningkatan Harness, buka pengalaman Agent baru
OpenAI · Teks
GPT-5.6 Terra, model kelas menengah dalam seri 5.6, dengan jendela konteks 272K dan output 128K. Performa yang seimbang untuk tugas produksi umum.
OpenAI · Teks
GPT-5.6 Sol, model unggulan OpenAI dalam seri 5.6, dengan jendela konteks 272K dan output 128K. Penalaran tingkat atas, pemahaman multimodal, dan kemampuan coding.
OpenAI · Teks
GPT-5.6 Luna, model yang cepat dan efisien secara biaya dalam seri 5.6, dengan jendela konteks 272K dan output 128K. Ideal untuk skenario konkurensi tinggi dan sensitif biaya.
OpenAI · Teks
OpenAI GPT-5.5 Pro, high-compute pro tier GPT-5.5 untuk penalaran frontier paling menuntut.
OpenAI · Teks
Flagship terbaru OpenAI, GPT-5.5, dengan jendela konteks 272K dan output 128K. Memimpin dalam pemahaman multimodal, penalaran, dan pengodean.
OpenAI · Teks
OpenAI GPT-5.4 Mini, varian kompak dari GPT-5.4 yang menyeimbangkan biaya dan kemampuan untuk tugas sehari-hari.
OpenAI · Teks
GPT-5.4, dengan jendela konteks 272K dan output 128K. Pendahulu dari GPT-5.5, menawarkan performa yang seimbang untuk tugas produksi umum.
OpenAI · Teks
OpenAI GPT-5.4 Pro, tingkatan pro berkinerja tinggi dari GPT-5.4 untuk beban kerja penalaran yang menuntut.
OpenAI · Teks
OpenAI GPT-5.4 Nano, varian terkecil dari GPT-5.4 untuk tugas ringan hemat biaya dan volume tinggi.
OpenAI · Teks
GPT-5.3 Instant, dengan jendela konteks 272K dan output 128K. Versi ultra-cepat yang menyeimbangkan kualitas dan kecepatan, ideal untuk skenario yang sensitif terhadap biaya.
Zhipu · Teks
Zhipu's latest flagship GLM-5.3, with major advances in complex software engineering and agent tasks. Same base model as GLM-5.2, all gains from post-training: 50% coding improvement and emergent cybersecurity / vulnerability-discovery capability. 1M context, 128K output, always-on thinking (reasoning_effort: low/high/max).
OpenAI · Teks
GPT-5.3 Codex, yang dioptimalkan khusus untuk tugas pemrograman, dengan penghasilan kode jangka panjang yang menonjol dan pengeditan berkas terkoordinasi multi-file.
OpenAI · Teks
GPT-5.2, dengan jendela konteks 272K dan output 128K. Flagship generasi sebelumnya, pilihan serbaguna untuk tanya jawab sehari-hari, pembuatan konten, dan coding ringan.
Zhipu · Teks
Flagship terbaru Zhipu, GLM-5.2, dengan jendela konteks 1M dan output 128K. Unggul dalam tugas jangka panjang dan konsisten menempati peringkat teratas di berbagai benchmark otoritatif. Gunakan nama model glm-latest untuk mengakses versi terbaru.
OpenAI · Teks
OpenAI GPT-5.2 Pro, tingkat pro berkinerja tinggi dari GPT-5.2 untuk penalaran lanjutan dan riset.
OpenAI · Teks
OpenAI GPT-5.2 Codex, varian yang dioptimalkan untuk coding dari GPT-5.2 dengan generasi kode multi-file yang kuat.
OpenAI · Teks
OpenAI GPT-5.1, 272K konteks + 128K output. Model umum generasi sebelumnya untuk tugas produksi sehari-hari.
Zhipu · Teks
Zhipu GLM-5.1, dengan jendela konteks 200K dan output 128K. Pendahulu dari GLM-5.2, dengan kemampuan penalaran dan coding yang seimbang.
Anthropic · Teks
Claude Opus 5, model flagship terbaru Anthropic dengan jendela konteks 1M dan output 128K. Kemampuan deep reasoning, coding, dan agen generasi berikutnya. Thinking aktif secara default dan dapat dimatikan.
Anthropic · Teks
Claude Sonnet 5, dengan jendela konteks 1M dan output 128K. Keseimbangan terbaik untuk coding dan tugas agen sehari-hari. Thinking aktif secara default dan dapat dimatikan.
OpenAI · Teks
OpenAI GPT-5 Codex, dioptimalkan untuk pemrograman dengan generasi kode multi-bahasa yang mengesankan dan agentic coding.
Anthropic · Teks
Claude Fable 5, dengan jendela konteks 1M dan output 128K. Opsi kelas menengah yang menyeimbangkan kemampuan dan biaya, dengan thinking aktif secara default.
Zhipu · Teks
Zhipu GLM-5 Code, dioptimalkan khusus untuk tugas pemrograman, dengan kemampuan generasi kode multi-bahasa dan debugging yang unggul.
Doubao · Gambar
ByteDance Doubao Seedream 5.0 Pro, model teks-ke-gambar dan edit gambar berkualitas tinggi, pemahaman adegan Tiongkok yang kuat.
OpenAI · Teks
OpenAI GPT-5 Pro, tingkatan pro berkomputasi tinggi dari GPT-5 untuk tugas penalaran dan risiko yang paling menuntut.
Doubao · Gambar
Volcano Engine image generation model
OpenAI · Teks
OpenAI GPT-5 Nano, 272K konteks. Model terkecil dan termurah untuk klasifikasi ringan dan perutean.
OpenAI · Teks
OpenAI GPT-5 Mini, 272K konteks. Model kompak dan terjangkau untuk tugas sehari-hari dengan volume tinggi.
OpenAI · Teks
OpenAI GPT-5, 272K konteks + 128K output. Generasi sebelumnya yang flagship dengan multimodal yang kuat, penalaran, dan coding.
Anthropic · Teks
Flagship Opus 4.8 dari Anthropic, dengan jendela konteks 1M dan output 128K. Pilihan teratas untuk deep reasoning dan tugas agen jangka panjang. Thinking diaktifkan secara default dan dapat dimatikan.
Zhipu · Teks
Zhipu GLM-4.7 Flash, dengan jendela konteks 200K dan output 128K. Respons ultra-cepat dengan biaya rendah, cocok untuk skenario konfigurasi tinggi.
Anthropic · Teks
Anthropic Claude Opus 4.7, 200K konteks, penalaran mendalam dan coding untuk tugas agen kompleks. Berpikir dapat diaktifkan/nonaktifkan.
Zhipu · Teks
Zhipu GLM-4.7, dengan jendela konteks 200K dan output 128K. Model produksi kelas umum yang menyeimbangkan kemampuan dan biaya.
Anthropic · Teks
Anthropic most capable model for coding and complex reasoning
Anthropic · Teks
Most powerful model for highly complex tasks
Anthropic · Teks
Anthropic Claude Opus 4.5, 200K konteks, sebuah flagship generasi sebelumnya untuk tugas-tugas yang sangat kompleks.
Anthropic · Teks
Claude Haiku 4.5, 200K konteks, kecepatan ekstrem dan efisiensi biaya, ideal untuk tugas ringan dengan konkurensi tinggi.
Anthropic · Teks
Anthropic Claude Sonnet 4.5, 200K konteks, seimbang dalam coding dan penalaran sehari-hari, model generasi sebelumnya.
Grok · Teks
xAI Grok 4.5, 256K konteks. Grok flagship terbaru dengan penalaran, coding, dan akses data real-time yang unggul.
Doubao · Gambar
ByteDance Doubao Seedream 4.5, model generasi sebelumnya untuk teks-ke-gambar dan pengeditan gambar, per-image billing.
Grok · Teks
Flagship terbaru xAI, Grok 4.3, dengan jendela konteks 1M dan output 1M. Mengintegrasikan data real-time dari platform X, dengan kemampuan penalaran dan pengkodean yang menonjol.
Grok · Teks
Grok 4.20 edisi multi-agent reasoning, dengan jendela konteks ultra-long 2M dan output 2M. Pilihan terbaik untuk multi-step reasoning dan agen jangka panjang. Thinking aktif secara default.
Grok · Teks
xAI Grok 4.1, 256K konteks. Model umum dengan penalaran yang kuat, pemrograman, dan pemahaman multimodal.
OpenAI · Teks
OpenAI GPT-4.1 Nano, varian terkecil dari GPT-4.1 untuk tugas ringan berkinerja tinggi dengan volume besar dan biaya rendah.
Grok · Teks
Grok 4.1, dengan jendela konteks 2M. Respons ultra-cepat dengan biaya rendah, ideal untuk tugas produksi dengan konkurensi tinggi.
OpenAI · Teks
OpenAI GPT-4.1, 1M konteks + 32K output. Model generasi sebelumnya yang kuat dalam pengkodean dan mengikuti instruksi.
OpenAI · Teks
OpenAI GPT-4.1 Mini, varian kompak dari GPT-4.1 yang menyeimbangkan kecepatan dan biaya untuk tugas sehari-hari.
DeepSeek · Teks
Model flagship DeepSeek-V4-Pro dengan jendela konteks 1M dan output 384K. Kemampuan agen yang ditingkatkan secara signifikan dan pengetahuan dunia yang kaya. Thinking aktif secara default dan dapat dimatikan.
Grok · Teks
Grok Code Fast, versi cepat yang dioptimalkan khusus untuk tugas pemrograman, dengan kecepatan generasi dan penyelesaian kode yang luar biasa.
Grok · Teks
xAI Grok 4 Fast, varian yang lebih cepat dan biayanya lebih rendah dari Grok 4 untuk tugas produksi dengan konkurensi tinggi.
DeepSeek · Teks
DeepSeek-V4-Flash, dengan jendela konteks 1M dan output 384K. Menyediakan layanan API yang lebih cepat dan lebih hemat. Berpikir aktif secara default dan dapat dimatikan.
Grok · Teks
Grok 4, dengan jendela konteks 256K. Menawarkan pemahaman multimodal dan penalaran mendalam, sangat cocok untuk tugas agen yang kompleks.
OpenAI · Teks
Affordable and intelligent small model
OpenAI · Visi
OpenAI multimodal flagship model with vision support
Qwen · Teks
Flagship terbaru Tongyi, Qwen3.8, dengan jendela konteks 992K dan output 64K. Unggul dalam kemampuan penalaran dan multibahasa, sangat cocok untuk tugas kompleks.
Qwen · Multimodal
Alibaba Qwen3.7 Plus, model agen multimodal hemat biaya dengan kemampuan vision-language yang ditingkatkan. Mendukung operasi GUI dan generasi kode referensi visual. 1M konteks + 64K output. Berpikir diaktifkan secara default.
Qwen · Multimodal
Qwen3.7 Flash, model Flash bahasa visi asli dengan konteks 1M dan output 64K. Pemahaman multimodal dan eksekusi agen yang ditingkatkan dibandingkan 3.6 Flash.
Qwen · Teks
Alibaba Qwen3.7 Max, model flagship generasi berikutnya untuk era agen. Unggul dalam pemrograman, produktivitas kantor, dan eksekusi otonom jangka panjang. Konteks 1M + output 64K. Berpikir diaktifkan secara default.
Qwen · Teks
Alibaba Qwen3.6 Max Preview, model paling canggih dalam seri Qwen3.6. Kemampuan coding dan coding agent yang menonjol. 256K konteks + 64K output. ⚠️ Mengundurkan diri pada 10 Oktober.
Gemini · Teks
Gemini 3.6 Flash, model Flash terbaru Google dengan jendela konteks 1M dan output 64K. Menyeimbangkan kecepatan dan kualitas, sangat cocok untuk tugas produksi umum.
Qwen · Multimodal
Alibaba Qwen3.6 Plus, model bahasa-vision native Plus. Upgrade agentic coding, pemrograman frontend, pengenalan multimodal dan OCR. 1M konteks + 64K output. Mendukung thinking.
Qwen · Multimodal
Alibaba Qwen3.6 Flash, model vision-language Flash asli. Ditingkatkan coding agentic, penalaran matematika, dan kecerdasan spasial. 1M konteks + 64K output. Cepat dan hemat biaya.
Qwen · Teks
Qwen3.5 Flash, 992K konteks + 64K output. Model ultra-cepat dan biaya rendah untuk tugas produksi dengan tingkat konkurensi tinggi.
Gemini · Teks
Gemini 3.5 Flash, dengan jendela konteks 1M dan output 64K. Menyeimbangkan kecepatan dan kualitas, sangat cocok untuk tugas produksi umum.
Gemini · Teks
Google Gemini 3.5 Flash Lite, 1M konteks. Sangat ringan dan biaya rendah, ideal untuk skenario tingkat konkurensi tinggi.
Qwen · Teks
Qwen3.5 Plus, dengan jendela konteks 992K dan output 64K. Model berkinerja tingkat produksi yang bersifat umum dan menyeimbangkan kemampuan serta biaya.
DeepSeek · Teks
DeepSeek V3.2, 128K konteks, penalaran dan efisiensi output yang seimbang, cocok untuk tugas sehari-hari dan produksi.
DeepSeek · Teks
DeepSeek V3.1, 128K konteks. Model yang seimbang dengan penalaran yang kuat dan efisiensi output untuk tugas harian dan produksi.
Gemini · Video
Google Veo 3.1, pembuatan teks-ke-video dan video-ke-video berkualitas tinggi dengan audio, ideal untuk klip sinematik.
Gemini · Gambar
Model generasi gambar Gemini 3.1 Flash dengan kemampuan text-to-image dan pengeditan gambar yang kuat. Cocok untuk aset pemasaran dan asisten desain.
Gemini · Teks
Gemini 3.1 Pro Preview, dengan jendela konteks 1M dan output 64K. Model flagship Google DeepMind, unggul dalam pemahaman multimodal dan penalaran konteks panjang.
Gemini · Teks
Gemini 3.1 Flash Lite, dengan jendela konteks 1M dan output 64K. Sangat ringan dan biaya rendah, ideal untuk skenario konfigurasi tinggi.
Grok · Teks
xAI Grok 3, 128K konteks. Generasi sebelumnya yang flagship dengan penalaran kuat dan data real-time platform X.
Qwen · Teks
Qwen3 235B, konteks 256K. Model MoE open-weight terkemuka dengan kemampuan penalaran umum yang kuat dan multibahasa.
Qwen · Teks
Qwen3 Coder 480B, 256K konteks. Model coding open-weight flagship dengan generasi multi-bahasa yang kuat dan pemahaman kode long-context.
DeepSeek · Teks
DeepSeek OCR, sebuah model pemahaman dokumen yang mengekstrak teks dan struktur dari gambar dan dokumen terpindai.
Moonshot · Teks
Kimi K3, model flagship terbaru dari Moonshot AI dengan jendela konteks 1M token dan output 128K. Penalaran mutakhir, pemrosesan konteks panjang, dan kemampuan coding. Thinking diaktifkan secara default dan dapat dimatikan.
Qwen · Visi
Qwen3 VL 235B, 128K konteks. Model multimodal open-weight dengan pemahaman gambar, dokumen, dan OCR yang kuat.
MiniMax · Teks
MiniMax M3, model bahasa generasi berikutnya dengan jendela konteks 1M dan output 128K. Mencapai hasil terbaik di industri pada pengujian coding dan agen, sangat cocok untuk penalaran agen dan pemanggilan alat.
Qwen · Teks
Qwen3 Coder Plus, dengan jendela konteks 998K dan output 64K. Dioptimalkan secara khusus untuk tugas pemrograman, dengan penghasilan kode multi-bahasa yang menonjol dan pemahaman kode jangka panjang.
Qwen · Visi
Model pemahaman visi Qwen3 VL Plus dengan jendela konteks 260K. Mendukung pemahaman gambar dan dokumen, serta penalaran multimodal.
Gemini · Teks
Google Gemini 3 Flash, 1M konteks + 64K output. Model cepat generasi sebelumnya untuk tugas produksi umum.
Qwen · Teks
Qwen3 Coder Flash, dengan jendela konteks 998K dan output 64K. Model pemrograman ultra-cepat yang sangat cocok untuk pelengkapan dan generasi kode dengan konfigurasi tinggi.
DeepSeek · Teks
Cost-effective model with strong coding ability
Gemini · Gambar
Produk unggulan generasi gambar Gemini 3 Pro, menghadirkan teks-ke-gambar berkualitas tinggi dan pemrosesan instruksi kompleks. Sangat cocok untuk pembuatan visual profesional.
Grok · Teks
xAI Grok 3 Fast, varian yang lebih cepat dan lebih murah dari Grok 3 untuk tugas produksi dengan konfigurasi tinggi.
MiniMax · Teks
MiniMax M2.7, 1M konteks. Model umum generasi sebelumnya yang menyeimbangkan kemampuan dan biaya untuk produksi.
Moonshot · Multimodal
Moonshot AI next-generation flagship model Kimi K2.7, multimodal multilingual 256K context. Kemampuan unggulan dalam konteks panjang dan coding. Thinking aktif secara default dan dapat dimatikan.
Moonshot · Teks
Model generasi berikutnya dari Moonshot AI, Kimi K2.6, dengan jendela konteks 262K. Kemampuan konteks panjang dan coding yang menonjol. Thinking diaktifkan secara default dan dapat dimatikan.
MiniMax · Teks
MiniMax M2.5, dengan jendela konteks 1M. Model umum siap produksi yang menyeimbangkan kemampuan dan biaya.
Moonshot · Teks
Kimi K2.5, dengan jendela konteks 262K. Menyeimbangkan kemampuan penalaran dengan kecepatan output, sangat cocok untuk tugas agen umum. Mode berpikir aktif secara default dan dapat dimatikan.
Gemini · Embedding
Gemini Embedding 2, dengan input 8K. Mengubah teks menjadi vektor berdimensi tinggi untuk skenario pencarian semantik dan RAG.
google · Teks
Fast and versatile model with long context
google · Visi
Google most capable model with 1M context window
Gemini · Teks
Google Gemini 2.5 Flash Lite, 1M konteks. Varian Flash termurah untuk tugas berkinerja ringan dengan volume tinggi.
OpenAI · Video
OpenAI 视频生成专业版。
OpenAI · Video
OpenAI 视频生成,文生/图生视频。
wan · Video
单图+音频驱动,生成说话/唱歌/表演数字人视频。
wan · Video
通过指令对视频进行编辑,支持局部/整体编辑、视频重塑、视频复刻等
wan · Video
参考视频中的人或物,精准保持形象和声音,支持多参考合拍
wan · Video
图片生成视频内容,稳定保持图像主体、风格和文字等细节信息
wan · Video
文字生成视频内容,丝滑动态能力,电影美学控制,精准指令遵循
MiniMax · Teks
MiniMax M2.1, 1M konteks. Model umum berbasis warisan untuk tugas produksi berkinerja tinggi dan berkapasitas besar yang sensitif terhadap biaya.
Doubao · Teks
ByteDance Doubao Seed 2.1 Turbo, keseimbangan kecepatan dan kualitas, konteks 256K, hemat biaya untuk tugas produksi.
Doubao · Teks
ByteDance Doubao Seed Evolving, model dengan iterasi cepat, konteks 256K, terus diperbarui dengan kemampuan terbaru.
Doubao · Teks
ByteDance Doubao Seed 2.1 Pro, flagship dengan kemampuan yang ditingkatkan, konteks 256K, kemampuan penalaran dan agen yang kuat.
wan · Video
多模态全能参考,灵活可控生成视频内容,轻松实现故事创作、创意表达、营销物料制作等
happyhorse · Video
HappyHorse-Video-Edit支持视频编辑,自然语言指令编辑视频,可参考最多5张图片局部或全局编辑视频元素,能够精准复刻视频动态过程,实现更强表现能力。
Qwen · TTS
Sintesis suara Qwen Audio 3.0 Plus, suara alami berkualitas tinggi.
Doubao · Teks
ByteDance Doubao Seed Character, model berorientasi peran dengan konsistensi persona dan interaksi karakter yang kuat, konteks 256K.
Doubao · Video
Model generasi video ByteDance Doubao Seedance 2.0 Mini, mendukung generasi video dan penyuntingan, ideal untuk video pendek dan grafik gerak.
Doubao · Video
ByteDance Doubao Seedance 2.0 Fast, varian yang lebih cepat dari Seedance 2.0 untuk pembuatan video yang cepat dengan biaya lebih rendah.
happyhorse · Video
Alibaba HappyHorse 1.1 R2V, reference-to-video generation yang mendukung hingga 9 gambar referensi, dengan konsistensi subjek/skenario/gaya yang lebih kuat. Penagihan per detik.
Doubao · Teks
Doubao Seed 2.0 Lite menyeimbangkan kualitas generasi dengan kecepatan respons, sangat cocok untuk pekerjaan produksi seperti pengolahan informasi tidak terstruktur, pembuatan konten, dan analisis data. Berpikir aktif secara default dan dapat dimatikan.
Doubao · Teks
Doubao Seed 2.0 Mini menargetkan skenario dengan latensi rendah, konkurensi tinggi, dan sensitif terhadap biaya dengan inferensi yang sangat cepat. Thinking diaktifkan secara default dan dapat dimatikan.
Doubao · 3D
ByteDance Doubao model generasi 3D Seed3D 2.0, image-to-3D, cocok untuk aset 3D dan pemodelan adegan game.
Doubao · Video
ByteDance Doubao Seedance 2.0, pembuatan teks-ke-video dan video-ke-video berkualitas tinggi, ideal untuk video sinematik pendek.
Qwen · Gambar
Model generasi gambar Tongyi Qwen 3.0 Pro, mendukung teks-ke-gambar resolusi 1K/2K dan pengeditan gambar, dengan penagihan terpisah untuk input dan output. Cocok untuk aset pemasaran berkualitas tinggi dan pembuatan desain.
Qwen · Gambar
Model generasi gambar Tongyi Qwen 3.0, mendukung teks-ke-gambar resolusi 1K/2K dan pengeditan gambar. Pilihan yang hemat biaya.
Doubao · Video
新一代视频创作模型,单次 30 秒长叙事、全模态参考、视频编辑与延长。
Doubao · 3D
Hyper3D Gen2 oleh Yingmou (影眸科技), image-to-3D generation yang dihosting di Volcengine Ark. Cocok untuk aset 3D dan pemodelan adegan game.
fun · music
Generasi musik Tongyi, ditagih per detik audio yang dihasilkan.
Qwen · ASR
Pengenalan suara Qwen Flash untuk transkripsi file audio.
Qwen · ASR
Pengenalan suara Qwen Audio 3.0 Flash untuk transkripsi file audio.
fun · TTS
Sintesis suara CosyVoice 3.5 Plus, suara multibahasa berkualitas tinggi.
fun · TTS
Sintesis suara CosyVoice 3.5 Flash, hemat biaya.
Qwen · Embedding
Model embedding teks Qwen terbaru, cocok untuk retrieval dan pencocokan semantik.
Qwen · Teks
Model unggulan open-source Tongyi Qwen 3.8, MoE 2.4T parameter (95B aktif), mendukung mode berpikir dan non-berpikir.
wan · Video
Wan pertukaran wajah video: mengganti karakter dalam video, mode standar/pro.
Qwen · Teks
Model dense open-source Tongyi Qwen 3.8 27B, pilihan seimbang dan hemat biaya.
Qwen · Teks
Model konteks panjang Qwen, dirancang untuk skenario konteks ultra panjang.
Qwen · Teks
Model riset mendalam Qwen, dengan pencarian multi-langkah, analisis, dan pembuatan laporan otomatis.
Qwen · TTS
Sintesis suara Qwen Audio 3.0 Flash, latensi rendah dan hemat biaya.
Qwen · Visi
Model visi Qwen OCR untuk pengenalan dokumen dan ekstraksi informasi terstruktur.
kling · Gambar
Generasi gambar Kling V3 dengan resolusi 1K/2K/4K.
kling · Video
Generasi video Kling V3, mendukung tanpa suara/beraudio dan resolusi 720P/1080P/4K.
wan · Video
Wan gambar-ke-gerakan: menghasilkan video potret dengan gerakan referensi, mode standar/pro.
Doubao · 3D
Hitem3D 2.0 by Shumei (数美万物), generasi gambar ke 3D yang dihosting di Volcengine Ark. Ideal untuk aset 3D dan pemodelan adegan.
Doubao · Teks
ByteDance Doubao Seed Code, model yang dioptimalkan untuk coding dengan kemampuan generasi dan debugging multi-bahasa yang kuat, konteks 256K.
Qwen · Gambar
Tongyi Wanxiang Qwen Image 2.0 Pro image generation model, menyediakan pembuatan gambar teks-ke-gambar dan pengeditan gambar berkualitas tinggi. Cocok untuk aset pemasaran dan pembuatan desain.
happyhorse · Video
Model pembuatan video T2V Alibaba Cloud HappyHorse 1.1. Text-to-video dengan dinamika, tekstur, dan audio yang ditingkatkan. Gerakan karakter dan atmosfer adegan yang lebih lancar dan alami.
happyhorse · Video
Alibaba HappyHorse 1.1 I2V, image-to-video generation dengan tekstur, gerakan, dan konsistensi cross-clip yang ditingkatkan. Penagihan per detik.
Doubao · Teks
ByteDance Doubao Seed Translation, model terjemahan khusus untuk terjemahan multibahasa berkualitas tinggi, konteks 256K.
Doubao · Teks
Doubao Seed 2.0 Pro, model flagship umum serbaguna dengan pemahaman multimodal yang ditingkatkan, penalaran konteks panjang, generasi terstruktur, dan eksekusi alat. Berpikir aktif secara default dan dapat dimatikan.
Doubao · Teks
Doubao Seed 2.0 Code membangun pada kemampuan agen dan VLM Seed 2.0 untuk memperkuat pemrograman, dengan hasil front-end yang luar biasa dan dukungan multi-bahasa. Tidak berpikir secara default, dengan pemikiran mendalam yang tersedia sesuai permintaan.
Doubao · Teks
ByteDance Doubao Seed 1.8, model ringan dan hemat biaya, konteks 256K, cocok untuk skenario dengan tingkat konkurensi tinggi.
Doubao · Visi
ByteDance Doubao Seed 1.6 Vision, sebuah model visi multimodal generasi sebelumnya, konteks 256K, pemahaman gambar dan dokumen.
Doubao · Teks
ByteDance Doubao Seed 1.6 Flash, varian ultra-cepat dan ringan dari 1.6, konteks 256K, ideal untuk skenario high-concurrency.
Doubao · Teks
ByteDance Doubao Seed 1.6, sebuah model umum generasi sebelumnya, konteks 256K, hemat biaya untuk tugas sehari-hari.
Doubao · Visi
ByteDance Doubao 1.5 Vision Lite, model visi multimodal ringan warisan, konteks 256K, pemahaman gambar yang hemat biaya.
Doubao · Video
ByteDance Doubao Seedance 1.5 Pro, model generasi video generasi sebelumnya yang mendukung audio dan output video tanpa suara.
Qwen · TTS
通义千问语音合成 Instruct Flash 版。
Qwen · TTS
通义千问语音合成 Flash 版。
Doubao · Embedding
Doubao's large-scale embedding model mengubah teks menjadi representasi vektor berdimensi tinggi untuk skenario pencarian semantik dan RAG.
Qwen · Embedding
Qwen3 Reranker 8B, reranker berbobot terbuka yang mengurutkan ulang dokumen yang diambil berdasarkan relevansi untuk RAG yang lebih berkualitas.
Doubao · Embedding
ByteDance Doubao Embedding Vision, model embedding multimodal yang mendukung input gambar dan teks.
Qwen · Teks
Qwen Turbo, dengan jendela konteks 1M dan output 16K. Sangat ringan dan murah, cocok untuk tugas sederhana berkonkurensi tinggi.
Qwen · Embedding
Qwen3 Embedding 8B, model embedding teks dengan bobot terbuka yang menghasilkan vektor berkualitas tinggi untuk pencarian semantik dan RAG.
Doubao · TTS
High-quality text-to-speech model.
Doubao · Embedding
ByteDance Doubao Embedding, model teks bawaan, representasi vektor berkualitas tinggi untuk pencarian semantik dan RAG.
Doubao · ASR
豆包流式语音识别模型 2.0,火山引擎语音团队基于大模型语音识别能力全新升级,依托业界领先的自研语音识别技术和海量的语音行业大数据优势,语音识别大模型拥有更加灵敏的耳朵+更加聪明的大脑。
Auto · Teks
Model perutean cerdas yang secara cerdas mencocokkan kombinasi komputasi dan model di seluruh kualitas dan kecepatan. Dapatkan akses awal ke model terbaru dari ByteDance dan ekosistemnya.