Seedance 2.0
ByteDance
ByteDance's video generation model (2026), powering the Dreamina/Doubao platforms. Seedance 2.0 accepts quad-modal inputs (text, image, video, audio) and features a 'Universal Reference' system that locks composition, camera movement, and character actions across shots for consistent multi-shot sequences.
Strengths
- Quad-modal inputs: text, image, video, and audio
- Universal Reference locks composition and character actions across shots
- Strong multi-shot consistency
- Native audio in generated video
- Backed by ByteDance's serving scale
Caveats
- Proprietary - API/app access only
- Served mainly via third-party API partners
- Newer ecosystem than Western incumbents
- Vendor
- ByteDance
- License
- Proprietary
- Modalities
- videoaudio
Capabilities
Vision
Audio
Video
Tool Use
Resources
Pricing
Per-generation pricing via API partners (fal, Replicate) and ByteDance consumer apps (Dreamina, Doubao).