Binubuo ng ByteDance ang mga sistema ng AI na makakagawa ng video sa real time na may spatial awareness. Ang parent company ng TikTok ay ginawa ang world models, na kumakapal ng real-time interactive video at 3D-aware generation, bilang pangunahing prioridad ng AI para sa 2026.
Ang mga teknikal na pundasyon
Ang Seed research team ng ByteDance ay patuloy na naglalabas ng mga bagong bersyon. Ang Seedance 2.0 ay ipinakilala noong Pebrero 2026 na may pagkakakilanlan sa physics-accurate multimodal generation. Pagkatapos ay dumating ang Seedance 2.5 noong Hulyo 31, na higit pang pinagpalawig ang hangganan gamit ang 30-segundong audio-video clips sa isang pagkakataon, mas mainam na spatial controls, at isang clay-render referencing system para sa 3D motion planning.
Isang papel sa arXiv na ipinakilala noong around August 24 ay naglalaman ng autoregressive adversarial post-training, o AAPT. Ang modelo na ilarawan sa papel ay makakagawa ng video sa 24 frames per second na may mababang latency, at nagpapalabas ng coherent na output na nagtatagal ng isang minuto.
Bago ang Seedance 2.5, ang ByteDance ay nagsalba na ng Helios, isang open-weight model na nakamit ang halos 19.5 fps para sa mga video na may haba ng isang minuto na tumatakbo sa isang GPU. Ang Helios ay ipinakilala noong Marso 2026.
Kasama rin sa pakete ang interactive controls. Tinatanggap ng mga sistema ang pose at camera inputs, na nagpapahintulot sa mga aplikasyon tulad ng virtual human generation kung saan ang mga user ay maaaring direkta ang output kaysa mag-prompt lamang.
Mga mundo model at ang Genie 3 benchmark
Noong Hunyo 2026, inayos ng ByteDance ang world models bilang pangunahing tulong sa AI. Ang inihayag na layunin ay makapareho ng Google’s Genie 3, isang benchmark para sa interactive world simulation.
Ang ByteDance ay naglalagay ng seryosong pera sa pagsisikap na ito. Ang mga budget para sa training data ng mga world model ay umabot na sa eight figures sa RMB.
Ang MultiMedia Lab ng kumpanya ay parehong komersyalisasyon ng 4D at 6DoF (six degrees of freedom) spatial video pipelines para sa volumetric content. Ang mga sistema na ito ay nagdadala ng parehong live at on-demand spatial experiences, na may napapansin na pag-unlad sa pag-deploy mula sa huling bahagi ng 2025 hanggang 2026.
