Step-Video-T2V
StepFun class B live
30B open-weights text-to-video model (~8s) with a deep-compression VAE; MIT-licensed, self-host plus free online demo.
Layer 1 — factual axes
Layer 2 — output quality
No independent measure yet. We publish a quality figure only when a named external benchmark ranks this model — we don’t invent one.
30B open-weights text-to-video model (~8s) with a deep-compression VAE; MIT-licensed, self-host plus free online demo.