Vidu

Vidu

Vidu是北京生数科技有限公司联合清华大学于2024年4月27日发布的中国首个长时长、高一致性、高动态性视频大模型,采用全球首个Diffusion与Transformer融合的U-ViT架构 (早于Sora的DiT方案),初始版本支持生成4秒、8秒的高动态性视频(分辨率达1080P),首批功能包括文生视频、图生视频及参考生视频 。该模型可精确模拟物理规律生成光影、人物表情等细节,支持多镜头切换及中国元素融合 ,2024年7月作为纯自研视频大模型全球上线后百日内用户突破千万,2025年1月发布的2.0版本将视频生成速度提升至10秒内并支持错峰免费生成,同期成为全球增速最快的AI视频模型 。截至2025年1月,平台累计生成视频数突破亿条 ,2025年10月升级为AI视频创作与分发一体化平台 。

Vidu核心技术U-ViT架构由团队于2022年9月提出,2023年3月开源验证可扩展性 。2024年6月支持32秒视频生成、音视频合成及4D生成功能 ,同年9月发布1.5版本新增“多主体一致性”功能实现多角色交互控制,并正式开放API接口 。2025年1月30日推出面向专业影视制作的Q3模型,支持16秒声画同出、多语言文字渲染,在国际AI基准测试中位列中国第一、全球第二 。2026年2月与万兴科技达成战略合作,共建AI漫剧工业化生产体系 。

模型迭代过程中,2024年7月30日全球上线时新增角色一致性、动漫风格等能力 ,2025年7月通过阿里云基础设施实现B端客户及调用量环比增长300% 。技术路线持续突破长视频处理能力,构建起涵盖视频生成、编辑到分发的全链路生态 。

想要了解更多“Vidu”的信息,请点击:Vidu百科

标签:Vidu,Vidu,历程