/ 新闻

Vidu Q4 Preview发布:推动旗舰视频模型大规模应用落地

发布时间:2026-10-08 18:52:43

摘要:人物演绎、镜头语言与复杂视效全面升级;支持最多15张参考图、3段参考音频,支持2K、4K输出,首发0.09元/秒起。

2026年10月8日,生数科技发布新一代视频生成旗舰模型的首个预览版本——Vidu Q4 Preview,主打“传神表现力”。


新模型围绕人物演绎、镜头语言与复杂视效三项核心能力升级,最多支持 15 张参考图、3 段参考音频,并提供 2K、4K 输出。首发优惠价格低至 0.09 元/秒起,推动旗舰视频生成进入以“分”为单位计价的区间。

随着 AI 视频从技术展示走向实际生产,行业竞争也走向高品质视频技术的大规模落地应用:人物表演与镜头叙事是否能承载高品质影视创作需求,以及创作者能否以合理成本持续试错。

生数科技联合创始人、CEO骆怡航表示:“前沿视频模型不应该只在精选样片里成立。每一次效率提升,都应该最终变成创作者多试一镜、多做一个版本的自由。”

人物表演能力升级,角色呈现更自然

人物表演是视频生成中最具挑战性的能力之一。Q4 Preview 重点提升表情、情绪与肢体动作之间的协调性,让眼神、停顿、微表情与动作变化更加自然,既能呈现文戏中的细腻情绪,也能表现武戏中的高速动作与对抗。

声音也进一步参与角色塑造。模型最多支持 3 段参考音频,可保持人物音色统一,并通过语气、语速和情绪增强表演感染力。同时,最多 15 张参考图可以组合人物、场景、服装、道具和商品等视觉元素,为剧情短片、漫剧和商业广告等复杂创作提供更强的控制能力。


镜头语言再升级,复杂视效融入叙事

Q4 Preview进一步提升动态运镜、切镜与复杂镜头衔接能力。在追逐、奔跑、打斗等高动态场景中,镜头可以更好地配合人物动作与叙事节奏;爆炸、烟火、粒子和能量等复杂视效,也更加注重与人物、空间和剧情的结合。

2K、4K输出,10bit 色深,则覆盖从创意测试到高清内容交付的不同需求。

0.09元/秒起,让创作拥有更多尝试空间

视频创作天然需要反复尝试。同一句台词可以尝试不同情绪,一场动作戏可以更换不同机位,一支广告也往往需要测试多个创意版本。

Vidu Q4 Preview首发优惠价格为 0.09 元/秒起,提供 540P、720P、1080P、2K、4K 等多种输出规格。在可比规格与计费条件下,同等预算可生成 5 倍内容。同时,模型持续优化推理效率与生成速度,降低多轮创作中的时间和成本。

对广告、电商团队而言,可以更高频地完成创意测试和素材迭代;对短剧、漫剧和影视团队而言,也可以更快验证人物表演、分镜和镜头节奏。


技术路线持续演进,Q4进一步强化“表现力”

Q4 Preview延续了生数科技在视频生成领域的技术路线。

2022 年,生数科技核心团队提出 U-ViT 架构;2024 年 4 月,Vidu 首次公开亮相。此后,Vidu 持续推进参考生视频、多主体一致性、生成效率与成本优化。从Vidu 2.0 到 Q 系列,模型逐步具备多镜头叙事、声画同出和复杂运镜等能力。Q4 Preview 模型则进一步聚焦人物表演、镜头语言与视觉特效,形成新一代“传神旗舰”。

视频生成与具身智能,共同指向世界模型

放眼 AI 行业,通用人工智能公司的技术探索正从语言和内容生成,进一步延伸到空间理解、世界建模和具身智能。

生数科技也在沿着这一方向持续投入。作为一家通用世界模型公司,其一端是面向数字世界的视频生成模型 Vidu,另一端是面向物理世界的世界动作模型 Motubrain。

在这条技术路线中,视频生成与具身智能并非彼此割裂:一个生成世界,一个在世界中行动。

免责声明:本文为转载,非本网原创内容,不代表本网观点。其原创性以及文中陈述文字和内容未经本站证实,对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。

如有疑问请发送邮件至:bangqikeconnect@gmail.com