Vidu用于从文字、图片和参考素材生成动画、真人短片与广告视频。它的多主体参考能力允许创作者分别指定人物、动物、商品或场景,再在提示词中用名称安排这些主体的动作与关系,减少连续镜头里角色外观和场景元素反复变化的问题。Vidu Q3还支持智能切镜与最长16秒音画同出,网页、移动App和开放API则分别面向个人创作、随身制作与产品集成。
用多主体参考组织角色与场景关系
参考生视频可以从多张图片提取主体或场景,并生成保持这些元素一致的视频。使用主体调用时,创作者可为每个图片或文字主体设置名称,再通过“@主体名”在提示词中安排谁出现、做什么以及彼此如何互动;Q3系列最多可在一项任务中使用七个图片或文字主体。对于漫剧、连续广告和角色短片,这比只提供一张首帧更适合管理多人镜头。
16秒音画同出与智能切镜
Vidu Q3参考生模式可同时生成画面和声音,并把音频细分为人声加音效、仅人声或仅音效。Q3与Q3 Turbo支持3至16秒时长,模型可在一个片段中智能切换机位。创作者可以把台词、旁白、动作和镜头节奏写入同一份提示词,直接得到带声音的叙事镜头。
参考视频可传递动作并参与画面编辑
Vidu Q2 Pro允许把视频作为主体或生成参考,让新人物沿用参考片段中的动作,也能进行视频编辑与元素替换。非主体调用支持一个较长参考片段或两个短参考片段,图片与视频还可组合使用。这个入口适合动作迁移、人物替换和已有素材改版,而不必逐帧重新设计表演。
文生图生与首尾帧覆盖不同起点
没有素材时可从文字描述生成视频;已有角色图、商品图或场景图时可使用图生视频;需要明确镜头起点和落点时,则可同时提供首帧和尾帧。各模式支持设置画幅、时长、清晰度和动态幅度,创作者可以根据最终发布渠道与镜头用途选择输入方式。
主体库复用人物形象与音色信息
开放平台提供主体的创建、查询和修改接口,可保存主体名称、参考图片或视频、风格描述及音色信息。后续生成时通过主体ID调用已有资产,不需要每次重新组织全部参考材料。对于系列短片和固定角色账号,这套主体库有助于在多个任务中复用人物设定。
Vidu Agent从一句需求展开完整作品
官网将Vidu Agent定位为从一句话需求开始协作完成作品的创作入口。它与单镜头生成工具并列,适合先说明主题和交付目标,再由Agent串联内容规划与多模态生成;需要精细控制某个镜头时,仍可回到参考生、图生或文生视频模式处理。
Vidu S1支持边对话边生成互动画面
Vidu S1面向实时互动场景,强调在对话发生时同步生成和更新画面。它服务的任务与预先提交提示词、等待完整视频生成不同,更适合互动角色、虚拟陪伴和需要即时视觉反馈的应用。官网同时说明该功能会针对连续使用和高风险对话设置相应的安全提醒与干预机制。
网页App与API对应不同创作规模
个人用户可通过Vidu网页或iPhone、Android App完成创作,移动端还包含创意社区与Remix入口。企业和开发团队可以使用开放平台,通过Token调用文生视频、图生视频、参考生视频、首尾帧、图片和音频等接口,并用任务ID查询结果或配置回调地址接收状态变化。
从主体参考到生成一段叙事镜头
- 确定镜头目标:先写清人物、场景、动作、台词和镜头节奏,判断是否需要多主体一致性或音画同出。
- 选择生成入口:从网页或App进入创作,按素材情况选择文生视频、图生视频、首尾帧或参考生视频。
- 准备主体素材:为人物、商品和场景分别上传参考图片,需要复用时将其保存到主体库并设置易识别的名称。
- 编写带主体标记的提示词:用“@主体名”安排各主体的动作、位置和互动,并补充台词、旁白、运镜与切镜节奏。
- 设置画面和声音:选择时长、画幅、分辨率与模型,并决定生成完整音频、仅人声或仅音效。
- 检查生成结果:重点核对角色外观、动作连接、切镜时机和音画关系,再调整提示词或参考素材重新生成。
漫剧广告社媒内容与互动角色的用法
AI漫剧连续镜头:把主要角色保存为多个主体,在不同分镜中重复调用,并用音画同出生成台词和环境声。
真人与动画短片:用首尾帧规划镜头过渡,或用参考视频迁移动作,再通过智能切镜完成一段多机位表演。
商品广告制作:上传商品和模特参考图,在提示词中固定包装、人物和场景关系,生成横屏或竖屏广告素材。
社交媒体创作:在移动App中从文字或照片开始生成短片,并使用社区Remix基于已有创意继续修改。
互动数字角色:将Vidu S1用于需要实时对话与画面反馈的角色体验,或通过开放API把生成能力接入自有产品。
用户评价与讨论
暂无评价,来发表第一条评价吧。