我用Vidu S2找来乔布斯,跟他聊了聊iPhone Duo
来源:凤凰网 2 小时前

最近, APPSO 观看了国内首场 AI 艺人线下演唱会,效果非常惊艳,但略有遗憾的是,主角 Yuri 尤栗和观众互动的方式是在大屏幕上打字,要是她能像真人歌手那样和观众实时互动,让我们点歌,和我们玩一些小游戏,那该多有趣啊。

现在,这样能实时生成和编辑的视频已经出现了。

当大部分视频生成模型还在卷时长、卷清晰度、算完再看的离线生成赛道厮杀时,生数科技刚刚发布的 Vidu S2 已经把战场直接拉到了边看边改的实时操控领域。

Vidu S2 的能力分为两部分, S2-Avatar 和 S2-Editing:

S2-Avatar,实时交互模型。面向实时数字人互动,支持 720p 高清输出,增强动作指令遵循与人物表演能力;可在直播过程中输入参考图,根据指令完成持品互动、换服装和换背景。

S2-Editing,实时编辑模型。 面向正在流动的视频画面,支持实时修改风格、服装、人物主体与背景,为直播、虚拟演绎和互动内容提供即时视觉编辑能力。

APPSO 第一时间进行了评测,我们发现:Vidu S2 将实时数字人互动进一步拓展到实时视频编辑,让数字人的表现更丰富、交互控制更灵活,也让正在进行的视频画面拥有了更多可编辑空间。

AI 视频终于边播边改了

Vidu S2-Avatar 对舞蹈、特定手势、情绪微表情的理解能力大幅提升,只需通过语音或文本指令即可驱动高质量动作,比如摆臂、扭身、踏步和抬腿等动作。

用户可以上传各种图片,比如真人照片、动漫形象或者可爱的宠物图片,从而创建出一个数字人物。

启用麦克风和摄像头权限后,便可以与所创建的角色对话。你可以在视频流进行中的任意时刻,加入物品、服装或背景图片:让角色拿起图中的杯子,换上指定服装,或进入新的场景,输出分辨率同步提升至 720p。

最近,iPhone 首款折叠屏手机成了科技圈最火的话题,同样也伴随着巨大争议,有外媒为 iPhone Duo 再现了布斯时代的惊艳,有人则认为创新不足。

我也很好奇,如果乔布斯能够重新站在我们面前,看到今天的 iPhone Duo,他会怎么评价?

所以这次我直接在 Vidu S2 里创建了一个乔布斯数字人。

创建方式并不复杂,我给了它一张乔布斯的全身参考图,同时补充了一份比较完整的角色描述,包括他的性格、表达方式,以及对于产品、设计和用户体验的态度。

我比较在意的一点,是模型最后生成出来的不能只是一个长得像乔布斯的人,交流和行为上也要尽可能维持住这个角色。

角色建立完成之后,我问乔布斯数字人 iPhone Duo 达到你的预期了吗?。

这考验的是:实时数字人能不能结合自己的人设,对眼前的产品做出符合角色逻辑的回应,而不是突然变成一个普通的 AI 助手。

实际体验下来,这种感觉还挺奇妙的。

简体中文 English