用两张照片制作 AI 双人 Rap 视频
让两张人像照片进入橙色录音间,生成简短的双人表演。动作由 AI 生成,成片可以带音频。先选好希望出现在画面里的两个人,场景与表演指令已经准备好。
这种 AI Rap 视频制作方式适合你吗?
如果你想让两个人一起出现在录音间,由照片生成表情、手势和镜头运动,可以使用这个生成器。朋友之间的录音室玩笑、双人亮相,都适合简短的表演形式。当前输出为 8 秒、720p、16:9 横屏。
如果你已经有一首完整歌曲,想制作对应的音乐视频,需要规划音轨、多段镜头和剪辑时间线。当前预设没有歌曲上传、歌词输入或精确对口型控件,不能保证人物演唱指定段落或跟随已有节拍。
这里不需要选模型,也不需要自己写提示词。预设把两个人放进共同的表演场景,同时允许不同手势与互动。模板选择指南说明了它与固定动作模板、剪辑工程的区别。
从两张照片到保存成片
- 确定人物。 每位成年人使用一张清楚的照片,并获得制作许可。避免人群、过小的脸和挡住嘴部的物品。
- 检查预览。 打开生成器,添加两张图片,确认每个位置都是想使用的人。照片预览不代表视频已经生成。
- 查看消耗。 登录后检查余额与显示的生成积分要求。可购买的套餐在价格区。
- 提交后跟踪任务。 等待明确的完成或失败状态。如果连接中断,先检查最近视频,再决定是否另开任务。
- 播放并下载。 看完整段画面并听声音,再从任务记录保存可用版本。
短视频仍可能出现脸部保持不理想或手势不自然的情况。清楚的输入有助于减少歧义,但不能保证特定结果。上传和任务恢复问题可看详细制作教程。
音乐和人声如何生成?
视频模型可以同时生成声音。成片中可能听到伴奏、人声式表演或其他声音,但它不是可供选择的固定音轨,也可能没有音频。发布前必须实际播放,尤其要留意是否出现像是当事人说出的不合适内容。
预设要求原创音频,不包含原版 Hotel Lobby 录音,也不能输入指定歌词。付费生成并不代表选择了某首歌曲。配乐方案见歌曲与音频指南。
如果画面合适而声音不合适,可以保留画面。在剪辑工具中复制一份、静音原声音,再加入适合用途的音轨。替换后重新检查嘴部动作;换音轨不会重新生成表演,也不能自动修正对口型。
怎样准备适合手机分享的版本?
转换竖屏之前,先检查整段视频中两张脸的位置。把 16:9 画面裁满 9:16 屏幕,会丢失大量左右内容,容易裁掉其中一人。可以在竖屏画布中完整保留横屏视频,再利用上下空间放标题。
字幕尽量避开脸部和手部。比如“我们的想象录音室首秀”就能介绍情境。导出后在手机上检查第一帧、音量与结尾;只看剪辑软件里的预览,还不能确认最终文件是否合适。
写实的双人视频在发布前最好让两位参与者都看过,并说明是 AI 生成,让观众知道画面中的表演来自照片。关于误导性冒充和其他禁止用途,见本站内容政策。
怎样有针对性地改善下一版?
脸部不容易辨认: 替换对应的人像,使用更清晰、无遮挡的照片。先只改这一项,便于判断是否有改善。
竖屏版本少了一个人: 回到未裁剪的下载文件,选择保留两位表演者的布局。这可能是裁剪问题,不一定需要重新生成。
动作与参考视频不同: 当前预设创作新的表演。可以保留自然、连贯的版本;如果固定动作是必要条件,应选择支持参考动作的工具。
声音不合适: 先尝试编辑已保存视频的音轨,再决定是否重新生成画面。
任务一直处理中: 查看最近视频及最终状态后再提交。持续异常时,通过支持入口提供任务标识,不要在公开帖子中粘贴带签名的媒体链接。