穿越与古人对话视频教学,AI仿真人短剧,包含提示词 | 新手入门避坑指南
核心要点
- 为什么这类内容突然火了
- 核心方法:三条落地路径
- 具体步骤:豆包+即梦从零到成片
- 第一步,写台词脚本
- 第二步,生成两个角色画面
- 第三步,让图片动起来并对上口型
为什么这类内容突然火了
我在短视频平台刷到过好几次古人和现代人同框对话的片段,评论区都在问是不是真拍的。其实这类内容不是实拍,而是AI仿真人短剧,利用生成式AI制作古人形象和口型,再配上现代感十足的对话。它好用的地方在于,一条视频几十秒,成本几乎为零,却能同时吃到历史、剧情和AI三个流量池。
但多数人卡在第一步:不知道用什么工具,也不知道提示词怎么架。这篇文章把我的实操经验完整写出来,你可以照着我试过的路子走,避开我踩过的坑。
核心方法:三条落地路径
我分别试过几条不同的制作路径,适合不同基础的人,列在下面供你选。
- 豆包+即梦组合:豆包负责写古风对话脚本、生成人物定妆照,即梦负责图生视频并生成对口型。这条路径画质稳定,现代语气的对话效果自然,适合既想要画面质量又不太会写提示词的人。
- 即梦+小云雀组合:即梦做画面,小云雀做文史类配音。小云雀的音色库里有偏书卷气的男声女声,配历史人物独白很贴脸,适合做正经科普向的穿越对话。
- 纯即梦单干:即梦本身就集成了角色对话配音,一个工具全流程跑通。上手快,但音色选择少一些,适合先跑通流程再做迭代。
如果你完全零基础,先走第三条,把流程跑通一次,再回去试前两条提升质感。
具体步骤:豆包+即梦从零到成片
下面按我实际操作的顺序写,你跟着一步步来。每步我尽量给出我踩过的关键细节。
第一步,写台词脚本
打开豆包对话窗口,输入下面这段提示词,让它生成一篇穿越对话脚本:
帮李白写一段穿越到现代的视频脚本。场景设定:李白醉酒醒来,发现自己站在城市天台上。请写一段他的内心独白,再加入一个来放风筝的小女孩和他的对话。要求:语言半文半白,带幽默感,最后一句要有反差。
脚本长度控制在100字以内,AI生成视频时长一般在5到10秒,太长的文案剪起来费劲。
第二步,生成两个角色画面
用即梦的图片生成功能,分别生成李白和现代小女孩的定妆照。建议提示词写法:
- 李白:唐朝诗人李白,月白色长袍,醉态,眼神迷离,站在现代城市天台,背景是高楼夜景,国风奇幻风格,半身景,高清。
- 小女孩:6岁中国女孩,休闲童装,手里拿着风筝,天台夜景,暖光,写实风格,半身景,高清。
在这个环节,你能得到两张静态图。生成之后别急着做视频,多生成几张选表情最自然的那张。
第三步,让图片动起来并对上口型
在即梦选择视频生成或对口型功能,上传上面两张图,把第一步豆包生成的那段台词粘贴进去,选择你想要的配音音色。等生成完成后,逐段查看。这里有个细节:分段生成的视频,每段的中文字幕要用同一字体同一字号,后面剪到一起才统一。
第四步,剪辑合成
把视频片段导入剪映,按顺序排列。旁白和台词音轨保留,背景氛围音加到15%音量左右,不要盖过人声。导出时选择1080p以上,码率选高一些,公众号和视频号都会优先推荐清晰度高的内容。
另一条快速路径:小云雀做文史对话
小云雀适合不喜欢折腾画面的人。它本质上是文字转语音工具,但它的音色和节奏控制得很好,适合做纯粹的知识口播。
我在做《杜甫与外卖小哥的深夜对话》时就用了它:先用豆包生成对话文本,再复制到小云雀里选好两位音色,AI会自动生成带情绪的双人朗读音频。下一步用即梦生成两张人物图,配上音频做成静止画面视频,视觉上做基础的缩放运镜就够了。
很多人容易忽略的一点是:做穿越对话,台词比画面重要。观众能接受画面稍微粗糙,但接受不了台词不生动。我建议把写脚本的时间比重从1/3提到一半以上。
避坑点,都是实战中遇到的问题
这几条是我反复调整后总结出来的,每条都有人反复踩。
- AI生成的古装人物面部容易崩,手指、发饰、衣袖变形特别常见。解决办法是:生成图片时多用“半身景”“面部特写”描述,避免全身,能显著减少畸变概率。
- 口型和音频对不上。如果AI对口型功能生成后有明显延迟,可以把文案拆得更碎,一句一生成,最后再拼接。
- 提示词里的朝代和职业别写死。写“唐朝诗人”AI可能给出不知道是谁的脸,直接写“诗歌爱好者李白”反而更像大家想象中的样子。
- 古风语气词会被AI夸张化。提示词里不要出现“之乎者也”这类词,AI会输出相对自然的半文半白,否则你会得到一版很像劣质古装剧的台词。
- 剪辑时不开字幕。字幕是这类视频被看懂的关键,藏到剪辑菜单里不导出字幕文件,发布时的观看率会差很多。
适合什么人做,需要多久入门
这活更适合这几类人:对AI视频工具不犯怵的短视频爱好者、做知识科普的自媒体人、历史老师或文化领域创作者。反过来说,如果你完全不愿意学剪辑软件,也不想记提示词,那这事对你就是负担,不必勉强。
时间上,学完这四个步骤大概半天;独立做出一条像样的视频,第一次可能花四五个小时,熟练后两小时一条很轻松。若是单纯用AI配音加图片轮播那种形式,半小时出一条都没问题。
我做这类内容两个月的观察
我自己的感受是,穿越对话这个形式最大的好处是让知识脱离PPT讲解的枯燥感,古代人物从书本里走出来,跟普通人聊天,观众容易产生亲切感。
同时也要提醒一句:题材不必只盯着李白杜甫这种被做滥了的大人物。我做过的几条数据,反响最好的一条是关于李清照和女外卖员的对话,比大历史话题更容易被推荐。
总结
用AI做穿越与古人对话的仿真人短剧,关键是拆成脚本、画面、配音、剪辑四步,各用合适的工具推进,别幻想一个App全自动搞定。先按我上面的流程走通一遍,再根据反馈优化你的提示词和选题。
你如果动手试了,你做的第一条穿越对话是什么题材?欢迎在评论区聊聊你的经验。
,内容基于实际经验整理。
常见问题解答
穿越与古人对话的视频怎么做?
主要思路是用AI写对话脚本,再用AI绘图工具生成古人形象,最后用图生视频和对口型工具合成动态画面。推荐路径是豆包写脚本、即梦出图并生成对口型,剪映做最后剪辑。流程跑通后,单条视频大概两到三小时能完成。
这个玩法适合什么人?
适合有表达欲的自媒体创作者、历史爱好者、知识科普博主,也适合给孩子做趣味历史启蒙的家长。前提是你愿意花点时间熟悉AI工具的操作逻辑。不太推荐对剪辑完全零兴趣的人尝试,过程会略显繁琐。
做一条AI仿真人穿越短剧需要多久?
第一次尝试建议留出半天时间,因为你得熟悉工具界面和提示词调整。制作一两次之后,配合模板化流程,纯操作时间可以压缩到两小时内;如果做最简版(不用对口型只加配音),半小时出片也完全可以。
AI仿真人视频生成对电脑配置有要求吗?
没有要求,所有运算都在云端完成。手机或普通电脑只要能打开网页、运行剪映这类剪辑工具就行。显卡和CPU跟视频生成速度无关。
提示词总是写不好怎么办?
先别追求一次到位,把提示词当成跟AI沟通的语言习惯来练。一个高效的做法是:固定结构——人物身份+外貌特征+环境设定+画面风格+镜头构图。套这个框架写,生成效果很快能稳定下来,你再根据产出结果微调描述词就行。