为什么大家都在做AI古诗词动画?
古诗词天然具备画面感与情感张力,但传统动画制作门槛极高。我在实操中发现,Deepseek+即梦+可灵的组合几乎是为这类内容量身定制的:Deepseek负责把诗句转成分镜脚本和画面提示词,即梦擅长生成水墨、国风等符合诗词意境的插画,可灵则让画面产生微动效果。整个过程不需要美术基础,更不需要写代码。
做这类视频最怕的不是技术,而是思路混乱。很多人一上来就打开某个工具乱试,结果画面风格不统一、诗句与画面错位,做了3小时直接放弃。正确的做法是先把工具分工想清楚,再按流水线执行。
做AI古诗词动画,一套靠谱的方法是什么?
根据我的经验,一套完整的AI古诗词动画制作方法分为五个环节,任何一环缺失都会直接影响成片质感:
延伸阅读:Deepseek+即梦+可灵|AI古诗词动画制作实战课,全流程手把手教学
- 诗词拆解:将一首诗逐句拆出核心意象与情绪基调,例如“枯藤老树昏鸦”需提取“枯藤”“老树”“昏鸦”三个视觉元素与“萧瑟”基调。
- 脚本生成:让Deepseek将每个意象扩展为包含镜头景别、画面构图、色彩氛围的分镜格式提示词。
- 静态画面生成:用即梦配合国风/水墨类模型,按提示词逐帧生成高质量图片,这一步决定画面上限。
- 动态化:将即梦生成的静态图导入可灵,选中画面主体设置运动轨迹,让云动、水动、人物衣袂翻飞。
- 配音剪辑:用任意文字转语音工具朗读原诗或白话译文,配合背景音乐在剪辑软件中合成。
我强烈建议新手把70%的时间花在前两步,尤其是用Deepseek打磨提示词。很多人的画面不理想,80%的原因不是工具不行,而是喂给工具的提示词太模糊。提示词写得越具体,生图工具回报给你的画面就越精准。
全流程实操步骤:从一首诗到成片
下面以《静夜思》为例,梳理我测试过完整的制作步骤,你可以直接按这个顺序执行:
第一步:用Deepseek生成分镜与提示词
打开Deepseek,输入这段指令:“你是一位中国风动画导演,请将《静夜思》拆解为4个分镜,每个分镜包含:画面内容描述、景别(远景/中景/特写)、光线氛围、色彩参考、动态元素。请直接用中文回答,提示词用一行表述,方便我复制到生图工具。” 这时Deepseek会输出结构化的分镜表。如果对某一镜不满意,直接说“第二镜改成俯视视角,强调月光倒影”即可反复调整,直到满意为止。
第二步:用即梦生成静态画面
打开即梦,在模型选择中优先选“图片2.0”或国风/水墨类专用模型。将Deepseek给出的分镜提示词逐条粘贴到即梦的输入框,比例统一设为9:16(竖屏)或16:9(横屏)。每句提示词生成4张候选图,选择最符合诗意的一张。这里有个关键细节:所有分镜必须锁定同一个风格关键词,例如统一使用“宋代院体画、墨色为主、淡彩渲染”。否则每张图风格漂移,整条片子看起来像拼盘。
第三步:用可灵做局部动态化
将即梦生成的图片导入可灵,选择图生视频功能。这里别指望整张图都动起来,而是只让局部元素动。比如静夜思的画面,让月亮周围的云缓慢飘动、床前的帘子轻轻晃动即可。参数设置上,运动幅度建议选“3-5”这个区间,太高容易画面扭曲,太低又感觉不动。时长可控在5秒左右,太长了AI容易崩坏。
第四步:剪辑合成与节奏搭配
将动态片段导入剪映,按诗词朗诵的节奏排列。我常用的方法是先配音、后铺画面,也就是先录好诗的朗诵音频,再根据每句的朗读时长去匹配分镜片段,这样能最大程度规避画面与声音错位的问题。最后加上字幕和合适的背景音乐,导出即可。
新手最容易踩的四个坑
这些坑我自己都踩过,完全避开,基本就能平稳度过新手期:
- 不做风格锁定就批量生成:画风不统一,整条视频像PPT拼盘。做法是在每条提示词后固定追加风格词。
- 提示词里堆砌过多元素:一首诗不是百科全书,画面里塞满元素会导致主题涣散。中文AI绘画更适合做减法,只保留最具辨识度的2-3个核心意象。
- 动态幅度调得太大:古诗动画讲究意境留白,动态幅度过大会让画面显得廉价。控制在小幅度范围,让水面、云雾、树叶呈现呼吸感即可。
- 忽视字幕字体与排版:诗词动画的字幕直接决定观感,不要用默认的宋体或黑体,尝试书法字体并加上半透明底框,观感立刻不一样。
还有一个很多人容易忽略的细节:在Deepseek生成分镜时,直接要求它给出“完整提示词长文本”,而不是让它输出散文描述。这两者的差异是,前者可以无修改直接塞进生图工具,后者需要你二次加工,非常浪费时间。
AI古诗词动画适合什么人?需要多久?
根据我的观察,最适合做这类内容的人是国学/语文类自媒体运营、幼教老师、知识区创作者。素材是公共版权不会侵权,赛道竞争远低于影视解说,同时天生适配短视频的完播率需求。零基础的小白跟着一套流程走,通常1-2小时就能完成第一支20秒左右的成品。学得快的人一周内可以将单支制作时间压缩到30分钟以内。但如果你想用这件事赚取可观收益,瓶颈往往不在制作,而在选题与审美。
常见问题
这里集中回答几个大家在实操过程中高频遇到的问题:
1. 提示词到底该怎么写才算合格?
一个合格的AI古诗词画面提示词,至少包含主体元素、风格限定、氛围色调、构图景别四个要素。例如“一位古装仕女的背影剪影,宋代院体画风格,清冷蓝色调,巨大的月亮作为背景,特写镜头”就是一段合格的提示词。
2. 用即梦生成图总是出现多根手指或畸形怎么办?
尽量避开人物近景或特写镜头。古诗词动画本来就更适合全景、中景构图,既规避了AI绘画的畸形重灾区,也更贴合古诗留白的意境。若必须拍人物,建议让人物背身、侧身或处于画面一角,可显著降低畸形概率。
3. 可灵和即梦的会员成本高吗?
这个问题敏感,我换个角度说:即梦每天登录可以获取一定数量的免费额度,可灵对新用户也有体验点数。如果你做得比较频繁,可以考虑按需选择基础档位;但在动手前先确认你有足够的时间去消耗额度,生成废片是非常消耗时间的。
总结
AI古诗词动画的核心方法论可以浓缩为一句话:Deepseek定分镜,即梦出画面,可灵做动态。新手掌握这套流程,完成第一支作品通常只需要一个下午。真正拉开差距的地方在于对诗词意象的提炼与独特的审美选择。
如果你最近也在研究AI古诗词动画,欢迎在评论区聊一聊:你做的第一首诗是哪一首?卡在了哪一步?我这边还有不少关于画面风格调配和剪辑节奏的经验,感兴趣的话可以继续交流。
本文更新于 2026-08-11,内容基于实际经验整理。
本网站的部分内容可能来源于网络或用户投稿,仅供大家学习与参考,如有侵权,请联系客服: hhxmw778 进行删除处理。
本站一切资源不代表本站立场,并不代表本站赞同其观点和对其真实性负责。
教程如引导您添加微信或有另外收费服务,请自行甄别!
如遇充值环节或绑定支付账户或输入支付密码之类的异常步骤,建议停止操作!本站不对操作项目的损失负责!
本站一律禁止以任何方式发布或转载任何违法的相关信息,访客发现任何资源有问题请向站长举报下架
(手机微信用户建议用默认浏览器打开,可体验完整功能)