AI剧情短片怎么做?一套7步实战方法,零基础半天出片
用即梦做一支2分钟以内的AI剧情短片,按”豆包写剧本→定角色场景→拆关键分镜→写视频提示词→Seedance全能参考生成→配音配乐→剪映合成”七步走,零基础半天能出片。 不用懂导演、不用会剪辑软件,只要你能把自己脑子里的想法说清楚。下面把这套方法完整拆开,每一步都带可以直接抄的提示词。
这套方法我自己完整跑过几遍,最大的体会是:做AI剧情短片,卡住人的从来不是工具,而是故事和画面怎么表达。工具操作都很简单,难的是你给AI的信息够不够具体。你说清楚想要什么故事,它就能写好剧本;你说清楚想要什么画面,它就能生成视频;说不清楚,它只能给你一个”平均值”。
一、先搞清楚:从想法到成片的完整链路
很多人以为做AI短片的流程是”脚本拆镜→每个镜头生成静帧→静帧转视频→剪辑成片”,每个画面都要单独生成。现在完全不用这么麻烦,链路已经简化成七步:
故事脚本 → 关键角色图+场景图 → 关键分镜图 → 视频提示词 → 生成视频片段 → 配音配乐 → 剪辑成片
关键变化在于:分镜图不再是”逐镜头生产素材”,而是用来”锁定角色、场景和关键画面”。其他过渡镜头、连续动作、运镜和衔接,都交给AI生成视频时自动完成。这正好解决了以前AI视频最大的毛病——人物前后长得不一样。
工具只需要三个,各管一段:
- 豆包(doubao.com):写故事剧本、分镜脚本、提示词,全程免费
- 即梦(jimeng.jianying.com):生成图片、视频、配音配乐,免费用户每天领积分
- 剪映(capcut.cn):最后剪辑合成,基本功能免费
二、第一步:用豆包写剧本,先过三幕结构这一关
做剧情短片,要解决的第一件事不是画面,是故事。你不用会编剧,哪怕只有一个模糊想法——一个人物、一个场景、甚至一句话——都能靠AI展开成完整故事。
所有好故事都能拆成三段:
- 第一幕·建置:交代人物、环境与目标,一个事件打破平衡,引出核心冲突
- 第二幕·对抗:主角不断行动,遭遇越来越大的阻碍,冲突升级产生转折
- 第三幕·解决:主角作出关键选择,核心冲突解决,故事形成结果
简单说就是:问题出现→主角应对→问题解决。这个结构不用背,下面的提示词里已经写好了。
打开豆包新建对话,把这套”AI编剧助手”提示词完整贴进去:
# 短视频剧情短片编剧
## 创作目标
根据用户提供的原创想法或现成文本,生成一个适合2分钟以内短片的完整故事。
## 基础设定
成片时长:控制在2分钟以内,剧情集中,避免冗余支线
形式:单部独立短片
## 创作方法
采用经典的三幕故事结构:建置→对抗→解决
第一幕|建置(Setup):交代人物、环境与目标,通过一个事件打破原有平衡,引出核心冲突。
第二幕|对抗(Confrontation):主角为实现目标不断采取行动,却遭遇越来越大的阻碍,冲突升级并产生转折。
第三幕|解决(Resolution):主角面对最终挑战,作出关键选择,核心冲突得到解决,故事形成结果。
## 故事核心
核心主题:故事最终想表达的情感或价值(成长、亲情、陪伴、梦想、传承、救赎、勇气等)
核心冲突:故事主线最大矛盾(人与家人、人与自己、人与命运、正邪对抗等)
情感钩子:能够让观众产生共鸣的关键情绪点(遗憾、等待、告别、重逢、误解、守护等)
核心看点:选择1-2种主要吸引力(温情反转/成长蜕变/宿命感/历史共鸣/神话想象/悬疑揭秘)
## 角色设定
核心主角:姓名+年龄+身份背景+外在目标+性格特质+内心执念+核心弱点+最终成长变化
关键配角1:身份+与主角关系+性格特点+剧情作用
关键配角2(可选):根据故事需要增加
特殊意象载体(按需):萌宠/信物/古物等,用于连接人物关系、推动剧情
## 创作要求
1. 开篇30秒内必须快速建立人物、环境或冲突,不允许长篇背景介绍
2. 故事围绕一个核心矛盾展开,不添加无关支线
3. 剧情节奏短平快,每个情节都推动人物变化或主题表达
4. 台词自然口语化,拒绝空洞说教
5. 结尾必须设置情感释放、反转或留白,提高记忆点
6. 优先选择简单场景、有限角色、容易实现的剧情设计
## 输出格式
1. 作品标题
2. 一句话故事(完整概括人物、情境、行动、冲突和结果)
3. 按三幕结构的故事脚本
## 用户输入
用户提供原创想法或现成文本
发送后,豆包会等你说你的想法。你的想法一两句话就够了,比如:
我是一只叫年糕的小橘猫,在我的视角,我那上初三的小主人总是奇奇怪怪,很可笑。从猫咪的视角去写,增加年糕OS旁白贯穿全文。
第一版剧本出来后,别急着往下走。读一遍,哪里不满意直接追问让它改。比如场景太少、总在一个房间里,就追一句”增加镜头调度:别总在一个房间里说故事,要让角色移动起来”;结尾不够打动人,就补一句”结尾的年糕OS需要升华一下——小主人陪年糕长大,年糕也在用自己的方式陪小主人长大”。
剧本不是一次生成出来的,是在一轮轮追问里打磨出来的。 围绕人物、冲突、情节、节奏、旁白和结尾,改到你自己满意为止。
三、第二步:锁定角色和场景,先解决”AI换脸”问题
故事定了,接下来把文字变成画面。这一步要准备两类核心视觉资产:
- 关键角色图:锁定人物长相、服装、主体一致性
- 关键场景图:锁定重要场景、构图和光线
先让豆包梳理:回到对话窗口,说”根据短片剧本内容,梳理本次创作所需人物角色设定与场景背景素材,为AI画面生成提供完整视觉参考依据”,再把定稿剧本贴进去。豆包会列出需要生成哪些角色图和场景图。
然后让豆包写生图提示词:
参考以下内容,写出生图提示词,仅做参考,不需要完全一致,
按照三个提示词整体布局可以修改,光影默认夜晚灯光,正常色调,
注意质感和美感,要求符合一个家庭的风格,简单不复杂,
符合即梦生成格式,请写出提示词:
【加入前面对应的角色整理素材】
打开即梦「图片生成」,选生图模型,把提示词贴进去生成角色图。注意这里要确定画风——写实风、2D动画风、3D动画风都行,只要在提示词里标清楚,后面所有图片和视频都要保持同一画风。
逐张生成调整,挑一张满意的当角色的”定妆照”。然后还需要一份多角度视图,这是让AI在不同镜头里认得出同一个角色的关键。上传定妆照作为参考,输入这段提示词:
严格依据上传的参考图,制作一份专业的角色参考表。使用干净、中性的纯白背景,
将参考表做成技术模型多角度展示图,严格匹配参考图视觉风格。构图分上下两横排:
上排四个全身站姿视图并排,顺序:正面视图、左侧面视图、右侧面视图、背面视图。
下排三幅高细节特写肖像,顺序:正面肖像、左侧面肖像、右侧面肖像。
所有视图角色形象完全一致,角色放松A字站姿,光照统一,画面清晰锐利。
用同样的方法生成场景图。不满意就直接选中素材说你想怎么改。出来的图还能进一步放大到4K清晰度。两个小技巧:可以把固定角色和背景融合成新图,也可以去掉人物单独得到干净背景图——后面换场景都用得上。
四、第三步:拆关键分镜,只生成”场景切换第一帧”
角色和场景定了,把剧本拆成具体画面。注意:不需要每个镜头都生图,只锁定几个关键分镜——重要场景、关键动作、情绪节点。其他过渡交给AI生成视频时自己补,效果反而更自然。
让豆包拆:贴入”影视分镜导演”提示词:
# 影视分镜导演
## 创作目标
你是专业影视分镜导演,根据完整剧本拆解AI视频生成所需的分镜关键帧。
请根据剧情节奏自动判断分镜数量。每个分镜提炼两个关键帧:
- 起始关键帧:分镜开始时的画面状态
- 结束关键帧:分镜结束时的画面状态
若某个分镜包含明显转折或重要情绪变化,可增加中间关键帧。
## 基础规则
- 不改变原剧本,不增加新剧情
- 每个分镜只表现一个主要事件或连续动作
- 每个关键帧只描述一个清晰、可冻结的画面瞬间
- 前后关键帧衔接自然,人物、服装、场景保持一致
- 关键帧描述以画面内容为主,不加摄影参数
## 输出格式
分镜1|分镜标题
分镜内容:该分镜发生的主要剧情
关键帧1|起始画面
画面描述
关键帧2|结束画面
画面描述
## 完整剧本
【粘贴你的定稿剧本】
发送后豆包会把故事拆成若干个分镜,每个分镜都有清晰的画面描述。判断哪些帧值得提前生图,有个简单标准:场景切换的第一帧。 每换一个新场景(从客厅到书房、从室内到窗边),第一帧的构图和光线先定好;走路、转头、拿东西这类过渡动作,交给AI自己补。
生成关键帧图片时:打开即梦「图片生成」,每次都要上传角色参考图和场景图作为参考,把豆包的关键帧描述当提示词。如果场景里有多个角色,标注清楚”参考图1为XX,参考图2为XX”。不满意就多跑几次或微调提示词。
五、第四步:让豆包写15秒视频提示词
关键帧图片准备好了,每个分镜要配一段视频生成提示词。这一步也不用自己写,继续让豆包生成:
依据剧本、关键帧参考图,写一段15秒的视频提示词。严格沿用以下格式:
电影级质感,专业精修调色,构图完美,唯美场景
(00:00 - 00:15)| 章节小标题
15s BGM乐章:【氛围关键词】
0-5s(起):音乐/音效描述
5-10s(承):音乐/音效描述
10-14.5s(转):音乐/音效推向高潮
14.5-15s(合):重击收尾+残响
画面与细节调度:
0-6s:运镜+画面+微细节
6-11s:运镜+画面+微细节
11-15s:运镜+画面+微细节
【对白轴】:
人物:台词
要求:
- 运镜仅限即梦适配词汇:Crash Zoom极速推镜、Whip Pan极速甩镜、
微距特写、升格慢动、高位俯拍、越肩俯拍、仰拍、特写、硬切等
- 对白简洁
- 衔接动作贴合前后关键帧,保证画面连贯
- 仅输出分镜内容
以下是用户输出的关键帧:
【粘贴你的对应分镜的关键帧描述】
以下是剧本旁白(如有,台词不要删减):
【粘贴你的对应段落的台词】
这段提示词其实藏着一套通用思路,以后做任何片子都能用:“风格+画面+运镜+声音”四块组织提示词——先定画风(电影级质感这类通用词锁定整体视觉),再定BGM乐章的起承转合,再定每段时间里的画面内容和镜头怎么动,最后定谁在什么时候说什么台词。
按分镜顺序逐段生成,全部出来后通读一遍,不合理就追问修改:动作太多塞不进15秒就拆成两段;台词和画面不同步就调整时间轴;视频里有大量对白,在提示词最前面加一句”全程不要任何字幕,无文字遮挡”。
六、第五步:用Seedance 2.0全能参考生成视频片段
这是全流程最关键的一步——把图片和提示词变成真正的视频。
打开即梦「视频生成」→「Seedance 2.0」→「全能参考」模式。这个模式的核心能力:同时上传多张参考图(角色多角度视图、关键帧图、场景图),AI根据这些参考+提示词生成连贯的视频片段。上传时标注清楚每张图对应的角色:
背景=@图片1,人物=@图片2,猫咪=@图片3
模型选择上,带Fast的比不带快,带VIP的更快但积分消耗也更多。免费用户走常规通道,提交任务后可以先去做别的事,生成完再回来看。
检查生成结果看三件事:
- 人物是否一致? 不像就换参考图或多传角度图
- 动作是否自然? 僵硬就微调提示词里的动作描述
- 画面是否连贯? 跳跃太大就把一段拆成两段分别生成
正常情况下每个片段跑2-3次就能拿到满意的结果,偶尔有镜头确实难出,降低要求或换个角度重新描述。
想让多个视频片段的音色保持一致? 在提示词里给角色关联声音参考。先把满意的视频片段导入剪映提取音频导出mp3当样本,生成时这样写:
背景=@图片1,人物=@图片2=@音频2,猫咪=@图片3=@音频1
这样对应角色输出的音色基本趋于一致,后期配音再精修升级。
七、第六步:配音和配乐,给片子注入情绪
视频片段是按8-15秒分段生成的,整体BGM不连贯,这一步要优化。
配音:给即梦任意一段5-30秒的音频样本,它就能克隆出想要的声音。三种找样本的方法:
- A:从已生成的视频片段里提取——有段视频人声效果刚好合适,导入剪映提取音频导出mp3
- B:用身边人的声音录一段——让孩子对着手机念5-30秒,小朋友的声音配猫咪旁白,效果意外地好
- C:直接在即梦配音模式里挑合适的音色
打开即梦「配音生成」,上传音色样本,输入台词,逐条生成所有配音下载保存。
配乐:让豆包根据故事情绪写BGM提示词:
根据以下文本写一个纯音乐BGM提示词,要求温馨治愈,符合故事情绪,按照即梦的规则写:
【粘贴你的故事一句话概要】
拿到提示词,打开即梦「音乐生成」,粘贴提示词,选时长(建议2分钟),多生成几条挑最满意的那条。
八、第七步:剪映合成,导出成片
所有素材齐了:视频片段、配音、配乐。最后在剪映里拼起来:
- 导入素材:新建项目,按故事顺序把所有视频片段拖入时间线,删掉冗长部分,根据画面节奏调播放速度
- 对齐配音:把配音拖到对应片段上方,调整时间位置让台词和画面对上
- 铺配乐:BGM拖到最底层音轨铺满全片,音量调到30%-40%,别盖过配音
- 加转场字幕:片段之间加淡入淡出转场;有旁白就加字幕,剪映能自动识别语音生成字幕
- 导出:推荐1080P,帧率24fps
九、几个实用小技巧
跑完整个流程,说几个实测中特别管用的点:
- 剧本阶段多花20分钟,后面省两小时。场景少、角色少、情节简单的故事最好实现。我第一版剧本五个场景,生成视频时反复返工,改成三个场景后一次过。
- 每个片段跑2-3次就够。别追求一次完美,AI生成本来就有随机性。先全流程跑通,成片后再回头精修不满意的片段,效率高得多。
- 免费用户先规划好一天的量。即梦免费积分每天随机领取,生成任务排队时间长。建议白天把提示词全写好,晚上统一提交生成,睡一觉起来素材全齐。
- 多角色场景一定要标图。参考图一多,AI容易搞混角色。生成前把”背景=@图片1,人物=@图片2”这样的标注写清楚,一致性立刻上一个台阶。
- 别贪长。第一次做,2分钟以内、6-8个片段最合适。时长翻倍,难度不是翻倍,是翻几倍。
十、给你的动手清单
做第一支AI剧情短片前,按这个清单准备:
- 注册好豆包、即梦、剪映三个工具
- 想好一个你真正想讲的故事(宠物、家人趣事、一句话都行)
- 贴编剧提示词,把想法喂给豆包
- 追问打磨剧本,直到你自己满意
- 生成角色定妆照+多角度视图+场景图
- 拆关键分镜,只生成场景切换第一帧
- 逐段生成15秒视频提示词
- 全能参考模式生成全部视频片段
- 配音配乐生成完毕
- 剪映合成,导出1080P 24fps成片
第一次做效果粗糙是正常的,重要的是跑通全流程。跑通了,后面每一步怎么优化你自然就清楚了。
十一、给想立刻动手的人
如果你也是做AI短剧/漫剧的,这套方法里最花时间的一步其实是角色设定——每个角色都要想设定、试画风、调一致性。不想从零开始的话,可以看看我用的这个古风言情人物资产包——200个零重名原创角色,每个都配好完整中文提示词,即梦、可灵、豆包通用,直接套上面的分镜模板就能出片。想要爆款短剧的节奏和悬念设计,还有一份短剧分镜脚本包在准备中。
我把这套方法整理成了一份完整的方法包:七步法全流程 + 全套可直接复制的提示词模板(编剧提示词、角色多角度视图提示词、分镜导演提示词、15秒视频提示词、BGM提示词),照着操作就能出片。
#AI剧情短片 #即梦AI #Seedance #分镜提示词 #零基础