豆包加即梦,从分镜到成片,半小时搞定一集AI漫剧的真实流程!
豆包搭配即梦来制作AI漫剧,如今已经成了我相当趁手的一套创作组合。用得久了,越发觉得这两款工具配合起来相当默契——豆包负责把脑中的构思转化为文字脚本和分镜,即梦则负责把文字内容渲染成画面与视频。每次生成时,在人物造型、视频连贯性方面总能收获一些意外之喜,久而久之便沉淀成了固定的工作流。
接下来,我就把最近制作一集古风漫剧的完整流程毫无保留地分享出来,从剧本创作到最终成片,每一步的具体操作、遇到问题时的应对策略,都是我自己反复摸索出来的实战心得。
第一步:让豆包先写剧本,不用太复杂
打开豆包之后,我从来不会写那种冗长繁琐的指令。提示词写得越复杂,AI反而越容易想太多,产出的内容也容易偏离方向。我通常只丢过去一句话:
帮我写一个古风短剧剧本,比较火的题材,带上人物形象的生图提示词,还有分镜。

就是这么简洁。为什么特意要求附带“人物形象生图提示词”?原因在于后面用即梦生成角色图时,直接套用豆包给出的提示词即可,省去了自己重新构思的麻烦。
豆包生成的内容通常涵盖以下几个方面:
- 故事梗概(两三句话把主线交代清楚)
- 人物设定(每个角色的外貌特征、性格特点、服饰搭配)
- 人物形象生图提示词(这是给即梦用的,非常关键)
- 分镜脚本(镜头编号、画面内容、台词对白、时长控制)
这里有个小技巧:豆包首次生成的剧本往往不够细致,比如分镜只有三四个镜头,或者人物描述过于笼统。这时候别急着放弃,直接在对话框里继续提要求,比如“分镜再细化一下,加到8个镜头”或者“女主的外貌描述再具体一点”。它会在原有基础上进行修改,不需要从头再来。

第二步:即梦生成形象图
拿到豆包生成的人物形象提示词之后,直接复制粘贴到即梦的生图界面里。
举个例子,豆包给我生成的女主提示词是这样的:
“女主:林晚星 | 底层宫女·现代社畜穿越,9:16竖屏,古风漫剧质感,古风气质宫女,明快柔光,月白宫女服,眉眼灵动带点疲惫,发丝利落,宫廷偏殿背景,干净高级画质”。
模型选最新的,比例选9:16;一次多生成几张。

不满意就微调提示词。第一次生成出来的脸型可能偏圆,那就在提示词里补一句“瓜子脸”;衣服颜色不对,就调整颜色描述。微调之后重新生成,反复尝试直到满意为止。

特别提醒:每个角色都要保存一套完整的形象图,因为后续生成视频时,需要不同角度的参考图来保证一致性。
豆包给出的提示词里,偶尔会夹杂场景描述,比如“桃花必集客下”。不过生成角色图的时候,这部分可以灵活调整,不必死板照搬。
所有角色的形象图都搞定之后,我会把它们统一存进一个文件夹,按“女主”“男主”“反派”这样的方式命名,方便后续随时调用。

第三步:生成视频,两个工具各有优缺点
这一步有两条路可选,我两条都走过,下面分别说说它们各自的问题和应对办法。
选择一:用豆包生成视频
操作方式:上传即梦生成的角色图,输入豆包写好的分镜描述,然后在描述里用“@角色图片”的方式标注出对应的人物。等上几分钟就能得到一条视频片段。

豆包的长处在于不用排队,出片速度很快。短板则是不能用@直接绑定角色图。解决办法是:在描述里写清楚“女主(图1)”或者在上传角色图时按顺序固定好位置。刚开始可能需要多试几次,慢慢就能摸清规律了。
选择二:用即梦生成视频
操作方式:同样上传角色图、填写分镜描述,但即梦支持在描述里用“@”直接呼出角色图库,点击即可完成绑定,操作非常便捷。而且即梦的Seedance 2.0模型画质更出色,角色一致性也更为稳定。

不过即梦有个明显的痛点:排队情况太严重。尤其是晚上时段,前面动不动就排着几千上万人,一个15秒的视频可能要等6小时甚至更久。如果你不赶时间,那用即梦效果更理想;如果想快速出片验证剧本,豆包则更合适。
我自己的折中方案:先用豆包快速生成一版粗剪视频,检查剧情走向和镜头衔接有没有明显问题。如果整体没问题,再用即梦针对那些不够满意的片段逐镜头精修。这样既不会浪费时间,又能保证最终的画质水准。

00:10
整个过程大概多久?
从打开豆包写剧本,到完成所有角色图,再到用豆包/即梦生成全部视频片段,我大致估算了一下:
剧本和分镜:5分钟(主要是跟豆包来回调整)角色图:10分钟(每个角色抽几次卡,挑图)视频生成:10-15分钟(取决于镜头数量和工具排队情况)
加起来也就半小时出头。当然这是熟练之后的速度,第一次操作可能会慢一些,毕竟需要熟悉每个工具的使用方法。
最后
豆包+即梦这套组合,未必是最专业的方案,但对于个人创作者来说,确实是目前门槛最低、最容易上手的一条路径。豆包帮你把想法转化成可执行的分镜,即梦把分镜变成能播放的视频。你只需要在中间充当“监工”——指挥AI干活,然后在关键环节把好关就行。

