现在用 AI 制作产品宣传片的人,大多已经知道要准备产品参考图,也知道在提示词里写慢推、环绕、特写、光影变化,甚至会把几个短镜头分别生成以后再剪到一起。 真正令人头疼的,已经不是“怎么让画面动起来”,而是为什么每个镜头单独看都不错,合起来却仍然像一组模型演示素材,不像一条真正的广告。 前一个镜头可能在展示产品旋转,后一个镜头突然切到液体飞溅,接着又出现人物使用场景。所有画面都带着明显的广告元素,却没有回答一个最基本的问题:观众看完以后,究竟应该记住产品的哪一点? 问题通常不是提示词写得太短,而是我们太早进入了镜头执行。在核心卖点、目标用户和传播顺序还没有确定时,就开始考虑运镜、景别和视觉特效,最后得到的自然只能是一份“漂亮镜头清单”。 分镜真正要解决的,是让这些镜头按照同一个传播目标发生关系。 提示词的英文是 Prompt,也可以简写成 Pmt。制作宣传片时,Prompt/Pmt 不只是描述某一个漂亮镜头,更重要的是把产品卖点、时间顺序、画面任务和镜头之间的逻辑组织起来。分镜,就是完成这件事的中间语言。

一、产品宣传片的分镜,到底在解决什么问题?

分镜不是把脑海中的故事画成几张草图,也不是列出“特写、近景、远景”就算完成了。对产品宣传片来说,分镜真正的作用,是把一个卖点拆成观众能够在几秒钟内看懂的视觉过程。 一条短广告通常要依次解决几个问题:先让观众停下来,再让他看见产品,接着理解产品有什么不同,最后留下品牌或行动信息。每个镜头都应该承担其中一项任务。 如果一个镜头既不能吸引注意,也不能介绍产品、证明卖点或推动下一步,它即使非常漂亮,也可能只是多余的素材。 所以写分镜前,不要先问“第一个镜头怎么拍”,而要先写清楚一句话:

这条视频要让哪一类人,因为哪个具体卖点,对产品产生什么感觉或行动?

例如:“让经常加班、又想喝新鲜果汁的上班族,认识这款可以随身携带的榨汁杯,并感受到它使用简单、清洗方便。” 这句话比“做一条高级榨汁杯广告”更有用,因为它已经包含了受众、卖点和传播结果。

二、为什么一条短视频最好只讲一个核心卖点?

很多产品确实有不少优点,但十几秒的视频没有足够时间解释全部内容。 便携榨汁杯可能同时拥有动力强、噪音低、容量大、重量轻、容易清洗、续航时间长等特点。如果每个优点都出现一秒,观众最后很可能只记住“这是一个榨汁杯”。 更好的做法是选定一个主要卖点,再用一两个辅助信息证明它。 假设核心卖点是“随时都能喝到新鲜果汁”,那么便携是原因,快速榨汁是过程,容易清洗可以作为降低使用顾虑的补充。 这三个信息之间有因果关系,而不是简单并列。分镜也就有了自然顺序:先表现不方便,再让产品出现,然后展示使用过程,最后呈现结果。 判断卖点是否适合做视频,可以问三个问题:它能不能被画面表现?观众能不能在几秒内看懂?它和同类产品相比有没有实际意义? “采用先进技术”很难直接拍出来,“把水果放进去,几十秒后就能直接饮用”则容易形成清楚的视觉动作。

三、15 秒产品宣传片应该怎样安排信息?

短视频不一定必须套用固定模板,但可以先用一个简单的时间结构建立节奏。 前0—2秒是钩子。 这部分不是急着介绍全部功能,而是让目标用户意识到“这件事和我有关”。可以是一种熟悉的困扰、一个意外动作,也可以是非常有质感的产品细节。 第2—5秒建立需求。 让观众快速理解问题或使用场景。例如午后办公室里只有高糖饮料,或者运动结束后想喝新鲜果汁却没有工具。 第5—10秒展示产品和核心动作。 产品在这里不是静静摆着,而是通过使用过程证明卖点。打开杯盖、放入水果、启动搅拌,这些动作共同解释“方便”是什么意思。 第10—13秒呈现结果。 让观众看到产品带来的具体变化,例如果汁质地、饮用状态以及使用后的轻松感。 最后2秒留下记忆。 回到干净的产品主视觉,放置品牌名称、核心短句和必要的行动提示。宣传文字最好在后期添加,不要完全交给视频模型生成。 时间结构不是为了限制创意,而是防止一条短片只有气氛、没有信息。

四、一份能真正用于生成的分镜应该写哪些内容?

每个镜头至少需要写清楚八项内容:镜头序号、持续时间、镜头任务、景别与构图、主体动作、镜头运动、环境与声音,以及必须保持不变的产品信息。 “镜头任务”尤其重要。它可以写成“制造好奇”“展示便携”“证明操作简单”或“留下品牌记忆”。当生成结果不好时,可以根据任务判断这个镜头是否应该重做,而不是只凭感觉说它不够高级。 景别与构图决定观众看见什么。特写适合表现按钮、水珠、材质和动作细节;中近景适合展示人物怎样使用产品;产品主视觉则需要干净背景和稳定构图。 主体动作与镜头运动应该分开写。主体动作是人物或产品发生什么,镜头运动是相机如何观察它。两者如果同时过于复杂,很容易让视频失控。 一个三秒镜头通常只安排一个主要动作,再配合一次缓慢、清楚的运镜。 最后要写产品固定信息,例如杯身比例、颜色、Logo位置、杯盖结构和按钮数量。它相当于整条宣传片的“产品身份证”,需要在不同镜头中反复出现。

五、怎样让 AI 帮你写分镜,而不是替你随机编广告?

把产品资料简单贴给AI,随后让它一次性输出完整分镜,通常会得到一张格式很齐全、内容却比较空泛的表格。 问题不在于不能让AI写分镜,而在于它还不知道什么信息最重要。比较可靠的做法,是先把传播任务和限制条件交代清楚。 至少应该提供这些信息:产品是什么,最重要的卖点是什么,目标用户是谁,视频发布在哪里,时长和画面比例是多少,现有素材有哪些,哪些产品细节不能改变,以及不希望出现哪些常见套路。 不要一开始就让AI输出最终方案。可以先让它围绕同一个卖点给出三种不同创意方向,例如真实生活型、产品质感型和问题解决型。选定方向后,再让它扩展成具体分镜。 可以使用下面这段任务Prompt/Pmt:

你是一名商业短视频导演,请为一款便携榨汁杯设计一条15秒竖版产品宣传片分镜。
目标用户是经常加班、通勤和运动的年轻上班族。核心卖点只有一个:用户在办公室、健身房或旅途中,也能快速喝到新鲜果汁。辅助信息是操作简单、杯体可直接饮用、清洗步骤少。
视频发布在短视频平台,比例为9:16。现有素材包括产品正面图、侧面图、杯盖细节图和三种颜色版本。必须准确保留杯体比例、按钮位置、透明杯身、品牌Logo和杯盖结构。
请先提出三种不同的创意方向,每种用三句话说明,不要写完整分镜。避免产品悬浮旋转、夸张水果爆炸、无意义粒子和无法拍摄或生成的复杂转场。三个方向必须围绕同一个卖点,但开场方式和叙事角度不同。

选好方向后,再追加要求:

采用“真实办公场景中的问题解决”方向,将它扩展成6个镜头。每个镜头写明持续时间、镜头任务、画面内容、景别与构图、人物或产品动作、镜头运动、声音、后期文字和产品一致性要求。
总时长不得超过15秒,每个镜头只设置一个主要视觉动作,前两个镜头必须在3秒内说明使用场景并引出产品。

这样生成出来的分镜,通常比直接要求AI输出一套完整方案更接近实际制作需要。

六、一个15秒便携榨汁杯广告可以怎样拆镜头?

下面以“办公室里也能快速喝到新鲜果汁”为核心卖点,设计一套六镜头结构。 镜头一,0—2秒:建立问题。 午后办公桌上放着喝了一半的甜饮料,一只手把它推到画面外。镜头使用桌面近景,动作干脆,保留键盘、文件和自然光,让观众迅速认出办公场景。声音只保留杯子划过桌面的轻响。 镜头二,2—4秒:产品出现。 同一只手从通勤包侧袋拿出便携榨汁杯,放在桌面中央。镜头轻微向前推进,重点表现产品体积不大、可以随身携带,不需要让它悬浮或自动旋转。 镜头三,4—6秒:操作准备。 草莓和香蕉被放入透明杯身,加入少量水,杯盖自然旋紧。使用手部和产品的中近景,镜头保持稳定,动作连续而清楚。这个镜头负责证明使用门槛低。 镜头四,6—9秒:核心功能。 手指按下按钮,杯内水果开始均匀搅拌,果汁颜色逐渐融合。镜头做非常轻微的水平移动,产品保持竖直,Logo和按钮始终清晰。 这是全片最重要的功能证明镜头,不需要同时加入水花、灯光扫动和背景切换。 镜头五,9—12秒:展示结果。 杯盖被打开,果汁质地细腻,人物直接拿起杯子饮用。背景中的办公环境轻微虚化,窗边自然光照在杯体上。这个镜头把“榨汁工具”转化成“可以直接带走的饮用体验”。 镜头六,12—15秒:留下品牌记忆。 产品回到干净的桌面主视觉,旁边放少量新鲜水果,镜头缓慢推近并在最后半秒停稳。右侧留出文字区域,后期加入一句核心短句和品牌名称。 整套分镜没有复杂剧情,却完成了一个完整过程:不想喝高糖饮料、从包里拿出产品、放入水果、启动、直接饮用。观众不用阅读长篇说明,也能理解这款产品解决了什么问题。

七、怎样把一条分镜改写成视频生成提示词?

分镜确定以后,不要把六个镜头一次性交给视频模型。应该把每个镜头分别写成独立Prompt/Pmt,并在开头重复产品身份要求。 以第四个“启动搅拌”镜头为例,可以这样写:

使用上传的便携榨汁杯图片作为唯一产品身份参考,准确保留透明圆柱形杯身、浅绿色杯盖、正面白色Logo、单个圆形启动按钮及整体比例。产品在整个镜头中保持结构一致,不增加按钮,不改变杯盖,不扭曲Logo。
竖版9:16写实商业短视频,时长约三秒。便携榨汁杯竖直放在明亮的办公室木质桌面上,镜头处于产品正前方略偏左的中近景。食指自然按下启动按钮,杯内草莓、香蕉和水开始形成稳定旋涡,液体逐渐变成均匀的淡粉色果汁。
相机只做幅度很小的从左向右平移,速度缓慢而稳定。杯身保持静止,不漂浮、不旋转,Logo和按钮始终清晰。窗边自然光从左侧照入,背景中的键盘与文件轻微虚化。
无快速变焦,无镜头抖动,无水果爆炸,无液体溢出,无随机文字,无额外产品,无手指变形。镜头结尾停在稳定、清晰的产品正面画面。

这段提示词只负责完成一个镜头。它没有重复整条广告的故事,也没有要求模型自己理解品牌战略。 分镜负责整体逻辑,单镜头Prompt/Pmt负责具体执行,两者不能混在一起。

八、怎样让六个镜头看起来属于同一条广告?

AI逐段生成视频时,很容易出现每个镜头都不错,拼在一起却像六条不同广告的情况。解决办法是提前建立一份简单的视觉规则。 第一是产品规则。所有镜头统一使用同一组产品参考图,并重复关键结构说明。 第二是场景规则。例如整条视频都发生在明亮、真实的现代办公室,不要一会儿是暖黄色咖啡馆,一会儿又变成蓝色未来实验室。 第三是光线和颜色。可以规定使用上午或午后的自然侧光,以浅木色、白色和产品主色为基础。 第四是镜头语言。例如以稳定机位、缓慢推近和小幅横移为主,不突然加入剧烈手持和高速环绕。 第五是人物一致性。如果多次出现同一个人,需要准备清楚的人物参考图,并固定服装、发型和手部配饰。只在必要镜头中露出人物,也可以降低身份漂移的风险。 这些规则可以整理成一段固定的基础Prompt,复制到每个镜头前面。后续只替换景别、动作和环境变化,整条视频会更容易保持统一。

九、AI写产品分镜最容易出现哪些问题?

第一个问题是把短广告写成微电影。人物起床、出门、开车、到公司、开会,十秒钟过去了,产品还没有出现。产品宣传片可以有故事,但故事必须服务卖点,而不是抢走产品的时间。 第二个问题是每个镜头都追求视觉奇观。水花、火焰、粒子、镜面空间和高速转场不断出现,观众只记住特效,却没有看清产品。商业画面并不等于动作越多越好。 第三个问题是先写口号,再硬找画面。像“释放无限可能”“开启全新生活”这样的文案听起来完整,却很难转化成具体镜头。更有效的方式是先找到可视化的产品动作,再从真实结果中提炼短句。 第四个问题是忽略镜头之间的连接。上一镜人物右手刚拿起产品,下一镜产品忽然出现在左边;前一镜光线从左侧照入,后一镜又从右侧出现强光。单独生成时不明显,剪在一起就会产生跳跃感。 第五个问题是让模型直接生成大量文字。包装之外的标题、价格、按钮和活动信息,尽量在剪辑软件中添加。这样不仅文字更准确,也方便根据不同平台调整尺寸和排版。

十、怎样判断一份分镜能不能真正使用?

最简单的方法,是先不看台词和说明,只看每个镜头的画面描述。如果静音播放,观众能不能知道产品是什么、怎样使用、带来了什么结果? 如果完全依赖字幕解释,说明画面还没有承担起传播任务。 还可以把每个镜头截成一张静态图放在一起,检查产品颜色、大小、Logo、人物和光线是否统一。如果六张图片像来自六个不同品牌,视频生成后也很难自然连起来。 最后删掉一个镜头试试。如果删除后信息没有任何损失,这个镜头很可能没有明确任务。短广告的时间有限,每一秒都应该帮助观众更快地理解产品。

结语:分镜不是给AI增加限制,而是减少浪费

AI可以迅速生成大量视频,但“生成得多”并不等于“宣传得清楚”。没有分镜时,我们会反复抽取随机结果,希望其中某一条碰巧像广告;有了分镜以后,才知道每个镜头为什么存在、需要生成什么,以及失败后应该修改哪里。 真正实用的流程是:先确定一个核心卖点,再把卖点拆成观众能够看懂的视觉过程;给每个镜头安排明确任务;建立统一的产品和视觉规则;最后把分镜分别改写成单镜头Prompt/Pmt,生成短片段并完成剪辑。 如果需要寻找产品构图、广告镜头和视频提示词的参考,可以先在 西西提示词 \| ccprompt.com 对照图片、视频与Prompt/Pmt案例,观察一个产品卖点是怎样变成具体画面的;即梦适合测试单镜头生成和首尾帧控制,Nano Banana Prompts也可以用来补充首帧构图思路。重点不是照搬某一段提示词,而是理解镜头为什么这样安排。 一条产品宣传片是否有效,最终不取决于它用了多少特效,而取决于观众看完以后,能不能用一句话说出这个产品为什么值得关注。