短视频分镜不是把完整故事塞进一段长提示词。先把一个传播目标拆成“建立场景—展示动作—给出结果”三个镜头,为每镜分别写时长、景别、主体动作、镜头运动和声音。可灵 3.0 官方说明支持多镜头故事板、参考素材和原生音频,但具体入口与额度仍要以当前账户为准。
你要制作一个 12 到 15 秒的产品展示、知识短片或剧情样片,希望三个镜头之间人物、商品和场景连续,并预留旁白、环境音或后期字幕。
先把输入准备好
- 01
只保留一个传播目标,例如展示一个卖点或讲清一个动作,不在 15 秒内解释完整产品。
- 02
准备人物、商品和场景参考,并记录每个素材的来源、授权和不能改变的特征。
- 03
先写无画面的三行故事:看见什么、发生什么、最后留下什么。
从输入到结果的 5 个步骤
- 01
用一句话写清最终结果
先定义观众看完后应该理解什么,例如“杯盖单手开启”或“主角从室外进入安静书店”。这句话决定哪些镜头必要、哪些只是装饰。
- 02
拆成建立、动作、结果三个镜头
镜头一交代人物、商品和环境;镜头二展示唯一核心动作;镜头三给出结果或情绪。先给核心动作更多时长,再分配开头和结尾。
- 03
为每镜填写五个字段
依次写时长、景别、主体动作、镜头运动和声音。画面只承担可见动作,价格、参数和行动号召留给后期真实字幕。
- 04
固定参考并标出连续性规则
使用有权上传的人物、商品或参考视频。在分镜顶部写明必须保持的发型、服装、Logo 位置、场景时间和光线方向,避免每镜重新发明。
- 05
分别验收画面、声音和剪辑
先静音逐帧检查人物、商品与动作,再只听声音检查对白、音效和环境音,最后检查镜头衔接。原生音频可作为草稿,重要旁白和品牌声音仍应人工审听与后期制作。
下载 Velochron,符合资格的新用户可体验 7 天
它是网络连接工具,不是 AI 模型,也不会代替你购买 AI 产品订阅。 下载后按客户端提示登录并检查体验资格,具体功能与有效期以客户端显示为准。
完整提示词模板
全片连续性:[人物核心特征];[服装/商品不可变化的细节];[场景时间与光线];整体节奏[平稳/轻快/紧张]。 镜头 1|[3 秒]|[全景/中景]:[建立场景与主体动作]。镜头[固定/缓慢推近/横移]。声音:[环境音/无对白]。 镜头 2|[6 秒]|[中景/近景]:[唯一核心动作]。镜头[跟随/轻微环绕]。声音:[动作音效/一句短对白]。 镜头 3|[4 秒]|[特写/中景]:[动作结果与结束状态]。镜头[固定/缓慢拉远]。声音:[收束音效/一句短旁白]。 三个镜头保持人物、商品比例、服装、场景和光线连续;真实 Logo、价格和行动号召由后期叠加。
- 时长是创作约束,不是必须照搬;以当前入口显示的模型与账户范围为准。
- 对白先写短句并注明说话顺序;多人对话要用明确角色标识。
- 分镜能用单镜头完成时,不要为了“电影感”强行增加切换。
输出完成后,逐项检查
- 三个镜头共同服务同一个传播目标,没有无关景别和装饰转场。
- 人物脸型、发型、服装、商品比例和场景光线连续。
- 每镜只有一个核心动作,镜头运动与动作方向不冲突。
- 对白、口型、动作音效和环境音分别审听,重要信息没有被噪声遮挡。
- 字幕、Logo、价格、参数和行动号召来自人工制作并已核对。
出现这些情况,应该怎样改
显式标出镜头编号、时长、景别、动作、镜头运动和声音,让每段有清楚结束状态。
先写连续性清单;只有推动故事的变化才允许出现。
生成阶段预留安全区,真实文字、价格和 CTA 在剪辑或设计软件中叠加。
实际使用时还会遇到什么
可灵 AI 可以直接生成多镜头视频吗?
快手官方说明可灵 3.0 和 3.0 Omni 支持多镜头叙事或故事板能力;实际入口、模型和可用额度以当前账户为准。
可以同时生成对白、音效和环境音吗?
官方资料说明相关模型支持原生音频与音画同出。重要台词、品牌读音和音乐权利仍需人工审听与复核。
15 秒应该拆几个镜头?
没有固定答案。初学者用三个镜头更容易控制:建立场景、核心动作和结果;如果一个长镜头已经讲清,就不必强行切三次。
官方参考资料
功能描述以官方帮助中心为准;版本、地区、账户权限和使用额度可能随时调整。
- 快手:可灵 3.0 系列模型全面上线核对多模态输入输出、参考素材、最长时长、多镜头叙事和故事板能力。
- 快手:可灵 2.6 推出音画同出能力核对图生音画、人声、音效、环境音以及电商与自媒体场景。
- 可灵 AI 官方应用核对当前可用模型、入口、方案和账户能力。