创意
一句话描述主角、目标、阻碍与变化,避免只有氛围没有事件。
真正值得学习的不是某个模型的“咒语”,而是把创意变成分镜、把分镜变成可控镜头、再用剪辑与声音建立叙事的一整套能力。
AI 视频不是“输入一句话,得到一部电影”。生成模型负责提供镜头素材;创作者仍然要决定看什么、何时切换、为什么产生情绪。
一句话描述主角、目标、阻碍与变化,避免只有氛围没有事件。
把故事拆成信息功能不同的镜头,为每个镜头规定景别和时长。
用角色、场景、服装与色板锁定视觉世界,降低随机漂移。
逐镜头控制主体动作和相机运动,选择可剪辑的版本。
通过剪辑、声音、字幕和调色,把离散素材变成连续体验。
《牌子》的经验提醒我们:AI 可以压缩执行成本,却不能替创作者产生真实感受、判断什么值得说,以及决定什么才算“好”。
从生活中的愤怒、怀念、困惑或期待开始,而不是先找热门风格。
它是否值得传递?能否给别人带来新的理解、感受或乐趣?
形式像请客吃饭:先降低理解门槛,再把最独特的表达端出来。
个人创作者必须在情绪消散前做完;无法控制的酷创意可以主动放弃。
生成、剪辑和视觉奇观完成后,再问一次:成片有没有偏离真正想说的事?
AI 擅长资料辅助、视觉实现和快速试错;细腻的人类情绪、幽默与表达仍需创作者做决定。
经历、城市、性格、审美和跨媒介“通感”共同构成个人底色。模型越趋同,这些变量越重要。
AI 最大的学习价值是降低试错代价。不要把第一部作品当代表作,把它当作获得反馈的实验。
来源:DiDi_OK 现场分享 · 分享全文整理与补充采访
共同基础都是镜头语言与剪辑,但作品形式、评价标准和技术深度不同。没有明确目标时,先走“内容创作”路线。
短视频、知识内容、故事账号。优先训练信息密度、前三秒吸引力、字幕和稳定周更能力。
产品视觉、概念片、社交广告。优先训练品牌一致性、产品真实性和商业可用性。
剧情短片、MV、视觉实验。重点是角色弧线、场面调度、连续性和声音叙事。
本地工作流、模型机制与可控生成。先具备创作判断,再进入节点系统、条件控制与评测。
工具会快速变化,能力结构不会。最小工具栈是“一个生成平台 + 一个剪辑软件”;不要同时学习五套界面。
适合中文创作和国内入门,覆盖文/图生视频、首尾帧及多模态参考。
适合角色与元素参考、镜头覆盖和叙事镜头实验。
承担剪辑、字幕、配音、音效、调色、补帧和画质增强。
适合系统学习镜头运动、参考素材和生成式视频工作流。
围绕 Veo 构建,强调场景素材复用、角色一致性和相机控制。
适合已经使用 Premiere 的创作者,便于把生成素材接入专业剪辑。
适合进入可复现节点流程、参数控制、批量实验和模型研究。
平台会不断换模型、换积分和换套餐。真正需要比较的是:谁最适合你的镜头类型、资产管理方式、地区可用性与单位可用镜头成本。
用即梦 Seedance 2.0 做主平台,用可灵 3.0 补固定角色、多人对白和声线镜头;动作与微表情交给海螺 2.3,动漫和低成本批量交给 Vidu。剪映或达芬奇负责剪辑、字幕、声音与最终输出。
| 平台 / 模型 | 最强场景 | 主要限制 | 价格口径(官方公开信息) | 官方资料 |
|---|---|---|---|---|
| 即梦 国内首选 | 多素材导演式参考、中文叙事、原生音画、15 秒多镜头。 | 多主体一致性、画面文字和复杂局部编辑仍可能失败。 | 消费者月费与单次扣分未公开稳定价,需登录购买页;火山方舟活动包 ¥196/1400 万 tokens 起,具体视频数量随规格变化。 | Seedance 2.0 发布 API 活动包 |
| 可灵 3.0 角色与对白 | 固定角色、声线、多角色对白、自定义多镜头、镜头内文字。 | 人民币套餐和积分兑换关系需在登录结算页确认。 | 5 秒:720p 静音 30 credits、有声 45;1080p 静音 40、有声 60;声线控制再加 10 credits。 | 官方指南与计费 |
| 海螺 2.3 动作专项 | 复杂身体动作、物理性、微表情、写实人物与风格化短镜头。 | 不属于原生音画联合工作流,声音通常后期完成。 | Standard $14.99/月 1000 credits;Pro $54.99/月 4500 credits。API:768p 6 秒 $0.28,1080p 6 秒 $0.49。 | 会员政策 API 价格 |
| Vidu Q3 批量与动漫 | 最多 7 张主体参考图;动漫、道具、场景一致性和成本敏感批量。 | 错峰任务可能等待最长 48 小时;消费者套餐价格动态。 | API 1 credit=¥0.03125;Q3 Turbo 1080p 约 ¥2.03/5 秒,错峰约 ¥1.09/5 秒;注册有体验积分和每日登录积分。 | API 价格 参考生视频 |
| Runway 国际工作台 | Gen-4.5、Seedance、Kling、Veo 等多模型切换与生成式视频编辑。 | 积分不结转;高频生成成本高;中国大陆可用性需自行确认。 | Free $0/一次性 125 credits;Standard $15/月(年付 $12/月)625;Pro $35(年付 $28)2250;Max $95(年付 $76)9500。 | 官方套餐 模型列表 |
| Google Flow / Veo 地区限制 | Scenebuilder、首尾帧、Ingredients、场景延展,适合多场景叙事。 | 中国大陆不在支持范围;Free、Plus、Pro 通常有可见水印。 | AI Plus $7.99/200 credits;Pro $19.99/1000;Ultra $100/10000。Veo Fast 约 20 credits/次,Quality 100/次。 | Google AI 套餐 Flow 积分规则 |
| Adobe Firefly 地区限制 | Adobe 生态、Premiere 衔接、商业素材治理与参考控制。 | 中国大陆不可用;1080p 生成消耗高。 | Standard $9.99/2000 credits;Pro $19.99/4000;Pro Plus $49.99/10000。1080p 为 100 credits/秒,Standard 约 4 条 5 秒 1080p。 | 官方套餐 积分消耗 |
| ComfyUI + Wan2.2 本地研发 | 可复现、隐私、批量队列、节点控制和模型研究。 | 配置、显存、存储和维护成本高;不适合零基础第一站。 | 软件与模型 $0;Wan2.2 官方 720p 基准建议至少 24GB 显存。8GB 优化版可装载,不代表能高效生产。 | Wan2.2 仓库 ComfyUI 教程 |
真正要记录的是 订阅费 + 加购积分 + 算力成本 ÷ 最终采用镜头数。同一镜头五次才采用,单位可用成本就是标价的五倍。
免费额度、可见品牌水印、依法保留的 AI 标识和商业授权是四件不同的事。付款也不自动意味着可以删除全部标识。
先用同一组 10–12 个测试镜头比较采用率、人物一致性、声音、等待时间和后期工作量,再决定是否续费。
对白、动作、双人互动、文字、运镜、首尾帧各做 1–2 个镜头。
先用 Seedance 2.0 完成整组,不要一开始同时注册八个平台。
角色/声线失败找可灵,动作失败找海螺,动漫与批量找 Vidu。
保留提示词、参考图、模型、版本、生成次数和最终采用结果。
Mx-Shell 的核心方法是把生图当作“美术资产生产”,而不是为每个镜头临时抽卡。优质参考图先定义人物、场景和视觉基调,再把稳定资产交给视频模型。
先完成角色母版,再逐层添加表情、服装与装备。主角高精度,次要角色按实际镜头需求降级。
hero_basehero_expr_*hero_costumeprop_revolverhero_sheet先生成同一场景的构图候选,选中母版后再拆内部空间、细节和空镜,保持空间关系一致。
set_masterset_variantsset_cleanplateset_detail_*style_tail把场景母版转成低成本草图,再标注人物位置、行动轨迹和镜头方向,降低视频模型的理解负担。
set_sketchblocking_startblocking_pathcamera_planshot_ref_*颜色、结构、材质、时代和最强记忆点。
纯色背景、全身、结构清晰,暂不加复杂装备。
表情、衣服、做旧依次生成,每层单独验收。
武器和复杂配件独立生成,再引用合成。
生成三视图、关节和关键部位特写。
按镜头只加载必要资产,减少条件冲突。
适量加入灰尘、污渍、划痕和磨损。过度光洁、过度华丽反而容易显出 AI 感。
例如独特的 LED 面部或轮廓特征。强识别点能稳定角色,也会让轻微穿帮不那么显眼。
基础结构通过后再加表情、服装和道具。失败时能明确回退到哪一层,而不是全部重做。
草图与构图探索用低成本规格,正式参考使用中等规格,只在最终关键资产上使用高分辨率。
CHAR_hero_base_v03.png
CHAR_hero_expr_angry_v02.png
PROP_revolver_clean_v01.png
SET_villa_master_night_v04.png
BLOCK_S03_path_v02.png
SHOT_S03_ref_final.png
案例的价值不在“像不像电影”,而在是否披露目标、素材、流程、取舍和限制。下面优先选择主创一手复盘或官方幕后资料,并明确平台自述的偏差。
官方文档或主创原始复盘,能看到输入、步骤与输出。
流程较清楚,但由平台发布,需留意选择性呈现。
二手解说或作品展示;不能据此断言成本、效率和方法。
封面即图片素材;点击后在当前页面载入 B 站播放器。离开“案例与视频”页时播放器会自动卸载,避免后台继续播放。
重点看创意起点、观众体验、表达形式与完成周期,而不是某个模型按钮。
重点看母版、变体、道具、草图调度和按镜头引用如何减少一致性失败。
Eliza McNitt 用实拍承载人物表演,用 Veo 处理传统拍摄难以完成的记忆与想象段落。
大羽玩AI 的完整技术复盘,从角色/场景资产包、分镜、多模型图生视频一路进入动画与剪辑,并讨论场景一致性与模型路由。
Jeremy Higgins 先用两周做 storyboards,再并行制作手绘角色 rough animation 与 AI 背景,最后补接触阴影和互动细节。
shy kids 围绕模型容易保持的“气球头”角色写故事,并用筛选、剪辑、调色、rotoscope、VFX 与声音把离散镜头变成成片。
Paul Trillo 把模型的连续变形匹配到“人生记忆不断前推”的 MV 形式;其复盘披露了大量生成、低采用率与后期补接。
围绕 LilWuKong 虚拟音乐人,把歌词情绪拆成视觉母题,以固定人物资产、段落节奏和镜头复用组织完整 MV。
《刻板印象宇宙》的核心不是一键生成,而是“剧本 / 分镜 → 图片转视频 → 剪辑”。公开采访称约 80% 的精力放在剧本和分镜,后 20% 才是动态化与拼接。
这条路径覆盖预演、生成、剪辑、声音与修补。A 级表示来源可靠且可照做,不代表功能永远不变;涉及模型版本、地区、套餐和显存的数据,使用前仍要复查官方页面。
先完成 Creative Training,再读当前 Gen-4.5 Prompting Guide。重点掌握文生视频写“画面 + 运动”,图生视频主要描述运动,并从简单指令逐步加约束。
学习文字、图片、Ingredients、首尾帧生成,再用版本历史、延长、保存关键帧与 Scenebuilder 把多个片段组织成场景。
目前较完整的国产官方单篇指南:多镜头、自定义分镜、Element 绑定、角色声音、多角色对白和首尾帧都有完整示例。
用 5–10 秒参考视频迁移构图或摄影机运动,再把结果加入 Firefly Video Editor 时间线。适合练“参考什么、不要参考什么”。
从 moodboard、品牌宣言、storyboard、previs 进入产品镜头、选角、B-roll、VFX 和人物/商品植入;适合建立商业片生产顺序。
Beginner’s Guide 用配套素材覆盖导入、剪辑、基础调色、Fairlight、Fusion 与交付;再用 Editor、Fairlight、Colorist 指南分别深入。
用 Grease Pencil 画关键姿势和镜头,再在 Video Sequencer 拼成 animatic。免费、离线,适合在生成之前验证节奏与调度。
从官方 TI2V 5B 工作流开始,下载模板和模型,保存 JSON、提示词、随机种子与输出;之后再进入轨迹、控制视频和音频驱动。
下面不是“工具介绍”,而是一套可以反复套用的拆解格式:先规定输入,再按步骤操作,最后用可见产物和检查标准判断是否真的学会。
命题、脚本、参考图、参考视频和声音素材。
只按教程解决一个控制问题,记录模型与版本。
镜头、分镜、粗剪、声音版或可复跑工作流。
叙事、主体、动作、剪辑、声音与成本六项检查。
保存提示词、输入、失败样本、采用率和未知项。
知道文生视频、图生视频、首尾帧、参考视频、Element / Ingredients、原生音画分别解决什么问题;在生成前确认素材与发布用途。
一句话命题、角色欲望、障碍、结局变化;参考梦游牛油果公开工作流,把最多精力放在剧本与分镜,而不是一开始反复抽卡。
角色设定、服装、道具、场景和参考风格;不要直接把一张复杂海报当作所有镜头的唯一参考。
一张构图明确的关键帧、一项主要动作、一个景别和一个相机运动;首轮不要写长篇世界观。
同一角色参考包、同一场景关键帧、5–10 秒参考运动视频,以及需要保持的首帧与尾帧。
6–12 个生成镜头、镜头表、临时声音和项目输出规格;先不追求每个镜头都漂亮。
粗剪画面、对白文本、环境声参考、动作音效和音乐草稿;声音克隆必须确认本人授权与平台条款。
精剪画面、声音 stem、字幕和发布平台要求;先确定主版本,再派生 16:9、9:16 或无字幕版本。
已更新的 ComfyUI、官方工作流 JSON、模型文件、同一张参考图和固定提示词;5B offloading 能启动不等于高效生产。
任选一个案例,使用同一套 6 镜头脚本、角色资产包和测试表;不把访谈中未披露的工具或成本写成确定事实。
勾选状态会保存在当前浏览器。每项任务都以可见产物结束,避免陷入“看了很多教程,但没有作品”。
好提示词不是形容词堆砌,而是一份清晰的“拍摄任务书”。先描述画面中发生什么,再描述摄影机如何观察。
示例命题:“一个深夜加班的人,在离开办公室时发现城市停电,随后看见久违的星空。”每个镜头只承担一个叙事功能。
| 镜头 | 叙事功能 | 画面 | 建议时长 | 主要控制 |
|---|---|---|---|---|
| S01 | 建立环境 | 空旷办公室,只剩一盏台灯和窗外城市灯光。 | 3 秒 | 全景、固定机位 |
| S02 | 介绍主角 | 疲惫的人合上电脑,揉眼睛,收拾背包。 | 4 秒 | 中近景、单一动作 |
| S03 | 触发事件 | 所有灯突然熄灭,人物停住,抬头。 | 3 秒 | 首尾状态、光线变化 |
| S04 | 制造悬念 | 人物借手机微光走过黑暗走廊。 | 5 秒 | 背后跟拍、稳定步态 |
| S05 | 揭示变化 | 推开天台门,黑暗城市上方出现密集星空。 | 5 秒 | 门作遮挡转场、缓慢推进 |
| S06 | 情绪反应 | 人物面部特写,从惊讶逐渐露出微笑。 | 4 秒 | 特写、微表情、固定镜头 |
| S07 | 结束余韵 | 人物背影面对星空,城市轮廓保持黑暗。 | 6 秒 | 大全景、缓慢拉远、标题空间 |
不要把一小时全部花在生成等待上。观察、设计、生成与复盘缺一不可;只有最后一步能让经验累积。
分析一个广告或电影镜头的景别、运动与信息功能。
今天只比较一个变量,例如推镜速度或角色动作幅度。
做四个版本;每轮只改一个控制条件。
保存最佳、最差版本,并写一句因果判断。
每个项目都引入一个新的难点。完成顺序比规模更重要:先做短、做完、复盘,再扩大。
用三个镜头表达“等待”“错过”或“释然”。全片只能有一个角色,禁止旁白解释。
为一件真实产品设计六个镜头:问题、出现、细节、使用、结果、品牌收束。
一个角色、一个地点、一次不可逆变化。加入环境声、动作音效、音乐与留白。
拖动滑杆为当前作品评分。低分项比总分更重要:下一轮只集中解决最低的一个维度。
展开查看诊断。越早学会缩小问题,越少浪费生成额度。
技术学习应建立在创作判断之上,否则容易只会连接节点,却无法判断输出是否真正可用。
模型界面和能力更新很快。以下链接用于核对当前功能;学习时重点提取可迁移的镜头与工作流原则。
从 15 秒开始,固定一个主模型。每次只解决一个问题,每周交付一个完整作品,并把成功与失败都变成下一轮可以复用的判断。
现在开始第一周 →