我从 Super-i 课程中学到了什么
最大的收获不是记住几百条提示词,而是形成了一套完整的 AI 影像生产逻辑:提示词不是咒语,而是一份给模型的“拍摄与生产合同”。
一、生图真正要控制什么
一张图需要分别控制主体身份、服装与产品、空间关系、摄影机位、光线、人物状态和画面风格。
- 主体身份:是谁、年龄、脸型、发型和体态。
- 服装与产品:结构、颜色、材质、Logo 和正反面。
- 空间:人物在哪,前中后景、入口出口和遮挡关系。
- 摄影:机位、景别、焦段、拍摄角度和透视。
- 光线:光从哪里来、软硬、明暗比、轮廓光、补光和体积光。
- 状态与行为:人物为什么在那里、正在做什么、看向哪里。
- 画面风格:色板、材质、颗粒、曝光和后期方向。
“高级感、电影感、真实感”本身几乎不可执行,必须翻译成这些可见条件。给一个女孩设计画面时,不能只写“漂亮女孩站在街头,电影感”,还要考虑她的身份、此刻要做什么、环境和她是什么关系、主光方向、机位距离、情绪通过什么动作表现,以及图片最终准备拿来做什么。
二、人物真实感不只是脸真
课程反复出现的一个重要规律是:人物要“有事可做”。
真实感来自明确的行为动机、视线落点、手与道具或环境的接触、符合动作的重心,以及轻微停顿、犹豫、呼吸感和无意识动作。表情、身体和环境必须相互呼应。
皮肤毛孔、胶片颗粒、8K 等只能增加表面质感,解决不了人物像模特摆拍、像 NPC 的问题。
三、一致性本质上是资产管理
“保持人物一致”不是一句提示词能解决的。参考资产需要拆分职责:
- 身份图只负责脸、年龄、骨相和发型。
- 服装图只负责版型、颜色、纹样和配饰。
- 产品图负责结构、文字、Logo 和细节。
- 场景图负责空间、家具、光线和色调。
- 动作视频只负责动作轨迹和节奏。
- 音频只负责声音或节拍。
每份参考都应该说明“负责什么、不负责什么”。如果服装或场景参考图中出现另一个人的脸,需要遮住整张脸,防止身份污染;真正的身份参考脸则保留。
四、AI 视频是在设计状态变化
AI 视频不是让图片随便动起来。动作提示要写清楚:
起始姿态 → 接触点 → 发力方式 → 重心变化 → 身体与衣料响应 → 摄影机跟随 → 最终状态
例如“女孩快速转身跑开”很容易生成得假。更可执行的写法需要说明她开始面向哪里、哪只脚先蹬地、肩膀和髋部如何转动、头发和衣摆怎样滞后、摄影机是原地摇摄还是侧向跟拍,以及最后跑向画面哪个方向。
动作太复杂时,不硬塞进一个镜头,而是拆成前摇、爆发和结果几个阶段。
五、运镜不是堆摄影术语
“推进、环绕、摇摄、变焦、手持”全部堆在一起,通常只会让模型互相打架。运镜必须服务于空间和信息:
- 建立镜头交代人物在哪里。
- 推近强调情绪或产品。
- 横移利用前后景视差。
- 跟拍表现人物移动。
- 环绕表现主体关系或造型。
- 空镜负责节奏、过渡和余韵。
一般一镜只保留一到两种核心运动。真正的电影感来自空间层次、主体调度、遮挡和视差,不是摄影术语越多越好。
六、分镜首先是信息设计
判断一个镜头有没有必要,应该先问:
- 这一镜让观众新知道了什么?
- 人物和产品在什么位置?
- 它承接了上一镜的什么状态?
- 这一镜结束时留下什么状态?
- 下一镜能不能自然接住?
因此,分镜不是把同一个人物换几个景别重复拍,而是每一镜都有职能:交代空间、建立身份、推动动作、展示产品、表达情绪或者完成转场。
对话场景还要先固定人物左右位置、视线方向和 180 度轴线,否则正反打很容易越轴。
七、首帧提示词与动态提示词必须分开
首帧主要负责:人物、服装、产品真值,姿势与位置,构图,场景、光线、材质和色调。
动态提示主要负责:动作起点、过程与终点,镜头方向和速度,衣料、头发、道具与环境反馈,时间顺序和禁止事项。
这样生成失败时,才能判断是静态资产错了,还是动态执行错了,而不是整段提示词全部推倒重来。
八、商业内容需要完整生产链
商业目标 → 参考机制拆解 → 资产真值 → 视觉规则 → 分镜 → 首帧 → 动态 → 粗剪 → 声音 → 调色与落版 → 验收
UGC 更重视手机感、生活光、可信身份、真实停顿、小瑕疵和快速钩子;TVC 与品牌片更重视视觉圣经、精准构图、产品英雄镜头、色板、材质和声音层次。
UGC 不是越精致越好。如果把它做成棚拍广告,反而容易失去可信感。
九、产品卖点必须变成可见证据
不能只写“突出科技感”或“体现清凉效果”。卖点应该转成使用动作、材质特写、结构展示、前后状态变化、人物和环境的真实反馈,以及产品在剧情中的因果作用。
冰晶、能量流、器官变化等视觉隐喻,只能作为创意表达,不能拿来证明真实性能或功效。
十、形成一套故障诊断顺序
当生成效果不好时,不直接把提示词加长,而是依次判断:
- 身份资产是否正确;
- 服装或产品真值是否完整;
- 构图和空间是否成立;
- 动作与接触关系是否合理;
- 运镜指令是否冲突;
- 光线和材质是否清楚;
- 模型能力或参考图之间是否冲突;
- 剪辑、声音与节奏是否破坏了成片。
然后优先修改最便宜、最能验证原因的那一项,而不是把所有内容全部重做。
现在可以实际承担什么
- 给一个女孩设计完整场景和生图提示词。
- 根据现有图片反推提示词。
- 扩图并规划新增区域。
- 保持人物、服装或商品一致。
- 把一张图片改造成视频首帧。
- 编写图生视频动作与运镜提示词。
- 设计短片、广告、短剧或电商视频分镜。
- 分析失败图片或视频并给出修正顺序。
- 按照具体模型改写提示词。
- 回查对应课程原文与出处。
最后说明边界
课程学习覆盖正文和全部可见教学图片,没有观看视频和附件,也没有把 299 门课程成品全部重新生成一遍。
因此,现在形成的是一套课程优先、细节充分、可追溯的实战知识系统。遇到具体项目时,再结合孙哥提供的素材、当前模型和实际生成结果进行验证,它才会进一步变成真正属于我们的经验。