ONE TEN · KNOWLEDGE BASE

技艺库 Playbook

学到的方法 · 提示词 · 参数,全部沉淀在这。每张卡片 = 成品 + 逐字提示词 + 参数 + 出处。做之前先查这里,不再重测。

打戏 11

打戏两条线 · 写实格斗 vs 超现实大戏(规则、分界与互借)
打戏 · 通用

打戏两条线 · 写实格斗 vs 超现实大戏(规则、分界与互借)

打戏写实格斗仙侠科幻物理规则打击感蓄势爆发Seedance 2.5两条线2026-10-08

老板定的分法:两条线分开做,不混。混在一起的成片「模棱两可」——写实不够真,大戏不够爽。

A 线 · 写实格斗(还原现实物理)

  • 铁律:有重力,不能飞,跳跃高度 = 人能跳的高度;没有发光、能量、冲击波、残影。
  • 动作:真实格斗技——鞭腿、扣腕夺器反拧、肩摔、肘击、锁喉、贴身缠抱;打不中会落空、打中会失衡。
  • 环境当武器:撞墙、砸椅、压进台面、破窗、踩油污滑倒、钢管横扫——环境被打坏的方式也要符合物理。
  • 受力:每一下都写对方身体怎么反应(头偏、腰折、后退几步、跪地),衣服和头发跟着惯性走。
  • 夸张只准用镜头做:慢放、碰撞点定格、急推、甩镜、手持晃——镜头可以戏剧化,物理不可以。
  • 镜头常用:贴地极速横移、高低切换跟拍、碰撞点极速推镜、轨迹全程跟拍 → 终点锁焦、渐快压迫推进。
  • 声音:拳脚闷响、呼吸、衣物摩擦、环境破碎声;不要能量音效。
  • 人物:仿真人质感(作者实测:仿真人和 3D 动漫的提示词写法差别很大,见 A 线素材)。

B 线 · 超现实大戏(仙侠 / 武侠轻功 / 科幻,打破物理)

  • 允许:飞、凌空停滞、能量剑气、冲击波、凤凰虚影、建筑一剑两断、残影瞬身。
  • 骨架 = 蓄势 → 爆发 / 定格(作者开源 skill 模板):「[介质/地点]上,[能量源]先[蓄能现象];能量逐层暴涨,沿[方向]喷发为[释放现象];[终结释放]落下,[受击目标]被[爆破结果],只留[余波]。」
  • 冲击分级:轻=黑白冲击帧+微震;重=放射冲击帧+双色能量三层爆散;终极=全屏定格+负片闪白+环形冲击波。
  • 节奏:TimeRamp 快慢镜,以 0.5 秒为单位排时序。

分界与互借(平衡点)

  • A 绝不借 B:A 线里出现一次「飞」或「发光」,整条就变成 B 线的劣质版。
  • B 必须借 A 的四个「重量锚点」,否则飘:

1. 接触瞬间有形变/反冲(剑撞剑有回弹,人中招有身体折叠);

2. 地面有反作用(落地踩裂、扬尘、滑出一段);

3. 惯性(冲过头、刹不住、衣发甩出去);

4. 碰撞顿一下(0.1–0.5 秒停顿再爆)。

——B 的「不讲物理」只体现在力量大小和能做的事上,力的因果关系照样讲物理。

  • 中间档(可选)B-轻:武侠轻功——能跳高、踩墙走,但没有能量和光效,落地照样受力。适合 2.5D 半写实打戏(老板 9-26 打斗铁律)。

素材分线(@阿拉赛博蕾,全文见「打戏提示词库」卡)

A 线 · 写实(7 条)

  • 6888 30s,seedance2.5真人格斗视频-效果展示+提示词 还是用之前的方法做的 <https://www.douyin.com/video/7687536395685989678>
  • seedance2.5,30s仿真人打戏合集1,提示词解析 把女子版的做了一个小合集。步骤都 <https://www.douyin.com/video/7693442076473593122>
  • seedance2.5,30s仿真人打戏6,附运镜提示词 skill直出。用一段打戏怀念一下 <https://www.douyin.com/video/7691981717732740386>
  • seedance2.5,30s仿真人打戏5,附运镜提示词 仍旧是用skill和小助手一起出的 <https://www.douyin.com/video/7690936925573696814>
  • seedance2.5,30s仿真人打戏4,附运镜提示词 连续做了几天现代打戏,总结出了不少 <https://www.douyin.com/video/7689784145798647050>
  • seedance2.5的30s真人格斗视频-3 视频由2条剪辑在一起,各自取了还不错的部分, <https://www.douyin.com/video/7688358380435524883>
  • 30s,seedance2.5真人格斗视频效果展示+提示词2 继续用之前的方法做了一版1V3 <https://www.douyin.com/video/7687968634374786319>

B 线 · 超现实(20 条)

  • 19.7K seedance2.5,30s持续打斗视频-5(附提示词) 这是第五次分享see <https://www.douyin.com/video/7673396758189182223>
  • 30s高燃打戏设计思路,附提示词模版及skill 提炼总结了一波最近20w+曝光打戏用到的特 <https://www.douyin.com/video/7692637583867792650>
  • 6套skill!实现漫剧短剧的剧本及脚本创作 整理了6套skill,可以实现漫剧或者短剧创作 <https://www.douyin.com/video/7690525260067654927>
  • 4个提升画面打击感的方法-本skill开源 总结了一波之前的打戏,整了了4个可以在打斗中提升 <https://www.douyin.com/video/7687072775877561636>
  • seedance2.5高燃打戏-16(附提示词) 本来是打算用blender尝试做一下打戏的 <https://www.douyin.com/video/7686119606590737715>
  • seedance2.5高燃打戏-15(附提示词) 已经出到第15则啦,收官啦。打戏的部分先到 <https://www.douyin.com/video/7684176686463618314>
  • 30s高燃打斗视频设计思路及实践(附提示词) 一个小教程。分享一则连贯高燃打斗的设计思路以及 <https://www.douyin.com/video/7683059541121994011>
  • seedance2.5,30s持续打斗运镜分解 拆解一则30s打戏用到的运镜。其实用到的运镜 <https://www.douyin.com/video/7682401881234148623>
  • seedance2.5/2.0,30s高燃武戏(附提示词) 继续用小黑和小红的形象做了一段3 <https://www.douyin.com/video/7680554912387747091>
  • seedance2.5,30s持续打斗视频-9(附提示词) 这是持续打斗的第九次分享。这次是 <https://www.douyin.com/video/7677949115195526440>
  • seedance2.5,30s持续打斗视频-竹林篇 竹林的打斗场景一直很经典,这次用seed <https://www.douyin.com/video/7676687502601735439>
  • seedance2.5,30s持续打斗视频-7(附提示词) 这是持续打斗的第七次分享。很喜欢 <https://www.douyin.com/video/7674977698359397651>
  • seedance2.5,30s持续打斗视频-6(附提示词) 第六次,继续分享seedance <https://www.douyin.com/video/7674258799775026466>
  • seedance2.5,30s连续打斗视频-4(附提示词) 第四次,又一次分享一组seeda <https://www.douyin.com/video/7672401193611611443>
  • seedance2.5,30s连续打斗视频-3(附提示词) 第三次,再再分享一组seedan <https://www.douyin.com/video/7672020666182307082>
  • seedance2.5,30s打斗视频-2(附提示词) 再次分享一组seedance2.5的 <https://www.douyin.com/video/7671641831104384298>
  • seedance2.5,30s打斗视频分享(附提示词) 分享一组seedance2.5的30 <https://www.douyin.com/video/7671204472189619482>
  • 4类!44组!seedance2.5/2.0风格化打斗特效! 看腻了常规的打斗特效?整理了4 <https://www.douyin.com/video/7670152727875374355>
  • 82组!seedance2.5武侠打斗规则! 整理了82组武侠相关的打斗规则,把动作,运镜, <https://www.douyin.com/video/7660493019354778932>
  • 45组超燃武侠打斗运镜!存等seedance2.5! 整理了一套共45组的武侠打斗类运镜,按 <https://www.douyin.com/video/7658870870902967606>

来源:老板 10-07 20:30 语音(Karen 两组试片:真实打斗 / 武侠仙境);@阿拉赛博蕾 真人格斗 1–6 与 30s 打戏 1–16、开源打击感 skill

拳皇式超必杀「光爆四溅」五步光影语法(B 线大招专用)
打戏 · 超现实

拳皇式超必杀「光爆四溅」五步光影语法(B 线大招专用)

拳皇超必杀光爆星芒背景压暗闪白冲击帧光影变化B 线超现实2026-10-08

五步

1. 压暗定格:发动瞬间背景压到近黑(普通大招深蓝调 / MAX 橙黄调),只剩放招者被照亮,白色轮廓边缘光,画面顿半拍。

2. 核心光爆:身上(胸口/拳心)爆出刺眼白色光点 → 四长四短八道细长锐利十字星芒 + 一圈快速扩散光环 + 橙黄火花。

3. 光随招走:能量从招式发出,地面和周围被照亮,影子被拉长甩向光源反方向。

4. 命中闪白:全屏闪白一帧 → 白芯橙边放射状爆炸火花 → 画面震动。

5. 回落余烬:亮度逐渐回落,背景恢复原色,空中飘落光点余烬,收招站定。

首测结论(Seedance 2.0 Mini)

  • 做到:背景压暗+顶光、出拳冲击波光、命中星芒爆炸、4–5 秒节奏。
  • 没做到:胸口光点与八道星芒、全屏闪白一帧;中途人物发色漂移。
  • v2 改法:拆两镜(蓄力光爆特写 / 出招命中);图生视频锁角色;星芒写具体(「白色核心,四长四短八道锐利星芒,十字形镜头光晕」)。
  • 成本:Wan 2.2 最便宜(20 积分/5s,480P)但当晚服务异常;Seedance 2.0 Mini 40;Hailuo 2.3 Fast 30(仅图生视频、6s 起)。
  • 用原创角色,不用拳皇角色(版权)。

来源:老板 10-07 20:39 语音令(KOF 97–2006 大招放光研究);首测 ops/takeover_kof/kof_lightburst_test02.mp4(Seedance 2.0 Mini 480p 5s,40 积分)

AI 打戏方法 · 动作档案 × 因果链 × 快慢呼吸(Seedance / H3 通用)
打戏 · 通用

AI 打戏方法 · 动作档案 × 因果链 × 快慢呼吸(Seedance / H3 通用)

打戏动作设计因果链快慢镜TimeRamp冲击帧SeedanceMiniMax H3skill2026-10-07

纯方法卡(2026-10-07 他令学打戏)。

一、动作:先给每个角色建「动作档案」

  • 最佳交手距离(贴身 / 半米 / 五米)、主攻方式、防守反击、机动特点(腾跃、滑铲、瞬身)。两人档案不同,打起来才不像同一个人在镜子里打。

二、每一下写成因果链(治「对着空气挥拳」「软绵绵」)

发起者 → 打向哪 → 接触结果(格挡 / 命中 / 擦过)→ 对方反应(重心偏移、后滑、跪地)→ 位置变化 → 下一拍的起点。

三个必写:① 对抗关系(谁压制谁)② 身体受力(重心、冲击、形变)③ 镜头节奏(爆发瞬间配慢放 + 推镜)。

三、快慢呼吸(TimeRamp)

  • 蓄力短 → 出招快 → 碰撞顿(0.1–0.5 秒定格)→ 恢复疾。
  • 冲击分级:轻=黑白冲击帧+轴向微震;重=放射冲击帧+双色能量三层爆散;终极=全屏定格+负片闪白+环形冲击波。
  • 收尾要「静」:高速戛然而止 → 死寂 → 延迟爆发(建筑延迟坍塌)。

四、时间轴写法(30 秒 ≈ 五拍)

按 4–6 秒一段:谁 + 在哪 + 做什么 + 镜头怎么动。例(仙侠原作):0-4s 起手交锋 / 4-10.5s 贴身缠斗 / 10.5-16.5s 攻防逆转 / 16.5-24s 终极一击。@阿拉赛博蕾 以 0.5 秒为单位规划时序。

五、三种节奏版本(fight-prompt-director)

高强度连打 / 稳重发力(力量+环境声)/ 混合(交手密度+手、表情、武器特写);另有超快模式压缩时间块。

六、现成工具

  • fight-prompt-director(Claude/Codex Skill):输入角色图 / 场景 / 分镜 / 参考视频 → 出 Seedance(粗时间块)或 H3(精确时间码)提示词 + 连续性追踪(位置、朝向、武器、破坏跨镜带下去)。
  • 打戏铁律(老板 9-26):2.5D 半写实;人物只写图1图2,不写外貌。

来源:GitHub irenerachel/fight-prompt-director(MIT);抖音「AI漫剧打戏软绵绵?记住这3点」1.1万赞;@阿拉赛博蕾 30s 打戏系列;易陶《AI做漫剧仙侠打斗》原作脚本

打戏提示词库 · @阿拉赛博蕾 46 条视频画面提示词全集(OCR)
打戏 · 通用

打戏提示词库 · @阿拉赛博蕾 46 条视频画面提示词全集(OCR)

打戏提示词库Seedance 2.530s 打戏运镜镜头视角特效武侠仙侠规则skill2026-10-07

怎么用:先在「30 秒打戏完整提示词」里找一条节奏接近的整段抄过来,再从「镜头运镜」「特效」分册换零件。原文为视频画面 OCR,个别字可能识别有误;每条都附原视频链接可核对。作者自述以 0.5 秒为单位规划时序。

目录

  • 30 秒打戏完整提示词(14 条)
  • 镜头运镜与站位(19 条)
  • 特效(5 条)
  • 规则与方法(含开源 Skill)(6 条)
  • 其他提示词合集(武侠/仙侠/科幻/妆造/Image2)(2 条)

30 秒打戏完整提示词

30s,seedance2.5真人格斗视频-效果展示+提示词 还是用之前的方法做的打戏设计和最后的提示词产出。突发奇想想要看看真人的效果怎么样,用格斗的方式做了

<https://www.douyin.com/video/7687536395685989678>

低角度贴身跟拍

女生凌空飞踢起势,男生格挡,两人近身缠斗

仰角推镜—>平行侧跟一环绕镜

环绕跟移

女生踢中铁架,男生重拳反击

环绕镜一>仰角推镜一>跟镜

俯冲坠落

女生绕背肘击蹬梁后跃,破窗坠下夹层,男生紧追

贴地跟移一>俯冲推进十贴地跟移

女生绕背时击蹬梁后跃,破窗坠下夹层,男生紧追

贴地跟移—>俯冲推进十贴地跟移

贴地橫扫

女生抄钢管横扫,两人互格

甩镜一急停推镜—>平行侧跟

仰角推镜

滑鈡,男生踩油污失衡,女生攀管疾走,男生重拳砸裂管道

俯冲推进一>贴地跟移—仰角推鏡

多平面立体跟移

两人管道上角力之后跃下管道追进货架

双人同步跟一俯冲推进十平行侧跟

双人同步跟一>俯冲推进十平行侧跟

定格收势

女生一拳终结

仰角推镜—>定格

seedance2.5,30s持续打斗视频-5(附提示词) 这是第五次分享seedance2.5的30s打斗视频,还是小红和小黑,这次从沙漠中达到了天上,下面滚

<https://www.douyin.com/video/7673396758189182223>

SEEDANCE2.5

30S-持续打斗(沙尘一云层)

PROMPT

沙漠驿站沙尘飞扬,红衣黑发少年盘腿闭目坐于画布中央,插沙的剑剧烈震动

麻布细绳绷紧,身后破败红帐被大风吹得翻飞,

0.5s-1s,固定机位锁焦急推,一团黑烟自画面右下方急速冲来,插沙银剑

感应震得沙粒四溅,少年猛然睁眼瞳孔骤缩,大风卷起沙尘扑向镜头,

1s-1.5S,剑身特写锁焦,银剑自动震出松软沙土,麻布细绳崩裂成不规则

毛边碎布四散,剑鸣震颤,沙土大团扬起,

1.5s-2S,低角度极速推镜,少年握剑猛然起身旋身斩向黑烟,黑烟中白发

少年凝聚成形黑雾缭绕,双剑凌空首撞,

2s-2.5S,碰撞点极速推镜小半环绕,银剑玄铁剑正面相撞火星四溅,红色

发光烟雾与黑色烟雾进发对冲,脚下松软沙士被冲击波掀起,

2.5s-35,贴身平行极速横移,密集对攻双剑高频交格,沙土成团扬起漫天

飞舞,两人衣袂发丝剧烈翻飞,

35-3.5s.横扫轨亦跟拍末端急停.剑风撕裂客栈后方红色垂纱布幔,碎成

靜态PROMPT见结尾

心些辰付1型臼供,

25-2.5S,碰撞点极速推镜小半环绕,银剑玄铁剑正面相撞火星四溅,红色

发光烟雾与黑色烟雾进发对冲,脚下松软沙土被冲击波掀起,

2.5s-3s,贴身平行极速横移,密集对攻双剑高频交格,沙土成团扬起漫天

3s-3.5s,横扫轨迹跟拍末端急停,剑风撕裂客栈后方红色垂纱布幔,碎成

不规则毛边碎布被大风吹散纷飞,

3.5s-4s,低角度仰跟垂直上摇过顶,红衣少年踏柱跃上客栈屋顶,松软沙

土随蹬地大团扬起,

A--A Ee 们古照随污焙 白安小年化作巴烟暖护古追坊计层顶 里悯愉屮

少年凝浆成形黑雾综统,双剑废全自撞,

3s-3.5S,横扫轨迹跟拍末端急停,剑风撕裂客栈后方红色垂纱布幔,碎成

3.5s-4S,低角度仰跟垂直上摇过顶,红衣少年踏柱跃上客栈屋顶,松软沙

4s-4.5s,侧方跟随运镜,白发少年化作黑烟腾起直追掠过屋顶,黑烟拖出

残影,大风将沙尘卷上屋顶,

4.5s-5s,尾部跟拍极速推镜,两人腾空升至天际,大风猛烈掀动衣袂,空

中双剑交格红蓝烟雾拉出光轨,

可川生江、年

5s-5.5S,极速推镜攻击直冲镜头,白发少年化作一整团墨色烟雾整体冲撞

无龙形态,裹挟力量撞向红衣少年,

5.5s-6s,攻击尖端极速跟拍,墨色烟雾持续追击压迫红衣少年,红衣少年

空中被推得连连后退,红烟被压散翻涌,

4.5S-55,尾部跟拍极速推镜,两人腾空升至天际,大风猛烈掀动衣袂,空

裹挟力量撞向红衣少年,

无龙形态,

5.5S-6S,攻击尖端极速跟拍,墨色烟雾持续追击压迫红衣少年,红衣少年

6s-6.5s,360度环绕极速急推,红衣少年空中猛然回身,银剑蓄力横扫红色

发光烟雾暴涨,

6.5s-7S,缓推焦点锚定能量交汇点锁焦,白发少年凝聚持玄铁剑斩来,两

剑凌空正面相撞,

•CIT

极速推镜攻击直冲镜头,白发少年化作一整团墨色烟雾整体冲撞

55-5.55,

6.5s-7s,缓推焦点锚定能量交汇点锁焦,白发少年凝聚持玄铁剑斩来,两

7s-7.5S,极速反向拉远广角拉升,红色发光烟雾与蓝色燃烧烟雾对冲爆

发,白发少年被击退从空中狠狠摔落地面,砸起巨大沙尘柱,

7.5s-8s,广角拉升定格收尾,沙尘柱冲天而起急速膨胀,松软沙尘弥漫整

个画布吞没画面,光爆渐隐画面收束

7s-7.5s,极速反向拉远广角拉升,红色发光烟雾与蓝色燃烧烟雾对冲爆

个画布吞没画面,光爆渐隐画面收束。

8s-8.5s,固定机位,漫天沙尘完全遮挡镜头,沙暴翻涌咆哮,

8.5s-9S,极速推镜,镜头穿过沙尘逼近,黑发红衣少年与白发黑衣少年持剑

对峙的身影轮廓浮现,白发少年周身黑雾缭绕,

6.5S-7S,缓推焦点锚足能量交汇总锁焦,日发少年凝聚持玄铁剑斩来,内

9s-9.5S,对峙特写锁焦,双剑交叉抵紧互相角力硬顶,红衣少年银剑缠绕红

色发光烟雾,白发少年手持黑色玄铁剑,剑身泛蓝光并缠绕蓝色烟雾,周身黑

色烟雾弥漫,剑刃交击处火星进溅,红蓝光烟与黑雾交

… 全文约 227047 字,已拆成单独页面。

打开全文 →

来源:抖音 @阿拉赛博蕾(主页 46 条:30s 打戏 1–16、真人格斗 1–6、186 组运镜图解、40 组视角、44/53/72 组特效、82 组武侠打斗规则、600+ 组提示词规则、开源打击感 skill 等)

仙侠打斗 24 秒完整脚本(易陶原作,OCR 扒出)· 剑客 vs 折扇女
打戏 · 超现实

仙侠打斗 24 秒完整脚本(易陶原作,OCR 扒出)· 剑客 vs 折扇女

仙侠打戏Seedance分段脚本TimeRamp冲击帧凤凰原作提示词2026-10-07

原作做法:拖入角色图片 + 粘贴下面脚本(Seedance,16:9 · 720P · 24s)。我们的参考 5 秒切片:https://hbd.oneten.live/out/dl/xianxia_5s_02-07.mp4 、https://hbd.oneten.live/out/dl/xianxia_5s_12-17.mp4 。复刻时人物只写图1图2、2.5D 半写实。

节奏:全程 TimeRamp 快慢镜——蓄力短、出招快、碰撞顿、恢复疾。轻碰撞:黑白冲击帧+轴向微震;重碰撞:放射状冲击帧+蓝黑水流与粉色火焰三层爆散;终极攻击:全屏定格+负片闪白+环形冲击波。

【0-4s 起手交锋】暴雨青石街,银发剑客与折扇女子五米对峙。剑客蹬地爆起,凌空旋身斩出巨大蓝黑重水剑气。折扇女后仰以扇挡剑,错身瞬间高速甩镜锁定,剑扇擦碰处蓝白电弧与粉焰飞溅。折扇女脚下粉焰爆开,化作多层粉黑水墨残影高速瞬身逼近,扇面贴着剑客面门横扫而过,剑客极限侧身闪避。

【4-10.5s 贴身缠斗】两人距离压缩至半米,侧面高速短弧跟拍:直拳偏头—扇扫颈侧剑柄格挡—剑反击仰身回扇—剑扇正面重撞。每次接触极短卡顿,最后一击蓝黑重水与粉色火焰同时爆开,自然遮挡转场。剑客借爆炸退至护栏,踩栏腾空跃上屋顶。折扇女挥扇断柱追上屋顶。剑客高处双手持剑逆空下劈,折扇女张扇格挡沿屋顶极速后退。五米蓝黑剑弧与粉焰对撞,雨水碎瓦炸向四周。屋顶超高速平行跟拍,折扇女前冲横劈,剑客边退边刺撩抹截四式连防,最后一击重碰撞,蓝黑水浪沿湿瓦圆环扩散。

【10.5-16.5s 攻防逆转】剑客踩碎屋瓦跃向更高处,折扇女紧随腾空。剑客凌空转身,全身蓝黑重水与电弧汇于剑身,迎面劈出沉重一击。折扇女被冲击向下击退,砸穿屋顶坠入大殿,镜头垂直俯拍追随坠落。大殿废墟中,折扇女周身粉焰暴涨,气浪环形炸开。火焰凝聚成巨大东方凤凰虚影,扑面瞬间升格慢镜展示压迫感。凤凰直扑剑客,剑客极限后仰贴地滑铲从凤下穿过,转腕横扫出半月蓝白水刃。双方落地即反冲,扇锋与剑刃同时压缩能量,即将碰撞的一瞬高速横向甩镜。

【16.5-24s 终极一击】超广角硬切,大殿、悬崖与暗黑云海铺展纵深。银发剑客化为一道贯穿画面的蓝色残影,一记凌厉平斩与折扇女高速错身。触发全屏冲击帧、0.15 秒定格、鱼眼畸变与 Bloom 高光,蓝黑重水拉出二十米水墨残影。追尾机位跟随剑客冲出大殿,悬崖边急停稳立。高速戛然而止。暴雨悬崖边,剑客背对折扇女子,银发与衣袍被风雨吹动,右手平稳收剑入鞘,剑鞘口只有细小蓝白电弧跳跃。焦点缓缓移向远处仍保持攻击姿势的折扇女。入鞘后短暂死寂。一道巨大蓝黑水墨剑罡斜贯背景,再次触发全屏冲击与环形冲击波。折扇女缓缓倒下,身后大殿沿同一斜向整齐断裂——木柱、青石、屋顶、铜钟同时延迟坍塌。镜头极慢后拉,暴雨中整座大殿大面积坠落,前景银发剑客纹丝不动。

来源:https://v.douyin.com/9jcKeh4I_Mg/ (AIGC设计师-易陶 · AI做漫剧仙侠打斗!附教程 · 2026-08-10)

视频提示词·舞蹈打斗短片的结构:四个特写入场 + 霓虹雨夜群战(来源:抖音 @小小吴 2026-10-05,他当天转发;豆包 / Seedance 2.5 出片,29 秒,无口播)
打戏 · 写实

视频提示词·舞蹈打斗短片的结构:四个特写入场 + 霓虹雨夜群战(来源:抖音 @小小吴 2026-10-05,他当天转发;豆包 / Seedance 2.5 出片,29 秒,无口播)

视频提示词舞蹈打斗霓虹雨夜特写入场Seedance结构拆解2026-10-05

关键词:视频提示词, 舞蹈打斗, 霓虹雨夜, 特写入场, Seedance, 结构拆解

结构(按秒)

| 段 | 时间 | 画面 | 作用 |

|---|---|---|---|

| 入场特写 ×4 | 0–9s | 发光的鞋踩在湿地上 → 嘴唇与脖子上的耳机(雨滴)→ 耳机上的光环 → 戴荧光绿半指手套的手把耳机扣上 | 不露全脸先立人设;「戴上耳机」是开打的信号 |

| 环境大全景 | 9–13s | 雨夜的废墟霓虹城,积水反光,一群黑影围上来,主角在画面正中,脚下一圈紫光 | 交代敌我和空间 |

| 舞蹈式打斗 | 13–22s | 低机位从腿间看过去、贴脸闪避的近景、主角动作带紫色拖光,敌人是不露脸的黑影 | 动作跟着节拍走,打斗像跳舞 |

| 爆点 | 22–25s | 紫色冲击波铺满画面,接一个声波图形的闪白 | 对上音乐的 drop |

| 定格 | 25–29s | 主角正面全身站定,身后是城市灯牌 | 收尾亮相 |

画面语言

  • 配色:青蓝的夜 + 洋红与紫的能量 + 荧光绿的小面积点缀。三种颜色,不多。
  • 质感:半写实的 3D,湿地反光、体积雾、雨丝、浅景深的特写。
  • 敌人全程是剪影或不露脸,观众的眼睛只跟着主角。
  • 全片宽银幕黑边。

对我们的用处

  • 这个结构直接能套到自家的歌上:前四个特写对前奏,群战对 build-up,冲击波对 drop,定格对结尾。
  • 「戴上耳机 = 进入节拍」和音乐品牌是天然一致的动作,可以当固定开场。
  • 人物换成我们自己的角色,不照搬原片的人物造型。

素材

  • 关键帧 11 张:`playbook/intake/dy_dance_fight_neon/kf_*.jpg`;去黑边和水印的参考图 9 张:同目录 `ref_*.jpg`,公网地址 `https://hbd.oneten.live/out/dl/mjref/dancefight/ref_<名字>.jpg`(sneaker / lips / headphone / gloves / city_wide / legs_low / dodge_close / shockwave / hero_pose)。
  • 还没用我们自己的角色验证过。
S 级提示词 · Contact 碰撞接触计算(坐骑/机甲/巨兽有重量感、不发飘)(来源:抖音 AIIGC硬核君 2026-09-17,他 2026-09-23 转发,31.6K 赞)
打戏 · 写实

S 级提示词 · Contact 碰撞接触计算(坐骑/机甲/巨兽有重量感、不发飘)(来源:抖音 AIIGC硬核君 2026-09-17,他 2026-09-23 转发,31.6K 赞)

坐骑机甲巨兽重量感接触反馈环境联动Field 立场扰动SeedanceAI 漫剧动作提示词碰撞2026-09-17

关键词:坐骑 / 机甲 / 巨兽 / 重量感 / 接触反馈 / 环境联动 / Field 立场扰动 / Seedance / AI 漫剧 / 动作提示词 / 碰撞

核心思路:AI 视频里骑乘、机甲、巨兽「发飘」是因为没写接触。分两层写,从核心到全局层层叠加:接触有重量、动态有节奏、环境有联动。

第一层 · 核心接触反馈(必写,一句)

Contact 碰撞接触计算:精准管控受力反馈与接触特效形态,受力部位与接触面精准贴合,随动作节奏产生对应接触特效。

第二层 · 环境联动反馈(Field 立场扰动模拟)

Field 立场扰动模拟:全域光影受特效色调轻度影响,同步环境气流与光影联动效果。

再按主体补一句对应物:

  • 暗翼魔龙 → 气流卷动烟尘、下方压弯植被
  • 作战机甲 → 尾焰热浪、扭曲空气与地面灼烧痕迹
  • 巨兽落地 → 碎石飞溅、尘幕、地面裂纹(类推)

对我们的用法

  • 拼进 Seedance / LibTV H3 的动作段提示词末尾(放在镜头语言之后、风格词之前);与 [[playbook/kb/impact_continuity.md]] 打击感卡、[[playbook/kb/vfx_explosion_impact.md]] 冲击帧配合。
  • 适用:STORM II 方阵冲撞、K-pop PV 机甲/坐骑镜头、《像素回廊》巨物场景。
  • 原视频 47 秒无口播字幕外配音,已转录;关键帧存 assets/kb_contact_weight_prompt.jpg。
站位锁定卡(剧本 → 文字站位图 → 锁定指令)(来源:抖音 可乐「AI 漫剧 skill 盘点」第 1 条,他 2026-09-16 转发、2026-09-17 要求入库)
打戏 · 通用

站位锁定卡(剧本 → 文字站位图 → 锁定指令)(来源:抖音 可乐「AI 漫剧 skill 盘点」第 1 条,他 2026-09-16 转发、2026-09-17 要求入库)

笔记2026-09-16

问题:多镜头漫剧里人物左右互换、场景漂移,成片和脑子里的不一样。

秘诀:出图前先用文字把站位和场景摆出来给人确认,确认完再翻成锁定指令。「指令啥样,成片就啥样」。

三步:

1. 拆剧本:每场列出 谁在场 / 各自位置(左中右、前后景) / 朝向 / 场景固定物 / 光源方向。

2. 文字站位图(给他看,不出图):

「场景:便利店门口,夜。A 在画左靠门,面朝右;B 在画右 2 米,背对镜头;招牌灯在右上。」

3. 锁定指令:把站位图逐句翻进每条镜头提示词开头,作为不变前缀:`[LOCK] A left/near door facing right · B right 2m back-to-camera · sign light top-right` + 该镜头的动作。

用法:= 我们的[[侧写分镜法]]加一步「文字确认」。所有多人多镜头线(STORM II 方阵、白月光、人机日志)在出图前先发站位文本给他过目,再生成;改站位只改前缀。

打击感 + 镜头连贯卡(来源:抖音 可乐「AI 漫剧 skill 盘点」第 2 条,2026-09-16/17)
打戏 · 通用

打击感 + 镜头连贯卡(来源:抖音 可乐「AI 漫剧 skill 盘点」第 2 条,2026-09-16/17)

笔记2026-09-16

问题:AI 打斗软绵绵,招和招之间画面断裂。

打击感五件套(写进出手那一镜的提示词):

1. 冲击帧:命中瞬间 1–2 帧全屏闪白或高反差定格。

2. 顿挫:命中后画面定住 0.1–0.2 秒再继续(hit-stop)。

3. 跟随震动:摄像机随冲击方向抖动,先大后小 0.3 秒。

4. 变速:出手前 0.5 秒慢放蓄力,命中后瞬间回正常速。

5. 收尾:被击者位移 + 尘土/碎片/发丝甩动,给冲击一个去处。

连贯三规则(写进下一镜提示词开头):

  • 上一镜结束的朝向和位置原样接上(左出画就右入画)。
  • 动作动量延续:上一镜挥拳向右,下一镜开头人物仍向右倾。
  • 镜头运动同向:上一镜推近,下一镜不反向拉远,除非是收招。

用法:与 [[vfx_explosion_impact]] 同源(闪白/震屏/冲击波),这张管人对人。Seedance 2.5 / H3 打斗镜头、drop 段卡点动作统一套。

打戏 · 通用

动作视频"没感觉"怎么治 · 力度×形变×变速 黄金三步(AIGC兔兔)

动作视频爆发力提示词语法打斗武侠形变变速具象词视频模型豆包skill2026-09-02

未跑(2026-09-02 intake,纯方法卡,零积分):作者原片(上方 = 作者示例,武侠打斗/水墨山水/血雾能量)讲的是视频提示词的写法,不是某个模型的参数。方法本身与模型无关 —— H3 / Seedance / Higgsfield / 即梦 任意一个都吃这套语法。作者把它包成一个"skill"喂给豆包(传图→自动出动作提示词),我们不需要豆包:这张卡就是那个 skill,本地直接用。

病因(一句话)

AI 是只会抄画面、完全不懂物理的"文盲导演"。你在提示词里写 `加速度 / 弹性系数 / 9.8m/s²`,它一个字都不认;它只认**具象画面**,不认物理定理。

所以"软、飘、假、无机核"的根因 = 提示词是学术报告(堆参数),而不是动态画面描述。

黄金三步(终极万能公式:力度定基调 · 形变做反馈 · 变速造爆发)

| 步 | 做什么 | 具象词库(直接往提示词里塞) | 治什么 |

|---|---|---|---|

| ① 叠力度 | 删掉所有空洞参数,用力度形容词强行拉高动作强度 | 迅猛 / 猛烈冲击 / 瞬间爆发 / 力道拉满 / 势大力沉 / 雷霆一击 | 动作拖沓、疲软 —— 适配所有运动/打斗/冲击场景 |

| ② 加形变 | 每一次发力都要有视觉结果;无反馈的全是假动作 | 炸开 / 扭曲 / 凹陷 / 飞溅 / 震颤 / 龟裂 / 尘土炸起 / 衣袂撕裂 / 空气波纹 | 动作"没落地"、打了跟没打一样 |

| ③ 控变速 | 爆发力 ≠ 全程快,而是瞬间突变的速度差;全程匀速必僵硬 | 骤起骤落 / 瞬间提速 / 急停 / 顿挫 / 蓄力一拍后炸出 / 慢起—急爆—急停 | 全片匀速的"呆板机器人感" |

写法口诀:别做学术报告,只画动态画面。 一个动作 = 力度词 + 形变结果 + 速度曲线,三样齐了才有"感觉"。

提示词模板(我们的落地版 · 中英双语,模型任选)

把一个动作拆成三段写,顺序就是"蓄力 → 爆发 → 反馈":

[蓄力·慢]  角色压低重心,衣袍与长发缓缓垂落,空气近乎静止(0.5s 的慢起)
[爆发·骤快] 瞬间提速,迅猛前冲,一剑势大力沉地劈下,力道拉满
[反馈·形变] 地面轰然凹陷炸开,碎石与尘土向四周飞溅,剑气把山雾扭曲撕开,画面因冲击震颤
[收·急停]  身形急停顿挫,只剩衣袂与尘埃还在飘落
[wind-up, slow]  The fighter sinks low, robe and hair drifting down, the air almost frozen (a half-second slow build)
[burst, sudden]  Then an instant speed spike — a ferocious lunge, the blade crashes down with crushing force
[feedback, deformation]  The ground caves in and bursts open, rock shards and dust spray outward, the sword-wind warps and tears the mountain mist, the frame shudders from the impact
[stop, hard]  A hard stop, sharp and staccato — only sleeves and dust keep falling

可复用的三个句式:

  • 力度句:`(迅猛 / 猛烈 / 势大力沉) 地 + 动词` → `a ferocious / crushing / explosive + verb`
  • 形变句:`+ 导致 X 炸开/凹陷/扭曲/飞溅/震颤` → `the X caves in / bursts / warps / sprays / shudders`
  • 变速句:`慢起 → 瞬间提速 → 急停顿挫` → `slow build → sudden speed spike → hard staccato stop`

我们怎么用

  • H3 Max / Cypher 卡点 / KODA 角色卡:`koda-anime-card-cut` 的 CUT 05 WORLD / CUT 08 IMPACT / CUT 12 HERO MOMENT 三个动作段,原版只写了 "dash, leap, strike",正好套这三步 —— 每个动作段补一句形变反馈 + 一句变速。KODA 的 "short speed ramps" 就是第③步,缺的是①②。
  • Seedance 广告 / IA10 B-roll:任何有"物体运动"的镜头(倒饮料、开箱、机械臂)同理:力度词 + 结果形变(水花炸开/包装弹开)+ 速度差。
  • 鲸背之城 MV / K-pop PV:舞蹈镜头也是动作 —— 把"跳舞"改成"骤然甩发、裙摆炸开、急停定格"。
  • 禁用:`acceleration / velocity / physics-accurate / 9.8m/s² / elastic coefficient` 这类参数词,直接从提示词里删。

关联

  • 同族:`koda-anime-card-cut`(动作段落地)· `cypher-pv-overdrive`(变速=卡点的响)· `h3max-multishot` · `yantong-lighting-grammar`(光影语法,同一"具象词代替参数"哲学)
  • 待办:拿 ONE TEN Karen 的 KODA A1 变体,只改三个动作段的提示词(其余逐字不动)跑一次 A/B,验证"形变+变速"在 H3 Max 上是否肉眼可见 —— 需老板点头再花积分。

来源:https://v.douyin.com/1BLKX7M8ERY/ (AIGC兔兔 · "为什么你做的动作视频缺乏感觉? 看完这个你也可以和大佬那样打斗炫酷丝滑!" #ai视频 #aigc #ai提示词 #ai漫剧 · 101s)

kick-5s-ink-silhouette
打戏 · 写实

kick-5s-ink-silhouette

4.6 秒一脚爆款:2.5D 特写 → 水墨剪影 → 红底一击

来源:抖音 AI newbie.「师姐这一脚帅不」2026-09-17,33.2 万赞,只有 4.6 秒(https://www.douyin.com/video/7686531620061729471)。原片 assets/kick-5s-ink-silhouette.mp4,帧图 _grid.jpg。

BGM:只有一句「我爱你我爱你」人声,反差萌,配的是打斗。

分镜(共 5 拍,每拍不到 1 秒)

1. 0.0s 粒子爆开现身:金蓝色粒子炸开,人物从光里冒出来。第一帧就是亮的、在动的。

2. 低机位跟腿:2.5D 半写实女主侧踢,机位贴着腿往上扫,腿上拖一道蓝金光带(参考 Niagara 三层:Emissive 自发光 + 运动模糊)。

3. 对手脸部特写:紫发反派一个冷笑,制造一点「她要挨揍了」的期待。

4. 硬切白底水墨剪影:两人变成黑色水墨剪影,踢中的瞬间墨迹炸开。

5. 白底一下翻成满屏正红:同一套剪影动作在红底上重演,对手散成墨雾;最后一拍是干净的侧面剪影,对手倒地扬起灰尘。

为什么会爆

  • 短到 4.6 秒,看完自然就重播,留存超过 100%。
  • 三次画风突变(写实 → 水墨 → 红底),每 1 秒左右就打断一次注意力。
  • 明暗、色块反差到了极致:白 → 红、黑剪影,正合老板要的「大块饱和色」。
  • 人物锁定 2.5D 半写实(跟 feedback_fight_video_style_25d 一致)。

给 Oneten_LAB 的 D 风格(打戏 + drop)

  • 套这个结构:粒子现身 → 2.5D 出招 → 对手反应 → 水墨剪影 → 红底一击。把「白翻红」那一下卡在 EDM 的 drop 上。
  • 总长 5–8 秒;结尾那个剪影定格接回第一帧的粒子,做成循环。
  • 角色用我们的四角色(文天 / IA10 / Karen / Mini),图 1 图 2 只写动作(打戏规矩)。
  • 要出新片,会花积分,跑之前先问老板。

镜头运镜 7

AI 镜头语言 · 景别 × 角度 × 运镜 × 镜头 × 跟谁拍(含四个镜头 Skill)
镜头运镜

AI 镜头语言 · 景别 × 角度 × 运镜 × 镜头 × 跟谁拍(含四个镜头 Skill)

镜头语言景别机位运镜镜头焦段跟拍MiniMax H3Seedanceskill2026-10-07

纯方法卡(2026-10-07 他令学镜头)。

词表

  • 景别:超远景 EWS / 远景 WS / 全景 FS / 中景 MS / 中近景 MCU / 特写 CU / 大特写 ECU
  • 角度:平视 / 俯拍 / 仰拍 / 荷兰斜角 / 贴地(虫视)/ 鸟瞰
  • 运镜:摇 pan / 俯仰 tilt / 横移 truck / 升降 pedestal / 推拉 dolly / 变焦 zoom / 摇臂 crane / 环绕 orbit / 跟 track / 甩镜 whip
  • 焦段:广角 / 长焦 / 微距 / 鱼眼;浅景深 / 深景深 / 移焦 rack focus
  • 构图:过肩 OTS / 双人 / POV / FPV / 侧脸 / 三分 / 对称
  • 跟谁拍:环绕跟、侧面平行跟、背后尾随、前方引导、双人同步跟

打戏配镜规则

  • 每个镜头只担一个职责:交代空间 / 跟动作 / 拍接触 / 为下一刀铺垫。
  • 运镜写法和动作参考分开写,免得互相打架。
  • 链式写法(@阿拉赛博蕾):「仰角推镜 → 平行侧跟 → 环绕镜」「贴地跟移 → 俯冲推进 + 贴地跟移」「甩镜 → 急停推镜 → 平行侧跟」「仰角推镜 → 定格」。

四个镜头 Skill

1. cinematic-director-camera-dsl(首推):短指令 `/MS /LOWANGLE /DOLLYIN:MS>MCU:SLOW` → 自动编译成 MiniMax H3(五种输入模式实测)/ Kling / Veo 的镜头提示词。纯 Python。

2. cinematic-video-prompt-skill:700+ 电影术语 + 按视频类型的现成组合 + 各模型常见错误。

3. fal-ai cinematography:镜头、灯光、焦段、调色、场面调度。

4. DirectorSKILL:剧本 → 分镜表(含覆盖镜头)→ 关键帧 / 运动提示词 → 剪辑时间线,10 种导演风格(斯皮尔伯格、库布里克、王家卫、诺兰…)——剧情片用。

用法

打戏 Skill 出动作与节拍,camera-dsl 出每拍镜头,两份合并成最终提示词。

来源:GitHub SK-SL-source/cinematic-director-camera-dsl(MIT)· Rylaispirit/cinematic-video-prompt-skill · fal-ai-community/skills cinematography · wuwangzhang1216/DirectorSKILL;fight-prompt-director camera-guide

视频提示词·电影感三组后缀:摄影机色彩 / 动态范围 / 胶片(来源:抖音 @AIGC小悦儿 2026-10-03,他 2026-10-04 转发;全套要评论暗号 577 领,视频里只露了关键词)
镜头运镜

视频提示词·电影感三组后缀:摄影机色彩 / 动态范围 / 胶片(来源:抖音 @AIGC小悦儿 2026-10-03,他 2026-10-04 转发;全套要评论暗号 577 领,视频里只露了关键词)

视频提示词电影感摄影机色彩HDR胶片广告片2026-10-03

关键词:视频提示词, 电影感, 摄影机色彩, HDR, 胶片, 广告片

用法:这是视频提示词的后缀(原作者用于文生视频),接在镜头描述之后,三组可叠加,不改构图只改质感。出广告片时默认带上(他 2026-10-04 定,已交代 Karen)。

| 组 | 中文原词(视频里的写法) | 英文对应 | 作用 |

|---|---|---|---|

| 1 现代数字摄影机色彩 | Ari Alexa 色彩科学、Red Komodo 肤色、摄影机原生色彩 | ARRI Alexa color science, RED Komodo skin tones, camera-native color | 压掉 AI 默认的过饱和渲染感,肤色更沉稳写实 |

| 2 动态范围 | 高动态 HDR、10bit 色深、宽广动态范围 | high dynamic range, 10-bit color depth, wide dynamic range | 光影层次拉开,高光不过曝 |

| 3 胶片氛围 | 富士胶卷模拟、宝丽来即时成像、柯达 Vision3 500T、适度颗粒度 | Fujifilm simulation, Polaroid instant film, Kodak Vision3 500T, moderate film grain | 去掉生硬的 AI 感,给胶片颗粒和偏色 |

注意:

  • 视频里的示例是文生视频(8 秒、电影级写实风格的镜头描述 + 这些后缀),作者强调「参数精准到个位,画面才不跑偏」。
  • 第 3 组里宝丽来和 500T 是两种不同的偏色(暖褪色 vs 钨丝灯冷调),同一条提示词里选一个,别全堆。
  • 没有对照就不算验证:上线前用同一条提示词做「带后缀 / 不带后缀」各一张对比。我们还没测过。
  • 相关卡:mj_cinematic_still_lens_control.md(镜头与焦段控制)。
  • 适用线:HYPER REAL K 写实韩剧预告、SONGGIFT 情侣广告、宴会/派对房间画面。
写实电影感 MV 静帧 · 镜头/景深控制词(Midjourney,来源:他 2026-09-24 凌晨自己跑的「车内夜驾」图,效果被他点名「高级感一下就出来」)
镜头运镜

写实电影感 MV 静帧 · 镜头/景深控制词(Midjourney,来源:他 2026-09-24 凌晨自己跑的「车内夜驾」图,效果被他点名「高级感一下就出来」)

MJ写实电影感景深虚化bokehfocus镜头语言车内夜景在你的城市醒来静帧模板lens2026-09-24

关键词:MJ / 写实 / 电影感 / 景深 / 虚化 / bokeh / focus / 镜头语言 / 车内 / 夜景 / 在你的城市醒来 / 静帧模板 / lens

原提示词(逐字,--ar 16:9)

#rednightdrive Photorealistic cinematic music video still, adult East Asian woman with long vivid copper-red hair driving a modern unbranded sports car at night, dark baseball cap, fitted charcoal ribbed knit top, visible seatbelt, calm introspective expression, looking ahead at the road. Camera from front passenger seat, medium shot showing her face, hands on steering wheel and dark car interior. Cool blue distant city skyline and soft bokeh lights outside the windows, warm amber dashboard light and passing streetlights grazing her cheek and red hair, deep shadows, moody quiet atmosphere, shallow depth of field, realistic skin texture, subtle analog film feel, no text, no logo, no extra people

哪几句在控制「镜头感」(拆解)

1. 定媒介:`Photorealistic cinematic music video still` —— 一开头就把它定成「MV 剧照」,MJ 会按电影机位/调色去理解,而不是证件照或插画。

2. 定机位与景别:`Camera from front passenger seat, medium shot showing her face, hands on steering wheel` —— 说清相机在哪、拍到什么,画面才有前景(方向盘、车门)挡在镜头前,这是虚化层次的来源。

3. 定虚化对象:`soft bokeh lights outside the windows` + `shallow depth of field` —— 一句说背景怎么虚(bokeh 光斑),一句说景深浅;两句都要,只写 shallow depth of field 常常不够。

4. 定光的方向与落点:`warm amber dashboard light and passing streetlights grazing her cheek` + `deep shadows` —— grazing(掠过)是关键动词,光从侧面擦过脸才有立体和高级感;deep shadows 保证暗部不被提亮。

5. 定质感:`realistic skin texture, subtle analog film feel` —— 皮肤纹理 + 胶片感,去掉 AI 塑料感。

6. 反向约束:`no text, no logo, no extra people` —— 干净。

原提示词没有写相机型号或焦段,景深靠 2+3+4 三组词堆出来。

以后出静帧统一追加的「镜头块」(贴在场景描述后面)

Camera from [机位], [景别] showing [主体部位], [前景元素] in the foreground. Soft bokeh [光源] in the background, shallow depth of field, focus locked on her eyes, [主光] grazing her cheek, deep shadows, realistic skin texture, subtle analog film feel, no text, no logo.

想再强一点可加:`shot on a 50mm lens at f/1.8, slight anamorphic flare`(焦段/光圈明说,MJ 与 Codex 都认)。

同批第二条(窗边金发,图生图改造)

Transform the blonde woman in the attached portrait into a cinematic analog-film photograph. Preserve her recognizable face, long pale-blonde hair and straight bangs. Seat her beside a window in a dim room, turning to look over her shoulder toward the camera; warm late-afternoon light through the window grazing one side of her face, deep shadows elsewhere, shallow depth of field, realistic skin texture, subtle film grain, no text, no logo.

同批变体(他 2026-09-24 01:33 截图,同一角色不同机位,都 --ar 16:9,负面:no text, letters, words, logo, watermark, signature, ui)

#zqldrive Interior of a sports car at night, a stylish young East Asian woman in the driver's seat wearing an oversized beige hoodie and a cap, one hand resting on the steering wheel, looking ahead calmly. Through the windshield a wide city skyline glitters far away, out of focus. She sits in the lower right of the frame, leaving the upper half open sky and skyline. cinematic night photography look, shallow depth of field, city bokeh, warm cabin light against cool blue city lights, soft film grain-free finish, moody and calm, high detail
#zqmdrivereal Interior of a sports car at night, a stylish young East Asian woman in the driver's seat, wearing a fitted ribbed knit top and a cap, long hair down, one hand on the steering wheel, looking ahead calmly. Through the windshield a wide city skyline glitters far away, out of focus. She sits in the lower right of the frame, the upper half left open for sky and skyline. cinematic night photography, shallow depth of field, city bokeh, warm cabin light against cool blue city lights, moody and calm, high detail
#zqlhood A stylish young East Asian woman sitting sideways on the open window frame of a parked sports car at night on an empty rooftop car park, legs inside the car, looking out at a distant city skyline, oversized cream knit and cap, wind in her long hair. She sits in the lower left third, the upper right is open …(截图截断)

这批多出来的第 7 个控制点 · 构图留白:`She sits in the lower right of the frame, leaving the upper half open sky and skyline` —— 明说人物落在哪个三分之一、哪半边留空,画面立刻有电影海报的呼吸感,也给字幕/歌名留了位置。写静帧时机位、景别、留白三句一起写。

用法

  • 《在你的城市醒来》Shorts/MV 写实线全部静帧按此模板出(Codex 编辑版也照抄镜头块)。
  • 与 [[poster_lighting_style_lock]] 的 2.5D 线并行:写实线用本卡,插画线用海报光影卡。
转场尾句卡(每条镜头提示词末尾自动补一句贴画面的转场)(来源:抖音 可乐「AI 漫剧 skill 盘点」第 3 条,2026-09-16/17)
镜头运镜

转场尾句卡(每条镜头提示词末尾自动补一句贴画面的转场)(来源:抖音 可乐「AI 漫剧 skill 盘点」第 3 条,2026-09-16/17)

笔记2026-09-16

问题:镜头之间硬切,像幻灯片。

秘诀:每条镜头提示词收尾固定加一句「转场句」,内容按当下画面定,不用通用词。

转场句模板(挑一句贴在提示词末尾):

  • 打击转场:「拳头命中的闪白直接盖满画面,下一镜从白中亮起。」
  • 遮挡转场:「路人/车/门从镜头前划过,划过时切到下一场。」
  • 光转场:「灯一灭全黑 0.3 秒,下一镜从黑中点亮。」
  • 运动转场:「镜头顺着人物跑动方向快速甩出,甩成拖影。」
  • 物件转场:「镜头推进到 X(杯子/屏幕/眼睛)填满画面,下一镜从同一物件拉开。」
  • 匹配转场:「结束帧的构图和下一镜开场帧同位置同大小。」

规则:转场句只写「本镜怎么结束」,不写下一镜内容;下一镜提示词开头写「从上一镜的 X 中开始」呼应。

用法:写分镜提示词时最后一步统一补尾句;[[cinematic_fx_glossary]] 里的 whoosh/impact 音效按转场类型对应。

镜头运镜

ChatGPT 机位"斜杠暗号" · 一张图 + /extremewide 等 4 个短码替代长提示词(reels_hwan)

ChatGPTGPT Image机位构图短码提示词压缩图生图人像一图多机位Codex出图2026-09-03

未跑(2026-09-03 intake,纯方法卡,零积分):韩国创作者 @reels_hwan 的 10 秒屏录:把一张真人街拍(灰上衣白裙过膝袜坐台阶)扔进 ChatGPT,输入框里不写提示词,只打一个斜杠短码,就出同一人物同一场景的不同机位图。视频无旁白,全部信息在字幕 + 屏录 + 文案里。上方 = 作者原片(压缩版),下方联络表见 `assets/ig-chatgpt-angle-slash-codes_contact.jpg`。

它是什么

一张参考图 + 一个"命令式"短码,让 ChatGPT(GPT Image 图生图)重新取景。作者文案原文给的 4 个码(逐字):

/extremewide
/topdown
/ultracloseup
/wormseyewide

屏录里实际演示了 3 个:`/extremewide` → 人变小、整栋咖啡店门脸+街道进画;`/ultraclose` → 只剩脸与吸管的正脸大特写;`/wormsey(e)wide` → 贴地仰拍,白鞋顶到镜头前、蓝天屋檐透视拉开。每次都保留了同一人物、同一服装、同一场景(台阶+白包+冰咖啡)。

为什么有效

  • ChatGPT 的图像模型对摄影术语单词(extreme wide / top-down / ultra close-up / worm's-eye)有很强的先验,一个词就能定机位,不需要"a cinematic photo of the same girl seen from…"这种长句。
  • 斜杠不是 ChatGPT 的正式命令,只是把词包装成指令的心理暗示 —— 模型看到 `/xxx` 会把它当成"对上一张图执行操作",而不是"重新描述一张新图",所以人物/服装/场景一致性反而更好(没有多余描述词去干扰)。
  • 长提示词的副作用是"每个形容词都在改画面";短码只改一个维度(机位),其他全部继承参考图 —— 这就是一图多机位便宜又稳的原因。
  • 传播角度:把常识(写机位)包装成"秘密代码",评论区求码(218 条评论 vs 3 赞,典型评论钓鱼型 Reel)。

用法(我们的落地版)

1. 传一张已定稿的人物图(KV / 角色卡 / 真人街拍都行),不要附任何文字描述。

2. 只发一个短码。可直接用的短码库(作者 4 个 + 我们补的常用机位):

/extremewide      极广角全景,人物变小、环境交代
/wideshot         普通全景
/mediumshot       腰上中景
/closeup          肩上近景
/ultracloseup     脸部大特写(眼睛/嘴唇/道具)
/topdown          正俯拍(平铺/上帝视角)
/highangle        高角度俯拍
/lowangle         低角度仰拍
/wormseyewide     贴地仰拍+广角(鞋/腿透视拉长,天空进画)
/overtheshoulder  过肩
/profile          纯侧脸
/backview         背影
/dutchangle       斜角

3. 想连续出一组:同一对话里一条条发,每条只有一个码,中途不要加形容词;要换机位就再发一个码,不要说"再来一张"。

4. 需要叠光影/焦距时,把码放最前面再补一句短的:`/wormseyewide, 24mm, golden hour`(见 `focal-length-control`)—— 但先跑纯码版当基线。

什么时候用(ONE TEN / PinLA)

  • KV 定稿后的补机位:T12 潮牌 KV / T13 都是一张主图配多机位插卡,之前是重写整段提示词;改成主图 + 短码,能省下大量描述词,一致性更稳。Codex 出图(GPT Image)走的就是同一模型,直接可用。
  • 侧写分镜 B-roll(IA10 工作日志):`/topdown`(桌面/设备)、`/ultracloseup`(手/道具)、`/backview` 正好是无脸插入镜头的三大机位。
  • KODA / Cypher 角色卡:角色定稿图 → 一组 `/extremewide` `/lowangle` `/ultracloseup` 得到 H3 首帧的多机位版本,再喂 H3 做动态。
  • SONGGIFT / 舞蹈室海报:客户一张自拍 → 多机位人像组图。
  • 局限:只管机位,不管镜头运动;真人脸在 `/ultracloseup` 下会被"美颜化"(联络表第 8 格的脸明显被重绘),做真人商单要复核相似度。

关联

  • 同族:`focal-length-control`(焦距 + 拍摄距离,跟机位码叠用)· `character-card-3step`(角色定稿图来源)· `t12-chaopai-kv-13cut`(多机位 KV 用途)· `mv-coverage`(同一时刻多机位覆盖,思路一致)
  • 待办:用 Karen 定稿图在 Codex 上跑一次 4 码基线(零额外 API 费,走 Codex 图像额度),把出图贴回这张卡定级;验证 `/wormseyewide` 对二次元角色是否同样稳。

来源:https://www.instagram.com/reel/Dcq1ZjitzZl/ (@reels_hwan 릴쏸 · "챗지피티 카메라 앵글 비밀코드" ChatGPT 相机角度秘密代码 · 10s · 无旁白,仅字幕+屏录 · 2026-08-30)

镜头运镜

H3 Max 单段自分镜(关键发现)

H3Max多镜头省积分2026-09-02

关键:Minimax H3 Max(后训练极速版)能在一段视频里硬切多个镜头——老H3做不到(只做连续运动)。所以多镜头PV不用生成好几段再拼,一段10s H3 Max 就够,成本从4-8段砍到一段(~140积分)。

怎么触发自分镜

提示词里给一串逐条列出的micro-shot + 明确时间线 + "每0.5-1.2s一个新构图" + "animate ENTIRE composition不只角色" + 快切/wipe/split/mask/snap。提示词越"密"、镜头越多越快;提示词太温=出来平、慢(教训)。

参数

  • model="Minimax H3 Max", modeType=singleImage2video, 768P, duration=10
  • 喂一张密集KV(越满效果越好)
镜头运镜

焦距控制 — 为什么你的24mm不炸裂

焦距电影感AI视频提示词2026-08

90%的人写焦距(如 24mm 广角)出来不炸裂,是搞错了焦距原理。焦距不是随便标个mm——要配合主体距离 + 透视 + 构图意图。

用法要点

  • 广角(14-24mm):夸张透视、近大远小、张力/压迫感、环境交代 → 近距离怼主体才炸裂,不是远远拍
  • 标准(35-50mm):接近人眼、自然、叙事
  • 中长焦(85-135mm):压缩空间、背景虚化、人物特写高级感、脸部不变形
  • 超长焦(200mm+):极致压缩、抽离感
  • 提示词里 焦距 + 拍摄距离 + 透视描述 一起给,H3/Seedance才吃得准
  • 深挖TODO:原视频有具体炸裂案例,重看取完整对照

来源:https://v.douyin.com/lRFI-KqO_vg

特效 5

音频驱动的水墨粒子可视化(TouchDesigner · 规则 × 随机混沌)
特效

音频驱动的水墨粒子可视化(TouchDesigner · 规则 × 随机混沌)

音频可视化audioreactiveTouchDesigner生成艺术粒子水墨实时Moon1k直播背景歌词视频2026-10-08

看到的效果

白底黑墨:一团墨芯在画面中心,随鼓点炸开成细长的墨线和羽毛状丝缕,再收回;每拍形状都不同,但始终围着中心——「精确规则 + 随机混沌」。极简单色,像墨滴进水里被声音推着走。

原理(TouchDesigner 典型做法)

  • 音频分析(Audio Spectrum / 分频段包络:低频→爆开半径,高频→丝线细碎度,瞬态→炸开触发)。
  • 粒子/流体:GPU 粒子或 2D 流体(noise 场 + 速度场)从中心发射,加长拖尾和反馈(feedback)形成墨线残影。
  • 反相 + 高对比:黑白、轻微模糊叠加 = 水墨感。

我们怎么做(不必学 TouchDesigner)

  • 离线出片:沿用 HTML→MP4 管线(__seek + puppeteer + ffmpeg),用 Three.js / WebGL 粒子 + 预先分析好的音频包络(逐帧读 RMS 和分频能量),做成 Moon1k / ONE TEN 的音频可视化竖版短片或直播背景。
  • 实时:TouchDesigner 非商用版免费可试;直播做现场可视化时再考虑。
  • 用途:Moon1k drop 切片、Oneten_LAB Shorts 的另一种画面风格(不需要角色,零积分)、文天台歌曲页背景。

来源:https://www.instagram.com/reel/Dd9Fa6dteth/ (td @incrprl.dsgn · sound @deescawa · "exploring intersection of precise rules and stochastic chaos" · 33 秒)

玻璃触屏界面 · 人物破屏质感(Pop-out on Glass UI)
特效

玻璃触屏界面 · 人物破屏质感(Pop-out on Glass UI)

笔记2026-09-22

定稿日期 2026-09-22 · 验证 16:30 Karen 用 mj_glass_ui.txt 在 MJ 一发命中,基准图 `~/claude-work/kpop-pv/thumb3d/glass_ui_ref.jpg` · 来源 他看 Karen 的两张 Midjourney 试图后拍板「这个质感非常喜欢」

质感锁(不动)

  • 暗色未来感触控界面,玻璃面向镜头延伸,带柔和反光
  • 背景是虚化、半透明、发光的信息流卡片(无 logo / 图标 / 文字 / 数字)
  • 浅景深;主光冷蓝青,轮廓光暖红
  • 人物 2.5D 插画:干净线稿 + 柔和厚涂阴影,保留参考图脸/发/黑色衣服
  • 出图模型:Midjourney(LibTV MJ 节点 1000 字上限;官网同一条);Codex gpt-5.5 也可但玻璃质感弱

可变(换人换动作)

  • 动作:不要贴着屏幕趴(太贴画面)。基础动作 = 从玻璃面里升起,上半身立起朝镜头,一手按玻璃掌下透光,玻璃上有倒影,接触处像液态光起波纹
  • 其它可选:单手撑起探头 / 一臂伸向镜头 / 坐在玻璃面上腿垂下 / 半身穿出玻璃回头
  • 人物:换参考图即可,其余提示词不动

提示词(799 字)

文件:`~/claude-work/kpop-pv/thumb3d/mj_glass_ui.txt`

Dark futuristic touchscreen interface seen from a low angle, the glass surface stretching toward the camera with soft reflections, blurred translucent feed tiles glowing in the background, shallow depth of field, cool blue-teal light with a warm red rim light. The girl from the reference image, same face hair and black outfit, 2.5D anime illustration with clean linework and soft painterly shading, rises up out of the glass surface from the waist, upper body upright and leaning toward the viewer, one hand pressed on the glass with a faint light bloom under her palm, her reflection visible on the surface, calm confident gaze at the camera. Where her body meets the glass the surface ripples like liquid light. Cinematic, high detail, no grain, no logos, no icons, no text, no numbers --ar 16:9

v2 · 物理折中版(2026-09-22 16:35 他嫌 v1「像池子飘出来」太抽象)

玻璃改硬、实;开一个方正卡片形开口,她从开口爬出,双手扒硬边,下半身在玻璃下隐约可见,硬面倒影 + 真实接触阴影;禁 ripples / liquid / melting。质感层不动。

文件:`~/claude-work/kpop-pv/thumb3d/mj_glass_ui_v2.txt`(937 字)。退路:人站在硬玻璃面上弯腰按屏(全写实,破屏感弱)。

v3 · 两个新方向(2026-09-22 16:40 他:不用爬,简单两层 3D 交互即可;或干脆放弃多重场景,只要质感)

  • A 两层站立版 `thumb3d/mj_glass_layers.txt`:玻璃面上一张平卡(她的世界),她作为独立一层站在卡前面,脚踩玻璃,手插兜看镜头,真实投影落在玻璃和卡上 + 倒影;无爬无波纹。
  • B 纯场景版 `thumb3d/mj_glass_scene.txt`:夜晚未来感 lounge,她倚长条黑玻璃台,手平放,背景大块半透明发光板虚化,蓝青主光红轮廓光,低机位,人在左三分之一。排版变体:换 left third→center / right third;换 leaning on→sitting on the edge of / standing behind。

姊妹模板

  • 平卡信息流破屏(斜看整页、平卡无框、人从卡里出来):`thumb3d/prompt_karen_popout.txt`(Codex 版)/ `thumb3d/mj_popout_v3.txt`(MJ 905 字)
  • 用途:YouTube 封面(政策:无假 UI 数据、无平台 logo)
特效

T15 乱线频谱 · Audio-Reactive Lines · 零积分音频驱动生成线条 · Moon1k Shorts(2× 画布 2K 竖版 crf15)

T15零积分音频驱动generativeflow-fieldnoise-linesMoon1kShorts9:162Kcrf15无星待评级ffmpegchrome-render2026-09-04

老板锁定 2026-09-04(待评级,他看片后定层) → 模板编号 T15。上方成品 = `hq_lines_cone_six_2k_nosparkle_tg.mp4` 的网页压缩版(540×960;原片 1440×2560 · 24.7s · 30fps · 无星粒子版)。点名法:「T15 + 歌/片段」或在选歌台点一段 → 自动出。一分积分不花:全程本机 Chrome 画布渲染 + ffmpeg 编码。

定位

  • 零积分的 Moon1k Shorts 视觉:纯黑底上几百根发光噪声/流场线条互相穿插,整张画面跟着音频呼吸。没有角色、没有版权画面、没有模型积分,一首歌一段 25s 直接出
  • 用途:Moon1k drop 切片引流线([[project_moon1k_clips]])的默认视觉、Shorts / Reels / 抖音音乐条、歌曲 teaser 底片;也可作 T05 Moon1k MV 的间隙镜头
  • 不适合:要露脸/角色的题材(那是 T13 / T08 家族);需要具象叙事的片子
  • 字幕层固定三行:`Moon1k` / `(feat. IA10)` / 钩子句(默认 `Moon1k on YouTube`,`--hook` 改,`--no-hook` 关);歌名隐藏(引流靠好奇心,不靠标题)

音频→画面映射(lines 风格的旋钮,全在 render_reactive.py 的 STYLES["lines"])

  • 低频 bass → 线宽 + 步长:`width=2.4 × (1 + 1.8·bass)`,`step_len=9 × (1 + 1.3·bass)`——鼓一踩线条变粗变长
  • 中频 mids → 湍流:`curl=2.4`、`turb_mid_gain=1.5`、`jitter=7`——人声/合成器一起来线条开始翻卷
  • 高频 highs → 色相偏移:`hue_base=205`(电蓝)`hue_spread=130`(青→品红)`hue_high_shift=45`;星粒子已关(`--no-sparkle`,老板定:只要线,不要星星)
  • onset(鼓点)→ 位移冲击 + 白闪:`kick=110` 像素级推开、`kick_decay=0.80`、`flash=0.9`
  • RMS(响度)→ 中心光晕:`bloom_radius=300`、`bloom_gain=420`、`bloom_alpha=0.2`——整段最响的地方中心最亮
  • 拖影 `fade=0.10`(8–15% 之间才有"线在流"的感觉,太高变糊、太低变闪);整体缓慢旋转 `rotate=0.025` + 漂移 `drift=0.45`
  • 视觉特征:`lines=96` 根、每根 `steps=64` 段;2× 画布下线芯锐利 + 外层 glow=3.2,这是"不像 720p"的关键

逐字命令 · 正式版(下次直接用这个)

python3 ~/claude-work/moon1k-clips/reactive/render_reactive.py <song_or_clip.mp4> <out.mp4> --style lines --scale 2 --out-w 1440 --out-h 2560 --hq --no-sparkle
  • 输出两份:`<out.mp4>` = 1440×2560 母版(`--hq`:libx264 slow · crf15 · high · keyint=60,不做 25MB 上限)+ `<out>_tg.mp4` = 1080×1920 crf18 ≤50MB(Telegram 发送版)
  • `--scale 2` = 画布按 2× 过采样渲染再 lanczos 缩到 `--out-w/--out-h`;只有 chrome 后端支持(默认 `--backend auto` 会选 chrome)
  • 耗时:约 7 分钟 / 25s 片段(iMac,含分析 + 帧渲染 + 两次编码)
  • 输入可以是整首歌或已切好的 drop 片段;音频分析在 `features.py`(bass/mid/high/RMS/onset,写 `features.json`)
  • `--seed`(默认 7)换线条布局;`--brand / --feat / --hook / --title` 改三行字(`--title` 默认空 = 歌名隐藏)
  • 本条成片实跑:`render_reactive.py moon1k_cone_six_v1_drop.mp4 hq_lines_cone_six_2k_nosparkle.mp4 --style lines --scale 2 --out-w 1440 --out-h 2560 --hq --no-sparkle`(2026-09-04 16:39–16:46)

自动路径(不用手跑)

  • 在选歌台点一段 → `segment_harvest`(launchd `com.pinla.segment-harvest.plist`)30 分钟内自动用上面这条命令渲染 → 成片进 Moon1k 切片线
  • 手动路径只在要换风格/换 seed/换字时用

可选风格(同一条命令换 `--style`)

  • `--style stormx`:更狠的鼓点位移(kick=255 · flash=1.35)+ RGB 分离(onset 后 3 帧 10→6px 色差);适合硬 drop
  • `--style shatter`:onset 时线条炸成 Voronoi 碎片(24–60 片按鼓点强度,0.4s 回聚,最大飞出 190px);适合 build→drop 的"碎一下"
  • `--style ar --plate <IMG>`:动漫底图压暗 20%(`ar_dark=0.2`)+ 线条沿底图边缘走(edge-guided,`ar_flow_gain=2.5` · `ar_pull=5.0`),onset 时底图 +15% 两帧 + 边缘闪;`--plate-x` 选 16:9 底图裁 9:16 的窗口位置(默认 0.565);默认底图在 `bgpool/`
  • `storm` 是 stormx 的底(更密更品红),一般直接用 stormx

生成视频的卡点重映射(配套工具,不是主线)

  • `reactive/beat_remap.py <video> <audio> <out>`:把已生成的素材按歌的 onset/RMS 做变速(`--slow 0.4 · --fast 2.8`,pingpong 回放),输出 `<out>.onsets.json` + 速度曲线图;样例 `demo_beatremap_cone_six.mp4` / `demo_speed_curve.png`
  • i2v 来源结论:只有 Google Flow Lite(10 分 / 8s 片) 值得拿来喂 beat_remap;Happy Horse 把抽象线条当静帧处理——否决,不要再试

学到的规矩(老板反馈 2026-09-04)

  • 样片一律当"文件"发给他:Telegram 视频通道会二压,线条类画面被压得像 720p,他看到的不是真效果;`--hq` 的 `_tg.mp4`(crf18 ≤50MB)走文件发送
  • "看着像 720p"的真解 = 2× 画布 + 锐利线芯 + crf15(`--scale 2 --hq`),不是简单拉分辨率;对比图 `reactive/compare_old_vs_2k.jpg`
  • 不要星粒子(`--no-sparkle`):星星让画面碎、抢线条;老板明确只要线
  • 歌名不出现在画面里;三行字(品牌 / feat / 钩子)固定在安全区([[feedback_9x16_safe_zone]])
  • 抽象线条内容熵极高:网页/Telegram 压缩版体积都比角色 PV 大得多,发之前看体积

时长 / 成本 / 渲染时间

  • 成片 24.7s(跟输入片段长度走)· 1440×2560 · 30fps · 音轨原样 mux
  • 成本:0 积分(本机 Chrome 画布 + ffmpeg)
  • 渲染:约 7 分钟 / 25s(2× 画布);不加 `--scale 2` 约 2 分钟但会被说"像 720p"
  • 自动:选歌台点段 → 30 分钟内出

关联

  • 切片线:[[project_moon1k_clips]](选歌台 → segment_harvest → 自动发)· 母引擎 `~/claude-work/moon1k-clips/reactive/`(`render_reactive.py` · `reactive.html` 画布 · `render_frames.js` · `features.py` · `beat_remap.py`)
  • 同族:T05 Moon1k MV(有画面的长片)· `method-kinetic-typography`(HTML→MP4 同一套 Chrome 渲染思路)· `beatsync-retime`(卡点变速)
  • 风格叠加:`--style ar` 可叠 S02 潮玩夜 / S01 白月光的底图当 plate
爆炸镜头「冲击帧 + 震屏」提示词配方(来源:抖音 菜菜 2026-07-30,他 2026-09-08 转发)
特效

爆炸镜头「冲击帧 + 震屏」提示词配方(来源:抖音 菜菜 2026-07-30,他 2026-09-08 转发)

笔记2026-07-30

问题:AI 漫剧里的法术爆炸像烟花,没有分量。

秘诀两个字:冲击。

1. 冲击帧(负责炸点 + 力度)——提示词直接写:

「爆炸瞬间画面全屏闪白,中心点高速炸开,冲击波像圆环一样向外扩散,地面尘土、碎石、残渣一起被掀起。」

2. 震屏(负责代入感)——同一镜头里加:

「爆炸瞬间摄像机剧烈震动,震动幅度先大后小,持续 0.3 秒,随后缓慢恢复稳定。」

三者对齐:闪白 = 爆点,冲击波 = 力度,震屏 = 代入。缺一个就飘。

用法:Seedance / H3 / Flow 的动作镜头统一套这两句;MV 打斗、drop 段视觉、IA10 工作日志的「数据流爆开」转场都可用。

fx-prompt-niagara-3layer
特效

fx-prompt-niagara-3layer

技能特效提示词 · Niagara 三层公式(漫剧打斗)

来源:抖音 柔柔漫剧 2026-10-08(https://www.douyin.com/video/7694184983774992763,50s,3.9k 赞)。演示界面:seedance2.5 · 16:9 · 720p · 30s。

原视频与缩略图:assets/fx-prompt-niagara-3layer.mp4、assets/fx-prompt-niagara-3layer_grid.jpg

思路

借游戏/影视实时粒子系统(UE Niagara)的术语写提示词。法阵、剑气、冲击波这类技能特效都是一层层粒子叠出来的,提示词也照这个顺序分层写。

第一层 · 核心光效结构

  • `Emissive 自发光`:控制亮度
  • `分层渲染`:让光效有前后层次
  • `高光锚定纹路中心`:亮点锁在符文/武器中心,不漂移
  • 光效形态跟着角色走(一套公式套三类技能):

- 法师 → 法阵符文

- 射手 → 弓弦上凝聚的光点

- 剑修 → 武器上的光效

第二层 · 动态轨迹

  • `Motion Blur 运动模糊采样`:技能有节奏、不生硬的关键
  • 动态节奏跟技能类型匹配;轨迹拖尾,粒子按节奏散开

第三层 · 环境联动

  • 从核心往外一层层叠:核心光效 → 轨迹 → 环境(尘雾、气浪、远景被照亮)
  • 口诀:光效有层次,动态有节奏,环境有联动

示例句(视频里屏幕上打出的原文)

特效:Emissive自发光,分层渲染精准管控核心亮度与……

能用在哪

  • B 线打戏和 KOF 大招光爆(ops/takeover_kof/):把「光爆」拆成核心 Emissive → Motion Blur 轨迹 → 环境受光这三层来写,就能补上 v3 那种画面发糊、没有层次的问题。
  • 作者把这套词收进了一个「漫剧打斗 skill」,要在评论区扣 666 才给,我们没拿到;上面的公式是从口播和画面里拆出来的。

出图风格 17

出图风格

AI 电影海报 Skill(梵想美学)· 先判断再出图:剧情→母题→分层出图→字体系统

电影海报宣发视觉视觉母题字体系统字图关系分层合成Codex skill文天影业2026-10-08

为什么 AI 海报一眼廉价

问题通常不是人物不真、图不清,而是没做判断与取舍:

  • 主角最大、配角依次缩小;所有人物都堆进画面;背景塞满剧情元素;
  • 标题最后才压到图上;字体和题材无关;爱情/战争/犯罪共用一个模板;
  • 一次讲完所有剧情、信息过载、没有留白——像平台封面,不像电影海报。

成立的海报:只呈现核心情绪、视觉中心明确、人物关系藏在镜头里、标题与画面共生、留白有呼吸、有宣发气质。

流程(四步)

1. 剧情解析(LLM):类型、子类型、受众、情绪温度、核心冲突、视觉母题——先找到一个足够准确的视觉核心。

2. 底图层:出一张不带字的底图,给字留出物理表面(墙、天空、地面、水面)。

3. 字体层:单独生成中文标题字设计(保证可读、笔势贴题材)。

4. 网格合成:本地按裁切、缩放、透明度、混合模式合成——不让模型在图里重新写字。

(脚本还会拦截假电影节桂冠、真实片厂标志、不合规的出品信息。)

题材 → 视觉语言(同一系统,不同风格)

| 题材 | 视觉语言 |

|---|---|

| 爱情文艺 | 人物距离、柔和光线、克制排版 |

| 运动剧情 | 临场压力、汗水、眼神、巨型标题 |

| 犯罪悬疑 | 夜景、交易、群像关系与空间压迫 |

| 战争 | 泥水、湿冷灰调、第一视角与现场感 |

| 东方题材 | 留白、礼制、山水尺度、书法笔势 |

| 文艺公路 | 旷野、旧车、停顿与人物关系 |

| 科幻隔离 | 密闭走廊、冷光、监控与实验物件 |

| 趣味概念 | 穿越、艺术风格冲突、大胆字图关系 |

规则补充:参考图明显是儿童/家庭/皮克斯气质,就别硬转成阴郁文艺片。

我们怎么用

  • 文天影业片单海报(Karen 在做):每部片先写「类型 + 核心冲突 + 一个视觉母题」三行,再出无字底图,字单独做、本地合成。顺手解决之前「横图塞竖格裁字」问题。
  • 和我们的「电影感镜头卡」「海报光影风格锁」配套:电影感负责画面语言,这套负责宣发层级与字图关系。

来源:https://v.douyin.com/qCRpWD5soxA/ (梵想美学 · AI 创作剧集影片,也应该拥有电影级宣发 · 2026-07-26 · 18 页图文);GitHub dacnay816y62-hub/fantasy-movie-poster-skill(作者标注「个人/实验性 skill,公开复用需授权」——只内部用,不转发)

角色资产化 · Higgsfield 电影级角色一致性法(去头全身图 + 高清脸 + 中性灰 + 分状态 + 压力测试)
出图风格

角色资产化 · Higgsfield 电影级角色一致性法(去头全身图 + 高清脸 + 中性灰 + 分状态 + 压力测试)

角色资产化一致性角色卡压力测试Seedance电影流程2026-09-27

这是什么:Higgsfield Studio 做整部 AI 电影时锁角色的方法,是我们见过最完整的一套。跟 `character-identity-board`(一张设定板)互补:设定板管「长什么样」,这张卡管「怎么把角色做成可反复调用的资产、怎么验收」。上游先翻官方脸锚点(`feedback_face_anchor_first`),四角色的识别锚点体系见 `mv-storyboard/IDENTITY_ANCHORS.md`。

一、角色设定表怎么拍(每个主角一套)

  • 三张基础图:正面全身 + 背面全身 + 一张大尺寸高清脸部特写。
  • 全身图把头去掉。原因:全身图里的脸太小、质量差,模型会把那张烂脸带进后面每个镜头;脸的信息只从高清特写取。
  • 背景中性灰 + 柔和均匀光,不要硬阴影、不要轮廓光,提示词里不要写「摄影棚 / studio」。角色卡是证件照,不是成片:复杂光影和环境会被烤进角色,之后每个场景都带着那套棚灯、底色和阴影方向。

二、按状态拆资产(一种状态一张图,绝不塞进同一张)

笑 / 不笑、不同服装、不同年龄、受伤前 / 后、各种情绪。每个状态单独一张,单独管理、单独命名。

三、开拍前压力测试(资产验收线)

用做好的角色连出 10 次以上成片镜头:跑步、说唱、打电话、哭、笑……逐张查脸、身体、服装、动作。十张里脸还在变 → 资产没做好,回到一、二步,不许带病开拍。

四、配套的锁定项

  • 声音独立成模块:一个角色一个固定音色,不按镜头临时生成。
  • 全片色彩规则先定,场景才像一部电影。
  • 镜头描述不写焦段:写视野范围、角色在画面里的大小、空间关系(生成模型不懂传统镜头参数)。
  • 多人场景:先出一张主镜头 + 站位图(谁站哪、看哪、相距多远),再拆特写和反打。
  • 表演档案:每个角色一份——紧张时眼神怎么动、手的小动作、说话节奏,提前写死,不然只是「会说话的照片」。

五、四条通用原则

1. 每个镜头先交代场景上下文、角色状态、前后情节再生成。

2. 用姿势图 / 手绘参考锁位置和视线,不让模型猜。

3. 台词后留约 1 秒静默(剪辑余量 + 表演自然)。

4. 表演按节拍写,不写「他很生气」。

六、五点总结(原话)

角色先资产化 → 每种状态单独管理 → 正式制作前做压力测试 → 镜头建立清楚空间关系 → 表演拆到眼神 / 手势 / 节拍。

和我们流程的接法

  • 出角色卡:Codex 生图优先(`character-identity-board` 逐字提示词),Higgsfield 兜底;全身镜头喂比例参考图。
  • 去头全身图:先出全身 → PIL 抠头或直接在提示词里要「颈部以上不入画」两版都留。
  • 压力测试:用最便宜档(LibTV Seedance 2.5 样片 480p)跑十条动作短句,只看脸和服装是否漂。
  • 动作迁移:Higgsfield Genjutsu Motion Transfer(video 4–30s + 1–8 张角色图);LibTV 侧 Wan 3.0 灰度动作迁移。

来源:https://v.douyin.com/NTa6XXlgq48 (抖音 三万AIGC · Higgsfield Studio 公开的 1h54m AI 电影流程,137 场 ~600 条 Seedance 2.5 成片;老板 2026-08-28 转来,2026-09-27 令整理成卡)

风格卡 · Midjourney 赛璐璐风(cel shading)提示词包(2026-09-25,Niji 7 规则 + sref 码 + 四组模板)
出图风格

风格卡 · Midjourney 赛璐璐风(cel shading)提示词包(2026-09-25,Niji 7 规则 + sref 码 + 四组模板)

笔记2026-09-25

老板说你现在跑出来的不像赛璐璐。查了 Niji 7 官方与社区指南,核心是三件事:用 Niji 模型、写死风格锁词、不写相机词。

规则(先改这五条,多数问题在这)

1. 模型:`--niji 7`(2026-01 起默认,线条最干净、--sref 最稳)。Niji 7 不支持 --cref 和 --style cute/expressive;要用 --cref 或 --style 预设才退回 `--niji 6`。

2. 风格锁词必带(缺了就漂向 3D/写实):`cel shading, flat color tones, clean line art, 2D anime illustration`;要更平再加 `thick outlines, no gradients`。

3. 不要写实词:`85mm、bokeh、shot on、photorealistic、ray tracing、octane、unreal engine` 一律删掉;光影用动画词:`hard rim light, two-tone shadow, single shadow layer`。

4. 参数:`--s 50~150`(低 stylize 才平);想更「老动画」加 `--style raw`(Niji 6 有效,7 也可试);比例 `--ar 16:9` 或 `9:16`。

5. 结构:[主体+外观] + [动作/姿势] + [场景] + [风格锁词] + [氛围] + 参数。Niji 7 读得很字面,颜色、发型、服装写具体。

风格参考码(每组各跑 2 张,挂 --sref 试)

  • `--sref 305424433`(库里标签 cel shading,鲜艳动漫)
  • `--sref 1928710828`(Blue-Sky Anime Rim Light,蓝天硬轮廓光的赛璐璐,Niji 6 收录,7 也能挂)
  • 有老板/自家参考图时:`--sref <图片URL>` 只借画风,主体另写;角色一致用 `--oref <角色图URL> --ow 200`

八条模板(两条一组,A/B 各出 2 张)

组 1 · 90 年代赛璐璐(AKIRA / 星际牛仔那代)

A:`a mecha pilot girl with short black hair and red flight suit, standing on a starship wreck, alien lake with two suns at dusk, 1990s cel animation style, cel shading, flat color tones, clean line art, thick outlines, film grain, muted retro palette --ar 16:9 --niji 7 --s 80`

B:同上加 `--style raw --sref 305424433`

组 2 · 现代高对比(ufotable / MAPPA 味)

A:`two mecha clashing mid-air, plasma blade slash, speed lines, hard rim light, two-tone shadows, cel shading, flat color tones, clean line art, 2D anime illustration, ufotable style, dramatic backlighting --ar 16:9 --niji 7 --s 120`

B:同上换 `mappa style` 并加 `--sref 1928710828`

组 3 · 平涂极简(京阿尼 / 新海诚背景 + 赛璐璐人物)

A:`white mecha standing on a floating fighter jet, giant alien moon, glowing spore forest, flat color, minimal gradients, cel shaded character, painterly anime background, soft dusk palette --ar 16:9 --niji 7 --s 60`

B:同上加 `kyoto animation style, no gradients on character`

组 4 · 机甲机设(高达 / EVA 线稿感)

A:`full-body mecha design sheet, red and white hero mecha, front and side view, clean line art, cel shading, flat color tones, mechanical panel lines, white background, 2D anime illustration, gundam style --ar 3:2 --niji 7 --s 50`

B:同上换 `black and gold rival mecha, evangelion style, sharp angular silhouette`

交付

每组发老板群 4 张(A2 + B2),标清组号和参数。老板挑中的风格,后面所有关键帧统一挂同一个 --sref 和同一串锁词。

风格卡 · 《BLEACH》漫画单行本封面风(来源:抖音 诺皮克NovaPix 2026-09-23,他 2026-09-24 转发;作者声明 AI 同人二创;原链接 https://v.douyin.com/mTNV-TjIaQY/ )
出图风格

风格卡 · 《BLEACH》漫画单行本封面风(来源:抖音 诺皮克NovaPix 2026-09-23,他 2026-09-24 转发;作者声明 AI 同人二创;原链接 https://v.douyin.com/mTNV-TjIaQY/ )

死神BLEACH漫画封面单行本纯白留白卷数数字竖排日文平面设计感角色海报封面模板Seedream 5.0GPT Image参考图换角色2026-09-23

关键词:死神 / BLEACH / 漫画封面 / 单行本 / 纯白留白 / 卷数数字 / 竖排日文 / 平面设计感 / 角色海报 / 封面模板 / Seedream 5.0 / GPT Image / 参考图换角色

用法(原帖)

任意一张角色参考图 + 下面提示词一起丢给生图模型(作者实测 GPT 与 即梦 Seedream 5.0 pro 都好)。想要封面上出现的字,追加在末尾:`标题文案:"NovaPix"` / `小字文案:"禁止转载和商用"`。

中文提示词(逐字)

生成一张《BLEACH》漫画单行本封面,1:2比例,**主体造型、姿势、服装结构/色彩特征保持不变**。纯白背景,艺术化留白处理,单人物孤立居中或轻微偏轴,构图极简但冲击强。具有少年漫画封面与高级平面设计感。顶部加入《BLEACH》封面标题红色字体蓝色描边,配低对比度大号英文章回标题(从参考图提取高亮色彩)、醒目卷数数字、少量竖排日文与细小编号排版,疏离、锋利、现代。

拆解(为什么好看)

1. 保人物:一句「主体造型、姿势、服装结构/色彩特征保持不变」锁住参考图,只换版式。

2. 纯白 + 留白:白底、单人、居中或微偏轴 → 久保带人封面的呼吸感。

3. 字型三层:顶部红字蓝描边 logo 位 / 低对比大号英文章回标题(颜色从参考图提取)/ 卷数大数字 + 竖排日文小字小编号 → 平面设计感全靠这三层。

4. 气质词:疏离、锋利、现代。

我们的用法(换成自有标识,不用 BLEACH 商标)

  • 把「《BLEACH》封面标题红色字体蓝色描边」换成 `顶部「ONETEN」标题,红字蓝描边同款字型` 或 `「文天台」`,章回标题填歌名英文、卷数填歌的编号 → 一套「歌=单行本」的封面系列,很适合 K-pop idol 线和 文天台 每日新歌的统一视觉。
  • 出图:Flow Nano Banana(免费)先出草稿,正式版 Codex gpt-5.5 或 LibTV Seedream 5.0(便宜档)。
  • 原帖 18 张范例存 `playbook/intake/dy_novapix_bleach_cover/`;作者下集预告「绮彩神怪风格」(待他转)。
风格卡 · 战术海报字型风(来源:抖音 黄大发「100种视觉风格练习 001/100」,他 2026-09-23 转发)
出图风格

风格卡 · 战术海报字型风(来源:抖音 黄大发「100种视觉风格练习 001/100」,他 2026-09-23 转发)

战术机能大字号排版海报枪械奶白红黑typography posterArknights 风风格克隆MJ sref2026-09-23

关键词:战术 / 机能 / 大字号排版 / 海报 / 枪械 / 奶白红黑 / typography poster / Arknights 风 / 风格克隆 / MJ sref

要素:海报式斜切半身;超大无衬线字母数字当背景图形(被人物遮挡、出血);小号技术标注散布;奶白底 + 黑 + 正红(变体:墨绿/深蓝底);动漫厚涂+利落线;战术外套护具手套 + 大型枪械/机械臂;可见笔触与飞溅。

用法:MJ `--sref` 挂 2~3 张原图 + 人物换成我们自己的角色;模板见 `warroom/handoff/style100_001/KAREN_STYLE_CLONE_CARD.md`。原图 zip:hbd.oneten.live/out/dl/style100_001_huangdafa.zip(14 张,前 11 张为该风格)。

适用:K-pop idol 线海报/封面、TTAN 电音封面的硬朗变体、《像素回廊》角色海报。

风格卡 · 冷紫配色游戏 PV(来源:抖音 DramaClaw 2026-09-22,他 2026-09-25 转发;原链接 https://v.douyin.com/4eueXHHZ9i8/ )
出图风格

风格卡 · 冷紫配色游戏 PV(来源:抖音 DramaClaw 2026-09-22,他 2026-09-25 转发;原链接 https://v.douyin.com/4eueXHHZ9i8/ )

笔记2026-09-22

一句话:不是靠模型,是靠一套「五色冷紫 + 一个保留色」的调色盘和五段式提示词结构。人物三视图上传 → 视频节点 → Minimax H3 原版 · 16:9 · 768p · 15s → 贴提示词 → 生成。画面从头到尾像一张不断拆解重组的动态游戏海报。

成片长什么样(帧分析)

  • 白发黑冠女王,深紫大披风,黑金几何长剑;纯白几何城市当底,楼只留白色线稿和紫色矩形色块
  • 阴影一到两层的赛璐璐,大面积纯色剪影,少量金色边缘线
  • 转场全靠图形:披风剪影、刀刃形色块、斜向遮罩、黑白反相、几何圆环追焦、杯子轮廓碎成紫黑切片
  • 红色全片只出现三次:反派的猩红沙发、酒杯里的酒液、危险信号

提示词骨架(从屏幕上抄回来的,右侧被裁掉的按语义补齐,中文直接用)

**提示词**:游戏宣传 PV,整体为纯二维日系赛璐璐动画与抽象 MG 合成,视觉基调为冷紫。

**【美术风格】** 冷紫视觉风格:深紫、紫罗兰、钴蓝紫、靛蓝、黑色和纯白构成高对比配色。描边赛璐璐与大面积纯色剪影,阴影只有一至两层。城市被高度平面化,只保留管道、窗格、楼轮廓,以白色线稿、紫色矩形色块和网格构成。融合抽象 Editorial MG、游戏 UI、时钟刻度、月相、蝴蝶、扫描线、网点和几何切片。画面像动态游戏海报不断拆解重组,空间允许不合理倾斜、翻转、变形。转场依靠人物剪影(特别是飘逸的紫色披风)、刀刃形色块、斜向遮罩、黑白反相与图形匹配完成。红色只用于反派沙发、酒液和危险信号。

**【角色】女王(主角):** 拥有雪白银发,头戴锐利的黑色几何王冠,唇色深紫。身穿深黑色深 V 长裙,外披巨大紫色披风,肩甲,双手佩戴黑色长手套。目光冰冷傲慢,表情克制。武器为一把修长优雅的黑金配色几何长剑。人物造型由黑色剪影、纯白肤色/银发,与少量的金色边缘线构成。**反派:** 灰色长发男性,戴宽檐黑帽,穿黑色长外套,从容而危险的松弛感。

**【分镜表|逐两秒】**
15–17s 女王站在纯白色几何城市中央,长剑垂在身侧,巨大的紫色披风如同一面旗帜般静止。整座城市突然翻转,只剩一个红点。红点逐渐放大,匹配转场为酒杯中的红色液体。
17–19s 画面进入紫黑色二维房间:几何灯影、猩红色沙发。反派翘着二郎腿坐在沙发上,缓慢摇晃酒杯。灰色长发和黑色帽檐形成清晰剪影。
19–21s 切入酒杯特写,杯中映出女王王冠的黑色剪影;焦点随几何圆环移动到反派面部,他从帽檐阴影中抬眼,露出从容而危险的微笑。
21–23s 无酒杯特写画面瞬间静止,杯子轮廓碎裂成紫黑色几何切片。原创游戏标题由时钟刻度与剑刃形状重新拼合,出现英文文案,定格,节奏收束。

**【严格限制】** 全片保持二维抽象 MG 和冷紫游戏 UI 美术;不要写实光影,不要立体 3D 城市,不要电影级真人质感,不要打斗,不要大面积霓虹灯,不要赛博朋克写实街景。人物、建筑、房间和道具全部平面化、剪影化、图形化,披风作为重要的视觉切割元素(MG 遮罩)来使用。

为什么这套配色成立

1. 五色锁死:深紫 / 紫罗兰 / 钴蓝紫 / 靛蓝 / 黑 + 纯白做底,模型没有第二套颜色可跑

2. 一个保留色:红只给三样东西,出现即是叙事信号

3. 阴影层数写死:一到两层,杜绝写实光影

4. 城市写成图形:白线稿 + 紫矩形 + 网格,不是「城市」而是版面

5. 转场用图形不用镜头:剪影、刀刃、斜遮罩、反相,都是 MG 遮罩,模型擅长

6. 禁用清单比风格清单长:3D、霓虹、赛博朋克、真人质感、打斗全部点名禁掉

套到我们线上

  • 直接对应 `kpop-pv/PV_PROMPT_ENGINE.md` 的三模块:这张卡 = STYLE DNA(冷紫版)+ 一段 MOTION DIRECTOR
  • 换调色盘即换项目:ONE TEN 用「墨黑 / 米白 / 荧光黄绿」,MINI 用 S05 墨圈版;保留色规则照抄(一种颜色只给一类事物)
  • H3 原版 mixed2video、三视图当参考图、15s、768p,跟 T13 同一条跑法
海报光影风格 —— 锁定包(给 IA10 做 MV 背景用)
出图风格

海报光影风格 —— 锁定包(给 IA10 做 MV 背景用)

笔记2026-09-21

2026-09-21 · Karen 整理 · 对应桌面「海报_光影迁移」那 9 张

先看这条,不然照抄提示词也出不来

这个风格不是用文字描述出来的,是喂图喂出来的。

提示词里一个形容光影的词都没有(没有 cinematic、没有 moody、没有 bokeh)。

真正起作用的是两张图同时 view_image:

1. `ref_lighting.jpg` —— 光影参考图(那张赛博 AUGMENTED FUTURE 海报),只取它的光、景深、虚化、调色

2. 角色图 —— 只取人

文字的唯一作用是说清楚图里看不出来的事:「参考图里的赛博植入/皮肤电路/发光颈环/发色/脸/衣服/文字,一样都不要带过来」。

这句必须留着,删了就会长出机械臂。

⇒ 交接给 IA10 的时候, `ref_lighting.jpg` 必须一起给, 只给文字没用。

跑法

  • 通道: Codex CLI `image_gen`(模型 `gpt-5.6-sol`)
  • 比例: LANDSCAPE 16:9
  • 必须串行 —— `~/.codex/generated_images` 是全局共享目录, 两个任务并发会互相偷图
  • 脚本原件: `~/workdir/poster_lighting/gen.py`

提示词模板(逐字)

`{RATIO}` = `landscape 16:9`;`{REF}` = 光影参考图路径;`{FACE}` = 角色图路径;`{SHOT}` = 下面每张各自的机位描述。

You have view_image and image_gen tools. Execute them now, do not just describe.

1) view_image the LIGHTING REFERENCE: {REF}
2) view_image the CHARACTER: {FACE}
3) image_gen ONE {RATIO_UPPER} POSTER, high resolution.

FROM THE LIGHTING REFERENCE, take ONLY these and nothing else:
its lighting, its depth of field, its background blur, its colour grading, its contrast,
and that shot-on-a-high-end-cinema-camera quality.

DO NOT take from the lighting reference: the cyberpunk implants, the circuit lines on the skin,
the glowing neck hardware, the hair colour, the face, the clothing, the on-image text.
None of that appears in the output.

FROM THE CHARACTER IMAGE, keep the person exactly: same face shape, same eyes, same nose,
same mouth, same hair colour and hairstyle, same clothing. The SAME individual, not a lookalike.
Do not beautify, do not restyle, do not age her up or down.

SHOT — re-stage her exactly like this: {SHOT}

Compose it as a {RATIO} poster with clean negative space beside her.

No text, no letters, no numbers, no logos, no watermarks anywhere in the image.```

没有指定机位时(最早那三张), `SHOT` 那一行换成:

Re-frame her for a landscape 16:9 poster: she is off-centre with clean negative space beside her,

background falls far out of focus.


## 九张各自的 SHOT 原文

### black — 黑发
角色图: `girl_black.jpg`

(无 SHOT, 用上面的默认构图句)


### platinum — 白金发
角色图: `girl_platinum.jpg`

(无 SHOT, 用上面的默认构图句)


### auburn — 红棕发
角色图: `girl_auburn.jpg`

(无 SHOT, 用上面的默认构图句)


### brown — 棕发
角色图: `girl_brown.jpg`

Camera is behind and slightly above her; she has turned her head back over her shoulder toward the lens, body still facing away. Background: a night street after rain, wet asphalt throwing long smeared reflections, the far end of the street completely out of focus.


### ash — 灰发
角色图: `girl_ash.jpg`

Strict side profile, camera at her eye level. She is seated, shoulders relaxed, arms out of frame. Background: a tall window at dusk behind her, sheer curtain and the room beyond dissolving into soft blur.


### ink — 墨发(插画)
角色图: `girl_ink.jpg`

Low angle looking up at her, camera near chest height; she stands and looks down past the lens, arms folded. Background: a long corridor running away behind her, ceiling strip lights receding into deep blur. Keep her illustrated art style — do not convert her to photographic.


### braid — 双辫(插画)
角色图: `girl_braid.jpg`

High angle looking down on her from above, she tilts her face up toward the camera, hands out of frame. Background: a rooftop at blue hour, the city far below reduced to soft points of light. Keep her illustrated art style — do not convert her to photographic.


### top_black — 黑发·俯视
角色图: `girl_black.jpg`

EXTREME TOP-DOWN: the camera hangs directly above her head, lens pointing straight down at the ground. We see her from above — the top of her head, her shoulders foreshortened, and HER SHOES flat on the ground below her, clearly in frame. The ground fills the whole background: wet dark asphalt with a shallow puddle beside her shoes catching one point of light. Her shadow spreads out around her feet. No horizon, no sky, no walls — only the ground.


### top_ash — 灰发·俯视
角色图: `girl_ash.jpg`

EXTREME TOP-DOWN: the camera hangs directly above her head, lens pointing straight down. We see the top of her head and hair spreading out, shoulders foreshortened, and HER SHOES on the floor below her, clearly in frame. The ground fills the whole background: pale tiled floor with one soft pool of window light falling across it and the edges falling out of focus. No horizon, no sky, no walls — only the floor.


## 三条写 SHOT 时的规矩(踩过坑的)

1. **换机位要把整个透视重推**,不是把人放大 —— 每条都要说清「从哪看、什么进画、什么虚掉」。
2. **不写伸手/指向类动作** —— 手最容易崩。一律用抱臂、靠、手不入画。
3. **插画角色要单独写一句** `Keep her illustrated art style — do not convert her to photographic.`
   不写就会被拉成照片。(ink / braid 两张就是靠这句保住的)

## 一个已知限制

俯视那两张(top_black / top_ash)背景虚化明显比其它张弱。
原因不是提示词写坏了:俯拍时地面**就是主体所在的那一层**,景深没有纵深可以衰减。
想更糊只能把相机再抬高、人压小,让地面拉开距离。
MJ 人物反推卡 —— 高质量中式/写实人物图的 Midjourney 提示词法(从抖音「黄鸭碎碎AI」skill 反推,2026-09-12)
出图风格

MJ 人物反推卡 —— 高质量中式/写实人物图的 Midjourney 提示词法(从抖音「黄鸭碎碎AI」skill 反推,2026-09-12)

反推提示词Midjourney人物中式美学写实去AI味skill2026-09-12

背景:他 2026-09-12 转发。博主卖一个 `SKILL.md`:喂给任一大模型学习 → 再喂参考图 → 大模型吐出几组「同风格不同人物/场景」的 MJ 提示词 → 贴进 MJ 直接出。卖点是避开「AI 味太重 / 磨皮严重 / 光影拉垮」。文件本身要私信,没拿到;但视频里大模型复述了它的核心规则(`kpop-pv/intake/dy_huangya/samples_row.jpg` 中间帧),照抄如下——这跟我们的 `ai-manju-replicate-viral-reverse-prompt` 六层法是一回事,我们本就会。

核心规则(大模型复述原文,逐条)

1. MJ 吃「名词和视觉概念」,不擅长复杂关系。像「光先照到不照脸」这种导演语言,要翻译成 MJ 能识别的实体画面元素(rim light on hair, face in shadow…)。

2. 正向提示词不写否定句:不能写 `no baby fat`,要直接描述正向特征(清晰饱满、下颌线分明)。

3. 前 1/3 权重最高:第一句先把「谁、在哪里、正在干什么」说清;整条 prompt 控制在 200–300 词。

4. 不能靠疯狂堆负词:默认 `--no` 只处理明显 AI 味;后续按实际翻车症状一次只加一项。

5. 场景类型 > 单个关键词:中式人物出成日本风,往往不是人物描述错,是整个摄影类型/场景类型选错了。

6. 画面要有动态事件:飞叶、风吹衣摆、巷雪、跑跳、雾气流动——比纯静态美景更「有看头」。

7. 人物图明确控制人物占画面比例(帧尾截断,推测:写明 full-body / medium / 人物占三分之一等)。

MJ 参数落地(结合规则)

  • 版本按需 `--v 8.2` 或 `--niji`(人物写实走 v,二次元走 niji);`--ar 3:4` 或 `4:5` 竖构图人物;`--style raw` 去 MJ 默认美颜滤镜(关键,去 AI 味)。
  • `--no` 只放明显 AI 味词(plastic skin, oversharpened, cgi),别堆。
  • 负面控制靠摄影类型选对 + `--style raw`,不靠堆词。

和我们已有资产的关系

  • 方法同 `ai-manju-replicate-viral-reverse-prompt`(六层反推)+ `style-baiyueguang-jk-backlit-film`(S01)。差别只是输出成 MJ 格式(--ar/--style raw/--no)而非 Codex 自然语言。
  • 落地:他充值 MJ 后,反推走「喂参考图 → 我按本卡规则出 3–5 组 MJ prompt → CDP 驱动 midjourney.com 出图」(MJ 无公开 API/CLI,走浏览器层,见 [[project_browser_automation_layer]])。
  • 样片参考:`kpop-pv/intake/dy_huangya/sample_{1,4,19}.jpg`(中式古风 + 现代灯笼街,博主自称三分钟出)。

待办

  • 他充 MJ 后跑第一组验证;若想要更全,私信博主拿 SKILL.md 原文补进本卡。

MJ 参考系统(2026 实查,--sref / --oref / --cref)

他 2026-09-13 要的「风格迁移」= MJ 原生参考功能,社区标准打法:

  • `--sref <风格图URL>` = 风格参考:只迁移调色/光影/质感/氛围,不迁移人脸/主体。`--sw 0–1000`(默认 100)控制风格强度。→ 用来锁「白月光」的味道。
  • `--oref <人物图URL> --ow` = Omni 参考(v7/v8 官方锁人像/物体的路子,`--ow` 越高越保留脸/衣/细节);老的 `--cref <图> --cw`(v6 引入、v7 改进)仍可用作角色一致性。→ 用来锁我们自己人物的脸。
  • 可同框:一条 prompt 里 `--sref <白月光风格图> --oref <我们人物图>`,MJ 自动分工:脸取 oref、氛围取 sref。参考不能单独用,必须配文字 prompt。
  • 落地:MJ 无公开 API → 浏览器驱动 midjourney.com 网页 composer:拖入风格图设 style ref、人物图设 omni/char ref,打 prompt,出 4 宫格,放大。见 [[project_browser_automation_layer]]。
  • 他的用法:第一张=白月光风格参考 → --sref;第二张=SONGGIFT 生成的人物(AI 无版权可用)→ --oref。等他充值 MJ + 发图 → 跑第一组。

来源:https://v.douyin.com/_qlEEINEiWo/ (抖音 video 7684645092208933275 · 黄鸭碎碎AI · 「人物高质量图片你还在用提示词生成?试试这个skill」· 50.1K 赞 · 2026-09-12;SKILL.md 文件需私信,未拿到;本卡=从视频里大模型复述的规则反推)

出图风格

反派光影四式(阴阳脸 / 鬼光 / 骷髅光 / 牢笼光)· 光位 = 人设

光影布光人设反派电影感提示词KVH3焰瞳补充2026-09-12

老板 2026-09-12 00:15 丢链接。 四张卡,每张一个光位 + 一种反派人格。它把「光位」当「人设」用,和我们的 焰瞳 lighting grammar(眼睛点燃 = 觉醒)

同一逻辑:光不是好看,是叙事。四条可直接进 KV / H3 / 人机日志的反派或对手镜头(Astra 那条线随时用得上)。

| # | 光位 | 画面 | 人设 | 直接可用的英文提示词短语 |

|---|---|---|---|---|

| 1 | 阴阳脸 · Split lighting(侧光) | 90° 侧光,脸一半全亮一半纯黑,对比极强 | 双面人格、伪善阴谋家:主打伪善,表里不一,温文尔雅的绅士外表,背地精算 | `hard 90-degree split lighting, one half of the face fully lit, the other half in pure black shadow, high contrast, cold key, no fill, cinematic close-up` |

| 2 | 鬼光 · Ghost light(底光) | 从人物下方向上打光,五官阴影倒置,面部轮廓扭曲 | 癫狂、暴戾、失控的极端反派:没底线,性格疯狂偏执,情绪不稳 | `single hard light from directly below the face (under-lighting), inverted facial shadows, distorted features, horror feel, dark background, cinematic` |

| 3 | 骷髅光 · Skull light(顶光) | 人物头顶正上方打光,双眼完全藏进黑暗,颧骨凸显如骷髅 | 高位掌权、冷酷无情、杀伐果断的顶级反派:看似平静,手握生杀 | `hard top-down light from directly above, eye sockets fall into complete black shadow, skull-like cheekbones, no catchlight, moody, cinematic portrait` |

| 4 | 牢笼光 · Cage light(格栅光) | 铁栏/百叶窗投下条状阴影切割人物,压抑感拉满 | 被欲望裹挟、深陷执念的幕后黑手:看似掌控一切,实则被自己囚住 | `light through venetian blinds / iron bars casting hard striped shadows across the face and body, caged feeling, film noir, low key, cinematic` |

用法

  • 角色卡(KODA/T12 骨架):给对手方角色换光位即换人设,不用改脸。Astra 在《人机日志》里若要「威胁感」→ 3 骷髅光;「不可信」→ 1 阴阳脸。
  • 和焰瞳叠加:先 1/3 定人设,再让眼睛点燃 = 反派觉醒的两段式。
  • H3 提示词里写「光位 + 阴影落在哪」比写形容词稳;四条短语可直接粘进 MOTION DIRECTOR 的 lighting 段。
  • 参考图 `assets/villain_light/s02–s05.jpg`(原卡)。

来源:https://v.douyin.com/h4TJLpyB0RY/ (临隐的影 · 图文 · 2026-09-11 · 「AI电影镜头·四大反派光影塑造」)

出图风格

提示词工具包 · 产品图一键精修 7 式(放大 / 线稿 / 风格复刻 / 高级感 / 融图 / 消杂物 / 废片变广告图)

提示词产品图精修抠图融图电商主图小老板素材NEWHI2026-09-11

老板 2026-09-11 23:21 丢链接:「提示词工具包,放进 playbook」。 21 秒竖版,8 张卡逐字抄录(画面文字),直接可套;对我们最值钱的用法:

NEWHI/AI studio 线里小老板发来的手机烂图 → 一键变电商级主图(消杂物 + 废片变广告图 + 精修),是开店包和月度包的产线原料。

逐字提示词(中文原文,图生图/编辑模型通用:Nano Banana / GPT Image / 即梦)

1. 糊图变 4K(无损放大):视频里此卡文字与「杂物秒消失」重复,疑为作者贴错;用法 = 「激活 AI 像素级重建算法,恢复被压缩的纹理与边缘,保持构图、透视、光照 100% 不变,输出 4K」。

2. 产品转手绘(一键转线稿):智能提取目标物体的空间透视与三维轮廓,一键转化为极具机械美感的工业设计黑白概念线稿。精准勾勒复杂的空气动力学边缘、机械传动部件与装配接缝。在背景自动生成专业的流体力学辅助线、透视网格及尺寸标注排版。采用精准的马克笔触与轻微的灰阶排线表现截面体积,呈现顶级工业设计师的手绘蓝图质感。

3. 产品风格复刻(一键复刻):提取参考图的环境特效与空间深度遮挡 Mask(蒙版)。将目标产品完美替换入特效中心,强制保留原始流体 / 烟雾对主体的前景遮挡关系。重构产品表面光线折射模型,使其 100% 匹配新场景的复杂环境光(如金属反光、丝绸漫反射),实现特效与实物的像素级物理融合。

4. 产品秒变高级感(光效渲染):严格锁定主体外轮廓与原始暗调背景,一键激活 X 光深层透视渲染模型。将产品外壳转化为半透明的黑透材质,清晰显露内部精密的散热铜管与电路结构。在三个风扇核心处注入极具能量感的霓虹双色动态光效(如电光蓝与核心橙),并在风扇周围生成符合空气动力学的悬浮发光粒子与高速旋转的光晕拉丝,呈现极具侵略性的硬核赛博状态。(示例是散热器,套用时把「风扇/铜管」换成自己产品的内部结构)

5. 产品融图(一键融图):精准提取目标产品并无缝置入新场景。强制启用全局光照(GI)计算,完美吸收环境双光源(如冷蓝光与暖橙光)形成立体反射。真实演算玻璃材质的透光率与折射率,并在承接面上投射带有液体色彩的物理焦散阴影(Caustics),彻底消除边缘抠图感,实现电影级空间光影融合。

6. 杂物秒消失(一键消除万物):智能识别并彻底抹除画面中的破坏性杂物及其投射的混乱阴影。激活 AI 像素级重建算法,深度解析并完美延展被遮挡的复杂背景(如高难度几何印花、编织纹理等)。强制对齐全局光照逻辑,无缝重连断裂的环境光影(如百叶窗投影),确保填补区域与原始画面在纹理、透视与光照上达成 100% 的物理级统一,拒绝任何 PS 涂抹痕迹。

7. 废片变广告图(精修产品):将主体置于纯白无缝背景中,利用 3D 渲染级光影重塑其初始材质(如高级皮革的哑光纹理、塑料组件的镜面反光)。一键抹除所有物理磨损、泥土污渍与岁月痕迹,恢复至全新出厂状态。强化立体光感与阴影过渡,提升整体商业精致度,直出符合顶配电商主图的标准图像。

写法规律(可迁移)

每条 = ①锁定什么不变(轮廓/背景/构图)②激活什么算法(听着专业的名词:GI、Caustics、像素级重建)③材质与光的物理描述 ④拒绝什么(PS 痕迹、抠图边)⑤目标交付标准(电商主图 / 4K / 蓝图质感)。把「术语堆叠 + 物理约束 + 交付标准」三段式套到任何编辑任务上。

我们的落地

  • NEWHI 开店包产线:客户手机图 → 6(消杂物)→ 7(白底主图)→ 5(融进品牌场景);美甲/餐饮各存一套场景参考图。
  • SONGGIFT/Moon1k 封面:3(风格复刻)把同一 KV 换主体。
  • 待验证:在 Flow 图片模式(Nano Banana)逐条跑一遍,记录哪条最稳;跑之前不花积分(Flow 免费)。

来源:https://v.douyin.com/iNh2gtndClU/ (用Ai的小女孩 · 2026-09-11 · 「AI 绘画常用提示词合集,人物一致性、高清材质直接套用」)

出图风格

抖音图文 · zzlClare「……但有一刻,月亮的确现在了我身上。」· 蓝调时刻冷调写真 8 图六层反推(S01 白月光的冷调姊妹篇,建议立 S07)

抖音参考反推提示词风格写真蓝调时刻blue hour冷调硬光侧光剪影前景遮挡窗影胶片组图zzlClareS01S07候选SONGGIFTNOVAKarenK-pop零积分未跑2026-09-06

未跑(2026-09-06 intake,纯反推,零积分)。老板丢图文链接无留言 = 入库 + 六层反推。同一作者 zzlClare,四天前那组 15 图我们已经沉淀成 S01 白月光(`style-baiyueguang-jk-backlit-film`),这组是她自己标的「尝试不同风格」:从傍晚暖逆光换成蓝调时刻冷调硬光。上方 = 8 图 3×3 总览 `assets/dy_zzlclare_moon2_contact.jpg`;原图 `intake/dy_zzlclare_moon2/img_01…08.jpg`(≤900px 预览在 `small/`)。结论先说:和 S01 同一套「表演 DNA + 镜头语法」,但光、色、构图三层全换,建议立新代号 S07「蓝调时刻」而不是塞进 S01 当变体——等老板点头再登记 styles.html。

抓取法(图文,douyin_watch.sh 不管)

  • `douyin_watch.sh` 只处理视频;图文照 `kpop-pv/intake/reference_douyin_watch.md` 的法子::9250 Chrome puppeteer 打开短链 → 落到 `www.douyin.com/note/7682483096515562798` → 收 `img[src*=aweme-images]` 且 naturalWidth≥2000(按 `~` 前 key 去重,方向键翻完轮播)→ 页内 `fetch` 转 base64 落盘 → sips webp→jpg。脚本留在 `intake/dy_zzlclare_moon2/dl.js`(可复用,改 note id 即可)。
  • 页面 DOM 里另外 6 张 3712×4949 的 `pcweb_cover~noop.jpeg` 是右侧推荐位封面,不是本组图,过滤掉了。8 张 = 轮播翻到底的去重数;页面没有 `n/8` 计数器可核,8 这个数有小概率漏张(见末尾不确定项)。

8 图逐张观察(实际看图)

| # | 画面 | 关键信息 |

|---|---|---|

| 01 | 大特写,脸占满画面,头微歪看镜头,发丝横过脸 | 蓝色粗针织毛衣(带亮片),纯蓝天背景;硬直射阳光从右上打在脸上,皮肤暖、世界冷 |

| 02 | 室内窗边,头枕在手臂上看镜头 | 黑色蕾丝头饰 + 蓝紫碎花荷叶边露肩裙;窗框硬影切过脸和墙,墙上贴满撕页/照片拼贴;窗外蓝天 |

| 03 | 俯拍,躺在地上仰视镜头 | 藏青水手服(同 S01 的 JK 语法,换成深蓝版);拼贴墙作背景;低照度,只有一小块暖光落在脸上 |

| 04 | 极近特写,半张脸藏在前景白花后 | 黑吊带 + 白色毛绒;深蓝背景;前景虚焦遮挡,硬侧光只亮唇和颧骨,刘海把眼睛压进阴影 |

| 05 | 蓝调城市天际线虚化,乱发盖眼,手托腮 | 白色露肩上衣;低角度硬侧光只亮下半张脸;整图最蓝、最「月光」——本卡缩略图 |

| 06 | 侧脸望向画外右侧 | 前景蓝色布/框虚化包边;风吹发;脸左侧一层柔暖光,阴影全是钴蓝 |

| 07 | 侧脸,手抵下巴 | 藏青毛衣 + 白衬衫领;蓝天 + 电线虚化;上方黑色结构压顶;低调子,脸一半在暗里,红唇是唯一暖点 |

| 08 | 全剪影,海边日落蓝调,云层,画左一道横向炫光 | 右下角还有第二个人的剪影一角(S01 里「那个人」的延续);人物零细节,天空是主角 |

「月亮」在哪:8 张里没有月亮实体。标题的「月亮现在了我身上」= 图 01/04/05/07 那一小块打在脸上的硬光(冷世界里唯一的暖),以及图 08 画左那道炫光。这是用光代替物体的 motif——复刻时不要真的画月亮。

六层反推(主体 / 服化 / 光影 / 镜头 / 材质质感 / 后期与排版)

| 层 | 反推结果 | 换皮时 |

|---|---|---|

| ① 主体 | 单人少女,黑长发/齐肩黑发 + 空气刘海,乱发盖眼是标配;表情克制:微张唇、不笑或半笑、眼神常被遮住或望向画外;动作 = 手托腮 / 头枕手臂 / 躺地仰视 / 侧脸望远 / 剪影 | 动 —— 换成自家角色;「发遮眼 + 望画外」的表演 DNA 保留 |

| ② 服化 | 整体蓝系:蓝色亮片粗针织、藏青水手服、蓝紫碎花荷叶边露肩裙 + 黑蕾丝头饰、藏青毛衣叠白衬衫领、白露肩上衣、黑吊带 + 白毛绒;红/粉唇是唯一暖色配件 | 可换款式,色相守住蓝/藏青/白/黑,唇色留暖 |

| ③ 光影 | 硬光 + 冷环境:低角度直射阳光(侧光/顶侧光)只亮脸的一部分,其余压进深蓝阴影;室内用窗框/百叶硬影切脸;02/03 的拼贴墙有明暗大块;08 纯逆光剪影 + 横向炫光。阴影不是 S01 的青灰,是饱和钴蓝/藏青 | 不动(这是 S07 和 S01 的分水岭) |

| ④ 镜头 | 85mm 大光圈浅景深不变;但景别更近(大特写/极近特写 ×3,侧脸 ×3,剪影 ×1,俯拍 ×1);前景遮挡(花/布/窗框)出现 3 次;机位有俯拍与低机位仰视;3:4 竖幅,主体偏一侧 | 不动 |

| ⑤ 材质质感 | 皮肤在硬光下保留毛孔与高光(不磨皮),针织/亮片/蕾丝/毛绒纹理清晰;发丝根根分明被风吹散;背景纸张拼贴有撕边;细腻均匀胶片颗粒 + 轻微雾面 glow | 不动 |

| ⑥ 后期与排版 | 蓝调 LUT:整图往青蓝/钴蓝偏,高光略暖保住肤色,黑位比 S01 更实(低调子,不是褪色);轻柔焦;饱和度中低但蓝色饱和;无 HDR 无锐化。排版:图上无标题字,只有作者水印 `z z l C l a r e`(小写、字距拉开、居中下三分之一、半透明白);标题/情绪全放在抖音文案里 | 水印换成我们的(如 `O N E T E N`),或不放 |

和 S01 白月光的对照

| 维度 | S01 白月光(15 图) | 本组 蓝调时刻(8 图) |

|---|---|---|

| 时段 / 色世界 | 傍晚黄金时段→初夜,暖橙高光 + 青蓝阴影,褪色胶片 | 蓝调时刻,蓝主导,皮肤靠硬光保暖,黑位实、对比高 |

| 光 | 逆光/侧逆光,发丝金边,炫光 + halation,软 | 硬直射侧光/顶侧光 + 窗影,只亮局部;剪影 |

| 场景 | 街头人潮、天台栏杆、霓虹虚焦、机场 | 蓝天大特写、室内拼贴墙窗边、蓝调天际线、海边 |

| 构图 | 中近景为主,回头看镜头 | 更近(大特写/极近)、侧脸、前景遮挡、俯拍、剪影 |

| 服装 | 白水手服黑裙 / oversize 黑针织 | 蓝系全套(藏青水手服 / 蓝针织 / 蓝紫碎花 + 蕾丝头饰) |

| 相同 | 同一人设(黑发空气刘海乱发盖眼)、克制表情、85mm 浅景深、3:4、细颗粒 + 雾面 glow、第二人剪影的组图叙事、图上无字只水印 | |

判定:立新 S 号(推荐 S07「蓝调时刻」,别名「月光」),不做 S01 变体 B。 理由:光影层 + 后期色层 + 构图层三层同时换(六层里换了三层),老板点名时「NOVA 走白月光」和「NOVA 走蓝调」出的是两种完全不同的片;塞进 S01 会让 S01 提示词的「暖橙高光/褪色黑位/逆光金边」和这里的「钴蓝阴影/硬侧光/实黑」互相打架。S01 卡末尾已加一行姊妹指引。S07 未登记 styles.html,等老板一句话。

可直接用的提示词 — 主体块可替换

主体块:`[角色:参考图1 的脸与发型]`;用时参考图1 = 身份板,参考图2 = 本组 `img_05.jpg`(只借光色,不借人)。

中文版(通用主干)

[角色:参考图1 的脸与发型],黑色齐肩发被风吹乱,几缕发丝横过眼睛,穿藏青色水手服(深蓝海军领三道白条)。
蓝调时刻:天空和整个环境都是饱和的钴蓝到藏青,只有一束低角度的硬直射阳光从画面一侧打在她脸上,亮出半张脸、唇和颧骨,其余全部沉进深蓝阴影;皮肤在冷世界里保持温暖。
85mm 大光圈浅景深,大特写,主体偏画面一侧,前景有一片虚焦的蓝色布料或白花轻轻遮住画面一角,背景城市天际线化成蓝色色块。
胶片质感:蓝调 LUT,黑位扎实、对比偏高,饱和度中低但蓝色饱和,细腻均匀颗粒,轻微柔焦雾面光晕,硬光下保留皮肤和针织纹理,不磨皮、无 HDR、无锐化。
表情克制,微张唇,不看镜头或眼睛被发丝遮住。3:4 竖幅。画面里没有月亮,光就是月亮。

English(Codex / Seedance 首帧通用)

[CHARACTER: face and hairstyle from reference image 1], black shoulder-length hair blown messy by wind, a few strands across her eyes, wearing a navy sailor-collar school uniform (dark blue collar, three white stripes).
Blue hour: the sky and the whole environment sit in saturated cobalt-to-navy blue; a single low-angle hard shaft of direct sunlight enters from one side of the frame and lights only half her face, lips and cheekbone, everything else sinks into deep blue shadow; her skin stays warm inside a cold world.
85mm f/1.4 shallow depth of field, tight close-up, subject off-center, an out-of-focus blue fabric or white flowers softly covering one corner of the foreground, the city skyline behind her melting into flat blue shapes.
Film look: blue-hour LUT, solid blacks and higher contrast, medium-low saturation but saturated blues, fine even film grain, slight soft-focus haze glow, skin pores and knit texture preserved under the hard light, no retouching, no HDR, no sharpening.
Restrained expression, lips slightly parted, not looking at the camera or eyes hidden by hair. 3:4 vertical. No moon in the frame — the light is the moon.

8 张构图的逐张替换句(只换第 2–3 句)

01 CLOSE / SKY   — extreme close-up, face filling the frame, head tilted, looking into the lens; plain deep blue sky behind; chunky blue sequined knit sweater; hard sun from upper right.
02 WINDOW / WALL — indoors by a window, head resting on her forearm, looking at the camera; black lace headdress and a blue-violet floral ruffled off-shoulder dress; hard window-mullion shadows cut across her face and a wall covered in torn photo collage; blue sky outside.
03 LYING / TOP-DOWN — top-down shot, she lies on the floor looking up at the camera, hair fanned out; navy sailor uniform; collage wall behind; low light with one small warm patch of sun on her face.
04 FLOWERS / HIDE — extreme close-up, half her face hidden behind out-of-focus white flowers in the foreground; black camisole strap and white fur; deep navy background; hard side light only on lips and cheekbone, bangs shadowing the eyes.
05 SKYLINE / CHIN — blue-hour city skyline blurred behind her, messy windblown hair covering her eyes, hand resting on her chin, bare shoulder in a white off-shoulder top; low-angle hard side light on the lower half of her face only.
06 PROFILE / AWAY — profile, looking off-frame to the right; out-of-focus blue fabric framing the edges; wind in the hair; soft warm light on the near side of the face, cobalt shadows.
07 PROFILE / HAND — profile with her hand at her chin, navy sweater over a white shirt collar; blue sky with blurred power lines; a dark structure pressing down from the top of the frame; low key, half the face in shadow, red lips the only warm note.
08 SILHOUETTE / SEA — full silhouette against a blue-hour sunset sky over the sea, layered clouds, a horizontal lens flare streak on the left; a second figure's silhouette barely entering the lower right corner.

负面提示

月亮实体, 暖橙整体色调, 金色逆光发丝边, 褪色灰黑位, 高饱和肤色, 磨皮, 塑料皮肤, HDR, 锐化, 正面平光, 大笑露齿, 多人正脸, 文字, logo, 水印, 畸形手指, 多余肢体, 霓虹光斑
visible moon, overall warm orange grade, golden backlit hair rim, faded grey blacks, oversaturated skin, over-smoothed, plastic skin, HDR, sharpening, flat frontal light, big toothy grin, multiple faces, text, logo, watermark, deformed hands, extra limbs, neon bokeh

微动(Seedance / H3 5s,等「跑」)

3–5s, camera nearly static with a 2% slow push-in; wind lifts a few hair strands across the eyes; the hard light patch on her face drifts slightly as if a cloud passes; foreground blue fabric sways out of focus; no cuts, no text, film grain constant.

对接我们的线

  • SONGGIFT 写真:`backend/cinematic_build.py` 现有 `BYG_SPINE` + `LOOKS_BAIYUEGUANG`(每单默认 2 张暖调)。本卡可加一条 `LANDIAO_SPINE` + `LOOKS_LANDIAO` 作冷调池:把主干整段换成上面的中文通用主干(S01 卡的教训:只改场景句不够,主干要整段换),参考图2 用 `intake/dy_zzlclare_moon2/img_05.jpg`;适合「思念 / 深夜 / 生日在异地」这类订单,或每单 1 暖 1 冷。
  • Karen / NOVA KV:NOVA 白金发在蓝调硬光下会变成冷白轮廓(比黑发更「月光」),用 `t09_newgirl/board_nova_E2.png` 当图1;Karen 用 `karen_frames/` 身份板。这组正好对上 `ig-ghost-remix-teaser-anime-open` 卡里欠的「Karen 蓝骨静帧候选 S 号」——冷开场静帧直接走本风格。
  • K-pop 虚拟 idol 剧照:回归 concept photo 常见的「blue hour cold concept」;构图 05/06/07 三张(托腮 / 侧脸 / 手抵下巴)是一套 teaser 三连,08 剪影作章节牌。配 `T11 亮相` 的柔情版首帧,或 `koda-anime-card-cut` 冷开场。
  • MV 插入镜头:《鲸背之城》回忆段落的冷调版,`cewrite-storyboard` 出无脸切出(02 的窗影墙、04 的前景花、08 的剪影都是现成的无脸机位)。

候补 / 状态

  • 风格卡,不进 picker(不是出片模板)。S07 候选,未登记 `styles.html`;老板点头后:加 S07 条目(缩略图用本卡 thumb 或 NOVA 复刻样张)+ 在 S01 条目加「冷调姊妹 S07」。
  • 零积分验证方案:NOVA 用 Codex 出 05 / 07 / 08 各 1 张(图1 身份板 + 图2 `img_05.jpg`),和原图并排看蓝调 + 硬光 + 实黑位有没有还原;出图不花积分,只有 Seedance/H3 微动要「跑」。
  • 老板问过「哪张哪个风格决定下一期」是作者对粉丝说的;我们不评论区互动,只内部学法。

注意事项

  • 学的是光、色、构图语法,不搬人物、不外发原图;原图带 `zzlClare` 水印,作者自标 AIGC。
  • 蓝调 + 硬光最容易翻车的是肤色:出图先看脸有没有被 LUT 压成青紫;有就在提示词里加「skin stays warm, only the environment is blue」,或把「hard sunlight」改成「warm hard sunlight」。
  • 白衣(05)在硬光下会爆:加「white top keeps fabric detail」。
  • 出图走 Codex;任何花积分的运行先问老板(`feedback_libtv_credit_budget`)。

参考图

  • 总览 3×3:`assets/dy_zzlclare_moon2_contact.jpg`(1060×1400)
  • 缩略图:`assets/dy_zzlclare_moon2_thumb.jpg`(= img_05,蓝调天际线托腮)
  • 原图 8 张:`intake/dy_zzlclare_moon2/img_01…08.jpg`(3712×4928,不进部署)

关联

  • 姊妹卡:`style-baiyueguang-jk-backlit-film`(S01 白月光,同作者暖调版)
  • 方法:`ai-manju-replicate-viral-reverse-prompt`(六层反推法)
  • 光影词库:`yantong-lighting-grammar` · 风格词库:`render-engine-keywords`
  • 主体资产:`character-identity-board` · `feedback_face_anchor_first`
  • 下游:`koda-anime-card-cut`(首帧)· `ig-ghost-remix-teaser-anime-open`(冷开场静帧)· `cewrite-storyboard`(插入镜头)· SONGGIFT `cinematic_build.py`

来源:https://v.douyin.com/h--Ssj0A43o/ (抖音图文 · note 7682483096515562798 · 作者 zzlClare · 2026-09-06 发布 · 抓取时 369 赞 · 8 图 3712×4928 · #蓝调时刻 #AIGC #冷调 · 文案「标题来自粉丝@ii少白Oo / 尝试不同风格的成片,欢迎到评论区说说你喜欢哪一张哪一个风格,这将决定下一期的风格~」· 图上有 zzlClare 水印)

出图风格

角色身份设定板 · CHARACTER IDENTITY BOARD(三个变体:编辑式 / 中性灰固定拼版 / 9:16四宫格)

角色资产化一致性设定板Codex逐字提示词KODA前置2026-09-02

已验证 2026-09-02:变体 A 用 Codex(喂 Karen 官方全身设计稿 + 面部特写)一次出图即合格 —— 见上方成品(1672×941)。全视图同脸同装、零重叠、CHARACTER ID/剪影/表情/细节区齐全。

用途:从一张参考图生成一张 16:9「角色身份设定板」—— 不对称编辑式排版、大留白、多尺度研究图、绝不重叠。产出物就是后续图/视频生成的单张身份权威:直接当 KODA 角色卡卡点(`koda-anime-card-cut`)的 `@[image1]`,也是 Higgsfield 角色一致性流程里"角色资产化/角色卡"那一步的更高级版本。

我们的执行规则:① 生图走 Codex(`codex exec … -i 参考图`),Higgsfield 只作兜底 ② 参考图必须先翻官方脸锚点(文天 / IA10 早有定案,见 `feedback_face_anchor_first`);全身镜头喂 `ref_wentian_proportion.jpg` ③ 方括号四个字段填好再跑 ④ 出图后检查:脸不裁、四肢不遮、姿势不融合,不合格只重跑一次。

变体 A · 16:9 编辑式设定板(带 CHARACTER ID 文字块)— 逐字,只改方括号

创作一张具有艺术感的16:9角色身份设定板(CHARACTER IDENTITY BOARD)。

>

以 [参考图] 中的人物为主体,并延续其视觉媒介与表现形式。

>

姓名:[角色名]

>

背景采用柔和的灰白色。不要环境场景,不要 Logo,不要水印。

>

设计方向

>

不要制作常规的角色设定表。请创作一张具有电影感的角色身份设定板,使其兼具高端动画工作室角色研究稿与艺术设定集版式的质感。

>

整体布局应当不对称、优雅,并具有鲜明的视觉记忆点。运用大面积留白、不同的图像尺度,以及经过设计的非平衡构图。

>

避免使用网格布局、蓝图式设计、产品目录式排版,以及机械重复的角色转面展示。

>

重要布局规则

>

任何角色图像都不得相互重叠。每个视图之间必须保持清晰的间隔与充足的呼吸空间。

>

所有全身像、肖像、剪影和细节研究都必须在视觉上彼此独立。

>

不得裁切面部,不得遮挡四肢,不得堆叠人物,不得让不同姿势彼此融合。

>

主体构图

>

将一个较大的主视觉全身像放置在画面中略微偏离中心的位置,作为整体视觉锚点。

>

在其周围以清晰、疏朗的间距安排尺寸较小的辅助研究图,包括:

>

中立姿态全身像、背面视图、侧面视图、坐姿、倚靠姿势、蹲姿、俯视角度的全身像、仰视角度的全身像、富有表现力的肖像研究。

>

每个视图都应呈现为一张独立、清晰的角色研究图(如有道具,展示角色与道具交互状态),而不是同一场景中的某一帧画面。

>

身份一致性锁定

>

所有视图中的角色身份必须保持严格一致。

>

相同的面孔、相同的五官比例、相同的发型、相同的服装、相同的身体比例、相同的姿态语言,相同的道具特征、以及相同的视觉个性。

>

实用参考细节

>

角色设计应具有足够清晰的辨识度,以便用于后续的图像与视频生成。

>

需要清楚呈现脸型、发型轮廓、服装轮廓、身体形态、双手、姿态与表情变化范围。

>

艺术化分区
加入一个小型剪影研究区,展示 3 个经过简化的黑色角色剪影。

>

加入一个小型表情研究区,展示细腻而克制的情绪变化。

>

加入一个小型细节研究区,展示角色面部、头发与服装中的关键视觉特征。

>

文字设计

>

加入一个具有设计感的角色身份信息块(CHARACTER ID)。

>

文字设计应简洁、醒目,并具有明确的艺术指导感。

>

仅使用以下字段:

>

(NAME):[角色姓名]

>

(ROLE):[角色定位]

>

(CORE MOOD):[核心情绪]

>

(VISUAL SIGNATURE):[视觉标志]

>

仅在确有帮助的位置使用少量手写风格标签。

>

可以加入克制的编辑式箭头与批注符号,但整体必须保持简洁、优雅。

>

整体风格

>

极简、电影感、高级、艺术设定集质感、干净、富有表现力,并且适合实际制作使用。

>

最终画面应当像一张经过专业艺术指导的角色身份设定板,帮助 AI 模型准确理解该角色的面部特征、整体剪影、服装、姿态语言与情绪表达范围。

变体 B · 16:9 中性灰摄影棚 · 固定横向拼版 · 无任何文字(时装/真人向)— 逐字

创作一张具有艺术感的16:9横向角色身份设定板(CHARACTER IDENTITY BOARD)。

>

以[参考图] 中的人物为主体,并延续其视觉媒介与表现形式。所有视图中的角色必须是同一个人。

>

背景采用均匀的中性灰色摄影棚背景。不要环境场景,不要复杂道具,不要文字,不要字母,不要数字,不要 Logo,不要水印。

>

设计方向

>

不要制作普通的三视图表格、九宫格或平均排列的角色目录。请创作一张高端动画工作室角色研究稿与时装造型拼版,采用固定的横向非对称布局。

>

画面由左侧纵向肖像栏、中部全身与动作视图、右侧大幅特写组成。不同视图使用不同大小,整体保持干净、平衡、疏朗。

>

重要布局规则

>

所有角色视图都必须独立存在,彼此保持清晰间隔,不得重叠、遮挡或融合。

>

所有视图置于同一块连续的灰色背景中,不要为每个视图添加独立场景或卡片背景。

>

左侧4张肖像直接排列在同一块连续的灰色背景上,不使用分割线、边框、卡片、色块或独立底板。通过上下留白和自然间距区分各个视图,保持每张肖像清晰独立。中部和右侧同样保持开放的连续背景,不使用规则网格。

>

画面中不出现任何可辨识文字、标签、说明、编号、箭头、标志或装饰性排版。

>

主体构图

>

左侧约占画面宽度的15%,设置一条纵向排列的肖像栏,放置4张彼此分开的头部至肩部近景。四张图呈现正面、三分之二侧面、侧面、轻微转头或不同情绪,保持上下叠放的节奏,每张都是独立的头肩构图。

>

中部约占画面宽度的55%,在偏左位置放置一张最大幅度的正面或三分之二角度全身像。完整展示人物的头部、服装、双手、腿部和鞋子。

>

主全身像右上方安排两张较小的全身视图:一张背面视图,一张侧面或三分之二侧面视图。两张图保持独立,呈现服装的背面、侧面轮廓和整体造型。

>

主全身像下方安排两张较小的动作全身像:一张蹲下、低头或整理服装的姿态;另一张自然站立、行走、倚靠或重心偏移的姿态。两张动作图完整显示身体轮廓,不要夸张成战斗动作。

>

右侧约占画面宽度的30%,放置一张纵向的大幅面部或半身特写。人物略微转头,清楚呈现参考图中的面部特征、发型、眼神、妆容、配饰和服装上半部分。特写可延伸至画面上下边缘,但不得裁切面部关键特征。

>

最终固定为:左侧4张头肩近景;中部1张大幅主全身像、上方2张角度全身像、下方2张动作全身像;右侧1张大幅特写。不得改变区域顺序和基本比例。

>

身份一致性锁定

>

所有视图保持相同的面孔、五官比例、发型、体型、服装、配饰、鞋子、材质与整体气质。只改变角度、表情、动作和取景,不改变人物设计。

>

整体风格

>

极简、电影感、高级、时装化、角色研究稿质感、干净、真实、富有表现力。

>

采用柔和均匀的摄影棚光线,保留自然的皮肤、头发、布料和配件质感。色彩与光线延续用户上传角色参考图的视觉气质,但排版固定为上述横向多视角拼版。

变体 C · 9:16 四宫格速用版(正脸 / 侧脸 / 无脸全身 / 背面全身)— 逐字

创作一个9:16的角色设定图

>

以 [参考图] 中的人物为主体,整体布局为不等大的四宫格视图,上小下大,左上正脸特写、右上侧脸特写、左下脖子以下全身无脸、右下背面全身含后脑勺。

>

背景、光线、色调背景均为白色。

选哪个:A = 要做"作品感"设定集 / 给 KODA 当 @[image1](带 CHARACTER ID 文字,海报味);B = 真人/时装/需要纯净无字的身份参考(中性灰,我们 Higgsfield 一致性流程的角色卡);C = 竖屏速用,10 秒出一张,"无脸全身"那格就是去头全身图的技巧(服装/体型参考不带脸,避免脸污染)。

关联 / 链路

  • ONE TEN 四人 canon 库(永久):https://playbook.oneten.live/canon —— 四人定版同框 + 每人脸锚点/三视图/身份板 + sha256 指纹;版本制(脸不变,服装/宇宙分版本)。做任何 ONE TEN 角色图先来这里取参考。
  • T08 链路:参考图(官方脸锚点)→ 本卡出身份设定板 → `koda-anime-card-cut` 的 `@[image1]` → H3 Max 15s 角色卡卡点
  • 同族:`reference_higgsfield_film_workflow`(角色资产化/中性灰角色卡)· `feedback_face_anchor_first` · `feedback_wentian_proportion`
  • 待办:为 IA10 / 文天 / ONE TEN idol 各出一张 A 版 + 一张 B 版存进 assets 当永久身份卡

来源:https://www.iesdouyin.com/share/microapp/?token=QTQ1RkFEOEVDNzUxNzZqcWFqNzhl&share_channel=copy (抖音小程序→飞书云文档,需 App 内打开;老板 2026-09-02 转来全文)

出图风格

MJ / Codex 手办3D风(人物→盲盒手办)

手办3D角色Codex优先2026-09-02

把四角色做成可爱3D盲盒/泡泡玛特手办风(TOONHUB那条线)。帖子核心:"审美决策 > prompt"——为什么大头/什么比例/圆形vs三角语言,才是决定人物设计的东西。

落地(按硬规矩先Codex免费)

  • 图片先走 Codex/GPT-Image(免费、included),别急着上MJ付费。手办3D风Codex做得很好
  • MJ V8.2优势=Style Reference/Style Code锁统一美术风;但我们四角色一致性已有脸锚点,Codex够用
  • 待测:拿一个ONE TEN角色 Codex出手办测试图对比;真有质量差距再考虑MJ

来源:抖音 大头的Ai世界(MJ人物设计)

出图风格

白月光 · JK 傍晚逆光胶片 —— 从抖音图文反推的风格卡(zzlClare「后来见过很多人,但只有那天的笑最明亮」)

风格写真胶片逆光反推提示词JK傍晚霓虹虚焦组图换皮2026-09-02

未跑(2026-09-02 intake,纯反推风格卡,零积分):把 zzlClare 这组 15 张「白月光」AIGC 写真按 `ai-manju-replicate-viral-reverse-prompt` 的六层法拆成可换皮的风格语法。上方 = 15 图 contact sheet;原图存 `~/claude-work/kpop-pv/intake/dy_baiyueguang/img_01…15.jpg`。这张卡的产出是一套提示词,不是任何一张图 —— 主体层留空位,换上我们自己的角色(默认示例 NOVA)就能出同款氛围的组图。

15 图观察总结(实际看图,不是想象)

| 维度 | 反复出现的元素 |

|---|---|

| 主体 / 服装 | 单人少女,黑长发或齐肩黑发 + 空气刘海,白色短袖水手服(深藏青海军领 + 三道白条)+ 黑百褶裙(01/05/08/09/10/14),另一套是oversize 黑色针织衫露肩/袖口一道红边(03/04/06/07/13/15);配件:黑色单肩包、一小捧纸包花、红色领结、一只奶白色气球。第 11 张是唯一的男生剪影(背影,无脸)—— 组图叙事里的"那个人"。 |

| 姿势 / 动作 | 几乎全是回头看镜头(over-the-shoulder),或半侧脸低头;风吹发丝盖住半张脸是招牌(10/13/15);手托下巴倚栏杆(07/08);抱气球半遮脸(05);抱花走在人潮里(01/14)。表情 = 淡淡一笑、眼神含光,没有大笑没有摆拍。 |

| 环境 / 时段 | 全部在傍晚→夜初这 40 分钟:① 校门口/街头人潮(前后景全是同款校服学生虚化);② 天台/天桥栏杆 + 落日云层(10/11/12);③ 城市霓虹虚焦——红、橙、白的大圆 bokeh(05/07/13);④ 机场/跑道晚霞 + 起飞飞机剪影(12)。 |

| 光影 | 金调逆光 / 侧逆光为主:太阳贴在画面边缘,发丝边缘一圈金色轮廓光、镜头炫光和 halation(高光晕开);脸靠环境光/反光板补,暗部偏青蓝。夜景则是霓虹当背景光源,脸上一层暖橙侧光。整体软、雾、有空气感。 |

| 镜头感 | 85mm 大光圈味:浅景深,主体清、背景全糊,bokeh 大而圆;中景/近景为主(腰上或胸上),少量半身;机位与眼平或略低;画幅 3:4 竖构图。 |

| 色调 / 画质 | 低饱和胶片:暖橙高光 + 青蓝阴影(teal-orange 但很克制),黑不死、白不爆(褪色 fade),均匀细颗粒,轻微柔焦/雾面 soft glow;无锐化感,无 HDR。 |

| 叙事 | 组图 = "某一天傍晚的那个人":人潮里回头 → 天台吹风 → 夜市霓虹 → 机场晚霞 → 男生背影 → 最后一张笑着回头。文案 "只有那天的笑最明亮" 点题。 |

六层拆解(反推法)

| 层 | 反推结果 | 换皮时 |

|---|---|---|

| ① 主体 | 单人少女;黑发/空气刘海;白水手服黑百褶裙 或 oversize 黑针织衫;黑肩包/纸包花/红领结/气球 | 动 —— 换成自己角色(脸/发型/服装换,"JK 语法"可保可换) |

| ② 动作·动态 | 回头看镜头 / 半侧脸低头 / 手托下巴倚栏 / 抱气球半遮脸 / 风吹发遮眼;表情克制淡笑 | 不动(这是"白月光"的表演 DNA) |

| ③ 环境氛围·时间 | 傍晚黄金时段→蓝调初夜;人潮街头 / 天台天桥栏杆 / 霓虹街 / 机场晚霞;怀旧、青春、一点点失落 | 场景三选一(见变体) |

| ④ 光影 | 逆光/侧逆光,太阳贴画面边缘;金色发丝轮廓光;镜头炫光 + halation;暗部青蓝补光;夜景用霓虹当背景光 + 暖橙侧光;强度中等偏软 | 不动 |

| ⑤ 运镜·镜头 | 85mm f/1.4–1.8 浅景深;中近景、眼平或略低机位;3:4 竖幅;主体偏一侧,背景留大片 bokeh | 不动 |

| ⑥ 视觉风格·色调·画质 | 低饱和胶片感,teal-orange 克制版,褪色黑位,细颗粒,轻柔焦/雾面 glow,无锐化无 HDR;静态图(无帧率)| 不动或按目标模型换词 |

可直接用的提示词(中英双语)— 主体层是可替换块

主体块(默认占位):`[角色:参考图1 的脸与发型]` —— 用时把参考图作为 `@[image1]` 上传,并把方括号换成该角色的一句话描述。

中文版

[角色:参考图1 的脸与发型],穿白色短袖水手服(深藏青海军领三道白条)和黑色百褶裙,肩上黑色单肩包。
傍晚黄金时段,城市街头人潮中,她回头看向镜头,风把几缕发丝吹到脸前,嘴角淡淡一笑,眼里有光。
太阳贴在画面边缘,强逆光:发丝边缘一圈金色轮廓光,镜头炫光与高光晕开(halation),脸部由环境反光柔和补亮,暗部偏青蓝。
85mm 大光圈浅景深,中近景,眼平机位,3:4 竖幅,主体偏画面一侧,背景人群与灯光全部化成大而圆的虚焦光斑。
低饱和胶片质感:暖橙高光、青蓝阴影、褪色黑位,细腻均匀颗粒,轻微柔焦雾面光晕,没有锐化和 HDR 感。
情绪:青春、怀旧、"那天傍晚的那个人"。

English

[CHARACTER: face and hairstyle from reference image 1], wearing a white short-sleeve sailor-collar school uniform (navy collar with three white stripes) and a black pleated skirt, black shoulder bag.
Golden-hour evening on a crowded city street; she glances back over her shoulder at the camera, a few strands of wind-blown hair across her face, a faint knowing smile, light caught in her eyes.
Sun sits at the edge of the frame — strong backlight, golden rim light tracing every hair strand, lens flare and soft halation blooming from the highlights; face gently filled by ambient bounce, shadows leaning teal-blue.
85mm f/1.4 shallow depth of field, medium close-up at eye level, 3:4 vertical, subject off-center, the crowd and city lights behind her dissolving into large round bokeh.
Low-saturation film look: warm orange highlights, teal shadows, lifted faded blacks, fine even film grain, slight soft-focus haze glow, no sharpening, no HDR.
Mood: youth, nostalgia, "the one from that evening".

填好的示例 · NOVA(白金短发)

主体块取自 `~/claude-work/kpop-pv/t09_newgirl/board_nova_E2.png`:白金色蓬松短 bob、浅绿眼睛、暗红唇、小黑发夹;身板细长腿长。
NOVA:白金色蓬松短 bob 发,发尾微翘,浅绿色眼睛,暗红色唇,耳后一枚小黑发夹(参考图1)。她穿白色短袖水手服(深藏青海军领三道白条)和黑色百褶裙,肩上黑色单肩包。
傍晚黄金时段,城市街头人潮中,她回头看向镜头,风把白金色碎发吹到脸前,嘴角淡淡一笑,眼里有光。
太阳贴在画面边缘,强逆光:白金发丝被打成一圈近乎透明的金色轮廓光,镜头炫光与高光晕开,脸部由环境反光柔和补亮,暗部偏青蓝。
85mm 大光圈浅景深,中近景,眼平机位,3:4 竖幅,主体偏画面一侧,背景人群与灯光化成大而圆的虚焦光斑。
低饱和胶片质感:暖橙高光、青蓝阴影、褪色黑位,细腻均匀颗粒,轻微柔焦雾面光晕,没有锐化和 HDR 感。
NOVA: platinum-white tousled short bob with flipped ends, pale green eyes, dark red lips, a small black hair clip behind one ear (reference image 1). White short-sleeve sailor-collar uniform (navy collar, three white stripes), black pleated skirt, black shoulder bag.
Golden-hour evening in a crowded city street; she looks back over her shoulder at the camera, wind pushing platinum strands across her face, a faint smile, light in her eyes.
Sun at the frame edge — strong backlight turning the platinum hair into an almost translucent golden rim, lens flare and halation blooming, face softly filled by ambient bounce, teal-blue shadows.
85mm f/1.4 shallow DOF, medium close-up at eye level, 3:4 vertical, subject off-center, crowd and city lights melting into large round bokeh.
Low-saturation film look: warm orange highlights, teal shadows, lifted faded blacks, fine even grain, slight soft-focus haze glow, no sharpening, no HDR.
 NOVA 的白金发在逆光里会比黑发更"炸",提示词里加了"近乎透明的金色轮廓光"压一下;若出图发丝过曝,把"强逆光"改成"侧逆光"。

负面提示

过度锐化, HDR, 高饱和, 塑料皮肤, 磨皮过度, 直射硬光正面打脸, 死黑, 高光溢出成白块, 背景清晰, 广角畸变, 大笑露齿, 多人主体, 文字, 水印, logo, 畸形手指, 多余肢体
oversharpened, HDR, oversaturated, plastic skin, over-smoothed, harsh frontal light, crushed blacks, blown-out white patches, sharp background, wide-angle distortion, big toothy grin, multiple subjects, text, watermark, logo, deformed hands, extra limbs

3 个变体方向(只换 ③ 环境层,其余不动)

| 变体 | 环境层替换文本 | 光影微调 |

|---|---|---|

| A · 天台夕阳(≈ img_10/12) | 天台/天桥金属栏杆,她倚栏回头,身后是落日压在城市天际线上、层层染金的云 | 太阳直接入画在肩后,最强的发丝轮廓光 + 明显炫光和 halation;脸可以半隐在发丝与逆光里 |

| B · 夜市霓虹(≈ img_05/07/13) | 蓝调初夜的街头,红橙白霓虹招牌全部虚焦成大圆光斑,她抱一只奶白气球半遮脸或托腮倚栏 | 霓虹作背景光,脸上一层暖橙侧光,暗部青蓝更重,颗粒略粗 |

| C · 机场晚霞(≈ img_12) | 机场外围/跑道边,橙红晚霞压在地平线,一架飞机剪影正起飞,她侧身看向远处 | 逆光最纯:人物接近剪影,只留发丝金边和衣服白色被透亮;天空是画面主角 |

适用场景

  • 角色写真组图:给 NOVA / Karen / ONE TEN 任一角色出 6–9 张"那天傍晚"系列,一套提示词换三个变体 + 三个动作(回头 / 托腮 / 遮脸)就是一组。
  • KODA 首帧的柔情版:`koda-anime-card-cut` 的首帧默认是舞台/冷调,需要"温柔开场"时用本卡 A 变体出首帧,再接 H3 卡点。
  • MV 插入镜头:《鲸背之城》/ K-pop PV 里的回忆段落 —— 本卡出静帧 → H3 5s 微动(发丝飘、光斑呼吸),配 `cewrite-storyboard` 的无脸切出镜头。

注意事项

  • 这张卡学的是氛围 / 光影 / 镜头语法,不搬运原作者的人物和构图;主体层必须换成我们自己的角色。
  • 抖音原作者 zzlClare 自标 aigc,原图有 `zzlClare` 水印 —— 只做内部参考,不外发。
  • 逆光 + 白衣极易过曝:出图先看衣服白位有没有细节,没有就把"强逆光"降为"侧逆光"或加"衣服保留布纹细节"。
  • 出图走 Codex(`codex exec … -i 参考图`),Higgsfield 只兜底;任何花积分的运行先问老板(`feedback_libtv_credit_budget`)。

参考图

  • 组图 contact sheet:`assets/baiyueguang_sheet.jpg`
  • 单张(≤1600px 内部参考):`assets/baiyueguang_01.jpg`(人潮回头·水手服)· `assets/baiyueguang_05.jpg`(霓虹·气球遮脸)· `assets/baiyueguang_10.jpg`(天台落日·风吹发)

关联

  • 方法:`ai-manju-replicate-viral-reverse-prompt`(六层反推法,本卡是它在静态图上的第一次落地)
  • 光影词库:`yantong-lighting-grammar` · 风格词库:`render-engine-keywords`
  • 主体资产:`character-identity-board`(NOVA 板 = `t09_newgirl/board_nova_E2.png`)· `feedback_face_anchor_first`
  • 下游:`koda-anime-card-cut`(首帧)· `cewrite-storyboard`(插入镜头)
  • 待办:老板点头后用 NOVA 示例跑 A/B/C 各 1 张(Codex),并排对比原图看还原度,把结果补进本卡。

复刻要点(2026-09-02 深夜实战,SONGGIFT 两轮对比得出)

  • 光改场景句不够:如果出图流水线里还挂着别的通用主干(比如「anamorphic 炫光 / premium movie still / 温暖气氛」),它会吃掉白月光的语法,出来还是原来的味道。要复刻,就把那段主干整段换掉,换成本卡的「candid 胶片照 + 低饱和雾面褪色」描述。
  • 必须喂风格参考图:把本卡的 `baiyueguang_01.jpg` 作为第二张参考图一起给 Codex(第一张 = 人物身份),提示词写明「第二张只借光、色、雾、氛围,不借人」。NOVA 版和 SONGGIFT v2 都是这样才对味的。
  • 宽幅(21:9)也能用:人放在三分之一处,其余留给虚焦街景和天空。
  • 已落地:SONGGIFT `backend/cinematic_build.py` 的 `BYG_SPINE` + `LOOKS_BAIYUEGUANG`(默认池每单 2 张)。

姊妹风格(2026-09-06)

  • 同作者第二组「……但有一刻,月亮的确现在了我身上。」= 蓝调时刻冷调硬光版,光/色/构图三层全换,反推卡 `dy-zzlclare-moonlight-2`;建议立 S07「蓝调时刻」(未登记,等老板)。「NOVA 走白月光」仍指本卡暖调版,别混。

首跑 2026-09-12(他令「用白月光出两张图看看」,Codex 零积分)

  • 输出 `~/claude-work/kpop-pv/byg_nova/nova_byg_01_crowd.png`(主版·人潮回头)/ `nova_byg_02_rooftop.png`(A 变体·天台夕阳),1086×1448;提示词 `prompt_1_crowd.txt` / `prompt_2_rooftop.txt`;参考 = `board_nova_E2.png`(身份)+ `baiyueguang_01/10.jpg`(只借光色)。
  • 结论:语法能换皮——逆光金边、halation、teal-orange、大圆 bokeh 全部出现;A 变体更接近原味;主版脸清楚但偏「画」,胶片软度略差 → 下次主版加「candid snapshot, slight motion softness, film halation stronger」。
  • 背景:他 9/12 用 zzlClare 原图做了三条 Moon1k 宣传片后问侵权风险 → 定论是以后不再用她的图,改本卡 + 自有角色出图。等他点头出 6–9 张组图。

来源:https://v.douyin.com/1d-FR9KNJJY/ (抖音图文 · note 7680384097549651215 · 作者 zzlClare · 「后来见过很多人,但只有那天的笑最明亮。#白月光 #aigc创…」· 15 图 3712×4928 · 作者自标 aigc)

出图风格

人物角色卡 3步(角色一致性设定表)

角色卡一致性设定表人物设计2026-08

从零做人物角色卡(character reference sheet)的3步法:基础信息(姓名/性别/年龄/身份/性格) → 外形设定(五官/发型/服饰/配饰/身材比例) → 用途(喂给图/视频模型锁一致性)。生成工具:小云雀。跟我们的脸锚点/face-anchor一路。

要点

  • 三视图 + 特殊标识(痣/眼镜/发色) 明确写死 → 跨镜头不漂
  • 我们已有 ONE TEN 四角色的锚点,转手办/换风格=restyle基于此
  • 关联:feedback_face_anchor_first、Higgsfield角色资产化

来源:https://v.douyin.com/CsdKzZd2QM8

出图风格

渲染引擎关键词 — 塑料感→电影感/游戏截图→电影帧

渲染电影感光影材质提示词关键词套装2026-08

塑料感AI视频和"神作"的差距,就在提示词里的渲染引擎 + 光影/材质关键词。电影感=细节堆出来的。(我们Cypher engine doc 的 RENDER-QUALITY LAYER 已收,仅用于写实/半写实镜头,别用在故意平涂的2D海报风。)

渲染引擎关键词(写实镜头才加)

  • UE5 + Lumen(实时全局光)、Octane render、Redshift、V-Ray、Unreal Engine 5 → 拉高质感
  • 光影:cinematic lighting, volumetric light, global illumination, ray tracing, rim light, soft shadows, god rays
  • 材质:subsurface scattering(皮肤), physically based rendering(PBR), micro-detail, fabric/metal/glass material
  • 画质:8K, hyper-detailed, photorealistic, film grain, shallow depth of field, anamorphic
  • 只加在写实/电影感镜头;平涂2D/编辑海报风(OVERDRIVE那种)别加,会破风格
  • 深挖TODO:dy_19"5套渲染关键词套装"重看取完整套装分类

来源:https://v.douyin.com/wVe7PDYpjm4 https://v.douyin.com/RXe7p0GInVQ

出图风格

焰瞳 — 让眼睛/脸光影炸裂的布光语法

焰瞳布光眼神光电影感人像提示词2026-08

"焰瞳"布光语法 —— 为什么这张图光影特别好看:关键光藏在镜头后面(画面里看不见光源),它的暖光是脸上唯一的主光,背景压到近全黑,眼睛里有细小的暖光反射(瞳孔里的"火焰")。 可移植到任何场景(雨夜/列车/festival),换角色+换环境、布光语法不变。

布光语法(核心·移植到任何场景)

  • 光源在镜头正后方、画面内不可见 → 只有它的暖光打在脸上
  • 背景压到近黑(人群/街道/车厢 dissolve into blackness)
  • 眼睛里有细小暖光反射/眼神光(这就是"焰瞳"的点睛)
  • 镜头:50mm f/2.8,warm unseen-neon key light,black background
  • 环境元素接暖光:雨滴像火珠、列车灯扫过、发丝边缘一点冷紫补光

用法(Codex图生图,喂两张ref)

  • ref1 = 角色(锁identity/发色/服装);ref2 = 一张示范这个布光语法的图
  • 提示词写死:"light source BEHIND THE CAMERA and not visible, warm glow the only key on the face, background near-black, tiny warm reflections glint in the eyes" + 新场景描述
  • 完整两条(雨夜蓝发/列车金发)在 gen_yantong_scenes.sh

来源:gen_yantong_scenes.sh

视频提示词 14

30 秒 AI 广告当导演拍 · Higgsfield 官方教程拆解(角色→场景→道具→分镜→修片→成本)
视频提示词

30 秒 AI 广告当导演拍 · Higgsfield 官方教程拆解(角色→场景→道具→分镜→修片→成本)

广告片HiggsfieldCinema StudioSeedance 2.5Soul CinemaSeedream 5 Pro角色卡站位图地标锚点匹配剪辑遮挡转场Claude skill2026-10-08

一句话:像真人拍摄一样先把「人、景、道具、站位」全部锁死再按生成键;每一镜失败都回到提示词里补「没写清楚的那一个变量」。整条广告约 2,100 积分(含失败),两周约 400 次生成。

1. 资产先建文件夹

Cinema Studio 新建项目 → 左侧按 角色 / 场景 / 道具 / 群演 建子文件夹。资产多了才不乱。

2. 角色卡(Soul Cinema 出,Seedream 5 Pro 修)

  • 先让 Claude 把一句人设扩成详细角色卡提示词:特写肖像 + 正面全身 + 背面全身。
  • 纯灰背景:没有干扰,脸和衣服一眼看清,可用率高。
  • 只留一张脸:全身图裁成脖子以下,Seedance 只认那一张特写脸,其他格只管衣服和比例 → 角色一致性的关键。
  • Soul Cinema 8 张只要 1 积分,适合大量试造型;出来皮肤太光、光太硬,就用 Seedream 5 Pro 编辑(柔光、留皮肤质感、去雀斑),它改细节还能保住原光影。
  • 存成「Character 名字」,以后每次生成都挂这张。

3. 场景(先锁光、布局、背景)

  • 场景参考图:暖色室内灯 + 窗外蓝调时刻、开放式厨房做纵深。
  • 永远用 3/4 侧角度:有纵深,运镜有东西可抓,比正面平视好渲染得多。
  • 生成后用 Seedream 改布局:前景柜子缩小、茶几清空给外卖袋留位置,「其他光影不变」。
  • 食物直接画进场景图:每个座位前已放好盘子 → 座位提前规划,不用单独出食物参考。

4. 道具与群演

手机在三人之间传递 → 单独一张参考;包装袋 logo 朝镜头;四个乐手做在一张图里(群演一张搞定);猫单独一张。

5. 分镜(Claude 写,带对白时间和运镜)

  • 用自建的「提示词 skill」:描述场景 → 自动拆成镜头 + 对白时间 + 运镜;参考图在提示词里用同名标签。
  • 匹配剪辑转场:点手机那一下切到下一个国家,人物取景和镜头运动保持一致,只换地点。
  • 遮挡转场:镜头横移到某人背后,背挡满画面时切 → 像一镜到底换场景。
  • 声音先行:先切掉音乐、先进新地点的环境声,再揭画面。
  • Seedance 2.5(Cinema Studio 里)约 200 积分/条。

6. 修片:失败都是「没写死的变量」

  • 座位跑了 → 提示词里没给他指定座位。加一个短的全景开场镜当「主关键帧」锁住每个人坐哪(成片可以剪掉它)。
  • 背景地标锚点:每个座位绑一个背景地标(天窗在 A 后面、书架在 B 后面、红灯在 C 后面),运镜时有东西可核对。
  • 反打方向错 → 明确写这个机位「看到什么」:楼在镜头旁边、桌子在乐手后面、山在远处。反打一定要用锚点告诉模型机位怎么绕。
  • 人数/餐位错(三人出四个位) → 用 Seedream 画一张彩色站位图(每人一种颜色编码:橙=左、蓝=上、绿=右,盘子、手机位置都标好),连同站位 skill 和参考一起喂;颜色只是标签。俯拍旋转镜还要给头顶留空间。
  • 不必用每一镜:用最强的片段剪成片。

7. 收尾 pack shot

品牌包装特写 → 拉远下摇到猫和吃饭的人,一个镜头四秒;动作写细(低头、咬、嚼),让运镜停下时画面里正好有事发生。

我们怎么用

  • 和我们已有的 [站位锁定卡 kb/blocking_lock] [Higgsfield 三 skill 工作流] 是同一套方法,这条是官方完整示范,可当 SONGGIFT / 文天影业广告片的标准流程。
  • 角色卡「灰底 + 只留一张脸」直接并入四角色和文天的出图规矩。

来源:https://v.douyin.com/B6broVVoJJ8/ (Higgsfield.AI 官方 · 让AI广告感觉像真实拍摄 · 17 分钟 · 16.4 万赞;示例:外卖 App「Higos」30 秒,三个朋友三个国家)

视频反推提示词卡(来源:抖音 鹏爷「分享一个做视频的好方法」2026-09-16 转发;实为 creatok 工具广告,只留清单)
视频提示词

视频反推提示词卡(来源:抖音 鹏爷「分享一个做视频的好方法」2026-09-16 转发;实为 creatok 工具广告,只留清单)

笔记2026-09-16

用途:看到爆款视频,反推一条能复刻其质感的提示词,再换成自己的主体。

反推指令(喂给能看视频的模型:Higgsfield video_analysis / Gemini):

「根据这段视频反推完整的视频提示词,必须涵盖:①主体(人物/物品)及核心特征 ②精准动作说明 ③场景与环境 ④氛围与时间设定 ⑤光影:光线类型、强度、方向 ⑥运镜手法:推拉摇移、俯仰 ⑦镜头语言与视觉风格 ⑧色调 ⑨画质、分辨率、帧率 ⑩特效参数。按这十项分条输出,每项一句。」

二次处理:只换 ①主体,其余九项原样保留 → 质感一致、主体是自己的。

用法:STORM II 这类翻拍先跑一遍反推,把「光影/运镜/色调」三项原文贴进 Seedance 提示词;配合 [[blocking_lock]] 锁站位。工具本身(creatok「一秒反推」)不买。

视频提示词

T16 · 奶油风双色偶像 PV(两色锁死 + 名字做布景 + 歌词唱画面)

奶油风双色配色AI偶像立体字母布景歌词视觉耦合KPOP-PV4K参考待复刻2026-09-11

老板 2026-09-11 定:不能直接拿来用,做成我们 T 系列的模板,稍微改动。 本卡 = 参考解剖 + ONE TEN 改法。状态:参考卡,未复刻(复刻需老板「跑」)。

原片解剖(50s,无口播,英文原创歌)

| 段 | 画面 | 学到的点 |

|---|---|---|

| 0–20s | 白金短发 AI 偶像 SHAN 脸部特写,雾霾蓝墨镜、奶油色外套,压在巨型字母海报「SHAN」(蓝字白底)上,像杂志封面;左上手写签名 | 名字本身就是背景,脸永远只占画面 1/3,其余交给排版 |

| 20–50s | 全身在立体奶油黄字母「SHAN」的布景里,踩着深蓝蓝莓球跳舞、转身、飞踢;台面奶油色、天空雾霾蓝 | 名字从海报变成可踩的舞台 = 同一元素两种用法,一条片子只记一个词 |

| 全片 | 只允许两种颜色:雾霾蓝 #6B8CB5 附近 + 奶油黄 #E9DCB6 附近;道具(蓝莓、圆台、墨镜)全部落在这两色里 | 配色锁死 = 高级感的来源,不靠光效 |

| 歌词 | "Light on all night / Blue glass shining bright / Blue blueberry bounce bounce back / Blue on yellow cut to black…" | 歌词把颜色和道具唱出来,画面和歌互相解释,观众一遍记住 |

ONE TEN 改法(T16 模板规格)

1. 每首歌定两个颜色(一主一辅),写进 style/KV/服装/道具四处;禁第三色(黑白算中性可用)。

2. 名字做布景:偶像名或歌名做成①海报字(特写段)②立体字母舞台(全身段);沿用 T12 的图形海报 KV 骨架,把四色章节改成双色单章。

3. 歌词耦合:Suno 词里至少一句点名主色/道具(如 "blue on yellow"),副歌短句可唱可跳(LYRIC_CRAFT 第 3 条)。

4. 镜头配比:前半特写压海报字 / 后半全身踩道具,各 50%;动作用 H3 mixed2video 2K(T05 配方),特写段可用 T13 的动效层。

5. 道具 = 主色的物化(蓝莓球→蓝;奶油台→黄),每个镜头至少一个道具入画。

6. 竖版发抖音(9:16 安全区规矩),横版留 YouTube。

发行钩子(2026-09-11 查证)

  • #AI偶像星光计划 = 即梦 AI 发起、抖音承接的 AI 偶像扶持标签(长期,无报名截止;机构靠它做「练习生/选秀」系列,如 麦芽的 @12星练赛)。发片带标签即可参与流量扶持。
  • #抖音AI创作大赛(即梦深度合作):2026 届征稿 6/10–8/20 已截止,入围 8/31、获奖 9/22 公示;要求 ≥2 分钟完整故事、抖音+即梦双端投稿、勾 AI 声明。等 2027 届。
  • 抖音「AI创变者计划」是大学生黑客松(4/13–6/20),与我们无关。

参考帧

`assets/t_cream_idol/kf_01..26.jpg`(每 5 秒一帧)、`sheet.jpg`(九宫格)、`ref_web.mp4`(960p 压缩参考,原片 4K 在 /tmp/douyin.fEM1Qq/video.mp4,需要时另存)。

来源:https://v.douyin.com/XCRrm5OoX2U/ (白棱_Shan · 「奶油蓝莓~! 当雾霾蓝遇见奶油黄」2026-08-10 · 50s · 3840×2160 · 212.5K 赞 · #万物皆可奶油风 #抖音AI创作大赛 #AI偶像星光计划)

视频提示词

Codex 配方 · 16.4s 赛博电子 visualizer(四张风格帧 → H3 每段 3–5s → 卡点剪)

候补visualizer赛博Y2K钴蓝铬金属H3Kling风格帧Codex卡点Moon1kBlue Astra零积分起步2026-09-06

候补(2026-09-06,老板转发 Codex 的方案 → 入库;风格帧已用 Codex image_gen 零积分出图,H3 段落未跑、未定级)。上方缩略图 = 四张风格帧联络表(`assets/recipe-cyber-visualizer-h3_contact.jpg`;原图在 `~/shared-review/cyber-viz/sf1_chrome.png … sf4_kaleido.png`)。

方案总纲(Codex 设计,2026-09-06)

  • 目标:16.4 s · 1080×1920 · 赛博电子 visualizer。不是一次生成出来的,而是 多个 AI/3D 素材 + 音乐 visualizer 剪辑 的合成物。
  • 骨架:四张风格帧(style frames)→ 每张喂 H3 出 3–5 s 动态 → 按鼓点硬切成片。风格帧决定"贵不贵",视频模型只负责让它动,剪辑负责节奏。
  • 统一色域:冷钴蓝单色 + 纯黑,铬金属与玻璃材质,Y2K 赛博专辑 visualizer 味;无人、无脸、无字、无 logo、无暖色。
  • 四段内容:(1) 铬金属玻璃雕塑悬浮黑暗 (2) 黑白高反差几何碎片爆炸 + 技术图纸线/坐标/HUD 符号 (3) 倾斜俯视冷蓝风暴云 + 发光雾 (4) 四向完全对称万花筒·发光蓝环 + 机械花瓣。

一、风格帧提示词(Codex image_gen,9:16,四张)

共用风格后缀(每条都接在主体后面):

cold cobalt-blue monochrome on pure black, chrome-and-glass materials, Y2K cyber album-visualizer aesthetic, polished 3D render, crushed blacks, fine grain, subtle chromatic aberration, vertical 9:16, no people, no faces, no text, no logos, no warm colors

sf1_chrome:

abstract chrome-and-glass sculpture floating in darkness with stretched blue reflections, cold cobalt-blue monochrome on pure black, chrome-and-glass materials, Y2K cyber album-visualizer aesthetic, polished 3D render, crushed blacks, fine grain, subtle chromatic aberration, vertical 9:16, no people, no faces, no text, no logos, no warm colors

sf2_shards_hud:

black-and-white high-contrast geometric shard explosion with thin technical-diagram lines, coordinate marks and tiny HUD glyphs (glyphs must be abstract marks, not readable words), cold cobalt-blue monochrome on pure black, chrome-and-glass materials, Y2K cyber album-visualizer aesthetic, polished 3D render, crushed blacks, fine grain, subtle chromatic aberration, vertical 9:16, no people, no faces, no text, no logos, no warm colors

sf3_clouds:

tilted aerial view above cold blue storm clouds with luminous haze, cold cobalt-blue monochrome on pure black, chrome-and-glass materials, Y2K cyber album-visualizer aesthetic, polished 3D render, crushed blacks, fine grain, subtle chromatic aberration, vertical 9:16, no people, no faces, no text, no logos, no warm colors

sf4_kaleido:

perfectly symmetrical four-way kaleidoscope of luminous blue loops and mechanical petals, cold cobalt-blue monochrome on pure black, chrome-and-glass materials, Y2K cyber album-visualizer aesthetic, polished 3D render, crushed blacks, fine grain, subtle chromatic aberration, vertical 9:16, no people, no faces, no text, no logos, no warm colors

二、H3 一段 15 s 多场景提示词(备选:一段生成而不是四段;结构逐字保留)

Cyber-electronic music visualizer, vertical 9:16, cold cobalt-blue monochrome on pure black, chrome-and-glass materials, Y2K album-visualizer aesthetic, polished 3D render, crushed blacks, fine grain, subtle chromatic aberration. Hard cuts on the beat, every scene a new composition, animate the ENTIRE composition.
00:00–00:02 — abstract chrome-and-glass sculpture floating in darkness, slow rotation, stretched blue reflections sliding across its surface, lens push-in.
00:02–00:05 — hard cut: black-and-white high-contrast geometric shard explosion, thin technical-diagram lines, coordinate marks and tiny abstract HUD glyphs flickering, shards burst outward then freeze, 2-frame white flash on the hit.
00:05–00:08 — hard cut: tilted aerial view gliding above cold blue storm clouds, luminous haze, camera banks slowly, light pulses inside the clouds on the beat.
00:08–00:12 — hard cut: perfectly symmetrical four-way kaleidoscope of luminous blue loops and mechanical petals, mirror H+V, petals opening and closing to the rhythm, rapid 8–12 fps strobe inserts.
00:12–00:15 — hard cut: return to the chrome sculpture, now shattering into shards that dissolve into cloud haze, kaleidoscope mirror folds the frame to black, final 2-frame white flash then black.
Negative: no people, no faces, no text, no letters, no readable words, no logos, no watermark, no warm colors, no red, no orange, no yellow, no daylight, no realistic landscape, no cartoon, no low-poly, no blur across the whole frame, no slow fade transitions.

三、Kling 分段提示词(每张风格帧单独出 3–5 s,image-to-video)

铬金属段(喂 sf1_chrome):

Image-to-video, 5 s, vertical 9:16. The chrome-and-glass sculpture rotates slowly in pure darkness; cold cobalt-blue reflections stretch and slide across its polished surfaces; subtle camera push-in with slight orbit; fine grain, subtle chromatic aberration, crushed blacks. No people, no text, no logos, no warm colors, no camera shake, no scene change.

风暴云段(喂 sf3_clouds):

Image-to-video, 5 s, vertical 9:16. Tilted aerial glide above cold blue storm clouds; luminous haze drifts and pulses from inside the cloud layer; camera banks slowly to one side; clouds roll in slow motion; crushed blacks, fine grain, subtle chromatic aberration. No people, no text, no logos, no warm colors, no sun, no daylight, no ground.

(碎片段 / 万花筒段同法:碎片 = "shards burst outward then hold, HUD glyphs flicker";万花筒 = "petals open and close to a pulse, mirror symmetry locked, never break symmetry"。)

四、后期参数(Codex 给的剪辑层,卡点剪时照抄)

  • 方向模糊 directional blur:60–180 px(切前 1–2 帧拉一下,制造"甩")
  • 快门角 shutter:180–270°(动态模糊偏重,铬金属拉丝感)
  • 镜像 mirror:H + V(万花筒段、以及任意段的强拍上翻一下)
  • 抽帧插入 8–12 fps inserts:最密鼓段用低帧率段落做"卡顿式"频闪
  • RGB 分离 chromatic split:1–3 px
  • 光晕 light glow:轻,只让高光发光,不糊黑
  • 白闪 white flash:1–2 帧(强拍)
  • 黑帧 black:2–5 帧(呼吸,塞在最密段前)
  • 字卡 words:每张 4–12 帧(一词一卡,快到读不完才对)
  • 字体:Eurostile Extended / Microgramma / Orbitron(Y2K 拉宽无衬线;三选一,全片只用一种)

我们的版本(零积分优先,H3 段落等他「跑」)

1. 风格帧(Codex,已出):`~/shared-review/cyber-viz/gen.sh` = 四条 `codex exec --skip-git-repo-check --sandbox danger-full-access -- "<prompt>"` 并行,失败自动重试一次;产物 `sf1_chrome.png / sf2_shards_hud.png / sf3_clouds.png / sf4_kaleido.png` + `*_small.jpg` + `styleframes_contact.jpg`。不满意只重出那一张。

2. H3 4 × 5 s(需要「跑」,约 160 积分):LibTV H3,singleImage2video,9:16,每张风格帧一段 5 s,提示词用上面第三节的分段写法(不用一段 15 s,多段更好挑)。人脸规矩不适用(无人),2K 不必,1080P 即可。参数与上传步骤照 `method-h3-mv-recipe`。

3. 卡点剪(本机,零积分):四段 H3 母版进 bank,用

python3 ~/claude-work/moon1k-clips/reactive/bank/bank_cut.py \
  ~/claude-work/moon1k-clips/blue_astra/blue_astra_short_drop.mp4 cyber_viz_blue_astra.mp4 \
  --bank ~/shared-review/cyber-viz/bank --len 16.4 --fps 30 \
  --manifest ~/claude-work/assets-lib/manifest.json --luma-plan --bridge auto \
  --user Moon1k --title "Blue Astra" --date 09.06.2026

— 歌 = Blue Astra 的 drop 段(113 BPM),16.4 s ≈ 31 拍;`--luma-plan` 让相邻切口亮度同档(修「图与图之间连接不够」),`--bridge` 让章节牌/透明字卡跨切口承接。

4. 字卡:drop 上按第四节参数压 word cards(每张 4–12 帧,Orbitron;Eurostile/Microgramma 本机没有就用 Orbitron),一词一卡,落在安全区([[feedback_9x16_safe_zone]]);Moon1k 线歌名隐藏,三行固定字照 T15 规矩。

5. 后期层(方向模糊 / 抽帧 / RGB 分离 / 白闪 / 黑帧)优先在 bank_cut.py 里加开关,不进剪映。

6. 发送规矩:频闪 + 细颗粒熵高,Telegram 当文件发。

候补定级(未跑)

  • 预估层:Tier 2(无角色无文字准确率问题;短板 = 抽象 visualizer 第二条起同质化,靠换风格帧续命)。
  • 六项预估:成片完成度 待验 / 动作密度 高 / 文字准确率 满(本机字卡)/ 角色一致性 不适用 / 可复用性 高 / 单条成本 ≈160 积分 + 本机剪辑。
  • 验证路径:Blue Astra drop 出一条 → 发他看片 → 定升降 → 登记 picker。

关联

  • 同族:`ig-scene-bank-strobe-teaser`(场景库频闪剪法、bank_cut.py 的来源)· `ig-ghost-remix-teaser-anime-open`(冷开场骨架)· `method-h3-mv-recipe`(H3 参数)· `h3max-multishot`(一段多镜头写法,第二节同源)· `dy-bocchi-lyric-typo-edit`(一词一卡)
  • 风格帧联络表:`assets/recipe-cyber-visualizer-h3_contact.jpg`

来源:Codex 设计,2026-09-06(老板转发的 Codex 方案,由笔记忠实重建;提示词英文逐字保留)

视频提示词

IG 参考 · ghost.「BETTER OFF」16 秒发歌 teaser · 一词一卡歌词字卡 × 每词换底图 × 词间频闪 × 黑帧呼吸 × 品牌收尾(update_complete 文案)

IG参考候补发歌teaserUKG歌词字卡一词一卡kinetic-typography每词换底频闪黑帧呼吸品牌收尾update_complete文案Moon1kT14同族零积分2026-09-04

候补(2026-09-04 IG intake,未复刻、未定级,零积分入库)。同作者三连之三(另见 `ig-scene-bank-strobe-teaser`、`ig-ghost-remix-teaser-anime-open`)。上方 = 作者原片(压缩版 480p),20 帧顺序表 `assets/ig-ghost-lyric-word-cards-teaser_contact.jpg`(0.8s 一格)。未登记 picker,等老板点头。

它是什么

16 秒发行日预告,原生 9:16,歌词一词一卡:`IF` → `BETTER` → `OFF` → `GONNA` → `MY` → `BE…`(词序被打乱重排,不是逐句字幕),每个词用同一款圆角科技体小字、居中、描边发光,但每个词换一张完全不同的底图:黑底 + 两个圆形 HUD 环 / 纯天蓝色空卡 / 红调故障碎片 / 黑色球体 / 白底铬碎片爆 / 真实云层照片 / 蓝色液态铬 / 白色玻璃碎。词与词之间塞 0.5–1s 的频闪段(scdet 在 2.3–4.5s、8–10.5s 几乎每帧触发:字重影 `AF/OF` 交替闪、横向拖影、故障横条),中段和结尾用整格黑帧呼吸;约 13.8s 黑底上出 `ghost.` 手写体 logo 停 1s,之后 2 秒纯黑收尾。人声几乎没有(Whisper 只听到一声 "Bye"),画面靠鼓点走。

它教的方法(拆出来的配方)

1. 一词一卡 + 每词换底:字体、字号、位置全片不变(视觉锚),变化全交给底图 → 既有"同一套系统"的统一感,又每 0.8s 一个新画面。和 T14(孤独摇滚)的"一词一卡"同源,区别是 T14 换的是立绘构图,这条换的是抽象底图。

2. 词序打乱:不按歌词顺序,先给最有记忆点的两个词(BETTER / OFF),再补 GONNA / MY / BE——观众自己拼句子,等于让他重看。

3. 词间频闪 = 转场:不用任何转场特效,两张卡之间塞几帧字重影 / 横向拖影 / 故障条,鼓点落在频闪上。

4. 底图三档亮度轮换:黑(HUD 环、球体)/ 中(蓝铬、云)/ 白(碎片、玻璃)交替,避免连续两张同亮度卡。

5. 纯色空卡(第 2 格整张天蓝无字):当"吸气",比黑帧柔。

6. 品牌收尾 + 黑尾巴:logo 单独一卡 1s,后面留 2s 纯黑——循环播放时这 2s 黑正好变成下一遍的"暗场",不显突兀。

7. 文案 = update_complete 模板(逐字):

┌ update_c o m p l e t e ◢◤
│
├ .mp3 :: ghost. - BETTER OFF
├ status :: released
├ arrival :: now
│
└ some connections are not meant 
  to survive the update.

⟡ transmission unlocked ::

link in main directory

#ukg #edm #electronicdancemusic #rave #ukgarage

树状框线字符 `┌ │ ├ └` + `::` 键值对 + 一句世界观;三条文案(INCOMING SIGNAL / log_file / update_complete)是同一个"系统日志"宇宙的三个阶段:预告 → 泄露 → 发行。

为什么有效

  • 字不动、底动:观众永远知道看哪里,信息零负担,抽象底图只负责情绪。
  • 打乱词序 + 只给 6 个词 = 悬念,发行日当天配 "status :: released" 直接转化。
  • 全程本机可做(字卡 + 底图 + 硬切),是三条里最便宜、最可批量的一条。

映射到我们的线

  • Moon1k Shorts / drop 切片(主用途):Moon1k 歌有英文歌词,一词一卡正好;底图 = T15 引擎四风格母版截帧 + Codex 抽象图 + 免费云图。
  • T14 同族:T14 的立绘版换成抽象底图版 = 这条;两者合并可成"歌词字卡"模板家族(角色版 / 抽象版)。
  • ONE TEN EDM 发歌文案:update_complete 模板套发行日;INCOMING SIGNAL 套预告;log_file 套 remix。
  • SONGGIFT:可做"歌词字卡版"生日歌预告(客户名字 + 3 个关键词),但要换暖色调,不能用这套冷系统感。
  • 不适用:人机日志(叙事)、K-pop PV(要角色,用 `ig-ghost-remix-teaser-anime-open`)。

我们的版本(零积分优先)

1. 选词:从 Moon1k 歌词挑 6–8 个词(含歌名两个词),打乱成"钩子词先出"的顺序。

2. 底图库:T15 `render_reactive.py` 四风格各出 1920×1080 母版截 8 帧(黑/中/白三档亮度各至少 2 张)+ Codex 出 2 张抽象图("chrome shards on white" / "black sphere HUD rings")+ 免费云图 1 张(他自己拍的天空更好)。

3. 字卡:`method-kinetic-typography` HTML→MP4,字体 Audiowide / Michroma(免费圆角科技体),字号固定、居中、白色 + 1px 描边 + 轻 glow;每词 0.8s,一词一底。

4. 词间频闪:ffmpeg 生成 6–12 帧的"字重影层"(同一词偏移 ±30px 两份交替)+ `tblend` 横向拖影 + 随机故障条,硬切拼接;鼓点位置读 `features.json` onset 对齐。

5. 呼吸:中段 1 张纯色空卡(品牌色)+ 结尾 1 格黑;品牌收尾 `Moon1k` 手写/logo 卡 1s + 黑 2s。

6. 三行字规矩照 T15(品牌 / feat / 钩子)放安全区([[feedback_9x16_safe_zone]]),歌名按 Moon1k 线只以"词"的形式混在歌词里出现,不做标题。

7. 文案套 update_complete 模板(发行日)或 INCOMING SIGNAL(预告)。

候补定级(未跑)

  • 预估层:Tier 2(文字本机 100% 准确;动作密度中;无角色一致性风险;短板 = 底图库要持续补,否则第三条起会像第一条)。
  • 复刻验证路径:Moon1k 一首现成歌 → 6 词版 16 秒 → 发他看片 → 定级 → 登记 picker(可与 T14 合成"歌词字卡"家族)。

关联

  • 同族:`dy-bocchi-lyric-typo-edit`(T14 一词一卡立绘版)· `method-kinetic-typography`(字卡引擎)· `ig-scene-bank-strobe-teaser`(底图库来源与频闪剪法)· `ig-ghost-remix-teaser-anime-open`(同作者角色开场版)· `t15-reactive-lines-2k`
  • 不确定项:完整歌词与词序未核(只认出 IF / BETTER / OFF / GONNA / MY / BE);底图是 3D 渲染还是 AI 生成未知;结尾 2 秒黑是否有意为循环设计(推测)。
  • 待办:做一个"歌词字卡"HTML 模板(变量:词表 / 每词底图 / 每词时长 / 频闪帧数),T14 与这条共用。

来源:https://www.instagram.com/reel/DY7jAYnAEN5/ (@ghostsandss "ghost." · 2026-05-29 发布 · 16.4s · 195 赞 23 评 · 单曲《BETTER OFF》UK garage 发行日 teaser)

视频提示词

IG 参考 · ghost.「Secondhand (ghost. remix)」8 秒 remix teaser · 二次元角色冷开场 → 白闪 → 故障字标题卡 → 蓝色抽象库(单色调 + 边缘竖排标签 + log_file 文案)

IG参考候补remix teaser8秒二次元开场单色电蓝白闪故障字标题卡竖排标签log_file文案Moon1kK-pop PV零积分Codex出图2026-09-04

候补(2026-09-04 IG intake,未复刻、未定级,零积分入库)。同作者三连之二(另见 `ig-scene-bank-strobe-teaser`、`ig-ghost-lyric-word-cards-teaser`)。上方 = 作者原片(压缩版 480p),16 帧顺序表 `assets/ig-ghost-remix-teaser-anime-open_contact.jpg`(0.5s 一格)。未登记 picker,等老板点头。

它是什么

8 秒 remix 预告,原生 9:16。结构四段:①冷开场(0–1.5s)一张 2D 动漫少女静帧(白发闭眼、皮肤下透出骨骼的 X 光画法、额头一个发光三角),整张只用电蓝单色,微微抖动不动镜头;②白闪(1.5s)画面过曝成白再落黑;③标题卡(2–4s)黑底上一道细蓝光线 → 云层/炫光底图上故障感圆角科技字 `SECONDHAND` → 蓝色云图上 `GHOST REMIX`,右缘竖排小标签 `EXPLORER`/`EXP`,左缘一列灰色竖排小字;④抽象库(4–8s)铬金属碎片、故障横条、放射线、墨迹拖影、炫光按鼓点频闪(scdet 在 4.8–7.8s 几乎每帧触发),最后一格白铬爆闪收。人声只有一句(Whisper 听成 "Touch it with my life, don't you?",应是原曲歌词,未核)。

它教的方法(拆出来的配方)

1. 角色只出现一次、只在开头、只一张静帧:不做动画,靠"静帧 + 微抖 + 突然白闪"制造紧张;角色不需要动就没有一致性问题。

2. 单色调铁律:全片只有电蓝 + 黑 + 白,角色、字、抽象库全部同一色相 → 8 秒里换十几种画面也不散。

3. 标题卡三件套:故障/圆角科技字体 + 云层或炫光底图 + 边缘竖排小标签(EXPLORER / EXP 这类"系统词")——标签不解释,只制造"这是某个系统界面"的感觉。

4. 顺序 = 人 → 白 → 字 → 抽象:先给脸(停留),再给名字,最后才是节奏;反过来(先节奏后脸)会失去"揭示"感。

5. 文案 = log_file 模板(逐字):

log_file ◢◤

last known file opened:
don toliver - secondhand (ghost.remix).mp3

you went too far.

foreign entity awakened.

containment failed.

breach info → link in main directory

#electronicmusic #bassmusic #futurebass

全角字母开头 + `◢◤` + "last known file opened:" 三行世界观句(每句一行、短、危险感)+ "link in main directory" 代替"链接在主页"。

6. 时长 8 秒 = 一次 H3 10s 生成的长度,也 = IG 完播率最优区。

为什么有效

  • 二次元 X 光少女是账号视觉锚(三条里唯一露"人"的),一张图就完成"这是谁的歌";白闪把静帧变成事件。
  • 单色 + 故障字 = "地下电子 / 赛博"的身份标记,不用讲一句话。
  • 8 秒短、人声一句、没有信息负担,评论区自然问 "what song"(50 评)。

映射到我们的线

  • K-pop PV / 角色线(主用途):Karen / NOVA / MINI 的"新歌预告"正好用这个骨架——官方脸锚点([[feedback_face_anchor_first]])→ Codex 出一张单色 X 光/蓝调静帧(S05 墨圈或新 S 号"蓝骨")→ 白闪 → 标题卡 → T15 抽象库。
  • Moon1k Shorts:remix / feat. 预告;Moon1k 不露脸时开场换成 IA10 2D 版或直接跳到②。
  • ONE TEN EDM 发歌文案:log_file 模板直接套。
  • 不适用:SONGGIFT(个人化)、人机日志(叙事)。

我们的版本(零积分优先)

1. 角色静帧:Codex(GPT Image)用角色身份板作图 1,提示"single-hue electric blue monochrome, skeleton faintly visible through skin like an X-ray, eyes closed, glowing triangle on forehead, flat anime cel shading, black background",只借风格不借人(文字白名单化)。

2. 开场 1.5s:ffmpeg 静帧 + 每 3 帧 ±2px 随机位移抖动 + 1.5s 处 4 帧过曝白(`curves`/`eq=brightness`)→ 2 帧黑。

3. 标题卡:`method-kinetic-typography` 的 HTML→MP4 路径,字体用圆角科技/故障体(免费:Orbitron / Audiowide / Michroma),底图用 T15 `--style stormx` 的一帧或免费云图;右缘 drawtext 旋转 90° 竖排 `EXPLORER`→改成 `ONE TEN` / `PINLA STUDIO`。

4. 抽象库 4 秒:T15 引擎 `--style stormx --seed N` 蓝色调母版按 onset 硬切(配方见 `ig-scene-bank-strobe-teaser`)。

5. 合成:全片 `hue` 锁电蓝(ffmpeg `colorbalance`/`hue=s=0` 后 `colorchannelmixer` 染蓝)保证单色。

6. 若要角色动 1 秒(眨眼/抬眼)再考虑 H3 Max 单图 10s(220cr,需「跑」)——零积分版先出。

候补定级(未跑)

  • 预估层:Tier 2(角色只一张静帧 → 一致性零风险;文字本机出 → 准确率满;短板 = 依赖角色图质量与单色执行)。
  • 复刻验证路径:Karen 版 8 秒 → 发他看片 → 定级 → 登记 picker。

关联

  • 同族:`ig-scene-bank-strobe-teaser`(抽象库剪法与画中画)· `ig-ghost-lyric-word-cards-teaser`(同作者字卡版)· `koda-anime-card-cut` / `character-identity-board`(角色图来源)· `method-kinetic-typography`(标题卡)· `t15-reactive-lines-2k`(抽象库引擎)
  • 不确定项:人声歌词未核;角色图是作者自绘还是 AI 未知;"EXPLORER" 标签含义未知(可能是作者系列名)。
  • 待办:给 Karen 出一张"蓝骨"静帧定 S 号候选;标题卡 HTML 模板做成可复用(歌名 / REMIX 标签 / 竖排标签三个变量)。

来源:https://www.instagram.com/reel/DX7NXPcAy4q/ (@ghostsandss "ghost." · 2026-05-04 发布 · 8s · 1844 赞 50 评 · Don Toliver《Secondhand》ghost. remix 预告 · 人声片段 + bass)

视频提示词

IG 参考 · ghost.「I SEE COLORS」DnB 发歌 teaser · 场景库频闪蒙太奇(16:9 画中画 + 模糊自填 9:16 + 竖排编辑字 + 传输日志文案)

IG参考候补发歌teaserDnB音频驱动场景库频闪抽象视觉16:9画中画模糊自填竖排字传输日志文案Moon1k零积分T15扩展2026-09-04

候补(2026-09-04 IG intake,未复刻、未定级,零积分入库)。老板丢链接无留言 → 按"可复刻的出片模板先进候补"规则入库;未登记进 picker(等他点头再占 T16 位)。上方 = 作者原片(压缩版 480p),25 帧顺序表 `assets/ig-scene-bank-strobe-teaser_contact.jpg`(只裁中间 16:9 画面,1.2s 一格)。

它是什么

一条 DnB 制作人 ghost. 的发歌 teaser(单曲《I SEE COLORS》,2025-08-04 发行):29 秒纯抽象视觉,没有人、没有场景、没有旁白,画面全靠二十多个互不相同的生成式"场景"(液态铬、万花筒、水墨旋涡、线框网、玻璃碎片、镜头炫光、颜料泼溅、粒子爆)按鼓点硬切 + 频闪。构图是 16:9 横版画面居中放进 9:16 竖版,上下用同一画面放大 + 重模糊填满(模糊自填),所以整屏颜色跟着中间画面一起变。文字极少:约 2.4s 时左下角小字 `I SEE COLORS`,右边缘一列旋转 90° 的竖排编辑字(`I SEE / COLORS` 大字 + 两行看不清的小字),像杂志内页。音频:人声钩子循环两遍(0–5s、18–29s;Whisper 听成 "I see the breeze",按歌名应是 "I see the colors")中间是鼓段,10–12s 与 18–24s 是响度峰。

它教的方法(拆出来的配方)

1. 场景库而不是单一视觉:不是一个 visualizer 跑到底,而是准备 20+ 个风格差异极大的 1–2 秒抽象片段(黑白/彩色、稠密/稀疏、2D/3D 混着),每个鼓点换一个,偶尔两个场景交替闪(scdet 阈值 8 在 13–20s 段几乎每 1–3 帧触发一次 = 频闪,不是剪辑)。

2. 黑白→彩色的叙事弧:开场 0–2s 是黑底白线(无色),中段逐步进电蓝/紫/青,偶尔一格红线、一格粉,收尾又回到白底黑点——配合歌名"我看见颜色了",视觉本身就是歌词。

3. 一格黑帧当呼吸(约 6s 处整格纯黑):在最密的地方塞一帧空,鼓点落回来更狠。

4. 画中画 + 模糊自填:主画面 16:9(1080×608,居中 y≈610–1218),四周 = 同帧放大裁切 + 高斯模糊;既避开 IG 上下 UI 区([[feedback_9x16_safe_zone]]),又让整屏色调随画面走,比纯黑上下条"贵"很多。

5. 编辑感文字:歌名不做大标题,只在角落小字 + 右缘竖排一列;只出现一次,2s 后消失,其余时间画面无字。

6. 文案 = 终端传输日志(这是最可直接抄的部分,逐字):

▌▌▌▌▌▌▌▌
I NCOMING SIGNAL FROM…
USER: ghost.
M P 3 NAME: 【I SEE COLORS】
RELEASE DATE: 08.04.25

⧉ a record of when the color returned.
⌲ data: uncorrupted | hope: restored

graphic transmission rendered by high level entity [ @furyxzia ]

#drumandbass #ghost. #iseecolors #edm #dnb #newmusic

用全角英文字母(U S E R)+ 方块字符 ▌ + ⧉ ⌲ 这类符号做"信号传入"的仪式感;固定字段 USER / MP3 NAME / RELEASE DATE + 一句世界观 + 视觉署名。

为什么有效

  • 抽象视觉的最大问题是"看 5 秒就腻",场景库每秒换风格把新鲜感撑到 29 秒;频闪让 DnB 的 170 上下的双倍速鼓点有画面对应。
  • 没有人物 = 零版权、零角色一致性问题、零模型积分,一首歌一条,可无限复制。
  • 模糊自填让竖屏"满",缩略图在 feed 里是一整块颜色,比黑边条抢眼。
  • 文案把"发歌预告"包装成"信号传入",评论区自然会问歌名和发行日(70 评)。

映射到我们的线

  • Moon1k Shorts / drop 切片(主用途):正好是 [[project_moon1k_clips]] 要的"无脸发歌 teaser"格式;T15 已有音频驱动线条引擎,这条教的是 T15 之上的剪法(多场景 + 呼吸黑帧 + 画中画)。
  • T15 扩展:`render_reactive.py` 的 lines / stormx / shatter / ar 四种风格各出一版 = 现成的 4 个"场景",换 `--seed` 再翻倍,按 onset 硬切拼起来就是这条的骨架。
  • ONE TEN EDM 发歌文案:传输日志模板直接套(USER: Moon1k / MP3 NAME: 【…】/ RELEASE DATE),中英都行。
  • 不适用:SONGGIFT(要露脸/个人化)、人机日志(要叙事)、K-pop PV(要角色)。

我们的版本(零积分优先)

1. 场景库:同一段 drop(选歌台切好的 25s)用 T15 引擎跑 4 风格 × 2 seed = 8 条母版(每条 ~7 分钟,本机 Chrome + ffmpeg,不花积分):

for s in lines stormx shatter ar; do for k in 7 21; do
  python3 ~/claude-work/moon1k-clips/reactive/render_reactive.py <drop.mp4> bank_${s}_${k}.mp4 --style $s --seed $k --out-w 1920 --out-h 1080 --no-sparkle
done; done

(`ar` 风格需 `--plate <IMG>`,用 bgpool/ 的动漫底图;先按 16:9 出,画中画留给合成步。)

2. 按鼓点切:读 `features.json` 的 onset 列表,每个强 onset 换一条母版(轮换或随机不重复),弱 onset 段允许两条交替闪 2–3 帧;在最密段前塞 1 格纯黑(呼吸);ffmpeg concat 硬切,不加转场。

3. 画中画合成 9:16:

ffmpeg -i cut_169.mp4 -filter_complex "[0:v]split[a][b];[a]scale=1080:1920:force_original_aspect_ratio=increase,crop=1080:1920,gblur=sigma=40,eq=brightness=-0.05[bg];[b]scale=1080:-2[fg];[bg][fg]overlay=(W-w)/2:(H-h)/2" -c:v libx264 -crf 18 -c:a copy out_916.mp4

4. 文字:三行固定字(`Moon1k` / `(feat. IA10)` / 钩子句)照 T15 规矩放安全区;歌名按 Moon1k 线隐藏(引流靠好奇心)——想试这条的"角落小字歌名"只放最后 2 秒当变体 A/B。右缘竖排字用 drawtext 旋转 90° 一列 `MOON1K / ONE TEN`。

5. 文案:套传输日志模板,全角字母,字段 USER / MP3 NAME / RELEASE DATE / 一句世界观 / 署名 `graphic transmission rendered by IA10`。

6. 发送/上传规矩:频闪内容熵高,Telegram 二压会糊 → 当文件发(T15 教训);发布前加"闪光提示"考虑(频闪对光敏观众有风险,IG 会限流极端频闪,把交替闪控制在 2–3 帧、不超过全片 20%)。

候补定级(未跑)

  • 预估层:Tier 2–3(零积分铺量型,无角色、无文字准确率问题;短板 = 抽象内容第二条起同质化,需要场景库持续加风格)。六项预估:成片完成度 待验 / 动作密度 高 / 文字准确率 满(本机 drawtext)/ 角色一致性 不适用 / 可复用性 高 / 单条成本 0 积分 + ~1 小时机时。
  • 复刻验证路径:选歌台点一段 Moon1k drop → 上面 6 步 → 发他看片 → 他定升降 → 登记 picker(建议占 T16)。

关联

  • 同族:`t15-reactive-lines-2k`(引擎与三行字规矩)· `beatsync-retime`(onset 变速)· `method-h3-mv-recipe`(快慢呼吸感转场,同一思路)· `dy-bocchi-lyric-typo-edit`("密→停→空"的 drop 定格,和这条的呼吸黑帧同源)
  • 不确定项:作者工具未知(看质感像 TouchDesigner / AE + 3D 渲染的多段素材,不是单一引擎);BPM 自相关估到 120,DnB 常见 170 上下,半拍/双拍未核;人声歌词按 Whisper 是 "I see the breeze",未与官方歌词核对。
  • 待办:给 `render_reactive.py` 加 `--style bank`(按 onset 自动轮换风格 + 呼吸黑帧 + 可选画中画输出),做完这条零积分即可自动出。

2026-09-05 老板反馈(v1 原型撤回):`reactive/bank/bank_cut.py` 样片「图与图之间连接不够」,硬切拼贴感强;保留工具,待新参考。要点:切换之间需要承接(同构图、同色、运动延续或形变过渡),不是只对齐鼓点。

来源:https://www.instagram.com/reel/DMYQ4-USBsb/ (@ghostsandss "ghost." · 视觉署名 @furyxzia · 2025-07-21 发布 · 29s · 1.57 万赞 70 评 · 无旁白,人声钩子循环 + Drum & Bass · 文案自称"graphic transmission")

视频提示词

T12 潮牌KV 十三切 · 四色章节参考 · 无武器动效角色 PV(H3 原版 mixed2video 2K 9:16)

H3mixed2video13cutsS06潮牌KV无武器多参考图9:162Kkinetic-typography逐秒写死2026-09-03

老板拍板 2026-09-03:"精确版动效 100 分,做成 T12"(上方成品 = `karen_s06_v1.mp4`,1440×2560 · 10.1s · 一次直出、未剪)。模板编号 T12「潮牌KV 十三切」,点名法:「T12 + 角色图」或「T12 + S06 四张 KV」。

这是什么

一条 10 秒竖版角色宣传 PV:四张 S06「潮牌KV」海报当四个"配色章节"(红黑白 → 黄黑赛博 → 灰白网格+黄黑警示条 → 粉黑漫画贴纸),H3 原版 `mixed2video` 全能参考一次吃四张图,按 13 个逐秒写死的切点把整张海报动起来(超大字压上、贴纸拍上、胶带擦、百叶窗、四格翻页、ID 卡收尾),最后落回红黑白 ID 卡定格。血统:T08 KODA 13 切骨架 + T01 OVERDRIVE 动效语言 + T02 PROTOCOL 冷转场,全部武器/打斗删除,能量只来自 motion design 和角色的自信动作。

什么时候用

  • 角色宣传 PV(新角色亮相、角色档案页配片、频道 trailer)
  • Shorts / Reels / 抖音首条——10 秒、9:16、自带 BGM、开头 0.7s 取景框弹开就是钩子
  • 已经有 S06 系列 KV(或任何"海报感"角色图)想直接出片,不想再拼剪辑
  • 不适合:需要打斗/武器/大幅肢体动画的题材(那是 T08/T09 的活);单张参考图(会退化成 T01/T03 单图法)

四章节参考法(核心)

  • 每一章 = 一张同角色、不同配色世界的 S06 KV(Codex 出图,提示词见 `kpop-pv/karen_frames/prompt_s06_karen_A.txt / _B / _C / _D`;出图时 @[image1] 永远是角色身份板,其余是版式样张)
  • 全部喂进 H3:`--left-add` ×4,提示词里以 `@[image1] @[image2] @[image3] @[image4]` 引用,并逐张声明它是哪一章的配色(红黑白 / 黄黑赛博 / 灰白网格警示 / 粉黑漫画)
  • 章节顺序即时间线顺序:A(0–2.2s)→ B(2.45–4.1s)→ C(4.35–6.0s)→ D(6.25–7.3s)→ 四格翻页(7.3–8.4s)→ 回到 A 做 ID 卡(8.4–10s)
  • 铁律仍是 KODA 那条:字先完整可读,人再压上来;文字只用参数块里的字,"No new text beyond the parameters"
  • 2D 锁写在参考角色段:"Keep the 2D anime rendering of the references throughout; no 3D, no photoreal"

四张 KV(`assets/t12_kv_a/b/c/d.jpg`):A 红黑白 `karen_s06_kv_A.png` · B 黄黑赛博 `karen_s06_kv_B_cyber.png` · C 网格+警示条 `karen_s06_kv_C_soldier.png` · D 粉黑漫画 `karen_s06_kv_D_comic.png`

无武器动作词汇(替代打斗的"能量来源")

  • 回头看镜头(turning back to camera,外套甩开,镜头 whip-pan 跟)
  • 抬下巴(lifting her chin)
  • 甩发(flicking hair)
  • 推护目镜到额头(pushing goggles up)
  • 插兜走向镜头、贴着镜头走出画(walking toward camera, hands in pockets)
  • 往画面上拍一张贴纸(slapping a sticker onto the frame)
  • 比心(finger-heart,配星星/爱心贴纸弹出)
  • 急停定格(a sharp stop,ID 卡用)

提示词里显式写 `NO WEAPONS, NO COMBAT: she never fights, strikes, shoots or wields anything.` —— 少这句 H3 会自己给她配长物件。

参数

  • 模型 Minimax H3 原版(不是 Max:`mixed2video` 全能参考只有原版有)· `modeType=mixed2video` · `ratio=9:16` · `resolution=2K` · `duration=10` · 24fps · H3 自带 BGM/音效
  • 参考图 4 张(`--left-add` ×4)· 220 积分 / 10s 2K
  • LibTV 提示词上限 7000 字符,本版 6023 字,改字时留余量
  • 跑法:`kpop-pv/karen_frames/run_s06_video.sh <name> <prompt_file>`(上传已做好,key 在 `s06_keys.txt`;一次付费提交、不重试——花积分前先问老板)
  • 后期:H3 硬切不要 frame-blend retime;要配自家歌就 `-c:v copy` 直接 mux

逐字提示词(v1 精确版 · 老板 100 分版 · 直接用)

CHARACTER_NAME = "KAREN"
STATUS_TEXT_1 = "ONE TEN"
STATUS_TEXT_2 = "QUANT DESK LEAD"
INTERSTITIAL_TEXT_1 = "PINLA STUDIO"
INTERSTITIAL_TEXT_2 = "カレン"
INTERSTITIAL_TEXT_3 = "ONE TEN"
SUBTITLE = "QUANT DESK LEAD"
PROJECT_TEXT = "PINLA STUDIO"

Create a 10-second premium anime character reveal PV, vertical 9:16, 24fps, with exactly 13 distinct cuts.

REFERENCE ROLE: @[image1] @[image2] @[image3] @[image4] are four graphic-poster key visuals of the SAME character KAREN: golden shoulder-length bob, same face, same proportions. Use them as the sole authority for her identity, the flat 2D anime illustration rendering, and the graphic-design language (oversized display typography, stickers, tape, barcodes, timecodes, HUD corner marks, halftone, hard color blocks). Never redesign the character, never change hair color or face. Keep the 2D anime rendering of the references throughout; no 3D, no photoreal. Each reference is one COLOR CHAPTER: @[image1] red/black/white, @[image2] yellow/black cyber, @[image3] pale grid with yellow/black warning stripes, @[image4] pink/black comic stickers. Do NOT simply animate the character — animate the ENTIRE poster composition: kinetic typography, sliding color panels, sticker slaps, tape wipes, geometric masks, split screens, 2.5D parallax, snap zooms, whip pans, frame-within-frame.

NO WEAPONS, NO COMBAT: she never fights, strikes, shoots or wields anything. Her energy comes from motion-design and confident movement: turning back to camera, lifting her chin, flicking hair, walking out of frame, hands in pockets, pushing goggles up, slapping a sticker onto the frame, a finger-heart, a sharp stop.

Use the text parameters above exactly. Text must be spelled correctly and fully legible before any overlap.

CUT 01 | 0.00-0.70s | EYE
Black. A small white viewfinder frame snaps open in the center revealing an extreme close-up of KAREN's eye (chapter @[image1]); a golden highlight ignites in the pupil, thin targeting circles and UI lines assemble around it, one white impact flash.

CUT 02 | 0.70-1.50s | ACTIVE CARD (red/black/white)
Hard graphic-match into @[image1]'s poster: a red diagonal block sweeps in, oversized black condensed KAREN typography drops from above, she slides in from the right as a cut-out and overlaps the type; two stickers slap on. Typography: STATUS_TEXT_1.

CUT 03 | 1.50-2.20s | SPLIT
Three vertical split panels snapping asynchronously: her eye / her hand flicking hair / a black silhouette on a red band. Barcodes and timecode tick in the gutters.

CUT 04 | 2.20-2.45s | TAPE WIPE
A black tape strip wipes right-to-left across the full frame with halftone trailing; the tape peels away to reveal the next chapter.

CUT 05 | 2.45-3.40s | WORLD (yellow/black cyber)
@[image2]'s world: yellow field bursts open, glitched KAREN letters shudder twice and lock; KAREN in the black/yellow techwear jacket turns back over her shoulder, coat flaring, camera whip-pans to follow. A small duplicate of her flickers in the corner. Typography: INTERSTITIAL_TEXT_1 rises from the bottom.

CUT 06 | 3.40-4.10s | DETAIL
Snap zoom into her eye, then a fast pull-back to full body; QR-like blocks, coordinates and serial numbers refresh rapidly around her.

CUT 07 | 4.10-4.35s | SHUTTER WIPE
Yellow horizontal panels close like blinds and reopen, revealing the grid chapter.

CUT 08 | 4.35-5.30s | INTERSTITIAL 02 (pale grid, warning stripes)
@[image3]'s world: fine coordinate grid draws on, yellow/black warning stripes clamp in from top and bottom; KAREN in the tactical jacket pushes her goggles up onto her forehead, hands in pockets, chin lifted; a crosshair reticle rotates and locks on her shoulder with a flash. Typography: INTERSTITIAL_TEXT_2 slides in vertically on the right.

CUT 09 | 5.30-6.00s | VELOCITY
Handheld micro-shake, she walks toward camera and crosses close to the lens, the grid stretches into speed blur, warning stripes scroll fast.

CUT 10 | 6.00-6.25s | STICKER SLAP
A white sticker slaps the whole frame and is ripped away, revealing the comic chapter.

CUT 11 | 6.25-7.30s | INTERSTITIAL 03 (pink/black comic)
@[image4]'s world: pink field with manga speed lines, outlined KAREN letters bounce in on two rows; KAREN in the black sleeveless top makes a finger-heart, stars and heart stickers pop out; burst speech-bubbles shoot in with the words. Typography: INTERSTITIAL_TEXT_3 and PROJECT_TEXT inside the bubbles.

CUT 12 | 7.30-8.40s | FLIPBOOK
Four-way rapid re-cut: red, yellow, grid, pink chapters flash 0.25s each, every one a different frozen pose of KAREN, typography fragments sweeping across and briefly occluding her, one white impact frame.

CUT 13 | 8.40-10.00s | CHARACTER ID
Settle into a clean final identity card in @[image1]'s red/black/white: KAREN full-body cut-out in a confident stop, looking straight into camera, overlapping enormous condensed typography; every sticker and tag locks into place, the barcode stops, the timecode reads 00:10:00; a slow push-in for the last 0.4s, then freeze with a black frame closing in.
Primary typography: CHARACTER_NAME. Secondary: SUBTITLE. Optional: PROJECT_TEXT.

EDITING: Very aggressive motion-design rhythm. Hard cuts, graphic matches, whip pans, freeze frames, impact flashes, directional smears, foreground wipes, silhouette transitions and short speed ramps. Nothing static longer than 1.2s. Every cut must introduce a clearly different composition or visual mode. Keep flat 2D; depth only through layered parallax and camera. Prioritize graphic-design animation and composition changes over complex body animation. No new text beyond the parameters.

BGM DESIGN: a fast 10-second electronic trailer cue around 140 BPM, restrained tension in the first 0.7s, then punchy percussion and bass with clear hits on every cut, sticker slap and tape wipe; camera-shutter click at the opening, tape-rip and sticker-slap foley on the wipes, glitch crackle in the yellow chapter, a bright pop on the finger-heart, one deep bass drop on the final freeze.

源文件:`kpop-pv/karen_frames/prompt_s06_v1_precise.txt`(6023 字)。

换角色怎么套(保持节拍不动)

1. 只改参数块 8 行:名字 / 两句状态语 / 三句间隙语 / 副标 / 项目名(全部用自家元素:ONE TEN / PINLA STUDIO / 角色名的片假名等)

2. 换 4 张 KV:用 S06 四个配色版提示词(A/B/C/D)给新角色出图,@[image1] 永远喂该角色的官方身份板(先翻 `canon/`,不许现编脸);上传后把 4 个 key 写进 `s06_keys.txt` 格式

3. 正文里的 `KAREN`、"golden shoulder-length bob"、"black/yellow techwear jacket / tactical jacket / black sleeveless top" 这些外观描述换成新角色的,其余逐字保留

4. 13 个时间码、CUT 顺序、EDITING、BGM 段一个字不动——节拍就是这个模板的 DNA

5. 想换气质:拧配色章节(比如 B 换成 S02 潮玩夜)、拧无武器动作词汇,一次只拧 2–3 个旋钮

教训

  • 逐秒写死 vs 自由发挥:同一天同四张图跑了 v2「自由版」(`prompt_s06_v2_free.txt`,中文、只给方向不给时间码)——被老板判"单调",本质是翻海报:四张图轮流平移/缩放,没有切点密度、没有字卡节奏。结论:这套模板的价值全在 13 个时间码 + 每个切点"必须换构图模式",不要省这一步
  • H3 视频节点不接受 `-s autoCompliance=0`(图片节点才有这参数);提示词过审靠内容本身,别在参数上找路
  • 原版 H3 会把 `STATUS_TEXT_1` 这类变量名正确替换成真字(Max 不会,见 T09 教训);所以本版可以继续用参数块写法
  • 8.0s 拖影瑕疵:CUT 12 四格翻页末尾进白闪那一下,KAREN 的脸/发有一帧被字碎片拖成横向 smear,2K 下看得出来。可接受(老板已过),要根治就在 CUT 12 加一句 "keep her face sharp during the flipbook; only the typography fragments smear",或把翻页缩到 0.2s×4 给白闪留 0.3s
  • 提示词 6023/7000 字,加锁定句要精简别的段落

关联

  • 骨架:`koda-anime-card-cut`(T08,13 切 + 字先可读)· 动效语言:`cypher-pv-overdrive`(T01 OVERDRIVE / T02 PROTOCOL,见 `kpop-pv/CYPHER_RECIPE.md`)
  • 风格:S06「潮牌KV」(`/styles`)· 角色:`canon/` Karen 官方版
  • 同族无武器模板:T10(superpower)· T11(亮相 · 仪式感)

补充教训(2026-09-03 MINI 首跑)

  • 参数块会被原样渲染:MINI 那条用同样的参数块写法,H3 原版把 `INTERSTITIAL_TEXT_1`、`SUBTITLE` 当成文字打在画面上(Karen 那条只是侥幸没中)。以后一律用内联词版:不留参数块,正文里每处 Typography 直接写引号里的实际词,并加一句 "render exactly those words, never render placeholder names"。内联版样例:`kpop-pv/mini_frames/prompt_mini_v1_inline.txt`。
  • H3 原版 2K 10s 渲染时间不稳定:Karen 两条约 10 分钟,MINI 一条 15 分钟;脚本轮询上限 20 分钟够用。
视频提示词

T13 LEGEND · MINI 超能力十三切 · 锁脸板 + 四章节 KV · 无武器超能力角色 PV(H3 原版 mixed2video 2K 9:16)

LEGEND五星H3mixed2video13cuts超能力无武器S05多参考图9:162Kkinetic-typography逐秒写死2026-09-03

老板拍板 2026-09-03 01:50:"目前最满意的一张",五星,"最终极的产品 … 一个 Legend" → 模板编号 T13,定级 LEGEND(五星),在 `/templates` 置顶第一格、金边金标。上方成品 = `mini_v1.mp4`(1440×2560 · 10.1s · H3 原版一次直出、未剪、220 积分)。点名法:「T13 + 角色图」或「T13 + 锁脸板」。

定位

  • LEGEND 五星,目前最满意成品。它是 T08/T09(角色动作)+ T10(超能力)+ T12(动效版式)三条线的合流:角色真的在动、有超能力、又保持海报级排版,三样在同一条 10 秒里没打架
  • 用途:角色亮相 PV、频道 trailer、Shorts / Reels / 抖音首条;也是"新角色定档"的默认出片模板
  • 不适合:需要武器/打斗对象的题材(T13 明令无武器);单张参考图(会退化成 T01/T03 单图法)

为什么这张能成(拆开看四层)

  • 动作层(来自 T08/T09):不是站着摆姿势,而是真动作链——开场攥拳特写(0–0.7s 不露脸)→ 天台冲刺 → 翻越栏杆 → 落地 → 急停回头。每个切点都换一个身体状态
  • 超能力层(来自 T10,删掉全部武器):落地冲击波、掌心光流、碎石定空力场、胸口能量球四个"能力镜头"各占一个 CUT,每个都是可辨识的视觉事件,而不是泛泛的"发光"
  • 动效版式层(来自 T12):13 个逐秒写死的切点、胶带擦、百叶窗、贴纸拍、三分屏、四格翻页、ID 卡收尾——把整张海报动起来,不只动人物;"字先完整可读,人再压上来"的 KODA 铁律不变
  • 四张章节 KV(S05 墨圈 editorial):米白纸感底、超大压缩黑体、荧光黄绿点缀、毛笔墨圈身份卡。四张图是同一套版式语言的四个章节(动作卡 / 间隙卡 / 状态卡 / 墨圈 ID 卡),所以 H3 在章节之间切换时观感统一,不像四张随机海报
  • 身份锁得住:@[image1] 永远是官方锁脸板 + 正脸定妆,全部四张 KV 出图时都以它为唯一依据,视频里脸、双麻花辫、墨绿短毛衣从头到尾没漂

参数

  • 模型 Minimax H3 原版(不是 Max:`mixed2video` 全能参考只有原版有)· `modeType=mixed2video` · `ratio=9:16` · `resolution=2K` · `duration=10` · 24fps · H3 自带 BGM/音效
  • 参考图 4 张(`--left-add` ×4,A/B/C/D 章节 KV)· 220 积分 / 10s 2K · 一次付费提交,不重试
  • 提示词:正式版(内联词)5564 字,实跑版(参数块)5768 字;LibTV 上限 7000 字,留余量
  • 跑法:`kpop-pv/mini_frames/run_mini_video.sh <name> <prompt_file>`(4 张 KV 已上传,key 在 `mini_keys.txt`;脚本轮询上限 20 分钟)
  • 后期:H3 硬切不要 frame-blend retime;要配自家歌就 `-c:v copy` 直接 mux

四张章节图(assets/t13_kv_a/b/c/d.jpg)+ Codex 提示词要点

  • 出图统一前缀:参考图1 = `canon/board_mini.png` 官方锁脸板,参考图2 = `canon/mini_face.png` 正脸定妆——脸、银白双麻花辫配黑缎带、墨绿短毛衣、高挑成年比例是唯一依据;参考图3 = 风格样张(T08 Karen 视频截帧,S05 墨圈 editorial 版式),只借版式:米白/灰白编辑式版面、超大压缩黑体、荧光黄绿色块、细技术线、小号 UI 标签、半调网点、毛笔墨圈,不复制其中人物/名字/文字
  • 统一尾缀:2D 动画插画平涂、不要写实光影/3D;画面文字只允许 MINI / ONE TEN / PINLA STUDIO / OPERATOR / SYSTEM ONLINE / ミニ + 装饰性编号/时间码/坐标;不要武器、不要打斗对象、不要水印、不要真实品牌 Logo;2:3 竖幅高分辨率
  • A 动作卡 `mini_kv_A_action.png`:米白纸感底极淡网格,一侧高窄黑色竖版面,超大压缩黑体「MINI」竖排贴版面;MINI 跑酷腾空即将落地(双腿收起、辫子上甩),脚下荧光黄绿光环正在展开(冲击波起点);角落小标签「ONE TEN」「OPERATOR」
  • B 间隙卡 `mini_kv_B_interstitial.png`:中灰版面,超大「PINLA STUDIO」两行占上半部,下方荧光黄绿横带内黑粗体「SYSTEM ONLINE」;MINI 半身侧对镜头望向画外,一手抬到胸前掌心聚光;背景右侧极淡线稿放大的她的眼睛做底纹
  • C 状态卡 `mini_kv_C_status.png`:左侧白底「ONE TEN」上下堆叠占满高度;右侧大块荧光黄绿,MINI 正面站立双臂微张掌心各一点光,几块碎石悬停慢转(力场),细线准星锁在手掌;小标签「ミニ」「OPERATOR」,半调网点做阴影
  • D 墨圈身份卡 `mini_kv_D_id.png`:浅色底、巨大半透明同心圆和技术弧线;中央偏后一个大号黑色毛笔墨圈(一笔旋出),圈内隐约嵌一颗发光球形能量体剪影当她的标志;MINI 全身自信定格,一手插兜,人物压在超大「MINI」上(名字先能完整看清);下方小字「OPERATOR」「ONE TEN」,角落时间码 00:10:00 和条码
  • 源提示词:`kpop-pv/mini_frames/prompt_kv_A/B/C/D.txt`(Codex 出图,四张串跑约 10 分钟)

逐字提示词 · 正式版(内联词 · 下次直接用这个)

关键差别:没有参数块,每处 Typography 直接写引号里的实际词,并加一句 "render exactly those words … Never render placeholder names"。
Create a 10-second premium anime character reveal PV, vertical 9:16, 24fps, with exactly 13 distinct cuts.

REFERENCE ROLE: @[image1] @[image2] @[image3] @[image4] are key visuals of the SAME character MINI: tall adult woman, silver-white twin braids tied with black ribbons, dark-green cropped sweater. Use them as the sole authority for her identity, the flat 2D anime rendering and the graphic-design language. Never redesign the character, never change hair or face. Keep the 2D anime rendering throughout; no 3D, no photoreal. Each reference is one COLOR CHAPTER: @[image1] off-white paper field + black vertical panel + lime-green accents (ACTION card), @[image2] mid-grey field + lime-green band (INTERSTITIAL card), @[image3] lime-green block + white (STATUS card), @[image4] pale field + black ink-brush circle (ID card). Animate the ENTIRE composition, not just the character: kinetic typography, sliding color panels, sticker slaps, tape wipes, geometric masks, split screens, 2.5D parallax, snap zooms, whip pans, frame-within-frame.

NO WEAPONS, NO COMBAT: she carries no blades, guns or projectiles and never fights an opponent. Her power is physical and elemental — running, parkour leaps and landings, sharp turns and stops, and a light-based ability: energy gathers in her open palm and releases as streaks of light, shockwaves ripple from her landings, debris freezes and floats in her field, a spherical energy field blooms from her chest. No enemies, no impacts on people.

Every on-screen word is given EXPLICITLY below in quotes; render exactly those words, spelled correctly, fully legible before any overlap. Never render placeholder names.

CUT 01 | 0.00-0.70s | FIST
Extreme close-up on her hands only: fingers slowly closing into a fist, a thin bracelet catching light, faint luminous seams waking under the skin. Shallow depth of field, slow push-in. Face not shown yet.

CUT 02 | 0.70-1.50s | ACTIVE CARD (chapter A)
Hard graphic-match into @[image1]'s poster composition: oversized condensed MINI typography drops in, color block sweeps, she enters as a cut-out overlapping the type, eyes lifting as light ignites in the pupils; two stickers slap on. Typography: "ONE TEN".

CUT 03 | 1.50-2.20s | SPLIT
Three vertical split panels snapping asynchronously: her eye / her open palm with light gathering / a black silhouette mid-stride on an accent band. Barcodes and timecode tick in the gutters.

CUT 04 | 2.20-2.45s | TAPE WIPE
A black tape strip wipes across the full frame with halftone trailing and peels away.

CUT 05 | 2.45-3.40s | WORLD (chapter B)
Smash cut into @[image2]'s world, a wide cinematic rooftop or empty avenue at night: she sprints toward camera, vaults a railing, lands hard and the ground ripples outward in a circular SHOCKWAVE of light; whip-pan tracking. Typography: "PINLA STUDIO" rises from the bottom.

CUT 06 | 3.40-4.10s | DETAIL
Fast close shot of her ability: an open palm pushed forward releases streaks of light that warp the air like heat haze; luminous seams glow along her arm. Strong foreground streaking.

CUT 07 | 4.10-4.35s | SHUTTER WIPE
Accent-color horizontal panels close like blinds and reopen.

CUT 08 | 4.35-5.30s | INTERSTITIAL 02 (chapter C)
@[image3]'s world: technical grid draws on, accent stripes clamp in; she raises one hand and a wall of flying debris freezes mid-air, pieces slowly rotating inside her field; a crosshair reticle locks on her palm with a flash. Typography: "ミニ" slides in vertically.

CUT 09 | 5.30-6.00s | VELOCITY
She flings the debris away in a burst and dashes past the lens, environment stretching into speed blur, braids whipping.

CUT 10 | 6.00-6.25s | STICKER SLAP
A white sticker slaps the whole frame and is ripped away.

CUT 11 | 6.25-7.30s | INTERSTITIAL 03 (chapter D)
@[image4]'s world: outlined MINI letters bounce in; she skids to a sharp stop, turns back to camera, a small grin, light still fading from her fingertips; stickers pop. Typography: "FULL DRIVE" and "PINLA STUDIO".

CUT 12 | 7.30-8.40s | HERO MOMENT
Her signature moment: she rises a little into the air, arms opening, and a spherical energy field blooms from her chest, pushing light and dust outward; she drops to one knee as it collapses into a single point. One white impact frame, then a four-way rapid re-cut of the four chapters, 0.2s each.

CUT 13 | 8.40-10.00s | CHARACTER ID
Settle into the clean final identity card in @[image1]'s chapter: MINI full-body cut-out in a confident stop, looking into camera, overlapping enormous condensed typography; every sticker and tag locks, the barcode stops, the timecode reads 00:10:00; slow push-in, freeze, black frame closes in. Behind her, a large black circular ink-brush emblem containing a ghosted light-sphere motif.
Primary typography: "MINI". Secondary: "OPERATOR". Optional: "PINLA STUDIO".

EDITING: Very aggressive premium trailer rhythm. Hard cuts, graphic matches, whip pans, freeze frames, impact flashes, directional smears, foreground wipes, silhouette transitions, short speed ramps. Nothing static longer than 1.2s. Every cut introduces a clearly different composition. Flat 2D, depth only via parallax and camera. No new text beyond the parameters.

BGM DESIGN: a fast 10-second character-driven trailer cue around 140 BPM: restrained tension under the fist, a hit on the ignition, punchy percussion and bass through the action, clear hits on every cut, sticker slap and tape wipe, a rising swell into the energy sphere, one deep bass drop on the final freeze; UI ticks, whooshes and light-burst foley.

源文件:`kpop-pv/mini_frames/prompt_mini_v1_inline.txt`(5564 字)。

逐字提示词 · 实跑版(参数块 · 成品就是这版跑出来的 · 仅存档)

两处已知渲染瑕疵:H3 原版把 `INTERSTITIAL_TEXT_1` 当成真字打在了 3.0s 天台镜头的底部黄带上,把 `SUBTITLE` 打在了 8.4s 起 ID 卡的顶部。老板看过,接受成品;但**下次不要再用这版**,用上面的内联词版。缩略图取自 ID 卡的 3:4 裁切(裁掉了顶部那行 SUBTITLE)。
CHARACTER_NAME = "MINI"
STATUS_TEXT_1 = "ONE TEN"
STATUS_TEXT_2 = "SYSTEM ONLINE"
INTERSTITIAL_TEXT_1 = "PINLA STUDIO"
INTERSTITIAL_TEXT_2 = "ミニ"
INTERSTITIAL_TEXT_3 = "FULL DRIVE"
SUBTITLE = "OPERATOR"
PROJECT_TEXT = "PINLA STUDIO"

Create a 10-second premium anime character reveal PV, vertical 9:16, 24fps, with exactly 13 distinct cuts.

REFERENCE ROLE: @[image1] @[image2] @[image3] @[image4] are key visuals of the SAME character MINI: tall adult woman, silver-white twin braids tied with black ribbons, dark-green cropped sweater. Use them as the sole authority for her identity, the flat 2D anime rendering and the graphic-design language. Never redesign the character, never change hair or face. Keep the 2D anime rendering throughout; no 3D, no photoreal. Each reference is one COLOR CHAPTER: @[image1] off-white paper field + black vertical panel + lime-green accents (ACTION card), @[image2] mid-grey field + lime-green band (INTERSTITIAL card), @[image3] lime-green block + white (STATUS card), @[image4] pale field + black ink-brush circle (ID card). Animate the ENTIRE composition, not just the character: kinetic typography, sliding color panels, sticker slaps, tape wipes, geometric masks, split screens, 2.5D parallax, snap zooms, whip pans, frame-within-frame.

NO WEAPONS, NO COMBAT: she carries no blades, guns or projectiles and never fights an opponent. Her power is physical and elemental — running, parkour leaps and landings, sharp turns and stops, and a light-based ability: energy gathers in her open palm and releases as streaks of light, shockwaves ripple from her landings, debris freezes and floats in her field, a spherical energy field blooms from her chest. No enemies, no impacts on people.

Use the text parameters above exactly. Text must be spelled correctly and fully legible before any overlap.

CUT 01 | 0.00-0.70s | FIST
Extreme close-up on her hands only: fingers slowly closing into a fist, a thin bracelet catching light, faint luminous seams waking under the skin. Shallow depth of field, slow push-in. Face not shown yet.

CUT 02 | 0.70-1.50s | ACTIVE CARD (chapter A)
Hard graphic-match into @[image1]'s poster composition: oversized condensed MINI typography drops in, color block sweeps, she enters as a cut-out overlapping the type, eyes lifting as light ignites in the pupils; two stickers slap on. Typography: STATUS_TEXT_1.

CUT 03 | 1.50-2.20s | SPLIT
Three vertical split panels snapping asynchronously: her eye / her open palm with light gathering / a black silhouette mid-stride on an accent band. Barcodes and timecode tick in the gutters.

CUT 04 | 2.20-2.45s | TAPE WIPE
A black tape strip wipes across the full frame with halftone trailing and peels away.

CUT 05 | 2.45-3.40s | WORLD (chapter B)
Smash cut into @[image2]'s world, a wide cinematic rooftop or empty avenue at night: she sprints toward camera, vaults a railing, lands hard and the ground ripples outward in a circular SHOCKWAVE of light; whip-pan tracking. Typography: INTERSTITIAL_TEXT_1 rises from the bottom.

CUT 06 | 3.40-4.10s | DETAIL
Fast close shot of her ability: an open palm pushed forward releases streaks of light that warp the air like heat haze; luminous seams glow along her arm. Strong foreground streaking.

CUT 07 | 4.10-4.35s | SHUTTER WIPE
Accent-color horizontal panels close like blinds and reopen.

CUT 08 | 4.35-5.30s | INTERSTITIAL 02 (chapter C)
@[image3]'s world: technical grid draws on, accent stripes clamp in; she raises one hand and a wall of flying debris freezes mid-air, pieces slowly rotating inside her field; a crosshair reticle locks on her palm with a flash. Typography: INTERSTITIAL_TEXT_2 slides in vertically.

CUT 09 | 5.30-6.00s | VELOCITY
She flings the debris away in a burst and dashes past the lens, environment stretching into speed blur, braids whipping.

CUT 10 | 6.00-6.25s | STICKER SLAP
A white sticker slaps the whole frame and is ripped away.

CUT 11 | 6.25-7.30s | INTERSTITIAL 03 (chapter D)
@[image4]'s world: outlined MINI letters bounce in; she skids to a sharp stop, turns back to camera, a small grin, light still fading from her fingertips; stickers pop. Typography: INTERSTITIAL_TEXT_3 and PROJECT_TEXT.

CUT 12 | 7.30-8.40s | HERO MOMENT
Her signature moment: she rises a little into the air, arms opening, and a spherical energy field blooms from her chest, pushing light and dust outward; she drops to one knee as it collapses into a single point. One white impact frame, then a four-way rapid re-cut of the four chapters, 0.2s each.

CUT 13 | 8.40-10.00s | CHARACTER ID
Settle into the clean final identity card in @[image1]'s chapter: MINI full-body cut-out in a confident stop, looking into camera, overlapping enormous condensed typography; every sticker and tag locks, the barcode stops, the timecode reads 00:10:00; slow push-in, freeze, black frame closes in. Behind her, a large black circular ink-brush emblem containing a ghosted light-sphere motif.
Primary typography: CHARACTER_NAME. Secondary: SUBTITLE. Optional: PROJECT_TEXT.

EDITING: Very aggressive premium trailer rhythm. Hard cuts, graphic matches, whip pans, freeze frames, impact flashes, directional smears, foreground wipes, silhouette transitions, short speed ramps. Nothing static longer than 1.2s. Every cut introduces a clearly different composition. Flat 2D, depth only via parallax and camera. No new text beyond the parameters.

BGM DESIGN: a fast 10-second character-driven trailer cue around 140 BPM: restrained tension under the fist, a hit on the ignition, punchy percussion and bass through the action, clear hits on every cut, sticker slap and tape wipe, a rising swell into the energy sphere, one deep bass drop on the final freeze; UI ticks, whooshes and light-burst foley.

源文件:`kpop-pv/mini_frames/prompt_mini_v1.txt`(5768 字)。

换角色怎么套(节拍不动,只换三样)

1. 锁脸板:先翻 `canon/`,拿该角色的官方身份板 + 正脸定妆当 Codex 参考图1/2(不许现编脸);风格参考图3 继续用 S05 墨圈样张(或直接用本页四张 KV 当版式样张)

2. 四张章节 KV:把 `prompt_kv_A/B/C/D.txt` 里的外观描述("银白色双麻花辫配黑缎带、墨绿色短毛衣")换成新角色的,允许的文字清单换成新角色的名字/片假名/头衔,四张串跑;上传后把 4 个 key 写进 `mini_keys.txt` 格式(A/B/C/D 各一行)

3. 视频提示词(内联词版):换 REFERENCE ROLE 里的名字和外观句;把 9 处引号里的实际词换成新角色的("ONE TEN" / "PINLA STUDIO" / "ミニ" / "FULL DRIVE" / "MINI" / "OPERATOR");四个章节的配色描述按新 KV 改

4. 改动作 / 能力:只在 CUT 01 / 05 / 06 / 08 / 09 / 11 / 12 的动作句和 NO WEAPONS 段里换——比如光流换成风/水/火,冲击波换成落地碎裂、力场换成漂浮花瓣;武器/打斗永远不加,能量只来自身体动作 + 元素特效 + 动效版式

5. 13 个时间码、CUT 顺序、EDITING、BGM 段一个字不动——节拍是这个模板的 DNA;一次只拧 2–3 个旋钮

时长 / 成本 / 渲染时间

  • 成片 10.1s(H3 固定 10s + 尾帧)· 1440×2560 · 24fps · 自带 BGM
  • 成本:视频 220 积分(一次提交);四张 KV 走 Codex 图像额度(Codex 优先,不走付费 API)
  • 渲染:H3 原版 2K 10s 这条用了 15 分钟(01:30 提交 → 01:45 下载;Karen 两条约 10 分钟,波动大),脚本 20 分钟轮询上限够用
  • 出图链:四张 KV 串跑约 10 分钟(00:22 → 00:32)
  • 从锁脸板到成片:约 30 分钟净时间 + 一次老板确认

关联

  • 骨架:`koda-anime-card-cut`(T08,13 切 + 字先可读)· T09 动作变体(攥拳开场、冲刺、跑酷翻越落地都从这两条来)
  • 超能力词汇:T10(superpower)—— 落地冲击波、掌心光流、碎石定空力场、胸口能量球,武器/打斗全部删除
  • 动效版式层:`t12-chaopai-kv-13cut`(T12,四章节参考法 + 逐秒写死 + 内联词教训)
  • 风格:S05 墨圈 editorial(`/styles`)· 角色:`canon/board_mini.png` + `mini_face.png`(MINI 官方版)
  • 同族无武器模板:T11(亮相 · 仪式感)
视频提示词

AI漫剧 · 一键复刻爆款短片 —— "反推提示词"万能指令(面条AI漫剧)

AI漫剧反推提示词复刻爆款视频反推提示词语法镜头语言光影运镜资产图多模态通用指令2026-09-02

未跑(2026-09-02 intake,纯方法卡,零积分):作者原片(上方 = 作者示例,凤凰/龙/仙侠 CG 大片感)讲的不是某个模型的参数,而是一条"把任意爆款视频反推成完整提示词"的通用指令。流程 = 把爆款视频丢给多模态模型 + 这条指令 → 得到结构化提示词 → 按自己需求二改 → 换成自己的资产图(角色/场景)→ 视频模型生成。本质是"爆款 → 模板 → 换皮",作者把它包装成"一键复刻/一键提取爆款短片模板"。指令本身就是这张卡,本地直接用。

作者原指令(口播逐字 · 转录;画面只出现要素关键字,没有整段文字屏,标点/分行是我们整理的)

请根据这段视频内容,反推完整的视频提示词,要求必须涵盖以下要素:
人物、物品、场景 —— 详细地描述核心对象的特征;
精准动作说明 —— 动态表现;
场景环境氛围、时间设定;
光影 —— 光线类型、强度、方向;
运镜手法 —— 推、拉、摇、移、俯拍、仰拍等镜头语言;
包含视觉风格、色调、画质、分辨率、帧率、特效参数。

画面字卡顺序(= 要素清单,可做 checklist):`反推出视频提示词 → 人物 / 物品 / 场景 → 精准动作说明 → 场景环境氛围 → 时间设定 · 光影光线类型 · 强度方向 → 运镜手法(推拉摇移俯拍仰拍) → 视觉风格色调画质 → 特效参数 → 光影质感`。

指令拆解(为什么这条能"一秒反推")

| 要素槽 | 反推出来的是什么 | 换皮时动不动 |

|---|---|---|

| 核心对象(人物/物品/场景) | 主体外观、材质、服装、道具 | 动 —— 换成自己的 IP / 资产图 |

| 精准动作 + 动态表现 | 动词序列、发力、形变、速度曲线 | 基本不动(这是爆款的"节奏 DNA") |

| 环境氛围 + 时间设定 | 天气/时段/情绪基调 | 可微调 |

| 光影(类型/强度/方向) | 逆光/轮廓光/体积光、硬软、来向 | 不动(决定"质感") |

| 运镜(推拉摇移/俯仰) | 每个镜头的机位与运动 | 不动(决定"电影感") |

| 风格/色调/画质/分辨率/帧率/特效 | 渲染引擎味、LUT、4K/24fps、粒子/光效 | 不动或按目标模型改 |

真正的方法论:把一个视频拆成"主体层"和"表现层",只换主体层,表现层原样继承 —— 和我们 KODA 卡的"保留 DNA、换角色只改参数块"是同一件事。

我们的落地版(喂给 Gemini / GPT-4o / Claude 视频理解,中英双语)

你是视频提示词反推师。请根据这段视频内容,反推出一条可直接喂给视频生成模型的完整提示词,必须涵盖:
1. 核心对象(人物/物品/场景):逐个描述外观、材质、服装、道具、比例
2. 精准动作说明:按时间顺序写动词序列,含力度、形变反馈、速度变化(慢起/骤快/急停)
3. 场景环境氛围 + 时间设定(时段、天气、季节、情绪)
4. 光影:光线类型(自然/人工/逆光/轮廓光/体积光)、强度、方向、色温
5. 运镜:每个镜头的机位、景别、运动(推/拉/摇/移/跟/环绕/俯拍/仰拍),以及切点时间
6. 视觉风格、色调/LUT、画质、分辨率、帧率、特效参数(粒子/光效/景深/动态模糊)
输出格式:先给一张"镜头表"(时间码|镜头|动作|光影|运镜),再给一段可直接使用的最终提示词(中英各一版)。
把主体层(角色/物品)单独标出,方便我替换为自己的资产。
You are a video-to-prompt reverse engineer. From this video, reconstruct a complete, directly usable generation prompt covering: (1) core subjects — characters/objects/scene, each with appearance, materials, wardrobe, props, proportions; (2) precise action description — ordered verb sequence with force, deformation feedback and speed changes (slow build / sudden burst / hard stop); (3) environment mood + time setting; (4) lighting — type, intensity, direction, color temperature; (5) camera — per-shot framing and movement (push/pull/pan/track/orbit/high-angle/low-angle) with cut timecodes; (6) visual style, color grade/LUT, quality, resolution, frame rate, VFX parameters. Output a shot table first, then the final prompt (EN + ZH). Mark the subject layer separately so I can swap in my own asset.

步骤(作者流程 → 我们的流程)

1. 拿爆款:`douyin_watch.sh <链接>` 下载原片(已有工具,同时出转录)。

2. 反推:把 mp4 + 上面的指令丢给多模态模型(Gemini 2.5 直接吃视频;GPT/Claude 用 contact sheet + 关键帧)。得到镜头表 + 最终提示词。

3. 二次优化:按自己的要求改主体层;表现层(动作/光影/运镜/风格)尽量逐字保留。动作段可叠 `action-video-feel-force-deform-tempo` 的力度×形变×变速。

4. 换资产图:上传自己的角色/场景图作为 `@[image1]`(身份权威 + "Never redesign"),主体描述与图一致。

5. 生成:H3 / Seedance / Higgsfield 任一(需老板点头才花积分)。

6. 校验:与原片并排看 —— 节奏点、光向、运镜是否复刻到位;不到位回到第 3 步补"表现层"细节。

什么时候用

  • 刷到一条"想要这个感觉"的爆款,但说不清它好在哪 —— 用这条指令让模型替你写出它的镜头表,这本身就是最好的分析笔记。
  • 给 IA10 / Karen / NOVA 换皮复刻某条仙侠/动漫 PV:反推 → 换资产图 → 跑。
  • 批量:intake 一批 Douyin 链接 → 反推提示词入库 → 变成模板池(每条爆款 = 一个模板候选)。
  • 不适合:需要逐字提示词的场景(KODA 那种作者公开提示词的,直接用原版更准);反推是"近似重建",和原作者的真实提示词会有差距。

关联

  • 同族:`koda-anime-card-cut`(同一"保 DNA 换参数"思路,作者给了逐字提示词)· `action-video-feel-force-deform-tempo`(反推出的动作段再补力度/形变/变速)· `yantong-lighting-grammar`(光影要素怎么写具象)· `render-engine-keywords`(风格/画质槽的词库)· `character-identity-board`(换皮用的资产图)
  • 待办:挑一条已入库的爆款(如 KODA 原片 `assets/koda_ref.mp4`)跑一次反推,把反推结果和作者逐字版对比,量一下"反推法"的还原度 —— 零积分,只用多模态模型。

来源:https://v.douyin.com/aBkT5EisUNs/ (面条AI漫剧 · "ai漫剧-一键复刻爆款短片 使用这套提示词,一键提取爆款短片模板" #aigc #AI教学 #ai渲染 #干货分享 · 60s)

视频提示词

Cypher PV — 多镜头 OVERDRIVE 快切

H3Max多镜头卡点motion-graphicsKV2026-09-02

一条完整 Cypher PV = 一段 ~10秒 H3 Max 视频(不是拼接、不是普通图生视频)。两个要素:① 密集KV(Codex)② 密集timecoded MOTION DIRECTOR提示词 → H3 Max 自己顺着时间线快切出多镜头。旧H3不能切镜头,必须 H3 Max。完整锁定版见 `~/claude-work/kpop-pv/CYPHER_RECIPE.md`。

参数

  • 模型 Minimax H3 Max · modeType=singleImage2video · resolution=768P(shorts)· duration=10 · ~140积分
  • KV 必须"塞满"(对标 posters/poster_a.png):巨型glitch大字 + ERROR/SIGNAL标 + 警告三角 + 角落眼部UI ins + 条码/数据条 + 散布glyph + halftone眼 + 斜切panel + HUD
  • 视频保持H3硬切别frame-blend retime(会糊);drop用 -c:v copy 直接mux

提示词 (OVERDRIVE版·逐字·换typography词与palette即可)

REFERENCE ROLE: Use this image as the character identity, palette and graphic-design reference — preserve the character, the ONE TEN typography, the electric-blue/cyan/black/white palette and all graphic elements throughout. Transform this static poster into a high-energy Japanese anime music PV with professional 2D motion graphics and aggressive editorial animation. Do NOT simply animate the character — animate the ENTIRE graphic composition. MOTION LANGUAGE: fast rhythmic motion-design editing, kinetic typography, geometric wipes, hard graphic cuts, split screens, masked transitions, extreme close-up inserts, rapid reframing, snap zooms, whip pans, 2D parallax, foreground graphic occlusion, rotating vector shapes, sliding panels, diagonal wipes, frame-within-frame. Every shot introduces a new composition, ~0.5-1.2s each, nothing static longer than 1.5s. TIMELINE: 0.0-0.7s extreme close-up on her eye, targeting circles assemble; 0.7-1.4s graphic wipe to medium shot, typography shoots up, panels slide; 1.4-2.1s smash cut to three split panels snapping; 2.1-2.8s push-in, circular targeting graphic expands as transition; 2.8-3.6s character far right, huge cropped typography left, manga detail windows flicker; 3.6-4.5s hard cut to silhouette then flash, triangles + vector lines explode; 4.5-5.5s rapid extreme close-ups (eye/hand/accessory) each in a geometric mask; 5.5-7.0s pull back to full composition, 2.5D parallax; 7.0-8.5s typography breaks into fragments sweeping across; 8.5-10s final hero, reaches toward camera, impact frame then freeze. GRAPHIC STYLE: manga halftone, technical UI graphics, crosshairs, thin grids, diagonal geometry, controlled visual overload. Flat 2D, depth via parallax. NO 3D, no long cinematic shots, no complex body animation. Prioritize graphic-design animation over character acting. No new text beyond the design.
视频提示词

KODA 风 · H3 动漫角色卡卡点(眼睛点燃→字卡→胶带擦→墨圈角色卡)

H3Max卡点动漫角色卡焰瞳kinetic-typography13cuts逐字提示词2026-09-02

已复刻 2026-09-02(上方成品 = 我们的 Karen 版 v1):原版 H3 · `modeType=mixed2video`(全能参考,Max 没有)· 2K · 16:9 · duration=15 一次直出(不用两段拼)· 24fps · H3 自带 BGM;输入 = Karen 的 A 版身份设定板 + 逐字提示词(只填 8 个文字参数)。切点几乎全压在 13 个时间码上。瑕疵:TARGET LOCK 卡上行字糊、末卡名字被人物压掉一字母、画风从 2D 偏 CG —— 待 v2 加两句锁定("keep the 2D anime rendering of the reference" + "the name must be fully legible before any overlap")。跑法:`kpop-pv/koda_karen/run_koda.sh <board.png> <name> "Minimax H3" mixed2video 2K 15 16:9`(参考视频见 `assets/koda_ref.mp4`)。

参考视频(作者原片):15 秒、单次 MiniMax H3 生成的动漫角色卡卡点 PV,8 秒内 20+ 个硬切 —— 和我们锁定的 Cypher OVERDRIVE 方法完全同族(密集 KV + 逐时间码 MOTION DIRECTOR → H3 自己切镜头),但镜头词汇是新的,值得吸收。原作者的逐字提示词老板已从群置顶转来,见下方 —— 直接可用。

镜头语法(按 scdet 切点反推,15s)

| 时间 | 镜头 | 学到的点 |

|---|---|---|

| 0.0–2.2 | 超近景眼睛长镜:白发少女、指节抵脸、垂眼→抬眼,瞳孔从琥珀色点燃成青色发光(=我们的焰瞳语法当"pre-drop") | 开头留 2 秒静,给 drop 蓄力;眼睛变色 = 最便宜的"能量觉醒"信号 |

| 2.2–3.5 | 硬切 状态字卡:角色半身立在圆形 HUD 前,压巨型黑体 `STATUS: ENGAGE`,眼睛青光 | 文字直接作为镜头,不是叠字幕 |

| 3.5–4.2 | 黄色警示胶带斜擦 + 角色黑剪影 + 局部字 `ENGAGE` | 高饱和单色块做转场(黄/黑),比 glitch 更"海报" |

| 4.2–4.8 | 白色光痕 whiteout 闪帧(1–2 帧全白) | 每个重拍前塞一个闪帧 = 卡点的"响" |

| 4.8–5.7 | 动作剪影 + 墨点飞溅:奔跑/挥刀,夜景低机位 | 动作只用剪影,避免 H3 画手崩 |

| 5.7–6.6 | 纵向拖影/竖条 smear 转场(黑白) | 用运动模糊条纹做"whip" |

| 6.6–8.0 | 白底角色卡:角色全身居中悬浮 + 毛笔墨圈(黑圈)+ 巨型压缩黑体 `HERO SUMMER` + 小号间隙标签 `INTERSTITIAL_ / 坐标 / 编号` | 白底角色卡是 KODA 味的核心:留白 + 墨圈 + 海报级排版 |

| 8.0–11.1 | 同角色卡的黑墨圈变体 `CHARACTER SUMMER`,圈以笔触方式旋出 | 同构镜头做 A/B 变体制造节奏 |

| 11.1–15.0 | 快切回眼睛/剪影/字卡的碎片,密度递增收尾 | 结尾把前面素材打碎重复 = 记忆点 |

参数(照 Cypher 卡)

  • LibTV H3 提示词上限 7000 字符(超了任务直接失败,积分 2 小时内自动返还)。原版提示词已 6778 字,加锁定句必须精简到 <7000。
  • Minimax H3 Max · singleImage2video · 16:9(原作横屏)· duration 10(原作两段 or 15s 版)· ~140 积分/10s
  • KV:白底角色卡设计稿(Codex):全身角色居中 + 墨圈 + 巨型压缩黑体 + 间隙小标签 + 角落 HUD;比 NEON PULSE 更"留白",密度靠排版而不是 glitch
  • 后期:H3 硬切不要做 frame-blend retime;drop 用 `-c:v copy` 直接 mux

原版提示词(逐字 · 老板 2026-09-02 从作者群置顶转来 · 直接用)

先填参数(照抄这几行,改方括号内容):

CHARACTER_NAME = "[CHARACTER NAME]"
STATUS_TEXT_1 = "[ACTIVE]"
STATUS_TEXT_2 = "[MODE: ENGAGE]"
INTERSTITIAL_TEXT_1 = "[SYSTEM LINK]"
INTERSTITIAL_TEXT_2 = "[TARGET LOCK]"
INTERSTITIAL_TEXT_3 = "[FULL DRIVE]"
SUBTITLE = "[CHARACTER TITLE / CODENAME]"
PROJECT_TEXT = "[OPTIONAL PROJECT NAME]"

正文(逐字):

Create a 15-second premium cinematic character reveal trailer with exactly 13 distinct cuts, 24fps.

>

Use @[image1] as the sole authority for the character's identity, proportions, outfit, materials, colors and visual style. Never redesign the character. Adapt the environment, abilities, VFX and movement naturally to them.

>

The overall presentation should feel like a premium AAA action-game character introduction. Motion-design sections use a bold editorial language: oversized condensed typography, clean white or pale-grey fields, huge circular color blocks, thin technical diagrams, concentric rings, halftone textures, tiny interface markings, scan lines, geometric accents, sweeping brush or energy strokes and strong foreground/background parallax. The main palette shifts between black and white, icy cyan, electric blue, neon yellow and warm golden amber. In text-based graphic screens, the typography must appear clearly and be fully readable first, then the character, a cropped close-up or a silhouette may slide in front of it, overlap it or stand beside it. In some graphic-card backgrounds, also use cropped character close-ups or enlarged facial details as integrated design elements.

>

Use the text parameters above exactly.

>

CUT 01 | 0.00-1.10s | FACE
Extreme cinematic close-up. Calm focused expression, part of the face naturally obscured by hair, hand, mask or accessory. Shallow depth of field and subtle push-in.

>

CUT 02 | 1.10-2.20s | ACTIVATION
A signature effect ignites around the character's eyes, hands, body or equipment: glowing rings, symbols, particles, energy filaments, holographic nodes or character-specific effects. The gaze lifts as the effect rapidly peaks.

>

CUT 03 | 2.20-3.20s | ACTIVE CARD
Hard graphic-match into a bright editorial freeze-frame. Large vivid circular field behind the character, oversized black condensed typography, thin technical circles, tiny UI text, halftone detail and sharp diagonal graphic streaks. Show the typography clearly first, then let the character overlap it or enter beside it. A cropped facial close-up or upper-body close-up may be integrated into the background design.

>

Typography:
STATUS_TEXT_1

>

CUT 04 | 3.20-4.10s | ENGAGE CARD
Snap to a high-contrast black character silhouette over a bold horizontal accent-color typography band. The text should read clearly before the silhouette crosses in front of it or locks beside it. A large luminous brushstroke or energy ribbon sweeps diagonally across the foreground with strong motion blur.

>

Typography:
STATUS_TEXT_2

>

CUT 05 | 4.10-5.20s | WORLD
Smash cut into a cinematic environment suited to the character. Wide dramatic perspective as they immediately dash, leap, land or burst forward. Fast whip-pan or reactive tracking camera.

>

CUT 06 | 5.20-6.20s | DETAIL
Fast close or medium shot of one defining ability, weapon motion, gesture, transformation or acrobatic action. Sharp character, strong foreground streaking.

>

CUT 07 | 6.20-6.90s | INTERSTITIAL 01
Hard cut to a text-led graphic design screen. Huge condensed typography, layered circles, technical lines, scan lines, halftone textures, tiny data text and aggressive graphic wipes. The typography must be fully readable first, then bring in the character as a smaller integrated figure, cropped close-up or silhouette.

>

Typography:
INTERSTITIAL_TEXT_1

>

CUT 08 | 6.90-7.90s | IMPACT
Return to action from a new aggressive angle. Attack, dodge, ability release or interaction with a simple secondary threat. Low angle, side track, whip-pan or short orbit.

>

CUT 09 | 7.90-8.60s | INTERSTITIAL 02
Another editorial text card, cleaner and punchier, built from bold typography, diagonal slashes, accent-color bars, fine UI markings and strong parallax. Let the typography dominate first, then place the character beside it or pass a cropped close-up in front for depth.

>

Typography:
INTERSTITIAL_TEXT_2

>

CUT 10 | 8.60-9.60s | VELOCITY
New perspective continues the momentum. Character rushes toward camera, crosses close to lens, launches upward or rapidly changes direction while the environment stretches into controlled speed blur.

>

CUT 11 | 9.60-10.30s | INTERSTITIAL 03
Final text-based graphic card before the hero beat. Bold oversized typography, sweeping energy stroke, geometric overlays, concentric diagrams and a fast silhouette or cropped character insert. Ensure the text is legible before the character layer overlaps or frames it.

>

Typography:
INTERSTITIAL_TEXT_3

>

CUT 12 | 10.30-12.30s | HERO MOMENT
The character performs their most iconic movement, ability, strike, landing or confident stop. Briefly stabilize at the visual peak, then collapse the shot into a bright smear, silhouette frame or graphic-match transition.

>

CUT 13 | 12.30-15.00s | CHARACTER ID
Premium final identity card. Clean pale background with enormous translucent concentric circles, fine technical arcs, network nodes, subtle halftone texture, tiny graphic markings and restrained chromatic glints. Place the character in a dynamic full-body hero pose overlapping huge condensed typography. The name should register clearly before the character overlap becomes dominant. A large cropped close-up can also be subtly embedded into the background composition.

>

Behind them, add a large black circular ink-brush or emblem shape containing a ghosted visual motif associated with the character: creature silhouette, symbol, power form, weapon motif or abstract representation of their identity.

>

Primary typography:
CHARACTER_NAME

>

Secondary:
SUBTITLE

>

Optional:
PROJECT_TEXT

>

Allow the character to overlap the typography for depth.

>

EDITING:
Very aggressive premium game-trailer rhythm. Hard cuts, graphic matches, whip pans, freeze frames, impact flashes, directional smears, foreground wipes, silhouette transitions and short speed ramps. Every cut must introduce a clearly different composition or visual mode. The text-based interstitial cards should break up the action rhythm and keep the sequence from feeling like uninterrupted combat footage. No slow dissolves or long continuous choreography.

>

BGM DESIGN:
Create a fast, character-driven AAA game-trailer score tightly synced to the edit. Adapt genre and instrumentation to the character, building from restrained tension into punchy percussion, bass and rising intensity, with clear hits for cuts, typography, transitions and action beats. Peak at the hero moment and finish with a strong final reveal stinger. Integrate subtle UI ticks, whooshes, energy swells and sub impacts into the music.

要点:① 单图 `@[image1]` 就是全部身份依据(不用密集 KV,字卡由提示词自己排)② 13 个切点逐时间码 ③ 文字先可读、角色再压上来 ④ 自带 BGM 设计段(H3 生音乐+音效,卡点由模型自己对齐)⑤ 15 秒 24fps。

(我按帧反推的重建版已作废,以上为准。)

KODA 的 DNA(可变形骨架 · 老板 2026-09-02:"摆脱原版的样子,保留原版的 DNA,一点一点变")

写法拆开就是一个模板,任何角色/任何风格都能套:

1. 参数块:8 个文字参数(NAME / 2 个状态语 / 3 个间隙语 / SUBTITLE / PROJECT),正文里只引用变量名 → 换角色只改这 8 行

2. 身份权威:`@[image1]` 唯一依据 + "Never redesign" +(我们加)2D 渲染锁一句

3. 视觉圣经(一段):排版语言(字体气质/几何母题/纹理/UI 小字/视差)+ 调色板(原版:黑白+冰青+电蓝+霓虹黄+琥珀)+ 铁律"字先可读、人再压上"

4. 13 个切点 × 固定节拍(15s/24fps):FACE→ACTIVATION→ACTIVE CARD→ENGAGE CARD→WORLD→DETAIL→INTERSTITIAL 01→IMPACT→INTERSTITIAL 02→VELOCITY→INTERSTITIAL 03→HERO MOMENT→CHARACTER ID。规律 = 动作段和字卡段交替,每 2-3 个动作插一张字卡,ID 卡收尾

5. EDITING 段:硬切/图形匹配/甩镜/定格/闪帧/拖影/剪影转场/短变速,"每个切点必须换构图模式"

6. BGM 段:跟剪辑同步的曲风描述 + 命中点 + hero 峰值 + 结尾 stinger + UI 音效

生成器:`kpop-pv/koda_gen/koda_variant_gen.py --seed N --knobs 3 --dur 10` → `out/variant_N.txt` + 旋钮记录 JSON + `variants.log`(查重,绝不重复);不变层逐字固定,变量层从选过的池子抽(配色/形状/排版方向/开场/点燃效果/笔触方向/字卡位置/ID 容器/ID 背景),真字直接写进字卡。它只出提示词,不提交任务。

变形旋钮(按幅度从小到大):① 调色板换主色 ② 几何母题(圆→矩形/竖条/斜切)③ 排版方向(横→竖)④ 开场镜头(脸→手/背影/道具)⑤ ID 卡的容器(墨圈→墨板/门/框)⑥ 切点节拍与顺序 ⑦ 动作段的世界观。每次只拧 2-3 个旋钮,其余逐字保留 = 保 DNA。

变体 A1 已跑(2026-09-02 · H3 Max · 768P · 10s · 单图 adaptive · 新 ONE TEN Karen 板)— `assets/koda_karen_A1.mp4`

验证通过:2D 锁在 Max 上有效(全片赛璐珞);一眼不是 v1 模子(手先握拳开场、绿点燃、绿+钢蓝、高矩形竖排字、竖向墨板 ID 卡);身份=ONE TEN Karen。教训:H3 Max 把变量名当字印(STATUS TEXT / INTERSTITIAL / CHARACTER),原版 H3 会替换、Max 不会 → 每个字卡处直接写真字(生成器已改)。Max 单图模式 ratio 只能 adaptive。下载带 LibTV 角标,正式用走会员去水印。

变体 A1(设计稿)— `kpop-pv/koda_karen/prompt_koda_variant_A1.txt`(<7000 字,含 2D 锁,未跑,等老板点头再跑)

拧了 5 个小旋钮:主色 霓虹黄/琥珀 → 霓虹绿 + 钢蓝(ONE TEN 官方白绿的亲戚);几何 巨圆 → 高矩形/竖条/淡网格;排版 横排 → 竖排;开场 脸 → 手先握拳再抬到脸;ID 卡 墨圈 → 竖向墨板 + "名字先完整可读再压"。13 个切点、节拍、字先可读、EDITING、BGM 逐字未动。文字参数换成 ONLINE / MODE: OVERCLOCK / SIGNAL FOUND / RANGE LOCK / LIMIT BREAK。

T11「亮相」概念(2026-09-02,NOVA 公主裙首跑成功)

生成器 `--concept ballroom`:五个动作段换成仪式感(宫殿大厅裙摆扫弧 / 指尖划吊灯 / 急转裙摆开圆+纸屑定格 / 镜面长廊奔跑 / 台阶聚光灯落定),字卡 `ARRIVING / MODE: ENCORE / GRAND ENTRANCE / FIRST LIGHT / CORONATION`,其余 KODA 骨架不变。参考图用过审版公主裙单图(露肩高开衩多视图板会被 LibTV 上传审核拒;或先注册合规素材库)。 单图模式 adaptive 跟参考图比例:2:3 → 竖版。成片 `koda_karen/koda_nova_t11b.mp4`。同族:T10 = `--concept superpower`(无武器)。

关联

  • 同族:`cypher-pv-overdrive`(方法主卡)· `yantong-lighting-grammar`(眼睛点燃)· `h3max-multishot`
  • 待办:用我们的 IP(喂一张角色图 + 填 8 个文字参数)复刻一条 → 进模板库当 T08「角色卡卡点 · KODA」

来源:https://v.douyin.com/mF1kDxhc0cg/ (李澹归 · "minimax h3 KODA 的提示词,真不错啊,放群置顶了自取" #minimax #ai动漫 #卡点)

视频提示词

H3 角色动漫PV(御姐/甜妹/咒术回战二创)

H3角色PV二创minimaxCypher相关2026-08

minimax H3 实测直出角色动漫PV:同一方法做性格相反的角色(御姐 vs 甜妹)各一条;也有人用H3做咒术回战二创效果惊艳。印证我们 Cypher 那套(H3密KV+动效提示词一段直出)。

要点

  • 一张角色/风格KV → H3 → 直出动漫PV,不同性格靠提示词的气质词切换(御姐=冷艳强势 / 甜妹=软萌明亮)
  • 二创:拿已知IP风格(咒术回战)喂H3,注意版权只自用/学习别商用
  • 直接走我们 CYPHER_RECIPE.md 那套,这些是同源印证

来源:https://v.douyin.com/NTa6XXlgq48 https://v.douyin.com/wJj-po3OCzE

视频提示词

Seedance 广告片流水线(已验证)

Seedance广告GPT-Image带货2026-08

验证过的带货/广告出片:GPT Image 出hero图 + CJK文字 → Seedance 动起来。Seedance 2.5 全能参考、音画同步、最长30s、mixed2video多图。适合产品广告、teaser。

要点

  • 真产品图/hero → Codex场景合成 → Seedance animate
  • Seedance 会顺着"逗号列出的分镜"自动切(同H3 T15原理)
  • 成本高于H3,owner说非必要用H3;广告/音画同步场景才上Seedance

来源:project_seedance_ad_pipeline

音乐与混音 3

8 种曲风的鼓组一格看懂 · 16 步鼓机网格(BPM / swing / 五轨)
音乐与混音

8 种曲风的鼓组一格看懂 · 16 步鼓机网格(BPM / swing / 五轨)

鼓组节奏型16 步BPMswingBoom bapTrapUK drillJersey clubUK garageAfrobeatsAmapianoReggaeton编曲2026-10-08

用法:写歌/做 Suno 风格提示词/Logic 打鼓时直接照这张表。一小节 16 格(每格 = 16 分音符),`x` = 打。图案从原视频逐帧识别后按多帧投票取出;Perc 行原视频多为空。

| 曲风 | BPM | swing | 一句话 |

|---|---|---|---|

| Boom bap | 90 | 56% | 采样器里的摇摆鼓 |

| Trap | 140 | — | 808 轰鸣上叠 hi-hat 连滚 |

| UK drill | 142 | — | 滑音 808,军鼓晚落 |

| Jersey club | 140 | — | 五连底鼓的弹跳 |

| UK garage | 132 | 60% | 跳跃的 2-step,摇到 60% |

| Afrobeats | 104 | 54% | 边击领节奏,底鼓留空 |

| Amapiano | 112 | 57% | 软底鼓,log drum 主导 |

| Reggaeton | 95 | — | dembow:boom, ch-boom, chick |

              1    2    3    4
Boom bap  Kick  x... ...x ..x. ....
          Snare .... x... .... x...
          Hats  x.x. x.x. x.x. x.x.
          Bass  x... ...x ..x. ....

Trap      Kick  x... ...x ..x. ....
          Snare .... .... x... ....      (半速军鼓落在第 3 拍)
          Hats  xxxx xxxx xxxx xxxx      (连滚,可加 1/32 滚奏)
          Bass  x... ...x ..x. ....      (808 跟底鼓)

UK drill  Kick  x... ..x. ..x. ....
          Snare .... .... x... x...      (晚落)
          Hats  x..x ..x. x..x .xx.
          Bass  x... ..x. ..x. ....      (滑音 808)

Jersey    Kick  x... x... x..x ..x.      (五连底鼓)
club      Snare .... x... .... x...
          Hats  x.x. x.x. x.x. x.x.
          Bass  x... x... x..x ..x.

UK garage Kick  x... .... ..x. ....      (2-step)
          Snare .... x... .... x...
          Hats  .x.x .x.x .x.x .x.x      (反拍)
          Perc  ..x. ..x. ..x. ..x.
          Bass  x..x ..x. ..x. ..x.

Afrobeats Kick  x... ..x. .... x...
          Snare ...x .... ..x. ....      (rim 边击)
          Hats  xxxx xxxx xxxx xxxx
          Perc  x..x ..x. x..x ..x.      (3-3-2 感)
          Bass  x... ..x. ..x. x...

Amapiano  Kick  x... x... x... x...      (四踩,轻)
          Snare .... x... .... x...
          Hats  xxxx xxxx xxxx xxxx
          Perc  .... x..x ..x. x...
          Bass  ..x. .x.x ..x. ..x.      (log drum)

Reggaeton Kick  x... x... x... x...
          Snare ...x ..x. ...x ..x.      (dembow)
          Hats  x.x. x.x. x.x. x.x.
          Bass  x... .... x... ....

我们怎么用

  • Suno 风格提示词:写 BPM + swing + 一句话特征(如「Afrobeats, 104 BPM, rim-led groove, kick leaves space, swing 54%」)比只写曲风名稳。
  • Logic MCP 打鼓:按上表直接写 MIDI;写前照规矩逐音校验。
  • ONE TEN EDM 换口味:future bass 之外想试的 UK garage / Jersey club / Amapiano 都能从这里起步。

来源:https://www.instagram.com/reel/DeHbh8Siw2p/ (The Producers Classroom · "8 genres. 1 grid. Which one is yours?")

Seed Audio 1.0(字节 Seed)— 一句话出「人声+配乐+音效」整段音频
音乐与混音

Seed Audio 1.0(字节 Seed)— 一句话出「人声+配乐+音效」整段音频

笔记2026-09-20

来源:抖音 @Xuan酱 2026-09-20 https://v.douyin.com/UsfY-Z6NH6k/ (417 万赞,10 分钟教程)· 全文转写 seed_audio_1_transcript.txt

入口

豆包 App → 工作模式 → 工作任务 → 模型选「豆包 2.1 Turbo」→ 技能里选「Seed Audio 1.0」。

能力(四种输入)

1. 文生音:一句话出完整声音片段,人声/配乐/音效一次出、时间线自动对齐(示例:《口技》失火高潮;白素贞 vs 法海金山寺对峙——多角色声线区分、法海自带混响、木门遮挡的闷感、远处钟声、江水撞法阵低频、BGM 从低沉弦乐切到急促弦乐+中国大鼓)。

2. 图生音:丢分镜图/连环画,它自己读顺序和场景配声(机甲厂房分镜:男驾驶员/女工程师声线、通风声、警报、金属脚步、充能蜗鸣、金属对撞全卡在画面时间点)。

3. 视频配音:给视频+台词 → 按口型和动作卡点配音(武侠片段)。

4. 视频翻译配音:丢中文短剧 → 自动翻译成韩语并生成配音、卡回原时间轨(出海/跨境)。

提示词公式(作者总结)

按时间顺序组织:发生什么动作 → 紧接着写配什么声音;细节写清:角色声线与情绪、声音远近距离、背景音乐起伏变化。抽卡一次即可得层次丰富的成片级配音。

对我们的用处

  • 《人机日志》/短剧线:对白+环境音+BGM 一次出,省掉 TTS+音效+对齐三步(注意 IA10 声线是我们自己的,Seed Audio 出的是它的声线;可只取音效/氛围层)。
  • 出海:TTAN/SKYC/Tenz 的中文短片 → 韩/日配音翻译,一步到位。
  • 有声绘本/有声漫画:白月光 MV 分镜图直接图生音。
  • 关联:project_acting_tts(有表演幅度的 TTS 正是它做到的方向)、T-015 录音棚线。

限制:只在豆包客户端内(无 API 口径未知);商用授权待查。

Cinematic FX 术语速查(来源:IG @큐버지 作曲家/音乐监督 reel,2026-09-08 他转发;评论可领 PDF+音源)
音乐与混音

Cinematic FX 术语速查(来源:IG @큐버지 作曲家/音乐监督 reel,2026-09-08 他转发;评论可领 PDF+音源)

笔记2026-09-08

| 术语 | 声音 | 用在哪 | 我们库里的对应 |

|---|---|---|---|

| Riser | 上升、紧张升高(Riser_Low / Strings / Strings Trem 分层) | drop 前 2–8 小节 | Splice: Grinding Bass House risers、KSHMR Sweeps Up |

| Whoosh | 快速掠过、「咻」(Whoosh Up / Down) | 转场、镜头切换、单个音效点 | 待补 |

| Impact / Hit | 砸下去的重击 | 段落第一拍、drop 落点 | KSHMR Impacts、DS_VSH2 impact |

| Downfilter | 下落、滤波往下扫 | 段落结束、能量下坠 | KSHMR Sweeps Down(待核) |

| Upfilter | 滤波往上开 | buildup | 同 sweep up |

| Sub Drop | 低频「嘟呜呜」下潜 | drop 第一拍与 impact 叠 | 需找 sub drop one-shot |

| BRAAAM | 铜管式巨响(Inception 声) | 预告片、史诗 drop | 待补 |

| Drone | 低而长的持续紧张音 | 铺底、buildup 前 | Alchemy Drone FX(自带)|

| Reverse | 倒放的声音、幻觉感 | 进入段落前的吸气(reverse crash / reverse vocal) | Afro House Reverse_Crash_FX、reverse crash |

| Transition | 泛指段落间的过渡音效组合 | riser+whoosh+impact 的组合 | 组合使用 |

用法:drop 标准组合 = Riser(8 小节)+ Sweep Up(最后 2 小节)+ Reverse(最后 1 拍吸气)→ Impact + Sub Drop(第一拍)→ Whoosh Down(第一拍后半)。

Serum/采样搜索关键词:riser, whoosh, impact, hit, downfilter, upfilter, sub drop, braam, drone, reverse。

剪辑与工作流 12

代码宣传片的一种版式:玻璃面板 + 渐变光球 + 一问一答的大字(来源:抖音 @Xuan子 2026-09-30,Opus 5.5 做的 30 秒看板宣传片;他 2026-10-06 转发:「我们下面几条广告可以做成这个样子」)
剪辑与工作流

代码宣传片的一种版式:玻璃面板 + 渐变光球 + 一问一答的大字(来源:抖音 @Xuan子 2026-09-30,Opus 5.5 做的 30 秒看板宣传片;他 2026-10-06 转发:「我们下面几条广告可以做成这个样子」)

代码宣传片玻璃面板渐变动效RemotionHyperFrames广告片版式2026-09-30

关键词:代码宣传片, 玻璃面板, 渐变, 动效, Remotion, HyperFrames, 广告片版式

结构(30 秒,按拍)

| 拍 | 秒 | 画面 | 文案形式 |

|---|---|---|---|

| 提问 | 0–4 | 深紫渐变背景,一个发光的粒子球在右侧慢转;左侧大字 | 一句问句:「如果创作流程,一句命令就能打开?」 |

| 命令 | 4–7 | 一个输入框浮现,打字,回车 | 命令本身就是文案 |

| 展开 | 7–12 | 几块半透明的玻璃面板从中间浮出、错位叠放,每块是产品的一个功能 | 面板里是真实界面的内容 |

| 收束 | 12–15 | 面板滑到一侧,大字 | 一句断言:「一个看板,全接住。」 |

| 功能逐个 | 15–24 | 每个功能一块面板放大,配一句大字;中间有一个数字滚动的计数卡 | 「贴个链接,AI 拆成选题」「数据不用抄」 |

| 真机 | 24–28 | 真实的电脑界面截屏,带光球叠在上面 | 「全在你自己的……」 |

| 落款 | 28–30 | 头像 + 产品名 + 一句副标题 | 关注入口 |

画面语言

  • 背景:深紫到洋红再到金的大渐变,流动,角落有暖光。
  • 玻璃面板:半透明深色、细白边、模糊背景、圆角,叠放时有层次。
  • 发光粒子球:全片的视觉锚点,位置变、大小变,面板出现时它退后。
  • 大字:粗黑体,一拍一句,最多两行,关键词换成金色或洋红。
  • 动效:浮现、切换、放大三种,节奏跟音乐的拍。
  • 全片用代码做,不用视频模型,所以每一帧的文字都是清楚的。

适合我们哪些片

  • SONGGIFT 操作总览(现在那支 overview_30s 可以按这个版式重做)。
  • 工作室那条线的「AI 录音助教」讲解(片三的替代版)。
  • 一页一片里偏功能的页面(项目大楼、文天台)。
  • 交结果的 AI 工作室的成果包宣传。

用法

  • 先做成一个可复用的模板:背景、光球、面板、大字、计数卡五个零件,换文案和截图就能出新片。
  • 面板里只放我们自己真实的界面,不画假功能。
  • 文案口径照旧客观,不写「最」「首家」。

素材

  • 关键帧 8 张:`playbook/intake/dy_glass_board_promo/kf_*.jpg`。
Codex + Remotion 官方 Skill 出「带转场动效」的产品宣传视频(抖音 @Ai大模型小橘子 2026-09-21,737 万赞)
剪辑与工作流

Codex + Remotion 官方 Skill 出「带转场动效」的产品宣传视频(抖音 @Ai大模型小橘子 2026-09-21,737 万赞)

笔记2026-09-21

来源 https://v.douyin.com/mJKej_MowpE/ · 43 秒口播 · 转写 codex_remotion_transitions_transcript.txt

要点:Remotion(React 写视频)官方开源了 agent Skill;Codex 装上后按逻辑生成代码视频——画面走位、字幕出场时机、转场、节奏全部可精确描述;不满意指段修改;示例:2015–2025 SpaceX 每次发射做成抛物线轨迹动画。不用 AE/剪辑软件。

我们已有:playbook/reference_video_shotcraft(Remotion 产品宣传导演 skill,152 镜头配方卡)+ 动态字幕 HTML→MP4 流水线 + Amazon 带货视频 Remotion 轨。这条视频等于给这套方法背书。

可用处(零积分):文天台 v3 宣传 15 秒(录屏 + 数据字幕 + 转场)、Lay Out 歌词动效 Shorts、SONGGIFT 促销片、人机日志片头。装法:Remotion Skill 仓库(github.com/remotion-dev/skills 一类,装到 Codex/Claude Code skills 目录)——装前按新工具协议先扫官方仓。

口播智能剪辑 + 深度动捕两条工作流(来源:抖音 玩AI的小杨哥 2026-09-17,他当天转发)
剪辑与工作流

口播智能剪辑 + 深度动捕两条工作流(来源:抖音 玩AI的小杨哥 2026-09-17,他当天转发)

灰度视频黑白视频深度图 depth map人物迁移角色迁移动作迁移Depth-Anything他 2026-09-22 说的「把原视频做成灰度视频有利于人物迁移」= 这一条2026-09-17

A · 口播智能剪辑(画布节点)

录多少遍都整包丢进去:画布加「智能剪辑」节点 → 选口播视频 → 上传素材 → 写剪辑要求 + 目标时长 → 先粗剪(去口水词、停顿、重复)→ 对话框确认 → 再加动态花字、画中画、音效。

对我们的意义:人机日志/过程视频的口播段可以整包录、机器粗剪;LibTV 画布若有同类节点,先查 `libtv node create -t` 支持的类型再试。

B · 开源深度动捕(motion transfer 减少原画风干扰)

关键词:灰度视频 / 黑白视频 / 深度图 depth map / 人物迁移 / 角色迁移 / 动作迁移 / Depth-Anything / 他 2026-09-22 说的「把原视频做成灰度视频有利于人物迁移」= 这一条

上传参考视频 → 逐帧提取深度视频(只留动作和运镜,丢掉原画风)→ 深度视频连接新角色图 + 新视频节点 → 生成时只参考动作和运镜。

对我们的意义:STORM II 方阵换人正卡在「原片的人脸盖过朋友的脸」——把 driver 视频先转成深度图序列再喂 Seedance 2.5,能压掉原片人像。可先用 Depth-Anything(本地免费)把 `driver_walk_8s.mp4` 转深度视频试一次,零积分。

2026-09-25 社区调研(哪个模型迁移效果最好):开源标准 Wan 2.2 Animate / Wan-Animate-2(深度视频驱动优于骨骼点;需 N 卡);商业最强 可灵 Motion Control 2.6/3.0(全身/手/表情);Seedance 2.0/2.5 参考视频第三。我们的路:LibTV「Kling3.0 动作迁移」节点 + 深度视频,Seedance 2.5 对照。参考:B 站 BV1v6qfBDEEq(Wan2.2 vs 可灵2.6 实测)、aivid.video Kling vs Wan Animate 2、r/comfyui Wan 2.2 Animate depth tracking 帖。

2026-09-25 实测(7 跑):Seedance 2.5 样片被合规检测挡(原片/灰度都挡,疑似网页默认「自动校验素材」;命令行 `--set autoCompliance=0` 待验);可灵 3.0 动作迁移只支持单人,人群失败;Wan 3.0 三跑全成:灰度片 + 角色图,5s/3s 480P,关掉「智能扩写」最贴灰度片 → 当前唯一可用通路。

(复核 16:02:可灵 schema「仅支持单人」;Seedance 命令行 autoCompliance=0 仍失败 → Wan 3.0 定为唯一通路。)

剪辑与工作流

抖音参考 · 小枝ya《动动嘴就能剪完一条视频,Codex 自动剪辑实测》· Codex + HyperFrames Skill:口播 + 录屏两个输入 → 一句话"按口播拆镜头配素材加字幕动效跑一版" → 返修循环 → 把剪辑规则沉淀成 Skill

抖音参考候补CodexHyperFrames自动剪辑auto-edit口播talking-head录屏screen-proof拆镜头字幕动效Skillskills-add返修循环revision-loop语音剪辑edit_by_voiceTelegramdialogue-videodaily-process挑战100零积分2026-09-05

候补(2026-09-05 抖音 intake,零积分入库,未拉取运行、未定级)。老板丢链接无留言 → 入库。这是一条工作流卡:作者把 HeyGen 的 HyperFrames(HTML→MP4,我们 5 月就装过)作为 Skill 装进 Codex,然后只丢两个文件(口播 mp4 + 操作录屏 mp4)+ 一句口头指令,让 Codex 出"第一版",不满意再口头返修,最后把字幕/排版/动效规则写成一个自用 Skill,下一条视频直接复用。上方 = 20 帧顺序表 `assets/dy_codex_edit_contact.jpg`(2.7s 一格);原片存 `intake/dy_codex_edit/video.mp4`。未登记 picker(不是出片模板)。注意:这条视频本身就是 HyperFrames 渲染的(画面角标 ` 真实已渲染 HyperFrames 版本`),真正的 Codex 录屏只有"安装"那一步,"剪辑中"的四行网格是信息图,不是 Codex 界面。

它是什么(带时间戳)

  • 0.0–3s:真人口播(灰幕、白椅、领夹麦),"有了 Codex 现在真的可以动动嘴就把视频剪完了"。
  • 3–5s:右下角标 `真实 HyperFrames 项目`,HyperFrames Studio 预览 + 底部时间线(3 条轨:Grid / 口播缩略图轨 / Result/Motion 轨),画面上两张输入卡:`口播 — 你负责说清楚要剪什么`(波形图标)、`素材 — 录屏、图片、证据一起丢进去`;右上 ` 第一版正在生成`。
  • 6–8s:分屏卡 `03 / READY TO USE 直接拿去用 — 不是概念,是一套能落地的剪辑流程。说清楚 → 自动剪 → 出第一版`。
  • 8–11s:真实 Codex 录屏,角标 `第 1 步 · 在 Codex 里安装 HyperFrames`。Codex 界面为中文("已运行 41s"、"加载了工具运行了命令"、"正在运行 y"),底部叠字 `OFFICIAL INSTALL COMMAND`:
npx skills add heygen-com/hyperframes --full-depth

终端回显:`Codex Agent detected — installing non-interactively` / `Source: https://…` / `Cloning repository…`(×4)。Codex 自述(逐字):"我会按 skill-installer 的安装与核验流程执行官网命令,并保存一份去除隐私信息的本地回执。安装后我会逐项检查目录、Skill 清单、核心元数据和一个不渲染正式视频的最小检查。" "基线已确认:独立项目目录内没有现存 SKILL.md。现在执行用户指定的官网命令;如果 CLI 出现目标范围选择会仅选择 Codex,并保持不登录、不上传。"

  • 12–14s:卡 `把口播和录屏放进项目 — 两个输入,自动合成一条可改的时间线`:`口播视频.mp4 TALKING HEAD` + `操作录屏.mp4 SCREEN PROOF` → 底部 `2 FILES READY · START EDITING`。口播:"先给 Codex 装上 HyperFrames,把口播和要用的素材一起丢进去。"
  • 15–19s:整屏信息图 `CODEX IS EDITING · 按照口播,拆镜头、配画面`,四行轨道(逐字):

- `口播 VOICE`:开场钩子 · 安装步骤 · 第一版结果

- `素材 B-ROLL`:真实录屏 · 素材画面 · 结果展示

- `动效 MOTION`:重点字幕 · 步骤强调 · 结果动效

- `输出 PREVIEW`:第一版生成中

右上状态 `正在配素材` → `正在跑第一版`。口播(= 她给 Codex 的指令,见下)。

  • 20–23s:`真实 HyperFrames 时间线 · LIVE PROJECT · 正在拆文案排画面`,同一 Studio 预览,播放头在跑。口播:"可以看到他已经自己开始拆文案排画面了。"
  • 24–26s:`AFTER · REAL RENDER · 素材、排版、动效,第一版直接出来`:左 `原片 只有人物口播` → 右 `FIRST PASS · 已生成 第一版 录屏 字幕 动效 还能继续改`,脚注 `CODEX + HYPERFRAMES 录屏、重点动效都配好了`,三枚勋章 `真实口播原片 / Codex 自动剪辑 / 首版已经生成`。
  • 27–29s:第二段 Codex 录屏(`真实 Codex 录屏`):顶栏 "在独立项目目录中演示一次 HyperFrames 官方安装演示。目标是使用官网命令 npx skills add heygen-com/hyperframes --full-depth 为 Codex 安装 / ③ 看到真实安装输出";`耗时 22秒` / `READY_TO_RECORD`;用户消息带角标 `由 ChatGPT 从另一项任务发送`(逐字):"现在开始正式安装并保留清晰回执。请在这个独立项目中执行官网命令:npx skills add heygen-com/hyperframes --full-depth 。安装后会核验:1) 实际安装到…(显示更多)";`已处理 1分钟 2秒`。
  • 30–34s:`REVISION LOOP · 哪里不满意,就改哪里`,三行:`素材`(旧素材·聊天画面 → 保留真实成品展示)· `节奏`(原节奏 0.8s)· `结果`(重新预览 → 结果更新 );脚注 "剪辑流程演示:替换素材、调整时长、重新查看结果。";右上状态 `等待返修指令` → `素材不对:替换素材`。
  • 36–40s:`STYLE SYSTEM · 把这套风格,整理成一个 Skill`,米色卡 `CODEX EDITING RULES 剪辑规则`:`字幕规范 CAPTIONS` / `排版规范 LAYOUT`(第三行动效规范被口播盖住)。
  • 42–46s:`NEXT VIDEO · 下一条视频,直接丢进去`:`下一条视频.mp4 NEW INPUT · READY` → 分屏 `口播输入 · SAME RULES · NEW VIDEO 照这一套继续剪` → `Codex + HyperFrames · 第一版 · 视频剪完 · 素材、排版、动效都配好了 `。
  • 47–49s:`MY WORKFLOW · 我不动,Codex 来剪 — 能不自己动手,我是真的不想动了。`
  • 50–54s:CTA `评论区留下两个字 → 剪辑`。

口播全文(Whisper,"CrowDance"= Codex,"HAPPER FRAMES"= HyperFrames):"有了 Codex 现在真的可以动动嘴就把视频剪完了。平时要剪口播做自媒体的,这套真的可以直接拿去用。先给 Codex 装上 HyperFrames,把口播和要用的素材一起丢进去,然后告诉他:按照口播拆镜头,把对应素材配好,字幕动效也一起做,先给我跑一版。可以看到他已经自己开始拆文案排画面了。原本就是一段纯口播,跑完以后素材字幕动效基本都加进来了,第一版就直接出来了。有哪里不满意的地方也很简单,继续告诉 Codex 让他改就行:素材不对就换素材,节奏不对就重新调。等这套风格跑熟以后,我再把常用的字幕、排版、动效这些规则整理成一段 Skill,这样下一条视频丢进去他就可以直接按照这一版剪。反正我现在的视频基本都先让 Codex 剪,能不自己动手我是真的不想动了。我把这套流程也整理好了,想要的话评论区留个『剪辑』我发你。"

工具链(视频里能核实的)

  • Codex 界面:ChatGPT 桌面端里的 Codex 任务视图(中文 UI、"已运行/已处理/加载了工具运行了命令"、消息角标"由 ChatGPT 从另一项任务发送" = 她先在 ChatGPT 里聊,再把任务转给 Codex 执行)。不是 CLI 直敲,也不是 IDE 插件。我们本机同一家的东西是 `/Applications/ChatGPT.app/Contents/Resources/codex`(CLI 二进制)。
  • 剪辑引擎:HyperFrames(HeyGen 开源,HTML 就是时间线,`data-*` 属性定时序 + GSAP 动画 → ffmpeg 出 MP4;自带 `transcribe`(Whisper 逐词)和 `tts`(Kokoro);Studio 有可视化时间线预览)。不是 CapCut / Premiere / Remotion。
  • 安装方式:`npx skills add heygen-com/hyperframes --full-depth`(Vercel 的 `skills` CLI,从 skills.sh 目录装 Skill;检测到 Codex 就装到 Codex 的 skills 目录,非交互)。我们 5 月是用 `npx hyperframes skills` 装的,12 个 Skill 在 `~/sites/.agents/skills/`(hyperframes / hyperframes-cli / hyperframes-registry / website-to-hyperframes / remotion-to-hyperframes / gsap / tailwind / three / lottie / animejs / css-animations / waapi),项目锁 `hyperframes@0.6.28`(`~/projects/foodbrand/tools/video/`)。同一套东西已在本机。
  • 输入:2 个文件——`口播视频.mp4`(TALKING HEAD)+ `操作录屏.mp4`(SCREEN PROOF)。素材卡还写了"录屏、图片、证据一起丢进去"。
  • 输出:一条可继续改的 HyperFrames 项目(HTML 时间线)+ 渲染的第一版 mp4:口播为主轨,按口播内容切段,段上叠录屏/素材画面 + 重点字幕 + 步骤强调 + 结果动效。
  • 耗时:只给了安装阶段数字(Codex 计时 `已运行 41s` / `耗时 22秒` / `已处理 1分钟 2秒`);剪辑本身耗时未展示。
  • 失败点:视频零展示(宣传向)。按我们 5 月实测 HyperFrames 的坑照旧适用:重叠 clip 必须各自 `data-track-index`;`.clip` 别写 `opacity:0`;中文字体不在确定性字体集,要 `@font-face` 自带 CJK;每次改完 `npm run check`(lint + validate + inspect),Intel iMac 上 22s 片渲染约 1 分钟。

配方(提示词逐字)

1. 装 Skill(Codex 里,逐字):

npx skills add heygen-com/hyperframes --full-depth

她给 Codex 的安装指令(逐字,截断处为画面"显示更多"):

现在开始正式安装并保留清晰回执。请在这个独立项目中执行官网命令:npx skills add heygen-com/hyperframes --full-depth 。安装后会核验:1) 实际安装到…

2. 把 `口播视频.mp4` + `操作录屏.mp4`(及图片/证据)放进项目目录(HyperFrames `init` 会拷媒体并自动 Whisper 转写口播)。

3. 一句剪辑指令(口播原话,逐字):

按照口播拆镜头,把对应素材配好,字幕动效也一起做,先给我跑一版。

4. 返修循环(口播原话):

素材不对就换素材,节奏不对就重新调。

画面示例:旧素材·聊天画面 → 换成 保留真实成品展示;节奏 0.8s → 调整时长;重新预览 → 结果更新。

5. 沉淀:跑熟后让 Codex 把 `字幕规范 / 排版规范 / 动效规范` 写成一段自用 Skill(`CODEX EDITING RULES 剪辑规则`),下一条视频丢进去直接按此剪。

和我们现有自动剪辑栈的对比

  • 已经有的(且更深):

- 语音→Telegram→Claude 的口头指令通道(`voice-stt` Groq Whisper + `reply` 回图回片),这正是她"动动嘴"的前半段;她还要打字/在 ChatGPT 转任务。

- 逐词级口播剪辑:`dialogue-video/word_edit.py`(按词索引 drop、压停顿、变速、重映射字幕时间轴)+ `filler_cut.py`(口头禅自动剔除)——她的方案切的是"段",我们切到"字"。

- 口播 + 底图 + 字幕 + BGM 一键成片:`dialogue-video/build_dialogue.py`(候选 schema、J-cut、安全区 assert、sidechain BGM、锁定音色链);`daily-process/daily_process.py`(当天日志 → IA10 主持 → 竖屏成片 → 私密上传);`moon1k-clips/reactive/render_reactive.py`(音频反应画面 + 场景库硬切);`method-kinetic-typography`(`__seek(t)` 确定性 HTML→MP4,= HyperFrames 的同类自研)。

- HyperFrames 本体 + 12 个 Skill 已装(`~/sites/.agents/skills/`),5 月做过 Jiang Nan 样片,Amazon 带货线是 Remotion/HyperFrames 双轨。

  • 真正新的 / 值得学的:

1. "两个输入 + 一句话 = 第一版"的产品化封装:口播(说清楚要剪什么)+ 录屏(证据)是唯一输入;Agent 负责"按口播拆镜头"= 用转写文本做分段,再把素材按语义配到段上。我们的 builder 都要手填 `CANDIDATES["X"]`(cuts/caps/ia10 行),没有"从转写自动出时间线"这一步。

2. 转写驱动的自动 B-roll 配位:口播说到"安装步骤"就压上"真实录屏",说到"结果"就压"结果展示"——按口播语义把素材对位,这是我们 `cewrite-storyboard`(无脸插入镜头)之后缺的"自动落位"环节。

3. 口头返修循环作用在时间线对象上(换素材 / 调时长 / 重预览),而不是重跑整条脚本;HyperFrames 的 HTML 就是可 diff 的时间线,Agent 改 `data-start/data-duration/src` 即可。

4. 把风格沉淀成 Skill(字幕/排版/动效规范)——和我们 playbook "EXECUTE from recipe" 一个思想,但她的落点是 Agent 可直接执行的 SKILL.md,而不是给人读的卡。

5. `npx skills add <owner/repo>` 这条统一装 Skill 的通道值得记:任何 GitHub 上带 SKILL.md 的仓库都能一条命令进 Codex/Claude Code(`feedback_new_tool_onboarding_protocol`)。

  • 她没有、我们有的:逐词剪、口头禅清理、锁定音色链、BGM sidechain、9:16 安全区断言、自动上传、Telegram 回片。她的成片是 16:9 横版。

我们的版本(零积分):`edit_by_voice` Skill——他的 Telegram 语音 → 现成脚本

1. 载体:`~/claude-work/edit-by-voice/`:`SKILL.md`(路由式:state / ops / render / reply 四段)+ `ops.py`(指令→操作)+ `state.json`(当前项目的时间线对象)。不引入新渲染器:口播对话片走 `build_dialogue.py`,过程片走 `daily_process.py`,音乐片走 `render_reactive.py`;"口播 + 录屏"型(挑战 100 / Jarvis 工作流内容线)新增一个 HyperFrames 组合模板(用本机已装的 hyperframes@0.6.28 + `~/sites/.agents/skills/hyperframes`)。

2. 时间线对象(`state.json`,每条片一份,改它不改脚本):

{"project":"DV_G","engine":"dialogue","src":{"owner":"candidates/owner_G_clean.m4a","words":"candidates/owner_G_words.json","screen":["shots/rec_01.mp4"]},
 "segments":[{"id":1,"t":[0.0,8.4],"text":"开场钩子…","broll":null,"caps":true},
             {"id":2,"t":[8.4,21.0],"text":"安装步骤…","broll":"shots/rec_01.mp4","caps":true}],
 "bgm":{"file":"~/claude-work/ia10-docu/bgm_ia10_theme_t1.mp3","vol":0.16},"tempo":1.2,"plate":"scene_09_console_noman.jpg","version":3}

段落由 `words.json` 自动切(停顿 >0.6s 或句末标点),再按转写文本给每段配一个"语义标签"(钩子/步骤/结果/收尾),素材按标签落位(她的"按口播拆镜头")。

3. 指令映射(他一句语音,`voice-stt` 转文本,先走规则表,规则不中再让模型抽 `{op,args}`;每次只改 state,然后重渲染):

- 「把第二段剪掉」→ `cut seg=2` → dialogue: 该段词索引全部进 `--drop`,`word_edit.py` 重跑并重映射字幕;daily: 删 item。

- 「第三段太啰嗦,砍一半」→ `trim seg=3 ratio=0.5` → 按词表保留前半句到句读。

- 「加字幕 / 去字幕」→ `caps on|off`(builder 的 caps 行来自 words.json,零成本)。

- 「换 BGM」「BGM 小一点」→ `bgm file=<最近他发的音频> | vol-=0.05` → `--bgm --bgm-vol`。

- 「第二段压上录屏」「这里放那张图」→ `broll seg=2 file=<最近他发的文件>` → dialogue 的 `--owner-clips` 位或 HyperFrames 轨 2。

- 「快一点 / 慢一点」→ `tempo ±0.1`(`word_edit.py --tempo`);「换底图」→ `plate <最近图片>`。

- 「跑一版 / 再来一版」→ `render` → 出 mp4 + `_contact.jpg` + `_script.txt` → `reply` 回 Telegram(≤20M,超了放桌面)。

- 「就这版」→ `lock` → 写进 playbook 候选并停止迭代。

"最近他发的文件"= Telegram 收件箱里时间最近的同类附件,避免他念文件名。

4. 回执:每次返修回一张 6 帧 contact + 一行改了什么("v4:删第 2 段 3.1s,BGM -0.05"),不发长文(`feedback_no_status_text_reaches_telegram`)。

5. 沉淀:他说「就这版」时,把 state 里的字幕/排版/BGM 参数写回 `DIALOGUE_PIPELINE.md` / 对应卡的 recipe 段 = 她的"剪辑规则 Skill"。

6. 成本:全部本机 ffmpeg / puppeteer / 现成脚本;Groq STT 免费档;零 LibTV/Seedance 积分。

候补定级(未跑)

  • 类型:工作流卡,不进 picker;对应产物是 `edit-by-voice` Skill + 一个 HyperFrames "口播 + 录屏"组合模板。
  • 预估价值:对「Claude Code 挑战 100 个项目」和「Jarvis 语音工作流内容线」(都是口播 + 录屏)是直接可用的生产线;对人机日志/每日过程视频是"口头返修"层的补齐。约半天:state 对象 + 8 条指令映射 + 接 `build_dialogue.py`;HyperFrames 组合模板另半天。
  • 验证路径:拿 F 版(`out/DV_F_console_v4.mp4`)的候选当 state,用他一条语音「把第二段剪掉,BGM 小一点,跑一版」走通 → 回 contact → 再决定要不要接 HyperFrames 轨。

关联

  • 同族:`method-kinetic-typography`(自研 HTML→MP4,= HyperFrames 替身)· `dy-motion-asset-library`(Agent Skill + 调用码组织法,这条是它的"剪辑"侧)· `method-ia10-worklog` / `cewrite-storyboard`(插入镜头从哪来,本条解决"落到哪一段")· `method-amz-带货视频`(HyperFrames 双轨)· 记忆 `reference_hyperframes`(5 月安装与坑)· `project_dialogue_video_realvoice` / `project_daily_process_video` / `project_claudecode_100_challenge` / `project_jarvis_content_line`。
  • 不确定项:`--full-depth` 具体含义(推测 = 连同子 Skill 一起装)未核;她的 Codex 是 ChatGPT 桌面端 Codex 面板还是 Codex App 未能百分百确认(UI 中文 + "由 ChatGPT 从另一项任务发送"支持前者);剪辑那一步的真实 Codex 对话与耗时未展示,"按照口播拆镜头…"是口播转述而非截图;她的流程文档要评论区索取,未拿到。
  • 待办:等老板点头 → 建 `~/claude-work/edit-by-voice/`(state + ops + SKILL.md)先接 `build_dialogue.py`;再评估 HyperFrames "口播 + 录屏"模板是否用于挑战 100 系列;加进自动化注册表(`feedback_automation_never_dies`)。

来源:https://v.douyin.com/nLSDMaySGYI/ (作者 小枝ya · 2026-09-05 发布 · 54s · 1280×720 横版 · 66 赞 9 评 9 转 · #ai新星计划 #ai学习指南 #codex #vibecoding #自动剪辑 · 视频 id 7681863806461270907 · 流程文档她说"评论区留『剪辑』发你",未公开链接)

剪辑与工作流

抖音参考 · 孤独摇滚「为你转身」歌词动态排版剪辑(白底编辑感字卡 × 立绘 · 逐词卡点 → 3 秒英雄定格)

抖音参考候补T14歌词卡点kinetic-typography动漫剪辑白底字卡立绘16:9一词一卡英雄定格无武器2026-09-03

候补 T14(2026-09-03 收进,未复刻、未定级)。老板丢链接无留言 → 按"抖音参考先进候补"规则入库。上方 = 作者原片(压缩版 480p),对比表 `assets/dy-bocchi-lyric-typo-edit_contact.jpg`(fps=2 全片缩略)。

这是什么

15 秒 · 16:9 横屏 1280×720 · 30fps · 无口播,音轨是一首中文情歌的副歌(听写:"秒针又在提醒我爱你几分 / 只要听到你的声音 我一定会为你转身 / 一直走 一直梦 一直风 一直没停留")。画面不是动画原片,是《孤独摇滚》山田凉的立绘/同人插画静帧(3–4 张不同画风的图)被当作"海报素材",配白底编辑感动态排版:每一个歌词词组 = 一张字卡镜头,字先落、人再压上,前 7 秒 15 个镜头平均 0.45s,第 7 秒一记白闪切进樱花英雄图定格 3.25s 放最抒情的一句,然后收成留白 + 手写签名。本质 = KODA/T12 那套"字先可读、人再压上"的字卡语法,去掉打斗/VFX,换成情歌歌词卡点——同族但温柔版。

  • 切点:`scene>0.3` 只抓到 3 个(0.97 / 6.07 / 11.3 = 三大段落),`scene>0.12` 抓到 ~19 个换镜(白底字卡之间差异小,要低阈值)。人工数 = 19 个镜头 / 15s,平均 0.8s;前 7s 15 镜(0.45s/镜),7–10.25s 一镜 3.25s,尾段 4 镜慢收。
  • 节奏形态:密 → 停 → 空(build 密集字卡 → drop 是"定格"而不是更快 → 留白收尾),跟我们 T12/T13 的"越切越密收尾"正好相反。

镜头语法表(时间 → 镜头 → 它在干什么)

| 时间 | 镜头 | 作用 / 学到的点 |

|---|---|---|

| 0.00–0.12 | 白场淡入,斜向散落的蓝黑色块从画外飞入 | 白闪开场,色块是全片的"节拍粒子" |

| 0.12–0.88 | 白底海报卡 A:银发版山田半身立绘居中,背后巨型灰字「山田凉」+ 英文小字环绕,蓝黑色块斜向散布,一条细弧线 | 字先铺满,人压在字上;小字/色块给"编辑感"密度 |

| 0.88–1.00 | 同构图头发变蓝(换成另一张立绘)+ 小幅缩放 | 同构图换素材 = 最便宜的"换镜头" |

| 1.00–1.37 | 硬切 巨字卡「秒针」:深蓝底,黑体字占满 1/2 画幅,中央圆形徽章里塞角色头像 + 细字 `YAMADA RYO` | 歌词第一个词 = 全屏巨字,圆徽章 = KODA 的墨圈同款 |

| 1.37–1.75 | 竖向拖影 smear → 竖条名片卡「又在」,深蓝底白色竖长条,上下小英文 | 拖影当 whip,竖条打破横向节奏 |

| 1.75–2.25 | 照片贴纸卡「提醒 remind」:车站实景照片贴在白底上,中英双语字压在照片上,角色只露腿 | 局部人物(腿/背)也算镜头;中英并置 = 双语字幕语法 |

| 2.25–2.75 | 「City Life —」卡 + 「LOVE 我爱」:校服立绘半身,照片贴纸 + 蓝色进度条小色块 | 每张卡都有"一大一小两个字层" |

| 2.75–3.50 | 巨型灰字 「Y U」 落在人身后 → 3.5s 黑字 「YAMADA」 横向滑入压底 | 字母逐个落位,最后姓名横条压上 = 卡点响 |

| 3.75–4.60 | 横向 whip → 拍立得/社媒帖子卡:三张竖图并排 + 点赞 UI,竖排歌词「只要」「听到」贴在左右 | 社媒 UI 当排版元素;歌词拆成两字一柱 |

| 4.60–5.25 | 心电图线条卡「你的声音」:白底,一条折线穿过画面,词在折线上"跳",角落小字 wink / yamada | 「声音」= 心电波形,歌词内容→图形隐喻 |

| 5.25–5.60 | 同折线卡只剩 「我」 | 一字一卡,字越少越响 |

| 5.60–6.10 | 青色色块「一定」 从小到大弹入白底 | 单色块 + 一个词 = 最省的"重拍" |

| 6.10–6.50 | 巨字 「会为」 夹住第三张立绘(黄眼、双手插兜) | 人从字中间钻出来 |

| 6.50–6.87 | 只剩 「你」 单字,缩放微动 | 单字停顿 = drop 前的吸气 |

| 6.87–7.00 | 白闪 3–4 帧 | 唯一一次全白闪,就放在 drop 前 |

| 7.00–10.25 | 樱花英雄定格:蓝天粉樱草地,黑裙山田回眸微笑;右上小字 `罗生门 [Follow]`+曲名/作者,左下 `Bocchi the Rock / yamada ryo` | drop = 停下来,3.25s 一动不动只做轻微推进;抒情句"我一定会为你转身"整句压在这一镜 |

| 10.25–11.30 | 白底细字 「一直没」(手写感,小号) | 情绪回落,字号从巨→小 |

| 11.30–12.10 | 灰色巨字 「停留」 + 蓝夹克版立绘从右滑入压字 | 最后一次"字先人后" |

| 12.10–13.50 | 白底 Thank You 细字 | 片尾留白 1.4s,等歌唱完 |

| 13.50–15.0 | 手写签名 `wink` + 一行小字 | 作者署名当封底 |

转场词汇:硬切(主)· 竖向/横向拖影 smear(3 次)· 白闪 1 次(只放 drop 前)· 色块弹入 · 字块横滑入 · 微缩放呼吸;没有 glitch、没有变速、没有 3D。

色彩:白底 + 深蓝/靛蓝 + 青色一个点缀色 + 灰字;只有英雄定格是全彩(蓝天粉樱)——前 7 秒故意压成单色,让 7s 的全彩一击成为 payoff。

素材类型:全部是静态立绘/插画(同人图 + 官方图),靠排版和位移做动感,没有任何原片动画帧 → 我们用 Codex 出 3–4 张角色静帧就能复刻,零视频生成也能做。

情绪结构

1. build(0–7s):一词一卡,越来越少字(山田凉 → 秒针 → 又在 → 提醒 → 我爱 → YAMADA → 只要听到 → 你的声音 → 我 → 一定 → 会为 → 你),字数递减 = 张力递增

2. drop(7s):白闪 → 全彩英雄图定格,副歌关键句"我一定会为你转身"

3. payoff / 收尾(10–15s):字号缩小、留白、Thank You、签名——把 7.7 万赞的"余味"留给评论区

我们能复用的(ONE TEN / Karen / MINI PV)

  • 歌词 = 镜头清单:把 ONE TEN 一首歌的副歌拆成 10–12 个词组,每个词组一张白底字卡,字数递减;最抒情的一句给 3 秒定格。对 Karen/MINI 的"角色情歌 PV"或 Moon1k 抒情段直接可用
  • drop = 定格,不 = 更快:跟 T12/T13 相反的节奏形态,给我们模板库补一个"温柔向";同一个角色可以出 T13(超能力)+ T14(情歌)两条反差片
  • 单色 build → 全彩 payoff:前段所有字卡压成白/靛蓝/青三色,英雄图才放全彩;Codex 出图时前几张明确要"monochrome editorial poster, white ground, indigo ink",英雄图才要 full color
  • 歌词内容→图形隐喻:「声音」= 折线波形、「秒针」= 圆徽章、「一定」= 实心色块;写 H3 提示词时每个词卡都给一个几何母题
  • 零视频生成方案(Plan B):3–4 张 Codex 立绘 + `method-kinetic-typography`(HTML→MP4)就能全复刻,不花 LibTV 积分;H3 只在想要"人从字里钻出来"的微动时才需要
  • 注意:原片 16:9;我们发抖音/Reels 要改 9:16,字卡纵向堆叠更顺(竖排歌词那张卡已经是竖版语法),遵守 9:16 安全区(y230–1480 / x60–940)

H3 提示词草稿(复刻节奏 · 换成我们的角色 · 无武器 · 未跑)

参考:`@[image1]` = 角色身份板(2D 锁),`@[image2]`–`@[image4]` = 三张白底单色立绘变体(Codex),`@[image5]` = 全彩英雄图(回眸微笑)。文字参数逐字写真字,不留变量名(Max 会把变量名当字印)。
LYRIC_01="秒针"  LYRIC_02="又在"  LYRIC_03="提醒 remind"  LYRIC_04="LOVE 我爱"
NAME_EN="KAREN"  LYRIC_05="只要 / 听到"  LYRIC_06="你的声音"  LYRIC_07="我"
LYRIC_08="一定"  LYRIC_09="会为"  LYRIC_10="你"  LYRIC_11="一直没"  LYRIC_12="停留"  OUTRO="Thank You"

Create a 15-second anime lyric-video PV, vertical 9:16, 30fps, exactly 19 cuts.
Use @[image1] as the sole authority for the character's identity; keep the 2D anime rendering of the references throughout; no 3D, no photoreal. NO WEAPONS, NO COMBAT, no VFX explosions: the only energy comes from typography motion and the character's small gestures (glance back, hair flick, hands in pockets).
Visual bible: white editorial poster ground, indigo/navy ink typography, one cyan accent, tiny grey caption text, scattered navy rectangles as beat particles, one thin arc line. Everything before 7.0s is near-monochrome; only the hero shot is full color. In every text card the typography must be fully legible FIRST, then the character (or a cropped part: legs, back, hair) slides in and overlaps it.
CUT 01 0.00–0.90 poster card: character centered, giant grey name behind, navy blocks scattered. CUT 02 0.90–1.35 hard cut, giant "秒针" filling half the frame, circular badge with cropped face. CUT 03 1.35–1.75 vertical smear → tall navy strip card "又在". CUT 04 1.75–2.25 photo-sticker card "提醒 remind", only the character's legs visible. CUT 05 2.25–2.75 "LOVE 我爱" over a street photo sticker, half-body. CUT 06 2.75–3.50 giant grey letters drop in one by one behind her, then "KAREN" slides in as a black bar at the bottom. CUT 07 3.50–4.60 horizontal whip → three polaroid/social-post cards side by side, vertical lyric "只要" "听到" on both sides. CUT 08 4.60–5.25 white card with a single EKG line across the frame, "你的声音" riding the peak. CUT 09 5.25–5.60 same line, only "我". CUT 10 5.60–6.10 solid cyan block pops in with "一定". CUT 11 6.10–6.50 giant "会为" split by the character emerging between the two words. CUT 12 6.50–6.85 single word "你", slow breath zoom. CUT 13 6.85–7.00 white flash 3 frames. CUT 14 7.00–10.25 HERO HOLD: full-color cherry-blossom field, she turns her head back to camera and smiles; hold still with a very slow push-in; tiny caption top-right. CUT 15 10.25–11.30 white ground, small handwritten "一直没". CUT 16 11.30–12.10 giant grey "停留", character slides in from the right and overlaps it. CUT 17 12.10–13.50 white ground, thin "Thank You". CUT 18–19 13.50–15.00 handwritten signature "ONE TEN", fade to white.
EDITING: hard cuts, 3 directional smears, exactly one white flash before the hero hold, block pop-ins, sliding text bars, subtle breathing zoom. No glitch, no speed ramps, no slow dissolves except the final fade.
BGM: soft Mandarin pop ballad chorus, one word per cut, the emotional line lands on the hero hold at 7.0s; sparse piano + light drums, no drop impact — the "drop" is silence-into-hold.

建议先用 Plan B(Codex 立绘 + HTML 动态排版) 复刻一条不花积分,验证节奏后再决定要不要上 H3 做人物微动。

关联

  • 同族:`koda-anime-card-cut`(字先可读、墨圈/圆徽章)· `t12-chaopai-kv-13cut`(无武器动作词汇、多参考图)· `method-kinetic-typography`(零积分复刻路径)· `beatsync-retime`
  • 反差配对:同角色 T13(超能力·越切越密)↔ T14(情歌·密→停→空)
  • 待办:Plan B 复刻一条 9:16 → 老板看 → 定级

来源:https://v.douyin.com/QtMs804CGWI/ ("wink" · uploader_id wink5236 · 2026-06-13 发布 · 7.7 万赞 · #孤独摇滚 #动漫剪辑 · 标题「孤独摇滚 只要听到你的声音 我一定会为你转身」)

剪辑与工作流

卡点变速 retime(本机免费·0积分)

卡点ffmpeg60fps免费2026-09-01

把成品视频踩着鼓点变速:弱拍慢放呼吸、重音上瞬间加速snap冲过去。全本机 ffmpeg/python,0 LibTV积分。脚本 `~/claude-work/kpop-pv/audioreact/cypher_retime.py`。

用法

  • `cypher_retime.py <in.mp4> <out.mp4> 60 <BOOST> <TOPQ> 1.15 <drop.mp3> <LEN>`
  • 慢镜自适应插值→丝滑60fps;snap保持crisp原帧不糊;bass-weighted onset检测踩重音
  • 已经有硬切的视频别用它frame-blend(会糊切点);那种只 -c:v copy mux drop
  • 不用 minterpolate(太吃电脑,720p都>2min);自适应blend 10s/60fps 只要~40s
剪辑与工作流

Moon1k MV 引擎 — LibTV H3 2K 配方(CANONICAL)

H3MVLibTV2K卡点CANONICAL2026-08-28

锁定的 H3 MV 出片配方(2026-08-28)。3种模式:single/frames/mixed2video;ratio=adaptive、resolution=2K;face=2K铁律(人脸镜头必须2K,close-up先漂);快慢呼吸感转场。详见 memory reference_h3_mv_recipe + H3_PV_PROMPT_BANK.md。

要点

  • 模式:singleImage2video(单图)/frames2video(首尾帧)/mixed2video(多参考最多9图)
  • 每clip一个运镜、重述identity防漂、多时间点查脸
  • 15s clip偏长→生成后剪短;卡点=喂原曲当参考音频(T9) 或 剪映后期

来源:reference_h3_mv_recipe

剪辑与工作流

IA10 工作日志 / 纪录片 出片方法

IA10纪录片SeedanceLibTV系列2026-08-22

IA10 系列出片(工作日志EP + 纪录片EP01-05)。IA10 avatar 主播讲workflow,不出镜。LibTV H3/Seedance 出画面 + 字幕 + EDM。EP02_cut.mp4、EP05_final 等成品在 ~/claude-work/ia10-docu/。

要点

  • IA10 官方脸锚点先喂(face_anchor_first)
  • Seedance 有音频caps注意;CCTV/B-roll plate库复用
  • 成品多版本(subbed/leveled/edm remix)迭代

来源:project_ia10_worklog_ep02, ia10-docu

剪辑与工作流

AI漫剧 15秒衔接做长视频

AI漫剧长视频衔接skillH32026-08

突破单段15秒限制做长视频:用一个 skill,直接在提示词里让视频模型做好首尾衔接(首帧=上一段尾帧 / 明确衔接动作),多段拼成连续长片。

要点

  • H3 支持 FL2VA(首尾帧控制) → 上段最后一帧当下段第一帧 → 无缝衔接
  • 提示词里明写"continue from the previous shot, same scene/character/lighting"
  • 配合我们 H3_PV_PROMPT_BANK 的首尾帧模式;深挖TODO:取那个具体skill

来源:https://v.douyin.com/q6MZE4Zgncw

剪辑与工作流

Amazon 站内带货视频流水线

Amazon带货RemotionHyperFrames选品2026-08

选品→扒图→Codex场景→Remotion / HyperFrames 双轨渲染→带货短视频。真产品图→自然16:9电影场景→9:16竖屏(安全区字幕、轮换模板)→BGM→上传。storefront shop/ailenovo (tag wentianzhang-20)。

要点

  • 双轨:Remotion(程序化) + HyperFrames(HTML→MP4)
  • 9:16安全区、模板轮换避免同质
  • 关联 amazon_storefront_video、hyperframes

来源:reference_amz_video_pipeline

剪辑与工作流

动态字幕/kinetic typography 出片(HTML→MP4)

kinetictypographyHTML→MP4ffmpeg后期2026-08

自动化 kinetic-typography 视频:HTML动画 → __seek 逐帧 → puppeteer-core截帧 → ffmpeg合成MP4。用于卡点字幕、片头、CJK大字动效(libass对CJK不稳,用drawtext+Arial Unicode)。

要点

  • HTML/CSS/JS 做动画 + 一个 __seek(t) 函数控制时间 → puppeteer逐帧截 → ffmpeg拼
  • 9:16安全区铁律(y230-1480/x60-940)
  • 关联 kinetic_video_pipeline、video-shotcraft(Remotion 152镜头配方)

来源:reference_kinetic_video_pipeline

剪辑与工作流

人机日志 · 台词房(五模型选稿)

剧本台词多模型人机日志2026-08

出对白/文案的方法:五种编剧流派各出一版对白 + 钩子句,再选稿融合。用于《人机日志》等叙事内容的台词生成。多模型并行→择优。

要点

  • 5个流派/模型各写一版 → 对比 → 选最强 + 嫁接各家亮点
  • 钩子句(hook)单独出一批挑
  • 关联:writers-room 台词房

来源:reference_writers_room

工具与自动化 7

Codex + 轻量模型分工 + 压缩前保上下文 hook(抖音 @有活别摸鱼 2026-09-21)
工具与自动化

Codex + 轻量模型分工 + 压缩前保上下文 hook(抖音 @有活别摸鱼 2026-09-21)

笔记2026-09-21

来源 https://v.douyin.com/cqqh3Aurn0U/ · 55 秒口播,无演示画面;配置文档在他评论区/粉丝群(未拿到)。转写 codex_jev_delegation_transcript.txt。

他的三招

1. 分工:复杂任务给强模型(Codex 主模型),大量重复、简单、明确的小判断丢给轻量模型「Jev」(具体是什么没说;#jev),省掉无意义的强模型消耗。

2. 压缩前 hook:Codex 压缩上下文之前先调轻量模型,把「以后可能用到的关键信息」挑出来存下。

3. 压缩后回注:压缩完把挑出来的上下文再注入回去 → 又聪明又省钱。

对照我们已有的

  • 分工:已有 Hermes(Gemini Flash 免费线)/ GLM / Kimi 做翻译、摘要、批量文本;Codex 出图刚改成 -m gpt-5.5(Astra 一次 11 万 → 5.5 一次 2.6 万 token)。缺的是「自动路由」:小判断默认走轻模型而不是我手动决定。
  • 上下文:我们走「记忆靠文件不靠会话」六条(决定即落盘、每日交接单),比 hook 更稳。Claude Code 有 PreCompact hook 可加「压缩前把待办/未决事项快照写到 memory」——等于他第 2、3 招的文件版。

可做(等老板点头,改 hook 需重启会话生效)

  • PreCompact hook:调用 hermes 从当前会话 transcript 抽「未决事项 + 待他回复」写入 memory/handoff 文件;压缩后我开场复述时读它。
  • Codex 侧:给 kr/jp/cn_bg 和 ingest 这类脚本一律 -m gpt-5.5(已做);写词/审词等「小判断」默认走 Hermes。
Jev(TypeSafe AI)— System One 决策模型 · 2026-09-21 调研
工具与自动化

Jev(TypeSafe AI)— System One 决策模型 · 2026-09-21 调研

笔记2026-09-21

老板 03:42 令:「JEV 快速下决策的模型,刚出,看怎么接进来」。

是什么

  • 不是 LLM、不生成文字。输入 state(JSON/文本,≤64k token)+ 若干「有类型的问题」,并行返回带概率和置信度的答案:

- Choice:N 选一(≤255);Score:2–10 级刻度上的位置;Noul:是/否概率 0–1。

  • 70–500 ms;$0.042 / 百万输入 token,输出免费;结构错误率 0(按构造)。官方自报,未独立复现。
  • 弱点:字面理解(否定词/范围词容易吃错)、不会算术和日期、无关 state 越多越差、不能写文字、可被输入文本操纵。
  • 好用处:路由/分诊、审核过滤、贵模型前的相关性筛选、给 LLM 输出打分做护栏、高频打标、请求内亚秒决策。

怎么接

  • API key:console.typesafe.ai/settings/keys(早期访问,排队);`pip install typesafe-sdk` / `npm i @typesafe-ai/sdk`,默认 jev-latest,读 TYPESAFE_API_KEY。
  • Claude Code 插件:`claude plugin marketplace add typesafe-ai/skills && claude plugin install typesafe@typesafe-ai`(改插件=动 .claude.json,按规矩等重启窗口)。
  • 开源本地替代(协议兼容 /v1/systemone):Von(wfzyx/von,395M,Apache 2.0,Apple MPS/CPU,~18 ms,49 任务 71.5% vs Jev 96.6%)、Laya(421M,58%)。无 key 也能先跑。
  • 参考实现:zjunlp/JevLoop(agent 循环里的「要不要动/哪个工具/安全吗/成了吗/完了吗/能交付吗」全走决策模型,LLM 只负责写);oppih/approval-judge-bridge(审批门);typesafe-ai/system-one-adapter-python(用 LLM 假装 Jev,做对比)。

对我们的真实位置

最大的 token 消耗是 IA10 本人对老板消息的推理与执行,Jev 替代不了(它不写字、不看图、不做复杂推理)。能替的是脚本里的「小判断」:

1. 自动化哨兵分诊(日志→健康/降级/死亡 + 该走哪条 restock)— 现在是规则表。

2. Suno 入库分类(SONGGIFT vs 歌库 / 语言 / 同曲不同 take)— 现在是正则+md5,Jev 可补「标题看起来是生日/管弦」这类模糊判断。

3. 战情室回执分诊(Karen 回执:完成/卡住/要老板拍板)。

4. LibTV / 浏览器自动化的状态判断(页面文本 → 成功/失败/被拒/额度不足)。

5. 文天台若开放用户文本(歌单名/评论)时的审核。

第 1–4 项每天各几十次判断,按 Jev 价格几乎免费;真正省的是这些地方现在偶尔调 Hermes/Codex 的开销和我的注意力。

计划(等老板)

A. 他去 console.typesafe.ai 排队申 key(要人注册)。

B. 我先装 Von 本地版做基准:拿我们自己的 200 条真实样本(标题分类、哨兵日志、Karen 回执)测准确率和中文支持;准了就先接哨兵和入库两处。

C. Jev key 到手后同一套代码换 endpoint 即可(协议兼容)。

2026-09-21 04:10 实测记录

  • iMac(Intel i9)跑不了 Von:macOS x86 的 torch 止于 2.2.2,Von 模型分词器需要 transformers 5(要求 torch≥2.5)。降级 transformers 4.49 → 报 `Tokenizer class TokenizersBackend does not exist`。结论:Von 只能在 Air(Apple Silicon)或云上跑;iMac 侧将来直接调 Jev API 或 Air 上的 Von HTTP 服务。
  • 已派 Karen 在 Air 跑基准:warroom/handoff/jev/bench_von.py + titles_labeled.csv(92 条)。
工具与自动化

抖音参考 · Code Liam《动效素材库已经整理好》· 46 个 Remotion 动效调用 × 19 分类 × 注册表 JSON × Agent Skill(SKILL.md + 调用码)× "把仓库丢给 Agent 选完再做"的素材库组织法

抖音参考候补动效素材库motion-libraryRemotionAgent-SkillSKILL.md调用码注册表manifest透明素材ProRes4444alpha字幕动效数据图表证据卡品牌收尾素材库组织法许可风险非商用Moon1k人机日志每日过程视频kinetic-typographybank_build零积分2026-09-05

候补(2026-09-05 抖音 intake,零积分入库,未拉取运行、未定级)。老板丢链接无留言 → 入库。这不是一条出片模板,是一条工具 + 组织法卡:一位 Remotion 动效作者把自己视频里用过的 46 个动效整理成"注册表 + 源码 + 原预览 + Agent Skill"开源包,玩法是把仓库地址丢给 Agent,让它读 SKILL.md 起预览库,人选好效果、Agent 按调用码做透明片段。上方 = 20 帧顺序表 `assets/dy_motion_lib_contact.jpg`(0.8s 一格);原片存 `intake/dy_motion_lib/video.mp4`。未登记 picker(非出片模板)。许可不是 MIT,见下"许可风险",商用线不能直接用它的素材。

它是什么(带时间戳)

  • 0.0–4.8s:左侧一张终端风"开源发布清单"卡(标题栏 `>_ motion-library-release`,眉题 `G16 / OPEN SOURCE`),三条依次点亮:`01 / DESIGNED WITH ASTRA 我用 Astra 设计的动效库`、`02 / FULL MOTION LIBRARY 完整的动效库 本次一并开源`、`03 / AGENT CALL SOP 附有完整的 Agent 调用 SOP`;右侧是他的动效预览墙(环形评分 82、"把复杂问题讲清楚"大字标题、日落照片上一个大写 B、柱状图"Astra,进步在哪里?"、Remotion 关注卡、放射线背景、手机录屏框、"AI 工作流 / 内容策略 / 动效…"列表 + 鼠标滑过)。这张清单卡本身就是库里 G16 家族的"WorkflowTipsTerminal"——他用自己的库做自己的发布视频。
  • 4.8–6.4s:真人露脸过场(土星投影灯、紫色氛围)。
  • 6.4–11.2s:整屏一张聊天卡,逐字:
请拉取 https://github.com/linhaixin45-cmyk/code-liam-motion-library,
阅读 SKILL.md,准备环境并打开动效预览库,
等我选择后再制作。

口播:"现在你只需要把这个包给你 Agent,然后让他参考设计属于你自己的动效。"

  • 11.2–13s:品牌收尾卡(`Code Liam` 渐变大字 + "关注我,下个风口之前,我们从最简单的 ai 开始" + 关注按钮 + `AI PRACTICE · CREATOR NOTES`)= 库里 G14 品牌收尾。
  • 13–14s:黑。

口播全文(Whisper):"我用 Astra 设计的动效库在今天已经开源了,附有完整的动效素材和 Agent 调用 SOP。那现在你只需要把这个包给你 Agent,然后让他参考设计属于你自己的动效。这里是 Code Liam,只做实用的 AI 分享,咱们下期见。"

素材源 / 工具清单(逐字,视频 + 仓库核对)

  • 仓库:`https://github.com/linhaixin45-cmyk/code-liam-motion-library`(描述:"Code Liam motion library: 46 reusable motion calls, original previews, editable source, design SOP and an Agent Skill. Community remix license.")。版本 0.1.0。Releases 页提供完整 Skill 包下载。
  • 引擎:Remotion(React 帧驱动视频)。Node.js 20+。透明导出默认 ProRes 4444 MOV(HEVC with Alpha 不提供)。
  • Skill 入口:`SKILL.md`(name: `liam-motion-library`),`scripts/library.mjs`(`doctor` / `list` / `resolve` / `init`),`agents/openai.yaml`。
  • 注册表:`assets/library/registry/library.v1.json` —— `contract: LIAM_MOTION_CALL_V1`,`approvedCalls` 46 条,每条字段 `code / family / compositionId / status / delivery(alpha|full) / sourceFile / compositionSourceFile / props[] / allowedContexts`。
  • 图库索引:`assets/library/gallery/api/library.json` —— `taxonomy{categories, skins, statuses, sources}` + 19 张首页卡 `items[]`(`id / name / summary / category / skin / status / durationLabel / tags / useWhen / avoidWhen / variants[]`)。本地 `npm run gallery:serve` 起预览站。
  • 9 个分类(逐字):开场与标题 / 字幕与文字标注 / 数据与指标 / 对比、筛选与决策 / 流程与关系 / 证据与素材 / 状态、公告与交接 / 转场与背景 / 收尾与 CTA。
  • 7 个皮肤:暗色编辑排版 / 深色玻璃仪表盘 / 工具实验室 / 系统治理图 / 公告状态牌 / 官方中性组件 / 纸张与手绘。
  • 19 张首页卡(家族码 · 名):G01 大字落定 · G02 章节牌建立 · G03 指标增长 · G04 对比挤压 · G05 流程轨道 · G09 扫描验证 · G10 证据窗口 · G12 状态交接 · G14 品牌收尾 · G15 手机与竖屏录屏 · G16 浏览器与系统界面 · G17 标签、徽章与印章 · G18 数据图表与评分 · G19 文字标注与原文强调 · R01 移动胶囊字幕 · R02 逐词字幕强调组 · R04 错层证据照片组 · R05 平台评论证据卡 · R06 主题转盘选择器。
  • 调用码样例(逐字):`G03::HeroNumberSourceFaithfulV1Alpha`(props: from,to,prefix,suffix,label,detail,accentColor,delay,countDuration,decimals,locale,fontSize…)· `R02::PoppingWordCaptionsAlphaV1`(tokens,timings,accentColor,position…)· `G18::ScoreRingSourceFaithfulV1Alpha`(value,max,label,eyebrow,color,chips…)· `G14::GenericSubscribeNudgeSourceFaithfulV1Alpha`(固定场景,props 空)。
  • 解析命令(逐字):
node "<skill-root>/scripts/library.mjs" resolve 'G03::HeroNumberSourceFaithfulV1Alpha' --props '{"from":0,"to":200,"prefix":"¥","suffix":"","label":"本次花费","detail":"人民币"}'
  • 多片段清单格式(YAML,逐字骨架):
contract: LIAM_MOTION_CALL_V1
library: liam-motion-library
libraryVersion: 0.1.0
calls:
  - code: G03::HeroNumberSourceFaithfulV1Alpha
    range: "00:00:21.000-00:00:26.000"
    props: {from: 0, to: 200, prefix: "¥", suffix: "", label: "本次花费", detail: "人民币"}
    placement: "左侧信息区,避开人物与字幕"
    delivery: alpha
  • 第三方来源(他自己列的):Remotion(官方 Sample 只留链接)、React Bits(`reactbits.dev`,只给"交互→确定性帧函数"方法,不打包组件)、"Kimi 早期动效包"(部分设计祖先)。
  • "Astra":视频与库里多处出现("我用 Astra 设计的"、`G18::AstraSolBenchmarkComparisonV1`、柱状图"Astra,进步在哪里?"),像是他用的 AI 设计/编码 Agent 或产品名,仓库未解释——未核实。

它的组织法(真正值得学的部分)

1. 三层分离:母版(`assets/library/`,永不改)→ 注册表(JSON,机器可查)→ 作品工程(`init` 到包外,一切修改在此)。库内原预览"只帮选型,不算验收"。

2. 一物一码:每个动效有唯一 `FAMILY::CompositionId` 调用码,人只说码 + props;近似码/家族码/多余参数一律报错,"不选看起来差不多的替代品"。

3. 两级索引:注册表(46 条精确调用,给机器)+ 图库(19 张首页卡合并同类项,给人挑);卡上带 `useWhen / avoidWhen / durationLabel / skin`。

4. Skill 只做路由:"不要一次读取全部组件、视频或参考说明",按任务读专项文档(制作 / 浏览 / 调用 / 借鉴 / 导出)。

5. 交付链固定:选预览 → 复制调用码 → 补文案/数据/SRT → 完整预览 → 用户确认这一版 → 独立透明导出(ProRes 4444)→ 二次剪辑(剪映/CapCut 叠上层轨道)。确认状态写进一段短 Markdown(作品 / 状态 / 调用码 / 帧数 / 预览文件 / 用户确认),"不编造审批"。

6. 多片段按 SRT cue 编号逐个交付,不主动合成整片。

7. 交互→帧函数表(React Bits 方法):鼠标 → 显式游标路径;滚动 → 帧数算 scrollProgress;rAF → `useCurrentFrame()`;随机粒子 → 固定种子;spring → 时间线插值。和我们 `method-kinetic-typography` 的 `__seek(t)` 是同一思想。

许可风险(必须记)

  • "Code Liam 二次创作许可 1.0",明写"不是 MIT,也不宣称为无限制开源"。允许:下载、学习、本地运行、修改、发布自己的非商业二创视频。不允许:广告、品牌推广、付费接单等商用(需另行授权);转售或重新打包成源码包 / 模板库 / Skill 包 / 独立动效素材合集分发。
  • 第三方:Remotion 自有许可(公司规模超限要付费);React Bits 固定版本条款限制组件再分发;部分设计"参考过 Kimi 工作区素材",作者自己声明"不宣称独立权属审计完成"。
  • 对我们的含义:ONE TEN 商业线(客户站、接单、带货、SONGGIFT)不能直接用它的源码/素材;只能学它的组织法与运动语法,自写。个人频道非商用视频(人机日志、每日过程、Moon1k 自发 Shorts)按字面允许,但 Moon1k/ONE TEN 是品牌推广性质,边界模糊 → 一律自研重写,不引入其代码。
  • 别把它的 `.tsx` 拷进我们仓库;playbook 是内部知识库,公开付费站更不能带。

映射到我们的线

  • Moon1k Shorts(T15 乱线 + 场景库硬切):老板 09-05 说 bank_cut 样片"图与图之间连接不够"。这条给的不是图,是叠加层思路:`reactive/bank/stills/` 目前只有自家渲染帧 + 三张纯色,缺异质素材;可补一层透明动效叠加(逐词字幕 R01/R02 语法、大字落定 G01、章节牌 G02、品牌收尾 G14),用我们的 HTML→MP4 引擎自写,作为硬切之间的"承接"元素(同一字卡跨两张底图 = 视觉连续)。
  • 人机日志 B-roll:G10 证据窗口 / G16 终端·代码·仓库卡 / G12 状态交接 / G09 扫描验证 —— 正是 IA10 讲 workflow 时最缺的"系统界面"插入镜头,且本机零积分(`cewrite-storyboard` 的无脸镜头 + 这些 UI 动效 = 一集对口型镜头压到 2–3 个)。
  • 每日过程视频卡:`daily-process/daily_process.py` 现在是静态卡;G03 指标增长(今日提交数 / 花费)、G05 流程轨道(今天跑了哪几步)、G18 环形评分 / 点阵,全部可参数化 → 每天自动填数。
  • Kinetic typography 管线:`method-kinetic-typography` 已有 `__seek(t)` 确定性时间线,缺的是注册表 + 调用码——把已做过的字卡效果(T14 一词一卡、ghost 词卡、QUANT ARENA promo 段)编成 `K01::…` 码 + props 白名单,就是我们的版本。
  • ONE TEN 建站:`motion-web-libraries` 卡(ReactBits 等)是网页动效;这条是"网页动效 → 视频动效"的桥,方法表可直接用。
  • 不适用:K-pop PV / KODA 系列(角色生成类,与 UI 动效无关)。

我们的版本(零积分,先建索引后建内容)

1. 目录:`~/claude-work/assets-lib/`

assets-lib/
  manifest.json          # 唯一索引,机器读
  stills/                # 底图(16:9 1080x608 / 9:16),来源=自家渲染帧/Codex/他自拍
  overlays/              # 透明动效(ProRes 4444 或 webm alpha)+ 生成它的 html
  cards/                 # 字卡/章节牌/品牌尾 HTML 模板(含 __seek)
  sfx/                   # 频闪/拖影/故障条短片
  previews/              # 每条 ≤2MB 480p mp4 + thumb.jpg

2. manifest.json 一条(字段定死,license 必填):

{"code":"O02::WordPopCaption","kind":"overlay","family":"O02","name":"逐词弹出字幕",
 "file":"overlays/O02_wordpop_v1.mov","preview":"previews/O02_v1.mp4","thumb":"previews/O02_v1.jpg",
 "size":"1080x1920","fps":30,"frames":180,"alpha":true,
 "props":["tokens","timings","accentColor","position","fontSize"],
 "source":"own/html:cards/wordpop.html","license":"own","commercial":true,
 "tags":["字幕","逐词","Moon1k","9:16"],"useWhen":["有逐词时间码"],"avoidWhen":["中文长句"],
 "luma":"dark","status":"approved","added":"2026-09-05"}

`license` 取值:`own`(自研,可商用)/ `cc0` / `stock-licensed`(写来源与授权号)/ `ref-only`(只看不用,如本条 Code Liam 库)。`commercial:false` 的条目 `pick` 时对商业线自动过滤。

3. 对接 `bank_build.py`:它已经输出 `bank.json`(file/src/frame/luma/tag)。加一个 `assets-lib/tools/ingest_bank.py`:读任意 `bank.json` → 补 `code:"S##::<stem>"`、`kind:"still"`、`license:"own"`、`luma` 由数值分档(<70 dark / <160 mid / else light)、`source:"render:"+src` → 合并进 `manifest.json`(按 file 去重)。`bank_build.py` 末尾加 `--manifest ~/claude-work/assets-lib/manifest.json` 直接写入,省一步。

4. 查询:`assets-lib/tools/lib.py list --kind still --luma dark --tag Moon1k` / `resolve O02::WordPopCaption --props '{...}'`(返回 html 路径 + props 白名单,交给 `render.js`);`pick --need "dark,mid,light" --n 8` 给 `bank_cut.py` 按亮度轮换出底图(这就是 `ig-ghost-lyric-word-cards-teaser` 要的"三档亮度")。

5. 预览页:复用 `playbook/build.py` 思路,`assets-lib/index.html` 由 manifest 生成,按 kind/family/luma 筛,缩略图必须真实(禁 emoji)。可挂 `playbook.oneten.live/assets`(内部)。

6. 首批内容(都零积分):stills = 现有 `reactive/bank/stills/` 6 帧 + 三纯色 → ingest;cards = T14 / ghost 词卡 HTML、QUANT ARENA promo 的字卡段拆成 K01–K04;overlays = 用 `__seek` 引擎自写 4 条最常用:大字落定 / 逐词弹出字幕 / 章节牌 / 品牌收尾(ONE TEN 与 Moon1k 各一版),Chrome 截 PNG 序列 → ffmpeg `prores_ks -profile:v 4444 -pix_fmt yuva444p10le` 出透明。

7. Skill 化:写 `~/claude-work/assets-lib/SKILL.md`(路由式:list / resolve / ingest / export 四段),老板说"O02 + 歌词时间码"= 我 resolve 后直接渲染,不再重新设计。

候补定级(未跑)

  • 类型:工具/组织法卡,不进 picker;对应产物是 `assets-lib/` 这套仓库本身。
  • 预估价值:Tier 1 级的"基础设施"(每条 Moon1k / 人机日志 / 每日过程视频都会从这里取件),但要老板点头才建(约半天:manifest + ingest + 4 条自写 overlay)。
  • 验证路径:建 manifest + ingest 现有 bank → 自写 1 条逐词字幕 overlay → 叠到一条 T15 成片上发他看 → 定是否继续填库。

关联

  • 同族:`ig-scene-bank-strobe-teaser`(底图库 + 硬切,本条补叠加层)· `ig-ghost-lyric-word-cards-teaser`(三档亮度底图需求)· `method-kinetic-typography`(`__seek` 引擎 = 我们的 Remotion 替身)· `motion-web-libraries`(ReactBits 网页侧)· `method-ia10-worklog` / `cewrite-storyboard`(人机日志插入镜头)· `t15-reactive-lines-2k`
  • 不确定项:Astra 是什么工具(未核);作者"46 个"与首页 19 卡的对应关系按 `family` 归并推断;仓库当日刚建(0 star),后续会否改许可未知;HEVC alpha 在我们 ffmpeg 上是否可行未测(macOS `hevc_videotoolbox` 带 alpha 理论可行)。
  • 待办:等老板点头 → 建 `~/claude-work/assets-lib/` + `ingest_bank.py` + 4 条自写 overlay;把它加进自动化注册表(`feedback_automation_never_dies`)。

来源:https://v.douyin.com/nNBbqEefTA8/ (作者 Code Liam · 2026-09-05 发布 · 14s · 1280×720 横版 · 52 赞 2 评 · #ai新星计划 #ai #remotion #动效设计 · 视频 id 7682086210319845297 · 仓库 https://github.com/linhaixin45-cmyk/code-liam-motion-library 同日 15:19 UTC 建)

工具与自动化

抖音参考 · 白小菜《VRChat 入坑指南》· VRChat 为什么受欢迎(社交在场 × 化身 × 世界 × 活动)× 新手上手顺序(先 PC 免费再买 VR)× "在 VRChat 里用自己的化身录口播"这个格式本身

抖音参考候补VRChatVR虚拟化身VTuber元宇宙虚拟直播间社交在场世界地图虚拟演唱会零积分IA10MINI3D桌面宠物NEONSEOULK-pop虚拟偶像Moon1kONE TEN world口播格式2026-09-05

候补(2026-09-05 抖音 intake,零积分入库,未复刻、未定级)。老板丢链接无留言 → 按"抖音参考先进候补"规则入库。这不是一条"出片模板",是一条平台认知 + 格式卡:讲清 VRChat 为什么火、新手怎么进,以及作者本人用的那个格式——整支视频就是作者的猫耳化身站在 VRChat 的虚拟海边日落世界里录的口播(全身手势跟踪、真实海面倒影、画中画贴素材 + 单行字幕),等于"零机位零布景的虚拟演播室"。上方 = 20 帧顺序表 `assets/dy_vrchat_contact.jpg`(16s 一格)。未登记 picker(非出片模板),等老板点头再定要不要做"VRChat 演播室"格式的候补 T 号。

它说了什么

5 分 26 秒口播,结构 = 钩子 → 能玩什么 → 别急着买 VR → 四种平台对比 → 推荐顺序 → 一段"别被吞没"的收尾。关键主张(时间戳按顺序表估,误差 ±10s):

  • 0:00–0:20 钩子:开 F1、开波音 747、全球景点打卡、虚拟 Live House 听演唱会、跟全球人聊天学外语、什么都不做坐在虚拟海边看日落——"这些全在一个叫 VRChat 的东西里"。
  • 0:20–0:35 定性:"严格来说 VRChat 不是一个游戏,它是一个平台,一个你想做什么它就有什么的地方。"(画面:VRChat logo 画中画)
  • 0:35–1:30 能玩什么:赛车世界(物理扎实,有人泡几百小时);飞行模拟社区(民航到战斗机、航母起降、空中加油,有人在里面学完整套飞行检查单);大量还原现实的世界(东京涩谷路口、京都竹林、北欧极光雪山,"足不出户全世界");社交 = 最核心(聊天、唱歌、跳舞、桌游;外国人学中文、中国人练英语口语,"语言交换在 VRChat 里是真实发生的");安静世界(只有雨声海浪声的小木屋地图,坐着发呆)。结论:"不是一个玩什么的游戏,是一个你想干什么就干什么的地方,这是它最大的魅力。"
  • 1:30–1:45 最容易犯的错:"不要为了 VRChat 一上来就买 VR。"先玩一段时间再决定。
  • 1:45–3:10 四种平台:① PC 端(最推荐新手;键鼠/手柄即可;能看到全部模型、进全部世界、画质功能最全;缺点 = 不能用手势和身体互动;免费);② PC 串流 VR 端("VRChat 的完全体",手柄手势 + 身体语言,沉浸最强;门槛 = 一套 VR + 一台不错的电脑);③ 一体机端(Quest / PICO 直接跑;方便;缺点 = 画质压缩、很多 PC 模型看不到、很多高质量世界进不去,"体验大打折扣");④ 手机端(安卓/iOS 新出,功能简单,外面随便逛逛发消息,只能当补充)。
  • 3:10–3:30 推荐顺序:"先在 PC 端免费玩,确定自己真的喜欢,再考虑要不要买 VR。别一上来花几千块玩两天发现不合适。"(口号:先试后买,绝不翻车)
  • 3:30–5:00 收尾:"你可以成为任何你想成为的人,去任何你想去的地方,认识任何你想认识的人;可以是下班后的精神避风港、探索世界的新方式、发现另一个自己的地方——但它终究不是现实。"引《头号玩家》哈利迪:"我创造绿洲是因为现实里不自在,快死了才明白现实才是唯一真实的东西。"再引 "The things that bring the greatest joy carry the greatest potential for loss and disappointment."——"享受它,但别被它吞没。"
  • 5:00–5:26:一键三连 + "我们下期再见,或者 VRChat 里见。欢迎来自现实的旅人。"

它教的东西(拆出来的要点)

1. VRChat 为什么受欢迎 = 四件事叠加:(a) 社交在场感——全身跟踪的化身 + 空间音频,聊天/唱歌/跳舞/语言交换是"真的发生",不是弹幕;(b) 化身自由——"成为任何你想成为的人",化身即身份,作者自己就是猫耳少女;(c) 世界 = 内容——玩家自建的地图(赛车、飞行、涩谷、竹林、小木屋)让平台"想干什么就有什么";(d) 活动——虚拟 Live House 演唱会、聚会、桌游局,把"在场"变成可约的事件。

2. 新手上手顺序(作者的 SOP):Steam 装 PC 版(免费)→ 键鼠先逛世界、试化身 → 玩一段确认喜欢 → 再买 VR;VR 首选 PC 串流(完全体),一体机是妥协,手机只当通讯补充。

3. 硬件真相:PC 端 = 全内容 + 最高画质,只缺身体语言;一体机 = 阉割画质 + 缺模型缺世界;"完全体"要 VR + 好电脑两样都有。

4. 创作者经济(视频里隐含、我补充):VRChat 的化身和世界全是用户用 Unity + SDK 上传的;化身/世界作者在 Booth / Gumroad 卖 VRM/Unity 包,主播用自己的化身在 VRChat 里录口播、开演唱会、做"VTuber 演播室"——作者这条视频本身就是这个经济的产物(她的化身 + 她选的日落海世界 = 全部布景)。

5. 格式本身可学:"化身在虚拟世界里录口播" = 零机位、零布景、零出镜;画中画贴截图/产品图 + 单行字幕 + 手势跟踪,5 分钟长口播也不闷;日落海面这种"低对比、暖色、有倒影"的世界天然把人物衬出来。

6. 世界观收尾法:讲工具的视频最后用一段"它不是现实、别被吞没"的价值观收尾——既显真诚又把粉丝关系从"教程"提到"同路人"("欢迎来自现实的旅人")。

为什么有效

  • 钩子是"一句话装下十个爱好",观众任何一个兴趣点都被勾到。
  • "别急着买 VR" 反直觉,给了新手最想要的安全感,且和作者上一期"VR 选购"互相引流。
  • 化身口播 = 作者本人就是 VRChat 的活广告:她讲的"成为任何人"当场被画面证明。

映射到我们的线

  • IA10 = VR 化身/主播(最直接):[[project_jarvis_content_line]] 定了"他不出镜、IA10 当主播";VRChat 就是现成的"虚拟演播室"——IA10 化身站在一个我们自己的世界里录口播/讲 workflow,比合成进实拍空镜便宜且更自然(真实身体跟踪 > 对口型模型)。MINI / Karen / NOVA 同理(canon 四角色在 `~/claude-work/canon/oneten/`)。
  • 3D 跳舞桌面宠物 / QUANTUM CORE:[[project_3d_dance_pet]] 已有可用的人形骨骼 GLB(`~/claude-work/pet3d/character.glb`,Mixamo 命名,含走/跑)+ 姿态提取(`extract_pose.py` / `retarget.html`)——同一套资产导出 VRM/VRChat 化身是顺手的事(Unity + VRChat SDK 或 VRM 转换);桌面宠物在屏幕上跳,化身在 VRChat 里跳,一份 mocap 两边用。
  • NEONSEOUL / K-pop 虚拟偶像 PV 线:[[project_neonseoul]] 四位 AI 歌手、[[project_kpop_pv_idol]] 的 H3 PV——VRChat 里的虚拟演唱会(作者钩子里的"虚拟 Live House")是这条线的"活动层":出道 showcase、粉丝见面、跳舞世界;VR 录屏本身又是 Shorts 素材。注意 K-pop 偶像 IP ⊥ ONE TEN 四角色,化身分开做。
  • ONE TEN world(元宇宙展厅):ONE TEN 音乐 + 四角色 + 曲库 = 可以做一张自己的 VRChat 世界(展厅:四角色立牌 / 歌墙 / 试听区 / 日落海面同款"发呆区"),作为品牌落地页的 3D 版;[[project_pinla_entertainment]] 的"自己玩的生意"(体验经济)正好落在这。
  • Moon1k 听歌会(listening party):新歌/囤货歌在 VRChat 世界里开"首播会",粉丝化身到场;录屏切片走 [[project_moon1k_clips]] 的 Moon1k+歌名+feat.IA10 三行字规矩。
  • 不适用:人机日志的实拍叙事(那条靠侧写分镜);SONGGIFT(客户不在 VR 里)。

我们的版本(零积分优先)

1. 先按作者的 SOP 自己入坑:Steam 装 PC 版 VRChat(免费,键鼠),逛 3 类世界(演唱会/Live House、展厅/画廊、安静海边),截 20 张世界参考图进 `intake/`;不买 VR。

2. 化身导出(零积分):拿 `~/claude-work/pet3d/character.glb`(或用 canon 板子经 Meshy/Higgsfield `generate_3d` 出 IA10 / MINI 的 GLB → Mixamo 自动绑骨)→ Unity + VRChat Creator Companion(免费)打 VRM/VRChat 化身包上传(私有化身即可,不用公开)。先做 IA10 一个。

3. 虚拟演播室口播:IA10 化身进一个日落海面类世界,用 OBS 录 VRChat 窗口(PC 端即可,键鼠 + 表情/手势热键,不需要 VR);口播用他真人原声或 IA10 声线([[project_dialogue_video_realvoice]]);后期只贴画中画 + 单行字幕 → 抖音 / @oneten_channel 的 workflow 讲解线。

4. Moon1k 首播会试水:选一个免费公共演唱会世界(或世界作者允许的活动世界),约 10 个人的小场,放一首囤货歌,录屏 → 剪 3 条 9:16 Shorts(安全区规矩 [[feedback_9x16_safe_zone]]);看数据决定要不要做自己的世界。

5. ONE TEN world v0:Unity 里用免费资产搭"海边展厅"(四角色立牌 = canon 图贴片,歌墙 = 曲库封面,试听 = 音源触发器),VRChat SDK 上传为私有世界;先当录屏布景,不追求公开。

6. VR 完全体(要花钱的部分,等他定):如果化身口播线跑通,再考虑 Quest 3 + PC 串流做全身跟踪的跳舞/演唱会内容——按作者规矩"先试后买"。

候补定级(未跑)

  • 类型:平台/格式卡,不是出片模板;不进 picker,除非老板要把"VRChat 演播室口播"立为候补 T 号(那时按候补规矩:无星虚线框,跑通一条 IA10 口播后定级)。
  • 预估层(若立 T):Tier 2(零积分、可批量、一次搭好化身+世界后每条成本≈只剩录屏;短板 = 前置工程量——Unity/SDK 上手 + 化身导出 + 世界搭建,第一次要 1–2 天)。
  • 复刻验证路径:PC 端装好 → IA10 化身上传 → 一条 60 秒口播录屏发他看 → 定级。

关联

  • 同族:`method-ia10-worklog`(IA10 出镜方法论)· `t13-legend-mini-superpower-13cut`(MINI 形象定案)· `character-identity-board`(化身建模的身份板来源)· `method-kinetic-typography`(口播字幕层)
  • 不确定项:作者化身是自购还是自制未知;她的世界名未报(日落海面类世界很多);时间戳是按 16s 顺序表反推的估值;"手机端"功能范围只按她口述;VRChat 化身上传对 Unity 版本/性能分级有硬要求(Quest 版限制更严),我们的 GLB 能否直接过审未验证。
  • 待办:(1) 他点头后 PC 端入坑 + 截世界参考;(2) 查 VRChat Creator Companion 当前 Unity 版本与化身性能分级;(3) 评估 pet3d GLB → VRM 转换路径(UniVRM);(4) 决定 IA10 化身用现有 GLB 还是 canon 板重出 3D。

来源:https://v.douyin.com/b9e2tKmIu2M/ (作者 白小菜 · 2026-06-13 发布 · 5:26 · 8085 赞 369 评 · #vrchat #游戏 · 视频 id 7650794285851506277)

工具与自动化

7个 Web 动效/动画库(ONE TEN 建站用)

web动效建站抄motion2026-08-21

做 ONE TEN 官网/落地页的高级动效参考库(完整清单见 memory reference_motion_libraries)。抄它们的公开设计模式、别直接抄模板代码。

库

  • MotionSites / ReactBits / UIverse / Aceternity / MagicUI / Animata / Anime.js
  • 用途:hero动画、scroll-driven reveal、hover微交互、3D卡片、gradient mesh
  • 配套:DesignMD 工作流(从设计到落地);已并入 personal-homepage-skill 的反廉价模板规则

来源:抖音(本session分享)

工具与自动化

克隆任意设计 → 自有IP网站 → 公网部署 流水线

克隆建站DaliPILVercel2026-08

复刻任意网站设计 → Dali/Codex 生图换成自有IP → PIL抠图 + 阴影立体化 → Vercel部署。用于 TOONHUB(3D手办hero)、motionsites克隆等。

要点

  • 复刻结构/动效(不抄代码抄模式) → 自有IP素材替换 → 部署
  • PIL抠图+阴影=手办立体感;配 personal-homepage-skill 反廉价模板规则

来源:reference_clone_to_site_pipeline

工具与自动化

工具集 — Agent全网视野 / 转录神器 / AI写小说 / 设计规律

工具开源agent-reach转录写小说2026-08

这个月抖音收集的几个工具(部分我们已在用):

  • 一行命令AI Agent看遍全网(dy_01) = 就是我们的 agent-reach(15平台读取,已装)
  • 微软开源转录神器(dy_25) = 长音频不切段秒转、本地离线免费(Github 5万星,疑似 whisper系/新品)→ 可替代/补充我们的 voice-stt;深挖TODO取名字
  • AI写小说 开源工具(dy_18) → 关联 LoreVista / 写作房
  • 理解网站设计规律的2个工具(dy_11) → 审美积累,喂 personal-homepage-skill
  • 1300万AI电影流程(dy_09, Higgsfield Studio拆解) → 关联 higgsfield film workflow
  • Seedance2.5 项目上下文连续生产(dy_03) → 从"抽卡"到连续,H3 mixed2video同理

来源:多个抖音链接

ONE TEN 技艺库 · 共 76 条 · 源=git仓 techniques/*.md + kb/*.md(可全文搜、永久)· 本页由 build.py 自动生成