KAMILA HOOK / LOCAL PROOF
这次只看一件事:拆成反应镜头和说话镜头后,整条片能不能顺。
这不是 template 产物,也不是线上任务。它只是把现有片段拼成一条完整 proof,让你直接看方法对不对。
32.067s
完整片时长
6
拼接片段
0
新模型调用
0
template / prod 改动
先看完整视频
顺序是:卡米拉摔倒、教练训话、卡米拉回话、教练先反应再说话、卡米拉收尾。重点看 s3 教练那段是否比旧版自然。
sha256: 2b489ab2901c2829bf51ecea516445fe11c79e9985f66d322db826a4395459b1
这条 proof 怎么拼出来
a0
摔倒铺垫
用已有片段。
s1
教练训话
用已有对齐片段。
s2
卡米拉回话
用已有对齐片段。
s3a
教练反应
无配音,嘴不说话。
s3b
教练说话
带配音,嘴跟着音。
s4
卡米拉收尾
用已有对齐片段。
这就是现在的判断:反应和台词不要塞在同一个 Seedance 片段里。反应镜头不给音频;说话镜头才给音频。
每段源片段
a0 摔倒铺垫
来自 cc-align 的现有片段。
s1 教练训话
来自 cc-align 的现有片段。
s2 卡米拉回话
来自 cc-align 的现有片段。
s3a 教练反应
无音反应片段。这里要看嘴是不是只在惊讶,不是在说话。
s3b 教练说话
纯说话片段。这里要看开口是否从前面就跟着声音。
s4 卡米拉收尾
来自 cc-align 的现有片段。
现在不要再走的路
不要再靠后处理猜 offset
- 前面几版的问题不是一个固定延迟。
- 不同段错法不同,猜一次只会修坏另一段。
- s3 那种反应和说话焊在一起的片,后面很难救。
不要把 prompt 写回 runner
- 故事、表演、镜头、时长都应该是 agent plan 数据。
- runner 只读 plan、调 API、拼接。
- template 之前必须先让你看本地 proof。
机器状态也一起放这
| 机器 | 系统盘 | 数据盘 | Docker | worker |
|---|---|---|---|---|
| worker2 43.153.208.102 |
27% | /mnt/tobatsu-data 34% |
/mnt/tobatsu-data/docker | 12 个 slot online mai 3×5, material 2×5, inquiry 2×1, test 5×1 |
| worker3 43.134.66.32 |
22% | /mnt/tobatsu-data 7% |
/mnt/tobatsu-data/docker | 12 个 slot online mai 3×5, material 2×5, inquiry 2×1, test 5×1 |
slot 不是总并发。真并发要看每个 worker 的 --concurrency 参数。
下一步只做一件事
你先看完整 proof。 如果这条方向对,再把这套拆 beat 的规则写成 template。没通过就继续在本地 proof 上改,不碰线上。