KAMILA HOOK / LOCAL PROOF

这次只看一件事:拆成反应镜头和说话镜头后,整条片能不能顺。

这不是 template 产物,也不是线上任务。它只是把现有片段拼成一条完整 proof,让你直接看方法对不对。

32.067s
完整片时长
6
拼接片段
0
新模型调用
0
template / prod 改动

先看完整视频

顺序是:卡米拉摔倒、教练训话、卡米拉回话、教练先反应再说话、卡米拉收尾。重点看 s3 教练那段是否比旧版自然。

sha256: 2b489ab2901c2829bf51ecea516445fe11c79e9985f66d322db826a4395459b1

这条 proof 怎么拼出来

a0

摔倒铺垫

用已有片段。

s1

教练训话

用已有对齐片段。

s2

卡米拉回话

用已有对齐片段。

s3a

教练反应

无配音,嘴不说话。

s3b

教练说话

带配音,嘴跟着音。

s4

卡米拉收尾

用已有对齐片段。

这就是现在的判断:反应和台词不要塞在同一个 Seedance 片段里。反应镜头不给音频;说话镜头才给音频。

每段源片段

a0 摔倒铺垫

来自 cc-align 的现有片段。

s1 教练训话

来自 cc-align 的现有片段。

s2 卡米拉回话

来自 cc-align 的现有片段。

s3a 教练反应

无音反应片段。这里要看嘴是不是只在惊讶,不是在说话。

s3b 教练说话

纯说话片段。这里要看开口是否从前面就跟着声音。

s4 卡米拉收尾

来自 cc-align 的现有片段。

现在不要再走的路

不要再靠后处理猜 offset

  • 前面几版的问题不是一个固定延迟。
  • 不同段错法不同,猜一次只会修坏另一段。
  • s3 那种反应和说话焊在一起的片,后面很难救。

不要把 prompt 写回 runner

  • 故事、表演、镜头、时长都应该是 agent plan 数据。
  • runner 只读 plan、调 API、拼接。
  • template 之前必须先让你看本地 proof。

机器状态也一起放这

机器系统盘数据盘Dockerworker
worker2
43.153.208.102
27% /mnt/tobatsu-data
34%
/mnt/tobatsu-data/docker 12 个 slot online
mai 3×5, material 2×5, inquiry 2×1, test 5×1
worker3
43.134.66.32
22% /mnt/tobatsu-data
7%
/mnt/tobatsu-data/docker 12 个 slot online
mai 3×5, material 2×5, inquiry 2×1, test 5×1

slot 不是总并发。真并发要看每个 worker 的 --concurrency 参数。

下一步只做一件事

你先看完整 proof。 如果这条方向对,再把这套拆 beat 的规则写成 template。没通过就继续在本地 proof 上改,不碰线上。