DarkString
DarkString
《奥德赛》30 秒快切视频实验封面
← ArticlesDarkString / Field Notes
AI workflow / visual experiment

用 AI 把《奥德赛》压缩成 30 秒快切视频

先让 Agent 读懂原著,再把六种电影语法编译成一位虚构导演,最后把参考图和 Prompt 交给视频模型执行。

Gunner30 seconds9 / 18 node test

这不是“把整本书直接交给视频模型”,也不是用六层滤镜拼出一段奇观。真正的实验是:能否让一个 Agent 先完成阅读、取舍和风格编排,再把创作意图交给另一个模型执行。

Video / 04:52在 B 站打开
01

先定义问题:保住《奥德赛》,而不是讲完它

《奥德赛》同时拥有海难、生存、怪物、神谕、诱惑、冥界、复仇和返乡。30 秒不可能平均讲完所有章节,所以先保留一条能被看懂的核心弧线:离家、诱惑、失去、坚持、归家。

09
对照组:检查模型能否保住主线和人物身份。
18
压力组:检查高密度时间轴下的节点、转场和参考图遵从。

18 节点版本约有 20–24 次切镜,平均每个节点只有约 1.67 秒。每个节点只保留一个视觉锚点,不要把节点写成完整场景说明。

4.5–6.2 秒:木桩刺入独眼巨人的巨大眼睛,瞳孔的圆形高光匹配切到下一镜的羊群或风袋扣环;奥德修斯从左向右运动,保持暗红披风作为身份锚点。
02

让 Seed Evolving 统领全局

先让负责理解和规划的模型完成创作决策,视频模型只负责执行镜头。长文本、删减理由和导演规则留在中间产物中,避免最终 Prompt 变成一篇无法执行的文章。

Seed Evolving
全局理解与编排
处理长文本、长程规划和多步骤 Agent 任务,负责理解原著、做取舍并统领后续输出。
Seedream 5.0 Pro
视觉资产建立
把文字设定转化为角色、场景和道具参考图,为人物身份、时代材质和整体风格建立视觉基准。
Seedance 2.5
视频执行
同时接收提示词和参考图,把已经设计好的镜头、动作和转场执行成视频。

把下面的总控任务交给 Seed Evolving,要求它逐步输出故事图谱、时间轴、导演 Bible、参考图 Prompt 和最终视频 Prompt:

你是本次视觉实验的总导演和制作统筹。

请完整阅读我提供的《奥德赛》原著 PDF,不预先假定必须保留哪些章节。先提炼人物、目标、冲突、转折、重复意象、情绪变化和具有强视觉辨识度的事件,再将全书压缩成一支 30 秒、16:9 的快切概念片。

依次输出:故事图谱、候选事件评分、9 节点对照组、18 节点压力组、虚构导演 Bible、参考图 Prompt、中文 500 字以内的视频 Prompt,以及生成后的验收指标。

不要把所有细节塞进最终视频 Prompt。长文本理解和删减理由留在中间产物中,参考图承担人物与材质细节,视频 Prompt 只负责时间、动作、镜头运动和转场。
截图占位 · Seed Evolving 的任务总览:输入 PDF、输出文件,以及 9/18 节点实验设置。
03

六种电影语法,编译成一个虚构导演

不要把六位导演当作六层滤镜叠加。先确定 70% 的统一基调,再给章节增加最多一个 30% 的强化模块。这样既能让每一章有区别,又不会跳出同一部电影。

维伦纽瓦
巨大负空间、冷峻尺度、不可理解的神明
风暴、波塞冬、冥界
艾格斯
仪式现实主义、粗粝材质、原始宗教
献祭、喀耳刻、亡灵
德尔·托罗
怪物生命感、独特材质、悲悯
独眼巨人、塞壬、斯库拉
乔治·米勒
连续动能、身体失衡、极速生存
海难、巨浪、逃亡
大卫·洛维
时间沉淀、孤独、诗意的返乡
卡吕普索、伊萨卡、结尾
朴赞郁
几何构图、克制暴力、精确秩序
弓箭、求婚者、复仇

最终 Prompt 不直接要求“模仿某位导演”,而是使用巨大负空间、仪式现实主义、怪物生命感、连续动能、时间沉淀和几何复仇等可执行属性。每张参考图都必须先满足统一时代、色彩、材质和运动方向,再增加一个章节模块。

截图占位 · 导演 Bible:70% 统一规则、30% 章节模块,以及禁止混用的风格约束。
04

参考图先于视频

视频模型最容易丢失的是人物身份、时代材质和镜头之间的视觉连续性。因此先用 Seedream 5.0 Pro 建立可复用的视觉资产,再开始视频生成。

  1. 01奥德修斯一致性角色板
  2. 02佩涅洛佩与配角角色板
  3. 03神怪、动物、船与道具板
  4. 0418 张单场景关键帧
  5. 05SB-A:S01–S09 九宫格
  6. 06SB-B:S10–S18 九宫格

每张参考图分配唯一编号,例如 R01 代表奥德修斯角色板,R03 代表神怪板,SB-A 代表前半段九宫格。最终 Prompt 用编号关联图片,避免模型在每个镜头重新发明人物和世界观。

截图占位 · 参考图资产清单、角色板和道具板,标出每张图在最终 Prompt 中的用途。
05

最终 Prompt 不能写成一篇文章

中文提示词控制在 500 字以内,英文提示词控制在 1000 词以内。长文本留在 Seed Evolving,参考图承担外观和材质,最终 Prompt 只保留统一基调、时间节点、核心动作、转场和负面约束。

Keep

人物身份、时间戳、核心动作、参考图编号、转场锚点。

Move out

完整背景、重复形容词、删减理由、次要剧情和材质说明。

统一基调:晚期青铜时代爱琴海神话写实,深海钴蓝、旧铜金、余烬红,巨大负空间,真实自然材质,人物从左向右运动;参考 R01、R03、R04、SB-A、SB-B。

时间轴:
0–1.6 秒,佩涅洛佩在织机前收紧蓝线,匹配切到航线;
1.6–3.2 秒,黑船离开燃烧的特洛伊,奥德修斯回望;
3.2–4.8 秒,莲花岛上的水手倒下,奥德修斯拖走同伴;
4.8–6.2 秒,木桩刺入独眼巨人巨眼,瞳孔匹配切圆形扣环;
……
28.4–30 秒,橄榄树婚床旁两人相认,蓝线收拢成完整海图,首尾闭环。

要求:保持人物和时代材质一致;每个节点只发生一个主要动作;转场由海浪、织线、眼睛、弓弦和漩涡完成;无文字、字幕、水印、现代物件和畸形肢体。
截图占位 · 最终 Prompt、参考图关联标记、中文字符数,以及 9 节点和 18 节点长度对比。
06

不调用 API,手动提交视频

本案例让 Agent 把生成包准备到可以提交的程度,最后由创作者在 Seedance 2.5 控制台完成生成。这样每次提交的 Prompt、参考图和参数都能被截图和复盘。

  1. 01上传角色板、神怪/道具板和两张九宫格。
  2. 02按 Prompt 中的编号关联对应参考图。
  3. 03粘贴 9 节点或 18 节点视频 Prompt。
  4. 04设置 30 秒、720p、16:9,分别提交两组实验。
  5. 05保存生成参数、结果链接、耗时和失败原因。
截图占位 · Seedance 2.5 手动提交界面。发布截图前遮挡账号、项目名称、Token 和其他敏感信息。
07

用对照实验判断结果

不要只挑一条最好看的视频。用同一张表比较 9 节点和 18 节点版本,并保留失败案例:

叙事可读性
不看说明,能否感到这是一次远征后的归家?
节点遵从率
计划中的节点实际出现了多少个?是否出现在正确时间片?
人物一致性
奥德修斯跨越多个地点后,是否仍像同一个人?
基调一致率
时代、色彩、材质和神明尺度是否统一?
模块区分度
怪物、动作和复仇章节是否有差异但不跳戏?
转场成功率
海浪、织线、眼睛、弓弦和漩涡是否真正连接了镜头?

这套评价方式比“哪条更好看”更有信息量:它能说明模型在哪个约束下开始丢失信息,也能为下一轮 Prompt、参考图和节点数量调整提供依据。

截图占位 · 9 节点对照组与 18 节点压力组的时间轴、指标和失败原因。
Next experiment

同一组场景,换掉导演语法

如果继续做系列,可以固定“风暴、独眼巨人、塞壬、冥界、伊萨卡”五个场景,只替换导演语法,让观众直接看到同一个故事如何被重新解释。

Start a brief →