1. 故事
粘贴或输入剧本。Studio 读取后提出一份结构:- 段落 ——故事的高层节拍(开场、转折、收尾)。
- 段落内的节拍 ——更小的叙事单元,相当于”她走过房间拿起照片”这种粒度。
2. 世界
一个故事有一个世界。世界分段是描述它的地方:- 角色 ——名字、外貌、服饰、声音以及任何连续性备注(“永远戴着挂坠”、“自第 3 个段落起左臂吊着绷带”)。
- 场景 ——故事发生的地点,配上参考图像和它们独特之处的备注。
- 道具 ——对故事有意义的物件。
- 阵营与关系 ——谁与谁结盟、谁认识谁、谁憎恨谁。
3. 资产
如果世界捕捉的是 谁 和 什么,资产捕捉的就是 样貌。对每个角色、场景或主要道具,你锁定一份参考:- 一张或多张定义视觉身份的参考图像。
- 关于哪些必须在镜头之间保持一致、哪些可以自由变化的备注。
4. 镜头
镜头是工坊。在这里你:- 搭建镜头板。 每段节拍成为一行;每个镜头成为该行上的一张卡片。
- 构图每个镜头。 选取出现在镜头里的资产,描述相机意图(取景、焦距、运动),并生成开场帧。
- 执导镜次。 镜次 是镜头的一次生成版本。从构图好的开场帧生成一个或多个镜次。如果某个镜次符合你想要的,接受它;否则调整构图再生成下一个。
- 把镜头串成片段。 一个镜头可以是单段短片,也可以是多段拼接以获得更长的连贯运动。
- 组装粗剪。 粗剪 是音频精修前的首次镜头组装。把已接受的镜次按你想要的顺序拖入。
5. 配音
声音是最后一层:- 音乐。 描述你想要的乐曲——风格、情绪、速度、调性、时长以及可选的歌词——Studio 进行作曲。不同的乐句可以分配到成片的不同片段。
- 声音。 提供一份参考语音样本,Studio 即可用该声音念出任何台词。语音克隆支持多语言,让你在不重新选角的情况下本地化。
- 音效。 Studio 监听视频并提出与画面相符的音效——门被打开时门的吱呀声。你可对每个效果进行批准、调整或替换。
导出
导出功能仍在开发中。当前主要产物是一份 交接包:一份记录已选镜次的可下载 JSON 清单,每个镜头都作为一个单元被带入——它的故事脉络、已选镜次、片段摘要、相机意图、声音方案以及就绪状态。清单会按包记录是否已有组装好的视频。 粗剪的单文件 MP4 作为早期 alpha 路径提供,由已选镜次和临时音频在本地组装得到。当本地组装不可用时,包内会保留一份可观看的网页预览作为如实的回退,让你仍能按顺序审看这一版剪辑。更完整的渲染输出已列入路线图。概念
有两个想法贯穿每个分段。资产优先
单提示词视频工具拿一句话尝试生成与之匹配的内容;如果下一段对不上上一段,唯一的修法就是再抽一次。 Studio 颠倒了这一点。在开始生成镜头之前,你先锁定每个复现元素——角色、场景、道具——的视觉身份。之后每个镜头都通过锁定解析身份,而不是通过一句文本。 实际后果:编辑一个角色改的是一份参考,不是二十个镜头。重渲是外科手术式的,不是整体项目级的。故事结构词汇
Studio 对一个项目的各层级使用刻意的词汇,让同一个词在产品的任何地方都意味着同一件事:
当产品中提到”节拍”或”镜头”时,它们的含义就是上述这个——各层级之间没有重叠或别名。
下一步
- 申请访问 来开启你自己的项目。
- 关于早期访问的咨询,请发邮件至 sales@cyberun.cloud。
