> ## Documentation Index
> Fetch the complete documentation index at: https://docs.cyberun.cloud/llms.txt
> Use this file to discover all available pages before exploring further.

# 工作方式

> 一页式走完 Cyberun Studio 五段式流程，从剧本到导出成片的全程。

Studio 项目按真实电影团队的工作顺序经过五个分段。任意分段一旦填充，你都可以反复回访；但新项目首次推进时，建议按列表顺序径直走下来。

```mermaid theme={null}
flowchart LR
    Story["Story<br/>script and structure"]
    World["World<br/>characters, places, props"]
    Assets["Assets<br/>locked references and variants"]
    Shots["Shots<br/>composition, takes, rough cut"]
    Dubbing["Dubbing<br/>music, voice, sound effects"]
    Export["Export<br/>finished cut"]

    Story --> World --> Assets --> Shots --> Dubbing --> Export
    Shots -.->|edit then only<br/>affected shots re-render| World
    Shots -.->|edit then only<br/>affected shots re-render| Assets
```

虚线箭头表示项目进行中你真正会反复经历的回路：某个镜头揭示了关于世界或某个资产的新事实，你在源头一处修正，只有引用该源头的镜头会重渲。这种外科手术式的重渲正是 Studio 资产优先设计的实际收益。

## 1. 故事

粘贴或输入剧本。Studio 读取后提出一份结构：

* **段落** ——故事的高层节拍（开场、转折、收尾）。
* **段落内的节拍** ——更小的叙事单元，相当于"她走过房间拿起照片"这种粒度。

你审阅提议的结构、修改偏离之处后确认。从此开始，其他每个分段都知道故事是什么，以及每个镜头属于哪一段节拍。

你在这里并未承诺最终结构。结构在项目的整个生命周期中都可编辑；这一段做的事，是给 Studio 的其余部分一个起始框架。

## 2. 世界

一个故事有一个世界。世界分段是描述它的地方：

* **角色** ——名字、外貌、服饰、声音以及任何连续性备注（"永远戴着挂坠"、"自第 3 个段落起左臂吊着绷带"）。
* **场景** ——故事发生的地点，配上参考图像和它们独特之处的备注。
* **道具** ——对故事有意义的物件。
* **阵营与关系** ——谁与谁结盟、谁认识谁、谁憎恨谁。

世界分段是每个镜头的真相来源。在这里编辑一个角色的外貌，会更新此后所有镜头都会使用的锁定参考。

## 3. 资产

如果世界捕捉的是 *谁* 和 *什么*，资产捕捉的就是 *样貌*。对每个角色、场景或主要道具，你锁定一份参考：

* 一张或多张定义视觉身份的参考图像。
* 关于哪些必须在镜头之间保持一致、哪些可以自由变化的备注。

资产一旦锁定，你可以让 Studio 生成它的 **变体** ——同一个角色换不同的着装、同一个场景在一天的不同时段、同一个道具从不同角度看。你说出想让它变化的维度（角度、时间、天气、地点、服装），Studio 从锁定参考生成变体，从而在仅改变那一个维度的同时保留身份。

这正是大多数 AI 视频管线丢失连续性的地方。在 Studio 中，每个变体都可追溯到一份锁定参考，所以第 2 个镜头中的角色与第 27 个镜头中的角色就是同一个角色。

## 4. 镜头

镜头是工坊。在这里你：

* **搭建镜头板。** 每段节拍成为一行；每个镜头成为该行上的一张卡片。
* **构图每个镜头。** 选取出现在镜头里的资产，描述相机意图（取景、焦距、运动），并生成开场帧。
* **执导镜次。** *镜次* 是镜头的一次生成版本。从构图好的开场帧生成一个或多个镜次。如果某个镜次符合你想要的，接受它；否则调整构图再生成下一个。
* **把镜头串成片段。** 一个镜头可以是单段短片，也可以是多段拼接以获得更长的连贯运动。
* **组装粗剪。** *粗剪* 是音频精修前的首次镜头组装。把已接受的镜次按你想要的顺序拖入。

镜头板还能在镜次上标记连续性问题——例如，如果生成镜次中角色的服装相对锁定资产发生了偏移，该镜次会被标记为待审核，之后再进入成片。

## 5. 配音

声音是最后一层：

* **音乐。** 描述你想要的乐曲——风格、情绪、速度、调性、时长以及可选的歌词——Studio 进行作曲。不同的乐句可以分配到成片的不同片段。
* **声音。** 提供一份参考语音样本，Studio 即可用该声音念出任何台词。语音克隆支持多语言，让你在不重新选角的情况下本地化。
* **音效。** Studio 监听视频并提出与画面相符的音效——门被打开时门的吱呀声。你可对每个效果进行批准、调整或替换。

当音频层就位时，粗剪就变成了成片。

## 导出

导出功能仍在开发中。当前主要产物是一份 **交接包**：一份记录已选镜次的可下载 JSON 清单，每个镜头都作为一个单元被带入——它的故事脉络、已选镜次、片段摘要、相机意图、声音方案以及就绪状态。清单会按包记录是否已有组装好的视频。

粗剪的单文件 **MP4** 作为早期 alpha 路径提供，由已选镜次和临时音频在本地组装得到。当本地组装不可用时，包内会保留一份可观看的网页预览作为如实的回退，让你仍能按顺序审看这一版剪辑。更完整的渲染输出已列入路线图。

## 概念

有两个想法贯穿每个分段。

### 资产优先

单提示词视频工具拿一句话尝试生成与之匹配的内容；如果下一段对不上上一段，唯一的修法就是再抽一次。

Studio 颠倒了这一点。在开始生成镜头之前，你先锁定每个复现元素——角色、场景、道具——的视觉身份。之后每个镜头都通过锁定解析身份，而不是通过一句文本。

实际后果：编辑一个角色改的是一份参考，不是二十个镜头。重渲是外科手术式的，不是整体项目级的。

### 故事结构词汇

Studio 对一个项目的各层级使用刻意的词汇，让同一个词在产品的任何地方都意味着同一件事：

| 术语     | 含义                              |
| ------ | ------------------------------- |
| **故事** | 整个项目——一个 Studio 项目对应一个故事。       |
| **段落** | 故事的一级章节。一部短片有三到六个段落。            |
| **节拍** | 段落内的叙事单元。"他走过去握住她的手"就是一个节拍。     |
| **镜头** | 单一相机取景。一段节拍由一个或多个镜头构成。          |
| **片段** | 连续的画面段落。一个镜头可以是一个片段，也可以由多个片段串联。 |

当产品中提到"节拍"或"镜头"时，它们的含义就是上述这个——各层级之间没有重叠或别名。

## 下一步

* [申请访问](/zh/studio/request-access) 来开启你自己的项目。
* 关于早期访问的咨询，请发邮件至 [sales@cyberun.cloud](mailto:sales@cyberun.cloud)。
