skillZs
★ LIVE SKILL TAGS ★
>>> LIVE SKILLS INDEX <<<
* OPEN SOURCE *
NO LOGIN, NO TRACKING
※ REAL INSTALL DATA ※
← back to all skills
skills.volces.com117 installs

byted-drama-sd2

AI视频创作工具。支持漫剧、短剧、电影创作,从剧本到成片的全流程自动化。触发词:漫剧, 短剧, 电影, 动漫视频, 漫画视频, 剧情视频, 短视频创作, 漫剧生成, 动画制作, drama video

How do I install this agent skill?

npx skills add https://skills.volces.com --skill byted-drama-sd2
view source ↗

Is this agent skill safe to install?

No partner audit is available yet. Read the source before installing.

What does this agent skill do?

byted-drama-sd2 - AI 视频创作工具

从剧本到成片的全流程自动化,支持漫剧、短剧、电影等多种创作类型。

🎬 项目类型

类型说明适用场景
漫剧AI生成的动漫风格视频抖音/小红书短视频、故事号
短剧真人演绎的剧情短片短视频平台、广告片
电影完整的电影作品B站/YouTube长视频

🎨 风格选项

风格适用类型视觉特点
动漫漫剧通用动漫风格
日漫漫剧日式动画,大眼萌系/热血
美漫漫剧美式漫画,线条粗犷
国漫漫剧中国风,水墨/古风/现代国潮
电影短剧/电影电影级画面,写实风格
纪录片短剧/电影真实感,自然光效
真人短剧/电影真人实拍风格

工作流程

新建项目(指定风格) → 创建AssetGroup → 剧本创作(遵循项目风格,详细描述角色性别/年龄/外貌/穿着/佩戴) → 根据剧本角色描述生成角色参考图(使用项目风格) → 生成场景参考图(使用项目风格) → 上传素材(角色:TOS+Asset库,场景/道具:仅TOS) → 提示词优化(画风与项目风格一致) → 视频生成(自动注入项目风格) → 合成成片

⚠️ 风格一致性贯穿全流程:项目创建时指定的风格(如真人、动漫、电影等)必须在剧本创作、角色设定、参考图生成、提示词优化、视频生成等所有环节保持一致,确保最终成片的视觉风格统一。脚本通过 --project 参数自动注入风格提示词,同时剧本创作和提示词优化也必须主动遵循项目风格。

素材上传流程(重要)

不同类型素材的上传路径不同,这是确保角色一致性的关键设计:

素材类型上传步骤视频生成时传入原因
角色1. 上传TOS获取公网URL → 2. 上传Asset库获取asset://ID → 3. 等待Active状态asset:// 引用角色一致性要求最高,Asset库提供跨分镜的角色特征保持能力
场景/物料/道具上传TOS获取公网URLTOS公网URL场景/道具不需要跨分镜严格一致性,TOS公网URL即可满足需求

核心能力

1. 项目管理

  • 新建项目并创建项目文件夹
  • 项目配置持久化存储
  • 支持多项目并行
  • 项目信息:名称、类型、风格、创建时间

2. 素材管理(角色一致性核心)

  • 创建项目对应的AssetGroup
  • 角色参考图:上传TOS获取公网URL → 上传到Asset库获取asset://引用地址 → 等待状态变为Active
  • 场景参考图:上传TOS获取公网URL(无需上传Asset库)
  • 道具参考图:上传TOS获取公网URL(无需上传Asset库)
  • 物料参考图:上传TOS获取公网URL(无需上传Asset库)
  • 视频生成时:角色通过--reference-image-urls传入asset://引用,场景/道具/物料传入TOS公网URL

3. 剧本创作

  • 支持多集结构,每集独立成章
  • 每集必须先输出故事内容(剧情叙述),再输出该集的分镜内容
  • 分镜内容必须与故事内容高度一致,确保画面呈现与剧情叙述完全匹配
  • 每个分镜固定 15秒 时长
  • 每个分镜必须包含对白(角色之间的对话,必须项)和旁白(第三人称叙述,辅助项)
  • 对白是剧情推进的核心手段,每个分镜必须有角色之间的对话,禁止出现"对白:无"
  • 角色设定与视觉描述
  • 场景色调规划
  • ⚠️ 风格一致性要求:剧本中的角色外观描述、画面描述必须与项目风格匹配。角色描述必须包含性别、年龄、从头到脚的外貌特征、穿着打扮、佩戴信息等完整维度。例如:
    • 真人风格:角色描述必须写实具体,如"男,35岁,亚洲人,短发,肤色偏黄,方脸,高鼻梁,身高178cm,体型中等偏壮,穿着深灰色拉链夹克,内搭白色圆领T恤,深蓝色直筒牛仔裤,棕色皮鞋,左手腕佩戴银色金属手表",画面描述使用写实电影感语言
    • 动漫风格:角色描述必须符合动漫特征且同样详细,如"男,16岁动漫少年,蓝色碎发微翘,大眼睛琥珀色瞳孔,精致五官,肤色白皙,身高170cm,体型纤细,穿着白色短袖校服衬衫,深蓝色领带,黑色短裤,白色运动鞋,右腕佩戴红色编织手绳",画面描述使用动漫视觉语言
    • 国漫风格:角色描述融入中国风元素且同样详细,如"女,22岁,国漫风格,黑色长发及腰配玉色发簪,柳叶眉丹凤眼,肤色如瓷,身高165cm,体型纤细,穿着月白色交领汉服长裙,腰系淡青色丝带,白色绣花布鞋,左耳佩戴翠色玉坠",画面描述使用水墨/古风视觉语言
    • 禁止在真人风格项目中使用动漫化的描述,反之亦然

剧本格式规范

角色设定规范(每个角色必须按以下维度详细描述,为文生图提供精确输入):

### [角色定位] [角色名]
- **性别**:[男/女]
- **年龄**:[具体年龄或年龄段]
- **外貌特征**:[从头到脚的详细描述,包括:发型发色、脸型、五官特征、肤色、体型身高、特殊标记(疤痕/胎记/纹身等)]
- **穿着打扮**:[从头到脚的服装描述,包括:上衣、下装、外套、鞋子、颜色材质款式]
- **佩戴信息**:[饰品、配件、武器、道具等,如项链、耳环、手表、眼镜、帽子、背包等]
- **性格**:[性格特点]

关键要求:

  • 外貌描述必须具体到可绘制的程度,不能使用模糊表述(如"帅气"、"美丽"),必须用可视觉化的特征替代(如"高鼻梁、深眼窝、浓眉")
  • 穿着打扮必须从头到脚完整描述,不能只写"制服"而要写明"深蓝色立领制服上衣,金色肩章,黑色腰带,深蓝色直筒裤,黑色皮质长靴"
  • 佩戴信息要逐一列出,每个配饰都要说明位置、材质、颜色
  • 角色描述的详细程度直接决定文生图的质量,描述越精确,生成结果越符合预期

每集结构:

## 第X集:[集名]

### 故事内容
[本集的完整故事叙述,包括情节发展、角色互动、情感变化等,用文字详细描述]

### 分镜内容
#### 分镜 1 (0-15s)
- **画面**:[画面描述,必须与故事内容对应]
- **对白**:[角色对白,标注角色名和情绪,每个分镜必须有角色之间的对话]
- **旁白**:[旁白内容,补充叙事]
- **时长**:15秒
- **运镜**:[镜头运动]

#### 分镜 2 (15-30s)
- **画面**:[画面描述,必须与故事内容对应]
- **对白**:[角色对白,标注角色名和情绪,每个分镜必须有角色之间的对话]
- **旁白**:[旁白内容,补充叙事]
- **时长**:15秒
- **运镜**:[镜头运动]
...

关键规则:

  1. 分镜时长固定15秒:每个分镜统一为15秒,不可自定义时长
  2. 故事内容优先:每集必须先写故事内容,再写分镜,分镜是故事内容的画面化呈现
  3. 一致性要求:分镜中的画面描述必须严格对应故事内容中的情节,不能出现故事内容没有提及的画面
  4. 对白必填:每个分镜必须有角色之间的对话,对白是观众理解剧情的关键,禁止出现"对白:无"的情况;旁白为辅助项,用于补充叙事
  5. 对白与旁白的区别:对白是角色之间的直接对话,是剧情推进的主要手段;旁白是第三人称叙述或内心独白,起辅助补充作用
  6. 风格一致性要求:剧本中的角色外观描述和画面描述必须与项目风格严格匹配,真人风格项目使用写实描述,动漫风格项目使用动漫化描述,不可混用

剧本示例(星际迷航短剧)

# 星际迷航短剧:深空求救信号
> 类型: 漫剧 | 风格: 科幻动漫
> 时长: 60秒 | 画幅: 9:16竖屏

## 故事梗概
深空探索舰「进取号」收到来自未知星域的求救信号,舰长柯克带领船员前往调查,却发现信号来源是一艘失事的古老联邦星舰,藏着一个惊人的秘密...

## 角色设定
### 主角 柯克舰长
- **性别**:男
- **年龄**:35岁
- **外貌特征**:金棕色短发,偏分刘海,方脸轮廓分明,高鼻梁,深蓝色眼睛,浓眉,肤色白皙偏粉,身高185cm,体型健壮匀称,下颌线条硬朗
- **穿着打扮**:深绿色立领制服上衣,金色织带斜跨胸前,金色肩章,黑色皮质腰带,深绿色直筒裤,黑色皮质及膝长靴
- **佩戴信息**:左胸佩戴星际舰队金色徽章,腰间佩戴通讯器
- **性格**:果敢、机智,富有冒险精神

### 配角 斯波克大副
- **性别**:男
- **年龄**:30岁
- **外貌特征**:黑色齐耳直发,斜刘海,瓦肯人标志性尖耳朵,窄长脸,高颧骨,深棕色眼睛,细长眉形,肤色偏橄榄色,身高183cm,体型偏瘦长,表情克制内敛
- **穿着打扮**:深蓝色立领制服上衣,蓝色织带斜跨胸前,蓝色肩章,黑色皮质腰带,深蓝色直筒裤,黑色皮质及膝长靴
- **佩戴信息**:左胸佩戴星际舰队蓝色徽章,腰间佩戴三录仪
- **性格**:理性、逻辑缜密,凡事以数据说话

## 第一集:深空信号

### 故事内容
深空中,进取号星舰正在执行常规巡航任务。突然,舰桥的警报系统响起,控制台上闪烁着红色警示灯。斯波克迅速分析信号来源,发现这是一个使用百年前联邦加密频道的求救信号。柯克舰长决定改变航向,前往信号发出的未知星域调查。星舰在星云中穿行,逐渐接近信号源,一种不安的气氛在舰桥上蔓延。

### 分镜内容
#### 分镜 1 (0-15s)
- **画面**:深邃宇宙中,银色的进取号星舰缓缓航行,背景是绚丽的星云,镜头缓慢推近星舰舰桥
- **对白**:斯波克(平静):「舰长,目前巡航一切正常,未检测到异常信号」;柯克(随意):「很好,保持警戒,深空从来不缺意外」
- **旁白**:在银河系的边缘,星舰进取号正在进行第37次深空巡航,一切看似平静如常
- **时长**:15秒
- **运镜**:缓慢推近星舰舰桥

#### 分镜 2 (15-30s)
- **画面**:舰桥内,红色警报灯突然闪烁,控制台发出刺耳的提示音,斯波克从科学站抬头看向柯克
- **对白**:斯波克(冷静):「舰长,收到未知星域的求救信号,频率是100年前联邦舰队的加密频道」;柯克(警觉):「百年前的加密频道?这不可能,确认信号来源」
- **旁白**:然而,一道来自未知星域的信号打破了宁静
- **时长**:15秒
- **运镜**:切换到两人面部特写

#### 分镜 3 (30-45s)
- **画面**:柯克站在指挥台前,目光坚定地望向主屏幕上的星图,手指轻敲扶手,随后下达指令
- **对白**:柯克(果断):「改变航向,前往信号源。斯波克,我要知道那片星域的一切数据」;斯波克(犹豫):「舰长,那片星域从未被探索过,存在未知风险……」;柯克(坚定):「正因为未知,才更要去看看」
- **旁白**:百年前的加密频道——这意味着什么,柯克心中已有判断
- **时长**:15秒
- **运镜**:中景镜头,固定机位

#### 分镜 4 (45-60s)
- **画面**:进取号在绚丽的星云中穿行,舰身灯光在星云的映照下忽明忽暗,舰桥上船员们紧张地注视着主屏幕
- **对白**:斯波克(低声):「舰长,前方星域的辐射读数异常……建议降低航速」;柯克(沉声):「降速至曲速3级,全员进入一级战备状态」;船员(紧张):「是,舰长!」
- **旁白**:星舰驶入未知,每前进一步,真相便更近一步,而危险也在悄然逼近
- **时长**:15秒
- **运镜**:远景镜头,缓慢跟随星舰

4. 提示词优化(视频生成前必须执行)

  • 按照Seedance 2.0提示词规范优化每个分镜的提示词
  • 遵循主公式:时间 + 镜头运镜 + 精准主体 + 动作细节 + 场景环境 + 光影色调 + 声音设计 + 约束条件
  • 固定参数(时长、比例、画面大小、画风)单独列出,不混入正文
  • ⚠️ 画风必须与项目风格一致:固定参数中的"画风"字段必须与项目风格匹配(如项目风格为"真人",画风应写"写实电影感";项目风格为"动漫",画风应写"动漫风格")。脚本通过 --project 参数会自动注入英文风格提示词,但提示词正文中的画风描述也必须保持一致,不可冲突
  • 使用 @图片n 格式清晰指代参考素材,并说明每个素材的用途
  • 支持多镜头时间格式:0.0-2.0秒:... 2.0-4.0秒:...
  • 声音设计单独成行描述,与画面描述分开
  • 对白/旁白直接嵌入提示词,与画面描述自然融合
  • 结尾必须添加稳定性约束词
  • 优先写缓慢、连续、可衔接的小动作,写出动作之间的过渡
  • 用身体信号外化情绪,而非抽象情绪词
  • 每个镜头只指定1种主运镜方式

5. 视频片段生成(纯参考图模式,不使用首帧)

  • 使用 Seedance 2.0 API 通过参考图直接生成视频
  • 不使用首帧模式:直接通过 --reference-image-urls 传入参考素材生成视频
  • 角色参考:传入 asset:// 引用(role: "reference_image"),模型在整个视频中保持角色外观一致
  • 场景/道具/物料参考:传入 TOS 公网URL(role: "reference_image"),提供场景风格和道具细节
  • --reference-image-urls 中可混合传入 asset:// 和 https:// 格式的URL
  • 支持多镜头切换的时间格式提示词
  • 可选 AI 音效生成(generate_audio=true)

6. 视频合成

  • FFmpeg 合并视频片段
  • 可选字幕嵌入
  • 输出格式:MP4

项目结构

projects/
├── 项目名称/
│   ├── project.json        # 项目配置(含Asset引用信息)
│   ├── script.md           # 剧本文件
│   ├── narration.md        # 旁白台词
│   ├── video_prompts.md    # 视频提示词(优化后)
│   ├── subtitles.vtt       # 字幕文件
│   ├── references/         # 参考素材(角色/场景/道具)
│   │   ├── roles/          # 角色参考图
│   │   │   ├── role_柯克_三视图.png
│   │   │   └── ...
│   │   ├── scenes/         # 场景参考图
│   │   │   ├── scene_舰桥.png
│   │   │   └── ...
│   │   └── props/          # 道具参考图
│   ├── videos/             # 视频片段
│   ├── final/              # 最终成片
│   │   └── final_video.mp4
│   └── assets/             # 素材资源
│       ├── audio/
│       ├── images/
│       └── fonts/

项目配置 (project.json)

{
  "name": "赛博朋克之梦",
  "type": "drama",
  "style": "anime",
  "created_at": "2026-03-15T09:00:00+08:00",
  "updated_at": "2026-03-15T10:30:00+08:00",
  "resolution": "1440x2560",
  "ratio": "9:16",
  "duration": 60,
  "status": "in_progress",
  "asset_group_id": "group-2026xxxxxxx",
  "assets": {
    "roles": {
      "阿光": "asset://asset-2026xxxxxxx-abc1",
      "神秘人": "asset://asset-2026xxxxxxx-abc2"
    },
    "scenes": {
      "赛博城市": "https://bucket-name.tos-cn-beijing.volces.com/drama-projects/赛博朋克之梦/assets/scenes/scene_赛博城市.png",
      "控制室": "https://bucket-name.tos-cn-beijing.volces.com/drama-projects/赛博朋克之梦/assets/scenes/scene_控制室.png"
    },
    "props": {
      "机械臂": "https://bucket-name.tos-cn-beijing.volces.com/drama-projects/赛博朋克之梦/assets/props/prop_机械臂.png"
    }
  },
  "stats": {
    "frames_total": 29,
    "frames_generated": 15,
    "videos_generated": 10
  }
}

注意:assets.roles 中存储的是 asset:// 引用(角色需要上传到Asset库),assets.scenes 和 assets.props 中存储的是 TOS 公网URL(场景和道具只需上传到TOS)。

默认配置

漫剧 (drama)

  • 分辨率: 1440x2560 (9:16 竖屏)
  • 平台: 抖音、小红书
  • 时长: 30秒-3分钟

短剧 (short_film)

  • 分辨率: 1920x1080 (16:9 横屏)
  • 平台: 抖音、快手、B站
  • 时长: 1-10分钟

电影 (movie)

  • 分辨率: 1920x1080 或 3840x2160
  • 平台: B站、YouTube
  • 时长: 10分钟以上

新建项目流程

触发方式

用户: 新建一个项目
用户: 创建一个漫剧项目
用户: 我要做一个电影

交互流程

助手: 🎬 创建新项目

请输入项目名称:____

选择项目类型:
  1. 漫剧 (默认) - AI动漫风格短视频
  2. 短剧 - 真人剧情短片
  3. 电影 - 完整电影作品

选择风格:
  [漫剧] 动漫 | 日漫 | 美漫 | 国漫
  [短剧/电影] 电影 | 纪录片 | 真人

用户: 项目名:赛博朋克之梦,类型:漫剧,风格:动漫

助手: ✅ 项目创建成功!

📁 项目目录: projects/赛博朋克之梦/
📋 项目配置:
   - 类型: 漫剧
   - 风格: 动漫
   - 分辨率: 1440x2560
   - 画幅: 9:16

接下来可以:
1. 创作剧本 - "帮我写一个1分钟的赛博朋克故事"
2. 上传素材 - "上传参考图片或背景音乐"
3. 设置角色 - "设定主角的外观和性格"

API 配置

Seedream(图片生成)

  • Endpoint: https://ark.cn-beijing.volces.com/api/v3/images/generations
  • Model: doubao-seedream-4-5-251128(或用户配置的 endpoint)

Seedance 2.0(视频生成,默认)

  • Endpoint: https://ark.cn-beijing.volces.com/api/v3/contents/generations/tasks
  • Model: doubao-seedance-2-0-260128
  • Fast Model: doubao-seedance-2-0-fast-260128
  • 关键能力:
    • 多模态参考:图片参考(0-9张)、视频参考(0-3个)、音频参考(0-3个)
    • Asset素材库:通过asset://引用确保角色一致性(场景/道具使用TOS公网URL)
    • 视频编辑、视频延长
    • 联网搜索增强
    • 生成有声视频

Seedance 1.5(视频生成,兼容旧版)

  • Endpoint: https://ark.cn-beijing.volces.com/api/v3/contents/generations/tasks
  • Model: doubao-seedance-1-5-pro-251215

重要规则

⚠️ 角色一致性保障(核心规则)

方案:使用 Seedance 2.0 的纯参考图模式(R2V),不使用首帧,直接通过参考图生成视频:

  1. 角色参考:角色参考图通过 --reference-image-urls 传入 asset:// 引用(role: "reference_image"),模型在整个视频中保持角色外观一致
  2. 场景参考:场景参考图通过 --reference-image-urls 传入 TOS 公网URL(role: "reference_image"),提供场景风格参考
  3. 道具/物料参考:道具/物料参考图通过 --reference-image-urls 传入 TOS 公网URL(role: "reference_image"),提供道具细节参考

完整流程:

1. 从剧本角色设定中提取性别、年龄、外貌特征、穿着打扮、佩戴信息 → 组合为英文提示词 → 生成角色参考图(三视图)→ 上传TOS获取公网URL → 上传到Asset库 → 获取 asset:// 引用 → 等待状态Active
2. 生成场景参考图 → 上传TOS获取公网URL(无需上传Asset库)
3. 生成道具参考图 → 上传TOS获取公网URL(无需上传Asset库)
4. 优化提示词(按Seedance 2.0规范)
5. 生成视频时传入参考素材:
   --reference-image-urls "asset://角色1,asset://角色2,https://场景1的TOS公网URL,https://道具1的TOS公网URL"
   -p "@图片1的XX角色形象,@图片2的YY角色形象,@图片3的场景风格,@图片4的道具细节,[画面描述]。声音设计:[音效]。约束条件:[稳定性要求]。"
   (不使用 -f 首帧参数)

提示词引用规则(Seedance 2.0 专属):

  • 必须使用 @图片n 格式引用参考素材,n为同类素材在请求中的排序(从1开始)
  • 引用时必须明确说明每个素材的用途
  • 正确:@图片1的柯克舰长形象,@图片2的舰桥场景风格
  • 错误:参考asset://asset-xxx的柯克舰长形象(不能用Asset ID指代)
  • 所有通过 --reference-image-urls 传入的图片都参与编号(无论 asset:// 还是 https:// 格式)

示例命令:

# 纯参考图模式生成视频(角色用asset://,场景用TOS公网URL,自动注入项目风格)
./scripts/generate_video_2.0.sh \
  -p "@图片1的阿光角色形象,@图片2的赛博城市场景风格,中景镜头,阿光站在废墟中仰望天空,镜头缓慢上移。声音设计:阿光低声自语:"这座城市还有希望吗?"约束条件:面部稳定不变形,动作自然流畅。禁止:任何字幕、文字、LOGO或水印;禁止BGM背景音乐和环境音效,只允许人物对话和旁白声音。" \
  --reference-image-urls "asset://asset-2026xxxx-abc1,https://bucket-name.tos-cn-beijing.volces.com/drama-projects/赛博朋克之梦/assets/scenes/scene_赛博城市.png" \
  --project "赛博朋克之梦" \
  -o videos/video_01.mp4

# 多角色+场景+道具 + 多镜头时间格式(自动注入项目风格)
./scripts/generate_video_2.0.sh \
  -p "时长:10秒
比例:9:16
画风:赛博朋克冷蓝紫色调

0.0-3.0秒:远景镜头,缓慢推近。@图片1的阿光角色形象,@图片2的神秘人角色形象,@图片3的赛博城市场景,两人在废墟中对峙,冷灰色调中带有粉色和青色霓虹残影。声音设计:旁白:"两人在废墟中对峙,气氛紧张。"约束条件:人物动作连贯自然。禁止:任何字幕、文字、LOGO或水印;禁止BGM背景音乐和环境音效,只允许人物对话和旁白声音。

3.0-7.0秒:中近景镜头,固定机位。阿光机械臂蓝光亮起,@图片4的机械臂道具细节,紧张氛围升级,借着刚才抬手的惯性手指微微握拳。声音设计:阿光低声说:"你到底是谁?"约束条件:面部稳定不变形,五官清晰。禁止:任何字幕、文字、LOGO或水印;禁止BGM背景音乐和环境音效,只允许人物对话和旁白声音。

7.0-10.0秒:特写镜头,缓慢推镜。两人面部特写交替切换,阿光眼神坚定,神秘人嘴角微微上扬。声音设计:神秘人冷笑道:"你不该来这里。"约束条件:面部稳定不变形,动作自然流畅,无卡顿无闪烁。禁止:任何字幕、文字、LOGO或水印;禁止BGM背景音乐和环境音效,只允许人物对话和旁白声音。" \
  --reference-image-urls "asset://asset-abc1,asset://asset-abc2,https://bucket-name.tos-cn-beijing.volces.com/scene_赛博城市.png,https://bucket-name.tos-cn-beijing.volces.com/prop_机械臂.png" \
  --project "赛博朋克之梦" \
  -t 10 \
  -o videos/video_01.mp4

⚠️ 素材管理规则

  • 每个项目必须创建AssetGroup:新建项目后立即创建
  • 角色参考图必须上传为Asset:生成角色参考图后,先上传TOS获取公网URL,再上传到Asset库获取asset://引用,等待状态变为Active
  • 场景参考图只需上传TOS:生成场景参考图后,上传TOS获取公网URL即可,无需上传Asset库
  • 道具参考图只需上传TOS:生成道具参考图后,上传TOS获取公网URL即可,无需上传Asset库
  • 物料参考图只需上传TOS:生成物料参考图后,上传TOS获取公网URL即可,无需上传Asset库
  • 引用必须保存到project.json:在assets.roles中记录角色的asset://引用,在assets.scenes和assets.props中记录TOS公网URL
  • 角色Asset状态必须为Active:上传后需轮询等待Asset状态变为Active才能使用
  • 角色参考图生成限制:生成角色参考图时,必须确保纯白色背景、图中不能出现任何文字信息(字母、汉字、数字、LOGO、水印等),使用21:9比例
  • 场景参考图生成限制:生成场景参考图时,必须排除血腥暴力词汇,使用安全替代描述,比例必须与项目画面比例保持一致(从project.json的ratio字段获取)

素材管理命令:

# 创建项目AssetGroup
./scripts/asset_manager.sh create-group "项目名称"

# 上传角色参考图(TOS + Asset库,返回 asset:// 引用地址)
./scripts/asset_manager.sh upload-role "项目名称" "references/roles/role_阿光_三视图.png" "阿光"

# 上传场景参考图(仅TOS,返回公网URL)
./scripts/asset_manager.sh upload-scene "项目名称" "references/scenes/scene_赛博城市.png" "赛博城市"

# 上传道具参考图(仅TOS,返回公网URL)
./scripts/asset_manager.sh upload-prop "项目名称" "references/props/prop_机械臂.png" "机械臂"

# 上传物料参考图(仅TOS,返回公网URL)
./scripts/asset_manager.sh upload-material "项目名称" "references/materials/mat_xxx.png" "物料名称"

# 查询角色Asset状态
./scripts/asset_manager.sh get-asset-status "asset-2026xxxxxxx"

⚠️ 项目管理

  • 所有创作必须在项目内进行
  • 新建项目时必须提供项目名称
  • 类型默认为"漫剧",风格默认为"动漫"
  • 项目文件夹路径:~/workspace/agent/workspace/projects/<项目名称>/

⚠️ 风格一致性规则(核心规则)

  • 项目风格必须在全流程中保持一致:创建项目时指定的风格,在后续所有环节必须严格遵循,确保视觉风格统一。风格一致性覆盖以下全流程:
    1. 剧本创作:角色外观描述、画面描述必须与项目风格匹配(真人项目用写实描述,动漫项目用动漫化描述)
    2. 角色参考图生成:从剧本角色设定中提取性别、年龄、外貌特征、穿着打扮、佩戴信息,组合为英文提示词,提示词中的角色描述必须匹配项目风格,调用 generate_image.sh 时传入 --project 参数自动注入风格
    3. 场景参考图生成:提示词中的场景描述必须匹配项目风格,调用 generate_image.sh 时传入 --project 参数自动注入风格
    4. 提示词优化:固定参数中的"画风"必须与项目风格对应,正文中的视觉描述必须与项目风格一致
    5. 视频生成:调用 generate_video_2.0.sh 时传入 --project 参数,脚本自动注入英文风格提示词
  • 自动注入机制:所有生成脚本(generate_image.sh、generate_video_2.0.sh、generate_video.sh)通过 --project 参数读取 project.json 中的风格配置,自动将风格提示词追加到用户提示词末尾
  • 调用时必须传入 --project 参数:生图和生视频时,必须传入 --project "项目名称",脚本会自动从项目配置中读取风格并注入,无需手动在提示词中重复指定风格
  • 风格映射表:
风格值 (style)风格标签 (style_label)注入的英文风格提示词画风应填写角色描述风格
anime动漫anime style, Japanese anime aesthetic, vibrant colors, clean lines动漫风格动漫化详细描述(性别+年龄+发型发色+大眼睛+五官+肤色+体型+穿着+佩戴)
japanese_anime日漫Japanese anime style, detailed anime aesthetic, cel-shaded, expressive eyes日式动漫风格日漫特征详细描述(性别+年龄+赛璐璐+大眼萌系+发型+穿着+佩戴)
american_comic美漫American comic book style, bold outlines, dynamic shading, graphic novel aesthetic美式漫画风格美漫特征详细描述(性别+年龄+粗犷线条+动态阴影+发型+穿着+佩戴)
chinese_anime国漫Chinese anime style, guofeng aesthetic, ink wash influences, modern Chinese animation国漫风格国风特征详细描述(性别+年龄+水墨+古风+发型+穿着+佩戴)
movie电影cinematic style, photorealistic, film grain, dramatic lighting, movie-quality rendering写实电影感写实详细描述(性别+年龄+真实肤色+自然光影+发型+穿着+佩戴)
documentary纪录片documentary style, natural lighting, realistic, authentic atmosphere, observational cinematography纪实风格纪实详细描述(性别+年龄+自然光效+真实感+发型+穿着+佩戴)
live_action真人live action style, photorealistic, natural skin tones, real-world lighting, cinematic realism写实真人风格写实详细描述(性别+年龄+真人质感+自然肤色+发型+穿着+佩戴)
  • 禁止手动覆盖风格:提示词中不应再手动添加与项目风格冲突的风格描述,避免风格混乱
  • 禁止风格混用:真人风格项目中禁止使用动漫化的角色/场景描述,动漫风格项目中禁止使用写实化的角色/场景描述
  • 同时自动注入画面比例:generate_video_2.0.sh 和 generate_video.sh 在传入 --project 时,还会自动从项目配置读取 ratio 字段,无需手动指定 -g 参数

⚠️ 成本控制

  • 视频生成成本高,批量操作前必须获得用户确认
  • 估算成本后再执行
  • 提供预览选项(发送单张图片/视频供确认)

⚠️ TTS 限制

  • 当前环境无 TTS(文字转语音)能力
  • 旁白配音需用户自行处理或提供 TTS API
  • Seedance 的 generate_audio 仅生成环境音效,非人声旁白

⚠️ 角色参考图规范

角色参考图必须使用统一格式,确保角色一致性:

  • 比例:21:9 宽屏比例
  • 背景:纯白色背景(便于抠图和合成)
  • 禁止文字:图片中不能出现任何文字信息(包括字母、汉字、数字、LOGO、水印、签名等),确保角色图纯净无干扰
  • 构图(从左到右排列,无重叠,间隔均匀):
    1. 左侧:超大清晰人物面部特写
    2. 右侧依次:全身正面视图、全身侧面视图、全身背面视图
  • 细节要求:所有全身视图必须完整展示人物的鞋子
  • 用途:作为分镜生成时的角色一致性参考

⚠️ 提示词来源规则(核心规则): 角色参考图的文生图提示词必须直接来源于剧本中角色设定的详细信息,按以下方式将角色描述转化为提示词:

  1. 提取角色描述:从剧本的角色设定中提取该角色的性别、年龄、外貌特征、穿着打扮、佩戴信息
  2. 组合为提示词:将提取的描述信息按"性别+年龄+外貌特征(发型发色+脸型+五官+肤色+体型身高+特殊标记)+穿着打扮(从头到脚)+佩戴信息"的顺序组合,填入提示词模板的 [角色详细描述] 位置
  3. 禁止遗漏或改写:提示词中的角色描述必须与剧本角色设定完全一致,不能遗漏任何维度信息,也不能用模糊表述替代具体描述

转换示例:

剧本角色设定:
- 性别:男
- 年龄:35岁
- 外貌特征:金棕色短发,偏分刘海,方脸轮廓分明,高鼻梁,深蓝色眼睛,浓眉,肤色白皙偏粉,身高185cm,体型健壮匀称,下颌线条硬朗
- 穿着打扮:深绿色立领制服上衣,金色织带斜跨胸前,金色肩章,黑色皮质腰带,深绿色直筒裤,黑色皮质及膝长靴
- 佩戴信息:左胸佩戴星际舰队金色徽章,腰间佩戴通讯器

↓ 转换为提示词 ↓

Character reference sheet, 21:9 aspect ratio, pure white background, NO TEXT, NO LETTERS, NO CHARACTERS, NO WATERMARK, NO WRITING, layout from left to right: [LEFT SIDE: LARGE close-up face portrait of the character, CLEAR AND DETAILED], then full body front view, full body side view, full body back view, all three full body views clearly show the character's shoes, equal spacing between each section, no overlapping. Male, 35 years old, short golden-brown hair with side-parted bangs, square face with defined jawline, high nose bridge, deep blue eyes, thick eyebrows, fair skin with pink undertone, 185cm tall, muscular and well-proportioned build, wearing deep green stand-collar uniform top with gold cross-body braiding and gold epaulettes, black leather belt, deep green straight-leg pants, black leather knee-high boots, gold Starfleet badge on left chest, communicator on belt. Professional character design sheet, clean horizontal layout, consistent character features in all views, high detail, 8K, absolutely no text or writing of any kind
尺寸: 3440x1440
  • ⚠️ 风格一致性要求:角色参考图的生成提示词必须与项目风格匹配,调用 generate_image.sh 时必须传入 --project 参数,脚本会自动注入项目风格提示词。不同风格的角色描述差异(描述必须包含性别、年龄、从头到脚的外貌特征、穿着打扮、佩戴信息):
    • 真人风格:描述必须写实具体,如"男,35岁亚洲男性,黑色短发,方脸,肤色偏黄,高鼻梁,身高178cm,体型中等偏壮,穿着深灰色拉链夹克,内搭白色圆领T恤,深蓝色直筒牛仔裤,棕色皮鞋,左手腕佩戴银色金属手表",生成真人质感角色图
    • 动漫风格:描述必须包含动漫特征且同样详细,如"男,16岁动漫少年,蓝色碎发微翘,大眼睛琥珀色瞳孔,精致五官,肤色白皙,身高170cm,体型纤细,穿着白色短袖校服衬衫,深蓝色领带,黑色短裤,白色运动鞋,右腕佩戴红色编织手绳",生成动漫质感角色图
    • 国漫风格:描述融入中国风元素且同样详细,如"女,22岁,国漫风格,黑色长发及腰配玉色发簪,柳叶眉丹凤眼,肤色如瓷,身高165cm,体型纤细,穿着月白色交领汉服长裙,腰系淡青色丝带,白色绣花布鞋,左耳佩戴翠色玉坠",生成国漫质感角色图
    • 禁止在真人风格项目中生成动漫风格的角色参考图,反之亦然

示例提示词模板:

Character reference sheet, 21:9 aspect ratio, pure white background, NO TEXT, NO LETTERS, NO CHARACTERS, NO WATERMARK, NO WRITING, layout from left to right: [LEFT SIDE: LARGE close-up face portrait of the character, CLEAR AND DETAILED], then full body front view, full body side view, full body back view, all three full body views clearly show the character's shoes, equal spacing between each section, no overlapping. [从剧本角色设定中提取:性别+年龄+外貌特征+穿着打扮+佩戴信息,翻译为英文]. Professional character design sheet, clean horizontal layout, consistent character features in all views, high detail, 8K, absolutely no text or writing of any kind
尺寸: 3440x1440

⚠️ 场景参考图规范

场景参考图必须遵循以下规范,确保场景能正常生成且与项目画面比例一致:

  • 比例:必须与项目画面比例(project.json 中的 ratio 字段)保持一致
    • 漫剧(9:16 竖屏):尺寸 1440x2560
    • 短剧(16:9 横屏):尺寸 2560x1440
    • 电影(16:9 横屏):尺寸 2560x1440
    • 其他比例按项目实际配置调整
  • 禁止血腥暴力内容:场景描述和提示词中不能包含血腥、暴力、恐怖等敏感词汇,避免触发内容审核导致生成失败
    • 禁止词汇包括但不限于:血、杀、死、暴力、砍、刺、枪击、爆炸、尸体、伤口、流血、折磨、酷刑等
    • 需要表达冲突或紧张氛围时,使用替代性描述:对峙、紧张气氛、冲突、追逐、闪避等
  • 内容安全:场景图应呈现环境氛围和空间感,避免包含任何可能触发审核的敏感内容
  • 用途:作为分镜生成时的场景风格参考
  • ⚠️ 风格一致性要求:场景参考图的生成提示词必须与项目风格匹配,调用 generate_image.sh 时必须传入 --project 参数,脚本会自动注入项目风格提示词。不同风格的场景描述差异:
    • 真人风格:场景描述必须写实,如"破旧的工业厂房,锈迹斑斑的钢梁,昏暗的灯光",呈现真实质感
    • 动漫风格:场景描述可包含动漫视觉元素,如"赛博朋克城市,霓虹灯光,动漫风格渲染",呈现动画质感
    • 国漫风格:场景描述融入中国风元素,如"古风庭院,水墨渲染,竹林掩映",呈现国风质感
    • 禁止在真人风格项目中生成动漫风格的场景参考图,反之亦然

场景提示词安全替换示例:

原始描述(禁止)安全替换(推荐)
鲜血淋漓的战场硝烟弥漫的战场
被杀害的角色倒地角色倒地失去意识
刀刺入身体紧张对峙的瞬间
血流成河激烈冲突后的寂静
暴力打斗场面紧张的追逐与闪避

示例提示词模板(9:16竖屏漫剧):

Scene reference image, 9:16 aspect ratio, [场景详细描述,不含任何血腥暴力词汇], [风格描述], atmospheric lighting, high detail, 8K, no blood, no violence, no gore, safe content
尺寸: 1440x2560

示例提示词模板(16:9横屏短剧/电影):

Scene reference image, 16:9 aspect ratio, [场景详细描述,不含任何血腥暴力词汇], [风格描述], atmospheric lighting, high detail, 8K, no blood, no violence, no gore, safe content
尺寸: 2560x1440

⚠️ 用户确认流程

  • 视频片段生成后:必须发送给用户确认
  • 合成最终视频后:必须发送给用户确认
  • 每个关键步骤都需要用户预览和确认

⚠️ 飞书文档输出规则

  • 创建飞书文档后:必须把文档链接发送给用户确认,不能只回答"已创建"
  • 确保用户能直接访问文档链接

⚠️ 剧本交付规则

  • 剧本创作或修改完成后:必须将完整的剧本内容主动发送给用户查看确认,不能只提示"修改完成"
  • 完整剧本包含:故事梗概、角色设定、每集故事内容、每集分镜的完整信息(画面、对白、旁白等)

⚠️ 剧本分镜规范规则

  • 分镜时长固定15秒:每个分镜统一为15秒时长,与 Seedance 2.0 单次生成上限对齐,不可自定义其他时长
  • 每集结构必须为"故事内容 + 分镜内容":先输出本集的完整故事叙述,再输出对应的分镜内容,不可只有分镜没有故事
  • 分镜与故事内容必须高度一致:分镜中的画面描述必须严格对应故事内容中的情节,不能出现故事内容未提及的画面或角色行为
  • 每个分镜必须包含对白和旁白:
    • 对白:角色之间的直接对话,标注角色名和情绪状态,每个分镜必须有角色之间的对话,这是观众理解剧情的关键
    • 旁白:第三人称叙述或内心独白,用于补充叙事、推进背景信息
    • 对白优先于旁白,对白是剧情推进的主要手段,旁白起辅助补充作用
    • 禁止出现"对白:无"的情况,每个分镜至少要有两个角色之间的一轮对话
  • 对白应丰富自然:对白要体现角色性格、推动剧情发展、表达角色情感,避免只有旁白没有角色互动的分镜

⚠️ 媒体文件发送规则

  • 生成的图片/视频需要发送给用户时:必须先将文件复制到/tmp/openclaw/目录下,再从该目录发送
  • 原因:飞书媒体上传仅允许访问/tmp/openclaw、/root/.openclaw/workspace等白名单目录
  • 示例流程:
    1. mkdir -p /tmp/openclaw/<项目名>/
    2. cp 原文件路径 /tmp/openclaw/<项目名>/
    3. 从/tmp/openclaw/路径发送文件

⚠️ 默认配置规则

  • 所有视频生成默认使用Seedance 2.0模型(generate_video_2.0.sh),不再默认使用 Seedance 1.5
  • 所有视频生成不使用首帧模式,采用纯参考图模式(--reference-image-urls)
  • 所有视频生成默认无水印,无需额外指定--no-watermark参数
  • 所有视频生成默认带音频,无需额外指定音频参数
  • 所有视频生成默认智能时长(duration=-1,自动匹配内容的最优长度)
  • 所有视频生成禁止BGM背景音效和环境音效,声音设计只能包含人物对话和旁白(提示词中必须声明此约束)
  • 所有视频生成禁止字幕,提示词中必须声明"禁止任何字幕、文字、LOGO或水印"
  • 视频生成时必须传入角色Asset引用(--reference-image-urls 中角色用 asset://,场景/道具用 TOS 公网URL),确保角色一致性
  • 提示词必须按 Seedance 2.0 规范优化后才能调用 API
  • 生图和生视频时必须传入 --project 参数,脚本会自动从项目配置中读取风格并注入到提示词中,确保全流程风格一致
  • 传入 --project 后,脚本还会自动读取项目画面比例(ratio),无需手动指定 -g 参数

⚠️ 分镜内容规范

Seedance 2.0 提示词优化规则(视频生成前必须执行)

每个分镜的提示词在调用 API 之前,必须按照以下规则进行优化。

核心原则:提示词不是堆砌形容词,而是写成"主体明确、动作连贯、镜头清楚、约束完整"的结构化表达。优先使用自然流畅的中文描述,Seedance 2.0 对自然语言理解能力很强。

提示词主公式

正文必须按以下顺序组织:

时间 + 镜头运镜 + 精准主体 + 动作细节 + 场景环境 + 光影色调 + 声音设计 + 约束条件

核心逻辑:

  1. 先用时间切开叙事
  2. 再说明这一段怎么拍
  3. 然后写清谁、在做什么
  4. 再补在哪里、什么氛围、什么光线
  5. 然后写声音设计(只能包含人物对话和旁白,禁止BGM背景音效和环境音效)
  6. 最后用约束条件收紧结果(必须包含禁止字幕和禁止BGM的声明)
固定参数与正文分离

固定参数(时长、比例、画面大小、画风)单独列在正文前,不要混在正文里反复出现:

时长:[X秒]
比例:[16:9 / 9:16 / 1:1]
画面大小:[2K / 4K]
画风:[必须与项目风格匹配]

⚠️ 画风与项目风格映射(强制规则):

固定参数中的"画风"必须与项目风格严格对应,不可随意填写或与项目风格冲突:

项目风格画风应填写说明
动漫 (anime)动漫风格日式动漫视觉,鲜艳色彩,干净线条
日漫 (japanese_anime)日式动漫风格精细动漫美学,赛璐璐渲染,大眼萌系
美漫 (american_comic)美式漫画风格粗犷线条,动态阴影,图像小说质感
国漫 (chinese_anime)国漫风格中国风美学,水墨影响,现代国潮
电影 (movie)写实电影感电影级画面,胶片质感,戏剧性光影
纪录片 (documentary)纪实风格自然光效,真实感,观察式摄影
真人 (live_action)写实真人风格真人实拍质感,自然肤色,电影级写实

禁止:在真人风格项目中填写"动漫风格"画风,或在动漫风格项目中填写"写实电影感"画风。

正文部分再按时间分镜逐段展开。

@引用系统(官方命名规范)

在提示词中使用 @ 引用上传的参考素材,明确说明每个素材的用途:

  • 图片:@图片1、@图片2、...、@图片9
  • 视频:@视频1、@视频2、@视频3
  • 音频:@音频1、@音频2、@音频3

引用时必须明确说明用途,例如:

  • @图片1的人物形象
  • 参考@视频1的运镜效果
  • 背景音乐参考@音频1

注意:@图片n 与 --reference-image-urls 中的顺序一一对应,编号从1开始连续编号,不能跳号。

提示词优化模板

单镜头模板:

@图片1的[角色名]角色形象,@图片2的[场景名]场景风格,[镜头类型],[角色动作描述],[场景环境描述],[光影/氛围描述],[风格描述]。声音设计:[角色对白或旁白]。约束条件:[稳定性要求]。禁止:任何字幕、文字、LOGO或水印;禁止BGM背景音乐和环境音效,只允许人物对话和旁白声音。

多镜头时间格式模板(一个分镜包含多个镜头切换时使用):

时长:[X秒]
比例:[16:9 / 9:16 / 1:1]
画风:[风格描述]

0.0-X秒:[镜头运镜]。@图片1的[角色名]角色形象,@图片2的[场景名]场景风格,[动作细节] + [场景环境] + [光影色调]。声音设计:[角色对白/旁白]。约束条件:[稳定性要求]。禁止:任何字幕、文字、LOGO或水印;禁止BGM背景音乐和环境音效,只允许人物对话和旁白声音。
X-Y秒:[镜头运镜]。[精准主体] + [动作细节] + [场景环境] + [光影色调]。声音设计:[角色对白/旁白]。约束条件:[稳定性要求]。禁止:任何字幕、文字、LOGO或水印;禁止BGM背景音乐和环境音效,只允许人物对话和旁白声音。
Y-Z秒:[镜头运镜]。[精准主体] + [动作细节] + [场景环境] + [光影色调]。声音设计:[角色对白/旁白]。约束条件:[稳定性要求]。禁止:任何字幕、文字、LOGO或水印;禁止BGM背景音乐和环境音效,只允许人物对话和旁白声音。
动作与运镜写法规则

动作写法:

  • 优先写缓慢、连续、可衔接的小动作(缓慢行走、轻轻抬手、微微低头、顺势坐下)
  • 尽量少写高强度、跳跃过大的动作(狂奔、大跳、剧烈翻滚)
  • 必须写出动作之间的过渡,例如:借着刚才转身的惯性继续向前、从停顿自然过渡到举手、先放慢脚步,再缓缓抬头

情绪外化:

  • 用身体信号替代抽象情绪词
  • 推荐:嘴角颤抖、眼眶渐红、肩膀微微抖动
  • 少用:很悲伤、非常愤怒

运镜写法:

  • Seedance 对中文运镜词理解力较强,可直接使用常见镜头语言
  • 一个镜头里尽量只指定1种主运镜方式,不要同时要求推、拉、摇、移
  • 运镜要求过多会明显增加画面不稳定性
声音设计规则
  • 声音设计单独成行,与画面描述分开
  • 格式:声音设计:[对白 / 旁白 / 动作音]
  • 对白用引号包裹,标注角色和情绪
  • 可指定音色参考:音色参考@音频1
  • ⚠️ 禁止 BGM 背景音效(强制规则):视频中不能出现任何背景音乐(BGM)或环境背景音效,声音设计只能包含以下两类:
    1. 人物对话:角色之间的直接对话,标注角色名和情绪
    2. 旁白/独白:第三人称叙述或内心独白
  • 禁止在声音设计中写入:背景音乐、BGM、环境音效、风声、雨声、脚步声、机械声等非人声音效
  • 正确示例:声音设计:阿光说:"我一定要找到真相。" 或 声音设计:旁白讲述阿光的决心
  • 错误示例:声音设计:风声呼啸,远处电流嗞嗞声 或 声音设计:BGM渐强,紧张氛围
稳定性约束词(必须添加)

在提示词结尾固定补一组稳定性要求,能显著降低变脸、掉脸、抖动、卡顿:

面部稳定不变形、五官清晰、人体结构正常、动作自然流畅、不僵硬、画面无卡顿、无闪烁
视频生成强制约束(必须添加)

每个视频生成提示词结尾必须添加以下两项强制约束:

1. 禁止字幕约束:

禁止:任何字幕、文字、LOGO或水印

2. 禁止BGM背景音效约束:

禁止:BGM背景音乐、环境音效,只允许人物对话和旁白声音

这两项约束与稳定性约束词一起,构成视频生成提示词的完整约束条件。

禁止项声明(按需添加)

在提示词结尾声明不需要的元素:

禁止:任何文字、字幕、LOGO或水印;不允许出现XXX

视频生成禁止项(必须添加):

禁止:任何字幕、文字、LOGO或水印;禁止BGM背景音乐和环境音效,只允许人物对话和旁白

角色参考图禁止项(必须添加):

禁止:任何文字、字母、数字、汉字、LOGO、水印、签名;纯白色背景以外的任何背景元素

场景参考图禁止项(必须添加):

禁止:血腥、暴力、恐怖、血、杀戮、尸体、伤口等敏感内容;不允许出现与项目画面比例不一致的构图
对白嵌入规则
  • 角色对白直接嵌入提示词中,用引号包裹
  • 格式:[角色名]说:"台词内容"
  • 可指定音色:[角色名](音色参考@音频1)说:"台词内容"
  • 台词只保留在该段最关键的位置,不要让整段都变成念白
原始文稿改写法

当剧本是文字剧情而非镜头化描述时,不要原样拼接台词,必须做镜头化改写:

  1. 先提取固定参数:总时长、比例、画面大小、画风
  2. 把原文拆成几个时间片
  3. 给每个时间片指定单一主镜头(全景/中景/中近景/过肩镜头/特写)
  4. 把台词转成可拍的身体动作、视线、停顿和表情
  5. 补场景环境、光影色调和环境音
  6. 最后补稳定性约束

改写原则:

  • 不要直接照抄"人物:XX;场景:XX;台词:……"
  • 要把文字剧情改成镜头内真正能看到的内容
  • 每段镜头尽量只承担一个主信息点
示例

单镜头提示词:

@图片1的阿光角色形象,@图片2的赛博城市场景风格,中景镜头,阿光站在废墟中仰望天空,破败的霓虹灯闪烁,冷灰色调中带有粉色和青色霓虹残影,镜头缓慢上移,赛博朋克风格。声音设计:阿光低声自语:"这座城市……还有希望吗?"。约束条件:面部稳定不变形,动作自然流畅。禁止:任何字幕、文字、LOGO或水印;禁止BGM背景音乐和环境音效,只允许人物对话和旁白声音。

多镜头时间格式提示词:

时长:10秒
比例:9:16
画风:赛博朋克冷蓝紫色调

0.0-3.0秒:远景镜头,缓慢推近。@图片1的阿光角色形象,@图片2的赛博城市场景风格,阿光在废墟中缓缓行走,脚步踩过碎玻璃,破败的霓虹灯闪烁,冷灰色调中带有粉色和青色霓虹残影。声音设计:旁白:"在废墟之中,他仍在寻找答案。"约束条件:人物动作连贯自然。禁止:任何字幕、文字、LOGO或水印;禁止BGM背景音乐和环境音效,只允许人物对话和旁白声音。

3.0-6.0秒:中近景镜头,固定机位。阿光抬头仰望天空,眼神坚定,破旧深灰色夹克随风飘动,借着刚才抬头的惯性目光缓缓扫过天际。声音设计:阿光低声说:"我不会放弃的。"约束条件:面部稳定不变形,五官清晰。禁止:任何字幕、文字、LOGO或水印;禁止BGM背景音乐和环境音效,只允许人物对话和旁白声音。

6.0-10.0秒:特写镜头,缓慢推镜。阿光的机械右臂微微反光,希望二字清晰可见,金属关节缓慢转动,从停顿自然过渡到手指微微握拳。声音设计:旁白:"机械臂上的希望二字,是他最后的信念。"约束条件:人体结构正常,动作自然流畅,无卡顿无闪烁。禁止:任何字幕、文字、LOGO或水印;禁止BGM背景音乐和环境音效,只允许人物对话和旁白声音。

历史情绪对话戏提示词:

时长:13秒
比例:16:9
画面大小:2K
画风:写实电影感

0.0-2.1秒:全景镜头,固定机位。画面呈现垓下楚营军帐内部,烛火在帐内摇曳,投下不安的影子,@图片1的项羽角色形象与@图片2的虞姬角色形象在案几两侧对坐,帐内隐约可见兵器与地图,氛围压抑凝重。声音设计:旁白:"垓下之夜,英雄末路。"约束条件:画面稳定,无多余人物乱入。禁止:任何字幕、文字、LOGO或水印;禁止BGM背景音乐和环境音效,只允许人物对话和旁白声音。

2.1-5.4秒:中景镜头,固定机位。画面聚焦虞姬,她双手平稳捧起青铜酒盏,轻柔而郑重地递向项羽方向,神色关切,目光专注。虞姬轻声问:"大王今日出战,胜负如何?"。声音设计:虞姬轻声问:"大王今日出战,胜负如何?"。约束条件:人物表情细腻稳定,动作自然。禁止:任何字幕、文字、LOGO或水印;禁止BGM背景音乐和环境音效,只允许人物对话和旁白声音。

5.4-8.7秒:过肩镜头,固定机位。以前景虞姬的肩部和递酒的手作为遮挡,焦点落在项羽身上。项羽眉头紧锁,低垂目光凝视酒盏,并未立刻去接,烛光从侧面打在他的脸上,阴影更深。声音设计:旁白:"项羽沉默不语,目光低垂。"约束条件:过肩构图稳定,焦点明确。禁止:任何字幕、文字、LOGO或水印;禁止BGM背景音乐和环境音效,只允许人物对话和旁白声音。

8.7-13.4秒:中近景镜头,固定机位。画面完全聚焦项羽,他缓缓抬手抚过眉头,随后沉重长叹,视线从酒盏移向虚空,身体姿态透露无力感。项羽低声道:"敌众我寡,难以取胜,此乃天亡我楚,非战之罪也!"。声音设计:项羽低声道:"敌众我寡,难以取胜,此乃天亡我楚,非战之罪也!"。约束条件:面部稳定不变形,动作自然流畅,无卡顿无闪烁。禁止:任何字幕、文字、LOGO或水印;禁止BGM背景音乐和环境音效,只允许人物对话和旁白声音。
提示词优化检查清单
  • 是否将固定参数(时长/比例/画面大小/画风)单独列出?
  • 是否使用 @图片n 格式引用了所有参考素材,并说明了每个素材的用途?
  • 是否按时间分镜组织正文,每段都包含"时间+镜头运镜+精准主体+动作细节+场景环境+光影色调"?
  • 动作是否为缓慢、连续、可衔接的小动作?是否写了动作之间的过渡?
  • 情绪是否用身体信号外化,而非抽象情绪词?
  • 每个镜头是否只指定了1种主运镜方式?
  • 声音设计是否单独成行描述?
  • 声音设计中是否只包含人物对话和旁白?是否已排除BGM背景音乐和环境音效?
  • 对白是否自然嵌入,且只在关键位置出现?
  • 是否添加了稳定性约束词?
  • 是否添加了"禁止字幕、文字、LOGO或水印"的约束?
  • 是否添加了"禁止BGM背景音乐和环境音效,只允许人物对话和旁白"的约束?
  • 参考图编号是否与 --reference-image-urls 中的顺序完全一致?
  • 角色参考图:是否包含"纯白色背景"和"禁止文字"约束(NO TEXT, NO LETTERS, NO WATERMARK)?
  • 场景参考图:是否排除了血腥暴力词汇?是否使用了安全替代描述?
  • 场景参考图:比例是否与项目画面比例(project.json中的ratio)保持一致?
  • 风格一致性:生图和生视频时是否传入了 --project 参数,确保项目风格自动注入?提示词中是否避免了与项目风格冲突的手动风格描述?
  • 画风与项目风格匹配:固定参数中的"画风"是否与项目风格严格对应(如真人项目→写实电影感,动漫项目→动漫风格)?是否避免了风格混用?
  • 角色描述风格匹配:角色外观描述是否与项目风格匹配(真人项目用写实描述,动漫项目用动漫化描述)?
  • 场景描述风格匹配:场景描述是否与项目风格匹配(真人项目用写实场景,动漫项目用动漫场景)?
镜头语言词汇库
类别关键词
景别大远景、远景、全景、中景、近景、特写、大特写
运镜推镜头、拉镜头、摇镜头、移镜头、跟拍、环绕拍摄、航拍、手持跟拍、希区柯克变焦
角度平视、俯拍、仰拍、低角度、鸟瞰视角、鱼眼镜头、第一人称视角、主观视角
节奏慢动作、快切、延时摄影、一镜到底、升格拍摄、硬切、卡点
焦点浅景深、深景深、焦点转移、虚化背景、选择性对焦
特殊遮挡擦镜转场、无缝渐变转场、环绕摇镜快切特写、定格慢放
风格词汇库
类别关键词
画面质感电影感、胶片质感、高清晰度、8K分辨率、HDR、RAW质感、4K医学CGI
影像风格好莱坞大片、独立电影、纪录片、MV风格、广告大片、Vlog风格、2.35:1宽银幕
色调氛围暖色调、冷色调、高对比度、低饱和度、莫兰迪色系、赛博朋克霓虹、红金高饱和
艺术风格写实主义、超现实主义、极简主义、蒸汽波、赛博朋克、中国风水墨、3D国漫CG
光影效果自然光、侧逆光、丁达尔效应、霓虹灯光、月光、黄金时段光线、体积光
动画风格中国奇幻动画电影风格、超精细CG动画、日漫赛璐璐、3D渲染写实
超长视频分段拼接策略(>15秒)

Seedance 2.0 单次生成上限为15秒。超过15秒的视频采用分段生成+视频延长拼接:

  1. 将总时长按叙事节奏切分为多个片段,每段≤15秒
  2. 每段之间必须有画面衔接点:上一段的结尾状态 = 下一段的开始状态
  3. 第一段正常生成,后续每段使用「将@视频1延长Xs」的格式
  4. 每段都要标注清楚属于整体的第几段、承接内容是什么

分段时长建议:

总时长推荐分段
16-30秒2段(首段15秒 + 延长段)
31-45秒3段
46-60秒4段
>60秒建议拆分为独立场景分别生成,再用剪辑软件拼接

参考图引用规则

Seedance 2.0 视频提示词引用规则(重要):

  • 必须使用 @图片N 格式引用参考素材,N为同类素材在请求中的排序(从1开始计数)
  • 所有通过 --reference-image-urls 传入的图片都参与编号
  • 编号顺序:按 --reference-image-urls 中传入的顺序从1开始
  • 引用时必须明确说明每个素材的用途(如 @图片1的人物形象、@图片2的场景风格)

通用编号规则:

  1. 编号规则:传入的参考图从 @图片1 开始连续编号,不能跳号
  2. 提示词格式:
    • 在提示词中明确引用参考图并说明用途(如 @图片1的阿光角色形象)
    • 提示词末尾用注释说明每个图是什么(如 // 图1是阿光角色,图2是赛博城市场景)
  3. API调用顺序:参考图的传入顺序必须与提示词中的编号顺序完全一致,不能颠倒

参考图类型:

  • 角色参考图:白色背景三视图(全身正面、侧面、背面),通过 asset:// 引用传入
  • 场景参考图:关键场景的氛围和风格参考,通过 TOS 公网URL 传入
  • 道具参考图:重要道具的视觉参考(可选),通过 TOS 公网URL 传入

示例:

分镜:屋顶观星

传入参考图(--reference-image-urls):
- @图片1:asset://asset-xxx1(林远角色参考,asset://格式)
- @图片2:asset://asset-xxx2(小萱角色参考,asset://格式)
- @图片3:https://bucket-name.tos-cn-beijing.volces.com/scene_农场夜晚.png(农场夜晚场景参考,TOS公网URL格式)

提示词:
时长:8秒
比例:9:16
画风:温暖怀旧电影感

0.0-4.0秒:中景镜头,缓慢推近。@图片3的农场夜景氛围,@图片1的林远角色形象和@图片2的小萱角色形象并肩躺在农舍屋顶上,35岁亚洲男子林远侧身看向18岁亚洲女孩小萱,小萱拿着黄铜望远镜看星星,脸上洋溢着幸福的微笑,星光映照在她的眼中,温暖侧光。声音设计:林远轻声说:"你看,那颗最亮的星。"约束条件:人物表情细腻稳定。禁止:任何字幕、文字、LOGO或水印;禁止BGM背景音乐和环境音效,只允许人物对话和旁白声音。

4.0-8.0秒:特写镜头,固定机位。聚焦小萱的脸部特写,星光在她眼中闪烁,嘴角微微上扬,从停顿自然过渡到转头看向林远。声音设计:小萱笑着说:"嗯,好漂亮!"约束条件:面部稳定不变形,五官清晰。禁止:任何字幕、文字、LOGO或水印;禁止BGM背景音乐和环境音效,只允许人物对话和旁白声音。
// 图1是林远角色(asset://),图2是小萱角色(asset://),图3是农场夜晚场景(TOS URL)

注意事项:

  • 只有纯特写(如手部特写、物体特写)或抽象场景可以不传入参考图
  • 同一分镜中,参考图编号不能跳过(@图片1、@图片2、@图片3...,不能跳到@图片3)
  • 每个时间段的提示词中引用的素材编号必须与实际传入顺序一致

创建新项目

用户: 新建项目,名字叫"仙剑奇缘",类型短剧,风格真人

助手: ✅ 项目"仙剑奇缘"创建成功!
📁 项目目录: projects/仙剑奇缘/
📋 配置: 短剧 | 真人风格 | 1920x1080 (16:9)

正在创建AssetGroup...
✅ AssetGroup创建成功,ID: group-2026xxxxxxx

接下来可以:
1. 创作剧本 - "帮我写一个1分钟的仙侠故事"
2. 设定角色 - "设定主角的外观和性格"(生成后需上传TOS+Asset库)
3. 上传素材 - "上传场景/道具参考图片"(上传TOS获取公网URL)

切换项目

用户: 打开"赛博朋克之梦"项目

助手: 📂 已切换到项目"赛博朋克之梦"
   - 状态: 制作中
   - 进度: 15/29 分镜已完成

查看项目列表

用户: 我有哪些项目?

助手: 📋 项目列表:

1. 赛博朋克之梦
   类型: 漫剧 | 风格: 动漫 | 状态: 制作中
   进度: 15/29 分镜

2. 仙剑奇缘
   类型: 短剧 | 风格: 真人 | 状态: 刚创建
   进度: 0/0 分镜

批量生成确认

用户: 生成所有分镜的视频

助手: 
⚠️ 视频生成成本较高
- 项目: 赛博朋克之梦
- 分镜数量: 29个
- 预计耗时: ~30分钟
- 预计费用: [估算]

确认生成吗?

常见问题

问题解决方案
视频无音频使用 generate_audio=true 重新生成
需要旁白配音当前无 TTS,需用户提供音频或 API
文件太大无法发送使用 FFmpeg 压缩:-crf 28 -preset fast
角色不一致必须使用 --reference-image-urls 传入角色Asset引用(asset://格式),不能仅用首帧模式或TOS URL
场景不一致使用 --reference-image-urls 传入场景TOS公网URL
角色Asset引用无效检查Asset状态是否为Active,等待处理完成后再使用
场景/道具TOS URL无法访问检查TOS文件是否上传成功,确认ACL设置为公共读
视频URL过期Seedance 2.0生成的视频URL有效期24小时,需及时下载或转存TOS
项目找不到使用"查看项目列表"确认项目名称

脚本工具

new_project.sh - 创建新项目

./scripts/new_project.sh \
  --name "项目名称" \
  --type drama \
  --style anime

asset_manager.sh - 素材管理

# 创建项目AssetGroup
./scripts/asset_manager.sh create-group "项目名称"

# 上传角色参考图(TOS + Asset库,返回 asset:// 引用地址)
./scripts/asset_manager.sh upload-role "项目名称" "references/roles/role_阿光_三视图.png" "阿光"

# 上传场景参考图(仅TOS,返回公网URL)
./scripts/asset_manager.sh upload-scene "项目名称" "references/scenes/scene_赛博城市.png" "赛博城市"

# 上传道具参考图(仅TOS,返回公网URL)
./scripts/asset_manager.sh upload-prop "项目名称" "references/props/prop_机械臂.png" "机械臂"

# 上传物料参考图(仅TOS,返回公网URL)
./scripts/asset_manager.sh upload-material "项目名称" "references/materials/mat_xxx.png" "物料名称"

# 查询角色Asset状态
./scripts/asset_manager.sh get-asset-status "asset-id"

generate_image.sh - 图片生成

# 生成分镜帧(默认模式,自动注入项目风格)
./scripts/generate_image.sh \
  --prompt "赛博朋克风格的霓虹街道" \
  --output frames/frame_01.png \
  --size 1440x2560 \
  --project "赛博朋克之梦"

# 生成角色参考图(自动设置21:9尺寸、纯白背景、禁止文字,自动注入项目风格)
# 提示词必须从剧本角色设定中提取性别、年龄、外貌特征、穿着打扮、佩戴信息,翻译为英文后填入
./scripts/generate_image.sh \
  --prompt "Character reference sheet, 21:9 aspect ratio, pure white background, NO TEXT, NO LETTERS, NO CHARACTERS, NO WATERMARK, NO WRITING, layout from left to right: [LEFT SIDE: LARGE close-up face portrait of the character, CLEAR AND DETAILED], then full body front view, full body side view, full body back view, all three full body views clearly show the character's shoes, equal spacing between each section, no overlapping. Male, 35 years old, short golden-brown hair with side-parted bangs, square face with defined jawline, high nose bridge, deep blue eyes, thick eyebrows, fair skin with pink undertone, 185cm tall, muscular and well-proportioned build, wearing deep green stand-collar uniform top with gold cross-body braiding and gold epaulettes, black leather belt, deep green straight-leg pants, black leather knee-high boots, gold Starfleet badge on left chest, communicator on belt. Professional character design sheet, clean horizontal layout, consistent character features in all views, high detail, 8K, absolutely no text or writing of any kind" \
  --output references/roles/role_柯克_三视图.png \
  --asset-type role \
  --project "星际迷航短剧"

# 生成场景参考图(自动按项目比例设置尺寸、添加安全内容约束,自动注入项目风格)
./scripts/generate_image.sh \
  --prompt "赛博朋克风格的霓虹街道" \
  --output references/scenes/scene_赛博城市.png \
  --asset-type scene \
  --project "赛博朋克之梦"

generate_video_2.0.sh - 视频生成(Seedance 2.0,纯参考图模式)

# 纯参考图模式生成视频(角色用asset://,场景用TOS公网URL,自动注入项目风格和画面比例)
./scripts/generate_video_2.0.sh \
  -p "@图片1的阿光角色形象,@图片2的赛博城市场景风格,中景镜头,阿光站在废墟中仰望天空。声音设计:阿光低声自语:"这座城市还有希望吗?"约束条件:面部稳定不变形,动作自然流畅。禁止:任何字幕、文字、LOGO或水印;禁止BGM背景音乐和环境音效,只允许人物对话和旁白声音。" \
  --reference-image-urls "asset://asset-2026xxxx-abc1,https://bucket-name.tos-cn-beijing.volces.com/scene_赛博城市.png" \
  --project "赛博朋克之梦" \
  -o videos/video_01.mp4

# 多角色+场景+道具一致性 + 多镜头时间格式(自动注入项目风格和画面比例)
./scripts/generate_video_2.0.sh \
  -p "时长:10秒
比例:9:16
画风:赛博朋克冷蓝紫色调

0.0-3.0秒:远景镜头,缓慢推近。@图片1的阿光角色形象,@图片2的神秘人角色形象,@图片3的赛博城市场景,两人在废墟中对峙,冷灰色调中带有粉色和青色霓虹残影。声音设计:旁白:"两人在废墟中对峙,气氛紧张。"约束条件:人物动作连贯自然。禁止:任何字幕、文字、LOGO或水印;禁止BGM背景音乐和环境音效,只允许人物对话和旁白声音。

3.0-7.0秒:中近景镜头,固定机位。阿光机械臂蓝光亮起,@图片4的机械臂道具细节,紧张氛围升级,借着刚才抬手的惯性手指微微握拳。声音设计:阿光低声说:"你到底是谁?"约束条件:面部稳定不变形,五官清晰。禁止:任何字幕、文字、LOGO或水印;禁止BGM背景音乐和环境音效,只允许人物对话和旁白声音。

7.0-10.0秒:特写镜头,缓慢推镜。两人面部特写交替切换,阿光眼神坚定,神秘人嘴角微微上扬。声音设计:神秘人冷笑道:"你不该来这里。"约束条件:面部稳定不变形,动作自然流畅,无卡顿无闪烁。禁止:任何字幕、文字、LOGO或水印;禁止BGM背景音乐和环境音效,只允许人物对话和旁白声音。" \
  --reference-image-urls "asset://asset-abc1,asset://asset-abc2,https://bucket-name.tos-cn-beijing.volces.com/scene_赛博城市.png,https://bucket-name.tos-cn-beijing.volces.com/prop_机械臂.png" \
  --project "赛博朋克之梦" \
  -t 10 \
  -o videos/video_01.mp4

generate_video.sh - 视频生成(Seedance 1.5,兼容旧版)

从图片生成视频片段,支持运镜描述。

merge_videos.sh - 视频合并

使用 FFmpeg 合并多个视频片段。

相关 Skill

  • miaoda-text-gen-image - 文字生成图片
  • miaoda-speech-to-text - 语音转文字(反向操作)
  • xiaohongshu-publish - 小红书发布(可选后续)

Add the canonical catalog link to the repository README so users can inspect current installs and available audits. The publishing guide covers the complete discovery path.

<a href="https://skillzs.dev/skills/skills.volces.com/byted-drama-sd2">View byted-drama-sd2 on skillZs</a>