AI Studio 用户操作手册

AI 视频 / 图片创作工作台 · 面向创作者的一站式指南
版本 5.1(中文) · 适用站点:dingshengshijie.studio
编制日期:2026 年 7 月 · 更新日期:2026 年 8 月 12 日

目录

  1. 1系统简介与快速上手
  2. 2注册与登录
    1. 2.1 邮箱注册与登录
    2. 2.2 使用 Google 登录
  3. 3工作台总览与界面导航
  4. 4积分规则说明
  5. 5AI 视频生成
    1. 5.1 文生视频
    2. 5.2 图生视频
    3. 5.3 参考图生视频
    4. 5.4 视频模型与参数速查
    5. 5.5 查看与下载结果
  6. 6AI 图片生成
    1. 6.1 文生图
    2. 6.2 图生图与素材库
    3. 6.3 图片模型与参数速查
  7. 7智能改图
  8. 8故事板(AI 智能体)
  9. 9商品套图(AI 智能体)
  10. 10图片复刻(AI 智能体)
  11. 11衣服图案裂变(AI 智能体)
  12. 12衣服图案迁移(AI 智能体)
  13. 13爆款视频复刻(AI 智能体)
  14. 14视频超分(AI 智能体)
  15. 15动作迁移(AI 智能体)
  16. 16视频编辑(AI 智能体)
  17. 17文字转语音(AI 智能体)
  18. 18我的创作
  19. 19素材库管理
  20. 20账户设置
    1. 19.1 账户资料
    2. 19.2 安全与绑定手机号
    3. 19.3 积分与账单
  21. 21常见问题(FAQ)

1. 系统简介与快速上手

AI Studio 是一套面向创作者的 AI 视频 / 图片生成工作台,把「生成、编辑、素材管理」集中在一个网站里完成。

你可以用它完成以下工作:

快速上手三步

  1. 打开网站首页,点击右上角登录按钮,使用邮箱Google 完成注册 / 登录(新用户自动赠送 100 积分)。
  2. 进入 Studio 工作台,从左侧菜单选择要使用的工具(文生视频、文生图、故事板等)。
  3. 上传参考素材:点击添加选择文件、从素材库复用,或直接从桌面拖拽文件到素材区(区域高亮后松开即上传,类型不符会提示跳过)。
  4. 填写提示词、选择模型与参数,点击生成按钮。生成会实时消耗积分,完成后可在预览区查看并下载。
提示:界面右上角可切换浅色 / 深色主题中文 / English 语言。本手册截图均为浅色主题、中文界面。
版本更新:网站发布新版本后,右上角会出现“发现新版本”提示。请先保存尚未提交的编辑内容,再点击立即刷新;点击稍后后,当前标签页不会再次提醒同一版本。

2. 注册与登录

登录页直接提供邮箱密码表单,并保留 Google 账号登录。

2.1 邮箱注册与登录

邮箱注册
图 2-1 注册页

注册步骤:

  1. 在登录页底部点击注册,或直接访问注册页。
  2. 依次填写姓名、邮箱、密码,点击注册提交。
  3. 系统会向邮箱发送一封验证邮件,请打开邮件点击其中的确认链接完成邮箱验证。
务必完成邮箱验证:未验证邮箱的账号无法进入工作台。若收件箱没有邮件,请检查垃圾邮件文件夹。
邮箱登录
图 2-2 邮箱登录页

登录步骤:

  1. 打开登录页,邮箱密码表单会直接显示。
  2. 填写邮箱密码;密码框右侧的眼睛图标可切换明文显示。
  3. 点击登录。如忘记密码,点击密码框上方的忘记密码?按邮件提示重置。

2.2 使用 Google 登录

在登录页点击使用 Google 登录,在弹出的 Google 授权页面选择账号并授权即可。

说明:在微信、QQ、抖音等 App 内置浏览器中,Google 会拦截登录(这是 Google 的策略)。此时页面会提示在系统浏览器中打开,请复制链接到 Safari / Chrome 等浏览器重试,或改用邮箱登录。

3. 工作台总览与界面导航

登录后进入 Studio 工作台。左侧是功能菜单,中间是工具卡片,底部展示最近创作。

紧凑导航:桌面端左侧导航采用更紧凑的宽度,为右侧创作区域留出更多空间;需要专注创作时,可将导航折叠为图标栏。移动端抽屉与原有折叠方式保持不变。
AI 智能体两级导航:「AI 智能体」菜单组内部按媒介类型分为视频智能体 / 图片智能体 / 音频智能体 三个可折叠子分类,默认全部展开;点击子分类标题旁的箭头可折叠/展开。当前所在页面所属的子分类会始终保持展开,不会被意外收起。音频智能体下现有文字转语音声音克隆两个工具(见第 17 章)。
统一的「新建任务」按钮:每个创作页面的右上角都有一个新建任务按钮,全站叫法一致。点击后会清空当前表单、回到干净的新建状态;若表单里有未提交的内容会先弹出确认,避免误清。正在查看历史任务时点击它则直接退出查看模式。
工作台首页
图 3-1 Studio 工作台首页

左侧菜单说明

分组子分类菜单项用途
首页 / 我的创作返回工作台首页;查看全部生成作品
AI 视频生成参考图生视频多张参考图 + 提示词生成视频
图生视频单张图片作为首帧生成视频
文生视频纯文字提示词生成视频
AI 图片生成图生图上传图片改绘
文生图纯文字生成图片
AI 智能体视频智能体故事板产品短视频分镜 + 视频一体化流程
爆款视频复刻分析爆款视频并替换主体重新渲染
视频超分低清视频提升为 720p–4K 高清
动作迁移把参考视频的动作迁移到角色照片上
视频编辑修改/增删元素、换声、延长、拼接一条已有视频
图片智能体商品套图一键规划并批量生成整套电商上架图
图片复刻按风格参考图批量复刻商品主图
衣服图案裂变一张图案裂变为多款配色与花型的方案
衣服图案迁移一个图案迁移到多个已有颜色版本
音频智能体文字转语音文案合成自然口播音频
声音克隆上传参考音频克隆专属音色
设置账户修改姓名、头像等资料
账单查看积分余额与消费明细
安全 / 素材 / 通知密码与手机绑定 / 素材库 / 通知设置

顶部与底部区域

提示:每个工具卡片点击打开工具即可进入对应工作区;也可以直接点击左侧菜单同名项。首页的「AI 智能体」区块同样按视频智能体 / 图片智能体分组排布,并在末尾以一行提示说明音频智能体正在开发中。

4. 积分规则说明

生成图片和视频都会消耗积分。理解积分规则有助于合理安排创作。

积分从哪里来

积分怎么消耗

  1. 每个生成任务在提交前就会在生成按钮上实时显示所需积分(例如「生成 · 200 积分」)。
  2. 点击生成时先扣除相应积分;系统已知余额不足时,付费操作仍可点击,点击后会明确提示「生成积分不足」,且不会创建任务。提交时服务端会再次校验,因此其他标签页消费造成的余额变化也会显示同一提示。
  3. 价格由所选模型、分辨率 / 质量、时长、参考图数量共同决定——参数越高,消耗越多。以界面按钮显示的数字为准。
失败自动退款:若任务因超时或供应商错误而失败,系统会自动把已扣积分退回,你可在账单页看到对应的退款记录。

生成耗时与超时

类型最长等待说明
图片5 分钟GPT Image 2 Flex 线路较慢,放宽至 10 分钟
视频约 17 分钟超过时限的任务判定为失败并退款
爆款视频复刻 · 分析8 分钟AI 分析参考视频镜头与口播的阶段
视频超分数分钟至数小时与视频时长 / 帧率 / 目标分辨率成正比,界面实时显示「预计剩余」
说明:生成过程中可以离开当前页面,任务会在后台继续;下次打开对应任务即可看到最新状态。

5. AI 视频生成

视频生成分三种模式,共用同一套操作界面:文生视频、图生视频、参考图生视频。三者可在页面顶部页签一键切换。

5.1 文生视频

仅用文字描述即可生成短视频,适合快速起草创意。

文生视频
图 5-1 文生视频工作区
  1. 左侧菜单进入文生视频(或在页签中切换到「文生视频」)。
  2. 模型:点击「模型」下拉框选择视频模型(详见 5.4 速查表)。每个模型名称前带有对应的品牌图标。
  3. 分辨率:选择 480p / 720p 等(不同模型可选项不同)。
  4. 时长:拖动滑块或点击时长按钮设置视频秒数。
  5. 宽高比:选择 16:9、9:16、1:1 等画面比例。
  6. 高级设置:展开后可开关「生成音频」,部分模型还提供随机种子等选项。
  7. 提示词:在底部提示词框内详细描述画面内容、镜头运动、光线氛围。
  8. 确认底部生成 · N 积分按钮上的价格,点击生成。
视频模型下拉
图 5-2 视频模型下拉列表

5.2 图生视频

上传一张图片作为视频首帧,AI 让静态画面「动起来」。

图生视频
图 5-3 图生视频工作区
  1. 进入图生视频
  2. 首帧区域点击添加上传本地图片,或点击素材库选用曾经上传过的图片。
  3. 部分模型支持额外上传尾帧(结束画面);单帧模型则只显示首帧。
  4. 设置模型、分辨率、时长、宽高比。
  5. 填写提示词描述期望的运动方式(如「镜头缓慢推近」「人物轻微转头」)。
  6. 点击生成

5.3 参考图生视频

提供多张参考图(甚至参考视频、音频),保持人物 / 产品 / 风格的一致性,适合系列化带货内容。

参考图生视频
图 5-4 参考图生视频工作区
  1. 进入参考图生视频
  2. 参考图片 / 参考视频 / 参考音频各分组上传素材(不同模型的数量上限不同,分组标题会显示「0/9」这样的配额)。
  3. 在提示词框中输入 @ 可弹出已上传素材列表,选择后以标记芯片形式插入提示词,用来精确引用某张素材。
  4. 设置模型与参数。Seedance 的服务商由平台自动调度(Kie / DeepWL / X Deal 三条通道,价格一致),无需手动选择。确认后点击生成
提示:@ 提及功能让你在提示词中直接引用「第 1 张参考图」等,模型能更准确地理解你想复用哪张素材。
选镜头(长视频按镜头挑选参考片段):参考视频上传后会立即进入选择流程:先显示「拆解镜头中」(可跳过直接用整条),识别完成后可选整条视频(行内显示三帧缩略、总时长与镜头数;超长将按模型上限自动截取前 15/30 秒,并以醒目提示标出)或勾选若干镜头——每个选中的镜头都会成为一条独立的参考视频条目(不拼接),报价按各片段秒数计。选择受两道上限约束:所选镜头总时长不能超过模型的单条参考上限(15/30 秒)、段数不能超过剩余参考视频位,超出时会提示不能再多选。不足 2 秒(供应商参考下限)的镜头会自动并入相邻镜头。选完后素材组下方显示「已选 N 段」,可随时重选镜头或点 ✕ 恢复整条;识别失败或只有单个镜头时自动按整条视频继续。
选择参考片段
图 5-5 选择参考片段:整条视频或勾选多个镜头
时长自动跟随:参考图生视频的「时长」会自动跟随参考视频(或所选片段)的总秒数,不必手动拖滑杆;你手动拖过之后就不再打扰。重选镜头或恢复整条后会按新的总和重新计算。
查看与「调整参数重试」保留片段:打开历史任务时,参考视频区按当时提交的片段显示为「镜头 N · 起-止秒」条目;点「调整参数重试」后片段原样保留、不会回退成整条视频。此时不会自动重跑镜头识别——只有点「重选镜头」才识别一次,弹窗里的「整条视频」行显示源视频真实时长,镜头列表不预勾旧片段(干净起步,确认后整组替换,取消则保留当前片段)。

5.3+ 提示词向导(Seedance 家族)

不知道视频提示词怎么写?在参考图生视频模式选择 Seedance 家族模型或 MiniMax H3 时,提示词框右上会出现提示词向导按钮(H3 的成稿按其官方英文六段式规范写出)(图生/文生视频暂不提供)。向导支持品类切换(首发「服装」与「通用」两档,默认服装;素材分析会自动识别品类并切换,手动点过后不再覆盖)——细节提取词表与推荐动作按品类适配,后续品类将持续增加。向导是一个单页表单:素材分析(可编辑)与六个板块(素材职责 → 目标 → 场景与氛围 → 主体与动作 → 镜头与节奏 → 声音)同屏排布、全程可见可改;顶部进度轨实时点亮已完成的板块并高亮当前建议填写的一节,点击可直接跳转。填好后一键按所选模型的官方提示词规范写出结构化提示词。关闭重开不丢内容,右上「重置」可随时清空。

提示词向导
图 5-6 提示词向导:素材职责与「一键分析」卡片
  1. 每一步都提供推荐选项 + 自由输入;上传了图片素材时,向导会先免费进行一次 AI 素材分析(识别产品、卖点、人群),推荐选项即由分析结果生成,分析出的产品/卖点/人群会预填进顶部的可编辑区——改一笔就是权威事实,编辑结果随成稿一起生效。
  2. 「素材职责」板块为每张图/每个视频指派用途:图片单选(产品参考、主体形象参考等,默认「智能分配」由 AI 按真实画面分配,成稿会附上参考图原图);视频可多选,默认已勾选「动作参考 + 运镜参考」(不改即按这两项逐镜头镜像原片),只勾「风格参考」时不逐镜头镜像、仅借其气质与节奏;也可以把某份素材明确标记为「未采用」。每种职责都会在成稿里实际生效:首帧=镜头 1 从该图出发、尾帧=末镜收束到该图、道具照图还原并在动作中实际使用、形象图只供五官发型体型(穿着以产品图为准)、场景图严格照图还原环境。
  3. 带参考视频:一键分析。素材职责确认后,素材板块与目标板块之间会出现「分析参考视频,一键生成方案」卡片(素材分析进行中时暂不可点,稍候即恢复)。点击一次即按已确认的职责拆解参考视频,同时填好目标标签、场景与调性(没传场景图时还原原片环境;指派了「场景风格参考」图时改为照该图描述)、逐镜头动作方案与运镜方案,各板块仍可继续编辑,不满意可「重新生成」。选了多个镜头片段时(最多 3 段),向导会把它们按顺序接成一条参考时间轴逐段分析并标注来源,如「4-8秒(视频2):…」。拆解只还原原片内容,成稿时再把原片中的人物与物件替换成你的主体与产品——原片人物的衣着配饰不会被照抄,每个镜头都会重申产品的配色与结构;原片产品的静态陈列镜头不镜像视频画面,只借景别与构图、陈列物按你的产品图重写,不会擅自把产品图当首帧(选镜头时这类镜头会被标出并建议不勾选)。带参考视频时建议至少给一张图指派「产品参考」,向导会在缺少时提示。需要成片出现品牌字样时,上传字样图并指派「Logo 参考」(向导检测到品牌词会自动提示;轻量模型写字母不可靠,建议 2.5 或 2.0 标准版)。声音板块下方另有「补充要求」自由输入框,写任何额外要求,成稿逐条落实。换品模式:识别为同品类产品演示时,选镜头弹窗默认进入换品模式——选一段连续区间(4-30 秒,需 Seedance 2.5),成片保留原片人物、动作、运镜与镜头切分,只把物件换成你的产品;向导按原片物件逐件映射(替换 / 移除 / 保留),不做机械换皮。
  4. 没传参考视频:串行级联。选定目标后先生成环境与调性建议(按目标与产品匹配),确认场景后再生成三个完整时间戳动作方案(三选一、可编辑,动作在选定场景里设计),最后按选定动作派生三套运镜方案——每一步都基于上一步的确认结果。把某张图指派为「场景风格参考」时,拍摄环境会严格以该图的真实画面为准。场景 / 动作 / 运镜与声音板块各有一条「要求 → 生成」操作行(「本板块要求」输入框 + 右侧生成按钮,回车即生成):生成前写下明确约束(如「要有开箱动作」「开场产品特写慢推」),方案会从设计之初就逐条落实你的要求;改要求后点「重新生成」或回车即按新要求重出。
  5. 「声音」板块决定成片的音频设计:选口播讲解可一键生成三套按镜头时间分段的口播文案(台词写在花括号内、语速与各镜头时长匹配、产品事实只取自你确认的产品信息),口播支持选择语言(中文、English、Español、日本語、ไทย、Bahasa Melayu,默认随站点语言);选纯背景音乐则生成三套逐段配乐方案;有参考视频时还可选跟随原声节奏。三选一后可继续手改,成稿会把台词按官方花括号语法逐镜头嵌入、或把配乐写进每个镜头的音频位。不选则不加声音约束。注意:声音设计只有「生成音频」开关开启时才会在成片中生效。
  6. 点击生成提示词(10 积分/次;在 24 小时内把该成稿应用并提交视频渲染时自动全额返还——留在本系统使用等于免费;问答、素材分析与视频分析均免费)。生成的提示词可直接编辑,点应用后填入提示词框——素材引用会自动变成标记芯片,之后的提交流程与手写提示词完全一致。
  7. 成稿体检与一键修复。成稿下方自动出现「成稿体检」面板:检查素材是否都被引用、有无引用不存在或「未采用」的素材、提到产品的镜头是否写明配色/材质、主体是否在镜头里变回「幼童/博主」类代称、时间段是否连续覆盖成片时长、口播是否超长、正文是否混入 4K/16:9 等渲染参数。全部通过为绿色;有问题时逐条点名,可直接手改(实时重算)或点「一键修复 · 10 积分」按这些问题重新生成一稿(应用并渲染后同样返还)。生成时服务端已先做同一套体检并自动修订一轮。
  8. 成片反馈。成功成片下方有「这条成片符合预期吗?👍 👎」:👍 直接提交,👎 可勾选问题标签(产品外观不符 / 人物不一致 / 动作、运镜、场景不符 / 口播声音 / 字幕水印 / 画质穿模 / 节奏时长)并补一句话,随时可改。不影响任务与积分;反馈与当时的向导配方关联,用于持续改进向导与提示词质量。
说明:向导按模型方言写作——Seedance 2.0 用「镜头 1/2/3」组织且附官方约束尾句;Seedance 2.5 仅当你在问答中自己给出时间分配(如「0-3秒 特写」)或带有参考视频时才使用时间戳。生成费用在账单中以「视频提示词向导」单独列示。

5.4 视频模型与参数速查

模型擅长支持模式
Seedance 2.0 / Fast / Mini综合性价比,速度快文 / 图 / 参考
Seedance 2.5新一代 Seedance,480p/720p文 / 图 / 参考
MiniMax H3高质量运动与多模态参考文 / 图 / 参考
Kling 3.0可开关音频,支持元素参考文 / 图 / 参考
Kling 3.0 TurboKling 平价档,出片更快文 / 图
Veo 3.1 Quality / Fast / Lite画质高,Google 出品文 / 图 / 参考
Gemini Omni多模态参考生成参考
HappyHorse 1.1阿里出品,九种画幅可选文 / 图 / 参考
Seedance 2.5 参数:分辨率仅 480p 或 720p(无 1080p/4K),时长 4–30 秒,参考素材额度与 2.0 三兄弟一致(最多 9 张图片、3 个视频、3 个音频)。文生视频模式下该模型恒定生成音频——音频开关锁定为开启、无法关闭;图生视频与参考生视频保持正常开关。
Seedance 2.5 计价:不携带参考视频时,480p 每秒 28 积分,720p 每秒 63 积分;携带参考视频时费率降为 480p 每秒 17 积分、720p 每秒 38 积分,另加该参考视频本身的整秒数。Seedance 家族的服务商(Kie / DeepWL / X Deal,价格一致)自 2026-08-16 起由平台统一调度,无需手动选择。Seedance 2.5 已开放于标准视频工作台、故事板和爆款视频复刻。
Kling 3.0 参数:分辨率 720p / 1080p / 4K,比例 16:9 / 9:16 / 1:1,时长 3–15 秒(默认 5 秒)。音频可开关。图生视频支持首帧、并可再加一张尾帧。参考生视频采用「元素」制而非扁平参考池:最多定义 3 个元素,每个元素起一个英文名并上传 2–4 张照片,然后必须在提示词中用 @名称 引用——未被引用的元素不会生效,提交时会拦截提示。
Kling 3.0 计价:关闭音频时 720p 每秒 14 积分、1080p 每秒 18 积分;开启音频时 720p 每秒 20 积分、1080p 每秒 27 积分;4K 恒为每秒 67 积分(与音频无关)。Kling 3.0 Turbo 是平价档:仅 720p / 1080p,无音频开关,图生视频只取首帧,计价为 720p 每秒 18 积分、1080p 每秒 22.5 积分。两者均只在标准视频工作台提供。
MiniMax H3 参数:默认 768P,可选 2K,时长 4–15 秒。文生视频支持 21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16 六种比例;图生视频的比例由首帧(及可选尾帧)决定;参考生视频还可选「自适应」。参考模式最多 9 张图片、3 个视频、3 个音频;不能只上传音频,至少还需一张图片或一个视频。
MiniMax H3 计价:768P 为 16 积分/秒,2K 为 26 积分/秒(2026-08-17 随上游降价下调);输出时长和每个参考视频的整秒数都按当前清晰度计费。前 5 张参考图免附加费,第 6–9 张每张加 8 积分,参考音频不加收输入费。实际后端服务商由平台路由并随任务固定,不影响你的模型参数或计价。MiniMax H3 仅在标准视频工作台可用——它已于 2026 年 8 月退出故事板与爆款视频复刻,这两处请改用 Seedance 家族。
Seedance 服务商:自 2026-08-16 起由平台自动调度(Kie / DeepWL / X Deal 三条通道,价格完全一致),无需也无法手动选择。不同通道的表单能力略有差异(例如某通道音频恒定开启时不显示音频开关、比例选项略有增减),表单会自动按当前通道渲染。已提交任务的路由随任务冻结,之后的平台调度不影响它。
说明:切换模型后,界面会自动过滤出该模型支持的分辨率、时长与宽高比;不支持的选项不会出现。具体积分价格以生成按钮上的数字为准。

5.5 查看与下载结果

  1. 提交后右侧预览区显示「等待中 / 生成中」,完成后自动显示视频。
  2. 点击视频可播放;点击下载按钮保存到本地。
  3. 所有任务也会出现在我的创作页(见第 18 章),点击卡片可再次查看或重试。
运行中也可调参:任务提交成功后,当前工作区会立即显示调整参数重试。点击后会把相同素材与参数保留在一个可编辑的新任务表单中,原任务继续运行。调整操作本身不收费,只有再次提交新任务时才扣除积分。

6. AI 图片生成

图片生成分两种模式:文生图(纯文字)与图生图(上传参考图改绘)。两者共用同一界面,顶部页签切换。

6.1 文生图

文生图
图 6-1 文生图工作区
  1. 左侧菜单进入文生图
  2. 模型:点击下拉框选择图片模型(详见 6.3 速查表)。
  3. 宽高比:点击选择「自动 / 1:1 / 3:2 / 16:9 / 9:16」等;部分模型还提供「自定义」尺寸。
  4. 质量 / 分辨率:GPT Image 2 Flex 提供 auto/low/medium/high 质量档;其它模型提供 1K/2K/4K 分辨率。
  5. 提示词:输入画面描述。
  6. 确认生成 · N 积分价格后点击生成。
图片模型下拉
图 6-2 图片模型下拉列表(每个模型带品牌图标)

6.2 图生图与素材库

上传一张或多张参考图,让 AI 在其基础上改绘。

图生图
图 6-3 图生图工作区
  1. 进入图生图
  2. 在上传区点击添加上传本地图片,或点击素材库从历史素材中选用。
  3. 填写提示词描述要如何修改(如「更换背景为纯白影棚」)。
  4. 设置模型与参数后点击生成
素材库选择弹窗
图 6-4 素材库选择弹窗(可多选,点击已选素材可取消)
素材库弹窗操作:顶部的全部素材 / 文件夹按钮用于缩小选择范围;弹窗内向下滚动会自动加载更多素材。点击缩略图即选中并加入上传区(选中的会显示彩色描边与「已添加」标记),再次点击可取消选择,不会移动原素材的文件夹归属。
运行中也可调参:图片任务提交后会立即显示调整参数重试。点击后,提示词、图片和参数会保留在可编辑的新任务表单中,原任务继续生成;只有再次提交新任务时才扣除积分。

6.3 图片模型与参数速查

模型特点可选精度
GPT Image 2 Flex官方线路,支持质量档与自定义尺寸质量 auto/low/medium/high
GPT Image 2 HD高清线路1K / 2K / 4K
Nano Banana ProGemini 系图片模型1K / 2K / 4K
Seedream 5 Pro字节跳动旗舰,7 种固定比例1K / 2K

7. 智能改图

对已生成的图片进行「标注式局部修改」:在图上手绘圈选、箭头、文字,描述修改要求,AI 会按标注修改并覆盖原图。文生图 / 图生图的成品、故事板的分镜图,以及商品套图、图片复刻、衣服图案裂变、衣服图案迁移的每张成品图都支持。

如何进入

在图片生成成功后,右侧预览区的下载按钮旁会出现智能改图按钮;故事板的板图成功后操作区同样有该按钮;商品套图 / 图片复刻 / 衣服图案裂变 / 衣服图案迁移的每张已完成卡片上也有对应入口。点击即打开编辑器。

生成结果与智能改图入口
图 7-1 图片生成结果 · 预览区的「智能改图」入口

编辑器工具说明

智能改图编辑器
图 7-2 智能改图编辑器
工具作用
标记点击落编号图钉,或拖拽画出虚线框,标出要修改的区域(编号自动递增,可在提示词中引用)
画笔自由涂画,可从色板选颜色(红/黄/绿/蓝/黑/白)
箭头 / 直线拖拽绘制箭头或直线,指示修改方向
文本点击画面落文本框,输入文字后回车确认
橡皮擦切换后,点击任意标注即可将其删除(按对象删除,不是像素擦)
撤销 / 重做回退或恢复上一步标注操作
缩放点击「−/+」按钮,或直接在画布上滚动鼠标滚轮放大 / 缩小(50%–300%)

操作步骤

  1. 点击智能改图打开编辑器。
  2. 用工具在图上标注要修改的位置(例如用「标记」框住某个物体,或用画笔圈出区域)。
  3. 在底部输入框描述修改要求(可引用标记编号,如「把标记 1 处的红苹果换成青苹果」)。
  4. 选择本次改图使用的模型分辨率(默认沿用原图的模型),确认按钮上的积分价格。
  5. 点击改图 · N 积分提交。图片进入「改图中…」,完成后新图会替换原图
注意:覆盖不可撤销。改图成功后新图会覆盖原图、旧图被销毁,无法找回。若改图失败,系统会自动退款且原图保持不变。

8. 故事板(AI 智能体)

故事板是一条完整的电商短视频流水线:上传产品 / 人物 / 场景素材 → AI 编剧撰写画面提示词 → 生成多镜头分镜图 → AI 编剧撰写视频提示词 → 视频模型渲染成片。

故事板工作区
图 8-1 故事板工作区

操作步骤

  1. 上传素材:产品图片(必填)、人物图片场景图片三个分组分别上传参考图。三个分组共享一个总配额(多数模型 8 张,Gemini Omni 为 6 张),可按需要自由分配。
  2. 视频参数:设置目标视频比例、口播语言(English / 中文 / Español / 日本語 / Bahasa Melayu / ไทย)、提示词生成模型、板图生成模型、视频生成模型、Seedance 服务商(仅选择 Seedance 时显示)、分辨率、时长、镜头数。
  3. 额外需求(可选):在下方填写卖点、风格、目标人群等补充说明,AI 会优先采纳。
  4. 一键生成:点击生成。系统会依次:① 编剧撰写画面提示词 → ② 板图模型渲染分镜图。右侧提示词框会实时显示 AI 写好的提示词,可手动编辑。
  5. 生成视频提示词:分镜图完成后,点击视频提示词区的AI 辅助生成,AI 会根据分镜图撰写视频提示词。
  6. 渲染视频:确认后提交,视频模型据此渲染成片。
不停止原故事板即可调参:提交后,左侧素材和参数会保持冻结,直到点击调整参数重试。点击后会脱离旧任务并生成一个可编辑的新故事板表单,不会重绘、停止或修改旧故事板;旧流程仍在后台继续。

参数说明

参数说明
板图生成模型GPT Image 2 Flex / HD,用于绘制分镜图
视频生成模型Seedance 2.0 / Fast / Mini、Seedance 2.5、Gemini Omni
Seedance 服务商平台自动调度(Kie / DeepWL / X Deal,价格一致);随故事板任务冻结,最终渲染视频时沿用
口播语言控制口播 / 字幕语言;画面内文字统一为英文(图片模型渲染中文不稳定)
时长 / 镜头数时长影响建议镜头数(约每 1.7 秒一个镜头),镜头数可手动调整
Seedance 2.5 在故事板中:位于 Seedance 2.0 Mini 之后,共享同一个 8 张参考池,分辨率仅 480p/720p(无 1080p/4K)。服务商由平台自动调度,最终渲染视频按不含参考视频的费率计价(详见第 5.4 节)。
与智能改图配合:分镜图生成后如需局部调整,点击板图操作区的智能改图即可(见第 7 节),改好后再进行视频渲染。
说明:故事板的每个步骤(编剧、板图、视频)单独计费,界面按钮会显示当次所需积分。完成的故事板在「我的创作」中以一张合并卡片展示。

9. 商品套图(AI 智能体)

上传商品图,AI 规划并批量生成一整套电商上架图:白底主图、场景图、卖点图与更多。适合快速搭建 Amazon / TikTok Shop / 速卖通等平台的商品详情页。

商品套图工作区
图 9-1 商品套图工作区

操作步骤

  1. 上传产品图片:最多 8 张,可从素材库选用。
  2. 目标平台 / 目标市场 / 文案语言:选择上架平台(TikTok Shop、Amazon、速卖通、独立站等)、目标市场与图内文案语言。AI 会按平台的真实图片规范(如 Amazon 纯白底、主体占比约 85%)来规划。
  3. 产品卖点:按「产品名 / 核心卖点 / 适用人群 / 期望场景 / 尺寸参数」五行骨架填写;也可点击AI 生成(2 积分)让 AI 根据商品图自动填写后再修改。
  4. 设计风格(三选一):
    • AI 推荐:点击「AI 推荐风格分析」,AI 分析商品图给出风格方案(2 积分),文字可编辑;
    • 风格模板:从 20 款预设风格中直接挑选(见图 9-2),涵盖质感高端 / 清新自然 / 活力潮流 / 品类特化四组,如「高端杂志感」「奶油少女系」「暗调奢华」「素人实拍」等;
    • 自定义要求:直接输入配色偏好、排版风格、创意方向等文字要求。
  5. 套图结构配置:「智能匹配」由 AI 自动搭配各类图的数量;「自定义配置」可手动调整白底图 / 场景图 / 卖点图 / 其他各类数量(共 4–12 张,白底图至少 1 张)。
  6. 生成套图规划(2 积分):AI 为每张图规划类别、标题与英文渲染提示词,以卡片列表展示。可勾选 / 取消某些卡片,也可直接编辑每张卡的提示词。
  7. 批量出图:在右侧选择出图模型(GPT Image 2 / Seedream 5 Pro / Nano Banana Pro)、质量档 / 分辨率与比例,点击生成勾选图片 · N 积分。每张图独立计费、独立生成,完成一张显示一张。
风格模板
图 9-2 设计风格 · 风格模板(20 款,带主题图标)

每张成品图的操作

操作说明
智能改图打开标注编辑器局部修改(见第 7 节),改图会覆盖该张图
放大查看 / 下载查看原图、保存到本地
改词重生成修改该卡提示词后重新生成一张(正常计费,旧图作废)
提示:规划阶段只花 2 积分——先看 AI 的整套方案与提示词,满意再批量出图,不满意可点调整参数重试载入原参数重新规划。
说明:发给图片模型的提示词始终为英文(中文模型渲染不稳定);你用中文修改提示词时系统会自动翻译成英文再出图。整套任务在「我的创作」显示为一张合并卡片,账单中所有子费用归组为一条记录。

10. 图片复刻(AI 智能体)

看到风格出色的竞品主图?上传它作为风格参考,再上传自己的商品图,AI 按参考图的构图版式批量输出属于你的商品主图——每张参考图对应一张成品。

图片复刻工作区
图 10-1 图片复刻工作区

操作步骤

  1. 风格参考图:最多 12 张,每张参考图会生成一张对应风格的成品。
  2. 商品图:上传自己的商品照片(上限随模型与人物图数量动态变化,界面实时显示)。AI 只会画你的商品,绝不会把参考图里的商品搬进成品。
  3. 人物图(可选):最多 2 张。只取模特的长相与身形,衣服一律以商品图为准——适合服装类目让「自己的模特」穿上「自己的衣服」。
  4. 目标市场 / 文案语言:决定图内文案的语言与审美取向。
  5. 复刻程度(二选一):参考排版——沿用版式、背景结构与主体关系,配色按商品本身设计;高度复刻——构图、版式、配色与细节全面复刻,只替换商品和卖点。
  6. 核心卖点(必填):手动填写或点击AI 生成(2 积分)自动提炼。
  7. 统一复刻要求(可选):对整套图的统一约束,如「文案统一用英文」「模特姿势保持不变」。要求会逐项写入每张提示词:数字(尺寸/厚度/角度)逐字保留,风格专名与结构卖点词以对应英文显式出现,系统还会对数字做机械核对、缺失时自动补写一轮。
  8. 生成方案(2 积分):AI 为每张参考图规划一条渲染提示词,卡片可勾选、可编辑。
  9. 批量出图:右侧选择模型、质量档与比例后点击生成勾选图片。单卡操作(智能改图 / 下载 / 改词重生成)与商品套图一致。
版权提醒:参考图仅用于让 AI 理解构图与风格,请勿直接商用他人图片素材;成品图中的商品、人物均来自你自己上传的素材。

11. 衣服图案裂变(AI 智能体)

把 1–6 张版型图、图案素材、上身图或细节图整理成草稿,点击开始分析(免费)创建可离开的持久任务;复核已保存的 AI 识别结果后,再点击确认生成付费生成方案与平铺图,最后一键批量生成模特展示图。

衣服图案裂变工作区
图 11-1 衣服图案裂变工作区

操作步骤

  1. 整理本地草稿(1–6 张,可混合上传,无需分组):版型图提供剪裁与轮廓,图案素材提供风格 DNA,上身图同时提供版型与图案,细节图只辅助理解。可自由增删、排序;仅上传不会调用 AI,也不会创建任务。
  2. 开始分析(免费):主动点击后,系统先创建任务,再由持久工作流逐图分析。任务会立即出现在「我的创作」;此时离开页面、关闭浏览器或换设备都不会中断。该阶段不扣积分,也不产生账单记录。
  3. 复核已保存的分析:每张素材会获得角色和摘要;降级结果标记为「需要人工确认」。素材及顺序保持冻结,但角色、摘要和全部分析字段均可编辑。
  4. 品类 / 目标性别 / 底色:由 AI 根据上传图片自动识别并填入,均可编辑;底色为可选文字描述(如「黑色」「米白」)。
  5. 风格 DNA / 售卖定位 / 场景建议 / 模特人设建议:AI 自动生成的四段说明(配色元素、目标客群、拍摄场景、模特风格),均可直接编辑覆盖。
  6. 裂变数量:10–20 个变体,默认 10,步进器调整。
  7. 模型 / 档位 / 两个比例:衣服图案裂变支持 GPT Image 2 HD(默认)、Nano Banana Pro、Seedream 5 Pro;选择质量档位,并分别设置平铺图比例模特图比例(两者均默认 1:1)。这些参数只在确认付费生成时冻结。
  8. 确认生成(方案 2 积分 + 每个变体的平铺图按所选模型计价,精确总价在按钮上明示):这是流程中的首次付费操作;确认后 AI 立即写出方案并自动渲染全部平铺图。
  9. 英文 Logo 与字体版式:每个新变体会自动获得一个不同的虚构英文品牌名,并按需要附带标语、字体风格和版式;这些信息会显示在卡片摘要中。提示词重生成时会保持该变体已冻结的 Logo 设计;模特图则以最新平铺图为唯一锚点,沿用完全相同的可见拼写与排版。
  10. 结果区(三列工作流):每个变体一行,按生成顺序显示平铺图 / 模特图 / 图案矢量图三列——桌面端并排显示,手机端纵向堆叠为同一顺序。每张卡片标题旁有一个勾选框,只要该卡自己的平铺图已成功即可勾选,默认全选。
  11. 多选批量生成:全部平铺图渲染完成(成功或失败)且至少一张成功后,结果区顶部出现批量工具栏——一个全选勾选框(点击可在全选/清空之间切换)+ 两个独立按钮生成所选模特图生成所选矢量图,各自的价格按「当前勾选且尚未生成该项」的卡片数实时计算。取消勾选某张卡即可把它排除在这一次批量之外;已经生成过模特图或矢量图的卡片即使仍勾选,也不会被重复计费或重新生成——两个按钮互不影响彼此的勾选状态。也可在单张卡片上单独点击生成模特图
  12. 图案矢量图(印刷级文件,结果区第三列):某个变体的平铺图渲染成功后,该列会出现生成图案矢量图按钮(16 积分,与是否已生成模特图无关)——AI 从该平铺图中只提取印花本体,重绘为白底透明、约 4096 像素(300dpi 下约 34.7cm,落在 32–36cm 印刷幅面区间)的独立文件;预览用棋盘格背景展示透明效果,点击下载获取文件名带 -300dpi 后缀的 PNG。渲染失败可原地按价格点击重试
  13. 统一修改并重新生成:图片下方不再分别放置两个重生成按钮。点击卡片提示词区域右上角的修改并重新生成,可同时编辑平铺图提示词,以及模特人设、拍摄场景、光线效果。只修改模特设定时,仅重新生成模特图;修改平铺图提示词时,系统先重新生成平铺图,再自动用新平铺图生成模特图。按钮会显示本次实际范围和积分,离开页面也不会中断已提交的两阶段任务。
  14. 其他单卡操作:智能改图(见第 7 节,局部修改并覆盖原图)、放大查看、下载。
两段式更安全:开始分析免费且可离开;确认生成才是明确的计费边界。任务 id 一创建(包括仍在分析时)就会显示调整参数重试,点击后打开预填的新草稿,不会修改或停止原任务。
商用提醒:系统生成的英文品牌名、标语和字体版式均为创意示例,不代表已完成商标检索或注册。用于商品、包装、店铺或广告前,请自行完成目标市场的商标与名称可用性检索。
说明:免费分析不产生账单记录。确认生成时才收取固定 2 积分方案费及全部平铺图费用;模特图另行计费。整套任务在「我的创作」显示为一张合并卡片:真实子图出现前显示分析 / 待确认阶段,之后显示实时子图进度。历史 Flex 任务仍可查看;点击调整参数重试后,新表单会切换为 GPT Image 2 HD。

12. 衣服图案迁移(AI 智能体)

同一款式的多个颜色版本共用一个图案:上传每个颜色一张的版型图(1–12 张)与一个图案(直传,或从一张爆款款式图免费提取),点击开始分析(免费)创建可离开的持久任务;复核颜色清单与图案预览后,再点击确认生成付费生成方案,系统会把图案逐色像素级迁移并自动渲染全部平铺图,平铺图审核通过后再逐色生成模特展示图(全组同一模特、每色不同场景)。

衣服图案迁移工作区
图 12-1 衣服图案迁移工作区

操作步骤

  1. 同款多颜色衣服照片(1–12 张):每张对应该款式的一个颜色版本,可自由增删、排序。
  2. 图案来源:二选一——直传图案图(单独的图案素材或印花特写);或从爆款款式图免费提取:上传一张带有目标图案的爆款衣服照片,系统立即在后台免费识别并抠出图案,卡片上会显示「提取中…」,完成后自动切换为「提取完成」并显示预览图,可点击重新提取换一次结果,或直接切回「直传图案」改用其他图。同一张爆款图重复使用会命中缓存,秒级完成、零成本。
  3. 模特参考图(可选,0–2 张):上传则全组固定为该模特身份;不传则由 AI 设计一位匹配衣服风格与目标市场的模特,全组同一人。
  4. 图案配色策略:原色保真(默认,图案颜色像素级不变)或自适应配色(图案的图形与排布保持不变,颜色按每件衣服的颜色协调微调)。
  5. 平铺风格 / 模型 / 档位 / 目标市场 / 两个比例:衣服图案迁移支持 GPT Image 2 HD(默认)、Nano Banana Pro、Seedream 5 Pro;分别设置平铺图比例模特图比例(两者均默认 1:1)。这些参数只在确认付费生成时冻结。
  6. 开始分析(免费):主动点击后,系统先创建任务,再逐颜色识别颜色名(中英文)、品类、性别,并检查各张衣服是否确属同一款式。任务立即出现在「我的创作」,离开页面不会中断。该阶段不扣积分。
  7. 复核 analysis_ready:颜色清单(每个颜色的缩略图 + 可编辑的中英文颜色名)、图案预览、品类 / 性别(均可编辑);若某张衣服的版型与其他明显不同,会出现非阻断的一致性提示,是否继续由你决定。
  8. 确认生成(方案 2 积分 + 每个颜色的平铺图按所选模型计价,精确总价在按钮上明示):这是流程中的首次付费操作;确认后 AI 把图案迁移到每个颜色并自动渲染全部平铺图。
  9. 结果区(颜色卡网格):每个颜色一张卡片,顶部显示颜色名徽章,下方按生成顺序显示平铺图 / 模特图 / 图案矢量图三列——桌面端并排显示,手机端纵向堆叠为同一顺序。每张卡片标题旁有一个勾选框,只要该颜色自己的平铺图已成功即可勾选,默认全选。平铺图渲染成功且已归档缩略图后,模特图列才会出现生成模特图按钮——用同一模特身份,按该颜色专属的场景与姿态单独渲染,费用独立计算。
  10. 多选批量生成:全部平铺图渲染完成(成功或失败)且至少一张成功后,结果区顶部出现批量工具栏——一个全选勾选框(点击可在全选/清空之间切换)+ 两个独立按钮生成所选模特图生成所选矢量图,各自的价格按「当前勾选且尚未生成该项」的颜色数实时计算。取消勾选某个颜色即可把它排除在这一次批量之外;已经生成过模特图或矢量图的颜色即使仍勾选,也不会被重复计费或重新生成。
  11. 图案矢量图(印刷级文件,结果区第三列):某个颜色的平铺图渲染成功后,该列会出现生成图案矢量图按钮(16 积分,与是否已生成模特图无关)——AI 从该平铺图中只提取印花本体,重绘为白底透明、约 4096 像素(300dpi 下约 34.7cm,落在 32–36cm 印刷幅面区间)的独立文件;预览用棋盘格背景展示透明效果,点击下载获取文件名带 -300dpi 后缀的 PNG。渲染失败可原地按价格点击重试
  12. 统一修改并重新生成:点击卡片提示词区域右上角的修改并重新生成,可同时编辑平铺图提示词、场景与姿态。只修改场景 / 姿态时,仅重新生成模特图;修改平铺图提示词时,系统先重新生成平铺图,再自动用新平铺图生成模特图。
  13. 其他单卡操作:智能改图(见第 7 节,局部修改并覆盖原图)、放大查看、下载。
两段式更安全:图案提取与开始分析均免费且可离开;确认生成才是明确的计费边界。任务 id 一创建就会显示调整参数重试,点击后打开预填的新草稿,不会修改或停止原任务。
说明:图案提取全程免费,结果按来源图内容寻址缓存,同一张图重复提取不再产生新的处理。确认生成时才收取固定 2 积分方案费及全部颜色的平铺图费用;模特图另行计费,人物参考图不计入平铺图输入。整套任务在「我的创作」显示为一张合并卡片,账单归组为一条「衣服图案迁移」记录(与「衣服图案裂变」分开统计与筛选)。

13. 爆款视频复刻(AI 智能体)

上传一条爆款参考视频,AI 分析它的镜头手法、节奏与口播,替换成你自己的人物 / 产品 / 场景后逐段重新渲染,最后一键合成完整成片。受控测试账号还可对比稳定的「原视频参考」与实验性的「深度参考」路径。

爆款视频复刻工作区
图 13-1 爆款视频复刻工作区

操作步骤

  1. 参考视频:上传 MP4/MOV,时长 3–60 秒,不超过 100MB。上传后系统会免费自动检测口播并逐字转写;同一次分析始终会生成发布标题和 3–5 个保留 #、可直接复制发布的标签。原视频标题与 tag 为可选输入,仅用于参考其结构与语气。
  2. 参考模式(仅受控测试账号):原视频参考 · 稳定为默认路径,把裁剪后的源片段交给视频模型;深度参考 · 实验性会先把每段转换成深度动作视频,保留人物 / 物体的几何结构与运动,同时压低源片的颜色、纹理和身份外观。账号未启用实验时不会显示选择器;历史任务仍会如实显示当时使用的模式。
  3. 替换图:产品图必传;人物 / 产品 / 场景三组共享 8 个槽位。人物图会免费自动做白底预处理(「白底✓」)。原视频模式下,留空分组可沿用 / 推断源片中的同类要素,场景为空时还可使用源片最干净的一帧;深度模式会刻意隔离源片外观,只由你上传的替换图锚定人物身份、产品和场景,因此需要的外观都应显式上传。
  4. 产品卖点与统一要求:填写有事实依据的产品卖点(必填,可用 AI 生成),并可补充作用于整条视频的镜头、造型或文案要求;所有片段共用。
  5. 口播文案(二选一):AI 重新创作会依据产品可见事实与卖点写新口播;沿用原口播(可微调)会逐字使用检测稿与手动修改。沿用模式留空文案表示保留参考原声;重写模式也能为无口播源片新增旁白。生成字幕默认关闭,口播语言支持英 / 中 / 西 / 日 / 马来 / 泰语。
  6. 选择视频生成参数:在「分析分镜」按钮之前选择模型、分辨率与比例。Seedance 全家族(2.0 / Fast / Mini / 2.5)的服务商由平台自动调度;Seedance 2.5 紧跟在 Seedance Mini 之后,仅提供 480p / 720p。提交分析时这组参数立即冻结,之后补渲、重渲自动沿用。
  7. 分析分镜(2 积分):AI 输出逐段复刻脚本——每段 4–15 秒,含镜头运动、动作描述与该段口播文案。系统在同一次分析调用中直接生成最终模型适用的提示词,不增加调用或费用:Seedance 使用其素材角色语法。口播行可单独点击编辑。
  8. 渲染视频:勾选要渲染的片段(可全选),点击生成视频。片段按时间顺序接力渲染:系统把前一段的最后一帧交给后一段参考。
  9. 合成完整成片:全部片段成功后出现合成完整视频按钮(免费),一键拼接成片;某段重渲后可重新合成
深度渲染要求预览:深度模式的未渲染片段会按当前网站语言显示完整渲染要求,并随补充要求即时更新,方便提交前核对。发送给生成模型的请求仍使用针对模型优化的英文内部提示词;口播台词不会因此改成英文,始终保留你在口播语言中选择的语言。
Seedance 2.5 在爆款视频复刻中:每个片段渲染都会携带一段物化好的参考片段,因此计价始终使用第 5.4 节中更便宜的含参考视频费率(不会按不含参考视频的费率计价)。针对被内容审核拒绝或触发版权判定的片段的自动恢复机制(先改写提示词重试,再降级为静音片段 + AI 生成配乐)同样适用于 Seedance 2.5 片段。

过程控制

操作说明
停止生成渲染中可随时点击「停止生成」:未完成片段标记失败并退款,已完成片段保留,之后仍可单独重渲
重试失败段 / 改词重生成失败或不满意的片段可单独重渲(正常计费),会自动从最近一个成功片段接力
调整参数重试载入本次提交(或历史首个子任务恢复)的模型、服务商、分辨率、比例及其它输入,创建一个参数可编辑的全新任务
如何选择:日常使用请选择稳定的原视频路径,尤其是需要借用源片场景 / 外观信息时;若测试账号可见深度模式,可用它评估更强外观隔离下的动作迁移。深度预处理会增加一些等待时间;若准备失败,片段会安全失败并退款,可切回原视频模式重试。
计费说明:切换参考模式本身不另收费。分析 2 积分;每个片段按所选模型 / 分辨率 / 时长独立计费;前序片段失败会自动取消后续片段并退款;成片合成免费。同一任务的全部费用在账单中归组为一条记录。
内容审核:个别参考画面可能被平台内容审核拦截(系统会先自动尝试净化提示词与静音重试)。若片段提示「参考画面被拦截」,请更换参考视频或调整该段内容。

14. 视频超分(AI 智能体)

把低分辨率、模糊的视频提升为高清:AI 超分辨率算子逐帧重建细节,输出 720p / 1080p / 2K / 4K。工作区空态提供一段真实前后对比演示——左「改前」右「改后」,滑动分界线即可对比。

视频超分工作区
图 14-1 视频超分工作区(右侧为滑动对比演示)

操作步骤

  1. 选择超分模型(二选一):Volcengine 视频超分——自选目标分辨率 720p–4K,适合任何尺寸的源;阿里云视频超分——固定放大 2 倍并增强画质,要求源分辨率大于 360×360 且小于 1920×1080、文件不超过 1GB,按时长计费(固定 2 积分/秒)。
  2. 上传源视频:时长不超过 600 秒(10 分钟),可从素材库选用。
  3. 选择目标分辨率(火山引擎模式):720p / 1080p / 2K / 4K 四档。竖屏视频按短边计档(如竖屏 1080p 输出 1080×1920)。阿里云模式无需此步——输出恒为源的 2 倍。
  4. 确认报价:按钮上实时显示所需积分——价格与视频时长、帧率、目标分辨率成正比;下方同时显示预计处理时长。实际时长 / 帧率以服务端探测为准。
  5. 点击开始超分。任务进入后台处理,界面显示「预计剩余」,期间可离开页面。
  6. 完成后右侧显示成品视频,点击下载保存。
价格参考:720p 档最便宜;1080p 约为其 3 倍,2K 约 5 倍,4K 约 11 倍;高帧率(>30fps)视频按帧率档位加成。一段 1 分钟 30fps 视频超到 720p 约 53 积分。
说明:长视频 + 高分辨率的组合处理时间可达数小时,系统最长等待 24 小时;超时或失败自动退款。删除处理中的任务同样会退款。

15. 动作迁移(AI 智能体)

把一段参考视频里的动作,迁移到你自己的角色照片上:上传一张角色照 + 一段动作视频,AI 让照片里的主体做出视频里的动作。成片时长与动作视频一致,并沿用其声音。

动作迁移工作区
图 15-1 动作迁移工作区(左侧素材与参数,右侧预览)

先选模型

本页提供两个互补的模型,选择会同时改变可用参数与价格:

 Wan 2.2 AnimateKling 3.0 Motion Control(默认)
适用主体不限真人——宠物、玩偶等同样可用真人(供应商会做人物检测,宠物/物体会被直接拒,这种失败不扣积分)
分辨率480p / 720p720p / 1080p
视频时长5–120 秒3–30 秒
价格480p 8 积分/秒,720p 16 积分/秒(不足 5 秒按 5 秒计)720p 20 积分/秒,1080p 27 积分/秒
沿用视频场景选「换进视频」即原生支持需开启「场景跟随视频」由本站预处理

简单说:要 1080p 选 Kling,其余情况选 Wan——Wan 更便宜、支持更长的视频,也是唯一能做非真人主体的。

操作步骤

  1. 上传角色图片(1 张):需清晰展示主体的头部与上身。JPG / PNG,不超过 10MB,最小边 340px,画面比例在 2:5 – 5:2 之间。
  2. 上传动作参考视频(1 段):MP4 / MOV,不超过 100MB,最小边 340px,时长须落在所选模型的区间内(见上表)。
  3. 迁移方式(Wan 专有):换进视频(默认)把视频里的主体换成你的角色,成片沿用视频的场景与镜头套用动作则只把动作套到角色照片上,保留角色照片原本的背景。
  4. 场景跟随视频(Kling,以及 Wan 的「套用动作」):开启后,系统会在提交前免费把动作视频首帧的场景与人物姿态一并合成进你的角色照片——成片背景与视频一致,且起手姿态就与视频对齐,动作衔接更自然;关闭则沿用角色照片原本的背景与姿态。合成约需 1 分钟,期间「生成」按钮不可点击。合成完成后,角色图片会直接换成合成图,你在提交前就能确认将要渲染的是什么。若对合成结果不满意,可在下方的补充要求框里写一句话(例如「站得更靠近镜头」「不要戴眼镜」),再点重新生成场景图——补充要求仅在点击该按钮时生效。Wan 的「换进视频」原生就沿用视频场景,因此不显示这个开关。
  5. 选择分辨率:随模型变化(Wan 480p/720p,Kling 720p/1080p)。
  6. 选择角色方向(Kling 专有):「跟随视频」时复杂动作还原更好;「跟随图片」时更支持镜头运动。
  7. 提示词(可选):可留空。需要强调某个动作细节时再填。
  8. 点击生成。按钮上实时显示所需积分。

计价

两个模型都按动作视频的时长计费(成片时长与之相同,不足 1 秒的部分不计)。Wan 2.2 Animate:480p 8 积分/秒、720p 16 积分/秒,不足 5 秒按 5 秒计;Kling 3.0 Motion Control:720p 20 积分/秒、1080p 27 积分/秒。例如一段 8 秒的动作视频,Wan 720p 需 128 积分,Kling 720p 需 160 积分。提交时服务端会重新读取视频真实时长后再扣费,因此最终扣费以真实秒数为准。

拍摄建议:角色照片用正面、光线均匀、主体完整入镜的照片效果最好;动作视频里的主体越清晰、动作幅度越明确,迁移效果越准。
关于场景:除 Wan 的「换进视频」外,成片背景都取自角色图片。这就是「场景跟随视频」开关的意义——它把视频首帧的场景与姿态先合成进角色照片,从而让成片看起来像是在视频的环境里拍的,并且开头的动作能自然接上。若合成失败,系统会自动改用角色照片的原始背景继续渲染,不会中断任务,界面上也会提示。

16. 视频编辑(AI 智能体)

用一句话改一条已有视频:修改 / 增加 / 删除画面元素、编辑声音、向后延长、多段转场拼接。既可直接上传视频,也可从任意 AI 成片卡右下角的「视频编辑」按钮一键带入。

视频编辑工作区
图 16-1 视频编辑工作区(中央画布 + 帧带 + 指令条,右侧参数)

六类任务

任务用途
修改元素把画面里的某个东西换成另一个(颜色 / 材质 / 主体 / 背景…)
增加元素在指定位置、指定时机加入新元素
删除元素去掉水印、路人、多余物件——未提及的部分保持原样
声音编辑删除背景音乐 / 修改人声 / 增加音效,画面保持不变
延长视频向后延长内容,风格与叙事无缝衔接
转场拼接2–3 段视频补全过渡、无缝相接

选中任一任务,指令框会预填官方推荐句式模板——只需替换尖括号里的空位;已手改的内容切换任务时不会被覆盖。

操作步骤

  1. 加入源视频:上传 / 素材库选择 / 从成片带入。单条时长上限随模型:Seedance 2.5 为 30 秒,2.0 家族为 15 秒;转场拼接可加 2–3 条。
  2. 浏览帧带:播放器下方是剪映式帧带时间轴(按宽度均匀采样,自动填满不滚动),点击或拖动即可定位播放头,编辑对象在第几秒一目了然。
  3. 圈定编辑区间(Seedance 2.5):在帧带上按住直接拖选即可圈定区间(区间外画面压暗;两端手柄可微调,单击仍是定位),「在 N-Ms 区间内」自动写进指令,编辑只作用于该时间段;拖回全幅即取消区间。
  4. 选任务类型并完善指令:替换模板空位即可;也可完全自己写。
  5. (可选)辅助参考图:换商品 / 换印花等组合任务,附上产品图并在指令里写「参考 图片1 的产品…」。
  6. 选模型与分辨率:Seedance 全家族四模型。2.5 的编辑任务自动对齐源片时长与画幅(官方规范锁定,无需选择);2.0 家族与延长任务可显式指定输出时长。
  7. 点击生成(按钮实时报价)。完成后播放器左上角原片 / 编辑后一键对比;成片可以成片继续编辑形成链式迭代,或发送到视频超分

计价

沿用带参考视频的费率:(输出秒数 + 源片取整秒数)× 每秒积分。例如 Seedance 2.5 480p 编辑一条 13 秒源片 = 17 × (13+13) = 442 积分;2.0 Mini 480p 同任务输出 5 秒 = 2.4 × (5+13) ≈ 43.2 积分。转场拼接的输出为各段之和再加每个过渡约 1 秒。失败自动退款。

写好编辑指令的三个要点:① 用「编辑视频 / 修改 / 删除 / 增加」这类明确动词开头;② 描述要改的对象时给出可辨认的特征(颜色、位置、材质);③ 结尾保留「其余画面、动作、运镜与声音保持不变」——官方明确强调保持项能显著提升未编辑部分的保真度(模板已自带,系统也会自动补全)。
关于结果:编辑输出本质是「按你的指令重新生成」而非逐像素手术,未编辑部分保真度极高但并非逐比特一致;对结果不满意可调整指令重试(新任务,原任务不受影响)。

17. 文字转语音(AI 智能体)

把文案变成自然口播音频:输入或粘贴文案,选择音色与模型档位,一键合成 mp3。支持停顿标记、情绪标签(表现力档)与 AI 文案润色,历史任务与示例就在工作区右侧。

文字转语音工作区
图 17-1 文字转语音工作区(左侧文案与参数,右侧历史/示例)

操作步骤

  1. 输入文案:上限 2000 字符(计费按字符数,插入的标记同样计入)。工具条可插入停顿标记——菜单内容随档位变化:标准档是精确秒数(0.3 / 0.5 / 0.8 / 1 / 1.5 / 2 / 3 秒,朗读为等长静音);表现力档是短 / 中 / 长三档语义停顿(约 0.5 / 1.5 / 2.3 秒),因为该档模型不支持秒数式停顿标记。智能标记(2 积分)分析文案并自动插入合适的停顿标记与情绪标签(标准档只插停顿),文字本身一字不改。
  2. 选择音色:点击「更换音色」打开音色库——16 个精选男女音色,支持性别筛选、名称搜索、试听与收藏;「自定义音色」tab 列出你克隆的专属音色(见本章「声音克隆」小节)。音色会被记住——再次进入工作台时默认选中你上次用过的音色(若该音色已被删除则回到内置默认)。
  3. 选择模型档位:标准档(3 积分/100 字符)速度快、价格省,语速 / 稳定性 / 相似度 / 风格强度滑杆全开;表现力档(5 积分/100 字符)演绎最自然,解锁情绪标签——工具条按「笑 / 情绪 / 气息与口部 / 语气台风 / 其它」五组提供 50 个常用标签(如 [laughs] 大笑、[whispers] 耳语、[professional] 专业、[warmly] 温暖);该模型对描述性标签是开放的,你也可以自己在文案里手写,例如 [frustrated sigh]。稳定性为「创意 / 自然 / 稳健」三档预设。
  4. 点击生成语音(按钮实时显示价格,不足 100 字符按 100 计)。任务出现在右侧「历史」并自动刷新到完成。
  5. 完成后卡片内直接播放,可下载 mp3、回填文案再次编辑,或删除(删除同时销毁成品文件)。
示例:右侧「示例」tab 提供三段带标签的成品文案(含试听音频),点「试一试」即可回填表单直接体验。
说明:中文由多语言模型驱动,不同音色的口音风格略有差异,建议先试听再选择;任务失败或超时自动退款。我的创作与积分账单均已同步——账单里 AI 润色费与合成费归组为一条「文字转语音」条目。

声音克隆

上传自己的参考音频,克隆出专属音色——克隆完成后即可在文字转语音的「自定义音色」tab 中选用,也可从克隆历史一键「在文字转语音中使用」。

声音克隆工作区
图 17-2 声音克隆工作区(左侧名称与参考音频,右侧克隆历史)
  1. 命名音色并上传 1–3 段参考音频(每段建议 30 秒–3 分钟的干净人声,无背景音乐/噪音效果最佳,也可从素材库选择)。
  2. 点击克隆音色(100 积分/个)。克隆通常几十秒内完成,完成后卡片附带一段自动生成的试听。
  3. 「在文字转语音中使用」直接带着该音色进入合成页;或在文字转语音的音色库「自定义音色」tab 中随时选用与收藏。
说明:克隆音色仅你本人可见可用;每个账户最多保留 2 个克隆音色,删除即释放名额(已生成的历史音频不受影响)。克隆失败或超时自动退款。参考音频质量决定克隆相似度——请使用无混响、无背景音乐的清晰人声。

18. 我的创作

集中管理你的全部作品:视频、图片、故事板、商品套图、图片复刻、衣服图案裂变、衣服图案迁移、爆款视频复刻、视频超分统一以卡片形式展示,可筛选、查看、下载与删除。

我的创作
图 18-1 我的创作页(顶部为任务类型筛选行)

筛选

卡片信息

常用操作

  1. 查看 / 重试:点击卡片主体进入对应工作区的查看模式;工作区内可用调整参数重试载入原参数新建任务。
  2. 下载:点击卡片上的下载按钮保存作品。
  3. 删除:点击卡片右下角的垃圾桶图标,在确认弹窗中确认。删除后作品及其结果文件会被清除,处理中的任务同时自动退款。
说明:带有关联视频的故事板会显示为一张合并卡片(不会把分镜图和视频拆成两张);商品套图 / 图片复刻 / 衣服图案裂变 / 衣服图案迁移 / 爆款视频复刻同样以一张合并卡片代表整个任务。

19. 素材库管理

「素材」把你上传过的图片、视频和音频集中在一个可搜索的素材库中。一级文件夹便于管理大量素材,也不会额外复制文件。

素材库
图 19-1 素材 · 全部素材与文件夹

18.1 视图、搜索与文件夹

18.2 文件夹整理,不复制文件

  1. 勾选一个或多个素材后,可批量移动到文件夹移至未归档、收藏或删除。
  2. 每个素材最多属于一个主文件夹。移动操作只改变整理信息,Cloudinary / R2 中的底层文件始终只存一份。
  3. 删除文件夹不会删除素材;其中素材仍保留在全部素材中,并进入未归档

18.3 在工作区使用文件夹

18.4 删除规则

  1. 可通过单行操作或批量操作栏删除底层素材;批量删除会分别报告已删除与已跳过数量。
  2. 若素材正被某个任务引用,系统会阻止删除并跳过该素材;仍可安全地移动或收藏它。
提示:文件夹归属与任务引用彼此独立。删除文件夹不会影响历史作品。
部署状态(2026 年 8 月 7 日):文件夹替换方案已上线;生产迁移 0039_asset_folder_management.sql 已执行,新版 Worker 已部署。

20. 账户设置

左侧菜单「设置」分组包含账户资料、安全、账单等页面。

19.1 账户资料

账户资料
图 20-1 账户资料页
  1. 进入设置 → 账户
  2. 可修改姓名、头像等基本资料,修改后点击保存。

19.2 安全与绑定手机号

安全设置
图 20-2 安全设置页(含手机号绑定)

绑定手机号是保留的账户安全能力,当前产品登录页仍只提供邮箱密码与 Google 登录:

  1. 进入设置 → 安全,找到手机号卡片。
  2. 输入 11 位手机号,点击获取验证码
  3. 填写收到的验证码,点击绑定。绑定成功后该卡片会显示脱敏后的手机号。

本页还可修改登录密码:填写原密码与新密码后保存。

说明:一期仅支持绑定,暂不支持换绑 / 解绑手机号。

19.3 积分与账单

积分与账单
图 20-3 积分与账单页

21. 常见问题(FAQ)

Q1 生成一直显示「生成中」,要等多久?

图片一般数十秒到数分钟,视频约几分钟。图片最长 5 分钟(GPT Image 2 Flex 为 10 分钟)、视频最长约 17 分钟、视频超分依任务规模可达数小时(界面显示预计剩余),超时会自动判定失败并退款。生成期间可离开页面,任务在后台继续。

Q2 任务失败了,积分会退吗?

会。因超时或供应商错误失败的任务,系统自动全额退回已扣积分,可在账单页看到退款记录。智能改图失败时原图保持不变。

Q3 绑定手机号时收不到验证码怎么办?

请确认使用的是中国大陆(+86)号码,并检查是否屏蔽了国际短信。若持续收不到,请稍后重试或联系客服;登录仍可直接使用邮箱密码。

Q4 智能改图后能恢复原图吗?

不能。改图成功后新图会覆盖并销毁原图。若担心,可先下载原图作为备份,再进行改图。

Q5 为什么有的历史图片没有「智能改图」按钮?

智能改图需要图片的高清副本作为编辑底图。极早期生成的历史作品可能没有该副本,因此不显示按钮;新生成的作品均支持。

Q6 画面内的中文字总是渲染不准?

当前图片模型渲染非英文文字不稳定,因此故事板等场景中画面内文字统一使用英文;口播 / 字幕语言可自由选择中文。

Q7 积分不够了怎么办?

点击付费生成操作时会提示「生成积分不足」,不会创建任务或扣除积分。可从顶部导航或侧栏「价格」进入价格页充值:四档一次性充值,当前统一对公转账、按弹窗提示联系「路易电商」办理,到账后可在账单页查看记录。

Q8 爆款视频复刻是怎么计费的?中途不想等了怎么办?

分析分镜收 2 积分;之后每个片段独立计费(按所选模型 / 分辨率 / 时长),失败的片段自动退款;最后的成片合成免费。渲染中可随时点击停止生成——未完成片段退款、已完成片段保留,之后仍可单独补渲。

Q9 商品套图 / 图片复刻的「规划」和「出图」是分开收费的吗?

是。规划(AI 写方案与提示词)只收 2 积分,看到整套方案满意后再点批量出图,每张图按所选模型独立计费。规划不满意可直接「调整参数重试」重新规划,之前的规划费不退但金额很小。

Q10 视频超分要花多少积分、等多久?

价格与视频时长、帧率、目标分辨率成正比(720p 档最便宜,4K 约为 720p 的 11 倍),提交前按钮上会显示准确报价与预计处理时长。长视频高分辨率组合可能需要数小时,可离开页面等待;失败或超时自动退款。

Q11 衣服图案裂变为什么要先出平铺图、再出模特图?

上传图片后 AI 会自动免费识别每张图的角色与整体风格,你确认或微调后一次提交,系统会自动写出裂变方案并渲染全部平铺图(方案 2 积分 + 每张平铺图按所选模型计价,总价在提交按钮上明示)——这一步不需要你再单独审核方案或逐张勾选渲染。真正「先看再花钱」的环节在模特图:某张平铺图渲染成功后,其卡片上才会出现「生成模特图」按钮,避免在不满意的图案上多花一次模特图的积分;全部平铺图完成后,结果区顶部会出现批量工具栏——默认全选每一张平铺图已成功的卡片,可逐张取消勾选后再点击「生成所选模特图」或「生成所选矢量图」,价格实时按当前勾选且尚未生成该项的卡片数计算,不会为已生成过的卡片重复扣费。若后续需要调整,使用提示词区的修改并重新生成:只改模特设定只收取一张模特图费用;改动平铺提示词会明示并收取平铺图加模特图费用,系统持久串行生成两张,始终保证模特图基于最新平铺图。整套任务(方案 + 每张平铺图 + 每张模特图)在账单中归组为一条「衣服图案裂变」记录。

Q12 衣服图案迁移的图案提取要花积分吗?和衣服图案裂变有什么区别?

图案提取全程免费:上传一张爆款衣服照片后,系统立即在后台免费识别并抠出图案,结果按来源图内容寻址缓存,同一张图重复提取零成本、秒级完成;提取失败可点重新提取,或改用直传图案图。与衣服图案裂变的区别在于输入结构与产出逻辑:图案裂变是「1 张衣服图 + 图案素材 → 10–20 个不同图案的变体」,迁移则是「1 个图案 + 1–12 个已有颜色版本 → 逐色把同一个图案像素级迁移上去」,更适合你已经确定要用哪个图案、只是想快速覆盖全部颜色版本的场景。两者共用平铺图 → 模特图的两段计费与「先审平铺再出模特」的门控逻辑,在「我的创作」与账单中各自独立统计、互不混淆。

需要更多帮助?如遇本手册未覆盖的问题,请通过站点提供的联系方式反馈,我们会尽快协助解决。