◎
AI Studio 用户操作手册
AI 视频 / 图片创作工作台 · 面向创作者的一站式指南
版本 5.1(中文) · 适用站点:dingshengshijie.studio
编制日期:2026 年 7 月 · 更新日期:2026 年 8 月 12 日
目录
1 系统简介与快速上手
2 注册与登录
2.1 邮箱注册与登录
2.2 使用 Google 登录
3 工作台总览与界面导航
4 积分规则说明
5 AI 视频生成
5.1 文生视频
5.2 图生视频
5.3 参考图生视频
5.4 视频模型与参数速查
5.5 查看与下载结果
6 AI 图片生成
6.1 文生图
6.2 图生图与素材库
6.3 图片模型与参数速查
7 智能改图
8 故事板(AI 智能体)
9 商品套图(AI 智能体)
10 图片复刻(AI 智能体)
11 衣服图案裂变(AI 智能体)
12 衣服图案迁移(AI 智能体)
13 爆款视频复刻(AI 智能体)
14 视频超分(AI 智能体)
15 动作迁移(AI 智能体)
16 视频编辑(AI 智能体)
17 文字转语音(AI 智能体)
18 我的创作
19 素材库管理
20 账户设置
19.1 账户资料
19.2 安全与绑定手机号
19.3 积分与账单
21 常见问题(FAQ)
1. 系统简介与快速上手
AI Studio 是一套面向创作者的 AI 视频 / 图片生成工作台,把「生成、编辑、素材管理」集中在一个网站里完成。
你可以用它完成以下工作:
AI 视频生成 :用文字、单张图片或多张参考素材生成短视频(支持 Seedance、Kling、MiniMax H3、HappyHorse、Veo、Gemini 等多种模型)。
AI 图片生成 :用文字生成图片,或上传图片进行改绘(GPT Image 2、Nano Banana Pro、Seedream 5 Pro)。
智能改图 :在已生成的图片上手绘标注(圈选、箭头、文字),让 AI 按标注局部修改并覆盖原图。
故事板 :上传产品 / 人物 / 场景素材,一键生成多镜头分镜图,并进一步渲染成带货短视频。
商品套图 :上传商品图,AI 规划并批量生成一整套电商上架图(白底主图、场景图、卖点图等),内置 20 款设计风格模板。
图片复刻 :上传竞品级风格参考图与自己的商品图,AI 按参考图的构图版式批量输出风格一致的商品主图。
衣服图案裂变 :上传 1–6 张参考图片(版型图 / 图案素材 / 上身图皆可,无需分组),AI 自动免费识别每张图的角色与整体风格、售卖定位,确认信息后一次提交即可自动生成方案并渲染全部平铺图,平铺图审核通过后再一键批量生成模特展示图。
衣服图案迁移 :上传同款式的多个颜色版本(1–12 张)与一个图案(直传,或从爆款款式图免费提取),AI 把图案逐色像素级迁移到每个颜色版本上,逐色产出平铺图与模特展示图(全组同一模特、每个颜色不同场景)。
文字转语音 :输入文案、选择精选音色与模型档位,合成自然口播音频;支持停顿标记、情绪标签(表现力档)与 AI 文案润色。
动作迁移 :上传一张角色照片 + 一段动作视频,让照片里的主体(人或宠物)做出视频里的动作,并可让成片场景与视频一致。
视频编辑 :对已有视频做修改/增删元素、声音编辑、延长与转场拼接——上传或从成片一键带入,用一句话描述改动。
声音克隆 :上传 1–3 段干净的参考音频,克隆出专属音色,直接在文字转语音中选用(仅本人可见可用)。
爆款视频复刻 :上传一条爆款参考视频,AI 分析其镜头手法与口播节奏,替换成你自己的人物 / 产品 / 场景后逐段重新渲染,并可一键合成完整成片。
视频超分 :上传低清视频,AI 超分辨率算子输出 720p 至 4K 的高清版本。
作品与素材管理 :所有生成结果集中在「我的创作」,上传过的图片自动进入「素材库」以便复用。
快速上手三步
打开网站首页,点击右上角登录按钮,使用邮箱 或 Google 完成注册 / 登录(新用户自动赠送 100 积分 )。
进入 Studio 工作台 ,从左侧菜单选择要使用的工具(文生视频、文生图、故事板等)。
上传参考素材:点击添加 选择文件、从素材库 复用,或直接从桌面拖拽文件到素材区 (区域高亮后松开即上传,类型不符会提示跳过)。
填写提示词、选择模型与参数,点击生成 按钮。生成会实时消耗积分,完成后可在预览区查看并下载。
提示: 界面右上角可切换浅色 / 深色主题 与中文 / English 语言 。本手册截图均为浅色主题、中文界面。
版本更新: 网站发布新版本后,右上角会出现“发现新版本”提示。请先保存尚未提交的编辑内容,再点击立即刷新 ;点击稍后 后,当前标签页不会再次提醒同一版本。
2. 注册与登录
登录页直接提供邮箱密码表单,并保留 Google 账号登录。
2.1 邮箱注册与登录
图 2-1 注册页
注册步骤:
在登录页底部点击注册 ,或直接访问注册页。
依次填写姓名、邮箱、密码 ,点击注册 提交。
系统会向邮箱发送一封验证邮件 ,请打开邮件点击其中的确认链接完成邮箱验证。
务必完成邮箱验证: 未验证邮箱的账号无法进入工作台。若收件箱没有邮件,请检查垃圾邮件文件夹。
图 2-2 邮箱登录页
登录步骤:
打开登录页,邮箱密码表单会直接显示。
填写邮箱 与密码 ;密码框右侧的眼睛图标可切换明文显示。
点击登录 。如忘记密码,点击密码框上方的忘记密码? 按邮件提示重置。
2.2 使用 Google 登录
在登录页点击使用 Google 登录 ,在弹出的 Google 授权页面选择账号并授权即可。
说明: 在微信、QQ、抖音等 App 内置浏览器中,Google 会拦截登录(这是 Google 的策略)。此时页面会提示在系统浏览器中打开 ,请复制链接到 Safari / Chrome 等浏览器重试,或改用邮箱登录。
3. 工作台总览与界面导航
登录后进入 Studio 工作台 。左侧是功能菜单,中间是工具卡片,底部展示最近创作。
紧凑导航: 桌面端左侧导航采用更紧凑的宽度,为右侧创作区域留出更多空间;需要专注创作时,可将导航折叠为图标栏。移动端抽屉与原有折叠方式保持不变。
AI 智能体两级导航: 「AI 智能体」菜单组内部按媒介类型分为视频智能体 / 图片智能体 / 音频智能体 三个可折叠子分类,默认全部展开;点击子分类标题旁的箭头可折叠/展开。当前所在页面所属的子分类会始终保持展开,不会被意外收起。音频智能体 下现有文字转语音 与声音克隆 两个工具(见第 17 章)。
统一的「新建任务」按钮: 每个创作页面的右上角都有一个新建任务 按钮,全站叫法一致。点击后会清空当前表单、回到干净的新建状态;若表单里有未提交的内容会先弹出确认,避免误清。正在查看历史任务时点击它则直接退出查看模式。
图 3-1 Studio 工作台首页
左侧菜单说明
分组 子分类 菜单项 用途
— — 首页 / 我的创作 返回工作台首页;查看全部生成作品
AI 视频生成 — 参考图生视频 多张参考图 + 提示词生成视频
图生视频 单张图片作为首帧生成视频
文生视频 纯文字提示词生成视频
AI 图片生成 — 图生图 上传图片改绘
文生图 纯文字生成图片
AI 智能体 视频智能体 故事板 产品短视频分镜 + 视频一体化流程
爆款视频复刻 分析爆款视频并替换主体重新渲染
视频超分 低清视频提升为 720p–4K 高清
动作迁移 把参考视频的动作迁移到角色照片上
视频编辑 修改/增删元素、换声、延长、拼接一条已有视频
图片智能体 商品套图 一键规划并批量生成整套电商上架图
图片复刻 按风格参考图批量复刻商品主图
衣服图案裂变 一张图案裂变为多款配色与花型的方案
衣服图案迁移 一个图案迁移到多个已有颜色版本
音频智能体 文字转语音 文案合成自然口播音频
声音克隆 上传参考音频克隆专属音色
设置 — 账户 修改姓名、头像等资料
账单 查看积分余额与消费明细
安全 / 素材 / 通知 密码与手机绑定 / 素材库 / 通知设置
顶部与底部区域
左下角账户区 :显示当前用户名与积分余额 (图中为 500)。点击可切换账号或退出登录。
右上角 :语言切换(中/英)与主题切换(浅色/深色)按钮。
最近创作 :首页底部以卡片形式展示近期作品,点击查看全部 进入「我的创作」。
提示: 每个工具卡片点击打开工具 即可进入对应工作区;也可以直接点击左侧菜单同名项。首页的「AI 智能体」区块同样按视频智能体 / 图片智能体 分组排布,并在末尾以一行提示说明音频智能体 正在开发中。
4. 积分规则说明
生成图片和视频都会消耗积分。理解积分规则有助于合理安排创作。
积分从哪里来
注册赠送: 新账号注册即赠送 100 积分 (每个账号一次)。
充值购买(2026-08 上线): 顶部导航或侧栏「价格 」进入价格页,提供四档一次性充值:¥250 得 5,000 积分、¥500 得 10,500(送 500)、¥2,500 得 55,000(送 5,000)、¥5,000 得 115,000(送 15,000)。当前统一对公转账 :点击「立即充值」按提示联系「路易电商 」办理,转账时备注账户邮箱,到账后积分充入账户。充值积分永不过期 ,充值记录显示在账单页。
积分怎么消耗
每个生成任务在提交前 就会在生成按钮上实时显示所需积分 (例如「生成 · 200 积分」)。
点击生成时先扣除 相应积分;系统已知余额不足时,付费操作仍可点击,点击后会明确提示「生成积分不足」,且不会创建任务。提交时服务端会再次校验,因此其他标签页消费造成的余额变化也会显示同一提示。
价格由所选模型、分辨率 / 质量、时长、参考图数量 共同决定——参数越高,消耗越多。以界面按钮显示的数字为准。
失败自动退款: 若任务因超时或供应商错误而失败,系统会自动把已扣积分退回 ,你可在账单页看到对应的退款记录。
生成耗时与超时
类型 最长等待 说明
图片 5 分钟 GPT Image 2 Flex 线路较慢,放宽至 10 分钟
视频 约 17 分钟 超过时限的任务判定为失败并退款
爆款视频复刻 · 分析 8 分钟 AI 分析参考视频镜头与口播的阶段
视频超分 数分钟至数小时 与视频时长 / 帧率 / 目标分辨率成正比,界面实时显示「预计剩余」
说明: 生成过程中可以离开当前页面,任务会在后台继续;下次打开对应任务即可看到最新状态。
5. AI 视频生成
视频生成分三种模式,共用同一套操作界面:文生视频、图生视频、参考图生视频。三者可在页面顶部页签一键切换。
5.1 文生视频
仅用文字描述即可生成短视频,适合快速起草创意。
图 5-1 文生视频工作区
左侧菜单进入文生视频 (或在页签中切换到「文生视频」)。
模型: 点击「模型」下拉框选择视频模型(详见 5.4 速查表)。每个模型名称前带有对应的品牌图标。
分辨率: 选择 480p / 720p 等(不同模型可选项不同)。
时长: 拖动滑块或点击时长按钮设置视频秒数。
宽高比: 选择 16:9、9:16、1:1 等画面比例。
高级设置: 展开后可开关「生成音频」,部分模型还提供随机种子等选项。
提示词: 在底部提示词框内详细描述画面内容、镜头运动、光线氛围。
确认底部生成 · N 积分 按钮上的价格,点击生成。
图 5-2 视频模型下拉列表
5.2 图生视频
上传一张图片作为视频首帧 ,AI 让静态画面「动起来」。
图 5-3 图生视频工作区
进入图生视频 。
在首帧 区域点击添加 上传本地图片,或点击素材库 选用曾经上传过的图片。
部分模型支持额外上传尾帧 (结束画面);单帧模型则只显示首帧。
设置模型、分辨率、时长、宽高比。
填写提示词描述期望的运动方式(如「镜头缓慢推近」「人物轻微转头」)。
点击生成 。
5.3 参考图生视频
提供多张参考图(甚至参考视频、音频),保持人物 / 产品 / 风格的一致性,适合系列化带货内容。
图 5-4 参考图生视频工作区
进入参考图生视频 。
在参考图片 / 参考视频 / 参考音频 各分组上传素材(不同模型的数量上限不同,分组标题会显示「0/9」这样的配额)。
在提示词框中输入 @ 可弹出已上传素材列表,选择后以标记芯片 形式插入提示词,用来精确引用某张素材。
设置模型与参数。Seedance 的服务商由平台自动调度(Kie / DeepWL / X Deal 三条通道,价格一致),无需手动选择。确认后点击生成 。
提示: @ 提及功能让你在提示词中直接引用「第 1 张参考图」等,模型能更准确地理解你想复用哪张素材。
选镜头(长视频按镜头挑选参考片段): 参考视频上传后会立即进入选择流程:先显示「拆解镜头中」(可跳过直接用整条),识别完成后可选整条视频 (行内显示三帧缩略、总时长与镜头数;超长将按模型上限自动截取前 15/30 秒,并以醒目提示标出)或勾选若干镜头 ——每个选中的镜头都会成为一条独立的参考视频条目 (不拼接),报价按各片段秒数计。选择受两道上限约束:所选镜头总时长不能超过模型的单条参考上限(15/30 秒)、段数不能超过剩余参考视频位,超出时会提示不能再多选。不足 2 秒(供应商参考下限)的镜头会自动并入相邻镜头。选完后素材组下方显示「已选 N 段」,可随时重选镜头 或点 ✕ 恢复整条 ;识别失败或只有单个镜头时自动按整条视频继续。
图 5-5 选择参考片段:整条视频或勾选多个镜头
时长自动跟随: 参考图生视频的「时长」会自动跟随参考视频(或所选片段)的总秒数,不必手动拖滑杆;你手动拖过之后就不再打扰。重选镜头或恢复整条后会按新的总和重新计算。
查看与「调整参数重试」保留片段: 打开历史任务时,参考视频区按当时提交的片段显示为「镜头 N · 起-止秒」条目;点「调整参数重试」后片段原样保留、不会回退成整条视频。此时不会自动重跑镜头识别——只有点「重选镜头」才识别一次,弹窗里的「整条视频」行显示源视频真实时长,镜头列表不预勾 旧片段(干净起步,确认后整组替换,取消则保留当前片段)。
5.3+ 提示词向导(Seedance 家族)
不知道视频提示词怎么写?在参考图生视频 模式选择 Seedance 家族模型或 MiniMax H3 时,提示词框右上会出现提示词向导 按钮(H3 的成稿按其官方英文六段式规范写出)(图生/文生视频暂不提供)。向导支持品类切换(首发「服装」与「通用」两档,默认服装;素材分析会自动识别品类并切换,手动点过后不再覆盖)——细节提取词表与推荐动作按品类适配,后续品类将持续增加。向导是一个单页表单:素材分析(可编辑)与六个板块(素材职责 → 目标 → 场景与氛围 → 主体与动作 → 镜头与节奏 → 声音)同屏排布、全程可见可改;顶部进度轨实时点亮已完成的板块并高亮当前建议填写的一节,点击可直接跳转。填好后一键按所选模型的官方提示词规范写出结构化提示词。关闭重开不丢内容,右上「重置」可随时清空。
图 5-6 提示词向导:素材职责与「一键分析」卡片
每一步都提供推荐选项 + 自由输入 ;上传了图片素材时,向导会先免费进行一次 AI 素材分析(识别产品、卖点、人群),推荐选项即由分析结果生成,分析出的产品/卖点/人群会预填进顶部的可编辑区——改一笔就是权威事实,编辑结果随成稿一起生效。
「素材职责」板块为每张图/每个视频指派用途:图片单选(产品参考、主体形象参考等,默认「智能分配」由 AI 按真实画面分配,成稿会附上参考图原图);视频可多选,默认已勾选「动作参考 + 运镜参考」 (不改即按这两项逐镜头镜像原片),只勾「风格参考」时不逐镜头镜像、仅借其气质与节奏;也可以把某份素材明确标记为「未采用」。每种职责都会在成稿里实际生效:首帧=镜头 1 从该图出发、尾帧=末镜收束到该图、道具照图还原并在动作中实际使用、形象图只供五官发型体型(穿着以产品图为准)、场景图严格照图还原环境。
带参考视频:一键分析。 素材职责确认后,素材板块与目标板块之间会出现「分析参考视频,一键生成方案」 卡片(素材分析进行中时暂不可点,稍候即恢复)。点击一次即按已确认的职责拆解参考视频,同时填好 目标标签、场景与调性(没传场景图时还原原片环境;指派了「场景风格参考」图时改为照该图描述)、逐镜头动作方案与运镜方案,各板块仍可继续编辑,不满意可「重新生成」。选了多个镜头片段时(最多 3 段),向导会把它们按顺序接成一条参考时间轴逐段分析并标注来源,如「4-8秒(视频2):…」。拆解只还原原片内容,成稿时再把原片中的人物与物件替换成你的主体与产品——原片人物的衣着配饰不会被照抄,每个镜头都会重申产品的配色与结构;原片产品的静态陈列镜头不镜像视频画面,只借景别与构图、陈列物按你的产品图重写,不会擅自把产品图当首帧(选镜头时这类镜头会被标出并建议不勾选)。带参考视频时建议至少给一张图指派「产品参考」,向导会在缺少时提示。需要成片出现品牌字样时,上传字样图并指派「Logo 参考」(向导检测到品牌词会自动提示;轻量模型写字母不可靠,建议 2.5 或 2.0 标准版)。声音板块下方另有「补充要求」自由输入框,写任何额外要求,成稿逐条落实。换品模式 :识别为同品类产品演示时,选镜头弹窗默认进入换品模式——选一段连续区间(4-30 秒,需 Seedance 2.5),成片保留原片人物、动作、运镜与镜头切分,只把物件换成你的产品;向导按原片物件逐件映射(替换 / 移除 / 保留),不做机械换皮。
没传参考视频:串行级联。 选定目标后先生成环境与调性建议(按目标与产品匹配),确认场景后再生成三个完整时间戳动作方案(三选一、可编辑,动作在选定场景里设计),最后按选定动作派生三套运镜方案——每一步都基于上一步的确认结果。把某张图指派为「场景风格参考」时,拍摄环境会严格以该图的真实画面为准。场景 / 动作 / 运镜与声音板块各有一条「要求 → 生成」操作行 (「本板块要求」输入框 + 右侧生成按钮,回车即生成):生成前写下明确约束(如「要有开箱动作」「开场产品特写慢推」),方案会从设计之初就逐条落实你的要求;改要求后点「重新生成」或回车即按新要求重出。
「声音」板块决定成片的音频设计:选口播讲解 可一键生成三套按镜头时间分段的口播文案(台词写在花括号内、语速与各镜头时长匹配、产品事实只取自你确认的产品信息),口播支持选择语言(中文、English、Español、日本語、ไทย、Bahasa Melayu,默认随站点语言);选纯背景音乐 则生成三套逐段配乐方案;有参考视频时还可选跟随原声节奏 。三选一后可继续手改,成稿会把台词按官方花括号语法逐镜头嵌入、或把配乐写进每个镜头的音频位。不选则不加声音约束。注意:声音设计只有「生成音频」开关开启时才会在成片中生效。
点击生成提示词 (10 积分/次;在 24 小时内把该成稿应用并提交视频渲染时自动全额返还——留在本系统使用等于免费;问答、素材分析与视频分析均免费)。生成的提示词可直接编辑,点应用 后填入提示词框——素材引用会自动变成标记芯片,之后的提交流程与手写提示词完全一致。
成稿体检与一键修复。 成稿下方自动出现「成稿体检」面板:检查素材是否都被引用、有无引用不存在或「未采用」的素材、提到产品的镜头是否写明配色/材质、主体是否在镜头里变回「幼童/博主」类代称、时间段是否连续覆盖成片时长、口播是否超长、正文是否混入 4K/16:9 等渲染参数。全部通过为绿色;有问题时逐条点名,可直接手改(实时重算)或点「一键修复 · 10 积分」按这些问题重新生成一稿(应用并渲染后同样返还)。生成时服务端已先做同一套体检并自动修订一轮。
成片反馈。 成功成片下方有「这条成片符合预期吗?👍 👎」:👍 直接提交,👎 可勾选问题标签(产品外观不符 / 人物不一致 / 动作、运镜、场景不符 / 口播声音 / 字幕水印 / 画质穿模 / 节奏时长)并补一句话,随时可改。不影响任务与积分;反馈与当时的向导配方关联,用于持续改进向导与提示词质量。
说明: 向导按模型方言写作——Seedance 2.0 用「镜头 1/2/3」组织且附官方约束尾句;Seedance 2.5 仅当你在问答中自己给出时间分配(如「0-3秒 特写」)或带有参考视频时才使用时间戳。生成费用在账单中以「视频提示词向导」单独列示。
5.4 视频模型与参数速查
模型 擅长 支持模式
Seedance 2.0 / Fast / Mini 综合性价比,速度快 文 / 图 / 参考
Seedance 2.5 新一代 Seedance,480p/720p 文 / 图 / 参考
MiniMax H3 高质量运动与多模态参考 文 / 图 / 参考
Kling 3.0 可开关音频,支持元素参考 文 / 图 / 参考
Kling 3.0 Turbo Kling 平价档,出片更快 文 / 图
Veo 3.1 Quality / Fast / Lite 画质高,Google 出品 文 / 图 / 参考
Gemini Omni 多模态参考生成 参考
HappyHorse 1.1 阿里出品,九种画幅可选 文 / 图 / 参考
Seedance 2.5 参数: 分辨率仅 480p 或 720p(无 1080p/4K),时长 4–30 秒,参考素材额度与 2.0 三兄弟一致(最多 9 张图片、3 个视频、3 个音频)。文生视频模式下该模型恒定生成音频——音频开关锁定为开启、无法关闭;图生视频与参考生视频保持正常开关。
Seedance 2.5 计价: 不携带参考视频时,480p 每秒 28 积分,720p 每秒 63 积分;携带参考视频时费率降为 480p 每秒 17 积分、720p 每秒 38 积分,另加该参考视频本身的整秒数。Seedance 家族的服务商(Kie / DeepWL / X Deal,价格一致)自 2026-08-16 起由平台统一调度,无需手动选择。Seedance 2.5 已开放于标准视频工作台、故事板和爆款视频复刻。
Kling 3.0 参数: 分辨率 720p / 1080p / 4K,比例 16:9 / 9:16 / 1:1,时长 3–15 秒(默认 5 秒)。音频可开关。图生视频支持首帧、并可再加一张尾帧。参考生视频采用「元素」制 而非扁平参考池:最多定义 3 个元素,每个元素起一个英文名并上传 2–4 张照片,然后必须在提示词中用 @名称 引用 ——未被引用的元素不会生效,提交时会拦截提示。
Kling 3.0 计价: 关闭音频时 720p 每秒 14 积分、1080p 每秒 18 积分;开启音频时 720p 每秒 20 积分、1080p 每秒 27 积分;4K 恒为每秒 67 积分(与音频无关)。Kling 3.0 Turbo 是平价档:仅 720p / 1080p,无音频开关,图生视频只取首帧,计价为 720p 每秒 18 积分、1080p 每秒 22.5 积分。两者均只在标准视频工作台提供。
MiniMax H3 参数: 默认 768P,可选 2K,时长 4–15 秒。文生视频支持 21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16 六种比例;图生视频的比例由首帧(及可选尾帧)决定;参考生视频还可选「自适应」。参考模式最多 9 张图片、3 个视频、3 个音频;不能只上传音频,至少还需一张图片或一个视频。
MiniMax H3 计价: 768P 为 16 积分/秒,2K 为 26 积分/秒(2026-08-17 随上游降价下调);输出时长和每个参考视频的整秒数都按当前清晰度计费。前 5 张参考图免附加费,第 6–9 张每张加 8 积分,参考音频不加收输入费。实际后端服务商由平台路由并随任务固定,不影响你的模型参数或计价。MiniMax H3 仅在标准视频工作台可用 ——它已于 2026 年 8 月退出故事板与爆款视频复刻,这两处请改用 Seedance 家族。
Seedance 服务商: 自 2026-08-16 起由平台自动调度(Kie / DeepWL / X Deal 三条通道,价格完全一致),无需也无法手动选择。不同通道的表单能力略有差异(例如某通道音频恒定开启时不显示音频开关、比例选项略有增减),表单会自动按当前通道渲染。已提交任务的路由随任务冻结,之后的平台调度不影响它。
说明: 切换模型后,界面会自动过滤出该模型支持的分辨率、时长与宽高比;不支持的选项不会出现。具体积分价格以生成按钮上的数字为准。
5.5 查看与下载结果
提交后右侧预览区 显示「等待中 / 生成中」,完成后自动显示视频。
点击视频可播放;点击下载 按钮保存到本地。
所有任务也会出现在我的创作 页(见第 18 章),点击卡片可再次查看或重试。
运行中也可调参: 任务提交成功后,当前工作区会立即显示调整参数重试 。点击后会把相同素材与参数保留在一个可编辑的新任务表单中,原任务继续运行。调整操作本身不收费,只有再次提交新任务时才扣除积分。
6. AI 图片生成
图片生成分两种模式:文生图(纯文字)与图生图(上传参考图改绘)。两者共用同一界面,顶部页签切换。
6.1 文生图
图 6-1 文生图工作区
左侧菜单进入文生图 。
模型: 点击下拉框选择图片模型(详见 6.3 速查表)。
宽高比: 点击选择「自动 / 1:1 / 3:2 / 16:9 / 9:16」等;部分模型还提供「自定义」尺寸。
质量 / 分辨率: GPT Image 2 Flex 提供 auto/low/medium/high 质量档;其它模型提供 1K/2K/4K 分辨率。
提示词: 输入画面描述。
确认生成 · N 积分 价格后点击生成。
图 6-2 图片模型下拉列表(每个模型带品牌图标)
6.2 图生图与素材库
上传一张或多张参考图,让 AI 在其基础上改绘。
图 6-3 图生图工作区
进入图生图 。
在上传区点击添加 上传本地图片,或点击素材库 从历史素材中选用。
填写提示词描述要如何修改(如「更换背景为纯白影棚」)。
设置模型与参数后点击生成 。
图 6-4 素材库选择弹窗(可多选,点击已选素材可取消)
素材库弹窗操作: 顶部的全部素材 / 文件夹 按钮用于缩小选择范围;弹窗内向下滚动会自动加载更多 素材。点击缩略图即选中并加入上传区(选中的会显示彩色描边与「已添加」标记),再次点击可取消选择 ,不会移动原素材的文件夹归属。
运行中也可调参: 图片任务提交后会立即显示调整参数重试 。点击后,提示词、图片和参数会保留在可编辑的新任务表单中,原任务继续生成;只有再次提交新任务时才扣除积分。
6.3 图片模型与参数速查
模型 特点 可选精度
GPT Image 2 Flex 官方线路,支持质量档与自定义尺寸 质量 auto/low/medium/high
GPT Image 2 HD 高清线路 1K / 2K / 4K
Nano Banana Pro Gemini 系图片模型 1K / 2K / 4K
Seedream 5 Pro 字节跳动旗舰,7 种固定比例 1K / 2K
7. 智能改图
对已生成的图片进行「标注式局部修改」:在图上手绘圈选、箭头、文字,描述修改要求,AI 会按标注修改并覆盖原图 。文生图 / 图生图的成品、故事板的分镜图,以及商品套图、图片复刻、衣服图案裂变、衣服图案迁移 的每张成品图都支持。
如何进入
在图片生成成功后,右侧预览区的下载 按钮旁会出现智能改图 按钮;故事板的板图成功后操作区同样有该按钮;商品套图 / 图片复刻 / 衣服图案裂变 / 衣服图案迁移的每张已完成卡片上也有对应入口。点击即打开编辑器。
图 7-1 图片生成结果 · 预览区的「智能改图」入口
编辑器工具说明
图 7-2 智能改图编辑器
工具 作用
标记 点击落编号图钉,或拖拽画出虚线框,标出要修改的区域(编号自动递增,可在提示词中引用)
画笔 自由涂画,可从色板选颜色(红/黄/绿/蓝/黑/白)
箭头 / 直线 拖拽绘制箭头或直线,指示修改方向
文本 点击画面落文本框,输入文字后回车确认
橡皮擦 切换后,点击任意标注即可将其删除(按对象删除,不是像素擦)
撤销 / 重做 回退或恢复上一步标注操作
缩放 点击「−/+」按钮,或直接在画布上滚动鼠标滚轮 放大 / 缩小(50%–300%)
操作步骤
点击智能改图 打开编辑器。
用工具在图上标注要修改的位置(例如用「标记」框住某个物体,或用画笔圈出区域)。
在底部输入框描述修改要求 (可引用标记编号,如「把标记 1 处的红苹果换成青苹果」)。
选择本次改图使用的模型 与分辨率 (默认沿用原图的模型),确认按钮上的积分价格。
点击改图 · N 积分 提交。图片进入「改图中…」,完成后新图会替换原图 。
注意:覆盖不可撤销。 改图成功后新图会覆盖原图、旧图被销毁,无法找回。若改图失败,系统会自动退款且原图保持不变。
8. 故事板(AI 智能体)
故事板是一条完整的电商短视频流水线:上传产品 / 人物 / 场景素材 → AI 编剧撰写画面提示词 → 生成多镜头分镜图 → AI 编剧撰写视频提示词 → 视频模型渲染成片。
图 8-1 故事板工作区
操作步骤
上传素材: 在产品图片 (必填)、人物图片 、场景图片 三个分组分别上传参考图。三个分组共享一个总配额 (多数模型 8 张,Gemini Omni 为 6 张),可按需要自由分配。
视频参数: 设置目标视频比例、口播语言(English / 中文 / Español / 日本語 / Bahasa Melayu / ไทย)、提示词生成模型、板图生成模型、视频生成模型、Seedance 服务商(仅选择 Seedance 时显示)、分辨率、时长、镜头数。
额外需求(可选): 在下方填写卖点、风格、目标人群等补充说明,AI 会优先采纳。
一键生成: 点击生成 。系统会依次:① 编剧撰写画面提示词 → ② 板图模型渲染分镜图。右侧提示词框会实时显示 AI 写好的提示词,可手动编辑。
生成视频提示词: 分镜图完成后,点击视频提示词区的AI 辅助生成 ,AI 会根据分镜图撰写视频提示词。
渲染视频: 确认后提交,视频模型据此渲染成片。
不停止原故事板即可调参: 提交后,左侧素材和参数会保持冻结,直到点击调整参数重试 。点击后会脱离旧任务并生成一个可编辑的新故事板表单,不会重绘、停止或修改旧故事板;旧流程仍在后台继续。
参数说明
参数 说明
板图生成模型 GPT Image 2 Flex / HD,用于绘制分镜图
视频生成模型 Seedance 2.0 / Fast / Mini、Seedance 2.5、Gemini Omni
Seedance 服务商 平台自动调度(Kie / DeepWL / X Deal,价格一致);随故事板任务冻结,最终渲染视频时沿用
口播语言 控制口播 / 字幕语言;画面内文字统一为英文(图片模型渲染中文不稳定)
时长 / 镜头数 时长影响建议镜头数(约每 1.7 秒一个镜头),镜头数可手动调整
Seedance 2.5 在故事板中: 位于 Seedance 2.0 Mini 之后,共享同一个 8 张参考池,分辨率仅 480p/720p(无 1080p/4K)。服务商由平台自动调度,最终渲染视频按不含参考视频的费率计价(详见第 5.4 节)。
与智能改图配合: 分镜图生成后如需局部调整,点击板图操作区的智能改图 即可(见第 7 节),改好后再进行视频渲染。
说明: 故事板的每个步骤(编剧、板图、视频)单独计费,界面按钮会显示当次所需积分。完成的故事板在「我的创作」中以一张合并卡片展示。
9. 商品套图(AI 智能体)
上传商品图,AI 规划并批量生成一整套电商上架图:白底主图、场景图、卖点图与更多。适合快速搭建 Amazon / TikTok Shop / 速卖通等平台的商品详情页。
图 9-1 商品套图工作区
操作步骤
上传产品图片: 最多 8 张,可从素材库选用。
目标平台 / 目标市场 / 文案语言: 选择上架平台(TikTok Shop、Amazon、速卖通、独立站等)、目标市场与图内文案语言。AI 会按平台的真实图片规范(如 Amazon 纯白底、主体占比约 85%)来规划。
产品卖点: 按「产品名 / 核心卖点 / 适用人群 / 期望场景 / 尺寸参数」五行骨架填写;也可点击AI 生成 (2 积分)让 AI 根据商品图自动填写后再修改。
设计风格 (三选一):
AI 推荐: 点击「AI 推荐风格分析」,AI 分析商品图给出风格方案(2 积分),文字可编辑;
风格模板: 从 20 款预设风格中直接挑选(见图 9-2),涵盖质感高端 / 清新自然 / 活力潮流 / 品类特化四组,如「高端杂志感」「奶油少女系」「暗调奢华」「素人实拍」等;
自定义要求: 直接输入配色偏好、排版风格、创意方向等文字要求。
套图结构配置: 「智能匹配」由 AI 自动搭配各类图的数量;「自定义配置」可手动调整白底图 / 场景图 / 卖点图 / 其他各类数量(共 4–12 张,白底图至少 1 张)。
生成套图规划 (2 积分):AI 为每张图规划类别、标题与英文渲染提示词,以卡片列表展示。可勾选 / 取消某些卡片,也可直接编辑每张卡的提示词。
批量出图: 在右侧选择出图模型(GPT Image 2 / Seedream 5 Pro / Nano Banana Pro)、质量档 / 分辨率与比例,点击生成勾选图片 · N 积分 。每张图独立计费、独立生成,完成一张显示一张。
图 9-2 设计风格 · 风格模板(20 款,带主题图标)
每张成品图的操作
操作 说明
智能改图 打开标注编辑器局部修改(见第 7 节),改图会覆盖该张图
放大查看 / 下载 查看原图、保存到本地
改词重生成 修改该卡提示词后重新生成一张(正常计费,旧图作废)
提示: 规划阶段只花 2 积分——先看 AI 的整套方案与提示词,满意再批量出图,不满意可点调整参数重试 载入原参数重新规划。
说明: 发给图片模型的提示词始终为英文(中文模型渲染不稳定);你用中文修改提示词时系统会自动翻译成英文再出图。整套任务在「我的创作」显示为一张合并卡片,账单中所有子费用归组为一条记录。
10. 图片复刻(AI 智能体)
看到风格出色的竞品主图?上传它作为风格参考,再上传自己的商品图,AI 按参考图的构图版式批量输出属于你的商品主图——每张参考图对应一张成品。
图 10-1 图片复刻工作区
操作步骤
风格参考图: 最多 12 张,每张参考图会生成一张对应风格的成品。
商品图: 上传自己的商品照片(上限随模型与人物图数量动态变化,界面实时显示)。AI 只会画你的商品,绝不会把参考图里的商品搬进成品。
人物图(可选): 最多 2 张。只取模特的长相与身形,衣服一律以商品图为准 ——适合服装类目让「自己的模特」穿上「自己的衣服」。
目标市场 / 文案语言: 决定图内文案的语言与审美取向。
复刻程度 (二选一):参考排版 ——沿用版式、背景结构与主体关系,配色按商品本身设计;高度复刻 ——构图、版式、配色与细节全面复刻,只替换商品和卖点。
核心卖点(必填): 手动填写或点击AI 生成 (2 积分)自动提炼。
统一复刻要求(可选): 对整套图的统一约束,如「文案统一用英文」「模特姿势保持不变」。要求会逐项写入每张提示词:数字(尺寸/厚度/角度)逐字保留,风格专名与结构卖点词以对应英文显式出现,系统还会对数字做机械核对、缺失时自动补写一轮。
生成方案 (2 积分):AI 为每张参考图规划一条渲染提示词,卡片可勾选、可编辑。
批量出图: 右侧选择模型、质量档与比例后点击生成勾选图片 。单卡操作(智能改图 / 下载 / 改词重生成)与商品套图一致。
版权提醒: 参考图仅用于让 AI 理解构图与风格,请勿直接商用他人图片素材;成品图中的商品、人物均来自你自己上传的素材。
11. 衣服图案裂变(AI 智能体)
把 1–6 张版型图、图案素材、上身图或细节图整理成草稿,点击开始分析(免费) 创建可离开的持久任务;复核已保存的 AI 识别结果后,再点击确认生成 付费生成方案与平铺图,最后一键批量生成模特展示图。
图 11-1 衣服图案裂变工作区
操作步骤
整理本地草稿(1–6 张,可混合上传,无需分组): 版型图提供剪裁与轮廓,图案素材提供风格 DNA,上身图同时提供版型与图案,细节图只辅助理解。可自由增删、排序;仅上传不会调用 AI,也不会创建任务。
开始分析(免费): 主动点击后,系统先创建任务,再由持久工作流逐图分析。任务会立即出现在「我的创作」;此时离开页面、关闭浏览器或换设备都不会中断。该阶段不扣积分,也不产生账单记录。
复核已保存的分析: 每张素材会获得角色和摘要;降级结果标记为「需要人工确认」。素材及顺序保持冻结,但角色、摘要和全部分析字段均可编辑。
品类 / 目标性别 / 底色: 由 AI 根据上传图片自动识别并填入,均可编辑;底色为可选文字描述(如「黑色」「米白」)。
风格 DNA / 售卖定位 / 场景建议 / 模特人设建议: AI 自动生成的四段说明(配色元素、目标客群、拍摄场景、模特风格),均可直接编辑覆盖。
裂变数量: 10–20 个变体,默认 10,步进器调整。
模型 / 档位 / 两个比例: 衣服图案裂变支持 GPT Image 2 HD(默认) 、Nano Banana Pro、Seedream 5 Pro;选择质量档位,并分别设置平铺图比例 与模特图比例 (两者均默认 1:1)。这些参数只在确认付费生成时冻结。
确认生成 (方案 2 积分 + 每个变体的平铺图按所选模型计价,精确总价在按钮上明示):这是流程中的首次付费操作;确认后 AI 立即写出方案并自动渲染全部平铺图。
英文 Logo 与字体版式: 每个新变体会自动获得一个不同的虚构英文品牌名,并按需要附带标语、字体风格和版式;这些信息会显示在卡片摘要中。提示词重生成时会保持该变体已冻结的 Logo 设计;模特图则以最新平铺图为唯一锚点,沿用完全相同的可见拼写与排版。
结果区(三列工作流): 每个变体一行,按生成顺序显示平铺图 / 模特图 / 图案矢量图 三列——桌面端并排显示,手机端纵向堆叠为同一顺序。每张卡片标题旁有一个勾选框,只要该卡自己的平铺图已成功即可勾选,默认全选。
多选批量生成: 全部平铺图渲染完成(成功或失败)且至少一张成功后,结果区顶部出现批量工具栏——一个全选 勾选框(点击可在全选/清空之间切换)+ 两个独立按钮生成所选模特图 与生成所选矢量图 ,各自的价格按「当前勾选且尚未生成该项」的卡片数实时计算。取消勾选某张卡即可把它排除在这一次批量之外;已经生成过模特图或矢量图的卡片即使仍勾选,也不会被重复计费或重新生成——两个按钮互不影响彼此的勾选状态。也可在单张卡片上单独点击生成模特图 。
图案矢量图(印刷级文件,结果区第三列): 某个变体的平铺图渲染成功后,该列会出现生成图案矢量图 按钮(16 积分,与是否已生成模特图无关)——AI 从该平铺图中只提取印花本体,重绘为白底透明、约 4096 像素(300dpi 下约 34.7cm,落在 32–36cm 印刷幅面区间)的独立文件;预览用棋盘格背景展示透明效果,点击下载 获取文件名带 -300dpi 后缀的 PNG。渲染失败可原地按价格点击重试 。
统一修改并重新生成: 图片下方不再分别放置两个重生成按钮。点击卡片提示词区域右上角的修改并重新生成 ,可同时编辑平铺图提示词,以及模特人设、拍摄场景、光线效果。只修改模特设定时,仅重新生成模特图;修改平铺图提示词时,系统先重新生成平铺图,再自动用新平铺图生成模特图。按钮会显示本次实际范围和积分,离开页面也不会中断已提交的两阶段任务。
其他单卡操作: 智能改图(见第 7 节,局部修改并覆盖原图)、放大查看、下载。
两段式更安全: 开始分析 免费且可离开;确认生成 才是明确的计费边界。任务 id 一创建(包括仍在分析时)就会显示调整参数重试 ,点击后打开预填的新草稿,不会修改或停止原任务。
商用提醒: 系统生成的英文品牌名、标语和字体版式均为创意示例,不代表已完成商标检索或注册。用于商品、包装、店铺或广告前,请自行完成目标市场的商标与名称可用性检索。
说明: 免费分析不产生账单记录。确认生成时才收取固定 2 积分方案费及全部平铺图费用;模特图另行计费。整套任务在「我的创作」显示为一张合并卡片:真实子图出现前显示分析 / 待确认阶段,之后显示实时子图进度。历史 Flex 任务仍可查看;点击调整参数重试 后,新表单会切换为 GPT Image 2 HD。
12. 衣服图案迁移(AI 智能体)
同一款式的多个颜色版本共用一个图案:上传每个颜色一张的版型图(1–12 张)与一个图案(直传,或从一张爆款款式图免费提取),点击开始分析(免费) 创建可离开的持久任务;复核颜色清单与图案预览后,再点击确认生成 付费生成方案,系统会把图案逐色像素级迁移并自动渲染全部平铺图,平铺图审核通过后再逐色生成模特展示图(全组同一模特、每色不同场景)。
图 12-1 衣服图案迁移工作区
操作步骤
同款多颜色衣服照片(1–12 张): 每张对应该款式的一个颜色版本,可自由增删、排序。
图案来源: 二选一——直传图案图 (单独的图案素材或印花特写);或从爆款款式图免费提取 :上传一张带有目标图案的爆款衣服照片,系统立即在后台免费识别并抠出图案,卡片上会显示「提取中…」,完成后自动切换为「提取完成」并显示预览图,可点击重新提取 换一次结果,或直接切回「直传图案」改用其他图。同一张爆款图重复使用会命中缓存,秒级完成、零成本。
模特参考图(可选,0–2 张): 上传则全组固定为该模特身份;不传则由 AI 设计一位匹配衣服风格与目标市场的模特,全组同一人。
图案配色策略: 原色保真 (默认,图案颜色像素级不变)或自适应配色 (图案的图形与排布保持不变,颜色按每件衣服的颜色协调微调)。
平铺风格 / 模型 / 档位 / 目标市场 / 两个比例: 衣服图案迁移支持 GPT Image 2 HD(默认) 、Nano Banana Pro、Seedream 5 Pro;分别设置平铺图比例 与模特图比例 (两者均默认 1:1)。这些参数只在确认付费生成时冻结。
开始分析(免费): 主动点击后,系统先创建任务,再逐颜色识别颜色名(中英文)、品类、性别,并检查各张衣服是否确属同一款式。任务立即出现在「我的创作」,离开页面不会中断。该阶段不扣积分。
复核 analysis_ready: 颜色清单(每个颜色的缩略图 + 可编辑的中英文颜色名)、图案预览、品类 / 性别(均可编辑);若某张衣服的版型与其他明显不同,会出现非阻断的一致性提示 ,是否继续由你决定。
确认生成 (方案 2 积分 + 每个颜色的平铺图按所选模型计价,精确总价在按钮上明示):这是流程中的首次付费操作;确认后 AI 把图案迁移到每个颜色并自动渲染全部平铺图。
结果区(颜色卡网格): 每个颜色一张卡片,顶部显示颜色名徽章,下方按生成顺序显示平铺图 / 模特图 / 图案矢量图 三列——桌面端并排显示,手机端纵向堆叠为同一顺序。每张卡片标题旁有一个勾选框,只要该颜色自己的平铺图已成功即可勾选,默认全选。平铺图渲染成功且已归档缩略图后,模特图列才会出现生成模特图 按钮——用同一模特身份,按该颜色专属的场景与姿态单独渲染,费用独立计算。
多选批量生成: 全部平铺图渲染完成(成功或失败)且至少一张成功后,结果区顶部出现批量工具栏——一个全选 勾选框(点击可在全选/清空之间切换)+ 两个独立按钮生成所选模特图 与生成所选矢量图 ,各自的价格按「当前勾选且尚未生成该项」的颜色数实时计算。取消勾选某个颜色即可把它排除在这一次批量之外;已经生成过模特图或矢量图的颜色即使仍勾选,也不会被重复计费或重新生成。
图案矢量图(印刷级文件,结果区第三列): 某个颜色的平铺图渲染成功后,该列会出现生成图案矢量图 按钮(16 积分,与是否已生成模特图无关)——AI 从该平铺图中只提取印花本体,重绘为白底透明、约 4096 像素(300dpi 下约 34.7cm,落在 32–36cm 印刷幅面区间)的独立文件;预览用棋盘格背景展示透明效果,点击下载 获取文件名带 -300dpi 后缀的 PNG。渲染失败可原地按价格点击重试 。
统一修改并重新生成: 点击卡片提示词区域右上角的修改并重新生成 ,可同时编辑平铺图提示词、场景与姿态。只修改场景 / 姿态时,仅重新生成模特图;修改平铺图提示词时,系统先重新生成平铺图,再自动用新平铺图生成模特图。
其他单卡操作: 智能改图(见第 7 节,局部修改并覆盖原图)、放大查看、下载。
两段式更安全: 图案提取与开始分析 均免费且可离开;确认生成 才是明确的计费边界。任务 id 一创建就会显示调整参数重试 ,点击后打开预填的新草稿,不会修改或停止原任务。
说明: 图案提取全程免费,结果按来源图内容寻址缓存,同一张图重复提取不再产生新的处理。确认生成时才收取固定 2 积分方案费及全部颜色的平铺图费用;模特图另行计费,人物参考图不计入平铺图输入。整套任务在「我的创作」显示为一张合并卡片,账单归组为一条「衣服图案迁移」记录(与「衣服图案裂变」分开统计与筛选)。
13. 爆款视频复刻(AI 智能体)
上传一条爆款参考视频,AI 分析它的镜头手法、节奏与口播,替换成你自己的人物 / 产品 / 场景后逐段重新渲染,最后一键合成完整成片。受控测试账号还可对比稳定的「原视频参考」与实验性的「深度参考」路径。
图 13-1 爆款视频复刻工作区
操作步骤
参考视频: 上传 MP4/MOV,时长 3–60 秒,不超过 100MB。上传后系统会免费自动检测口播 并逐字转写;同一次分析始终会生成发布标题和 3–5 个保留 #、可直接复制发布的标签。原视频标题与 tag 为可选输入,仅用于参考其结构与语气。
参考模式(仅受控测试账号): 原视频参考 · 稳定 为默认路径,把裁剪后的源片段交给视频模型;深度参考 · 实验性 会先把每段转换成深度动作视频,保留人物 / 物体的几何结构与运动,同时压低源片的颜色、纹理和身份外观。账号未启用实验时不会显示选择器;历史任务仍会如实显示当时使用的模式。
替换图: 产品图必传;人物 / 产品 / 场景三组共享 8 个槽位。人物图会免费自动做白底预处理 (「白底✓」)。原视频模式下,留空分组可沿用 / 推断源片中的同类要素,场景为空时还可使用源片最干净的一帧;深度模式会刻意隔离源片外观,只由你上传的替换图锚定人物身份、产品和场景,因此需要的外观都应显式上传。
产品卖点与统一要求: 填写有事实依据的产品卖点(必填,可用 AI 生成),并可补充作用于整条视频的镜头、造型或文案要求;所有片段共用。
口播文案 (二选一):AI 重新创作 会依据产品可见事实与卖点写新口播;沿用原口播(可微调) 会逐字使用检测稿与手动修改。沿用模式留空文案表示保留参考原声;重写模式也能为无口播源片新增旁白。生成字幕 默认关闭,口播语言支持英 / 中 / 西 / 日 / 马来 / 泰语。
选择视频生成参数: 在「分析分镜」按钮之前选择模型、分辨率与比例。Seedance 全家族(2.0 / Fast / Mini / 2.5)的服务商由平台自动调度;Seedance 2.5 紧跟在 Seedance Mini 之后,仅提供 480p / 720p。提交分析时这组参数立即冻结,之后补渲、重渲自动沿用。
分析分镜 (2 积分):AI 输出逐段复刻脚本——每段 4–15 秒,含镜头运动、动作描述与该段口播文案。系统在同一次分析调用中直接生成最终模型适用的提示词,不增加调用或费用:Seedance 使用其素材角色语法。口播行可单独点击编辑。
渲染视频: 勾选要渲染的片段(可全选),点击生成视频 。片段按时间顺序接力渲染 :系统把前一段的最后一帧交给后一段参考。
合成完整成片: 全部片段成功后出现合成完整视频 按钮(免费),一键拼接成片;某段重渲后可重新合成 。
深度渲染要求预览: 深度模式的未渲染片段会按当前网站语言显示完整渲染要求,并随补充要求即时更新,方便提交前核对。发送给生成模型的请求仍使用针对模型优化的英文内部提示词;口播台词不会因此改成英文,始终保留你在口播语言中选择的语言。
Seedance 2.5 在爆款视频复刻中: 每个片段渲染都会携带一段物化好的参考片段,因此计价始终使用第 5.4 节中更便宜的含参考视频费率(不会按不含参考视频的费率计价)。针对被内容审核拒绝或触发版权判定的片段的自动恢复机制(先改写提示词重试,再降级为静音片段 + AI 生成配乐)同样适用于 Seedance 2.5 片段。
过程控制
操作 说明
停止生成 渲染中可随时点击「停止生成」:未完成片段标记失败并退款,已完成片段保留,之后仍可单独重渲
重试失败段 / 改词重生成 失败或不满意的片段可单独重渲(正常计费),会自动从最近一个成功片段接力
调整参数重试 载入本次提交(或历史首个子任务恢复)的模型、服务商、分辨率、比例及其它输入,创建一个参数可编辑的全新任务
如何选择: 日常使用请选择稳定的原视频路径,尤其是需要借用源片场景 / 外观信息时;若测试账号可见深度模式,可用它评估更强外观隔离下的动作迁移。深度预处理会增加一些等待时间;若准备失败,片段会安全失败并退款,可切回原视频模式重试。
计费说明: 切换参考模式本身不另收费。分析 2 积分;每个片段按所选模型 / 分辨率 / 时长独立计费;前序片段失败会自动取消后续片段并退款;成片合成免费。同一任务的全部费用在账单中归组为一条记录。
内容审核: 个别参考画面可能被平台内容审核拦截(系统会先自动尝试净化提示词与静音重试)。若片段提示「参考画面被拦截」,请更换参考视频或调整该段内容。
14. 视频超分(AI 智能体)
把低分辨率、模糊的视频提升为高清:AI 超分辨率算子逐帧重建细节,输出 720p / 1080p / 2K / 4K。工作区空态提供一段真实前后对比演示——左「改前」右「改后」,滑动分界线即可对比。
图 14-1 视频超分工作区(右侧为滑动对比演示)
操作步骤
选择超分模型 (二选一):Volcengine 视频超分 ——自选目标分辨率 720p–4K,适合任何尺寸的源;阿里云视频超分 ——固定放大 2 倍并增强画质,要求源分辨率大于 360×360 且小于 1920×1080、文件不超过 1GB,按时长计费(固定 2 积分/秒)。
上传源视频: 时长不超过 600 秒(10 分钟),可从素材库选用。
选择目标分辨率 (火山引擎模式):720p / 1080p / 2K / 4K 四档。竖屏视频按短边计档(如竖屏 1080p 输出 1080×1920)。阿里云模式无需此步——输出恒为源的 2 倍。
确认报价: 按钮上实时显示所需积分——价格与视频时长、帧率、目标分辨率成正比;下方同时显示预计处理时长 。实际时长 / 帧率以服务端探测为准。
点击开始超分 。任务进入后台处理,界面显示「预计剩余」,期间可离开页面。
完成后右侧显示成品视频,点击下载 保存。
价格参考: 720p 档最便宜;1080p 约为其 3 倍,2K 约 5 倍,4K 约 11 倍;高帧率(>30fps)视频按帧率档位加成。一段 1 分钟 30fps 视频超到 720p 约 53 积分。
说明: 长视频 + 高分辨率的组合处理时间可达数小时,系统最长等待 24 小时;超时或失败自动退款。删除处理中的任务同样会退款。
15. 动作迁移(AI 智能体)
把一段参考视频里的动作,迁移到你自己的角色照片上:上传一张角色照 + 一段动作视频,AI 让照片里的主体做出视频里的动作。成片时长与动作视频一致,并沿用其声音。
图 15-1 动作迁移工作区(左侧素材与参数,右侧预览)
先选模型
本页提供两个互补的模型,选择会同时改变可用参数与价格:
Wan 2.2 Animate Kling 3.0 Motion Control(默认)
适用主体 不限真人 ——宠物、玩偶等同样可用仅真人 (供应商会做人物检测,宠物/物体会被直接拒,这种失败不扣积分)
分辨率 480p / 720p 720p / 1080p
视频时长 5–120 秒 3–30 秒
价格 480p 8 积分/秒,720p 16 积分/秒(不足 5 秒按 5 秒计) 720p 20 积分/秒,1080p 27 积分/秒
沿用视频场景 选「换进视频」即原生支持 需开启「场景跟随视频」由本站预处理
简单说:要 1080p 选 Kling,其余情况选 Wan ——Wan 更便宜、支持更长的视频,也是唯一能做非真人主体的。
操作步骤
上传角色图片 (1 张):需清晰展示主体的头部与上身。JPG / PNG,不超过 10MB,最小边 340px,画面比例在 2:5 – 5:2 之间。
上传动作参考视频 (1 段):MP4 / MOV,不超过 100MB,最小边 340px,时长须落在所选模型的区间内(见上表)。
迁移方式(Wan 专有): 换进视频 (默认)把视频里的主体换成你的角色,成片沿用视频的场景与镜头 ;套用动作 则只把动作套到角色照片上,保留角色照片原本的背景。
场景跟随视频 (Kling,以及 Wan 的「套用动作」):开启后,系统会在提交前免费把动作视频首帧的场景与人物姿态 一并合成进你的角色照片——成片背景与视频一致,且起手姿态就与视频对齐,动作衔接更自然;关闭则沿用角色照片原本的背景与姿态。合成约需 1 分钟,期间「生成」按钮不可点击。合成完成后,角色图片会直接换成合成图 ,你在提交前就能确认将要渲染的是什么。若对合成结果不满意,可在下方的补充要求框里写一句话(例如「站得更靠近镜头」「不要戴眼镜」),再点重新生成场景图 ——补充要求仅在点击该按钮时生效。Wan 的「换进视频」原生就沿用视频场景,因此不显示这个开关。
选择分辨率: 随模型变化(Wan 480p/720p,Kling 720p/1080p)。
选择角色方向(Kling 专有): 「跟随视频」时复杂动作还原更好;「跟随图片」时更支持镜头运动。
提示词(可选): 可留空。需要强调某个动作细节时再填。
点击生成 。按钮上实时显示所需积分。
计价
两个模型都按动作视频的时长 计费(成片时长与之相同,不足 1 秒的部分不计)。Wan 2.2 Animate:480p 8 积分/秒、720p 16 积分/秒,不足 5 秒按 5 秒计 ;Kling 3.0 Motion Control:720p 20 积分/秒、1080p 27 积分/秒。例如一段 8 秒的动作视频,Wan 720p 需 128 积分,Kling 720p 需 160 积分。提交时服务端会重新读取视频真实时长后再扣费,因此最终扣费以真实秒数为准。
拍摄建议: 角色照片用正面、光线均匀、主体完整入镜的照片效果最好;动作视频里的主体越清晰、动作幅度越明确,迁移效果越准。
关于场景: 除 Wan 的「换进视频」外,成片背景都取自角色图片 。这就是「场景跟随视频」开关的意义——它把视频首帧的场景与姿态先合成进角色照片,从而让成片看起来像是在视频的环境里拍的,并且开头的动作能自然接上。若合成失败,系统会自动改用角色照片的原始背景继续渲染,不会中断任务,界面上也会提示。
16. 视频编辑(AI 智能体)
用一句话改一条已有视频:修改 / 增加 / 删除画面元素、编辑声音、向后延长、多段转场拼接。既可直接上传视频,也可从任意 AI 成片卡右下角的「视频编辑」按钮一键带入。
图 16-1 视频编辑工作区(中央画布 + 帧带 + 指令条,右侧参数)
六类任务
任务 用途
修改元素 把画面里的某个东西换成另一个(颜色 / 材质 / 主体 / 背景…)
增加元素 在指定位置、指定时机加入新元素
删除元素 去掉水印、路人、多余物件——未提及的部分保持原样
声音编辑 删除背景音乐 / 修改人声 / 增加音效,画面保持不变
延长视频 向后延长内容,风格与叙事无缝衔接
转场拼接 2–3 段视频补全过渡、无缝相接
选中任一任务,指令框会预填官方推荐句式模板——只需替换尖括号里的空位;已手改的内容切换任务时不会被覆盖。
操作步骤
加入源视频 :上传 / 素材库选择 / 从成片带入。单条时长上限随模型:Seedance 2.5 为 30 秒,2.0 家族为 15 秒;转场拼接可加 2–3 条。
浏览帧带 :播放器下方是剪映式帧带时间轴(按宽度均匀采样,自动填满不滚动),点击或拖动即可定位播放头,编辑对象在第几秒一目了然。
圈定编辑区间(Seedance 2.5) :在帧带上按住直接拖选即可圈定区间(区间外画面压暗;两端手柄可微调,单击仍是定位),「在 N-Ms 区间内」自动写进指令,编辑只作用于该时间段;拖回全幅即取消区间。
选任务类型并完善指令 :替换模板空位即可;也可完全自己写。
(可选)辅助参考图 :换商品 / 换印花等组合任务,附上产品图并在指令里写「参考 图片1 的产品…」。
选模型与分辨率 :Seedance 全家族四模型。2.5 的编辑任务自动对齐源片时长与画幅 (官方规范锁定,无需选择);2.0 家族与延长任务可显式指定输出时长。
点击生成 (按钮实时报价)。完成后播放器左上角原片 / 编辑后 一键对比;成片可以成片继续编辑 形成链式迭代,或发送到视频超分 。
计价
沿用带参考视频的费率:(输出秒数 + 源片取整秒数)× 每秒积分 。例如 Seedance 2.5 480p 编辑一条 13 秒源片 = 17 × (13+13) = 442 积分;2.0 Mini 480p 同任务输出 5 秒 = 2.4 × (5+13) ≈ 43.2 积分。转场拼接的输出为各段之和再加每个过渡约 1 秒。失败自动退款。
写好编辑指令的三个要点: ① 用「编辑视频 / 修改 / 删除 / 增加」这类明确动词开头;② 描述要改的对象时给出可辨认的特征(颜色、位置、材质);③ 结尾保留「其余画面、动作、运镜与声音保持不变」——官方明确强调保持项能显著提升未编辑部分的保真度(模板已自带,系统也会自动补全)。
关于结果: 编辑输出本质是「按你的指令重新生成」而非逐像素手术,未编辑部分保真度极高但并非逐比特一致;对结果不满意可调整指令重试(新任务,原任务不受影响)。
17. 文字转语音(AI 智能体)
把文案变成自然口播音频:输入或粘贴文案,选择音色与模型档位,一键合成 mp3。支持停顿标记、情绪标签(表现力档)与 AI 文案润色,历史任务与示例就在工作区右侧。
图 17-1 文字转语音工作区(左侧文案与参数,右侧历史/示例)
操作步骤
输入文案: 上限 2000 字符(计费按字符数,插入的标记同样计入)。工具条可插入停顿标记 ——菜单内容随档位变化:标准档 是精确秒数(0.3 / 0.5 / 0.8 / 1 / 1.5 / 2 / 3 秒,朗读为等长静音);表现力档 是短 / 中 / 长三档语义停顿(约 0.5 / 1.5 / 2.3 秒),因为该档模型不支持秒数式停顿标记。智能标记 (2 积分)分析文案并自动插入合适的停顿标记与情绪标签(标准档只插停顿),文字本身一字不改。
选择音色: 点击「更换音色」打开音色库——16 个精选男女音色,支持性别筛选、名称搜索、试听与收藏;「自定义音色」tab 列出你克隆的专属音色(见本章「声音克隆」小节)。音色会被记住 ——再次进入工作台时默认选中你上次用过的音色(若该音色已被删除则回到内置默认)。
选择模型档位: 标准档 (3 积分/100 字符)速度快、价格省,语速 / 稳定性 / 相似度 / 风格强度滑杆全开;表现力档 (5 积分/100 字符)演绎最自然,解锁情绪标签 ——工具条按「笑 / 情绪 / 气息与口部 / 语气台风 / 其它」五组提供 50 个常用标签(如 [laughs] 大笑、[whispers] 耳语、[professional] 专业、[warmly] 温暖);该模型对描述性标签是开放的,你也可以自己在文案里手写,例如 [frustrated sigh]。稳定性为「创意 / 自然 / 稳健」三档预设。
点击生成语音 (按钮实时显示价格,不足 100 字符按 100 计)。任务出现在右侧「历史」并自动刷新到完成。
完成后卡片内直接播放,可下载 mp3、回填文案 再次编辑,或删除 (删除同时销毁成品文件)。
示例: 右侧「示例」tab 提供三段带标签的成品文案(含试听音频),点「试一试」即可回填表单直接体验。
说明: 中文由多语言模型驱动,不同音色的口音风格略有差异,建议先试听再选择;任务失败或超时自动退款。我的创作与积分账单均已同步——账单里 AI 润色费与合成费归组为一条「文字转语音」条目。
声音克隆
上传自己的参考音频,克隆出专属音色——克隆完成后即可在文字转语音的「自定义音色」tab 中选用,也可从克隆历史一键「在文字转语音中使用」。
图 17-2 声音克隆工作区(左侧名称与参考音频,右侧克隆历史)
命名音色 并上传 1–3 段参考音频 (每段建议 30 秒–3 分钟的干净人声,无背景音乐/噪音效果最佳,也可从素材库选择)。
点击克隆音色(100 积分/个) 。克隆通常几十秒内完成,完成后卡片附带一段自动生成的试听。
点「在文字转语音中使用」 直接带着该音色进入合成页;或在文字转语音的音色库「自定义音色」tab 中随时选用与收藏。
说明: 克隆音色仅你本人可见可用 ;每个账户最多保留 2 个克隆音色,删除即释放名额 (已生成的历史音频不受影响)。克隆失败或超时自动退款。参考音频质量决定克隆相似度——请使用无混响、无背景音乐的清晰人声。
18. 我的创作
集中管理你的全部作品:视频、图片、故事板、商品套图、图片复刻、衣服图案裂变、衣服图案迁移、爆款视频复刻、视频超分统一以卡片形式展示,可筛选、查看、下载与删除。
图 18-1 我的创作页(顶部为任务类型筛选行)
筛选
任务类型: 页面顶部平铺一排类型按钮(全部 / 参考图生视频 / 图生视频 / 文生视频 / 图生图 / 文生图 / 故事板 / 商品套图 / 爆款视频复刻 / 图片复刻 / 衣服图案裂变 / 衣服图案迁移 / 视频超分),点击即切换。
状态 + 时间: 第二行可按状态(生成中 / 已完成 / 失败等)与时间(今天 / 本月 / 自定义区间)筛选。
筛选记忆: 你选过的类型、状态、时间会自动记住 ——下次进入页面直接恢复上次的筛选,无需重新选择。
卡片信息
缩略图 + 状态标签: 「生成中 / 已完成 / 失败」等状态一目了然;带视频的作品缩略图上有播放图标。
提示词、模型、参数、任务 ID :卡片下方展示关键信息;智能体任务(商品套图 / 复刻等)还显示出图进度与素材缩略条。
消耗积分: 显示该任务累计消耗的积分(智能体任务显示整条流水线的合计净额)。
常用操作
查看 / 重试: 点击卡片主体进入对应工作区的查看模式;工作区内可用调整参数重试 载入原参数新建任务。
下载: 点击卡片上的下载 按钮保存作品。
删除: 点击卡片右下角 的垃圾桶图标,在确认弹窗中确认。删除后作品及其结果文件会被清除,处理中的任务同时自动退款。
说明: 带有关联视频的故事板会显示为一张合并卡片 (不会把分镜图和视频拆成两张);商品套图 / 图片复刻 / 衣服图案裂变 / 衣服图案迁移 / 爆款视频复刻同样以一张合并卡片代表整个任务。
19. 素材库管理
「素材」把你上传过的图片、视频和音频集中在一个可搜索的素材库中。一级文件夹便于管理大量素材,也不会额外复制文件。
图 19-1 素材 · 全部素材与文件夹
18.1 视图、搜索与文件夹
全部素材 显示完整素材库;最近使用 按最近调用排序;收藏 集中显示已标记素材;未归档 显示尚未放入文件夹的素材。
文件夹名称位于素材页自己的桌面侧栏中;在手机上则收进顶部视图选择器。可在同一导航中创建、重命名或删除一级文件夹。
搜索框可查找文件名或文件夹;素材类型、引用状态与排序控件可继续缩小范围。列表由服务端分页读取,素材再多也能找到较早上传的内容。
18.2 文件夹整理,不复制文件
勾选一个或多个素材后,可批量移动到文件夹 、移至未归档 、收藏或删除。
每个素材最多属于一个主文件夹。移动操作只改变整理信息,Cloudinary / R2 中的底层文件始终只存一份。
删除文件夹不会删除素材;其中素材仍保留在全部素材 中,并进入未归档 。
18.3 在工作区使用文件夹
在视频、图片与智能体工作区直接上传的素材默认进入未归档 ,之后可在素材页统一整理。
素材库 选择器(见图 6-4)可按文件夹筛选。选取素材只记录最近使用,不会移动原素材。
18.4 删除规则
可通过单行操作或批量操作栏删除底层素材;批量删除会分别报告已删除与已跳过数量。
若素材正被某个任务引用 ,系统会阻止删除并跳过该素材;仍可安全地移动或收藏它。
提示: 文件夹归属与任务引用彼此独立。删除文件夹不会影响历史作品。
部署状态(2026 年 8 月 7 日): 文件夹替换方案已上线;生产迁移 0039_asset_folder_management.sql 已执行,新版 Worker 已部署。
20. 账户设置
左侧菜单「设置」分组包含账户资料、安全、账单等页面。
19.1 账户资料
图 20-1 账户资料页
进入设置 → 账户 。
可修改姓名、头像 等基本资料,修改后点击保存。
19.2 安全与绑定手机号
图 20-2 安全设置页(含手机号绑定)
绑定手机号 是保留的账户安全能力,当前产品登录页仍只提供邮箱密码与 Google 登录:
进入设置 → 安全 ,找到手机号 卡片。
输入 11 位手机号,点击获取验证码 。
填写收到的验证码,点击绑定 。绑定成功后该卡片会显示脱敏后的手机号。
本页还可修改登录密码 :填写原密码与新密码后保存。
说明: 一期仅支持绑定 ,暂不支持换绑 / 解绑手机号。
19.3 积分与账单
图 20-3 积分与账单页
积分余额: 顶部显示当前余额,以及累计获得 / 累计消耗。
积分明细: 展示注册赠送、任务消费 / 退款、充值与人工调整,并标注时间与关联任务;同一任务的相关流水会归组显示,减少重复行。
智能体任务归组: 同一个故事板、商品套图、图片复刻、衣服图案裂变、衣服图案迁移或爆款视频复刻的多笔子费用会合并成一行 显示(如「故事板 共 3 笔」),点击明细 可展开查看每一笔;点击查看任务 跳转到对应作品。
用户自行导出: 点击积分记录卡片右侧的导出明细 ,可选择近 7 / 30 / 90 天、自定义范围(最长 366 天)或全部记录。CSV 以一个逻辑任务一行为单位,展示扣除合计、退款合计、净消耗、余额变动与最后一次变动后的余额;注册赠送、充值和人工调整仍单独成行。全部记录最多导出最新 10,000 条任务分组,若更早记录被省略,弹窗会明确提示。
当前方案: 展示当前订阅方案(免费版)。在线购买积分为后续开放能力。
21. 常见问题(FAQ)
Q1 生成一直显示「生成中」,要等多久?
图片一般数十秒到数分钟,视频约几分钟。图片最长 5 分钟(GPT Image 2 Flex 为 10 分钟)、视频最长约 17 分钟、视频超分依任务规模可达数小时(界面显示预计剩余),超时会自动判定失败并退款。生成期间可离开页面,任务在后台继续。
Q2 任务失败了,积分会退吗?
会。因超时或供应商错误失败的任务,系统自动全额退回 已扣积分,可在账单页看到退款记录。智能改图失败时原图保持不变。
Q3 绑定手机号时收不到验证码怎么办?
请确认使用的是中国大陆(+86)号码,并检查是否屏蔽了国际短信。若持续收不到,请稍后重试或联系客服;登录仍可直接使用邮箱密码。
Q4 智能改图后能恢复原图吗?
不能。 改图成功后新图会覆盖并销毁原图。若担心,可先下载原图作为备份,再进行改图。
Q5 为什么有的历史图片没有「智能改图」按钮?
智能改图需要图片的高清副本作为编辑底图。极早期生成的历史作品可能没有该副本,因此不显示按钮;新生成的作品均支持。
Q6 画面内的中文字总是渲染不准?
当前图片模型渲染非英文文字 不稳定,因此故事板等场景中画面内文字统一使用英文;口播 / 字幕语言可自由选择中文。
Q7 积分不够了怎么办?
点击付费生成操作时会提示「生成积分不足」,不会创建任务或扣除积分。可从顶部导航或侧栏「价格」进入价格页充值:四档一次性充值,当前统一对公转账、按弹窗提示联系「路易电商」办理,到账后可在账单页查看记录。
Q8 爆款视频复刻是怎么计费的?中途不想等了怎么办?
分析分镜收 2 积分;之后每个片段独立计费 (按所选模型 / 分辨率 / 时长),失败的片段自动退款;最后的成片合成免费。渲染中可随时点击停止生成 ——未完成片段退款、已完成片段保留,之后仍可单独补渲。
Q9 商品套图 / 图片复刻的「规划」和「出图」是分开收费的吗?
是。规划(AI 写方案与提示词)只收 2 积分,看到整套方案满意后再点批量出图,每张图按所选模型独立计费。规划不满意可直接「调整参数重试」重新规划,之前的规划费不退但金额很小。
Q10 视频超分要花多少积分、等多久?
价格与视频时长、帧率、目标分辨率成正比(720p 档最便宜,4K 约为 720p 的 11 倍),提交前按钮上会显示准确报价与预计处理时长。长视频高分辨率组合可能需要数小时,可离开页面等待;失败或超时自动退款。
Q11 衣服图案裂变为什么要先出平铺图、再出模特图?
上传图片后 AI 会自动免费识别每张图的角色与整体风格,你确认或微调后一次提交,系统会自动写出裂变方案并渲染全部平铺图(方案 2 积分 + 每张平铺图按所选模型计价,总价在提交按钮上明示)——这一步不需要你再单独审核方案或逐张勾选渲染。真正「先看再花钱」的环节在模特图:某张平铺图渲染成功后,其卡片上才会出现「生成模特图」按钮,避免在不满意的图案上多花一次模特图的积分;全部平铺图完成后,结果区顶部会出现批量工具栏——默认全选每一张平铺图已成功的卡片,可逐张取消勾选后再点击「生成所选模特图」或「生成所选矢量图」,价格实时按当前勾选且尚未生成该项的卡片数计算,不会为已生成过的卡片重复扣费。若后续需要调整,使用提示词区的修改并重新生成 :只改模特设定只收取一张模特图费用;改动平铺提示词会明示并收取平铺图加模特图费用,系统持久串行生成两张,始终保证模特图基于最新平铺图。整套任务(方案 + 每张平铺图 + 每张模特图)在账单中归组为一条「衣服图案裂变」记录。
Q12 衣服图案迁移的图案提取要花积分吗?和衣服图案裂变有什么区别?
图案提取全程免费 :上传一张爆款衣服照片后,系统立即在后台免费识别并抠出图案,结果按来源图内容寻址缓存,同一张图重复提取零成本、秒级完成;提取失败可点重新提取 ,或改用直传图案图 。与衣服图案裂变的区别在于输入结构与产出逻辑:图案裂变是「1 张衣服图 + 图案素材 → 10–20 个不同图案的变体」,迁移则是「1 个图案 + 1–12 个已有颜色版本 → 逐色把同一个图案像素级迁移上去」,更适合你已经确定要用哪个图案、只是想快速覆盖全部颜色版本的场景。两者共用平铺图 → 模特图的两段计费与「先审平铺再出模特」的门控逻辑,在「我的创作」与账单中各自独立统计、互不混淆。
需要更多帮助? 如遇本手册未覆盖的问题,请通过站点提供的联系方式反馈,我们会尽快协助解决。