制作流程快捷入口
推荐:新建项目选行业 →「创作流水线」粘贴文案或解析热点链接 → 一键出片;多条脚本用「脚本中心」。
我的项目
脚本库
新手请从「创作流水线」粘贴宣传文案并一键生成。本页用于手改已有脚本与 AI 润色,不是另一套项目。
创作流水线
脚本 → 出镜要素 → 竖屏分镜 → 配音 → 出视频更多操作(单步智能体 / 导出)
高级:分步智能体
AI 原始输出
素材库 · 场景 · 道具
脚本中心 · 多条文案
管理多条宣传脚本(每条可对应一个短视频)。粘贴文案或从流水线生成后,在此勾选并「制作选中条」生成分镜与视频。
角色卡片
分镜镜头
出片专家校验 — 待校验
选择项目后自动检查出片就绪度。
出片专家校验 — 待校验
检查分镜完整性、素材绑定与视频 payload。
请从左侧选择镜头,或先在脚本中心完成分镜生成。
出片专家校验 — 待校验
选择项目后自动检查:分镜字段、素材绑定、参考图、台词长度、prep/payload 可构建性。
编辑左侧文案后此处实时更新
视频 API 请求包
请从左侧选择镜头
或先在脚本中心 / 流水线生成分镜
漫画成品
新建创作
高级 & 批量模式
成片库
宣传短视频默认由视频模型自带音画(口播在视频 prompt 中约束为中文)。「配音」页用于后期替换口播、多语言版本或精细情绪控制,非一键流程必需。
任务列表
操作进度
上方为服务端后台任务(批量制作、串联出视频、导出等);下方为浏览器本地操作记录。出图/出视频成片请在「任务」页查看。
加载中…
本地操作记录
配音片段
使用说明(配音流程 · Edge · 小米 MiMo)
宣传短视频要不要配音?一键流程里视频模型会自带音画(口播写在分镜/视频 prompt 中)。本页用于后期替换口播、多语言版本、或 MiMo/Edge 精细控制语气——不是生成宣传片的必需步骤。成片预览请去「成片」页。
基本流程:点「新建片段」→ 填写标题与要合成的台词 → 选择合成引擎 → 保存 → 在列表中点「合成」生成音频。与分镜联动时,可在分镜页勾选镜头后使用「从分镜生成配音草稿」,再到此页逐条调整并合成。
Edge TTS:部署环境需 pip install edge-tts,且服务器能访问微软语音服务。音色 ID 与微软 ShortName 一致,完整列表请执行 edge-tts --list-voices。若出现 No audio was received,可先 pip install -U edge-tts 或尝试固定版本 edge-tts==7.2.0,也可配置 EDGE_TTS_PROXY 并校准系统时间。Edge 没有单独的「恐惧 / 豪气」等声线开关,主要靠换音色 ID 与台词语气;需要更细的情绪与风格控制请用 MiMo。
MiMo 国内 / 海外谁说了算:只看部署服务器上 .env 里的 MIMO_API_BASE 域名(含 xiaomimimo.com 即为国内),与您的上网 IP、浏览器地区无关。配音弹窗顶部蓝色区域会写明当前是「国内线路」还是「海外线路」,以及合成时真正生效的 audio.voice 或 voice。
MiMo(国内):配置 MIMO_API_KEY。小米只认三档底音。界面默认收起「海外兼容 voice」进阶区,只突出「国内合成底音」与风格;需要手改 alloy/echo 时到「设置」勾选「显示海外兼容 voice 进阶区」。
预设与搜索:「短剧预设」会同时写入底音、风格与兼容名(即使进阶区关闭也会写入)。底音与预设支持搜索过滤;进阶区打开后才有兼容名列表与手输框。
风格写法(MiMo):风格栏可写自然语言(如温柔、东北话、语速慢)。国内线路会按小米文档把风格包进台词前的 <style>…</style>;若你已自行写好完整 <style>…</style>,系统会识别并不再重复包裹。细粒度语气可用正文式说明,例如 (紧张,深呼吸)、停顿、笑声等。唱歌场景建议台词最前单独加 <style>唱歌</style> 再接歌词。
MiMo(海外线路):将 MIMO_API_BASE 设为海外地址(如 https://api.mimo-v2.com/v1)时,将使用 /v1/audio/speech,此时「海外兼容 voice」会实际参与请求。
网络与试听:MiMo 默认不使用系统代理;若需走代理,在 .env 设置 MIMO_USE_SYSTEM_PROXY=1。配音「试听」默认在当前页弹窗播放,可在「设置」里改为新标签打开。
剪辑时间线
tracks 为 JSON 数组,每项含 type(video|audio)、src(URL)、start_ms、duration_ms、label。成片合成可在专业剪辑软件中按此清单拼接。
模型库
校验最新免费模型 · 失效自动下线 · 按 OpenRouter 热度精选(免费文本 top、收费 top5、顶级文本补充、出图含免费、视频 top5)
灵感案例
借鉴成功案例提示词与模型,一键填入「创作」页后再按需修改。管理员可在「管理」中维护案例库。
出片就绪度 — 待校验
选择项目后自动校验同框首帧、台词与任务进度
多角色剧本中心 — 爆款文案 → 剧本 → 角色 → 同框首帧 → 拆分 multi_speaker 分镜(参照 1.txt)
① 粘贴爆款文案 → 点「一键生成多角色剧本分镜」
② 系统自动:LLM 解析角色与对话 → 建剧本 → 建/匹配角色卡 → 按剧本人数生成同框定妆照(含场景背景)→ 按说话人拆分分镜(共用首帧)
③ 完成后切换到 「多角色口播创作台」,逐镜预览 prompt 并 i2v 出片(服装特征 + 嘴在动 + 纯中文,无字幕)
本页负责「剧本与分镜」;出片请在创作台。分镜带 kind=multi_speaker,与普通分镜/一键制作隔离。
高级选项(可选)
多角色对话分镜列表 (真实 DB 分镜 · kind=multi_speaker)
联系客服 · 充值凭证
未签约用户付款后,可在此提交支付宝 / 微信等支付截图与说明;管理员核对后可快速为您加积分开通。也可纯文字咨询。
我的工单
平台配置
试听与成片预览
控制配音「试听」、任务「预览」的打开方式。下载、转存下载等仍为原逻辑。偏好保存在本机浏览器。
配音表单(MiMo)
默认不显示「海外兼容 voice」等进阶项,界面只突出国内底音与风格。需要手改 alloy/echo 等名字时,再勾选下方选项。偏好存在本机浏览器。
API 访问
通过 Bearer Token 调用 API · 查看文档 · Agent/MCP 可参考仓库内 studio/agent_http_tools.json
curl -H "Authorization: Bearer TOKEN" http://localhost:51888/api/v1/models
curl -X POST -H "Authorization: Bearer TOKEN" -H "Content-Type: application/json" \
-d '{"model_id":"bytedance/seedance-1-5-pro","prompt":"...","duration":8}' \
http://localhost:51888/api/v1/generateAI 默认配置
全局默认三类模型:文本、出图、出视频(配音固定小米 MiMo)。OpenRouter 可选多个模型;Agnes 等平台每类仅一个固定模型。新建项目时可单独覆盖(先选平台再选模型)。生效优先级:项目设置 → 此处全局;流水线/分镜出图出视频不再单独选模型。
加载中…
OpenRouter 网络代理
控制访问 OpenRouter 是否走代理。开关切换后立即生效,无需重启服务。未在设置页保存过时,读取 .env 中的 OPENROUTER_*_PROXY。
加载中…
网络诊断
点击执行
我的账户
修改密码
积分流水
每次调用文字/图片/视频模型生成都会记录扣积分;任务失败自动退还。管理员可在此查看自己账号的流水。
系统设置
客服工单
灵感案例
新增后在前台「灵感」中展示;用户可搜索并一键填入创作。
积分费率配置
配置积分扣除规则。修改后保存到数据库,重启服务后生效。也可在 .env 中设置环境变量永久生效。
公式:视频 = (基础 + 每秒 × 时长) × 倍率;图片 = 基础 × 倍率;文字 = 基础 × 倍率。模型自定义费率优先于公式。
积分兑换与充值
充值套餐管理
用户管理
| 用户名 | 角色 | 积分 | 状态 | 注册时间 | 操作 |
|---|
运行监控
查看三项并发限制、Celery/Gunicorn 进程、内存与任务占用,便于判断服务器是否过载。
并发与队列
进程与配置
用户负载(进行中)
实时同步操作
角色「生成设定板」等会先走 AI 写词 + 同步出图,在写入任务表之前也会占用服务器;此处单独展示。
进行中的媒体 Task
仅统计任务表 status 为 pending/submitted/processing;出图若在同一请求内完成可能看不到。