智能短视频生产线

把文案、素材、配音和节奏组织成一条清晰的出片流程

第一次使用从「内容创作」开始;已有文案可直接进入「视频工作台」。生产预设会自动协调分镜、字幕、音效和质量检查。

正在处理

排队与生成任务

已完成作品

可预览或下载

素材总数

本地素材库

待处理问题

失败任务可重试

QUICK START

快捷开始

按生产阶段进入

LIVE QUEUE

最近任务

正在读取任务状态…

SYSTEM READINESS

生产准备度

尚未刷新

后端服务

检测中…

任务队列

读取中…

素材资产

读取中…

建议下一步

准备创作

第 1 步 · 爆款参考

只学套路,不复用原文。原文中的地名、价格、人名会被提取成禁用清单,仿写时全部避开。

待筛选候选

先分析一条爆款文案。

采用和不采用都要填写理由;提交后候选会从这里移除,规则会用于后续生成。

剩余 0 条

尚未生成候选。

手工录入文案

正在读取文案库…

已沉淀规则

权重表示同一理由被提交的次数。只有启用规则会参与后续生成。

正在读取规则库…

一键生产

先在左侧创建自己的生产模板和行程计划;工作台只负责选择并生成,不会暗中套用陌生默认模板。

模板中的完整出片参数将在提交时由服务器解析并存入任务快照。

行程计划会把价格、集合地点、服务内容、时长及禁用表述注入文案上下文,用于减少编造;它不是仅供查看的备注。

智能功能说明(是否启用由生产模板决定)
根据文案自动规划镜头调用 AI 理解每句旁白并安排镜头,可能产生模型费用并增加处理时间;失败时回退普通素材顺序,不修改原文件。
按每句旁白匹配画面使用素材中心已经生成的内容分析结果匹配画面;模板不会重复分析素材,没有结果时按文件名和标签兜底。
1

生成爆款文案

2

关键词 & 素材

自动选材、素材分类、语义范围和分镜方式均由所选生产模板决定。这里仅允许为本次任务指定优先素材。

可选:上传或指定优先素材
3

按模板生成

此处不再重复显示生产参数

画幅、配音、语速、音量、字幕模板、BGM、转场、拼接、智能分镜、语义选材、卡点、音效和开头缓冲,全部使用上方所选生产模板。

4

出片进度 & 成品

尚未提交任务
每次提交都会在这里新增任务,排队和生成进度互不覆盖

1. 文案与情绪拆分

AI 不可用时会自动使用本地规则,不会阻塞测试

2. 选择成片声音

默认只需要选导演预设和音色,其余交给系统

系统会把相邻内容合成“呼吸组”,自动裁掉多余静音并自然衔接,不再每句话都重新开口。

3. 文案导演结果

简洁模式只展示系统判断;确实需要时再展开高级参数

尚未分析

先在上方输入文案并分析。

4. 试听对比

记录 Provider、音色、耗时和最终时长,便于后续做质量/成本决策

生成后会在这里显示候选。

📁 素材大分类
🎬 素材详情
暂无批量分析任务
视频素材AI 视频语义裂变变体

← 先选左侧一个标签文件夹

新建模板

我的模板

字体库

支持 TTF / OTF / TTC / OTC。导入后立即可在模板中选用,字体授权请自行确认。

新建模板

内置模板只能另存为新模板

基于 1080×1920 竖屏、WCAG 高对比和字幕安全区规范配置;字体来自开放许可证项目。

0 = 无描边

只调整第一条,后续字幕仍使用上方延迟。

强调词在「系统设置 → 强调词」维护;逐字高亮和动感花字只给命中的词上色,其他动效整句应用。

9:16 实时预览

动效由浏览器即时模拟,无需渲染视频;最终出片仍以本地渲染为准。

自定义音效

系统只使用你自己导入的音效,显示名称取自原文件名。

音效来源用户音效 · 检查中

已导入音效

关键词触发规则

文案命中关键词时使用对应音效;每个音效都可以先试听。

基本信息

画面与剪辑

转场示意预览

无:直接切换镜头,真实自然,推荐海钓信息流使用。

镜头 A · 出海航行
镜头 B · 真实鱼获

这是动画示意,不会读取或修改你的原始素材;最终效果会随镜头内容略有差异。

不设置“每段时长”:优先播放完当前有效素材,只在语义变化、镜头结束或旁白结束时裁剪。

配音与字幕

背景音乐与音效

素材调用与智能剪辑

素材内容分析仍在“素材中心”一键执行;生产模板只决定如何使用已经存在的分析数据。

输出质量

我的模板

匹配语义组

“标准词”代表统一含义;“相近说法”用逗号分隔。例如文案写“开船”,素材分析写“船只航行”,仍会归到同一组。

动作信息

加载中…

情绪信息

加载中…

主体与对象词(高级)

用于鱼种等对象归一。一般无需频繁修改,但同样会参与实际匹配。

删除或关闭词组后,对应关系将不再参与后续任务。已完成任务不会被追溯修改;素材中心已有分析数据无需重复分析。

我的行程计划

新建 / 编辑项目

~

已有项目

批量主题(每行一个)

📌 每条任务只会使用「通用」和所选大分类中的素材;选择「通用」时只用通用素材。批量任务会通过文案语义自动挑选素材。

批量任务进度

提交后每条任务的状态会显示在这里

生成发布素材

发布素材

生成的标题、话题标签、简介会出现在这里

后端地址

留空则用当前页面同源地址。仅当前后端分离部署时才需填写。

DeepSeek 文案模型

用于爆款分析、批量仿写以及其他文本生成。保存后会将全局文本模型切换为 DeepSeek。

未配置
创建 API Key →

API Key 仅保存到本机 config.toml,网页状态接口不会回传完整密钥。已有密钥时留空保存不会覆盖。

视觉语义导演

对完整镜头抽取关键帧,识别主体、动作、数量、场景和情绪;同时把文案转换为视觉意图,再参与素材评分。

未配置

使用 OpenAI 兼容多模态接口。填写中转基础地址时,系统会依次尝试 /v1/chat/completions 和 /chat/completions;也可以直接填写完整 Chat Completions 地址。接口需支持 image_url Data URL 和 JSON response_format。

付费自然语音接入中心

支持阿里云 Qwen3-TTS、火山引擎豆包语音 2.0(小何 2.0)和自行部署的 IndexTTS;密钥只保存到本机配置。

正式成片

密钥只保存在本机 config.toml,状态接口不会回传完整密钥。输入空密钥并保存可停用对应 Provider。

字幕时间轴与特效

字幕的淡入、弹入、上滑、花字和逐字高亮全部在本机渲染。需要更准确的中文字级时间轴时,可选阿里云百炼 Paraformer;它只上传配音音频做识别,不上传视频画面,也不代替本地特效渲染。

本地时间轴

Paraformer 复用“付费自然语音接入中心”中 Qwen3-TTS 的阿里云百炼 API Key,无需重复填写。只有选择 Paraformer 并实际生成字幕时才会调用计费接口。

语义素材弹性时间窗

素材只能在配音语义目标点前后的允许时间内开始;错过窗口会直接放弃,不会延后补播。单位:秒。

普通语义

关键动作

通用素材

敏感词与广告合规

默认仅提醒,不再静默把“第一次”等正常表达替换成星号。你可以关闭检测、仅提醒或明确替换。

花字强调词

出片勾选"花字强调"后,含这些词的字幕会放大变金色。逗号分隔。

裂变方式库

勾选启用的防查重方式,裂变时只从启用的里随机组合。取消勾选=不再使用该方式。

⚠ 上线安全提醒

当前无登录鉴权。若部署到公网用域名访问,任何人都能打开并消耗你的 DeepSeek key 和服务器算力。上公网前必须启用登录鉴权(见部署文档)。