三步就能做出IP口播短视频

新手小白不写文案、不出镜、不剪辑也能搞出短视频

一键改写爆款文案
选您的形象与声音
生成成片并批量发布

最近创作

悬停即可静音预览最近生成的竖屏成片

还没有创作记录,点击小助手开始第一条视频吧

我的形象

已注册形象会优先显示,没有形象的槽位保留为预览占位

我的声音

试听已注册的专属音色,创作时可直接调用

更多功能

进入专业短视频制作工具

视频引擎
文案引擎
配音引擎
数字人引擎
数字人形象
点击卡片选中,再次点击取消
生成引擎
悬停或点击查看方案,确认使用后生效
视频底模数字人

视频底模数字人方案是推荐方案,基于视频进行动作和讲话风格学习,生成的数字人活人感强,视频不会被打上“AI水印”。

图片生成数字人

一张照片就能生成数字人讲话,会有自然的动作和手势,但是生成的时间稍长,有一定概率会被平台识别为“AI视频”。

动作参考口播

上传一段参考视频,完美复刻参考口播视频的动作和情绪,生成时间相对较长,耐心等待。

文案输入
0 字
口语化
专业
幽默
激情
温柔
字数 0 字 · 预估时长 0 秒
选择已完成的蒸馏报告
随机采用该博主的选题、叙事结构与语言节奏,生成一条原创文案。
暂无可用报告
主标题、副标题和发布文案
可生成后继续修改确认
音色选择
点击卡片选中, 试听音色
语音高级设置
当前音色克隆模型为 正在读取… ,可在“我的声音”页面直接更换。
提前生成配音
按当前文案、音色和参数生成完整配音;整单任务会直接复用,不再重复合成。您也可以直接跳过,制作视频的时候统一生成音频。
仅保留 3 天
尚未生成
最近配音任务
进入声音设置后会加载最近任务。
字幕样式
字幕样式预设会带出推荐值;之后手动修改的双层/双语开关为最终结果。
背景音乐 (BGM)
正在加载抖音热榜…

抖音热榜曲目的使用范围以平台授权为准。

选择曲目后可试听
视频效果
超级IP智能封面
读取视频设置
当前封面模板
黑金案例拆解封面
默认读取“视频设置”中的封面;在这里修改后会自动同步,并用于本次作品。
自动 B-roll(本次作品)
当前方案读取中
生成模型读取中
最大片段数
单段时长
画面呈现模式
预计最高算力
当前启用状态同步中
正在读取“自动 B-roll”总设置和本次作品可用状态...
本次作品可单独开启或关闭;总开关关闭时本次作品不可用。
配置汇总
发布目标

勾选已登录账号,成片后将按发布设置自动分发

正在读取可用账号...
未选择账号,仅生成视频 发布仅在桌面端执行
流水线进度
生成结果
视频将在此处展示
标题
最终文案
视频封面
生成完成后可预览和下载
文案输入
生成设置
流水线进度
生成结果
视频将在此处展示
标题
封面
最终文案
详细信息

          
原始文案
AI 处理
处理结果
使用提示

润色:优化表达,保留原意

仿写:语义级改写,避免查重

扩写:增加细节和案例

缩写:精简压缩,保留核心

风格转换:调整语气风格

主题生成:根据主题创作

已预置 Coding Plan · DeepSeek V4,无需单独配置即可使用。

基础设置
选择模块执行
音频产物
执行后展示
视频产物
执行后展示
执行结果
等待执行...
批量文案输入
N 条文案 × 1 组参数 = N 个视频
音乐来自统一云端音乐库;批量任务与“视频设置”使用同一套曲目。
批量进度
0 / 0
提交后将显示每条文案的处理进度
通过第三方算力生成broll
文本模型先筛选适合画中画的原文段落,再按情景或流程撰写独立画面提示词;按所选模型消耗算力余额 · 预计最高消耗 — 算力
启用
通过我的素材库智能匹配 B-roll
视觉模型在上传时分析一次,生成时按字幕严格匹配;不合适的片段会自动跳过
启用
正在读取自有素材库…
素材库 0 / 50 项 视频≤15秒/100MB,图片≤20MB,总空间2GB
图片画中画
AI 生成或选择素材库图片,按口播内容自动插入。支持小窗或全屏展示,保留口播原声。
启用
预计最高算力启用后核算
开启后,在创作口播时勾选自动 B-roll,即可按文案插入配图。
使用说明
画中画与整段插播
画中画模式(PIP):B-roll 视频以小窗口叠加在数字人画面上,数字人仍可见(适合讲解类)
整段切换模式(CUT):在指定时间段用 B-roll 替换主画面,数字人暂离(适合展示实景素材)
3 种添加入口(不是画面模式):① 点击字幕间的 + 在两段字幕之间添加;② 点击 B-roll 轨道空白处在任意位置添加;③ 点击“在播放头插入”按当前播放位置添加
快捷剪辑:裁剪头尾、调整音量、片头片尾淡入淡出,一键应用
选择任务
我的素材库明细(与上方智能匹配同步)
两处共用同一个账户素材库;在任一处上传或删除,数量、分析状态和素材列表都会同步更新
上传到上方同一个智能匹配素材库
时间轴编辑器
素材来源
请先选择一个任务
选择任务后将显示字幕时间轴
闭源视觉模型算力余额
账户余额与公开计费标准
算力余额 闭源模型算力余额 · 用户剩余算力
新用户默认赠送 20 算力
按条计费 标准模型
1.26 算力起/条
按清晰度与生成时长自动估算
按时长计费 性价比模型
0.1008 算力/秒
480P 输出 · 另含每段 0.13 算力首图 · 5 秒约 0.63 算力,10 秒约 1.14 算力
按时长计费 高端模型 S
0.336 算力/秒
默认 10 秒约 3.36 算力/条
按时长计费 MiniMax H3
0.5998 算力/秒
768P 输出 · 默认 5 秒约 3.00 算力/条
正在读取用户余额...
注册形象素材上传要求
正面面对镜头自然讲话,手上有一定的手势动作,但是动作不要挡到嘴,一直侃侃而谈,录制一个15秒以上的视频。
您注册形象所用的素材,可以掐头去尾,比如可以把开头和结尾点击录制键的手势掐掉,保留状态最好的 15 秒。
注册新形象
点击或拖拽上传照片/视频
支持 JPG/PNG 照片或 MP4/MOV 视频;照片正面清晰,视频自然讲话,上传后可裁剪
已注册形象
形象换背景
选一个参考形象,为它换上新的场景。生成后可保存为新形象,长期用于口播创作。

请选择至少 10 秒的已注册视频形象。

选择形象后在这里预览
正在加载场景…
生成 10 秒视频自有算力SC · 无需额外算力
查看换背景案例
案例对比 同一形象,仅将背景更换为飞机头等舱
H3 实例
原始形象
飞机头等舱

人物、动作、逐帧嘴型与原声保持不变;案例仅用于展示换背景效果。

最近任务
暂无换背景任务
注册新音色
读取中
当前音色克隆模型为 正在读取… ,下拉选择后会自动保存。
样本要求会按模型动态调整
点击或拖拽上传音频 / 视频
正在读取支持格式…
视频会自动提取音频,超出模型允许时长时自动截取开头一段。
    点击“注册音色”后自动提取音频。请使用清晰、单人讲话的视频。
    已注册音色
    正在连接云端 GPU 工作台…
    正在载入自由创作画布…
    视频一键修改

    用一句话,修改视频画面

    上传视频或粘贴抖音链接,填写想修改的内容,即可开始生成。

    2–15 秒
    上传视频
    成片参数
    预计消耗正在计算…完成后按实际消耗结算
    视频修改记录
    暂无视频修改任务
    新建蒸馏
    检查中
    蒸馏记录
    暂无蒸馏记录

    通过聊天做视频

    内测中

    聊创意、生成图片、修改分镜,确认算力后开始创作。

    历史对话

    打开后加载当前账号的对话。

    新的创作对话

    可以开始
    创作技能
    选择创作技能

    选好技能,补充需求;先看方案和算力,再确认生成。

    正在读取技能…

    模型与设置
    选择视频模型

    正在读取通道…

    正在读取模型…

    选择通道后,生成前可查看费用。

    可拖入图片、视频、TXT、MD · 视频每条 ≤300 MB / 5分钟Enter 发送 · Shift+Enter 换行

    项目组

    一次创作,一个独立工作区

    每个项目分别保留素材与参数,切换时不用反复清空。

    素材与生成方式
    项目组 01
    任务文件保留 3 天

    支持视频、JPG、PNG、WebP 图片混合添加;单次最多 20 个素材,单素材不超过 300 MB,总量不超过 2 GB。

    尚未选择素材
    多条任务会更换镜头组素材和剪辑节奏。
    支持 MP3、M4A、FLAC、OGG,最大 100 MB。
    留空时按上方目标时长进行纯素材混剪;填写后以实际配音长度为准。
    任务与成片
    项目组 01
    当前项目暂无混剪任务
    创作档案 0 个已保存

    已保存项目组

    保留素材、文案和参数。重新打开,就能接着混剪。

    保存的素材可持续复用;再次保存会保留新版本。成片仍保留 3 天,需要长期留存请下载。

    任务列表

    视频队列 0

    拖拽视频或文件夹到这里开始处理支持 MP4、MOV、MKV、AVI、WEBM,单次最多 6 条
    文件 / 任务信息媒体信息处理参数状态
    还没有任务。添加视频后,这里会显示处理队列。
    处理设置

    参数与算法

    输出位置云端对象存储任务完成后可预览与下载,成片保留 3 天
    分辨率配置跟随源视频自动匹配原片宽高和画面比例
    待处理任务0
    输出位置云端对象存储最终成片保留 3 天
    提交进度0%
    运行日志

    处理动态

    待命

    暗水印对抗去重工作台已就绪

    我的项目

    先给我原视频
    你可以一句话替换爆款视频中的人物,场景还有产品。
    或者
    统一资产修改
    点选要修改的资产,再填写要求;替换素材可选。
    可选:添加商品、人物或场景素材不添加则完全以原片为参考

    选中资产后,直接写明要换成什么;替换素材可选。未选中的资产保持原样,分镜头的单独修改除外。

    生成规格
    生成模型

    系统按成片时长自动分段生成并拼接。

    算力消耗

    正在读取所选模型的计价…

    任务进度
    提交后自动更新,刷新页面也能继续查看
    等待同步
    暂无进行中的任务
    任务记录
    暂无复刻任务
    场景化创作模板
    每个模板预置了该场景的口播文案骨架、字幕样式、BGM、滤镜、转场、情感、语速。选择场景后填入关键词即可生成完整文案,一键应用全部样式。
    预制数字人形象库
    预制形象可直接选用,搭配推荐音色。想要真人效果,点"换成我的真人形象"上传您的照片或出镜视频——推荐上传 10-30 秒的说话视频,数字人会保留您的头部动作和神态,效果远好于静态照片。
    预制音色库
    基于 Edge TTS 的免费音色,按场景推荐。点击"使用此音色"将设为默认音色。
    样式模板库(字幕/BGM/滤镜/转场)
    任务列表
    作品标题 状态 创建时间 更新时间 操作
    任务详情
    选择上方任务查看详情

    数字人口播视频制作教学

    注册形象 · 注册声音 · 生成第一条口播视频 · 15分02秒

    深度爆款复刻教学视频

    直接自动复刻 · 分镜头修改 · 9分22秒 · 1080p

    字幕样式
    以下画面由真实照片与最终 ASS 字幕引擎渲染,字体、颜色、描边和排版均为成片效果。
    选择模板会带出推荐值;之后手动修改的双层/双语开关为最终结果。
    视频输出参数
    超级IP智能封面
    自动提取成片代表帧,并结合标题生成封面。
    所选封面模板预览
    黑金案例拆解封面 生成时会保留当前视频人物,并按所选模板重构标题与版式。
    发布模式
    平台管理
    发布账号管理
    扫码添加多个平台账号;每个账号独立保存,互不串号
    登录资料只保存在当前电脑,不上传服务器。添加账号时请使用对应平台 App 扫码。
    一键分发
    将成片同时发布到多个平台、多个账号
    选择任务后会自动填入该任务的标题、发布文案和标签,仍可手动修改
    账户概览

    VIP 用户无限自有算力,第三方算力走批发价

    口播工厂与专项模型额度相互独立,系统会在真实生成完成后记录实际消耗。

    正在同步算力余额…
    基础算力

    口播工厂

    持续可用
    VIP 用户享受无限算力

    覆盖日常口播创作流程,不占用专项模型额度。

    数字人口播 文案处理 常规成片 博主分析报告 批量口播制作 所有自有算力模型使用 获客视频智作 口播IP工厂工作台
    独立额度,不参与扣减
    专项算力

    闭源模型

    20算力

    第三方算力或者闭源模型算力消耗此额度。

    爆款复刻(第三方算力) AI获客短视频(第三方算力) 自由创作画布 自动broll素材(第三方算力)
    仅按真实结果记录消耗