首页
数字人口播
退出
1
获取内容
2
人物形象
3
声音选择
4
合成音频
5
生成视频
1
获取口播内容
从视频提取口播文字,或直接输入
视频链接
📝 提取文字
支持抖音/小红书/视频号等链接
口播文字
*
0 字
✨ AI二创优化
选择优化风格:
保持原样
🎵 抖音
📕 小红书
📰 公众号
确认内容 → 下一步
2
人物形象
上传照片,选择场景背景,预览合成效果
人物照片
*
点击上传人物正面照片(JPG/PNG)
原始图片
抠图效果
选择场景背景
或上传自定义场景:
🖼️ 上传
🎨 合成预览
合成效果预览:
确认使用此形象 → 下一步
3
声音选择
选择标准音色或克隆声音,试听效果后确认
标准音色
克隆声音
录制或上传音频,克隆专属声音
暂无克隆声音,录制或上传音频后提交克隆
🎤 录制声音(上限30秒)
🎙️
00:00
点击开始录音
📁 上传音频文件
选择音频文件
提交克隆
确认使用此声音 → 下一步
4
生成合成音频
使用选定声音生成口播音频,试听确认
📋 配置摘要
声音:
-
口播文字
*
0 字
分辨率
1080P
720P
🎵 生成合成音频
🎧 合成音频试听
✅ 音频合成完成,请试听确认
确认使用此音频 → 下一步
5
生成对口型视频
配置检查,生成数字人口播视频
📋 配置摘要
文案字数:
-
字
场景:
-
声音:
-
分辨率:
1080P
🎧 合成音频(可再次试听)
🖼️ 对口型形象预览
🚀 生成对口型视频
生成进度
0%
🎬 生成完成!
📥 下载视频
🔄 重新开始