图音成片
历史记录
视频教程
图音成片
单图音频驱动(180s) · OmniHuman 双引擎
人物/主体图片(必填)
本地上传
从资产库
单张 jpg/png,< 5MB,< 4096×4096;支持真人 / 动漫 / 宠物
音色
Vivi 2.0
优化提示词
0/3000
复制
清空
声音克隆(可选)· 复刻你的声音做专属口播音色
上传 10~30 秒清晰人声(wav/mp3,无背景音乐、无杂音)
训练音色
查询状态
标准档:单图音频驱动,保持原图比例,最长 180 秒,约 0.3 元/秒;高清档:OmniHuman 1.5,1080P/720P,最长 60 秒,1 元/秒。文案最长约对应 120 秒语音(TTS 单次上限)。
注:智能生成的内容仅供参考,不代表平台立场
档位
标准
分辨率
1080P
立即生成
1点
图音成片
一张人物图 +
一段文案
= 数字人开口说话的口播视频
人物图
1 张·真人/动漫/宠物
+
文案+音色
系统合成语音
口播视频
图音成片
×
SevenAI
SEVENAI
欢迎登录
密码登录
验证码登录
已阅读并同意
用户协议
、
隐私政策
和
付费协议
立即登录
或
还没有账户,去注册 ›
深圳市文恩传媒有限公司 · 粤ICP备 ________ 号
×
模型接入设置
本地代理地址(转发请求用,避免浏览器跨域)
接口地址 Base URL
硅基流动·可图
硅基流动·FLUX
智谱 GLM
火山方舟
OpenAI
API Key
Key 保存在本机
proxy-config.json
(由本地代理读取),浏览器不会拿到明文。
正式上线时把代理这层搬到服务器上
,前端永远不碰 Key。
模型名 Model ID
开启真实模型调用(关闭则为演示模式)
连通测试
保存