AAI SONG智能口播+训练个人中心
SMART TALK

一张人物图,讲完整段文案。

上传人物图并输入口播文案,AI 自动生成自然开口、口型同步的数字人口播视频。

智能口播+训练 · 文案驱动
01

上传人物图与参考音频

左侧人物图用于固定形象;右侧建议上传 10 秒左右清晰人声,用于克隆音色。

上传人物图点击选择或拖入图片,自动适配横屏、竖屏与方图
IMAGE · 口播人物图上传人物图点击选择或拖入图片,自动适配横屏、竖屏与方图
上传参考音频建议 10 秒左右,上传后可直接试听拖动
AUDIO · 参考音色上传参考音频建议 10 秒左右,上传后可直接试听拖动
02

输入口播文案

写清楚要说的内容,越自然越好;文案越长生成时间越长。

03

情绪强度

分别调整高兴、愤怒、悲伤、恐惧、厌恶、低落、惊讶、中性的强度。

本次任务智能口播+训练 · 39 字文案 · 待传参考音频