用一张人像生成说话视频
上传清晰人像,再输入台词或添加录音。系统会按照语音节奏生成嘴型和面部动作,同时尽量保留人物原本的样子。
文字和录音都能用
输入台词可直接选 AI 音色;需要保留语气、发音或节奏时,也可以上传自己的录音。
支持 720p 和 1080p
日常试做可选 720p,需要更多面部细节时选择 1080p。
生成前看清费用
页面会先估算语音时长,并显示对应积分。
在线制作对口型视频,只需三步
从选人像到下载 MP4,都可以在当前页面完成。
选择人像
上传正面清晰的 JPG、PNG 或 WEBP,也可以先用预设体验。
添加台词或录音
输入人物要说的话并试听音色,或者上传 MP3、WAV、M4A。
确认后生成
检查预计时长、分辨率和积分,再生成并下载视频。
选一张模型容易识别的人像
清楚的脸部和干净的语音,能避开大部分常见的嘴型问题。
不要遮住嘴部
尽量使用单人正面照,避免手、头发、口罩或麦克风挡住下半张脸。
光线尽量均匀
眼睛和嘴部不要落在重阴影里,面部细节会更稳定。
台词要适合朗读
短句和标点能带来更自然的停顿,最终语音需控制在 60 秒内。
适合需要人物出镜的短内容
不必重新拍摄,也能用一段简短的正面说话视频,把信息表达得更直接。
产品和客服说明
制作产品介绍、功能更新、新手引导或常见问题短片。
社交媒体开头
为 TikTok、Reels、Shorts 制作会说话的照片或角色开场。
课程与个人消息
让讲述者、历史人物或插画角色用于课程、祝福、邀请和通知。
从人像到成片,都在同一个工作区
查看真实示例、试听音色、确认价格、开始生成,再回到历史记录查看结果,不用在多个工具之间来回传文件。
30 种音色可试听
选择前就能听到每个音色,并用对应人物预览理解声音风格。
示例和历史记录并排
可随时切换预设示例,以及处理中、已完成或失败的任务。
衔接其他视频工具
需要更多镜头时,可以继续使用视频生成、语音生成或视频帧提取。
AI 对口型生成常见问题
关于人像、音频、时长、分辨率、积分和失败任务的实用说明。
它会把静态人像变成说话视频。你可以输入台词或上传录音,模型会按照音频节奏生成嘴型和面部动作。
可以。需要保留特定声音、发音或表演方式时,请上传 MP3、WAV 或 M4A。
建议使用单人、正面、清晰且光线均匀的照片,并让嘴部完整可见。侧脸、模糊或遮挡都会影响稳定性。
单次最长 60 秒。台词不限制固定字数,但系统估算出的朗读时长不能超过 60 秒。
试做和日常社交内容可选 720p;成片需要更多面部细节时选择 1080p。生成前会显示积分。
720p 每秒 5 积分,1080p 每秒 9 积分。费用会根据预计或上传音频的时长更新。
失败任务会保留在历史记录中。若任务已扣除积分但未能完成,可退款积分会自动退回。