Eldin Motion
你的脸。你的声音。为爆款而做的视频。
保存一张清晰的正面照片作为形象,Eldin Motion 会在每个镜头里保持你的样貌。再添加一段 20 到 60 秒的声音样本,你的视频就能用你自己的声音说出脚本,口型同步,并配上字幕和音乐。
- 保留你的样貌: 引擎被要求在每个镜头里保持你的脸、发型和肤色不变,绝不换成别人,也绝不美化你。
- 你自己的声音: 只需录制或上传一次 20 到 60 秒的清晰语音;之后的说话类视频就能使用你的克隆声音,并经过口型同步处理。
- 围绕你的场景: 保留照片里的真实背景,或者把自己放进新场景,还可以把真实的产品图加入镜头。
- 可以直接发布的收尾: 逐字字幕、开头标题、音乐和品牌素材,一键加上。
- 1 张照片 清晰正面照,至少 512 × 512 像素
- 20-60 秒 的清晰语音即可克隆你的声音
- 6 个可保存的形象(每个账号)
怎样用你的脸做 AI 视频
- 保存你的形象:在光线好的地方拍一张清晰的正面自拍,至少 512 × 512 像素,并给它起个名字。最多可以保存 6 个。
- 添加你的声音(可选):录制或上传 20 到 60 秒的清晰语音来克隆你的声音。
- 写下想法或台词:描述场景,或者一字不差地写下你想说的话。只有想法时,引擎会写一段以钩子开头的简短口播脚本。
- 选择模式并生成:用你的样貌搭配场景中生成的声音,或者用你的样貌说出你克隆的声音。
选择哪种模式
让自己出现在视频里的方式
| 模式 | 你会得到 | 适合 | 时长 |
|---|
| 我 | 你的样貌出现在生成的场景中,用场景里生成的声音说话 | 钩子、反应和快速小技巧 | 8、12 或 15 秒 |
| 我加我的声音 | 你的样貌用你的克隆声音说出脚本,口型同步 | 对着镜头讲解和推荐 | 8、12 或 15 秒 |
| 在标准引擎中客串 | 你的形象被放进场景,可选说一句台词 | 更长的场景和产品镜头 | 5 到 30 秒 |
说话类视频使用视频包;“我加我的声音”模式额外消耗 1 个视频包。
让样貌更像你
- 正对镜头,睁开眼睛,脸部不要有遮挡。
- 使用柔和均匀的光线,不要用强滤镜或美颜效果。
- 上传至少 512 × 512 像素的清晰图片,不要用截图的截图。
- 穿上你想在视频里穿的衣服:引擎被要求在不同镜头之间保持你的服装不变。
- 写你会大声说出来的句子;短句更容易对上口型。
你的脸,由你同意
只使用你自己的脸和声音,或者已书面同意的人的脸和声音。让一个人看起来说了他从没说过的话,可能违反平台规则和法律。
在平台要求的地方为逼真的 AI 视频加标签:YouTube 要求创作者披露使用修改或合成媒体制作的逼真内容,例如替换的人脸或合成的声音;TikTok 要求为包含逼真图像、音频或视频的 AI 生成内容添加标签。
你的照片和声音样本会怎样处理
- 照片和声音样本在保存前会检查文件类型、大小和恶意软件。
- 你的形象照片用于生成你的视频;你的声音样本会发送给语音引擎一次,用来创建克隆声音。
- 在工作室里删除形象或声音后,它就不会再用于任何新视频。
- 视频工作室目前面向创作者、品牌、机构和 CEO 账号开放测试;付费套餐每月包含少量标准视频额度,说话类视频使用视频包。
常见问题
视频真的会像我吗?
它会紧贴你的正面照片,因为引擎被要求在每个镜头里保持你的脸和五官不变。请使用清晰、光线好、正面、至少 512 × 512 像素的自拍;侧面照片会保存以供未来的模型使用,不会改变目前的效果。
声音克隆是怎么做的?
录制或上传 20 到 60 秒的清晰语音。之后在“我加我的声音”模式下,视频会用这个克隆声音说出你的脚本,并通过口型同步让嘴型对上,额外消耗 1 个视频包。
有工具能保证视频爆火吗?
没有。Eldin Motion 按照短视频信息流偏好的方式制作视频(钩子在前、主体清晰、竖屏构图),但播放量取决于创意、时机和你的受众。
可以删除我的形象和声音吗?
可以。随时在工作室里删除保存的形象或克隆声音,之后就不能再用于新视频。只使用你自己的脸和声音,或已经同意的人的脸和声音。
用我的脸做视频
ChamsPilot 功能介绍
切换其他语言阅读: English Français Español العربية 繁體中文