AI 视频翻译员

商业用途OK 380+模型 无水印 不需要注册
型号 :
+ GPT-5, Claude, Gemini
Repost your YouTube in Spanish, Hindi, French — with your face actually saying the words. Upload a video, pick a target language + voice, and we transcribe, translate, re-voice, and mix the new audio back into the original clip. Toggle lip-sync to also re-render the mouth.

拖放视频到这里拖放( 放下), 或者单击浏览

MP4、MOV、WWM最多100MM 5分钟以下的剪辑工作最快

· ·
每分钟摄像头(音频路径)~1 500个标记 ~ 3,000 分钟/分钟,用唇合音。
正在从视频中提取音频...
翻译视频已准备好
Show transcript + translation
原件(已批准)

                    
已翻译

                    
下载 MP4

视频翻译员付款的地方

在全球各地重新张贴YouTube

一份英文上传的西班牙文、印地文、法文、葡萄牙文、印度尼西亚文,

课程本土化课程

在线教育者在一夜之间用10种语言将50个视频课程分成10个语言。 口语合成选项让口语头部分感到土生土长,而不是字幕。

本地化广告

在10个具体国家广告账户上运行同样的产品证明。 同样的角色、同样的镜头、每个市场的本地音频 — 没有重拍。

视频翻译如何工作

步骤1

解开音频

服务器端 ffmpeg 从您的上传中提取一个干净的 MP3 音轨。 Fast - 运行在 API VPS 上 。

步骤2

加密

Whiper 将音频转换成有自动语言检测的文本。 99种语言支持出盒子 。

步骤3

Translate + re-voice

MadLAD 翻译为目标语言; Kokoro用您从 174 种选项中选择的声音回过头来说。

步骤4

Mix back + (optional) lip-sync

ffmpeg 将原始音频替换为新音轨。 如果使用唇同步, Sync Lipsync v2 将嘴部重新显示为匹配 。

最清洁的翻译视频提示

  • 单个前方扬声器。 多位扬声器的场景混淆了笔录和唇合音同时通过。
  • 在 - 6 dB 清除音频。 背景音乐或噪音会降低抄录准确性。
  • 5分钟以下的短片以2至5分钟(音频路径)或5至15分钟(用唇合音)传送。
  • 西班牙语、法语、德语、葡萄牙语、葡萄牙语、意大利语有最自然的科科罗语语音选项,印地语、阿拉伯语、日语、韩语、中文也有工作。
高级选项
结果成果
声调越来越低 获取更多当当量
想要更好的结果吗? 模型 提供质量更高的产品。 查看计划

❤️ Love this tool? Share it!

< a href="/ signup/" style="color:#16A34A" > 签名 以获得查询链接, 并获得每个朋友25,000个代币的 。

还要吗? 每天免费注册30K个纪念品 + 10K 奖金
免费注册

处理您的请求...

以西班牙文、印地文、法文重贴YouTube, 发言者用目标语言发声。 Whisper 抄录、 MadLAD 翻译、Kokoro 重新发音、 ffmpeg 混音。 可选的 Sync Lipsync v2 重新发嘴。

如何使用 AI 视频翻译员

1
输入

键入文本、上传文件或描述您想要的东西。不需要账户 。

2
点击生成

我们的人工智能使用最佳的开放源码模型,在秒内处理你的请求。

3
下载共享( S)

下载、复制或分享您的结果。 免费个人和商业使用 。

通过 API 使用此工具

从您自己的代码中自动启用此工具。 OpenAI 兼容的 REST 端点、 Bearer-tok 异常点、 不需要额外的 SDK 。 Token 成本符合网络界面 。

curl -X POST https://api.free.ai/v1/video/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"prompt": "A cat playing piano", "duration": 4}'

AI 视频翻译员 — FAQ

上传任何视频(YouTube剪辑、课程讲座、产品证词),我们用发言者的语音合成将其翻译为目标语言。可以选择,嘴唇合成重新插入嘴部,使其与新音频相匹配。音频:用西班牙语、印地语和法语重新张贴YouTube,用你的脸说词。

5个步骤按顺序运行客户端:(1) ffmpeg从视频中提取了干净的MP3,(2) Whisper 抄录了它(自动检测99种语言),(3) MadLAD 翻译文本,(4) Kokoro 以您所选的声音翻译译文,(5) ffmpeg 将新音调回原始视频, 取代原始音调。使用唇合成, 第六步通过 Sync Lipsync v2 将结果通过 Sync Lipsync v2 重新恢复嘴部。

视频 Dubbing 总是运行全唇同步管道 — 这是高档, 身份保护选项。 视频翻译选择了唇同步: 跳过它3×更快, ~ 50%更便宜的运行, 完全适合超音速内容, 而口音完美同步并不关键( 播客、 屏幕录音、 烹饪视频、 任何发言者不全时闭门的节目 ) 。

音频专用路径几乎完全使用自托管模型(ffmpeg + Whiseper + MadLAD + Kokoro)运行,因此它适合您每日的短片代用品补贴。 Lip-sync 使用高级Sync Lipsync v2 模式, 需要购买代用品。 估计 : 音频路径每分钟视频有~ 1500个代用品, ~ 3,000 分钟 。

下降暴露了20种高需求语言(西班牙语、法语、德语、意大利语、葡萄牙语、荷兰语、波兰语、俄语、土耳其语、阿拉伯语、希伯来语、印地语、中文、日语、韩语、越南语、印度尼西亚语、泰语、瑞典语、英语)。

是的—— 语音采集器将所有 174 个Kokoro 声音吸引到37种语言上, 每个声音都标注在样本上, 这样您就可以在承诺前试镜。 最自然的结果是将声音性别与演讲者性别匹配。

否——Kokoro从174个储存声音中摘取,而不是从原发言者的克隆中摘取。对于保留身份的语音克隆,先运行我们的/语音/克隆/组合/工具,先捕捉发言者的声音,然后使用定制工作流程。一个管道中的语音克隆+自动翻译在路线图上。

剪贴到 100MB 进程井。 5分钟以下的音频路径在2-5分钟内转换为2-5分钟, 5-15分钟加唇合音。 更长的视频, 分成片段, 翻译每个片段, 并在/ 视频/ 编辑/ 中恢复播放 。

MP4, MOV, WebMKV 最高可达 100MB 。 单一前方扬声器提供最干净的音稿和( 如果能够) 最佳的唇合音。 背景音乐或多位扬声器会降低音译准确性 。

不是用AI 视频翻译员来替换音频, 而不是视觉。 要将翻译的字幕刻录到视频中, 请在结果上运行我们的/ 视频/ 字幕/ 工具。 要导出 SRT/ VTT 字幕文件, 请在原始视频中使用/ 绑架/ 。

否。 上传在翻转后几分钟内被删除。 输出在共享链接的 CDN 上持续24小时( 付费用户为7天), 然后被删除 。

不是单端点,而是连接现有活点的链条:POST/V1/VAV/to-andio//v1/stt//v1/ translate//v1/ts//v1/VAVA/add-audio/,然后是可选的/v1/VAVE/lip-sync/。在/api/。前端调制了这个精确的链条。

免费注册一万个符号

创建自由账户

无需信用卡

你会如何评分这个工具?

Love this tool? Share it!