Speech to Text

商业使用OK 579 模型 无水印 不需要注册
型号 :
+ GPT-5, Claude, Gemini
Upload an audio or video file - or paste a URL - and get a clean transcript with timestamps. Speaker diarization, SRT/VTT subtitle export, 100+ languages with auto-detect. Cost scales exactly with clip length. Powered by Whisper large-v3-turbo (self-hosted), plus premium Wizper and ElevenLabs STT.

拖放音频/视频,或单击浏览

MP3、WAV、MP4、WebM、M4A-至多500MB

- - -
Whisper 大型-v3 - 99种语言,最精确级数。
此剪辑的调制估量
-
YouTube、Instagram、TikTok、Spotify和1 300+平台
URL 转录成本基于剪辑的实际持续时间——下载后我们引用。在Whisper上期待~500个标记/分钟。
记录 : 0:00

使用麦克风实时抄录

记录栏

正在写入您的音频...

较长的文件可能需要一秒钟。

人用 Free.ai 写入什么

采访+播客

diarization 标签每个发言者。 导出 SRT 直接进入您的视频编辑器, 或者文章写作的简单文本 。

自动字幕+字幕

上传YouTube上传或 TikTok, 选择 SRT 或 WebVTT, 并用 / Video/ Sub标题/ 刻录字幕/ 。 一站式字幕工作流程 。

会议记录

Upload a Zoom/Teams recording - get transcript + speaker labels. Pair with /write/summarize/ for bullet-point minutes.

讲座+课程

写90分钟的讲课,然后使用/学习/剪切卡/或/写/摘要/将其变成学习材料。

外语音频

Whisper 自动检测99种语言。 将文字以原文刻录, 然后通过 / translate/ 发送到跳过语言 。

法律+医疗

时间戳、演讲人标签、JSON出口,每个字的开始/结束时间——准确的法院报告人或临床注解前注。

Free.ai 转录比

得到什么 Free.ai Otter.ai Descript Rev.com
免费每日使用5K+ tokens/day300 minutes/mo1 hr/month-
引擎Whisper large-v3-turboProprietaryProprietaryHuman + AI
语文99English-focused2230+
议长对角
SRT / VTT 出口PaidPaid
APIP 公共LimitedLimited
实时流流 STT (自由) Paid--
需要注册无 无YesYesYes
竞争者数字反映了2026年公开公布的免费分层,请查看每个供应商目前的计划。
高级选项
结果成果
代号正在下降 获取更多调制当量
想要更好的结果吗? 模型 (GPT-5, Claude, Gemini) 提供更高质量的品质。 视图计划

❤️ 爱 Free.ai 告诉你的朋友!

< a href="/ signup/" style="color:#16A34A" > 签名 以获得查询链接, 并获得每个朋友25,000个代币的 。

还要吗? 免费签名: 每天30 000个象征性
免费注册

处理你的请求...

Best free speech to text tool. Upload MP3, WAV, MP4 or record live. Auto-detect language. Speaker diarization. No sign up required.

如何使用 Speech to Text

1
输入

输入文本、上传文件或描述您想要的。不需要账户 。

2
单击 单击 生成

我们的AI在使用最佳开放源码模型的秒内处理你的请求。

3
下载共享( S)

下载、复制或分享您的结果。 免费个人和商业使用 。

通过 API 使用此工具

自动使用您自己的代码中的此工具。 OpenAI 兼容的 REST 端点、 Beaner-tok auth, 不需要额外的 SDK 。 Tok 成本符合网络界面 。

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@audio.mp3", "language": "auto"}'

Speech to Text - FAQ

Free.ai提供Whisper 动力语音, 精准地读到文字、99种语言、字幕导出、语音探测、现场主听监听- 完全免费。

上传音频或视频文件( MP3, WAV, MP4, M4A), 点击 Transcrip 键, 并获得文本的准确语音, 或从您的麦克风上现场直播 。

是的。 在 URL 标签中粘贴任何 YouTube URL, 文Speech To Text的演讲词会提取音频并将其转换。 与 Instagram、 TikTok、 Spotify 和 1300+ 平台一起工作 。

是的, 从99种语言中自动检测或选择。 我们的语音和文本处理口音、背景噪音和混合语言音效良好。

是。同时选择多个音频文件 - 每一个通过语音发送到文本中,并进行进度跟踪,结果可以单独下载或合并。

/api/的文本 API 的演讲与 OpenAI 兼容, 以程序方式上传音频, 并接收 JSON 的文字、 语言和时间戳 。

是, 在上传前切换音员检测, 发言到文本输出时贴上每个发言者的标签( 发言者 1, 发言人 2...) 。 象征性成本加50% 。

文本的语音接收文件, 最多为每上传500MB。 对于多小时内容, 先将音频分割成块 。

清晰音频非常精确 - 通常为 95 字准确英语, 包括我们的 Whisper 大型 v3 后端。 质量取决于音频清晰度、 口音和背景噪音 。

是的, 抄本完全可以编辑 。 将错误、 重新格式化和复制/ 下载作为 TXT、 SRT 或 VTT 来修正 。

是的。 音频是通过我们自己GPU处理的,在演讲后删除,以完成文字的完整,没有长期储存、共享或用于培训。

将音频或视频文件上传到/聊天/并请大赦国际将其抄录-将讲话与文字合并,并加上后续问题和在一个工作流程中进行总结。

免费签名: 每天30 000个象征性

创建自由账户

无需信用卡

你怎么评价这个工具?

爱 Free.ai 告诉你的朋友!