Speech to Text

商业用途OK 380+模型 无水印 不需要注册
型号 :
+ GPT-5, Claude, Gemini
上传一个音频或视频文件(或粘贴一个 URL ), 并用时间戳获得一份干净的文字记录。 议长对称、 SRT/ VTT 字幕导出、 100+ 语言和自动检测。 成本比例与剪辑长度完全相同。 由 Whiseper large- v3 和 Parakeet (自托管) 提供动力, 加上 溢价 Wizper 和 11Labs STT 。

拖放音频/视频,或单击浏览

MP3、WAV、MP4、WebM、M4A-至多500MB

- - -
低语大V3——99种语言,最精准。
此剪辑的 Token 估计
-
免费注册 - 10K 符号 购买牌牌
YouTube、Instagram、TikTok、Spotify和1 300+平台
URL 转录成本基于剪辑的实际持续时间——下载后我们引用。在Whisper上期待~500个标记/分钟。
记录 : 0:00

使用麦克风实时抄录

脚本

正在写入您的音频...

较长的文件可能需要一点时间 。

人们用Free.ai的文字抄录什么?

采访+播客

diarization 标记每个扬声器 。 导出 SRT 直接进入您的视频编辑器, 或文章撰写的纯文本 。

自动字幕+字幕

上传 YouTube 上传或 TikTok, 选择 SRT 或 WebVTT, 并用 / 视频/ 字幕/ 燃烧字幕。 一站式字幕工作流程 。

会议说明

Upload a Zoom/Teams recording - get transcript + speaker labels. Pair with /write/summarize/ for bullet-point minutes.

讲座+课程

撰写90分钟的演讲稿,然后使用/学习/剪切卡片/或/写/摘要/将其转化为学习材料。

外语音频

私语自动检测 99 种语言。 将文字写在原文中, 然后通过 / translate/ to jump languages 发送文本 。

法律+医疗

时间戳、演讲人标签、JSON出口,每个字的开始/结束时间——准确的法院报告人或临床注解前注。

How Free.ai transcription compares

你得到什么 Free.ai Otter.ai Descript Rev.com
每日免费使用5K+ tokens/day300 minutes/mo1 hr/month-
引擎Whisper large-v3, ParakeetProprietaryProprietaryHuman + AI
语言99English-focused2230+
议长对角
SRT / VTT 导出PaidPaid
APIP 公共LimitedLimited
实时流流 STT (自由) Paid--
需要注册无 无YesYesYes
竞争者数字反映了截至2026年公开列出的免费分层。 请查看每个供应商当前的计划 。
高级选项
结果成果
代号正在下降 获取更多当当量
想要更好的结果吗? 模型 提供质量更高的产品。 查看计划

❤️ Love this tool? Share it!

< a href="/ signup/" style="color:#16A34A" > 签名 以获得查询链接, 并获得每个朋友25,000个代币的 。

还要吗? 每天免费注册30K个纪念品 + 10K 奖金
免费注册

处理您的请求...

Best free speech to text tool. Upload MP3, WAV, MP4 or record live. Auto-detect language. Speaker diarization. No sign up required.

如何使用 Speech to Text

1
输入

键入文本、上传文件或描述您想要的东西。不需要账户 。

2
点击生成

我们的人工智能使用最佳的开放源码模型,在秒内处理你的请求。

3
下载共享( S)

下载、复制或分享您的结果。 免费个人和商业使用 。

通过 API 使用此工具

自动使用您自己的代码中的此工具。 OpenAI 兼容的 REST 端点、 Beaner-tok auth, 不需要额外的 SDK 。 Tok 成本符合网络界面 。

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@audio.mp3", "language": "auto"}'

Speech to Text - FAQ

Free.ai提供极精准的语音、99种语言、字幕导出、语音探测和现场主听录制,

上传音频或视频文件( MP3, WAV, MP4, M4A), 点击 Transcrip 键, 并获得文本的准确语音, 或从您的麦克风上现场直播 。

是的。 在 URL 标签中粘贴任何 YouTube URL, 文Speech To Text的演讲词会提取音频并将其转换。 与 Instagram、 TikTok、 Spotify 和 1300+ 平台一起工作 。

是的, 从99种语言中自动检测或选择。 我们的语音和文本处理口音、背景噪音和混合语言音效良好。

是。同时选择多个音频文件——每个文件通过讲话发送到文本中,并进行进度跟踪,结果可以单独下载或合并下载。

/api/的文本 API 的演讲与 OpenAI 兼容, 以程序方式上传音频, 并接收 JSON 的文字、 语言和时间戳 。

是, 在上传前切换音员检测, 发言到文本输出时贴上每个发言者的标签( 发言者 1, 发言人 2...) 。 象征性成本加50% 。

文本的语音接收文件, 最多为每上传500MB。 对于多小时内容, 先将音频分割成块 。

清晰音频非常精确, 通常以英文表示95个字的准确性, 并使用我们的 Whisper 大型 v3 后端。 质量取决于音频清晰度、 口音 和背景噪音 。

是的, 抄本完全可以编辑 。 将错误、 重新格式化和复制/ 下载作为 TXT、 SRT 或 VTT 来修正 。

是的。 音频是通过我们自己GPU处理的,在演讲后删除,以完成文字的完整,没有长期储存、共享或用于培训。

将录音或录像文件上载/聊天/并请大赦国际将其抄录——将讲话与后续问题和总结放在一个工作流程中。

免费签署——每天30 000个象征性

创建自由账户

无需信用卡

你会如何评分这个工具?

Love this tool? Share it!