faster-whisper large-v3-turbo
Free.ai (self-hosted)
·
stt
·
~500 符合的运数符数 minute
faster-whisper large-v3-turbo是a 语音到文本模式,由OpenAI / SYSTRAN制造。 最强的 Accurate transcription。 在Free.ai GPUs上自行托管——免费运行于您的每日代币池({tpm_signs} 每分钟)。 以MIT -- -- 允许在Free.ai上的商业用途释放。
通过 API 使用
生成一个密钥, 并用秒调用此模式 。
curl -X POST https://api.free.ai/v1/stt/ \
-H "Authorization: Bearer sk-free-..." \
-H "Content-Type: application/json" \
-d '{"model":"whisper","audio_url":"https://..."}'
APP API 文件
获取 API 密钥
常问问题
faster-whisper large-v3-turbo 抄录语音音频到文字。 上传 MP3、 WAV、 M4A 或视频文件 和 faster-whisper large-v3-turbo 返回全文, 并随时间戳一起, 加上可选 SRT/ VTT 字幕 。
faster-whisper large-v3-turbo handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.
语言压力率在清洁英语音频上为5-10%,在吵闹或口音音上为10-20%。同一结构的大变体在硬体上效果更好 - - 当音频粗糙时取大一点。
是 - 每个段都包含起始/ 结束时间戳。 导出为 SRT 或 VTT, 时间图会直接映射到您的视频中 。
faster-whisper large-v3-turbo runs on our own GPUs against your daily free pool first; $5 → 200,000 paid tokens after that. About ~500 tokens per minute.
MP3、WAV、M4A、FLAC、OGG,加上视频(MP4、MOV、WebM)——我们提取音频。每次上传最大值为500MB。较长的文件?与/audio/cut/或使用/v1/stt/batch/分割。
议长的diarization是单独的通行证, 将/ scrancense/ faster-whisper large-v3-turbo 上的“diarize” 划为处理抄录的通道; 每一段的diarization标签由1/ seamer 2 等的发言人 。
是 -/batch/ 接受一个音频文件文件夹。 每一个抄本在/ account/? tab=历史文件名中都有原文件名。 文件夹树的保存使用 API 。
是 — POST 您的音频到 /v1/stt/ transcrip/ 模式= "faster-whisper large-v3-turbo" 。 返回 JSON 时标时标, 文本+部分+单词值 。 / api/ 有完整参考。
自营模型保留了我们GPU的音频; 溢价通过一个政治部。 共享窗口( 24h anon, 7d 签名) 后, 音频将被删除 。 我们不培训您的投入 。
是的 - Free.ai 允许商业使用抄录。 您需要您上传的音频(您自己的录音、许可材料或经过同意的内容)的权利。
实时因子约为 0.05-0.2x - 3 - 12 分钟内60 分钟的播客剪贴机。 配比模型通常会更快完成。 使用队列按钮关闭标签 。