Speech to Text

Dùng thương mại được rồi. 579 models Không dấu nước Không cần đăng ký
Mô hình:
+ GPT-5, Claude, Gemini
Upload an audio or video file - or paste a URL - and get a clean transcript with timestamps. Speaker diarization, SRT/VTT subtitle export, 100+ languages with auto-detect. Cost scales exactly with clip length. Powered by Whisper large-v3-turbo (self-hosted), plus premium Wizper and ElevenLabs STT.

Kéo và thả âm thanh/video, hoặc nhấn để lướt

MP3, WAV, MP4, WebM, M4A - lên đến 500MB

- - -
Whisper large-v3 - 99 ngôn ngữ, độ chính xác tốt nhất.
Ước tính token cho đoạn phim này
-
YouTube, Instagram, TikTok, Spotify, và hơn 1.300 nền tảng
URL transcription cost is based on the clip's actual duration — we quote after download. Expect ~500 tokens/minute on Whisper.
Ghi âm: 0:00

Phiên âm thời gian thực bằng micrô

Bản dịch

Đang chuyển âm thanh...

Điều này có thể mất một chút thời gian cho các tập tin dài hơn.

Những gì người ta viết với Free.ai

Phỏng vấn + podcast

Diarization đánh dấu mỗi loa. Xuất SRT trực tiếp vào trình biên tập video của bạn, hoặc văn bản đơn giản cho một bài viết.

Tự động

Tải lên một video YouTube hoặc TikTok, chọn SRT hoặc WebVTT, và ghi phụ đề vào với /video/subtitle/.

Ghi chú cuộc họp

Upload a Zoom/Teams recording - get transcript + speaker labels. Pair with /write/summarize/ for bullet-point minutes.

Bài học

Transcript a 90-minute lecture, then use /study/flashcards/ or /write/summarize/ to turn it into study material.

Âm thanh ngôn ngữ ngoại quốc

Whisper tự động phát hiện 99 ngôn ngữ. Viết lại bằng ngôn ngữ gốc, sau đó gửi văn bản qua /translate/ để nhảy ngôn ngữ.

Luật + y tế

Time stamps, speaker labels, JSON export with every word's start/end time — chính xác court-reporter hoặc clinical-note prep.

Cách phiên âm Free.ai so sánh

Cái mày có được Free.ai Otter.ai Descript Rev.com
Sử dụng miễn phí hàng ngày5K+ tokens/day300 minutes/mo1 hr/month-
Động cơWhisper large-v3-turboProprietaryProprietaryHuman + AI
Ngôn ngữ99English-focused2230+
Điều chỉnh loa
Xuất SRT / VTTPaidPaid
API công cộngLimitedLimited
Truyền trực tiếp STT (được) Paid--
Cần đăng kýKhôngYesYesYes
Số liệu của đối thủ phản ánh các cấp miễn phí được liệt kê công khai vào năm 2026.
Tùy chọn cao cấp
Kết quả
Tiền đang cạn. Lấy thêm token
Muốn kết quả tốt hơn? Mô hình cao cấp (GPT-5, Claude, Gemini) cung cấp chất lượng cao hơn. Xem kế hoạch

❤️ Cậu yêu Free.ai?

Đăng ký để nhận liên kết giới thiệu và kiếm được 30.000 token cho mỗi người bạn.

Muốn thêm nữa không? Đăng ký miễn phí: 30,000 token/ngày
Đăng ký miễn phí

Đang xử lý yêu cầu của bạn...

Best free speech to text tool. Upload MP3, WAV, MP4 or record live. Auto-detect language. Speaker diarization. No sign up required.

Cách sử dụng Speech to Text

1
Nhập thông tin nhập vào

Nhập văn bản, tải lên tập tin, hay mô tả điều bạn muốn. Không cần tài khoản.

2
Nhấn để tạo

AI của chúng tôi xử lý yêu cầu của bạn trong vài giây sử dụng các mô hình nguồn mở tốt nhất.

3
Tải về và chia sẻ

Tải xuống, sao chép, hoặc chia sẻ kết quả của bạn. Miễn phí cho sử dụng cá nhân và thương mại.

Dùng công cụ này qua API

Tự động hóa công cụ này từ mã của bạn. Điểm cuối REST tương thích OpenAI, xác thực token Bearer, không cần SDK bổ sung. Chi phí token tương ứng với giao diện web.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@audio.mp3", "language": "auto"}'

Speech to Text - FAQ

Free.ai cung cấp Whisper-powered speech to text với độ chính xác tuyệt vời, 99 ngôn ngữ, xuất bản phụ đề, phát hiện người nói, và ghi mic trực tiếp - hoàn toàn miễn phí.

Tải lên một tập tin âm thanh hoặc video (MP3, WAV, MP4, M4A), nhấn vào Phép dịch, và nhận được lời nói chính xác thành văn bản trong vài giây. Hoặc ghi âm trực tiếp từ micro của bạn.

Có. Đưa URL YouTube vào mục URL và công cụ chuyển đổi từ nói sang văn bản sẽ trích xuất âm thanh và chuyển đổi nó.

Đúng. Tự động phát hiện hoặc chọn từ 99 ngôn ngữ. Tiếng nói của chúng tôi để văn bản xử lý giọng điệu, tiếng ồn nền, và âm thanh hỗn hợp ngôn ngữ tốt.

Đúng. Chọn nhiều tập tin âm thanh cùng một lúc - mỗi tập tin sẽ được gửi qua trình chuyển đổi giọng nói thành văn bản với việc theo dõi tiến độ và kết quả có thể tải về riêng lẻ hoặc kết hợp.

Có. API nói đến văn bản ở /api/ tương thích với OpenAI. Tải lên âm thanh bằng chương trình và nhận JSON với bản dịch, ngôn ngữ và dấu thời gian.

Đúng. Bật/ tắt Kiểm tra người nói trước khi tải lên và kết quả nói đến văn bản sẽ được đánh dấu cho mỗi người nói (Người nói 1, Người nói 2...). Thêm 50% giá trị token.

Từ nói thành văn bản chấp nhận tập tin lên đến 500MB mỗi lần tải lên. Đối với nội dung nhiều giờ, chia âm thanh thành các mảnh trước.

Rất chính xác cho âm thanh rõ ràng - thường là chính xác hơn 95% từ trong tiếng Anh với phần mềm sau Whisper large- v3 của chúng tôi. Chất lượng phụ thuộc vào độ rõ âm thanh, giọng nói và tiếng ồn nền.

Có. Transcript có thể được chỉnh sửa hoàn toàn tại chỗ. Sửa lỗi, định dạng, và sao chép/tải xuống như TXT, SRT, hay VTT.

Có. Âm thanh được xử lý trên GPU của chúng tôi và bị xóa sau khi hoàn thành chuyển đổi từ nói sang văn bản. Không có gì được lưu trữ lâu dài, chia sẻ, hay dùng để huấn luyện.

Đúng. Tải lên một tập tin âm thanh hoặc video trong / chat / và yêu cầu AI chuyển đổi nó - kết hợp nói chuyện với văn bản với các câu hỏi tiếp theo và tóm tắt trong một luồng công việc.

Đăng ký miễn phí: 30,000 token/ngày

Tạo tài khoản

Không cần thẻ tín dụng

Anh đánh giá công cụ này thế nào?

Cậu yêu Free.ai?