Free Tiếng Ả Rập Transcript
Transcript Tiếng Ả Rập audio and video to text with AI. Nhanh, chính xác và miễn phí.
Nó hoạt động thế nào?
- Đi tới Trình dịch Free.ai
- Tải lên tập tin âm thanh hoặc video Tiếng Ả Rập của bạn
- AI của chúng tôi tự động phát hiện Tiếng Ả Rập và chuyển ngữ nó.
- Tải về bản ghi của bạn dưới dạng văn bản hoặc phụ đề SRT
Tiếng Ả Rập Tính năng phiên âm
- ✓Được cung cấp bởi faster-whisper (giấy phép MIT)
- ✓Tự động phát hiện ngôn ngữ Tiếng Ả Rập
- ✓Hỗ trợ MP3, WAV, MP4, M4A, FLAC, và nhiều hơn
- ✓Nhập tên tập tin
- ✓Không giới hạn kích thước tập tin trên các gói trả phí
- ✓Độc lập và an toàn -- tập tin sẽ bị xóa sau khi xử lý
Chi tiết ngôn ngữ
| Ngôn ngữ | Tiếng Ả Rập |
| Mã ISO | ar |
| Mô hình AI | faster-whisper |
| Giá | Tự do |
Nhiều ngôn ngữ hơn
Xem tất cả ngôn ngữCâu hỏi thường gặp
Whisper large-v3-turbo xử lý Tiếng Ả Rập một cách tốt — tỷ lệ sai từ 7-15% trên âm thanh tiêu chuẩn. Chờ đợi thay thế thỉnh thoảng trên các thực thể có tên, số, và từ vựng kỹ thuật dày đặc; phần lớn bản ghi sẽ chính xác.(Trình độ B, 7-15% word error rate trên các tập điểm chuẩn - chúng tôi công bố các cấp độ WER trung thực hơn là tuyên bố tiếp thị.)
Có — Tiếng Ả Rập bản dịch lấy từ nguồn token miễn phí hàng ngày của bạn trước. Âm thanh tốn khoảng 50 token mỗi phút, vì vậy nguồn ẩn danh hàng ngày bao gồm vài giờ âm thanh mỗi ngày. Tài khoản đăng nhập nhận được một nguồn lớn hơn 30.000 token hàng ngày. Sau đó, bản dịch là trả theo thời gian, với token tăng dần từ $1.
Tiếng Ả Rập được xử lý ở mức chuẩn Ả Rập hiện đại (MSA) theo mặc định. Tiếng Ai Cập, Levantine, Gulf, và Maghrebi được nhận ra nhưng được chuyển thành chính tả MSA - Whisper không chuyển sang Latinh hay giữ lại chính tả đặc biệt của phương ngữ. Đối với tin tức/ bài giảng MSA thuần túy, hãy chờ độ chính xác cấp B; tiếng Maghrebi hay Ai Cập nói chung sẽ đẩy thấp hơn.
MP3, WAV, M4A, FLAC, OGG, OPUS, và WEBM được chấp nhận trực tiếp. Đối với video (MP4, MOV, MKV) chúng ta sẽ trích xuất các đoạn âm thanh bên máy chủ trước khi gửi nó đến Whisper - bạn không cần phải tự chuyển đổi gì cả. Cũng có đường ống tương tự bất kể ngôn ngữ nguồn, bao gồm Tiếng Ả Rập.
Tải lên ẩn danh giới hạn khoảng 500 MB mỗi tập tin. Tài khoản đăng nhập lên đến 2 GB. Thời gian không phải là giới hạn cứng — các tập tin dài sẽ được chia nhỏ tự động (cửa sổ 30 giây với chồng chéo) và ghép lại thành một bản ghi duy nhất với dấu thời gian liên tục. Các bản ghi Tiếng Ả Rập nhiều giờ (podcast, bài giảng đầy đủ, cuộc họp) hoạt động tốt.
Vâng — mặc định, việc ghi lại các người nói được bật cho mỗi bản ghi âm Tiếng Ả Rập. Kết quả được phân chia thành Người nói 1 / Người nói 2 / Người nói 3 với dấu thời gian, vì vậy các cuộc phỏng vấn, thảo luận, và các cuộc họp đa bên sẽ được đánh dấu. Việc ghi lại được chạy trên một mô hình riêng và hoạt động giống nhau trên tất cả các ngôn ngữ chúng tôi hỗ trợ.
Có - dán URL vào /transcribe/youtube/ cho YouTube hoặc /transcribe/podcast/ cho podcast feed (Apple, Spotify, RSS). Chúng tôi tải về âm thanh, chạy nó qua Whisper với language=ar, và trả lại bản ghi với dấu thời gian và nhãn người nói. Nội dung Tiếng Ả Rập điển hình: các đoạn tin tức, các bài giảng, các bài giảng và các cuộc phỏng vấn chính trị trong Tiếng Ả Rập là những công việc phổ biến nhất; dán URL YouTube vào /transcribe/youtube/ hoặc tải lên tập tin.
Whisper có giá khoảng 50 token mỗi phút âm thanh, vì vậy một giờ ghi âm là ~3,000 token. Hầu hết người dùng không bao giờ tiêu tiền - 30,000 token miễn phí mỗi ngày bao gồm các đoạn phim ngắn, ghi chú giọng nói, và podcast một lần. Ngoài ra, phiên dịch là trả theo thời gian, với token tăng từ $1.
Có - cả dấu thời gian cấp đoạn (mỗi ~10-30 giây) và cấp từ đều có sẵn. Mặc định là cấp từ cho xuất phụ đề VTT/SRT vì vậy các phụ đề đồng bộ hóa từng dòng. Trên API đặt timestamps="word" trong cơ thể yêu cầu. Các bản dịch Tiếng Ả Rập được trả lại trong văn bản từ phải sang trái bản địa của chúng và hiển thị chính xác trong bất kỳ trình xem RTL-aware nào (trình duyệt, Word, Google Docs).
Đúng. POST âm thanh (multipart/form-data, field name "file") to /v1/transcribe/ with language=ar - or omit the language parameter to let Whisper auto-detect. Returns JSON with the transcript, segments, timestamps, and speaker labels. Full reference and SDK snippets at /api/.
Có - khi phiên dịch hoàn tất, nhấn vào dịch hoặc dán văn bản vào /translate/. Tiếng Ả Rập cặp với mọi ngôn ngữ khác chúng tôi hỗ trợ (200+). Đối với các văn bản hội nghị, chuyển phiên dịch qua /summarize/; cho lồng tiếng gửi nó đến /voice/tts/ để tạo âm thanh trong ngôn ngữ mục tiêu.
Whisper được huấn luyện trên hàng trăm ngàn giờ âm thanh thực tế, vì vậy nó chịu được tiếng ồn nền và ghi âm chất lượng điện thoại trên Tiếng Ả Rập. Để đạt được kết quả tốt nhất, cung cấp âm thanh sạch (micro tai nghe, không có giường âm nhạc) - ở cấp độ này tiếng ồn làm tăng tỉ lệ lỗi cơ sở.Nếu một bản ghi lại trở lại không thể sử dụng, email contact@free.ai với tập tin - chúng tôi sẽ trả lại token và xem xem liệu một engine khác có xử lý âm thanh của bạn tốt hơn.