الإنجليزية مجاني
. نقل الإنجليزية صوت وفيديو إلى نص مع الذكاء الاصطناعي. سريع، دقيق، ومجاني
كيف يعمل
- اذهب إلى Free.ai مسجل
- تحميل ملفك الإنجليزية السمعي أو الفيديو
- الذكاء الاصطناعي لدينا يكتشف تلقائيا الإنجليزية ويسجلها
- تحميل نسختك النصية كـ نص أو SRT عناوين فرعية
الإنجليزية خصائص النسخ
- ✓دعم faster-whisper (MIT مرخصة)
- ✓كشف الإنجليزية لغة آليا
- ✓دعم MP3، WAV، MP4، M4A، FLAC، وأكثر
- ✓تصدير الختم الزمني والترجمة النصية (SRT)
- ✓لا حدود لحجم الملف على الخطط المدفوعة
- ✓سرية وآمنة - تُحذف الملفات بعد التجهيز
تفاصيل اللغة
| اللغة | الإنجليزية |
| رمز المنظمة الدولية للتوحيد القياسي | en |
| نموذج الذكاء الاصطناعي | faster-whisper |
| السعر | مجاني |
لغات أخرى
جميع اللغاتالأسئلة المتكررة
يسقط Whisper large-v3-turbo في أعلى مستوى من الدقة على الإنجليزية - تحت 7% معدل خطأ الكلمات على المعايير القياسية. في الممارسة العملية، يعني ذلك أن الصوت النظيف في الاستوديو يعود قريبا من الكمال، والصوت المحادثة قابلة للاستخدام مع الحد الأدنى من التنظيف.(الطبقة A، under 7% word error rate على مجموعات المعايير المرجعية - ننشر طبقات WER الصادقة بدلاً من ادعاءات التسويق).
نعم — الإنجليزية النسخ يستمد من مجمع الرموز اليومية المجانية أولا. السمعي تكلفة حوالي 50 الرموز في الدقيقة، لذلك المجمع اليومي المجهول يغطى عدة ساعات من الصوت في اليوم. الحسابات المسجلة تحصل على أكبر 30000 الرموز اليومية المجمع. بعد ذلك، النسخ هو دفع حسب الاستخدام، مع رموز تغذية من $1.
يشمل النص الإنجليزي الولايات المتحدة، المملكة المتحدة، أستراليا، الهند، وغيرها من اللهجات الرئيسية في نموذج واحد. Whisper تم تدريبه على جميعهم والنص يخرج في الهجاء الإنجليزي العادي بغض النظر عن لهجة المتحدث.
يقبل مباشرة MP3, WAV, M4A, FLAC, OGG, OPUS, WEBM. بالنسبة للفيديو (MP4, MOV, MKV) نقوم باستخراج المسار الصوتي من جانب الخادم قبل إرساله إلى Whisper - لا تحتاج إلى تحويل أي شيء بنفسك. نفس الأنبوب بغض النظر عن لغة المصدر، بما في ذلك الإنجليزية.
Anonymous uploads cap at roughly 500 MB per file. Signed-in accounts go up to 2 GB. Duration is not a hard limit - long files are chunked automatically (30-second windows with overlap) and stitched back into a single transcript with continuous timestamps. Multi-hour الإنجليزية recordings (podcasts, full lectures, meetings) work fine.
نعم - تفعيل تسجيل المتحدثين في السجلات بصورة افتراضية لكل نسخة من الإنجليزية. ويقسم المخرج إلى المتحدث 1 / المتحدث 2 / المتحدث 3 مع علامات زمنية، وبالتالي فإن المقابلات، ومناقشات الأفرقة، والاجتماعات المتعددة الأطراف تعود مع علامات. ويجري تسجيل المتحدثين في السجلات على نموذج منفصل ويعمل بنفس الطريقة عبر جميع اللغات التي ندعمها.
نعم - لصق العنوان في /transcribe/youtube/ لليوتيوب أو /transcribe/podcast/ للبودكاست (Apple، Spotify، RSS). نحن نقوم بتنزيل الصوت، ونقوم بتشغيله عبر Whisper مع language=en، ونعيد النص مع الختم الزمني وعلامات المتحدث. المحتوى النموذجي الإنجليزية: المحاضرات، والمقابلات، والملاحظات الصوتية، ومحتويات يوتيوب في الإنجليزية كلها تعمل - لصق عنوان URL في /transcribe/youtube/ أو تحميل الملف مباشرة.
Whisper costs about 50 tokens per minute of audio, so a one-hour recording is ~3,000 tokens. Most users never spend anything - the free daily pool of 30,000 tokens covers short clips, voice notes, and one-off podcasts. Beyond it, transcription is pay-as-you-go, with token top-ups from $1.
نعم - كل من مستوى القطاع (كل ~ 10-30 ثانية) ومستوى الكلمات الختم الزمني متاح. مستوى الكلمات هو الافتراضي ل VTT / SRT النصوص المترجمة تصدير بحيث النصوص المترجمة تزامن سطر بسطر. على API وضع timestamps="كلمة" في جسد الطلب. يتم إرجاع نسخ الإنجليزية في معيار UTF-8 مع الهجاء العادي لللغة.
نعم. صوت POST (بيانات متعددة الأجزاء/شكل، اسم الحقل "الملف") إلى /v1/transcribe / مع language=en - أو حذف البارامتر اللغة لترك Whisper الكشف الآلي. يعيد JSON مع النص، الأجزاء، الختم الزمني، وعلامات المتحدث. المرجع الكامل و SDK قطع في /api/.
نعم - بمجرد الانتهاء من النسخ، انقر على ترجمة أو لصق النص في /translate/. الإنجليزية زوج مع كل لغة أخرى ندعم (200 +). لمحاضر الاجتماع توصيل النص من خلال /summarize/؛ للدبلجة إرسالها إلى /voice/tts/ لعرض الصوت في اللغة المستهدفة.
تم تدريب Whisper على 680K ساعات من الصوت الضجيج في العالم الحقيقي، لذلك نسخ الإنجليزية قوية لضوضاء الخلفية، أسرة الموسيقى، والتسجيلات ذات النوعية الهاتفية. القطع الحاد أو المكالمات المتعددة المتداخلة سوف تضر الدقة.إذا كان النص يعود غير قابل للاستخدام، بريد إلكتروني contact@free.ai مع الملف - سنرد الرموز والنظر فيما إذا كان محرك مختلف يتعامل مع الصوت الخاص بك أفضل.