الماراثية مجاني
. نقل الماراثية صوت وفيديو إلى نص مع الذكاء الاصطناعي. سريع، دقيق، ومجاني
كيف يعمل
- اذهب إلى Free.ai مسجل
- تحميل ملفك الماراثية السمعي أو الفيديو
- الذكاء الاصطناعي لدينا يكتشف الماراثية تلقائياً ويسجلها
- تحميل نسختك النصية كـ نص أو SRT عناوين فرعية
الماراثية خصائص النسخ
- ✓دعم faster-whisper (MIT مرخصة)
- ✓كشف الماراثية لغة آليا
- ✓دعم MP3، WAV، MP4، M4A، FLAC، وأكثر
- ✓تصدير الختم الزمني والترجمة النصية (SRT)
- ✓لا حدود لحجم الملف على الخطط المدفوعة
- ✓سرية وآمنة - تُحذف الملفات بعد التجهيز
تفاصيل اللغة
| اللغة | الماراثية |
| رمز المنظمة الدولية للتوحيد القياسي | mr |
| نموذج الذكاء الاصطناعي | faster-whisper |
| السعر | مجاني |
لغات أخرى
جميع اللغاتالأسئلة المتكررة
الماراثية هي لغة متوسطة الموارد لـ Whisper — تقع لغة large-v3-turbo في نطاق معدل أخطاء الكلمات 15-25%. وجوهر النص موثوق به؛ لذا كن على استعداد لأخطاء الكيانات المسماة، وأخطاء أحيانية في تبديل الرموز، وأخطاء في النطق القصير.(الطبقة C، 15-25% word error rate على مجموعات المعايير - ننشر مستويات قيمة السوق الحقيقية بدلا من ادعاءات التسويق.)
نعم — الماراثية النسخ يستمد من مجمع الرموز اليومية المجانية أولا. السمعي تكلفة حوالي 50 الرموز في الدقيقة، لذلك المجمع اليومي المجهول يغطى عدة ساعات من الصوت في اليوم. الحسابات المسجلة تحصل على أكبر 30000 الرموز اليومية المجمع. بعد ذلك، النسخ هو دفع حسب الاستخدام، مع رموز تغذية من $1.
وترد النصوص المستنسخة من الماراثية باللغة الديفاناغاري (UTF-8).
MP3, WAV, M4A, FLAC, OGG, OPUS, and WEBM مقبولة مباشرة. بالنسبة للفيديو (MP4, MOV, MKV) نقوم باستخراج المسار الصوتي من جانب الخادم قبل إرساله إلى Whisper — لا تحتاج إلى تحويل أي شيء بنفسك. نفس الأنبوب بغض النظر عن لغة المصدر، بما في ذلك الماراثية.
لا يوجد حد زمني صارم للمدة - الملفات الطويلة يتم تقطيعها تلقائيا (نافذة 30 ثانية مع التداخل) ويتم دمجها في نسخة واحدة مع ختم زمني مستمر. التسجيلات المتعددة الساعات الماراثية (البودكاست، المحاضرات الكاملة، الاجتماعات) تعمل بشكل جيد.
نعم - تفعيل تسجيل المتحدثين في السجلات بصورة افتراضية لكل نسخة من الماراثية. ويقسم المخرج إلى المتحدث 1 / المتحدث 2 / المتحدث 3 مع علامات زمنية، وبالتالي فإن المقابلات، ومناقشات الأفرقة، والاجتماعات المتعددة الأطراف تعود مع علامات. ويجري تسجيل المتحدثين في السجلات على نموذج منفصل ويعمل بنفس الطريقة عبر جميع اللغات التي ندعمها.
نعم - لصق العنوان في /transcribe/youtube/ لليوتيوب أو /transcribe/podcast/ للبودكاست (Apple, Spotify, RSS). نحن نقوم بتنزيل الصوت، وتشغيله من خلال Whisper مع language=mr، ونعيد النص مع الختم الزمني وعلامات المتحدث. المحتوى النموذجي لـ الماراثية: الملاحظات الصوتية على واتساب، والمدونات على يوتيوب، والفيديو القصير هي أكثر أشكال العمل شيوعا في الماراثية - لصق عنوان URL في /transcribe/youtube/ أو تحميل الصوت مباشرة.
Whisper تكلف حوالي 50 رمزاً لكل دقيقة من الصوت، لذا فإن تسجيل ساعة واحدة يكلف حوالي 3000 رمزاً. معظم المستخدمين لا ينفقون أي شيء أبداً - المجموع اليومي المجاني من 30 رمز يشمل مقاطع قصيرة، ومذكرات صوتية، وبرامج إذاعية غير متكررة. وفوق ذلك، يدفع المستنسخ حسب استخدامه، مع رموز تغذية من $1.
نعم — كل من مستوى القطاع (كل ~ 10-30 ثانية) ومستوى الكلمة الختم الزمني متاح. مستوى الكلمة هو الافتراضي لتصدير VTT / SRT النصوص الفرعية بحيث أن النصوص الفرعية تزامن سطر بسطر. على API وضع timestamps="كلمة" في جسد الطلب. وترد النصوص المستنسخة من الماراثية باللغة الديفاناغاري (UTF-8).
نعم. صوت POST (بيانات متعددة الأجزاء/شكل، اسم الحقل "الملف") إلى /v1/transcribe/ مع language=mr — أو حذف بارامترات اللغة للسماح ل Whisper بالاكتشاف التلقائي. يعيد JSON مع النص، الأجزاء، الختم الزمني، وعلامات المتحدث. المرجع الكامل وقطع من SDK في /api/.
نعم - بمجرد الانتهاء من الترجمة، انقر على ترجمة أو لصق النص في /translate/. الماراثية يتوافق مع كل لغة أخرى ندعمها (200+). بالنسبة لمحاضر الاجتماعات، أرسل النص إلى /summarize/؛ بالنسبة للترجمة، أرسله إلى /voice/tts/ لعرض الصوت باللغة المستهدفة.
لا تزال قوة الضوضاء في Whisper تنطبق على الماراثية، ولكن في هذا المستوى من الدقة، أي ضوضاء إضافية تزيد من معدل خط الأخطاء الأساسي.إذا عادت نسخة غير قابلة للاستخدام، يرجى إرسال بريد إلكتروني إلى contact@free.ai مع الملف - سنعيد الرموز وننظر فيما إذا كان محرك مختلف يتعامل مع الصوت بشكل أفضل.