الطاجيكية مجاني
. نقل الطاجيكية صوت وفيديو إلى نص مع الذكاء الاصطناعي. سريع، دقيق، ومجاني
كيف يعمل
- اذهب إلى Free.ai مسجل
- تحميل ملفك الطاجيكية السمعي أو الفيديو
- الذكاء الاصطناعي لدينا يكتشف تلقائيا الطاجيكية ويسجلها
- تحميل نسختك النصية كـ نص أو SRT عناوين فرعية
الطاجيكية خصائص النسخ
- ✓دعم faster-whisper (MIT مرخصة)
- ✓كشف الطاجيكية لغة آليا
- ✓دعم MP3، WAV، MP4، M4A، FLAC، وأكثر
- ✓تصدير الختم الزمني والترجمة النصية (SRT)
- ✓لا حدود لحجم الملف على الخطط المدفوعة
- ✓سرية وآمنة - تُحذف الملفات بعد التجهيز
تفاصيل اللغة
| اللغة | الطاجيكية |
| رمز المنظمة الدولية للتوحيد القياسي | tg |
| نموذج الذكاء الاصطناعي | faster-whisper |
| السعر | مجاني |
لغات أخرى
جميع اللغاتالأسئلة المتكررة
الطاجيكية هي لغة أقل موارد ل Whisper - large- v3- turbo تقع فوق 25% معدل خطأ الكلمات، في بعض الأحيان أعلى بكثير. النص مفيد للبحث و gist ولكن لا ينبغي أن تعامل كنشر جاهز. إذا كان محرك أعلى دقة يصبح متاحا ل الطاجيكية نحن نوصله في تلقائيا.(الطبقة D، over 25% word error rate على مجموعات المعايير المرجعية - ننشر طبقات WER الصادقة بدلاً من ادعاءات التسويق).
نعم — الطاجيكية النسخ يستمد من مجمع الرموز اليومية المجانية أولا. السمعي تكلفة حوالي 50 الرموز في الدقيقة، لذلك المجمع اليومي المجهول يغطى عدة ساعات من الصوت في اليوم. الحسابات المسجلة تحصل على أكبر 30000 الرموز اليومية المجمع. بعد ذلك، النسخ هو دفع حسب الاستخدام، مع رموز تغذية من $1.
يتم إرجاع نسخ الطاجيكية في معيار UTF-8 مع الهجاء العادي لللغة.
يقبل مباشرة MP3, WAV, M4A, FLAC, OGG, OPUS, WEBM. بالنسبة للفيديو (MP4, MOV, MKV) نقوم باستخراج المسار الصوتي من جانب الخادم قبل إرساله إلى Whisper - لا تحتاج إلى تحويل أي شيء بنفسك. نفس الأنبوب بغض النظر عن لغة المصدر، بما في ذلك الطاجيكية.
Anonymous uploads cap at roughly 500 MB per file. Signed-in accounts go up to 2 GB. Duration is not a hard limit - long files are chunked automatically (30-second windows with overlap) and stitched back into a single transcript with continuous timestamps. Multi-hour الطاجيكية recordings (podcasts, full lectures, meetings) work fine.
نعم - تفعيل تسجيل المتحدثين في السجلات بصورة افتراضية لكل نسخة من الطاجيكية. ويقسم المخرج إلى المتحدث 1 / المتحدث 2 / المتحدث 3 مع علامات زمنية، وبالتالي فإن المقابلات، ومناقشات الأفرقة، والاجتماعات المتعددة الأطراف تعود مع علامات. ويجري تسجيل المتحدثين في السجلات على نموذج منفصل ويعمل بنفس الطريقة عبر جميع اللغات التي ندعمها.
نعم - لصق العنوان في /transcribe/youtube/ لليوتيوب أو /transcribe/podcast/ للبودكاست (Apple، Spotify، RSS). نحن نقوم بتنزيل الصوت، ونقوم بتشغيله عبر Whisper مع language=tg، ونعيد النص مع الختم الزمني وعلامات المتحدث. المحتوى النموذجي الطاجيكية: المحاضرات، والمقابلات، والملاحظات الصوتية، ومحتويات يوتيوب في الطاجيكية كلها تعمل - لصق عنوان URL في /transcribe/youtube/ أو تحميل الملف مباشرة.
Whisper costs about 50 tokens per minute of audio, so a one-hour recording is ~3,000 tokens. Most users never spend anything - the free daily pool of 30,000 tokens covers short clips, voice notes, and one-off podcasts. Beyond it, transcription is pay-as-you-go, with token top-ups from $1.
نعم - كل من مستوى القطاع (كل ~ 10-30 ثانية) ومستوى الكلمات الختم الزمني متاح. مستوى الكلمات هو الافتراضي ل VTT / SRT النصوص المترجمة تصدير بحيث النصوص المترجمة تزامن سطر بسطر. على API وضع timestamps="كلمة" في جسد الطلب. يتم إرجاع نسخ الطاجيكية في معيار UTF-8 مع الهجاء العادي لللغة.
نعم. صوت POST (بيانات متعددة الأجزاء/شكل، اسم الحقل "الملف") إلى /v1/transcribe / مع language=tg - أو حذف البارامتر اللغة لترك Whisper الكشف الآلي. يعيد JSON مع النص، الأجزاء، الختم الزمني، وعلامات المتحدث. المرجع الكامل و SDK قطع في /api/.
نعم - بمجرد الانتهاء من النسخ، انقر على ترجمة أو لصق النص في /translate/. الطاجيكية زوج مع كل لغة أخرى ندعم (200 +). لمحاضر الاجتماع توصيل النص من خلال /summarize/؛ للدبلجة إرسالها إلى /voice/tts/ لعرض الصوت في اللغة المستهدفة.
يساعد تدريب الضوضاء لـ Whisper أقل في هذا المستوى - الاختناق هو كمية الصوت الطاجيكية الذي رأى Whisper أثناء التدريب، وليس الضوضاء. لا يزال صوت الاستوديو النظيف يفوق الصوت المضطرب، ولكن لا أحد منهما سيصل إلى الدقة التي ستحصل عليها على لغة عالية الموارد.إذا كان النص يعود غير قابل للاستخدام، بريد إلكتروني contact@free.ai مع الملف - سنرد الرموز والنظر فيما إذا كان محرك مختلف يتعامل مع الصوت الخاص بك أفضل.