الصينية مجاني

. نقل الصينية صوت وفيديو إلى نص مع الذكاء الاصطناعي. سريع، دقيق، ومجاني

كيف يعمل

  1. اذهب إلى Free.ai مسجل
  2. تحميل ملفك الصينية السمعي أو الفيديو
  3. الذكاء الاصطناعي لدينا يكتشف تلقائيا الصينية ويسجلها
  4. تحميل نسختك النصية كـ نص أو SRT عناوين فرعية

الصينية خصائص النسخ

  • ✓دعم faster-whisper (MIT مرخصة)
  • ✓كشف الصينية لغة آليا
  • ✓دعم MP3، WAV، MP4، M4A، FLAC، وأكثر
  • ✓تصدير الختم الزمني والترجمة النصية (SRT)
  • ✓لا حدود لحجم الملف على الخطط المدفوعة
  • ✓سرية وآمنة - تُحذف الملفات بعد التجهيز

تفاصيل اللغة

اللغةالصينية
رمز المنظمة الدولية للتوحيد القياسيzh
نموذج الذكاء الاصطناعيfaster-whisper
السعرمجاني

لغات أخرى

جميع اللغات

الأسئلة المتكررة

يسقط Whisper large-v3-turbo في أعلى مستوى من الدقة على الصينية - تحت 7% معدل خطأ الكلمات على المعايير القياسية. في الممارسة العملية، يعني ذلك أن الصوت النظيف في الاستوديو يعود قريبا من الكمال، والصوت المحادثة قابلة للاستخدام مع الحد الأدنى من التنظيف.(الطبقة A، under 7% word error rate على مجموعات المعايير المرجعية - ننشر طبقات WER الصادقة بدلاً من ادعاءات التسويق).

نعم — الصينية النسخ يستمد من مجمع الرموز اليومية المجانية أولا. السمعي تكلفة حوالي 50 الرموز في الدقيقة، لذلك المجمع اليومي المجهول يغطى عدة ساعات من الصوت في اليوم. الحسابات المسجلة تحصل على أكبر 30000 الرموز اليومية المجمع. بعد ذلك، النسخ هو دفع حسب الاستخدام، مع رموز تغذية من $1.

تمر language=zh للماندرين (الافتراضي - مخرج مبسط أو تقليدي اعتمادا على المصدر). بالنسبة للكانتوني استخدم language=yue إذا كان صوتك هو حديث هونغ كونغ / غوانغزو؛ الكانتوني المنسخ ك zh سينتج تقديرا لمهج الماندرين الذي يفقد النغمات واللغات الشائعة.

يقبل مباشرة MP3, WAV, M4A, FLAC, OGG, OPUS, WEBM. بالنسبة للفيديو (MP4, MOV, MKV) نقوم باستخراج المسار الصوتي من جانب الخادم قبل إرساله إلى Whisper - لا تحتاج إلى تحويل أي شيء بنفسك. نفس الأنبوب بغض النظر عن لغة المصدر، بما في ذلك الصينية.

Anonymous uploads cap at roughly 500 MB per file. Signed-in accounts go up to 2 GB. Duration is not a hard limit - long files are chunked automatically (30-second windows with overlap) and stitched back into a single transcript with continuous timestamps. Multi-hour الصينية recordings (podcasts, full lectures, meetings) work fine.

نعم - تفعيل تسجيل المتحدثين في السجلات بصورة افتراضية لكل نسخة من الصينية. ويقسم المخرج إلى المتحدث 1 / المتحدث 2 / المتحدث 3 مع علامات زمنية، وبالتالي فإن المقابلات، ومناقشات الأفرقة، والاجتماعات المتعددة الأطراف تعود مع علامات. ويجري تسجيل المتحدثين في السجلات على نموذج منفصل ويعمل بنفس الطريقة عبر جميع اللغات التي ندعمها.

نعم - لصق العنوان في /transcribe/youtube/ لليوتيوب أو /transcribe/podcast/ للبودكاست (Apple، Spotify، RSS). نحن نقوم بتنزيل الصوت، ونقوم بتشغيله عبر Whisper مع language=zh، ونعيد النص مع الختم الزمني وعلامات المتحدث. المحتوى النموذجي الصينية: :: البرامج الصوتية، والمحاضرات، والمقابلات، والمحتوى الطويل على يوتيوب في الصينية هي أكثر عبء عمل شائع نراه.

Whisper costs about 50 tokens per minute of audio, so a one-hour recording is ~3,000 tokens. Most users never spend anything - the free daily pool of 30,000 tokens covers short clips, voice notes, and one-off podcasts. Beyond it, transcription is pay-as-you-go, with token top-ups from $1.

نعم - كل من مستوى القطاع (كل ~ 10-30 ثانية) ومستوى الكلمات الختم الزمني متاح. مستوى الكلمات هو الافتراضي ل VTT / SRT النصوص المترجمة تصدير بحيث النصوص المترجمة تزامن سطر بسطر. على API وضع timestamps="كلمة" في جسد الطلب. الصينية تعود النصوص في حروف هان الأصلية (UTF-8) - مبسطة أو تقليدية حسب الصوت المصدر ورمز ISO.

نعم. صوت POST (بيانات متعددة الأجزاء/شكل، اسم الحقل "الملف") إلى /v1/transcribe / مع language=zh - أو حذف البارامتر اللغة لترك Whisper الكشف الآلي. يعيد JSON مع النص، الأجزاء، الختم الزمني، وعلامات المتحدث. المرجع الكامل و SDK قطع في /api/.

نعم - بمجرد الانتهاء من النسخ، انقر على ترجمة أو لصق النص في /translate/. الصينية زوج مع كل لغة أخرى ندعم (200 +). لمحاضر الاجتماع توصيل النص من خلال /summarize/؛ للدبلجة إرسالها إلى /voice/tts/ لعرض الصوت في اللغة المستهدفة.

تم تدريب Whisper على 680K ساعات من الصوت الضجيج في العالم الحقيقي، لذلك نسخ الصينية قوية لضوضاء الخلفية، أسرة الموسيقى، والتسجيلات ذات النوعية الهاتفية. القطع الحاد أو المكالمات المتعددة المتداخلة سوف تضر الدقة.إذا كان النص يعود غير قابل للاستخدام، بريد إلكتروني contact@free.ai مع الملف - سنرد الرموز والنظر فيما إذا كان محرك مختلف يتعامل مع الصوت الخاص بك أفضل.

أحب Free.ai؟ أخبر أصدقائك!

تقييم هذه الصفحة