मोफत व्हिएतनामी प्रत

व्हिएतनामी ऑडिओ व व्हिडीओला AI सह पाठ्य मध्ये रूपांतरित करा. जलद, अचूक व मोफत.

काम करताना

  1. याकडे जा Free.ai प्रतलेखक
  2. तुमचे व्हिएतनामी ऑडिओ किंवा व्हिडीओ फाइल अपलोड करा
  3. आमचे AI व्हिएतनामी आपोआप शोधते व ते लिहिते
  4. पाठ्य किंवा SRT उपशीर्षक म्हणून तुमचे ट्रान्सक्रिप्ट डाउनलोड करा

व्हिएतनामी ट्रांसक्रिप्शन वैशिष्ट्ये

  • faster-whisper द्वारे पुरविले (MIT परवानाकृत)
  • व्हिएतनामी भाषा आपोआप शोधा
  • MP3, WAV, MP4, M4A, FLAC, व इतर समर्थन पुरविते
  • टाइमस्टॅम्प व उपशीर्षक एक्सपोर्ट (SRT)
  • विनामूल्य योजनांवर फाइल आकार मर्यादा नाही
  • खाजगी व सुरक्षित -- फाइल प्रक्रिया केल्यावर नष्ट केले जातात

भाषा तपशील

भाषाव्हिएतनामी
ISO कोडvi
AI मॉडेलfaster-whisper
किंमतमोकळे

अधिक भाषाName

सर्व भाषा दर्शवा

वारंवार विचारले जाणारे प्रश्न

Whisper large-v3-turbo व्हिएतनामी चांगल्या प्रकारे हाताळते - बेंचमार्क ऑडिओवर ७-१५% शब्द त्रुटी दर. नावाप्रमाणे संस्था, संख्या आणि घट्ट तांत्रिक शब्दकोशावर काही वेळा बदल होण्याची अपेक्षा करा; प्रत पूर्णपणे बरोबर असेल. (Tier B, 7-15% word error rate on benchmark sets - we publish honest WER tiers rather than marketing claims.)

होय — व्हिएतनामी लिप्यंतरण प्रथम तुमच्या रोजच्या मोफत टोकन पूल पासून दाबते. ऑडिओची किंमत सुमारे 50 टोकन प्रति मिनिट आहे, म्हणून अननोमासिक दैनिक पूल दररोज काही तास ऑडिओ कव्हर करते. दाखल झालेल्या खात्यांसाठी मोठे 30,000-टोकन दैनिक पूल मिळते. त्यापुढे, लिप्यंतरण वापराप्रमाणे मोजले जाते, $1 पासून टोकन टॉपअपसह.

व्हिएतनामी transcripts हे मानक UTF-8 मध्ये परत येते ज्यात भाषांची सामान्य वर्णमाला आहे.

MP3, WAV, M4A, FLAC, OGG, OPUS, व WEBM थेट स्वीकारले जातात. व्हिडीओ (MP4, MOV, MKV) साठी आम्ही ऑडिओ ट्रॅक सर्वर-साईड एक्सट्रॅक्ट करतो ते व्हिस्परला पाठविण्यापूर्वी — तुम्हाला स्वतः काहीही रूपांतरित करण्याची गरज नाही. स्त्रोत भाषा नव्हे, व्हिएतनामी सह समान पाईपलाईन.

बेनामी अपलोड मर्यादा सुमारे 500 MB प्रति फाइल आहे. दाखल झालेले खाते2GB पर्यंत जाऊ शकते. कालावधी हा कठोर मर्यादा नाही - लांब फाइल स्वचलितपणे खंडीत केले जातात (30 सेकंदाच्या ओव्हरलेपसह चौकट) आणि एकत्रितपणे एकत्रित केले जातात एकत्रित वेळ स्टॅम्पसह. बहु-तास व्हिएतनामी रेकॉर्डिंग (पोडकास्ट, पूर्ण व्याख्याने, बैठकी) चांगले काम करते.

होय - स्पीकर डायराइजेशन प्रत्येक व्हिएतनामी ट्रान्सक्रिप्टसाठी मुलभूतरित्या चालू आहे. आऊटपुट स्पीकर 1 / स्पीकर2/ स्पीकर3याप्रमाणे वेळचिन्हांसह विभागले जाते, म्हणून मुलाखती, पॅनेल चर्चा आणि बहु-पक्ष बैठकी परत लेबल केले जातात. डायराइजेशन वेगळ्या मॉडेलवर चालते आणि आम्ही समर्थन देणाऱ्या सर्व भाषांमधून समान कार्य करते.

होय — यूट्यूबसाठी URL /transcribe/youtube/ मध्ये किंवा पॉडकास्ट फीड्ससाठी /transcribe/podcast/ मध्ये चिकटवा (ॲपल, स्पॉटीफाई, RSS). आम्ही ऑडिओ डाउनलोड करतो, language=vi द्वारे Whisper द्वारे चालवतो, आणि टाइमस्टॅम्प आणि स्पीकर लेबलसह ट्रान्सक्रिप्ट परत करतो. सामान्य व्हिएतनामी सामग्री: WhatsApp आवाज नोट्स, YouTube vlogs, आणि छोट्या स्वरूपाचे व्हिडिओ हे सर्वात सामान्य व्हिएतनामी कार्यभार आहेत - URL /transcribe/youtube/ मध्ये चिकटवा किंवा थेट ऑडिओ अपलोड करा.

Whisper चा दर मिनिटास 50 टोकनचा खर्च येतो, त्यामुळे एका तासाच्या रेकॉर्डिंगसाठी ~3,000 टोकन लागतो. बहुतेक वापरकर्ते कधीही काही खर्च करत नाहीत - 30,000 Tokens चा मोफत दररोजचा साठा लहान क्लिप, आवाज नोट्स आणि एकदा पॉडकास्टसाठी वापरला जातो. त्यापेक्षा जास्त, लिप्यंतरण 1 डॉलर पासून टोकन टॉपअपसह, तुम्ही वापरल्याप्रमाणे पैसे भरा.

होय — दोन्ही खंड-स्तरीय (प्रत्येक ~10-30 सेकंद) व शब्द-स्तरीय टाइमस्टॅम्प उपलब्ध आहेत. शब्द-स्तरीय VTT/SRT उपशीर्षक एक्सपोर्ट करीता मुलभूत आहे जेणेकरून शीर्षक लाइन-ब-लाइन समक्रमित होते. API वर विनंतीच्या मुख्य भागात timestamps="word" निश्चित करा. व्हिएतनामी transcripts हे मानक UTF-8 मध्ये परत येते ज्यात भाषांची सामान्य वर्णमाला आहे.

होय. POST ऑडिओ (multipart/form-data, क्षेत्र नाव "file") to /v1/transcribe/ with language=vi — किंवा Whisper ला स्वचलितपणे शोधू देण्यासाठी भाषा परिमाण सोडून द्या. JSON मध्ये transcript, segments, timestamps, आणि speaker labels सोबत परत येते. पूर्ण संदर्भ आणि SDK स्निपेट /api/ येथे आहे.

होय — एकदा अनुवाद पूर्ण झाल्यानंतर, अनुवादित करा वर क्लिक करा किंवा /translate/ मध्ये पाठ्य चिकटवा. व्हिएतनामी आम्ही समर्थन देणाऱ्या सर्व इतर भाषांशी जोडले जाते (200+). बैठकीच्या मिनिटांसाठी /summarize/ द्वारे /voice/tts/ ला पाठवा.

व्हिस्परला वास्तविक ऑडिओच्या हजारो तासांच्या प्रशिक्षणावर प्रशिक्षण दिले जाते, म्हणून ते पार्श्वभूमी आवाज आणि व्हिएतनामी वरील फोन-गुणवत्तेचे रेकॉर्डिंग सहन करते. सर्वोत्तम परिणामांसाठी, स्वच्छ ऑडिओ पुरवा (हेडसेट मायक, संगीत बेड नाही) - या स्तरावर आवाजाने आधारभूत त्रुटी दर वाढविले जाते.जर एक प्रत वापरण्यायोग्य नसेल तर, contact@free.ai या ईमेलवर फाइल पाठवा - आम्ही टोकन परत देऊ आणि तुमच्या ऑडिओला वेगळ्या इंजिनने चांगले हाताळले आहे का हे बघू.

Free.ai ला आवडते?

या पानाला गुण द्या