ਵੀਅਤਨਾਮੀ ਮੁਫਤ ਟਰਾਂਸਲੇਸ਼ਨ
ਵੀਅਤਨਾਮੀ ਆਡੀਓ ਅਤੇ ਵੀਡਿਓ ਨੂੰ AI ਨਾਲ ਟੈਕਸਟ ਵਿੱਚ ਬਦਲੋ। ਤੇਜ਼, ਸਹੀ ਅਤੇ ਮੁਫਤ ਹੈ।
ਇਹ ਕਿਵੇਂ ਕੰਮ ਕਰਦਾ ਹੈ
- ਇਸ ਉੱਤੇ ਜਾਓ Free.ai ਟਰਾਂਸਕਰੀਪਰ
- ਆਪਣੀ ਵੀਅਤਨਾਮੀ ਆਡੀਓ ਜਾਂ ਵੀਡਿਓ ਫਾਇਲ ਅੱਪਲੋਡ ਕਰੋ
- ਸਾਡੀ AI ਨੇ ਵੀਅਤਨਾਮੀ ਆਟੋਮੈਟਿਕ ਹੀ ਖੋਜਿਆ ਅਤੇ ਇਸ ਨੂੰ ਤਬਦੀਲ ਕੀਤਾ
- ਆਪਣੀ ਟਰਾਂਸਕਰੀਪਟ ਪਾਠ ਜਾਂ SRT ਸਬ-ਟਾਈਟਲ ਵਾਂਗ ਡਾਊਨਲੋਡ ਕਰੋ
ਵੀਅਤਨਾਮੀ ਟਰਾਂਸਲੇਸ਼ਨ ਫੀਚਰ
- ✓faster-whisper ਵਲੋਂ ਪਾਵਰ ਕੀਤਾ (MIT ਲਾਈਸੈਂਸ)
- ✓ਵੀਅਤਨਾਮੀ ਭਾਸ਼ਾ ਆਟੋਮੈਟਿਕ ਖੋਜ
- ✓MP3, WAV, MP4, M4A, FLAC ਅਤੇ ਹੋਰ ਸਹਿਯੋਗੀ
- ✓ਟਾਈਮ- ਸਟੈਂਪ ਅਤੇ ਸਬ- ਟਾਈਟਲ ਐਕਸਪੋਰਟ (SRT)
- ✓ਭੁਗਤਾਨ ਕੀਤੇ ਪਲਾਨ ਉੱਤੇ ਕੋਈ ਫਾਇਲ ਸਾਈਜ਼ ਲਿਮਟ ਨਹੀਂ ਹੈ
- ✓ਨਿੱਜੀ ਅਤੇ ਸੁਰੱਖਿਅਤ -- ਫਾਇਲਾਂ ਕਾਰਵਾਈ ਤੋਂ ਬਾਅਦ ਹਟਾਈਆਂ ਜਾਂਦੀਆਂ ਹਨ
ਭਾਸ਼ਾ ਵੇਰਵਾ
| ਭਾਸ਼ਾ | ਵੀਅਤਨਾਮੀ |
| ISO ਕੋਡ | vi |
| AI ਮਾਡਲ | faster-whisper ਖੋਲ੍ਹੋ |
| ਕੀਮਤ | ਮੁਫ਼ਤ |
ਹੋਰ ਭਾਸ਼ਾਵਾਂ
ਸਭ ਭਾਸ਼ਾਵਾਂ ਵੇਖੋਅਕਸਰ ਪੁੱਛੇ ਜਾਂਦੇ ਸਵਾਲ
Whisper large-v3-turbo ਵੀਅਤਨਾਮੀ ਨੂੰ ਚੰਗੀ ਤਰ੍ਹਾਂ ਹੈਂਡਲ ਕਰਦਾ ਹੈ - ਬੈਂਚਮਾਰਕ ਆਡੀਓ ਉੱਤੇ 7-15% ਸ਼ਬਦ ਗਲਤੀ ਦਰ ਹੈ। ਨਾਂਵਿਤ ਇਕਾਈਆਂ, ਅੰਕ ਅਤੇ ਗੂੜ੍ਹੇ ਤਕਨੀਕੀ ਸ਼ਬਦ-ਜੋੜਾਂ ਉੱਤੇ ਕਦੇ-ਕਦੇ ਤਬਦੀਲੀਆਂ ਦੀ ਉਮੀਦ ਕਰੋ; ਟਰਾਂਸਕਰੀਪਟ ਦਾ ਵੱਡਾ ਹਿੱਸਾ ਠੀਕ ਹੋਵੇਗਾ।(Tier B, 7-15% word error rate on benchmark sets — ਅਸੀਂ ਮਾਰਕੀਟਿੰਗ ਦਾਅਵਿਆਂ ਦੀ ਬਜਾਏ ਈਮਾਨਦਾਰ WER tiers ਪ੍ਰਕਾਸ਼ਤ ਕਰਦੇ ਹਾਂ।)
ਹਾਂ — ਵੀਅਤਨਾਮੀ ਟਰਾਂਸਲੇਸ਼ਨ ਪਹਿਲਾਂ ਤੁਹਾਡੇ ਰੋਜ਼ਾਨਾ ਮੁਫ਼ਤ ਟੋਕਨ ਪੂਲ ਤੋਂ ਲਿਆ ਜਾਂਦਾ ਹੈ। ਆਡੀਓ ਲਈ ਪ੍ਰਤੀ ਮਿੰਟ 50 ਟੋਕਨ ਦੀ ਕੀਮਤ ਹੁੰਦੀ ਹੈ, ਇਸ ਲਈ ਅਣਜਾਣ ਰੋਜ਼ਾਨਾ ਪੂਲ ਦਿਨ ਵਿੱਚ ਕੁਝ ਘੰਟੇ ਆਡੀਓ ਲਈ ਵਰਤਿਆ ਜਾ ਸਕਦਾ ਹੈ। ਲਾਗਇਨ ਅਕਾਊਂਟ ਲਈ ਵੱਡਾ 30,000 ਟੋਕਨ ਰੋਜ਼ਾਨਾ ਪੂਲ ਮਿਲਦਾ ਹੈ। ਇਸ ਤੋਂ ਬਾਅਦ ਟਰਾਂਸਲੇਸ਼ਨ $1 ਤੋਂ ਟੋਕਨ ਟਾਪ-ਅੱਪ ਨਾਲ ਭੁਗਤਾਨ ਕੀਤਾ ਜਾਂਦਾ ਹੈ।
ਵੀਅਤਨਾਮੀ ਟਰਾਂਸਕਰੀਪਸ਼ਨ ਨੂੰ ਸਟੈਂਡਰਡ UTF-8 ਵਿੱਚ ਭਾਸ਼ਾ ਦੇ ਸਧਾਰਨ ਸ਼ਬਦ- ਜੋੜ ਨਾਲ ਵਾਪਸ ਦਿੱਤਾ ਜਾਂਦਾ ਹੈ।
MP3, WAV, M4A, FLAC, OGG, OPUS, ਅਤੇ WEBM ਸਿੱਧੇ ਹੀ ਸਵੀਕਾਰ ਕੀਤੇ ਜਾਂਦੇ ਹਨ। ਵਿਡੀਓ (MP4, MOV, MKV) ਲਈ ਅਸੀਂ ਸਰਵਰ-ਸਾਇਡ ਆਡੀਓ ਟਰੈਕ ਨੂੰ ਵਿਸਪਰ ਨੂੰ ਭੇਜਣ ਤੋਂ ਪਹਿਲਾਂ ਐਕਸਟਰੈਕਟ ਕਰਦੇ ਹਾਂ - ਤੁਹਾਨੂੰ ਆਪਣੇ ਆਪ ਕੁਝ ਵੀ ਬਦਲਣ ਦੀ ਲੋੜ ਨਹੀਂ ਹੈ। ਸਰੋਤ ਭਾਸ਼ਾ ਤੋਂ ਬਿਨਾਂ ਇੱਕੋ ਪਾਈਪਲਾਈਨ, ਵੀਅਤਨਾਮੀ ਸਮੇਤ।
ਬੇਨਾਮ ਅੱਪਲੋਡ 500 MB ਪ੍ਰਤੀ ਫਾਇਲ ਤੱਕ ਸੀਮਿਤ ਹੈ। ਲਾਗਇਨ ਅਕਾਊਂਟ2GB ਤੱਕ ਪਹੁੰਚਦੇ ਹਨ। ਲੰਬਾਈ ਕੋਈ ਸਖਤ ਸੀਮਾ ਨਹੀਂ ਹੈ - ਲੰਬੀਆਂ ਫਾਇਲਾਂ ਨੂੰ ਆਟੋਮੈਟਿਕ ਹੀ ਟੁਕੜਿਆਂ ਵਿੱਚ ਵੰਡਿਆ ਜਾਂਦਾ ਹੈ (30-ਸਕਿੰਟ ਦੀਆਂ ਵਿੰਡੋਜ਼ ਨੂੰ ਓਵਰਲੈਪ ਨਾਲ) ਅਤੇ ਲਗਾਤਾਰ ਟਾਈਮ-ਸਟੈਂਪ ਨਾਲ ਇੱਕ ਟਰਾਂਸਕਰੀਪਟ ਵਿੱਚ ਸਟਿੱਕੀ ਕੀਤਾ ਜਾਂਦਾ ਹੈ। ਕਈ ਘੰਟਿਆਂ ਦੀ ਵੀਅਤਨਾਮੀ ਰਿਕਾਰਡਿੰਗ (ਪੋਡਕਾਸਟ, ਪੂਰੇ ਲੇਖ, ਮੀਟਿੰਗਾਂ) ਚੰਗੀ ਤਰ੍ਹਾਂ ਕੰਮ ਕਰਦੀ ਹੈ।
ਹਾਂ — ਹਰ ਵੀਅਤਨਾਮੀ ਟਰਾਂਸਕਰੀਪਟ ਲਈ ਡਿਫਾਲਟ ਤੌਰ ਉੱਤੇ ਸਪੀਕਰ ਡਾਇਰੀਜ਼ੇਸ਼ਨ ਚਾਲੂ ਹੈ । ਆਉਟਪੁੱਟ ਨੂੰ ਟਾਈਮ-ਸਟੈਂਪ ਨਾਲ ਸਪੀਕਰ 1 / ਸਪੀਕਰ2/ ਸਪੀਕਰ3ਵਿੱਚ ਵੰਡਿਆ ਜਾਂਦਾ ਹੈ, ਤਾਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੈਨਲ ਚਰਚਾ ਅਤੇ ਬਹੁ-ਪੱਖੀ ਮੀਟਿੰਗਾਂ ਲੇਬਲ ਨਾਲ ਵਾਪਸ ਆਉਣ । ਡਾਇਰੀਜ਼ੇਸ਼ਨ ਵੱਖਰੇ ਮਾਡਲ ਉੱਤੇ ਚੱਲਦਾ ਹੈ ਅਤੇ ਅਸੀਂ ਸਹਿਯੋਗੀ ਸਭ ਭਾਸ਼ਾਵਾਂ ਵਿੱਚ ਇੱਕੋ ਤਰ੍ਹਾਂ ਕੰਮ ਕਰਦਾ ਹੈ ।
ਹਾਂ — URL ਨੂੰ ਯੂਟਿਊਬ ਲਈ /transcribe/youtube/ ਵਿੱਚ ਜਾਂ ਪੋਡਕਾਸਟ ਫੀਡ (ਐਪਲ, ਸਪੋਟਫਾਈ, RSS) ਲਈ /transcribe/podcast/ ਵਿੱਚ ਪਾਈਪ ਕਰੋ। ਅਸੀਂ ਆਡੀਓ ਡਾਊਨਲੋਡ ਕਰਦੇ ਹਾਂ, ਇਸ ਨੂੰ ਵਿਸਪਰ ਨਾਲ language=vi ਰਾਹੀਂ ਚਲਾਉਦੇ ਹਾਂ, ਅਤੇ ਟਰਾਂਸਕਰੀਪਟ ਨੂੰ ਟਾਈਮਸਟੈਂਪ ਅਤੇ ਸਪੀਕਰ ਲੇਬਲ ਨਾਲ ਵਾਪਸ ਕਰਦੇ ਹਾਂ। ਆਮ ਵੀਅਤਨਾਮੀ ਸਮੱਗਰੀ: WhatsApp ਵੌਇਸ ਨੋਟਿਸ, YouTube vlogs, ਅਤੇ short-form ਵੀਡੀਓ ਸਭ ਤੋਂ ਆਮ ਵੀਅਤਨਾਮੀ ਵਰਕਲੋਡ ਹਨ - URL ਨੂੰ /transcribe/youtube/ ਵਿੱਚ ਚਿਪਕਾਓ ਜਾਂ ਆਡੀਓ ਸਿੱਧਾ ਅੱਪਲੋਡ ਕਰੋ।
Whisper ਦੀ ਕੀਮਤ ਪ੍ਰਤੀ ਮਿੰਟ ਆਡੀਓ ਲਈ 50 ਟੋਕਨਾਂ ਦੀ ਹੈ, ਇਸ ਲਈ ਇੱਕ ਘੰਟੇ ਦੀ ਰਿਕਾਰਡਿੰਗ ਲਈ ~3,000 ਟੋਕਨਾਂ ਦੀ ਲੋੜ ਪਵੇਗੀ। ਬਹੁਤੇ ਯੂਜ਼ਰ ਕੁਝ ਵੀ ਖਰਚ ਨਹੀਂ ਕਰਦੇ - 30,000 ਮੁਫਤ ਟੋਕਨਾਂ ਦਾ ਦਿਨ ਭਰ ਦਾ ਪੁਲ ਛੋਟੇ ਕਲਿੱਪ, ਆਵਾਜ਼ ਨੋਟਿਸ ਅਤੇ ਇੱਕ-ਅੱਖਰ ਪਡਕਾਸਟ ਲਈ ਹੈ। ਇਸ ਤੋਂ ਇਲਾਵਾ, ਟਰਾਂਸਕਰੀਪਸ਼ਨ $1 ਤੋਂ ਟੋਕਨ ਟਾਪ-ਅੱਪ ਨਾਲ ਭੁਗਤਾਨ-ਜਿਵੇਂ-ਤੁਹਾਡੇ-ਗਤੀ ਨਾਲ ਹੈ।
ਹਾਂ — ਦੋਵੇਂ ਸੈਗਮੈਂਟ-ਲੇਵਲ (ਹਰ ~10-30 ਸਕਿੰਟ) ਅਤੇ ਸ਼ਬਦ-ਲੇਵਲ ਟਾਈਮ-ਸਟੈਂਪ ਉਪਲੱਬਧ ਹਨ। ਸ਼ਬਦ-ਲੇਵਲ VTT/SRT ਸਬ-ਟਾਈਟਲ ਐਕਸਪੋਰਟ ਲਈ ਡਿਫਾਲਟ ਹੈ ਤਾਂ ਕਿ ਟਾਈਟਲ ਲਾਈਨ-ਬ-ਲਾਈਨ ਸੈਕਰੋ ਹੋ ਜਾਣ। API ਉੱਤੇ ਬੇਨਤੀ ਦੇ ਭਾਗ ਵਿੱਚ timestamps="word" ਸੈੱਟ ਕਰੋ। ਵੀਅਤਨਾਮੀ ਟਰਾਂਸਕਰੀਪਸ਼ਨ ਨੂੰ ਸਟੈਂਡਰਡ UTF-8 ਵਿੱਚ ਭਾਸ਼ਾ ਦੇ ਸਧਾਰਨ ਸ਼ਬਦ- ਜੋੜ ਨਾਲ ਵਾਪਸ ਦਿੱਤਾ ਜਾਂਦਾ ਹੈ।
ਹਾਂ। /v1/transcribe/ ਲਈ POST ਆਡੀਓ (multipart/form-data, field name "file") language=vi ਨਾਲ — ਜਾਂ Whisper ਨੂੰ ਆਟੋ-ਖੋਜਣ ਲਈ ਭਾਸ਼ਾ ਪੈਰਾਮੀਟਰ ਛੱਡੋ। ਟਰਾਂਸਕਰੀਪਟ, ਸੈਗਮੈਂਟ, ਟਾਈਮ-ਸਟੈਂਪ ਅਤੇ ਸਪੀਕਰ ਲੇਬਲ ਨਾਲ JSON ਵਾਪਸ ਦਿੰਦਾ ਹੈ। ਪੂਰਾ ਹਵਾਲਾ ਅਤੇ SDK ਨਿਸ਼ਾਨ /api/ ਉੱਤੇ ਹੈ।
ਹਾਂ — ਜਦੋਂ ਟਰਾਂਸਲੇਸ਼ਨ ਮੁਕੰਮਲ ਹੋ ਜਾਵੇ ਤਾਂ ਅਨੁਵਾਦ ਕਲਿੱਕ ਕਰੋ ਜਾਂ ਟੈਕਸਟ /translate/ ਵਿੱਚ ਪਾਉ । ਵੀਅਤਨਾਮੀ ਹਰੇਕ ਹੋਰ ਭਾਸ਼ਾ ਨਾਲ ਜੋੜਿਆ ਜਾਂਦਾ ਹੈ ਜੋ ਅਸੀਂ ਸਹਿਯੋਗੀ ਹਾਂ (200+) । ਮੀਟਿੰਗ ਮਿੰਟਾਂ ਲਈ ਟਰਾਂਸਲੇਸ਼ਨ ਨੂੰ /summarize/ ਰਾਹੀਂ ਪਾਈਪ ਕਰੋ; ਡਬਿੰਗ ਲਈ ਇਸ ਨੂੰ /voice/tts/ ਨੂੰ ਭੇਜੋ ਤਾਂ ਕਿ ਟਾਰਗੇਟ ਭਾਸ਼ਾ ਵਿੱਚ ਆਡੀਓ ਰਿਡਰ ਕੀਤਾ ਜਾ ਸਕੇ ।
ਵਿਸਪਰ ਨੂੰ ਅਸਲੀ ਆਡੀਓ ਦੇ ਹਜ਼ਾਰਾਂ ਘੰਟਿਆਂ ਉੱਤੇ ਟਰੇਨ ਕੀਤਾ ਗਿਆ ਹੈ, ਇਸ ਲਈ ਇਹ ਬੈਕਗਰਾਊਂਡ ਨੋਇਸ ਅਤੇ ਵੀਅਤਨਾਮੀ ਉੱਤੇ ਫੋਨ-ਕੁਆਲਿਟੀ ਰਿਕਾਰਡਿੰਗ ਨੂੰ ਸਹਿਣ ਕਰ ਸਕਦਾ ਹੈ। ਸਭ ਤੋਂ ਵਧੀਆ ਨਤੀਜਿਆਂ ਲਈ ਸਾਫ਼ ਆਡੀਓ (ਹੈੱਡਸੈੱਟ ਮਾਈਕ, ਕੋਈ ਸੰਗੀਤ ਬੈੱਡ ਨਹੀਂ) ਦਿਓ - ਇਸ ਪੱਧਰ ਉੱਤੇ ਨੋਇਸ ਬੇਸਲਾਈਨ ਗਲਤੀ ਦਰ ਨੂੰ ਵਧਾਉਂਦੀ ਹੈ।ਜੇਕਰ ਕੋਈ ਟਰਾਂਸਕਰੀਪਟ ਅਣਉਪਯੋਗੀ ਹੋ ਜਾਵੇ ਤਾਂ ਫਾਇਲ ਨਾਲ contact@free.ai ਨੂੰ ਈਮੇਲ ਕਰੋ - ਅਸੀਂ ਟੋਕਨ ਮੁੜ ਭੇਜ ਦੇਵਾਂਗੇ ਅਤੇ ਵੇਖਾਂਗੇ ਕਿ ਕੀ ਕੋਈ ਵੱਖਰਾ ਇੰਜਣ ਤੁਹਾਡੀ ਆਡੀਓ ਨੂੰ ਬਿਹਤਰ ਢੰਗ ਨਾਲ ਸੰਭਾਲ ਸਕਦਾ ਹੈ।