Distil-Whisper large-v3

Free.ai (self-hosted) · stt · ~500 សញ្ញា​សម្គាល់​ក្នុង​មួយ minute

ទម្លាក់​ឯកសារ​អូឌីយ៉ូ ឬ​វីដេអូ ឬ​បិទភ្ជាប់ URL ខាងក្រោម

~500 សញ្ញា​សម្គាល់​ក្នុង​មួយ minute

Distil-Whisper large-v3 គឺ a ម៉ូដែល​និយាយ​ទៅ​អត្ថបទ សាងសង់ដោយ HuggingFace ។ ខ្លាំងក្លាបំផុតនៅ Real-time transcription, large-volume batch STT.. ខ្លួនឯងបានរៀបចំនៅលើ Free.ai GPUs - រត់ដោយឥតគិតថ្លៃប្រឆាំងនឹងទឹកកាក់ប្រចាំថ្ងៃរបស់អ្នក (500 រូបិយប័ណ្ណ នាទី) ។ ចេញផ្សាយក្រោម MIT - ការប្រើពាណិជ្ជកម្មត្រូវបានអនុញ្ញាតនៅលើ Free.ai ។

ប្រើ​តាម API

OpenAI- ឆបគ្នា REST API ។ បង្កើត​កូនសោ និង​ហៅ​ម៉ូដែល​នេះ​ក្នុង​វិនាទី ។

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"distil-whisper-large-v3","audio_url":"https://..."}'
ឯកសារ API យក​សោ API

សំណួរ​ដែល​សួរ​ញឹកញាប់

Distil-Whisper large-v3 បកប្រែសំឡេងនិយាយទៅជាអត្ថបទ. ផ្ទុកឡើង MP3, WAV, M4A, ឬឯកសារវីដេអូនិង Distil-Whisper large-v3 ត្រឡប់មកវិញការបកប្រែពេញលេញបន្ថែមទៀត SRT / VTT ចំណងជើងជាជម្រើសជាមួយ timestamp.

Distil-Whisper large-v3 handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

អត្រា​កំហុស​ពាក្យ​គឺ ៥- ១០% លើ​អូឌីយ៉ូ​អង់គ្លេស​ស្អាត 10- 20% លើ​អូឌីយ៉ូ​មាន​សំឡេង​រំខាន ឬ​ accented ។ កំណែ​ធំ​នៃ​ស្ថាបត្យកម្ម​ដូចគ្នា​ធ្វើ​ឱ្យ​មាន​ន័យ​ល្អ​ប្រសើរ​លើ​ករណី​ធ្ងន់ធ្ងរ - ជ្រើស​ធំ​ជាង​ពេល​អូឌីយ៉ូ​គឺ​ក្រាស់ ។

បាទ - គ្រប់​ផ្នែក​រួម​បញ្ចូល​ចាប់​ផ្ដើម/ បញ្ចប់​ពេលវេលា​សម្គាល់ ។ នាំចេញ​ជា SRT ឬ VTT និង​ផែនទី​ពេលវេលា​ដោយ​ផ្ទាល់​ទៅ​លើ​វីដេអូ​របស់​អ្នក ។

Distil-Whisper large-v3 ដំណើរការនៅលើ GPUs ផ្ទាល់ខ្លួនរបស់យើងប្រឆាំងនឹងទឹកកកឥតគិតថ្លៃប្រចាំថ្ងៃរបស់អ្នកដំបូង; $5 → 200,000 រូបិយប័ណ្ណដែលបានបង់ប្រាក់បន្ទាប់ពីនោះ. អំពី ~500 រូបិយប័ណ្ណក្នុងមួយនាទី.

MP3, WAV, M4A, FLAC, OGG, បន្ថែមពីលើវីដេអូ (MP4, MOV, WebM) - យើងដកស្រង់អូឌីយ៉ូ។ អតិបរមា 500 មេកាបៃក្នុងមួយការផ្ទុកឡើង។ ឯកសារយូរជាងនេះ? ចែកជា /audio/cut/ ឬប្រើ /v1/stt/batch/ ។

កម្មវិធី​សរសេរ​សំបុត្រ​របស់​អ្នក​និយាយ​គឺ​ជា​ការ​ឆ្លងកាត់​ដាច់​ដោយ​ឡែក — បិទបើក "diarize" នៅ​លើ / transcribe / ។ Distil-Whisper large-v3 គ្រប់គ្រង​ការ​សរសេរ​សំបុត្រ​ឡើងវិញ​; កម្មវិធី​សរសេរ​សំបុត្រ​ដាក់​ស្លាក​ផ្នែក​នីមួយៗ​ជាមួយ​អ្នក​និយាយ 1 / អ្នក​និយាយ2/ ល ។

បាទ/ ចាស - / batch / ទទួល​យក​ថត​ឯកសារ​អូឌីយ៉ូ ។ អត្ថបទ​សរសេរ​នីមួយៗ​ត្រូវ​បាន​ដាក់​ក្នុង / account /? tab=history ជាមួយ​ឈ្មោះ​ឯកសារ​ដើម ។ សម្រាប់​ការ​រក្សា​ទុក​ថត​មែកធាង​ប្រើ API ។

បាទ - POST អូឌីយ៉ូរបស់អ្នកទៅ /v1/stt/transcribe/ ជាមួយ model="Distil-Whisper large-v3" ។ ត្រឡប់ JSON ជាមួយអត្ថបទ + ផ្នែក + សញ្ញាពេលវេលាកម្រិតពាក្យ ។ /api/ មានសេចក្ដីយោងពេញលេញ ។

ម៉ូដែលដែលរៀបចំដោយខ្លួនឯងរក្សាអូឌីយ៉ូនៅលើ GPUs របស់យើង; ប្រាក់រង្វាន់ឆ្លងកាត់តាមរយៈជាមួយ DPA ។ អូឌីយ៉ូត្រូវបានលុបបន្ទាប់ពីបង្អួចចែករំលែក (24h anon, 7d ចុះឈ្មោះចូល) ។ យើងមិនបណ្តុះបណ្តាលលើការបញ្ចូលរបស់អ្នកទេ។

បាទ - Free.ai ផ្តល់ការប្រើពាណិជ្ជកម្មនៃ transcripts. អ្នកត្រូវការសិទ្ធិទៅអូឌីយ៉ូដែលអ្នកបានផ្ទុកឡើង (ការថតផ្ទាល់ខ្លួនរបស់អ្នក, អាជ្ញាប័ណ្ណសម្ភារៈឬមាតិកាជាមួយការយល់ព្រម) ។

កត្តាពេលវេលាពិតប្រាកដគឺប្រហែល 0.05-0.2 × - ផតខាស់ 60 នាទីសរសេរក្នុង 3-12 នាទី។ ម៉ូដែល premium តែងតែបញ្ចប់លឿនជាង។ ប្រើប៊ូតុងជួរដើម្បីបិទផ្ទាំង។

ស្រឡាញ់ Free.ai? ប្រាប់មិត្តភក្តិរបស់អ្នក!

វាយតម្លៃ​ទំព័រ​នេះ