алман буш транскрипция
AI ярдәмендә алман аудио һәм видеоны текстка күчерегез. Җибәрү тиз, төгәл һәм бушлай.
Ничек эшли
- Өйгә күчү Free.ai Транскриптор
- алман аудио яки видео файлыгызны куегыз
- Безнең җанлы уен автоматик рәвештә алман билгеләп һәм аны тәрҗемә итә
- Сезнең транскрипцияне текст яки SRT субтитрлары буларак төшерү
алман Транскрипция сыйфатлары
- ✓faster-whisper тарафыннан эшләнә (MIT лицензиясе)
- ✓Автомат алман телен ачыклау
- ✓MP3, WAV, MP4, M4A, FLAC һәм башкаларны яклый
- ✓Вак-вакыт билгесе һәм субтитрлар экспортлау (SRT)
- ✓Плата планнарында файл зурлыгы чикләүләре юк
- ✓Үзәк һәм куркынычсыз -- файллар эшкәртелгәннән соң юкка чыгарыла
Тел турында мәгълүмат
| Тел | алман |
| ISO коды | de |
| Модель | faster-whisper |
| Сыйфат | Бушлай |
Күбрәк телләр
Барлык телләрне күрсәтүКайбер сораулар
Whisper large-v3-turbo алман га иң югары төгәллек дәрәҗәсенә төшә — стандарт бәяләүләрдә сүз хаталары 7%тан ким. Практикада бу чиста студия тавышы тулысынча туры килә, һәм сөйләшү тавышы минималь чистарту белән кулланыла. (Tier A, under 7% word error rate on benchmark sets - we publish honest WER tiers rather than marketing claims.)
Әйе - алман транскрипциясе сезнең көн саен бушлай криптовалюта фондыннан башта файдалана. Аудио минутына якынча 50 криптовалюта сорый, шуңа күрә аноним көн саен туплау көн саен берничә сәгать аудионы каплый. Күзәтүче исәп-хисаплар көн саен 30 000 криптовалютадан зуррак туплау ала. Моннан соң, транскрипция кулланган саен түләнә, криптовалюта өстәмәләре $1дән башлана.
алман транскрипцияләре UTF-8 стандарты белән кайтарыла, телнең нормаль орфографиясе белән.
MP3, WAV, M4A, FLAC, OGG, OPUS, һәм WEBM форматлары турыдан-туры кабул ителә. Видео өчен (MP4, MOV, MKV) без аудио юлны сервер тарафыннан Whisper-ка җибәрер алдыннан чыгарабыз - сезгә үзегез бернәрсәне дә үзгәртергә кирәкми. Башлангыч телдән тыш, алман-ны да кертеп, бер үк канал кулланыла.
Аноним куюлар файл өчен 500 МБ га кадәр чикләнгән. Кергән аккаунтлар 2 ГБ га кадәр җитә. Озынлыгы чикләнмәгән - озын файллар автоматик рәвештә киселә (30 секундлы ишекләр бер-берсенә күчеп тора) һәм бер вакыт билгесе белән бер текстка беркетелгән. Күп сәгатьле алман яздырулар (подкастлар, тулы дәресләр, очрашулар) яхшы эшли.
Әйе - сөйләүчене диаризацияләү һәр алман транскрипциясе өчен default рәвештә куелган. Чыгу 1 / 2 / 3 сөйләүчегә бүленә, шулай итеп интервьюлар, дискуссияләр һәм күп кешеле очрашулар да вакыт билгесе белән кайта. Диаризацияләү аерым модельдә эшли һәм без яклаган барлык телләрдә дә бертигез эшли.
Юк, URLны /transcribe/youtube/ адресына YouTube өчен яки /transcribe/podcast/ адресына подкастлар өчен (Apple, Spotify, RSS) куябыз. Без аудионы төшерәбез, Whisper аша language=de белән эшлибез, һәм вакыт билгесе һәм сөйләүче билгесе белән транскриптны кайтарабыз. Типик алман эчтәлеге: алман форматында подкастлар, лекцияләр, интервьюлар һәм YouTube-да озын форматлы эчтәлек без күрүче иң киң таралган эш йөкләмәләре.
Whisper costs about 50 tokens per minute of audio, so a one-hour recording is ~3,000 tokens. Most users never spend anything - the free daily pool of 30,000 tokens covers short clips, voice notes, and one-off podcasts. Beyond it, transcription is pay-as-you-go, with token top-ups from $1.
Әйе - сегмент дәрәҗәсе (~10-30 секунд саен) һәм сүз дәрәҗәсе вакыт билгесе бар. VTT/SRT субтитр экспорты өчен сүз дәрәҗәсе гадәти, шуңа күрә субтитрлар юлдан-юлга синхронлаштырыла. API-да сорау өлешендә timestamps="word" куйган. алман транскрипцияләре UTF-8 стандарты белән кайтарыла, телнең нормаль орфографиясе белән.
Әйе. Аудио (мультиплекс/форм-дәүләт, "файл" дигән урын) /v1/transcribe/ка language=de белән POST итегез - яки Whisper автоматик рәвештә ачыклау өчен тел параметрын калдырыгыз. Транскрипт, сегментлар, вакыт билгесе һәм сөйләүченең билгесе белән JSON кайтара. /api/ сайтында тулы мәгълүмат һәм SDK фрагментлары.
Әйе - транскрипция тәмамлангач, тәрҗемә итү төймәсенә басыгыз яки текстны /translate/ка куегыз. алман безнең ярдәм иткән барлык телләр белән дә (200+) кушылып эшли. Киңәшмә протоколлары өчен транскрипцияне /summarize/ аша җибәрегез; дубляж өчен аны /voice/tts/ка җибәрегез, бу максатлы телдә аудионы күрсәтү өчен.
Whisper 680K сәгать реаль дөнья тавышы белән өйрәтелгән, шуңа күрә алман транскрипциясе фон тавышы, музыка ятаклары һәм телефон сыйфатындагы язуларга чыдам. Күп тапкыр кисеп алу яки күп тапкыр бер-берсенә туры килгән тавыш кайтаргычлар төгәллекне боза.Әгәр дә берәр текст кулланылмыйча кире кайтса, contact@free.ai электрон почтасына файл белән җибәрегез — без сезнең аудионы башка мотор яхшырак кабул итәме-юкмы дип карыйбыз.