Free италиявӣ Транскриптсия

Тағйири италиявӣ аудио ва видео ба матн бо AI. Суръат, дақиқ ва ройгон.

Чӣ тавр кор мекунад

  1. Гузаштан ба Free.ai Транскриптор
  2. Боркунии файли аудиоӣ ё видеоии италиявӣ
  3. AI-и мо худкорона италиявӣ-ро муайян мекунад ва онро нусхабардорӣ мекунад
  4. Боргирии нусхаи шумо ҳамчун матн ё зерсарлавҳаҳои SRT

италиявӣ Хусусиятҳои тарҷума

  • ✓Бо faster-whisper (бо иҷозатномаи MIT)
  • ✓Муайянкунии худкори забони италиявӣ
  • ✓MP3, WAV, MP4, M4A, FLAC ва ғайраро дастгирӣ мекунад
  • ✓Содироти вақт ва зернависи (SRT)
  • ✓Бе маҳдудияти андозаи файл дар нақшаҳои пардохтшуда
  • ✓Шахсӣ ва бехатар -- файлҳо баъди коркарди онҳо нобуд карда мешаванд

Тафсилоти забон

Забонҳоиталиявӣ
Коди ISOit
Намунаи AIfaster-whisper
& НархОзод

Забонҳои иловагӣ

Намоиши ҳамаи забонҳо

Саволҳои зиёд

Whisper large-v3-turbo дар дараҷаи дақиқии баландтарин дар италиявӣ - дар сатҳи 7% хатои калима дар стандартҳои стандартӣ қарор мегирад. Дар амал ин маънои тоза кардани студияи аудиоӣ ба наздикӣ комил бармегардад ва аудиои муошират бо тозакунии минималӣ истифодашаванда аст. (Tier A, under 7% word error rate on benchmark sets - we publish honest WER tiers rather than marketing claims.)

Ҳа - нусхаи италиявӣ аз захираи ҳаррӯзаи ройгони шумо дар аввал гирифта мешавад. Садо тақрибан 50 токен дар як дақиқа арзиш дорад, бинобар ин захираи ҳаррӯзаи беном чанд соат аудиоро дар як рӯз фаро мегирад. Ҳисобҳои воридшуда захираи ҳаррӯзаи 30,000 токенро мегиранд. Баъд аз ин, нусхаи ройгон аст, бо иловаи токен аз $1.

италиявӣ транскриптҳо дар стандарти UTF-8 бо орфографияи оддии забон бармегарданд.

MP3, WAV, M4A, FLAC, OGG, OPUS ва WEBM бевосита қабул карда мешаванд. Барои видео (MP4, MOV, MKV) мо роҳчаи аудиоро аз тарафи сервер пеш аз фиристодани он ба Whisper бароварда мекунем - шумо лозим нест, ки худи шумо ягон чизро табдил диҳед. Яке аз каналҳо новобаста аз забони сарчашма, аз ҷумла италиявӣ.

Андозаи файли беному нишон дар 500 МБ барои ҳар як файл маҳдуд аст. Ҳисобҳои воридшуда то 2 ГБ мераванд. Маҳдудияти дарозии файлҳо вуҷуд надорад - файлҳои дароз ба таври худкор ба қисмҳо ҷудо карда мешаванд (30 сония тирезаҳо бо ҳамроҳшавӣ) ва ба як нусхаи ягона бо нишонаҳои вақти пайваста пайваст карда мешаванд. Сабтҳои бисёрсоатаи италиявӣ (подкастҳо, дарсҳои пурра, вохӯриҳо) хуб кор мекунанд.

Да, диаризация оратора по умолчанию включена для каждого италиявӣ транскрипта. Вывод делится на сегменты как оратора 1 / оратора 2 / оратора 3 с временными метками, так что интервью, дискуссии и многосторонние встречи возвращаются с метками. Диаризация работает на отдельном моделе и работает одинаково на всех языках, которые мы поддерживаем.

Да — URL-ро ба /transcribe/youtube/ барои YouTube ё /transcribe/podcast/ барои подкастҳо (Apple, Spotify, RSS) ҷойгир кунед. Мо аудиоро боргирӣ мекунем, онро тавассути Whisper бо language=it иҷро мекунем ва транскриптро бо нишонаҳои вақт ва нишонаҳои сухангӯ бармегардонем. Мӯҳтавои италиявӣ оддӣ: podcasts, лексияҳо, мусоҳибаҳо ва мундариҷаи YouTube-и дароз дар италиявӣ бори кории маъмултаринест, ки мо мебинем.

Whisper costs about 50 tokens per minute of audio, so a one-hour recording is ~3,000 tokens. Most users never spend anything - the free daily pool of 30,000 tokens covers short clips, voice notes, and one-off podcasts. Beyond it, transcription is pay-as-you-go, with token top-ups from $1.

Бале - ҳардуи сатҳҳои сегментӣ (ҳар ~10-30 сония) ва сатҳҳои калимаҳои вақт дастрасанд. Сатҳи калима пешфарзи содироти зерсарлавҳаҳои VTT/SRT мебошад, ки дар он ҷо сарлавҳаҳо сатҳ ба сатҳ синхронизатсия мешаванд. Дар API дар бадани дархости timestamps="word" -ро насб кунед. италиявӣ транскриптҳо дар стандарти UTF-8 бо орфографияи оддии забон бармегарданд.

Ҳа. POST аудио (multipart/form-data, field name "file") ба /v1/transcribe/ бо language=it - ё параметри забонро барои худмуайянкунии Whisper тарк кунед. JSON-ро бо транскрипт, сегментҳо, штампҳои вақт ва нишонаҳои сухангӯ бармегардонад. Истиснои пурра ва SDK-и фрагментҳо дар /api/.

Дар ин ҷо шумо метавонед матнро ба /translate/ ҷойгир кунед. италиявӣ бо ҳамаи забонҳои дигаре, ки мо дастгирӣ мекунем (200+) ҳамроҳ мешавад. Барои протоколи вохӯрӣ матнро тавассути /summarize/ фиристед; барои дубляж онро ба /voice/tts/ фиристед, то садоро дар забони ҳадафӣ бозсозед.

Whisper бо 680K соатҳои садои шуои воқеӣ омӯзонида шудааст, бинобар ин, нусхаи италиявӣ барои садои фонӣ, мусиқӣ ва сабтҳои сифати телефон устувор аст. Тақсимкунии сахт ё баландгӯякҳои зиёди барҳамхӯрда ҳанӯз ҳам ба дақиқӣ зарар мерасонад. If a transcript comes back unusable, email contact@free.ai with the file - we will refund the tokens and look at whether a different engine handles your audio better.

Шумо дӯст медоред Free.ai? Ба дӯстонатон бигӯед!

Баҳогузории ин саҳифа