ElevenLabs STT

Free.ai · stt · ~500 ٹوکنس پر minute

آ ڈیو يا ويڈیو فائل ڈاليں يا URL کو نيچے چپکا دیں

~500 ٹوکنس پر minute
ہمارے GPUs پر مفت چلتا ہے. اس کے لیے بہتری ElevenLabs STT →

ElevenLabs STT a زبان سے متن ماڈل ہے. باہری ماڈلز کے ذریعے روٹ کیا گیا - ~500 ٹوکنs منٹ (50% مارک اپ اپسٹریم لاگت پر)

API کے ذریعے استعمال کریں

اوپن اے آئی-مطابق REST API. ایک کلید پیدا کریں اور اس ماڈل کو سیکنڈز میں بلايں

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/elevenlabs/speech-to-text","audio_url":"https://..."}'
API دستاویزی API کلید حاصل کریں

بار بار پوچھے گئے سوالات

ElevenLabs STT بولے گئے اوڈيو کو متن میں نقل کرتا ہے MP3، WAV، M4A يا ويڈیو فائل اپ لوڈ کريں اور ElevenLabs STT پورے نقل کو واپس لاتا هے اور اختياري SRT/VTT سب ٹیٹل کو وقت کے نشان کے ساتھ

ElevenLabs STT handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

لفظ غلطيوں کا ريٹ صاف انگريزي او ديو پر 5-10% هے ، شوردار يا افراط آ ديو پر 10-20% هے ۔ يک ئي اڑان کے بڑے تقسيمات سخت حالات پر قابلِ ذکر طور پر بہتر کام کريں هيں ۔

ہاں - ہر سگمنٹ میں شروع/آخر وقت کے نشان شامل ہیں. SRT یا VTT کے طور پر برآمد کریں اور وقت کی میپ براہ راست آپ کی ویڈیو پر.

ElevenLabs STT ایک پرائم نقلی انجن ہے. ہر منٹ میں آڈیو کے 500-1500 ٹوکن کے بارے میں، آپ پیدا کرنے سے پہلے زندہ دکھایا. خود مہمان نقلی آپ کے 30,000-ٹوکن روزانہ پول پر مفت چلتا ہے; پرائم ماڈل ہیں ادا-کیسا کہ آپ-گو، $1 سے ٹوپ-اپس کے ساتھ.

MP3, WAV, M4A, FLAC, OGG, اور ویڈیو (MP4, MOV, WebM) - ہم آڈیو کو نکالیں. ہر اپ لوڈ کے لیے زیادہ سے زیادہ 500 MB. لمبی فائلیں؟ /audio/cut/ کے ساتھ تقسیم کریں یا /v1/stt/batch/ استعمال کریں.

اسپیکر ڈائريزيشن ایک الگ پاس ہے - /transcribe/ پر "diarize" کو ٹگل کریں. ElevenLabs STT نقل کو ہینڈل کرتا ہے؛ ڈائريزيشن ہر سگمنٹ کو اسپیکر 1 / اسپیکر 2 / اور اور کے ساتھ لیبل کرتا ہے

ہاں - /batch/ آڈیو فائلیں کا فولڈر قبول کرتا ہے ہر نقل /account/؟tab=history میں اصلی فائلیں کے نام کے ساتھ لگتا ہے فولڈر درخت محفوظ رکھنے کے لیے API استعمال کریں

ہاں - آپ کی آڈیو کو /v1/stt/transcribe/ میں POST کریں موڈل ""ElevenLabs STT"" کے ساتھ. JSON متن + سگمنٹ + ورڈ سطح timestamps کے ساتھ واپس کرتا ہے. /api/ میں پورا حوالہ ہے.

خود مہمان ماڈل ہمارے GPUs پر آڈیو رکھتے ہیں؛ پرائم DPA کے ساتھ گزرتے ہیں۔ آڈیو شیئر-وینڈو کے بعد حذف کی جاتی ہے (24h anon، 7d sign-in). ہم آپ کی انٹیجوں پر تربیت نہیں کرتے.

ہاں - Free.ai نقل کے تجارتی استعمال کو اجازت دیتا ہے آپ کو آپ نے اپ لوڈ کی ہوئی آڈیو کے حقوق کی ضرورت ہے (اپنا خود ریکارڈ، لائسنس شدہ مواد، یا رضامندی کے ساتھ مواد)

ریئل ٹائم فیکٹر تقریبا 0.05-0.2× ہے - ایک 60 منٹ پوڈکاسٹ 3-12 منٹ میں نقل کرتا ہے. پرائم ماڈل اکثر تیزی سے ختم ہوتا ہے. ٹیب بند کرنے کے لیے قطار بٹن استعمال کریں.

Free.ai سے محبت؟ اپنے دوستوں کو بتاؤ۔

اس صفحے کو درجہ دیں