Speech to Text

الاستخدام التجاري 579 models لا يوجد علامة مائية لا يلزم التسجيل
النموذج:
+ GPT-5, Claude, Gemini
Upload an audio or video file - or paste a URL - and get a clean transcript with timestamps. Speaker diarization, SRT/VTT subtitle export, 100+ languages with auto-detect. Cost scales exactly with clip length. Powered by Whisper large-v3-turbo (self-hosted), plus premium Wizper and ElevenLabs STT.

سحب وإسقاط الصوت/الفيديو، أو النقر للتصفح

MP3، WAV، MP4، WebM، M4A - حتى 500 ميغابايت

- - -
Whisper large-v3 - 99 لغة، أفضل دقة في الفئة.
تقدير الرموز لهذا المقطع
-
يوتيوب، إنستغرام، تيك توك، سبوتي، وأكثر من 1300 منصة
تستند تكلفة نسخ URL إلى المدة الفعلية للمقطع - نذكر بعد التنزيل. توقع ~500 رموز/دقيقة على Whisper.
التسجيل: 0:00

نسخ في الوقت الحقيقي باستخدام ميكروفونك

نسخة من النص

...نسخ صوتك

وقد يستغرق ذلك بعض الوقت بالنسبة للملفات الأطول.

ماذا يكتب الناس بـ Free.ai

مقابلات + برامج إذاعية

تصدير SRT مباشرة إلى محرر الفيديو الخاص بك، أو النص العادي لكتابة مقالة.

النصوص التلقائية + النصوص الفرعية

تحميل تحميل يوتيوب أو تيك توك، واختيار SRT أو WebVTT، وحرق النصوص الجانبية على مع /video/subtitle/.

مذكرات الاجتماع

Upload a Zoom/Teams recording - get transcript + speaker labels. Pair with /write/summarize/ for bullet-point minutes.

المحاضرات + الدروس

تسجيل محاضرة مدتها 90 دقيقة، ثم استخدام /study/flashcards/ أو /write/summarize/ لتحويلها إلى مواد دراسية.

التسجيلات الصوتية باللغات الأجنبية

يقوم برنامج Whisper بالكشف عن 99 لغة تلقائيا، ويقوم بنقل النص باللغة الأصلية، ثم يرسل النص عبر /translate/ إلى اللغات الأخرى.

القانوني + الطبي

الختم الزمني، علامات المتحدث، تصدير JSON مع كل كلمة بداية / نهاية الوقت - المحكمة-مراسل دقيق أو إعداد الملاحظة السريرية.

كيف يشبه نسخة Free.ai

ماذا ستحصل عليه Free.ai Otter.ai Descript Rev.com
الاستخدام اليومي المجاني5K+ tokens/day300 minutes/mo1 hr/month-
المحركWhisper large-v3-turboProprietaryProprietaryHuman + AI
اللغات99English-focused2230+
Speaker diarization
تصدير SRT/VTTPaidPaid
برنامج الوصلة العامةLimitedLimited
البث الحي (مجاناً) Paid--
التوقيع مطلوبلاYesYesYes
تعكس أرقام المنافسة المستويات المجانية المدرجة علنا اعتبارا من عام 2026. تحقق من كل مقدم للخطط الحالية.
الخيارات المتقدمة
النتيجة
تريد نتائج أفضل؟ نماذج عالية الجودة (GPT-5, Claude, Gemini) توفر جودة أعلى. عرض الخطط

❤️ أحب Free.ai؟ أخبر أصدقائك!

تسجيل للحصول على رابط الإحالة وكسب 30 الرموز لكل صديق.

تريد المزيد؟ Sign up free: 30,000 tokens/day
التسجيل مجانا

... معالجة طلبك

Best free speech to text tool. Upload MP3, WAV, MP4 or record live. Auto-detect language. Speaker diarization. No sign up required.

كيف تستخدم Speech to Text

1
أدخل مدخلك

أدخل نص، أو تحميل ملف، أو وصف ما تريد. لا حساب مطلوب.

2
انقر على إنشاء

الذكاء الاصطناعي لدينا يقوم بمعالجة طلبك في ثوانٍ باستخدام أفضل نماذج المصدر المفتوح.

3
تنزيل وتقاسم

تحميل، نسخ، أو مشاركة نتائجك مجانا للاستخدام الشخصي والتجاري.

استخدام هذه الأداة عن طريق API

أتمتة هذه الأداة من شفرة الخاصة بك. OpenAI-متوافقة REST نقطة نهاية، حامل-رمز توثيق، لا إضافية SDK مطلوبة. تكاليف الرموز تتطابق مع واجهة شبكة الويب.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@audio.mp3", "language": "auto"}'

Speech to Text - FAQ

Free.ai يقدم Whisper-powered الكلام إلى النص مع الدقة الممتازة، 99 اللغات، تصدير النصوص، الكشف عن المتحدث، وتسجيل الميكروفون الحي - مجانا تماما.

تحميل ملف صوت أو فيديو (MP3، WAV، MP4، M4A)، انقر على نسخ، والحصول على الكلام الدقيق إلى النص في ثوان. أو تسجيل مباشرة من ميكروفونك.

نعم، ضع أي عنوان يوتيوب في علامة URL وأداة تحويل الكلام إلى نص يستخرج الصوت وتحويلها. يعمل مع Instagram، TikTok، Spotify، و 1300 + منصات.

نعم، الكشف التلقائي أو اختيار من 99 لغة. حديثنا إلى النص يتعامل مع اللهجات، ضوضاء الخلفية، والصوت المختلطة اللغة جيدا.

نعم، يمكنك اختيار ملفات سمعية متعددة في وقت واحد - كل منها يرسل عن طريق تحويل الكلام إلى نص مع تتبع التقدم المحرز، ويمكن تنزيل النتائج على حدة أو مجتمعة.

نعم، إن برنامج تحويل الكلام إلى نص في /api/ متوافق مع OpenAI. تحميل الصوت البرمجي وتلقي JSON مع النص، واللغة، وعلامات التوقيت.

نعم. قم بتغيير اكتشاف المتحدث قبل تحميل النص ويتم تصنيف الكلمة إلى نص لكل متحدث (المتحدث 1، المتحدث 2...).

يقبل تحويل الكلام إلى نص ملفات تصل إلى 500 ميغابايت لكل تحميل. بالنسبة لمحتوى متعدد الساعات، قم بتقسيم الصوت إلى قطع أولاً.

دقيق جداً للصوت الواضح - عادة 95%+ دقة الكلمات في الإنجليزية مع Whisper big-v3 backend. quality depends on audio clarity, accent, and background noise.

نعم، يمكن تحرير النص الكامل في المكان نفسه، وتصحيح الأخطاء، وإعادة صياغته، ونسخه/تنزيله في شكل TXT أو SRT أو VTT.

نعم، يتم معالجة الصوت على وحدات المعالجة المركزية الخاصة بنا ويتم حذفه بعد الانتهاء من تحويل الكلام إلى نص، ولا يخزن أي شيء على المدى الطويل، أو يتم تقاسمه، أو يستخدم للتدريب.

نعم، تحميل ملف صوتي أو فيديو في /chat/ وطلب من الذكاء الاصطناعي نسخه - الجمع بين التحدث والنص مع أسئلة المتابعة والتلخيص في تدفق عمل واحد.

Sign up free: 30,000 tokens/day

إنشاء حساب مجاني

لا تلزم بطاقة ائتمان

كيف تقيّمون هذه الأداة؟

أحب Free.ai؟ أخبر أصدقائك!