AI Voice - Sesame CSM-1B

الاستخدام التجاري 581 models لا يوجد علامة مائية لا يلزم التسجيل
النموذج:
+ GPT-5, Claude, Gemini
محرك TTS المستضافة ذاتيا Apache 2.0
Sesame CSM-1B — Sesame CSM-1B - Apache 2.0. Conversational Speech Model designed for low-latency, real-time voice. 24 kHz output, sounds best with a short reference-audio context turn. Self-hosted on Free.ai for the /voice/realtime/ tool.
0 حروف ~0 tokens
جداول التكاليف مع عدد الحروف
توليد الكلام...

ماذا يفعل Sesame CSM-1B ماذا تبدو عليه؟

Sesame CSM-1B - Apache 2.0. Conversational Speech Model designed for low-latency, real-time voice. 24 kHz output, sounds best with a short reference-audio context turn. Self-hosted on Free.ai for the /voice/realtime/ tool.

حاول المربع أعلاه مع: مرحبا، اسمي سام، وأنا أقرأ هذه العينة لتوضيح الصوت. - هذا هو العبارة النموذجية لعرض TTS.

متى تستخدم Sesame CSM-1B

كتب مسموعة

صورة طويلة من السرد مع نغمة متسقة، لصق فصل في وقت واحد، تنزيل WAV أو MP3، وجمع خارجيا.

مقدمات البودكاست

.. ضع حواجز مرورية قصيرة و إعلانات.. عدِّل السرعة لتوفير الطاقة.. و تغير الشكل إلى MP3 للملفات الصغيرة

نظام الاستجابة الهاتفية + البريد الصوتي

تلقّي نداءات من نظام الهاتف، إنتاج عالي الجودة بدون حجز، تسجيل، أو اتفاقات سرية مع الموهبة الصوتية.

إمكانية الوصول

إضافة محتويات سمعية إلى جانب محتويات مكتوبة للقراء ذوي الإعاقة البصرية وذوي صعوبة القراءة، وإضافة محتويات على أي صفحة.

عينة من العبارات

"Welcome to the show, today we are exploring the future of AI."
"Your package has arrived. Please retrieve it from the front desk."
"Once upon a time, in a quiet village far away, lived a curious child."
"Press one for sales, two for support, or stay on the line for an agent."
"Breaking news: scientists have discovered a new species of deep-sea fish."
"Thank you for choosing us. We appreciate your business and look forward to serving you again."

التسعير

Self-hosted on our GPUs. Generation draws from your daily free pool first; once that runs out, paid token packs start at $5 → 200,000 tokens. Roughly ~5 tokens per character, minimum 100 per clip.

المرجع الكامل للنموذج → · انظر جميع الأصوات → · Compare 2 voices side-by-side →

الخيارات المتقدمة
النتيجة
تريد نتائج أفضل؟ نماذج عالية الجودة (GPT-5, Claude, Gemini) توفر جودة أعلى. عرض الخطط

❤️ أحب Free.ai؟ أخبر أصدقائك!

تسجيل للحصول على رابط الإحالة وكسب 30 الرموز لكل صديق.

تريد المزيد؟ Sign up free: 30,000 tokens/day
التسجيل مجانا

... معالجة طلبك

Sesame CSM-1B - Apache 2.0. Conversational Speech Model designed for low-latency, real-time voice. 24 kHz output, sounds best with a short reference-audio …

كيف تستخدم AI Voice - Sesame CSM-1B

1
أدخل مدخلك

أدخل نص، أو تحميل ملف، أو وصف ما تريد. لا حساب مطلوب.

2
انقر على إنشاء

الذكاء الاصطناعي لدينا يقوم بمعالجة طلبك في ثوانٍ باستخدام أفضل نماذج المصدر المفتوح.

3
تنزيل وتقاسم

تحميل، نسخ، أو مشاركة نتائجك مجانا للاستخدام الشخصي والتجاري.

استخدام هذه الأداة عن طريق API

أتمتة هذه الأداة من شفرة الخاصة بك. OpenAI-متوافق REST نقطة نهاية، حامل-رمز توثيق، لا إضافية SDK مطلوبة. تكاليف الرموز تتطابق مع واجهة شبكة الويب.

curl -X POST https://api.free.ai/v1/tts/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"text": "Hello from Free.ai", "voice": "af_heart", "model": "kokoro"}'

AI Voice - Sesame CSM-1B - FAQ

يدعم Sesame CSM-1B مجموعة واسعة من اللغات. القائمة الدقيقة تعتمد على المحرك؛ النموذج على هذه الصفحة يقبل أي نص والمحرك سيعرض في لغاته المدعومة. انظر / voice / لاختيار كامل متعدد المحركات إذا كنت بحاجة إلى لغة محددة.

معظم المحركات تقوم بعرض إنجليزية أمريكية محايدة بشكل افتراضي ولغات مناسبة للمنطقة للغات غير الإنجليزية. المحركات العالية قد تكشف عن متغيرات لهجة - لصق عينة للمقارنة.

يختلف دعم SSML حسب المحرك. يتم احترام علامات التوقف، والصوت، والتأكيد على معظم المحركات العالية الجودة وعلى عدد قليل من المحركات المستضافة ذاتياً. يعمل النص البسيط دائماً - لا توجد علامات مطلوبة.

تدفق TTS متاح على محركات عالية الجودة من خلال / v1 / tts / API نقطة نهاية مع stream=true.

Sesame CSM-1B يجري على وحدات المعالجة المركزية الخاصة بنا. التوليد يستمد من مجمعك اليومي المجاني أولاً. بمجرد أن تنفد، الرموز المدفوعة تبدأ من $5 → 200,000 الرموز. تقريباً ~ 5 رموز لكل شخصية، الحد الأدنى 100 لكل مقطع.

يصل إلى 5000 كلمة لكل طلب على واجهة المستخدم الشبكية. وبالنسبة للقطع الأطول (كتب مسموعة، فصول كاملة)، استخدم /voice/audiobook/ الذي يقطع ويجمع تلقائيا، أو استدعاء API في حلقة.

نعم - POST قائمة من السلسلة إلى /v1/tts/batch/، أو استخدام واجهة المستخدم في مساحة العمل في /workspace/ لتسلسل TTS في خط أنابيب أطول (مثلا، ترجمة → تحدث → خيوط).

نعم - POST text to /v1/tts/ with model="Sesame CSM-1B" (or the slug on this page). returns WAV or MP3. See /api/ for full reference + SDK snippets.

هذه الصفحة هي نص إلى حديث، وليس استنساخ الصوت - الصوت هو المحرك الافتراضي. لاستنساخ الصوت (تحميل مرجع صوت)، انظر /voice/clone/، الذي يتطلب منك إما امتلاك حقوق الصوت أو الحصول على موافقة مكتوبة صريحة.

المحركات المستضافة ذاتياً تعمل على وحدات المعالجة المركزية المملوكة لـ Free.ai؛ ولا يخرج أي شيء من خوادمنا. المحركات العالية الجودة تنقل النص إلى مقدمي النماذج في المرحلة الأولى من التطوير في إطار اتفاقية البيانات الخاصة بنا.

نعم - Free.ai يمنح الاستخدام التجاري للصوت المولد. ترخيص المحرك الأساسي (Apache 2.0، MIT، أو شروط البائع) يظهر أعلى وعلى صفحة النموذج المرجعية؛ في الممارسة العملية، يعني هذا أن الصوتيات، والإعلانات، والبث، والتطبيقات كلها في النطاق.

نعم - الوظائف الفاشلة إعادة تلقائية إلى المصدر (المجمع اليومي أو الرموز المدفوعة). إذا لم يظهر رد في اليوم نفسه، بريد إلكتروني contact@free.ai.

Sign up free: 30,000 tokens/day

إنشاء حساب مجاني

لا تلزم بطاقة ائتمان

كيف تقيّمون هذه الأداة؟

4.6/5 from 5 ratings

أحب Free.ai؟ أخبر أصدقائك!