AI Voice - Sesame CSM-1B

استفاده تجاری مدل هاي 581 بدون نشان آبی نیازی به ثبت نام نیست
مدل:
+ GPT-5, Claude, Gemini
موتور TTS خودمیزبان Apache 2.0
Sesame CSM-1B — Sesame CSM-1B - Apache 2.0. Conversational Speech Model designed for low-latency, real-time voice. 24 kHz output, sounds best with a short reference-audio context turn. Self-hosted on Free.ai for the /voice/realtime/ tool.
0 نویسه‌ها ~0 نشانه
مقیاس هزینه با شمارش کاراکتر
در حال تولید گفتار...

چي ميشه Sesame CSM-1B مثل چي ميمونه؟

Sesame CSM-1B - Apache 2.0. Conversational Speech Model designed for low-latency, real-time voice. 24 kHz output, sounds best with a short reference-audio context turn. Self-hosted on Free.ai for the /voice/realtime/ tool.

در این حالت، جعبه بالا را با: سلام، اسم من سم است، و من این نمونه را برای نشان دادن صدا می‌خوانم. - این عبارت نمایشی TTS است.

چه زمانی استفاده شود Sesame CSM-1B

کتابهای صوتی

راوی‌گویی شکل طولانی با صدای هماهنگ. یک فصل را در یک زمان بچسبانید، به صورت WAV یا MP3 دانلود کنید، و به صورت خارجی دوخت کنید.

معرفی پادکست

سرعت رو براي انرژي تنظیم کن، براي فایل هاي کوچکتر به MP3 تبديل کن

پیام صوتی

خروجي با کیفیت استوديويي بدون رزرو، ضبط يا توافق نامه هاي محرمانه با استعداد صدا

دسترسی‌پذیری

اضافه کردن صدا در کنار محتوای نوشته شده برای خوانندگان کم بینا و دلسکس. در هر صفحهٔ دیگر.

جملات نمونه

"Welcome to the show, today we are exploring the future of AI."
"Your package has arrived. Please retrieve it from the front desk."
"Once upon a time, in a quiet village far away, lived a curious child."
"Press one for sales, two for support, or stay on the line for an agent."
"Breaking news: scientists have discovered a new species of deep-sea fish."
"Thank you for choosing us. We appreciate your business and look forward to serving you again."

قیمت

خود-میزبان بر روی GPUهای ما. نسل اول از استخر روزانه رایگان شما استفاده می‌کند؛ هنگامی که آن تمام می‌شود، بسته‌های توکن پرداختی از $5 → 200,000 توکن شروع می‌شود. تقریباً ~5 توکن برای هر کاراکتر، حداقل 100 برای هر کلیپ.

مرجع مدل کامل → · همه صداهای TTS را ببینید → · Compare 2 voices side-by-side →

گزینه‌های پیشرفته
نتیجه
. يه کم کم ميشه گرفتن نشانه‌های بیشتر
نتيجه بهتري ميخواي؟ مدلهای پریمیوم (GPT-5, Claude, Gemini) کیفیت بالاتری را ارائه می‌دهند. نمایش نقشه

❤️ دوست Free.ai رو به دوستانت بگو

ثبت نام کنید تا لینک پیشنهادی دریافت کنید و 30 توکن برای هر دوست بدست آورید.

بيشتر ميخواي؟ ثبت نام رایگان: 30,000 tokens/day
ثبت نام

در حال پردازش درخواست شما...

Sesame CSM-1B - Apache 2.0. Conversational Speech Model designed for low-latency, real-time voice. 24 kHz output, sounds best with a short reference-audio …

چطور استفاده شود AI Voice - Sesame CSM-1B

1
وارد کردن ورودی

متن را تایپ کنید ، پرونده‌ای را بارگذاری کنید ، یا آنچه را می‌خواهید توصیف کنید. حساب نیازی نیست.

2
ایجاد را کلیک کنید

هوش مصنوعی ما درخواست شما را در چند ثانیه با استفاده از بهترین مدل‌های منبع باز پردازش می‌کند.

3
بارگیری و اشتراک

دانلود، کپی یا اشتراک‌گذاری نتایج خود. برای استفاده شخصی و تجاری رایگان است.

استفاده از این ابزار از طریق API

این ابزار را از کد خودتان خودکار کنید. نقطه پایانی REST سازگار با OpenAI، گواهی‌نامه توکن حامل، نیازی به SDK اضافی نیست. هزینه توکن با رابط وب مطابقت دارد.

curl -X POST https://api.free.ai/v1/tts/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"text": "Hello from Free.ai", "voice": "af_heart", "model": "kokoro"}'

AI Voice - Sesame CSM-1B - FAQ

Sesame CSM-1B از طیف گسترده‌ای از زبان‌ها پشتیبانی می‌کند. فهرست دقیق به موتور بستگی دارد؛ فرم در این صفحه هر متنی را قبول می‌کند و موتور به زبان‌های پشتیبانی شده آن را نمایش می‌دهد. اگر به یک زبان خاص نیاز دارید ، برای انتخاب‌کننده چند موتور کامل ، /voice/ را ببینید.

بیشتر موتورها به صورت پیش‌فرض انگلیسی آمریکایی خنثی را نمایش می‌دهند و یک لهجه مناسب منطقه برای زبان‌های غیر انگلیسی. موتورهای Premium ممکن است انواع لهجه را نشان دهند - برای مقایسه نمونه را بچسبانید.

پشتیبانی SSML با موتور متفاوت است. برچسبهای توقف ، نظم و تأکید در بیشتر موتورهای پرمیوم و تعداد کمی از موتورهای خود میزبان رعایت می‌شوند. متن ساده همیشه کار می‌کند - هیچ علامت‌گذاری نیازی نیست.

پخش TTS در موتورهای پریمیوم از طریق /v1/tts/ API endpoint با stream=true در دسترس است. وب UI در این صفحه کلیپ کامل را پس از پایان رندرینگ باز می‌گرداند.

Sesame CSM-1B روی GPUهای خودمان اجرا می‌شود. نسل اول از مجموعه روزانه رایگان شما استفاده می‌کند. وقتی خالی شد، توکن‌های پرداختی از $۵ → ۲۰۰۰۰۰ توکن شروع می‌شوند. تقریباً ~۵ توکن برای هر کاراکتر، حداقل ۱۰۰ برای هر کلیپ.

Up to 5,000 characters per request on the web UI. For longer pieces (audiobooks, full chapters), use /voice/audiobook/ which chunks and stitches automatically, or call the API in a loop.

بله - یک لیست از رشته‌ها را به /v1/tts/batch/ POST کنید، یا از رابط کاربری فضای کاری در /workspace/ استفاده کنید تا TTS را به یک خط لوله طولانی‌تر زنجیر کنید (مثلاً، ترجمه → صحبت کردن → ست کردن).

بله - متن POST به /v1/tts/ با model=" Sesame CSM-1B "(یا slug در این صفحه). WAV یا MP3 را برمی‌گرداند. برای مرجع کامل + قطعه‌های SDK ، /api/ را ببینید.

این صفحه متن به گفتار است، نه شبیه‌سازی صدا - صدا پیش‌فرض موتور است. برای شبیه‌سازی صدا (بارگذاری یک صدای مرجع)، /voice/clone/ را ببینید، که نیازمند این است که شما یا مالک حقوق صدا باشید یا اجازهٔ کتبی صریح داشته باشید.

موتورهای خود میزبانی‌شده بر روی GPUهای Free.ai اجرا می‌شوند؛ هیچ‌چیز سرورهای ما را ترک نمی‌کند. موتورهای پرمیوم متن را به ارائه‌دهندگان مدل بالادستی تحت DPA ما می‌دهند. ما روی ورودی‌های شما آموزش نمی‌دهیم و داده نمی‌فروشیم.

بله - Free.ai اجازه استفاده تجاری از صدای تولید شده را می‌دهد. مجوز موتور (Apache 2.0، MIT، یا شرایط فروشنده) در بالا و در صفحه مرجع مدل نشان داده می‌شود؛ در عمل این به این معنی است که صداگذاری، تبلیغات، پادکست‌ها و برنامه‌ها همگی در محدوده قرار دارند.

بله - کارهای شکست خورده به منبع خودکار بازگردانده می‌شوند (جمع‌آوری روزانه یا نشانه‌های پرداخت شده). اگر بازگرداندن در همان روز ظاهر نشود، به contact@free.ai پیام الکترونیکی بفرستید.

ثبت نام رایگان: 30,000 tokens/day

ایجاد حساب

کارت اعتباري لازم نيست

اين ابزار رو چطور رتبه بندي ميکني؟

4.6/5 from 5 ratings

دوست Free.ai رو به دوستانت بگو