AI Voice - Sesame CSM-1B

ใช้ในเชิงพาณิชย์ได้ รุ่น 581 ไม่มีสัญลักษณ์น้ำ ไม่ต้องลงทะเบียน
รุ่น:
+ GPT-5, Claude, Gemini
กลไก TTS จัดเก็บเอง Apache 2.0
Sesame CSM-1B — Sesame CSM-1B - Apache 2.0. Conversational Speech Model designed for low-latency, real-time voice. 24 kHz output, sounds best with a short reference-audio context turn. Self-hosted on Free.ai for the /voice/realtime/ tool.
0 ตัวอักษร ~0 tokens
ค่าค่าใช้จ่ายตามจำนวนตัวอักษร
กำลังสร้างเสียง...

อะไร Sesame CSM-1B ฟังดูเหมือนไง

Sesame CSM-1B - Apache 2.0. Conversational Speech Model designed for low-latency, real-time voice. 24 kHz output, sounds best with a short reference-audio context turn. Self-hosted on Free.ai for the /voice/realtime/ tool.

ลองใช้กล่องด้านบน ด้วย: สวัสดี ฉันชื่อแซม และฉันกำลังอ่านตัวอย่างนี้ เพื่อแสดงเสียง นั่นคือคำพูด TTS แบบ Demo แบบปกติ

เมื่อใดที่ควรใช้ Sesame CSM-1B

หนังสือเสียง

คำบรรยายแบบยาวๆ ด้วยเสียงที่คงที่ ปักหมุดบทละครั้ง ดาวน์โหลดเป็น WAV หรือ MP3 และต่อเข้ากับตัวหนังสือ

นำเสนอพอดคาสต์

เสียงเปิดเพลงและเสียงอัดเสียง ปรับความเร็วให้เหมาะสมกับพลังงาน เปลี่ยนรูปแบบเป็น MP3 สำหรับไฟล์ขนาดเล็ก

เครื่องมือค้นหา

ระบบโทรศัพท์แจ้งเตือน เสียงที่ออกมามีคุณภาพเหมือนสตูดิโอ ไม่มีการจอง บันทึก หรือข้อตกลงความลับ กับนักร้องเสียงที่เก่ง

ความสามารถในการเข้าถึง

เพิ่มเสียงร่วมกับเนื้อหาที่เขียนไว้สำหรับผู้อ่านที่มองเห็นไม่ชัดและคนที่อ่านไม่ออก ลงบนหน้าใดหน้าหนึ่ง

ตัวอย่างประโยค

"Welcome to the show, today we are exploring the future of AI."
"Your package has arrived. Please retrieve it from the front desk."
"Once upon a time, in a quiet village far away, lived a curious child."
"Press one for sales, two for support, or stay on the line for an agent."
"Breaking news: scientists have discovered a new species of deep-sea fish."
"Thank you for choosing us. We appreciate your business and look forward to serving you again."

ราคา

สร้างขึ้นเองบน GPU ของเรา สร้างจากแหล่งฟรีของคุณในแต่ละวันก่อน เมื่อมันหมดไป แพ็คเกจท็อคเก็ตที่จ่ายเริ่มต้นที่ $5 → 200,000 โต๊ะ. ประมาณ ~5โต๊ะต่อตัวละคร, อย่างน้อย 100 ต่อคลิป

คำอ้างอิงแบบอย่างเต็ม → · แสดงเสียง TTS ทั้งหมด → · เปรียบเทียบเสียง2เสียง ข้างๆกัน →

ตัวเลือกระดับสูง
ผลลัพธ์
เหรียญหมดแล้ว เอาชิ้นส่วนเพิ่ม
อยากได้ผลดีกว่านี้ไหม รุ่นพิเศษ (GPT-5, Claude, Gemini) ทำให้คุณภาพดีขึ้น แสดงแผน

❤️ รัก Free.ai บอกเพื่อนของคุณ

สมัคร เพื่อรับลิงค์แนะนำ และรับท็อปคอน 30,000 ต่อเพื่อน

อยากได้อีกมั้ย ลงทะเบียนฟรี: 30,000 ชิ้น/วัน
ลงทะเบียน

กำลังประมวลผลคำร้องขอของคุณ...

Sesame CSM-1B - Apache 2.0. Conversational Speech Model designed for low-latency, real-time voice. 24 kHz output, sounds best with a short reference-audio …

วิธีการใช้ AI Voice - Sesame CSM-1B

1
เติมข้อมูลของคุณ

พิมพ์ข้อความ, โหลดแฟ้ม, หรืออธิบายสิ่งที่คุณต้องการ ไม่จำเป็นต้องใช้บัญชีผู้ใช้

2
คลิกสร้าง

AI ของเรา ประมวลผลคำขอของคุณในไม่กี่วินาที โดยใช้แบบจำลอง Open Source ที่ดีที่สุด

3
ดาวน์โหลดและแบ่งปัน

ดาวน์โหลด คัดลอก หรือแบ่งปันผลลัพธ์ของคุณ ฟรีสำหรับใช้ส่วนตัวและใช้ในเชิงพาณิชย์

ใช้เครื่องมือนี้ผ่าน API

สร้างเครื่องมือนี้ให้อัตโนมัติจากโค้ดของคุณเอง จุดจบ REST ที่เข้ากันได้กับ OpenAI, การตรวจสอบสิทธิ์ด้วยเบียร์รี่โทเคน, ไม่จำเป็นต้องใช้ SDK เพิ่มเติม ค่าโทเคนเท่ากับอินเทอร์เฟซเว็บ

curl -X POST https://api.free.ai/v1/tts/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"text": "Hello from Free.ai", "voice": "af_heart", "model": "kokoro"}'

AI Voice - Sesame CSM-1B - FAQ

Sesame CSM-1B รองรับภาษามากมาย รายการที่ถูกต้องขึ้นอยู่กับกลไกการทำงานของเครื่อง; แบบฟอร์มบนหน้านี้ สามารถรับข้อความได้ทุกภาษา และกลไกจะแสดงผลในภาษาที่รองรับ หากต้องการเลือกภาษาที่เฉพาะเจาะจง โปรดดูที่ / voice / เพื่อเลือกกลไกการทำงานหลายภาษา

กลไกส่วนใหญ่จะแสดงภาษาอังกฤษอเมริกันโดยปริยาย และใช้สำเนียงที่เหมาะสมกับภูมิภาคสำหรับภาษาที่ไม่ใช่ภาษาอังกฤษ กลไก Premium อาจจะแสดงสำเนียงที่แตกต่างกันได้ - ปักหมุดตัวอย่างเพื่อเปรียบเทียบ

การรองรับ SSML นั้นแตกต่างกันไปตามกลไกต่าง ๆ แท็กการหยุดชะงัก, คำอธิบายและการเน้น จะถูกใช้บนกลไกพิเศษส่วนใหญ่ และบนกลไกที่ใช้เองบางตัว ข้อความธรรมดาจะทำงานได้เสมอ - ไม่จำเป็นต้องมีมาก้า

การสตรีม TTS สามารถใช้ได้บนเครื่องมือระดับพรีเมี่ยมผ่านทาง / v1/ tts/ API endpoint ด้วย stream=true ส่วนติดต่อผู้ใช้เว็บบนหน้านี้จะส่งคลิปเต็มเมื่อการแสดงผลเสร็จสมบูรณ์

Sesame CSM-1B ทำงานบน GPU ของพวกเราเอง สร้างจากสระที่คุณมีฟรีทุกวันก่อน เมื่อหมดแล้ว ค่าใช้จ่ายเริ่มต้นที่ $5 → 200,000 โต๊ะ ประมาณ ~5โต๊ะต่อตัวอักษร อย่างน้อย 100 ต่อคลิป

สูงสุด 5,000 อักขระต่อคำร้องขอบนเว็บ UI สำหรับส่วนที่ยาวกว่า (หนังสือเสียง, บทเต็ม) ใช้ /voice/audiobook/ ซึ่งจะแยกและต่อกันโดยอัตโนมัติ หรือเรียก API ในลูป

ใช่ - POST รายการข้อความไปยัง / v1/ tts/ batch / หรือใช้ UI ของพื้นที่ทำงานที่ / workspace / เพื่อเชื่อมต่อ TTS เข้ากับท่อที่ยาวกว่า (เช่น Translate → Speak → Stitch)

ใช่ - POST ข้อความไปยัง / v1/ tts / ด้วย model=" Sesame CSM-1B "(หรือ slug ที่หน้านี้) คืนค่าเป็น WAV หรือ MP3 ดูที่ / api / สำหรับอ้างอิงที่ครบถ้วน + สแปม SDK

หน้านี้เป็นส่วนของการแปลงข้อความเป็นเสียง ไม่ใช่การโคลนเสียง - เสียงเป็นตัวกำหนดค่าของกลไก สำหรับโคลนเสียง (อัปโหลดเสียงที่อ้างอิง) โปรดดูที่ /voice/clone/ ซึ่งคุณต้องเป็นเจ้าของสิทธิ์เสียงหรือมีใบรับรองโดยอ้างอิง

กลไกที่ใช้เองทำงานบน GPU ที่ Free.ai ถือครอง ไม่มีอะไรออกจากเซิร์ฟเวอร์ของเรา กลไกพิเศษส่งข้อความไปยังผู้ให้บริการแบบจำลองด้านบนภายใต้ DPA ของเรา เราไม่ฝึกการเข้าถึงของคุณและไม่ขายข้อมูล

ใช่ - Free.ai อนุญาตให้ใช้เสียงที่สร้างขึ้นเพื่อการค้า ลิขสิทธิ์ของเครื่องจักร (Apache 2.0, MIT, หรือเงื่อนไขของผู้ผลิต) แสดงไว้ด้านบนและบนหน้าอ้างอิงแบบอย่าง ในทางปฏิบัติ หมายถึงเสียง, โฆษณา, พ็อดแคสต์ และแอพพลิเคชันทั้งหมดอยู่ในขอบเขต

ใช่ — งานที่ล้มเหลวจะถูกคืนเงินอัตโนมัติไปยังแหล่งที่มา (กองประจำวัน หรือ โต๊ะที่จ่ายค่าบริการ) หากการคืนเงินไม่ปรากฏในวันเดียวกัน โปรดส่งอีเมลไปที่ contact@free.ai

ลงทะเบียนฟรี: 30,000 ชิ้น/วัน

สร้างบัญชีผู้ใช้ฟรี

ไม่ต้องใช้บัตรเครดิต

คุณจะให้คะแนนเครื่องมือนี้ยังไง

4.6/5 from 5 ratings

รัก Free.ai บอกเพื่อนของคุณ