AI Voice - Sesame CSM-1B

商业使用OK 581 模型 无水印 不需要注册
型号 :
+ GPT-5, Claude, Gemini
TTS engine 自自托管 Apache 2.0
Sesame CSM-1B — Sesame CSM-1B - Apache 2.0. Conversational Speech Model designed for low-latency, real-time voice. 24 kHz output, sounds best with a short reference-audio context turn. Self-hosted on Free.ai for the /voice/realtime/ tool.
0 字符 约 0 个 Token
具有字符数的比额表
正在生成演讲...

What do 的 Sesame CSM-1B 听起来像?

Sesame CSM-1B - Apache 2.0. Conversational Speech Model designed for low-latency, real-time voice. 24 kHz output, sounds best with a short reference-audio context turn. Self-hosted on Free.ai for the /voice/realtime/ tool.

试一下上面的盒子: 你好,我的名字是山姆, 我读了这个样本来演示声音。

何时使用 Sesame CSM-1B

音传书

以一致的语气进行长式叙述。 一次粘贴一章, 以 WAV 或 MP3 下载, 并对外缝合 。

播客内演

短开板保险杠和广告读取。 调整能量速度, 格式切换到 MP3 用于较小文件 。

IVR+语音邮件

电话系统提示 工作室质量产出 不带预订、录音 或有语音天赋的无声数据

无障碍

向低视读写和读写能力读写者添加音频和书面内容。 任何页面都放入 。

样例短语

"Welcome to the show, today we are exploring the future of AI."
"Your package has arrived. Please retrieve it from the front desk."
"Once upon a time, in a quiet village far away, lived a curious child."
"Press one for sales, two for support, or stay on the line for an agent."
"Breaking news: scientists have discovered a new species of deep-sea fish."
"Thank you for choosing us. We appreciate your business and look forward to serving you again."

定价

自托管在我们的 GPU 上。生成首先从您的每日免费额度中支取;用完后,付费 Token 包从 $5 起 → 200,000 个 Token。大约每字符 5 个 Token,每个片段最低 100 个。

完整示范参考 → · 看见TTS所有的声音 → · Compare 2 voices side-by-side →

高级选项
结果成果
代号正在下降 获取更多 Token
想要更好的结果吗? 模型 (GPT-5, Claude, Gemini) 提供更高质量的品质。 视图计划

❤️ 爱 Free.ai 告诉你的朋友!

< a href="/ signup/" style="color:#16A34A" > 签名 以获得查询链接, 并获得每个朋友25,000个代币的 。

还要吗? 免费注册:30,000 个 Token/天
免费注册

处理你的请求...

Sesame CSM-1B - Apache 2.0. Conversational Speech Model designed for low-latency, real-time voice. 24 kHz output, sounds best with a short reference-audio …

如何使用 AI Voice - Sesame CSM-1B

1
输入

输入文本、上传文件或描述您想要的。不需要账户 。

2
单击 单击 生成

我们的AI在使用最佳开放源码模型的秒内处理你的请求。

3
下载共享( S)

下载、复制或分享您的结果。 免费个人和商业使用 。

通过 API 使用此工具

自动使用您自己的代码中的此工具。 OpenAI 兼容的 REST 端点、 Beaner-tok auth, 不需要额外的 SDK 。 Tok 成本符合网络界面 。

curl -X POST https://api.free.ai/v1/tts/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"text": "Hello from Free.ai", "voice": "af_heart", "model": "kokoro"}'

AI Voice - Sesame CSM-1B - FAQ

Sesame CSM-1B 支持多种语言。 精确列表取决于引擎; 格式将接受任何文本, 引擎将使用支持的语言。 如果您需要特定语言, 请查看/ voice/ 完整多引擎选取器 。

大多数引擎默认会使中美英语成为默认的英语,非英语的口音适合地区。 优先发动机可能会暴露口音变异 - - 粘贴样本以进行比较。

SSML 支持因引擎而异。 大部分高级引擎和一些自托管引擎都安装了暂停、 手动和强调标签。 纯文本总是有效, 不需要加标记 。

串流 TTS 可通过 /v1/tts/ API 端点通过流= true 的溢价引擎进入。 此页面上的网络界面在完成后会返回完整剪辑 。

Sesame CSM-1B 运行在我们自己的 GPU 上。生成首先从您的每日免费额度中支取。用完后,付费 Token 从 $5 起 → 200,000 个 Token。大约每字符 5 个 Token,每个片段最低 100 个。

网络界面中每个请求最多5,000个字符。 对于较长的片段( 音频、 完整章节), 使用/voice/ diosbook/ 自动块和缝合的 /voice/ adiosbook/ 或回拨 API 。

是 - POST 的字符串列表到 /v1/tts/batch/, 或使用 /workspace/ 的工作空间界面将 TTS 连接到更长的管道( 例如, 翻译 _ peak _ work) 。

是 - POST 文本到 /v1/ tts/ 带有模型= "Sesame CSM-1B" (或本页上的弹片) 。 返回 WAV 或 MP3 。 请参见 /api/ 完整引用 + SDK 片段 。

这个页面是文字语音, 不是语音克隆, 声音是引擎的默认。 语音克隆( 上载参考音频), 见/ voice/ crone/, 需要您拥有语音权利或有明确的书面同意 。

自行托管的引擎运行在 Free.ai 拥有的 GPUs 上; 服务器上没有留下任何内容。 优先引擎根据我们的政治部将文本传送给上游模式供应商。 我们不培训您的投入,也不出售数据。

是的 - Free.ai 授权商业使用生成的音频。 引擎的基本许可证(Apache 2.0、MIT 或供应商条款)显示在上方和模型参考页面上;实际上,这意味着配音、广告、播客和应用程序都在范围内。

Yes - failed jobs auto-refund to the source (daily pool or paid tokens). If a refund does not show up the same day, email contact@free.ai.

免费注册:30,000 个 Token/天

创建自由账户

无需信用卡

你怎么评价这个工具?

4.6/5 from 5 ratings

爱 Free.ai 告诉你的朋友!