StyleTTS 2

Free.ai (self-hosted) · tts · ~500 tokens per clip · 4.6 từ 5 người dùng trong danh mục này
~500 tokens per clip

StyleTTS 2 là a giọng nói chuyển văn bản thành nói được xây bởi Yinghao Aaron Li. Đứng đầu là Voice cloning without training data; expressive multilingual speech.. Tự lưu trữ trên Free.ai GPU — chạy miễn phí đối với hồ token hàng ngày của bạn (500 tokens mỗi đoạn). Phát hành dưới MIT - sử dụng thương mại được phép trên Free.ai.

Câu hỏi thường gặp

StyleTTS 2 hỗ trợ nhiều ngôn ngữ. Danh sách chính xác phụ thuộc vào máy; mẫu trên trang này chấp nhận bất kỳ văn bản nào và máy sẽ vẽ bằng ngôn ngữ được hỗ trợ. Xem / voice / cho bộ chọn nhiều máy nếu bạn cần một ngôn ngữ cụ thể.

Hầu hết các máy tạo ra tiếng Anh trung lập Mỹ theo mặc định và một giọng nói phù hợp với vùng cho các ngôn ngữ không phải tiếng Anh. Các máy cao cấp có thể cho thấy các biến thể giọng nói - dán một mẫu để so sánh.

Hỗ trợ SSML khác nhau tùy theo động cơ. Thẻ tạm dừng, ngữ điệu, và nhấn mạnh được tôn trọng trên hầu hết động cơ cao cấp và trên một vài động cơ tự động. Văn bản đơn luôn luôn hoạt động - không cần đánh dấu.

TTS truyền tải có sẵn trên các máy chủ cao cấp thông qua điểm cuối API /v1/tts/ với stream=true. Giao diện người dùng web trên trang này trả lại đoạn phim đầy đủ khi hoàn thành trình chiếu.

StyleTTS 2 chạy trên GPU của chúng tôi. Thế hệ rút từ nguồn miễn phí hàng ngày của bạn trước tiên. Khi hết, token trả tiền bắt đầu từ $5 → 200,000 token. Khoảng ~5 token mỗi nhân vật, tối thiểu 100 mỗi đoạn phim.

Up to 5,000 characters per request on the web UI. For longer pieces (audiobooks, full chapters), use /voice/audiobook/ which chunks and stitches automatically, or call the API in a loop.

Có - POST một danh sách các chuỗi vào /v1/tts/batch/, hoặc sử dụng giao diện workspace UI tại /workspace/ để liên kết TTS vào một đường ống dài hơn (ví dụ, translate → speak → stitch).

Có - POST văn bản đến /v1/tts/ với model="StyleTTS 2" (hoặc slug trên trang này). Trả WAV hoặc MP3. Xem /api/ để tham khảo đầy đủ + đoạn SDK.

Trang này là văn bản-để-nói, không phải là sao chép giọng nói - giọng nói là mặc định của máy. Đối với sao chép giọng nói (tải lên một âm thanh tham khảo), xem /voice/clone/, yêu cầu bạn phải sở hữu quyền giọng nói hoặc có sự đồng ý viết tắt.

Các bộ máy tự động chạy trên GPU của Free.ai; không có gì rời khỏi máy chủ của chúng tôi. Các bộ máy cao cấp truyền văn bản đến các nhà cung cấp mô hình trên dưới DPA của chúng tôi. Chúng tôi không huấn luyện vào đầu vào của bạn và không bán dữ liệu.

Có - Free.ai cho phép sử dụng thương mại âm thanh được tạo ra. Giấy phép cơ bản của động cơ (Apache 2.0, MIT, hoặc các điều khoản của nhà cung cấp) được hiển thị trên và trên trang tham khảo mô hình; trong thực tế, điều này có nghĩa là lồng tiếng, quảng cáo, podcast, và ứng dụng đều trong phạm vi.

Có — công việc thất bại tự động được trả lại nguồn (tập hợp hàng ngày hoặc token trả tiền). Nếu không có tiền trả lại trong cùng ngày, gửi email đến contact@free.ai.

Cậu yêu Free.ai?

Đánh giá trang này