Wizper (Whisper v3)

Free.ai · stt · ~500 ชิ้น minute

วางแฟ้มเสียงหรือวิดีโอลงไป หรือปักหมุดที่อยู่ URL ด้านล่างนี้

~500 ชิ้น minute
ทำงานฟรีบน GPU ของเรา ปรับระดับสำหรับ Wizper (Whisper v3) →

Wizper (Whisper v3) คือ a โมเดลการแปลงเสียงเป็นข้อความ ผ่านโมเดลภายนอก - ~500 โต๊กเกอร์ ต่อนาที (50% ค่าใช้จ่ายสูงกว่าต้นทาง)

ใช้ผ่าน API

REST API รองรับ OpenAI สร้างกุญแจและเรียกโมเดลนี้ในไม่กี่วินาที

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/wizper","audio_url":"https://..."}'
เอกสาร API ดาวน์โหลดกุญแจ API

คำถามที่ถามบ่อย

Wizper (Whisper v3) ใช้บันทึกเสียงที่พูดออกมาเป็นข้อความ โหลดแฟ้ม MP3, WAV, M4A หรือวิดีโอ และ Wizper (Whisper v3) จะส่งกลับมาเป็นข้อความเต็ม ๆ รวมถึงตัวเลือกของคำอธิบาย SRT/ VTT ด้วยเวลาที่ระบุไว้

Wizper (Whisper v3) handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

อัตราความผิดพลาดของคำคือ 5- 10% สำหรับเสียงอังกฤษที่สะอาด, 10- 20% สำหรับเสียงที่รบกวนหรือมีเสียงอ่อน ตัวแปรขนาดใหญ่ของสถาปัตยกรรมเดียวกันทำได้ดีกว่าในกรณีที่ยาก - เลือกขนาดใหญ่กว่าเมื่อเสียงไม่ค่อยดี

ใช่ - ทุกส่วนมีสแตมป์เวลาเริ่ม/ ปิดไว้ นำออกเป็นรูปแบบ SRT หรือ VTT และเวลาจะถูกแปลงไปยังวิดีโอของคุณโดยตรง

Wizper (Whisper v3) เป็นเครื่องมือแปลภาษาระดับพรีเมี่ยม ประมาณ ~500-1,500 โต๊กเกอร์ต่อนาทีของเสียง, แสดงสดก่อนที่คุณจะสร้าง การแปลภาษาที่โฮสต์เองทำงานฟรีบน 30,000 โต๊กเกอร์ของคุณในแต่ละวัน โมเดลระดับพรีเมี่ยมคือการจ่ายตามที่คุณใช้, กับการเติมเงินจาก $1

MP3, WAV, M4A, FLAC, OGG, รวมถึงวิดีโอ (MP4, MOV, WebM) - เราจะดึงเสียงออกมา สูงสุด 500 MB ต่อการอัพโหลด แฟ้มยาวกว่านี้? แยกด้วย /audio/cut/ หรือใช้ /v1/stt/batch/

การแปลภาษาเป็นภาษาอังกฤษเป็นเรื่องที่แยกกัน - เปลี่ยน "diarize" ใน / transcribe / Wizper (Whisper v3) จัดการการแปลภาษา; การแปลภาษาจะระบุทุกส่วนด้วย ภาษา 1 / ภาษา2/ ฯลฯ

ใช่ - / batch / รองรับโฟลเดอร์ของแฟ้มเสียง ทุกๆ ส่วนที่แปลเป็นภาษาต่างๆ จะถูกเก็บไว้ใน / account /? tab=history ด้วยชื่อแฟ้มเดิม สำหรับการเก็บรักษาต้นไม้โฟลเดอร์ ให้ใช้ API

ใช่ - POST เสียงของคุณไปยัง /v1/stt/transcribe/ ด้วย model="Wizper (Whisper v3)" คืนค่า JSON ด้วยข้อความ + ส่วน + ตราเวลาระดับคำ /api/ มีคำอ้างอิงเต็ม

โมเดลที่ใช้ตัวเครื่องเองจะเก็บเสียงไว้บน GPU ของเรา; โมเดลพิเศษจะส่งผ่านผ่าน DPA เสียงจะถูกลบหลังจากที่เปิดหน้าต่างแบ่งปัน (24 ชั่วโมงโดยไม่ระบุชื่อ, 7วันเข้าใช้งาน) เราจะไม่ฝึกการเข้าถึงข้อมูลของคุณ

ใช่ - Free.ai อนุมัติให้ใช้ข้อมูลในเชิงพาณิชย์ คุณต้องมีสิทธิ์ในการใช้งานเสียงที่คุณอัปโหลด (การบันทึกของคุณเอง, เนื้อหาที่ได้รับอนุญาต หรือเนื้อหาที่ได้รับอนุญาต)

ค่าเวลาจริงประมาณ 0.05-0.2x - พอดคาสต์ 60 นาที ถูกบันทึกในเวลา 3-12 นาที รุ่นพิเศษจะทำงานเร็วกว่า ใช้ปุ่มคิวเพื่อปิดแท็บ

รัก Free.ai บอกเพื่อนของคุณ

จัดอันดับหน้านี้