การบันทึกเสียง

ใช้ในเชิงพาณิชย์ได้ รุ่น 581 ไม่มีสัญลักษณ์น้ำ ไม่ต้องลงทะเบียน
รุ่น:
+ GPT-5, Claude, Gemini
โหลดพ็อดแคสต์และรับการตีพิมพ์ที่สะอาดและมีป้ายกำกับของผู้พูดพร้อมกับการตรวจจับอัตโนมัติของบทที่ระบุจากช่องว่างของความเงียบ แฟ้มรูปแบบยาว สูงสุด 2GB, ภาษา 99, Whisper-large-v3 ความแม่นยำ ส่งออกเป็น SRT/VTT สำหรับพ็อดแคสต์วิดีโอของคุณ, TXT ธรรมดาสำหรับโน้ตการแสดง, หรือ JSON สำหรับแก้ไขในกระบวนการทำงานแบบ Descript

ลากและวางรายการโทรทัศน์ของคุณ หรือคลิกเพื่อค้นหา

MP3, WAV, M4A, OGG, MP4 - ตอนยาว ขนาดสูงสุด 2GB

- - - -
ตัวบ่งชี้บทจะถูกคำนวณโดยคลาวด์จากช่องว่างของส่วนและติดตั้งไว้กับการตีความ ติดตั้งมันเข้าไปใน YouTube หรือ Spotify คำอธิบายเช่นเดียวกัน
ค่าที่คาดการณ์ไว้สำหรับคลิปนี้
-
ข้อมูลของพอดแคสต์
บทที่ตรวจพบอัตโนมัติ

กำลังเขียนป๊อปอัปของคุณ...

ตอนยาวใช้เวลาหลายนาที คุณสามารถปิดแท็บนี้ได้ หากคุณเลือก อีเมลเมื่อเสร็จ

สร้างขึ้นสำหรับผู้เล่นพอดคาสต์ + บรรณาธิการรายการ

แสดงโน้ตในแผ่นเดียว

โหลดตอน ดาวน์โหลด TXT ตัวอักษรของผู้พูดในช่อง ฉบับที่เวลาสแกนพร้อมสำหรับ Spotify / YouTube คำอธิบายของคุณ บล็อกโพสต์เขียนใน 10 นาทีแทนที่จะ4ชั่วโมง

ชื่อเสียง

ส่งออก SRT หรือ WebVTT ด้วยแท็กผู้พูด วางลงใน Premiere, Final Cut หรือ DaVinci Resolve ได้ทันที หรือโหลดวิดีโอ YouTube ของคุณเพื่อใช้คำบรรยายให้สะอาด

ปรับแต่งตอนที่ใช้ข้อความ

การส่งออก JSON จะให้คุณได้คำทุกคำพร้อมกับเวลาเริ่ม/จบ นำเข้าไปยัง Descript, Reaper หรือกระบวนการทำงานที่กำหนดเอง - แก้ไขโดยการทำลายข้อความ

วิธีการที่การแปลภาษาของโพดักซ์ทำงาน

  1. ลากเอกสารของคุณไปยังพื้นที่วาง — MP3, WAV, M4A, MP4, สูงสุด 2GB
  2. ทิ้งแท็กผู้พูดและเครื่องหมายบทไว้เปิดใช้งาน (เป็นค่าปริยาย) เลือกรูปแบบการส่งออก
  3. เราจะตรวจสอบระยะเวลา + ราคาก่อนที่คุณจะใช้เงิน คลิก เขียนต่อ
  4. ดาวน์โหลด TXT, SRT, VTT หรือ JSON ที่ติดป้ายว่าเป็นผู้พูด ตัวบ่งชี้บทเรียนจะถูกส่งพร้อมกันพร้อมที่จะปักหมุด

Free.ai บทแปลโพดักซ์ กับ เดสคริปต์, ริเวอร์ไซด์, ออตเตอร์

ตัวเลือก Free.ai Descript Riverside Otter.ai
ค่าPay-per-use ($0.003/min)$15-30/mo$19/mo$16.99/mo
ขนาดแฟ้มสูงสุด2 GB5 GBTied to record session500 MB (varies)
ปรับแต่งการแสดงผล
เครื่องหมายบทอัตโนมัติ (ที่อยู่บนความเงียบ)Manual-Paid tier
ส่งออก SRT/ VTTPaid
ภาษา9922100+English-focused
API สาธารณะ--Limited
ค่าบริการของคู่แข่ง สะท้อนระดับของการจัดอันดับในปี 2026 ตรวจสอบผู้ให้บริการแต่ละราย สำหรับแผนปัจจุบัน
ตัวเลือกระดับสูง
ผลลัพธ์
เหรียญหมดแล้ว เอาชิ้นส่วนเพิ่ม
อยากได้ผลดีกว่านี้ไหม รุ่นพิเศษ (GPT-5, Claude, Gemini) ทำให้คุณภาพดีขึ้น แสดงแผน

❤️ รัก Free.ai บอกเพื่อนของคุณ

สมัคร เพื่อรับลิงค์แนะนำ และรับท็อปคอน 30,000 ต่อเพื่อน

อยากได้อีกมั้ย ลงทะเบียนฟรี: 30,000 ชิ้น/วัน
ลงทะเบียน

กำลังประมวลผลคำร้องขอของคุณ...

เขียนบทความจากโพดักส์เป็นข้อความด้วย AI ฟรี ติดป้ายผู้พูด ติดป้ายบท นำเข้า SRT

วิธีการใช้ การบันทึกเสียง

1
เติมข้อมูลของคุณ

พิมพ์ข้อความ, โหลดแฟ้ม, หรืออธิบายสิ่งที่คุณต้องการ ไม่จำเป็นต้องใช้บัญชีผู้ใช้

2
คลิกสร้าง

AI ของเรา ประมวลผลคำขอของคุณในไม่กี่วินาที โดยใช้แบบจำลอง Open Source ที่ดีที่สุด

3
ดาวน์โหลดและแบ่งปัน

ดาวน์โหลด คัดลอก หรือแบ่งปันผลลัพธ์ของคุณ ฟรีสำหรับใช้ส่วนตัวและใช้ในเชิงพาณิชย์

ใช้เครื่องมือนี้ผ่าน API

สร้างเครื่องมือนี้ให้อัตโนมัติจากโค้ดของคุณเอง จุดจบ REST ที่เข้ากันได้กับ OpenAI, การตรวจสอบสิทธิ์ด้วยเบียร์รี่ท็อกเก้น, ไม่จำเป็นต้องใช้ SDK เพิ่มเติม ค่าท็อกเก้นเท่ากับส่วนติดต่อเว็บ

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@audio.mp3", "language": "auto"}'

การบันทึกเสียง - FAQ

เครื่องมือโพดักซ์ใช้การตั้งค่าปริยายในการจัดเรียงผู้พูดและตัวบ่งชี้บท (ตรวจจับความเงียบ >2วินาที) และรองรับแฟ้มขนาดยาวถึง 2GB รูปแบบผลลัพธ์รวมถึง SRT + VTT สำหรับวิดีโอคลิปแสดงโน้ต, TXT ธรรมดาสำหรับโพสต์บล๊อก และ JSON ที่มีโครงสร้างพร้อมกับสแกนเวลาต่อรอบ + แท็กผู้พูด เพื่อแก้ไขในกระบวนการทำงานแบบ Descript

สูงสุด 2GB ต่อแฟ้ม - ประมาณ 14 ชั่วโมงของเสียง podcast ที่ 128 kbps MP3 แฟ้มยาวจะถูกแยกออกจากกันบนเซิร์ฟเวอร์เพื่อความยืดหยุ่น คุณจะได้รับแค่หนึ่งเดียวรวมกัน transcript กลับมา

ใช่ การจัดเรียงเสียงของผู้พูดจะเปิดไว้โดยปริยาย เราจะตรวจสอบเสียงที่แตกต่างกัน 2- 10 เสียงผ่านการฝังเสียง ECAPA ติดป้ายพวกเขาว่า คนพูด 1 / 2/... และใช้ป้ายนี้กับทุกส่วน คุณสามารถเปลี่ยนชื่อพวกเขาได้ในมุมมองผลลัพธ์

ช่วงเวลาเงียบที่ยาวกว่า2วินาที - ช่วงเวลาที่ผู้เล่นพ็อดแคสต์ใช้ระหว่างการแยกส่วน บทแต่ละบทจะได้รับสัญลักษณ์เวลาที่คุณสามารถปักหมุดเข้าไปในโน้ตรายการของคุณได้โดยตรง โดยใช้บล๊อก "บท:" สำหรับ YouTube + Spotify

เดสคริปต์เรียกเก็บค่าบริการ 15-30 ดอลลาร์ต่อเดือน สำหรับ 10 ชั่วโมงของการแปล ติดกับผู้จัดพิมพ์ของเรา เราเรียกเก็บค่าบริการ 500 ชิ้น/นาทีบน Whisper ($5 = 200K ชิ้น = ~400 นาที) ไม่มีค่าใช้จ่าย เพียงแค่ส่งออก คุณสามารถปักลงไปที่ไหนก็ได้

ริเวอร์ไซด์เป็นสตูดิโอที่บันทึกเสียง ที่จะบันทึกการประชุมของคุณเองฟรี ในแอพของพวกเขา แต่หลังจากที่พวกเขาบันทึก เราบันทึก MP3 / WAV / MP4 ทุกอย่าง ไม่ว่ามันจะบันทึกที่ไหน

Otter จำกัดเวลา 300 นาทีต่อเดือน ในระดับฟรี และเน้นภาษาอังกฤษ เราสนับสนุนภาษา 99 ภาษา ด้วยความแม่นยำเดียวกัน Whisper-large-v3 ไม่มีจำกัดเดือน - คุณจ่ายตามนาทีที่แปล

ใช่ - เลือก SRT หรือ WebVTT เป็นรูปแบบผลลัพธ์ แท็กของผู้พูดจะถูกรวมไว้ในบรรทัด (SRT) หรือเป็นแท็ก <v Speaker N> (VTT) ซึ่งเครื่องเล่นสมัยใหม่ส่วนใหญ่จะแสดงให้เห็นอย่างถูกต้อง

Whisper- ใหญ่- v3 จัดการเพลงและเสียงสะท้อนแสงน้อยดี (โดยทั่วไปคำที่ผิดอัตรา 3-7%) เสียงดนตรีดังมากหรือการซ้อนกันหนักลดความแม่นยำ - คิดเกี่ยวกับการทำงาน / music / vocal- remover / ก่อนที่คัดลอกหรือแบ่งเปิดของคุณ

Whisper จัดการชื่อที่ใช้กันมากที่สุด แต่คำศัพท์เฉพาะของแบรนด์สูง อาจจะต้องผ่านการแก้ไขหลังการผ่าน ตอน ~ 30 นาทีโดยทั่วไปมี 5-10 ชื่อแบรนด์/ชื่อที่ถูกแก้ไขให้ใช้มือ

โหลดมันขึ้นมาที่นี่ ครั้งละหนึ่งครั้ง หรือใช้ฟังก์ชัน / batch / เมื่อเข้าใช้งานแล้ว เพื่อจัดคิวของฤดูกาล API ที่ / api / ยังรองรับ POST / v1/ stt / สำหรับโปรแกรมแบตช์

ไม่ แฟ้มที่โหลดจะถูกลบออกหลังจากการแปลภาษาเสร็จสมบูรณ์ แปลภาษาของคุณจะอยู่ใน / account / ประวัติการดาวน์โหลดของคุณ หากคุณล็อกอินเข้าใช้ระบบ ผู้ใช้ที่ไม่ระบุชื่อจะได้รับลิงก์การแชร์ภายใน 24 ชั่วโมง

ลงทะเบียนฟรี: 30,000 ชิ้น/วัน

สร้างบัญชีผู้ใช้ฟรี

ไม่ต้องใช้บัตรเครดิต

คุณจะให้คะแนนเครื่องมือนี้ยังไง

รัก Free.ai บอกเพื่อนของคุณ