Saw an interesting video from @andreijikh about South Korea’s AI bubble having popped and couldn’t quite grasp some of the context even after rewatching a few times - In comes transcribe.so with the save, giving me a full transcript and letting me ask questions 🙌🔥
การถอดเสียงอัจฉริยะสำหรับเสียงและวิดีโอ
มืออาชีพนักเรียนและนักศึกษาครีเอเตอร์
ค้นหาว่าใครพูดอะไร และพูดเมื่อไรอย่างแม่นยำ
ถอดเสียงวิดีโอ การประชุม การบรรยาย หรือพอดแคสต์ ค้นหาสิ่งที่พูดไว้ ถามคำถามพร้อมรับคำตอบที่มีแหล่งอ้างอิง และข้ามไปยังช่วงที่ต้องการได้ทันที
ไม่ต้องใช้บัตรเครดิต
ป้ายกำกับผู้พูด·การประทับเวลาระดับคำ·52 ภาษาและภาษาถิ่น·ประมวลผลแบบเป็นส่วนตัว
Command Palette
Search for a command to run...
โพสต์จริงจาก X
ผู้คนใช้เครื่องมือนี้เพื่อค้นหาว่าใครพูดอะไร
Thanks @shsunmoon, I used @transcribeso twice for tricky Arabic YouTube videos, and the results were really good! It gave me full Arabic transcripts and kept them in my account for later retrieval so I could share them with ChatGPT instead of watching the full videos!
So I have been using handy and its really handy hahaha. it failed to transcribe a 10 min voice memo. That kinda sucked. I tried out transcribe.so and it did an amazing job. it can also handle hours of video&audio.
ต้นทุนที่แท้จริงของไฟล์บันทึกยาวๆ
คุณจำได้ว่าใครพูด แต่กลับหาช่วงนั้นไม่เจอ
ลูกค้าตกลงเปลี่ยนขอบเขตงาน ในที่สุดอาจารย์ก็อธิบายแนวคิดนั้น แขกรับเชิญพูดประโยคที่คุณอยากนำไปอ้าง ไฟล์บันทึกรู้แน่ชัดว่าใครพูดและพูดเมื่อไร แต่ไม่ยอมบอกคุณ คุณจึงเลื่อนไทม์ไลน์หา เลยจุด ย้อนกลับ แล้วลงเอยด้วยคำว่า "น่าจะอยู่แถวกลางๆ"
ต่อไฟล์บันทึกยาวหนึ่งรายการ
ไฟล์บันทึก 3 ชั่วโมงที่มีช่วงเดียวซึ่งคุณต้องการย้อนกลับไปหา
+ 20 ถึง 40 นาทีเพื่อเลื่อนไทม์ไลน์หาว่าใครพูด
+ 30 ถึง 60 นาทีเพื่อฟังซ้ำที่ความเร็ว 1.5 เท่า
+ บทสรุปที่ไม่มีชื่อผู้พูดและไม่มีการประทับเวลา
+ ∞ นาทีที่เสียไปกับการสงสัยว่าช่วงนั้นอยู่ในไฟล์บันทึกไหน
= เสียเวลาไปทั้งเย็น
มีวิธีที่เร็วกว่า
วิธีการทำงาน
เปลี่ยนไฟล์บันทึกให้พร้อมใช้งานในสามขั้นตอน
ภาพหน้าจอจริงจากบทถอดเสียงจริง นี่คือสิ่งที่คุณจะได้รับ
- 1
เพิ่มอะไรก็ได้
วางลิงก์หรืออัปโหลดไฟล์ ไม่ว่าจะเป็นการประชุม การบรรยาย พอดแคสต์ วิดีโอ หรือบันทึกเสียงก็ใช้งานได้เหมือนกัน
เวลาเริ่มต้น: ไม่ถึงหนึ่งนาที

- 2
รับบทถอดเสียงที่จัดโครงสร้างแล้ว
ทุกบทถอดเสียงมาพร้อมป้ายกำกับผู้พูด การประทับเวลาระดับคำ บทสรุป และบทที่อ่านเป็นธรรมชาติเหมือนมนุษย์เขียน ไม่ใช่โครงร่างที่สร้างอัตโนมัติ
เสียงหลายชั่วโมงกลายเป็นเนื้อหาที่อ่านจบในไม่กี่นาที

- 3
นำไฟล์บันทึกไปใช้งาน
ค้นหา ถามคำถามพร้อมรับคำตอบที่มีแหล่งอ้างอิง ข้ามไปยังช่วงที่ต้องการ และส่งออกโน้ตหรือคำบรรยายเมื่อจำเป็น
โค้ชหนุ่ม10:32แนวทางประคองชีวิตด้วยรายได้ใหม่แทนเงินเก็บน้ำFinance19:13โฟกัสการสำรวจตัวเองเพื่อหารายได้เพิ่มทุกคำตอบระบุผู้พูดและช่วงเวลาที่พูด
ไม่ต้องใช้บัตรเครดิต
ข้อความจากผู้สร้าง
สวัสดี ผม Seunghun 👋
ผมออกจาก Spotify ในปี 2023 เพื่อสร้างสตาร์ทอัพที่ช่วยค้นหาช่วงเวลาสำคัญในคอนเทนต์ขนาดยาว
ตอนนั้น AI ยังดีไม่พอ และธุรกิจก็ล้มเหลว
ในปี 2025 ผมรู้ว่าเทคโนโลยีพัฒนาตามทันแล้ว จึงลาออกจากงานและสร้าง transcribe.so
ผมชอบฟังบทสนทนาที่ชวนให้คิดมาโดยตลอด แต่การกลับไปค้นหาเรื่องที่เคยฟังหมายถึงต้องเปิดเนื้อหาหลายชั่วโมงซ้ำอีกครั้ง
ผมจึงต้องสร้างวิธีที่ดีกว่าในการค้นหาว่าใครพูดอะไรและพูดเมื่อไร.
สิ่งที่คุณจะได้รับ
ทุกสิ่งที่คุณต้องใช้เพื่อทำความเข้าใจไฟล์บันทึก
รู้ว่าใครเป็นคนพูด
ป้ายกำกับผู้พูดแยกแต่ละเสียงออกจากกัน คุณจึงเห็นว่าใครพูดอะไร และรู้ว่าคำรับปากนั้นมาจากใครอย่างชัดเจน ไม่ใช่ประโยคนิรนามในก้อนข้อความยาวๆ
รู้เวลาที่พูดอย่างแม่นยำ
การประทับเวลาระดับคำเชื่อมทุกบรรทัดกับไฟล์บันทึก คลิกประโยคแล้วการเล่นจะข้ามไปยังวินาทีที่พูดประโยคนั้นทันที
ถามแทนการดูซ้ำ
ถามคำถามกับไฟล์บันทึกแล้วรับคำตอบพร้อมแหล่งอ้างอิง ทุกแหล่งอ้างอิงจะพาไปยังช่วงต้นทาง คุณจึงตรวจสอบได้ด้วยตนเอง
การค้นหาและคำตอบพร้อมแหล่งอ้างอิง
ถามไฟล์บันทึก แล้วตรวจสอบคำตอบ
บทสรุปบอกว่าไฟล์บันทึกเกี่ยวกับอะไร ส่วนการถามจะบอกว่าใครพูดอะไรและพูดเมื่อไรอย่างแม่นยำ โดยทุกคำตอบเปิดไปยังช่วงต้นทางได้
คำถามจริงจากบทถอดเสียงจริง
โค้ชแนะนำอย่างไรให้คนวัย 27 ที่ตกงาน หยุดนับเงินเก็บแล้วเริ่มสร้างรายได้?
โค้ชแนะนำให้เร่งหางานใหม่โดยเร็วที่สุด แม้รายได้จะลดลงจากเดิมแต่ก็ช่วยประคองชีวิตได้โดยไม่ต้องพึ่งเงินเก็บฉุกเฉิน หากยังไม่มีงานประจำ ควรใช้ไอเดียและความคิดสร้างสรรค์เริ่มต้นทำธุรกิจออนไลน์แบบไม่ต้องสต็อกของเพื่อสร้างรายได้เสริม สิ่งสำคัญคือต้องขยับขยายขอบเขตความรู้และทักษะของตนเองให้กว้างขึ้น เพื่อเปิดรับโอกาสใหม่ๆ และเพิ่มช่องทางรายได้
- คำตอบมาจากไฟล์บันทึกโดยตรง ไม่ใช่ความรู้ทั่วไป
- ทุกคำตอบอ้างอิงว่าใครพูดและพูดเมื่อไรอย่างแม่นยำ
- คลิกแหล่งอ้างอิงแล้วการเล่นจะเปิดที่วินาทีนั้นทันที
- ถามจากไฟล์เดียวหรือทั้งคลังพร้อมกัน
คุณภาพและภาษา
บทถอดเสียงที่พร้อมใช้โดยไม่ต้องเสียเวลาแก้เป็นชั่วโมง
บทถอดเสียงจะมีประโยชน์ก็ต่อเมื่อคุณเชื่อถือได้ บทถอดเสียงของเราพร้อมสำหรับการอ่าน ค้นหา และอ้างคำพูด
- เครื่องหมายวรรคตอน การใช้ตัวพิมพ์ใหญ่เล็ก และย่อหน้าที่เรียบร้อย ไม่ใช่ข้อความตัวพิมพ์เล็กยาวติดกันเป็นพืด
- ป้ายกำกับผู้พูดสำหรับเสียงที่มีหลายคน
- การประทับเวลาระดับคำที่ใช้ทำคำบรรยายและคลิปได้อย่างมั่นใจ
- ความแม่นยำที่ยังคงทำได้ดีในภาษาอื่นนอกเหนือจากอังกฤษ พร้อมช่วงอัตราความผิดพลาดแยกตามภาษาจากผลทดสอบที่เผยแพร่แล้ว
ข้อผิดพลาดน้อยกว่า Whisper large-v3 1.5 ถึง 2.3 เท่าในการเปรียบเทียบแบบแบ่งชุดเดียวกันที่เผยแพร่แล้ว
ทดสอบกับ 52 ภาษาและภาษาถิ่น รวมถึงกวางตุ้ง จีนกลาง ญี่ปุ่น เกาหลี อาหรับ และฮินดี
หยุดเลื่อนไทม์ไลน์หา แล้วเริ่มถาม
ประมวลผลแบบเป็นส่วนตัว
ไฟล์บันทึกของคุณยังคงเป็นส่วนตัว
การถอดเสียง การระบุผู้พูด บท การค้นหา และ Q&A ทั้งหมดทำงานบนโครงสร้างพื้นฐานที่เราดูแล เนื้อหาของคุณจะไม่ถูกส่งไปยังผู้ให้บริการ AI ภายนอก และจะไม่ถูกนำไปฝึกโมเดล AI เว้นแต่คุณเลือกอนุญาต
- เข้ารหัสระหว่างส่งและขณะจัดเก็บ
- เนื้อหาของคุณจะไม่ถูกขาย
- ลบไฟล์บันทึกแต่ละรายการหรือทั้งบัญชีได้ทุกเมื่อ
- ไม่นำไปฝึกโมเดล AI เว้นแต่คุณเลือกอนุญาต
คลังที่ใช้งานต่อเนื่อง ไม่ใช่บทถอดเสียงครั้งเดียว
ทุกไฟล์บันทึกกลายเป็นส่วนหนึ่งของความทรงจำของคุณ
เครื่องมือส่วนใหญ่ส่งบทถอดเสียงให้หนึ่งรายการแล้วก็จบ แต่ที่นี่ทุกการประชุม การบรรยาย และวิดีโอจะรวมอยู่ในคลังที่ค้นหาได้ตราบเท่าที่คุณเก็บไว้
ค้นหาในทุกบทถอดเสียง
ค้นหาคำพูด หัวข้อ หรือสิ่งที่ผู้พูดคนหนึ่งพูดเกี่ยวกับงบประมาณจากไฟล์บันทึกหลายชั่วโมงได้ภายในไม่กี่วินาที
ถามจากไฟล์บันทึกหลายรายการ
คำถามเดียวใช้ข้อมูลจากทั้งคลังได้ พร้อมแหล่งอ้างอิงกลับไปยังแต่ละต้นทาง
กลับไปฟังช่วงต้นฉบับ
ทุกผลลัพธ์เชื่อมกลับไปยังการเล่น คุณจึงได้ยินชัดเจนว่าพูดไว้อย่างไร
เก็บทุกอย่างไว้ด้วยกัน
บท โน้ต และไฟล์ส่งออกจะอยู่กับไฟล์บันทึกแต่ละรายการ ไม่กระจัดกระจายไปตามเครื่องมือต่างๆ
สำหรับนักพัฒนา
มอบเอนจินการฟังแบบเดียวกันให้ผลิตภัณฑ์ของคุณ
ระบบเบื้องหลังหน้านี้คือ API ส่งสื่อเข้ามาแล้วรับบทถอดเสียงที่จัดโครงสร้าง พร้อมผู้พูดและเวลา
- ถอดเสียงจากไฟล์เสียงและวิดีโอด้วยการเรียก HTTP เพียงครั้งเดียว
- มีการระบุผู้พูดและผลลัพธ์พร้อมเวลาในตัว
- มีเซิร์ฟเวอร์ MCP สำหรับเอเจนต์ พร้อมข้อกำหนด OpenAPI สำหรับการใช้งานอื่นๆ
- ใช้ Bearer token เดียว กระเป๋าเครดิตและประวัติจะซิงค์กับเว็บแอป
ราคา
ถอดเสียงได้มากขึ้นโดยไม่ต้องคอยดูเวลา
เริ่มด้วยเครดิตฟรี $1 หากมีไฟล์เป็นครั้งคราว เลือกจ่ายตามการใช้งานในราคา $1/ชั่วโมง หรือเลือกแพ็กเกจไม่จำกัดเริ่มต้นที่ $9/เดือนสำหรับการใช้งานเป็นประจำ ทุกไฟล์ใช้เอนจินมาตรฐานเดียวกัน คุณไม่ต้องเลือกเอนจิน
ฟรี
ไม่ต้องสมัครแพ็กเกจ
- การถอดเสียงมาตรฐาน $1/ชั่วโมง
- ฟีเจอร์ AI ทั้งหมด: บทสรุป บท ป้ายกำกับผู้พูด และการค้นหา
- AI Q&A
- ไฟล์ยาวสูงสุด 90 นาที
- เครดิตในวอลเล็ตไม่มีวันหมดอายุ
- ใช้ API และ MCP ได้ทุกแพ็กเกจ
Pro
ไม่จำกัด สำหรับงานจริงจัง
- ถอดเสียงพร้อมกันได้ 3 รายการ
- ไฟล์ยาวสูงสุด 5 ชั่วโมง
- AI Q&A ไม่จำกัดพร้อมคำตอบที่ยาวขึ้น
- ความช่วยเหลือทางอีเมล
Business
ไม่จำกัด สร้างมาเพื่อทีม
- ทุกอย่างใน Pro
- ถอดเสียงพร้อมกันได้ 15 รายการ
- ไฟล์ยาวสูงสุด 10 ชั่วโมง
- ประมวลผลแบบลำดับความสำคัญสูง
เลือกชำระรายปีและรับฟรี 3 เดือน แพ็กเกจ Starter และ Enterprise อยู่ในหน้าราคาฉบับเต็ม
ยกเลิกได้ทุกเมื่อ แพ็กเกจแบบชำระเงินมีการรับประกันคืนเงินภายใน 7 วัน
คำถามที่พบบ่อย
ก่อนลองใช้ transcribe.so
ค้นหาว่าใครพูด แล้วข้ามไปยังช่วงนั้นทันที
เพิ่มการประชุม การบรรยาย พอดแคสต์ หรือวิดีโอรายการแรก แล้วเปลี่ยนให้เป็นบทถอดเสียงที่ค้นหา ถาม และตรวจสอบได้
ไม่ต้องใช้บัตรเครดิต