Loma Sub API
Speech-to-Text AI เพื่อซับไตเติลไทยโดยเฉพาะ
Loma Sub คืออะไร
Loma Sub คือบริการสร้างซับไตเติลภาษาไทยด้วย AI ที่แม่นยำที่สุด แก้ปัญหาการสร้างซับไตเติลที่เคยใช้เวลานานให้ง่ายและรวดเร็ว ด้วย Speech to Text AI คุณภาพสูงที่พัฒนาเพื่อการสร้างซับไตเติลโดยเฉพาะ — ถอดคำถูกต้อง แม่นยำตรงเวลา ตัดคำอย่างเป็นธรรมชาติ
เอกสารชุดนี้อธิบายการใช้งาน Loma Sub Transcription API สำหรับนักพัฒนาที่ต้องการส่งไฟล์เสียง/วิดีโอเข้ามาถอดเสียงเป็นซับไตเติลโดยอัตโนมัติผ่าน HTTP API
ระบบทำงานอย่างไร
เมื่อคุณส่ง URL ของไฟล์เสียงเข้ามา ระบบจะสร้าง งานถอดเสียง (job) และประมวลผลตามขั้นตอนดังนี้
- แบ่งช่วงเสียง (Splitting) — ตรวจจับช่วงที่มีการพูด (VAD) และแบ่งไฟล์เสียงเป็นช่วงที่เหมาะสม
- ถอดเสียง (Transcribing) — โมเดล Speech-to-Text คุณภาพสูงถอดคำภาษาไทยอย่างถูกต้อง
- จัดตำแหน่งเวลา (Aligning) — ระบุเวลาของแต่ละคำให้ตรงระดับเสี้ยววินาที
- สร้างซับไตเติล (Building SRT) — ตัดคำและจัดบรรทัดอย่างเป็นธรรมชาติ พอดีบรรทัด อ่านง่าย
- ระบุผู้พูด (Diarizing) — (ตัวเลือกเสริม) จำแนกและติดป้ายชื่อผู้พูดในแต่ละบรรทัด
เมื่อเสร็จสิ้น คุณจะได้รับลิงก์ดาวน์โหลดไฟล์ผลลัพธ์ 6 รูปแบบ
| ไฟล์ | รูปแบบ | เหมาะสำหรับ |
|---|---|---|
result.srt |
SubRip Subtitle | ใช้กับโปรแกรมตัดต่อและเครื่องเล่นวิดีโอทั่วไป |
result.vtt |
WebVTT | ใช้กับวิดีโอบนเว็บ (HTML5 <track>) |
result.compact.txt |
ข้อความล้วน | อ่านเนื้อหา สรุปความ หรือนำไปประมวลผลต่อ |
result.karaoke.vtt |
WebVTT + timestamp ระดับคำ | เรนเดอร์ซับแบบคาราโอเกะ (ไฮไลต์ทีละคำ) |
result.words.json |
JSON ระดับคำ | วิเคราะห์จังหวะการพูด / ฝึกโมเดลตัด cue — ดู รูปแบบไฟล์ |
result.debug.vtt |
WebVTT สำหรับดีบัก | cue แบบคาราโอเกะพร้อมบล็อก NOTE ค่า VAD รายเฟรมและ speaker embedding ของแต่ละ cue — ใช้วิเคราะห์/ดีบัก ไม่ใช่ซับสำหรับผู้ชม — ดู รูปแบบไฟล์ |
การใช้งาน API มี 2 ขั้นตอน
การใช้งานหลักมีเพียง 2 endpoint เท่านั้น
| ขั้นตอน | Endpoint | หน้าที่ |
|---|---|---|
| 1. ส่งงานถอดเสียง | POST /new-transcribe |
ส่ง URL ไฟล์เสียงเพื่อสร้างงานใหม่ ระบบตอบกลับ job_id |
| 2. ตรวจสอบสถานะ | GET /status |
ตรวจสอบความคืบหน้าด้วย job_id จนได้ลิงก์ดาวน์โหลดผลลัพธ์ |
หากไฟล์อยู่ในเครื่องและยังไม่มี URL สาธารณะ ใช้ POST /presigned-url เพื่อขอลิงก์อัปโหลดไฟล์ชั่วคราวก่อน แล้วนำ source_url ที่ได้มาส่งงานตามปกติ
endpoint เสริม: GET /jobs ดูประวัติงานและค้นหางานเดิมด้วยชื่อไฟล์, PUT /jobs/{job_id} บันทึกซับไตเติลที่แก้ไขและดาวน์โหลดผ่าน API, POST /short-topics เลือกช่วงไฮไลต์จากไฟล์ซับไตเติล และ GET /account/me ตรวจสอบตัวตนของผู้เรียก
ข้อมูลพื้นฐาน
| รายการ | ค่า |
|---|---|
| Base URL | https://api.lomasub.ai |
| การยืนยันตัวตน | HTTP Header Authorization: Bearer <API_KEY> |
| รูปแบบข้อมูล | JSON (Content-Type: application/json) ยกเว้น /short-topics ที่เป็น multipart/form-data |
| ลิงก์ผลลัพธ์ | presigned GET อายุ 86 400 วินาที (24 ชั่วโมง) |
หมายเหตุ: ทุก endpoint ต้องแนบ API key เสมอ หากไม่มีหรือไม่ถูกต้องจะได้รับ
401 Unauthorized— ติดต่อทีม Loma เพื่อขอรับ API key สำหรับการใช้งาน
พร้อมเริ่มต้นแล้ว? ไปที่ เริ่มต้นใช้งาน (Quickstart) เพื่อสร้างซับไตเติลแรกของคุณภายในไม่กี่นาที