รีวิว repo
VoiceStudio รวมงานเสียงทั้งชุดไว้ในเครื่องตัวเอง
งานที่มันทำได้มีหกอย่าง โคลนเสียงจากคลิปสั้น ๆ ออกแบบเสียงใหม่จากคำบรรยาย พากย์คลิปข้ามภาษาพร้อมซับที่ตรงจังหวะ ถอดเสียงเป็นตัวหนังสือ พิมพ์งานด้วยการพูด และทำหนังสือเสียงยาว ๆ ทั้งหมดนี้ทำงานอยู่ในเครื่องเรา ไม่ต้องสมัคร ไม่ต้องมีคีย์ ไม่มีมิเตอร์นับวินาที ไฟล์เสียงกับงานที่ทำค้างไว้ก็อยู่บนดิสก์ของเราตามเดิม
อันดับ 10ของ 646 ภาษาในชุดข้อมูล
ผมกางตารางภาษาในเอกสารของมันนับเองเมื่อ 13 กันยายน 2026 — ไทยมีข้อมูลเสียง 10,500 ชั่วโมง จากทั้งชุด 581,489 ชั่วโมง มากกว่าอิตาลี 9,402 เกาหลี 8,609 และเวียดนาม 8,482 ชั่วโมง
สิ่งที่มันทำให้ได้จริง
- เสียงที่อัดไว้ไม่ต้องอัปขึ้นเครื่องของใคร งานทั้งหมดจบบนดิสก์ตัวเอง
- โค้ดเดิมที่เคยยิงไปหา OpenAI ใช้ต่อได้ แค่เปลี่ยนที่อยู่ปลายทางเป็นเครื่องตัวเอง
- ต่อเข้ากับผู้ช่วย AI ได้ผ่านช่องมาตรฐาน MCP ให้มันสั่งพากย์และถอดเสียงเองโดยไม่ต้องเปิดแอป
- สลับตัวสร้างเสียงได้ 16 ตัวและตัวถอดเสียง 11 ตัว เลือกตามเครื่องที่มี
ต่อของเดิมเข้าเครื่องตัวเอง
$ curl http://localhost:3900/v1/audio/speech \$ -H "Content-Type: application/json" \$ -d '{"model":"tts-1","input":"ทดสอบเสียงจากเครื่องตัวเอง","voice":"default","response_format":"wav"}' \$ --output speech.wavหน้าตาเหมือนที่เคยยิงไปหา OpenAI ทุกอย่าง ต่างกันแค่ปลายทางเป็นเครื่องเราเอง โค้ดเดิมเปลี่ยนบรรทัด base_url บรรทัดเดียวก็ใช้ได้ · ⛔️ ผมยกคำสั่งนี้มาจากเอกสารของเขา ยังไม่ได้ติดตั้งแอปและยังไม่ได้ลองเอง ใบนี้เลยไม่มีตัวเลขความเร็วหรือคำตัดสินเรื่องคุณภาพเสียงอยู่เลย