หนังสือเสียงและนิยายเสียงภาษาไทย
ให้ AI อ่านนิยายและสร้างหนังสือเสียงภาษาไทยจากต้นฉบับ ส่งทีละบท คิดค่าใช้จ่ายตามจำนวนตัวอักษร และใช้เสียงเดียวได้ตลอดทั้งชุด
ไอเดียให้ลองเล่น
ทุกการ์ดเล่นคลิปจริงที่สร้างจากสคริปต์นั้น ๆ ด้วยเสียงนมเย็น เปิดใน Playground เพื่อให้พูดข้อความของคุณเองได้
จากต้นฉบับสู่หนังสือเสียง
เมืองไทยมีที่ทางให้หนังสือเสียงอยู่แล้ว MEB มีร้านหนังสือเสียงของตัวเอง Sonar Audiobooks จัดทำหนังสือเสียงภาษาไทย และ TK Park ให้สมาชิกยืมฟังได้โดยไม่เสียค่าใช้จ่าย ข้อจำกัดจริงอยู่ก่อนหน้านั้น คือขั้นตอนอัดเสียง เสียงที่เสร็จแล้วแปดชั่วโมงหมายถึงเวลาในห้องอัดแปดชั่วโมงบวกงานตัดต่อ ผู้อ่านต้องจองคิวและว่างต่อเนื่องตลอดทั้งชุด และการแก้ประโยคเดียวในบทที่เก้าก็ต้องเรียกเสียงนั้นกลับมาอีกครั้ง Text-to-Speech API คิดราคาหนังสือเล่มเดียวกันตามจำนวนตัวอักษรแทน บทหนึ่งสร้างเสียงได้ระหว่างที่บทถัดไปยังอยู่กับบรรณาธิการ ผู้อ่านคือรหัสเสียงที่ยังอยู่ครบตลอดทั้งชุด และการแก้หนึ่งบรรทัดมีค่าใช้จ่ายเท่ากับหนึ่งคำขอ
- ตัดต้นฉบับตามบทบทที่ยาวเกิน 5,000 ตัวอักษรส่งเป็นส่วน โดยตัดตรงย่อหน้า การตัดตามโครงของต้นฉบับเองทำให้บทที่แก้ใหม่ยังตรงกับส่วนเดิม
- สร้างเสียงทั้งเล่มเป็นชุดทุกส่วนคือหนึ่งคำขอที่ใช้รหัสเสียงเดียวกัน แล้วนำไฟล์ MP3 ที่ได้มาต่อเป็นแทร็กของบทนั้น หนังสือทั้งเล่มทำงานได้เองโดยไม่ต้องเฝ้า และความเร็วขึ้นอยู่กับลิมิตของแพ็กเกจ
- แก้ทีละบรรทัดโดยไม่ต้องจองห้องอัดย่อหน้าที่แก้แล้วสร้างเสียงใหม่ได้ด้วยคำขอเดียวในเสียงเดิม ส่วนที่เหลือของเล่มไม่ถูกแตะต้อง และคิดเงินเฉพาะตัวอักษรที่เปลี่ยน
คิดราคาหนังสือทั้งเล่มตามจำนวนตัวอักษร
| ความยาว | ตัวอักษร | เครดิต | ค่าใช้จ่าย |
|---|---|---|---|
| หนึ่งบท 20 นาที | 12,150 | 182.25 | $0.18 |
| ชุดละ 5 เล่ม | 1,458,000 | 21,870 | $21.87 |
| หนังสือเสียง 8 ชั่วโมง อ่านครบทั้งเล่ม | ประมาณ $4.37 | ||
คำนวณที่ 608 ตัวอักษรต่อเสียงหนึ่งนาที ตามอัตราเดียวทุกแพ็กเกจ
สำหรับนักพัฒนา
ตัวอย่าง Python และ TypeScript ส่งเนื้อหาหนึ่งส่วนของบทแล้วเขียนไฟล์ MP3 ที่งานชุดเก็บไว้ ส่วนตัวอย่างตัวเลือกแสดงฟิลด์ voice, model, format และ stream ที่หนังสือหนึ่งเล่มตั้งครั้งเดียวแล้วใช้ยาวถึงบทสุดท้าย
import os
import requests
response = requests.post(
"https://api.paxalabs.com/v1/tts",
headers={"Authorization": f"Bearer {os.environ['PAXA_API_KEY']}"},
json={"text": "สวัสดีครับ ยินดีต้อนรับสู่ Paxa Labs", "voice": "khanomkrok", "model": "paxa-tts-flash-v1"},
)
response.raise_for_status()
with open("speech.mp3", "wb") as f:
f.write(response.content)import { writeFile } from "node:fs/promises";
const response = await fetch("https://api.paxalabs.com/v1/tts", {
method: "POST",
headers: {
Authorization: `Bearer ${process.env.PAXA_API_KEY}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
text: "สวัสดีครับ ยินดีต้อนรับสู่ Paxa Labs",
voice: "khanomkrok",
model: "paxa-tts-flash-v1",
}),
});
if (!response.ok) throw new Error(`TTS failed: ${response.status}`);
await writeFile("speech.mp3", Buffer.from(await response.arrayBuffer()));curl -X POST https://api.paxalabs.com/v1/tts \
-H "Authorization: Bearer $PAXA_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"text": "สวัสดีครับ ยินดีต้อนรับสู่ Paxa Labs",
"voice": "khanomkrok",
"model": "paxa-tts-flash-v1",
"format": "mp3",
"stream": false
}' \
--output speech.mp3ฟังเสียงจริง
พะแนงชาย0:03
เสียงนุ่มภูมิฐานแบบนักแสดงละครเวที เหมาะกับงานเล่าเรื่องจริงจัง
ค่ำคืนนี้ เรื่องราวทั้งหมดจะค่อย ๆ เผยออกมา ทีละฉาก ทีละบรรทัด
ขนมครกชาย0:03
เสียงผู้ใหญ่ใจเย็น ไม่เร่งรีบ เสียงชายหลักของทั้งชุด เหมาะกับสารคดี เรื่องเล่าย้อนวัน และงานบรรยาย
สมัยผมยังหนุ่ม แถวนี้ยังเป็นทุ่งนา เดินไปตลาดทีหนึ่งก็ค่อนวันแล้วครับ
นมเย็นหญิง0:06
เสียงสดใสมีพลัง เสียงหญิงหลักของทั้งชุด เหมาะกับโปรโมต คลิปโซเชียล และเสียงพูดในผลิตภัณฑ์ทั่วไป
ยินดีต้อนรับสู่ Paxa Labs ค่ะ เสียงภาษาไทยที่สลับเป็น English ได้กลางประโยค อย่างเป็นธรรมชาติ
ตะโก้ชาย0:05
เสียงหนุ่มเป็นกันเอง เหมาะกับหนังสือเสียง สรุปข่าว และคลิปอธิบาย
ยามเช้าในกรุงเทพฯ แสงแดดอ่อน ๆ ทาบลงบนถนนที่เริ่มคึกคัก
เสียงบางส่วนจากทั้งหมด 26 เสียง สร้างจาก API ด้วยรหัสเสียงที่เปิดให้ใช้งานจริง ฟังครบทุกเสียงได้ที่หน้า Text-to-Speech
สร้างมาเพื่อภาษาไทยความยาวระดับหนังสือ
หนึ่งบทคือข้อความหลายพันตัวอักษรที่ไม่มีการเว้นวรรคระหว่างคำ และนิยายหนึ่งเล่มมีทั้งบทสนทนา ชื่อเฉพาะ และตัวเลขอยู่ทุกหน้า Paxa Flash ตัดคำในข้อความไทยยาว อ่านวรรณยุกต์จากรูปเขียนแบบที่คนอ่านออก และรักษาน้ำเสียงเดียวไว้ได้ตลอดทั้งชุด
คำถามที่พบบ่อย
- หนึ่งบทยาวได้เท่าไร
- ไม่เกิน 5,000 ตัวอักษรต่อคำขอ บทที่ยาวกว่านั้นส่งเป็นส่วนโดยตัดตรงย่อหน้า แล้วใช้เครื่องมือทั่วไปต่อไฟล์ MP3 เข้าด้วยกันเป็นแทร็กเดียว
- บทที่สี่สิบจะเป็นเสียงเดิมไหม
- เป็นเสียงเดิม เสียงหนึ่งเสียงคือรหัสตายตัวในแคตตาล็อก ไม่ต้องจองคิวผู้อ่าน รหัสเดิมจึงให้เสียงเดียวกันทั้งบทแรกและบทสุดท้าย
- อ่านไทยปนอังกฤษในประโยคเดียวได้ไหม
- ได้ เสียงเดียวอ่านได้ทั้งสองภาษา ชื่อเรื่องหรือชื่อเฉพาะภาษาอังกฤษกลางประโยคไทยจึงอยู่ในน้ำเสียงเดียวกับผู้อ่านคนเดิม
- หนังสือเสียงหนึ่งเล่มมีค่าใช้จ่ายเท่าไร
- ประมาณ $4.37 สำหรับเสียงที่เสร็จแล้ว 8 ชั่วโมง คิดตามจำนวนตัวอักษรในต้นฉบับ การสร้างเสียงบทที่แก้ใหม่ก็คิดแบบเดียวกัน
- นำหนังสือเสียงไปเผยแพร่เชิงพาณิชย์ได้ไหม
- เสียงที่สร้างด้วยเครดิตฟรีใช้ได้เพื่อการส่วนตัวและการทดลองใช้งาน เมื่อซื้อแพ็กเกจหรือเครดิตแล้ว เสียงที่สร้างขึ้นเป็นของคุณและเผยแพร่เชิงพาณิชย์ได้ รวมถึงเสียงที่สร้างไว้ก่อนการซื้อครั้งแรก ส่วนลิขสิทธิ์ของต้นฉบับยังเป็นเรื่องที่คุณต้องเคลียร์เอง
เริ่มต้นด้วยเครดิตฟรี
เข้าสู่ระบบด้วย Google, GitHub หรือ Hugging Face แล้วใช้เครดิตฟรี 100 เครดิตกับข้อความของคุณเอง