ถอดเสียงบันทึกสายภาษาไทยเป็นข้อความ
เปลี่ยนทุกสายที่บันทึกไว้เป็นข้อความภาษาไทยที่ค้นหาได้ ทีม QA อ่านได้ทุกสาย ระบบแจ้งเตือนเมื่อพบคำสำคัญ และประวัติลูกค้าอยู่ห่างแค่การค้นหาเดียว
บทถอดเสียงเขียนว่าอย่างไร
คำสัญญาว่าจะชำระ
spokenลูกค้ายืนยันว่าจะชำระยอด สามพันสองร้อยบาท ภายในวันที่ ยี่สิบ นี้ ผ่านแอปนะคะ
writtenลูกค้ายืนยันว่าจะชำระยอด 3,200 บาท ภายในวันที่ 20 นี้ ผ่านแอปนะคะ
แบบเขียนใส่ยอดเงินและวันที่เป็นตัวเลข ซึ่งเป็นสิ่งที่กฎติดตามหนี้ใช้จับคู่
ชื่อสินค้ากลางประโยค
spokenเรื่องแพ็กเกจ Fiber Max ที่สมัครไปเมื่อวานยังไม่ได้เปิดใช้เลยค่ะ
writtenเรื่องแพ็กเกจ Fiber Max ที่สมัครไปเมื่อวานยังไม่ได้เปิดใช้เลยค่ะ
ชื่อภาษาอังกฤษยังคงเป็นอังกฤษทั้งสองแบบ คลังคำศัพท์ช่วยให้สะกดเหมือนกันทุกสายแม้มีเป็นพันสาย
คำขอคืนเงิน
spokenขอคืนเงินค่าบริการเดือนสิงหาคมจำนวน ห้าร้อยเก้าสิบเก้าบาท ได้ไหมคะ
writtenขอคืนเงินค่าบริการเดือนสิงหาคมจำนวน 599 บาท ได้ไหมคะ
กฎคำสำคัญที่จับคำว่าคืนเงินอ่านข้อความเดียวกับที่คนอ่าน พร้อมยอดเงินที่บันทึกต่อได้ทันที
บทถอดทุกคู่บนหน้านี้เป็นตัวอย่างที่เขียนขึ้นเพื่อแสดงว่าตัวเลือกรูปแบบเปลี่ยนอะไร และตรวจกับผลลัพธ์จริงก่อนเผยแพร่ หน้า Speech-to-Text มีบทถอดจริงของโมเดลจากไฟล์เสียงจริง พร้อมวันที่บันทึก
เชื่อมกับคอลเซ็นเตอร์อย่างไร
คอลเซ็นเตอร์บันทึกทุกสาย แต่แทบไม่ได้ฟังสายไหนเลย ทีม QA สุ่มฟังสัปดาห์ละไม่กี่สาย ให้คะแนนด้วยหู ส่วนที่เหลือนอนอยู่ในที่เก็บจนกว่าจะมีเรื่องร้องเรียนให้ต้องไปขุด การถอดเสียงเปลี่ยนเลขคณิตนี้ ทุกสายกลายเป็นข้อความทันทีที่วางสาย ระบบตรวจสคริปต์อ่านได้ทุกสาย การแจ้งเตือนคำสำคัญทำงานกับสายที่พูดถึงการคืนเงิน คู่แข่ง หรือคำสัญญาว่าจะชำระ เมื่อลูกค้าโทรกลับ เจ้าหน้าที่อ่านบทสนทนาครั้งก่อนได้เลย ไม่ต้องถามซ้ำ บทถอดเก็บสิ่งที่พูดไว้ในภาษาที่พูด ชื่อสินค้าภาษาอังกฤษกลางประโยคไทยจึงรอดมาถึงข้อความ
- ส่งไฟล์บันทึกทันทีที่วางสายส่งไฟล์ที่ระบบโทรศัพท์บันทึกอยู่แล้ว ยาวได้ถึง 60 นาที ระบบอ่านความยาวก่อนตัดเครดิต ไฟล์เสียจึงไม่มีค่าใช้จ่าย
- ขอแบบเขียนยอดเงิน วันที่ และเวลามาเป็นตัวเลข กฎที่จับคู่ตัวเลขจึงเรียบง่าย ใช้แบบพูดเมื่อต้องการบันทึกคำต่อคำ
- รันกฎของคุณบนข้อความการตรวจสคริปต์ การแจ้งเตือนคำสำคัญ และการค้นหาลูกค้าเป็นของคุณ คลังคำศัพท์ชื่อสินค้าและแพ็กเกจได้สูงสุด 50 คำ ช่วยให้สะกดเหมือนกันทุกสาย
ทุกสายที่บันทึกไว้กลายเป็นอะไร
- 100%
- ตรวจสคริปต์ครบ
- คำทักทาย การยืนยันตัวตน และประโยคปิดสาย คือการจับคู่ข้อความบนบทถอด ทุกสายถูกตรวจ และสายที่ขาดประโยคใดคือสายที่ QA ควรฟัง
- 0 และ 1
- ผู้พูด
- เมื่อเปิดแยกผู้พูด แต่ละช่วงพูดจะมีหมายเลขผู้พูด นับจาก 0 ตามลำดับที่ปรากฏ ระบบตรวจสคริปต์จึงหาช่วงพูดของเจ้าหน้าที่ได้จากหมายเลขและถ้อยคำ
- แจ้งเตือนคำสำคัญ
- คืนเงิน ยกเลิก ร้องเรียน ชื่อคู่แข่ง กฎบนบทถอดยกสายขึ้นมาภายในไม่กี่นาทีหลังวางสาย ขณะที่ลูกค้ายังจำได้
- ประวัติลูกค้า
- ทำดัชนีบทถอดตามลูกค้า เจ้าหน้าที่คนถัดไปอ่านสายล่าสุดก่อนตอบ และลูกค้าเล่าเรื่องแค่ครั้งเดียว
โมเดลเขียนสิ่งที่พูด การให้คะแนน การแจ้งเตือน และการจัดเส้นทางคือกฎที่คุณเขียนบนข้อความ
การตรวจสคริปต์ ในรูปบันทึกการทำงาน
call 2026-09-08T10:14:02+07:00 agent=A17 duration=4:12 greeting ✓ 0.4s สวัสดีค่ะ ... ยินดีให้บริการค่ะ identity ✓ 11.8s ขอทราบเลขบัตรประชาชน 4 ตัวท้าย hold-notice ✗ (no match) closing ✓ 241.9s ขอบคุณที่ใช้บริการค่ะ keywords คืนเงิน @ 96.2s ยกเลิก @ 133.0s flag review: missing hold notice, refund mentioned
เวลาระดับคำให้แต่ละจุดจับคู่มีวินาทีของตัวเอง ผู้ตรวจจึงกระโดดไปฟังตรงนั้นได้ทันที เวลาที่แสดงเป็นตัวอย่าง
หนึ่งเดือนของสายคิดเท่าไร
| ปริมาณงาน | เสียง | เครดิต |
|---|---|---|
| หนึ่งสาย 4 นาที | 4 นาที | 33.34 |
| หนึ่งวัน 100 สาย | 7 ชม. | 3,334 |
| หนึ่งเดือน 2,000 สาย | 66,680 เครดิต | |
8.33 เครดิตต่อเสียงหนึ่งนาที คิดถึงระดับมิลลิวินาที ตัวเลือกของบทถอดไม่เปลี่ยนราคา
สำหรับนักพัฒนา
ตัวอย่างโค้ดส่งไฟล์บันทึกหนึ่งไฟล์ด้วยแบบเขียน แล้วอ่านบทถอดและเครดิตที่คิดจากคำตอบ
AUDIO=$(base64 < meeting.m4a | tr -d '\n')
curl -X POST https://api.paxalabs.com/v1/stt \
--max-time 300 \
-H "Authorization: Bearer $PAXA_API_KEY" \
-H "Content-Type: application/json" \
-d "{\"audio\": \"$AUDIO\", \"model\": \"paxa-stt-lite-v1-preview\", \"convention\": \"written\"}"import { readFile } from "node:fs/promises";
const audio = (await readFile("meeting.m4a")).toString("base64");
const response = await fetch("https://api.paxalabs.com/v1/stt", {
method: "POST",
headers: {
Authorization: `Bearer ${process.env.PAXA_API_KEY}`,
"Content-Type": "application/json",
},
body: JSON.stringify({ audio, model: "paxa-stt-lite-v1-preview" }),
// A long recording can run for minutes; give it room.
signal: AbortSignal.timeout(300_000),
});
if (!response.ok) throw new Error(`Transcription failed: ${response.status}`);
const { text, usage } = await response.json();
console.log(text, `${usage.credits} credits`);import base64
import os
import requests
with open("meeting.m4a", "rb") as file:
audio = base64.b64encode(file.read()).decode()
response = requests.post(
"https://api.paxalabs.com/v1/stt",
headers={"Authorization": f"Bearer {os.environ['PAXA_API_KEY']}"},
json={"audio": audio, "model": "paxa-stt-lite-v1-preview"},
# A long recording can run for minutes; give it room.
timeout=300,
)
response.raise_for_status()
body = response.json()
print(body["text"], body["usage"]["credits"], "credits")โมเดลถูกสร้างมาให้ฟังอะไร
Paxa STT Lite ถอดเสียงภาษาไทยและอังกฤษ รวมประโยคที่สลับภาษากลางทาง ระบุช่วงพูดของผู้พูดเป็นหมายเลขเมื่อร้องขอ และจะไม่เผยแพร่ตัวเลขความแม่นยำจนกว่าจะเผยแพร่วิธีประเมินไว้ข้างกัน
คำถามที่พบบ่อย
- บทถอดบอกไหมว่าใครพูด
- บอกเป็นหมายเลข ตั้ง diarization เป็น true แล้วแต่ละช่วงพูดจะมาพร้อมหมายเลขผู้พูด นับจาก 0 ตามลำดับที่ปรากฏ โดยไม่มีชื่อกำกับ ช่วงพูดมาจากการอ่านไฟล์รวดเดียว ไฟล์จึงต้องสั้นกว่า 9 นาที ซึ่งครอบคลุมสายทั่วไป ไฟล์ที่บันทึกแยกสองช่องยังส่งเป็นสองไฟล์ได้
- สายที่ยาวเกินหนึ่งชั่วโมงทำอย่างไร
- หนึ่งคำขอรับได้ถึง 60 นาที และต้องสั้นกว่า 9 นาทีเมื่อเปิดแยกผู้พูด ตัดสายที่ยาวกว่านั้นตรงช่วงเงียบ แล้วส่งแต่ละส่วนพร้อมกัน แต่ละส่วนนับหมายเลขผู้พูดจาก 0 ใหม่
- ค้นหาสายตามเวลาได้ไหม
- ขอเวลาระดับคำ แล้วทุกคำจะมีเวลาเริ่มและจบเป็นวินาที คำสำคัญที่พบจึงลิงก์ไปยังวินาทีที่พูดได้
- ถอดเสียงไม่สำเร็จคิดเงินไหม
- ไม่คิด ระบบตัดเครดิตก่อนแล้วคืนให้อัตโนมัติเมื่อคำขอล้มเหลว และไฟล์ที่โมเดลอ่านไม่ได้จะถูกปฏิเสธก่อนตัดเครดิต
เริ่มต้นด้วยเครดิตฟรี
เข้าสู่ระบบด้วย Google, GitHub หรือ Hugging Face แล้วใช้เครดิตฟรี 100 เครดิตกับข้อความของคุณเอง