Paxa Labs

งานวิจัยและผลิตภัณฑ์ AI ที่สร้างมาเพื่อภาษาไทย

Paxa Labs คือแล็บผลิตภัณฑ์และวิจัยในกรุงเทพฯ

คนไทยสลับภาษากลางประโยค เขียนโดยไม่เว้นวรรคระหว่างคำ ใช้วรรณยุกต์เปลี่ยนความหมาย และทำงานกับเอกสารที่มีหลายภาษา ตาราง ตราประทับ และลายมืออยู่ด้วยกัน

เราเปลี่ยนปัญหาในชีวิตประจำวันเหล่านี้เป็นผลิตภัณฑ์ด้านเสียง งานแปล และเอกสารที่ทีมต่าง ๆ นำไปใช้จริงได้

01 / 03

อินพุตคือภาษาไทยที่ใช้จริง

คนไม่ได้ปรับชีวิตให้เป็นภาษาสะอาดแบบชุดทดสอบก่อนใช้ซอฟต์แวร์

ส่ง email หา HR หน่อย

เดี๋ยว join meeting แล้วส่ง file ให้

ใช้ AI summarize อันนี้ให้หน่อย

ลูกค้าหนึ่งคนอาจพูดไทย สลับเป็นอังกฤษ ต่อด้วยชื่อสินค้าและตัวเลขในลมหายใจเดียว โมเดลที่ใช้งานได้ต้องรักษาบริบท ระดับภาษา และตัวตนของผู้พูดไว้ตลอด

ขอบเขตคำขึ้นกับบริบท

ตากลม

จุดที่คำหนึ่งจบและอีกคำเริ่ม ขึ้นกับบริบท ก่อนที่โมเดลจะเข้าใจประโยคไทย บางครั้งต้องตัดสินก่อนว่าคำคืออะไร

วรรณยุกต์เปลี่ยนคำ

เสือ · เสื่อ · เสื้อ

พยัญชนะและสระในระบบถอดเป็นอักษรโรมันอาจดูเกือบเหมือนกัน แต่เปลี่ยนวรรณยุกต์แล้วคำก็เปลี่ยน

ความซับซ้อนแบบเดียวกันอยู่ในเอกสารธุรกิจ ชื่อไทยและอังกฤษ ตัวอักษรซ้อน ตัวเลข ตาราง ตราประทับ และโน้ตลายมือต่างแย่งพื้นที่อยู่บนหน้าเดียวกัน

สำหรับเรา สิ่งเหล่านี้คือกรณีปกติ และคืออินพุตจริง

02 / 03

แต่ละปัญหากลายเป็นผลิตภัณฑ์

เราสร้างผลิตภัณฑ์เฉพาะรอบจุดที่ไปป์ไลน์ทั่วไปสะดุด

Text-to-Speechเรือธง

เสียงไทยที่การออกเสียง วรรณยุกต์ จังหวะ คำอังกฤษ ตัวเลข คำย่อ และชื่อ เป็นปัญหาชุดเดียวกัน

AI Translationเปิดให้ใช้งานแล้ว

งานแปลที่เข้าใจบริบท ระดับภาษา ศัพท์ คำยืม และวิธีที่คนไทยเขียนจริง

Speech-to-Textพรีวิวงานวิจัย

การถอดเสียงสำหรับไฟล์เสียงไทยจริง รวมประโยคที่เปลี่ยนภาษาครึ่งทาง พร้อมเวลาระดับคำ

OCRเปิดให้ใช้งานแล้ว

โมเดลที่สร้างมาเพื่ออ่านเอกสารที่คนไทยและธุรกิจไทยใช้จริง

Text-to-Speech, Speech-to-Text, AI Translation และ OCR เปิดใช้งานจริงแล้ว แต่ละตัวเริ่มจาก failure case ในอินพุตภาษาไทยจริงที่ไปป์ไลน์ทั่วไปผ่านไม่ได้

ผลิตภัณฑ์คือบททดสอบ งานวิจัยต้องผ่านอินพุตจริง latency จริง และผู้ใช้จริง

03 / 03

งานวิจัยที่ส่งถึงผู้ใช้

เราเริ่มจากความผิดพลาดในเสียง ภาษา และเอกสารไทยจริง โรดแมปของเราเริ่มจากความผิดพลาดเหล่านั้น

ความผิดพลาดหนึ่งจุดกลายเป็นตัวอย่างข้อมูลและชุดประเมินผล รูปแบบที่เกิดซ้ำส่งผลต่อโมเดล วิธีฝึก และระบบให้บริการ ระบบที่ดีขึ้นกลับเข้าไปในผลิตภัณฑ์ แล้วอินพุตยากชิ้นถัดไปจะบอกเราว่าควรวิจัยอะไรต่อ

ผู้เชี่ยวชาญภาษา นักวิจัยโมเดล และวิศวกรแพลตฟอร์มทำงานในลูปเดียวกัน การออกเสียง ศัพท์ เลย์เอาต์ พฤติกรรม API และความเสถียรใน production จึงไม่ถูกแยกเป็นงานคนละช่วง

ผลลัพธ์ของแล็บคือผลิตภัณฑ์ที่ดีขึ้น

สร้างในกรุงเทพฯ ทดสอบกับภาษาไทยในชีวิตจริง

งานวิจัยมีความหมายเมื่อทำให้ผลิตภัณฑ์มีประโยชน์ขึ้น

paxa-tts-flash-v1

ทีมของเรา

หนึ่งแล็บในกรุงเทพฯ ที่ทำงานด้วยทั้งสองภาษาที่เราสร้างโมเดล

แล็บนี้มีผู้ที่เคยทำงานวิจัย AI ในบริษัทเทคโนโลยีระดับโลก ผู้ที่เคยร่วมงาน Typhoon ตระกูลโมเดลภาษาไทยแบบเปิดของ SCB 10X และผู้ที่เคยดูแลผลิตภัณฑ์ AI ที่มีทราฟฟิกสูงมาก เราขอแนะนำแล็บด้วยหน้าที่ ทุกชั้นที่อยู่ด้านล่างนี้เราดูแลเองทั้งหมด ตั้งแต่ระบบสัทศาสตร์ไปจนถึง API ที่คุณเรียกใช้

งานวิจัยโมเดล

สถาปัตยกรรมและเทคนิคการฝึกโมเดล รวมถึงการฝึกโมเดลทุกตัวที่เราเปิดให้ใช้งาน

ภาษาไทยและข้อมูล

จุดที่ภาษาไทยทำให้ไปป์ไลน์ทั่วไปสะดุด ถูกบันทึกไว้เป็นข้อมูล ชุดประเมินผล และกฎการอ่าน

แพลตฟอร์มและระบบให้บริการ

ดูแลผลิตภัณฑ์ AI ให้เร็วและเสถียรภายใต้โหลดการใช้งานจริง

เสียงเดโมทั้งหมดบนเว็บไซต์นี้ตั้งชื่อตามขนมไทย โมเดลคือหน้าตาสาธารณะของแล็บแห่งนี้

งานวิจัยที่เผยแพร่

เราเผยแพร่วิธีการที่อยู่เบื้องหลังโมเดล รายงานทั้งสองฉบับอยู่บน arXiv พร้อมน้ำหนักโมเดล ชุดทดสอบ และโค้ดประเมินผลที่เปิดให้ใช้งาน

รายงานและสิ่งที่เผยแพร่ทั้งหมด

Text-to-Speech, AI Translation และ OCR เปิดให้เรียกใช้งานจริงแล้ว

อ่านเอกสาร API