คู่มือทำ Audiobook ฉบับมือใหม่ ใช้ AI พากย์เสียงฟรีเปลี่ยนข้อความให้เป็นหนังสือเสียง
อยากทำหนังสือเสียงเป็นของตัวเองสักเล่ม แต่ไม่อยากจ้างนักพากย์ราคาแพงและไม่อยากลงทุนซื้ออุปกรณ์อัดเสียงราคาสูง? ตอนนี้แค่มีคอมพิวเตอร์หรือสมาร์ตโฟนหนึ่งเครื่อง กับเครื่องมือ แปลงข้อความเป็นเสียงพูด ออนไลน์ ก็ทำได้ครบตั้งแต่ต้นฉบับจนเป็นไฟล์พร้อมเผยแพร่ บทความนี้จะพาไปทีละขั้น ตั้งแต่เตรียมข้อความ พากย์ด้วย AI ไปจนตัดต่อและส่งออก
1. ขั้นตอนหลักของการทำหนังสือเสียง
หนังสือเสียงหนึ่งเล่มมี 4 ขั้นตอนใหญ่ ๆ
- เตรียมต้นฉบับ จัดเรียงเนื้อหา แก้คำผิด ตรวจเครื่องหมายวรรคตอน และแบ่งบทให้ชัดเจน
- สร้างเสียงพากย์ เปลี่ยนข้อความเป็นเสียงพูด สร้างเสียงบรรยายและเสียงตัวละคร
- ตัดต่อเสียง รวมไฟล์ ปรับจังหวะเว้นวรรค ลดเสียงรบกวน และทำความดังให้สม่ำเสมอ
- ส่งออกและเผยแพร่ เรนเดอร์เป็น MP3 หรือ M4B แล้วอัปโหลดขึ้นแพลตฟอร์ม
ในอดีตขั้นตอนพากย์เสียงคือค่าใช้จ่ายที่สูงที่สุด เพราะการจ้างนักพากย์มืออาชีพหนึ่งบทอาจมีค่าใช้จ่ายหลักพันถึงหลักหมื่นบาท แต่ตอนนี้คุณสามารถใช้ แปลงข้อความเป็นเสียงพูดออนไลน์ ฟรี เพื่อทำขั้นตอนนี้ได้เอง โดยไม่ต้องเสียค่าตัวนักพากย์ และแก้ไขหรืออัดใหม่ได้ไม่จำกัด
2. เตรียมข้อความก่อนป้อนให้ AI
ก่อนจะเอาข้อความไปสร้างเสียงพูด ai ฟรี ควรเตรียมต้นฉบับให้พร้อมเสียก่อน
- รวมเครื่องหมายวรรคตอนให้เป็นมาตรฐาน AI ใช้เครื่องหมายในการกำหนดจังหวะหยุด ถ้าประโยคยาวเกินไปให้ตัดเป็นประโยคสั้นลง จะทำให้เสียงอ่านเป็นธรรมชาติขึ้นมาก
- ระวังคำที่ออกเสียงหลายแบบ ภาษาไทยมีคำที่อ่านได้หลายเสียงตามบริบท เช่น คำที่มาจากบาลีสันสกฤต หรือคำย่อบางคำ ควรเขียนคำอ่านกำกับหรือเปลี่ยนเป็นคำที่ออกเสียงตรงกับที่ต้องการ
- แยกบทสนทนาของตัวละคร ถ้าเป็นนิยาย ควรแยกบรรยายกับคำพูดตัวละครออกจากกัน เพื่อให้ภายหลังกำหนดเสียงคนละแบบได้ง่าย
- แบ่งไฟล์ตามบท ควรสร้างทีละบท ไม่ควรปล่อยข้อความยาวเป็นหมื่นคำในครั้งเดียว เพราะอาจทำให้ระบบประมวลผลนานหรือผิดพลาดได้
แนะนำให้แต่ละบทมีความยาวประมาณ 3,000–8,000 คำ ซึ่งพอดีกับความยาวตอนละ 20–40 นาที ตามพฤติกรรมผู้ฟังส่วนใหญ่บนแพลตฟอร์มอย่าง Meb, Ookbee, Storytel หรือ Spotify
3. สร้างเสียงพากย์ด้วย AI ฟรี
ขั้นตอนนี้คือหัวใจของงาน แนะนำวิธีต้นทุนศูนย์โดยเปิดหน้า โคลนเสียงฟรี ของ VoxClone ซึ่งมีสองแนวทางให้เลือก
วิธีที่ 1 ใช้เสียงสำเร็จรูป
อัปโหลดหรือวางข้อความแต่ละบท เลือกเสียงที่เหมาะกับเนื้อหา แล้วกดสร้างเสียงได้เลย นี่คือกระบวนการ text to speech ภาษาไทย ฟรี แบบมาตรฐาน ไม่ต้องสมัครสมาชิก text to speech ก็ใช้งานได้ เหมาะกับมือใหม่ที่อยากได้ไฟล์เร็ว ๆ
การเลือกเสียงควรดูโทนเรื่อง เช่น
- หนังสือสาระหรือบทบรรยาย ควรใช้เสียงกลาง ๆ จังหวะช้าและชัดถ้อยชัดคำ
- หนังสือเด็ก ควรใช้เสียงสดใส มีชีวิตชีวา
- เรื่องสืบสวนหรือระทึกขวัญ ควรใช้เสียงทุ้มต่ำ มีน้ำหนัก
วิธีที่ 2 โคลนเสียงตัวเอง
ถ้าอยากได้เอกลักษณ์เฉพาะตัว สามารถอัปโหลดตัวอย่างเสียงคนพูดที่สะอาดยาวประมาณ 10 วินาทีขึ้นไป แล้วใช้ระบบโคลนเสียงตัวเองเพื่อสร้างเสียงเฉพาะสำหรับอ่านทั้งเล่ม ข้อดีคือไม่ต้องส่งข้อมูลส่วนตัว และทดลองปรับได้โดยไม่มีค่าใช้จ่าย เหมาะกับครีเอเตอร์ที่อยากสร้างเสียงนักพากย์อัตโนมัติเป็นแบรนด์ของตัวเอง
เคล็ดลับสำหรับนิยายหลายตัวละคร
กำหนดเสียงให้ตัวละครแต่ละตัว แล้วแยก合成บทสนทนาออกมาต่างหาก จากนั้นนำไปรวมในโปรแกรมตัดต่อตามลำดับเนื้อเรื่อง แม้จะใช้เวลามากขึ้นเล็กน้อย แต่ผลลัพธ์จะทำให้ผู้ฟังแยกตัวละครได้ชัดขึ้นทันที
4. ตัดต่อและส่งออก
เสียงที่สร้างเสร็จยังไม่ควรนำไปเผยแพร่ทันที ควรผ่านการตัดต่อเบา ๆ ก่อน
- รวมบทเข้าด้วยกัน ใช้ Audacity หรือ CapCut เวอร์ชันฟรีในการเรียงไฟล์ตามลำดับบท
- ปรับความดังให้เท่ากัน ไฟล์ที่สร้างคนละรอบอาจมีความดังไม่เท่ากัน ใช้การทำ Loudness Normalization เพื่อปรับให้เสมอกัน
- ใส่ช่วงเงียบ เว้นวรรคระหว่างย่อหน้าประมาณ 0.5–1 วินาที เพื่อให้เหมือนคนพูดหายใจตามธรรมชาติ
- ใส่เสียงเปิดและปิดบท เริ่มด้วยการอ่านชื่อเรื่องและชื่อบท ปิดท้ายด้วยความเงียบ 2 วินาที
รูปแบบไฟล์ที่แนะนำคือ MP3 ความละเอียด 128 kbps ขึ้นไป ใช้ได้กว้างที่สุด ถ้าจะทำเป็นหนังสือเสียงหลายบทในไฟล์เดียว อาจส่งออกเป็น M4B เพื่อให้ผู้ฟังข้ามบทได้สะดวก และหากต้องผลิตจำนวนมากเป็นประจำ สามารถศึกษาการเรียกใช้ API สังเคราะห์เสียงฟรีเพื่อทำงานอัตโนมัติกับต้นฉบับหลายไฟล์ได้
5. คำถามที่พบบ่อย
ทำหนังสือเสียงด้วย AI ผิดลิขสิทธิ์ไหม?
ประเด็นสำคัญอยู่ที่ตัวต้นฉบับ ถ้าเป็นงานที่คุณเขียนเอง หรือเป็นงานที่หมดอายุลิขสิทธิ์แล้ว ย่อมทำได้อย่างปลอดภัย แต่ถ้าเป็นงานของผู้อื่นต้องได้รับอนุญาตก่อน สำหรับการโคลนเสียงบุคคลอื่น ต้องได้รับความยินยอมจากเจ้าของเสียง และควรระวังข้อกำหนดตาม พ.ร.บ.คุ้มครองข้อมูลส่วนบุคคล (PDPA) รวมถึง พ.ร.บ.ลิขสิทธิ์ ไม่ควรนำเสียงของบุคคลสาธารณะหรือคนดังไปใช้ในเชิงพาณิชย์โดยไม่ได้รับอนุญาต
เสียงจาก TTS ฟรีคุณภาพพอใช้กับหนังสือเสียงจริงไหม?
เครื่องมือสร้างเสียงพูด ai ฟรีในปัจจุบันให้คุณภาพใกล้เคียงเสียงพากย์มืออาชีพมาก ในสถานการณ์ทั่วไปผู้ฟังแยกได้ยากว่าเป็นเสียงสังเคราะห์ ยกเว้นบางอารมณ์สุดขั้ว เช่น ร้องไห้หรือหัวเราะหนัก ๆ ที่เสียงคนจริงยังทำได้ดีกว่า ซึ่งสามารถอัดเพิ่มเฉพาะจุดได้ภายหลัง
โคลนเสียงต้องใช้ตัวอย่างนานแค่ไหน?
โดยทั่วไปตัวอย่างเสียงที่ชัดเจนยาว 10–30 วินาทีก็เพียงพอ ยิ่งตัวอย่างสะอาด ไม่มีเสียงรบกวน พูดจังหวะสม่ำเสมอ และอารมณ์เป็นกลางมากเท่าไร เสียงที่ได้ก็จะใกล้เคียงต้นฉบับมากขึ้น แนะนำให้อัดในห้องเงียบด้วยสมาร์ตโฟนในระยะใกล้
สรุป
การทำหนังสือเสียงในยุคนี้ไม่จำเป็นต้องมีสตูดิโอหรืองบประมาณก้อนใหญ่ เพียงเตรียมข้อความให้เรียบร้อย ใช้เครื่องมือโคลนเสียงฟรีหรือเสียงสำเร็จรูปในการสร้างเสียงพากย์ แล้วตัดต่อเล็กน้อย ก็ได้ไฟล์พร้อมเผยแพร่บน Meb, Ookbee, Storytel, YouTube หรือแพลตฟอร์มพอดแคสต์อย่าง Spotify ได้ทันที ทั้งหมดนี้ทำได้โดยไม่ต้องสมัครสมาชิกและไม่ต้องจ่ายล่วงหน้า ลองเริ่มจากบทสั้น ๆ หนึ่งบทก่อน เมื่อคุ้นขั้นตอนแล้วค่อยทำทั้งเล่ม สำหรับเทคนิคเพิ่มเติมสามารถดูได้ที่ บทเรียนเพิ่มเติม