คู่มือทำ Audiobook ฉบับมือใหม่ ใช้ AI พากย์เสียงฟรีเปลี่ยนข้อความให้เป็นหนังสือเสียง

อยากทำหนังสือเสียงเป็นของตัวเองสักเล่ม แต่ไม่อยากจ้างนักพากย์ราคาแพงและไม่อยากลงทุนซื้ออุปกรณ์อัดเสียงราคาสูง? ตอนนี้แค่มีคอมพิวเตอร์หรือสมาร์ตโฟนหนึ่งเครื่อง กับเครื่องมือ แปลงข้อความเป็นเสียงพูด ออนไลน์ ก็ทำได้ครบตั้งแต่ต้นฉบับจนเป็นไฟล์พร้อมเผยแพร่ บทความนี้จะพาไปทีละขั้น ตั้งแต่เตรียมข้อความ พากย์ด้วย AI ไปจนตัดต่อและส่งออก

1. ขั้นตอนหลักของการทำหนังสือเสียง

หนังสือเสียงหนึ่งเล่มมี 4 ขั้นตอนใหญ่ ๆ

  1. เตรียมต้นฉบับ จัดเรียงเนื้อหา แก้คำผิด ตรวจเครื่องหมายวรรคตอน และแบ่งบทให้ชัดเจน
  2. สร้างเสียงพากย์ เปลี่ยนข้อความเป็นเสียงพูด สร้างเสียงบรรยายและเสียงตัวละคร
  3. ตัดต่อเสียง รวมไฟล์ ปรับจังหวะเว้นวรรค ลดเสียงรบกวน และทำความดังให้สม่ำเสมอ
  4. ส่งออกและเผยแพร่ เรนเดอร์เป็น MP3 หรือ M4B แล้วอัปโหลดขึ้นแพลตฟอร์ม

ในอดีตขั้นตอนพากย์เสียงคือค่าใช้จ่ายที่สูงที่สุด เพราะการจ้างนักพากย์มืออาชีพหนึ่งบทอาจมีค่าใช้จ่ายหลักพันถึงหลักหมื่นบาท แต่ตอนนี้คุณสามารถใช้ แปลงข้อความเป็นเสียงพูดออนไลน์ ฟรี เพื่อทำขั้นตอนนี้ได้เอง โดยไม่ต้องเสียค่าตัวนักพากย์ และแก้ไขหรืออัดใหม่ได้ไม่จำกัด

2. เตรียมข้อความก่อนป้อนให้ AI

ก่อนจะเอาข้อความไปสร้างเสียงพูด ai ฟรี ควรเตรียมต้นฉบับให้พร้อมเสียก่อน

  • รวมเครื่องหมายวรรคตอนให้เป็นมาตรฐาน AI ใช้เครื่องหมายในการกำหนดจังหวะหยุด ถ้าประโยคยาวเกินไปให้ตัดเป็นประโยคสั้นลง จะทำให้เสียงอ่านเป็นธรรมชาติขึ้นมาก
  • ระวังคำที่ออกเสียงหลายแบบ ภาษาไทยมีคำที่อ่านได้หลายเสียงตามบริบท เช่น คำที่มาจากบาลีสันสกฤต หรือคำย่อบางคำ ควรเขียนคำอ่านกำกับหรือเปลี่ยนเป็นคำที่ออกเสียงตรงกับที่ต้องการ
  • แยกบทสนทนาของตัวละคร ถ้าเป็นนิยาย ควรแยกบรรยายกับคำพูดตัวละครออกจากกัน เพื่อให้ภายหลังกำหนดเสียงคนละแบบได้ง่าย
  • แบ่งไฟล์ตามบท ควรสร้างทีละบท ไม่ควรปล่อยข้อความยาวเป็นหมื่นคำในครั้งเดียว เพราะอาจทำให้ระบบประมวลผลนานหรือผิดพลาดได้

แนะนำให้แต่ละบทมีความยาวประมาณ 3,000–8,000 คำ ซึ่งพอดีกับความยาวตอนละ 20–40 นาที ตามพฤติกรรมผู้ฟังส่วนใหญ่บนแพลตฟอร์มอย่าง Meb, Ookbee, Storytel หรือ Spotify

3. สร้างเสียงพากย์ด้วย AI ฟรี

ขั้นตอนนี้คือหัวใจของงาน แนะนำวิธีต้นทุนศูนย์โดยเปิดหน้า โคลนเสียงฟรี ของ VoxClone ซึ่งมีสองแนวทางให้เลือก

วิธีที่ 1 ใช้เสียงสำเร็จรูป

อัปโหลดหรือวางข้อความแต่ละบท เลือกเสียงที่เหมาะกับเนื้อหา แล้วกดสร้างเสียงได้เลย นี่คือกระบวนการ text to speech ภาษาไทย ฟรี แบบมาตรฐาน ไม่ต้องสมัครสมาชิก text to speech ก็ใช้งานได้ เหมาะกับมือใหม่ที่อยากได้ไฟล์เร็ว ๆ

การเลือกเสียงควรดูโทนเรื่อง เช่น

  • หนังสือสาระหรือบทบรรยาย ควรใช้เสียงกลาง ๆ จังหวะช้าและชัดถ้อยชัดคำ
  • หนังสือเด็ก ควรใช้เสียงสดใส มีชีวิตชีวา
  • เรื่องสืบสวนหรือระทึกขวัญ ควรใช้เสียงทุ้มต่ำ มีน้ำหนัก

วิธีที่ 2 โคลนเสียงตัวเอง

ถ้าอยากได้เอกลักษณ์เฉพาะตัว สามารถอัปโหลดตัวอย่างเสียงคนพูดที่สะอาดยาวประมาณ 10 วินาทีขึ้นไป แล้วใช้ระบบโคลนเสียงตัวเองเพื่อสร้างเสียงเฉพาะสำหรับอ่านทั้งเล่ม ข้อดีคือไม่ต้องส่งข้อมูลส่วนตัว และทดลองปรับได้โดยไม่มีค่าใช้จ่าย เหมาะกับครีเอเตอร์ที่อยากสร้างเสียงนักพากย์อัตโนมัติเป็นแบรนด์ของตัวเอง

เคล็ดลับสำหรับนิยายหลายตัวละคร

กำหนดเสียงให้ตัวละครแต่ละตัว แล้วแยก合成บทสนทนาออกมาต่างหาก จากนั้นนำไปรวมในโปรแกรมตัดต่อตามลำดับเนื้อเรื่อง แม้จะใช้เวลามากขึ้นเล็กน้อย แต่ผลลัพธ์จะทำให้ผู้ฟังแยกตัวละครได้ชัดขึ้นทันที

4. ตัดต่อและส่งออก

เสียงที่สร้างเสร็จยังไม่ควรนำไปเผยแพร่ทันที ควรผ่านการตัดต่อเบา ๆ ก่อน

  • รวมบทเข้าด้วยกัน ใช้ Audacity หรือ CapCut เวอร์ชันฟรีในการเรียงไฟล์ตามลำดับบท
  • ปรับความดังให้เท่ากัน ไฟล์ที่สร้างคนละรอบอาจมีความดังไม่เท่ากัน ใช้การทำ Loudness Normalization เพื่อปรับให้เสมอกัน
  • ใส่ช่วงเงียบ เว้นวรรคระหว่างย่อหน้าประมาณ 0.5–1 วินาที เพื่อให้เหมือนคนพูดหายใจตามธรรมชาติ
  • ใส่เสียงเปิดและปิดบท เริ่มด้วยการอ่านชื่อเรื่องและชื่อบท ปิดท้ายด้วยความเงียบ 2 วินาที

รูปแบบไฟล์ที่แนะนำคือ MP3 ความละเอียด 128 kbps ขึ้นไป ใช้ได้กว้างที่สุด ถ้าจะทำเป็นหนังสือเสียงหลายบทในไฟล์เดียว อาจส่งออกเป็น M4B เพื่อให้ผู้ฟังข้ามบทได้สะดวก และหากต้องผลิตจำนวนมากเป็นประจำ สามารถศึกษาการเรียกใช้ API สังเคราะห์เสียงฟรีเพื่อทำงานอัตโนมัติกับต้นฉบับหลายไฟล์ได้

5. คำถามที่พบบ่อย

ทำหนังสือเสียงด้วย AI ผิดลิขสิทธิ์ไหม?

ประเด็นสำคัญอยู่ที่ตัวต้นฉบับ ถ้าเป็นงานที่คุณเขียนเอง หรือเป็นงานที่หมดอายุลิขสิทธิ์แล้ว ย่อมทำได้อย่างปลอดภัย แต่ถ้าเป็นงานของผู้อื่นต้องได้รับอนุญาตก่อน สำหรับการโคลนเสียงบุคคลอื่น ต้องได้รับความยินยอมจากเจ้าของเสียง และควรระวังข้อกำหนดตาม พ.ร.บ.คุ้มครองข้อมูลส่วนบุคคล (PDPA) รวมถึง พ.ร.บ.ลิขสิทธิ์ ไม่ควรนำเสียงของบุคคลสาธารณะหรือคนดังไปใช้ในเชิงพาณิชย์โดยไม่ได้รับอนุญาต

เสียงจาก TTS ฟรีคุณภาพพอใช้กับหนังสือเสียงจริงไหม?

เครื่องมือสร้างเสียงพูด ai ฟรีในปัจจุบันให้คุณภาพใกล้เคียงเสียงพากย์มืออาชีพมาก ในสถานการณ์ทั่วไปผู้ฟังแยกได้ยากว่าเป็นเสียงสังเคราะห์ ยกเว้นบางอารมณ์สุดขั้ว เช่น ร้องไห้หรือหัวเราะหนัก ๆ ที่เสียงคนจริงยังทำได้ดีกว่า ซึ่งสามารถอัดเพิ่มเฉพาะจุดได้ภายหลัง

โคลนเสียงต้องใช้ตัวอย่างนานแค่ไหน?

โดยทั่วไปตัวอย่างเสียงที่ชัดเจนยาว 10–30 วินาทีก็เพียงพอ ยิ่งตัวอย่างสะอาด ไม่มีเสียงรบกวน พูดจังหวะสม่ำเสมอ และอารมณ์เป็นกลางมากเท่าไร เสียงที่ได้ก็จะใกล้เคียงต้นฉบับมากขึ้น แนะนำให้อัดในห้องเงียบด้วยสมาร์ตโฟนในระยะใกล้

สรุป

การทำหนังสือเสียงในยุคนี้ไม่จำเป็นต้องมีสตูดิโอหรืองบประมาณก้อนใหญ่ เพียงเตรียมข้อความให้เรียบร้อย ใช้เครื่องมือโคลนเสียงฟรีหรือเสียงสำเร็จรูปในการสร้างเสียงพากย์ แล้วตัดต่อเล็กน้อย ก็ได้ไฟล์พร้อมเผยแพร่บน Meb, Ookbee, Storytel, YouTube หรือแพลตฟอร์มพอดแคสต์อย่าง Spotify ได้ทันที ทั้งหมดนี้ทำได้โดยไม่ต้องสมัครสมาชิกและไม่ต้องจ่ายล่วงหน้า ลองเริ่มจากบทสั้น ๆ หนึ่งบทก่อน เมื่อคุ้นขั้นตอนแล้วค่อยทำทั้งเล่ม สำหรับเทคนิคเพิ่มเติมสามารถดูได้ที่ บทเรียนเพิ่มเติม