เลือกภาษา

เครื่องมือคำนวณขนาดไฟล์เสียงและพื้นที่จัดเก็บ

คำนวณขนาดไฟล์เสียง PCM แบบไม่บีบอัด ทั้ง WAV และ AIFF ตามค่า Sample Rate, Bit Depth และจำนวนแชนแนล พร้อมแสดงอัตราบิตเรตแบบเรียลไทม์

Mehmet Demiray (เมห์เมต เดมิเรย์) เผยแพร่ อัปเดตล่าสุด
แชร์
ความยาวของการบันทึกเสียง

การคำนวณไฟล์เสียงแบบไม่บีบอัดทำได้ง่ายๆ: อัตราสุ่มตัวอย่าง × ความลึกของบิต × จำนวนช่องสัญญาณ จะได้บิตต่อวินาที และคูณด้วยระยะเวลาเพื่อหาขนาดรวม

ขนาดไฟล์ใช้หน่วยฐานสิบ (1 MB = 1,000,000 ไบต์) ตามมาตรฐานผู้ผลิตอุปกรณ์จัดเก็บข้อมูล ระบบปฏิบัติการของคุณอาจแสดงค่าน้อยกว่าเล็กน้อยเนื่องจากการคำนวณแบบฐานสอง

สำหรับอ้างอิง: FLAC จะลดขนาดลงประมาณ 40-60% โดยไม่สูญเสียคุณภาพเสียง และ MP3 ขนาด 320 kbps จะมีขนาดประมาณ 2.4 MB ต่อนาทีไม่ว่าจะตั้งค่าต้นฉบับไว้อย่างไร

ปัจจัยกำหนดขนาดไฟล์เสียงดิจิทัลแบบไม่บีบอัด

ขนาดของไฟล์เสียงดิจิทัลประเภทที่ไม่ผ่านการบีบอัดข้อมูล เช่น WAV หรือ AIFF ถูกกำหนดโดยตัวแปรทางคณิตศาสตร์สี่ประการอย่างชัดเจน ได้แก่ อัตราสุ่มตัวอย่าง (Sample Rate) ความลึกบิต (Bit Depth) จำนวนแชนเนล (Channels) และระยะเวลาของเสียง โดยไม่มีข้อมูลสูญหายจากการเข้ารหัส

อัตราสุ่มตัวอย่างวัดเป็นหน่วยเฮิรตซ์ (Hz) หรือกิโลเฮิรตซ์ (kHz) ซึ่งเป็นจำนวนภาพถ่ายของคลื่นเสียงที่ถูกบันทึกในหนึ่งวินาที ยิ่งสุ่มตัวอย่างถี่ ความถี่สูงก็ยิ่งถูกเก็บไว้ได้แม่นยำ ส่วนความลึกบิตคือความละเอียดในการเก็บระดับความดังของแต่ละภาพถ่าย เช่น 16 บิตให้ระดับความดังได้ 65,536 ระดับ และ 24 บิตให้ได้มากกว่า 16,777,216 ระดับ เมื่อคูณค่าเหล่านี้ด้วยจำนวนแชนเนล เช่น 1 แชนเนลสำหรับโมโน หรือ 2 แชนเนลสำหรับสเตอริโอ ขนาดข้อมูลต่อวินาทีจะเพิ่มขึ้นเป็นสัดส่วนตรงกัน

สมการหลักในการคำนวณหาขนาดไฟล์ในหน่วยไบต์คือ

ไบต์=อัตราสุ่มตัวอย่าง×ความลึกบิต8×จำนวนแชนเนล×วินาที\text{ไบต์} = \text{อัตราสุ่มตัวอย่าง} \times \frac{\text{ความลึกบิต}}{8} \times \text{จำนวนแชนเนล} \times \text{วินาที}

เครื่องมือคำนวณขนาดไฟล์เสียงใช้หลักการทางคณิตศาสตร์นี้เพื่อประเมินขนาดข้อมูลดิบ (Raw PCM) ได้ทันที โดยโครงสร้างส่วนหัวของไฟล์เสียงอย่าง WAV Header มีขนาดเพียงประมาณ 44 ไบต์ ซึ่งส่งผลต่อขนาดโดยรวมน้อยมากจนตัดทิ้งได้

ค่ามาตรฐานเสียงและการคำนวณขนาดไฟล์ที่พบบ่อย

ในงานโปรดักชันเสียงมีค่ามาตรฐานที่นิยมใช้งานอยู่หลายระดับ ซึ่งแต่ละระดับสร้างขนาดข้อมูลที่แตกต่างกันอย่างมาก การเข้าใจขนาดมาตรฐานช่วยให้วางแผนการส่งมอบงานและการอัปโหลดได้แม่นยำ

มาตรฐานการบันทึก การตั้งค่า (kHz/bit) แชนเนล ขนาดต่อนาที (MB) ขนาดเพลง 3.5 นาที (MB)
คุณภาพซีดีเพลง (CD Audio) 44.1 / 16 สเตอริโอ 10.58 37.04
มาตรฐานสตูดิโอและวิดีโอ 48 / 24 สเตอริโอ 17.28 60.48
เสียงความละเอียดสูง (Hi-Res) 96 / 24 สเตอริโอ 34.56 120.96
ระบบเสียงรอบทิศทาง 5.1 48 / 24 6 แชนเนล 51.84 181.44

หากต้องการคำนวณบิตเรตดิบของสัญญาณเสียง สามารถใช้สมการความสัมพันธ์ดังนี้

บิตเรต (kbps)=อัตราสุ่มตัวอย่าง×ความลึกบิต×จำนวนแชนเนล1000\text{บิตเรต (kbps)} = \frac{\text{อัตราสุ่มตัวอย่าง} \times \text{ความลึกบิต} \times \text{จำนวนแชนเนล}}{1000}

ตัวอย่างเช่น สัญญาณเสียงระดับ 96 kHz และ 24 บิต แบบสเตอริโอ มีอัตราบิตเรตอยู่ที่ 4,608 kbps ซึ่งเทียบเท่ากับประมาณ 34.56 MB ต่อหนึ่งนาที เมื่อทำขั้นตอนสุดท้ายของงานเสร็จ การตรวจสอบค่าความดังผ่าน เครื่องมือวัดความดัง LUFS ควบคู่ไปกับการเช็กขนาดไฟล์จะช่วยให้งานตรงตามเกณฑ์ของแพลตฟอร์มสตรีมมิง

การวางแผนพื้นที่จัดเก็บสำหรับเซสชันสตูดิโอ

การบันทึกเสียงแบบหลายแทร็ก (Multitrack Recording) ใช้พื้นที่ฮาร์ดดิสก์มากกว่าขนาดของเพลงสเตอริโอที่มิกซ์เสร็จแล้วหลายเท่าตัว เพราะทุกแทร็กที่อัดจะสร้างไฟล์ WAV แยกเป็นของตัวเอง

ตัวอย่างการคำนวณขนาดเซสชันอัดวงดนตรีความยาว 4 นาที ที่มาตรฐาน 48 kHz / 24 บิต:

  1. แทร็กโมโน 1 แทร็กความยาว 4 นาที ใช้พื้นที่ประมาณ 34.56 MB
  2. กลองชุด 8 ไมค์ กีตาร์ 4 ไมค์ เบส 2 ช่อง และร้อง 2 ช่อง รวมเป็น 16 แทร็ก จะใช้พื้นที่รอบละ 552.96 MB
  3. เมื่อบันทึกทั้งหมด 4 รอบการเล่น (Takes) ขนาดข้อมูลรวมจะอยู่ที่ประมาณ 2.21 GB

สำหรับงานพอดแคสต์ การบันทึกเสียงผู้ร่วมรายการ 2 คน คนละ 1 แทร็กโมโน ที่ระดับ 48 kHz / 24 บิต เป็นเวลา 60 นาที จะใช้พื้นที่จัดเก็บประมาณ 1.04 GB ก่อนเข้าสู่ขั้นตอนตัดต่อ การใช้เครื่องมือคำนวณขนาดไฟล์เสียงช่วยให้สามารถประเมินพื้นที่ไดรฟ์สำรองข้อมูลล่วงหน้าได้อย่างปลอดภัย

ความคุ้มค่าของการบันทึกเสียงระดับความละเอียดสูงและระบบ 32-bit Float

การเลือกความละเอียดในการบันทึกเสียงส่งผลต่อการใช้พื้นที่หน่วยความจำโดยตรง จึงจำเป็นต้องพิจารณาความเหมาะสมตามลักษณะงานจริง

การบันทึกที่ 96 kHz หรือ 192 kHz ให้ประโยชน์สำคัญในขั้นตอนการประมวลผล เช่น การยืดหดเวลาของเสียง (Time-stretching) หรือการสังเคราะห์เสียงซาวด์ดีไซน์ที่ไม่ต้องการให้เกิดการเพี้ยนของฮาร์มอนิกส์ แต่สำหรับงานบรรยายทั่วไปหรือพอดแคสต์ การใช้ความละเอียดสูงระดับนี้จะทำให้ไฟล์มีขนาดใหญ่เกินจำเป็นโดยไม่ส่งผลต่อคุณภาพเสียงที่ผู้ฟังทั่วไปรับรู้ได้

ในงานบันทึกเสียงภาคสนาม (Field Recording) รูปแบบ 32 บิตแบบทศนิยมลอยตัว (32-bit Float) ได้รับความนิยมสูงเนื่องจากรองรับช่วงไดนามิกมหาศาลโดยสัญญาณไม่แตกพร่า แม้ไฟล์จะมีขนาดใหญ่กว่าระบบ 24 บิตประมาณ 33.33% แต่ช่วยป้องกันความเสียหายของเสียงที่ไม่สามารถอัดซ้ำได้ ซึ่งคุ้มค่าต่อการจัดสรรพื้นที่จัดเก็บเพิ่มเติม

ข้อผิดพลาดที่พบบ่อยในการคำนวณและจัดการไฟล์เสียง

ความเข้าใจผิดเกี่ยวกับการคำนวณขนาดไฟล์เสียงมักเกิดขึ้นจากหน่วยนับและคุณสมบัติของการบีบอัดข้อมูลที่แตกต่างกัน

ข้อผิดพลาดประการแรกคือการสับสนระหว่างกิโลบิตต่อวินาที (kbps) กับกิโลไบต์ต่อวินาที (kB/s) โดยอัตราบิตเรตในระบบดิจิทัลมักระบุเป็นบิต ทำให้ตัวเลขดูสูง เช่น บิตเรต 1,411 kbps ของไฟล์ WAV คุณภาพซีดี แท้จริงแล้วกินพื้นที่บันทึกประมาณ 176.4 kB/s เท่านั้นเมื่อแปลงเป็นหน่วยไบต์

ข้อผิดพลาดประการที่สองคือการนำสมการของไฟล์ไม่บีบอัดไปใช้กับไฟล์ MP3 หรือ AAC ไฟล์ MP3 บิตเรตคงที่ 320 kbps จะใช้พื้นที่ราว 2.4 MB ต่อนาทีเสมอ ไม่ว่าจะถูกแปลงมาจากไฟล์ต้นฉบับ 44.1 kHz หรือ 96 kHz ก็ตาม

ข้อผิดพลาดประการสุดท้ายคือความแตกต่างของหน่วยฐานสอง (Binary MiB) ในระบบปฏิบัติการบางระบบ กับหน่วยฐานสิบ (Decimal MB) ที่ผู้ผลิตสื่อบันทึกข้อมูลและเครื่องมือคำนวณออนไลน์ใช้งาน ไฟล์ขนาด 100 MB ในระบบฐานสิบจะแสดงผลเป็นประมาณ 95.37 MiB บนคอมพิวเตอร์ ซึ่งเป็นเพียงความต่างของมาตรวัด ไม่ใช่การสูญหายของข้อมูลเสียง

คำถามที่เราตอบบ่อยที่สุด

ทำไมไฟล์ WAV ถึงมีขนาดใหญ่กว่าไฟล์ MP3 ของเพลงเดียวกันหลายเท่า

ไฟล์ WAV และ AIFF เป็นรูปแบบไฟล์เสียงแบบไม่บีบอัด ซึ่งจัดเก็บข้อมูลคลื่นเสียงครบถ้วนทุกจุดตามความละเอียดที่บันทึก เพลงสเตอริโอคุณภาพระดับแผ่นซีดีความยาว 3.5 นาที จึงมีขนาดประมาณ 37 MB ในขณะที่ไฟล์ MP3 ทำการบีบอัดข้อมูลแบบตัดทอนความถี่เสียงที่หูมนุษย์แทบไม่ได้ยินออกไป ที่ระดับบิตเรต 320 kbps เพลงเดียวกันจะใช้พื้นที่เพียงประมาณ 8.4 MB

เหตุใดขนาดไฟล์ที่คำนวณได้จึงต่างจากขนาดไฟล์ที่ระบบปฏิบัติการแสดงผล

เครื่องมือคำนวณขนาดไฟล์เสียงใช้หน่วยวัดฐานสิบตามมาตรฐานสากล โดยกำหนดให้ 1 MB เท่ากับ 1,000,000 ไบต์ แต่ระบบปฏิบัติการบางระบบ เช่น Windows จะคำนวณขนาดไฟล์ด้วยระบบฐานสอง ซึ่ง 1 MiB เท่ากับ 1,048,576 ไบต์ ส่งผลให้ไฟล์เสียงขนาด 100 MB ตามการคำนวณฐานสิบ แสดงผลเป็นขนาดประมาณ 95.37 MB บนหน้าต่างแสดงผลของคอมพิวเตอร์ แม้ปริมาณข้อมูลจริงจะเท่ากัน

ควรตั้งค่า Sample Rate และ Bit Depth เท่าไรสำหรับการบันทึกพอดแคสต์และเพลง

งานพอดแคสต์หรือเสียงพูดทั่วไป นิยมบันทึกแบบโมโนที่ความละเอียด 48 kHz และ 24-bit ซึ่งไฟล์ความยาว 60 นาทีจะใช้พื้นที่ประมาณ 518 MB สำหรับงานเพลง แนะนำให้บันทึกที่ 48 kHz หรือ 44.1 kHz ที่ความลึก 24-bit เพื่อให้มีเฮดรูมและไดนามิกเรนจ์เพียงพอต่อการมิกซ์เสียง จากนั้นจึงทำการตรวจสอบความดังด้วย เครื่องมือวัดค่า LUFS ก่อนส่งไฟล์ไปยังแพลตฟอร์มสตรีมมิง

วิธีวางแผนคำนวณพื้นที่จัดเก็บข้อมูลสำหรับงานบันทึกเสียงแบบหลายแทร็ก

การบันทึกเสียงแบบมัลติแทร็ก ขนาดพื้นที่ที่ต้องใช้จะคูณตามจำนวนแทร็กที่เปิดใช้งานพร้อมกัน ตัวอย่างเช่น การบันทึกเสียงวงดนตรีสดจำนวน 24 แทร็ก ที่ความละเอียด 48 kHz และ 24-bit แต่ละแทร็กโมโนจะใช้พื้นที่ประมาณ 8.64 MB ต่อนาที เมื่อบันทึกต่อเนื่องเป็นเวลา 60 นาที จะต้องเตรียมพื้นที่จัดเก็บข้อมูลในฮาร์ดไดรฟ์อย่างน้อย 12.4 GB สำหรับหนึ่งเทก

การบันทึกเสียงแบบ 32-bit Float หรือ 96 kHz จำเป็นหรือไม่ และกินพื้นที่มากเท่าใด

การบันทึกเสียงที่ 96 kHz และ 24-bit ในระบบสเตอริโอ ต้องใช้พื้นที่สูงถึง 34.6 MB ต่อนาที เหมาะสำหรับงานบันทึกเสียงบรรยากาศภาคสนามที่ต้องนำมาปรับลดระดับเสียงหรือทำซาวด์ดีไซน์ สำหรับระบบ 32-bit Float จะช่วยป้องกันเสียงแตกพร่าจากระดับสัญญาณที่แรงเกินไป แต่จะใช้ขนาดไฟล์เพิ่มขึ้นจากระบบ 24-bit ราว 33.3% สำหรับงานโปรดักชันทั่วไป การเลือกใช้ 48 kHz และ 24-bit ถือเป็นจุดสมดุลที่ดีที่สุดระหว่างคุณภาพและขนาดพื้นที่

ไฟล์แบบ FLAC ช่วยประหยัดพื้นที่จัดเก็บข้อมูลได้มากน้อยเพียงใดเมื่อเทียบกับ WAV

รูปแบบ FLAC เป็นการบีบอัดข้อมูลเสียงแบบไม่สูญเสียรายละเอียด สามารถลดขนาดไฟล์ลงได้ประมาณ 40% ถึง 60% เมื่อเทียบกับไฟล์ WAV หรือ AIFF ดั้งเดิม โดยที่คุณภาพเสียงยังคงความสมบูรณ์เหมือนต้นฉบับทุกประการ จึงเหมาะสำหรับการสำรองข้อมูลโปรเจกต์เสียงระยะยาวเพื่อประหยัดพื้นที่สตอเรจ