音量調整器是一種工具,將音訊檔案中每個解碼後的取樣振幅乘以指定的倍率(以 0% 到 400% 的百分比表示),然後將修改後的訊號匯出為新的音訊檔案,而無需重新編碼來源檔。在瀏覽器的實作中,每個有限的取樣會以浮點數讀取,並將每個值乘以線性增益:100% 時振幅不變,50% 時減半,200% 時加倍,0% 時則產生一段保留原始時長與取樣率的靜音 WAV 檔案。接著將結果裁剪至支援的全幅範圍,寫入 16 位元 PCM WAVE 容器,並作為可下載檔案交還給您。包括解碼、增益、裁剪、編碼、預覽與下載在內的整個流程,都在目前的瀏覽器分頁中執行,因此原始音訊絕不會離開您的裝置。這種架構正是百分比表現為精確倍率、而非模糊的「更大聲」旋鈕的原因,也說明了為何此工具能精確回報處理過程中有多少取樣被裁剪。

volume changer explained
音量調整器解析:取樣振幅如何成為 WAV

音量調整器的實際運作方式

音量調整器作用於取樣,而不是感知響度。來源檔案解碼為浮點數聲道取樣緩衝區後,工具會對每個取樣套用一次乘法,並以修改後的振幅重新寫入音訊。您選擇的百分比直接對應這些倍率:50% 表示每個取樣乘以 0.5,200% 表示每個取樣乘以 2,依此類推,範圍涵蓋 Volume Changer 在其滑桿中提供的 0% 到 400%。

由於百分比是套用於振幅而非感知響度,滑桿值與檔案聽感之間的對應關係,取決於原始錄音的內容。200% 的增幅可能讓重度限制過的音軌聽起來與原始版本幾乎相同,但同樣的 200% 套用於安靜的野外錄音,則能將對話提升至可用的音量範圍。音量調整器無法提升已被壓縮之檔案的動態範圍;它只能重新縮放現有的內容。

為何百分比是倍率而非分貝控制

常見的誤解是將 200% 理解為「增加 200 分貝」或「讓檔案音量變成兩倍」,兩者皆不正確。振幅換算成分貝的標準公式為 dB = 20 × log10(倍率)。對於 200%,可得到 20 × log10(2.00) = 20 × 0.30103 ≈ 6.02 dB,因此振幅加倍會產生 6.02 dB 的振幅增加,而不是 6 dB 或 200 dB 的變化。6.02 dB 是一個常數:振幅加倍永遠約為 6.02 dB,振幅變為四倍約為 12.04 dB,減半則約為 −6.02 dB。Volume Changer 並不會套用以分貝為基礎的增益曲線、執行限制器,也無計算 LUFS。它執行的是純粹的乘法,這也正是它能將裁剪以計數方式呈現,而不是以平滑後的響度指標呈現的原因。滑桿的對照數值列於下表中。

百分比線性增益近似振幅變化
0%×0.00靜音(所有取樣皆變為零)
50%×0.50約 −6.02 dB
100%×1.000 dB(無變化)
200%×2.00約 +6.02 dB
400%×4.00約 +12.04 dB

若想更清楚了解此公式的推導過程,線性增益準確度指南以實際範例說明相同的概念,並展示振幅與感知響度之間的界線究竟落在哪裡。

瀏覽器管線如何產生 WAV

Volume Changer 使用瀏覽器的 Web Audio 解碼器(定義於 W3C Web Audio API 1.1 規範),在套用任何增益之前,將整個已編碼檔案轉換為浮點數聲道緩衝區。正因為這單一的解碼步驟,格式支援取決於您的瀏覽器、作業系統與編解碼器版本,而不是固定的伺服器端清單。MP3、WAV、M4A、AAC、Ogg、WebM 與 FLAC 都是可能的輸入格式,但副檔名本身並不保證解碼一定會成功。若解碼失敗,工具會停止並顯示錯誤,而不會產生空白檔案。

緩衝區進入記憶體後,Volume Changer 會將每個有限的取樣乘以所選的增益。高於 +1 或低於 −1 的數值會被裁剪至數位全幅,並由引擎統計有多少取樣跨越了此界線。裁剪計數與裁剪後的峰值會顯示於預覽中,讓您能判斷所選的百分比是否引入了可聞的失真。用於解碼的 AudioContext 在處理完畢後會關閉,前一次結果的物件 URL 會被撤銷,而任務識別碼可避免較舊的非同步解碼覆蓋較新的設定。這正是為什麼變更百分比或檔案時,先前的下載都會失效。

三步驟變更音訊音量

  1. 從您的裝置中選擇一個不超過 50 MiB 的支援音訊檔案,並等待檔案名稱顯示於輸入區域。Volume Changer 接受 MP3、WAV、M4A、AAC、Ogg、WebM 或 FLAC,前提是您的瀏覽器具備解碼該檔案的能力。
  2. 在滑桿上將線性輸出音量設定為 0% 至 400% 之間,然後選擇Change volume。工具會解碼檔案,將每個有限的取樣乘以您的增益,將結果裁剪至 ±1,並準備 WAV 預覽。
  3. 透過合適的耳機或喇叭聆聽完整預覽,檢查報告中的峰值與被裁剪取樣數,然後再下載產生的 -volume-adjusted.wav 檔案。若被裁剪取樣數不為零,或峰值已達全幅,請降低百分比並重新處理檔案。

如何解讀被裁剪取樣報告

設置被裁剪取樣計數器的原因,在於線性增益存在一個硬性上限。在 Web Audio 的表示中,解碼緩衝區內的每個取樣都是介於 −1 與 +1 之間的浮點數。一旦您套用高於 100% 的增益,振幅原本已接近範圍頂端的取樣就會超過 +1 或低於 −1。Volume Changer 會將這些取樣箝制在 ±1,因為 PCM16 格式無法儲存超出該範圍的數值:−32768 對應負全幅,32767 對應正全幅,遵循 Microsoft 所記錄的 WAVE PCM 結構。

被裁剪取樣數不為零,強烈表示您選擇的增益已引入可聞失真,尤其當裁剪後回報的峰值落在全幅時更是如此。零裁剪並不保證理想的感知響度;它僅代表沒有任何取樣需要被限制。若要進行真正的母帶處理並對應響度目標,應使用獨立的測量式音訊工作流程,而不是線性增益工具。

為何輸出是 WAV 而非 MP3 或 AAC

即使來源是有損壓縮格式,輸出仍採用 PCM16 WAV,因為它可在本地端編碼,無需引入第二個有損編解碼器。瀏覽器中的 MP3 與 AAC 編碼通常依賴 JavaScript 編碼器,這會增加額外的相依性與額外產生量化誤差的機會。WAV 能以不經額外來回轉換的方式,精確呈現乘算後的取樣,這也是為什麼預覽、被裁剪取樣報告與下載檔案描述的是同一份資料。其代價是檔案大小:一段五分鐘、44.1 kHz 的立體聲 WAV 約為 53 MB,明顯大於相同內容的 192 kbps MP3。

檔案限制、解碼限制與被捨棄的內容

Volume Changer 套用兩組限制。在編碼端,輸入檔案必須是瀏覽器可解碼的音訊檔案,且大小不超過 50 MiB。在解碼端,工具會拒絕超過五分鐘時長、超過八個聲道,或總聲道取樣數超過 3000 萬的解碼緩衝區。體積小的壓縮檔仍可能因解碼限制而失敗,因為解碼會在任何增益套用之前大幅擴展資料量。

匯出的檔案保留解碼訊號的取樣率、聲道數與時長。來源檔案中的標籤、章節、循環點、cue 標記、編碼器中繼資料與專輯封面均不會保留。若您需要這些中繼資料得以延續,請在下載後重新附加,而不是期待 WAV 會將其一併帶走。也請保留原始檔案,因為此操作無法還原來源中已被裁剪的資訊,且反覆的 PCM 轉換會使版本控管變得複雜。

何時應使用 Volume Changer

當您想增益安靜的錄音、降低過度處理的來源音量,或產生固定時長的靜音占位 WAV 時,請使用 Volume Changer。當您需要感知響度標準化、廣播合規、真峰值限制、LUFS 目標,或任何需要測量式響度的工作流程時,則不適用。這些任務屬於響度計量工作,而非線性增益工作,需要的是能以測量單位而非倍率描述「足夠響度」的工具。對於所有本質上可化約為「將每個取樣以同一數值縮放」的工作,Volume Changer 是更簡潔的選擇。

若您正在權衡各種選項,無需應用程式的音訊音高變換器:瀏覽器工作流程對此有詳細說明。