在 MacBook 上啟用文字轉語音只需幾秒鐘:在 Chrome 或 Safari 中開啟一個瀏覽器工具,貼上最多 20,000 字元的文字,選擇一個可用的系統語音,然後按下朗讀即可。音訊會透過 MacBook 的揚聲器播放,使用的是瀏覽器和作業系統所公開的語音引擎,因此不需要安裝額外的應用程式、不會上傳任何檔案,也不需要建立帳號。閱讀框可接受任何長度的純文字(上限為 20,000 字元),在開始播放前,可透過簡單的滑桿調整速率與音調。朗讀期間,暫停、繼續和停止按鈕會持續顯示,讓你能在任何一個詞彙處操控播放。這些單一功能——本機播放、系統語音、明確的控制項——就是「how to use text to speech on macbook」這個搜尋在實務上的最佳解答,特別適合那些想待在瀏覽器分頁內、不想深入 macOS 輔助使用設定的人。
對大多數讀者而言,動機都是小而具體的:他們有一份想聽它被朗讀出來的草稿、一封想在寄出前聽過一遍的電子郵件、一篇想讓眼睛休息時也能閱讀的文章,或是一份發音不確定的人名清單。macOS 確實內建了文字轉語音功能,只要記得選單路徑和鍵盤快捷鍵,用起來效果不錯。當上述操作太麻煩時,瀏覽器型工具就是解方——開啟分頁、貼上文字,幾秒內就能聽到結果。

MacBook 使用者對朗讀工具的期待
搜尋文字轉語音相關協助的 MacBook 使用者,通常心中已有明確目標:不必離開鍵盤就能聽到自己的文字被播放出來。在人們描述問題時,有三個期待反覆出現。
- 最快聽到聲音。最理想的工作流程是貼上、點擊、聆聽——從開啟工具算起最好在十秒內完成。
- 不透過系統設定就能控制語音。從 MacBook 本身已有的語音中選擇,不必下載額外項目或重新開機。
- 本機處理。文字不會離開裝置,尤其是當草稿包含私人筆記或未公開的內容時。
瀏覽器型工具能滿足這些期待,因為它們是建構在 macOS 已向 Safari 和所有以 Chromium 為基礎的瀏覽器公開的標準化語音引擎之上。Lizely 上的 Text To Speech 工具正是其中之一:它接受最多 20,000 字元的純文字,向瀏覽器索取語音清單,然後把產生的語音內容交給驅動「朗讀所選文字」的同一個本機引擎。
瀏覽器型 TTS 在 macOS 上的運作方式
在底層,這個工作流程相當精簡且有完善文件。當你按下朗讀時,工具會建立一個 SpeechSynthesisUtterance——也就是 MDN SpeechSynthesisUtterance 參考文件 中定義的 JavaScript 物件——設定其文字、語音、速率和音調,再透過瀏覽器的 SpeechSynthesis 介面排入佇列。接著瀏覽器會向作業系統索取可用語音,透過所選的音訊輸出播放語音內容,並在朗讀開始、結束或發生錯誤時觸發事件。
這樣的架構會帶來三個結果。第一,音訊生成在本機進行——沒有遠端合成伺服器,因此文字從不離開你的 MacBook。第二,可用語音的清單就是當前瀏覽器所回報的內容,在 macOS 上,這是已安裝系統語音的子集。第三,較長的段落會被切分成較小的區塊——每段最多 220 個 UTF-16 字碼單位——以維持跨瀏覽器播放的穩定性,切分器會優先在句子邊界切開,其次是子句標點,再來是空白,最後才在單一未中斷的詞彙異常冗長時進行硬切。
在 MacBook 上朗讀內容:逐步教學
在 MacBook 上的完整步驟簡短且可重現,在 Chrome、Safari、Edge 和 Firefox 中的操作都相同。
- 在 MacBook 的瀏覽器分頁中開啟 Text To Speech 工具。
- 點擊閱讀框內部,貼上或輸入你想聽的段落。支援最多 20,000 字元的純文字。
- 等待語音選擇器載入完成。如果你的瀏覽器公開了系統語音清單,請挑選想要的那個。如果沒有清單出現,代表瀏覽器並未公開可供選擇的語音清單。
- 如需要,可調整速率(0.5× 到 2.0×)和音調(0.5 到 2.0)——兩者都保留在 1.0 即為預設速度和音色。
- 按下朗讀。音訊幾乎會立即透過 MacBook 揚聲器或連接的耳機開始播放。
- 使用暫停可在朗讀到一半時停下、繼續可接續播放、停止則會完全結束朗讀。
- 編輯文字或變更設定以重新開始。工具會取消先前的佇列,並將新文字視為全新的朗讀。
上述步驟涵蓋所有支援的互動。不需要安裝任何東西、不必啟用擴充功能,也不需要在首次使用時接受任何權限對話框。
速率、音調與你實際會看到的滑桿
工具中的速率和音調控制項,直接對應到 SpeechSynthesisUtterance.rate 與 SpeechSynthesisUtterance.pitch。兩者都是標準化數值,由瀏覽器傳遞給語音引擎,且都被限制在文件記載的含端點範圍內。下表顯示工具強制執行的上下限,以及在 macOS 上滑桿兩端通常聽起來的感覺。
| 控制項 | 允許範圍 | 低端效果 | 高端效果 |
|---|---|---|---|
| 速率 | 0.5 – 2.0 | 緩慢、從容、較易跟上 | 快速,在最高極端時偶爾會有截斷感 |
| 音調 | 0.5 – 2.0 | 較低、較沉的音色 | 較高、較明亮的音色 |
這些只是控制數值,並非實際測量出的每秒字數或音樂半音。不同的語音引擎對其解讀略有差異,因此在同一部 MacBook 上,Safari 中的 1.5× 速率聽起來不一定和 Chrome 中的 1.5× 完全相同。如果某個語音即使在 0.5× 最低速率下仍讀得太快,通常的解法是縮短文字長度,而不是去動一個已處於最左端的滑桿。
為何在每部 Mac 上語音聽起來都不一樣
經常在多部 Mac 之間切換的使用者會很快注意到,各裝置的語音清單並不相同。這是預期行為,而非錯誤。語音可用性、語言涵蓋範圍、口音品質,甚至音訊忠實度,全都來自當前的 macOS 安裝版本,而非來自 Text To Speech 工具本身。macOS 預設會公開一組較小的內建精簡語音,並透過系統設定 → 輔助使用 → 語音內容提供更高品質的可下載語音。已下載「Samantha (Premium)」的 MacBook 會顯示該語音,而另一部機器可能只顯示內建的精簡版「Samantha」;設定為其他系統語言的 MacBook,也可能出現純英文 MacBook 永遠不會列出的語音。
工具本身的職責很明確:讓你挑選當前瀏覽器所公開的任何語音,並把該名稱傳入語音內容中。安裝或下載額外的作業系統語音不在其範圍內——若你想要更豐富的語音庫,下一步是到 macOS 設定中處理,而不是在瀏覽器分頁裡進行。
這個工具能做與不能做的事
先列一張簡明的支援行為對照表,有助於讓 MacBook 使用者對工具的能力建立合理期待,避免要求它執行從未設計要做的任務。
| 任務 | 工具是否支援? |
|---|---|
| 朗讀最多 20,000 字元的文字 | 是 |
| 從瀏覽器回報的系統語音中選擇 | 是 |
| 設定速率於 0.5× 與 2.0× 之間 | 是 |
| 設定音調於 0.5 與 2.0 之間 | 是 |
| 在朗讀中途暫停、繼續與停止 | 是 |
| 將朗讀音訊下載為 MP3 或 WAV | 否 |
| 取代螢幕報讀軟體以供輔助使用 | 否 |
| 作為伺服器端 TTS 引擎運作 | 否 |
其中有兩列值得再次閱讀。第一,這個工具不是螢幕報讀軟體——它不會報讀焦點、不會導覽地標、不會朗讀控制項,也不會公開語意角色。若在 MacBook 上需要這些功能,請使用 VoiceOver 或由維護中的第三方螢幕報讀軟體。第二,音訊無法匯出為檔案,因為標準化的 Web Speech API 只公開播放控制項,並未提供可攜式的音訊緩衝區。若你需要在 MacBook 上產出可重複使用的錄音,必須透過另一套獨立工具來擷取系統音訊,這屬於不同的工作流程,且涉及不同的授權考量。
當音訊無法播放時的快速排除方式
偶爾會有 MacBook 使用者按下朗讀卻什麼都聽不到。最常見的原因既單純也容易依序排除。
- 確認 MacBook 沒有靜音、輸出音量也不為零。選單列上的系統音量滑桿同樣會影響瀏覽器的音訊。
- 確認文字框不是空的,也不僅包含空白字元;工具會在把語音排入佇列之前,先拒絕空白的輸入內容。
- 檢查文字是否超過 20,000 字元。若已超過,請拆成兩段分別朗讀。
- 查看狀態列。若工具回報播放錯誤,可能是瀏覽器要求必須有使用者手勢、未公開任何語音清單,或拒絕所選的語音。若有列出其他語音,請嘗試改用不同語音,或重新載入分頁再試一次。
- 重新載入分頁。若早先 session 留下的語音內容仍佔用著合成佇列,重新載入即可將其取消。
- 使用 Option+Esc 快捷鍵測試 macOS 的「朗讀所選文字」。若該功能也失敗,表示問題發生在工具的上游——通常是缺少語音下載、輸出裝置設定錯誤,或是有內容封鎖程式抑制了音訊。
若上述六項檢查皆通過,音訊仍然無法播放,問題幾乎可以確定不在工具本身:可能是瀏覽器的語音引擎被旗標或擴充功能停用、macOS 的語音快取損毀,或音訊輸出裝置已被重新指定。重新啟動 MacBook 通常能清除這些狀態,使播放功能恢復正常,無需再做任何調整。
延伸閱讀:在 iPhone 上計算按鍵次數:在 Safari 中計算按鍵。
延伸閱讀:在信頭產生器中,文字輸入能否注入 SVG 標記。