iPhone 個人語音教學:用自己的聲音打字說話

先看結論

在「設定」App 依序點選「輔助使用」→「個人語音」→「建立個人語音」,唸完約一百五十句提示語並完成裝置端訓練後,就能在「輔助使用」→「即時語音」中選用這個聲音,打字讓 iPhone 用自己的聲音朗讀出來。

字級

個人語音(Personal Voice)是 iPhone 內建的語音備份功能,只要用自己的聲音朗讀約一百五十句提示語,系統就能在裝置上訓練出一個接近本人音色的合成語音,之後透過「輔助使用」裡的「即時語音」(Live Speech),打字就能用這個聲音唸出來,適合聲音狀況可能改變的人事先保留,也適合單純想用自己的聲音做語音輸出。以下用編輯部整理的常見問題,說明開通條件、錄製流程與實際使用方式。

什麼樣的人適合先設定個人語音?

個人語音最早是為了聲音狀況可能隨時間改變的使用者所設計,例如因為健康因素預期未來說話能力會受影響的人,可以趁現在聲音狀態穩定時先錄製保存,之後即使實際說話有困難,仍能透過打字並用自己的聲音朗讀出來,維持與家人朋友溝通時聽起來仍是「自己在說話」的感覺。除此之外,這項功能也開放給所有使用者,不需要特別的資格審核,任何想要在「即時語音」中使用自己聲音而非系統預設語音的人,都可以在「設定」App 裡直接開始錄製,並沒有額外的申請或驗證流程。另外也有人單純是覺得系統預設的合成語音聽起來不夠自然,想在需要打字朗讀的場合,讓輸出的聲音更貼近自己平常說話的樣子,這類需求同樣可以直接使用個人語音,不需要特別的理由。

個人語音是什麼?跟語音備忘錄差在哪?

個人語音是 iPhone 上的「語音克隆」功能,錄製完成後系統會在裝置端建立一個語音模型,讓「即時語音」在朗讀輸入的文字時,聲音聽起來接近使用者本人,而不是系統預設的合成語音。語音備忘錄則單純是錄下一段既有的聲音檔案,並不會生成新的語音模型,之後也不能拿來朗讀任意打出來的文字。兩者用途不同:語音備忘錄是保存一段錄音,個人語音是保存一種「聲音的樣式」,讓未來任何輸入的文字都能用這個樣式唸出來。

開通個人語音需要什麼條件?

個人語音需要較新的 iOS 版本與支援的機型,實際支援清單與系統需求,仍請以 Apple 官網公告為準,錄製前建議先確認裝置已更新到最新的 iOS 版本。此外,錄製過程需要一段連續、不受打斷的時間(通常十五到三十分鐘),裝置需要有足夠的儲存空間,且訓練語音模型的階段建議在充電並鎖定螢幕的狀態下進行,讓系統背景運算不受影響。若裝置容量吃緊,建議先清理不必要的檔案,避免訓練過程因空間不足而中斷。由於各機型支援情況與所需的最低儲存空間會隨系統版本調整,開始錄製前若「個人語音」選項顯示為灰色或找不到入口,多半代表目前系統版本或機型尚未支援,這種情況同樣建議查閱 Apple 官網最新公告,或先確認是否有可更新的系統版本。

如何開始錄製個人語音?

進入「設定」App,依序點選「輔助使用」,往下找到「個人語音」,點進去後選擇「建立個人語音」。系統會先說明錄製需求,接著要求朗讀一系列句子,句子會逐句顯示在畫面上,唸完一句系統會自動跳到下一句。整個錄製流程大約需要唸滿一百五十句左右的提示語,中途若需要暫停,可以直接退出流程,之後再從「個人語音」頁面回到「繼續錄製」接續完成,不需要從頭重來。錄製過程中畫面下方通常會顯示目前完成的句數與進度,方便掌握還剩下多少內容要唸;建議挑選一個不會被家人、寵物或環境聲音打斷的時段進行,唸的時候看著螢幕上的文字自然朗讀即可,不需要背誦或刻意表演語氣,系統訓練的重點是聲音的音色與發音習慣,而不是朗讀的戲劇效果。

錄製過程中要注意什麼?

錄製環境建議找一個安靜、沒有回音的房間錄製,環境噪音愈少,之後合成出來的語音愈接近本人,也建議用平常說話的自然語速朗讀,不需要刻意放慢或加重語氣,唸錯字或停頓可以重新唸一次該句即可,系統會自動偵測並允許重錄。

除了環境安靜之外,也建議手機與嘴巴保持穩定的距離,避免忽近忽遠造成音量忽大忽小;如果中途接到電話或被打斷,錄製進度會自動保留,回來後可以直接接續,不會遺失已經完成的部分。整個過程建議一次完成,若真的需要分次錄製,也盡量在同一個安靜環境進行,讓每一句的收音品質接近,合成出來的聲音會更自然。

錄製完成後,個人語音要多久才能使用?

朗讀完所有提示句之後,系統會進入語音模型的訓練與處理階段,這個階段需要裝置維持充電、鎖定螢幕,並讓系統在背景持續運算,處理時間依裝置效能而有差異,短則數小時,長則可能需要一個晚上,並非錄完馬上就能使用。訓練期間可以在「設定」的「個人語音」頁面查看目前的處理進度,完成後頁面會顯示語音已可使用,並會列出剛剛建立的個人語音項目,供後續在「即時語音」中選用。

如何在「即時語音」中使用個人語音朗讀文字?

個人語音建立完成後,需要另外開啟「即時語音」功能才能實際朗讀輸入的文字。路徑是「設定」→「輔助使用」→「即時語音」,將開關打開,接著在「語音」選項中,把預設語音改選為剛剛建立的個人語音。開啟後,在支援的畫面上連續按三下側邊按鈕(部分機型為按鈕組合,實際操作以裝置提示為準),就會叫出「即時語音」的輸入框,打字後系統會用選定的語音把文字唸出來,適合在通話、面對面對話或需要語音輔助的場合使用。若常用的對話情境比較固定,也可以在「即時語音」設定裡預先輸入幾句常用的句子存成收藏,需要時直接點選即可快速播放,不用每次都重新打字,對於需要快速回應的場合會比較方便。此外,「即時語音」也能在通話進行中直接叫出輸入框朗讀文字給對方聽,不需要中斷通話另外操作。

個人語音可以在多台裝置之間共用嗎?

個人語音的語音模型是在裝置本機建立與儲存的,預設情況下不會自動同步到其他 Apple 裝置,若在另一台 iPhone 或 iPad 上也想使用同一個聲音,需要在該裝置上另外設定,實際跨裝置的支援方式與限制,以 Apple 官網最新說明為準。若日後更換手機,建議在轉移新機前先確認個人語音的保留與遷移方式,避免資料轉移過程中遺失已經訓練好的語音模型。若同時使用 iPhone 與 iPad,且兩台裝置都需要使用同一個聲音,目前較穩妥的做法是分別在每台裝置上各自完成一次錄製與訓練流程,而不是預期系統會自動幫忙同步,實際是否支援跨裝置共享、未來是否會調整,仍請留意 Apple 官網公布的更新內容。

想刪除或重新錄製個人語音該怎麼做?

回到「設定」→「輔助使用」→「個人語音」,點選已建立的語音項目,會看到刪除的選項,點選後即可移除該個人語音與相關的訓練資料。如果想要重新錄製,可以先刪除舊的語音,再依照「建立個人語音」的流程重新走一次;也可以視需求建立多組不同名稱的個人語音,例如語速或語氣略有不同的版本,供不同情境切換使用,每組語音在「個人語音」清單中會分別列出,方便管理。

個人語音的隱私與安全性如何?

個人語音的錄製與語音模型訓練都是在裝置本機端完成,不需要把聲音資料上傳到伺服器進行處理,這也是這項功能被設計成可以離線使用的原因之一。使用者可以隨時在「設定」的「個人語音」頁面查看已建立的語音,也可以隨時刪除,刪除後該裝置上的語音模型與訓練資料就會一併移除。若對於資料處理方式、跨裝置同步的細節仍有疑慮,建議直接查閱 Apple 官網的輔助使用與隱私說明頁面,取得最新且完整的官方資訊。

留意裝置鎖定與備份個人語音的訓練資料保存在裝置本機,建議平時就設定好螢幕鎖定密碼與生物辨識,避免他人任意存取設定內容;若有整機備份的習慣,也建議確認備份方式是否涵蓋輔助使用相關設定,實際涵蓋範圍以 Apple 官網的備份說明為準。

常見問題

個人語音只能講中文或英文嗎? 個人語音支援的語言以錄製當下裝置系統設定的語言為主,實際支援的語言清單會隨系統版本更新而調整,不同語言錄製時提示句的內容也會不同,請以 Apple 官網公告的最新語言支援範圍為準,錄製前也建議先確認裝置的語言設定是否為習慣使用的語言。

沒有唸完一百五十句可以中途用嗎? 不行,個人語音需要完整唸完系統要求的提示句,並且經過訓練處理階段之後才能在「即時語音」中選用,若中途離開只完成部分句子,語音模型不會生成,之後需要回到「個人語音」頁面選擇「繼續錄製」補完剩下的句子,才能進入訓練階段。

錄製個人語音會不會很花時間,一定要一次錄完嗎? 整個錄製流程大約十五到三十分鐘,系統設計上允許分次完成,中途離開的進度會自動保留,之後可以隨時回來接續;但因為分次錄製時環境、狀態可能不一致,建議盡量安排一段完整、安靜且不受打擾的時間一次錄完,聲音品質會比分次錄製時更穩定一致。

個人語音跟 Siri 的聲音是同一件事嗎? 不是,個人語音是使用者自己聲音訓練出來的合成模型,只用於「即時語音」朗讀打字輸入的內容;Siri 的語音則是系統內建、可在多種選項中挑選的助理聲音,兩者是完全獨立的功能,設定入口與用途也不相同,彼此不會互相影響。

如果裝置太舊沒有個人語音選項,還有其他替代方式嗎? 若裝置或系統版本不支援個人語音,「輔助使用」裡仍會有系統內建的多種合成語音,可以在「朗讀螢幕」與「即時語音」中選用,雖然無法還原使用者本人的音色,但同樣能達到打字後由裝置朗讀出來的效果,作為過渡期的替代方案;實際哪些機型與系統版本支援個人語音,仍以 Apple 官網公告的最新資訊為準。

操作步驟

跟著做,點一下打勾

常見問題

個人語音只能講中文或英文嗎?

個人語音支援的語言以錄製當下裝置系統設定的語言為主,實際支援的語言清單會隨系統版本更新而調整。請以 Apple 官網公告的最新語言支援範圍為準,錄製前也建議先確認裝置的語言設定。

沒有唸完一百五十句可以中途用嗎?

不行,個人語音需要完整唸完系統要求的提示句並完成訓練處理後才能使用。若中途離開只完成部分句子,需回到「個人語音」頁面選擇「繼續錄製」補完,才能進入訓練階段。

錄製個人語音會不會很花時間,一定要一次錄完嗎?

整個錄製流程大約十五到三十分鐘,系統允許分次完成,中途離開的進度會自動保留。但建議盡量安排一段完整安靜的時間一次錄完,聲音品質會比分次、環境不一致時更穩定。

個人語音跟 Siri 的聲音是同一件事嗎?

不是,個人語音是使用者自己聲音訓練出來的合成模型,只用於「即時語音」朗讀打字內容;Siri 的語音是系統內建的助理聲音,兩者是完全獨立的功能與設定入口。

如果裝置太舊沒有個人語音選項,還有其他替代方式嗎?

若裝置或系統版本不支援個人語音,「輔助使用」裡仍有系統內建的多種合成語音可供「朗讀螢幕」與「即時語音」使用,作為過渡替代方案,實際支援機型與系統需求仍以 Apple 官網公告為準。

這篇有幫助嗎?
問 AI
外觀