使用指南
dicto 會將你所說或所輸入的內容顯示為又大又清晰的文字。本指南說明這個 App 的運作方式。
目錄
開始使用
首次啟動 dicto 時,會先經過簡短的新手導覽,從中選擇預設的說話語言和配色。兩者都可以隨時在設定中更改。這些偏好設定畫面之後是三個介紹 App 功能的基本操作說明畫面,可以跳過。
首次按下麥克風按鈕時,iOS 會顯示取用權限畫面,請求取用你裝置上的語音辨識和麥克風。這兩項都是 Apple 服務,dicto 需要它們才能將你的話語顯示為文字。請點一下「允許」;若要之後再啟用取用權限,請打開 iOS 設定 App,前往設定 ▸ dicto,然後開啟麥克風和語音辨識。
主畫面
主畫面會顯示目前的訊息,以及用來建立、清除和重新查看訊息的控制項。直向顯示的文字略大(適合較短的訊息),橫向則可顯示較長的文字(適合稍長或含前後文的訊息)。
- 訊息顯示區:顯示螢幕上的操作說明和目前的訊息,在可用空間允許的範圍內盡量放大,並在你說話時即時更新。在該區域點兩下可開始或停止聽寫。長按可編輯目前的訊息。較長的訊息會自動捲動;可在設定中改為手動捲動。
- 麥克風按鈕:開始或停止一則語音訊息。請參閱說話與聽寫。按住可在 Solo 中開始登記。
- 鍵盤按鈕:打開鍵盤,以輸入或貼上訊息來代替說話。請參閱輸入。
- 清除按鈕:清除目前的訊息。被清除的訊息不會儲存到先前。長按清除按鈕會跳出「開始新的對話?」對話框,此操作會重設 App。
- 先前:螢幕底部一排已完成的訊息。開始新訊息時,未清除的訊息會加入先前區域。點一下某則訊息可再次顯示。關閉 App 後先前會被清空,且在悄悄話模式開啟或 Solo 對話進行期間會停用。
- 朗讀按鈕:使用在設定中選擇的語音朗讀目前的訊息。請參閱朗讀。
- 設定按鈕:打開設定畫面,可在其中設定語言、配色、說話速度和悄悄話模式等偏好設定。請參閱設定。
說話與聽寫
點一下麥克風按鈕或在訊息顯示區點兩下即可開始聽寫。正常說話即可,文字會隨著你的話語出現。如果聽寫效果不佳(句子無法正確結束),設定選單中針對說話較快或較慢者的說話速度設定可能會有幫助。
依預設,約一秒的停頓會結束一個句子,接著 dicto 會加上句號或問號並繼續聆聽。約兩秒的停頓會結束目前的發言,並顯示最終文字;超出主畫面下方的訊息會自動捲動。訊息也可以手動捲動,且可在設定選單中關閉自動捲動。可在設定的說話速度中調整 dicto 在停頓處等待的時間。Solo 對話約一分半鐘後會自動停止,以免麥克風在吵雜的環境中一直開著。Solo 的句子計時同樣由說話速度設定決定。
聽寫由 Apple 的語音辨識提供,並不完美。口音、背景噪音、不常見的名字、非常短的語句,以及多人同時說話,都可能被聽錯。以自然的速度清楚地說話,並使用與說話者相符的說話速度設定,效果最好。
若要清除螢幕上的文字,請按螢幕底部的清除。按住清除會跳出開始新的對話?對話框。按重新開始可重設 dicto,並清空先前區域。
Solo
Solo 透過人聲分離技術讓 dicto 專注於一個已登記的聲音,目的是顯示該說話者的話語,並忽略附近的其他聲音。Solo 支援免手操作。其他聲音的話語不會顯示,也絕不會被轉錄。Solo 在安靜至中等吵雜的環境中、每次只有一人說話時效果最好;當 dicto 無法確定某個聲音是否為已登記的聲音時,就不會顯示任何內容。快速說出的三個字以內的短語可能太短而無法辨識(例如「Hello」、「That's great」),可能不會出現在螢幕上。
Solo 的運作方式
Solo 啟用期間,dicto 會聆聽環境中的聲音,並把每一段話語轉換成一組描述音色而非字句的少量數字。這些數字會與登記時擷取的數字進行比對。與已登記聲音相符的話語會被轉錄並顯示;不相符的話語會被捨棄,絕不會被轉換成文字。比對由 App 內建、完全在裝置上執行的小型機器學習模型完成;不涉及任何雲端服務、帳號或網路連線。任何話語都絕不會被保留或錄製。
登記聲音
- 按住麥克風按鈕並自然地說話。按住期間你所說的內容會以一般訊息顯示。
- 面板會顯示登記進度。在擷取到足以進行基本分辨的聲音之前,進度列為紅色。
- 實際說話約三秒後,進度列變為黃色並發出提示音:基本登記已成功,此時可隨時放開按鈕。
- 繼續按住按鈕可改善登記效果,實際說話最多十秒即可完成完整登記。隨著擷取到更多聲音,進度列會從黃色漸變為綠色,約十秒時變為綠色。完整登記會以 Solo Glow(一種全螢幕光暈效果)來表示。
- 放開按鈕。Solo 便開始聆聽已登記的聲音。登記成功時,麥克風圖像會變成 Solo 圖像:一個帶聲波條的人物圖像,外圍是實線青綠色圓環。
如果放開按鈕時擷取到的聲音太少,dicto 會再聆聽約兩秒;若仍無法完成登記,就會取消這次登記。
登記補充與 Solo Glow
基本登記就足以開始使用,dicto 會自行悄悄把剩下的工作完成。對話進行期間,與已登記聲音明確相符的話語片段會被加入登記,隨著對話進行提升準確度。這稱為登記補充;它只使用已登記的聲音,絕不使用其他話語。當登記達到完整規模時,無論是透過按住按鈕直到進度列變綠,或是透過對話中的補充,Solo Glow 都會出現:一次短暫、無聲的全螢幕光暈,表示 dicto 已完整登記該聲音。它出現時無需做任何操作。
對話進行期間
已登記的聲音會依說話速度的計時逐則顯示訊息。其他聲音在螢幕上不會產生任何內容。Solo 對話進行期間,先前會隱藏。點一下麥克風按鈕可暫停或繼續聆聽;環境中約三十秒沒有聲音後,對話也會自行暫停。Solo 對話暫停時,實線的青綠色圓環會變成虛線。若要重新啟用目前的對話,請點一下 Solo 按鈕。
結束對話
按住清除按鈕並確認重新開始,即可清除目前的文字和已登記的聲音;接著會出現短暫的「對話已清除」提示,確認已清除。約三分鐘內未出現已登記的聲音,或 App 被移到背景時,對話也會自行結束。在對話進行期間按住麥克風按鈕,可登記另一個聲音來取代已登記的聲音。
聲音特徵檔案
聲音比對由 App 內建、完全在你裝置上執行的小型機器學習模型完成。其中不涉及任何雲端服務、帳號或網路連線;這些模型只做聲音比對,僅此而已。登記本身是一組用來分辨聲音的少量數字,只在對話期間保留在記憶體中:絕不儲存,絕不傳送到任何地方,對話結束即消失。
聲音比對模型為 pyannote community-1 語者模型(WeSpeaker 系列),由 FluidInference 轉換為 Core ML,並依 Creative Commons Attribution 4.0 授權使用。
輸入
點一下鍵盤按鈕打開輸入文字。輸入或貼上訊息,然後點一下完成(或按鍵盤上的藍色打勾按鈕)將其顯示在主畫面上,或點一下取消關閉而不更改目前的訊息。
悄悄話模式
悄悄話模式用於開啟或關閉訊息消失功能。在設定中開啟悄悄話模式即可傳送 Wisps:出現在螢幕上、停留幾秒鐘、然後永久消失的訊息。Wisps 絕不會儲存到先前,且在悄悄話模式開啟期間,先前會隱藏。悄悄話模式開啟期間,自動捲動也會關閉。
朗讀
點一下右上角的朗讀按鈕,即可將目前顯示的訊息朗讀出來。螢幕上沒有訊息時,該按鈕無法使用。朗讀所用的語音在設定的語音中設定;可在 iOS 設定 App 的輔助使用 ▸ 朗讀內容 ▸ 語音中加入更多語音(不是 Siri)。
設定
點一下設定按鈕(左上角的齒輪)打開設定選單。
- 悄悄話模式:開啟或關閉訊息消失功能。請參閱悄悄話模式。
- 說話速度:快、中等或慢。調整 dicto 在停頓處等待多久來結束句子或訊息。如果句子沒有分開,請設為快;如果句子被截斷,請設為慢。
- Solo 聲音比對:嚴格、均衡或寬鬆。調整聲音需要與已登記的聲音多接近才會在 Solo 中顯示。自下次登記起生效。房間裡的聲音聽起來相似時,請選擇嚴格。
- 對話距離(僅限 iPad):為近距離(較小字體)和遠距離(較大字體)的對話調整字體大小。
- 自動捲動長訊息:開啟後,長訊息會以易於閱讀的速度自動捲動到結尾再返回;關閉即停止自動捲動訊息。訊息隨時都可以手動捲動。
- 開啟時的輸入方式:「語音」會讓 dicto 開啟時即進入聆聽模式接收第一則訊息,就像一位反應快速的對話夥伴;「手動」則以一般介面開啟 dicto,第一則訊息可用語音或文字輸入。
- 語音:朗讀所使用的語音。
- 配色:選擇偏好的顯示顏色。提供系統、淺色和深色選項,以及多種高對比組合:白底黑字、黑底白字、藍底黃字、黑底綠字、黑底橘字、白底深紅字、黑底螢光粉紅字,以及綠底白字。每種顏色組合都符合 WCAG AA 無障礙對比標準,而在 dicto 顯示的大字級下,每種組合都達到 AAA。
- 語言:你聽寫時所說的語言(不是 App 的介面語言)。dicto 採用 Apple 的裝置端聽寫,支援 50 多種口說語言。只要裝置支援,任何語言都可以選用,與使用者介面語言無關(例如可在英文介面的 App 中使用中文聽寫)。請參閱聽寫語言列表。dicto 介面本身提供 14 種語言;請參閱介面語言。
- 關於 dicto:App 版本、簡短說明,以及指向本網站的連結。
隱私與資料
dicto 的所有處理都在你的裝置上進行。你所說或所輸入的內容都不會傳送給我們,關閉 App 後也不會儲存任何內容。完整詳情請參閱隱私權政策。
支援
有疑問、遇到問題或想提供意見?歡迎來信 support@speechdisplay.com,我們很樂意協助。