使用指南

dicto 會將你所說或所輸入的內容顯示為又大又清晰的文字。本指南說明這個 App 的運作方式。

目錄

開始使用

首次啟動 dicto 時,會先經過簡短的新手導覽,從中選擇預設的說話語言和配色。兩者都可以隨時在設定中更改。這些偏好設定畫面之後是三個介紹 App 功能的基本操作說明畫面,可以跳過。

首次按下麥克風按鈕時,iOS 會顯示取用權限畫面,請求取用你裝置上的語音辨識和麥克風。這兩項都是 Apple 服務,dicto 需要它們才能將你的話語顯示為文字。請點一下「允許」;若要之後再啟用取用權限,請打開 iOS 設定 App,前往設定 ▸ dicto,然後開啟麥克風語音辨識

主畫面

主畫面會顯示目前的訊息,以及用來建立、清除和重新查看訊息的控制項。直向顯示的文字略大(適合較短的訊息),橫向則可顯示較長的文字(適合稍長或含前後文的訊息)。

說話與聽寫

點一下麥克風按鈕或在訊息顯示區點兩下即可開始聽寫。正常說話即可,文字會隨著你的話語出現。如果聽寫效果不佳(句子無法正確結束),設定選單中針對說話較快或較慢者的說話速度設定可能會有幫助。

依預設,約一秒的停頓會結束一個句子,接著 dicto 會加上句號或問號並繼續聆聽。約兩秒的停頓會結束目前的發言,並顯示最終文字;超出主畫面下方的訊息會自動捲動。訊息也可以手動捲動,且可在設定選單中關閉自動捲動。可在設定說話速度中調整 dicto 在停頓處等待的時間。Solo 對話約一分半鐘後會自動停止,以免麥克風在吵雜的環境中一直開著。Solo 的句子計時同樣由說話速度設定決定。

聽寫由 Apple 的語音辨識提供,並不完美。口音、背景噪音、不常見的名字、非常短的語句,以及多人同時說話,都可能被聽錯。以自然的速度清楚地說話,並使用與說話者相符的說話速度設定,效果最好。

若要清除螢幕上的文字,請按螢幕底部的清除。按住清除會跳出開始新的對話?對話框。按重新開始可重設 dicto,並清空先前區域。

Solo

Solo 透過人聲分離技術讓 dicto 專注於一個已登記的聲音,目的是顯示該說話者的話語,並忽略附近的其他聲音。Solo 支援免手操作。其他聲音的話語不會顯示,也絕不會被轉錄。Solo 在安靜至中等吵雜的環境中、每次只有一人說話時效果最好;當 dicto 無法確定某個聲音是否為已登記的聲音時,就不會顯示任何內容。快速說出的三個字以內的短語可能太短而無法辨識(例如「Hello」、「That's great」),可能不會出現在螢幕上。

Solo 的運作方式

Solo 啟用期間,dicto 會聆聽環境中的聲音,並把每一段話語轉換成一組描述音色而非字句的少量數字。這些數字會與登記時擷取的數字進行比對。與已登記聲音相符的話語會被轉錄並顯示;不相符的話語會被捨棄,絕不會被轉換成文字。比對由 App 內建、完全在裝置上執行的小型機器學習模型完成;不涉及任何雲端服務、帳號或網路連線。任何話語都絕不會被保留或錄製。

登記聲音

  1. 按住麥克風按鈕並自然地說話。按住期間你所說的內容會以一般訊息顯示。
  2. 面板會顯示登記進度。在擷取到足以進行基本分辨的聲音之前,進度列為紅色。
  3. 實際說話約三秒後,進度列變為黃色並發出提示音:基本登記已成功,此時可隨時放開按鈕。
  4. 繼續按住按鈕可改善登記效果,實際說話最多十秒即可完成完整登記。隨著擷取到更多聲音,進度列會從黃色漸變為綠色,約十秒時變為綠色。完整登記會以 Solo Glow(一種全螢幕光暈效果)來表示。
  5. 放開按鈕。Solo 便開始聆聽已登記的聲音。登記成功時,麥克風圖像會變成 Solo 圖像:一個帶聲波條的人物圖像,外圍是實線青綠色圓環。

如果放開按鈕時擷取到的聲音太少,dicto 會再聆聽約兩秒;若仍無法完成登記,就會取消這次登記。

登記補充與 Solo Glow

基本登記就足以開始使用,dicto 會自行悄悄把剩下的工作完成。對話進行期間,與已登記聲音明確相符的話語片段會被加入登記,隨著對話進行提升準確度。這稱為登記補充;它只使用已登記的聲音,絕不使用其他話語。當登記達到完整規模時,無論是透過按住按鈕直到進度列變綠,或是透過對話中的補充,Solo Glow 都會出現:一次短暫、無聲的全螢幕光暈,表示 dicto 已完整登記該聲音。它出現時無需做任何操作。

對話進行期間

已登記的聲音會依說話速度的計時逐則顯示訊息。其他聲音在螢幕上不會產生任何內容。Solo 對話進行期間,先前會隱藏。點一下麥克風按鈕可暫停或繼續聆聽;環境中約三十秒沒有聲音後,對話也會自行暫停。Solo 對話暫停時,實線的青綠色圓環會變成虛線。若要重新啟用目前的對話,請點一下 Solo 按鈕。

結束對話

按住清除按鈕並確認重新開始,即可清除目前的文字和已登記的聲音;接著會出現短暫的「對話已清除」提示,確認已清除。約三分鐘內未出現已登記的聲音,或 App 被移到背景時,對話也會自行結束。在對話進行期間按住麥克風按鈕,可登記另一個聲音來取代已登記的聲音。

聲音特徵檔案

聲音比對由 App 內建、完全在你裝置上執行的小型機器學習模型完成。其中不涉及任何雲端服務、帳號或網路連線;這些模型只做聲音比對,僅此而已。登記本身是一組用來分辨聲音的少量數字,只在對話期間保留在記憶體中:絕不儲存,絕不傳送到任何地方,對話結束即消失。

聲音比對模型為 pyannote community-1 語者模型(WeSpeaker 系列),由 FluidInference 轉換為 Core ML,並依 Creative Commons Attribution 4.0 授權使用。

輸入

點一下鍵盤按鈕打開輸入文字。輸入或貼上訊息,然後點一下完成(或按鍵盤上的藍色打勾按鈕)將其顯示在主畫面上,或點一下取消關閉而不更改目前的訊息。

悄悄話模式

悄悄話模式用於開啟或關閉訊息消失功能。在設定中開啟悄悄話模式即可傳送 Wisps:出現在螢幕上、停留幾秒鐘、然後永久消失的訊息。Wisps 絕不會儲存到先前,且在悄悄話模式開啟期間,先前會隱藏。悄悄話模式開啟期間,自動捲動也會關閉。

朗讀

點一下右上角的朗讀按鈕,即可將目前顯示的訊息朗讀出來。螢幕上沒有訊息時,該按鈕無法使用。朗讀所用的語音在設定語音中設定;可在 iOS 設定 App 的輔助使用 ▸ 朗讀內容 ▸ 語音中加入更多語音(不是 Siri)。

設定

點一下設定按鈕(左上角的齒輪)打開設定選單。

隱私與資料

dicto 的所有處理都在你的裝置上進行。你所說或所輸入的內容都不會傳送給我們,關閉 App 後也不會儲存任何內容。完整詳情請參閱隱私權政策

支援

有疑問、遇到問題或想提供意見?歡迎來信 support@speechdisplay.com,我們很樂意協助。

返回首頁