No Upload Studio
ZH-TW

音訊轉文字

把訪談、課堂、語音訊息或 Podcast 轉成文字,每一行都附有時間,支援英文等 14 種語言。語音模型在你的瀏覽器裡執行,所以錄音從不離開你的裝置。

音訊轉文字

如何把音訊轉成文字

  1. 在音訊編輯器中開啟你的檔案,選擇左側的字幕工具。轉成文字在最下方。
  2. 選擇說的語言,或保留自動偵測。
  3. 按轉成文字。第一次使用時,頁面會告訴你要下載什麼(一個約 85 MB 的語音模型,只需下載一次),並等你按下載並開始。
  4. 等它聆聽完畢:進度會顯示做到哪裡,按取消可以停止。接著點一下任一行,就從那裡開始播放。
  5. 按複製文字,或儲存下來:儲存 .txt 儲存文字,儲存 .srt 或儲存 .vtt 儲存附有時間的字幕。

問與答

它聽得懂哪些語言?

英文、西班牙文、葡萄牙文、法文、德文、義大利文、荷蘭文、波蘭文、羅馬尼亞文、捷克文、瑞典文、俄文、烏克蘭文和土耳其文。中文目前還不在其中。選擇自動偵測時,它會根據開頭幾句話判斷說的是其中哪一種。

我的錄音會被上傳嗎?

不會。頁面只下載一次語音模型(瀏覽器會保留它),模型在你的裝置上聆聽。錄音和文字都留在你身邊,沒有其他人聽得到或看得到。

需要多久?

要看你的裝置:在較新的電腦上,花的時間常常比錄音本身還短。長檔案會在停頓處切成最長半分鐘的片段,再一段一段處理。

準確嗎?

靠近麥克風的清楚語音效果很好;音樂、多人同時說話和很大的雜音會讓錯誤變多。先去除背景噪音會有幫助。和任何自動產生的逐字稿一樣,使用前先從頭讀一遍。

可以做成影片字幕嗎?

可以:儲存 .srt 或儲存 .vtt 會得到附有這些時間的字幕。影片編輯器也能直接幫影片寫字幕並對準時間。