SpeechdashHelp Center
功能

音頻和視頻轉寫

將音頻或視頻檔案轉換為帶發言人標籤、字詞時間戳的可讀文字,並提供 TXT/SRT/VTT 格式的導出。

Speechdash 將 音頻和視頻檔案 轉換為帶時間戳的可讀文字。轉寫會在後台執行:上傳檔案後,可以繼續使用應用程式,等待處理完成。側邊欄中的 轉寫 是作業隊列。作業完成後,文字會在 圖書館 中打開。

你將獲得什麼

  • 完整轉寫,分成帶開始/結束時間的段落
  • 發言人標籤(可選):當啟用發言人偵測時,段落會標記為 SPEAKER_00SPEAKER_01
  • 字詞級別時間戳,以便精確導航和字幕
  • 導出為純文字(TXT)或字幕(SRT、VTT)

支援的檔案格式

常見的音頻和視頻格式都支援:MP3、WAV、M4A、AAC、OGG、OPUS、FLAC、MP4、MOV、WEBM、MKV、AVI 等。檔案大小可達 500 MB

開始轉寫

將音頻或視頻檔案拖放到 首頁,或開啟側邊欄中的 轉寫,並開始新的作業。

選擇 語言(或保持自動偵測),並開啟 發言人偵測 如果錄音有多個聲音。這些選項在上傳開始後將被鎖定。

確認後,檔案會開始上傳,並顯示進度條,然後作業會進入隊列。您可以離開頁面;隊列會即時顯示狀態。作業完成後,點擊它以在圖書館中開啟轉寫。

語言偵測

將語言設定為 自動,Speechdash 會從音頻的前幾秒偵測語言。明確選擇語言有助於處理短檔案或重口音。

費用和限制

2 分鐘的音頻 會計算 1 個信用點(每開始的分鐘都會計算)。信用點在轉寫完成時收費,不會對失敗的作業收費。

計劃每檔案最大長度同時進行的轉寫
Free30 分鐘1
Unlimited10 小時5

閱讀和導出

完成的作業會在圖書館閱讀器中開啟(與其他文件相同的佈局、語音和播放功能)。沒有單獨的轉寫頁面:轉寫 在側邊欄中僅是作業隊列。

從閱讀器工具列中,您可以:

  • 播放 並帶有句子高亮顯示
  • 導出TXT(純文字)、SRTVTT(帶時間戳和發言人標籤的字幕)

進行中的和失敗的作業會保留在 轉寫 队列中,以便您監控狀態。

相關

On this page