功能
音頻和視頻轉寫
將音頻或視頻檔案轉換為帶發言人標籤、字詞時間戳的可讀文字,並提供 TXT/SRT/VTT 格式的導出。
Speechdash 將 音頻和視頻檔案 轉換為帶時間戳的可讀文字。轉寫會在後台執行:上傳檔案後,可以繼續使用應用程式,等待處理完成。側邊欄中的 轉寫 是作業隊列。作業完成後,文字會在 圖書館 中打開。
你將獲得什麼
- 完整轉寫,分成帶開始/結束時間的段落
- 發言人標籤(可選):當啟用發言人偵測時,段落會標記為
SPEAKER_00、SPEAKER_01等 - 字詞級別時間戳,以便精確導航和字幕
- 導出為純文字(TXT)或字幕(SRT、VTT)
支援的檔案格式
常見的音頻和視頻格式都支援:MP3、WAV、M4A、AAC、OGG、OPUS、FLAC、MP4、MOV、WEBM、MKV、AVI 等。檔案大小可達 500 MB。
開始轉寫
將音頻或視頻檔案拖放到 首頁,或開啟側邊欄中的 轉寫,並開始新的作業。
選擇 語言(或保持自動偵測),並開啟 發言人偵測 如果錄音有多個聲音。這些選項在上傳開始後將被鎖定。
確認後,檔案會開始上傳,並顯示進度條,然後作業會進入隊列。您可以離開頁面;隊列會即時顯示狀態。作業完成後,點擊它以在圖書館中開啟轉寫。
語言偵測
將語言設定為 自動,Speechdash 會從音頻的前幾秒偵測語言。明確選擇語言有助於處理短檔案或重口音。
費用和限制
每 2 分鐘的音頻 會計算 1 個信用點(每開始的分鐘都會計算)。信用點在轉寫完成時收費,不會對失敗的作業收費。
| 計劃 | 每檔案最大長度 | 同時進行的轉寫 |
|---|---|---|
| Free | 30 分鐘 | 1 |
| Unlimited | 10 小時 | 5 |
閱讀和導出
完成的作業會在圖書館閱讀器中開啟(與其他文件相同的佈局、語音和播放功能)。沒有單獨的轉寫頁面:轉寫 在側邊欄中僅是作業隊列。
從閱讀器工具列中,您可以:
- 播放 並帶有句子高亮顯示
- 導出 為
TXT(純文字)、SRT或VTT(帶時間戳和發言人標籤的字幕)
進行中的和失敗的作業會保留在 轉寫 队列中,以便您監控狀態。