LibraTool logoLibraTool

免費音訊轉文字

將音訊或影片轉寫為文字和字幕,全程在你的裝置上完成。可匯出 SRT、VTT、ASS 等格式。無需上傳,無需帳號。

TurboScribe 的免費版每天只能處理 3 個檔案——這裡沒有每日限制,音訊絕不會離開你的裝置。 · 已核實 2026年9月

將檔案拖放到此處或點選瀏覽

MP3, WAV, M4A, AAC, OGG, FLAC, WEBM, MP4, MOV, MKV, M4V · 無強制大小限制

或按 Ctrl+V 從剪貼簿貼上

你可以一次拖放多個檔案

瀏覽檔案

一次拖入多個檔案,即可依次轉寫,並一起儲存為 ZIP。

工作原理

轉錄直接在你的瀏覽器中執行 Whisper 語音識別模型。音訊在你自己的裝置上解碼、重取樣並輸入模型——錄音絕不會上傳。

  1. 1
    你的檔案被解碼為 16 kHz 單聲道
    Whisper 只接受一種格式:每秒 16,000 個取樣的單聲道音訊。瀏覽器音訊引擎會自行完成轉換,對於大多數音樂和語音檔案來說根本無需額外下載。不常見的影片容器會回退到內建的 ffmpeg。
  2. 2
    模型只下載一次,且只在你要求時下載
    語音模型約 81 MB(更快但準確度較低的選項為 45 MB)。只有在你按下“載入”後才會取得,然後快取起來,以後存取可立即啟動。你可以隨時再將其刪除。
  3. 3
    音訊以 30 秒為視窗轉錄
    Whisper 每次讀取 30 秒,兩側各有 5 秒重疊,因此跨越邊界的單字不會丟失。這在後台執行緒中執行,所以頁面保持回應,“取消”也始終有效。
  4. 4
    文字變為易讀的字幕
    原始輸出會被拆分並重新定時,使每行不超過 42 個字元,且顯示速度不超過每秒 21 個字元——與我們的字幕編輯器檢查的限制相同。時間軸絕不會為了滿足這些目標而被拉伸,因為那會歪曲單字實際說出的時間。

你的錄音絕不會離開你的裝置。模型檔案本身從我們的伺服器下載,但音訊只在你自己的瀏覽器中讀取——適用於採訪、醫療記錄、法律錄音以及其他任何機密內容。

相關工具

常見問題