SRT、VTT、逐字稿與音訊檔案有什麼區別

了解 SRT、VTT、逐字稿和音訊檔案分別包含什麼、適合哪些平台,以及影片翻譯後應該保留哪些檔案。

更新日期:

影片翻譯專案通常會產生多種看似相似的檔案。SRT 和 VTT 是帶時間軸的字幕格式,逐字稿主要用於閱讀和編輯,音訊檔案則承載配音聲音。理解差異能避免上傳錯誤資產,也讓未來更新更容易。

快速比較

SRT 結構簡單、平台支援廣;VTT 支援網頁字幕及更多提示資訊;逐字稿不一定含可播放的時間碼;音訊檔案包含實際聲音而不是文字。一個完整專案通常需要保留核准譯稿、字幕檔案、乾淨音軌和最終混音,而不是只儲存匯出影片。

什麼是 SRT 檔案?

SRT 是純文字字幕檔案,每個字幕塊包含序號、開始和結束時間,以及顯示文字。時間格式通常為小時、分鐘、秒和毫秒。它適合 YouTube、編輯軟體和許多學習平台,但樣式能力有限。檔案應使用正確字元編碼,並在上傳後檢查換行和同步。

什麼是 VTT 檔案?

WebVTT 通常以 WEBVTT 開頭,使用點號表示毫秒,並可包含位置、說話人或樣式提示。它常用於 HTML5 影片和網頁播放器。平台可能只支援部分 VTT 功能,因此複雜樣式上傳後不一定保留。核心仍是準確文字和時間軸。

SRT 與 VTT 的區別

兩者都可以顯示字幕,主要差異是語法、毫秒分隔符和擴充功能。選擇應以目標平台要求為準,而不是哪個格式「更高階」。轉換格式後需要驗證時間碼、特殊字元和空行,不能只改副檔名。

什麼是逐字稿?

逐字稿記錄影片中說了什麼,可能採用段落、說話人標籤或粗略時間戳。它適合搜尋、翻譯、審稿和內容再利用,但通常沒有逐條字幕的顯示時長與斷句。逐字稿是製作字幕的重要來源,卻不能未經處理直接當字幕發布。

什麼是音訊檔案?

音訊檔案可能是目標語言對白、完整混音、無對白的音樂效果軌或單個說話人片段。WAV 適合高品質編輯,MP3 或 AAC 更適合交付和預覽。檔名應寫明語言、說話人、混音類型、取樣率和版本,避免把母版與壓縮預覽混淆。

上傳前的技術檢查

確認字幕使用 UTF-8 編碼,時間碼依序且不重疊,檔案語言與平台標籤一致。音訊應與最終影片同起點、同總時長,取樣率和聲道符合平台要求,並且沒有削波或多餘靜音。所有檔案都用實際平台測試一次。

應該保留哪些檔案?

保留最終原始影片、準確的原始逐字稿、核准譯文、SRT 或 VTT、目標語言乾淨對白、音樂效果軌、最終混音和發布記錄。若使用聲音複製,還應保留同意與範圍證明。不要只儲存嵌入字幕的成品影片,因為那會讓未來修訂非常困難。

如何組織這些檔案

依專案、原始版本和語言建立目錄,使用一致檔名,例如 video01_zh-CN_subtitles_v03.srt。設定一份資產清單,記錄狀態、審核者、核准日期和發布位置。把工作草稿與已核准檔案分開,並限制聲音原始檔案的存取權限。

常見錯誤

把逐字稿當成字幕上傳

長段落沒有合適斷句與時間軸,會讓觀眾來不及閱讀。應根據畫面重新切分並調整時間軸。

修改字幕卻沒有修改音訊

若兩者來自不同譯稿,觀眾會聽到和看到不同內容。確定一個核准版本,並追蹤所有受影響資產。

使用舊譯稿的字幕

檔名不清會導致過期版本混入發布包。上傳前對比版本號與核准日期。

丟失乾淨音訊

只有最終混音時,未來無法輕鬆改變音樂或修復一句對白。儲存獨立對白和背景軌。

混用地區版本

簡體與繁體、不同地區詞彙和聲音可能需要分開管理。檔名和平台語言標籤應寫清地區。

Dub AI 提供什麼

Dub AI 將轉錄、翻譯、配音和字幕放在同一專案中,便於從已審核文字匯出相關資產。匯出後仍應依照你的版本規範歸檔,並在目標平台驗證格式、同步和語言選擇。工具負責加速流程,團隊負責核准內容與維護記錄。

作者
  • 作者頭像
    作者:
    Chao Wu
    職稱
    Dub AI 創辦人