Lecture Video to PDF & Transcription Studio:把課程影片轉成講義 PDF,也能輸出逐字稿字幕
去年三月,我曾經寫過一篇文章,介紹自己改良過的一款小工具: 《Video to PDF with Transcription:免網路、快速轉影片成投影片+語音轉文字的免費工具!》 。 那時候的需求很單純。 我常常會看課程影片、線上教學、讀書會錄影或簡報型影片。這類影片如果只有影片檔,其實很不方便複習。你要一直拖時間軸,找到某一張投影片,再手動截圖,最後還要整理成 PDF。 所以當時我就做了一個小工具,希望可以把影片裡的投影片畫面擷取出來,整理成一份講義 PDF。對我自己來說,這個工具確實有解決一些真實需求。 不過老實說,當時的版本也有一些限制。 舊版能用,但還有幾個明顯問題 當時的版本比較像是早期自用工具。可以跑,也真的能產出 PDF,但遇到比較複雜的影片時,效果就不一定穩。 舉例來說: 如果投影片裡有很多動畫,可能會把同一頁重複擷取好幾次。 如果換頁很快,有些投影片可能會被漏掉。 如果影片畫面裡有講師視窗、Zoom 版面,或投影片區域一直改變,擷取判斷就容易受影響。 舊版啟動速度比較慢,介面也比較像測試工具。 語音轉文字功能當時沒有做得很穩,實際使用上比較難當成主功能。 這些問題其實不難理解。 那時候 AI agent 還沒有現在這麼成熟,我很多流程是靠自己在網頁版 ChatGPT 一來一往慢慢調。那個時代能把工具做出來已經算有趣,但如果要公開分享給更多人用,工程品質、介面、安裝方式和錯誤處理就還需要再整理。 所以這次我重新做了一版。 新版專案名稱叫做 Lecture Video to PDF & Transcription Studio 。中文名稱我暫定為「課程影片轉講義 PDF 與逐字稿工具」。 新版主要想解決什麼 我這次的想法很明確:核心功能仍然是「把課程影片轉成講義 PDF」。 但我也發現,語音轉文字其實是另一個很實用的需求。很多時候我不一定需要 PDF,我只是想把一段課程錄音、會議錄音或影片轉成字幕檔和逐字稿。 所以新版把功能拆成兩個正式入口: 影片轉講義 PDF 語音轉文字 前者適合整理簡報型影片,後者可以單獨處理影片或音檔。 這樣使用情境會清楚很多。想要 PDF 的人,就專心用 PDF 流程。只想要字幕或逐字稿的人,也不用被投影片擷取功能綁住。 影片轉講義 PDF:多了審核與補救空間 ...