Mac 專用 · 完全離線
把錄音檔轉成逐字稿,再讓 AI 幫你整理成筆記。演講、會議、Podcast、線上課程都可以用。 全部在你自己的電腦上跑 —— 錄音不會上傳到任何地方,不用付錢,也不用註冊帳號。
先確認一件事,免得白忙
這個工具只能在 Mac 上跑,而且必須是 M1 以後的機型。
怎麼確認:點左上角 → 關於這台 Mac, 看「晶片」那一行有沒有寫 Apple M1 / M2 / M3 / M4。
目前是小範圍測試
這個工具還在找人幫忙測試,還沒公開下載。 在我的貼文底下留言或私訊我,我把下載連結給你。
先確認一下你的 Mac 是 M1 以後的機型(上面有寫怎麼看), 不然拿到也用不了。
解壓縮拿到的檔案,會看到一個資料夾。找到裡面的 安裝.command。
這一步最容易卡住
要按右鍵,不要雙擊。 在 安裝.command 上按右鍵 → 選 打開 → 跳出視窗後再按一次 打開。
直接雙擊會跳出「無法打開,因為來自未識別的開發者」然後什麼都不會發生。 這是 macOS 對所有非商店軟體的預設保護,右鍵打開就是告訴系統「這個我信任」。 只有第一次要這樣做。
接著會跳出一個黑色視窗開始跑東西,那是正常的。它會自動裝好需要的元件。
中途會問你密碼
那是你電腦的開機密碼。輸入的時候螢幕上不會有任何顯示 —— 連圓點都沒有,看起來像鍵盤壞了。這是正常的,直接打完按 Enter 就好。
看到「安裝完成!」就結束了,按 Enter 關掉視窗。
在 啟動.command 上按右鍵 → 打開。 (同樣只有第一次要用右鍵,之後就可以直接雙擊了。)
等幾秒,瀏覽器會自己打開工具的操作畫面。
那個黑色視窗不要關
它就是工具本體,關掉的話網頁就失效了。等你把逐字稿複製走之後再關。
把錄音檔拖進網頁上的框框,然後選這次要做什麼:
| 你的音檔是 | ① 修音質 | ② 轉逐字稿 |
|---|---|---|
| 自己現場錄的演講、會議 | 勾 | 勾 |
| YouTube、Podcast、線上課程 | 不要勾 | 勾 |
| 多人對談、訪談 | 看情況 | 勾 · 另外開「講者分辨」 |
已經後製過的音檔(網路上下載的那些)再修一次音質只會讓人聲變悶,反而讓辨識變差。
按 開始處理,然後等進度條跑完。
第一次會等比較久
要下載約 3 GB 的辨識模型。之後就不用再下載了。 正常情況下,30 分鐘的錄音大約要等 10 分鐘上下。
跑完之後,網頁最下面有一欄「整理筆記用」,那是指令加逐字稿已經拼好的一整段。 按下面的 複製「指令+逐字稿」貼給 AI 按鈕。
然後打開 ChatGPT、Claude 或 Gemini,貼上、送出。 它就會整理出摘要、分段重點、金句、提到的書單,還有可以採取的行動。
只想要逐字稿
按 複製逐字稿全文 就好。逐字稿動輒上萬字,用滑鼠拖選很容易漏抓, 用按鈕一次抓完整份。
先跑一次環境檢查。雙擊 檢查環境.command, 它會逐項檢查你的機器、權限、套件、模型,每個有問題的地方都會寫出怎麼修。
它同時會產生一份 診斷報告.txt, 裡面沒有你的錄音和逐字稿內容,可以放心交給別人看。
可以請 AI 幫你裝
如果你有在用 Claude Code、Codex 這類能讀取電腦檔案、執行指令的 AI 工具, 把這個資料夾交給它,貼上這段話就好:
請閱讀這個資料夾裡的 AI安裝指引.md,協助我在這台 Mac 上 安裝並啟動這套錄音清理工具。 請遵守指引裡的規則,重點是: 1. 先執行 ./檢查環境.command 看目前狀況 2. 優先使用專案提供的「安裝.command」,不要自行改寫流程 3. 不要動系統 Python,套件都裝在專案的 .venv 裡 4. 不要修改專案的程式碼來解決安裝問題 5. 需要管理員權限的操作,先跟我說明再執行 6. 失敗時先讀完整錯誤訊息,不要重複執行同樣的命令 7. 不要讀取我的錄音檔和逐字稿
資料夾裡有一份 AI安裝指引.md 是專門寫給 AI 看的, 裡面有正確步驟和已知問題的解法。有這份,AI 就不會自己亂試一套。
網頁版的 AI 幫不上太多忙
只能聊天的 AI(瀏覽器開的 ChatGPT、Claude)看不到你的電腦, 沒辦法檢查環境、執行安裝、讀錯誤訊息。它可以給你建議,但你得自己動手, 而且它不知道你這台機器的實際狀況。
使用倫理
這個工具跑得很快,快到容易忘記一件事:一場演講的逐字稿, 等於把整場內容完整重製了一份。
| 這樣沒問題 | 這樣就過頭了 |
|---|---|
| 自己聽、自己整理筆記、自己複習 | 把逐字稿貼到群組、社團、社群平台 |
| 丟給 AI 幫你摘要,自己看 | 把別人的內容改寫成自己的文章、簡報、課程 |
| 存起來當個人的學習紀錄 | 公開發表,或拿去做任何商業用途 |
界線不在「能不能轉逐字稿」,而在轉完之後拿去哪裡。 自己留著看是一回事,散布出去是另一回事 —— 後者是講者的權利,不是你的。
錄別人講話之前
很多講者不介意被錄,但也有人明確不希望,收費的場次尤其如此。 先問一聲比事後尷尬好。多人會議還牽涉到其他與會者的隱私 和公司的保密規定,那跟版權是兩回事。
網路上抓的音檔
除了著作權,還有平台的服務條款。付費課程通常在條款裡明文禁止錄製和轉錄 —— 那是合約問題,跟著作權法無關,就算你只是自己看也一樣違反。
以上是一般性的提醒,不是法律意見。有疑慮請諮詢專業人士。 最簡單的判斷方式:如果你不好意思讓講者看到你正在做的事,那大概就不該做。
要用右鍵 → 打開,不是雙擊。如果右鍵也不行, 到「系統設定 → 隱私權與安全性」,往下捲,會看到一行提示和「仍要打開」的按鈕。
展開「逐字稿設定」,在「專有名詞提示」欄位裡把講者名字、公司名、專業術語打進去, 再跑一次。這招最有效 —— 模型知道會出現哪些詞之後,辨識率會明顯提高。
開了「講者分辨」的話,那一步會顯示像「12 / 30」這樣的數字。 只要數字有在動就是正常的,這步本來就慢。真的完全不動超過幾分鐘才是有問題。
這個工具跑起來要 4 到 6 GB 記憶體。處理完之後按網頁上的 釋放記憶體 按鈕就會還給系統。另外,不要同時開兩個工具視窗, 兩份會各自佔一份記憶體。
把整個資料夾丟到垃圾桶就好,不會有東西留在系統裡。 下載的模型檔存在 ~/.cache,想一起清掉的話, 在 Finder 按 ⌘⇧G 貼上那個路徑, 刪掉 huggingface 和 audio-cleanup-models 兩個資料夾。
還是卡住了?
先跑一次 檢查環境.command,多數問題它會直接告訴你怎麼修。 真的解不掉再來找我,帶著它產生的 診斷報告.txt 我會比較快知道問題在哪。