video-use:用 Claude Code 編輯影片
video-use 為編碼代理提供了用於剪切、排列、添加字幕和渲染視訊專案的命令。
秒懂
- 它是什麼?
- 這個儲存庫描述一種不用預設和選單的影片編輯方式,以及 README 說明了什麼、沒有說明什麼。
- 適合誰用?
- browser-use-video-use 適合需要依照 README 中的 Claude Code 與 ffmpeg 來閱讀、試作或整合的人,不適合把未記載的能力當成保證的使用者。採用前先檢查 VIDEO_EDITING_GUIDE.md 的實際內容、輸入輸出與授權界線,再決定是否放進自己的流程。
- 可以商用嗎?
- 可以。MIT 是寬鬆授權:你可以使用、修改並販售以它為基礎的軟體,只需保留著作權與授權聲明。
- 還在維護嗎?
- 有在維護。儲存庫最近一次提交在 17 天前。
- 用什麼語言寫的?
- 主要是 Python(依據 GitHub 的語言統計)。
以上回答依據專案的 GitHub 資料(最近同步於 2026年9月15日)與我們的分析,不構成法律意見。
開源專案深度解析
無預設、無選單地編輯影片
段落核對 0:video-use 是一個 Python 專案,為 Claude Code 新增影片編輯技能。README 描述的工作流程是:把原始素材放進資料夾,與 Claude Code 對話,得到 final.mp4。它面向口播、混剪、教學、旅行和訪談等內容,並且不依賴預設或選單。README 稱該專案 100% 開源,也建議在 Browser Use Cloud 中試用 video-use,那是另一個服務。儲存庫中繼資料列出主分支上有 19,543 顆星、2,421 個 fork 和 61 個未關閉議題。
段落核對 1:在 browser-use-video-use 的具體脈絡裡,Claude Code 是讀者追蹤資料流、設定或貢獻邊界的線索。應先閱讀 README 已明確記錄的內容,逐項對照專案中的檔案、命令和設定,再把結果放回實際工作流程判斷。README 沒有說明的版本差異、平台限制或執行結果,必須保留為未定事項,不能從專案名稱或熱門程度推導。ffmpeg 所代表的倉庫內容,和實際發布給使用者的封裝流程也可能位於不同層次,這正是閱讀 browser-use-video-use 時需要分開確認的地方。
編輯流程包含哪些能力
段落核對 2:README 列出了七項具體能力。它會剪掉 umm、uh 等填充詞,以及錯誤開頭和空白時段。它會套用自動調色,可選暖色電影感、中性衝擊感,或自訂 ffmpeg 鏈。它在每次剪輯處加入 30ms 音訊淡入淡出,避免爆音。它會燒錄字幕,預設是兩字大寫區塊,並完全可自訂。它會透過 HyperFrames、Remotion、Manim 或 PIL 產生動畫疊加層,每個動畫由並行子代理產生。它會在每个剪輯邊界對渲染輸出進行自我評估,並將工作階段記憶儲存在 project.md 中,以便下次工作階段接續上次進度。所有輸出都寫到來源影片旁的 edit/ 目錄,技能目錄保持乾淨。
段落核對 3:在 browser-use-video-use 的具體脈絡裡,ffmpeg 是讀者追蹤資料流、設定或貢獻邊界的線索。應先閱讀 README 已明確記錄的內容,逐項對照專案中的檔案、命令和設定,再把結果放回實際工作流程判斷。README 沒有說明的版本差異、平台限制或執行結果,必須保留為未定事項,不能從專案名稱或熱門程度推導。VIDEO_EDITING_GUIDE.md 所代表的倉庫內容,和實際發布給使用者的封裝流程也可能位於不同層次,這正是閱讀 browser-use-video-use 時需要分開確認的地方。
透過代理提示或手動安裝
段落核對 4:README 提供了一個設定提示,可以貼到 Claude Code、Codex、Hermes、Openclaw 或任何有 shell 存取權限的代理中。該提示指示代理先閱讀 install.md,設定 ffmpeg,註冊技能,並要求使用者提供 ElevenLabs API 金鑰,然後閱讀 SKILL.md 和 helpers/。安裝後,代理被告知不要自行轉錄,而是等待使用者把素材放進資料夾。README 也記錄了手動安裝路徑:複製儲存庫,將其符號連結到代理的 skills 目錄,執行 uv sync 或 pip install -e .,用 brew 安裝 ffmpeg,可選安裝 yt-dlp,並把 .env.example 複製為 .env 以加入 ElevenLabs 金鑰。README 還說明技能目錄會保持乾淨,因為輸出位於 <videos_dir>/edit/。
段落核對 5:在 browser-use-video-use 的具體脈絡裡,VIDEO_EDITING_GUIDE.md 是讀者追蹤資料流、設定或貢獻邊界的線索。應先閱讀 README 已明確記錄的內容,逐項對照專案中的檔案、命令和設定,再把結果放回實際工作流程判斷。README 沒有說明的版本差異、平台限制或執行結果,必須保留為未定事項,不能從專案名稱或熱門程度推導。Claude Code 所代表的倉庫內容,和實際發布給使用者的封裝流程也可能位於不同層次,這正是閱讀 browser-use-video-use 時需要分開確認的地方。
為什麼 LLM 從不觀看影片
段落核對 6:核心思路是讓語言模型閱讀轉錄文字,而不是逐幀看影片。每個來源檔案呼叫一次 ElevenLabs Scribe,得到詞級時間戳、說話人分離,以及笑聲、掌聲等音訊事件。所有素材被壓縮進一個約 12KB 的 takes_packed.md 檔案,README 稱之為 LLM 的主要閱讀視圖。當決策點需要視覺上下文時,timeline_view 會產生包含膠片條、波形和詞標籤的合成 PNG。README 將這種做法與天真的逐幀方案對比:30,000 幀乘以每幀 1,500 token,相當於 45M token 的雜訊;而 video-use 只需要 12KB 文字加少量 PNG。README 還用 browser-use 給 LLM 提供結構化 DOM 而非截圖來類比。
段落核對 7:在 browser-use-video-use 的具體脈絡裡,Claude Code 是讀者追蹤資料流、設定或貢獻邊界的線索。應先閱讀 README 已明確記錄的內容,逐項對照專案中的檔案、命令和設定,再把結果放回實際工作流程判斷。README 沒有說明的版本差異、平台限制或執行結果,必須保留為未定事項,不能從專案名稱或熱門程度推導。ffmpeg 所代表的倉庫內容,和實際發布給使用者的封裝流程也可能位於不同層次,這正是閱讀 browser-use-video-use 時需要分開確認的地方。
流程和自我評估迴圈
段落核對 8:README 記錄的流程是 Transcribe、Pack、LLM Reasons、EDL、Render 和 Self-Eval。自我評估步驟會在每個剪輯邊界對渲染輸出執行 timeline_view,以捕捉視覺跳變、音訊爆音和隱藏字幕。如果發現問題,流程會修復並重新渲染,最多三次。只有通過自我評估後才會顯示預覽。README 也強調 LLM 從不觀看影片,它只讀取轉錄文字和按需產生的合成圖。輸出檔案是來源檔案旁邊的 edit/final.mp4。
README 中的設計原則
段落核對 9:README 列出五條設計原則。文字加按需視覺取代逐幀傾倒。音訊為主,視覺為輔,剪輯基於語音邊界和靜音間隙。工作流程遵循詢問、確認、執行、自我評估、持久化的順序。它不對內容類型做任何假設,同時執行 12 條硬性製作規則,在其餘方面保留藝術自由。README 指向 SKILL.md 取得完整製作規則和剪輯工藝,並說明製作正確性不可妥協,而品味可以自由。
授權條款和待驗證的問題
段落核對 10:該儲存庫使用 MIT 授權條款,授予使用、複製、修改、合併、發布、散布、再授權和出售副本的權限,軟體按原樣提供且不附帶任何保證。README 沒有說明 ElevenLabs Scribe 的成本或速率限制,沒有說明 API 金鑰是否每次操作都必須提供,也沒有說明支援哪些硬體和作業系統。它也沒有包含版本號或變更日誌。這些問題對任何採用該專案的使用者來說都是需要驗證的問題。授權條款文字本身除了 MIT 條款外,沒有涉及安全態勢、支援或責任。
browser-use-video-use 的核對入口
段落核對 11:browser-use-video-use 的 README 把 Claude Code、ffmpeg 與 VIDEO_EDITING_GUIDE.md 放在可核對的位置,這些記號也界定了讀者能從倉庫直接確認的範圍。處理這篇文章時,我只把已出現在素材中的檔案、命令、套件或設定名稱寫入判斷,不把未記載的功能補成承諾。對使用者而言,先看 Claude Code 的實際內容,再對照 ffmpeg 的入口,會比只看專案描述更能分辨它究竟適合哪一種工作流程。
編輯結論
browser-use-video-use 適合需要依照 README 中的 Claude Code 與 ffmpeg 來閱讀、試作或整合的人,不適合把未記載的能力當成保證的使用者。採用前先檢查 VIDEO_EDITING_GUIDE.md 的實際內容、輸入輸出與授權界線,再決定是否放進自己的流程。
社群筆記