Claude Real Video
2,191 stars讓 LLM「真的看到影片」:模型無法直接吃影片,此技能先抽取場景感知的去重關鍵幀+字幕,再讓模型讀這些產物來摘要、分析或討論影片(支援 URL 或本機檔案)。
- 首次公開:2026-06-30
- 數據截至:
- 2026-09-30
- 授權:
- MIT
什麼時候用
要 Agent 理解一支影片的內容(教學、會議錄影、產品演示)時。
要注意
依賴 ffmpeg 等本機工具與轉錄模型;長影片=大量關鍵幀與上下文成本。
安裝提示詞
請幫我安裝「Claude Real Video」技能:從 https://github.com/HUANGCHIHHUNGLeo/claude-real-video/tree/master/skills/claude-real-video(技能路徑:skills/claude-real-video/) 取得完整的技能目錄,放進我的 Agent 的技能目錄(例如專案內的 skills/ 資料夾,或該 Agent 文件指明的全域技能位置),確認裡面的 SKILL.md 存在、frontmatter 的 name 與 description 完整,然後列出這個技能宣告的腳本、外部工具與 API 需求,先不要執行任何腳本。把這段貼給你的 agent。它刻意不含任何工具子命令 —— 指令請以該工具的官方文件為準。