Agentic Research

Claude Real Video

2,191 stars

讓 LLM「真的看到影片」:模型無法直接吃影片,此技能先抽取場景感知的去重關鍵幀+字幕,再讓模型讀這些產物來摘要、分析或討論影片(支援 URL 或本機檔案)。

首次公開:2026-06-30
數據截至:
2026-09-30
授權:
MIT

什麼時候用

要 Agent 理解一支影片的內容(教學、會議錄影、產品演示)時。

要注意

依賴 ffmpeg 等本機工具與轉錄模型;長影片=大量關鍵幀與上下文成本。

安裝提示詞

請幫我安裝「Claude Real Video」技能:從 https://github.com/HUANGCHIHHUNGLeo/claude-real-video/tree/master/skills/claude-real-video(技能路徑:skills/claude-real-video/) 取得完整的技能目錄,放進我的 Agent 的技能目錄(例如專案內的 skills/ 資料夾,或該 Agent 文件指明的全域技能位置),確認裡面的 SKILL.md 存在、frontmatter 的 name 與 description 完整,然後列出這個技能宣告的腳本、外部工具與 API 需求,先不要執行任何腳本。

把這段貼給你的 agent。它刻意不含任何工具子命令 —— 指令請以該工具的官方文件為準。

取得 官方來源 來源(2,191 ★)
相容工具
相關範式