做圖
zenstory-ai
2026-09-03
視頻拆成六層索引,寫稿前先看清素材全貌
看完一部紀錄片,你只記得'好像不錯'。裝上它,視頻自動變成場景、臺詞、畫面觀察、靜音、時間線和寫作 brief——。
做什麼用
看完一部紀錄片,你只記得'好像不錯'。裝上它,視頻自動變成場景、臺詞、畫面觀察、靜音、時間線和寫作 brief——。不是單一轉錄,而是六層產物互相咬合:ASR 對齊場景,VLM 觀察畫面,靜音窗補敘事空隙。
應用範圍
用在「做圖」這一格。只吃本地視頻文件,不吃 YouTube 鏈接;需預裝 ffmpeg 和一臺能跑 VLM 的 GPU(無 GPU 則視覺。
如何使用
- 就按「視頻拆成六層索引,寫稿前先看清素材全貌」這一件來做,不要中途改風格。
- 把我手上這張按它的規矩重做,風格不許換。
- 只要成品,過程裡的解釋可以沒有。
- 做完對照應用範圍,越界的那一稿丟掉。
安裝
git clone --depth 1 https://github.com/zenstory-ai/video-recap-skills.gitcp -r video-recap-skills/skills/video-understanding ~/.claude/skills/video-understanding