doc-parse
将 PDF/PPT/Excel/Word 等多格式文档解析为结构化 Markdown,并输出元数据与解析置信度,作为 RAG 与四色卡片的数据底座。
影片与视频编辑、自媒体创作者在需要拆解优秀视频、提取分镜参考或反推提示词时,使用本技能可自动抽取视频关键帧,调用视觉大模型批量分析画面,一键生成结构化描述与创作提示词,轻松搞定视频内容提取与场景分析。
$ npx -y skills add anbeime/skill --skill video-frame-extractor --agent claude-codeHow it fires
How this skill gets triggered: by you, by Claude, or both.
/video-frame-extractorContext preview
The summary Claude sees to decide when to auto-load this skill.
影片与视频编辑、自媒体创作者在需要拆解优秀视频、提取分镜参考或反推提示词时,使用本技能可自动抽取视频关键帧,调用视觉大模型批量分析画面,一键生成结构化描述与创作提示词,轻松搞定视频内容提取与场景分析。
name: video-frame-extractor
description: 影片与视频编辑、自媒体创作者在需要拆解优秀视频、提取分镜参考或反推提示词时,使用本技能可自动抽取视频关键帧,调用视觉大模型批量分析画面,一键生成结构化描述与创作提示词,轻松搞定视频内容提取与场景分析。
dependency:
python:
- opencv-python>=4.8.0
- pillow>=10.0.0
- requests>=2.28.0opencv-python>=4.8.0 pillow>=10.0.0 requests>=2.28.0
需要配置视觉模型API密钥(如GPT-4V、Claude-3.5-Sonnet),环境变量格式:
export VISION_API_KEY="your_api_key" export VISION_API_BASE="https://api.openai.com/v1" # 或其他API地址 export VISION_MODEL="gpt-4-vision-preview" # 模型名称
使用您发布的Coze Bot API进行视觉分析,环境变量格式:
export COZE_BOT_ID="7572557757883383858" # 您的Bot ID export COZE_API_KEY="cztei_qHZQ0A5OSJjsmfZWmVb8bqu2BTbtB240YGbDYLhZpsIr8jER4aL4Aevyii8rnKfNs" # 您的API Key
Coze Bot的优势: 集成了官方抽帧插件和视觉模型,无需额外配置
**步骤1: 视频抽帧**
# 示例: 抽取视频关键帧 python scripts/video_frame_extractor.py \ --input ./input/video.mp4 \ --output ./output/frames \ --interval 3 \ --max_frames 10
**步骤2: 视觉分析**
**方案A: 使用Coze Bot API(推荐)**
# 示例: 使用Coze Bot分析抽帧图片 python scripts/coze_bot_client.py \ --image_dir ./output/frames \ --prompt "分析场景内容、人物状态、构图特点,适合AI视频创作" \ --output ./output/analysis.json
**方案B: 使用其他视觉模型API**
# 示例: 使用GPT-4V分析抽帧图片 python scripts/visual_analyzer.py \ --input ./output/frames \ --output ./output/analysis.json \ --prompt "分析场景内容、人物状态、构图特点,适合AI视频创作"
**步骤3: 结果整合**
**抽帧参数:**
**分析参数:**
# 1. 抽取视频关键帧 python scripts/video_frame_extractor.py \ --input ./input/source_video.mp4 \ --output ./output/frames \ --interval 2 \ --max_frames 8 # 2. 使用Coze Bot分析抽帧内容 python scripts/coze_bot_client.py \ --image_dir ./output/frames \ --prompt "详细描述场景、人物、构图,适合AI视频创作参考" \ --output ./output/analysis.json # 3. 智能体读取analysis.json,生成创作提示词 # 智能体将根据分析结果组织内容,生成可用于AI创作的提示词
python scripts/video_frame_extractor.py \ --input ./input/video.mp4 \ --output ./output/frames \ --interval 5 \ --max_frames 5
# 使用Coze Bot python scripts/coze_bot_client.py \ --image ./output/frames/frame_00001.jpg \ --prompt "分析这张图片的场景风格和构图" # 或使用其他视觉模型 python scripts/visual_analyzer.py \ --input ./output/frames/ \ --output ./analysis.json \ --prompt "分析场景风格和构图"
**抽帧输出:**
./output/frames/ ├── frame_00001.jpg ├── frame_00002.jpg ├── frame_00003.jpg └── ...
**分析输出(JSON):**
{
"total_frames": 10,
"analysis": [
{
"frame_file": "frame_00001.jpg",
"timestamp": "00:00:00",
"description": "场景描述内容...",
"elements": ["人物", "背景", "道具"],
"style": "风格描述..."
},
{
"frame_file": "frame_00002.jpg",
"timestamp": "00:00:03",
"description": "场景描述内容...",
"elements": ["人物", "背景", "道具"],
"style": "风格描述..."
}
]
}**抽帧技术:**
**视觉分析:**
**Coze Bot优势:**
**性能优化:**
收录最全、更新最快的AI Agent技能库,涵盖文档处理、内容创作、编程开发、机器学习、自动化工作流等多个领域的精选技能包。 🧠 知易智能基座 :20+模型自由切换,知识永远留在你手里 —一个对话框调度所有模型,240+技能即插即用,四色卡片让AI真正记住你。 👉 申请体验
将 PDF/PPT/Excel/Word 等多格式文档解析为结构化 Markdown,并输出元数据与解析置信度,作为 RAG 与四色卡片的数据底座。
产品经理与项目管理专家在应对复杂项目时,使用此技能可动态组建包含“执行、指挥、评审”的专属AI团队。实时查看多智能体辩论与决策全过程,共享统一上下文记忆,一键完成从会议决策到系统构建的全流…
电商运营与内容创作者在需要制作带货短视频时,用此技能一键生成9:16竖屏数字人成片。自动编排AI绘画、语音合成与视频生成,快速产出“小省导购员”专属形象与专业配音,让多模态视频制作省时省力…