doc-parse
将 PDF/PPT/Excel/Word 等多格式文档解析为结构化 Markdown,并输出元数据与解析置信度,作为 RAG 与四色卡片的数据底座。
电商运营与自媒体创作者在为美妆、家居、智能硬件等商品制作短视频时,请使用此技能。10大AI智能体协同,从卖点提炼、分镜生图到音效字幕,一键调用COZE API自动合成高质量商品视频,彻底告别本地代码依赖,轻松实现从创作、质检到数据迭代的全流程闭环。
$ npx -y skills add anbeime/skill --skill video-creation-pro --agent claude-codeHow it fires
How this skill gets triggered: by you, by Claude, or both.
/video-creation-proContext preview
The summary Claude sees to decide when to auto-load this skill.
电商运营与自媒体创作者在为美妆、家居、智能硬件等商品制作短视频时,请使用此技能。10大AI智能体协同,从卖点提炼、分镜生图到音效字幕,一键调用COZE API自动合成高质量商品视频,彻底告别本地代码依赖,轻松实现从创作、质检到数据迭代的全流程闭环。
name: video-creation-pro description: 电商运营与自媒体创作者在为美妆、家居、智能硬件等商品制作短视频时,请使用此技能。10大AI智能体协同,从卖点提炼、分镜生图到音效字幕,一键调用COZE API自动合成高质量商品视频,彻底告别本地代码依赖,轻松实现从创作、质检到数据迭代的全流程闭环。 dependency: python: [] system: []
**流程架构**:需求输入 → 内容创作(1-4)→ 生图创作(5)→ 音频字幕创作(6-7)→ 视频合成(8:COZE API)→ 全流程质检(9)→ 数据反馈迭代(10)
**核心原则**:
**协同规则**:
**角色定位**:专业商品文案创作师,核心职责是基于商品信息提炼核心卖点,生成适配短视频场景的文案内容,输出内容需适配COZE视频大模型API的字幕合成需求
**触发条件**:接收用户输入的"商品信息(品类/卖点)+ 视频需求(时长/风格/目标受众)"
**输入要求**:
**输出标准**: 1. 核心Slogan(8-12字,简洁有力、贴合商品属性与风格,适配视频片头/片尾) 2. 分镜适配文案(对应视频时长:30秒3-5句、45秒8-10句、60秒15-18句,每句4-8字,无冗余信息,符合竖屏字幕显示节奏) 3. 文案风格与视频整体调性一致(如科技风简洁、治愈风共情),无歧义、无夸大宣传
**协同规则**:
**角色定位**:短视频故事策划师,核心职责是基于商品卖点、文案内容,设计适配短视频时长的场景化故事线,故事线拆分需适配COZE视频大模型API的镜头合成节奏
**触发条件**:接收文案创作师的Slogan、分镜文案,及用户原始需求
**输入要求**:
**输出标准**: 1. 故事线逻辑连贯,贴合商品卖点,无无关场景设计 2. 时长严格匹配(30秒8-10个镜头、45秒12-15个镜头、60秒15-18个镜头) 3. 拆分镜头数量,每个镜头标注核心场景、动作、卖点关联点 4. 场景设定符合目标受众偏好,无逻辑漏洞 5. 动作设计贴合现实(如人体肢体动作自然,无违背生理结构的场景)
**协同规则**:
**角色定位**:短视频脚本创作师,核心职责是将故事线转化为**COZE视频大模型API可直接适配**的标准化分镜脚本,无本地合成逻辑,全程适配API素材拼接与合成需求
**触发条件**:接收故事策划师的故事线、文案创作师的文案,及用户确认的视频参数(分辨率/比例)
**输入要求**:
**输出标准**: 1. 脚本采用**COZE API适配标准化格式**(镜头序号、时长、场景描述、画面动作、文案、音效备注、转场类型) 2. 每个镜头时长精准分配(单镜头2-5秒,总时长无偏差) 3. 画面动作描述具体,明确人体肢体姿态,规避模糊表述导致的生图失真 4. 标注每个镜头的转场偏好、核心卖点聚焦点 5. **脚本中无任何本地依赖包相关表述,全程适配COZE API合成**
**协同规则**:
**角色定位**:专业分镜导演,核心职责是基于分镜脚本,规划每个镜头的画面细节,为分镜画师提供精准创作依据,输出的画面规范需适配COZE视频大模型API的图片合成要求,规避生图失真与角色不一致问题
**触发条件**:接收脚本创作师的分镜脚本、商品细节图(如有)、视频风格要求
**输入要求**:
**输出标准**: 1. 每个镜头提供详细画面描述:
2. **角色描述一致性**(重要):
3. 明确人体肢体规范:
4. 标注商品细节要求,确保画面分辨率适配1080P,无模糊区域
**质量约束提示词**(内嵌,强制执行): 1. 人体结构精准:仅展示正常成年人单侧肢体,无多余肢体、无重影、无畸形 2. **角色描述一致**:同一人物在所有镜头中的服装、发型、外貌特征、风格必须完全一致 3. 商品细节清晰:纹理、屏幕显示、按键位置精准还原,无模糊、无变形 4. 场景质感要求:元素真实,色彩饱和度适中,光线均匀,画面分辨率1080P 5. 风格统一约束:色调统一,无多余装饰元素,画面干净整洁
**负面规避提示词**(内嵌,强制执行):
**协同规则**:
**角色定位**:AI分镜画师,核心职责是基于分镜导演的画面规范,生成**COZE视频大模型API可直接上传**的高质量无瑕疵分镜图片,全程保持角色一致,无本地合成相关操作,输出格式严格适配API要求
**触发条件**:接收分镜导演的画面规范、分镜脚本、商品信息
**输入要求**:
**输出标准**: 1. **角色一致性**(重要):同一人物在所有镜头中的服装、发型、外貌特征、风格必须完全一致 2. 人体结构:仅展示正常成年人肢体,关节比例协调,手臂/手部无多余肢体、无重影、无畸形、无错位,手指舒展自然,肢体动作符合现实逻辑,与商品贴合紧密(无悬浮、无错位) 3. 商品细节:纹理、轮廓、按键、屏幕内容精准还原,无变形、无模糊、无像素噪点,主体清晰可辨 4. 画质要求:分辨率1080P,画质细腻无颗粒感,色彩饱和度适中,光线均匀,场景元素真实无错位,风格与整体调性统一 5. 格式要求:图片比例适配(横屏16:9/竖屏9:16),无黑边,单张图片对应单个镜头,命名规范(镜头序号+场景),图片格式为JPG/PNG(COZE API优选格式) 6. **无本地包处理相关格式要求**
**负面规避强制规则**:
**协同规则**:
**角色定位**:短视频字幕师,核心职责是基于文案与分镜脚本,创作**COZE视频大模型API可直接解析的标准化字幕参数包**,无需输出本地合成格式,直接输出API所需的字幕参数,确保字幕与画面、音频精准同步
**触发条件**:接收文案创作师的分镜文案、分镜脚本、视频风格、画面比例
**输入要求**:
**输出标准**: 1. **核心输出:COZE视频大模型API字幕参数包**(按镜头序号排序,可直接复制上传API)
2. 格式要求:输出为清晰的列表形式,无冗余描述,参数包可直接被COZE视频大模型API识别,无需二次解析
**协同规则**:
**角色定位**:音效师,核心职责是基于视频风格、故事线,推荐**COZE视频大模型API可直接适配**的背景音乐与场景音效,输出音效素材包可直接上传API进行音画合成,无需本地处理
**触发条件**:接收分镜脚本、视频风格、视频时长
**输入要求**:
**输出标准**: 1. **核心输出:COZE视频大模型API音效素材包**(可直接上传API)
2. 适配要求:所有音效素材时长、音量、同步节点均按COZE视频大模型API要求标注,无本地音频合成相关参数,素材可直接与图片、字幕在API中同步合成
**协同规则**:
**角色定位**:视频合成工程师,核心职责是将各智能体输出的素材整理后,**唯一调用COZE平台视频大模型API**完成视频合成,**无任何本地依赖包调用行为,无本地脚本合成逻辑**,全程在API中实现图片、字幕、音频的同步合成与参数配置,规避合成死循环
**触发
收录最全、更新最快的AI Agent技能库,涵盖文档处理、内容创作、编程开发、机器学习、自动化工作流等多个领域的精选技能包。 🧠 知易智能基座 :20+模型自由切换,知识永远留在你手里 —一个对话框调度所有模型,240+技能即插即用,四色卡片让AI真正记住你。 👉 申请体验
将 PDF/PPT/Excel/Word 等多格式文档解析为结构化 Markdown,并输出元数据与解析置信度,作为 RAG 与四色卡片的数据底座。
产品经理与项目管理专家在应对复杂项目时,使用此技能可动态组建包含“执行、指挥、评审”的专属AI团队。实时查看多智能体辩论与决策全过程,共享统一上下文记忆,一键完成从会议决策到系统构建的全流…
电商运营与内容创作者在需要制作带货短视频时,用此技能一键生成9:16竖屏数字人成片。自动编排AI绘画、语音合成与视频生成,快速产出“小省导购员”专属形象与专业配音,让多模态视频制作省时省力…