ai-image-gen
通用 AI 生图:文生图 / 图生图 / 图像变体。当用户说 AI 生图、AI 画图、文生图、图生图、生成图片、生成配图、图像生成、AI 出图、AI…
视频制作策略与工具选型:AI 视频生成模型对比、视频脚本结构设计、制作流程规划,覆盖产品演示/解说/社媒短视频场景。 当用户说"视频怎么做""视频选型""用什么工具做视频""视频制作流程""视频策略""视频系列规划"时使用。 和 video-script 的区别:video-strategy 做内容规划与工具选型,video-script 写具体某条视频的脚本。
$ npx -y skills add zju-real/easel --skill video-strategy --agent claude-codeHow it fires
How this skill gets triggered: by you, by Claude, or both.
/video-strategyContext preview
The summary Claude sees to decide when to auto-load this skill.
视频制作策略与工具选型:AI 视频生成模型对比、视频脚本结构设计、制作流程规划,覆盖产品演示/解说/社媒短视频场景。 当用户说"视频怎么做""视频选型""用什么工具做视频""视频制作流程""视频策略""视频系列规划"时使用。 和 video-script 的区别:video-strategy 做内容规划与工具选型,video-script 写具体某条视频的脚本。
name: video-strategy description: >- 视频制作策略与工具选型:AI 视频生成模型对比、视频脚本结构设计、制作流程规划,覆盖产品演示/解说/社媒短视频场景。 当用户说"视频怎么做""视频选型""用什么工具做视频""视频制作流程""视频策略""视频系列规划"时使用。 和 video-script 的区别:video-strategy 做内容规划与工具选型,video-script 写具体某条视频的脚本。 layer: produce
视频制作策略与工具选型。覆盖 AI 视频生成模型对比、程序化视频框架选择、视频脚本结构设计、制作流程规划。
> 本技能负责**策略规划和工具选型**。已部署的 `video-editing` 技能可执行实际的 ffmpeg 剪辑操作(裁剪、跳切、文字覆盖、变速等)。
确认以下信息(未提供则主动询问):
| 方案 | 适用场景 | 工具 | 可用性 | |------|---------|------|--------| | **程序化视频** | 模板化、数据驱动、批量 | Hyperframes, Remotion | ✅ Node.js 可用 | | **AI 视频生成** | 原创画面、B-roll | Veo 3, Sora 2, Runway, Kling, Seedance | ⚠️ 需 API key | | **AI 数字人** | 真人呈现、多语言 | HeyGen, Synthesia | ⚠️ 需 API key | | **剪辑/二创** | 长视频拆短视频 | ffmpeg (video-editing 技能), CapCut | ✅ ffmpeg 可用 |
如用户需要 AI 生成视频画面,参考此表选型:
| 模型 | 分辨率 | 最长时长 | 特长 | 成本 | |------|--------|---------|------|------| | **Veo 3** (Google) | 最高 1080p | 可变 | 最高画质 + 同步音频 | API 计费 | | **Sora 2** (OpenAI) | 最高 1080p | ~20s | 电影质感 + 同步音频 | API + ChatGPT | | **Runway Gen-4** | 最高 4K | ~10s/次 | 运动控制、时序一致性 | 订阅制 | | **Kling 2.5/3.0** (快手) | 最高 1080p | 最长 2 分钟 | 长镜头、单位成本低 | 按秒计费(低单价) | | **Seedance** (字节跳动) | 最高 1080p | 短片段 | 快速生成、运动保真度高、适合批量 | 按积分 | | **Hailuo / MiniMax** (MiniMax) | 最高 1080p | 短片段 | 跨镜头角色一致性 | 按积分 | | **Pika 2.x** | 1080p | 短片段 | 快速特效、图生视频 | 按积分 | | **混元视频 / Wan 2** (腾讯) | 720p-1080p | 可变 | 开源自部署,完全可控,无 API 费 | 免费 (需 GPU) |
**快速选型**:
> 上表型号版本号与定价随厂商快速迭代,仅供选型参考,**以各厂商官方最新公布为准**。
> 视频 AI 提示词写法详见 [references/ai-video-prompting.md](references/ai-video-prompting.md)
| 平台 | 画幅比 | 推荐分辨率 | 时长限制 | 备注 | |------|--------|-----------|---------|------| | **抖音** | 9:16 | 1080x1920 | 15s / 60s / 15min | 15s 以内完播率权重最高 | | **B站** | 16:9 | 1920x1080 | 无硬性上限 | 横屏为主,竖屏也支持 | | **快手** | 9:16 | 1080x1920 | 11min | 竖屏为主 | | **视频号** | 9:16 / 16:9 | 1080x1920 | 30min | 短视频 < 1min 优先推荐 | | **小红书** | 9:16 / 3:4 | 1080x1920 | 15min | 3:4 也常用 |
| 平台 | 画幅比 | 推荐分辨率 | 时长限制 | |------|--------|-----------|---------| | **YouTube** | 16:9 | 1920x1080 / 3840x2160 | 无限制 | | **YouTube Shorts** | 9:16 | 1080x1920 | 60s | | **TikTok** | 9:16 | 1080x1920 | 10min | | **Instagram Reels** | 9:16 | 1080x1920 | 90s | | **Instagram Feed** | 1:1 / 4:5 | 1080x1080 / 1080x1350 | 60s |
用代码生成视频,适合可重复、模板化、数据驱动的批量制作。
**Hyperframes**(HTML/CSS,推荐)— 开源,Apache 2.0,每帧是 HTML 文档,对 agent 最友好。 **Remotion**(React)— 更强的动画能力,适合复杂动效和 Lambda 批量渲染。
| 因素 | Hyperframes | Remotion | |------|-------------|----------| | Agent 友好度 | 更好(纯 HTML) | 好(React) | | 动画能力 | 基础(CSS transition) | 高级(Spring, interpolate) | | 批量渲染 | 本地 | Lambda (AWS) | | 许可 | Apache 2.0 | 商用需授权 |
**产品演示视频**:脚本 → 录屏 → 程序化叠加(标题、标注)→ AI B-roll → 配音 → 按平台规格导出
**解说视频**:脚本(问题→方案→CTA)→ 选呈现方式(AI 数字人 / 旁白)→ 画面制作 → 加字幕 → 导出
**批量社媒短视频**:Hyperframes/Remotion 建模板 → 灌数据 → 批量渲染 → 加平台字幕 → 分发
**病毒式剪辑复刻**:拉参考视频 → 逐拍分解剪辑节奏 → 输出 beat sheet → 用自己素材执行。详见 [references/edit-anatomy.md](references/edit-anatomy.md)
Agent 写脚本(结合 Profile)
↓
Hyperframes: HTML → MP4(程序化视频)
和/或
AI 视频 API: 生成 B-roll
↓
ffmpeg (video-editing 技能): 剪辑拼接
↓
产物 → outputs/1. **先选工具再想策略** — 先明确视频目标,再选工具 2. **AI 生成视频中加文字** — 模型无法可靠渲染可读文字,用程序化叠加 3. **忽略字幕** — 85% 社媒视频静音观看,必须加字幕 4. **画幅比错误** — 竖屏 9:16 社媒,横屏 16:9 YouTube/网站 5. **过度制作** — 社媒平台上真实感往往胜过精致感
检测 `=== EASEL ACCOUNT PROFILE ===` 标记。
**有 Profile 时**:
**无 Profile 时**:
An open-source AI agent for social media — discover trends, create content, publish everywhere, and learn what works across Xiaohongshu, Douyin, Zhihu, Bilibili, and more.🎨一个开源的 AI 社交媒体智能体——发现热点趋势、创作内容、一键发布至各大平台,并学习分析哪些内容真正有效,覆盖小红书、抖音、知乎、哔哩哔哩等平台。
Repo: zju-real/easel
通用 AI 生图:文生图 / 图生图 / 图像变体。当用户说 AI 生图、AI 画图、文生图、图生图、生成图片、生成配图、图像生成、AI 出图、AI…
AI 音乐 / BGM 生成:给短视频、社媒内容生成原创背景音乐 / 配乐 / 纯音乐。通过可插拔 provider(阿里 DashScope / Suno 类第三方…
AI 视频生成:文生视频 / 图生视频 / 数字人首帧驱动。通过可插拔 provider(通义万相 Wan / 火山 Seedance / 快手可灵 / OpenAI…
outputs/ 目录下的产物管理:按日期/平台/类型归档、打标签、搜索历史内容、生成素材清单。 当用户说"整理素材"、"归档"、"找之前的内容"、"搜索历史"、"素材管理"、…
音频降噪:去除录音中的背景噪声、电流声、风噪、嗡嗡声,基于 ffmpeg 滤镜链(afftdn/highpass/lowpass)。…
通用音频处理:音频剪辑/裁剪、格式转码(mp3/wav/m4a/aac)、音量归一化、从视频提取音轨、多段拼接、淡入淡出、变速(保音高)。当用户说“剪音频”“裁一段”“转成…