ai-image-gen
通用 AI 生图:文生图 / 图生图 / 图像变体。当用户说 AI 生图、AI 画图、文生图、图生图、生成图片、生成配图、图像生成、AI 出图、AI…
AI 视频生成:文生视频 / 图生视频 / 数字人首帧驱动。通过可插拔 provider(通义万相 Wan / 火山 Seedance / 快手可灵 / OpenAI 兼容)异步生成视频,用户自备 API key。当用户说 AI 视频生成、文生视频、图生视频、AI 生成视频、AI 短视频、让图片动起来、数字人视频、生成一段视频 时使用。与 video-strategy(选型/策略)、video-editing(剪辑处理)、clipify(切片)区别:本 SKILL 是从 0 用 AI 生成新视频。
$ npx -y skills add zju-real/easel --skill ai-video-gen --agent claude-codeHow it fires
How this skill gets triggered: by you, by Claude, or both.
/ai-video-genContext preview
The summary Claude sees to decide when to auto-load this skill.
AI 视频生成:文生视频 / 图生视频 / 数字人首帧驱动。通过可插拔 provider(通义万相 Wan / 火山 Seedance / 快手可灵 / OpenAI 兼容)异步生成视频,用户自备 API key。当用户说 AI 视频生成、文生视频、图生视频、AI 生成视频、AI 短视频、让图片动起来、数字人视频、生成一段视频 时使用。与 video-strategy(选型/策略)、video-editing(剪辑处理)、clipify(切片)区别:本 SKILL 是从 0 用 AI 生成新视频。
name: ai-video-gen description: "AI 视频生成:文生视频 / 图生视频 / 数字人首帧驱动。通过可插拔 provider(通义万相 Wan / 火山 Seedance / 快手可灵 / OpenAI 兼容)异步生成视频,用户自备 API key。当用户说 AI 视频生成、文生视频、图生视频、AI 生成视频、AI 短视频、让图片动起来、数字人视频、生成一段视频 时使用。与 video-strategy(选型/策略)、video-editing(剪辑处理)、clipify(切片)区别:本 SKILL 是从 0 用 AI 生成新视频。" layer: produce
> 文生视频 / 图生视频 / 数字人首帧驱动。封装 `shared/scripts/ai_video.py`,多 provider 可插拔、异步提交→轮询→下载。**用户自备 API key**(在 `.env` 配置)。
> **配置检查路径铁律**:先 `cd` 到 `AGENTS.md` 末尾给出的 Easel 项目根,确认当前目录有 `.env` 和 `skills/shared/scripts/`,再运行注册表、`check` 或生成命令。不得改用 workspace 的 `./shared/scripts/...`,也不得以 `env` / `printenv` 没显示变量为由判断未配置。
先选 provider 并在 `.env` 填对应 key,然后 `check` 离线校验:
python skills/shared/scripts/ai_video.py check --provider dashscope
| provider | 服务 | 需在 .env 配 | |----------|------|-------------| | `dashscope` | 阿里通义万相 Wan | `DASHSCOPE_API_KEY`(可选 `DASHSCOPE_VIDEO_MODEL`/`DASHSCOPE_BASE_URL`;兼容旧名 `DASHSCOPE_MODEL`) | | `ark` | 火山引擎 Seedance | `ARK_API_KEY`(可选 `ARK_MODEL`/`ARK_BASE_URL`) | | `kling` | 快手可灵 | `KLING_ACCESS_KEY` + `KLING_SECRET_KEY`(JWT 鉴权) | | `openai-compatible` | 通用 /videos 端点 | `VIDEO_API_KEY` + `VIDEO_BASE_URL`(可选 `VIDEO_MODEL`) | | `xhs-maas` | 小红书内网 MaaS(happyhorse 文/图生视频)| `XHS_MAAS_API_KEY`(可选 `XHS_MAAS_VIDEO_BASE`/`XHS_MAAS_T2V_MODEL`/`XHS_MAAS_I2V_MODEL`)。DashScope 风格异步 + api-key 头,内网直连 | | `agnes` | Agnes(agnes-video-2.5-flash)| `AGNES_API_KEY`(可选 `AGNES_BASE_URL`/`AGNES_MODEL`/`AGNES_SIZE`)。OpenAI Videos 兼容创建 + 自定义端点轮询;**默认带原生音频**(prompt 描述声音);外网走代理 |
也可设 `VIDEO_PROVIDER` 免去每次 `--provider`。
执行前先跑 `model_registry.py configured --group video --env-file .env`:只有一个可用就显式选它;多个可用且用户没点名时,列出 provider/模型询问本次使用哪个,不按默认值擅自选择。
> **画幅确认硬门**:用户或上游任务未明确横版/竖版(或 16:9/9:16/具体比例)时,任何生成/付费调用前必须追问并等确认;不得从平台、Profile 或脚本默认值静默推断。已明确则不重复问。
生成的视频文件;必须用 `-o` 指定到 `outputs/主题名/`。异步任务自动轮询到完成再下载。
1. **确认配置与能力**:先运行 `check`,再运行 `capabilities --provider <p> --model <m>`。短剧不得根据品牌名猜测模型是否支持原生音频;新模型用 `VIDEO_CAPABILITIES_JSON` 登记能力和请求字段,无需修改调用流程。
2. **写好 prompt**:AI 视频对 prompt 敏感,按 [AI 视频提示词规范](../video-strategy/references/ai-video-prompting.md) 写镜头、运镜、风格与时长。竖版短视频用 `--ratio 9:16`。 3. **文生视频**:
python skills/shared/scripts/ai_video.py text2video --provider dashscope \
--prompt "海边日落,慢镜头推进,暖色调,电影感" --ratio 9:16 --duration 5 \
--audio auto \
-o outputs/主题名/clip.mp44. **图生视频 / 让图动起来 / 数字人首帧**:
python skills/shared/scripts/ai_video.py image2video --provider kling \
--image outputs/主题名/cover.png --prompt "人物微笑挥手,头发轻微飘动" \
-o outputs/主题名/clip.mp45. **后续加工**:生成的片段可交给 `video_ops.py`(拼接/加字幕/加 BGM/横竖转)、`auto-subtitle`(字幕)、`tts-voiceover`(配音)串成成片,或直接进 `auto-short-video` 端到端流程。
An open-source AI agent for social media — discover trends, create content, publish everywhere, and learn what works across Xiaohongshu, Douyin, Zhihu, Bilibili, and more.🎨一个开源的 AI 社交媒体智能体——发现热点趋势、创作内容、一键发布至各大平台,并学习分析哪些内容真正有效,覆盖小红书、抖音、知乎、哔哩哔哩等平台。
Repo: zju-real/easel
通用 AI 生图:文生图 / 图生图 / 图像变体。当用户说 AI 生图、AI 画图、文生图、图生图、生成图片、生成配图、图像生成、AI 出图、AI…
AI 音乐 / BGM 生成:给短视频、社媒内容生成原创背景音乐 / 配乐 / 纯音乐。通过可插拔 provider(阿里 DashScope / Suno 类第三方…
outputs/ 目录下的产物管理:按日期/平台/类型归档、打标签、搜索历史内容、生成素材清单。 当用户说"整理素材"、"归档"、"找之前的内容"、"搜索历史"、"素材管理"、…
音频降噪:去除录音中的背景噪声、电流声、风噪、嗡嗡声,基于 ffmpeg 滤镜链(afftdn/highpass/lowpass)。…
通用音频处理:音频剪辑/裁剪、格式转码(mp3/wav/m4a/aac)、音量归一化、从视频提取音轨、多段拼接、淡入淡出、变速(保音高)。当用户说“剪音频”“裁一段”“转成…