ai-image-gen
通用 AI 生图:文生图 / 图生图 / 图像变体。当用户说 AI 生图、AI 画图、文生图、图生图、生成图片、生成配图、图像生成、AI 出图、AI…
把口播、讲座、直播或 Vlog 转录并改写成小红书笔记、公众号文章或知乎内容,同时抽帧配图。当用户说“视频转图文/文章/笔记、视频扒文案、口播转文章、视频内容复用”时使用。只生成字幕文件用 auto-subtitle;翻译已有字幕用 subtitle-translate。
$ npx -y skills add zju-real/easel --skill video-to-article --agent claude-codeHow it fires
How this skill gets triggered: by you, by Claude, or both.
/video-to-articleContext preview
The summary Claude sees to decide when to auto-load this skill.
把口播、讲座、直播或 Vlog 转录并改写成小红书笔记、公众号文章或知乎内容,同时抽帧配图。当用户说“视频转图文/文章/笔记、视频扒文案、口播转文章、视频内容复用”时使用。只生成字幕文件用 auto-subtitle;翻译已有字幕用 subtitle-translate。
name: video-to-article description: "把口播、讲座、直播或 Vlog 转录并改写成小红书笔记、公众号文章或知乎内容,同时抽帧配图。当用户说“视频转图文/文章/笔记、视频扒文案、口播转文章、视频内容复用”时使用。只生成字幕文件用 auto-subtitle;翻译已有字幕用 subtitle-translate。" layer: produce
> 把视频复用成图文内容:转录 → 结构化成篇 → 抽帧配图。转录与抽帧走确定性脚本 > (`asr.py` / `video_ops.py`),**结构化成文由你(LLM)完成**——这是本 SKILL 的核心价值。
> 只出字幕文件见 **auto-subtitle**;翻译字幕见 **subtitle-translate**; > 出成套小红书卡片见 **xhs-note-creator**;纯文案润色见 **text-polisher**。
| 字段 | 必填 | 说明 | |------|------|------| | 视频文件 | 是 | 口播/讲座/直播/Vlog(没给就问) | | 目标形态 | 否 | 小红书笔记(默认)/ 公众号文章 / 知乎回答 / 通用图文 | | 配图数量 | 否 | 从视频抽几张配图(默认 3-6,按内容节点) |
脚本路径(相对项目根):`skills/shared/scripts/asr.py`、`skills/shared/scripts/video_ops.py`。
python skills/shared/scripts/asr.py transcribe -i input.mp4 --format json \ -o outputs/主题名/assets/transcript.json python skills/shared/scripts/asr.py transcribe -i input.mp4 --format txt \ -o outputs/主题名/assets/transcript.txt
(首次跑 ASR 需外网代理下模型,见 auto-subtitle 前置说明。)
读转录,按目标形态改写成图文,**不是照抄口语**:
知乎(专业、有逻辑链)。字数与排版参考 `post-formatter` / `social-content` 规范。
按第 2 步标注的时间点,逐个抽帧:
python skills/shared/scripts/video_ops.py frame -i input.mp4 \ -o outputs/主题名/assets/frame-01.jpg --time 00:02:15 --width 1080
挑画面清晰、有信息量的时间点(避免糊帧/转场帧)。
需要做成小红书卡片组时,把 `article.md` 交给 **xhs-note-creator** 或 **card-xiaohongshu**。
话题标签贴合账号垂类;合规底线遵守 `preferences.md`。
1. 是**改写**不是**照搬转录**——口语要书面化、结构化,去口水词。 2. 配图从视频真实画面抽取,时间点由内容决定,避免糊帧。 3. 不编造视频里没有的信息;转录不清处标注"[听不清]"而非臆测。 4. 保留说话人的核心观点与个人风格,别改成千篇一律的 AI 腔(可再过 text-polisher)。 5. 最终 `article.md` 放 `outputs/主题名/`,转录和抽帧等中间件放 `outputs/主题名/assets/`。
视频→图文是创作者复用内容的高频需求(一鱼多吃)。转录用 faster-whisper(asr.py),配图用 ffmpeg 抽帧(video_ops.py frame),成文结构化交给 LLM——把确定性 IO 与创意改写分层。
An open-source AI agent for social media — discover trends, create content, publish everywhere, and learn what works across Xiaohongshu, Douyin, Zhihu, Bilibili, and more.🎨一个开源的 AI 社交媒体智能体——发现热点趋势、创作内容、一键发布至各大平台,并学习分析哪些内容真正有效,覆盖小红书、抖音、知乎、哔哩哔哩等平台。
Repo: zju-real/easel
通用 AI 生图:文生图 / 图生图 / 图像变体。当用户说 AI 生图、AI 画图、文生图、图生图、生成图片、生成配图、图像生成、AI 出图、AI…
AI 音乐 / BGM 生成:给短视频、社媒内容生成原创背景音乐 / 配乐 / 纯音乐。通过可插拔 provider(阿里 DashScope / Suno 类第三方…
AI 视频生成:文生视频 / 图生视频 / 数字人首帧驱动。通过可插拔 provider(通义万相 Wan / 火山 Seedance / 快手可灵 / OpenAI…
outputs/ 目录下的产物管理:按日期/平台/类型归档、打标签、搜索历史内容、生成素材清单。 当用户说"整理素材"、"归档"、"找之前的内容"、"搜索历史"、"素材管理"、…
音频降噪:去除录音中的背景噪声、电流声、风噪、嗡嗡声,基于 ffmpeg 滤镜链(afftdn/highpass/lowpass)。…
通用音频处理:音频剪辑/裁剪、格式转码(mp3/wav/m4a/aac)、音量归一化、从视频提取音轨、多段拼接、淡入淡出、变速(保音高)。当用户说“剪音频”“裁一段”“转成…