ai-image-gen
通用 AI 生图:文生图 / 图生图 / 图像变体。当用户说 AI 生图、AI 画图、文生图、图生图、生成图片、生成配图、图像生成、AI 出图、AI…
通用音频处理:音频剪辑/裁剪、格式转码(mp3/wav/m4a/aac)、音量归一化、从视频提取音轨、多段拼接、淡入淡出、变速(保音高)。当用户说“剪音频”“裁一段”“转成 mp3”“调音量/响度”“提取音轨/扒音频”“拼接音频”“淡入淡出”“加速/减速音频”“变速不变调”时使用。与 audio-denoise 的区别:audio-denoise 专做降噪,audio-editing 做除降噪外的通用音频操作(也内置 denoise 作为兜底)。
$ npx -y skills add zju-real/easel --skill audio-editing --agent claude-codeHow it fires
How this skill gets triggered: by you, by Claude, or both.
/audio-editingContext preview
The summary Claude sees to decide when to auto-load this skill.
通用音频处理:音频剪辑/裁剪、格式转码(mp3/wav/m4a/aac)、音量归一化、从视频提取音轨、多段拼接、淡入淡出、变速(保音高)。当用户说“剪音频”“裁一段”“转成 mp3”“调音量/响度”“提取音轨/扒音频”“拼接音频”“淡入淡出”“加速/减速音频”“变速不变调”时使用。与 audio-denoise 的区别:audio-denoise 专做降噪,audio-editing 做除降噪外的通用音频操作(也内置 denoise 作为兜底)。
name: audio-editing description: "通用音频处理:音频剪辑/裁剪、格式转码(mp3/wav/m4a/aac)、音量归一化、从视频提取音轨、多段拼接、淡入淡出、变速(保音高)。当用户说“剪音频”“裁一段”“转成 mp3”“调音量/响度”“提取音轨/扒音频”“拼接音频”“淡入淡出”“加速/减速音频”“变速不变调”时使用。与 audio-denoise 的区别:audio-denoise 专做降噪,audio-editing 做除降噪外的通用音频操作(也内置 denoise 作为兜底)。" layer: produce
除降噪外的通用音频操作:裁剪、转码、音量归一化、提取音轨、拼接、淡入淡出、变速。全部通过共享脚本 `skills/shared/scripts/audio_ops.py` 封装 ffmpeg,参数确定、可复现,不现场手拼命令。
| 字段 | 必填 | 说明 | |------|------|------| | input_file | 是 | 音频或视频文件路径 | | operation | 是 | trim / convert / normalize / extract / concat / fade / speed / denoise / info | | output_file | 否 | 默认 `outputs/主题名/{name}-{op}.{ext}` |
支持格式:wav / mp3 / m4a / aac / flac,视频容器 mp4 / mkv / mov(提取音轨)。
脚本路径(相对项目根):`skills/shared/scripts/audio_ops.py`。每个子命令都支持 `-h`。
python skills/shared/scripts/audio_ops.py info input.mp3
脚本自身会检查 ffmpeg/ffprobe,缺失时给安装提示。先 `info` 展示文件时长/码率/声道再动手。
# 起止时间 python skills/shared/scripts/audio_ops.py trim in.mp3 -o outputs/主题名/clip.mp3 --start 00:00:05 --end 00:00:20 # 起点 + 时长 python skills/shared/scripts/audio_ops.py trim in.mp3 -o clip.mp3 --start 5 --duration 15
python skills/shared/scripts/audio_ops.py convert in.wav -o out.mp3 --bitrate 192k python skills/shared/scripts/audio_ops.py convert in.m4a -o out.wav --sample-rate 44100 --channels 2
输出格式由扩展名决定(mp3/wav/m4a/aac)。
python skills/shared/scripts/audio_ops.py normalize in.mp3 -o out.mp3
默认 loudnorm 到 -14 LUFS / -1.5 dBTP(社媒/播客通用响度)。可用 `--i --tp --lra` 覆盖。
python skills/shared/scripts/audio_ops.py extract video.mp4 -o audio.m4a python skills/shared/scripts/audio_ops.py extract video.mp4 -o audio.aac --copy # 不重编码,最快
python skills/shared/scripts/audio_ops.py concat a.mp3 b.mp3 c.mp3 -o all.mp3
按参数顺序拼接,重编码方式兼容不同采样率/容器。
python skills/shared/scripts/audio_ops.py fade in.mp3 -o out.mp3 --fade-in 2 --fade-out 3
`--fade-out` 自动定位到结尾前 N 秒。
python skills/shared/scripts/audio_ops.py speed in.mp3 -o out.mp3 --factor 1.5 # 1.5 倍速 python skills/shared/scripts/audio_ops.py speed in.mp3 -o out.mp3 --factor 0.8 # 放慢
基于 atempo 保音高,超 0.5-2.0 范围自动级联。
python skills/shared/scripts/audio_ops.py denoise in.wav -o out.wav --tier 2
1. **绝不删除原始文件** — 只写新文件到 `outputs/主题名/`。 2. **先 info 再处理** — 展示文件信息,避免误操作。 3. **视频输入只动音频** — denoise 对视频自动 `-c:v copy`;纯抽音用 extract。 4. **透明执行** — 脚本会打印实际 ffmpeg 命令。 5. **无 Profile 也能用** — 音频处理不依赖账号画像。
有 Profile 时可据平台偏好选默认参数(如短视频响度、目标码率);无 Profile 退到通用默认(-14 LUFS、192k)。
An open-source AI agent for social media — discover trends, create content, publish everywhere, and learn what works across Xiaohongshu, Douyin, Zhihu, Bilibili, and more.🎨一个开源的 AI 社交媒体智能体——发现热点趋势、创作内容、一键发布至各大平台,并学习分析哪些内容真正有效,覆盖小红书、抖音、知乎、哔哩哔哩等平台。
Repo: zju-real/easel
通用 AI 生图:文生图 / 图生图 / 图像变体。当用户说 AI 生图、AI 画图、文生图、图生图、生成图片、生成配图、图像生成、AI 出图、AI…
AI 音乐 / BGM 生成:给短视频、社媒内容生成原创背景音乐 / 配乐 / 纯音乐。通过可插拔 provider(阿里 DashScope / Suno 类第三方…
AI 视频生成:文生视频 / 图生视频 / 数字人首帧驱动。通过可插拔 provider(通义万相 Wan / 火山 Seedance / 快手可灵 / OpenAI…
outputs/ 目录下的产物管理:按日期/平台/类型归档、打标签、搜索历史内容、生成素材清单。 当用户说"整理素材"、"归档"、"找之前的内容"、"搜索历史"、"素材管理"、…
音频降噪:去除录音中的背景噪声、电流声、风噪、嗡嗡声,基于 ffmpeg 滤镜链(afftdn/highpass/lowpass)。…