Skip to content
Image Generation
Skill

/punk-ip-video-cover

从上传人物照片提取四个颜色并搭配,抠出真人,按主题与标题自由构图,制作小红书人物 IP 视频封面;从独立库选择字体、材质与装饰风格,允许动作表情修改,支持 3:4、16:9、4:3、9:16 和多个版本。也用于接入新风格和编写封面提示词。

BOOST
From plugin
punk-skill
1.3k3 skills
Install
$ npx -y skills add adrianpunk/punk-skill --skill punk-ip-video-cover --agent claude-code

How it fires

How this skill gets triggered: by you, by Claude, or both.

  • Fires itselfAuto-invocation. Claude auto-loads it when your prompt matches the work.Auto-invocation is when the right skill fires by itself at the right moment, driven by a FLOW.md router and a hook, instead of you invoking it by name. It is the difference between a skill being installed and a skill actually getting used.Read the full definition →
  • You can call itInvoke it directly when you want it.
  • Slash command/punk-ip-video-cover

Context preview

The summary Claude sees to decide when to auto-load this skill.

从上传人物照片提取四个颜色并搭配,抠出真人,按主题与标题自由构图,制作小红书人物 IP 视频封面;从独立库选择字体、材质与装饰风格,允许动作表情修改,支持 3:4、16:9、4:3、9:16 和多个版本。也用于接入新风格和编写封面提示词。

SKILL.md

punk-ip-video-cover.SKILL.md
name: punk-ip-video-cover
description: 从上传人物照片提取四个颜色并搭配,抠出真人,按主题与标题自由构图,制作小红书人物 IP 视频封面;从独立库选择字体、材质与装饰风格,允许动作表情修改,支持 3:4、16:9、4:3、9:16 和多个版本。也用于接入新风格和编写封面提示词。

Punk IP Video Cover

核心逻辑:上传照片 → 提取四个代表色并合理搭配 → 抠出真人主体 → 每次按主题、标题与画幅自由构图 → 以所选风格处理字体、材质与装饰。四个颜色来自本期照片,构图没有固定模板,人物保持摄影质感;动作与表情可修改。

任务工作流负责输入、四色配色、真人抠图、自由排版与交付;风格库提供字形、字效、材质、标题载体与装饰语言。旧风格文件中的固定坐标、参考色盘、自然背景或不抠图建议,是提炼时的示例而非执行要求,均以本核心规则为准。用户当次明确要求原场景、固定构图或特定色盘时按当次要求执行。

风格保存在自己的 `styles/` 目录:保留用户提供的 Y2K、服装取色真人撕纸拼贴,以及经用户授权整理的 23 个设计方向。不自动引入其他 Punk 技能,也不恢复之前被否定的旧试验模板。文件接入不代表已验证生成效果。

研究只沉淀为文字设计规则。技能包不包含采集的参考封面;生成时不读取研究画廊、截图或博主照片,不将它们传给图像工具。输出仅有本期封面,不出现参考图、研究标注、案例编号、示意框或手机平台界面。

资源

  • 选风格、推荐或列出已有风格:读 [references/style-catalog.md](references/style-catalog.md)。该目录是索引,实际风格以 `styles/*/STYLE.md` 为准。
  • 编写封面提示词:读 [references/cover-prompt-blueprint.md](references/cover-prompt-blueprint.md),再读所选风格的 `STYLE.md` 与 `PROMPT.md`。
  • 提取本期四个颜色并配套:读 [references/photo-palette.md](references/photo-palette.md),记录 C1–C4 的来源和用途;全部风格共用此流程。
  • 安排人物与文字空间、做多比例或同风格排版变体:读 [references/layouts.md](references/layouts.md)。
  • 决定字高、字形、描边、底托、曲线和装饰:读 [references/design-system.md](references/design-system.md)。
  • 选择或重设计人物动作、表情与手持物:读 [references/person-remix.md](references/person-remix.md)。
  • 将同一设计适配到其他比例:读 [references/ratios.md](references/ratios.md)。
  • 用户添加新风格文档、提示词或参考:读 [references/add-style.md](references/add-style.md)。
  • `SOURCE.md` 是原始材料,只有核对原文或处理歧义时才读取;不是每次生成的完整提示词。

输入

  • 人物照片:用于确定本期人物。新一轮未提供照片时,可以沿用用户明确指定的已有照片,不从风格参考中换人。没有照片可以先选风格或写方案;实际生成人物封面前需有身份照片。
  • 用户已允许修改上传人物的动作与表情,适用于全部风格。可按主题调整姿势、手势、朝向、视线与情绪;身份保留不等于锁死原姿态或原笑容。用户在某次任务明确要求原动作/原表情不变时,再局部锁定。
  • 主题或视频标题:用户有标题时逐字保留;只有主题时可提炼封面标题,不编造数据、成果、身份或引语。仅有照片没有内容时询问主题,不擅自给这张照片编一个口号。
  • 比例:使用用户指定值。未指定时采用 3:4 并说明;支持 3:4、16:9、4:3、9:16。用户只要求一个比例时不自动输出四个比例。
  • 可选:风格、版本数量、背景大字、人物名字、辅助短句、补充要求。背景大字仅在风格使用该元素时提炼或沿用;人物名字与辅助短句缺省时省略,不虚构姓名或填充文案。

选风格与多版本

依据主题的表达意图、受众、语气、照片景别与可用空间,以及各风格的 `best_for`、`avoid_for`、`style_anchors`、`supported_ratios` 选择。索引有按主题路由的候选,风格的实际规则以文件为准。

| 用户意图 | 行为 | |---|---| | 指定风格 | 使用指定风格,不再让用户选一次 | | 给主题与照片,让你选;或直接要求制作且没有指定风格 | 自动选一个合适风格,简述选择后继续,不强制等待确认 | | 先推荐、先给我选 | 展示最多三个有差异的已有候选,各给一句贴合主题的理由;等选择后再生成 | | 出几个版本让我选 | 未给数量时默认三个;优先选不同的合适风格,分别生成 | | 指定同一风格、多套排版 | 使用一个风格,改变布局、断行、人物占比或图文层次 | | 只改 skill、接入风格、只要方案或提示词 | 完成对应工作,不额外生成封面 |

多版本沿用同一人物、主题、标题与比例;只有用户要求时才改变文案。不同方案优先在字形、文字路径、人物与字的关系上拉开差异,不仅换背景色。每版各使用一个风格,独立生成和保存,不合成对照九宫格。

没有足够多的合适风格时,如实说明。用户笼统要“几个版本”可以用同一风格的不同排版补足,但必须标注为排版变体;明确要多个不同风格时,先说明当前数量,询问是否接受排版变体或继续提供风格,不冒充已有其他风格。数量不因比例数量而自动相乘。

编译封面

1. 查看上传照片,提取四个代表色,记录各自来源;按本版需求分配背景、文字、强调、辅助用途及同色族派生色,不照搬风格固定色值。 2. 确定本期文字、画幅和人物保护区。把人物从原照片环境中抠出作为独立主体,保留摄影质感和稳定身份,按主题设计动作与表情;不默认复制原背景。 3. 读取所选风格的元数据和视觉原子,用其字形、材质、标题载体和装饰语言设计。每次重新决定人物位置、景别、标题区、断行和文字路径;基础构图库是可选灵感,不按风格固定模板或随机轮转布局。多版本要有可辨认的构图区别。 4. 按蓝图编译成具体提示词,落实四色来源与分工、真人抠图、标题逐字白名单、字号、字效、前后层次、动作表情和装饰用途。标题框或背景字可以随本期布局迁移,不能把材料参考的固定位置、网格数量或固定色盘当约束。 5. 风格的泡泡字、标题牌、纸边、涂鸦等只作用于该风格;提取四个颜色、合理搭配、真人抠图和自由构图是全部风格共用的核心规则。用户当次要求优先,不把研究分析或参考图拼入生成提示词。 6. 原始文档的模型名称只是来源标识,不等于当前环境可用的模型或工具参数。

生成与保存

生成前在当前工作目录保存 `punk-assets/punk-ip-video-cover/{slug}/brief.md`,记录输入、选用风格、比例与每版差异;提示词分别保存为 `prompts/{version}-{style-id}-{ratio}.md`。

实际制作图片使用当前环境可用的内置图像工具。本地图片未查看时先查看。默认只传入本期身份照片;产品图或已有作品仅在用户提供且本期确需使用时作为内容素材传入,并明确其角色。风格依据本技能的文字规则,不用采集封面做图生图。使用准确的本地图片路径,避免把最近的研究截图批量作为输入;无法单独取得身份图时请求重附人物照片。

每个版本、每个已请求比例单独生成一张成品,数量不因风格数或四种比例自动相乘。生成动作和主题道具时,按所选风格保留身份;Y2K 的服装/手持物保留规则仍只作用于 Y2K。

用户要求成品且有工具时实际生成;用户只要提示词、先选方案或添加风格时按该范围执行。工具不可用时保留提示词并说明,不能称为已生成图片。不虚构工具参数,不因来源文件提到某模型而切换 API。

用工具明确返回的当前产物保存图片到本任务目录,按版本、风格与比例命名。不从全局产物目录猜测文件,不伪造未返回的文件。

检查与交付

核对四色是否来自上传照片、色彩角色与派生关系是否清楚、人物是否作为独立抠图主体、新版布局是否根据本期内容决定,不能因换了风格便恢复固定坐标或旧色盘。

检查身份、中文逐字准确性、标题层级、文字路径、眼鼻嘴遮挡、手与道具接触、装饰用途、版间差异及风格锚点。动作与表情允许修改,检查其主题适配、自然程度及修改后身份是否仍可辨认,不把笑容或姿势变化本身判为身份失败;五官变成另一人、肢体畸形或明显不合主题才需修正。确认没有参考图、他人头像、原案例标题、采集水印、研究框线和多版本拼图。按 3:4 封面约 270×360 的缩略图观感检查,其他比例按同等小尺寸检查。

读取实际宽高核对比例;不能确认尺寸时说明。工具无法输出精确画幅时,用图像工具调整构图或如实报告实际尺寸,不拉伸脸和字。不因为尚未进行所有风格生成验证而额外生成一整库图片。

有具体问题才针对性修正,同一问题两次修正仍未解决时保留结果并说明。交付各版本图片与提示词,标明风格、比例、差异和验证状态;不把排版变体命名为新风格。

使用许可

本技能沿用 Punk Skill 的[使用协议](LICENSE):个人非商用使用免费;企业、团队、客户项目、商业账号内容、营销或其他商业使用,须事先取得书面商业授权并支付适用许可费。具体费用与授权范围由单独签署的商业协议确定。

完整条款见 [LICENSE-PERSONAL.md](LICENSE-PERSONAL.md),商业授权申请见 [COMMERCIAL-LICENSE.md](COMMERCIAL-LICENSE.md),联系邮箱为 `adrian.pduck@gmail.com`。第三方材料声明见 [THIRD_PARTY_NOTICES.md](THIRD_PARTY_NOTICES.md)。

Read more
Ships withpunk-skill

Punk Skill 是一组给 AI Agent 使用的视觉生成 Skills。安装后,可以用它把文章生成封面图,或把人物、宠物、物品照片生成头像图。 Punk Skill v2.0.0 及后续版本源码公开,个人非商用使用免费。任何企业、机构、工作室、团队、雇员、承包商或客户项目使用,以及用于收费服务、商业内容、营销、广告、品牌传播、产品集成、商业工作流或其他商业目的,均须事先取得书面商业授权并支付许可费用。详见 使用许可。

Get the whole plugin
Stats
1,293
Stars
121
Forks
Active
Maintenance
JavaScript
Language
10h ago
Last commit
4mo ago
Created
4d ago
Added

Repo: adrianpunk/punk-skill

Other skills on punk-skill.