paper-analyzer
将学术论文转化为深度HTML长文。6轮强制工作流、代码仓库搜索、公式渲染、Mermaid图表。 3种写作风格,输出可直接分享的精美HTML页面。
将论文、技术文章或知识内容制作成高真实感的 AIGC 幻灯片。先做叙事结构和逐页视觉导演,再调用生图模型生成每一页 16:9 slide image,最后合成为 PPTX/PDF。适合论文汇报、组会、公开课、技术分享、商业化研究展示;当用户提到“论文PPT”“AI生成PPT”“不像AI的PPT”“高质感幻灯片”“逐页生图PPT”时使用。
$ npx -y skills add zsyggg/paper-craft-skills --skill paper-deck --agent claude-codeHow it fires
How this skill gets triggered: by you, by Claude, or both.
/paper-deckContext preview
The summary Claude sees to decide when to auto-load this skill.
将论文、技术文章或知识内容制作成高真实感的 AIGC 幻灯片。先做叙事结构和逐页视觉导演,再调用生图模型生成每一页 16:9 slide image,最后合成为 PPTX/PDF。适合论文汇报、组会、公开课、技术分享、商业化研究展示;当用户提到“论文PPT”“AI生成PPT”“不像AI的PPT”“高质感幻灯片”“逐页生图PPT”时使用。
name: paper-deck description: | 将论文、技术文章或知识内容制作成高真实感的 AIGC 幻灯片。先做叙事结构和逐页视觉导演,再调用生图模型生成每一页 16:9 slide image,最后合成为 PPTX/PDF。适合论文汇报、组会、公开课、技术分享、商业化研究展示;当用户提到“论文PPT”“AI生成PPT”“不像AI的PPT”“高质感幻灯片”“逐页生图PPT”时使用。
把论文/知识内容做成**看起来真的被设计过**的幻灯片。
核心路线不是用 PPT 对象硬摆版式,而是:
1. 先理解内容,做出 deck brief 和逐页叙事。 2. 为每一页写清楚“这页要让观众看到什么、感到什么、记住什么”。 3. 用生图模型生成 16:9 slide image。 4. 合成 PPTX/PDF,并保留 prompts 作为可返修的源文件。
Paper Deck 的 V1 是 **raster-first AIGC slide image** 工作流。除非用户明确要求“不要生图”“用代码画图”“只要可编辑 PPT”或“使用 HTML/SVG/Canvas 生成”,否则必须调用真实的 raster image generation backend 为每一页生成图片。
严格禁止把以下产物冒充为本 skill 的“生图页”:
允许的本地处理仅限:
如果当前环境没有可用的 raster image generation backend,必须停止并说明缺少生图后端;不要退化成本地绘图替代方案。
适合:
不适合:
如果用户需要完全可编辑的 PPT,说明本 skill 的 V1 是 raster-first;可改用常规 PPTX 工具,或生成“图片背景 + 可编辑文字层”的混合方案。
接受:
如果是论文,优先复用 `paper-analyzer` 的阅读方式:读摘要、方法、实验、图表、结论;必要时搜索代码仓库。目标不是写长文,而是提取适合做 slide 的核心叙事。
输出并保存 `analysis.md`:
默认必须确认,不要直接生成图片。除非用户明确说“直接生成/不用确认/按默认来”。
询问时控制在 3 个问题以内:
1. 页数和用途:组会 / 答辩 / 公开分享 / 商业汇报,需要几页? 2. 风格:见 `references/style-system.md`。 3. 是否插入真实素材:是否允许从 PDF/论文图表中截图,或由用户提供截图/图片?如果允许,说明预计第几页使用哪些真实素材。
推荐话术:
我建议做 12 页,风格用 journal-minimal:像 Nature/IEEE 论文图 + 正式学术汇报,清晰、克制、不花哨。 也可以换成 business-research 做商业研究分享,warm-notes 做手记风,或 liquid-glass 做 Apple 式玻璃质感。 这篇论文我建议在第 4 页插入原论文方法图局部截图,第 8 页插入实验曲线/表格截图,再基于这些真实素材做设计化排版。 确认后我会先生成 outline.md 和每页 prompt,再逐页出图并合成 PPTX/PDF。
保存 `deck-brief.md`。必须包含:
风格细节按需读取 `references/style-system.md`。 真实素材策略按需读取 `references/source-visuals.md`。
保存 `outline.md`。每页用固定结构:
## 01. Slide Title - Role: cover / context / method / mechanism / evidence / result / takeaway - Message: 这一页唯一要讲清楚的观点 - Visual: 画面主视觉和构图 - Text: 页面上允许出现的短文字 - Evidence: 引用的论文图表/公式/实验数据/代码位置 - Source visual: 是否使用真实截图/论文图表;来源、裁剪范围和落位 - Repair handle: 后续返修时可引用的定位描述
规则:
每页必须先写 prompt 文件,再调用任何生图工具。
路径:
paper-deck/{topic-slug}/
├── analysis.md
├── deck-brief.md
├── outline.md
├── prompts/
│ ├── 01-slide-cover.md
│ ├── 02-slide-context.md
│ └── ...
├── images/
│ ├── 01-slide-cover.png
│ ├── 02-slide-context.png
│ └── ...
├── {topic-slug}.pptx
└── {topic-slug}.pdfPrompt 写法读取 `references/prompt-template.md`。
硬规则:
图片后端选择:
1. Codex 环境优先用内置 `imagegen`。 2. 如果用户指定 `baoyu-imagine`、Gemini、OpenAI、Seedream 等后端,按用户指定。 3. 如果没有可用生图后端,停止并告诉用户需要一个 raster image backend。
生图门禁:
生成策略:
生成完图片后运行:
python3 <SKILL_ROOT>/scripts/merge_deck.py paper-deck/{topic-slug}脚本会读取 `images/NN-*.png|jpg|webp`,输出同名 `.pptx` 和 `.pdf`。每张图片铺满一页 16:9。
交付前按 `references/quality-gate.md` 检查:
返修时永远先改源文件:
| 用户说 | 操作 | |---|---| | “第 5 页更学术一点” | 改 `prompts/05-*.md`,保留旧图,生成新图 | | “统一成第 1 页的质感” | 把第 1 页风格锚点追加到相关 prompts | | “第 7 页文字太多” | 修改 outline 的 Text,再改 prompt | | “只重做背景,不动内容” | 在 prompt 中保留 Message/Text,重写 Visual | | “新增一页机制细节” | 更新 outline,新增 prompt,生成图片,重跑合成脚本 |
不要用程序在生成图上涂改文字。文字错了就改 prompt 重生成,或切换到混合文字层方案。
Turn academic papers into polished method figures, visual slide decks, and in-depth articles — zero config, one command. From arxiv link to publication-ready visuals, AIGC slide decks, and deep-dive articles.
将学术论文转化为深度HTML长文。6轮强制工作流、代码仓库搜索、公式渲染、Mermaid图表。 3种写作风格,输出可直接分享的精美HTML页面。
论文方法图解——用视觉图解彻底讲清楚一篇论文到底做了什么、怎么做的。 自动分析论文核心方法,先推荐封面/概述图/机制细节图的生成方案,必须由用户确认范围、张数、语言、风格后再生成。 支持温暖笔记风和论文框架图风。