Converts video lectures into LaTeX PDF notes via speech-to-text, with refined subtitles and tensor formula visuals. Fires when processing bilibili or YouTube lecture videos.
$ npx -y skills add wdkns/wdkns-skills --agent claude-code
Run the curl in your terminal, the rest in Claude Code.
What's inside
youtube-render-pdf:将 YouTube 讲座、教程或技术分享整理为结构化、配图丰富的中文 LaTeX 讲义,并编译交付最终 PDF。
bilibili-render-pdf:面向 Bilibili 视频生成中文 LaTeX 讲义和最终 PDF,并针对字幕缺失、登录高清与分 P 视频提供专门处理流程。subtitle-refine:在保持时间轴同步和原意不变的前提下精修 ASR 生成的中文 SRT 字幕,并通过校验脚本产出可发布的完整字幕。tensor-formula-viz:把张量、矩阵或向量公式及其代码路径转换为形状对齐、语义清晰且适合演示的计算示意图。这个仓库托管两个 Codex skill,用于将视频讲座转换为结构化的中文 LaTeX 讲义和最终 PDF。
| Skill | 平台 | 说明 |
|---|---|---|
youtube-render-pdf | YouTube | 原始版本,利用 YouTube CC 字幕和章节结构 |
bilibili-render-pdf | Bilibili (B站) | 适配 B 站的字幕缺失、登录高清、分P视频等特点 |
两个 skill 共享相同的写作规则、配图策略和 LaTeX 模板,但在素材获取阶段有平台特定的差异。
yt-dlp --cookies-from-browser chrome)whisper(openai-whisper)用于语音转写\section{} / \subsection{} 结构的完整 .tex如果你想在本地 Codex 环境中使用这些 skill,可以把对应目录放到你的技能目录中:
mkdir -p ~/.codex/skills
# YouTube 版
cp -R skills/youtube-render-pdf ~/.codex/skills/
# Bilibili 版
cp -R skills/bilibili-render-pdf ~/.codex/skills/
然后在 Codex 中使用对应 skill 处理视频链接,请求生成讲义 .tex 和最终 PDF。
| 工具 | 两个 skill 都需要 | 仅 Bilibili 版需要 |
|---|---|---|
yt-dlp | ✓ | |
ffmpeg | ✓ | |
xelatex (TeX Live + CTeX) | ✓ | |
magick (ImageMagick) | ✓ | |
whisper (openai-whisper) | ✓ |
此外,运行 skill 的 coding agent 必须具备一定的读图能力,否则很难选择关键帧,很难做到图文align(即至少是一个还不错的 vlm model,ps. MiniMax 2.7 只是一个纯文本模型)。
spwan_agent 的触发,规定的比较死,"Only use spawn_agent if and only if the user explicitly asks for sub-agents, delegation, or parallel agent work.",即需要我们在 query 中显式地要求,才可以触发 subagents$youtube-render-pdf https://www.youtube.com/watch?v=vXb2QYOUzl4 请 spwan 多 sub agents 执行,隔离上下文,避免 master agent 的“上下文焦虑”, 形成一个完整全面的 pdf:
- 1 个 outline agent:先定全局目录、术语、符号表、章节边界等
- 5 个 writer agents:各自直接写成完整章节草稿,落盘成 section_*.tex
- 1 个 figure agent:单独负责抽帧、筛图、crop、脚本生成新的示意图、图注和时间脚注等;
- 1 个 consistency agent:检查重复定义、前后术语不一致、章节衔接断裂
spwan 一个独立的reviewer agent,基于原始字幕文件,check 是否有重要、细节及有趣等一切有意的信息的漏召回,仅反馈,不修改,不断交互,直至reviewer agent 觉得 tex 信息已完备。
仓库保留了根目录下原有的 LICENSE 文件。使用、分发或二次修改时,请以该许可证为准。
.gitignore
demos/
kimi-k3-tensor/
06-attnres-block-topology.pdf
08-moonvit-v2-seq-embedding.pdf
karpathy_sgd.pdf
kda-shape-flow.pdf
latentmoe-qb.pdf
mla-shape-flow.pdf
video-render-pdf/
01 - Agentic AI 时代的操作系统课:绪论 [2026 南京大学操作系统原理].pdf
chatgpt_images_2_notes_v2.pdf
CS231N-notes-renrenew.pdf
CS336-05-GPUs-notes.pdf
dive-into-k2.5-notes.pdf
haojingfang-ai-collaboration.pdf
L8_Principal_Agentic_Engineering_Workflow_课程笔记.pdf
saining.pdf
zhangxiaojun-episode136_notes.pdf
LICENSE
README.md
resources/
age-of-ai-icm-2026.pdf
readme.md
TikZ-Tunight-recompiled.pdf
skills/
bilibili-render-pdf/
agents/
openai.yaml
assets/
notes-template.tex
SKILL.md
subtitle-refine/
agents/
openai.yaml
scripts/
check_clean_srt.py
SKILL.md
tensor-formula-viz/
agents/
openai.yaml
assets/
kimi-matrix-style-reference.png
SKILL.md
youtube-render-pdf/
agents/
openai.yaml
assets/
notes-template.tex
SKILL.md
templates/
tex/
lecture.tex
readme.md
writing/
readme.mdFAQ
wdkns-skills is a Claude Code plugin with 4 hand-picked skills for content work, indexed on Flowy. Install it with the command on its page. It includes bilibili-render-pdf, subtitle-refine, tensor-formula-viz. Its skills do not fire on their own yet. Request auto-invocation to have Flowy route them as you prompt. Free and open source.