Pre-submission AI review stress-test for research papers. A Claude Code skill: review, verdict, revise, verify.
> /plugin marketplace add Spark-To-Paper-Skills/paperjury> /plugin install paperjury@u7079256
Repo: Spark-To-Paper-Skills/paperjury
What's inside
[!IMPORTANT] PaperJury 是投稿前的自查工具,不能替代作者的科学判断,也不能替代 peer review。它不能用来编造实验、伪造结果、添加没有证据支撑的 claim,或掩盖论文局限。遇到需要新实验、缺证据、需要作者私有知识或研究判断的问题,它都会交回作者处理。
如果 PaperJury 对你的研究或写作流程有帮助,可以引用这篇 arXiv 论文:
@misc{wang2026paperjurydueprocessreviewbounded,
title={PaperJury: Due-Process Review for Bounded LaTeX Revision},
author={Yiran Wang and Ruixuan An and Biao Wu and Wenhao Wang},
year={2026},
eprint={2606.16322},
archivePrefix={arXiv},
primaryClass={cs.CL},
url={https://arxiv.org/abs/2606.16322},
}
同一条目也放在 CITATION.bib。
在 Claude Code 里安装:
/plugin marketplace add u7079256/paperjury
/plugin install paperjury@u7079256
然后在你的论文项目里直接说需求:
审稿,重点看实验和 claim 是否站得住。
也可以更日常一点:
把 introduction 这段改紧一些,但不要改变 claim。
不需要背命令。PaperJury 会根据你的描述选择 direct-edit、review 或 auto 模式;真正落稿前,会先把补丁交给你确认。
PaperJury 以 Claude Code skill 的形式提供,把投稿前自查组织成一套闭环:审稿 → 裁定 → 修改 → 复查。它不会照单全收 AI 反馈,而是先把每条意见分成三类:
| 结果 | 含义 |
|---|---|
| ✅ 安全修复 | 表达不清、claim 过强、结构不顺这类文本问题;不需要补实验,也不会把原意改偏。 |
| 🧑💻 作者处理 | 缺实验、缺 ablation、缺数据或证据,必须由作者自己判断。 |
| 🛑 不成立 | AI reviewer 误读了论文,或者提了不该改的问题。 |
| 你现在的情况 | 可以直接这样用 |
|---|---|
| 📝 刚写完初稿 | 让它像 reviewer 一样通读全文,先找最可能影响投稿的问题。 |
| 🔍 投稿前最后自查 | 让它检查 claim 是否说过头、实验是否撑得住,以及有没有明显格式风险。 |
| ✍️ 只想改一段话 | 直接说「把这段改紧一点,但不要改变 claim」,它会先起草补丁,等你确认后再改。 |
| 🔁 想多轮打磨但不想一直盯着 | 明确授权 auto 模式;安全修改可以落稿,高风险问题仍会交回作者决定。 |
| 输出 | 内容 |
|---|---|
| 📋 问题清单 | 每条 reviewer-style 问题都会带证据、位置、判断结果和当前状态;不会把一堆意见直接倒进正文。 |
| 🧩 可审阅补丁 | 只有安全修复会进入最小补丁;高风险改动会先放着,等作者决定。 |
| 🛠️ 复查报告 | 有 LaTeX 工具链就真实编译;没有就明说哪些检查做不了,不会假装验证过。 |
| 🧪 真实样例 | samples/dogfood/ 里有修改前后 PDF 和人工核对过的运行报告。 |
| 场景 | PaperJury 会怎么做 |
|---|---|
| 🔎 投稿前挑问题 | 模拟几位不同方向的 reviewer 通读全文,找出真正可能被抓住的弱点,并把致命问题和小修小补分开。 |
| ✍️ 安全改 LaTeX / Markdown | 只针对你指定的位置起草补丁,自检后再交给你确认;不会把一处小改扩成整篇重写。 |
| 🛡️ 复查格式风险 | 本机有 LaTeX 工具链时会真实编译,检查报错、未定义引用、overfull box、页数和常见 desk-reject 风险;没有工具链时会明说。 |
| 🔁 多轮打磨 | 在你明确授权的 auto 模式下,多轮跑完「评审-修订-复查」;安全修改可以自动应用,高风险问题会留给作者处理。 |
PaperJury 的重点不是“让 AI 多写一点”,而是让 AI 先像 reviewer 一样认真挑错,再用确定性脚本守住能验证的边界。
| 模式 | 什么时候用 | 行为 | 人工确认 |
|---|---|---|---|
| ✍️ direct-edit(常用) | 只想改一处文字、caption、LaTeX 表达或段落结构。 | 不开评审面板,直接用写作工具包起草补丁。 | 作者确认后再应用。 |
| 🔎 review(偶尔) | 想让它审稿、挑问题、mock-review,或只审某一节 / 某条 claim。 | 启动对抗式评审引擎,先判断问题是否成立,再决定要不要修改。 | 每处改动逐一确认。 |
| 🔁 auto(无人值守) | 已经明确给出 /goal 或配置 mode: auto,希望它多轮跑到一个可验证目标。 | 先确认 spine 和评审分配,再按 bounded-aggressive + edit-safety 策略迭代。 | 先给整体授权;高风险项仍交回作者。 |
简单说:改一处 → 直接说;想被挑刺 → 说「审稿」;想无人值守 → 用 /goal。
[!WARNING] auto 必须明确开启。 只打开工具权限再发普通 prompt,只会跑一轮就停,不会进入多轮循环。原因见
docs/AGENT-GUIDE.md§3。
想看它真实产出,仓库里有一个 dogfood sample:在一篇真实草稿上跑完整多轮评审,附修改前后 PDF 和一份人工核对过的运行报告。
samples/dogfood/(original_draft.pdf · revised_draft.pdf · 运行报告)
如果只想确认稿件不会先被格式问题挡住,可以说:
跑一下 submission-readiness / 合规检查。
它会做确定性格式筛查,再配合编译驱动的版面检查。
推荐用 marketplace 路线:
/plugin marketplace add u7079256/paperjury
/plugin install paperjury@u7079256
也可以把仓库 clone 到 Claude Code 读取 skill 的目录:
# macOS / Linux
git clone https://github.com/u7079256/paperjury ~/.claude/skills/paperjury
# Windows (PowerShell)
git clone https://github.com/u7079256/paperjury "$env:USERPROFILE\.claude\skills\paperjury"
也可以放在 <项目>/.claude/skills/ 下,只对单个项目生效。
安装后建议检查:
SKILL.md 自动发现它,skill 名称是 paperjury。node,因为确定性检查跑在 Node 上。npm run doctor,可以检查仓库完整性、所需工具和论文文件识别。PAPERJURY_DISABLE_UPDATE_CHECK=1 可以关闭提醒。更新后请开新会话。| 版本 | 入口 | 适合 |
|---|---|---|
| Claude Code 版 | 本仓库;Claude Code plugin 或 .claude/skills/ | 你主要在 Claude Code 里写论文、改 LaTeX、跑 workflow。 |
| Codex 版 | paperjury-codex | 你主要在 Codex / Codex plugin 环境里跑同一套评审和修订流程。 |
给 Claude / 编码 agent: 更深入的驱动说明见 docs/AGENT-GUIDE.md。里面写了安装、三种模式及触发方式、引擎管线、auto 与 /goal 的区别,以及并行评审如何启动。
PaperJury 能审 Word(.docx)文件吗?
能。PaperJury 会把 .docx 一次性转成 Markdown,并明确告诉你转换保留了什么、哪些内容带不过来,比如复杂表格和公式。随后它在这份 Markdown 工作副本上跑完整多轮评审。原始 Word 文件不会被改动。结束后你拿回的是改好的 Markdown 和逐条修改清单;要不要合并回 Word,由你自己决定。你也可以先把论文导出成 .md 或 .tex,再直接交给它。
它会不会擅自改我的论文?
不会。direct-edit 和 review 模式下,补丁需要你确认后才会应用。auto 模式也必须显式开启,并且会先拿到对核心方向、修订范围和策略的整体授权。
新用户可以先跳过这一节。想看机制、源码结构或 agent 驱动方式,可以从这里开始:
| 你想了解 | 入口 |
|---|---|
| 真实运行效果 | samples/dogfood/RUN_REPORT.zh-CN.md |
| 怎么驱动 Claude / 编码 agent | docs/AGENT-GUIDE.md |
| 引擎设计细节 | docs/REVIEW_ENGINE_V3_DESIGN.md |
| 完整协议和状态机 | references/review-engine-v3.md · references/ledger-schema.md |
| 在线可视化说明 | 交互式总览 |
PaperJury 把审稿拆成一套有边界的“庭审”流程:先由有限数量的 reviewer 找问题,再把有争议的意见拿出来审议;编辑阶段按风险加护栏,多轮结束时由确定性脚本判断是否收敛。
assign-reviewers → reading-check → coverage-auditor → merge
→ { trial ‖ polish } → recall-audit → drafter
→ { edit-audit | meaning-audit } → clerk
能用脚本检查的部分都放在 scripts/ 里,由 orchestrator 在各个 workflow 之间调用;需要判断语义的问题,则交给相互隔离的 model agents。
npm run doctor,检查仓库完整性、所需工具和手稿识别。valid-fixable 或 author-required。也支持简化的 3 人评审小组,作为快速路径。
references/review-engine-v3.md、references/reviewer-personas.md、references/writing-toolkit.md。LEDGER.json 是机器可读的主记录,LEDGER.md 是给人看的版本;Claude memory 存放下次会话需要沿用的稳定约定,比如 house style、venue 和 reviewer persona 调校。Reviewer panel 由 N 位领域 reviewer 组成(默认 3 位,范围 2-4 位),运行时按论文 subfield 分配。所有 reviewer 共享同一个资深 reviewer 的底层要求:严苛、精确、建设性;能区分致命缺陷和可修补的小问题,也能跨 section 推理。某个 reviewer 无法确认时,就退回通用 reviewer;单个失败不会拖垮整个 panel。
compile-guard.js 不会假装验证过:无法真正编译时,就退到结构 lint,并报告 compiled:null。compliance-check.js + 一个语义 agent;B = 复用 compile-guard.js 的编译检查,再让模型读取 PDF 做版面复查。[!NOTE] 你的项目文件、ledger、journal 和 patch 都留在本地论文项目里。PaperJury 自己没有后端或服务器,也就不会把文件上传到 PaperJury 服务器。审稿走的是你自己的 Claude Code session;模型本身仍可能跑在云端,内容如何被处理取决于这套 Claude Code 环境的条款和设置,PaperJury 不会再额外加一层。
| 路径 | 作用 |
|---|---|
.claude-plugin/ | Claude Code marketplace 打包配置。 |
workflows/ | 语义阶段:评审分配、覆盖检查、合并、庭审、召回审计、起草和收敛。 |
scripts/ | 确定性检查脚本:ledger、journal、apply-patch、anchor-diff、cross-ref、compile-guard、doctor 等。 |
references/ | 引擎协议、ledger schema、评审者人格、写作工具和方法论。 |
docs/ | 设计说明、交互式总览、arXiv 论文 PDF 和 agent 驱动指南。 |
samples/dogfood/ | 真实草稿的 before/after PDF 和人工核对过的运行报告。 |
tests/ | 确定性脚本和核心状态机测试。 |
.cls / 模板自动识别 venue。references/review-engine-v3.mdreferences/auto-mode.mdreferences/reviewer-personas.md、references/writing-toolkit.md、references/methodology.mdreferences/ledger-schema.mdreferences/submission-compliance.mddocs/REVIEW_ENGINE_V3_DESIGN.mdscripts/(decompose、extract-docx、ledger、journal、apply-patch、anchor-diff、cross-ref、spine、rekey、compile-guard、compliance-check、doctor)workflows/(assign-reviewers、reading-check、coverage-auditor、merge、trial、polish、recall-audit、drafter、edit-audit、meaning-audit、clerk、review-panel)了解更多: docs/AGENT-GUIDE.md(驱动指南)· docs/REVIEW_ENGINE_V3_DESIGN.md(设计说明)· 在线交互式总览
PaperJury 的 spine 和防漂移设计受 PaperSpine 启发,尤其是 anchor logic-transfer audit、claim register、minimal-edit 且保义的改写策略。PaperSpine 更偏 motivation-driven 的论文起草和改写;PaperJury 借用了其中的 anchoring 思路,以及“可检查步骤交给确定性脚本、判断交给 model agent”的分工,再在此基础上加入对抗式 review 和庭审式裁定流程。
.claude-plugin/
marketplace.json
plugin.json
.github/
ISSUE_TEMPLATE/
bug_report.yml
config.yml
feature_request.yml
paper_workflow_feedback.yml
workflows/
ci.yml
.gitignore
CHANGELOG.md
CHANGELOG.zh-CN.md
CITATION.bib
configs/
config-template.md
docs/
AGENT-GUIDE.md
AUTO_MODE_DESIGN.md
index.html
overview-card-dark.png
overview-card-light.png
overview-card.png
overview.html
paperjury-favicon.png
paperjury-mark.png
paperjury-paper.pdf
REVIEW_ENGINE_V3_DESIGN.md
showcase/
SHOWCASE.md
SUBMISSION_READINESS_DESIGN.md
LICENSE
package.json
README.en.md
README.md
references/
auto-mode.md
ledger-schema.md
methodology.md
review-engine-v3.md
reviewer-personas.md
spine.md
submission-compliance.md
writing-toolkit.md
samples/
dogfood/
original_draft.pdf
README.md
revised_draft.pdf
RUN_REPORT.md
RUN_REPORT.zh-CN.md
scripts/
anchor-diff.js
apply-patch.js
check-update.js
compile-guard.js
compliance-check.js
cross-ref.js
decompose.js
doctor.js
extract-docx.js
journal.js
ledger.js
rekey.js
spine.js
SKILL.md
tests/
apply-patch.test.js
check-update.test.js
compile-guard-md.test.js
compliance-md.test.js
decompose.test.js
doctor.test.js
docx-e2e.test.js
extract-docx.test.js
fixtures/
decompose-latex-snapshot.json
minimal-paper/
main.tex
update-tags.txt
helpers/
docx-fixture.js
ledger.test.js
rekey.test.js
workflows/
assign-reviewers.workflow.js
clerk.workflow.js
coverage-auditor.workflow.js
drafter.workflow.js
edit-audit.workflow.js
meaning-audit.workflow.js
merge.workflow.js
polish.workflow.js
reading-check.workflow.js
recall-audit.workflow.js
review-panel.workflow.js
trial.workflow.jsFAQ
paperjury is a Claude Code plugin with 1 hand-picked skill for testing work, indexed on Flowy. Install it with the command on its page. It includes paperjury. Its skills do not fire on their own yet. Request auto-invocation to have Flowy route them as you prompt. Free and open source.