claudeers.
// Other

BZD-review-paper

数学建模竞赛论文智能评审 Skill,支持 Codex 与 Claude Code,使用近五年国赛评阅细则、评分要点、评分概述等文件以及对应赛题进行蒸馏,并将真正在主观评审中涉及到的各种因素考虑在内,较为完备的复刻完整的评审流程,以便大家能够对自己的论文有较好的定位。

// Other[ api ][ claude ]#claude#other$open-sourceupdated 8 days ago

Install with your AI

Paste into Claude Code, Cursor, or any agent — it reads the repo and wires the tool into your project.

Install and set up BZD-review-paper (git-clone project) into my current project.
Found on https://claudeers.com/bzd-review-paper
Repo: https://github.com/BZDmathclub/BZD-review-paper
Homepage/docs: —
Detected install method: git-clone → git clone https://github.com/BZDmathclub/BZD-review-paper
Category: other. Platforms: api.
Read the repo's README for exact setup and env vars, then install it and wire it into my project.

Claudeers Health Verdict:
unknown; community-verified: false. Confirm the source before running anything.
// or clone
git clone https://github.com/BZDmathclub/BZD-review-paper

// compatibility

Platformsapi
Operating systems
AI compatibilityclaude
License
Pricingopen-source
LanguageHTML

BZD-review-paper

面向数学建模竞赛论文的智能评审 Skill,支持 CodexClaude Code。本项目使用2020—2025年16道高教社杯全国大学生数学建模竞赛题目的评分细则、评分要点、评阅概述及完整评阅流程蒸馏形成,主要适用于高教社杯国赛论文评审。

用户只需提供完整赛题和参赛论文,Skill 会先根据赛题独立制定百分制评分细则,再对论文逐项评审,计算最终得分与竞赛位次,并生成可直接查看、打印或保存为 PDF 的 HTML 评审报告。

奖项预估战绩

截至目前(8月14日),共预测14篇国赛论文,仅1篇论文奖项低估,其他论文奖项均正确。

V1.0.2 更新介绍

修改V1.0.1版本,针对国赛预测成绩准确,但是预测小比赛不准确的情况:

国赛参赛队伍众多,获奖分数呈现正态分布;但其他比赛参赛人数有限,大部分呈现均匀分布。结合认证杯、亚太杯、妈杯等小型数模竞赛的百分制评分结果,设定非国赛比赛的奖项阈值。

主要功能

  • 根据当前赛题独立生成专属百分制评分细则
  • 覆盖赛题全部问题、约束条件和必需输出
  • 检查论文资格要求与格式规范
  • 对摘要、格式、模型假设、模型建立、模型求解和检验分析逐项评分
  • 每个评分项目实行其权重 90% 封顶,模拟实际主观评审中评委通常不打满分的情况
  • 应用论文格式质量系数,对整体阅读观感进行修正
  • 输出原始得分、最终得分、预估排名百分位和等价前百分比
  • 首先区分高教社杯国赛与其他小型竞赛,避免混用排名分布
  • 给出详细得分依据、扣分原因、评委式评价和优先修改建议
  • 自动生成自包含、响应式、打印友好的 HTML 报告
  • 支持 PDF、DOCX 等常见赛题和论文文件

仓库结构

BZD-review-paper/
├─ codex/
│  ├─ SKILL.md
│  ├─ agents/
│  ├─ assets/
│  ├─ references/
│  └─ scripts/
└─ claude-code/
   ├─ CLAUDE.md
   ├─ SKILL.md
   ├─ assets/
   ├─ references/
   └─ scripts/

输入要求

每次正式评审必须同时提供:

  1. 竞赛类型:是否为高教社杯全国大学生数学建模竞赛;若不是,请填写竞赛名称;
  2. 完整的竞赛赛题,包括附件说明、数据说明和全部子问题;
  3. 完整的参赛论文,包括摘要、正文、参考文献和附录。

如果缺少赛题或论文,Skill 只能给出初步分析,不应输出正式得分和排名百分位。

评分规则

本项目不是使用一张固定评分表评价所有论文,而是先阅读当前赛题,再为该题建立专属的百分制评分细则。评分细则必须先于论文质量判断制定并冻结,避免因为论文采用了某种模型而倒推评分项目或临时改变权重。

1. 先进行赛题拆解

系统首先只分析赛题,逐问建立任务矩阵。每个问题需要识别:

  • 需要完成的决策、预测、分类、评价、解释、设计或优化任务;
  • 必须输出的具体结果,例如数值、排序、方案、图表、文件、区间或结论;
  • 题目明确给出的变量、单位、范围、精度、时间和空间尺度;
  • 必须满足的硬约束、物理规律、业务规则和边界条件;
  • 题目提供的数据、附件以及允许使用的外部资料;
  • “分析”“比较”“验证”“说明理由”“评价”“推广”等强调性要求;
  • 各问题之间的依赖关系,例如问题二是否必须复用问题一的模型。

一个问题中如果包含多个独立任务,需要拆成可以分别判断完成情况的评分点。例如“预测未来数值并评价预测可靠性”应拆为预测模型、预测结果和可靠性评价,而不能只设一个笼统的“问题三完成情况”。

2. 确定百分制总体结构

评分细则总权重固定为 100 分,默认结构如下:

评分板块权重要求主要评价内容
摘要固定 10 分问题、方法、模型、结果是否能被独立理解
格式规范固定 10 分资格规则、结构、图表、公式、引用和附录
模型假设、建立与求解合计 70—75 分赛题各问的核心数学建模和计算工作
补充质量合计 5—10 分检验、敏感性、稳健性、评价、推广或创新
合计100 分

补充质量不能为了凑足100分而机械设置。如果赛题明确要求验证、误差分析或方案评价,应为这些要求独立分配分值;如果赛题没有相应任务,则将权重用于真正影响答案可信度的质量维度。

3. 分配各问题和模型环节的权重

模型部分不是按照“有几问就平均分配”,而是依据以下因素分配:

  1. 任务重要性: 对最终目标起决定作用的问题应获得更多权重;
  2. 依赖程度: 被后续多问复用的基础模型应有较高权重;
  3. 建模难度: 同时涉及机制推导、约束设计、参数估计和算法实现的问题通常高于简单代入计算;
  4. 工作量: 需要数据处理、仿真、优化和结果验证的任务通常高于单一描述性任务;
  5. 题目强调: 题目明确要求“证明、比较、验证、给出具体方案”的内容必须获得可见分值;
  6. 交付完整性: 指定表格、结果文件、精度、单位和方案清单同样属于正式评分对象。

模型建立与求解部分必须明确覆盖三类内容:

  • 模型假设: 假设是否必要、合理、相互一致,是否说明适用范围及其对结果的影响;
  • 模型建立: 变量和参数是否定义完整,数学关系、目标函数、约束、机理和推导是否正确;
  • 模型求解: 算法步骤、参数设置、计算过程、收敛性、结果和复现证据是否充分。

模型假设通常占全文 5—10 分;模型建立通常占 35—45 分;模型求解通常占 20—30 分。具体比例根据赛题属于理论推导、数据分析、仿真、优化或综合决策而调整,但三部分合计必须保持在 70—75 分。

4. 为每个评分项建立可观察的评分锚点

每个评分项不能只写“模型合理”“结果正确”等主观表述,必须包含:

  • 评分项编号及其对应的赛题任务;
  • 该项权重;
  • 获得高分所需的具体证据;
  • 部分完成时的评分标准;
  • 完全未完成或方向错误时的零分条件;
  • 重大错误触发的单项封顶或总分限制;
  • 论文中可以核查该项的页面、章节、公式、图表或附录位置。

通常可以设置四级质量锚点:

完成水平判断原则
高水平完成模型正确、过程完整、结果可核验,并有充分验证
基本完成核心方向正确,但存在推导、参数、验证或表达缺口
部分完成有相关尝试,但模型链不完整或结果支撑不足
未完成没有回答任务、严重误读题目,或结果无法由模型得到

评分关注方法与赛题的适配性,而不是模型名称是否复杂。简单模型如果满足机制、约束、计算和验证要求,可以获得高分;堆砌高级算法但无法支撑结论,不应获得额外奖励。

5. 摘要的 10 分评价

只要存在一个真正完成的摘要,且没有严重虚构、矛盾或不可读问题,普通起评分为 3 分。评分时使用“非数模读者测试”:只阅读摘要,能否回答以下问题?

  1. 论文解决了什么具体问题?
  2. 作者实际完成了哪些研究工作?
  3. 每个问题使用了什么主要模型或算法?
  4. 最终得到了什么数值、规律、排序、预测或方案?

如果其中任何一项明显无法回答,摘要通常不超过 6 分;能够完整体现“研究问题—求解方法—主要结果”并给出代表性结果时,可达到 7—8 分;内容准确、凝练、自洽且完整覆盖各问时,名义质量可达到 9—10 分。

由于所有项目实行90%封顶,摘要最终最高得分为 9.0/10

6. 格式规范的 10 分评价

格式评价分为三个阶段。

第一阶段:资格规则检查

先检查竞赛明确规定的一票否决事项,例如匿名要求、摘要页限制、禁止目录、页码规则、必要附录和引用要求。只有在文件能够证明违规,并且该规则确实适用于当前竞赛时,才判定不具备评奖资格。装订方式、纸张颜色等无法从电子文件确认的项目标记为“待人工核验”。

若确认触发一票否决项,则停止数值评分,不计算最终得分和位次。

第二阶段:格式分扣分

通过资格检查后,格式名义分从10分起评:

  • 孤立的轻微不一致通常扣1分;
  • 反复出现的中等错误、缺少结构要素或引用形式较弱通常扣2分;
  • 严重影响阅读、核验或复现的问题通常扣3分。

相同错误反复出现时通常合并成一种错误类别,避免机械重复扣分;同一问题也不能同时在摘要、格式和模型质量中重复处罚。

完成普通扣分后,再应用90%封顶:

格式实际得分 = min(10 - 格式扣分, 9.0)

第三阶段:格式质量系数

格式分之外,再根据整篇论文的阅读体验应用一次整体系数:

系数适用情况
1.00页面专业统一,只有1—2处孤立轻微问题
0.95多处轻微问题,或一种反复出现的中等问题
0.90错误分布在多个章节,一致性和阅读流畅性明显下降
0.80错误很多,图表、公式、引用或结构多次妨碍评阅
0.70严重格式和结构问题普遍存在,内容较难定位核查
0.60文档整体混乱,许多内容不可正常阅读或验证
0.50格式极差,但仍勉强能够完成技术评阅

不得因为论文采用了不同但内部一致的字体或版式而降低系数。

7. 每项90%封顶规则

评分表权重仍然合计100分,但每个项目的实际得分满足:

单项实际得分 ≤ 单项权重 × 0.90

例如:

  • 摘要权重10分,最高9分;
  • 格式权重10分,最高9分;
  • 某一问权重20分,最高18分;
  • 验证分析权重8分,最高7.2分。

被90%封顶保留的分值不能转移给其他项目,因此原始总分理论最高为90分。报告中必须将这部分写为“评委满分保留(该项90%封顶)”,不能把它描述成论文错误。

8. 重大缺陷和封顶规则

普通错误首先在对应评分项中扣分。只有当错误影响整篇论文有效性时,才使用总分封顶,并避免对同一个问题重复处罚。典型情况包括:

  • 缺失一个主要问题:总分原则上不超过69分;
  • 中心模型在数学或物理上无效,主要结论无法成立:总分原则上不超过59分;
  • 没有实质模型或结果,或者论文整体无法阅读:总分原则上不超过49分;
  • 违反明确硬约束,使所谓最优解实际不可行:相关问题不能获得高分;
  • 结果无法追溯到论文所述数据、模型或程序:同时影响结果和可复现性评价。

低质量、异常结果或引用问题本身不能被直接认定为抄袭或学术不端。没有充分证据时,只能描述可疑点和无法核验之处。

9. 原始分和最终分计算

逐项评分后,先计算原始分:

原始得分 = 所有评分项实际得分之和

再应用格式质量系数:

最终得分 = 原始得分 × 格式质量系数

最终结果四舍五入到小数点后一位。例如:

原始得分:73.0/100
格式质量系数:0.95
最终得分:73.0 × 0.95 = 69.4/100

10. 得分到竞赛位次的换算

若存在同一竞赛、同一年度、同一题目和组别的真实得分样本,优先按照样本的中位秩计算超过百分比。没有真实分布时,按竞赛类型选择估算方法。

高教社杯国赛参赛规模约6万支队伍,使用2025年国赛经验锚点进行单调插值:

最终得分预估超过的论文比例等价前百分比
100.1%前99.9%
4550%前50%
5575%前25%
6590%前10%
7598%前2%
9099.9%前0.1%

例如最终得分69.4分,位于65分和75分之间,线性插值后预估超过约93.5%的有效参赛论文,即约前6.5%。

其他非高教社杯竞赛通常规模较小,默认采用10—90分近似均匀分布:

预估超过比例 = (最终得分 - 10) / 80 × 100%
等价前百分比 = 100% - 预估超过比例

小型竞赛奖项经验锚点为:75分及以上为一等奖竞争区间,65—75分为二等奖竞争区间,55—65分为三等奖竞争区间。对应均匀分布位次约为:75分前18.8%、65分前31.3%、55分前43.8%。小型竞赛估算默认使用至少±8个百分点的不确定区间。

以上均为模型化估算,不是官方竞赛排名。2026年及以后随着AI辅助论文质量提高,实际奖项门槛可能上升。

11. 百分制评分细则的质量检查

评分细则只有同时满足以下条件后才能冻结并用于论文评分:

  • 总权重严格等于100分;
  • 摘要严格为10分,格式严格为10分;
  • 模型假设、建立和求解合计为70—75分;
  • 赛题每个明确任务都至少对应一个评分项;
  • 每个评分项都能追溯到赛题要求或已声明的通用质量标准;
  • 不存在明显重复评分或重复扣分;
  • 每项都有可以观察的高分、部分得分和零分条件;
  • 重大错误、任务依赖和封顶规则在阅读论文质量前已经确定;
  • 没有无依据地强制指定某一种算法;
  • 两名具备数模评审能力的人员可以依据细则得到大体一致的判断。

Codex 安装与使用

codex 文件夹复制到 Codex 的 Skills 目录,并将目录命名为 bzd-review-paper

Windows 默认位置通常为:

C:\Users\你的用户名\.codex\skills\bzd-review-paper

重新启动 Codex 后调用:

使用 $bzd-review-paper 评审以下材料:

赛题:<赛题文件路径>
论文:<论文文件路径>

请根据赛题制定评分细则,完成逐项评分,并生成HTML评审报告。

Claude Code 安装与使用

claude-code 文件夹复制到项目中,例如:

你的项目/
└─ .claude/
   └─ bzd-review-paper/

在项目根目录的 CLAUDE.md 中加入:

当用户要求评审数学建模论文时,必须完整读取并执行:

@.claude/bzd-review-paper/SKILL.md

然后在项目目录启动 Claude Code:

claude --add-dir "赛题与论文所在目录"

输入:

请使用 BZD-review-paper 评审:

赛题:<赛题文件路径>
论文:<论文文件路径>

严格按照SKILL.md执行,并生成BZD-review-paper-report.html。

也可以直接进入 claude-code 目录运行 claude,该目录自带的 CLAUDE.md 会导入评审规则。

HTML 报告

默认生成:

BZD-review-paper-report.html

报告主要包含:

  1. 最终得分与竞赛位次;
  2. 详细评分;
  3. 本题任务分解;
  4. 资格与格式审查;
  5. 评委式评价;
  6. 优先修改建议;
  7. BZD 数模社联系方式。

HTML 文件不依赖外部 CSS、字体或 JavaScript,可离线打开,并支持浏览器打印或保存为 PDF。

位次说明

当没有同一竞赛、同一年度、同一题目和组别的真实得分样本时,高教社杯国赛使用2025年大规模竞赛分数锚点;其他竞赛使用10—90分小型竞赛均匀分布近似。两类排名模型不得混用。

该结果属于模型化评审参考,不是竞赛官方排名或获奖结果。随着参赛论文整体质量变化,特别是 AI 辅助写作普及,同等奖项的实际门槛可能发生变化。

使用限制

  • 不应将本项目生成的得分视为官方评审结果;
  • 不应将预估百分位表述为精确竞赛名次;
  • 未提供原始数据或程序运行环境时,部分结果可能无法独立复算;
  • PDF 图表、公式或页面无法读取时,应在报告中说明评审局限;
  • 使用者应自行确认竞赛关于 AI 工具、论文格式和学术诚信的最新规定。

隐私建议

使用时请勿将以下内容提交到公开仓库:

  • 未公开的参赛论文和赛题附件;
  • 姓名、学校、参赛编号等个人信息;
  • API Key、访问令牌、Cookie 和 .env 文件;
  • 包含隐私信息的评审报告;
  • 无公开传播授权的官方内部评阅材料。

联系方式

✨ 如需进一步详细的论文检查、赛中资料等服务
可关注 BZD数模社 官网:https://bzdshumo.com/

**QQ数模交流群(主群1):**689964173
**QQ数模交流2群(主群2):**275032074
**资料通知群(仅推送资料/无聊天):**928949323
**微信(个性化定制):**bzdsxjm521
备用微信:bzdsxjm520 / BZD661188

// faq

What is BZD-review-paper?

数学建模竞赛论文智能评审 Skill,支持 Codex 与 Claude Code,使用近五年国赛评阅细则、评分要点、评分概述等文件以及对应赛题进行蒸馏,并将真正在主观评审中涉及到的各种因素考虑在内,较为完备的复刻完整的评审流程,以便大家能够对自己的论文有较好的定位。. It is open-source on GitHub.

Is BZD-review-paper free to use?

BZD-review-paper is open-source, so it is free to use.

What category does BZD-review-paper belong to?

BZD-review-paper is listed under other in the Claudeers registry of Claude-compatible tools.

4 views
16 stars
unclaimed
updated 8 days ago

// embed badge

BZD-review-paper on Claudeers
[![Claudeers](https://claudeers.com/api/badge/bzd-review-paper.svg)](https://claudeers.com/bzd-review-paper)

// retro hit counter

BZD-review-paper hit counter
[![Hits](https://claudeers.com/api/counter/bzd-review-paper.svg)](https://claudeers.com/bzd-review-paper)

// reviews

// guestbook

0/500

// related in Other

🔓

符合nature论文学术表达和科研绘图的Skill

// otherYuan1z0825/Python36,535Apache-2.0[ claude ]
🔓

Open source Ghostty-based macOS terminal with vertical tabs and notifications for AI coding agents. Built for multitasking, organization, and programmability.

// othermanaflow-ai/Swift26,069NOASSERTION[ claude ]
🔓

Anti-AI-slop design skill for Claude Code, Cursor, and Codex.

// otherNutlope/CSS25,307MIT[ claude ]
🔓

Huashu Design · HTML-native design skill for Claude Code · Claude Code 里 HTML 原生的设计 skill · 高保真原型 / 幻灯片 / 动画 + 20 设计哲学 + 5 维评审 + MP4 导出 · Agent-agnostic

// otheralchaincyf/HTML23,151MIT[ claude ]
→ see how BZD-review-paper connects across the ecosystem