
BZD-review-paper
数学建模竞赛论文智能评审 Skill,支持 Codex 与 Claude Code,使用近五年国赛评阅细则、评分要点、评分概述等文件以及对应赛题进行蒸馏,并将真正在主观评审中涉及到的各种因素考虑在内,较为完备的复刻完整的评审流程,以便大家能够对自己的论文有较好的定位。
Install with your AI
Paste into Claude Code, Cursor, or any agent — it reads the repo and wires the tool into your project.
Install and set up BZD-review-paper (git-clone project) into my current project. Found on https://claudeers.com/bzd-review-paper Repo: https://github.com/BZDmathclub/BZD-review-paper Homepage/docs: — Detected install method: git-clone → git clone https://github.com/BZDmathclub/BZD-review-paper Category: other. Platforms: api. Read the repo's README for exact setup and env vars, then install it and wire it into my project. Claudeers Health Verdict: unknown; community-verified: false. Confirm the source before running anything.
git clone https://github.com/BZDmathclub/BZD-review-paper
// compatibility
| Platforms | api |
|---|---|
| Operating systems | — |
| AI compatibility | claude |
| License | — |
| Pricing | open-source |
| Language | HTML |
BZD-review-paper
面向数学建模竞赛论文的智能评审 Skill,支持 Codex 与 Claude Code。本项目使用2020—2025年16道高教社杯全国大学生数学建模竞赛题目的评分细则、评分要点、评阅概述及完整评阅流程蒸馏形成,主要适用于高教社杯国赛论文评审。
用户只需提供完整赛题和参赛论文,Skill 会先根据赛题独立制定百分制评分细则,再对论文逐项评审,计算最终得分与竞赛位次,并生成可直接查看、打印或保存为 PDF 的 HTML 评审报告。
奖项预估战绩
截至目前(8月14日),共预测14篇国赛论文,仅1篇论文奖项低估,其他论文奖项均正确。
V1.0.2 更新介绍
修改V1.0.1版本,针对国赛预测成绩准确,但是预测小比赛不准确的情况:
国赛参赛队伍众多,获奖分数呈现正态分布;但其他比赛参赛人数有限,大部分呈现均匀分布。结合认证杯、亚太杯、妈杯等小型数模竞赛的百分制评分结果,设定非国赛比赛的奖项阈值。
主要功能
- 根据当前赛题独立生成专属百分制评分细则
- 覆盖赛题全部问题、约束条件和必需输出
- 检查论文资格要求与格式规范
- 对摘要、格式、模型假设、模型建立、模型求解和检验分析逐项评分
- 每个评分项目实行其权重 90% 封顶,模拟实际主观评审中评委通常不打满分的情况
- 应用论文格式质量系数,对整体阅读观感进行修正
- 输出原始得分、最终得分、预估排名百分位和等价前百分比
- 首先区分高教社杯国赛与其他小型竞赛,避免混用排名分布
- 给出详细得分依据、扣分原因、评委式评价和优先修改建议
- 自动生成自包含、响应式、打印友好的 HTML 报告
- 支持 PDF、DOCX 等常见赛题和论文文件
仓库结构
BZD-review-paper/
├─ codex/
│ ├─ SKILL.md
│ ├─ agents/
│ ├─ assets/
│ ├─ references/
│ └─ scripts/
└─ claude-code/
├─ CLAUDE.md
├─ SKILL.md
├─ assets/
├─ references/
└─ scripts/
输入要求
每次正式评审必须同时提供:
- 竞赛类型:是否为高教社杯全国大学生数学建模竞赛;若不是,请填写竞赛名称;
- 完整的竞赛赛题,包括附件说明、数据说明和全部子问题;
- 完整的参赛论文,包括摘要、正文、参考文献和附录。
如果缺少赛题或论文,Skill 只能给出初步分析,不应输出正式得分和排名百分位。
评分规则
本项目不是使用一张固定评分表评价所有论文,而是先阅读当前赛题,再为该题建立专属的百分制评分细则。评分细则必须先于论文质量判断制定并冻结,避免因为论文采用了某种模型而倒推评分项目或临时改变权重。
1. 先进行赛题拆解
系统首先只分析赛题,逐问建立任务矩阵。每个问题需要识别:
- 需要完成的决策、预测、分类、评价、解释、设计或优化任务;
- 必须输出的具体结果,例如数值、排序、方案、图表、文件、区间或结论;
- 题目明确给出的变量、单位、范围、精度、时间和空间尺度;
- 必须满足的硬约束、物理规律、业务规则和边界条件;
- 题目提供的数据、附件以及允许使用的外部资料;
- “分析”“比较”“验证”“说明理由”“评价”“推广”等强调性要求;
- 各问题之间的依赖关系,例如问题二是否必须复用问题一的模型。
一个问题中如果包含多个独立任务,需要拆成可以分别判断完成情况的评分点。例如“预测未来数值并评价预测可靠性”应拆为预测模型、预测结果和可靠性评价,而不能只设一个笼统的“问题三完成情况”。
2. 确定百分制总体结构
评分细则总权重固定为 100 分,默认结构如下:
| 评分板块 | 权重要求 | 主要评价内容 |
|---|---|---|
| 摘要 | 固定 10 分 | 问题、方法、模型、结果是否能被独立理解 |
| 格式规范 | 固定 10 分 | 资格规则、结构、图表、公式、引用和附录 |
| 模型假设、建立与求解 | 合计 70—75 分 | 赛题各问的核心数学建模和计算工作 |
| 补充质量 | 合计 5—10 分 | 检验、敏感性、稳健性、评价、推广或创新 |
| 合计 | 100 分 | — |
补充质量不能为了凑足100分而机械设置。如果赛题明确要求验证、误差分析或方案评价,应为这些要求独立分配分值;如果赛题没有相应任务,则将权重用于真正影响答案可信度的质量维度。
3. 分配各问题和模型环节的权重
模型部分不是按照“有几问就平均分配”,而是依据以下因素分配:
- 任务重要性: 对最终目标起决定作用的问题应获得更多权重;
- 依赖程度: 被后续多问复用的基础模型应有较高权重;
- 建模难度: 同时涉及机制推导、约束设计、参数估计和算法实现的问题通常高于简单代入计算;
- 工作量: 需要数据处理、仿真、优化和结果验证的任务通常高于单一描述性任务;
- 题目强调: 题目明确要求“证明、比较、验证、给出具体方案”的内容必须获得可见分值;
- 交付完整性: 指定表格、结果文件、精度、单位和方案清单同样属于正式评分对象。
模型建立与求解部分必须明确覆盖三类内容:
- 模型假设: 假设是否必要、合理、相互一致,是否说明适用范围及其对结果的影响;
- 模型建立: 变量和参数是否定义完整,数学关系、目标函数、约束、机理和推导是否正确;
- 模型求解: 算法步骤、参数设置、计算过程、收敛性、结果和复现证据是否充分。
模型假设通常占全文 5—10 分;模型建立通常占 35—45 分;模型求解通常占 20—30 分。具体比例根据赛题属于理论推导、数据分析、仿真、优化或综合决策而调整,但三部分合计必须保持在 70—75 分。
4. 为每个评分项建立可观察的评分锚点
每个评分项不能只写“模型合理”“结果正确”等主观表述,必须包含:
- 评分项编号及其对应的赛题任务;
- 该项权重;
- 获得高分所需的具体证据;
- 部分完成时的评分标准;
- 完全未完成或方向错误时的零分条件;
- 重大错误触发的单项封顶或总分限制;
- 论文中可以核查该项的页面、章节、公式、图表或附录位置。
通常可以设置四级质量锚点:
| 完成水平 | 判断原则 |
|---|---|
| 高水平完成 | 模型正确、过程完整、结果可核验,并有充分验证 |
| 基本完成 | 核心方向正确,但存在推导、参数、验证或表达缺口 |
| 部分完成 | 有相关尝试,但模型链不完整或结果支撑不足 |
| 未完成 | 没有回答任务、严重误读题目,或结果无法由模型得到 |
评分关注方法与赛题的适配性,而不是模型名称是否复杂。简单模型如果满足机制、约束、计算和验证要求,可以获得高分;堆砌高级算法但无法支撑结论,不应获得额外奖励。
5. 摘要的 10 分评价
只要存在一个真正完成的摘要,且没有严重虚构、矛盾或不可读问题,普通起评分为 3 分。评分时使用“非数模读者测试”:只阅读摘要,能否回答以下问题?
- 论文解决了什么具体问题?
- 作者实际完成了哪些研究工作?
- 每个问题使用了什么主要模型或算法?
- 最终得到了什么数值、规律、排序、预测或方案?
如果其中任何一项明显无法回答,摘要通常不超过 6 分;能够完整体现“研究问题—求解方法—主要结果”并给出代表性结果时,可达到 7—8 分;内容准确、凝练、自洽且完整覆盖各问时,名义质量可达到 9—10 分。
由于所有项目实行90%封顶,摘要最终最高得分为 9.0/10。
6. 格式规范的 10 分评价
格式评价分为三个阶段。
第一阶段:资格规则检查
先检查竞赛明确规定的一票否决事项,例如匿名要求、摘要页限制、禁止目录、页码规则、必要附录和引用要求。只有在文件能够证明违规,并且该规则确实适用于当前竞赛时,才判定不具备评奖资格。装订方式、纸张颜色等无法从电子文件确认的项目标记为“待人工核验”。
若确认触发一票否决项,则停止数值评分,不计算最终得分和位次。
第二阶段:格式分扣分
通过资格检查后,格式名义分从10分起评:
- 孤立的轻微不一致通常扣1分;
- 反复出现的中等错误、缺少结构要素或引用形式较弱通常扣2分;
- 严重影响阅读、核验或复现的问题通常扣3分。
相同错误反复出现时通常合并成一种错误类别,避免机械重复扣分;同一问题也不能同时在摘要、格式和模型质量中重复处罚。
完成普通扣分后,再应用90%封顶:
格式实际得分 = min(10 - 格式扣分, 9.0)
第三阶段:格式质量系数
格式分之外,再根据整篇论文的阅读体验应用一次整体系数:
| 系数 | 适用情况 |
|---|---|
| 1.00 | 页面专业统一,只有1—2处孤立轻微问题 |
| 0.95 | 多处轻微问题,或一种反复出现的中等问题 |
| 0.90 | 错误分布在多个章节,一致性和阅读流畅性明显下降 |
| 0.80 | 错误很多,图表、公式、引用或结构多次妨碍评阅 |
| 0.70 | 严重格式和结构问题普遍存在,内容较难定位核查 |
| 0.60 | 文档整体混乱,许多内容不可正常阅读或验证 |
| 0.50 | 格式极差,但仍勉强能够完成技术评阅 |
不得因为论文采用了不同但内部一致的字体或版式而降低系数。
7. 每项90%封顶规则
评分表权重仍然合计100分,但每个项目的实际得分满足:
单项实际得分 ≤ 单项权重 × 0.90
例如:
- 摘要权重10分,最高9分;
- 格式权重10分,最高9分;
- 某一问权重20分,最高18分;
- 验证分析权重8分,最高7.2分。
被90%封顶保留的分值不能转移给其他项目,因此原始总分理论最高为90分。报告中必须将这部分写为“评委满分保留(该项90%封顶)”,不能把它描述成论文错误。
8. 重大缺陷和封顶规则
普通错误首先在对应评分项中扣分。只有当错误影响整篇论文有效性时,才使用总分封顶,并避免对同一个问题重复处罚。典型情况包括:
- 缺失一个主要问题:总分原则上不超过69分;
- 中心模型在数学或物理上无效,主要结论无法成立:总分原则上不超过59分;
- 没有实质模型或结果,或者论文整体无法阅读:总分原则上不超过49分;
- 违反明确硬约束,使所谓最优解实际不可行:相关问题不能获得高分;
- 结果无法追溯到论文所述数据、模型或程序:同时影响结果和可复现性评价。
低质量、异常结果或引用问题本身不能被直接认定为抄袭或学术不端。没有充分证据时,只能描述可疑点和无法核验之处。
9. 原始分和最终分计算
逐项评分后,先计算原始分:
原始得分 = 所有评分项实际得分之和
再应用格式质量系数:
最终得分 = 原始得分 × 格式质量系数
最终结果四舍五入到小数点后一位。例如:
原始得分:73.0/100
格式质量系数:0.95
最终得分:73.0 × 0.95 = 69.4/100
10. 得分到竞赛位次的换算
若存在同一竞赛、同一年度、同一题目和组别的真实得分样本,优先按照样本的中位秩计算超过百分比。没有真实分布时,按竞赛类型选择估算方法。
高教社杯国赛参赛规模约6万支队伍,使用2025年国赛经验锚点进行单调插值:
| 最终得分 | 预估超过的论文比例 | 等价前百分比 |
|---|---|---|
| 10 | 0.1% | 前99.9% |
| 45 | 50% | 前50% |
| 55 | 75% | 前25% |
| 65 | 90% | 前10% |
| 75 | 98% | 前2% |
| 90 | 99.9% | 前0.1% |
例如最终得分69.4分,位于65分和75分之间,线性插值后预估超过约93.5%的有效参赛论文,即约前6.5%。
其他非高教社杯竞赛通常规模较小,默认采用10—90分近似均匀分布:
预估超过比例 = (最终得分 - 10) / 80 × 100%
等价前百分比 = 100% - 预估超过比例
小型竞赛奖项经验锚点为:75分及以上为一等奖竞争区间,65—75分为二等奖竞争区间,55—65分为三等奖竞争区间。对应均匀分布位次约为:75分前18.8%、65分前31.3%、55分前43.8%。小型竞赛估算默认使用至少±8个百分点的不确定区间。
以上均为模型化估算,不是官方竞赛排名。2026年及以后随着AI辅助论文质量提高,实际奖项门槛可能上升。
11. 百分制评分细则的质量检查
评分细则只有同时满足以下条件后才能冻结并用于论文评分:
- 总权重严格等于100分;
- 摘要严格为10分,格式严格为10分;
- 模型假设、建立和求解合计为70—75分;
- 赛题每个明确任务都至少对应一个评分项;
- 每个评分项都能追溯到赛题要求或已声明的通用质量标准;
- 不存在明显重复评分或重复扣分;
- 每项都有可以观察的高分、部分得分和零分条件;
- 重大错误、任务依赖和封顶规则在阅读论文质量前已经确定;
- 没有无依据地强制指定某一种算法;
- 两名具备数模评审能力的人员可以依据细则得到大体一致的判断。
Codex 安装与使用
将 codex 文件夹复制到 Codex 的 Skills 目录,并将目录命名为 bzd-review-paper。
Windows 默认位置通常为:
C:\Users\你的用户名\.codex\skills\bzd-review-paper
重新启动 Codex 后调用:
使用 $bzd-review-paper 评审以下材料:
赛题:<赛题文件路径>
论文:<论文文件路径>
请根据赛题制定评分细则,完成逐项评分,并生成HTML评审报告。
Claude Code 安装与使用
将 claude-code 文件夹复制到项目中,例如:
你的项目/
└─ .claude/
└─ bzd-review-paper/
在项目根目录的 CLAUDE.md 中加入:
当用户要求评审数学建模论文时,必须完整读取并执行:
@.claude/bzd-review-paper/SKILL.md
然后在项目目录启动 Claude Code:
claude --add-dir "赛题与论文所在目录"
输入:
请使用 BZD-review-paper 评审:
赛题:<赛题文件路径>
论文:<论文文件路径>
严格按照SKILL.md执行,并生成BZD-review-paper-report.html。
也可以直接进入 claude-code 目录运行 claude,该目录自带的 CLAUDE.md 会导入评审规则。
HTML 报告
默认生成:
BZD-review-paper-report.html
报告主要包含:
- 最终得分与竞赛位次;
- 详细评分;
- 本题任务分解;
- 资格与格式审查;
- 评委式评价;
- 优先修改建议;
- BZD 数模社联系方式。
HTML 文件不依赖外部 CSS、字体或 JavaScript,可离线打开,并支持浏览器打印或保存为 PDF。
位次说明
当没有同一竞赛、同一年度、同一题目和组别的真实得分样本时,高教社杯国赛使用2025年大规模竞赛分数锚点;其他竞赛使用10—90分小型竞赛均匀分布近似。两类排名模型不得混用。
该结果属于模型化评审参考,不是竞赛官方排名或获奖结果。随着参赛论文整体质量变化,特别是 AI 辅助写作普及,同等奖项的实际门槛可能发生变化。
使用限制
- 不应将本项目生成的得分视为官方评审结果;
- 不应将预估百分位表述为精确竞赛名次;
- 未提供原始数据或程序运行环境时,部分结果可能无法独立复算;
- PDF 图表、公式或页面无法读取时,应在报告中说明评审局限;
- 使用者应自行确认竞赛关于 AI 工具、论文格式和学术诚信的最新规定。
隐私建议
使用时请勿将以下内容提交到公开仓库:
- 未公开的参赛论文和赛题附件;
- 姓名、学校、参赛编号等个人信息;
- API Key、访问令牌、Cookie 和
.env文件; - 包含隐私信息的评审报告;
- 无公开传播授权的官方内部评阅材料。
联系方式
✨ 如需进一步详细的论文检查、赛中资料等服务
可关注 BZD数模社 官网:https://bzdshumo.com/
**QQ数模交流群(主群1):**689964173
**QQ数模交流2群(主群2):**275032074
**资料通知群(仅推送资料/无聊天):**928949323
**微信(个性化定制):**bzdsxjm521
备用微信:bzdsxjm520 / BZD661188
// faq
What is BZD-review-paper?
数学建模竞赛论文智能评审 Skill,支持 Codex 与 Claude Code,使用近五年国赛评阅细则、评分要点、评分概述等文件以及对应赛题进行蒸馏,并将真正在主观评审中涉及到的各种因素考虑在内,较为完备的复刻完整的评审流程,以便大家能够对自己的论文有较好的定位。. It is open-source on GitHub.
Is BZD-review-paper free to use?
BZD-review-paper is open-source, so it is free to use.
What category does BZD-review-paper belong to?
BZD-review-paper is listed under other in the Claudeers registry of Claude-compatible tools.
// embed badge
[](https://claudeers.com/bzd-review-paper)
// retro hit counter
[](https://claudeers.com/bzd-review-paper)
// reviews
// guestbook
// related in Other
Open source Ghostty-based macOS terminal with vertical tabs and notifications for AI coding agents. Built for multitasking, organization, and programmability.
Anti-AI-slop design skill for Claude Code, Cursor, and Codex.
Huashu Design · HTML-native design skill for Claude Code · Claude Code 里 HTML 原生的设计 skill · 高保真原型 / 幻灯片 / 动画 + 20 设计哲学 + 5 维评审 + MP4 导出 · Agent-agnostic