写作与内容 peer-reviewacademic-writingliterature-reviewjournal-fitmethodology-reviewre-reviewcalibration

学术论文多视角审稿模拟器

模拟国际期刊同行评审流程,五位审稿人独立评审并整合为编辑决策与修订路线图。

FollowSkills 评估 · FSRS-2.0
不推荐
52/ 100 五分制 2.6 / 5
1 2 3 4 5 6
1信任安全15 / 25 · 3.0/5

证据显示IRON RULE #7明确将投稿稿件、评审意见等视为不可信数据,禁止其中的指令改变代理身份、路由、工具使用、网络/API调用、文件写入、披露规则或工作流约束,这体现了对提示注入的防护意识;同时IRON RULE #6为只读约束,禁止修改稿件,但未见最小权限、用户确认(仅在Phase 0后展示配置卡)、数据流透明、回滚机制或敏感数据处理细节。扣除因缺少外部效应控制、权限范围不明确和部分确认环节。

2可靠稳定8 / 20 · 2.0/5

SKILL.md描述了详细的编排流程和多种模式,但引用了大量参考文件和脚本(如scripts/check_pipeline_integrity.py)未在提供的文件中存在,依赖外部提示源(reviewer_sprint_prompt_source.md)和跨技能路由规则,关键路径无法从静态文件确认。存在失败反馈的声明(如[PROTOCOL-VIOLATION]标记),但未提供实际执行或测试证据。因无法复现和依赖缺失扣除。

3适用触发10 / 15 · 3.3/5

SKILL.md提供了丰富的触发关键词(中英韩)、非触发场景表、模式选择指南,场景与预期输出清晰,适合学术论文评审需求。但未明确能力边界(如不支持的论文类型或领域),环境适配方面核心功能依赖Claude Code和外部模型,未提及对中国大陆网络的适配性。扣除因边界描述不完整和环境适配证据不足。

4规范维护10 / 15 · 3.3/5

SKILL.md具有清晰的版本(1.10.0)、更新日期、状态和元数据,结构良好,提供快速入门和集成关系。但缺少安装/依赖说明、已知限制披露(仅在DA代理中部分提及)、故障排除指南、完整变更日志和明确维护责任。许可证元数据为NOASSERTION,来源不明确。扣除因版本治理不完整和许可证不明。

5有效结果6 / 15 · 2.0/5

技能设计目标明确:模拟5位审稿人并提供编辑决定和修改路线图,输出格式有模板支持,宣称可简化同行评审流程。但无实际输出样本或第三方执行证据,边际价值声明(如节省时间)不可验证,核心任务完成度存疑。因缺乏执行证据和可验证的输出扣除。

6证据核验3 / 10 · 1.5/5

SKILL.md引用了参考文献(如Kim et al. 2026)和内部脚本,但未提供任何外部验证或测试结果。校准模式声称测量FNR/FPR,但未提供实现细节或输出样例。静态文件中无第三方证据,关键论断无法独立验证。因无外部佐证和可复现实验证据扣除。

证据充分度: 评估于 2026年8月7日 审查版本 3021248c4609
上游仓库在本次评估后已有新提交;当前评分仍对应所示审查版本,可能尚未覆盖最新改动。
使用前请注意
  • 该技能依赖Claude Code和外部网域资源,核心功能可能无法在中国大陆网络环境下正常运行。
  • 许可证元数据为NOASSERTION,来源不明确,使用前需核实版权和再分发条款。
  • 技能声称拥有测试脚本和CI,但本次审查仅基于静态文件,未验证其实际存在和有效运行。
  • 评审过程涉及多代理和跨模型调用,可能产生成本;用户需明确了解成本结构。
  • 技能输出依赖模型判断,可能产生不准确或偏差的结果,需人工复核。
评估证据 [1][2][3][4]
查看完整评分方法 →

这个 Skill 能做什么,适合哪些场景?

该技能模拟完整的国际期刊同行评审流程:自动识别论文领域,动态配置五位审稿人(期刊匹配审稿人、三位同领域审稿人、恶魔代言人),从五个不重叠的视角进行评审,最终由编辑综合器生成结构化的编辑决策和修订路线图。支持完整评审、复审(验证)、快速评估、方法聚焦、苏格拉底式引导和校准六种模式。它强调证据驱动的评审,禁止捏造评审意见,并设有严格的只读约束,确保审稿人不会修改原稿。

读取论文全文,通过领域分析代理识别领域和方法论类型,动态生成五位审稿人的身份。五位审稿人分别从期刊匹配度、方法论严谨性、领域贡献、跨学科视角和核心论点挑战五个角度独立生成评审报告。编辑综合器汇总五份报告,识别共识与分歧,调解争议,标记恶魔代言人的关键问题,最终生成编辑决定信和优先级修订路线图。在复审模式下,使用可追溯性矩阵验证修订是否解决了首轮意见。校准模式使用黄金标准论文集测量审稿人的误报率和漏报率。

  1. 投稿前,作者希望全面评估论文质量并预测期刊编辑可能的决定,使用完整评审模式。
  2. 收到修改意见后,作者需要检查修改是否已充分回应审稿人的关切,使用复审模式。
  3. 当作者只想快速了解论文的整体水平或主要问题,可以使用快速评估模式。
  4. 当论文存在严重的方法论或统计问题,作者希望深入审查研究设计和统计分析,使用方法论聚焦模式。
  5. 当作者希望通过引导式的苏格拉底对话自己发现论文中的问题,使用引导模式。
  6. 当作者怀疑审稿人的评分可靠性,希望通过校准模式了解其误判率,再决定是否信任评分。

这个 Skill 有哪些优点和局限?

优点
  • 深度模拟真实期刊评审流程,提供五个非重叠视角,包括专门的恶魔代言人角色来质疑核心论点。
  • 通过编辑综合器生成官方的编辑决定信和分优先级的修订路线图,可直接用于后续修改。
  • 强调证据驱动,每一条评审意见都必须指向具体位置,禁止泛泛而谈。
  • 提供复审模式,用可追溯性矩阵验证修改是否到位,避免橡皮图章式结论。
  • 具有校准模式,能测量审稿人自身的误判率,增强可信度。
局限
  • 不支持商业化使用,采用 CC-BY-NC 4.0 许可。
  • 目前没有公开的测试套件或基准来客观衡量评审质量。
  • 实现复杂,包含大量内部的代理和协议,对于简单的快速评估可能显得过重。
  • 一些高级功能(如跨模型验证、模型分级)依赖 Claude Code 环境,可能不适用于其他平台。

如何安装这个 Skill?

该技能包含在 academic-research-skills 仓库中。在 Claude Code 中,可通过插件市场安装:/plugin marketplace add Imbad0202/academic-research-skills 然后 /plugin install academic-research-skills。也可手动克隆仓库并将 academic-paper-reviewer 文件夹放入项目的 .claude/skills 或全局技能目录。

如何使用这个 Skill?

安装后,直接对 Claude Code 说:"Review this paper: [paste paper or provide file]" 即可触发完整评审。输出包括五位审稿人报告和编辑决定。若要使用其他模式,可输入如 "quick review"、"check methodology"、"guide me"、"verification review" 或 "calibrate reviewer"。该技能支持中文、英文和韩文触发词。

常见问题

这个技能会帮我修改论文吗?
不会。该技能严格只读,审稿人只生成评审报告和修订路线图,绝不修改原稿。它帮助你发现问题,但修改工作仍需你自己完成。
评审需要多长时间?
提供快速评估模式,约15分钟即可获得期刊匹配审稿人的快速评估和关键问题列表。完整评审模式会消耗较多 token,并生成详细报告。
这个技能需要联网吗?
核心评审流程不需要网络访问。但某些可选功能,如跨模型验证或语义学者 API 验证,需要网络。默认情况下,所有功能均在本地运行。
我可以商用这个技能吗?
不可以。该仓库采用 CC-BY-NC 4.0 许可,禁止商用。如果你需要商业用途,请联系维护者。

同仓库的其他 Skills

均来自 Imbad0202/academic-research-skills

相关 Skills