Nature 文献自动化发现管线
每日自动化文献发现:多源检索 → 六维评分 → 精读 → 格式化推送 → 归档。
技能明确说明只写入raw/目录,不修改wiki/知识库,体现了数据流透明和权限最小化的意图。但缺少显式的用户确认步骤(如推送前确认)、外部副作用(如定时消息推送)的隔离和回滚机制描述,也未提及如何安全处理敏感数据(如API凭据)。因此无法给予满分,扣除部分分数。
静态审查无法验证关键路径是否可重现,也没有本技能的测试套件。文档提供了详细的降级策略和失败恢复步骤,但缺少自动化测试和异常输入的明确反馈示例,因此可靠性得分偏低。
技能目标明确,适用场景和边界清晰(如支持中文、注明无法访问全文时的处理),但缺少明确的非适用场景和触发条件的限定,可能被误用。依赖多个海外学术服务,但未说明对中国大陆用户的网络可达性,环境适配有局限。
文档结构良好,有中英文README、分层架构说明,但缺少明确的版本历史和变更日志,所有权归属虽在README中列出开发者,但未提供明确的维护责任和更新路径,License信息存在不一致(SKILL.md声明MIT,仓库为Apache-2.0)。
价值主张清晰,但静态审查无法验证实际输出质量。文档提供了详细的输出模板,但未提供真实案例或交付示例,无法确证产出是否直接可用,因此得分有限。
缺乏针对本技能的自动化测试和第三方执行证据,文档多为说明性内容,验证性证据不足,因此得分低。
- 技能中的许可证声明(MIT)与仓库级Apache-2.0不一致,需澄清。
- 依赖的海外学术服务(arXiv、OpenAlex等)在中国大陆可能访问受限,影响实际使用。
- 缺少用户确认机制和外部副作用回滚方案,可能触发未预期的自动推送。
- 技能文档未提供版本历史和变更日志,维护责任不明确。
这个 Skill 能做什么,适合哪些场景?
Nature Literature Pipeline 是一个完整的、生产环境验证过的自动化文献管线,不只是搜索论文,而是结构化引擎,每天对论文进行评分、分类、精读、推送和归档。它整合了多个学术搜索源(arXiv、OpenAlex、Crossref、Semantic Scholar),通过六维评分系统筛选出高相关论文,提供摘要级或全文级精读,并自动推送到飞书等消息平台,同时进行去重和归档。该技能采用引擎与应用层分离的架构,支持关键词、评分权重和推送目标等灵活配置,并内置多项安全机制(如评分验证、三重去重、优雅降级、只读归档)。
该技能实现一个每日文献发现管线,具体操作包括:
- 通过 cron 触发(如每天 08:30)运行,自动从 arXiv、OpenAlex、Crossref、Semantic Scholar 检索 30 个候选论文,若某个来源不可用则自动降级到其他来源。
- 对候选论文进行六维评分(主题匹配 35 分、方法论 20 分、期刊质量 15 分、网络关联 10 分、应用价值 10 分、归档价值 10 分),筛选出前 5 篇。
- 对高分论文进行摘要级或全文级精读,并标注来源级别(全文/摘要/仅元数据)。
- 生成格式化的文献推送摘要,包含排名、标题、期刊、评分、一句话概述、方法、关键结果和评论,发送到飞书、Telegram 等平台。
- 进行 DOI/arXiv 去重,分类归档到本地 vault/wiki 目录,写入笔记并更新索引。
- 科研人员每天早晨通过飞书群接收定制领域的文献推送,快速了解最新相关研究。
- 课题组设置每日 cron 任务,自动监控本领域高相关论文,避免遗漏重要成果。
- 文献管理爱好者将推送结果自动归档到 Obsidian 或本地 vault,建立个人文献知识库。
- 需要批量文献综述的研究者,利用管线的评分和分类功能快速筛选出一组高价值论文。
- 喜欢使用 Telegram 的研究者将推送目标设为 Telegram 频道,随时随地获取最新文献。
这个 Skill 有哪些优点和局限?
- 生产验证的完整管线,覆盖搜索、评分、精读、推送、归档全流程。
- 多源搜索(arXiv、OpenAlex、Crossref、Semantic Scholar)与自动降级机制,增强可靠性。
- 六维评分系统可配置,适应不同领域需求。
- 三重去重和只读归档设计,保护数据完整性和知识库安全。
- 飞书、Telegram 等多平台推送支持,灵活集成到日常工作流。
- 依赖 cron 定期触发,若机器未运行则无法自动执行。
- 配置需要一定技术知识,特别是 cron 和消息平台集成。
- 评分和分类规则需要定期调整,否则可能导致关键词漂移或分数膨胀。
- 缺少自动化测试,可能在新环境或异常情况下出现未预期问题。
- 归档只写入 raw/ 目录,wiki 集成需要手动操作。
如何安装这个 Skill?
该技能位于 nature-skills 仓库的 skills/nature-literature-pipeline/ 目录,是 19 个技能的集合之一。
- 克隆仓库:
git clone https://github.com/Yuan1z0825/nature-skills.git - 进入技能目录:
cd skills/nature-literature-pipeline - 将整个技能目录复制到你的 Agent 技能目录(例如
~/.claude/skills/或~/.codex/skills/),确保保留SKILL.md、references/、templates/等完整结构。
也可以使用 npx skills add 命令安装,例如:npx skills add Yuan1z0825/nature-skills --agent codex --skill nature-literature-pipeline --yes --copy。
注意:安装后需要配置 cron 和消息推送目标(如飞书),具体配置方法在 references/cron-setup.md 中说明。
如何使用这个 Skill?
安装后,告诉 Agent 你的研究领域、关键词和推送目标,例如:
"我的研究领域是 [X],关键词:[Y],推送到 [飞书群名称],归档到 [路径]"。
然后设置每日 cron 任务:
"设置每天北京时间 08:30 的每日文献推送,30 个候选,推送前 5 篇"。
Agent 会按照 SKILL.md 中的流程自动运行管线。你也可以手动触发一次试试,或参考 references/review-compilation-workflow.md 进行集中文献综述。
这个 Skill 与同类方案有什么区别?
与同仓库的 nature-academic-search 技能互补:nature-academic-search 用于即席文献搜索,而本技能提供结构化的每日自动化推送。相对于通用 RSS 或 Google Scholar 提醒,本技能更结构化和自动化,但其适用性仅限科研场景。