Skip to content

minimax-ai/openscience

v0.2.0MIT

Evidence-first research workflow plugins for MiniMax Code — literature search, traceable evidence, citation verification, and human-gated research stages.

citation-verify

当用户需要核验参考文献真实性、检查 BibTeX 条目是否有误、审查论文引用是否可靠、 排查 bibliography 中的错误条目、验证 DOI 与题录是否对得上、发现参考文献张冠李戴、 做投稿前引用体检或审稿引用抽查时使用。同义场景:参考文献核验、引用核查、 文献真伪鉴别、bib 文件检查、参考文献纠错、引用元数据比对、 "帮我看看这些参考文献有没有问题""这个 DOI 对得上吗""有没有编造的引用"。

claim-check

当需要检查论文草稿中的事实性论断是否有证据支撑、做引用-论断对齐审计、 找出没有出处的陈述、核对文内引用是否真能支撑所在句子时加载使用; 通常由 evidence-loop 或审稿类流程调用,不直接面向用户。同义场景: 论断支撑检查、claim 支撑审计、无支撑断言排查、证据覆盖检查、 引用与论断对齐、"这段话有没有文献撑""哪些说法没有引用"。

cn-literature

当用户需要检索或整理中文文献(CNKI 知网、万方、维普、超星)、把中文数据库 导出的题录文件解析成统一 PaperDocument、或把中文文献与英文检索结果合并去重 时使用。同义场景:中文文献检索、知网导出题录解析、万方检索、Refworks/EndNote 格式转换、"帮我把这份 CNKI 导出的 txt 整理成文献表""中文核心期刊上关于 X 有哪些研究"。

cold-start-interview

当用户首次使用科研工作台、研究画像仍为空白,或用户主动说"先做个访谈""重新设置我的研究信息""初始化画像""cold start""重新 interview"时使用。本技能通过结构化访谈收集用户的研究领域、常用数据源、算力环境、写作语言与目标期刊、引用格式、团队协作规范、伦理合规要求,并把回答以散文形式写回插件根目录 CLAUDE.md 的研究画像部分。支持 quick(2 分钟 5 问)、full(完整 15 问)、--redo(推翻重谈)、--check(只检查画像完整度不提问)四种模式,支持中断后续谈。同义触发场景:新用户引导、首次配置、研究背景调查、填研究档案、更新个人研究信息、check 画像。

customize

当用户想修改研究画像或共享守则(guardrails)时使用:换了研究领域、换了目标期刊、换了引用格式、换了算力环境、合规要求变化、想调整某条 guardrail 的严格程度。同义触发场景:改一下画像、更新我的研究信息、修改 CLAUDE.md、调整设置、换引用格式、customize、个性化配置、改规则、重新配置工作台。本技能是画像与守则的唯一维护入口:读取 CLAUDE.md、与用户逐项确认修改点、写回文件、并明确告知哪些 skill 的行为会因此变化。

epi-data-access

当用户需要获取流行病学与公共卫生数据、查找疾病负担或疫情公开数据源、下载 国际或中国的公卫统计与监测数据、评估某个数据源能不能用/怎么引用时使用。 同义场景:WHO 数据、GHDx/IHME 疾病负担、Our World in Data、ProMED 疫情快报、 国家卫健委疫情通报、中国 CDC 周报、China CDC Weekly、国家统计局人口数据、 CHNS 队列、发病率/死亡率数据去哪找、疫情数据下载、公卫数据源推荐、 个案数据去标识化、涉及人的数据要不要伦理审查、"帮我找找某地某病的数据"。

epi-writing

当用户需要撰写暴发调查报告、流行病学观察性研究论文、公卫项目总结、 对照 STROBE 清单自查论文、按中文期刊格式整理稿件或按 GB/T 7714 排版 参考文献时使用。同义场景:暴发调查报告模板、疫情调查报告、现场流行 病学报告、观察性研究写作、STROBE 核对清单、队列/病例对照/横断面研究 论文、中华流行病学杂志投稿、中文期刊格式、GB/T 7714 参考文献、 伦理声明写作、"帮我把这次暴发调查写成报告"。

evidence-capsule

当论文级结论定型、需要把支撑某个结论的全部产物(数据、代码、图表、环境记录)冻结成一个可长期保存、可复核的包裹时使用。同义触发场景:冻结证据、证据胶囊、capsule、保存复现材料、投稿前整理数据、补充材料打包、reproducibility、可复现性归档、审稿人要看原始数据。也用于历史项目的补录归档(标注 historical_content_unverified),以及回答"这个图还能重现吗"类问题。

evidence-loop

当用户希望一次性修好论文的证据链——先核验引用、再查正文支撑、对问题条目 定向补检文献、迭代修订直到收敛——时使用。同义场景:证据闭环、 引用修复流水线、核验-补检-修订迭代、边查边补、系统性消除无支撑论断、 "帮我把这篇文章的引用问题全部查出来并补上文献""修到没有硬伤为止"。

hpc-slurm

当用户需要向 Slurm 集群提交计算作业,说"提交集群任务""写个 sbatch 脚本""作业还在排队吗""批量跑一组参数""作业超时被杀了""GPU 作业怎么交"时使用。本技能规定 Slurm 集群的统一操作规程:sbatch 脚本模板(分区/时长/内存/GPU 指令 + set -euo pipefail + 环境导出 + 结束自动 rsync 产物)、squeue/sacct 状态查询口径、数组任务批量提交、超时与重排队策略、产物抓回与 record_run 登记。同义触发场景:Slurm、HPC、集群、超算、排队、批处理、job array、机时。连接与主机认知纪律沿用 remote-compute(别名、画像合同),本技能只规定作业生命周期。

literature-search

当用户需要检索学术文献、按主题找论文、收集综述素材、查询某篇文献的元数据或 DOI、追踪某方向最新进展或预印本、做开题文献调研时使用。同义场景:文献检索、 论文搜索、查文献、找论文、文献调研、资料收集、题录补全、 "帮我找关于 X 的论文""这个主题有哪些代表性工作""查一下这篇文献的 DOI 和出处"。

literature-survey

当用户需要对已检索到的文献集合做整体分析、写文献调研报告、梳理某领域的 研究概况 / 共识 / 争议 / 空白、提取文献证据为综述写作做准备时使用。 同义场景:文献综述分析、领域调研、研究现状梳理、证据提取、文献精读笔记、 "帮我分析这批论文讲了什么""这个领域的研究现状如何""这些文献有什么共识和分歧"。

outbreak-analysis

当用户处置疑似疾病暴发、需要画流行曲线、做三间分布描述、计算罹患率或 RR/OR、梳理暴发调查思路、形成与验证病因假设、设计回顾性队列或病例对照 研究时使用。同义场景:暴发调查、聚集性疫情分析、流行曲线/epi curve、 病例定义分层(疑似/临床/确诊)、发病时间分布、罹患率比较、2×2 表、 相对危险度 RR、比值比 OR、同源暴发/持续同源/人传人曲线形态、 食源性疾病暴发、现场流行病学调查、"帮我分析这份病例一览表"。

paper-read

当需要对单篇论文做全文精读与结构化证据提取时加载:获取并解析全文文本、 按章节组织阅读、逐字摘录 quote 并定位页码、产出 EvidenceItem 与阅读笔记。 通常由 literature-search / literature-survey 在「检索→阅读→综述」链路中 加载,或经 review-writing 链路回读证据时使用,不直接面向用户。 同义场景:全文精读、证据提取、逐字摘录、阅读笔记、PDF 文本提取、 abstract-only 标注、EvidenceItem 生成。

paper-search

当需要真正执行文献数据库 API 检索时加载:构建检索式(布尔组合、字段限定)、 调用 OpenAlex / Crossref / arXiv 接口、遵守请求礼仪(限速、UA、指数退避)、 把返回解析为统一 PaperDocument。通常由 literature-search 调用,不直接面向用户。 同义场景:检索执行、API 查询、文献接口调用、query 构建、检索脚本运行、 接口限速与重试、检索结果解析。

provenance-record

当任何 skill 或用户操作产生了工作区文件(报告、数据、图、脚本、下载的文献),需要登记"这是什么、谁产生的、在什么环境下产生的"时使用;所有关键步骤结束后都应调用本技能。同义触发场景:记录运行、登记产物、provenance、来源追溯、运行日志、record_run、实验记录、登记一下这次计算、这个文件哪来的。也用于回答溯源类问题:这个结果是哪次运行产生的、当时用的什么环境。

python-analysis

当用户使用 Python 做科研数据分析、统计建模、机器学习实验或批量数据处理,说"用 Python 跑一下分析""做个统计""清洗数据""画结果图""跑个脚本"时使用。本技能规定本地 Python 分析的统一操作规程:环境优先 uv/venv 隔离、依赖写入 requirements.txt 并通过 record_run 记录环境指纹、随机种子固定并登记、原始数据只读(清洗另存新文件)、产物落盘 output/<skill>/<slug>/latest/、图表 PNG+PDF 双格式 300dpi,并附 stats_integrity_check.py 对报告数字做确定性体检。同义触发场景:Python 分析、跑数据、统计分析、数据处理、画图、pandas、matplotlib、分析环境怎么配。

r-analysis

当用户使用 R 做统计分析、流行病学建模、生物信息分析、ggplot 作图,说"用 R 跑一下""写个 R 脚本""rmarkdown 出报告""quarto 渲染""R 环境怎么管"时使用。本技能规定本地 R 分析的统一操作规程:renv 锁定依赖环境、脚本化非交互执行(Rscript 一条命令跑完)、sessionInfo() 必须记录进 provenance、rmarkdown/quarto 作为报告产物、产物落盘 output/<skill>/<slug>/latest/ 并与 record_run 集成。同义触发场景:R 分析、R 脚本、tidyverse、ggplot、RStudio、knitr、renv、R 统计。

remote-compute

当用户需要在 SSH 远程服务器上跑计算任务,说"连服务器跑一下""远程跑个任务""把代码传到服务器""服务器上有 GPU 吗""rsync 抓回结果""SSH 怎么配"时使用。本技能规定远程算力的统一操作规程:连接一律走 ~/.ssh/config 别名加 ControlMaster 共享连接复用(避免集群双因子认证反复打扰)、首次接入新主机做有界只读探测并把能力画像写入 .openscience/hosts/<alias>.yaml 当作合同(画像为 null 的能力禁止臆测)、明确的失败分支处理、远程产物必须 rsync 抓回并 record_run(不记录的运行等于不存在)、安全红线(不在命令行传密钥、不在远端存凭证)。同义触发场景:远程计算、SSH、服务器、算力、集群登录、scp、同步结果。

research-lifecycle

当用户提出研究主题、想开始一项新研究、问"接下来该做什么"、或要求继续上次的研究流程时使用。本技能是科研工作台的元路由器:把一个研究主题拆解为 question(问题界定)→ literature(文献调研)→ hypothesis(假设形成)→ experiment(实验/计算)→ analysis(数据分析)→ writing(写作成稿)六个阶段,逐阶段调用相应插件的 skill 执行,每个阶段结束经 stage-gate 门禁审批后进入下一阶段。同义触发场景:开始研究、开题、走流程、研究流程、lifecycle、继续上次的研究、阶段推进、研究项目管理、六阶段、从选题到成稿。

research-workspace

当用户开始新研究项目、说"初始化工作区""建一下项目目录""检查目录结构""workspace""整理一下我的研究文件夹",或任何 skill 发现当前目录不符合工作区约定时使用。本技能定义并维护科研工作区的标准目录结构(data/figures/notebooks/papers/reports/reviews/scripts/output/.openscience)、产物路径契约(output/<skill>/<slug>/latest/ 指向最近运行,历史运行按时间戳归档)与原始数据只读原则,并提供项目初始化与结构体检两套清单。同义触发场景:新建课题目录、项目结构检查、目录规范、产物放哪里、原始数据能不能改。

review-writing

当用户需要基于文献证据撰写综述、写论文引言或相关工作、把文献调研结果组织成 规范成文、生成带 GB/T 7714 参考文献的综述初稿时使用。同义场景:综述写作、 文献综述成文、相关工作撰写、调研报告写作、生成参考文献列表、 "帮我写一篇关于 X 的综述""把分析结果写成文章""整理成 GB/T 7714 格式"。

reviewer-protocol

当某个 skill 或 agent 需要输出结构化审查意见、或需要解析他方输出的审查意见时使用:本技能定义科研工作台统一审查输出契约(review 围栏 JSON 数组),供所有核验类 skill(如 citation-verify)与发布前审查流程引用。本技能是库技能,不直接面向用户触发。契约规定:意见以 ```review 代码围栏包裹的 JSON 数组输出,元素含 level(error|warn|ok)、check(citation|number|figure|domain|integrity|source)、title、evidence、note 五个字段;全数组最多 8 条,按严重度排序,遵循 evidence-or-silence。

run-monitor

当用户有耗时较长的本地任务需要后台执行,说"后台跑一下""这个任务要跑很久""帮我盯着这个任务""任务跑完了吗""看看日志"时使用。本技能定义长任务 Run 抽象(核心设计:不让人机等任务、轮询不耗 token):run 目录 runs/<run_id>/{run.json, stdout.log, stderr.log},run.json 记录 {id, cmd, cwd, pid, started, status, exit_code};配套纯标准库脚本 run_task.py 提供 start(detached 后台启动,Windows/POSIX 跨平台)、status(pid 存活检查 + 退出码)、list、tail 四个子命令。同义触发场景:长任务、后台运行、任务监控、看进度、训练还没跑完、批处理脚本。

scientific-databases

当用户需要查询科研专业数据库(生物医学实体与临床试验、材料结构与计算性质、 宏观经济时间序列、气象与空间天气、水文地学数据)、或不确定某个数据需求该走 哪个数据库 connector 时使用。同义场景:查数据库、材料数据查询、Materials Project 查结构、FRED 查经济数据、气象数据下载、临床 trial 检索、 "帮我查一下某种材料的带隙""这个经济指标的时间序列去哪拿"。

seir-modeling

当用户需要用仓室模型做传染病传播情景推演、选择 SIR/SEIR/SEIRS 模型结构、 理解 β/σ/γ/R0 参数含义、做参数敏感性分析、估计峰值时间与峰值感染数、 解读或评审一篇仓室模型结果时使用。同义场景:SEIR 模型、SIR 模型、 仓室模型、传播动力学建模、基本再生数 R0、有效再生数、传染期/潜伏期 参数化、疫情趋势情景模拟、干预效果推演、"帮我跑一个 SEIR 看看峰值"。

spatial-epi

当用户需要比较分地区发病率/死亡率、计算标准化发病比 SMR、处理小区域 率不稳定问题、检测疾病空间聚集性、制作分级统计地图(choropleth)、 评审一张疾病地图的规范性时使用。同义场景:空间流行病学、疾病地图、 SMR 标化、间接标化、小区域估计、率平滑、Moran's I 莫兰指数、空间自相关、 扫描统计量、SaTScan、GeoDa、聚集性分析、热点分析、choropleth 制图规范、 "帮我算算各县 SMR""这病有没有空间聚集"。

stage-gate

当研究流程的任一阶段产出物完成、需要用户审批后推进时使用;通常由 research-lifecycle 在每个阶段末尾自动调用,用户也可以直接说"看看当前阶段状态""审批一下""approve""revise""reject""阶段门禁""stage gate"触发。本技能负责:把阶段产出物落盘、生成 stage-report.md(本阶段做了什么/关键结果/风险与疑虑/建议)、更新 output/<project>/stage.yaml,然后停止等待用户三选一——approve 进入下一阶段、revise 携带意见重跑本阶段(原产物归档不覆盖)、reject 终止并写结题说明。同义触发场景:阶段确认、继续下一步、打回重做、终止项目、恢复进度、上次进行到哪了。