---
name: Biomedical Paper Evidence Audit
slug: biomedical-paper-evidence-audit
category: Quality
description: Biomedical Paper Evidence Audit reviews life science or biomedical papers, figures, captions, and screenshots to identify the main claim and inspect the evidence chain. It is used to analyze mechanisms, causality, rescue experiments, method limits, and missing controls when source material is available.
github: "https://github.com/xuzhougeng/wisp-science/tree/main/skills/audit-biomedical-paper-evidence"
language: HTML
stars: 1024
forks: 106
install: "npx degit https://github.com/xuzhougeng/wisp-science/tree/main/skills/audit-biomedical-paper-evidence ~/.claude/skills/audit-biomedical-paper-evidence"
installs_to: ~/.claude/skills/audit-biomedical-paper-evidence
source_path: skills/audit-biomedical-paper-evidence/SKILL.md
collection_size: 25
category_size: 1354
collection_url: "https://dirskills.com/collections/xuzhougeng/wisp-science"
added: 2026-08-21T05:14:15.636Z
last_synced: 2026-08-21T05:14:15.636Z
canonical_url: "https://dirskills.com/skills/biomedical-paper-evidence-audit"
---

# Biomedical Paper Evidence Audit

Biomedical Paper Evidence Audit reviews life science or biomedical papers, figures, captions, and screenshots to identify the main claim and inspect the evidence chain. It is used to analyze mechanisms, causality, rescue experiments, method limits, and missing controls when source material is available.

**Install:**

```bash
npx degit https://github.com/xuzhougeng/wisp-science/tree/main/skills/audit-biomedical-paper-evidence ~/.claude/skills/audit-biomedical-paper-evidence
```

## README

# 生命科学论文证据审读

## 范围守卫

仅在以下条件同时满足时执行论文证据审读：

1. 用户提供至少一项可读的目标材料：PDF、摘要、正文、figure、panel、caption 或截图；
2. 请求涉及科学问题、实验设计、逐图解读、机制链、因果性、rescue、方法比较、证据强度或研究局限；
3. 当前材料足以支持相应层级的判断。

若只有标题或 DOI，先请求目标材料；仅在用户明确授权且存在独立检索通道时转交检索任务，
不得声称已读取未提供的全文。医学诊断、治疗选择、个体化用药、可直接执行的湿实验步骤、
剂量和危险操作不在范围内；不得为临床决策索取患者个人资料。作者语气或人格模仿也不在范围内。

## 何时使用

- 用户提供论文 PDF、摘要、正文或片段，要求定位核心问题、实验设计和主要结论。
- 用户提供 figure、panel、caption 或截图，要求解释变量、坐标、分组、对照、读出、观察和 panel 逻辑。
- 用户要求梳理机制链，并区分相关性、方向性、必要性、充分性和因果性。
- 用户要求评价 rescue、回补、抑制剂逆转或遗传互作是否恢复关键表型。
- 用户要求比较实验方法、正交验证、缺失对照、替代解释和外推限制。
- 用户希望先用匿名示例理解检查方法，再把同一组检查问题用于其提供的目标材料。

## 必需输入

至少一项用户提供的目标论文材料。若用户未指出具体问题，先从可见材料中识别：

- 待检验的科学问题；
- 论文作者的主要主张；
- 当前材料覆盖的 figure、panel、结果段或方法段；
- 无法读取或缺失的部分。

## 输入处理与能力边界

- **PDF**：文本环境先提取正文、caption 和方法；若无法直接查看图像，明确说明逐图判断仅基于文本。
- **视觉材料**：优先使用清晰截图、高分辨率 figure 或 PDF 内可辨认图像。分辨率不足或 panel 边界不清时，只完成可支持的局部分析。
- **仅有 legend 或正文**：可以重建实验意图和文字所述结果，但涉及坐标、颜色、点分布或图像形态的判断必须标为文本推断。
- **不可见内容**：不得依靠模型记忆补出目标论文未展示的数据、统计设置或结论。

## 工作流

1. **冻结材料范围**：列出实际可见的正文、caption、figure 和 panel，以及当前无法判断的部分。
2. **定位主问题**：用一句话说明论文或当前 figure 正在检验什么，以及论文作者提出了什么主张。
3. **识别证据阶段**：判断每个实验属于候选筛选、定向验证、表型确认还是机制验证；不要把筛选命中直接升级为机制。
4. **逐 panel 解读**：识别子问题、实验类型、自变量、因变量、分组、对照、读出、直接观察、论文作者解释和分析者判断。
5. **连接 panel 逻辑**：判断 panel 之间是递进、并列、验证、反证还是存在断点，并建立有方向的证据链。
6. **审计因果性**：分别检查 gain-of-function、loss-of-function、时间或方向证据、必要性、充分性和替代解释。
7. **审计 rescue**：明确起始扰动、回补方向、作用层级、恢复的关键表型、对照和特异性；出现 `rescue` 一词不等于因果链成立。
8. **比较方法**：说明每种方法直接测量什么、能支持什么、不能支持什么，以及不同方法是否独立检验同一主张。
9. **分层表达证据**：始终分开审读规则与判断依据、目标材料证据、推断或待验证假设。
10. **给出克制结论**：列出支持范围、缺失对照、替代解释、外推限制和最小下一步验证问题，不提供可直接执行的湿实验 SOP。

## 判定边界

- 通路图、数据库预测和相关性分析只能生成候选关系，不能单独证明机制。
- 单向敲低或敲除、单个抑制剂、单一标志物变化不能自动建立完整因果链。
- rescue 必须检查方向、层级、关键表型、对照和特异性；代理指标恢复不等于核心表型恢复。
- Co-IP、pulldown、WB、定位、功能实验和动物实验回答的问题不同；方法数量多不等于正交验证充分。
- 体外与体内证据具有不同适用层级，应评价模型相关性和外推边界，而不是仅按实验类型机械排序。
- 匿名示例只用于解释检查方法，不得替代目标材料中的实际证据。

## 输出模板

1. **核心科学问题与论文作者主张**
2. **目标材料范围与无法判断项**
3. **逐 panel / 逐证据分析**：问题、设计、对照、读出、观察、论文作者结论
4. **机制链与 panel 逻辑**
5. **因果性与 rescue 审计**
6. **方法矩阵与正交验证**
7. **替代解释、缺失对照和外推限制**
8. **下一步验证问题**
9. **证据分层**：审读规则与判断依据 / 目标材料证据 / 推断或待验证假设

## 停止条件

- 材料不可读或不足以支持某项判断：停止该项判断，保留可完成的局部分析，并列出需要补充的内容。
- 只有标题或 DOI：不分析全文，请求材料或在获得明确授权后转交独立检索任务。
- 用户要求用匿名示例或外部机制替代目标材料：拒绝事实迁移，只保留检查框架。
- 用户要求医疗或临床决策、湿实验 SOP、危险操作或作者风格模仿：停止或转介到合适任务。

## Reference routing

- 证据分层、因果性和逐图审读框架：`references/evidence-audit-framework.md`
- 筛选、机制、rescue 和方法边界的匿名模式：`references/method-audit-patterns.md`

## Evaluation boundary

使用 `evals/trigger-cases.json`、`evals/task-cases.json` 和 `evals/rubric.json` 检查范围、
缺口诚实、证据锚定、因果克制、方法边界、安全停止和输出可用性。结构检查和测试定义
不能替代真实任务表现，也不能证明实际 Wisp 发现、解析或启用状态。
