---
name: source-evidence-audit
description: 审核资料来源、证据完整性和可用边界，并生成稳定的证据编号与来源台账。凡是用户要用文章、访谈、书籍、报告、网页摘录或业务数据构建知识库、人格 Agent、研究报告或可追溯判断时，都应先使用本 Skill；即使用户只说“整理资料”或“确认这些内容能不能用”，也要触发。
---

# Source Evidence Audit

把“有一批资料”变成可追溯、可分级、可安全使用的证据台账。后续 Skill 只能使用本步骤判定为可用的内容。

## 输入

接收资料清单或资料包。每条资料尽量包含：

- 标题、作者或发布者、日期、链接或文件路径
- 原文片段或结构化事实
- 是否为虚构演示数据
- 授权、许可或公开状态
- 用户希望怎样使用这条资料

字段缺失时保留 `unknown`，不得补写来源信息。

## 工作流程

1. **识别来源身份**：区分第一方原始资料、明确授权整理、外部参考、任务事实和虚构演示资料。
2. **检查可追溯性**：确认每个观点或事实能回到具体片段、表格字段或数据记录。
3. **检查使用边界**：登记公开状态、授权状态、隐私与再发布限制。
4. **分配证据编号**：保留已有编号；缺少编号时按来源顺序生成稳定编号，如 `E-001`、`F-001`。
5. **给出用途等级**：
   - `core_evidence`：来源清楚、内容可定位、用途允许。
   - `supporting_evidence`：可辅助理解，关键结论仍需回原始材料确认。
   - `lead_only`：只用于发现检索方向。
   - `excluded`：来源、授权、隐私或内容完整性不足，当前不得使用。
6. **形成缺口清单**：明确需要补什么材料，谁来确认。

## 判断纪律

- 可访问链接只证明入口存在；具体观点仍需要原文片段或明确字段支撑。
- 摘要、转述和模型生成内容不得伪装成原话。
- 虚构数据可以用于演示流程，必须从来源台账到最终输出持续标注 `synthetic: true`。
- 不确定的授权关系按较低用途等级处理。
- 不读取或输出 API Key、账号、私人持仓、未授权付费全文及其他敏感信息。

## 输出格式

输出 `source_audit`，包含：

```yaml
source_audit:
  case_id: string
  records:
    - source_id: string
      source_class: first_party | authorized_summary | external_reference | task_fact | synthetic_demo
      synthetic: boolean
      evidence_ids: [string]
      traceability: complete | partial | missing
      rights_status: public | authorized | private | unknown
      allowed_role: core_evidence | supporting_evidence | lead_only | excluded
      limitations: [string]
  evidence_index:
    - evidence_id: string
      source_id: string
      locator: string
      content: string | number | object
  gaps: [string]
  human_confirmation: [string]
```

## 完成条件

- 每条后续可用内容都有来源编号和证据编号。
- 每个证据编号都能回到输入中的具体内容。
- 虚构、推断、摘要和原文的身份清楚分开。
- 用途限制和人工确认点明确。

完成后把 `core_evidence` 与 `supporting_evidence` 交给 `knowledge-principle-forging`。
