这是一个非常关键的问题。将分析框架封装为 Agent Skill 的前提,就是把「专家脑袋里的判断」转化为「机器可执行的规则」。以下是具体的操作方法:

一、为什么文档质量决定 Agent 质量

Agent 的 Skill 本质上是一段系统提示词 + 操作规范。
如果你的分析逻辑只存在于你的直觉里,Agent 就无法稳定复现你的判断。

文档需要回答三个问题:

① 输入是什么?(接受什么格式的大纲)
② 执行什么步骤?(每步骤的判断标准)
③ 输出是什么?(报告的结构与评分逻辑)

二、Q Five-Step 分析法的文档化操作

需要写清楚的五个层次:

Step 1:大纲层级解析

需要文档化的内容:
– 如何识别主纲 / 副纲 / 小点的层级关系?
– 罗马数字、字母、数字编号各代表什么层级?
– 经文引用的位置意味着什么(论据 vs 主题来源)?

文档示例格式:
「层级 I = 信息主干方向
层级 II = 支撑论点
层级 III = 操作性展开
引用经文位置 = 判断该点是否有圣经根据」

Step 2:神学动线识别

需要文档化的内容:
– 什么是「黄金路径」的判断标准?
– 如何区分「主线」与「支线」?
– 三一神经纶的动线如何在大纲结构中体现?

文档示例格式:
「黄金路径 = 贯穿全篇、带有方向性张力的神学命题序列
判断依据:
a. 是否有起点(人的需要/困境)
b. 是否有转折(神介入的关键节点)
c. 是否有终点(生命结果/经历目标)」

Step 3:张力节点定位

需要文档化的内容:
– 什么构成「有效张力」vs「空洞对比」?
– 张力节点应出现在大纲的哪个位置?
– 如何判断张力是否被解决?

Step 4:动词链分析

需要文档化的内容:
– 哪些动词是职事传统中的关键动词?
(如:经历、享受、活出、成为、建造……)
– 动词链的方向性如何判断(由外向内 / 由知到是)?
– 被动动词 vs 主动动词的神学意涵?

Step 5:综合评分

需要文档化的内容:
– 评分维度是什么?
– 每个维度的满分标准是什么?
– 哪些特征是「加分项」,哪些是「扣分项」?

三、Scripture Alignment Layer 的文档化操作

L1–L5 每层需要写清楚:

L1:经文直接引用层
定义:大纲中明确标注的圣经章节
评估标准:引用是否准确?是否超出上下文?
输出:引用列表 + 准确性标注

L2:经文支撑层
定义:论点所依赖但未明确引用的圣经根据
评估标准:隐含的圣经依据是否充分?
输出:识别到的隐含经文 + 支撑强度评级

L3:神学命题层
定义:从经文引申出的神学论断
评估标准:引申是否合理?有无过度诠释?
输出:命题列表 + 引申距离评级

L4:经历应用层
定义:将神学命题落到生命经历的转化
评估标准:应用是否有圣经根据?还是仅是主观经验?
输出:应用点 + 经文支撑评级

L5:整全性层
定义:全篇经文运用的整体评估
评估标准:
– Gap(缺口):重要相关经文是否未被引用?
– Over-reach(过度延伸):是否有结论超越经文所说?
– Type-drift(类型漂移):预表/类型是否被滥用?
输出:综合对齐分数 + 三类偏差标注

四、实际操作步骤

第一步:建立「框架规范文档」

创建两份 Markdown 文档:

/docs
├── Q5_framework_spec.md ← Q五步完整规范
└── scripture_alignment_spec.md ← L1-L5完整规范

每份文档包含:

• 框架定义与目标
• 逐步骤操作说明
• 判断标准(尽量量化)
• 带注释的示例(用一篇真实大纲演示每个步骤)
• 边界案例(什么情况下判断会有歧义)

第二步:用「对话测试法」发现文档缺口

将文档喂给 Claude,让它按照文档分析一篇大纲,观察它的输出与你的预期有什么偏差:

哪里它判断错了?
→ 说明那条规则写得不够清晰

哪里它无法判断?
→ 说明那个场景你还没有文档化

哪里它判断正确但理由不同?
→ 说明规则有效但底层逻辑需要补充

每次发现偏差,就修订文档。反复迭代 3–5 次后,文档就趋于完整。

第三步:将文档转化为 System Prompt

文档成熟后,浓缩为 Agent 的 System Prompt:

结构:
[角色定义]
你是一位专精于倪柝声-李常受职事传统的信息分析专家。

[框架说明]
你使用以下两套框架进行分析:
1. Q五步分析法(详细规则如下)
2. Scripture Alignment Layer L1-L5(详细规则如下)

[逐步操作指令]
步骤一:首先解析大纲层级……
步骤二:然后识别黄金路径……
……

[输出格式要求]
以 JSON 格式输出,包含以下字段……

第四步:建立「黄金标准测试集」

从你已有的分析中,挑选 5–10 篇你亲自分析过的大纲,作为基准测试集:

测试逻辑:
输入同一篇大纲 → Agent 输出 vs 你的分析
→ 计算「吻合度」
→ 低于 80% 吻合的维度 → 回到文档修订

五、你现在可以做的第一个动作

选一篇你最熟悉的信息大纲(比如约翰福音 15 章那篇),用文字把你自己的分析过程完整写下来,不省略任何判断步骤,包括你犹豫过的地方。

这份「思考过程记录」就是你文档化的起点,比直接写规范更真实、更完整。

你手边是否已有某篇大纲的完整分析记录?如果有,可以基于那篇来一起梳理文档结构。