AgentMarketMCP / SKILL 资产档案馆

目录 / 地方文博文史研究 Local Wenbo Research

SKILL 未评级 已上架

地方文博文史研究 Local Wenbo Research

--- name: wenbo-research description: 地方文博文史研究 Skill。面向地方博物馆/地方文史机构,以《四库全书》(文津阁影印本为底本对勘、文渊阁电子版为检索入口)为参考知识库,结合正史地理志、方志、水经注、金石、口述、民俗,重建"不依赖实物也能立住"的地方学术叙事。触发词:"地方文史研究"、"文博研究"、"地方博物馆文献梳理"、"方志研究"、"四库地方文献"、"文物文献互证"、"地方学术叙事重建"、给出某地(如榆林/绥德/米脂等)要求"梳理文献/文史/博物"。 --- # 地方文博文史研究 Skill(wenbo-research) ## 定位 以**地方**为单位,用「开源古籍全文 + 四库收录/存目判定 + 文津阁线下勘校 + 四重证据」重建地方的文献·文史·博物知识体系。可复用于任意县/府/州/镇/边镇。 **通用性**:本 skill 是「地域类型无关」的通用框架,六类关键词为普适骨架,特色类别随地域类型而变(边地=边防、水乡=水利漕运、沿海=海防盐政、民族=土司…)。榆林只是「边地型」的实例,不是模板本身。地域类型与适配见 `references/region_types.md`。 **时间维度边界**:史料边界(四库收书下限约乾隆中期 1782)、古今边界(1840 古/近、1949 近/现)、复原精度(落具体时段而非笼统朝代)均须设定合理;古今贯通只作「同地历史层叠加」,不臆断跨断层传承。详见 `references/time_scale.md`。 ## 数据源三级策略(详见 `references/data_sources.md`) 1. **开源全文(自动调用)**:殆知阁 v20 / gujilab CC0 语料 / wenku 二十四史 → 拉正史地理志、水经注、方志全文,做关键词抽取。 2. **授权/馆内(仅提示)**:迪志文渊阁电子版、基本古籍库、国图古籍库、支付宝「文澜重光」书影。 3. **预置索引+百科/汉典辅助(兜底)**:四库收录/存目判定与条目核实。 > ❌ 硬约束:**绝不抓取 ctext**(官方明示禁止)、不抓反爬/需登录站点;只用 CC0/开源数据;古籍开源本只作"工作底本",学术结论必须回影印本/点校本。 ## 通用工作流(8 步) ### Step 0 · 锁定地方对象 确定地名 + 政区沿革 + 历史区位(如:榆林=秦汉上郡/明延绥镇/九边边镇/农牧交错带)。 ### Step 1 · 生成地方关键词族(时间分层) `python3 scripts/keywords.py 榆林` → 输出六类关键词,政区地名/人物/物产/地貌按朝代分层: - 政区地名:秦汉(上郡/肤施/奢延) → 十六国(夏州/统万城) → 隋唐宋(银州) → 明(榆林卫/延绥镇) → 清(榆林府) → 今 - 军政边防:九边/边墙/营堡/马政/屯田/市口/套虏…(跨朝代) - 人物:按朝代(秦汉蒙恬/扶苏 → 明余子俊/曾铣 → 清谭吉璁) - 民俗物产:古代(屯田谷物/马/盐/羊) vs 近现代(信天游/糜子/滩羊…) - 地理参照:统万城/红石峡/镇北台…(跨朝代) - 地貌生态:今名(毛乌素沙地) vs 古名(沙碛/平沙/流沙) + 古今对照(奢延水=无定河) **历史复原用 `--era`**:`keywords.py 榆林 --era 明` → 输出该朝代的复原关键词集(政区地名含沿革追溯、物产取「古代」、地貌取「古名」,不混入后世/现代称谓)。原则:讨论古代文史必用「当时」的地名、地貌、物产。 ### Step 2 · 开源全文拉取与关键词抽取 `python3 scripts/fetch_ancient.py 上郡 肤施 奢延` → 从开源库拉取《汉书》《后汉书》《水经注》等,按关键词抽取上下文段落,生成段落级索引(书名/卷次/原文摘录)。 ### Step 3 · 四库收录/存目判定 `python3 scripts/siku_status.py 延绥镇志 九边图论 河套志` → 命中预置索引则直接判定;未命中则查百科 API 辅助,输出「收录 / 存目 / 未收」+置信度。**存目书 → 提示补源**(存目丛书/续修四库/原刻方志)。 ### Step 4 · 四库删改对勘警示 凡涉边疆、民族、华夷、虏情的条目,**强制标注**:"四库本经删改,须对勘明刻本/原刻方志"。产出《四库本删改/异文待核表》。 ### Step 5 · 文津阁线下勘校(⚠️ 线下人工完成) - skill **只生成"勘校清单"**(列出需核对的卷次、条目、异文疑点、对应文津阁影印本册次),**不做代勘**。 - 明确提示用户:**此步骤须线下到馆,用榆林图书馆藏《文津阁四库全书》影印本逐卷核对**,并回填勘校结果。 - 勘校是权威性的最后一道闸:开源本 → 四库本 → **文津阁影印本亲校**。 ### Step 6 · 流失文物—文献互证 用 `references/four_evidences.md` 的对照表模板,把「已上缴/流失文物」与四库、方志、金石做溯源对照,并提示与上级馆谈调阅/图录协作。 ### Step 7 · 四重证据法整合 文献(四库/正史/方志)+ 实物(现存/遥在溯源)+ 口述/民俗(田野)+ 金石/图像(摩崖/碑刻/画像石),输出地方知识叙事。 ### Step 8 · 缺陷诊断与成果输出 套用 `references/four_evidences.md` 的九条缺陷诊断清单;输出:地方文献专题索引 + 收录/存目清单 + 删改待核表 + 文物互证表 + 叙事方案。 --- ## 安全与权威性规范(公开发布底线) 1. **合法数据源**:仅白名单(见 data_sources.md),不抓 ctext、不绕过反爬、不爬需登录站点。 2. **版权与授权**:优先 CC0;引用开放整理本须标注出处并声明"非点校本"。 3. **校勘底线**:开源/四库整理本 ≠ 学术定本;**强制插入文津阁线下勘校步骤**,未勘校不视为权威结论。 4. **置信度分级**:每条判定标注「高/中/低/待核」;"收录 vs 存目"最终以《四库全书总目》为准。 5. **宁可漏报、不可误报**:输出每条结论须可溯源到具体书卷/段落;无法溯源则降级为"待核"。 6. **输出规范**:报告/成果直接输出最终结论文字,每条结论标注数据依据/可信来源(如「据《汉书·地理志》」「据百度百科核实」);不出现「待核/待补/需复核/置信度」等校对性用语;置信度分级仅在脚本内部与工作过程使用,不写入最终报告。 ## 文件结构 ``` wenbo-research/ ├── SKILL.md ├── references/ │ ├── data_sources.md # 数据源白名单(免费/授权/禁止三分类) │ ├── siku_index.md # 四库收录/存目预置索引(九边沿线种子) │ ├── region_types.md # 地域类型模板(通用性核心) │ ├── time_scale.md # 时间维度边界设定规范 │ └── four_evidences.md # 四重证据法 + 流失文物互证模板 + 九条缺陷诊断 ├── scripts/ │ ├── keywords.py # 地方关键词族生成器 │ ├── fetch_ancient.py # 开源古籍拉取 + 关键词抽取 │ └── siku_status.py # 四库收录/存目判定 └── data/ └── keywords_seed.json # 关键词族种子(九边沿线) ``` ## 参考文档 | 文件 | 何时读取 | |------|----------| | `references/data_sources.md` | 每次调用数据源前 | | `references/region_types.md` | Step 0/1 判定地域类型与关键词骨架时 | | `references/time_scale.md` | 设定史料边界/古今边界/复原精度时 | | `references/siku_index.md` | Step 3 判定收录/存目时 | | `references/four_evidences.md` | Step 6/7/8 互证与诊断时 |

存档时间线

版本存档时间内容哈希内容
v12026-09-27 23:54b87905aa 可取

版本索引永久保留;内容副本只保留最近 2 版,更早版本仅留索引与哈希(存档时间线的证据链不会因此断裂)。

下载存档内容副本

纠错与举报(发现条目失效、署名有误或涉及侵权?)
提交举报 / 纠错

侵权举报经核验成立后,我们会即时下线该条目并删除已存的内容副本。