# 三星堆官网文物资料库

打开 **资料库/文物检索.html** 即可检索；不用安装软件。页面支持关键词、类别、级别、出土地点筛选，分别显示主站馆藏与知识图谱资料，并提供来源链接。

首页增加文物发掘地图，可切换八座祭祀坑局部图与遗址全图，按地点、出土年份和文物年代组合筛选，点击文物查看详情。底图保存在 `assets/maps/`，离线可用。时间沿用官网字段；遗址事件与单件文物出土日期分别展示。地图汇总和定位边界见 `reports/地图说明.md`。调整地图后可运行 `scripts/catalog_html.py`，直接更新页面而无需重新采集或重建数据库。

- `资料库/三星堆文物资料库.sqlite`：关系数据库，包含文物、属性、媒体、文章、时间线、展览、原始来源和关联关系。
- `资料库/exports/`：UTF-8 BOM CSV，可直接用 Excel 打开。ID 和编号建议按文本导入。
- `资料库/文物知识.jsonl`：逐条结构化知识，适合后续检索、写作和脚本分析。
- `资料库/文物条目/`：按稳定 ID 命名的 Markdown 文物条目。
- `assets/collection/`：已归档的主站文物图片。
- `data/raw/`：原始接口快照；`reports/采集报告.md` 与 `coverage.json`：范围、缺失及核验记录。

主站 1,100 条与知识图谱 1,137 条有重叠，不能相加作为文物总件数。编号重复或缺失的记录未自动合并。原文中“可能”“认为”“或”等判断语气保持原样。

## 命令行检索

```powershell
& 'C:\Users\Administrator\.cache\codex-runtimes\codex-primary-runtime\dependencies\python\python.exe' -X utf8 scripts/query.py 神树
```

## 更新资料

脚本仅使用 Python 标准库。依次运行 `scripts/collect.py`、`scripts/collect_extra.py`、`scripts/collect_kgs.py`、`scripts/collect_knowledge_context.py`、`scripts/repair_context.py`、`scripts/repair_graph_paged.py`、`scripts/consolidate_context.py`、`scripts/archive_media.py`、`scripts/build_database.py`、`scripts/build_outputs.py`、`scripts/verify_database.py`。采集默认重用成功快照，重复运行不会自动刷新已有记录。独立更新应在新的日期目录进行，并保留旧版；脚本依赖 `data/site-app.js` 中的官网前端配置，更新时需要重新获取官网当前脚本。采集后查看报告中的缺失与接口计数差异。

## 字段和来源

`collections.inventory_number` 为主站 total_num，`excavation_number` 为主站 exhibit_num，二者不等同；`knowledge_entities.inventory_number` 为图谱 sortNumber。关联只接受非空且两边都唯一的编号。`article_mentions` 是关键词检索辅助，不证明文章涉及某件具体器物。主站和知识图谱材料分别标明来源，不将翻译差异或分类差异擅自统一。

资料来源为三星堆博物馆官网及其链接的三星堆主题知识服务。此处为本地研究整理；来源图片和文字的权利信息以官网为准。
