# 模型仓库的构造 *构建元模型 · 第 1 课,共 6 课 · 约 15 分钟* ## 你将学到 合规模型仓库的规范形态:每一个保留位置、什么该放进去,以及为什么形态本身就是一份契约。 ## 规范的目录树 ```text meta-model/ ├── README.md # human landing ├── BOOTSTRAP.md # operating instructions: how to read this model (read first) ├── LICENSE ├── CHANGELOG.md ├── manifest.yaml # walk declaration: bundle order, classification, exclusions ├── sources.yaml # Data Mastership Register: who masters each dataset │ ├── bundles/ # the model data: bundles → layers → records ├── canon/ # source texts this model treats as ground truth ├── raw/ # unprocessed harvested captures (never hand-edited) ├── artifacts/ # generated, regenerable outputs (never authored) ├── imports/ ├── mappings/ # external standards and alignments to them ├── schemas/ ├── examples/ ├── diagrams/ ├── docs/ └── tools/ ``` 每个位置都承载固定含义,因此读者(人或智能体)永远不必凭感觉猜测某个文件是什么。 ## 两个入口 **`BOOTSTRAP.md`** 面向心智:如何阅读这个模型、按什么顺序、本地约定是什么、哪些东西不可触碰。**`manifest.yaml`** 面向机器:身份、包的顺序、文件分类规则、排除项。其余一切都可以从这两者抵达。如果你的生态已经有入口文件(`CLAUDE.md`、`AGENTS.md`),保留它,但让它指向 BOOTSTRAP:结构上只有一个真值来源。 ## 内容的四种秉性 模型里的一切都属于四种秉性之一,而它们从不混合: 1. **撰写型**内容(包、政策、文档):由人或以作者身份行事的智能体写就,就地编辑,像代码一样评审。 2. **正典**文本(`canon/`):模型所*论述*或所受其约束的文档:一份学说、一项已通过的决议、你所遵循的元模型规范。各层引用正典,但从不转述它。若记录与正典文本冲突,以正典为准。 3. **采集型**证据(`raw/`):来自外部系统的抓取:导出、转储、爬取。按 `raw/<系统>/<数据集>/` 组织,每一份都配有来源旁注(源头、范围、抽取时间、工具)。手工编辑一份抓取会摧毁它的证据价值:更正要么发生在源头(然后重新采集),要么以带批注的模型记录形式存在。 4. **生成型**产物(`artifacts/`):计算得出的视图、报告、遍历结果。健康的 `artifacts/` 的检验标准是:把它整个删掉再重新生成,没有任何有价值的东西丢失。 ## 真实例子:一个平台模型 DevTeam.Games 的模型展示了这种形态如何吸收混乱的现实:它的 `_raw/`(一个遗留名称,在清单中做了映射)保存着追踪器退役时冻结的 ClickUp 导出、竞品研究与设计抓取;`00-meta/` 保存着 AISMM 正典的内嵌镜像及其来源旁注;平台真正的源代码以外部 git 克隆的形式挂接,存在于磁盘上,但被声明为主权在别处的镜像。2613 个文件,无一未分类。遗留的目录布局无需重命名:清单把旧名称映射到保留含义上。 ## 要点 - 两个入口:BOOTSTRAP.md 面向心智,manifest.yaml 面向机器。 - 四种秉性(撰写、正典、采集、生成)各有保留的居所;它们从不混合。 - 遗留布局能够存活:映射优于重命名。 ## 深入阅读 - [MMAS-Package:仓库与包结构](/spec/#02-architecture/MMAS-Package.md) - [模型遍历与约定位置](/spec/#02-architecture/Model-Traversal-and-Layout.md) 下一课:[包、层与记录](02-records.md)