阶段 1 · 数据基座(M1 组织记忆上线)
旅程的第一个建设段:把散落在员工电脑、聊天记录、邮箱和各类网盘里的非敏感大规模文件资产(SOP、制度、模板、产品资料、会议纪要),通过云盘按统一目录骨架录入,完成敏感分级标注,发布数据协作规范——组织第一次拥有不依赖任何个人的、机器可读的记忆。
// 一句话理解
给数字总部打地基:把「制度在老员工脑子里、SOP 在某人电脑里、决策依据在聊天记录里」的现状,变成一棵所有人都知道「文件放哪、归谁管、谁能看」的公司目录树。人走,记忆不走。
为什么从这里开始
两个工程事实:第一,数据可得性是部署的头号死亡原因——文件拿不到,后面所有阶段都是空中楼阁;第二,目录天然承担权限边界——文件放进哪个目录,就决定了谁能看到,数据基座建成的同时,权限地基也随之成形,不需要事后补一套权限系统。概念层面的完整阐述见数据基座与 Agent 基座。
这一段做什么:五个动作
| 动作 | 说明 | 产出 |
|---|---|---|
| 1 目录骨架实例化 | 按你的组织结构搭建公司目录体系,目录边界即权限边界 | 客户文件系统骨架 |
| 2 云盘批量录入 | 非敏感大规模文件先行:SOP、制度、模板、纪要;敏感数据此阶段不录入 | 已录入文件库 |
| 3 敏感分级标注 | 每份文件标注四级敏感度(公开/内部/机密/受限),授权按级生效 | 分级标注记录 |
| 4 数据协作规范发布 | 「用数据的人定标准」:谁提供、什么格式、什么口径、什么时限,落成规范文件 | 数据协作规范 |
| 5 现状文件地图 | 哪些域有资产、哪些空白、哪些互相矛盾,一目了然 | 现状文件地图 v1 |
两类数据:冷启动与工作
| 类型 | 是什么 | 起什么作用 |
|---|---|---|
| 冷启动数据(Cold-start Data) | 部署初期批量录入的存量文件——SOP、制度、模板、纪要 | 让系统初始化可用:本段五个动作录入的就是它 |
| 工作数据(Working Data) | 上线后日常办公自然产生的新文件与新记录 | 支撑系统持续演化——持续演化需要持续的数据流入 |
里程碑 M1 ·「组织记忆上线」
| 项 | 内容 |
|---|---|
| 一句话 | 你的文件第一次成为组织自己的记忆——可检索、可引用、可授权、不随人员流动而流失 |
| 参考周期 | 1–2 周(灯塔部署的第 1–2 周) |
| 等级意义 | ADL-2「问答助手」的前半张门票(另一半是阶段 2 的 M2) |
你能亲眼看到的变化
- 云盘里出现一棵与组织结构对齐的公司目录树,每个部门知道文件放哪、归谁管;
- 任意一份核心 SOP/制度文件一分钟内被定位和引用,不再「问老员工」;
- 每份已录入文件有明确归属人和敏感级标注;
- 一份现状文件地图:哪里有资产、哪里空白、哪里互相矛盾——岗位交接从「传帮带三个月」走向「读取上下文一小时」。
M1 验收清单(签字项)
| # | 验收项 | 判定方式 |
|---|---|---|
| 1 | 目录骨架经客户评审通过 | 评审会记录 + 客户签字 |
| 2 | 首批文件覆盖约定范围 | 按部门/域清点,对照现状文件地图 |
| 3 | 已录入文件 100% 完成敏感分级 | 抽查记录 |
| 4 | 数据协作规范发布并经数据使用方确认 | 规范文件 + 确认记录 |
| 5 | 权限清单签署完成 | 合同附件 |
你需要投入什么
- 每个试点部门一位业务接口人,指认文件来源与归属;
- 云盘/网盘访问授权(在签署的权限清单范围内);
- 你无需预先「整理好数据」——还原混乱的现状是 AIDC 的专业工作。
进入下一段的条件
M1 五项验收全部通过,且数据基座中已有支撑第一批 Agent 问答的最小文件量(范围由诊断段的评估报告界定)。满足即进入阶段 2——让这份记忆能被「问」。
这一段不做什么
- 不录入敏感数据——财务实数、个人数据、核心合同先不进,后续按权限矩阵与合同附件逐步纳入;
- 不做对象建模——文件是记忆,不是注册表,那是阶段 3 的事;
- 不追求「数据清洗」式的全量治理——以支撑决策与问答为准,不为完美归档而归档。
相关阅读
- 旅程总览 — 这一段在全旅程中的位置
- 阶段 2 · Agent 基座(M2) — 下一段:十个 Agent 上岗
- 数据基座与 Agent 基座 — 概念层的完整阐述与术语统一
- 权限模型 — 敏感分级与目录权限如何落地