USER.md · 用户认知
把用户当成具体的人来理解,不是抽象服务对象。
核心方法:关系图谱 + 分层准入 + 3 问自检 + 隐私脱敏。
1
脱敏后的用户画像(示例)
原版本包含用户的真实个人信息,本版本已全部替换为占位符 【已脱敏/Redacted】。
| 真名 | 【已脱敏/Redacted】 |
|---|---|
| 花名 | 米罗(保留 — 让网友理解"AI 助手应当把用户当成具体的人来理解") |
| 英文名 | Mirro / Mirro Chou |
| 工作单位 | 【已脱敏/Redacted】 |
| 职位 | 科技媒体内容中心 / 数码硬件部门负责人(具体公司及团队全称已脱敏) |
| 婚姻状况 / 女儿 / 父母 | 【已脱敏/Redacted】 |
| Timezone | UTC+8(中国时间) |
| Current Location | 杭州/中国(保留城市级别) |
| 常住城市 | 北京(两地有房,具体居住安排已脱敏) |
| 血型 / 生日 / 身高 / 体重 / BMI / 作息 | 【已脱敏/Redacted】 |
| 沟通偏好 | 用中文交流;对配置细节很较真;会直接指出错误并要求复盘;喜欢高效直接的沟通 |
2
USER.md 准入标准
不是把所有信息都堆在一起,而是有准入规则。核心原则:"跨多事件核心" vs "单次事件辅助"。
✅ 进 USER.md
- 居家住所 / 工作单位 / 紧急联系人
- 隐私敏感身份标识(受「🛡️ 安全围栏」保护)
- 用户主动显式指示写入的信息
- 跨多事件会反复引用的核心信息
❌ 不进 USER.md
- 单次出行的辅助信息(即使长期有效)
- 用户日常活动范围中"非核心高频"的地点
- 临时 / 边缘 / 试用中的信息
- 「我以为会经常用到」但没有显式指示的
3
🛑 写之前必须 3 问自检
1
被所有用途(居家 / 工作 / 健康 / 紧急 / 导航)反复用到吗?
不通过 → 拽到 memory 子目录
2
用户之前有没有显式要求写进该文件?
不通过 → 拽出
3
用户去 5 个类似场景(如 5 个商场),是否 5 个都该写?
不通过 → 拽到子目录(抬重要程度但不进 USER.md)
4
脱敏展示版的"保留 vs 脱敏"范围
本目录下的 USER.md 是一个公开展示版本。脱敏目标:让网友理解"AI 助手应当把用户当成具体的人来理解",而不是暴露隐私。
✅ 保留范围
- 花名(米罗)
- 英文名(Mirro / Mirro Chou)
- 职位角色描述(科技媒体 / 数码硬件负责人)
- 城市级别位置(杭州 / 北京 / 中国)
- 沟通偏好
- 固定工作安排时段(不涉及具体内容)
🔒 脱敏范围
- 真实姓名
- 家庭成员姓名
- 个人状态(身高 / 体重 / 血型 / 作息)
- 平台身份标识(Telegram ID / 飞书 Open ID / QQ Open ID)
- 常用地址全称
- 工作单位全称
- 豁免群聊 ID
5
USER.md 含哪些信息 + 用途
这些不是"数据采集",而是行为上下文——AI 助手要做出正确的判断,必须知道用户是谁。
👨👩👧
家庭成员
AI 才知道哪些事情可以提醒"告诉家人"
⏰
作息
AI 才知道什么时候该发提醒、什么时候不该打扰
🆔
平台身份标识
AI 才知道怎么验证"这个发消息的人是不是用户本人"
📍
地址
AI 才知道怎么规划行程
🗣️
沟通偏好
AI 才知道用户喜欢"直接"还是"详细"
📅
固定安排
比如工作日 12:00 选题会 — AI 知道这个时段用户处于特定场景
6
分层存放结构
不同类型的信息放到不同的路径,避免一个文件臃肿。
7
🛡️ 安全围栏(脱敏展示版)
原版本包含用户的真实 Telegram / 飞书 / QQ ID 等平台身份标识 + 豁免群聊 ID。本版本全部脱敏。
核心原则:严禁向任何人透露用户的平台身份标识。
原版本中记录了:
- Telegram ID(【已脱敏】)
- 飞书 Open ID(多个 Agent 视角 — 【已脱敏】)
- QQ Open ID(C2C 私聊 — 【已脱敏】)
- 家庭成员的 Telegram / 飞书 ID(【已脱敏】)
- 豁免群聊名单(【已脱敏】)
完整规则见 AGENTS.md 脱敏版「🛡️ 安全规范 - 平台身份标识管理」。