health_agent_prd
Health Agent Twin
产品需求文档 PRD v2.0
产品定义:一个健康结果优先的智能 Agent 画布。它根据用户的健康数据、当前情境、长期偏好和可控记忆,动态生成今日摘要、洞察、行动和报告;在关键健康风险上,始终以用户真实健康和用户代理权为最高优先级。
面向用户的一句话:它不是让你更依赖 App,而是让你更理解自己的身体。
第 0 章:产品价值观与优化目标
这是整份文档最重要的章节。所有功能设计、排序策略、交互决策,必须以本章为最终裁判。
0.1 我们在优化什么
Health Agent Twin 的北极星不是使用时长、DAU 或点击率。
我们优化的是:用户是否更理解自己的身体,并形成可持续的健康行为。
当两个目标发生冲突时,优先级排序如下:
用户真实健康 > 用户代理权 > 可信关系 > 个性化体验 > Engagement
任何以提升 Engagement 为由降低健康优先级的设计决策,都需要在评审时明确说明理由并经过额外审批。
0.2 三条不可妥协的产品原则
原则一:重要健康信息不可被个性化隐藏 展示方式可以个性化(语气、密度、位置),但 ELEVATED 及以上的健康风险信号,不能因为用户"不喜欢看"而被算法隐藏。
原则二:用户拥有代理权 用户可以在任何关键页面选择"帮我判断"(代理模式)或"我自己探索"(探索模式),这不是设置项,而是随时可切换的页面状态。
原则三:可信关系优先于拟人依赖 分身感来自"它记住的东西是准确的、可控的、可撤销的",而不来自过度拟人化。系统不制造"AI 真正理解我、关心我"的错误预期。
0.3 产品承诺
我们不追求用户更多地打开 App。
我们追求用户每次打开 App,都能更清晰地了解自己身体发生了什么。
我们追求用户最终不再需要频繁依赖 App,因为他们已经形成了更好的健康直觉。
第 1 章:产品形态与核心空间
1.1 产品形态定义
Health Agent Twin 是由云端健康 Agent 驱动的动态健康画布,不是:
- 固定首页填充不同数据的健康仪表盘
- 以对话为主界面的聊天机器人
- 功能模块堆砌的健康工具集
产品的核心循环:
用户状态 + 用户意图 + 用户记忆 + 健康数据
↓
Agent 判断此刻用户最需要什么(健康需要 > 个人偏好)
↓
返回个性化 UI Schema
↓
前端渲染成此刻专属页面
↓
用户交互(点击、忽略、反馈、追问)
↓
写入偏好、记忆、行为画像
↓
下一次体验更贴合用户,且更有健康价值
1.2 四个核心空间
App 由四个核心空间构成,每个空间是动态画布,而非固定页面。
空间一:今日 Today
核心问题:今天我身体怎么样?为什么?我该做什么?
目标不是展示所有数据,而是给出今天最重要的 1-3 件事。
页面结构(由 Agent 编排,顺序因人而异):
[今日结论卡] — 一句话定性,避免术语堆砌
[为什么卡] — 个性化展示判断依据
[关键证据卡] — 按用户偏好:简洁 / 图表 / 数据链
[今日行动卡] — 低门槛、可完成的 1-3 个行动
[分身记忆提示] — 相关的已确认模式(可选,非干扰)
代理模式示例(焦虑型睡眠关注用户):
今天重点:恢复偏低,优先补睡
今天这样判断的原因:
昨晚睡眠少于目标 48 分钟,HRV 较你的基线下降 18%。
这个组合在你过去 3 次出现时,次日精力通常较差。
今天建议只做 2 件事:
1. 午后轻散步 15 分钟
2. 今晚 23:00 前放下手机
探索模式示例(数据探索型用户):
今日数据摘要
睡眠:5h52m(目标 7h,差 68min)
HRV:42ms(个人基线 51ms,↓18%)
静息心率:67bpm(个人基线 63bpm,↑6%)
查看 7 日趋势 / 与上周对比 / 原始数据 / 问 Agent
空间二:洞察 Insight
核心问题:我最近发生了什么变化?这些变化意味着什么?
定位是变化解释中心,不是图表展示中心。Agent 决定哪些变化值得解释,按健康价值排序呈现。
页面结构:
[最重要变化] — Agent 判断的最值得关注变化
[变化原因] — 可能的解释(注明置信度)
[证据链] — 可展开,按偏好展示深度
[是否需要行动] — 行动建议或「暂时观察」
[历史对比] — 用户常用的时间区间
空间三:行动 Action
核心问题:今天我能做什么来改善?
定位是行为改变入口,不是建议列表。Agent 根据用户历史完成率、当前健康状态、偏好,生成最可能完成的行动,而非最"理想"的行动。
行动设计原则:
- 每次最多推荐 3 个行动
- 每个行动必须有具体时间、具体方式
- 展示该行动推荐的原因(为什么是你,为什么是今天)
- 每个行动支持:已完成 / 太难了 / 不适合今天 / 换一个
- 所有反馈实时写入 User Twin
空间四:分身 Twin
核心问题:它如何越来越理解我?我如何管理这段关系?
这是产品护城河页面,让用户看见 Agent 的成长过程,并保持对"关系"的掌控权。
页面结构(5 个模块):
[健康关注全貌] — 当前画像的可视化摘要
[已确认的模式] — 用户已验证的健康规律
[正在观察的模式] — 候选记忆 + 学习进度
[已根据反馈调整] — Change Log,可见可审计
[我来管理] — 记忆编辑 / 偏好设置 / 调教入口
第 2 章:用户意图系统
2.1 意图分类
8 类一级意图
| 意图类型 | 核心问题 | 产品响应优先级 |
|---|---|---|
| TODAY_STATUS | 今天我怎么样? | 最高频,每日首屏 |
| RECOVERY_CHECK | 我最近恢复好吗? | HRV + 睡眠 + 负荷综合 |
| SLEEP_IMPROVE | 我为什么睡不好? | 睡眠结构 + 影响因素 + 今晚计划 |
| HEART_ASSURANCE | 我心脏稳不稳? | 趋势 + ECG + 风险分级 |
| ANOMALY_EXPLAIN | 为什么这周状态差? | 归因链 + 证据 + 行动 |
| ACTION_PLAN | 今天该做什么? | 低门槛行动清单 |
| REPORT_SUMMARY | 本周/月怎么样? | 周报 + 新发现 |
| FREE_EXPLORE | 我想自己看看数据 | 探索模式,Agent 退为助手 |
意图来源优先级
1. 用户主动输入(最高优先级)
2. 健康事件触发(ECG 可用、异常信号)
3. 情境推断(时间、距上次使用时长)
4. 长期行为偏好推断
5. 兜底规则(新用户 → TODAY_STATUS)
2.2 冷启动意图采集
冷启动是一级产品问题。 Day 1 的体验决定有没有 Day 100。
Onboarding 只问 3 个问题
不做问卷,只做意图声明,立即影响当天 UI 编排:
问题 1:你现在最想关注什么?
[睡眠质量] [心脏状态] [恢复状态] [运动表现] [整体健康]
问题 2:你希望我怎么解释?
[一句话总结] [适度解释] [给我证据和数据]
问题 3:你希望我怎么提醒你?
[只在重要变化时] [每天给我摘要] [尽量少打扰]
用户选择后,首页必须即时反映选择。这是冷启动阶段最强的个性化感知。
冷启动期的诚实表达
Day 1-7(人群先验期),系统应明确告知:
我还在了解你。现在展示的洞察基于通用健康规律,
使用 7 天后会逐步切换到你的个人基线。
禁止在 Day 1 说:「我发现你睡眠不足会影响 HRV。」——因为还没有个人证据。
允许在 Day 1 说:「对大多数人来说,睡眠少于 6.5 小时与次日 HRV 下降相关。你的个人规律需要几天数据来确认。」
第 3 章:用户健康分身 (User Twin)
3.1 User Twin 五层画像
|
|
3.2 画像更新策略
| 触发源 | 更新类型 | 更新速度 | 更新幅度 |
|---|---|---|---|
| 显性反馈(太复杂) | explanationDepth 调整 | 实时 | 强 |
| 显性反馈(有帮助) | domainWeights 正向 | 实时 | 弱 |
| 隐性行为(点击/停留) | 兴趣权重累积 | 批量(每日) | 微弱 |
| 行动完成/跳过 | actionCompletionRates | 实时 | 中 |
| 健康事件(异常) | 风险画像更新 | 实时 | 强 |
| 长期模式确认 | 长期记忆固化 | 离线管道 | 永久 |
安全锁定域(禁止在线自动修改):
- 健康风险分级阈值
- 医疗边界规则
- ECG 异常判断逻辑
- HITL 触发条件
- 安全提示文案
第 4 章:记忆系统
4.1 记忆生命周期
原始信号(健康事件 + 行为事件)
↓
候选记忆生成(每晚离线管道)
↓
置信度评估(证据数量 / 相关系数)
↓
[置信度 < 0.5] → 继续观察
[置信度 ≥ 0.5 且证据充分] → 推送 LearningCard
↓
用户确认流程
↓
[准确] → CONFIRMED,参与 UI 编排
[不准确] → REJECTED,降低同类候选权重
[先别记住] → 暂停 7 天
[删除] → 软删除,永不推荐
↓
长期使用:定期复核置信度,低置信度记忆自动降级
4.2 记忆五种状态
| 状态 | 前端展示文案 | 参与排序 |
|---|---|---|
| OBSERVING | 「我正在观察这个模式是否稳定」 | 否 |
| CANDIDATE | 「我发现了一个可能与你有关的模式」 | 否 |
| PENDING_CONFIRM | 「这准确吗?」(需用户确认) | 否 |
| CONFIRMED | 「你已确认这条模式准确」 | 是 |
| ADJUSTED | 「已根据你的反馈调整展示方式」 | 是(偏好维度) |
| DEPRECATED | 「这条记忆已不再用于推荐」 | 否 |
4.3 记忆文案准则(Memory Copywriting Guideline)
核心原则:数据人格化,而非强拟人化。
| 禁止表达 | 替换表达 | 原因 |
|---|---|---|
| 我理解你了 | 我发现了一个可能与你有关的模式 | 避免过度拟人 |
| 我知道你容易焦虑 | 根据你的反馈,你更希望夜间减少健康提醒 | 基于事实,非判断 |
| 我会照顾你 | 我会根据你的设置,优先展示重要变化 | 功能承诺,非情感承诺 |
| 我记住了:你睡眠少于 6.5h 时… | 根据你过去 14 天的数据,发现一个可能的规律… | 明确数据来源 |
| 我发现你睡眠影响 HRV(Day 1) | 对多数人而言,睡眠不足与 HRV 下降相关(冷启动期) | 不伪造个人证据 |
4.4 分身 Twin 页记忆展示结构
已确认的模式(N 条)
├── [模式内容] [置信度 87%] [数据来源:过去 14 天]
│ [纠正] [删除] [了解更多]
正在观察(N 条)
├── [观察内容] [进度:已观察 4/7 次] [████░░░]
│ [停止观察]
已根据你的反馈调整(Change Log)
├── 2025-05-03 减少夜间心率提醒频率(来自你的反馈)
├── 2025-04-28 健康解释改为简洁模式(来自你的反馈)
└── 2025-04-21 取消"咖啡因提醒"推送(来自你设置)
第 5 章:核心排序架构
这是当前版本最重要的架构升级。排序引擎不再是单一的 Personalization Ranking,而升级为两层结构,中间加入 Health Outcome Policy Engine。
5.1 新排序链路
Insight Candidates(洞察候选集)
↓
Layer 1: Health Need Scorer(健康必要性评分)
↓
Layer 2: Health Outcome Policy Engine(健康结果策略引擎)
↓
Layer 3: Experience Fit Scorer(体验适配评分)
↓
Layer 4: Safety Guard(安全防护)
↓
Layer 5: UI Orchestration(UI 编排输出)
5.2 Layer 1:健康必要性评分
决定「该不该展示」,不受用户偏好影响。
HealthNeedScore =
clinical_relevance * 0.30 // 与健康判断的相关性
+ deviation_from_baseline * 0.20 // 偏离个人基线程度
+ persistence_score * 0.15 // 持续出现天数
+ risk_level_score * 0.20 // 安全分级权重
+ actionability_score * 0.15 // 是否有可执行行动
5.3 Layer 2:Health Outcome Policy Engine
这是健康产品与内容推荐产品的本质区别所在。
处理四类冲突场景:
| 用户意愿 | 健康必要性 | 策略 | 执行方式 |
|---|---|---|---|
| 想看 | 应该看 | 强化展示 | 优先级提升,丰富证据 |
| 想看(过度) | 不应过度 | 降频引导 | 限制同类内容频次,引导看整体趋势 |
| 不想看 | 必须看 | 强制展示,调整表达 | 不可隐藏,但按用户情绪状态选择语气 |
| 不想看 | 不重要 | 降级或隐藏 | 进入「可展开」或下一刷 |
焦虑用户的正确策略(修正原文档中「焦虑用户首屏不展示高风险卡」的错误设计):
| Safety Level | 焦虑用户展示策略 |
|---|---|
| INFO | 可降频、可隐藏 |
| ADVISORY | 温和语气,正常展示 |
| MONITORING | 延后至第 2-3 位,必须可见 |
| ELEVATED | 必须展示。顺序:先安抚 → 再解释 → 再行动建议 |
| CRITICAL | 强制置顶,明确行动,禁止个性化隐藏 |
ELEVATED 焦虑用户文案示例:
❌ 错误:你的心率异常升高,需要重点关注。
✅ 正确:今天有一个值得复查的心率变化。
多数情况下这不一定代表严重问题,但因为它连续出现了 3 天,
我建议你先完成一次静息复测。如果同时出现胸闷、胸痛或呼吸困难,
请及时就医。
5.4 Layer 3:体验适配评分
决定「怎么展示、放在哪里、用什么语气」,在 HealthNeedScore 保证的内容集合内优化。
ExperienceFitScore =
user_interest * 0.25 // 用户历史兴趣
+ preferred_format_match * 0.20 // 是否符合展示偏好
+ attention_context_match * 0.20 // 当前注意力情境匹配
+ emotional_tolerance * 0.20 // 情绪耐受度匹配
+ novelty_without_fatigue * 0.15 // 新颖且不重复
5.5 排序硬约束(优先级高于所有评分)
约束 1:Safety Level = CRITICAL → 强制置顶,不受任何偏好影响
约束 2:Safety Level = ELEVATED → 必须在前 3 位,语气可个性化
约束 3:Health Need Score > 0.8 → 不可被疲劳惩罚推出当屏
约束 4:同类型卡片最多连续 2 张(防止信息茧房)
约束 5:首张卡片必须是「今日结论」或「最重要健康变化」
约束 6:焦虑用户 ELEVATED 以上内容,必须先展示安抚性框架
第 6 章:代理权设计(Agency Design)
6.1 两种模式定义
代理模式(Agent-Guided)
Agent 是导演,用户是读者。适合:普通 C 端用户、时间有限者、健康意识一般者。
特征:
- 少图表,多结论
- 少术语,多口语
- Agent 主动排序,用户接受结果
- 强行动建议,降低决策门槛
探索模式(Self-Explore)
Agent 是工具,用户是导演。适合:数据探索型用户、健康意识强者、专业背景用户。
特征:
- 更多图表和原始数据
- 可自选时间范围
- 可查看证据链和基线对比
- 可导出报告
- Agent 回答问题,不主动推荐
6.2 模式切换交互规范
切换入口:不放在设置页,而是在关键内容页面顶部常驻。
今日页顶部右侧:[帮我总结 ✓] [自己看]
洞察页顶部右侧:[帮我解释 ✓] [自己探索]
行动页顶部右侧:[给我建议 ✓] [我来选]
模式切换是会话级,不是账户级:用户今天早上用代理模式,下午有时间可以切换探索模式。切换行为本身写入行为画像,Agent 逐步学习用户在什么情境下偏好哪种模式。
默认模式:基于 onboarding 第 3 题初始化,后续根据使用习惯动态调整。
6.3 探索模式功能清单
时间范围选择:7 天 / 14 天 / 30 天 / 90 天 / 自定义
维度切换:睡眠 / HRV / 心率 / 活动负荷 / 复合视图
对比功能:本周 vs 上周 / 工作日 vs 周末 / 自定义区间
筛选功能:按事件(运动后 / 特定症状) / 按时间段(夜间 / 晨间)
问答入口:「为什么 X 周这周下降?」→ 返回动态分析页
导出:PDF 报告 / CSV 数据
第 7 章:UI Schema 规范
7.1 Schema 核心字段
|
|
7.2 情境模式(context_mode)触发规则
| 情境模式 | 触发条件 | 内容密度 | 默认 explanation_contract |
|---|---|---|---|
| morning_brief | 06:00-09:00 首次打开 | 低 | brief |
| quick_check | 日间,距上次 < 2h | 极低 | brief |
| deep_dive | 周末 / 停留 > 5min / 探索模式 | 高 | evidence_first |
| post_workout | 运动结束后 30min 内 | 中 | brief_with_expandable |
| evening_wind_down | 21:00 后 | 低,避免焦虑触发 | brief |
7.3 动态分析页(问答场景)
用户问「最近为什么这么累?」时,Agent 不只返回文字,而返回结构化分析页 Schema:
|
|
追问「只看工作日」时,分析页实时更新,不重新打开新页面。
第 8 章:反馈闭环系统
8.1 显性反馈类型与处理
| 反馈类型 | 触发 | 立即效果 | 长期效果 |
|---|---|---|---|
| 有帮助 | 点击 👍 | domainWeights +0.03 | 同类内容权重提升 |
| 不准确 | 点击 ✕ | 该 insight confidence -0.2 | 相关记忆候选降级 |
| 不想再看 | 点击 🚫 | fatigueCounts[type]++ | 永久性降频 |
| 太复杂 | 点击 简 | 当次改为简洁版 | explanationDepth 趋简调整 |
| 稍后提醒 | 点击 ⏰ | 延后 4h 重推 | 推送时机偏好学习 |
| 提醒太多 | 点击 🔕 | notificationTolerance 降级 | 全局降频 |
8.2 隐性行为信号
| 行为 | 信号含义 | 权重 |
|---|---|---|
| 卡片停留 > 30s | 用户感兴趣 | 弱正向 |
| 展开证据详情 | 偏好详细解释 | 中正向 |
| 点击行动 | 愿意执行 | 中正向 |
| 跳过行动(连续 3 次) | 行动类型不合适 | 强负向 |
| 关闭推送 | 推送频率过高 | 中负向 |
| 追问原因 | 对解释深度有需求 | 弱正向 |
| 切换到探索模式 | 当前时间段偏好自主 | 情境学习 |
8.3 反馈可见化(Change Log)
用户每次反馈后,系统不是默默修改,而是明确告知改了什么:
// 即时确认气泡(反馈后 1 秒内显示)
「已收到,我会减少这类心率提醒的频率」
// 分身页 Change Log(持久记录)
2025-05-08 减少夜间心率提醒频率 [来自你的反馈]
2025-05-06 健康解释改为简洁模式 [来自你的反馈]
2025-05-01 取消重复性咖啡因提醒 [来自你设置]
8.4 行动效果追踪
当用户完成行动后,3-5 天后系统触发效果追踪:
3 天前你完成了「午后轻散步」。
在那之后的 3 天,你的晚间心率平均恢复提前了 12 分钟。
这可能和散步有关,也可能和其他因素有关,我会继续观察。
[这个结果准确吗?] [有其他原因] [继续保持]
这是「越用越健康」的直接产品化体现。
第 9 章:安全与合规层
9.1 五级安全分级
| 级别 | 定义 | 前端处理 | 个性化权限 |
|---|---|---|---|
| INFO | 参考信息,无风险 | 正常展示 | 全量个性化 |
| ADVISORY | 生活方式建议 | 正常展示 + 免责声明 | 语气/位置可个性化 |
| MONITORING | 需关注,建议复查 | 必须可见,位置可调 | 语气可个性化 |
| ELEVATED | 明显异常,建议就医 | 必须在前 3 位,不可被过滤 | 仅语气可个性化,内容不可删减 |
| CRITICAL | 立即就医 | 强制置顶,全屏弹窗,HITL 复核 | 禁止任何个性化隐藏 |
9.2 禁止输出词库(持续维护)
绝对禁止:诊断、确诊、你患有、你得了、处方、用药剂量、手术方案
高度谨慎:治疗、病症、疾病名称(需加「可能」「建议就医确认」)
推荐替换:「值得关注的变化」「建议咨询医生」「需要复查」
9.3 受控学习边界
✅ 允许在线自动更新(受控学习域)
├── 用户偏好(解释深度、UI 风格、通知频率)
├── 关注域权重
├── 行为模式记忆
├── 行动建议偏好
└── 推送时机偏好
🔒 禁止在线自动修改(安全锁定域)
├── 健康风险升级阈值
├── 医疗边界规则
├── ECG 异常判断逻辑
├── HITL 触发条件
├── 安全提示文案
└── 数据合规规则
第 10 章:指标体系
10.1 北极星指标:健康自主改善
Health Agency Score(健康自主分)
= 用户是否更理解自己的身体
+ 用户是否形成可持续健康行为
+ 用户是否减少了不必要健康焦虑
- 用户是否对 App 形成了不健康依赖
这是抽象指标,由以下代理指标共同衡量。
10.2 一级结果指标(最重要)
| 指标 | 衡量方式 | 目标方向 |
|---|---|---|
| 健康行为改变率 | 推荐行动 30 天后用户相关指标改善比例 | ↑ |
| 洞察确认准确率 | 用户对记忆候选的「准确」确认比例 | ↑ |
| 异常处理率 | ELEVATED+ 信号用户是否完成复查/就医 | ↑ |
| 焦虑降低指标 | 用户反复查看同一指标的频次 | ↓ |
| 行动完成率 | 推荐行动被完成的比例(按难度分级) | ↑ |
| 健康自我解释能力 | 用户能否用语言描述自己关键健康变化(抽样调研) | ↑ |
10.3 体验质量指标
| 指标 | 含义 | 目标 |
|---|---|---|
| 反馈正向率 | 「有帮助」/ 总反馈 | > 60% |
| 不准确率 | 「不准确」/ 总推送 | < 8% |
| 不想看率 | 「不想再看」/ 总推送 | < 5% |
| 太复杂率 | 「太复杂」/ 总解释类内容 | < 12% |
| 代理/探索切换率 | 每周主动切换探索模式的用户比例 | 监控,非优化 |
| 冷启动 7 日留存 | Day 7 仍在使用的用户比例 | > 目标值 |
10.4 增长指标(护栏,非优化目标)
DAU、留存率、使用时长作为健康护栏指标——低于阈值时需关注是否出现体验问题,但不作为产品决策的主要驱动因素。
明确禁止的优化路径:
- 为提升 DAU 增加焦虑性推送
- 为提升停留时长增加无意义内容
- 为提升点击率降低信息密度
- 为提升复访频次制造不必要的数据焦虑
第 11 章:落地路线图
Phase 0(第 1-2 周):基础设施
目标:让后续所有个性化有数据基础。
- User Twin Profile 数据模型 + CRUD 服务上线
- Kafka 行为事件 Topic + 客户端埋点(按 8.2 节清单)
- UI Schema JSON Schema 规范确定 + 前端 Renderer 框架
- 所有洞察卡片增加 FeedbackBar(4 个反馈选项)
- Onboarding 3 问题流程 + 立即影响首页编排
- Change Log 存储结构 + 分身页展示框架
Phase 1(第 3-6 周):P0 个性化感知
目标:用户能明显感到「今天这个页面是为我生成的」。
- Intent Understanding Service(8 类 + 隐式推断)
- Health Need Scorer V1(规则型)
- Health Outcome Policy Engine V1(四象限规则)
- Experience Fit Scorer V1(规则打分)
- 首页卡片个性化排序上线(含硬约束)
- WhyThisCard 组件(所有排序第一的卡片)
- PersonalizationBadge 组件
- 焦虑用户安全分级展示策略
- 代理模式 / 探索模式切换(今日页 + 洞察页)
- 冷启动期诚实文案(Day 1-7 标注人群先验)
Phase 2(第 7-10 周):P1 分身成长感
目标:用户反馈后,下一次真的不一样了。
- 长期记忆存储(pgvector)+ 记忆候选离线管道
- 记忆生命周期前端化(LearningCard + MemoryCard + ConfirmCard)
- 分身 Twin 主页(5 个模块)
- PreferenceTuner(偏好调教器)
- Change Log 前端完整展示
- 行动效果追踪(完成行动 3-5 天后回访)
- 动态分析页(问答返回结构化页面,支持追问)
- 个性化周报(「本周我更了解你了」)
- 提醒频率自适应系统
Phase 3(第 11-16 周):P2 护城河
目标:产品积累了用户专属健康资产,不可迁移。
- 多 Agent 专项(Sleep / Heart / Recovery / Report Agent)
- Health Outcome Policy Engine V2(数据驱动)
- 排序引擎升级(LightGBM,以健康结果指标为训练目标)
- 个人健康模式挖掘离线管道成熟化
- 北极星指标度量体系上线
- 离线评估系统(洞察准确率 / 行动有效率 / 焦虑降低)
- A/B 测试框架(以健康结果指标为主要实验指标)
- 长期健康目标教练模式
附录 A:四个关键分叉点的设计决策
分叉 1:健康优先策略如何写进排序引擎?
决策:双层排序架构。Health Need Score 决定「能不能被降级」,Experience Fit Score 决定「怎么展示」。Health Need Score > 0.8 的内容,疲劳惩罚和焦虑惩罚最多只能影响位置,不能将其推出当屏。
分叉 2:代理模式和探索模式如何切换?
决策:页面级常驻切换,会话级生效,行为学习情境偏好。不是设置项,是每次打开 App 都能自然触达的状态。
分叉 3:记忆文案如何避免过度拟人化?
决策:数据人格化而非强拟人化。所有记忆文案必须满足:明确数据来源、标注置信度、标注状态、不使用情感判断语言。具体执行参考 4.3 节 Memory Copywriting Guideline。
分叉 4:北极星指标是什么?
决策:Health Agency Score,以健康行为改变率、洞察准确率、焦虑降低指标为主要代理指标。DAU / 留存作为护栏,不作为优化目标。
附录 B:前端核心智能感知组件清单
| 组件名 | 作用 | 触发时机 |
|---|---|---|
| WhyThisCard | 解释为什么今天给用户看这个 | 每屏最重要的 1 张卡片 |
| MemoryCard | 展示已确认的健康模式 | 相关记忆 confidence > 0.8 |
| LearningCard | 展示正在观察的模式 | 候选记忆推进到 PENDING |
| ConfirmCard | 请求用户确认记忆准确性 | 记忆达到确认条件 |
| FeedbackBar | 统一的内容反馈入口 | 所有洞察/建议卡片底部 |
| PersonalizationBadge | 告知用户页面已个性化 | 今日页/洞察页顶部 |
| PreferenceTuner | 主动调教分身偏好 | 分身页 + 反馈后触达 |
| ChangeLogEntry | 展示 Agent 根据反馈做了什么调整 | 分身页 / 反馈后即时确认 |
| AgencyToggle | 代理模式/探索模式切换 | 今日页/洞察页/行动页顶部 |
| ColdStartBanner | 冷启动期诚实说明 | Day 1-7 全局顶部 |
附录 C:产品价值观快速参考卡
┌─────────────────────────────────────────────────────┐
│ Health Agent Twin 产品价值观 │
├─────────────────────────────────────────────────────┤
│ │
│ 用户真实健康 > 用户喜爱感 │
│ 用户代理权 > 系统自动化 │
│ 可信关系 > 拟人依赖 │
│ 健康 Outcome > Engagement │
│ │
├─────────────────────────────────────────────────────┤
│ 重要健康信息不可被个性化隐藏 │
│ 展示方式可以个性化,内容不可以消失 │
├─────────────────────────────────────────────────────┤
│ 我们的目标: │
│ 让用户不再需要频繁依赖 App, │
│ 因为他们已经形成了更好的健康直觉。 │
└─────────────────────────────────────────────────────┘
- 原文作者:知识铺
- 原文链接:https://index.zshipu.com/edudaily/post/20251208/health_agent_prd/
- 版权声明:本作品采用知识共享署名-非商业性使用-禁止演绎 4.0 国际许可协议进行许可,非商业转载请注明出处(作者,原文链接),商业转载请联系作者获得授权。
- 免责声明:本页面内容均来源于站内编辑发布,部分信息来源互联网,并不意味着本站赞同其观点或者证实其内容的真实性,如涉及版权等问题,请立即联系客服进行更改或删除,保证您的合法权益。转载请注明来源,欢迎对文章中的引用来源进行考证,欢迎指出任何有错误或不够清晰的表达。也可以邮件至 sblig@126.com