Grack AI 循证体系
每个健康论断, 都有看得见的来路。
这份案例研究定义了完整的产品契约:哪些来源可用、提示词如何把论断绑定到证据、展示前校验什么,以及 Grack 何时应当交代不确定性。
证据如何 进入回答。
提示词只是更大系统中的一个控制点:检索提供可核验的证据,校验确认回答没有越出证据的范围。
每个有依据的论断都带着对应来源。证据缺失或不足时,Grack 会移除无依据的结论,并把不确定性清楚呈现出来。
- 01
甄选
只收录来源清晰、日期明确的指南、共识声明与同行评审研究。
- 02
检索
传递最小的相关证据片段,并附带稳定的来源 ID,而不是一堆无法追溯的文档。
- 03
约束
在开发者提示词中,把临床与定量论断绑定到所提供的证据上。
- 04
校验
拦截无依据的论断、失效的引用、剂量指导,以及掩饰不确定性的回答。
查看这三个控制项:它们把“使用证据”变成可落地的产品要求。
开发者指令 · 节选
提示词契约
- 01把用户自己的观察数据与公开证据区分开。
- 02临床或定量论断只能引用所提供的证据 ID。
- 03把 [source_id] 紧跟在受其支撑的论断之后。
- 04证据缺失或相互矛盾时,说明不确定性,或拒绝给出该论断。
- 05绝不诊断、开处方,或建议更改剂量。
提示词定义行为契约,但它本身并不创造证据。
回答内可见的控制
个人数据计算、逐条论断的来源说明、可以打开的来源链接、用药安全边界,以及明确的“无可靠证据”回退状态。
证据质量体系
精选语料检索、论断与引用一致性校验、证据版本记录、失败监测与临床医生质量抽样,共同保证循证路径始终可查。
来自 Grack App

一个回答, 四个核验
界面让个人观察、有出处的建议、引用元数据与临床边界在视觉上彼此分开。
- 观察记录
- Wegovy 2.4 mg · 第 40 周 · 100.0 → 80.0 kg · 计算为每周 0.5 kg
- 关联证据的论断
- 力量训练与 1.2–1.6 g/kg/day 的蛋白质区间,都在其支撑的论断处带有标记。
- 来源对象
- 每个标记都能打开具名来源,并说明该来源具体支撑相邻的哪一项论断。
- 临床边界
- 回答只描述记录到的趋势,把个体判断与用药决定交还给临床医生。
证据回退
无证据 不结论
Grack 仍可根据用户记录复算趋势。但无法获得足够相关的可靠证据时,它会移除无依据的适宜性判断,不展示引用,并把个人情况是否适合交还给临床医生评估。
- 保留可复算的趋势:每周 0.5 千克
- 移除无证据支持的适宜性判断
- 没有可靠来源,就不显示来源卡片
- 请临床医生评估是否适合个人情况
规则始终一致:保留可以复算的结果,移除无法证实的判断,并让边界清楚可见。

上下文, 改变相关性。
个人数据决定用哪套计算、哪种措辞。它不会变成临床证据,也不会放松引用规则。
用下面的对比,查看两种请求状态。
交互对比
由你决定模型收到什么。
切换查看两种状态,下方请求路径中每个变化的字段都会高亮。
当前显示:仅问题
在你的 iPhone 上
你的问题
“我最近的减重速度正常吗?”
不附带任何用药、体重、年龄或 HealthKit 上下文。
Grack 后端
最小化并约束
- 空值会被省略。
- 显示名称不会传给模型。
- 服务端会附加安全指令。
模型请求
仅问题
模型只会收到最小可用的信息,外加禁止诊断、处方与剂量调整的规则。
模型凭证只保存在服务端。
上下文改变相关性与计算方式,但绝不降低证据标准:临床论断仍然只能使用符合条件的来源,并经过同样的校验闸门。
边界, 始终明确。
- 不做诊断,也不把症状解读为某种疾病
- 不开处方,也不指示开始或停用药物
- 不调整剂量、用药时机或滴定
- 严重症状与用药决定交还给临床医生
证据质量, 可以度量。
- 证据库经过人工精选并保留版本,配有负责人与复核日期
- 回答进入界面前,先完成论断与引用的核对
- 用审计日志记录来源、提示词版本、拒答与未通过的校验
- 由临床医生复核的质量抽样,以及明确的回滚阈值
可靠性, 坦诚说明。
Grack 可以约束、检视、度量并持续改进 AI 输出。但任何通用模型都无法保证零幻觉。
发布目标是被证据约束的行为,以及看得见的失败处理:无依据的论断会被移除,不确定性会被如实呈现,高风险决定交还给临床医生。