
由 NLP 提取的认知标志物(TTR、MLU、连贯性、信息密度),并与 MoCA / MMSE 对照验证 — 对早期变化更敏感。
每日数据点,而不是季度临床就诊。以周级分辨率追踪药效,不必等待 3–6 个月后的下一次评估。
来自居家环境的自然数据 — 不是人工实验室场景。适合 FDA / EMA 真实世界证据提交所需的生态效度。
覆盖 CNS 三大支柱的连续语音衍生信号。
情绪
从语音特征、词汇标志和自我报告推断情绪状态 — 每日采集,并按受试者建立基线。
认知
覆盖回忆、流畅性、定向力和参与度的综合认知指数 — 在 7 天、30 天和 90 天窗口中追踪。
依从性
双向确认的用药依从性,包含漏服时间戳和下游症状相关性。
为什么自然环境数据会改变一切。
现有数字认知工具依赖结构化测试。Amigo 从自然的每日对话中采集数据 — 没有测试焦虑、没有练习效应,也没有患者负担。
| 维度 | Amigo | 结构化测试工具 |
|---|---|---|
| 采集方式 | 自由形式每日对话 | 提示式认知任务(画钟、图片描述、纸牌游戏) |
| 频率 | 每日 — 每次对话都是一个数据点 | 每周到每季度 — 预约式会话 |
| 患者负担 | 零 — 对话本身就是产品(陪伴) | 需要主动参与测试流程 |
| 练习效应 | 无 — 没有重复测试结构可学习 | 分数会因重复接触而提高 |
| 测试焦虑 | 无 — 数据采集嵌入愉快的日常习惯 | 表现焦虑可能扭曲结果 |
| 生态效度 | 高 — 居家环境中的真实语音 | 低到中等 — 人工测试条件 |
| 数据模态 | 语言 + 声学 + 行为 + 情绪 | 通常每个工具只有 1–2 个维度 |
| 依从性 | 高 — 老人愿意聊天 | 随时间下降 — 测试疲劳 |
| 纵向深度 | 每位受试者在数月内有数百次会话 | 最多通常只有数十次会话 |
| 单数据点成本 | 边际成本 — 无临床人员、无设备发放 | 更高 — 需要监督执行或专用设备 |
“结构化测试工具”指基于提示式测试的数字认知评估平台(画钟、图片描述、反应时间任务)— 这类工具需要患者主动参与。
从自然语音到可用于研究的结构化数据集。
每一步都由内部工程化并运营,在每个阶段都有明确版本控制,并保留每个数据点生成过程的完整审计轨迹。
每次会话 31 个结构化变量。
覆盖认知、语音、行为、情绪和临床维度。每次导出均附带版本化数据结构和数据字典。
| Field | Type | Example | Category |
|---|---|---|---|
| subject_id | string | anon_8f3a2c | ID |
| session_date | date | 2026-02-28 | ID |
| call_duration_seconds | int | 540 | Session |
| word_count | int | 312 | Cognitive |
| type_token_ratio | float | 0.68 | Cognitive |
| mean_utterance_length | float | 8.4 | Cognitive |
| words_per_minute | float | 98 | Cognitive |
| repetition_rate | float | 0.05 | Cognitive |
| coherence_score | int (1-10) | 8 | Cognitive-AI |
| idea_density_score | int (1-10) | 7 | Cognitive-AI |
| word_finding_score | int (1-10) | 9 | Cognitive-AI |
| composite_score | int (0-1000) | 742 | Cognitive |
| participation_ratio | float | 0.45 | Behavioral |
| turn_count | int | 24 | Behavioral |
| engagement_quality | enum | good | Behavioral |
| mood_primary | enum (5) | positive | Mood |
| mood_intensity | int (0-10) | 7 | Mood |
| alert_triggered | bool | false | Alert |
| alert_nature | enum | null | Alert |
| alert_severity | enum | null | Alert |
| f0_mean_hz | float | 185.3 | Voice |
| f0_std_hz | float | 28.7 | Voice |
| jitter_percent | float | 1.12 | Voice |
| shimmer_percent | float | 3.45 | Voice |
| hnr_db | float | 18.2 | Voice |
| speech_rate | float | 3.8 | Voice |
| pause_rate | float | 0.22 | Voice |
| mean_pause_duration_ms | int | 680 | Voice |
| composite_z_score | float | +0.3 | Baseline |
| baseline_sessions | int | 12 | Baseline |
| trend | enum | stable | Baseline |
队列拆分
数据集中临床画像的分布
指标分布
AI 评估连贯性得分的样本直方图
语音频率演变
24 周内 F0 均值(Hz)— 单一受试者
每次对话会产生什么。
每次通话都会生成一个多维结构化快照。带版本、带时间戳,并可追踪数据血缘。
NLP 认知标志物
通过 Amigo's 确定性 NLP 管线,从语音模式中提取量化语言指标。
AI 认知评分
由 Amigo 认知引擎评分的高阶语言功能,并与临床量表校准。
语音与声学生物标志物
从原始音频中提取韵律和频谱特征。用于抑郁、帕金森病和认知下降的已验证标志。
行为指标
参与度、互动比例和对话动态 — 揭示随时间变化的行为模式。
情绪与情感
5 类情绪分类,带连续强度评分和会话级情绪语境。
临床提醒
结构化检测抑郁标志、认知混乱、身体不适和安全信号。
纵向基线
个体内 z 分数基线,用于个人轨迹追踪和变化检测。
一次对话。一条结构化记录。
每条记录代表一次会话。可提供 JSON、CSV 或 Parquet 格式 — 并附带版本化数据字典和审计血缘。
{
"subject_id": "anon_8f3a2c",
"age_band": "75-79",
"session_date": "2026-02-28",
"call_duration_seconds": 540,
"cognitive": {
"word_count": 312,
"type_token_ratio": 0.68,
"mean_utterance_length": 8.4,
"repetition_rate": 0.05,
"words_per_minute": 98,
"coherence_score": 8,
"idea_density_score": 7,
"word_finding_score": 9,
"composite_score": 742
},
"voice": {
"f0_mean_hz": 185.3,
"f0_std_hz": 28.7,
"jitter_percent": 1.12,
"shimmer_percent": 3.45,
"hnr_db": 18.2,
"speech_rate": 3.8,
"pause_rate": 0.22,
"mean_pause_duration_ms": 680
},
"behavioral": {
"participation_ratio": 0.45,
"turn_count": 24,
"engagement_quality": "good",
"user_speech_duration_s": 245
},
"mood": {
"primary": "positive",
"intensity": 7
},
"alert": {
"triggered": false,
"nature": null,
"severity": null
},
"baseline_delta": {
"composite_z_score": +0.3,
"sessions_in_baseline": 12,
"trend": "stable"
}
}建立在同行评审研究基础上。
与既有临床量表的初步内部相关性已完成。外部多中心验证正在进行中。
指标 ↔ 临床量表相关性
初步 · 内部验证队列(N = 120)
| Amigo metric | Scale | r | Direction |
|---|---|---|---|
| Composite Score | MoCA | 0.72 | ↑↑ |
| Type-Token Ratio | MMSE | 0.65 | ↑↑ |
| Idea Density | MoCA | 0.68 | ↑↑ |
| Word Finding Score | BNT | 0.71 | ↑↑ |
| Repetition Rate | MMSE | -0.58 | ↑↓ |
| Pause Rate | MoCA | -0.54 | ↑↓ |
| F0 Std (Hz) | GDS | -0.49 | ↑↓ |
| Mood Intensity | GDS | -0.61 | ↑↓ |
| Jitter | UPDRS-III | 0.52 | ↑↑ |
| Speech Rate | MoCA | 0.47 | ↑↑ |
验证方法
- 1
Paired assessment: Subjects completed standard clinical scales (MoCA, MMSE, GDS, BNT) within 48h of Amigo conversation sessions.
- 2
Pearson correlation: Each metric was correlated with the clinically closest scale at subject level, controlling for age and education.
- 3
Longitudinal sensitivity: Change scores over 6 months vs. clinical re-assessment — Amigo composite detected decline 4–8 weeks earlier than quarterly MoCA.
基于已发表研究
- →
Type-Token Ratio decline as MCI marker — Bucks et al., 2000; Forbes-McKay & Venneri, 2005
- →
Idea density predicting AD onset — Snowdon et al. (Nun Study), 1996
- →
Pause patterns and speech rate in cognitive decline — Hoffmann et al., 2010; Roark et al., 2011
- →
F0 and jitter as depression biomarkers — Cummins et al., 2015; Low et al., 2011
- →
Vocal shimmer / HNR in Parkinson's disease — Tsanas et al., 2012; Rusz et al., 2011
- →
Spontaneous speech analysis for dementia screening — Fraser et al., 2016; Luz et al., 2020
正在寻找学术和制药合作伙伴开展多中心验证研究。
这些数据正在被用于哪些场景。
覆盖神经退行性疾病、老年精神医学、临床药物研发和真实世界证据。
阿尔茨海默病与失智症早期检测
用细微语言标志训练模型(TTR 下降、重复增加、信息密度降低),这些信号可能比临床诊断提前数月或数年出现。纵向基线可实现个体内变化检测。
临床试验数字终点
将连续认知快照作为 II–III 期试验的数字终点。周级分辨率相较季度 MMSE 对变化更敏感,患者负担更低,并支持远程监测。
老年抑郁与社交孤立
用于研究抑郁发生、社交孤立和干预效果的纵向情绪轨迹、参与度下降模式和提醒频率数据。
监管真实世界证据
来自真实居家场景的自然、连续数据。适用于 FDA / EMA 上市后监测、标签扩展和真实世界证据包。
语音与声学生物标志物研究
追踪数月内 F0 下降、jitter / shimmer 演变和停顿模式变化。用于抑郁筛查、帕金森病监测和早期认知变化的已验证语音标志。
语音与语言生物标志物验证
将计算语言学和声学特征与既有临床认知量表交叉验证。成对的指标 + 评分数据可支持稳健的多模态生物标志物验证。
为 CNS 试验中最难触达的人群而构建。
语音优先采集去除了限制老年或认知脆弱人群数字终点采集的大部分摩擦。
老年抑郁
在研究中心就诊之间提供每日情绪信号,并进行弱信号提醒。
MCI 与早期阿尔茨海默病
无需重复正式测试即可获得纵向认知标志。
帕金森病与运动障碍
居家场景中的语音特征和依从性报告。
精神分裂症与双相障碍
在临床接触之间提供每日情绪与参与度信号。
疼痛与长新冠
通过自然对话追踪患者报告的症状及其影响。
照护者 / 双人组研究
在适当情况下,从家庭信息提供者并行采集信号。
可嵌入你已经运行的研究技术栈。
纯语音采集
无需可穿戴设备、无需 App、无参与者负担。队列成员只需接电话 — 就这样。
API 优先数据流
按参与者输出时间序列到你的数据湖。可按需兼容 REDCap 和标准 CDISC 映射。
审计级记录
每次通话、转录、评分、提醒和访问事件都有时间戳,不可变并可导出。
监管姿态
符合 HIPAA 控制要求、基于角色的访问、传输与静态存储加密、可提供 BAA、可按需提供 21 CFR Part 11 路线图。
按赞助方和 IRB 已有假设来设计。
根据你的项目灵活提供数据访问。
静态数据集
一次性历史数据导出。适合探索性分析、模型训练和可行性研究。
- Full historical cohort
- CSV / Parquet / JSON
- Data dictionary included
实时数据流
持续 API 访问,每日增量更新。适用于临床监测和适应性试验设计。
- Real-time API access
- Daily incremental updates
- Webhook notifications
- SLA-backed uptime
研究合作
共同设计方案,包含自定义指标、目标队列条件和联合发表权。
- Custom NLP pipelines
- Targeted cohort selection
- Joint publication
- Dedicated data engineer