# 双语 AI 听力学专家在盲测模拟研究中胜过人类专家

> 研究团队报告称，他们基于大语言模型和规则手册构建的 AI 系统，在英语和中文的 58 个模拟病例中，表现优于 17 名执业听力学专家。

Oossa · 2026-09-29 · https://oossa.com/zh/bilingual-ai-audiologist-beats-human-experts-in-blind-simulation-study

研究人员于 2026 年 9 月 29 日发布论文，介绍一款接受真实医生对照测试的 AI 听力学专家系统。测试采用模拟患者系统，共包含 58 个病例——中文 30 个、英文 28 个。在每一个病例中，AI 得分都更高，胜过参与盲测对比的全部 17 名人类听力学专家。

## AI 系统如何构建

该系统以通用大语言模型为基础——这类 AI 正是 ChatGPT 背后的技术——但没有对模型进行微调。研究团队为模型提供了一份包含 21 项内容的检查清单（评分标准），并根据 73 个既往听力学病例（英文 43 个、中文 30 个）总结出 19 条决策规则（即“操作手册”）。AI 还能读取听力图——医生用来展示听力损失情况的图表——并在需要时调用外部医学知识。消融测试显示，操作手册对提升系统表现的贡献最大。

## 这对患者意味着什么

如果这种方法能从模拟测试走向实际应用，即使在听力学专家短缺的地方，诊所也有望提供快捷的双语听力评估。AI 或许可以处理问诊中的常规环节，让医生把精力集中在复杂决策和与患者交流上。

## 事实

- 该 AI 系统在 58 个模拟病例中接受评估（中文 30 个、英文 28 个）。
- 在所有病例中，该系统的表现均优于 17 名执业听力学专家，得分为 58/58。
- 在满分 5 分的综合评分中，平均得分优势为 +1.35 分；Cohen’s d = 1.84（p = 4.5 × 10⁻²⁰）。
- 该系统使用了一份 21 项评分标准和一套 19 条规则的操作手册，内容根据 73 个训练病例（英文 43 个、中文 30 个）整理而成。
- 论文于 2026 年 9 月 26 日提交至 arXiv，并于 2026 年 9 月 29 日公开发布。

## 为什么重要

对大多数人来说，这表明 AI 能够可靠地处理英语和中文中的基础听力测试任务，有望加快人们获得相关医疗服务的速度。它不能取代医生，但可以让专家腾出更多时间处理最复杂的病例，并与患者进行个性化沟通。

## 来源与参考

1. [A bilingual AI audiologist built through rubric-guided playbook induction outperforms human audiologists in a blinded evaluation of simulated cases](https://arxiv.org/abs/2609.32220) – arXiv, 2026-09-29

最后更新: 2026-09-29
