在日常生活中,当我们在嘈杂的环境中听不清对方说话时,往往会不自觉地盯着对方的嘴唇,试图通过口型来补全丢失的信息。这种被称为“读唇”的技能,似乎人人都具备一些,但背后的视觉机制一直让科学家充满好奇。一项发表于《自然·通讯》的最新研究首次系统揭示了人们在读唇时大脑与眼睛究竟是如何协作的——答案不仅关乎嘴唇,更关乎整张脸的“动态地图”。

看不见的“读唇秘密”

长期以来,学界普遍认为读唇的核心在于观察嘴唇的形状、开合与舌位变化。然而,耶鲁大学与马克斯·普朗克研究所联合团队通过高精度眼动追踪与功能性磁共振成像技术,对32名听力正常志愿者进行了实验。他们让志愿者在无声视频中观看不同说话者的面部,并尝试理解句子内容。结果出人意料:当人们努力读唇时,眼睛的注视点并非固定在嘴唇上,而是呈现一种“扇形扫描”模式——视线先在嘴唇、鼻尖、脸颊和眼睛之间快速跳动,最终稳定在一个被称为“口周区域”的椭圆形范围内,覆盖了嘴唇、下巴、面颊下部甚至部分颈部。

“我们原本以为嘴唇是唯一焦点,但数据显示,唇读依赖的是一个‘动态面部地图’。”研究第一作者、神经科学家艾玛·洛佩兹在接受采访时表示,“大脑同时整合了嘴唇运动与周围肌肉、皮肤褶皱的同步变化,甚至包括说话时下巴的轻微位移。”

大脑的“超整合”系统

更令人惊讶的是,研究还发现读唇过程中大脑并非被动接收视觉信息,而是主动“预测”发音。通过脑成像扫描,科学家观察到当志愿者注视说话者面部时,大脑的“布罗卡区”——主要负责语言产生的区域——被显著激活。这意味着人们在读唇时,大脑会模拟自己发出相应声音的动作,从而帮助理解。换句话说,读唇不仅是“看”,更是一种“无声的内心模仿”。

实验还对比了不同背景的受试者:那些日常依赖唇读的听力障碍者与正常听力者在视觉策略上存在明显差异。听障人士的注视点更密集地集中在嘴唇中央,且扫描频率降低,但准确率反而更高。研究人员推测,长期训练使他们的视觉系统发展出了更高效的“唇读捷径”。

从实验室到现实应用

这一发现对多个领域具有直接启示。在人工智能领域,现有唇语识别系统大多仅提取唇部特征,准确率往往受限于光照、角度等因素。新研究提示,将面部其他区域(如下巴运动、鼻翼扩张)纳入特征库,可能大幅提升识别鲁棒性。此外,在语言康复训练中,治疗师可以引导患者关注更广的面部区域,而非只盯嘴唇,从而加快听力障碍儿童的口语习得速度。

伦敦大学学院的言语科学教授大卫·霍华德评价称:“这项研究打破了‘唇读=读嘴唇’的陈旧认知。它告诉我们,交流从来不是单一感官的事,即使失去声音,面部依然是一个充满信息的多维窗口。”

未来展望

当然,研究也留下了一些未解之谜。例如,当说话者戴口罩时,人们是否会自动调整读唇策略?那些天生视觉优势较强的人,是否更容易通过短期训练成为唇读高手?洛佩兹团队计划下一步探索不同文化背景下的读唇差异,因为不同语言的口型模式可能塑造不同的视觉注意习惯。

对于普通人而言,这项研究或许带来了一点生活小启发:下次在嘈杂的酒吧或地铁里,不妨有意识地把视线从对方的嘴唇稍稍扩大——看看他的下巴、脸颊甚至眉毛,大脑或许能捕捉到更多声音之外的“无声对话”。毕竟,我们看见的从来不只是嘴,而是整个人在讲述。