【刘健医生说心脏】AI,让中风失语患者“开口说话”

当脑血管堵塞或破裂,就会引起脑梗死或者脑出血,这两类急症在医学上合称脑卒中,大众也称之为“中风”。由于大脑受损,患者中风后可能出现语言功能障碍,也就是“失语症”。
失语症患者虽然意识清晰、精神正常,而且发音和构音器官没有病变,但由于脑部病变使其缺乏或丧失理解和语言运用能力,表现为完全不能说话,或者只能讲单字、单词,又或者不能理解,胡言乱语,答非所问。
目前,中风后失语多采取康复训练,但对于完全性失语治疗效果较差。不过,日前在全球顶级医学期刊《自然》(Nature)发表的一项研究[1],为中风失语者带来希望。
这项研究由加州大学旧金山分校神经外科团队完成,目标是帮助由于中风、脑瘫和肌萎缩性脊髓侧索硬化症等疾病而无法说话的人,可以通过人工智能(AI)模拟进行实时对话,并且传达语调、抑扬和喜悦、愤怒等情绪。
这项研究的受试者是48岁的约翰逊女士,她在18年前由于脑干中风瘫痪,完全丧失了语言表达能力。

研究团队为她研发出一种植入式的脑机接口,这种接口通过在脑部植入数十个微型电极,解码大脑产生的电信号,通过AI算法将脑电信号转化为文字和音频语音。在实验中,约翰逊女士只需要在脑海中思考语言,植入电极就可以捕捉到相关语言中枢的活动电信号,并输出为完整流畅的语句。
这已经不是该研究团队的首次尝试,两年前,他们就使用简单的植入物和算法生成了50基本单词,比如“你好”和“饿了”等简单词语,让一位瘫痪的男士在思考语音后,在计算机上以文本形式显示出来。
而在这次研究中,为约翰逊女士植入的电极更多,可以检测来自与口腔、嘴唇、下巴、舌头和喉部相关的感觉和运动过程的大脑信号,在这项研究中,约翰逊女士使用植入装置时,语音合成速率可达到每分钟78个词,更接近正常语速(160词/分钟),而且语音表达也更为准确。
更令人惊喜的是,为了让语音交流更自然,科研团队还创建了一个类似约翰逊本人的数字化身,能够实时模拟她的面部表情,包括下巴张开和闭合、嘴唇撅起和抿紧、舌头上翘和下垂等动作,以及快乐、悲伤和惊讶的面部表情。现在,当约翰逊尝试说话时,数字化身就会呈现动作,并说出她想说的话。

划重点
虽然这里介绍得很简单,但是,从电极植入捕获大脑信号,再应用人工智能深度学习,从这些大脑信号中预测发音、语音和口腔动作,最终将这些预测转化为文本、合成语音和虚拟化身的动作,整个过程都需要很多高精尖的技术支持,在研究过程中,也遇到了很多难题和困境。在研究团队的努力下,才呈现出目前的成果。
这项研究为中风后不能言语的患者提供了重新说话的希望,虽然人机接口技术和AI还存在许多难题,比如植入物可能引发感染、信号解码准确率有待提高、AI数据安全等。但这项技术让我们看到了科技进步的力量,它正在一步步扩展人类自身可以到达的边界,让更多因疾病陷入绝望的人能重拾希望。
