研究揭示言语理解中存在对语音信息的预测
哲学家克拉克提出,“大脑在本质上是一个预测机器”。根据当前情境和言语信息,对将要出现的信息进行预测是人类重要的认知智能。在日常交流中,我们常常遇到一方话音未落,另一方已经猜到对方想要表达什么的情况。无论是日常生活经验抑或实验证据,均表明人们能够对言语信息进行预测。当前,关于言语预测的一个关键研究问题是语言预测内容,即人们能够预测哪些层级的语言信息。目前研究揭示,言语理解中存在对句法、语义信息的预测。但是,关于语音特征能否被预测研究较少且争议较大。 为了考察人们在言语理解中能否预测语音信息,中国科学院行为科学重点实验室李兴珊研究组的青年特聘研究员屈青青及同事在一项最新研究中采用视觉情境眼动范式,以汉语作为研究材料,开展了两项实验研究。汉语可以更好地分离语音与字形信息,以考察更纯净的语音预测效应。 实验一考察了汉语言语理解中的语义和语音预测。实验中,被试听到含有高预测性目标词的句子,例如“要放学了,我把铅笔盒和本子装进了书包......阅读全文
研究揭示言语理解中存在对语音信息的预测
哲学家克拉克提出,“大脑在本质上是一个预测机器”。根据当前情境和言语信息,对将要出现的信息进行预测是人类重要的认知智能。在日常交流中,我们常常遇到一方话音未落,另一方已经猜到对方想要表达什么的情况。无论是日常生活经验抑或实验证据,均表明人们能够对言语信息进行预测。当前,关于言语预测的一个关键研究
心理所揭示言语工作记忆对语言预测的调节作用
近年来,认知科学家阿尼尔·塞斯(Anil Seth)提出了“我预测故我在”的新观念。预测编码(Predictive Coding)模型认为,人类大脑持续地对即将到来的信息进行预测,并将预测信息与实际的感官输入进行对比。这种预测机制深植于日常行为和认知过程中。无论是走路、说话,还是理解他人的语言、情绪
首个支持30种方言混说语音大模型发布
“唔该查吓电话费吖”“侬帮阿拉查下话费好伐?”中国电信万号智能客服每天接到几百万通电话,其中许多是用方言拨打,尤其是一些老人习惯说方言、只会说方言,智能客服及人工客服都难以理解,沟通效率大打折扣。近日,中国电信人工智能研究院(TeleAI)发布业内首个支持30种方言自由混说的语音识别大模型——星辰超
俄罗斯研究团队首次找到自闭症患者言语障碍原因
莫斯科国立心理与教育大学在世界上首次发现了与大脑听觉皮层工作有关的自闭症患者言语障碍的原因。这些发现正在深刻改变对自闭症障碍机理的理解,并可能成为新的康复方法的基础。相关研究结果近日发表在Molecular Autism杂志上。 莫斯科国立心理与教育大学研究人员指出,自闭症患者言语迟缓的主要原
语音报警验电器
描述伸缩型语音报警验电器主要技术指标产品规格:10KV、35KV、110KV、220KV、500KV注:可根据用户需求定做。序号项目验电器类别参数10KV35KV110KV220KV500KV1缩态长度mm38048058078016002伸态长度mm100015002000310072003有效绝
心理所发现工作记忆容量影响语言理解中的预测加工
日常交流中,人们经常会预测对方即将说出的内容。例如,你的朋友跟你说“我刚从青岛回来,在海边捡了很多……”,可能还没说完,你就已经根据“青岛”“海边”等概念预测到即将说出的是“贝壳”。这种语义信息的预先激活(语义预测加工)是人脑能够实现高效语言理解的重要原因之一。那么,在语言理解过程中,人脑是如何
ChatGPT将变身AI语音助手?挑战Siri和谷歌语音助手
新品发布在即,奥特曼的最新表态或暗示OpenAI意在人工智能语音助手。当地时间5月11日,人工智能(AI)巨头OpenAI CEO山姆·奥特曼(Sam Altman)在一档播客节目中称,OpenAI将继续改进并提升ChatGPT的语音功能质量,并表示相信语音交互是通向未来交互方式的一个重要途径。奥特
莫言语录与地沟油分析
知名作家莫言和王安忆是令人仰视的人物,他们的作品看过多篇,莫言多次获文学大奖。王安忆贵为十年上海作协主席。最近看到他们的一些话,就写了此篇博客。 一、在2011年9月12日出版的2011年34期《中国新闻周刊》第22页《速读》上,莫言有如下一段话及评论: “作品
将音乐作为爱好,让大脑保持年轻
原文地址:http://news.sciencenet.cn/htmlnews/2023/4/499550.shtm长期专业的音乐训练,可以让处于衰老的大脑保持年轻,这可不是异想天开。4月26日,中国科学院心理研究所(以下简称心理所)研究员杜忆团队的研究成果登上了《科学进展》(Science Adv
相关脑区到感觉运动皮层地标的距离预测语言理解功能
大脑皮层的脑区按照功能可分为两类:视觉、听觉、感觉运动皮层(主要加工外界的单通道信息,如视觉、听觉)和联合皮层(主要整合多通道信息,支持记忆功能)。认知神经科学的核心问题之一是:大脑的拓扑特征是否能够解释这两类脑区功能的差异化? 为了回答这一问题,中国科学院心理研究所行为科学院重点实验室杜忆研
脑植入物让失语者“说”出所想
据6日发表在《自然·通讯》上的一项研究,美国杜克大学研究团队开发出一种语言假体,可将人的大脑信号转化为他们想要说的话。这项新技术相对于当前速度较慢的通信辅助工具来说是一个重大进步,未来或能帮助因神经系统疾病而无法说话的人,让他们通过脑机接口重新获得交流的能力。 目前可用的最佳语音解码速率约为每
语音识别技术分析:语音变成文字其实没有那么神秘2
那每帧音素对应哪个状态呢?有个容易想到的办法,看某帧对应哪个状态的概率最大,那这帧就属于哪个状态。比如下面的示意图,这帧对应 S3 状态的概率最大,因此就让这帧属于 S3 状态。 那这些用到的概率从哪里读取呢?有个叫“声学模型”的东西,里面存了一大堆参数,通过这些参数,就可以知道帧和状态对应的
语音识别技术分析:语音变成文字其实没有那么神秘1
简要给大家介绍一下语音怎么变文字的吧。希望这个介绍能让所有同学看懂。 首先,我们知道声音实际上是一种波。常见的 mp3、wmv 等格式都是压缩格式,必须转成非压缩的纯波形文件来处理,比如 Windows PCM 文件,也就是俗称的 wav 文件。wav 文件里存储的除了一个文件
脑机接口新技术让渐冻症患者重新“说话”
美国加州大学戴维斯分校健康中心开发出一款新型脑机接口(BCI),可将脑信号转化为语音,准确率高达97%,是目前同类系统中最高的。该团队在一名因肌萎缩侧索硬化症(ALS,俗称渐冻症)而语言能力严重受损的男子大脑中植入了传感器。启动该系统后,该男子在几分钟内就能说出自己想要说的话。相关研究15日发表在《
延缓脑衰老,音乐有妙招
不管是什么年纪,如果能尽快开始学习一门乐器,甚至开始唱歌,可能都会让大脑衰老得更慢。所以我们鼓励中老年朋友学习一门乐器或声乐,什么时候开始都不算晚。一些研究表明,从未学过音乐的老年人在接受短期音乐训练后,言语加工能力也有一定的提高。杜忆中国科学院心理研究所研究员大脑是人体中最先开始衰老的器官之一,大
脑机接口新技术让渐冻症患者重新“说话”
科技日报北京8月15日电 (记者张梦然)美国加州大学戴维斯分校健康中心开发出一款新型脑机接口(BCI),可将脑信号转化为语音,准确率高达97%,是目前同类系统中最高的。该团队在一名因肌萎缩侧索硬化症(ALS,俗称渐冻症)而语言能力严重受损的男子大脑中植入了传感器。启动该系统后,该男子在几分钟内就能说
当心陷入深度伪造语音陷阱
原文地址:http://news.sciencenet.cn/htmlnews/2023/8/505961.shtm
植入物结合AI将大脑信号转为语音
荷兰拉德堡德大学和乌得勒支大学科学家成功将人类的大脑信号转化为人们能听得见的语音。借助植入物和人工智能解码来自大脑的信号,他们能够预测用户想说的话,准确率为92%至100%。研究人员希望这项技术能够帮助瘫痪且无法沟通的患者再次“发声”。相关论文发表于最新一期《神经工程杂志》。 拉德堡德大学科研
新设备可将大脑信号直接转换为语音
据美国每日科学网站近日报道,有史以来第一次,美国科学家研制出的一套新系统,借助语音合成器和人工智能,通过监控某人的大脑活动,将其想法直接转化成了可理解、可识别的语音。研究人员称,最新研究为那些言语能力有限或无法说话的人重新获得与外界沟通的能力奠定了基础,也有望为计算机直接与大脑通信开辟新途径。
BMJ-open:言语与情感的交流能够增强性欲
根据最近发表在《BMJ open》杂志上的一篇文章,英国的女性相比男性更加容易出现性冷淡的现象(风险高达两倍之多)。此外,处对象一年以上的女性相比刚刚找到对象的女人来说出现性冷淡的现象则更为普遍。 这项研究是由来自伦敦学院大学的研究者们做出的。他们调查了16岁到74岁之间的6669名女性与43
无需言语-读人所想:神经假体解码大脑活动
英国《自然·通讯》杂志8日报告一项神经科学最新研究,美国加利福尼亚州立大学团队开发了一种新设备,能够在一名失语瘫痪患者无声地尝试拼读出词汇时,解码被试者的脑活动构成完整句子。这些发现凸显出无声控制的语言神经假体通过基于拼读的方法生成句子的潜力。 神经假体是一种替代缺失神经系统功能的设备,有望为因
ZLG深度解析:语音识别技术(一)
语音识别已成为人与机器通过自然语言交互重要方式之一,本文将从语音识别的原理以及语音识别算法的角度出发为大家介绍语音识别的方案及详细设计过程。语言作为人类的一种基本交流方式,在数千年历史中得到持续传承。近年来,语音识别技术的不断成熟,已广泛应用于我们的生活当中。语音识别技术是如何让机器“听懂”
ZLG深度解析:语音识别技术(二)
6、波束形成波束形成是指将一定几何结构排列的麦克风阵列的各个麦克风输出信号,经过处理(如加权、时延、求和等)形成空间指向性的方法,可用于声源定位和混响消除等。波束形成主要分为:固定波束形成、自适应波束形成和后置滤波波束形成等。2语音识别的基本原理已知一段语音信号,处理成声学特征向量之后表示为
高压语音核相仪的特点
高压语音核相仪主要应用于电力线路、变电所的相位校验和相序校验,具有核相、测相序、验电等功能,具备很强的抗干扰性,符合(EMC)标准要求,适应各种电磁场干扰场合。 将被测高电压相位信号由采集器取出,经过处理后直接发射出去,由核相仪接收并进行相位比较,由核相后的结果定性。 因本产品
OpenAI发布语音模型GPTrealtime
8月28日,美国人工智能公司OpenAI发布了其所谓“最先进的语音到语音模型”GPT-realtime,以及配套的Realtime API(实时应用程序接口)。据OpenAI公司介绍,该模型在理解复杂指令、精准调用工具以及生成自然、富有表现力的语音方面表现突出,并在客户服务、教育、个人助理等多种场景
量子场论预测结果首获实验证实,为研究和理解量子纠缠打开大门
纠缠是一种量子现象,其中两个或多个粒子的属性以某种方式相互关联,人们无法单独描述单个粒子的性质,只能描述整体系统的性质。粒子的纠缠最终决定了材料的性质,但人们却很难理解“纠缠”。据最新一期《自然》杂志报道,奥地利因斯布鲁克大学和奥地利科学院量子光学和量子信息研究所研究人员开创了一种新方法,首次通
一例突发右侧肢体无力伴言语不清病例分析
临床资料患者男性,30岁,技术人员,因“突发右侧肢体无力5h余”入院。患者2016年6月10日19:30时聊天时突发右侧肢体无力伴言语不清(白天有跳绳活动),右侧上肢不能抬举,右侧下肢不能站立,无肢体抽搐,无恶心呕吐,于2016年6月11日凌晨0:40时来我院急诊,头颅CT未见异常(图1A),以“急
头晕伴言语不利12小时入院诊治病例分析
【一般资料】患者,女,69岁,农民【主诉】主因头晕伴言语不利12小时入院【现病史】患者于入院前12小时无明显诱因出现言语不利伴有头晕症状,头晕时自感天旋地转,不能睁眼;未诉头痛症状,无肢体功能障碍,无恶心呕吐,无流涎等症状,当地未给予特殊处理,2018-05-05就诊于我院J诊查头颅CT示:脑千腔隙
讯飞星火正式发布语音大模型
“听说今年尔滨特别火,作为南方小土豆还挺想去玩一下的。要不你用东北话介绍下有啥好玩的呗?” 1月30日,科大讯飞举行星火认知大模型V3.5升级发布会。科大讯飞董事长刘庆峰、研究院院长刘聪发布基于首个全国产算力训练的讯飞星火V3.5。在实操演示环节,刘聪和讯飞星火V3.5现场互动,后者一口地道的