人工客服vsAI前台:谁更胜一筹?

人工客服 vs AI前台:谁更胜一筹? 英国南约克郡多家诊所部署的AI语音"前台"系统"Emma"因无法识别当地浓重的约克郡口音,导致不少患者干脆放弃预约、不再就医。这一由当地医疗与社会监督机构Healthwatch Rotherham曝出的事件,在一向被视为AI落地范本的医疗客服场景中,撕开了一道真实的裂缝。 Healthwatch Rotherham的经理Kym Gleeson向BBC坦言:"问题之一在于这套系统并不总是能听懂人们咨询的内容,因为他们的约克郡口音太重了。整个南约克郡的口音差异很大,各种腔调变化多端,系统似乎并不总是能够理解,这让人十分沮丧。"她补充道,不同地区居民的口音差别显著,机器往往措手不及。 挫折感或许还算是轻描淡写。一位患者经由《卫报》向Healthwatch投诉说:"我从来没能让它听懂我说的话。"他表示自己最终"干脆挂断电话,懒得再去试着预约门诊"。当求助渠道本身成了障碍,最容易被甩下的恰恰是那些口......阅读全文

人工客服-vs-AI前台:谁更胜一筹?

人工客服 vs AI前台:谁更胜一筹? 英国南约克郡多家诊所部署的AI语音"前台"系统"Emma"因无法识别当地浓重的约克郡口音,导致不少患者干脆放弃预约、不再就医。这一由当地医疗与社会监督机构Healthwatch Rotherham曝出的事件,在一向被视为AI落地范本的医疗客服场景中,撕开了一道

模拟AI芯片将语音识别能效提升14倍

原文地址:http://news.sciencenet.cn/htmlnews/2023/8/507362.shtm美国IBM研究实验室的科学家报告了一种能效为传统数字计算机芯片14倍的人工智能(AI)模拟芯片。这一芯片在语音识别上的效率超过了通用处理器,该技术或能打破当前AI开发中因对算力性能和效

模拟AI芯片将语音识别能效提升14倍

  美国IBM研究实验室的科学家报告了一种能效为传统数字计算机芯片14倍的人工智能(AI)模拟芯片。这一芯片在语音识别上的效率超过了通用处理器,该技术或能打破当前AI开发中因对算力性能和效率的需求而遇到的瓶颈。相关研究近日发表于《自然》。  随着AI技术的崛起,对能源和资源的需求也随之上升。在语音识

AI大模型“源”炼造客服大脑

  2018年至今,NLP领域经历了非常大的变化,Transformer、ELMO、BERT、GPT-3,再到最近的ChatGPT(GPT 3.5的微调)的突破,NLP在预训练大模型的暴力拆解路上越走越远,这也让各行业开始相信:很多之前无法做到的场景、效果,现在可以有新的解法和落地。  智能客服,是

首个支持30种方言混说语音大模型发布

“唔该查吓电话费吖”“侬帮阿拉查下话费好伐?”中国电信万号智能客服每天接到几百万通电话,其中许多是用方言拨打,尤其是一些老人习惯说方言、只会说方言,智能客服及人工客服都难以理解,沟通效率大打折扣。近日,中国电信人工智能研究院(TeleAI)发布业内首个支持30种方言自由混说的语音识别大模型——星辰超

ZLG深度解析:语音识别技术(一)

语音识别已成为人与机器通过自然语言交互重要方式之一,本文将从语音识别的原理以及语音识别算法的角度出发为大家介绍语音识别的方案及详细设计过程。语言作为人类的一种基本交流方式,在数千年历史中得到持续传承。近年来,语音识别技术的不断成熟,已广泛应用于我们的生活当中。语音识别技术是如何让机器“听懂”

ZLG深度解析:语音识别技术(二)

6、波束形成波束形成是指将一定几何结构排列的麦克风阵列的各个麦克风输出信号,经过处理(如加权、时延、求和等)形成空间指向性的方法,可用于声源定位和混响消除等。波束形成主要分为:固定波束形成、自适应波束形成和后置滤波波束形成等。2语音识别的基本原理已知一段语音信号,处理成声学特征向量之后表示为

ChatGPT将变身AI语音助手?挑战Siri和谷歌语音助手

新品发布在即,奥特曼的最新表态或暗示OpenAI意在人工智能语音助手。当地时间5月11日,人工智能(AI)巨头OpenAI CEO山姆·奥特曼(Sam Altman)在一档播客节目中称,OpenAI将继续改进并提升ChatGPT的语音功能质量,并表示相信语音交互是通向未来交互方式的一个重要途径。奥特

玖富—中科院自动化所联合实验室为何专注于智能语音?

   人工智能在近两年十分火爆,包括金融科技在内的诸多领域都已经开始了相关研发、应用。在2018年初,玖富集团也联合中国科学院自动化研究所成立了智能语音实验室,开启了AI in All”的智能金融年。联合实验室有哪些规划?为何选择智能语音作为研发重点?前不久,联合实验室相关负责人对此做出了回答。

新训练可减少AI系统社会偏见

来自美国俄勒冈州立大学工程学院和Adobe公司的科学家携手,开发出一种用于训练人工智能(AI)的新技术FairDeDup。该技术不仅能降低训练成本,而且有望减少AI系统的社会偏见。研究团队已经在近期于美国西雅图举行的IEEE/CVF计算机视觉和模式识别会议大会上介绍了FairDeDup算法。该会议是

新训练可减少AI系统社会偏见

来自美国俄勒冈州立大学工程学院和Adobe公司的科学家携手,开发出一种用于训练人工智能(AI)的新技术FairDeDup。该技术不仅能降低训练成本,而且有望减少AI系统的社会偏见。研究团队已经在近期于美国西雅图举行的IEEE/CVF计算机视觉和模式识别会议大会上介绍了FairDeDup算法。该会议是

语音识别技术分析:语音变成文字其实没有那么神秘2

  那每帧音素对应哪个状态呢?有个容易想到的办法,看某帧对应哪个状态的概率最大,那这帧就属于哪个状态。比如下面的示意图,这帧对应 S3 状态的概率最大,因此就让这帧属于 S3 状态。  那这些用到的概率从哪里读取呢?有个叫“声学模型”的东西,里面存了一大堆参数,通过这些参数,就可以知道帧和状态对应的

语音识别技术分析:语音变成文字其实没有那么神秘1

  简要给大家介绍一下语音怎么变文字的吧。希望这个介绍能让所有同学看懂。  首先,我们知道声音实际上是一种波。常见的 mp3、wmv 等格式都是压缩格式,必须转成非压缩的纯波形文件来处理,比如 Windows PCM 文件,也就是俗称的 wav 文件。wav 文件里存储的除了一个文件

我国学者实现对类脑语音的识别

记者16日从安徽大学获悉,该校集成电路学院吴秀龙课题组与北京大学杨玉超教授课题组合作,利用动态忆阻器的动力学行为,开发了一种生物学可解释的特征提取单元,用于提取语音事件信号时空特征,并基于此单元成功构建了语音识别硬件系统进行实验验证。相关研究成果日前在线发表于国际学术期刊《科学进展》上。目前,基于深

解析设计ARM语音识别系统的步骤(二)

  2.3 语音组成单元规划  TTS(Text To Speech)文本转语音技能是人机智能对话开展的趋势。依据TTS技能的语音系统无需事前录音就能够随时依据查询条件查出并组成语音进行播报,然后大大减少了系统维护的作业量。利用此技能,经过MCU或许PC机就能操控语音芯片发音。  这篇文章选

我国学者实现对类脑语音的识别

记者16日从安徽大学获悉,该校集成电路学院吴秀龙课题组与北京大学杨玉超教授课题组合作,利用动态忆阻器的动力学行为,开发了一种生物学可解释的特征提取单元,用于提取语音事件信号时空特征,并基于此单元成功构建了语音识别硬件系统进行实验验证。相关研究成果日前在线发表于国际学术期刊《科学‧进展》上。目前,基于

解析设计ARM语音识别系统的步骤(一)

  伴着高新技能在军事范畴的大范围利用,武器装备逐渐向高、精、尖方面开展。传统的军事练习因为练习时刻长、练习费用高、练习空间窄,常常不能到达预期的练习作用,已不能满意现代军事练习的需求。为解决上述问题,模仿练习应运而生。    为进一步提高练习作用,这篇文章利用智能语音交互芯片规划了某模仿练

类器官电子混合计算系统可识别语音

  美国科学家报告了一种由电子硬件和一个大脑类器官组成的混合计算系统,可以执行如语音识别和非线性方程预测等任务。这一研究凸显出一种可能的方法,或可克服现有计算硬件的一些限制。相关研究12月12日发表于《自然—电子学》。  随着人工智能(机器学习和人工神经网络模型)成为关键驱动因素,近年来对算力的需求

腾讯建人工智能实验室-任命顶级专家俞栋为AI-Lab副主任

  近日,腾讯宣布任命语音识别技术顶级专家俞栋为AI Lab(人工智能实验室)副主任,并成立美国西雅图AI实验室。  据新浪科技5月2日消息,俞栋将负责西雅图AI实验室的运营及管理,推动腾讯在语音识别及自然语言理解等AI领域的基础研究。  而在今年3月,腾讯曾宣布任命人工智能领域顶尖科学家张潼担任腾

首届世界声博会开幕-2018科大讯飞全球开发者节同期举行

   10月24日,由中国语音产业联盟、中国智能写作产业联盟主办,科大讯飞股份有限公司(下简称“科大讯飞”)等承办的首届世界声博会在合肥开幕。作为业界首个以语音技术产业链为主题的生态盛会,首届声博会意在为期2天的活动中向世界展示“中国声谷”和语音产业的科技创新成果。  “智能语音技术在人们日常生活中

植入物结合AI将大脑信号转为语音

  荷兰拉德堡德大学和乌得勒支大学科学家成功将人类的大脑信号转化为人们能听得见的语音。借助植入物和人工智能解码来自大脑的信号,他们能够预测用户想说的话,准确率为92%至100%。研究人员希望这项技术能够帮助瘫痪且无法沟通的患者再次“发声”。相关论文发表于最新一期《神经工程杂志》。  拉德堡德大学科研

用AI识别AI:西湖大学研究可检测AI生成文本

虚假新闻、恶意产品评论、剽窃……ChatGPT、 GPT-4等AI大语言模型的应用带来便利,但其误用也带来一系列问题。西湖大学工学院张岳教授的“文本智能实验室”日前发布的一项研究提出一种高准确率、高速、低成本、通用的新文本检测方法——Fast-DetectGPT,无需训练即可识别各种AI大语言模型生

AI同传离成熟还有多远

  9月21日,一篇指责科大讯飞“AI同传造假”的文章引发了社会广泛关注,文中知乎用户、同传译员Bell Wang表示,在日前举行的2018创新与新兴产业发展国际会议上,科大讯飞在现场和直播中展示的“AI同传”,用的其实是自己现场同传翻译的内容。  当晚,科大讯飞在电话会议回应中称:应主办方要求提供

AI同传离成熟还有多远

  9月21日,一篇指责科大讯飞“AI同传造假”的文章引发了社会广泛关注,文中知乎用户、同传译员Bell Wang表示,在日前举行的2018创新与新兴产业发展国际会议上,科大讯飞在现场和直播中展示的“AI同传”,用的其实是自己现场同传翻译的内容。  当晚,科大讯飞在电话会议回应中称:应主办方要求提供

用真正无障碍沟通“温暖”冬奥

“不管是运动员还是观众,只要有这个随身‘翻译官’,就可以随时随地跟其他国家的朋友无障碍沟通。”科大讯飞AI研究院副院长陈志刚拿着讯飞双屏翻译机边演示边介绍,“只要打开双屏,选择对方的语言,按住按键说话就可以了。”    话音刚落,翻译机的屏幕上,几行翻译好的英语“跳”了出来。    科大讯飞

AI如何改变医疗未来?

  众所周知,由于数字革命,数字技术解放了广大医生、护士和研究人员,医护工作者可以将更多的精力放在更高层次的认知任务和患者护理上,而人工智能的使用,势必将此提升到新的水平。图片来源于网络  随着人工智能技术不断进步,它有望在三个关键领域增强人类的思维力量:高级计算、统计分析和假设生成。这三个领域对应

为何AI卡路里识别误差引发关注?

借助人工智能,只需拍一张照片就能估算一顿饭的热量与营养,这种应用正快速普及。它比手动录入每种食物和分量更便捷,但美国国立卫生研究院(NIH)一项新研究提醒:这类照片估算的结果可能明显低于盘中真实数值。在针对四款照片类应用(MyFitnessPal、LoseIt!、CalAI 与 Appediet)的

研究构建超万张人类图像数据库,评估AI视觉偏见

国际知名学术期刊《自然》最新发表一篇人工智能(AI)研究论文,提出并构建了一个超过1万张人类图像的数据库,旨在评估AI模型在以人为本的计算机视觉领域中的偏见。这一“公平的以人类为中心的图像基准”(FHIBE)由索尼AI团队开发,其采用符合伦理手段获取、基于用户同意的数据集,可用于评估以人为中心的计算

回归学术热,大学迎来一个又一个AI界“大牛”

  蚂蚁金服原副总裁、AI团队负责人漆远已于近日离职,出任复旦大学「浩清」教授,复旦人工智能创新与产业研究院院长。将从事深度学习、强化学习等人工智能领域的前沿研究和应用。  那个支付宝背后的AI大牛,重返学术界了!  近日,前蚂蚁金服副总裁、蚂蚁AI首席科学家,蚂蚁金服人工智能部负责人,达摩院金融智

熟悉的声音还能当真吗?AI语音克隆技术引争议

对于音乐行业来说,AI克隆声音生成音乐的影响是巨大的。随着技术进步,在不久的将来,人们可以利用某款软件很容易地将自己的歌声转换为自己最喜欢的歌手的声音。1970年4月,披头士乐队解散,数百万歌迷们伤心不已。50多年后的今天,人工智能(AI)正在将“逝去的记忆”复活,重新创作和重新想象披头士乐队的演唱