研究显示:人类阅读与AI语言处理存在关键分歧
导语:为什么读书时有些句子一掠而过,有些却必须重读才能读懂?一项由纽约大学与麻省大学阿默斯特分校完成的新研究,借助大语言模型(LLM)给出部分答案,也揭示了人类与AI语言处理之间的根本分歧。研究团队用AI——具体来说是神经网络大语言模型(LLMs)——发现人类阅读的部分加工过程与AI平行。然而,另一些「我们为何这样阅读」的环节无法被这些技术解释,从而暴露出人类与AI语言处理的分歧,也保留了阅读某些阶段的神秘性。这项发表于《美国国家科学院院刊》(PNAS)的研究显示:在阅读的极早时刻,人类与AI以相似方式处理语言——都依赖「预测下一个词」;但随着阅读推进、文本变复杂(往往需重读),人类的处理方式不同于完全建立在「下一词预测」之上的AI,因此AI无法解释我们如何应对这类段落。研究团队运用眼动追踪技术,分析了368名成年读者的阅读行为,重点考察他们在精心设计的句子(包括被称为「花园路径句」的句法歧义句)上停留与重读每个词的时间,并将其......阅读全文
研究显示:人类阅读与AI语言处理存在关键分歧
导语:为什么读书时有些句子一掠而过,有些却必须重读才能读懂?一项由纽约大学与麻省大学阿默斯特分校完成的新研究,借助大语言模型(LLM)给出部分答案,也揭示了人类与AI语言处理之间的根本分歧。研究团队用AI——具体来说是神经网络大语言模型(LLMs)——发现人类阅读的部分加工过程与AI平行。然而,另一
眼动研究取得重大进展
导语:一项发表于《美国国家科学院院刊》(PNAS)的新研究,让眼动研究取得重大进展——它首次用大规模数据,标出人类阅读与AI语言处理分道扬镳的精确节点。 纽约大学与麻省大学阿默斯特分校的团队,招募368名成年读者,用眼动仪记录他们阅读(及重读)精心设计的句子所花的时间,并把这些眼动数据,与超过40
人类与AI阅读差异难题终于有解了
核心看点:纽约大学与马萨诸塞大学阿默斯特分校的团队,用368名成年读者的眼动数据比对400多个神经网络语言模型,首次清晰揭示人类与AI在阅读加工上的关键分岔点。 为什么书上有些句子一气呵成,有些却要回读才能读懂?由纽约大学(NYU)与马萨诸塞大学阿默斯特分校(UMass Amherst)语言学
阅读认知难题终于有解了
阅读认知难题终于有解了 为什么读书时有些句子我们一气呵成,有些却要反复重读才能读懂?长期以来,语言学界对这一"阅读认知"之谜争论不休。一个主流假说认为,句中的理解困难只是单词"可预测性"(以surprisal量化)影响加工难度的特例;与之相对的理论则将其归因于句子结构构建过程中的错误。由于受试者少、
会“说人话”的AI为何“读不懂人话”
你有没有过这样的阅读体验:有些句子一眼扫过便了然于胸,而另一些句子明明每个字都认得,却非得倒回去再读一遍,才能恍然大悟其含义。这种差异背后,藏着一个关于人类大脑如何处理语言的微妙谜题。美国纽约大学和马萨诸塞大学阿默斯特分校的科学家最近借助人工智能(AI),找到了部分答案,同时也发现,在阅读这件事
大语言模型在线辩论说服力超人类
实验设计示意图。图片来源:英国《自然·人类行为》在线版《自然·人类行为》19日发表的一项人工智能(AI)研究发现,在线辩论中,GPT-4一类的大语言模型(LLM)如能根据对手的个性化信息调整它们的论据,其说服力比人类辩手高出64%。研究结果显示了GPT-4生成有针对性和说服力论据的能力,揭示出AI工
压缩算法为大语言模型“瘦身”
据美国科学促进会旗下网站19日报道,美国普林斯顿大学和斯坦福大学团队开发出一种新压缩算法CALDERA,能精简大型语言模型(LLM)的海量数据,为LLM“瘦身”。这项算法不仅有助保护数据隐私、节约能源、降低成本,还能推动LLM在手机和笔记本电脑上高效使用。团队举例称,当人们使用ChatGPT时,请求
8个小技巧“用好”大语言模型
用大语言模型,还需要技巧?在人们的印象中,这是个极其简单的操作:只需输入一个问题,立刻就能得到回答。但实际上,如何有效地与这些人工智能模型互动,发挥出它们的最大潜力,却是一个经常被忽视的话题。中国科学技术大学心理学系特任研究员林志成关注到这一话题,并在他最近的评论文章中提供了一系列的策略和指导,希望
科研人员提出大语言模型复杂执行路径推理能力分析框架
近日,中国科学院软件研究所等围绕动态类型程序语言中复杂执行路径难以有效分析的问题,分析大语言模型的路径约束推理能力,并构建覆盖测试生成、路径可行性判定和缺陷检测的评测基准。 执行路径由程序从入口到出口依次经过的语句和分支构成,是理解程序语义、生成高覆盖测试和发现特定路径缺陷的基础。传统符号执行
新型AI芯片将大语言模型能耗减半
美国俄勒冈州立大学科研团队研发出一种新型AI芯片,成功将大语言模型的能耗降低50%。这项成果于近期在波士顿举行的IEEE定制集成电路会议上发布,是半导体领域的重大突破,有望成为解决大语言模型高能耗问题的“绿色钥匙”。 当前,以谷歌“双子座”和OpenAI的GPT-4为代表的大语言模型,因海量参
新引擎实现大语言模型推理速度显著提升
原文地址:http://news.sciencenet.cn/htmlnews/2023/11/511841.shtm
日本发布大规模语言模型
科技日报讯 (记者李杨)东京工业大学、日本理化学研究所及富士通公司等近日宣布,利用超级计算机“富岳”,他们开发的大规模语言模型“Fugaku-LLM”正式发布。“Fugaku-LLM”是首个完全由日本国产技术构建的AI语言模型,其在处理日语及相关文化内容上表现卓越。模型特别擅长基于日语敬语进行自然对
AI语言模型“提速”药物发现
原文地址:http://news.sciencenet.cn/htmlnews/2023/6/502762.shtm美国麻省理工学院和塔夫茨大学研究人员设计出一种基于大型语言模型(如ChatGPT)的人工智能算法,这种称为ConPLex的新模型可将目标蛋白与潜在的药物分子相匹配,而无需执行计算分子结
日本发布大规模语言模型
东京工业大学、日本理化学研究所及富士通公司等近日宣布,利用超级计算机“富岳”,他们开发的大规模语言模型“Fugaku-LLM”正式发布。 “Fugaku-LLM”是首个完全由日本国产技术构建的AI语言模型,其在处理日语及相关文化内容上表现卓越。模型特别擅长基于日语敬语进行自然对话,并展现出在人
首个种业大语言模型“丰登”发布
4月28日,中国农业大学生物学院教授王喜庆团队联合上海人工智能实验室、崖州湾国家实验室发布首个种业大语言模型“丰登”(SeedLLM)。种业大语言模型“丰登”。中国农业大学供图“丰登”集成了先进的人工智能技术(书生·浦语2.0)与大数据分析,通过深入学习我国迄今发布的科研文献、科技书籍、种企报告和历
研究:狗懂人语因其与人类处理语言方式类似
数千年来,狗一直是人类最好的朋友。自从石器时代开始,狗就是人类的忠诚伴侣。据英国《每日邮报》26日报道,最近科学家猜想他们已经发现了这种关系的根本原因。那就是一只狗真的可以理解主人的声音。 研究者发现,宠物狗处理语言的方式与人类相似。它们会学着识别人们说的话,也就是一组组的辅音和元音。 但是
人类语言基因让小鼠变“聪明”
美欧研究人员15日发表的一项新研究表明,如果给小鼠引入人类版本的语言基因Foxp2,那么小鼠的学习能力将得到提高。这一成果有助于研究人类语言的出现和进化。 Foxp2语言基因是十多年前在英国一个存在严重语言障碍的家族中首先发现的,缺乏这种基因的人普遍存在学习障碍和语言组织障碍。这种基因并非人类
鲸鱼歌声与人类语言惊人相似
根据《科学进展》发表的一项新研究,鲸鱼的歌声在效率上可以与人类的交流相媲美,在某些情况下甚至更胜一筹。与此同时,《科学》发表的另一项研究,通过对座头鲸歌声的录音,进一步观察了鲸鱼的歌声是否遵循普遍的语言规律。自然选择青睐简洁而非冗长。例如,大喊“躲开!”比大喊“小心,有一枚炮弹来袭,你得闪开!”更快
“AI+教育”,复旦推出大语言模型助力新生报到
8月25日,是复旦大学本科生新生报到的日子。来自全国各地和全球40多个国家的4300余名2024级本科新生,开启了在复旦的求学生涯。新生报道现场。为帮助来自世界各地的新同学尽快融入复旦大学,学校基于大语言模型,推出“复旦迎新助手”智能Agent。作为新生的贴心小帮手,大语言模型为新同学在迎新阶段提供
为何大语言模型越狱漏洞引发整个业界的安全关注?
只需几句巧妙的提示,全球最先进的大语言模型就能被劫持,吐出制造燃烧弹、甲基苯丙胺乃至铀浓缩设施的详细步骤。独立网络安全研究员大卫·库兹玛在一年多时间里发现了七种越狱方法,而多数模型厂商对漏洞披露几乎置若罔闻——这正是整个行业必须正视的安全警钟。一、案例详情:从泰坦尼克到核材料2024 年 10 月,
大脑处理语言,母语最“省事”
多数人只会说一两种语言,而美国华盛顿特区的47岁地毯清洁工Vaughn Smith却精通24国语言。据《科学》报道,在一项新的大脑成像研究中,研究人员仔细观察了像Smith这样多语言者的大脑,以了解其语言特定区域在听到不同语言时的反应。研究人员发现,受试者熟悉的语言引起了他们大脑更强烈的反应。但有一
心理所研究发现不同语言阅读加工的相似机制
眼睛是心灵的窗户,眼球的移动(眼动)可以很好地反映大脑思维过程。人们在执行大部分认知活动时,眼动的轨迹并不是平滑的,而是由不连续的注视(fixation)和眼跳(saccade)组成的。人们只能在注视时获取信息,注视的位置和时间长短均与执行的任务及注视区域的信息有关。通过眼动跟踪技术,可以获得人
神经机器模型能翻译200种语言
科技日报北京6月5日电 (记者张梦然)《自然》5日发表的一篇论文报道了一个Meta人工智能(AI)模型的底层技术。该模型能翻译200种不同语言,增加了机器翻译的语言数量。神经机器翻译模型利用人工神经网络翻译各种语言。这些模型通常需要大量可在线获取的数据加以训练,但并非所有语言数据都是公开、低成本或是
神经机器模型能翻译200种语言
自然》5日发表的一篇论文报道了一个Meta人工智能(AI)模型的底层技术。该模型能翻译200种不同语言,增加了机器翻译的语言数量。神经机器翻译模型利用人工神经网络翻译各种语言。这些模型通常需要大量可在线获取的数据加以训练,但并非所有语言数据都是公开、低成本或是普遍可及的,这类语言被称为低资源语言。一
研究人员研发出抗体语言模型
近日,中国科学院合肥物质科学研究院研发出基于表型感知对比学习的抗体语言模型BCRInsight。该模型通过对海量序列的自监督学习,实现了对复杂免疫信号的深度解码,在抗体结合位点预测和B细胞亚群分析等任务上均达到当前最佳性能。B细胞受体(BCR)免疫库蕴含丰富的生物学信号,决定抗原识别的特异性,记录B
ChatGPT进入课堂:语言模型如何改变教育
最近,教育心理学家罗纳德·贝格托(Ronald Beghetto)以一种引人注目的方式引领一群研究生和教育专业人员,与一系列以创造力为中心的聊天机器人进行了交流。这些聊天机器人由贝格托设计,即将托管在亚利桑那州立大学(ASU)设立的平台上。这些机器人使用与ChatGPT相同的人工智能(AI)技术,目
东北大学研究团队发布TechGPT2.0大语言模型
近日,计算机科学与工程学院任飞亮副教授主持的“东北大学知识图谱研究组”发布了大语言模型TechGPT2.0。 TechGPT-2.0在继承了TechGPT-1.0全部特性的同时,通过增加多领域、多任务的数据,展现出了嵌套实体的抽取、幻觉回答、回答不可回答问题和回答长文本问题的能力。这些改进使得
科研人员利用大语言模型解释调节睡眠的分子机制
华中科技大学生命学院张珞颖团队和薛宇团队在Nature Communications杂志上合作发表了题为“Large-language models facilitate discovery of the molecular signatures regulating sleep and activ
科研人员利用大语言模型解释调节睡眠的分子机制
华中科技大学生命学院张珞颖团队和薛宇团队在Nature Communications杂志上合作发表了题为“Large-language models facilitate discovery of the molecular signatures regulating sleep and activ
东北大学研究团队发布TechGPT2.0大语言模型
近日,计算机科学与工程学院任飞亮副教授主持的“东北大学知识图谱研究组”发布了大语言模型TechGPT2.0。TechGPT-2.0在继承了TechGPT-1.0全部特性的同时,通过增加多领域、多任务的数据,展现出了嵌套实体的抽取、幻觉回答、回答不可回答问题和回答长文本问题的能力。这些改进使得模型更适