人类与AI阅读差异难题终于有解了

核心看点:纽约大学与马萨诸塞大学阿默斯特分校的团队,用368名成年读者的眼动数据比对400多个神经网络语言模型,首次清晰揭示人类与AI在阅读加工上的关键分岔点。 为什么书上有些句子一气呵成,有些却要回读才能读懂?由纽约大学(NYU)与马萨诸塞大学阿默斯特分校(UMass Amherst)语言学家与数据科学家组成的研究团队,在《美国国家科学院院刊》(PNAS)发表研究,给出了部分答案。他们比较了368名成年读者在阅读句法复杂文本(包括"花园路径句")时的眼动数据,与400多个神经网络语言模型的预测。 研究发现人类与AI在阅读的"最初瞬间"方式相似:二者都依赖"预测下一个词"。论文第一作者、NYU 语言学博士生 William Timkey 指出,大语言模型(LLM)能够解释读者在顺畅通读时识别单词所需的时间,却无法捕捉"将某个词整合进句子更大语境"时出现的困难——而这往往伴随回读。他表示:"LLM 大幅低估了我们在阅读困难......阅读全文

人类与AI阅读差异难题终于有解了

核心看点:纽约大学与马萨诸塞大学阿默斯特分校的团队,用368名成年读者的眼动数据比对400多个神经网络语言模型,首次清晰揭示人类与AI在阅读加工上的关键分岔点。 为什么书上有些句子一气呵成,有些却要回读才能读懂?由纽约大学(NYU)与马萨诸塞大学阿默斯特分校(UMass Amherst)语言学

研究显示:人类阅读与AI语言处理存在关键分歧

导语:为什么读书时有些句子一掠而过,有些却必须重读才能读懂?一项由纽约大学与麻省大学阿默斯特分校完成的新研究,借助大语言模型(LLM)给出部分答案,也揭示了人类与AI语言处理之间的根本分歧。研究团队用AI——具体来说是神经网络大语言模型(LLMs)——发现人类阅读的部分加工过程与AI平行。然而,另一

阅读认知难题终于有解了

阅读认知难题终于有解了 为什么读书时有些句子我们一气呵成,有些却要反复重读才能读懂?长期以来,语言学界对这一"阅读认知"之谜争论不休。一个主流假说认为,句中的理解困难只是单词"可预测性"(以surprisal量化)影响加工难度的特例;与之相对的理论则将其归因于句子结构构建过程中的错误。由于受试者少、

眼动研究取得重大进展

导语:一项发表于《美国国家科学院院刊》(PNAS)的新研究,让眼动研究取得重大进展——它首次用大规模数据,标出人类阅读与AI语言处理分道扬镳的精确节点。 纽约大学与麻省大学阿默斯特分校的团队,招募368名成年读者,用眼动仪记录他们阅读(及重读)精心设计的句子所花的时间,并把这些眼动数据,与超过40

会“说人话”的AI为何“读不懂人话”

  你有没有过这样的阅读体验:有些句子一眼扫过便了然于胸,而另一些句子明明每个字都认得,却非得倒回去再读一遍,才能恍然大悟其含义。这种差异背后,藏着一个关于人类大脑如何处理语言的微妙谜题。美国纽约大学和马萨诸塞大学阿默斯特分校的科学家最近借助人工智能(AI),找到了部分答案,同时也发现,在阅读这件事

高风险与低风险儿童眼动差异显著,眼动追踪能否成为儿童抑郁早期筛查工具?

儿童抑郁症长期以来是一个被低估的公共卫生问题。部分原因在于儿童的认知和语言能力尚未充分发展,难以准确描述主观情绪体验;另一部分原因则是儿童期抑郁的临床表现与成人显著不同,常常表现为易激惹、学业退步或社交退缩等形式,不易被家长和教师识别。2026年6月,纽约州立大学宾汉顿分校一项为期两年的纵向研究揭示

科研人员提出大语言模型复杂执行路径推理能力分析框架

  近日,中国科学院软件研究所等围绕动态类型程序语言中复杂执行路径难以有效分析的问题,分析大语言模型的路径约束推理能力,并构建覆盖测试生成、路径可行性判定和缺陷检测的评测基准。  执行路径由程序从入口到出口依次经过的语句和分支构成,是理解程序语义、生成高覆盖测试和发现特定路径缺陷的基础。传统符号执行

压缩算法为大语言模型“瘦身”

据美国科学促进会旗下网站19日报道,美国普林斯顿大学和斯坦福大学团队开发出一种新压缩算法CALDERA,能精简大型语言模型(LLM)的海量数据,为LLM“瘦身”。这项算法不仅有助保护数据隐私、节约能源、降低成本,还能推动LLM在手机和笔记本电脑上高效使用。团队举例称,当人们使用ChatGPT时,请求

心理所研究发现不同语言阅读加工的相似机制

  眼睛是心灵的窗户,眼球的移动(眼动)可以很好地反映大脑思维过程。人们在执行大部分认知活动时,眼动的轨迹并不是平滑的,而是由不连续的注视(fixation)和眼跳(saccade)组成的。人们只能在注视时获取信息,注视的位置和时间长短均与执行的任务及注视区域的信息有关。通过眼动跟踪技术,可以获得人

8个小技巧“用好”大语言模型

用大语言模型,还需要技巧?在人们的印象中,这是个极其简单的操作:只需输入一个问题,立刻就能得到回答。但实际上,如何有效地与这些人工智能模型互动,发挥出它们的最大潜力,却是一个经常被忽视的话题。中国科学技术大学心理学系特任研究员林志成关注到这一话题,并在他最近的评论文章中提供了一系列的策略和指导,希望

阅读过程中首轮平均注视时间的个体差异与这个有关

  眼动(eye movement)是阅读中最重要的行为之一。研究表明,人们在阅读中的眼动存在个体差异,但学界尚不清楚其神经关联。中国科学院行为科学重点实验室研究员李兴珊课题组针对该问题进行了研究,利用眼动追踪和静息态磁共振成像技术,探究个体在篇章阅读中的首轮平均注视时间与个体静息态功能连接间的关联

通用大模型的发展路径与挑战

  当今世界,以大模型为代表的通用人工智能技术在全球范围内扮演着日益重要的角色,对推动全球科技进步和经济发展起到重要的作用。  时代的拷问也随之而至:未来通用大模型的发展路径是什么?如何构建高效、自主的算法算力?如何利用大模型等先进人工智能技术来构建新一代科学研究的新范式?  日前,第二十六届中国科

通用大模型的发展路径与挑战

当今世界,以大模型为代表的通用人工智能技术在全球范围内扮演着日益重要的角色,对推动全球科技进步和经济发展起到重要的作用。时代的拷问也随之而至:未来通用大模型的发展路径是什么?如何构建高效、自主的算法算力?如何利用大模型等先进人工智能技术来构建新一代科学研究的新范式?日前,第二十六届中国科协年会“通用

新型AI芯片将大语言模型能耗减半

  美国俄勒冈州立大学科研团队研发出一种新型AI芯片,成功将大语言模型的能耗降低50%。这项成果于近期在波士顿举行的IEEE定制集成电路会议上发布,是半导体领域的重大突破,有望成为解决大语言模型高能耗问题的“绿色钥匙”。  当前,以谷歌“双子座”和OpenAI的GPT-4为代表的大语言模型,因海量参

新引擎实现大语言模型推理速度显著提升

原文地址:http://news.sciencenet.cn/htmlnews/2023/11/511841.shtm

来了!科大讯飞发布星火认知大模型

原文地址:http://news.sciencenet.cn/htmlnews/2023/5/500078.shtm

讯飞星火认知大模型面向全民开放

原文地址:http://news.sciencenet.cn/htmlnews/2023/9/507872.shtm

大语言模型在线辩论说服力超人类

实验设计示意图。图片来源:英国《自然·人类行为》在线版《自然·人类行为》19日发表的一项人工智能(AI)研究发现,在线辩论中,GPT-4一类的大语言模型(LLM)如能根据对手的个性化信息调整它们的论据,其说服力比人类辩手高出64%。研究结果显示了GPT-4生成有针对性和说服力论据的能力,揭示出AI工

PNAS:小鼠模型需慎用,基因表达差异大

PNAS:小鼠模型需慎用,基因表达差异大  小鼠被广泛用于模拟人类代谢、疾病和药物应答,是医学研究中的一个基本工具。然而斯坦福大学的研究团队指出,人类和小鼠的基因表达存在着惊人的差异,不论是蛋白编码基因还是非编码基因。这项研究发表在十一月十七日的美国国家科学院院刊PNAS杂志上。  Mic

“AI+教育”,复旦推出大语言模型助力新生报到

8月25日,是复旦大学本科生新生报到的日子。来自全国各地和全球40多个国家的4300余名2024级本科新生,开启了在复旦的求学生涯。新生报道现场。为帮助来自世界各地的新同学尽快融入复旦大学,学校基于大语言模型,推出“复旦迎新助手”智能Agent。作为新生的贴心小帮手,大语言模型为新同学在迎新阶段提供

为何大语言模型越狱漏洞引发整个业界的安全关注?

只需几句巧妙的提示,全球最先进的大语言模型就能被劫持,吐出制造燃烧弹、甲基苯丙胺乃至铀浓缩设施的详细步骤。独立网络安全研究员大卫·库兹玛在一年多时间里发现了七种越狱方法,而多数模型厂商对漏洞披露几乎置若罔闻——这正是整个行业必须正视的安全警钟。一、案例详情:从泰坦尼克到核材料2024 年 10 月,

《自然》最新研究:人工智能追踪他人心理状态能力与人类相当

中新网北京5月25日电 (记者 孙自法)人工智能可否追踪他人心理状态?能力如何?施普林格·自然旗下专业学术期刊《自然-人类行为》最新一期发表一篇人工智能研究论文显示,在测试追踪他人心理状态能力(也称心智理论,Theory of Mind)的任务中,两类人工智能大语言模型(LLM)在特定情况下的表现与

大脑阅读中心没有文化差异

  学习阅读中文或许会让那些习惯于拼音文字的西方人感到畏惧,但对以法语和汉语作为母语的人士进行的大脑扫描结果却显示,人们利用相同的大脑区域完成跨越文化的阅读。这项研究成果发表在11月26日出版的美国《国家科学院院刊》上。   主持这项研究的法国Gif-sur-Yvette国立卫生与医学研究院的认知

“紫东太初”全模态大模型开启AGI新路径

原文地址:http://news.sciencenet.cn/htmlnews/2023/5/500126.shtm“‘紫东太初’2.0全模态大模型可融入3D、视频、传感信号等更多模态数据,并优化语音、视频和文本的融合认知及常识计算等功能,进一步突破感知、认知和决策的交互屏障。”5月6日,在华为昇腾

理学里的“读心术”-浙大女科学家20余年解锁大脑决策黑箱

  走进浙江大学神经管理学实验室,脑电帽、眼动仪、近红外设备、远红外成像仪、经颅直流电刺激(tDCS)、沉浸式虚拟现实(VR)系统……这些看似与“管理学”毫不相干的设备陈列其间,仿佛一个科幻电影中的场景。  “我们这里有十余类研究设备,都是用来研究人类决策背后的‘为什么’。”浙江大学求是特聘教授、神

日本发布大规模语言模型

科技日报讯 (记者李杨)东京工业大学、日本理化学研究所及富士通公司等近日宣布,利用超级计算机“富岳”,他们开发的大规模语言模型“Fugaku-LLM”正式发布。“Fugaku-LLM”是首个完全由日本国产技术构建的AI语言模型,其在处理日语及相关文化内容上表现卓越。模型特别擅长基于日语敬语进行自然对

AI语言模型“提速”药物发现

原文地址:http://news.sciencenet.cn/htmlnews/2023/6/502762.shtm美国麻省理工学院和塔夫茨大学研究人员设计出一种基于大型语言模型(如ChatGPT)的人工智能算法,这种称为ConPLex的新模型可将目标蛋白与潜在的药物分子相匹配,而无需执行计算分子结

日本发布大规模语言模型

  东京工业大学、日本理化学研究所及富士通公司等近日宣布,利用超级计算机“富岳”,他们开发的大规模语言模型“Fugaku-LLM”正式发布。  “Fugaku-LLM”是首个完全由日本国产技术构建的AI语言模型,其在处理日语及相关文化内容上表现卓越。模型特别擅长基于日语敬语进行自然对话,并展现出在人

近红外脑成像技术与眼动仪在测试建设工程安全认知程...

近红外脑成像技术与眼动仪在测试建设工程安全认知程度的对比     近期,清华大学建设管理系廖彬超副教授与清华大学心理学张丹副教授的联合研究工作在知名期刊《Safety Science》(Q1区, 影响因子4.105)发表了题为“A multimodal study to measure the

自动化所提出三大“人机交互”新模型

  面对十万个为什么,计算机能否”谦虚谨慎”、准确回答?多轮口语对话中,计算机如何顺利接招,延续话题?顺着说、倒着说,首尾齐发,当突破人类极限时,高质量机器翻译呼之欲出……中国科学院自动化研究所研究者们提出三种“人机交互”新模型:任务型对话中,计算机也有了”自知之明”;人机多轮交互时,进一步强化语境