研究显示:AI模型在经典注意力测试中崩溃

核心数据:GPT-4o在处理五个词的列表时准确率达91%,十个词时降至57%,四十个词时仅为15%。Claude 3.5 Sonnet在二十个词前保持稳定,四十个词时陡降至24%。这表明当前AI模型在维持注意力方面存在根本性缺陷。 研究者让多个领先AI模型完成了经典的Stroop任务——一种已被用了数十年的心理学实验。在测试中,颜色词(如“红色”“蓝色”)以不同颜色的墨水显示,参与者需要说出墨水的颜色而不是读出词语本身。这看似简单,但实际上要求大脑抑制自动阅读的习惯,专注于识别墨水颜色。 当匹配和不匹配的颜色词出现在同一列表中时,挑战变得更加严峻。在这些条件下,不匹配项目的准确率降至接近零。AI模型无法始终如一地维持识别墨水颜色的指令,而是越来越倾向于直接读取单词本身。 这一发现特别引人关注,因为人类也面临类似的冲突。人们读词能力远强于识别墨水颜色的能力,但即便有这种偏差,大多数人仍能在长列表中保持高准确率和稳定表现。 ......阅读全文

新型AI芯片将大语言模型能耗减半

  美国俄勒冈州立大学科研团队研发出一种新型AI芯片,成功将大语言模型的能耗降低50%。这项成果于近期在波士顿举行的IEEE定制集成电路会议上发布,是半导体领域的重大突破,有望成为解决大语言模型高能耗问题的“绿色钥匙”。  当前,以谷歌“双子座”和OpenAI的GPT-4为代表的大语言模型,因海量参

AI语言模型“提速”药物发现

原文地址:http://news.sciencenet.cn/htmlnews/2023/6/502762.shtm美国麻省理工学院和塔夫茨大学研究人员设计出一种基于大型语言模型(如ChatGPT)的人工智能算法,这种称为ConPLex的新模型可将目标蛋白与潜在的药物分子相匹配,而无需执行计算分子结

“AI+教育”,复旦推出大语言模型助力新生报到

8月25日,是复旦大学本科生新生报到的日子。来自全国各地和全球40多个国家的4300余名2024级本科新生,开启了在复旦的求学生涯。新生报道现场。为帮助来自世界各地的新同学尽快融入复旦大学,学校基于大语言模型,推出“复旦迎新助手”智能Agent。作为新生的贴心小帮手,大语言模型为新同学在迎新阶段提供

研究显示:AI模型在经典注意力测试中崩溃

核心数据:GPT-4o在处理五个词的列表时准确率达91%,十个词时降至57%,四十个词时仅为15%。Claude 3.5 Sonnet在二十个词前保持稳定,四十个词时陡降至24%。这表明当前AI模型在维持注意力方面存在根本性缺陷。 研究者让多个领先AI模型完成了经典的Stroop任务——一种已被

压缩算法为大语言模型“瘦身”

据美国科学促进会旗下网站19日报道,美国普林斯顿大学和斯坦福大学团队开发出一种新压缩算法CALDERA,能精简大型语言模型(LLM)的海量数据,为LLM“瘦身”。这项算法不仅有助保护数据隐私、节约能源、降低成本,还能推动LLM在手机和笔记本电脑上高效使用。团队举例称,当人们使用ChatGPT时,请求

8个小技巧“用好”大语言模型

用大语言模型,还需要技巧?在人们的印象中,这是个极其简单的操作:只需输入一个问题,立刻就能得到回答。但实际上,如何有效地与这些人工智能模型互动,发挥出它们的最大潜力,却是一个经常被忽视的话题。中国科学技术大学心理学系特任研究员林志成关注到这一话题,并在他最近的评论文章中提供了一系列的策略和指导,希望

AI大模型“拿捏”电池寿命

作为现代生活中不可或缺的能源载体,电池的重要性不言而喻。从清晨唤醒我们的闹钟,到随身携带的手机、平板电脑等智能设备,无一不依赖于电池提供的稳定电力。此外,随着科技的发展,电动汽车、无人机等新兴领域也广泛应用了各类高性能电池,推动了绿色出行和智能科技的进步。因此,电池不仅极大地便利了我们的日常生活,还

生成式AI可训练机器人执行多种任务

铲子,刀子,锤子,扳手3个不同的数据集:模拟(上)、机器人远程操作(中)和人类演示(下)让机器人能学习使用不同的工具。图片来源:麻省理工学院科技日报北京6月23日电 (记者张梦然)据美国麻省理工学院官网近日报道,该机构研究人员为了训练更先进的多用途机器人,开发出一种技术:使用一种称为扩散模型的生成式

释放AI大模型促消费潜力

  今年的《政府工作报告》提出持续推进“人工智能+”行动,旨在抓住人工智能技术突破机遇,使我国数字技术与制造优势、市场规模优势充分结合,推动人工智能大模型广泛应用,真正赋能千行百业、走进千家万户。在构建新发展格局战略背景下,AI大模型在激活内需市场、促进消费升级等方面充满“模”力。  随着人工智能技

新引擎实现大语言模型推理速度显著提升

原文地址:http://news.sciencenet.cn/htmlnews/2023/11/511841.shtm

新AI模型可预测系列任务中人类的决定

近日,一项发表于《自然》的研究报道了创新人工智能(AI)系统——Centaur。它可以预测人们在各种情况下做出的决定,并且优于利用心理学经典理论所做的推测。不同于谷歌Deepmind的AlphaGo等只能预测一个人就单一任务做出选择的AI系统,Centaur可以模拟一系列任务中人类的行为,包括赌博、

厦大尝试AI大模型破译甲骨文

近日,厦门大学信息学院自然语言处理实验室教授史晓东团队申报的“基于甲骨文多模态大模型的多元信息甲骨文辅助考释模型”入选“探元计划2024”“创新探索型项目”TOP10榜单。基于甲骨文多模态大模型的多元信息甲骨文辅助考释模型。厦门大学供图甲骨文也被称作“殷墟文字”,距今已有三千多年历史,是世界四大古文

AI大模型“源”炼造客服大脑

  2018年至今,NLP领域经历了非常大的变化,Transformer、ELMO、BERT、GPT-3,再到最近的ChatGPT(GPT 3.5的微调)的突破,NLP在预训练大模型的暴力拆解路上越走越远,这也让各行业开始相信:很多之前无法做到的场景、效果,现在可以有新的解法和落地。  智能客服,是

AI大模型走出“泡沫期”未来何如

  今年3月ChatGPT-4上线以来,国内科技龙头企业密集推出人工智能大模型,百度“文心一言”、阿里云“通义千问”、华为“盘古”、360“智脑”、昆仑万维“天工”、京东“灵犀”、科大讯飞“星火”、腾讯“混元”、商汤“日日新”等大模型先后登场,呈现百花齐放、迅猛发展的态势。截至2023年10月初,国

华为发布大模型时代AI存储新品

原文地址:http://news.sciencenet.cn/htmlnews/2023/7/504751.shtm

大语言模型在线辩论说服力超人类

实验设计示意图。图片来源:英国《自然·人类行为》在线版《自然·人类行为》19日发表的一项人工智能(AI)研究发现,在线辩论中,GPT-4一类的大语言模型(LLM)如能根据对手的个性化信息调整它们的论据,其说服力比人类辩手高出64%。研究结果显示了GPT-4生成有针对性和说服力论据的能力,揭示出AI工

设计基因编辑工具的AI大模型问世

  记者27日从中国农业科学院获悉,该院农业基因组研究所农业基因编辑技术研发与应用创新团队构建了全球规模最大的实验验证数据集,并基于此开发出人工智能(AI)大模型AlphaCD。该模型不仅能高效预测超过2万余种胞嘧啶脱氨酶的酶活特征,还能设计出新型高性能碱基编辑工具。相关成果日前发表于国际期刊《细胞

日本发布大规模语言模型

  东京工业大学、日本理化学研究所及富士通公司等近日宣布,利用超级计算机“富岳”,他们开发的大规模语言模型“Fugaku-LLM”正式发布。  “Fugaku-LLM”是首个完全由日本国产技术构建的AI语言模型,其在处理日语及相关文化内容上表现卓越。模型特别擅长基于日语敬语进行自然对话,并展现出在人

日本发布大规模语言模型

科技日报讯 (记者李杨)东京工业大学、日本理化学研究所及富士通公司等近日宣布,利用超级计算机“富岳”,他们开发的大规模语言模型“Fugaku-LLM”正式发布。“Fugaku-LLM”是首个完全由日本国产技术构建的AI语言模型,其在处理日语及相关文化内容上表现卓越。模型特别擅长基于日语敬语进行自然对

两个人工智能系统说起“悄悄话”

原文地址:http://news.sciencenet.cn/htmlnews/2024/3/519675.shtm 两个AI系统实现相互对话,预示着AI系统将像人类一样进行互动交流。图片来源:slguardian.org瑞士日内瓦大学的一个科学家团队在人工智能(AI)研究方面取得一项突破:

提高大语言模型可信度,新方法助生成式AI破除“幻觉”

人工智能(AI)在给出准确答案的同时,也会有一些“胡乱输出”令人难辨真假,这被称为“幻觉”(hallucination)。而新一期《自然》杂志发表的一项研究报道了一种新方法,能检测大语言模型(LLM)产生的“幻觉”,即该方法能测量生成回答的含义的不确定性,或能提升LLM输出答案的可靠性。类似Chat

东北大学研究团队发布TechGPT2.0大语言模型

近日,计算机科学与工程学院任飞亮副教授主持的“东北大学知识图谱研究组”发布了大语言模型TechGPT2.0。TechGPT-2.0在继承了TechGPT-1.0全部特性的同时,通过增加多领域、多任务的数据,展现出了嵌套实体的抽取、幻觉回答、回答不可回答问题和回答长文本问题的能力。这些改进使得模型更适

科研人员利用大语言模型解释调节睡眠的分子机制

华中科技大学生命学院张珞颖团队和薛宇团队在Nature Communications杂志上合作发表了题为“Large-language models facilitate discovery of the molecular signatures regulating sleep and activ

东北大学研究团队发布TechGPT2.0大语言模型

  近日,计算机科学与工程学院任飞亮副教授主持的“东北大学知识图谱研究组”发布了大语言模型TechGPT2.0。  TechGPT-2.0在继承了TechGPT-1.0全部特性的同时,通过增加多领域、多任务的数据,展现出了嵌套实体的抽取、幻觉回答、回答不可回答问题和回答长文本问题的能力。这些改进使得

科研人员利用大语言模型解释调节睡眠的分子机制

华中科技大学生命学院张珞颖团队和薛宇团队在Nature Communications杂志上合作发表了题为“Large-language models facilitate discovery of the molecular signatures regulating sleep and activ

一年零一月,文心大模型进化成AI创造“底牌”

“未来,自然语言将成为新的通用编程语言。”4月16日,Create 2024百度AI开发者大会在深圳举行。百度公司董事长兼首席执行官李彦宏作“人人都是开发者”的主题演讲,并带来了“开箱即用”的三大AI开发工具——智能体开发工具AgentBuilder、AI原生应用开发工具AppBuilder、各种尺

顶流AI大模型集结中关村科学城

  6月14日上午,2024北京智源大会在中关村国家自主创新示范区展示中心开幕,大会现场具身智能机器人Galbot和国内主流大模型展览区备受关注。  在展览区,记者看到银河通用首代具身智能机器人Galbot正忙着为嘉宾“送吃送喝”。收到指令后,Galbot自主导航到货架,通过“视觉”锁定货架上的目标

刘聪:中国AI大模型也要走“直道冲锋”之路

原文地址:http://news.sciencenet.cn/htmlnews/2023/4/498384.shtm

阿里云推出首个域名AI大模型应用

8月8日,在阿里云万网焕新发布会上,阿里云宣布域名产品服务完成AI化系列改造,推出首个基于通义大模型的域名AI应用,并上线“.ai”等40余个全新的热门域名后缀、2000万个全球域名资源。域名是网站的地址,它就像现实生活中的门牌号,是互联网稳定运行和持续发展的关键基础资源。数据显示,中国域名保有量3

顶流AI大模型集结中关村科学城

  6月14日上午,2024北京智源大会在中关村国家自主创新示范区展示中心开幕,大会现场具身智能机器人Galbot和国内主流大模型展览区备受关注。  在展览区,记者看到银河通用首代具身智能机器人Galbot正忙着为嘉宾“送吃送喝”。收到指令后,Galbot自主导航到货架,通过“视觉”锁定货架上的目标