研究显示:大推理模型的“思维链”效果存疑
大型推理模型(LRM)到底是在“推理”,还是仅仅给出了正确答案却说错了理由?2025年,东北大学和加州大学伯克利分校的团队对前沿开源LRM的研究显示,模型在基准数学题上产生的“思考步骤”中,有 30%到60% 对最终答案“几乎无因果影响”——砍掉一半,性能几乎不掉。作者魏彦诗(Weiyan Shi)提醒:审视思维链时要小心,它们未必与输出挂钩。 更早的线索来自纽约大学2024年的论文:用一串无意义的“点”充当思维链,效果竟与可读的自然语言相当。亚利桑那州立大学的苏巴拉奥·坎布汉帕蒂(Subbarao Kambhampati)把中间文本称为“喃喃自语”,并在2026年机器学习顶会ICML上以立场论文直呼:“停止把中间token拟人化为推理轨迹!”这位前AAAI主席并不否认LRM能work,他反感的是学界与业界急于拥抱“过度方便的解释”。 矛盾的另一面同样耀眼。2026年5月,OpenAI的通用推理模型“一击”解开了著名的单位距离......阅读全文
研究显示:大推理模型的“思维链”效果存疑
大型推理模型(LRM)到底是在“推理”,还是仅仅给出了正确答案却说错了理由?2025年,东北大学和加州大学伯克利分校的团队对前沿开源LRM的研究显示,模型在基准数学题上产生的“思考步骤”中,有 30%到60% 对最终答案“几乎无因果影响”——砍掉一半,性能几乎不掉。作者魏彦诗(Weiyan Shi
《自然》发文盛赞中国开源AI模型DeepSeek
最近,由来自杭州的“深度求索”初创团队开发的DeepSeek系列AI模型,引发了全球范围的关注。1月24日,知名学术期刊《自然》也发文关注该模型及相应产品,称“中国开发的大语言模型DeepSeek-R1以亲民价格和开放性挑战了OpenAI的推理模型GPT-o1的地位,令科学家们感到兴奋”。《中国科学
“深度思维”让人工智能成功检测眼病
据英国《金融时报》在线版近日消息称,继“阿法狗”之后,谷歌旗下人工智能子公司——“深度思维”(DeepMind)已成功训练一种人工智能(AI)算法检测疾病,比人类专家更迅速、更高效,这或是AI在医疗领域的首个重大应用。 2017年5月,当“深度思维”最知名的人工智能——“阿法狗”战胜围棋世界冠
蓝闽波委员:调整思维模式促进转化链“发育”
“我们的创新体系依然存在一定程度的‘重科研、轻转化’现象。目前我国已形成较完善的基础科研体系,但是转化链依然‘发育’不足。”谈及科学研究如何与产业发展衔接的问题,全国政协委员、华东理工大学教授蓝闽波对《中国科学报》说。” 调研中,蓝闽波发现多年形成的以论文影响因子及数量考核和科研项目考核的机制依
ChatGPT如何“思考”
北京时间5月14日凌晨,美国开放人工智能研究中心(OpenAI)发布了其下一代大型语言模型GPT-4o,人工智能(AI)领域再起硝烟。尽管AI一词已很普及,但其内部运作方式仍像黑箱操作一样,是一个谜。因为AI依赖机器学习算法,而先进的机器学习算法使用模拟人脑结构的神经网络,信息在不同神经元间传递,以
机器人或对儿童思维影响大
随着人工智能快速发展,机器人越来越多地出现在日常生活中,尤其是一些面向儿童的机器人往往受到父母的青睐。一个国际研究团队近日说,机器人有可能显著影响儿童的思维观念。 为弄清楚具有一定“社交”功能的机器人对人类尤其是儿童的影响,英国、德国等国研究人员采用“艾氏范式”测试法,让参与者独自或者在有3个
科大讯飞全国产深度推理模型星火X1实现升级
3月3日,记者从科大讯飞获悉,其自主研发的全国产深度推理大模型“星火X1”完成全面升级,并在医疗、教育等领域推出系列创新应用。科大讯飞表示,此次升级“充分证明基于国产算力训练的全栈自主可控大模型具备登顶业界最高水平的强大实力和持续创新的巨大潜力”。 在升级后的星火X1加持下,科大讯飞旗下讯飞晓
日本借深度神经网络破译人类思维-人工智能走近大脑
外媒称,日本研究人员已经成功借助人工智能破译了人类的思维和想象,从而在理解人类思想及其背后的大脑机制领域获得了重大突破。 据阿根廷 21 世纪趋势网站 6 月 6 日报道,破解人类思维的内容是科学界长久以来的愿望。事实上,此前的种种研究也已经实现了破译人类所见、回忆、想象和梦境的内容。 例如
智谱发布推理模型初代版本
12月31日,国内明星大模型创业公司北京智谱华章科技有限公司推出基于扩展强化学习技术训练的推理模型GLM-Zero-Preview,擅长处理数理逻辑、代码和需要深度推理的复杂问题。GLM-Zero-Preview是GLM-Zero的初代版本。智谱表示,目前的GLM-Zero-Preview与Open
恐惧可影响整个食物链
一项近日发表于《自然—通讯》的浣熊研究发现,对大型食肉动物的恐惧可以对其他猎物产生与被捕食者相同的效果,而且可能导致连锁反应并传递到整个食物链,这表明顶级捕食者在生态系统内的影响力比以前认为的更为深远。 顶级捕食者的存在会产生瀑布效应,其存在减少了猎物数量,这反过来又使得与被捕食生物竞争的对手
怎样解释性别二态性的存在
性别二态性即为同性恋。同性恋产生原因很复杂:天生的性激素变异,成长环境的特殊性、家庭影响、长年的性压抑或性方面的诱导演变。但有一点无庸置疑:同性恋只是一种个人性取向,与疾病罪恶变态无关。在国外,孩子们很早就能得到同性恋的教育。比如美国六七年级的教材就有‘彩虹儿童’章节,介绍同性恋的性交方式。当少男少
我国科学家提出高效推理策略-可避免大模型“过度思考”
随着人工智能大模型的不断发展,如何让其在“难”的问题上深入思考,而不是对所有问题“想个不停”?记者5月29日从中国科学院自动化研究所获悉,该所联合鹏城实验室提出了一种高效推理策略AutoThink,可让大模型实现自主切换思考模式,避免“过度思考”。 “当前,越来越多的大模型开始具备‘深度思考能
中美近1800亿能源大单,能否终结零和思维
盘点此次中美元首外交经贸成果,两国达成总共34笔、2535亿美元大单中,能源项目三分天下有其二(1754亿美元),无疑是汪洋副总理提前剧透“好戏在后头”中的重头戏。 这份超出普通人想象、也超出业界预期的大单,在令两国能源人兴奋的同时,似乎昭示着另一种更深远的可能性——零和思维的终结。 零和
讯飞联手华为攻克全国产算力下推理模型训练难关
1月15日,科大讯飞发布了我国“全国产”算力平台第一个深度推理大模型——讯飞星火X1。据公开测试,该模型中文数学能力表现突出,目前已应用于教育、医疗等场景。在大模型研发领域,讯飞星火坚持走全国产化路线。据科大讯飞研究院副院长殷兵介绍,尽管在全国产算力平台上训练深度推理模型遭遇了诸多挑战,但科大讯飞携
国际首个符合国人特点的罕见病大模型进入临床
2月16日,北京协和医院与中国科学院自动化研究所共同研发的“协和·太初”罕见病大模型正式进入临床应用阶段。 据悉,该模型基于我国罕见病知识库的多年积累和中国人群基因检测数据支撑,是国际首个符合中国人群特点的罕见病大模型,能帮助医生更加准确快捷地识别诊断罕见病,进一步缩短确诊时间,破解罕见病诊疗
人工智能结合物理规律绘制储氢材料设计蓝图-为绿色能源存储提供可解释性搜索路径
氢能被广泛视为存储可再生能源并驱动燃料电池的理想载体,但氢气本身的安全高效储存始终是一个关键技术瓶颈。金属氢化物是有望安全存储大量氢气并在需要时释放的候选材料。然而,许多在便捷压力下释放氢的材料,其重量储氢量却不足以满足实用需求。研究人员面对这样一种苛刻的权衡关系,究竟应从何处着手寻找解决方案?一支
对标GPT4o,商汤推出日日新5o实现实时交互
·徐立表示,人工智能大模型某种程度上只是“记忆器”,思维能力、实时交互、可控生成才能推动模型落地。今年着重优化模型端侧,用好端、云两部分的计算机资源,实现全自然的交互模式。商汤科技董事长兼CEO徐立。和它打个招呼,它便能根据打招呼的人身上佩戴的胸卡带子,判断出对方在世界人工智能大会,并说“在这个地方
大模型向人类思维方式“对齐”将颠覆各行业生态
原文地址:http://news.sciencenet.cn/htmlnews/2023/4/497842.shtm “大型语言模型技术的快速演进,已经为我们展现了通用人工智能的大框架。下一步,最重要的是让大模型和现实世界‘对齐’。在模型自我学习、自我迭代过程中,人必须参与其中,以保持机器与人类价值
人工智能声呐眼镜可识别唇语
原文地址:http://news.sciencenet.cn/htmlnews/2023/4/498153.shtm
人工智能助力应对科研大挑战
近年来,人工智能(AI)领域发生了巨大变化,ChatGPT横空出世,引发生成式AI创业热潮。英国《新科学家》杂志网站在近日的报道中指出,很多科研团队和公司正在利用AI应对人类目前面临的最大的科学挑战:从破译蛋白质的秘密,到研制出新药,再到应对气候变化以及实现可商用的核聚变发电等。揭示蛋白质结构根据蛋
酒精性幻觉症的检查
震颤谵妄常起于酒精戒断48~72小时之后,表现为焦虑发作,日益意识浑浊,睡眠不佳(伴有噩梦或夜间幻觉),出汗明显和深度抑郁。患者常因不断闪现的幻觉而坐立不安和恐惧。最初的谵妄,意识浑浊和定向不全这些典型状态是对日常习惯活动的再现;例如,患者常想象自己又去上班了,并试图从事某些相关活动。此时除谵妄
肝癌晚期说胡话有幻觉原因分析
核心提示: 癌症晚期患者一般会出现各种各样的并发症,除了常见的脱发,身体免疫力低下,还会在癌症患者心情比较低落的时候,出现一些胡言乱语或者是幻觉的情况。这时候都会把家人吓得不轻,不知道是什么原因导致的患者胡言乱语或者是幻觉的状况。下面让我们一起来了解一下肝癌晚期患者说胡话和出现患绝是什么原因引起
酒精性幻觉症的原因
长期过量饮酒后突然戒断。 长期酗酒者停止饮酒一般会在12~48小时后出现一系列症状和体征。轻度戒断综合征表现为震颤,乏力,出汗,反射亢进以及胃肠道症状。有些人还会发生癫痫大发作,但一般不会在短期内发作2次以上(酒精性癫痫或酒痉挛)。 长期过量饮酒后突然戒断会发生酒精性幻觉症。症状常是责骂性与
启信慧眼发布商业大数据领域AI大模型应用,降低“AI幻觉”概率
7月17日,上海合合信息科技股份有限公司旗下启信慧眼宣布完成品牌升级,定位为“商业数据智能决策企业级AI产品”。同时,启信慧眼首次发布中国商业大数据领域AI大模型应用,聚焦企业营销、尽调、风控等核心场景,赋能企业数智化转型。“慧眼”寓意洞察本质、明辨真伪的能力。合合信息数据事业部副总经理沈东辉表示,
国家区块链中心牵头共建人工智能语料共享新模式
近日,新华社国家重点实验室、人民网、中国科学院文献情报中心、北京广播电视台、高等教育出版社、首都图书馆、中央电化教育馆出版社、万方数据、中国知网等语料数据重点单位宣布,联合国家区块链技术创新中心,共同成立高价值语料可信安全流通生态体系。运用区块链、隐私计算等前沿信息技术,全国范围的大模型语料资源将在
联合多家产业链公司-华为全面布局人工智能
10月31日,华为创始人兼CEO任正非与ICPC(国际大学生程序设计竞赛)主席、教练及获奖选手座谈会纪要曝光。谈及时下火热的人工智能(AI),任正非表示,世界走向人工智能的潮流是不可阻挡的。芯片、算力等各种技术的发展,促进了智能时代的到来,这个时代的转折点是人工智能的应用。 自提出全面智能化战
人工智能新模型可解码DNA隐藏“语言”
DNA包含了维持生命所需的基础信息。理解这些信息是如何存储和组织的,一直是20世纪最大的科学挑战之一。现在,借助GROVER这一基于人类DNA训练的新型大型语言模型,研究人员有望解码基因组中隐藏的复杂信息。GROVER由德国德累斯顿工业大学生物技术中心开发,它将人类DNA视为文本,通过学习其规则和上
人工智能新模型可解码DNA隐藏“语言”
DNA包含了维持生命所需的基础信息。理解这些信息是如何存储和组织的,一直是20世纪最大的科学挑战之一。现在,借助GROVER这一基于人类DNA训练的新型大型语言模型,研究人员有望解码基因组中隐藏的复杂信息。GROVER由德国德累斯顿工业大学生物技术中心开发,它将人类DNA视为文本,通过学习其规则
人工智能新模型可解码DNA隐藏“语言”
DNA包含了维持生命所需的基础信息。理解这些信息是如何存储和组织的,一直是20世纪最大的科学挑战之一。现在,借助GROVER这一基于人类DNA训练的新型大型语言模型,研究人员有望解码基因组中隐藏的复杂信息。GROVER由德国德累斯顿工业大学生物技术中心开发,它将人类DNA视为文本,通过学习其规则和上
人工智能可助寻找更佳的用药组合
美国斯坦福大学一个研究团队开发出一种新的人工智能系统,可预测两种药物联合使用的潜在副作用。这项研究成果不仅可帮助医生更好地开出用药处方,也能帮助研究人员寻找更佳的用药组合。图片来源网络该研究团队10日在芝加哥举行的国际计算生物学学会会议上报告说,目前美国药物市场上大约有5000种药物,已知副作用大约