人工智能破解埃尔德什数学难题取得重大进展
2026年5月20日,OpenAI宣布其内部AI模型给出了单位距离猜想的反例——这是1946年由匈牙利数学奇才保罗·埃尔德什(Paul Erdős)提出的著名难题。随后8月1日,名为Astra的未发布模型又取得10项数学进展,其中包括另外3道埃尔德什问题。许多数学家将其称为AI数学能力的"相变",曾经只属于人类智慧殿堂的难题,正一片片落向机器。一、问题提出:埃尔德什留下的千道悬题埃尔德什是有史以来最高产的同数学家之一,性格古怪、蔑视权威。他终年漂泊,几乎身无长物,却在发表的论文和寄往世界各地的信件中抛出成千上万个问题,常常自掏腰包为第一个解出者附上奖金——少则10美元、25美元,重要者可达数千。1996年,他在华沙一场数学会议上因心脏病去世。他提出的问题中,单位距离问题尤为特殊:既易于表述又数学深邃。它由"平面上能摆放多少对等距点"这一朴素发问出发,80年来数学家普遍相信他提出的上界是正确的。正是这道问题,成为历史上第一个由AI......阅读全文
人工智能破解埃尔德什数学难题取得重大进展
2026年5月20日,OpenAI宣布其内部AI模型给出了单位距离猜想的反例——这是1946年由匈牙利数学奇才保罗·埃尔德什(Paul Erdős)提出的著名难题。随后8月1日,名为Astra的未发布模型又取得10项数学进展,其中包括另外3道埃尔德什问题。许多数学家将其称为AI数学能力的"相变",曾
研究显示:AI破解数学难题效果提升显著
核心数据:AI模型50%成功率推翻80年猜想1946年,著名数学家保罗·埃尔德什提出了一个关于单位距离问题的猜想:在平面上放置若干点,使得尽可能多的点对之间距离相同,埃尔德什认为最佳排列方式是使用规则网格。八十年来,无人能够证明或推翻这一猜想。然而,OpenAI的研究者将这一猜想交给AI模型处理后,
为何AI破解数学猜想引发关注?
上周,OpenAI震动数学界:它披露旗下一个内部人工智能模型,找到了传奇匈牙利数学家保罗·埃尔德什(Paul Erdős)1946年提出著名猜想的反例。这个“平面单位距离问题”(埃尔德什第90号问题)困扰数学家数十年。加拿大数学家丹尼尔·利特(Daniel Litt)称其为“第一个由AI自主产出、
AI接连推翻数学猜想,人类还能守住菲尔兹奖吗?
“本届菲尔兹奖,将是人类最后一次拿下这项数学最高荣誉?”这个论断你相信吗?在王虹、邓煜历史性拿下菲尔兹奖的时候,大会还深入探讨了一个非常关键的问题:迅猛发展的AI究竟会不会取代数学家?国际数学家大会现场,继丘成桐后第二位获菲尔兹奖的华裔数学家陶哲轩当众敲响百年警钟:AI正在引爆数学界前所未有的“
来自俄罗斯的声音:寻求中俄两国科学领域的协同发展
《中国科学报》记者计红梅9月24日至26日,2024 CCF全国高性能计算学术年会(CCF HPC China 2024)在湖北省武汉市举行。俄罗斯科学院院士、马尔丘克数值数学研究所所长叶夫根尼·季尔季什尼科夫(Evgeny Tyrtyshnikov)参加了本次年会。据悉,叶夫根尼·季尔季什尼科夫曾
助手还是对手?AI工具将如何改变数学领域
原文地址:http://news.sciencenet.cn/htmlnews/2023/2/494250.shtm ChatGPT的横空出世让人们对聊天机器人的兴趣如野火般蔓延,数学家们开始探索人工智能(AI)如何帮助他们完成工作。英国《自然》杂志网站在2月17日的报道中指出,机器学习等AI工
谷歌推出两大数学模型,19秒解开IMO2024几何问题
·六道题每题可得7分,总分最高42分。谷歌DeepMind的人工智能系统在今年国际数学奥林匹克竞赛中最终得分28分。今年金牌的门槛是29分,在正式比赛的609名选手中,58名达到了这一门槛。·DeepMind表示,尽管基于自然语言的方法可以访问更多数据,但会产生看似合理但不正确的中间推理步骤和解决方
OpenAI打包新闻集团版权训练大模型
ChatGPT再扩容,这次将加入十余家媒体的新闻内容。当地时间5月22日,OpenAI宣布与新闻集团(News Corp)达成多年期协议,将获得主要新闻和信息出版物的当前和存档内容,包括《华尔街日报》《巴伦周刊》《纽约邮报》《泰晤士报》《太阳报》等十余家媒体。根据协议,OpenAI将能在ChatGP
压缩算法为大语言模型“瘦身”
据美国科学促进会旗下网站19日报道,美国普林斯顿大学和斯坦福大学团队开发出一种新压缩算法CALDERA,能精简大型语言模型(LLM)的海量数据,为LLM“瘦身”。这项算法不仅有助保护数据隐私、节约能源、降低成本,还能推动LLM在手机和笔记本电脑上高效使用。团队举例称,当人们使用ChatGPT时,请求
科学家设置数学测试新基准,难倒AI
下棋、写诗、绘画……人工智能(AI)似乎越来越“多才多艺”,就连数学似乎都难不倒它。大语言模型(LLM),如OpenAI的ChatGPT,几乎在每一次数学测试中都表现良好。不过,此前AI几乎没有触及数学领域的前沿研究,并不能反映其真正的数学能力。近日,一项在预印本平台公布的研究中,美国技术研究机构E
87年雅可比猜想难题终于被推翻
当无数人还沉浸在最近世界杯决赛的余兴中,数学界正酝酿另一种兴奋。在人工智能公司 Anthropic 工作的数学家 Levent Alpöge 在 X 平台随性地宣布,他借助数周前刚向公众发布的 Anthropic 大语言模型 Claude Fable 5,找到了代数几何中著名老问题“雅可比猜想”(
日本将开发更强日语能力的“大语言模型”人工智能技术
据共同社消息,日本东北大学和日本东京工业大学等团队计划开发一种更强日语能力的“大语言模型”,作为生成式人工智能(AI)的基础技术。该团队将利用理化学研究所的超级计算机“富岳”学习大量数据,并将在本年度内逐步公开。这一技术的开发将使国内企业和研究人员能够为自己的公司的服务或研究而自行改良。生成式AI可
“征服”数学,AI是否有能力“回答世界”
最近,专门为人工智能(AI)设立的AI国际奥林匹克数学竞赛(IMO)即将进入尾声,其结果将随今年7月于英国巴斯举行的65届IMO大会同步揭晓。这项赛事的目的是推动发展大语言模型的数学推理能力,训练出更高数学水平的新AI模型。 纯数学领域中的重大发现是推理和创造力的灵感结晶,往往意味着人类智慧
《自然》发文盛赞中国开源AI模型DeepSeek
最近,由来自杭州的“深度求索”初创团队开发的DeepSeek系列AI模型,引发了全球范围的关注。1月24日,知名学术期刊《自然》也发文关注该模型及相应产品,称“中国开发的大语言模型DeepSeek-R1以亲民价格和开放性挑战了OpenAI的推理模型GPT-o1的地位,令科学家们感到兴奋”。《中国科学
ChatGPT涉嫌侵权?普利策奖得主提起诉讼
原文地址:http://news.sciencenet.cn/htmlnews/2023/9/508358.shtm 中新网9月12日电 据路透社报道,包括普利策小说奖得主迈克尔·夏邦(Michael Chabon)在内的几名美国作家,日前在旧金山联邦法院起诉美国人工智能公司OpenAI,指控其
人工智能新模型可解码DNA隐藏“语言”
DNA包含了维持生命所需的基础信息。理解这些信息是如何存储和组织的,一直是20世纪最大的科学挑战之一。现在,借助GROVER这一基于人类DNA训练的新型大型语言模型,研究人员有望解码基因组中隐藏的复杂信息。GROVER由德国德累斯顿工业大学生物技术中心开发,它将人类DNA视为文本,通过学习其规则和上
人工智能新模型可解码DNA隐藏“语言”
DNA包含了维持生命所需的基础信息。理解这些信息是如何存储和组织的,一直是20世纪最大的科学挑战之一。现在,借助GROVER这一基于人类DNA训练的新型大型语言模型,研究人员有望解码基因组中隐藏的复杂信息。GROVER由德国德累斯顿工业大学生物技术中心开发,它将人类DNA视为文本,通过学习其规则
人工智能新模型可解码DNA隐藏“语言”
DNA包含了维持生命所需的基础信息。理解这些信息是如何存储和组织的,一直是20世纪最大的科学挑战之一。现在,借助GROVER这一基于人类DNA训练的新型大型语言模型,研究人员有望解码基因组中隐藏的复杂信息。GROVER由德国德累斯顿工业大学生物技术中心开发,它将人类DNA视为文本,通过学习其规则和上
人工智能新模型可解码DNA隐藏“语言”
科技日报北京8月6日电 (记者张佳欣)DNA包含了维持生命所需的基础信息。理解这些信息是如何存储和组织的,一直是20世纪最大的科学挑战之一。现在,借助GROVER这一基于人类DNA训练的新型大型语言模型,研究人员有望解码基因组中隐藏的复杂信息。GROVER由德国德累斯顿工业大学生物技术中心开发,它将
人工智能新模型可解码DNA隐藏“语言”
DNA包含了维持生命所需的基础信息。理解这些信息是如何存储和组织的,一直是20世纪最大的科学挑战之一。现在,借助GROVER这一基于人类DNA训练的新型大型语言模型,研究人员有望解码基因组中隐藏的复杂信息。GROVER由德国德累斯顿工业大学生物技术中心开发,它将人类DNA视为文本,通过学习其规则和上
OpenAI最新模型o3展现强大推理能力
12月20日,美国开放人工智能研究中心(OpenAI)介绍了其最新的人工智能(AI)推理模型——o3及其轻量版o3-mini。该公司宣称,o3具备更先进、近似人类的推理能力,在代码编写、数学竞赛和掌握人类博士级别的科学知识等方面,均超越了其“前辈”o1。 不过,英国《新科学家》网站在12月22
OpenAI开发神秘项目“草莓”提升模型智能
·使用“草莓”模型的目的是使OpenAI的人工智能不仅能够生成查询答案,还能够提前做好充足计划,自主可靠地在互联网上导航,执行OpenAI所说的“深度研究”。推理是人工智能实现或超人类智能水平的关键。OpenAI正在开发代号为“草莓”(Strawberry)的新推理技术。据路透社当地时间7月12日报
当模型足够大,就可以模拟现实世界
今年,OpenAI公司的视频生成模型Sora又火了一把,同时也带火了DiT。纽约大学计算机系助理教授谢赛宁称,Sora是基于自己和威廉·皮布尔斯(William Peebles)共同提出的DiT(一个能够直接生成4K分辨率图像的模型)框架设计而成。6月14日,在2024智源大会上,围绕“语言模型是否
8个小技巧“用好”大语言模型
用大语言模型,还需要技巧?在人们的印象中,这是个极其简单的操作:只需输入一个问题,立刻就能得到回答。但实际上,如何有效地与这些人工智能模型互动,发挥出它们的最大潜力,却是一个经常被忽视的话题。中国科学技术大学心理学系特任研究员林志成关注到这一话题,并在他最近的评论文章中提供了一系列的策略和指导,希望
人工智能参加国际奥数仅比金牌差一分
在从围棋到战棋类游戏的所有领域战胜人类后,美国谷歌公司旗下DeepMind现在表示,它在解决数学问题方面即将击败世界顶尖学生。7月25日,DeepMind宣布,其人工智能系统已经解决了本月在英国巴斯举行的2024年国际数学奥林匹克竞赛(IMO)所出6个题目中的4个。人工智能给出了严谨、循序渐进的证明
研究显示:大推理模型的“思维链”效果存疑
大型推理模型(LRM)到底是在“推理”,还是仅仅给出了正确答案却说错了理由?2025年,东北大学和加州大学伯克利分校的团队对前沿开源LRM的研究显示,模型在基准数学题上产生的“思考步骤”中,有 30%到60% 对最终答案“几乎无因果影响”——砍掉一半,性能几乎不掉。作者魏彦诗(Weiyan Shi
上海发布“书生·浦语”大模型:评测表现优秀
“书生·浦语”联合团队选取了20余项评测对其进行检验,其中包含全球最具影响力的四个综合性考试评测集,对“书生·浦语”、清华大学的GLM-130B、Meta的LLaMA-65B、OpenAI的ChatGPT和GPT-4进行了全面测试。6月7日,上海人工智能实验室(上海AI实验室)、商汤科技联合香港中文
“顶流”之下,看人工智能喜与忧
目前,ChatGPT还没有通过图灵测试的评估。其实,迄今为止,还没有人工智能模型能真正通过图灵测试。 去年11月,美国人工智能研究公司OpenAI发布了一款名为ChatGPT的聊天机器人,其在推出后的几周内就风靡全球,甚至引发了一场新的全球人工智能竞赛。 社交媒体推特首席执行官埃隆·马斯克在
OpenAI也降价了
·GPT-4o mini每百万token的输入价格为15美分,每百万token的输出价格是60美分,比GPT-3.5 Turbo便宜60%以上。7月19日,OpenAI发布GPT-4o mini,加入大模型价格战。在ChatGPT中,免费用户、Plus用户和团队用户即日起可访问GPT-4o mini
数学家计划计算机证明费马大定理
原文地址:http://news.sciencenet.cn/htmlnews/2024/3/519642.shtm费马大定理是一个关于数字的著名定理,几个世纪以来一直困扰着数学界。现在,数学家希望开发一种计算机证明费马大定理的方法。这是一个雄心勃勃、为期数年的项目,旨在展示计算机辅助数学证明的潜力