网上断病,这轮AI行不行?专家:模型尚不完善
原文地址:http://news.sciencenet.cn/htmlnews/2023/7/504964.shtm ?图为研究团队的方法和现有技术的比较。Flan-PaLM 540B模型在MedQA,MedMCQA和PubMedQA数据集上均超过了以往最先进的SOTA,每列上方显示的是准确率百分比。图片来源:《自然》你在网上搜过“我哪哪疼是不是得了啥啥病”吗?答案可能不尽如人意。但随着ChatGPT等大型自然语言模型(LLM)风生水起,人们开始尝试用它来回答医学问题或医学知识。不过,靠谱吗?就其本身而言,人工智能(AI)给出的答案是准确的。但英国巴斯大学教授詹姆斯·达文波特指出了医学问题和实际行医之间的区别,他认为“行医并不只是回答医学问题,如果纯粹是回答医学问题,我们就不需要教学医院,医生也不需要在学术课程之后接受多年的培训了。”鉴于种种疑惑,在《自然》杂志新近发表的一篇论文中,......阅读全文
未来五年AI如何改变各学科?从LLM到AI蛋白设计、医疗保健......
五年前(2019 年 1 月),《Nature Machine Intelligence》创刊。当然,就人工智能(AI)而言,五年前似乎是一个不同的时代。 1 月 24 日,Nature Machine Intelligence 杂志在《Anniversary AI reflections》(
人工智能大举“入侵”科学搜索引擎
当前,互联网搜索引擎中出现了越来越多的人工智能(AI)聊天机器人,如谷歌的Bard、微软的Bing等。这似乎将要改变科学搜索引擎。 据《自然》报道,8月1日,荷兰出版业巨头爱思唯尔向其Scopus数据库的部分用户发布了一个基于ChatGPT的AI界面。当天,英国数字科学公司(Digital S
“帮手”还是“帮凶”?生成式AI学术使用须关注
生成式人工智能(AI)工具快速普及,在学术写作领域呈现爆炸式应用势头。使用基于大语言模型(LLM)的生成式AI工具能节省时间,减少语言障碍,让论文更加明白通畅。但这些工具的应用也让剽窃问题变得更复杂。英国《自然》网站在近日的报道中指出,对利用AI写作是否构成剽窃,以及在什么情况下允许利用AI进行写作
“帮手”还是“帮凶”?生成式AI学术使用须关注
图片来源:《自然》网站生成式人工智能(AI)工具快速普及,在学术写作领域呈现爆炸式应用势头。使用基于大语言模型(LLM)的生成式AI工具能节省时间,减少语言障碍,让论文更加明白通畅。但这些工具的应用也让剽窃问题变得更复杂。英国《自然》网站在近日的报道中指出,对利用AI写作是否构成剽窃,以及在什么情况
人工智能倒逼出版界“立规矩”
2022年11月,OpenAI发布生成式人工智能(AI)工具ChatGPT。鉴于生成式AI可快速创建文本、图像等内容,两个月后,ChatGPT已作为作者,赫然出现在一些学术论文上。英国纽卡斯尔大学数字创新研究员萨瓦斯·帕帕扬尼斯表示,在学术界这一竞争激烈的领域,任何能增加研究人员学术产出的工具都是“
ChatGPT如何“思考”
北京时间5月14日凌晨,美国开放人工智能研究中心(OpenAI)发布了其下一代大型语言模型GPT-4o,人工智能(AI)领域再起硝烟。尽管AI一词已很普及,但其内部运作方式仍像黑箱操作一样,是一个谜。因为AI依赖机器学习算法,而先进的机器学习算法使用模拟人脑结构的神经网络,信息在不同神经元间传递,以
AI工具使用导致科研成果数量骤增质量下滑
一项近日发表于《科学》的研究指出,像ChatGPT 这样的人工智能(AI)写作工具正在大幅提升科研生产力。研究人员借助AI工具使论文发表数量最多增加了50%。但这也有不利的一面,AI生成的文本虽然文笔流畅,但不具备科学价值。此类文本数量的不断增加,使同行评议、资金决策和科研监督变得更为复杂,因为决策
1/7生物医学论文摘要由AI撰写
一项针对学术文献的大规模分析显示,去年发表的生物医学论文摘要中,约1/7可能借助人工智能(AI)完成撰写。2024年,医学数据库PubMed收录的150万篇摘要中,超过20万篇包含大型语言模型(LLM)常推荐使用的词汇。相关研究于2024年6月以预印本形式在线公布,当时预计上半年约1/9的摘要由AI
提高大语言模型可信度,新方法助生成式AI破除“幻觉”
人工智能(AI)在给出准确答案的同时,也会有一些“胡乱输出”令人难辨真假,这被称为“幻觉”(hallucination)。而新一期《自然》杂志发表的一项研究报道了一种新方法,能检测大语言模型(LLM)产生的“幻觉”,即该方法能测量生成回答的含义的不确定性,或能提升LLM输出答案的可靠性。类似Chat
类似-ChatGPT-的人工智能即将出现在主要科学搜索引擎中
人工智能驱动的会话式聊天机器人已经出现在互联网搜索引擎中,例如谷歌的 Bard 和微软的 Bing,看起来也将越来越多地改变科学文献搜索方式。8 月 1 日,荷兰出版巨头 Elsevier 为其 Scopus 数据库的部分用户发布了由 ChatGPT 支持的 AI 界面,而英国公司 Digita
日本发布大规模语言模型
科技日报讯 (记者李杨)东京工业大学、日本理化学研究所及富士通公司等近日宣布,利用超级计算机“富岳”,他们开发的大规模语言模型“Fugaku-LLM”正式发布。“Fugaku-LLM”是首个完全由日本国产技术构建的AI语言模型,其在处理日语及相关文化内容上表现卓越。模型特别擅长基于日语敬语进行自然对
日本发布大规模语言模型
东京工业大学、日本理化学研究所及富士通公司等近日宣布,利用超级计算机“富岳”,他们开发的大规模语言模型“Fugaku-LLM”正式发布。 “Fugaku-LLM”是首个完全由日本国产技术构建的AI语言模型,其在处理日语及相关文化内容上表现卓越。模型特别擅长基于日语敬语进行自然对话,并展现出在人
AI心理推断能力或与人类相当,但不意味它们有情商
新一期《自然·人类行为》发表论文显示,在测试追踪他人心理状态能力——也称心智理论(Theory of Mind)的任务中,两类大语言模型(LLM)在特定情况下的表现与人类相似,甚至更好。研究团队对热门LLM展开测试。图片来源:《自然·人类行为》心智理论对人类社交互动十分重要,是人类沟通交流和产生共鸣
AI写作仍无法媲美人类
图片来源:COREDESIGN/SHUTTERSTOCK本报讯 只需敲几下键盘,任何人都可以要求ChatGPT等人工智能(AI)程序写一篇论文,或创作一首歌曲、一部戏剧,但不要指望它具有威廉·莎士比亚的独创性。一项新研究发现,这种AI产出的作品仍然是衍生品——至少目前是这样。近日,研究人员设计出一个
谷歌DeepMind推出“惊艳”的通用科学AI系统
谷歌DeepMind利用聊天机器人模型成功解决了数学和计算机科学领域的重大难题。据《自然》报道,5月14日,DeepMind推出能够自主生成、改进算法代码的通用科学人工智能(AI)系统AlphaEvolve。该系统将大型语言模型(LLM)的创造力与能够审查模型建议的算法相结合,通过不断筛选和改进
大语言模型在线辩论说服力超人类
实验设计示意图。图片来源:英国《自然·人类行为》在线版《自然·人类行为》19日发表的一项人工智能(AI)研究发现,在线辩论中,GPT-4一类的大语言模型(LLM)如能根据对手的个性化信息调整它们的论据,其说服力比人类辩手高出64%。研究结果显示了GPT-4生成有针对性和说服力论据的能力,揭示出AI工
AI生成的科学假说在接受检验时不如人类
全球范围内,人工智能(AI)正在推动科学研究加速发展,部分原因在于它使一项曾被认为是人类独有的创造活动——假说的生成自动化了。但当研究人员在现实世界对这些假说进行测试并让人类评估人员对结果进行比较后发现,AI生成的假说仍然不如人类生成的假说,但两者间差距不大,这种落后局面可能不会持续太久。这是此
AI心理推断能力或与人类相当,但不意味它们有情商
新一期《自然·人类行为》发表论文显示,在测试追踪他人心理状态能力——也称心智理论(Theory of Mind)的任务中,两类大语言模型(LLM)在特定情况下的表现与人类相似,甚至更好。研究团队对热门LLM展开测试。心智理论对人类社交互动十分重要,是人类沟通交流和产生共鸣的关键。之前的研究表明,LL
AI心理推断能力或与人类相当,但不意味它们有情商
新一期《自然·人类行为》发表论文显示,在测试追踪他人心理状态能力——也称心智理论(Theory of Mind)的任务中,两类大语言模型(LLM)在特定情况下的表现与人类相似,甚至更好。 研究团队对热门LLM展开测试。图片来源:《自然·人类行为》 心智理论对人类社交互动十分重要,是人类沟通交
科学家设置数学测试新基准,难倒AI
下棋、写诗、绘画……人工智能(AI)似乎越来越“多才多艺”,就连数学似乎都难不倒它。大语言模型(LLM),如OpenAI的ChatGPT,几乎在每一次数学测试中都表现良好。不过,此前AI几乎没有触及数学领域的前沿研究,并不能反映其真正的数学能力。近日,一项在预印本平台公布的研究中,美国技术研究机构E
AI冒充人类让聊天更走心
6月30日发表于《自然-人类行为》的一项研究指出,人类倾向于拒绝来自人工智能(AI)对话机器人的情绪支持,除非这种同理心被误认为来自人类。生成式AI对话机器人,尤其是使用大语言模型(LLM)的对话机器人,自面向公众以来,受欢迎程度日益上升。它们可以与用户进行社交互动并给予情绪支持。此前研究显示,LL
合见工软发布UDA-2.0
3月18日,中国数字EDA龙头企业上海合见工业软件集团股份有限公司正式发布第二代数字设计AI智能平台——智能体UniVista Design Agent (UDA) 2.0。此次升级后,UDA平台正式从智能辅助工具进化为真正意义上的Agentic AI智能体。UDA 2.0是国内首款基于全部自主研发
AI-代写重要学术会议稿件评审引发争议
在发现一场国际人工智能(AI)会议21%的稿件评审是由AI生成后,争议爆发了。 据《自然》报道,许多学者对提交给明年“国际学习表征会议”(ICLR)的稿件和同行评审表示担忧。他们在社交媒体上指出,其稿件评审中出现了臆造的参考文献,以及对其工作给予了异常冗长且模糊的反馈。ICLR是一场机器学习专
OpenAI回应“暂停更强大模型研发”公开信
原文地址:http://news.sciencenet.cn/htmlnews/2023/4/498843.shtm近日,OpenAI 联合创始人兼 CEO 萨姆?奥特曼(Sam Altman)在美国麻省理工学院“想象力行动”活动上接受了采访。受访中,奥特曼回应了此前引起广泛关注的、“生命未来研究所
问题越简单,人工智能越“糊涂”
9月25日,一项发表于《自然》的研究表明,当大型语言模型(LLM)变得更大并从人类反馈中学习时,它们在回答简单问题方面似乎变得不那么可靠。大型语言模型能够回答各种各样的问题,但并不总是准确的。图片来源:Jamie Jin/Shutterstock人工智能开发人员试图通过两种主要方式提高LLM的能力,
晶泰科技携手微软-探索生物医药与材料科学领域AI应用
12月16日,晶泰科技与微软中国宣布签署一项战略合作备忘录,旨在利用人工智能(AI)、大模型、机器人实验室等前沿技术开展合作,并积极探索这些技术在生物医药与材料科学领域的革新性应用,开创科研、教育及创新应用的新篇章。 本次合作中,晶泰科技将利用其AI for Science研发平台的专业知识及其机
科学家评估大型语言模型回答医学问题的能力
图为研究团队的方法和现有技术的比较。Flan-PaLM540B模型在MedQA,MedMCQA和PubMedQA数据集上均超过了以往最先进的SOTA,每列上方显示的是准确率百分比。 你在网上搜过“我哪哪疼是不是得了啥啥病”吗?答案可能不尽如人意。但随着ChatGPT等大型自然语言模型(LLM)
松山湖材料实验室发布MatChat-AI-材料科学领域迎来AI助手
昨日从松山湖高新区获悉,松山湖材料实验室近日发布了材料科学重磅AI工具——MatChat AI Agent(即MatChat AI智能体),用户可通过对话形式,轻松获取知识库中的材料科学内容和“靠谱”答案。这标志着自然科学垂类模型时代到来,也意味着松山湖材料实验室在“AI+材料科学”领域的进一步
GPT4驱动的机器人化学家登Nature:自主设计反应,挑战复杂实验
基于 Transformer 的大语言模型(LLM)在自然语言处理、生物、化学和计算机编程等各个领域取得了重大进展。 但对于在实验室工作的研究人员或那些不熟悉计算机代码的人来说,人工智能方法并不那么容易理解。 近日,卡内基梅隆大学的研究团队找到了如何让人工智能系统自学化学的方法。提出了一种基
硬刚“GPT4”,谷歌重磅推出最强杀手锏“Gemini”
12月6日,谷歌宣布推出其认为规模最大、功能最强大的人工智能模型Gemini。Gemini将包括三种不同的套件:Gemini Ultra,Gemini Pro和Gemini Nano。官方宣文中,概括出这三种套件的突出特性: Gemini Ultra——参数量最大,能力最强,适用于高度复杂的任