ChatGPT没有黑科技,机制创新值得借鉴

原文地址:http://news.sciencenet.cn/htmlnews/2023/4/498069.shtm 在与新必应(New Bing,集成了大语言模型GPT-4能力的搜索引擎)“深聊”之后,中国科学院计算技术研究所副所长、研究员包云岗发现了一点“规律”:对于一些需要精准答案的场景,GPT-4开始变得不可靠。“与New Bing讨论一些社会人文话题,它回答得头头是道;让它列一个信息技术发展报告大纲,看起来很有层次;让它望文作图、再赋诗一首,表现也还不错。直到开始讨论一道数学题,它似乎有‘情绪’了——试了两次都没答对,最终它不想再继续对话。”包云岗说道。他不灰心,继续第三次尝试,但New Bing仍然没有给出正确答案。“但依然有惊喜——New Bing的三次回答,使用了三种不同的思路,这说明它背后的GPT-4所采用基于人工反馈的强化学习(RLHF)确实在发挥作用。”包云岗说。 包云岗 受访者供图&nb......阅读全文

ChatGPT进入课堂:语言模型如何改变教育

最近,教育心理学家罗纳德·贝格托(Ronald Beghetto)以一种引人注目的方式引领一群研究生和教育专业人员,与一系列以创造力为中心的聊天机器人进行了交流。这些聊天机器人由贝格托设计,即将托管在亚利桑那州立大学(ASU)设立的平台上。这些机器人使用与ChatGPT相同的人工智能(AI)技术,目

压缩算法为大语言模型“瘦身”

据美国科学促进会旗下网站19日报道,美国普林斯顿大学和斯坦福大学团队开发出一种新压缩算法CALDERA,能精简大型语言模型(LLM)的海量数据,为LLM“瘦身”。这项算法不仅有助保护数据隐私、节约能源、降低成本,还能推动LLM在手机和笔记本电脑上高效使用。团队举例称,当人们使用ChatGPT时,请求

日本将开发更强日语能力的“大语言模型”人工智能技术

据共同社消息,日本东北大学和日本东京工业大学等团队计划开发一种更强日语能力的“大语言模型”,作为生成式人工智能(AI)的基础技术。该团队将利用理化学研究所的超级计算机“富岳”学习大量数据,并将在本年度内逐步公开。这一技术的开发将使国内企业和研究人员能够为自己的公司的服务或研究而自行改良。生成式AI可

人工智能新模型可解码DNA隐藏“语言”

DNA包含了维持生命所需的基础信息。理解这些信息是如何存储和组织的,一直是20世纪最大的科学挑战之一。现在,借助GROVER这一基于人类DNA训练的新型大型语言模型,研究人员有望解码基因组中隐藏的复杂信息。GROVER由德国德累斯顿工业大学生物技术中心开发,它将人类DNA视为文本,通过学习其规则和上

人工智能新模型可解码DNA隐藏“语言”

  DNA包含了维持生命所需的基础信息。理解这些信息是如何存储和组织的,一直是20世纪最大的科学挑战之一。现在,借助GROVER这一基于人类DNA训练的新型大型语言模型,研究人员有望解码基因组中隐藏的复杂信息。GROVER由德国德累斯顿工业大学生物技术中心开发,它将人类DNA视为文本,通过学习其规则

人工智能新模型可解码DNA隐藏“语言”

DNA包含了维持生命所需的基础信息。理解这些信息是如何存储和组织的,一直是20世纪最大的科学挑战之一。现在,借助GROVER这一基于人类DNA训练的新型大型语言模型,研究人员有望解码基因组中隐藏的复杂信息。GROVER由德国德累斯顿工业大学生物技术中心开发,它将人类DNA视为文本,通过学习其规则和上

人工智能新模型可解码DNA隐藏“语言”

DNA包含了维持生命所需的基础信息。理解这些信息是如何存储和组织的,一直是20世纪最大的科学挑战之一。现在,借助GROVER这一基于人类DNA训练的新型大型语言模型,研究人员有望解码基因组中隐藏的复杂信息。GROVER由德国德累斯顿工业大学生物技术中心开发,它将人类DNA视为文本,通过学习其规则和上

人工智能新模型可解码DNA隐藏“语言”

科技日报北京8月6日电 (记者张佳欣)DNA包含了维持生命所需的基础信息。理解这些信息是如何存储和组织的,一直是20世纪最大的科学挑战之一。现在,借助GROVER这一基于人类DNA训练的新型大型语言模型,研究人员有望解码基因组中隐藏的复杂信息。GROVER由德国德累斯顿工业大学生物技术中心开发,它将

商汤大模型多个评测表现超ChatGPT

本报讯 (记者沈湫莎)商汤科技近日公布了自研中文语言大模型“商量SenseChat 2.0”在MMLU、AGIEval、C-Eval三个权威大语言模型评测基准的成绩。评测显示,“商量”在这三个测试集中的表现均领先ChatGPT,实现了我国语言大模型研究的突破。      全球三大权威语言模型测评基准

8个小技巧“用好”大语言模型

用大语言模型,还需要技巧?在人们的印象中,这是个极其简单的操作:只需输入一个问题,立刻就能得到回答。但实际上,如何有效地与这些人工智能模型互动,发挥出它们的最大潜力,却是一个经常被忽视的话题。中国科学技术大学心理学系特任研究员林志成关注到这一话题,并在他最近的评论文章中提供了一系列的策略和指导,希望

商汤大模型“商量”多个评测表现超ChatGPT

原文地址:http://news.sciencenet.cn/htmlnews/2023/6/503362.shtm

新型AI芯片将大语言模型能耗减半

  美国俄勒冈州立大学科研团队研发出一种新型AI芯片,成功将大语言模型的能耗降低50%。这项成果于近期在波士顿举行的IEEE定制集成电路会议上发布,是半导体领域的重大突破,有望成为解决大语言模型高能耗问题的“绿色钥匙”。  当前,以谷歌“双子座”和OpenAI的GPT-4为代表的大语言模型,因海量参

新引擎实现大语言模型推理速度显著提升

原文地址:http://news.sciencenet.cn/htmlnews/2023/11/511841.shtm

复旦团队发布国内首个类ChatGPT模型MOSS,邀公众参与内测

ChatGPT发布以来,基于指令学习技术的类ChatGPT模型在我国能否开发成功,成为业界关注的一个焦点。今天,解放日报·上观新闻记者从复旦大学自然语言处理实验室获悉,国内第一个对话式大型语言模型MOSS已由邱锡鹏教授团队发布至公开平台(https://moss.fastnlp.top/),邀公众参

ChatGPT火了,人工智能会造就最佳员工?

原文地址:http://news.sciencenet.cn/htmlnews/2023/4/499294.shtm 中新社上海4月24日电 题:ChatGPT火了 人工智能会造就未来“最佳员工”吗? 中新社记者 郑莹莹 “嘱咐‘两句话’,它就去‘干活’了。”——基于AI(人工智能)技术

大语言模型在线辩论说服力超人类

实验设计示意图。图片来源:英国《自然·人类行为》在线版《自然·人类行为》19日发表的一项人工智能(AI)研究发现,在线辩论中,GPT-4一类的大语言模型(LLM)如能根据对手的个性化信息调整它们的论据,其说服力比人类辩手高出64%。研究结果显示了GPT-4生成有针对性和说服力论据的能力,揭示出AI工

科技企业抢滩ChatGPT,“人工智能”能否破局现代科研

  近期,人工智能研究公司OpenAI推出的ChatGPT聊天机器人软件掀起热潮,国内已有百度、京东、科大讯飞等多家公司宣布进入此赛道,中国版ChatGPT有望于3月份与公众见面。  接受《经济参考报》采访的多位业内人士表示,ChatGPT代表了人工智能向更加智能、更加通用方向发展的趋势,预计未来自

类ChatGPT给金融行业带来何种机遇与挑战?

“金融业和人工智能开展合作还有很大的应用空间,所以推动人工智能技术在金融领域,尤其是资产管理领域的创新应用,将成为上海金融中心、资管中心建设的重要支撑和未来重要的关键方向。”上海市地方金融监管局监管三处处长赵焕如是说。18日,由上海资产管理协会、智能投研技术联盟主办,中国信息通信研究院云计算与大数据

ChatGPT敲开了通用人工智能的大门了吗?

  连日来,一路“狂飙”的ChatGPT持续引发着“话题地震”。  作为由OpenAI训练的对话式大规模语言模型,ChatGPT 以对话的方式与人进行交互。重点在于,它的回答之智能、之流畅令人意外。据媒体报道,ChatGPT不仅能在短短几秒内响应人们的问题需求,它还通过了美国部分高校的法律、医学考试

“聪明的小孩”确实有“ChatGPT那味儿”

原文地址:http://news.sciencenet.cn/htmlnews/2023/3/495355.shtm前不久,复旦大学计算机科学技术学院邱锡鹏团队发布类ChatGPT模型MOSS的新闻迅速登上微博热搜。2月20日,MOSS发布当天就收到大量内测申请、采访、投资、合作邀约——公众对这项原

“顶流”之下,看人工智能喜与忧

目前,ChatGPT还没有通过图灵测试的评估。其实,迄今为止,还没有人工智能模型能真正通过图灵测试。 去年11月,美国人工智能研究公司OpenAI发布了一款名为ChatGPT的聊天机器人,其在推出后的几周内就风靡全球,甚至引发了一场新的全球人工智能竞赛。 社交媒体推特首席执行官埃隆·马斯克在

ChatGPT爆火出圈,AI写研报、做投顾的时代来了?

人工智能写研报、做投顾的时代或许来临了。  2月5日,财通证券(7.600, -0.08, -1.04%)李跃博团队采用聊天机器人(10.760, -0.30, -2.71%)ChatGPT撰写了一篇医美行业研究报告《ChatGPT实测:提高外在美,增强内在自信——医疗美容革命》。  在这份由Cha

“AI+教育”,复旦推出大语言模型助力新生报到

8月25日,是复旦大学本科生新生报到的日子。来自全国各地和全球40多个国家的4300余名2024级本科新生,开启了在复旦的求学生涯。新生报道现场。为帮助来自世界各地的新同学尽快融入复旦大学,学校基于大语言模型,推出“复旦迎新助手”智能Agent。作为新生的贴心小帮手,大语言模型为新同学在迎新阶段提供

文心一言开启邀测,专家呼吁给中国类ChatGPT更多成长机会

距离新一代人工智能语言模型GPT-4发布不到24小时,国内互联网大厂百度3月16日发布了对标ChatGPT的AI产品——文心一言。 尽管百度创始人兼董事长李彦宏一上台就“降了音调”,表示推出文心一言是为了回应市场期待,产品本身并不完美,但仍然无法降低网友心中早已被拉满的期望值。文心一言开启邀请测试不

ChatGPT或将上岗医疗!哈佛医学教授亲测其表现接近医生

近期,ChatGPT因其高超的自然语言任务处理能力在各行各业爆火出圈。在编程、翻译、写论文等领域的应用,ChatGPT已经算是游刃有余。然而,在高壁垒的行业如医学领域中,ChatGPT却显得不够活跃。过去十年,神经网络、深度学习和人工智能 (AI) 等技术的进步已经对制造业、服务业和金融业等诸多行业

复旦MOSS团队:研究成果将会开源!

原文地址:http://news.sciencenet.cn/htmlnews/2023/3/495039.shtm 由美国OpenAI公司开发的ChatGPT模型在全球点燃了新一轮AI革命,海内外关注度陡增。前不久,复旦大学计算机科学技术学院邱锡鹏团队发布类ChatGPT模型MOSS,新闻迅速

复旦MOSS团队:研究成果将会开源!

   由美国OpenAI公司开发的ChatGPT模型在全球点燃了新一轮AI革命,海内外关注度陡增。前不久,复旦大学计算机科学技术学院邱锡鹏团队发布类ChatGPT模型MOSS,新闻迅速登上微博热搜。  MOSS“火”了。2月20日发布当天就收到大量内测申请、采访、投资、合作邀约——公众对于这项原本局

上海发布“书生·浦语”大模型:评测表现优秀

“书生·浦语”联合团队选取了20余项评测对其进行检验,其中包含全球最具影响力的四个综合性考试评测集,对“书生·浦语”、清华大学的GLM-130B、Meta的LLaMA-65B、OpenAI的ChatGPT和GPT-4进行了全面测试。6月7日,上海人工智能实验室(上海AI实验室)、商汤科技联合香港中文

日本发布大规模语言模型

科技日报讯 (记者李杨)东京工业大学、日本理化学研究所及富士通公司等近日宣布,利用超级计算机“富岳”,他们开发的大规模语言模型“Fugaku-LLM”正式发布。“Fugaku-LLM”是首个完全由日本国产技术构建的AI语言模型,其在处理日语及相关文化内容上表现卓越。模型特别擅长基于日语敬语进行自然对

AI语言模型“提速”药物发现

原文地址:http://news.sciencenet.cn/htmlnews/2023/6/502762.shtm美国麻省理工学院和塔夫茨大学研究人员设计出一种基于大型语言模型(如ChatGPT)的人工智能算法,这种称为ConPLex的新模型可将目标蛋白与潜在的药物分子相匹配,而无需执行计算分子结