MOSS!今日正式开源上线

复旦大学自然语言处理实验室开发的新版 MOSS 模型今日正式上线,成为国内首个插件增强的开源对话语言模型。目前,MOSS 模型已上线开源,相关代码、数据、模型参数已在 Github 和 Hugging Face 等平台开放,供科研人员下载。据介绍,MOSS 是一个支持中英双语和多种插件的开源对话语言模型,moss-moon 系列模型具有 160 亿参数,在 FP16 精度下可在单张 A100 / A800 或两张 3090 显卡运行,在 INT4/8 精度下可在单张 3090 显卡运行。MOSS 基座语言模型在约七千亿中英文以及代码单词上预训练得到,后续经过对话指令微调、插件增强学习和人类偏好训练具备多轮对话能力及使用多种插件的能力。MOSS 来自复旦大学自然语言处理实验室的邱锡鹏教授团队,名字与《流浪地球》电影中的 AI 同名,已发布至公开平台(https://moss.fastnlp.top/),邀请公众参与内测。通过查看 ......阅读全文

MOSS!今日正式开源上线

复旦大学自然语言处理实验室开发的新版 MOSS 模型今日正式上线,成为国内首个插件增强的开源对话语言模型。目前,MOSS 模型已上线开源,相关代码、数据、模型参数已在 Github 和 Hugging Face 等平台开放,供科研人员下载。据介绍,MOSS 是一个支持中英双语和多种插件的开源对话语言

复旦MOSS团队:研究成果将会开源!

原文地址:http://news.sciencenet.cn/htmlnews/2023/3/495039.shtm 由美国OpenAI公司开发的ChatGPT模型在全球点燃了新一轮AI革命,海内外关注度陡增。前不久,复旦大学计算机科学技术学院邱锡鹏团队发布类ChatGPT模型MOSS,新闻迅速

复旦MOSS团队:研究成果将会开源!

   由美国OpenAI公司开发的ChatGPT模型在全球点燃了新一轮AI革命,海内外关注度陡增。前不久,复旦大学计算机科学技术学院邱锡鹏团队发布类ChatGPT模型MOSS,新闻迅速登上微博热搜。  MOSS“火”了。2月20日发布当天就收到大量内测申请、采访、投资、合作邀约——公众对于这项原本局

复旦MOSS团队回应:未抢注商标、拟3月开源

原文地址:http://news.sciencenet.cn/htmlnews/2023/2/494312.shtm2月20日,复旦大学自然语言处理实验室教授邱锡鹏团队将其开发的对话式大型语言模型——MOSS,发布至公开平台(),并邀请公众参与内测。然而,很快由于“计算资源不足以支持激增的访问量”,

复旦团队发布国内首个类ChatGPT模型MOSS,邀公众参与内测

ChatGPT发布以来,基于指令学习技术的类ChatGPT模型在我国能否开发成功,成为业界关注的一个焦点。今天,解放日报·上观新闻记者从复旦大学自然语言处理实验室获悉,国内第一个对话式大型语言模型MOSS已由邱锡鹏教授团队发布至公开平台(https://moss.fastnlp.top/),邀公众参

复旦MOSS距离ChatGPT还有多远?

原文地址:http://news.sciencenet.cn/htmlnews/2023/2/494390.shtm 最近上热搜的MOSS,不是《流浪地球2》中量子计算机550W给自己起的新名字,而是复旦大学计算机科学技术学院教授邱锡鹏团队最新发布的国内第一个对话式大型语言模型,也被称作中国版C

复旦MOSS距离ChatGPT还有多远?

最近上热搜的MOSS,不是《流浪地球2》中量子计算机550W给自己起的新名字,而是复旦大学计算机科学技术学院教授邱锡鹏团队最新发布的国内第一个对话式大型语言模型,也被称作中国版ChatGPT。2月20日,MOSS悄然上线,邱锡鹏团队发布至公开平台(https://moss.fastnlp.top/)

复旦MOSS团队回应内测:没想到引起这么大关注

原文地址:http://news.sciencenet.cn/htmlnews/2023/2/494275.shtm 中新网2月21日电(中新财经记者 宋宇晟) 近日有报道称,从复旦大学自然语言处理实验室获悉,国内第一个对话式大型语言模型MOSS已发布至公开平台,邀公众参与内测。记者21日注意到

“聪明的小孩”确实有“ChatGPT那味儿”

原文地址:http://news.sciencenet.cn/htmlnews/2023/3/495355.shtm前不久,复旦大学计算机科学技术学院邱锡鹏团队发布类ChatGPT模型MOSS的新闻迅速登上微博热搜。2月20日,MOSS发布当天就收到大量内测申请、采访、投资、合作邀约——公众对这项原

大模型向人类思维方式“对齐”将颠覆各行业生态

原文地址:http://news.sciencenet.cn/htmlnews/2023/4/497842.shtm “大型语言模型技术的快速演进,已经为我们展现了通用人工智能的大框架。下一步,最重要的是让大模型和现实世界‘对齐’。在模型自我学习、自我迭代过程中,人必须参与其中,以保持机器与人类价值

日本发布大规模语言模型

  东京工业大学、日本理化学研究所及富士通公司等近日宣布,利用超级计算机“富岳”,他们开发的大规模语言模型“Fugaku-LLM”正式发布。  “Fugaku-LLM”是首个完全由日本国产技术构建的AI语言模型,其在处理日语及相关文化内容上表现卓越。模型特别擅长基于日语敬语进行自然对话,并展现出在人

AI语言模型“提速”药物发现

原文地址:http://news.sciencenet.cn/htmlnews/2023/6/502762.shtm美国麻省理工学院和塔夫茨大学研究人员设计出一种基于大型语言模型(如ChatGPT)的人工智能算法,这种称为ConPLex的新模型可将目标蛋白与潜在的药物分子相匹配,而无需执行计算分子结

日本发布大规模语言模型

科技日报讯 (记者李杨)东京工业大学、日本理化学研究所及富士通公司等近日宣布,利用超级计算机“富岳”,他们开发的大规模语言模型“Fugaku-LLM”正式发布。“Fugaku-LLM”是首个完全由日本国产技术构建的AI语言模型,其在处理日语及相关文化内容上表现卓越。模型特别擅长基于日语敬语进行自然对

压缩算法为大语言模型“瘦身”

据美国科学促进会旗下网站19日报道,美国普林斯顿大学和斯坦福大学团队开发出一种新压缩算法CALDERA,能精简大型语言模型(LLM)的海量数据,为LLM“瘦身”。这项算法不仅有助保护数据隐私、节约能源、降低成本,还能推动LLM在手机和笔记本电脑上高效使用。团队举例称,当人们使用ChatGPT时,请求

首个种业大语言模型“丰登”发布

4月28日,中国农业大学生物学院教授王喜庆团队联合上海人工智能实验室、崖州湾国家实验室发布首个种业大语言模型“丰登”(SeedLLM)。种业大语言模型“丰登”。中国农业大学供图“丰登”集成了先进的人工智能技术(书生·浦语2.0)与大数据分析,通过深入学习我国迄今发布的科研文献、科技书籍、种企报告和历

《自然》发文盛赞中国开源AI模型DeepSeek

最近,由来自杭州的“深度求索”初创团队开发的DeepSeek系列AI模型,引发了全球范围的关注。1月24日,知名学术期刊《自然》也发文关注该模型及相应产品,称“中国开发的大语言模型DeepSeek-R1以亲民价格和开放性挑战了OpenAI的推理模型GPT-o1的地位,令科学家们感到兴奋”。《中国科学

我国首款网络安全领域编程语言实现开源

“当前,范围更广、技术更强、危害更大的新型网络攻击手段威胁网络生态,如何构建更强大、更可靠的网络安全防御体系?”在电子科技大学网络空间安全学院联合YAK语言研发团队于5月30日举行的发布会上,电子科技大学网络空间安全学院院长张小松表示,在开源共享平台的基础上,通过底层的创新,能有效提高网络的安全性和

ChatGPT进入课堂:语言模型如何改变教育

最近,教育心理学家罗纳德·贝格托(Ronald Beghetto)以一种引人注目的方式引领一群研究生和教育专业人员,与一系列以创造力为中心的聊天机器人进行了交流。这些聊天机器人由贝格托设计,即将托管在亚利桑那州立大学(ASU)设立的平台上。这些机器人使用与ChatGPT相同的人工智能(AI)技术,目

神经机器模型能翻译200种语言

科技日报北京6月5日电 (记者张梦然)《自然》5日发表的一篇论文报道了一个Meta人工智能(AI)模型的底层技术。该模型能翻译200种不同语言,增加了机器翻译的语言数量。神经机器翻译模型利用人工神经网络翻译各种语言。这些模型通常需要大量可在线获取的数据加以训练,但并非所有语言数据都是公开、低成本或是

神经机器模型能翻译200种语言

自然》5日发表的一篇论文报道了一个Meta人工智能(AI)模型的底层技术。该模型能翻译200种不同语言,增加了机器翻译的语言数量。神经机器翻译模型利用人工神经网络翻译各种语言。这些模型通常需要大量可在线获取的数据加以训练,但并非所有语言数据都是公开、低成本或是普遍可及的,这类语言被称为低资源语言。一

8个小技巧“用好”大语言模型

用大语言模型,还需要技巧?在人们的印象中,这是个极其简单的操作:只需输入一个问题,立刻就能得到回答。但实际上,如何有效地与这些人工智能模型互动,发挥出它们的最大潜力,却是一个经常被忽视的话题。中国科学技术大学心理学系特任研究员林志成关注到这一话题,并在他最近的评论文章中提供了一系列的策略和指导,希望

腾讯大模型上线文生视频并宣布开源

据腾讯官微消息,腾讯今日宣布,混元大模型上线并开源文生视频能力。据介绍,该模型参数量为130亿,已经在Hugging Face平台及Github上发布,包含模型权重、推理代码、模型算法等完整模型,可供企业与个人开发者免费使用和开发生态插件。这也是当前最大的视频开源模型。

Meta发布最新开源大模型Llama-4

  据路透社报道,当地时间4月6日,美国科技公司Meta推出了开源人工智能模型Llama 4。据介绍,该模型目前有Scout和Maverick两个版本,是Meta迄今为止最先进的模型,也是同类产品中多模态性最强的模型。  报道称,Llama 4系列采用了先进的混合专家架构,这一架构在模型训练及用户查

科研人员开发出RNA基础语言模型

  在真核生物中,RNA转录、剪接、翻译和降解等生物学过程受到顺式调控元件、RNA结构和反式作用因子的调控。解析RNA多层次调控,对研究基因表达分子机制和设计RNA药物具有重要意义。但是,由于调控复杂和数据量不足,构建RNA调控的预测模型面临挑战。  近日,中国科学院上海营养与健康研究所研究员张国庆

中国首个海洋领域开源大模型OceanGPT正式发布

近日,中国首个海洋领域开源大模型OceanGPT(沧渊)在杭州正式发布。该大模型由海洋精准感知技术全国重点实验室(浙江大学)牵头研发,具备基础的海洋专业知识问答,以及声呐图像、海洋观测图等海洋特色多模态数据的自然语言解读能力。其采用的领域知识增强“慢思考”推理机制,相较现有通用大模型能有效降低幻觉式

学者开源物理传热启发的视觉表征模型vHeat

  近日,鹏城实验室网络智能研究部视觉智能研究所与中国科学院大学电子电气与通信工程学院共同合作,分别在GitHub和OpenI启智社区开源了物理传热启发的高效视觉表征模型vHeat。  研究团队认为,CNN和ViT的卷积算子与自注意力算子都是特征内部的像素传播过程,分别是一种信息传递的形式,从而联想

学者开源物理传热启发的视觉表征模型vHeat

  近日,鹏城实验室网络智能研究部视觉智能研究所与中国科学院大学电子电气与通信工程学院共同合作,分别在GitHub和OpenI启智社区开源了物理传热启发的高效视觉表征模型vHeat。  研究团队认为,CNN和ViT的卷积算子与自注意力算子都是特征内部的像素传播过程,分别是一种信息传递的形式,从而联想

学者开源物理传热启发的视觉表征模型vHeat

近日,鹏城实验室网络智能研究部视觉智能研究所与中国科学院大学电子电气与通信工程学院共同合作,分别在GitHub和OpenI启智社区开源了物理传热启发的高效视觉表征模型vHeat。vHeat与ViT核心算子计算复杂度对比。研究团队供图研究团队认为,CNN和ViT的卷积算子与自注意力算子都是特征内部的像

人工智能新模型可解码DNA隐藏“语言”

DNA包含了维持生命所需的基础信息。理解这些信息是如何存储和组织的,一直是20世纪最大的科学挑战之一。现在,借助GROVER这一基于人类DNA训练的新型大型语言模型,研究人员有望解码基因组中隐藏的复杂信息。GROVER由德国德累斯顿工业大学生物技术中心开发,它将人类DNA视为文本,通过学习其规则和上

人工智能新模型可解码DNA隐藏“语言”

科技日报北京8月6日电 (记者张佳欣)DNA包含了维持生命所需的基础信息。理解这些信息是如何存储和组织的,一直是20世纪最大的科学挑战之一。现在,借助GROVER这一基于人类DNA训练的新型大型语言模型,研究人员有望解码基因组中隐藏的复杂信息。GROVER由德国德累斯顿工业大学生物技术中心开发,它将