为何开放权重AI引发关注?
核心事实:Kimi K3 发布即引爆需求 中国开发者月之暗面(Moonshot AI)于 7 月 17 日发布 Kimi K3 后仅三天,便停止接受新订阅——这款巨型人工智能模型的需求,已超出公司可用算力。然而 Moonshot 表示,计划在 7 月 27 日前发布 K3 的完整模型权重,让其他机构能够自行托管与修改该模型。这种"发布即开源权重"的节奏,使其一经亮相便成为行业焦点。 战略逻辑:开放权重如何转化为优势 OpenAI 战略未来负责人 Dean W. Ball 在 X 平台发文称,一个由开放权重模型主导的世界可能走向"全面 AI 共产主义",他将其描述为一幅"反乌托邦地狱图景"。但免费放出顶级 AI 模型的权重,其实具备现实合理性:对 Moonshot 而言,这能让 K3 扩散至自身算力基础设施之外,并帮助其与那些权重保密的美国领先系统竞争。 所谓"开放权重",指的是公开模型的参数,使任何人都能下载、在自有硬件上运......阅读全文
为何开放权重AI引发关注?
核心事实:Kimi K3 发布即引爆需求 中国开发者月之暗面(Moonshot AI)于 7 月 17 日发布 Kimi K3 后仅三天,便停止接受新订阅——这款巨型人工智能模型的需求,已超出公司可用算力。然而 Moonshot 表示,计划在 7 月 27 日前发布 K3 的完整模型权重,让其他
《自然》发文盛赞中国开源AI模型DeepSeek
最近,由来自杭州的“深度求索”初创团队开发的DeepSeek系列AI模型,引发了全球范围的关注。1月24日,知名学术期刊《自然》也发文关注该模型及相应产品,称“中国开发的大语言模型DeepSeek-R1以亲民价格和开放性挑战了OpenAI的推理模型GPT-o1的地位,令科学家们感到兴奋”。《中国科学
“大”以致用,百度开放文心大模型助阵AI大赛
4月16日,2021百度认知AI创意赛“AI创意派”决赛在京举行(含线上)。在本期赛事中,百度开放了文心大模型中的知识增强百亿参数大模型ERNIE 3.0的能力,选手可以近距离感受人工智能(AI)预训练大模型(以下简称大模型)的魅力,并基于对ERNIE技术能力的理解产生全新的应用。这是业内首次将先进
Meta发布最新开源大模型Llama-4
据路透社报道,当地时间4月6日,美国科技公司Meta推出了开源人工智能模型Llama 4。据介绍,该模型目前有Scout和Maverick两个版本,是Meta迄今为止最先进的模型,也是同类产品中多模态性最强的模型。 报道称,Llama 4系列采用了先进的混合专家架构,这一架构在模型训练及用户查
腾讯大模型上线文生视频并宣布开源
据腾讯官微消息,腾讯今日宣布,混元大模型上线并开源文生视频能力。据介绍,该模型参数量为130亿,已经在Hugging Face平台及Github上发布,包含模型权重、推理代码、模型算法等完整模型,可供企业与个人开发者免费使用和开发生态插件。这也是当前最大的视频开源模型。
AI大模型“拿捏”电池寿命
作为现代生活中不可或缺的能源载体,电池的重要性不言而喻。从清晨唤醒我们的闹钟,到随身携带的手机、平板电脑等智能设备,无一不依赖于电池提供的稳定电力。此外,随着科技的发展,电动汽车、无人机等新兴领域也广泛应用了各类高性能电池,推动了绿色出行和智能科技的进步。因此,电池不仅极大地便利了我们的日常生活,还
阿里强势发力-引领AI创新潮流
在人工智能技术日新月异的今天,阿里国际AI团队再次向全球展示了其强大的研发实力与创新成果——最新版多模态大模型Ovis的发布,不仅标志着阿里在AI多模态技术领域的重大突破,更为全球AI生态的开放与合作树立了新的标杆。 Ovis作为阿里国际倾力打造的多模态大模型,其独特之处在于能够跨越多种数据模
中国首个海洋领域开源大模型OceanGPT正式发布
近日,中国首个海洋领域开源大模型OceanGPT(沧渊)在杭州正式发布。该大模型由海洋精准感知技术全国重点实验室(浙江大学)牵头研发,具备基础的海洋专业知识问答,以及声呐图像、海洋观测图等海洋特色多模态数据的自然语言解读能力。其采用的领域知识增强“慢思考”推理机制,相较现有通用大模型能有效降低幻觉式
释放AI大模型促消费潜力
今年的《政府工作报告》提出持续推进“人工智能+”行动,旨在抓住人工智能技术突破机遇,使我国数字技术与制造优势、市场规模优势充分结合,推动人工智能大模型广泛应用,真正赋能千行百业、走进千家万户。在构建新发展格局战略背景下,AI大模型在激活内需市场、促进消费升级等方面充满“模”力。 随着人工智能技
OpenAI对中国地区停止服务,国产大模型“抢客”
OpenAI“断供”,国产大模型“抢客”忙。6月25日,人工智能(AI)巨头OpenAI通过官方推送邮件告知API(应用接口)用户,自7月9日起,将阻止来自未列入支持国家和地区名单的区域的API流量,如要继续使用OpenAI的服务,需要在受支持的区域进行访问。OpenAI API通知邮件OpenAI
厦大尝试AI大模型破译甲骨文
近日,厦门大学信息学院自然语言处理实验室教授史晓东团队申报的“基于甲骨文多模态大模型的多元信息甲骨文辅助考释模型”入选“探元计划2024”“创新探索型项目”TOP10榜单。基于甲骨文多模态大模型的多元信息甲骨文辅助考释模型。厦门大学供图甲骨文也被称作“殷墟文字”,距今已有三千多年历史,是世界四大古文
“35岁以下科技创新35人”中国区入选者公布
7月11日下午,2024中国科技青年论坛暨《麻省理工科技评论》“35岁以下科技创新35人”(以下简称TR35)中国区发布仪式在上海闵行大零号湾科创大厦开幕。活动发布了2023年度TR35中国区入选者名单,其中最年轻的为27岁。2023年度《麻省理工科技评论》“35岁以下科技创新35人”中国区入选者。
华为发布大模型时代AI存储新品
原文地址:http://news.sciencenet.cn/htmlnews/2023/7/504751.shtm
AI大模型“源”炼造客服大脑
2018年至今,NLP领域经历了非常大的变化,Transformer、ELMO、BERT、GPT-3,再到最近的ChatGPT(GPT 3.5的微调)的突破,NLP在预训练大模型的暴力拆解路上越走越远,这也让各行业开始相信:很多之前无法做到的场景、效果,现在可以有新的解法和落地。 智能客服,是
AI大模型走出“泡沫期”未来何如
今年3月ChatGPT-4上线以来,国内科技龙头企业密集推出人工智能大模型,百度“文心一言”、阿里云“通义千问”、华为“盘古”、360“智脑”、昆仑万维“天工”、京东“灵犀”、科大讯飞“星火”、腾讯“混元”、商汤“日日新”等大模型先后登场,呈现百花齐放、迅猛发展的态势。截至2023年10月初,国
大模型应该如何卷应用?开源闭源谁更有未来?
AI企业曾经受困于投入和回报难成比例的问题,在今年的人工智能大会上,大模型的“变现”之路也成为外界关注焦点。“(商业化)就像小时候玩打砖块的游戏,把砖块精准地打到一个缝隙里去,首先要知道缝隙在哪儿,路径在哪儿。”7月5日,2024世界人工智能大会暨人工智能全球治理高级别会议(简称“WAIC2024”
智源研究院与浪潮信息共推AI产业快速发展
7月29日,北京智源人工智能研究院(以下简称智源研究院)与浪潮信息签署战略合作协议,双方将围绕大模型开源生态共建联合实验室,通过优势资源共享与互补,增强人工智能算法基础设施创新能力,以开放生态加速大模型技术创新与成果转化,促进AI产业化和产业AI化落地。 智源研究院是在科技部和北京市支持下,联合北
讯飞星火认知大模型面向全民开放
原文地址:http://news.sciencenet.cn/htmlnews/2023/9/507872.shtm
设计基因编辑工具的AI大模型问世
记者27日从中国农业科学院获悉,该院农业基因组研究所农业基因编辑技术研发与应用创新团队构建了全球规模最大的实验验证数据集,并基于此开发出人工智能(AI)大模型AlphaCD。该模型不仅能高效预测超过2万余种胞嘧啶脱氨酶的酶活特征,还能设计出新型高性能碱基编辑工具。相关成果日前发表于国际期刊《细胞
中关村开源生态论坛暨大模型智能应用技术大会举办
原文地址:http://news.sciencenet.cn/htmlnews/2024/1/516894.shtm1月27日,中关村论坛永久会址建成后的首场活动—2024中关村论坛系列活动之中关村开源生态论坛暨大模型智能应用技术大会正式举办。大会聚集大模型生态上下游领军企业和技术专家,邀请海内外开
采用Sora同款架构,混元文生图大模型宣布开源
5月14日,腾讯宣布其旗下混元文生图大模型全面升级,并对外开源。据了解,这是首个中文原生的类Sora 架构开源模型,填补了国产大模型在文生图先进架构上的空白。目前,主流的文生图开源生态基本围绕英文建设,如Stable Diffusion 等主流开源模型,虽然一定程度支持中文输入,但其核心数据集仍以英
国产-AI-大模型-DeepSeek-升级,性能对标-OpenAI-o1-正式版
1 月 20 日,国产 AI 大模型 DeepSeek 正式发布新版本 DeepSeek-R1,并同步开源模型权重。开发者表示,DeepSeek-R1 在后训练阶段大规模使用了强化学习技术,在仅有极少标注数据的情况下,极大提升了模型推理能力。在数学、代码、自然语言推理等任务上,DeepSeek-
“龙虾热”开启AI产业竞速
过去几周,“养龙虾”逐渐从极客群体的爱好,演变成一场全球范围的AI(人工智能)智能体淘金热。忧心错失风口的互联网大厂争相布局,担心被AI取代的普通打工者也纷纷尝鲜。热浪翻滚中不乏泡沫与喧嚣,但毋庸置疑,一场AI产业竞速已经开启。 忧心错失风口 大厂竞速入局 “龙虾装上了吗?”“朋友用龙虾做的
“鹏城·脑海2.1开元2B”正式发布
近日,鹏城实验室联合清华大学研制成功的首个国产算力下全开源模型“鹏城·脑海-2.1-开元-2B”(以下简称“脑海2.1-开元2B”)在深圳正式发布。该模型在“中国算力网”核心节点“鹏城云脑Ⅱ”上进行训练数据清洗、去重和训练的全流程,并完全公开过程和代码。不仅为中国算力网和业界提供了一条可复现、可迭代
国内首个纯自研视频大模型开放使用
7月30日,曾在今年中关村论坛期间亮相发布的首个国产纯自研视频大模型Vidu宣布在全球范围内上线,向公众提供服务,其开放了文生视频、图生视频两大核心功能,提供4秒和8秒两种时长选择,分辨率最高达1080P。据了解,Vidu能够准确理解并生成提示词中的文字,包括字母、数字等,并能生成文字特效。对于第一
2023北京智源大会:人工智能顶级专家对话
未来生命研究所创始人Max Tegmark(左)与清华大学讲席教授张亚勤对话。 中新社记者 孙自法 摄中新网北京6月10日电 (记者 孙自法)作为定位于“AI(人工智能)内行顶级盛会”的年度国际性人工智能高端专业交流活动,由北京智源人工智能研究院(智源研究院)主办的2023北京智源大会6月9日至10
上海启动科学数据开源开放平台建设
原文地址:http://news.sciencenet.cn/htmlnews/2023/4/497836.shtm
刘聪:中国AI大模型也要走“直道冲锋”之路
原文地址:http://news.sciencenet.cn/htmlnews/2023/4/498384.shtm
新型AI芯片将大语言模型能耗减半
美国俄勒冈州立大学科研团队研发出一种新型AI芯片,成功将大语言模型的能耗降低50%。这项成果于近期在波士顿举行的IEEE定制集成电路会议上发布,是半导体领域的重大突破,有望成为解决大语言模型高能耗问题的“绿色钥匙”。 当前,以谷歌“双子座”和OpenAI的GPT-4为代表的大语言模型,因海量参
顶流AI大模型集结中关村科学城
6月14日上午,2024北京智源大会在中关村国家自主创新示范区展示中心开幕,大会现场具身智能机器人Galbot和国内主流大模型展览区备受关注。 在展览区,记者看到银河通用首代具身智能机器人Galbot正忙着为嘉宾“送吃送喝”。收到指令后,Galbot自主导航到货架,通过“视觉”锁定货架上的目标