200亿A股出手!布局大规模算力集群
10月24日,协创数据表示,因规划建设具备大模型训练和推理能力的大型算力服务集群(万卡级),将采购GPU服务器,包括H20 NVLINK型AI GPU服务器,预计采购金额不超过9亿元。 值得注意的是,协创数据此次再度加码算力服务器业务,旨在推出万卡级别的计算集群。通过万卡集群来为大模型提供更高算力虽然已成为业内共识,但能设计并有效运行万卡集群的企业仍为少数。加码算力服务器业务 10月24日,协创数据发布公告称,因规划建设具备大模型训练和推理能力的大型算力服务集群(万卡级),公司间接控股的子公司广州奥佳软件技术有限公司与上海域允信息技术有限公司签署《采购框架合同》,向其采购GPU服务器,包括H20 NVLINK型AI GPU服务器,预计采购金额不超过9亿元。 协创数据表示,本合同有利于公司云服务业务开展,进一步提升公司的市场竞争力,从而更好地满足市场对公司产品及算力服务的需求,增强公司整体实力,预计将对公司未来的经营业绩......阅读全文
200亿A股出手!布局大规模算力集群
10月24日,协创数据表示,因规划建设具备大模型训练和推理能力的大型算力服务集群(万卡级),将采购GPU服务器,包括H20 NVLINK型AI GPU服务器,预计采购金额不超过9亿元。 值得注意的是,协创数据此次再度加码算力服务器业务,旨在推出万卡级别的计算集群。通过万卡集群来为大模型提供更高
讯飞联手华为攻克全国产算力下推理模型训练难关
1月15日,科大讯飞发布了我国“全国产”算力平台第一个深度推理大模型——讯飞星火X1。据公开测试,该模型中文数学能力表现突出,目前已应用于教育、医疗等场景。在大模型研发领域,讯飞星火坚持走全国产化路线。据科大讯飞研究院副院长殷兵介绍,尽管在全国产算力平台上训练深度推理模型遭遇了诸多挑战,但科大讯飞携
新引擎实现大语言模型推理速度显著提升
原文地址:http://news.sciencenet.cn/htmlnews/2023/11/511841.shtm
OpenAI打包新闻集团版权训练大模型
ChatGPT再扩容,这次将加入十余家媒体的新闻内容。当地时间5月22日,OpenAI宣布与新闻集团(News Corp)达成多年期协议,将获得主要新闻和信息出版物的当前和存档内容,包括《华尔街日报》《巴伦周刊》《纽约邮报》《泰晤士报》《太阳报》等十余家媒体。根据协议,OpenAI将能在ChatGP
研究显示:大推理模型的“思维链”效果存疑
大型推理模型(LRM)到底是在“推理”,还是仅仅给出了正确答案却说错了理由?2025年,东北大学和加州大学伯克利分校的团队对前沿开源LRM的研究显示,模型在基准数学题上产生的“思考步骤”中,有 30%到60% 对最终答案“几乎无因果影响”——砍掉一半,性能几乎不掉。作者魏彦诗(Weiyan Shi
OpenAI-发布新一代大模型,更擅长推理也更贵
传说中的“草莓”现身,9月12日晚间,OpenAI正式对外发布一款名为o1的新模型,这款模型为该公司下一代 “推理” 模型中的第一个,o为“Orion(猎户座)”,这款模型可以比人类更快地回答更复杂的问题。与以前的模型相比,在编写代码和解决多步骤问题方面做得更好。但它也比此前发布的GPT-4o更贵,
全国首个DNA存储领域预训练大模型“ChatDNA”发布
近年来,DNA 和人工智能一直都是科技发展的热门议题。随着科学技术的进步,它们之间便有了无限的可能性。例如,DNA 和人工智能可以帮助我们更快地研究特定基因组的变异和功能。科学家可以使用人工智能算法来分析大量的 DNA 序列,从而发现有价值的变异和基因功能,为疾病的治疗提供线索。DNA 是生物世界中
我国科学家提出高效推理策略-可避免大模型“过度思考”
随着人工智能大模型的不断发展,如何让其在“难”的问题上深入思考,而不是对所有问题“想个不停”?记者5月29日从中国科学院自动化研究所获悉,该所联合鹏城实验室提出了一种高效推理策略AutoThink,可让大模型实现自主切换思考模式,避免“过度思考”。 “当前,越来越多的大模型开始具备‘深度思考能
高文:将训练大模型底座面向全社会开放
·高文表示,开发大模型不是拍脑袋、喊口号那么容易,而是必须拥有算力,只有投入几十亿元甚至上百亿元才能做出“像样的东西”,但这笔资金对于高校和初创企业而言是一个门槛。“我们基本的想法就是用鹏城实验室的算力、公开渠道的数据,训练出大模型底座面向全社会开放,供研究人员、创业者使用。”5月22日,中国工程院
大模型训练遇“算力荒”,“超智融合”来帮忙
论及当下计算技术的发展方向和趋势,“超智融合”当仁不让——在今年6月发布的2024年全球“最节能超算”榜单(Green500)上,位列榜单前三的超算都采用了“超智融合”的技术理念。超智融合,顾名思义,意即“采用融合架构,集成超算和智算的功能”。在当前大模型训练不断需要大算力支持的时代背景下,超智融合
OpenAI推出具备推理能力新AI模型
据ChatGPT制造者美国开放人工智能公司(OpenAI)官网12日报道,该公司已经成功研发出一系列具备推理能力的人工智能(AI)模型,并命名为“OpenAI o1”。这些模型的独特之处在于,其会花更长时间思考问题,再做出响应,就像人类一样。因此,这些模型能对复杂任务进行推理,解决以前模型很难解决的
智谱发布推理模型初代版本
12月31日,国内明星大模型创业公司北京智谱华章科技有限公司推出基于扩展强化学习技术训练的推理模型GLM-Zero-Preview,擅长处理数理逻辑、代码和需要深度推理的复杂问题。GLM-Zero-Preview是GLM-Zero的初代版本。智谱表示,目前的GLM-Zero-Preview与Open
OpenAI推出具备推理能力新AI模型
据ChatGPT制造者美国开放人工智能公司(OpenAI)官网12日报道,该公司已经成功研发出一系列具备推理能力的人工智能(AI)模型,并命名为“OpenAI o1”。这些模型的独特之处在于,其会花更长时间思考问题,再做出响应,就像人类一样。因此,这些模型能对复杂任务进行推理,解决以前模型很难解决的
面向跨模态遥感数据的生成式预训练大模型发布
以深度学习为代表的人工智能技术已被应用于多种遥感图像解译任务中。遥感数据幅宽大、场景内容复杂,一幅标准景图像往往就可达数十亿像素,覆盖上万平方公里,与自然场景数据存在较大差异。大多数现有的深度神经网络模型是利用自然场景图像预训练的权重来进行初始化,在遥感数据解译任务上的性能和普适性有待进一步提升。中
预训练模型创业渐入佳境
2月10日,创新工场在京宣布,北京澜舟科技公司已完成近亿元Pre-A轮融资,此次融资由联想创投、斯道资本共同领投,创新工场跟投。本轮融资澜舟科技将主要用于自然语言处理(NLP)核心产品的开发和前瞻性研究。澜舟科技的新一轮融资,是时下围绕人工智能预训练大模型的创新创业渐入佳境的生动体现。在澜舟科技创始
学术论文正被高价出售给大模型训练,作者却零收入
·越来越多的学术出版商正将研究论文卖给科技公司用以训练人工智能(AI)模型,而作者收入为零。大语言模型(LLM)因训练数据问题再次引发争议。日前,国际著名期刊《自然》(《Nature》)杂志编辑伊丽莎白·吉普尼(Elizabeth Gibney)发布一篇题为《你的论文被用来训练人工智能模型了吗?几乎
OpenAI最新模型o3展现强大推理能力
12月20日,美国开放人工智能研究中心(OpenAI)介绍了其最新的人工智能(AI)推理模型——o3及其轻量版o3-mini。该公司宣称,o3具备更先进、近似人类的推理能力,在代码编写、数学竞赛和掌握人类博士级别的科学知识等方面,均超越了其“前辈”o1。 不过,英国《新科学家》网站在12月22
科学家在大模型少样本域适应方面取得进展
近日,中国科学院软件研究所天基综合信息系统全国重点实验室研究团队提出了一种新颖的提示学习方法BayesPrompt,该方法通过探索以去偏方式近似下游任务的完整训练域,为预训练语言模型提供去歧义指导。相关论文被机器学习领域顶级学术会议ICLR 2024接收。研究人员认为,学习范式长期存在的问题之一是下
学者发布无机材料AI模型,推理能力到达新高度
松山湖材料实验室研究员孟胜/刘淼团队在国家自然科学基金等项目的支持下,研发了一种基于深度学习图结构的通用预训练力场(graph-based pre-trained transformer force field,简称GPTFF)。相关成果近日发表于《科学通报(英文版)》(Science Bullet
2023年“双创领航精英训练营”启动
原文地址:http://news.sciencenet.cn/htmlnews/2023/8/506148.shtm8月4日上午,2023年教育部内地与港澳高等学校师生交流计划暨“双创领航精英训练营”在深圳大学启动。本届训练营由深圳大学和香港理工大学共同成立的大湾区国际创新学院、深圳大学创新创业教育
青年科学家:尺度定律不能显著提高模型因果推理能力
幻觉和泛化是模型落地绕不开的话题。模型的幻觉带来错误回答,使得人们在一些关键的认知上产生疑虑,一定程度上会阻碍大模型落地。由于过分注重尺度定律,人力、算力等大量资源资源投入到尺度定律,导致基层研究人员没有足够多的计算资源研究新的模型路线,挤压创新空间。青年科学家共同探讨大模型技术架构的未来可能性人工
AI大模型助力前列腺癌无创精准诊断与分级
海军军医大学第二附属医院(上海长征医院)泌尿外科教授任善成团队联合国内多家单位,构建了一种基于人工智能(AI)的前列腺癌影像—病理基础模型,可从磁共振影像中无创预测肿瘤侵袭性,且诊断性能显著优于现有临床方法,为前列腺癌无创精准诊断与分级提供了新方向。相关研究9月2日发表于《自然-癌症》。前列腺癌已成
网宿科技:边缘计算将在大模型时代迎来更多用武之地
近日,在全球边缘计算大会上,网宿科技携网宿边缘智能平台重磅亮相,并分享了网宿边缘计算对于大模型时代的思考与探索。 网宿科技边缘智能平台资深架构师陈云辉表示,在未来大模型将成为一种基础设施,每个行业甚至每个企业都会有属于自己的大模型。而如何更好地将大模型落地到具体应用场景、提升生产力,是产业共同
北大成立大模型联合实验室
12月12日,北京大学联合字节跳动成立豆包大模型系统软件联合实验室,校企携手面向人工智能系统软件开展科学研究和技术转化,培养高素质创新型软件人才。 “以大模型为代表的人工智能技术的迭代升级,正以前所未有的速度推进。对于大模型而言,高效能、大规模的算力资源管理是重大需求,而系统软件是解决这一需求
直面大模型“大成本”挑战,如何提高算力效率?
近年来,为了追求大模型的智慧能力,各国公司不停加码投入,4月,Meta宣布追加10亿美元投资,用于其AI芯片研发和AI数据中心建设;亚马逊为了建设新数据中心投入110亿美元。但在大模型扩张的背后,算力代价、能源代价同样巨大。有业界技术团队测算,若要对一个5000亿参数规模的单体大模型进行充分训练,所
用AI生成数据训练AI或导致模型崩溃
科技日报北京7月25日电 (记者张梦然)《自然》24日正式发表的一篇研究论文指出了一个人工智能(AI)严重问题:用AI生成的数据集训练未来几代机器学习模型,可能会严重“污染”它们的输出,这被称为“模型崩溃”。研究显示,原始内容会在9次迭代以后,变成不相关的“胡言乱语”(演示中一个建筑文本最终变成了野
用AI生成数据训练AI或导致模型崩溃
《自然》24日正式发表的一篇研究论文指出了一个人工智能(AI)严重问题:用AI生成的数据集训练未来几代机器学习模型,可能会严重“污染”它们的输出,这被称为“模型崩溃”。研究显示,原始内容会在9次迭代以后,变成不相关的“胡言乱语”(演示中一个建筑文本最终变成了野兔的名字),这凸显出使用可靠数据训练
再次提高上限-夸克健康大模型通过12门主任医师考试
7月23日,夸克健康大模型成功通过中国12门核心学科的主任医师笔试评测。目前,“主任级 AI 医生”能力已全面集成至夸克的AI搜索中,用户在查询健康问题时,选择深度搜索即可调用。 这是继5月通过副主任医师职称考试后,夸克健康大模型能力的又一次跃升。在垂类模型与通用模型对比中,夸克健康大模型呈现
科大讯飞全国产深度推理模型星火X1实现升级
3月3日,记者从科大讯飞获悉,其自主研发的全国产深度推理大模型“星火X1”完成全面升级,并在医疗、教育等领域推出系列创新应用。科大讯飞表示,此次升级“充分证明基于国产算力训练的全栈自主可控大模型具备登顶业界最高水平的强大实力和持续创新的巨大潜力”。 在升级后的星火X1加持下,科大讯飞旗下讯飞晓
面对大模型应用门槛高-如何大模型发挥更大价值?
原文地址:http://news.sciencenet.cn/htmlnews/2022/9/485510.shtm 人工智能预训练大模型的研发,面临着数据规模大、数据质量参差不齐、模型体积大、训练难度高、算力需求大等一系列挑战。在这样的背景下,如何加速大模型的产业落地,让大模型发挥更大价值?