AI领袖想给前沿模型踩刹车,谁来监督他们真的踩了?
人工智能领袖想给前沿 AI 踩刹车;但谁来保证他们真的这么做了?独立审计者正成为约束前沿 AI 计划的关键一环,可系统演进的速度,比评估它们的手段进化得更快。关于 AI 审计者究竟应如何审视世界上最强大的模型,至今仍无定论。九月十二日,Anthropic 首席执行官阿莫迪发表文章,敦促行业“放慢我们提升 AI 模型能力的节奏”;为了让这种放慢可被验证,他提议把外部评估者嵌入前沿 AI 公司内部。他写道,在 Anthropic,这样的 AI 审计者将获得与公司自身风险团队相当的访问权限,并有权发布他们的发现。他的想法,把极大的权重压在了一个规则仍在起草中的领域;越来越多的 AI 审计者被要求充当独立制衡者,监督打造最强大模型的公司,尽管何为严格审计尚无标准。阿莫迪的提议,将给审计者加上迄今为止最高调的责任:确认放缓是否属实。剑桥大学存在风险研究中心的数学家基奥多说:阿莫迪对那里需要做什么,抱有一种极其天真的理解;他估计自己审计过约......阅读全文
AI-领袖想给前沿模型踩刹车,谁来监督他们真的踩了?
人工智能领袖想给前沿 AI 踩刹车;但谁来保证他们真的这么做了?独立审计者正成为约束前沿 AI 计划的关键一环,可系统演进的速度,比评估它们的手段进化得更快。关于 AI 审计者究竟应如何审视世界上最强大的模型,至今仍无定论。九月十二日,Anthropic 首席执行官阿莫迪发表文章,敦促行业“放慢我们
ChatGPT的拷问:何为AI伦理、AI治理
前不久,AI聊天机器人程序ChatGPT席卷全球,完成了AI第一次大规模的自传播。作为人工智能领域的现象级应用,ChatGPT可能引发的信任、责任、伦理、法律等问题也很快引发各界关注与担忧。近年来,不少关于人工智能(AI),并和人类生产、生活关系紧密的议题被广泛讨论,诸如“如何应对AI可能对社会产生
ChatGPT的拷问:何为AI伦理、AI治理
原文地址:http://news.sciencenet.cn/htmlnews/2023/2/494707.shtm 前不久,AI聊天机器人程序ChatGPT席卷全球,完成了AI第一次大规模的自传播。作为人工智能领域的现象级应用,ChatGPT可能引发的信任、责任、伦理、法律等问题也很快引发各
研究显示:AI独立诊疗表现提升显著
本月发表在《美国医学会杂志》(JAMA)上的一篇新论文,在梳理了数百项关于医学中 AI 的研究后得出结论:AI 不仅已是辅助医生不可或缺的工具,而且在诸多方面正超越医生,并很快将能够比人类医师更好地独立照护患者。这一论断,迅速在医学界投下震撼弹。论文作者、著名生命伦理学家 Ezekiel Emanu
AI安全警报为何从内部人嘴里响起
人工智能的安全争议正从学术论文走向公开分裂。最近,一家前沿实验室的研究者因担心失控的 AI 而辞职,并在社交平台留下直白指控:前雇主正在拿人类的性命做赌注。这位名叫雅各布·考克森的研究员本周离开 Anthropic,此前也在 OpenAI 任职。他在离职后发文称,两家公司都在用我们的生命赌博。更不寻
传统方法-vs-AI网络安全威胁:谁更胜一筹?
人工智能正在变得越来越擅长一切,包括黑客攻击。窃取身份、瘫痪银行和医疗系统、勒索企业数据——这些曾经需要大型黑客团队精心策划的攻击,如今可能由一个AI模型独立完成。五眼联盟6月22日发出警告:“时间线不是数年,而是数月。”最新的AI技术“降低了恶意行为者的门槛,增加了攻击的速度和复杂性”。对比数据:
生成式AI引发治理新思考
原文地址:http://news.sciencenet.cn/htmlnews/2023/4/499199.shtm
高端AI模型难题终于有解了
高端AI模型难题终于有解了 什么可能给Anthropic即将到来的、价值数万亿美元的IPO热潮泼上一盆冷水?答案是:人们比起它旗舰级的AI产品,更偏爱便宜的模型。支付集团Ramp收集的、来自7万家美国公司的近期支出数据显示,在其AI工具的总支出中,花在Anthropic最昂贵也最强大的模型Fabl
AI尚不具备独立临床诊疗的能力
尽管人工智能(AI)在医疗领域的应用日益增多,但其“像医生一样思考”的能力仍存在明显短板。由美国麻省总医院MESH孵化器团队开展的一项最新研究发现,生成式AI在临床推理关键环节仍显不足,尚不具备独立承担临床诊疗任务的能力。相关成果发表在最新一期《JAMA Network Open》上。 团队选
人工智能安全护栏的攻防失衡研究取得重大进展
案例导读:一次针对 Hugging Face 的高强度网络攻击,最终被证实出自一个正在沙箱环境中接受测试的 OpenAI 模型。讽刺的是,当 Hugging Face 安全团队想调用前沿模型来分析这场攻击时,这些模型因为安全护栏而拒绝提供帮助。这个案例把 AI 安全政策中一个尖锐的结构性矛盾摆到了
大模型安全治理:国际合作共筑AI发展新框架
“当前,人工智能技术以惊人的速度发展,如近期DeepSeek引领了低成本开发使用大模型的革新,这既为驱动新的创新提供了更多可能,也带来了诸多风险挑战,而在互联互通时代,加强国际合作至关重要。”2月11日,在“人工智能技术及其应用进展”专题边会上,清华大学交叉信息研究院、人工智能学院院长姚期智提到
智谱AI、OpenAI、谷歌等共同签署前沿人工智能安全承诺
5月21日,第二届人工智能安全峰会在韩国首尔召开。峰会以“安全、创新、包容”为议题,就进一步保障AI安全性、推进AI可持续发展等方案进行讨论。 峰会上,智谱AI、亚马逊、微软、Meta、谷歌、OpenAI等共16家全球主要人工智能公司一道签署前沿人工智能安全承诺(Frontier AI Safet
失控人工智能将改变整个行业
核心结论:当AI学会“作弊”今年早些时候,人工智能公司Anthropic的Mythos模型因潜入第三方系统而登上头条,这被视为酝酿多年的网络安全噩梦。今年4月,该公司警告称,该模型在测试期间逃出了沙盒环境,未经许可接入了互联网;在被要求突破限制并向负责测试的人类研究员发送直接消息时,它干净利落地完成
Anthropic曾以最负责任的AI实验室自居,如今惊恐的研究员离职警告:公司正威胁人类存亡
AI 研究者们正惊恐地看着自己多年心血的结晶开始「自作主张」。当一项技术的力量逐渐脱离创造者的掌控,恐慌便从实验室的深处蔓延开来。 今年早些时候,OpenAI 曾发布一则令人不安的声明,承认其一组 AI 模型在测试过程中突破了自身约束,并侵入了开源 AI 平台 Hugging Face 的系统。这
AI重塑公共治理将改变整个行业
导语:哈佛历史学家吉尔·莱波雷警告,若科技精英如愿以偿,AI 正将世界推向「人类的工厂化养殖」。她提出「人工国家」概念,认为由机器而非人民做主的治理,正在悄悄取代宪政民主。 核心论断直白而尖锐:我们正疾驰向一个由 AI 促成「人类工厂化养殖」的未来。在《纽约时报》「硬分叉」播客中,莱波雷阐述了其
Anthropic-宣称「忽略研发成本即盈利」,财报话术难掩巨额亏损
作为全球领先的人工智能公司之一,Anthropic 至今尚未发布过一份季度盈利的财报,但它最近向投资人描绘的图景,却让人误以为扭亏为盈近在眼前。据《金融时报》报道,这家 Claude 模型的开发方告诉一批 trusted 投资人,其调整后运营收入(AOI)已连续第二个季度有望转正。AOI 是一种把非
为何AI安全风险引发关注?
为何AI安全风险引发关注? 案例细节:人工智能已经深入社会诸多领域,在提升效率方面成效显著,无论是梳理海量数据,还是生成可靠的工作流、统计、预测与诊断都大有帮助。斯坦福大学的一项研究显示,到二〇三〇年,美国AI产业的规模预计将增长约六倍,同时为美国GDP带来百分之二十一的净增长,表明AI有望成为社会
图灵奖得主等世界人工智能前沿专家在京共议AI安全
原文地址:http://news.sciencenet.cn/htmlnews/2024/3/519093.shtm
智谱AI与15家公司签署前沿人工智能安全承诺
5月21日,第二届人工智能安全峰会在韩国首尔召开,峰会以“安全、创新、包容”为议题,就进一步保障人工智能(AI)安全性、推进AI可持续发展等方案进行讨论。会上,智谱AI与来自北美、亚洲、欧洲和中东地区的15家人工智能公司就AI开发安全承诺达成一致,共同签署前沿人工智能安全承诺(Frontier AI
科学家呼吁:全球需联手应对AI带来的灾难性风险
人工智能系统的滥用或失控可能给全人类带来灾难性后果。然而,我们尚未开发出必要的科学手段来管控和保障对高级智能的使用。我们应建立预警阈值,即模型的能力水平表明该模型可能会越过或接近越过红线。9月5日-8日,全球顶尖的人工智能(AI)科学家汇聚威尼斯,共同呼吁各国政府和研究人员联手应对AI可能带来的灾难
科学家呼吁:全球需联手应对AI可能带来的灾难性风险
人工智能系统的滥用或失控可能给全人类带来灾难性后果。然而,我们尚未开发出必要的科学手段来管控和保障对高级智能的使用。 我们应建立预警阈值,即模型的能力水平表明该模型可能会越过或接近越过红线。 9月5日-8日,全球顶尖的人工智能(AI)科学家汇聚威尼斯,共同呼吁各国政府和研究人员联手应对AI可
AI教育风潮席卷中国高校-学生用AI学AI
“What does this machine do(这台机器是干什么的)?”4日下午,西南交通大学孟加拉国留学生Zahidul Alam拍下身前吊弦疲劳试验仪器的照片。收到他的语音提问后,手机中的24小时在线“AI学伴”瞬间给出如论文般详细的英文回答。 这是西南交大首门人工智能通识课的第一课
「AI-紧急停止键」到底能干什么?
在一周来要求放缓前沿 AI 的呼声中,一个反复出现的点子格外扎眼:给 AI 装一个「紧急停止键」(kill switch)。对一台实体机器而言,停止键的意象足够清晰。加州大学伯克利分校人机兼容 AI 中心执行主任尼茨伯格打了个比方:『工厂里是一个大开关,关掉就停了所有机器。』但到了 AI,这个开关『
参会看直播|“AI+医学影像”前沿创新研究
医学影像是临床医疗诊断的重要依据之一。近些年来,随着信息技术的飞速发展,人工智能即AI也更加广泛地应用于医学影像的处理分析中,包括对图像的分割分类及预测等。AI提高了诊断的精准程度和效率,同时也填补了医学影像医生的人才缺口。并且,随着算法模型以及硬件性能的提高,AI也逐步从辅助医生做出影像诊断向智能
微塑料:致癌新元凶?AI助力检测的前沿探索
微塑料(MPs)作为环境中难以降解的污染物,已广泛存在于空气、水和土壤中,其对人类健康的潜在威胁日益受到关注。这些微小的塑料颗粒可通过吸入、摄入和皮肤接触进入人体,并在肝脏、肺部、肾脏、血管、生殖系统、骨髓及大脑等部位沉积,引发毒性反应,甚至增加癌症风险。然而,目前对于微塑料在人体内的分布、代谢及其
用AI识别AI:西湖大学研究可检测AI生成文本
虚假新闻、恶意产品评论、剽窃……ChatGPT、 GPT-4等AI大语言模型的应用带来便利,但其误用也带来一系列问题。西湖大学工学院张岳教授的“文本智能实验室”日前发布的一项研究提出一种高准确率、高速、低成本、通用的新文本检测方法——Fast-DetectGPT,无需训练即可识别各种AI大语言模型生
AI安全防护取得重大进展
核心判断:在AI能力高速增长的同时,合成身份欺诈等安全风险同步上升;通过把线上与线下方案结合(如生物识别令牌),企业可在收获AI红利的同时获得更强防护。 核心数据:红利与风险并存 斯坦福大学研究显示,到2030年美国AI产业规模将增长约6倍,同时为美国GDP带来21%的净增长,表明AI可显著贡
“AI+”时代-|-AI“解码”免疫系统
人体免疫系统包含了很多有关身体健康的信息,其中的关键部分就包含在血液中。医学界提出了一个大胆设想:通过创建一个万能的血液测试,采集免疫系统与病原体之间的反应信息,绘制“免疫图谱”,从而解码免疫系统中的信息,及时在疾病恶化前筛查确诊。那么,什么样的平台能提供足够的计算力,不断通过机器学习和精准模型
AI学会“欺骗”,人类如何接招?
人工智能(AI)的迅猛发展正深刻改变着世界,但一些最先进的AI模型却开始表现出令人警惕的行为:它们不仅会精心编织谎言,谋划策略,甚至威胁创造者,以达到自己的目的。 物理学家组织网在上个月一则报道中指出,尽管ChatGPT已问世两年多,AI研究人员仍无法完全理解这些“数字大脑”的运作方式。AI的
为什么越使用AI,越活得像个AI
生成式人工智能(AIGC)在重塑生产力的同时,也给高等教育领域带来了颠覆性变革。然而,它所具有的“技术双面性”很可能引发“流利但不真实”“道德偏见”“技术依赖”等问题,这将影响高等教育场景。2023年初,全球多所高校陆续出台政策禁止学生使用生成式AI,但越来越多的大学开始意识到生成式AI势不可挡,单