人格问卷构建难题终于有解了

导语:编制一份科学有效的人格问卷,往往要耗费研究者数月乃至数年。而一项发表于Cell Press旗下iScience期刊的新研究提出:让ChatGPT(GPT-4)从任意文本自动生成、验证并预测问卷结果,这一长期难题或许已经有了答案。由耶路撒冷希伯来大学Rotem Monsa领衔的研究团队,开发了一种用ChatGPT从任意源文本生成人格测评问卷的方法,并于8月6日发表在iScience。为检验该方法,他们刻意选用了两份反差极大的文本:临床用的《精神疾病诊断与统计手册》(DSM-5),以及一本并不科学的占星术教科书。结果显示,LLM生成的问卷从两类文本中都提取出有意义的人格信号——基于DSM-5的问卷表现出与金标准「大五人格量表」(BFI)相当的高内部一致性,而GPT-4还能在人类作答前,准确预测参与者将如何回答、并预判题目间的相关性模式。「鉴于人格特质反映于语言之中,LLM可能是在训练过程中,作为自然副产品习得了人类人格的结构,......阅读全文

人格问卷构建难题终于有解了

导语:编制一份科学有效的人格问卷,往往要耗费研究者数月乃至数年。而一项发表于Cell Press旗下iScience期刊的新研究提出:让ChatGPT(GPT-4)从任意文本自动生成、验证并预测问卷结果,这一长期难题或许已经有了答案。由耶路撒冷希伯来大学Rotem Monsa领衔的研究团队,开发了一

ChatGPT性格预测取得重大进展

导语:一项发表于Cell Press旗下iScience期刊(8月6日)的研究展示,利用GPT-4可以从任意文本自动生成、验证并预测人格评估问卷,且预测准确度令人惊讶。这标志着大语言模型在心理测量领域取得重大进展。 研究团队开发了一种新方法:用ChatGPT从任何来源文本生成人格评估问卷。为

商汤大模型多个评测表现超ChatGPT

本报讯 (记者沈湫莎)商汤科技近日公布了自研中文语言大模型“商量SenseChat 2.0”在MMLU、AGIEval、C-Eval三个权威大语言模型评测基准的成绩。评测显示,“商量”在这三个测试集中的表现均领先ChatGPT,实现了我国语言大模型研究的突破。      全球三大权威语言模型测评基准

ChatGPT进入课堂:语言模型如何改变教育

最近,教育心理学家罗纳德·贝格托(Ronald Beghetto)以一种引人注目的方式引领一群研究生和教育专业人员,与一系列以创造力为中心的聊天机器人进行了交流。这些聊天机器人由贝格托设计,即将托管在亚利桑那州立大学(ASU)设立的平台上。这些机器人使用与ChatGPT相同的人工智能(AI)技术,目

上海发布“书生·浦语”大模型:评测表现优秀

“书生·浦语”联合团队选取了20余项评测对其进行检验,其中包含全球最具影响力的四个综合性考试评测集,对“书生·浦语”、清华大学的GLM-130B、Meta的LLaMA-65B、OpenAI的ChatGPT和GPT-4进行了全面测试。6月7日,上海人工智能实验室(上海AI实验室)、商汤科技联合香港中文

“王炸”功能只给看,自然语言处理“战国时代”即将到来?

北京时间3月15日凌晨,人工智能初创公司OpenAI公布新一代人工智能语言模型GPT-4。与ChatGPT所用的模型相比,GPT-4不仅能够处理图像内容,而且在回答的细节和表述方面更有价值和人情味。“这是OpenAI努力扩展深度学习的最新里程碑。”OpenAI在当天的声明中这样表示。鉴于这是一个只训

压缩算法为大语言模型“瘦身”

据美国科学促进会旗下网站19日报道,美国普林斯顿大学和斯坦福大学团队开发出一种新压缩算法CALDERA,能精简大型语言模型(LLM)的海量数据,为LLM“瘦身”。这项算法不仅有助保护数据隐私、节约能源、降低成本,还能推动LLM在手机和笔记本电脑上高效使用。团队举例称,当人们使用ChatGPT时,请求

文心一言开启邀测,专家呼吁给中国类ChatGPT更多成长机会

距离新一代人工智能语言模型GPT-4发布不到24小时,国内互联网大厂百度3月16日发布了对标ChatGPT的AI产品——文心一言。 尽管百度创始人兼董事长李彦宏一上台就“降了音调”,表示推出文心一言是为了回应市场期待,产品本身并不完美,但仍然无法降低网友心中早已被拉满的期望值。文心一言开启邀请测试不

百度文心大模型3.5已内测应用,实测得分超ChatGPT

原文地址:http://news.sciencenet.cn/htmlnews/2023/6/503251.shtm 6月20日消息,据内部人士透露,百度文心大模型3.5版本已内测可用。早在5月末中关村论坛上,百度创始人、董事长兼CEO李彦宏透露,百度大模型产品“文心一言”的“母本”将迎来3.5

实测得分超ChatGPT!百度文心大模型3.5版内测应用

原文地址:http://news.sciencenet.cn/htmlnews/2023/6/503256.shtm 6月20日消息,据内部人士透露,百度文心大模型3.5版本已内测可用。早在5月末中关村论坛上,百度创始人、董事长兼CEO李彦宏透露,百度大模型产品“文心一言”的“母本”将迎来3.5

中科院心理所:大数据把脉社会心理态势

   信息科学技术的发展和互联网平台的出现,为及时有效感知社会心理态势提供了新的契机,使通过网络数据实现对用户心理要素的计算预测成为可能。  目前,国内的微博用户数量已近3亿人。不可否认,微博在快速改变传统网络舆论格局力量的同时,也逐渐展现出其自身所具有的独特优势。用户在微博平台上可以真实、自发地表

8个小技巧“用好”大语言模型

用大语言模型,还需要技巧?在人们的印象中,这是个极其简单的操作:只需输入一个问题,立刻就能得到回答。但实际上,如何有效地与这些人工智能模型互动,发挥出它们的最大潜力,却是一个经常被忽视的话题。中国科学技术大学心理学系特任研究员林志成关注到这一话题,并在他最近的评论文章中提供了一系列的策略和指导,希望

OpenAI正式发布GPT4

原文地址:http://news.sciencenet.cn/htmlnews/2024/1/515804.shtm (图片源自网络)3月15日,OpenAI发布了多模态预训练大模型GPT-4,这是其大型语言模型的最新版本。与此前的版本相比,GPT-4具备强大的识图能力,文字输入限制也提升至

商汤大模型“商量”多个评测表现超ChatGPT

原文地址:http://news.sciencenet.cn/htmlnews/2023/6/503362.shtm

评测成绩比肩GPT4,商汤日日新大模型再升级

原文地址:http://news.sciencenet.cn/htmlnews/2024/2/517164.shtm近日,商汤科技发布“日日新SenseNova 4.0”,多维度升级了大模型体系。据介绍,日日新SenseNova 4.0 具备更广泛的知识覆盖、更稳定的推理能力、更优秀的长文本理解力、

中科院心理所基于社交媒体语言表达心理幸福感感知模型

积极心理健康受到各个领域的关注,心理幸福感可以在一定程度上反映个体的心理健康水平。然而,民众的心理幸福感测量很难大规模实时评估。社交媒体的流行使非侵入性方式感知和了解在线用户的心理幸福感成为可能。中国科学院行为科学重点实验室朱廷劭研究组基于社交媒体用户的语言表达建立心理幸福感预测模型,并通过心理问卷

日本打造自己的“ChatGPT”

原文地址:http://news.sciencenet.cn/htmlnews/2023/9/508482.shtm日本正在打造自己的聊天机器人ChatGPT。日本政府和NEC、富士通、软银等大型科技公司正在投入数亿美元,开发基于相同底层技术的人工智能系统——大型语言模型(LLMs),使用语言为日语

新型AI芯片将大语言模型能耗减半

  美国俄勒冈州立大学科研团队研发出一种新型AI芯片,成功将大语言模型的能耗降低50%。这项成果于近期在波士顿举行的IEEE定制集成电路会议上发布,是半导体领域的重大突破,有望成为解决大语言模型高能耗问题的“绿色钥匙”。  当前,以谷歌“双子座”和OpenAI的GPT-4为代表的大语言模型,因海量参

新引擎实现大语言模型推理速度显著提升

原文地址:http://news.sciencenet.cn/htmlnews/2023/11/511841.shtm

用AI识别AI:西湖大学研究可检测AI生成文本

虚假新闻、恶意产品评论、剽窃……ChatGPT、 GPT-4等AI大语言模型的应用带来便利,但其误用也带来一系列问题。西湖大学工学院张岳教授的“文本智能实验室”日前发布的一项研究提出一种高准确率、高速、低成本、通用的新文本检测方法——Fast-DetectGPT,无需训练即可识别各种AI大语言模型生

利用“微博”行为可以预测用户的人格特征

  作为心理学的核心研究领域之一,人格代表了人际之间存在个性化差异的重要原因与心智基础。由于人格具有内隐性,需要借助外显行为来间接表达,因此如何有效地测量个体的人格特征是开展人格心理学研究的前提基础。传统的测量方法主要是采用自评问卷,但该方法在被试招募效率、测试资源消耗等诸多方面存在着局限,亟待改进

办公软件可一键生成PPT?微软抛出“王炸”全面植入GPT4

  ChatGPT引发的热潮仍在继续。  3月17日,微软宣布名为Microsoft 365 Copilot的AI产品将应用于该公司一些最受欢迎的商业应用程序中,包括Word、Excel、PowerPoint、Outlook、Teams等。Copilot基于型语言模型(LLM)基础之上,背后有来自于

OpenAI发布新品GPT4o,功能秒杀Siri

·GPT-4o可以对音频、视觉和文本进行实时推理,在232毫秒内响应音频输入,与人类在对话中的响应时间相似。·GPT-4o的文本和图像功能开始在ChatGPT中免费推出,音频模式存在各种新风险而未公开,未来音频输出将仅限于选定的预设声音,并要遵守安全政策。GPT-4o生成图像:机器人正在输入日志条目

教师该如何让ChatGPT为学术写作服务

原文地址:http://news.sciencenet.cn/htmlnews/2023/4/497763.shtm   ■郭英剑 ChatGPT诞生后,对于写作产生了巨大的影响。虽然此前已有很多致力于机器写作的应用程序,但大多限于日常生活交流的写作。相比之下,ChatGPT学术写

GPT4很强大但仍有诸多谜团,OpenAI选择只透露这么多

“(该模型) 仍然存在很多问题和错误……但你确实可以看到微积分或法律等技能的飞跃,从某些领域的非常糟糕到相对于人类来说实际上相当好。 ”从长远来看,OpenAI计划构建和部署可以处理多种媒体的系统,包括声音和视频。“我们可以采用所有这些通用知识技能,并将它们传播到各种不同领域。这将技术带入了一个全新

大语言模型在线辩论说服力超人类

实验设计示意图。图片来源:英国《自然·人类行为》在线版《自然·人类行为》19日发表的一项人工智能(AI)研究发现,在线辩论中,GPT-4一类的大语言模型(LLM)如能根据对手的个性化信息调整它们的论据,其说服力比人类辩手高出64%。研究结果显示了GPT-4生成有针对性和说服力论据的能力,揭示出AI工

AI预测调查将改变整个行业

大模型能相当准确地"猜"出社会实验的结果,但它真的理解人类行为吗?一项发表于《自然》的研究给出了令人惊讶的答案,也附带一句严肃的警告:能预测,不等于能理解。 问题提出 是什么让人改变想法或行为?社会科学家花大量时间思考这个问题,而受控实验是最有力的回答方式之一。但在真人身上检验想法,既费时又费钱

ChatGPT没有黑科技,机制创新值得借鉴

原文地址:http://news.sciencenet.cn/htmlnews/2023/4/498069.shtm 在与新必应(New Bing,集成了大语言模型GPT-4能力的搜索引擎)“深聊”之后,中国科学院计算技术研究所副所长、研究员包云岗发现了一点“规律”:对于一些需要精准答案的场景,GP

从ChatGPT看“从0到1”和“从1到100”

■吕乃基 转眼间,OpenAI发布ChatGPT已经一年多,但围绕其展开的话题仍然很“热”。 “从0到1”和“从1到100”是近年来常见于媒体的表述,前者指原始创新,后者意为原始创新落到实处并在各领域得到广泛应用。然而,究竟何为“1”?OpenAI发布ChatGPT前后的过程,其主线即“从0

从ChatGPT看“从0到1”和“从1到100”

  转眼间,OpenAI发布ChatGPT已经一年多,但围绕其展开的话题仍然很“热”。  “从0到1”和“从1到100”是近年来常见于媒体的表述,前者指原始创新,后者意为原始创新落到实处并在各领域得到广泛应用。然而,究竟何为“1”?OpenAI发布ChatGPT前后的过程,其主线即“从0到100”,