设置
  • 日夜间
    随系统
    浅色
    深色
  • 主题色

AI心理推断能力或与人类相当,但不意味着它们有像人那样的情商

2024-05-23 17:32:07 来源: 中国科技网

新一期《自然·人类行为》发表论文显示,在测试追踪他人心理状态能力——也称心智理论(Theory of Mind)的任务中,两类大语言模型(LLM)在特定情况下的表现与人类相似,甚至更好。PSO速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

心智理论对人类社交互动十分重要,是人类沟通交流和产生共鸣的关键。之前的研究表明,LLM这类人工智能(AI)可以解决复杂的认知任务,如多选决策。不过,人们一直不清楚LLM在心智理论任务(被认为是人类独有的能力)中的表现是否也能比肩人类。PSO速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

此次,德国汉堡—埃彭多夫大学医学中心团队选择了能测试心智理论不同方面的任务,包括发现错误想法、理解间接言语以及识别失礼。他们随后比较了1907人与两个热门LLM家族——GPT和LLaMA2模型完成任务的能力。PSO速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

团队发现,GPT模型在识别间接要求、错误想法和误导方面的表现能达到甚至超越人类平均水平,而LLaMA2的表现逊于人类水平;在识别失礼方面,LLaMA2强于人类但GPT表现不佳。研究人员指出,LLaMA2的成功是因为回答的偏见程度较低,而不是因为真的对失礼敏感;GPT看起来的失利,其实是因为对坚持结论的超保守态度,而不是因为推理错误。PSO速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

研究团队认为,LLM在心智理论任务上的表现堪比人类,不等于它们具有人类般的“情商”,也不意味着它们能掌握心智理论。但他们也指出,这些结果是未来研究的重要基础,并建议进一步研究LLM在心理推断上的表现,以及这些表现会如何影响人类在人机交互中的认知。PSO速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

总编辑圈点:PSO速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

情商,就是情绪智力,主要是指人在情绪、情感、意志、耐受挫折等方面的品质。有时候,我们不知道如何回复上司的一句“辛苦了”,亲戚的一句“你这工作能挣多少”,也会求助大模型,希望这凝聚了人类智慧的语言模型能给出一些缓解尴尬或令人愉悦的建议。但大模型有情商吗?大模型可以表现出有情商的样子,但它显然无法揣测人心的幽微之处,也无法体会出所谓话外有话,这些独属于人类社交互动的复杂之处,大模型还需要进一步学习。PSO速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

新一期《自然·人类行为》发表论文显示,在测试追踪他人心理状态能力——也称心智理论(Theory of Mind)的任务中,两类大语言模型(LLM)在特定情况下的表现与人类相似,甚至更好。PSO速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

心智理论对人类社交互动十分重要,是人类沟通交流和产生共鸣的关键。之前的研究表明,LLM这类人工智能(AI)可以解决复杂的认知任务,如多选决策。不过,人们一直不清楚LLM在心智理论任务(被认为是人类独有的能力)中的表现是否也能比肩人类。PSO速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

此次,德国汉堡—埃彭多夫大学医学中心团队选择了能测试心智理论不同方面的任务,包括发现错误想法、理解间接言语以及识别失礼。他们随后比较了1907人与两个热门LLM家族——GPT和LLaMA2模型完成任务的能力。PSO速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

团队发现,GPT模型在识别间接要求、错误想法和误导方面的表现能达到甚至超越人类平均水平,而LLaMA2的表现逊于人类水平;在识别失礼方面,LLaMA2强于人类但GPT表现不佳。研究人员指出,LLaMA2的成功是因为回答的偏见程度较低,而不是因为真的对失礼敏感;GPT看起来的失利,其实是因为对坚持结论的超保守态度,而不是因为推理错误。PSO速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

研究团队认为,LLM在心智理论任务上的表现堪比人类,不等于它们具有人类般的“情商”,也不意味着它们能掌握心智理论。但他们也指出,这些结果是未来研究的重要基础,并建议进一步研究LLM在心理推断上的表现,以及这些表现会如何影响人类在人机交互中的认知。PSO速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

总编辑圈点:PSO速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

情商,就是情绪智力,主要是指人在情绪、情感、意志、耐受挫折等方面的品质。有时候,我们不知道如何回复上司的一句“辛苦了”,亲戚的一句“你这工作能挣多少”,也会求助大模型,希望这凝聚了人类智慧的语言模型能给出一些缓解尴尬或令人愉悦的建议。但大模型有情商吗?大模型可以表现出有情商的样子,但它显然无法揣测人心的幽微之处,也无法体会出所谓话外有话,这些独属于人类社交互动的复杂之处,大模型还需要进一步学习。PSO速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

本文链接:AI心理推断能力或与人类相当,但不意味着它们有像人那样的情商http://www.sushuapos.com/show-2-6208-0.html

声明:本网站为非营利性网站,本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇: 推动“昆蒙框架”落实,共筑生物多样性网络

下一篇: 破解“富矿挖不出宝藏”难题——山东探索科技金融新模式

热门资讯

  • 创新中药八子补肾胶囊抗衰老研究取得重大突破

    3月20日对于我国抗衰老研究是个特殊的日子,经过近3年的不懈努力,八子补肾胶囊抗衰老取得又一重大突破。挑战人类生命极限是摆在全球科学家面前的重大

  • 量子计算机能更好解决组合优化问题

    旅行推销员问题是一个经典的数学问题,也是一个组合优化问题。德国柏林弗雷大学和亥姆霍兹柏林能源与材料研究中心(HZB)科学家开展的一项新研究证明,量

  • 马斯克开源3140亿参数的Grok,大模型争相开源所为何求?

      马斯克开源3140亿参数的Grok,大模型争相开源所为何求?  作者:刘晓洁  特斯拉CEO埃隆・马斯克(Elon Musk)给大模型领域投下一枚重磅炸弹。  北京时间3月18日凌晨,马斯

  • 人工智能重新定义职场技能

    据阿根廷布宜诺斯艾利斯经济新闻网2月19日报道,在人工智能(AI)迅速重新定义就业格局的今天,通常被称为“软”技能的人类技能成为最有韧性、最有价值

  • CRISPR能消除培养细胞中艾滋病病毒

    荷兰阿姆斯特丹大学医学院科学家开展的一项新研究证明,利用最新CRISPR-Cas基因编辑技术,能消除实验室中受感染细胞内所有艾滋病病毒(HIV)的痕迹,为治愈

  • 省电“神器”是“黑科技”还是智商税?

    3月15日,我国一些地区停止居民集中供热。初春时节,乍暖还寒。停暖初期昼夜温差较大,老人、儿童等身体较弱者,可能需要使用电暖气、电热毯等取暖设备,这

  • 银鲳高质量染色体水平 参考基因组发布

    3月19日,记者从中国科学院海洋研究所了解到,该所研究团队在国际上首次发布了银鲳的高质量染色体水平参考基因组。相关研究论文近日在线发表于《自然

  • 小龙虾能将锂离子转入食物链

    从手机到手表再到电动汽车,锂离子充电电池为众多设备提供动力。但随着消费者丢弃电子产品的增加,越来越多的锂可能会进入环境。研究人员在美国化学会

  • 2999元!xiaomiCivi 4 Pro供不应求:春野绿配色好多门店缺货

    3月22日消息,xiaomi集团的许斐在微博上表示,xiaomiCivi 4 Pro的预售业绩远超预期,尤其是春野绿配色,许多门店都出现了缺货情况。据了解,xiaomiCivi 4 Pro的

  • 首发天玑9300+联发科最强芯片!vivo X100s Pro入网

    3月23日消息,据最新爆料,vivo X100s Pro已经获得3C认证,估计 会在5月份前后发布。该机可以看做是vivo X100 Pro的小迭代机型,属于半代升级款,与去年X90s类似

  • 英国2026年试飞电动“飞的”

    据英国《每日电讯报》网站3月18日报道,根据英国政府的新航空计划,首批电动飞行出租车将于2026年试飞。周一发布的《“飞行未来”行动计划》为飞行出

  • 新技术破解结核病“早发现早治疗”难题

    3月24日是第29个世界防治结核病日,我国的宣传主题是“你我共同努力,终结结核流行”。在北京大学社会化媒体研究中心21日举办的“技术升级,加速我国终

推荐资讯

  • 日榜
  • 周榜
  • 月榜