设置
  • 日夜间
    随系统
    浅色
    深色
  • 主题色

提高大语言模型可信度,新方法助生成式AI破除“幻觉”

发布时间: 2024-06-22 16:24:18 来源: 科技日报

 3WI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

人工智能(AI)在给出准确答案的同时,也会有一些“胡乱输出”令人难辨真假,这被称为“幻觉”(hallucination)。而新一期《自然》杂志发表的一项研究报道了一种新方法,能检测大语言模型(LLM)产生的“幻觉”,即该方法能测量生成回答的含义的不确定性,或能提升LLM输出答案的可靠性。
3WI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

类似ChatGPT和Gemini等LLM,是能阅读和生成自然人类语言的AI系统。不过,这类系统很容易产生所谓“幻觉”,即生成不准确或没有意义的内容。检测LLM出现的这种错误非常难,因为这些回答的呈现方式看起来很可信。3WI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

英国牛津大学研究团队此次尝试量化一个LLM产生此类错误的程度,从而判断生成的内容有多忠于提供的源内容。他们的方法能检测“编造”——这是幻觉的一个子类别,特指不准确和随意的内容,常出现在LLM缺乏某类知识的情况下。这种方法考虑了语言的微妙差别,以及回答如何能以不同的方式表达,从而拥有不同的含义。团队的研究表明,他们的方法能在LLM生成的个人简介,以及关于琐事、常识和生命科学这类话题的回答中识别出“编造”内容。3WI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

在同时发表的新闻与观点文章中,澳大利亚皇家墨尔本理工大学科学家指出,该方法由一个LLM完成,并通过第三个LLM进行评价,等于在“以毒攻毒”。文章写道,“用一个LLM评估一种基于LLM的方法似乎是在循环论证,而且可能有偏差。”不过,团队指出他们的方法有望帮助用户理解在哪些情况下使用LLM的回答需要注意,也意味着可以提高LLM在更多应用场景中的置信度。3WI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

12月16-17日,北京大学经济学院举办第六届“中国百所大学经济学院院长论坛”暨“首届孙尚清发展知识研究与交流奖颁奖典礼 堆叠、扭曲铜酸盐超导体的示意图。图片来源:物理学家组织网 几十年来,超导体一直是物理学界研究的热点。但这些允许 本次甘肃积石山6.2级地震,震中距青海省省界最近距离5公里,青海多地震感强烈。 在青海省海东市民和县中川乡金田村, 近日,美国化学会旗下C&EN杂志公布了2023年最“炫”的分子榜单。尽管这些分子很小,但其能量却很大,有些甚至可能改 2023年12月中旬以来,受冷空气持续影响,我国天气形势复杂,集中出现寒潮、雨雪、低温、冰冻等灾害性天气。 近日,中国科学院 关于对拟表扬2023年度甘肃省科技统计先进个人名单进行公示的通知 甘科计函〔2024〕15号 为树立典型、表扬先进, 。

本文链接:提高大语言模型可信度,新方法助生成式AI破除“幻觉”http://www.sushuapos.com/show-11-7468-0.html

声明:本网站为非营利性网站,本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇: 新技术可发现基因突变初期迹象

下一篇: 陕西省发布关键核心技术攻关项目答辩评审事项通知

热门资讯

推荐资讯

  • 日榜
  • 周榜
  • 月榜