设置
  • 日夜间
    随系统
    浅色
    深色
  • 主题色

人工智能“迎战”奥数难题

2024-08-05 16:19:22 来源: 中国科技网

继击败人类围棋大师和战略棋盘游戏顶尖高手之后,谷歌“深度思维”公司人工智能(AI)系统在英国巴斯举行的2024年国际数学奥林匹克竞赛(IMO)上,仅以1分之差与金牌失之交臂,获得了银牌。这是AI选手首次登上IMO领奖台。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

英国《自然》杂志网站在7月27日的报道中指出,“深度思维”正与其他公司竞相解决数学领域的疑难问题。近年来,IMO被广泛认为是对机器学习的一个挑战,也是衡量AI系统高级数学推理能力的理想基准。AI系统在今年IMO中的精彩表现,标志着其即将再下一城:在解决数学难题方面击败世界顶尖学生。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

首登领奖台kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

“深度思维”公司训练了一个专门用于解答数学奥赛考题的AI系统,成功解答了6道竞赛题中的4道,获得28分(满分42分),达到本次比赛银牌获得者的水平。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

该系统包括解答数学推理问题的模型AlphaProof和解答几何问题的模型AlphaGeometry的升级版AlphaGeometry 2。其中,AlphaGeometry 2解决了一个几何问题,而AlphaProof则解答了两个代数问题和一个数论问题。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

今年1月份,AlphaGeometry在解决欧几里得几何问题上,就已表现出奖牌级选手的水平。在今年的IMO比赛前,AlphaGeometry 2已经能够解决过去25年里83%的IMO几何问题,而其“前身”仅能解决53%。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

“深度思维”公司AI科学副总裁普什米特·科利指出,这是AI系统首次达到获IMO奖牌级别的性能。IMO主席格雷戈尔·多利纳尔也表示,AI最终将能比人类更好地解决大多数数学问题,其进步速度令人惊叹。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

几乎同一时间,软件公司Numina的科学家使用语言模型,赢得了AI数学奥林匹克奖(AIMO)的首个“进步奖”。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

但Numina团队在获奖后表示,要解决更难的数学问题,仅靠语言模型可能还不够。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

与自己对抗kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AlphaProof是一个自学习系统,其核心创新在于结合预训练语言模型与AlphaZero强化学习算法的策略。强化学习是机器学习领域一种重要的学习范式,系统可通过多次尝试找到自己的解题方法。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

这种方法需要用AI能理解和验证的语言编写大量问题,而大多数IMO问题都是用英语编写的。为解决这个问题,“深度思维”团队托马斯·赫伯特及其同事使用谷歌的大语言模型Gemini,将这些问题翻译成一种名为Lean的编程语言,以供AI进行学习。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AlphaProof使用经过微调的Gemini模型,自动将数学问题转换为Lean语言,从而创建了一个涵盖不同难度级别的大型问题库。在强化学习阶段,系统每验证一个证明,就用它来强化AlphaProof的语言模型,提高其解决后续更具挑战性问题的能力。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

赫伯特表示,在挑战围棋游戏时,他们也采用了类似的方法:AI通过与自己对抗,来学习如何更好地玩游戏。结果显示,在某些情况下,AlphaProof能够在无限多的可能性中迈出正确的一步,展现出“灵光一闪”的能力。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

仍有改进空间kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

尽管AlphaProof的表现令人印象深刻,但其速度相对较慢,解决3个问题耗费了3天时间,而人类参赛者仅需4个半小时。此外,它也未能回答两个与组合数学有关的问题。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

英国数学家约瑟夫·迈尔斯审查了AI在本次IMO比赛中给出的答案。他指出,AlphaProof采取的这些技术能否予以完善还有待观察。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

英国伦敦数学科学研究所何杨辉称,AlphaProof这样的系统对于帮助数学家证明问题很有用,但它无法帮助研究人员确定需要解决和研究的问题。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

“深度思维”团队表示,他们正继续探索多种用于推进数学推理的AI方法。未来,数学研究者将与AI合作,验证假说,尝试新方法来解决长期未解决的数学难题。他们也希望AlphaProof能够通过减少错误响应,帮助改进谷歌的大型语言模型。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

继击败人类围棋大师和战略棋盘游戏顶尖高手之后,谷歌“深度思维”公司人工智能(AI)系统在英国巴斯举行的2024年国际数学奥林匹克竞赛(IMO)上,仅以1分之差与金牌失之交臂,获得了银牌。这是AI选手首次登上IMO领奖台。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

英国《自然》杂志网站在7月27日的报道中指出,“深度思维”正与其他公司竞相解决数学领域的疑难问题。近年来,IMO被广泛认为是对机器学习的一个挑战,也是衡量AI系统高级数学推理能力的理想基准。AI系统在今年IMO中的精彩表现,标志着其即将再下一城:在解决数学难题方面击败世界顶尖学生。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

首登领奖台kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

“深度思维”公司训练了一个专门用于解答数学奥赛考题的AI系统,成功解答了6道竞赛题中的4道,获得28分(满分42分),达到本次比赛银牌获得者的水平。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

该系统包括解答数学推理问题的模型AlphaProof和解答几何问题的模型AlphaGeometry的升级版AlphaGeometry 2。其中,AlphaGeometry 2解决了一个几何问题,而AlphaProof则解答了两个代数问题和一个数论问题。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

今年1月份,AlphaGeometry在解决欧几里得几何问题上,就已表现出奖牌级选手的水平。在今年的IMO比赛前,AlphaGeometry 2已经能够解决过去25年里83%的IMO几何问题,而其“前身”仅能解决53%。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

“深度思维”公司AI科学副总裁普什米特·科利指出,这是AI系统首次达到获IMO奖牌级别的性能。IMO主席格雷戈尔·多利纳尔也表示,AI最终将能比人类更好地解决大多数数学问题,其进步速度令人惊叹。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

几乎同一时间,软件公司Numina的科学家使用语言模型,赢得了AI数学奥林匹克奖(AIMO)的首个“进步奖”。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

但Numina团队在获奖后表示,要解决更难的数学问题,仅靠语言模型可能还不够。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

与自己对抗kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AlphaProof是一个自学习系统,其核心创新在于结合预训练语言模型与AlphaZero强化学习算法的策略。强化学习是机器学习领域一种重要的学习范式,系统可通过多次尝试找到自己的解题方法。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

这种方法需要用AI能理解和验证的语言编写大量问题,而大多数IMO问题都是用英语编写的。为解决这个问题,“深度思维”团队托马斯·赫伯特及其同事使用谷歌的大语言模型Gemini,将这些问题翻译成一种名为Lean的编程语言,以供AI进行学习。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AlphaProof使用经过微调的Gemini模型,自动将数学问题转换为Lean语言,从而创建了一个涵盖不同难度级别的大型问题库。在强化学习阶段,系统每验证一个证明,就用它来强化AlphaProof的语言模型,提高其解决后续更具挑战性问题的能力。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

赫伯特表示,在挑战围棋游戏时,他们也采用了类似的方法:AI通过与自己对抗,来学习如何更好地玩游戏。结果显示,在某些情况下,AlphaProof能够在无限多的可能性中迈出正确的一步,展现出“灵光一闪”的能力。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

仍有改进空间kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

尽管AlphaProof的表现令人印象深刻,但其速度相对较慢,解决3个问题耗费了3天时间,而人类参赛者仅需4个半小时。此外,它也未能回答两个与组合数学有关的问题。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

英国数学家约瑟夫·迈尔斯审查了AI在本次IMO比赛中给出的答案。他指出,AlphaProof采取的这些技术能否予以完善还有待观察。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

英国伦敦数学科学研究所何杨辉称,AlphaProof这样的系统对于帮助数学家证明问题很有用,但它无法帮助研究人员确定需要解决和研究的问题。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

“深度思维”团队表示,他们正继续探索多种用于推进数学推理的AI方法。未来,数学研究者将与AI合作,验证假说,尝试新方法来解决长期未解决的数学难题。他们也希望AlphaProof能够通过减少错误响应,帮助改进谷歌的大型语言模型。kDr速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

本文链接:人工智能“迎战”奥数难题http://www.sushuapos.com/show-2-7828-0.html

声明:本网站为非营利性网站,本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇: 捕获原子充当晶体管,新型纳米光子电路显示量子网络潜力

下一篇: 从亿万年到半小时——我国生物炭高效制备及产业化攻关纪实

热门资讯

  • 云南首批621座变电站实现人工智能巡检

    “远方巡视启动!”南方电网云南保山220千伏大寨变电站日前启动首次全套智能巡视,109个摄像头快速旋转,10套在线监测系统开始收集数据,变电站的无人机机

  • 感染新冠会“导致智商下降”吗?

    据英国《泰晤士报》网站3月15日报道,2020年1月,英国帝国理工学院的亚当·汉普希尔与英国广播公司合作,对8万人进行了30分钟的测试,目的是揭示生

  • 科研人员在大别山区发现植物新物种

    据中国科学院武汉植物园消息,我国科研人员在大别山区开展植物多样性科学考察时,发现了天门冬科天门冬属新物种,并将其命名为大别山天门冬。相关研究成

  • 突发!Kimi,崩了!

    因流量突然剧增,3月21日,陆续有用户在社交平台上表示,月之暗面旗下大模型应用Kimi智能助手的APP和小程序均无法正常使用。截至记者发稿时,相关

  • 云海二号02组卫星发射成功

    记者从中国航天科技集团获悉,3月21日13时27分,长征二号丁运载火箭/远征三号上面级在酒泉卫星发射中心起飞,随后将云海二号02组卫星送入预定轨道,发射任

  • AI、死亡与机器人:“数字生命”背后的生意与争议

    21世纪经济报道记者 冯恋阁 王俊 广州、北京报道2013年播出的科幻电视剧《黑镜》第二季中有这样一个故事——女主角玛莎在男友艾什被车祸

  • 我国成功发射云海二号02组卫星

      我国成功发射云海二号02组卫星  中新网北京3月21日电(马帅莎 曹译 张艳)北京时间2024年3月21日13时27分,我国在酒泉卫星发射中心使用长征二号丁运载火箭/远征三号上面

  • 我国网民规模达10.92亿人:互联网普及率77.5%!

    3月22日消息,中国互联网络信息中心(CNNIC)今天发布了《中国互联网络变化状况计算报告》。《报告》显示,截至2023年12月,我国网民规模达10.92亿人,较2022年12

  • 【科技强国有我】让青年科技人才敢坐“冷板凳”

    习近平总书记在中共中央政治局第三次集体学习时强调,要加强科研学风作风建设,引导科技人员摒弃浮夸、祛除浮躁,坐住坐稳“冷板凳”。甘坐“冷板凳”是

  • 首发天玑9300+联发科最强芯片!vivo X100s Pro入网

    3月23日消息,据最新爆料,vivo X100s Pro已经获得3C认证,估计 会在5月份前后发布。该机可以看做是vivo X100 Pro的小迭代机型,属于半代升级款,与去年X90s类似

  • 1799元!红米狙击一加Ace3V 简直就是来捣乱的

    一加Ace 3V刚发布,就被红米砍了一刀!随着昨天一加Ace 3V的发布,新一轮中端机的内卷终于拉开了序幕。 而且这电话售价居然还不增反降,直接1999起步。 先来回

  • 人工智能大模型赋能企业科技创新研讨会召开

    3月21日,人工智能大模型赋能企业科技创新研讨会在广州召开。中国知网在会议期间发布了专利大数据智能应用产品“AI Pat+”。据中国知网相关负责人介

推荐资讯

  • 日榜
  • 周榜
  • 月榜