在2024全国两会上,全国政协委员、中国科学院计算技术研究所研究员张云泉就发展国家“主权级大模型”话题接受了《中国科学报》的采访。
张云泉委员。受访者供图
他提出,大模型是实现新质智能生产力的重要手段,但目前我国在大模型研发及用于大模型训练的国产AI芯片方面显著落后,国家应该主导整合优质科研和产业力量,尽快训练出我国的“主权级大模型”。
张云泉解释说,“主权级大模型”是一个动态概念,指代一定时期内最高水平的基础大模型,它的通用智能水平最高、对算力要求最高,是一个国家AI水平的体现。同时,基础大模型的技术水平也深刻影响着大模型技术在行业落地应用中的智能水平。
目前,国产大模型的训练受到多方面的限制,其中尤以算力限制最为突出。为解决这个问题,张云泉专门做了调研。经过研判,他提出:“除了继续攻关人工智能芯片之外,我们能不能聚合中国的超算,为大模型预训练提供算力支撑?”
张云泉告诉《中国科学报》,训练大模型需要的算力特点,如大规模并行技术、高速互联网络等技术手段,超算系统都具备。同时,中国有一批超算方面的科学研究和工程技术人才,组织好人才开展技术攻关,研制大模型专用超算体系是可行的。
“我认为可以通过设立专项,研制支撑主权级大模型训练的超级计算机,以解燃眉之急。”张云泉提出,研制这样的超算设施,成本会高一些,但它解决的是主权大模型有或无的问题。同时,也要“两条腿走路”——国内人工智能芯片的研制要跟上,取得了突破后成本自然就会降下来。
他还提到,当前国产AI芯片的研发缺乏系统规划,各家各自为战,无法形成合力,这可能会延误高端国产AI芯片的进程。他建议国家相关部门应在顶层设计层面加以引导。
谈及希望上升到国家高度做这件事的原因,张云泉说,他注意到,国内一些企业倾向于使用国外的开源架构开发大模型,容易出现“重复造轮子”与“急于变现”的倾向,长此以往“容易错过原始创新”,还会延误主权级大模型的研发。
“中国可以有数百家机构做大模型的场景落地,通过与行业数据的结合挖掘大模型的应用潜力,但我们一定要有一支‘尖刀部队’,推动主权基础大模型的研制、迭代,以防未来再被‘卡脖子’。”张云泉对《中国科学报》说。
12月16~17日,“第一届集成芯片和芯粒大会”在上海举行。 在会上,国家自然科学基金委领导介绍了“集成芯片前沿技术 过去的数个月,对我国道路交通智能检测领域知名专家赵祥模教授来讲,一如既往地保持着忙碌而有序的“快节奏”,他从容地在多 中新网伦敦1月2日电 (彭欣怡)当地1月2日,英国气象局发布数据指出,2023年是英国自1884年有气象记录以来第二热的一年,仅 ? 夏培肃 (1923.7.28—2014.8.27),四川江津人 (今重庆江津),著名计算机专家和教育家,我国计算机研究的先驱和计算机事业 2023年12月28日,陕西省审计厅在官网发布《2023年第9号审计结果公告》,其中西安工业大学2020年度预算执行及其他财务收支 2023年12月28日,陕西省审计厅在官网发布《2023年第9号审计结果公告》,其中西北大学2019年度预算执行及财务收支情况审计 。本文链接:张云泉委员:整合力量研发国家“主权级大模型”http://www.sushuapos.com/show-11-3690-0.html
声明:本网站为非营利性网站,本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。
上一篇: 种康委员:推动原创研究核心问题在评价体系