近日,全球模型聚合平台OpenRouter最新周度Token(词元)调用榜单出现历史性变化:前五名全部为国产大模型,DeepSeek V4 Flash位居榜首,小米MiMo V2.5、腾讯Hy3、DeepSeek V4 Pro、智谱GLM5.2依次位列第二至第五名。DeepSeek V4 Flash正式版上线后,单日使用量和合作平台新订阅用户均实现约30%的增长,凭借突出的性价比优势,扭转全球AI开发者的使用格局。
DeepSeek为何登顶全球调用榜?这体现了我国大模型产业怎样的竞争优势?记者就此采访了有关专家。
第一问:DeepSeek为何登顶全球调用榜?
对于“登顶”原因,中国电子信息产业发展研究院未来产业研究中心人工智能研究室主任钟新龙表示,直接原因是DeepSeek V4 Flash正式版的上线。
他介绍,该正式版将此前发布的预览版的能力验证转化为稳定的商用服务,上线过程中,DeepSeek与合作平台同步推进旧有版本用户的迁移以及旧接口停用,使用户调用在短期内集中到该正式版。
同时,极致性价比叠加智能体需求放大了该正式版的用户需求。数据显示,该版本官方价格为每百万Token输入1元、输出2元,且智能体应用场景Token消耗量大,市场需求水涨船高。据报道,该版本上线后,单日使用量和合作平台新订阅用户均增长30%,说明它的发布既提高了存量用户的使用频次,也带来了新增客户的入场。“可以理解为,正式版上线触发了需求,成本性能比和智能体生态又将需求持续放大。”钟新龙说。
第二问:国产模型在技术层面有哪些优势?
在国产模型包揽榜单前五的背景下,我国大模型在技术层面的优势值得关注。“国产大模型的突出优势,已经扩展到全链路工程能力。”钟新龙表示。
以DeepSeek V4 Flash为例,通过混合专家、稀疏注意力和长上下文压缩等技术路径,在百万级上下文、推理能力、工具调用和低价格之间形成平衡;小米MiMo V2.5、腾讯Hy3、DeepSeek V4 Pro及智谱GLM 5.2,则分别在多模态、代码生成、长程规划和复杂推理等方向上形成互补。
“更为关键的是,国内企业能够快速完成灰度测试、正式发布、接口迁移和多平台分发,从而将技术进步迅速转化为全球开发者的实际调用。”钟新龙说。
第三问:将给国内AI企业带来哪些机遇与挑战?
从更长周期看,国产模型在海外推理成本上的优势,正在为产业发展打开新空间。
我国大模型普遍采用MoE(混合专家)架构,这一架构可以通过降低参数激活比来压缩推理成本。通俗来讲,一个公司有几十个专家,处理一个任务时,MoE架构下只需要“激活”几个最擅长的专家来完成,而不需要动用所有专家,从而实现有效“降本”。
在钟新龙看来,国内AI企业可以利用该正式版发布的窗口吸引全球开发者,并由低价API(应用程序接口)服务逐步延伸至推理工具链、行业解决方案等高附加值环节,扩大发展空间。同时,调用量增长还将拉动国产推理芯片、服务器、存储等基础设施需求,为软硬件协同优化提供真实场景。
不过,挑战同样不容忽视。钟新龙表示,高调用未必带来高利润,正式版发布形成的流量峰值会考验企业的算力供给、服务稳定性、故障恢复能力等,持续低价还可能压缩利润空间。此外,海外市场对版权合规、网络安全及审计等方面的要求日益严格,持续抬高合规门槛。“对国内企业而言,要进一步把价格优势转化为稳定服务能力、合规交付能力、开发者生态以及高价值应用。”钟新龙建议。
近日,全球模型聚合平台OpenRouter最新周度Token(词元)调用榜单出现历史性变化:前五名全部为国产大模型,DeepSeek V4 Flash位居榜首,小米MiMo V2.5、腾讯Hy3、DeepSeek V4 Pro、智谱GLM5.2依次位列第二至第五名。DeepSeek V4 Flash正式版上线后,单日使用量和合作平台新订阅用户均实现约30%的增长,凭借突出的性价比优势,扭转全球AI开发者的使用格局。
DeepSeek为何登顶全球调用榜?这体现了我国大模型产业怎样的竞争优势?记者就此采访了有关专家。
第一问:DeepSeek为何登顶全球调用榜?
对于“登顶”原因,中国电子信息产业发展研究院未来产业研究中心人工智能研究室主任钟新龙表示,直接原因是DeepSeek V4 Flash正式版的上线。
他介绍,该正式版将此前发布的预览版的能力验证转化为稳定的商用服务,上线过程中,DeepSeek与合作平台同步推进旧有版本用户的迁移以及旧接口停用,使用户调用在短期内集中到该正式版。
同时,极致性价比叠加智能体需求放大了该正式版的用户需求。数据显示,该版本官方价格为每百万Token输入1元、输出2元,且智能体应用场景Token消耗量大,市场需求水涨船高。据报道,该版本上线后,单日使用量和合作平台新订阅用户均增长30%,说明它的发布既提高了存量用户的使用频次,也带来了新增客户的入场。“可以理解为,正式版上线触发了需求,成本性能比和智能体生态又将需求持续放大。”钟新龙说。
第二问:国产模型在技术层面有哪些优势?
在国产模型包揽榜单前五的背景下,我国大模型在技术层面的优势值得关注。“国产大模型的突出优势,已经扩展到全链路工程能力。”钟新龙表示。
以DeepSeek V4 Flash为例,通过混合专家、稀疏注意力和长上下文压缩等技术路径,在百万级上下文、推理能力、工具调用和低价格之间形成平衡;小米MiMo V2.5、腾讯Hy3、DeepSeek V4 Pro及智谱GLM 5.2,则分别在多模态、代码生成、长程规划和复杂推理等方向上形成互补。
“更为关键的是,国内企业能够快速完成灰度测试、正式发布、接口迁移和多平台分发,从而将技术进步迅速转化为全球开发者的实际调用。”钟新龙说。
第三问:将给国内AI企业带来哪些机遇与挑战?
从更长周期看,国产模型在海外推理成本上的优势,正在为产业发展打开新空间。
我国大模型普遍采用MoE(混合专家)架构,这一架构可以通过降低参数激活比来压缩推理成本。通俗来讲,一个公司有几十个专家,处理一个任务时,MoE架构下只需要“激活”几个最擅长的专家来完成,而不需要动用所有专家,从而实现有效“降本”。
在钟新龙看来,国内AI企业可以利用该正式版发布的窗口吸引全球开发者,并由低价API(应用程序接口)服务逐步延伸至推理工具链、行业解决方案等高附加值环节,扩大发展空间。同时,调用量增长还将拉动国产推理芯片、服务器、存储等基础设施需求,为软硬件协同优化提供真实场景。
不过,挑战同样不容忽视。钟新龙表示,高调用未必带来高利润,正式版发布形成的流量峰值会考验企业的算力供给、服务稳定性、故障恢复能力等,持续低价还可能压缩利润空间。此外,海外市场对版权合规、网络安全及审计等方面的要求日益严格,持续抬高合规门槛。“对国内企业而言,要进一步把价格优势转化为稳定服务能力、合规交付能力、开发者生态以及高价值应用。”钟新龙建议。
南方财经全媒体记者 吴立洋 上海报道日前,2024中国家电及消费电子博览会(AWE)在上海新国际博览中心闭幕。作为一年一度的家电产业盛会,AWE既是各大厂商展示新技术与新产品的重要节点,也是 21世纪经济报道见习记者 顾婷婷 杭州报道如何让沉睡在实验室里的专利真正应用到车间,真正面向市场,转化为真正的新质生产力?3月19日,由国家知识产权局组织的高校和科研机构存量专利盘活 英国《自然》周刊网站3月12日刊登题为《OpenAI的文生视频工具Sora会如何改变科学——以及社会》的文章,作者为乔纳森·奥卡拉汉,内容编译如下:美国开放人工智能研究中心(OpenAI 人类的语言自产生以来,就不断演化发展。发音、词汇、语法的演变过程,是语言学家较为关注的领域。语言演化的根本动力是什么,演化又呈现出怎样的规律?我国科学家主导的一项心理学研究显示,人类的某 中国气象局下一代大气数值模式日前发布。该模式采用完全自主的动力框架算法——多矩约束有限体积方法为基础算法,进一步提升全球公里级和区域百米级尺度数值预报的精度,显著减小全球 联合国政府间气候变化专门委员会(IPCC)最新发布的评估报告显示,全球温升预计在2021年至2040年内达到1.5℃。报告指出,自IPCC第五次评估报告发布以来,全球减缓气候变化的政策和法律不断增多,但实施 。本文链接:国产大模型改写全球AI调用版图http://www.sushuapos.com/show-2-17099-0.html
声明:本网站为非营利性网站,本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。
上一篇: 禁止进口中国新型光模块是个“昏招”
下一篇: AI效率红利下,创业如何“超越代码”