返回顶部
返回首页
返回首页
home 您现在的位置: 首页 >今日头条 > 详细信息

国产大模型改写全球AI调用版图

2026年08月12日    阅读量:20     新闻来源:中网行业信息网    |  投稿

近日,全球模型聚合平台OpenRouter最新周度Token(词元)调用榜单出现历史性变化:前五名全部为国产大模型,DeepSeek V4 Flash位居榜首,小米MiMo V2.5、腾讯Hy3、DeepSeek V4 Pro、智谱GLM5.2依次位列第二至第五名。DeepSeek V4 Flash正式版上线后,单日使用量和合作平台新订阅用户均实现约30%的增长,凭借突出的性价比优势,扭转全球AI开发者的使用格局。

  DeepSeek为何登顶全球调用榜?这体现了我国大模型产业怎样的竞争优势?记者就此采访了有关专家。

  第一问:DeepSeek为何登顶全球调用榜?

  对于“登顶”原因,中国电子信息产业发展研究院未来产业研究中心人工智能研究室主任钟新龙表示,直接原因是DeepSeek V4 Flash正式版的上线。

  他介绍,该正式版将此前发布的预览版的能力验证转化为稳定的商用服务,上线过程中,DeepSeek与合作平台同步推进旧有版本用户的迁移以及旧接口停用,使用户调用在短期内集中到该正式版。

  同时,极致性价比叠加智能体需求放大了该正式版的用户需求。数据显示,该版本官方价格为每百万Token输入1元、输出2元,且智能体应用场景Token消耗量大,市场需求水涨船高。据报道,该版本上线后,单日使用量和合作平台新订阅用户均增长30%,说明它的发布既提高了存量用户的使用频次,也带来了新增客户的入场。“可以理解为,正式版上线触发了需求,成本性能比和智能体生态又将需求持续放大。”钟新龙说。

  第二问:国产模型在技术层面有哪些优势?

  在国产模型包揽榜单前五的背景下,我国大模型在技术层面的优势值得关注。“国产大模型的突出优势,已经扩展到全链路工程能力。”钟新龙表示。

  以DeepSeek V4 Flash为例,通过混合专家、稀疏注意力和长上下文压缩等技术路径,在百万级上下文、推理能力、工具调用和低价格之间形成平衡;小米MiMo V2.5、腾讯Hy3、DeepSeek V4 Pro及智谱GLM 5.2,则分别在多模态、代码生成、长程规划和复杂推理等方向上形成互补。

  “更为关键的是,国内企业能够快速完成灰度测试、正式发布、接口迁移和多平台分发,从而将技术进步迅速转化为全球开发者的实际调用。”钟新龙说。

  第三问:将给国内AI企业带来哪些机遇与挑战?

  从更长周期看,国产模型在海外推理成本上的优势,正在为产业发展打开新空间。

  我国大模型普遍采用MoE(混合专家)架构,这一架构可以通过降低参数激活比来压缩推理成本。通俗来讲,一个公司有几十个专家,处理一个任务时,MoE架构下只需要“激活”几个最擅长的专家来完成,而不需要动用所有专家,从而实现有效“降本”。

  在钟新龙看来,国内AI企业可以利用该正式版发布的窗口吸引全球开发者,并由低价API(应用程序接口)服务逐步延伸至推理工具链、行业解决方案等高附加值环节,扩大发展空间。同时,调用量增长还将拉动国产推理芯片、服务器、存储等基础设施需求,为软硬件协同优化提供真实场景。

  不过,挑战同样不容忽视。钟新龙表示,高调用未必带来高利润,正式版发布形成的流量峰值会考验企业的算力供给、服务稳定性、故障恢复能力等,持续低价还可能压缩利润空间。此外,海外市场对版权合规、网络安全及审计等方面的要求日益严格,持续抬高合规门槛。“对国内企业而言,要进一步把价格优势转化为稳定服务能力、合规交付能力、开发者生态以及高价值应用。”钟新龙建议。

标签:今日头条技术中心
免责声明: 本文仅代表作者本人观点,与本网无关。本网对文中陈述、观点判断保持中立,不对所包含内容的准确性、可靠性或完整性提供任何明示或暗示的保证。请读者仅作参考,并请自行承担全部责任。本网转载自其它媒体的信息,转载目的在于传递更多信息,并不代表本网赞同其观点和对其真实性负责。如因作品内容、版权和其它问题需要同本网联系的,请在一周内进行,以便我们及时处理。客服邮箱:service@cnso360.com | 客服QQ:23341571

全站地图

深圳网络警察报警平台 深圳网络警
察报警平台

公共信息安全网络监察 公共信息安
全网络监察

经营性网站备案信息 经营性网站
备案信息

中国互联网举报中心 中国互联网
举报中心

中国文明网传播文明 中国文明网
传播文明

深圳市市场监督管理局企业主体身份公示 工商网监
电子标识