每经评论员 杜恒峰
7月16日,月之暗面推出新一代旗舰模型Kimi K3,在前端代码评测Arena榜单中,其代码生成能力登顶,成为首款在该赛道超越GPT、Claude等顶级闭源模型的开源权重大模型。Kimi K3发布后迅速引发全球AI(人工智能)行业震动,大量企业与开发者转向测试部署,由于算力告急,7月19日晚间,Kimi还暂停了C端新用户订阅。
到目前为止,中国大模型产业的发展可以划分成三个阶段。
在第一阶段,国内大模型整体处在“能用”的水平,起步时间晚于美国同行,上下文长度有限、逻辑推理偏差大、幻觉问题突出,在数学、代码、复杂长文本等核心任务上与同期海外模型存在显著代差,全球市场调用份额低,仅能满足基础文本问答等简单需求。
第二阶段以DeepSeek R1落地为分界,中国大模型完成了从“能用”到“好用”的跨越,产品实用性大幅提升并加速走向全球市场。据《每日经济新闻》报道,今年7月13日至19日这一周,全球AI大模型总调用量为62.2万亿token(词元),上榜AI大模型中,中国模型调用量36.11万亿token,美国为7.28万亿token,中国大模型调用量连续12周超过美国并稳居全球首位。
但这一阶段技术差距仍然显著,比如美国企业在处理复杂数学推演、高端多模态创作、深度科研推理等硬核任务时,仍会转回OpenAI、Anthropic闭源旗舰模型,高端复杂场景依旧存在能力代差。
第三阶段以Kimi K3为标志,中国大模型大幅缩小与美国顶级模型的综合差距。此前国产模型依靠极致性价比抢占基础调用市场,高端性能始终存在一层难以突破的天花板,而Kimi K3证明国产开源模型可在单一核心赛道实现对海外闭源头部的反超,打破“美国模型垄断高性能场景”的固有认知。
其中一个令人印象深刻的细节是,在连续48小时的自主智能体运行中,Kimi K3基于开源EDA(电子设计自动化)工具和Nangate 45nm工艺库,独立完成了芯片的构建、优化与验证,验证了复杂工程的能力,当天全球EDA巨头新思科技、铿腾电子盘中均一度大跌超12%。
从技术路径看,Kimi K3没有单纯依靠无限堆叠算力,而是通过MoE(混合专家)架构、注意力优化、缓存推理工程创新提升效率。由此,Arena榜单运营负责人也表示,Kimi K3或将倒逼投资者重新审视整个AI行业,可能“引发资本市场的重新洗牌”,因为它“动摇了OpenAI、Anthropic等美国闭源模型的主导地位”。
中国大模型能够实现能力和市场份额的快速提升,核心在于坚持开放开源与普惠。国内主流头部模型均选择开源权重、开放商用授权,相比闭源模型,其优势在于:企业可本地私有化部署,所有业务数据留存自有服务器,规避商业机密、客户数据外泄风险,尤其是可以规避核心能力被大模型公司复制的风险;硬件仅需一次性投入,无需持续支付高额按token计费的API(应用程序接口)账单,长期使用成本大幅降低。反观闭源模式,其存在不可控的断供风险,今年6月Anthropic旗下最强模型Fable 5上线仅3天,便被美国政府强行“停供”,海外用户瞬间丧失核心AI工具。
普惠层面,当前海外高端AI模型高昂调用成本让广大发展中国家难以承担,持续拉大全球数智鸿沟;国产模型凭借极低单价,让中小企业、科研机构、基层公共服务都能负担AI数字化改造,可以推动全球数字发展均衡化。
在大模型能力快速增强的过程中,中国的创新者们仍需保持足够的清醒。
仅从产品层面看,Kimi K3及同类国产模型仍存在明显的短板,比如综合通用能力不均衡、生态配套建设滞后、前沿基础创新偏少、高端商用落地验证不足等。更重要的是,大模型的发展是一个长期过程,企业之间的竞争必然要在更强大的模型能力上久久为功,今天领先的模型,明天就可能被赶上甚至超越,这需要持续坚定的投入。
就在不久前,包括智谱、MiniMax两家公司都明确提出了AGI(通用人工智能)的长期目标,而DeepSeek的特色在于其是一家独立的人工智能实验室,其长期目标也被认为专注于AGI,这一点也体现在其最近一轮融资当中(梁文锋个人出资200亿元,继续保持控股);就在7月19日,阿里Qwen3.8 Max预览版上线,官方自评“可能是除Fable 5外最强大的模型”;而DeepSeek也或将在近日发布DeepSeek-V4正式版。中国大模型仍在持续进化,也将给市场带来更多好消息。
封面图片来源:每日经济新闻
1本文为《每日经济新闻》原创作品。
2 未经《每日经济新闻》授权,不得以任何方式加以使用,包括但不限于转载、摘编、复制或建立镜像等,违者必究。