一批海外模型“长”在中国开源底座上
北京日报客户端 | 记者 孙奇茹

2026-09-24 21:56 语音播报

城事

越来越多的全球人工智能创新,正“长”在中国开源模型之上。近来,多家海外公司推出的新模型,被证实分别基于智谱、月之暗面、DeepSeek等中国公司的开源基座模型开发。

比利时网络安全公司合气道安全(Aikido)于9月21日发布开放权重安全模型Altar,并表示该模型基于中国智谱公司的GLM-5.3开发。“我们选择GLM-5.3作为起点,是因为它是我们安全评测中表现最强的模型之一。”公司写道。

无独有偶,西班牙企业多元宇宙计算(Multiverse Computing)近日发布Quasar 1.1 438B模型,并在官网明确表示,该模型基于智谱的开放权重模型GLM-5.2开发,通过其名为CompactifAI的技术进行了改造。也就是说,这一被该企业在社交网络上冠以“欧洲最强AI模型”之称的成果并非从零训练的欧洲基础模型,而是以中国模型为底座、加入当地压缩及后训练技术的衍生模型。

这两个案例,并非中国开放权重模型进入海外人工智能产品研发链条的孤例。今年8月,美国法律人工智能企业哈维公司(Harvey)发布法律人工智能模型Tenet。哈维公司明确披露,Tenet以月之暗面的Kimi K3模型为基础,通过法律数据、专家数据及强化学习进行后训练(后训练是大模型预训练之后的关键优化阶段,‌通过微调和对齐等技术让通用模型变成能干活、懂规矩的专才)。

美国AI编程平台——“光标”代码编辑器(Cursor)所属公司此前发布编码模型Composer 2,则从Kimi K2.5开放底座出发,在代码数据上继续预训练,并进行大规模强化学习。该公司后来在技术报告中公开确认了这一模型与中国模型的“血缘”关系。

这一系列案例从侧面反映出的,是中国大模型正以一种颇为低调的方式出海:中国企业承担通用型基础模型研发,欧美企业利用开放权重进行压缩、行业后训练和产品化,再以本土模型的身份在当地市场亮相。中国模型正在进入欧美企业产品的技术栈,成为法律、编程等高价值行业的基础模型。业内人士分析,随着权重、数据、架构等技术成果更深融入全球AI(人工智能)研发和产业体系,中国开放权重模型在全球AI供应链中的作用不断增强,其国际影响正由产品出海进一步向技术输出延伸。


编辑:匡峰

打开APP阅读全文
APP内打开