这款沙特模型,“底座”来自中国!
政事儿微信公众号  2026年09月07日

9月1日,沙特科技博主阿尔法伊菲(Sultan Alfaifi)在X平台兴冲冲地宣布了一个好消息:“100%沙特模型HUMAIN M3发布”。并且骄傲地表示该模型“超越全球最强AI模型,与我们的文化和语言完全兼容”。

undefined

什么时候沙特的AI水平也如此之高了?随着评论区对“100%沙特”的质疑,阿尔法伊菲立刻纠正,表示该模型其实是“基于MiniMax旗下的M3”。

这一表述“乌龙”的背后实际上是中国大模型另一种形式的出海。9月5日,中国驻沙特大使馆发文证实了这一消息。这一幕,对于几十年前的中国似曾相识。当个人电脑和互联网刚刚兴起的时候,我们必须学习Windows操作系统、office办公软件等,而这些“底层”软件的开发者来自西方。

undefined

2026年,随着AI时代来临,中国的大模型正在悄无声息地成为“别人家的Windows”,而且还更加“本地化”:国产大模型起到“底座”作用,辅以海湾地区的阿拉伯语语料,这一模式无疑能让模型更加适应当地用户的习惯。从另一个层面来看,这何尝不是中华文化兼容并蓄在AI领域的一种“延伸”呢?

七项阿拉伯语基准测试,平均分89.37%超过美国闭源大模型

据了解,HUMAIN是沙特公共投资基金(PIF)旗下的人工智能公司,由沙特王储穆罕默德·本·萨勒曼担任董事长,业务覆盖数据中心、云基础设施、模型及应用,可谓是沙特版本的“央企”,承担着推动沙特“2030愿景”、发展本土技术与创新能力的任务。

undefined

为何一家对于沙特如此重要的公司,会选择中国大模型作为底座?

最有说服力的莫过于二者“融合”后的模型性能:据HUMAIN官方公布的评测结果,HUMAIN M3在七项公开阿拉伯语基准测试中的等权平均分达到89.37%,评测覆盖阿拉伯语理解、知识、语言能力、真实性及检索增强生成等任务。

该测试的分项得分如下图所示,值得注意的是,和HUMAIN M3同场竞技的还有GPT-5.6 SOL和Opus 5这两款先进的美国闭源大模型。最终,七项测试中,HUMAIN M3有五项取得最高分,仅在检索增强生成和广泛知识翻译两项测试中以小数点后一位的微弱劣势未能夺冠。

undefined

值得注意的是,上述测试中,还包括作为对比项的底座M3。可以发现,在阿拉伯语这个垂直赛道,HUMAIN M3比原版M3的成绩有了平均接近10%的巨大提升。

在性能提升的背后,HUMAIN M3采用4280亿参数的混合专家(MoE)架构,每个Token激活230亿参数。在底座M3模型的基础上,HUMAIN M3进行了超过1万亿Token的阿拉伯语专项训练,重点强化阿拉伯语理解与生成、本地文化适配,以及Agent、工具调用和计算机操作等能力,这才有了这个阿拉伯语“特长”的大语言模型。

HUMAIN首席执行官塔里克·阿明表示,“阿拉伯语拥有数亿使用者,但在人工智能前沿领域的代表性却仍严重不足。通过HUMAIN M3.我们正致力于改变这一现状。”

开源模型底座+垂直场景微调,中国大模型

HUMAIN M3的优异表现,离不开中国大模型打下的“基础”。

MiniMax M3于今年6月发布并开源,是MiniMax面向Coding、Agent和原生多模态场景打造的旗舰模型。模型从训练初期即进行文本、图像和视频的多模态混合训练,支持百万Token级上下文。

这次与HUMAIN的合作中,体现了通用底座与本地化能力之间的分工:M3提供已有的模型架构和通用能力,阿拉伯语专项训练则进一步适配当地的语言表达、知识和文化语境。针对形态复杂、方言分化严重、高质量语料长期稀缺的阿拉伯语,M3展现出了优秀的“兼容并蓄”能力。不同国家的合作方都可以在模型的已有能力之上,继续发展适合自身需求的模型,通过“强底座+本地化深度训练”的范式,形成1+1>2的效果。

除了优秀的性能外,较低的成本也是中国大模型广受青睐的原因,据《纽约时报》报道,肯尼亚创业者的法律检索系统用中国模型成本约2.5万美元,用Claude则要超过100万美元。肯尼亚内罗毕数字营销机构创始人Moses Kemibaro(摩西·凯米巴罗)上周在个人博客发文称,“视模型、工作负载和算力配置而定,中国开放权重模型在某些情况下最多便宜90%”

在高性价比的背后,中国大模型出海的形式已悄然升级。以往中国大模型出海,更多是卖API、卖产品、卖解决方案,本质上还是“卖服务”;而这一次,沙特直接把中国的开源模型当作技术底座,在其之上训练出属于自己的国家级大模型。这有些类似于帮助海外运营商建设通信网络:中国输出的不再只是最终产品,而是帮助别国建立起自主数字能力的“基础设施”。

开源的意义也正在于此。世界各地的人们,可以基于同一个强大的开源底座进行训练,形成各自语言、各自文化的大模型,阿拉伯语的HUMAIN M3如此,其他语言也正在向这一方向发展。例如,乐天Rakuten AI 3.0日语模型的底层架构是DeepSeek V3、新加坡SEA-LION(海狮)V4模型的底座是Qwen。

这种企业间自发的技术合作,与国家层面推动的全球AI合作方向恰好同频。在此前举行的世界人工智能大会(WAIC)上,中国专门提出面向阿拉伯国家联盟建设国际AI应用合作中心,倡导“坚持开放共赢,驱动创新发展;鼓励包容并蓄,促进文明互鉴;支持全球人工智能能力建设”。HUMAIN M3正是这些理念的一次生动注脚:中国坚持开源底座,赋能整个开源生态,让阿拉伯语这种在AI前沿长期“代表性不足”的语言,拥有了不输英语大模型的先进模型。

上周,LEAP科技展同步在利雅得举办。中国企业在此次展会上带来了人工智能、机器人、云计算、智能终端等领域的创新成果。中国驻沙特大使常华在现场表示,中国“一带一路”倡议与沙特“2030愿景”战略高度契合,为两国科技合作开辟了广阔空间。

回到开头那场“乌龙”。沙特博主从“100%沙特模型”到改口“基于MiniMax M3”,这个小小的更正,恰是中国大模型全球位置变化的缩影:几十年前,我们学习Windows,西方软件定义了数字世界的基础规则;几十年后,阿拉伯世界最前沿的大模型,底座来自中国。

假以时日,全球主要语言都可能出现属于自己的“M3”,而它们的底座一栏,写着的是中国模型的名字,这或许才是中国大模型开源的最大价值。真正强大的技术,从来不是锁在高墙后的黑箱,而是能被全世界拿来、改造、再生长的土壤。当越来越多语言、越来越多文明选择在中国开源模型之上构建自己的AI未来,中国大模型才算真正走出国门。

编辑:刘素素