沙特与中国公司联手开发阿拉伯语大模型
沙特将阿拉伯语大模型的开发工作委托给中国的MiniMax公司。9月3日,沙特公共投资基金PIF旗下的HUMAIN发布了名为HUMAIN-M3的阿拉伯语模型,该模型参数达到4280亿,采用了230亿参数每个token的激活方式,并使用了逾1万亿的阿拉伯语tokens进行进一步训练。该模型部署在HUMAIN Node上,未来将公开权重。HUMAIN的董事长为沙特王储小萨勒曼。HUMAIN的官方声明明确表示,模型是由MiniMax开发,其基础为MiniMax-M3。沙特投入资金、计算能力和阿拉伯语数据,而MiniMax则提供了已完成基础训练的模型,双方的合作成果以沙特国家模型的名义发布。
在发布前两天,沙特的一位科技博主Sultan Alfaifi曾声称此模型是“100%沙特”,其帖子获得了28.5万次浏览,评论区有人对此提出质疑,导致博主更正说模型源自MiniMax的M3。沙特通过资金与资源获取控制权,旨在建立一个自主的AI体系,而不仅仅是一个能进行阿拉伯语对话的聊天机器人。
在2025年5月,小萨勒曼亲自宣布成立HUMAIN,这是一家涉及数据中心、云计算、模型和应用的公司,着重于将AI的开发和应用尽可能掌握在自己手中。虽然沙特拥有丰富的资金和能源,但想要从零开始训练前沿模型仍需要耗费多年的时间和巨额成本。MiniMax的预训练模型为沙特节省了大量时间,并使沙特得以在本土构建AI主权。 龙8头号玩家
HUMAIN-M3在七项阿拉伯语公开基准上平均得分达到89.37%,比没有经过本地化训练的参考模型高出9个百分点。虽然这些基准测试主要集中在阿拉伯语,但这表明建立本土模型并不一定要从预训练开始。沙特的例子展示了数据、训练、服务和信息安全的控制权得以实现。
同样,HUMAIN-M3并不是唯一的案例,越来越多的国际机构开始不再从头开始自研,而是选择在本地数据和框架上进行后续训练。日本乐天推出的Rakuten AI 3.0虽然声称是高性能的日语模型,但其配置中显示了“DeepseekV3ForCausalLM”的信息,暗示了对中国模型架构的应用。新加坡的AI Singapore也在对Qwen3-VL进行本地语言适应时使用了中国的模型架构。
此外,Meta在美国开发的模型Avocado中同样融合了来自Qwen、Gemma和OpenAI等的开放模型。即使是拥有顶尖研究团队的公司,也开始打破以往对自有材料的执着,采用开放的模型以更快更便宜的方式完成训练。 龙8头号玩家
如Kimi的案例所示,尽管存在一些不确定性,但其通过本地化支持了Claude Code的兼容性。多个模型的开发者一致认可开源路径的价值,认为这种方式避免了被单一闭源厂商锁定的风险。中国的开源模型正逐渐成为全球AI发展的重要基石。
发表评论