ARTICLE DETAIL

资讯详情

深耕编程入门与网站建设的一线实战洞察。

中国大模型出海再突破!沙特合作、多国应用,成全球AI建设上游力量

中国大模型出海再突破!沙特合作、多国应用,成全球AI建设上游力量 沙特委托MiniMax开发阿拉伯语大模型沙特将本国阿拉伯语大模型的开发任务交给了MiniMax。9月3日沙特公共投资基金PIF旗下的HUMAIN发布阿拉伯语模型HUMAIN - M3它有4280亿总参数每个token激活230亿参数使用超过1万亿阿拉伯语tokens继续训练。模型部署在HUMAIN Node上未来还计划开放权重。HUMAIN的董事长是沙特王储小萨勒曼。模型开发合作模式及争议HUMAIN官方新闻稿表明模型经委托由中国公司MiniMax开发底座是MiniMax - M3。沙特拿出资本、算力和阿拉伯语数据MiniMax提供已完成基础训练的模型双方合作成果以沙特国家模型名义发布。然而发布前两天沙特科技博主Sultan Alfaifi抢先在X上称它是“100%沙特”模型帖子获28.5万次浏览后有人在评论区追问质疑后来博主更正称它基于MiniMax的M3这或许是AI骄傲让博主一时上头。合作带来的双赢成果沙特用资金、算力和本地数据换到了几年训练时间和模型控制权MiniMax也不再只向海外出售调用次数而是进入了他国模型研发的最底层。这意味着中国大模型出海往前推进了一层过去输出App和API海外客户是用户现在输出基础模型海外客户可以继续训练、重新命名将其变成自己的“国产AI”。更进一步中国的开源大模型正在容纳各种语言近乎成为世界AI的统一语言。沙特合作的战略意义2025年5月小萨勒曼亲自宣布成立HUMAIN该公司由沙特公共投资基金PIF持有业务覆盖数据中心、云、模型和应用。沙特要构建的是从算力到应用都尽量掌握在自己手里的AI体系。虽然沙特有钱、有能源也能买GPU但从零训练前沿模型需付出几年时间和大量失败成本。MiniMax提供已完成基础训练的模型沙特提供算力、本地数据和应用场景并继续训练这笔合作省下的首先是从零开始的时间。HUMAIN - M3在七项阿拉伯语公开基准上的等权平均分达到89.37%比未经本地化训练的M3参考模型高出9个百分点并在五项测试中取得最高分这证明一个国家建设本土模型不一定要从预训练的第一步开始。同时沙特也由此建立了AI主权数据、训练、服务、信息安全都能掌握在自己手里。中国模型成各国“自研”上游HUMAIN - M3并非个例越来越多海外机构所谓的“自研”不再是从第一块GPU、第一批预训练数据开始。它们掌握本地数据、完成后训练、负责部署和应用基础模型从全球开放模型中选择。此前Llama是常见选择现在中国模型大量进入。比如日本乐天发布Rakuten AI 3.0时强调是高性能日语模型但公开配置文件显示模型架构与DeepSeek有关新加坡国家研究基金支持的AI Singapore把Qwen3 - VL继续训练成Qwen - SEA - LION适配多种语言泰国CMKL大学用Qwen3.5做出泰英双语模型MANGO。围绕中国模型及其架构的本地化案例已覆盖至少九种非中文语言。此外Meta在训练新模型时使用了Qwen等开放模型Kimi也有相关应用案例如提供接入Claude Code的兼容方案Mozilla技术负责人把不少日常任务转向Kimi K3。MiniMax、Qwen、DeepSeek和Kimi的开源路线得到肯定它们填补了从头预训练太贵和长期调用闭源模型把数据和服务交给供应商之间的空白。Hugging Face数据显示过去一年中国研发的模型占平台下载量的41%首次超过美国仅Qwen家族就已衍生出超过11.3万个模型中国开放模型开始成为各国建设本土模型绕不开的上游。中国开放模型提升全球AI及格线过去几年GPT和Claude定义了模型能力的上限新模型发布需证明与它们的差距。中国开放模型虽未取代这套标准却改变了及格线让海外模型采购需考虑与中国开放模型相比单位能力的价格、能否拿到权重、政府和企业能否把数据留在自己服务器等问题。沙特国家级平台、日本企业、新加坡国家项目和Meta等的行动让中国开放模型成为一套共同的度量衡。中国参与建设的世界人工智能合作组织WAICO推动全球南方的AI能力建设还提出面向阿盟建设国际AI应用合作中心HUMAIN - M3与该政策方向一致但目前无公开材料证明由WAICO直接撮合更像是商业需求先于政策发展。不过中国模型成为度量衡后开放权重虽方便客户采用和更换底座但模型被重新训练和命名后中国品牌可能完全消失。MiniMax使用的社区许可接近“开放权重”是token经济的全新范式。
返回列表