沙特阿拉伯公共投资基金(PIF)旗下机构 HUMAIN 近日发布了阿拉伯语大模型 HUMAIN-M3。该模型总参数达 4280 亿,每个 token 激活 230 亿参数,并使用超过 1 万亿个阿拉伯语 token 进行进一步训练,未来计划开放权重。
与某些国家修改开源模型并声称自主研发的做法不同,HUMAIN 在官方新闻稿中明确表示,该模型是委托中国公司 MiniMax 开发的,并以 MiniMax-M3 作为基座模型。在此合作中,沙特提供资金、算力和阿拉伯语本地数据,MiniMax 则提供已完成基础训练的模型。
这种合作模式首先为沙特节省了从头开始预训练所需的大量时间与试错成本。根据 HUMAIN 发布的数据,HUMAIN-M3 在七项公共阿拉伯语基准测试中的等权平均分达到 89.37%,比未经本地化训练的 M3 参考模型高出 9 个百分点,并在五项测试中获得最高分。通过这种方式,沙特无需从预训练的第一步开始即可构建本土模型,从而在数据、训练、服务和信息安全方面实现自主控制,建立起“AI 主权”。
这一事件标志着中国大语言模型出海迈上了新台阶。过去,中国主要向海外出口应用和 API,海外客户多为终端用户;如今,中国开始出口基座模型,海外客户可以在此基础上继续训练、重新命名,将其转化为自己的“国产 AI”。MiniMax 也不再仅仅向海外市场出售 API 调用量,而是深入到了其他国家模型研发的底层。
从更宏观的视角来看,中国的开源大语言模型正在包容各种语言,几乎正在成为全球 AI 的统一语言,即所谓的“公制”(metric system)。
原始来源: 36 氪 ↗
本文由博一・AI营销中枢整理编辑,用于行业观察分享。观点归原作者所有。