沙烏地 HUMAIN 押注中國:humain-m3 是建立在 MiniMax 之上的 428B 參數阿拉伯語前沿模型
HUMAIN 的 humain-m3 是以中國 MiniMax-M3 為基礎改造的 428B 參數阿拉伯語 MoE 模型,在七項阿拉伯語基準測試平均拿下 89.37%,於公司自測中擊敗 GPT-5.6 SOL 與 Opus 5。
利雅德 — LEAP 2026 上最具份量的模型發布,不是來自西方實驗室的全新旗艦,而是一個 4280 億參數的混合專家(MoE)系統:由沙烏地阿拉伯國家支持的 AI 公司 HUMAIN 委託、中國 MiniMax 打造,並在公司自己的基準測試表中,於阿拉伯語 AI 評測拿下最高平均分——超越 GPT-5.6 SOL 與 Anthropic 的 Opus 5。
這個名為 humain-m3 的模型已於 9 月 3 日(週四)在 HUMAIN Node 上線研究預覽版。這是主權 AI(sovereign AI)真正走向的最清晰訊號:並非每個國家都會從零訓練前沿模型,而通往前沿級語言能力的最快路徑,可能經過一座中國基礎模型、一兆(trillion)token 的阿拉伯語原生預訓練,以及最上層的主權推理平台。
HUMAIN 究竟打造了什麼
humain-m3 是建立在 MiniMax-M3 血緣之上的 428B 參數 MoE 模型。這個架構在內部保留了數千億參數,但每個 token 只激活約 230 億參數——正是這個效率技巧讓 MoE 成為前沿的主流設計:在保留總容量的同時,把推理成本壓在可管理的範圍。
基礎模型是 MiniMax-M3,由這家上海實驗室於 2026 年 6 月發布:原生多模態系統、100 萬 token 上下文視窗、約 428B 總參數、約 23B 激活參數。HUMAIN 的貢獻不是新的基礎架構,而是委託 MiniMax 將 M3 適配阿拉伯語:以超過一兆 token 的阿拉伯語原生內容進行再預訓練,再加上服務沙烏地本地工作負載所需的對齊與安全工作。
這個區別很重要。HUMAIN 明確稱之為「建立在 MiniMax-M3 血緣之上」的模型——委託改造,而非從零打造的國家級 LLM。它加入該公司既有的 ALLAM 阿拉伯語模型家族;後者中的 ALLAM 34B 今年稍早在 BALSAM 阿拉伯語排行榜名列第二,僅次於 GPT-5.2。
基準成績:七項阿拉伯語測試平均 89.37%
在 HUMAIN 自己的評測中,humain-m3 在七項等權重的公開阿拉伯語基準上平均達 89.37%,相較 MiniMax-M3 基準檢查點的 80.34%——提升了 9.03 個百分點,可歸功於阿拉伯語原生預訓練。該公司的對照表也將其置於 GPT-5.6 SOL(87.30%)與 Opus 5(87.34%)之上,並表示模型在七項測試中的五項領先。
測試集涵蓋阿拉伯語理解、原生與翻譯知識、學科考試、語言能力、真實性,以及檢索增強生成——範圍很廣,但總歸是一個平均數字。兩點必須強調:這些是 HUMAIN 自家對預覽檢查點的評測結果,並非獨立排名;單一平均分也無法取代針對特定部署任務的實測。但「中國前沿基座、針對阿拉伯語深度調優、在阿拉伯語工作上超越頂級西方閉源模型」這個模式,才是故事本身——小數點後的位數反而不是。
今日開放存取,權重明日再說(也許)
目前的實際產品是透過 HUMAIN Node——該公司的企業級模型存取與規模化推理平台——提供存取。開發者可用無程式碼的 playground,以及與 OpenAI 相容的 API。目前上線兩個層級:
- 研究預覽(research preview):完整檢查點,啟用思考與串流,支援工具呼叫與電腦操作以處理長時間運行的代理工作流,三種思考模式(永遠開啟、自適應、關閉),以及跨文字、影像、影片的多模態能力,包含長影片理解與原生螢幕操作。
- 有限預覽(limited preview):加入沙烏地對齊護欄,停用思考與串流,延遲較高。
更具關鍵性的承諾是權重發布。HUMAIN 表示計劃以 MiniMax Community License 公開可下載的權重,目標是下個月——但明確附帶條件:必須先完成安全訓練與對齊工作。這次預覽的目的之一,就是在正式版之前,收集針對各阿拉伯方言的能力、安全性與對齊回饋。在權重真正落地之前,「開放」仍是一個承諾,而非產品。
為什麼沙烏地的國家模型建立在中國基座上
Bloomberg 標題點出的地緣政治是整件事的潛台詞:沙烏地公共投資基金(PIF)支持的國家 AI 冠軍,選擇了中國基礎模型作為其旗艦阿拉伯語發布——就在同一週,它才與 AMD、Cisco、AWS 等簽下兆瓦級的基礎設施協議。
其邏輯很務實。對多數西方前沿實驗室而言,阿拉伯語是相對低資源的語言;頂級閉源模型很強,但並未針對阿拉伯語優化。MiniMax-M3 以社群授權形式公開權重,讓委託改造在法律上直接了當,也保留了主權持有權重的路徑。而 HUMAIN 的既定策略是模型不可知的市集——把架構視為王國自控運算、資料與安全框架之上可替換的分層。在這個框架下,不問來源、為工作挑選最好的基座,不是妥協,而是設計本身。
這也延續了一個趨勢:中國的開放權重生態系——Qwen、DeepSeek、Kimi、MiniMax——正成為其他國家建立主權 AI 的基材。一旦權重發布成真,humain-m3 將是現存最大、可開放授權且具阿拉伯語能力的模型之一。
後續觀察
三件事決定這場發布能否超越新聞週期。第一,權重發布:HUMAIN 能否達成「下個月」的目標、以 MiniMax Community License 釋出,以及該授權實際允許什麼。第二,獨立驗證:第三方阿拉伯語評測,在中立場地上檢驗 89.37% 這個數字對上 GPT-5.6 與 Opus 5。第三,透過 HUMAIN Node 的實際採用:沙烏地企業與政府工作負載是否真的標準化於阿拉伯語調優的 MoE,還是繼續預設使用西方 API。
對模型產業而言,訊息更簡單:前沿正在裂解為區域前沿,而基礎層已經全球化——一個海灣主權基金、一間上海 AI 實驗室、一兆阿拉伯語 token,以及一張美國熟悉的名字不再坐在頂端的基準成績表。
Sources
- [1] https://www.prnewswire.com/news-releases/humain-unveils-humain-m3-a-frontier-arabic-language-model-developed-by-minimax-in-research-preview-on-humain-node-302869158.html
- [2] https://www.bloomberg.com/news/articles/2026-09-03/saudi-arabia-s-humain-unveils-ai-model-based-on-china-s-minimax
- [3] https://superpowerdaily.com/posts/humain-releases-arabic-ai-preview-built-on-minimax-s-m3-lineage
- [4] https://www.middleeastainews.com/p/humain-unveils-428b-parameter-arabic
- [5] https://www.unite.ai/pif-backed-humain-launches-humain-m3-arabic-model-at-leap-riyadh/
- [6] https://huggingface.co/MiniMaxAI/MiniMax-M3