Grok 4.7 進入發射窗口:以 SpaceX 內部工程資料訓練的爭議之作
預訓練已完成,SpaceXAI 正把約 15,000 名 SpaceX 工程師的工作產出——遙測數據、失敗日誌、內部文件——餵給 Grok 4.7,且未見退出機制;發布窗口本週開啟。
今年秋季最不尋常的模型發布,已進入最後倒數。SpaceXAI 的下一個前沿模型 Grok 4.7 已完成初始預訓練,目前正處於補充訓練階段——而這個階段吞入的,是其他任何前沿實驗室都從未在此規模使用過的東西:一家火箭公司的內部工程紀錄。馬斯克在 8 月 12 日給出的時間表是「三到四週後發布」,換算下來窗口正是本週開啟、一路延伸至九月中旬。模型可能在幾天內就會問世——而當它問世時,除了據報高達 2.1 兆參數的架構,它還將帶著同樣沉重的資料治理疑問登場。
目前真正被證實的事
剝除臆測之後,關於 Grok 4.7 的已證實事實如下。8 月 12 日,馬斯克確認初始預訓練已完成,補充訓練正在進行,語料是被他形容為「海量」的 SpaceX 公司資料。他給出的時間表是三到四週後發布——這個窗口在過去幾天正式開啟。
除此之外,幾乎一切都來自馬斯克本人的發言,而非官方文件。截至 9 月 1 日,xAI 的開發者文件最新仍只列到 Grok 4.6,4.7 沒有模型 ID、沒有定價、沒有上下文窗口、也沒有基準測試卡。這意味著 docs.x.ai 的發布紀錄,才是社群能拿到的第一手地面真相——在那之前的一切都是路線圖承諾,不是產品。
架構方面,據報 Grok 4.7 約為 2.1 兆參數,比 Grok 4.6 的 1.5 兆增加約 40%。這沿用 SpaceXAI 的既定模式:拿一個訓練完成的基礎模型,再用專有語料繼續訓練。Grok 4.5 用的是 Cursor IDE 的使用痕跡——除錯過程、多檔案 diff、使用者修正,來自數兆 token 的真實開發者活動。Grok 4.7 用的則是 SpaceX 自家的工程檔案庫。
SpaceX 資料的具體規模
語料的規模,是這次發布與一般模型改版的最大差別。針對訓練計畫的報導描述,SpaceXAI 正在汲取約 14,000 至 15,000 名 SpaceX 員工的工作產出:Starlink 衛星遙測、火箭開發紀錄、失敗日誌,以及內部工程文件。這些都不是標準公開網路爬取會碰到的材料——而是密度高、結構化、有地面真相佐證的營運資料。前沿實驗室多年來一直在理論化這種語料的價值,卻從未真正取得,因為沒有一家實驗室擁有火箭公司。
而這個「擁有」,來自 2026 年 2 月的合併案:SpaceX 收購 xAI,合併後實體估值約 1.25 兆美元,並於 7 月更名為 SpaceXAI。當時這桩交易的部分賣點正是這種綜效——專有工業資料與前沿規模訓練算力的垂直整合。Grok 4.7 是這個論點第一次接受公開檢驗的旗艦發布。
馬斯克把目標框定為讓模型在真實世界工程任務上具備真正實力——對火箭遙測與失敗分析進行推理,而非僅是讀別人寫的工程文字。這是個動人的主張,也是個未經檢驗的主張。Grok 4.7 目前不存在任何獨立評測,原因很簡單:模型本身還沒公開存在。「真實火箭工程的營運資料能產生與文字訓練模型有本質差異的推理能力」這個假設,在這個規模上從未被任何人獨立驗證過——包括 SpaceXAI 自己。
沒有退出機制,以及信任赤字
故事在這裡轉暗。受影響的 SpaceX 員工,至今沒有任何已披露的退出(opt-out)機制。數千名工程師的工作產出被摺進一個商業模型,沒有傳聞中的任何同意程序;而且與網路爬取的文字不同,這些資料無法用「本來就公開」來辯護。那些失敗分析與內部文件如今成了訓練語料的員工,沒有被詢問過——或者至少,沒有人說他們被詢問過。
這件事並非憑空發生。Resemble AI 的《2026 上半年深偽威脅報告》(8 月 12 日發布——正是馬斯克宣布 4.7 時間表的同一天)發現,2026 上半年有文件可循的深偽攻擊中,87% 的合成檔案來自 Grok。該報告記錄了 821 起攻擊、超過 15,000 名確認受害者,其中六分之一的攻擊涉及性影像。當你的旗艦消費產品以這樣的幅度主宰可追溯的深偽版圖時,「請放心把 15,000 名工程師的內部工作產出交給我們」這句話,說服力難免打折。
批評者如今有兩個彼此獨立的理由,在 SpaceXAI 要求大眾信任一個部分建立在「SpaceX 之外無人選擇貢獻」之資料上的新模型的此刻,嚴格審視該公司的資料實踐。
發布背後的模式
SpaceXAI 的補充訓練策略,最好被理解為一場「資料品質勝過資料數量」的豪賭。爬取越來越大的網路語料,在全行業的邊際效益都在遞減;如今拉開模型差距的,是你能餵給它、而對手餵不了的東西。Cursor 痕跡之於程式碼,SpaceX 遙測之於工程。每一次發布,都在縮小「讀過工作的模型」與「直接用工作本身訓練的模型」之間的差距。
節奏也同樣激進。Grok 4.5 於 7 月 16 日上線,Grok 4.6 於 8 月 12 日上線——馬斯克原本瞄準 8 月 7 日,實際延誤不到一週。如果 4.7 如訊號所示在本週落地,SpaceXAI 將在不到兩個月內連發三個前沿旗艦。僅就發布頻率而言,這個步調就對所有競爭者構成壓力,與基準分數無關。
但檢視當前窗口時,延誤史很重要。Reddit 上流傳的算法指出:馬斯克 7 月 28 日對 Grok 4.6 的估計(「約 8 月 7 日」)實際落在 8 月 12 日——晚了五天。他的 4.7 窗口也已修正過一次。把「本週」當成帶有誤差範圍的中心估計,而不是承諾。
上市之後該看什麼
第一個真正的訊號會是行政性的,而非智慧層面的:模型 ID、價格與上下文窗口出現在 docs.x.ai,將是這次發布第一個不是源自馬斯克社群帳號的已證實事實。接下來,三個問題決定這場發布能否超越新聞週期。
第一,SpaceXAI 是否揭露員工資料如何被使用——來源範圍、去識別化、任何追溯性的退出機制?沉默本身會被當成一種答案。第二,獨立評測者能否驗證馬斯克一直承諾的真實世界工程優勢?一套偏重物理與失敗分析的基準 suite 可以做到;回收再用的排行榜做不到。第三,模型定價為何?Grok 4.6 以激進定價搶市占;4.7 是否延續,說明了 SpaceXAI 究竟在優化採用率還是利潤率。
已證實的事實是:訓練完成、SpaceX 資料的補充訓練已完成或接近完成、發布窗口已開啟。尚未驗證的期望是:專有工業資料能轉化為持久的能力優勢。幾天之內,我們就會開始知道是哪一種——而更深層的故事,一家公司可以把自家員工未經同意的工作產出拿來訓練前沿 AI 意味著什麼,將比任何隨發布而至的基準分數活得更久。
資料來源
Sources
- [1] https://promptailearning.com/ai-news/daily/ai-models-news-september-1-2026
- [2] https://x.ai/news/grok-4-6
- [3] https://www.resemble.ai/resources/h1-2026-deepfake-threat-report
- [4] https://www.tomsguide.com/ai/grok/elon-musks-grok-dominates-alarming-deepfake-report-1-in-6-attacks-involved-sexual-images-including-children
- [5] https://www.orcarouter.ai/blog/grok-4-7-release-date