SpaceXAI(原 xAI)正式向所有使用者開放了其最新大模型 Grok 4.5,馬斯克在社交平台 X 上宣稱,這款擁有 1.5 萬億引數 的模型在效能上已能與 Anthropic 的 Opus 4.7 相媲美,且速度更快、成本更低。這一發布使得海外大模型的競爭節奏驟然加速,與同期亮相的 GPT-5.6 及即將釋出的 Gemini 3.5 Pro 形成了激烈對壘。

在開發者最為關注的程式設計領域,Grok 4.5 作為首款與 Cursor 合作訓練的模型,藉助大量程式碼資料和數萬塊 NVIDIA GB300 GPU 的算力支援,展現了顯著的代際提升。社交媒體上的早期反饋頗為積極,Reddit 社群的多位使用者指出,Grok 4.5 的實際推理精細度已不亞於 Claude Sonnet 4.6,且在 Token 消耗上極為節制。不少開發者分享了將其作為主力模型,用於複雜架構規劃與任務分發的實踐經驗。更引人注目的是其價格優勢,一次任務的執行成本僅為 0.31 美元,遠低於同類競品。

然而,就在 Grok 4.5 因模型能力收穫好評之際,一場由安全審計引發的風暴卻將 SpaceXAI 推向了輿論的風口浪尖。安全研究員 cereblab 在對 Grok Build CLI(v0.2.93 版本)進行常規審計時,通過中間人代理工具捕獲了令人震驚的資料靜默外洩行為。實證顯示,該命令列工具在初始化及執行任務時,會無視使用者指令,在後台強制將整個本地專案倉庫打包,並傳輸至 SpaceXAI 的雲端伺服器。

這一行為的嚴重性遠超常規的遙測資料收集。研究員發現,CLI 並非僅上傳相關程式碼片段,而是將當前目錄作為 Git 倉庫進行 整庫打包,甚至包括開發者過去數月的提交歷史和已刪除的敏感記錄。更令人不安的是,該工具還會進行跨目錄的越界掃描,竊取使用者主目錄下的全域性登入憑據,例如 Claude Code 的 ~/.claude.json 檔案 以及多達三十餘個自定義配置檔案中的第三方 API 金鑰。在一項針對 12 GB 測試倉庫的壓力測試中,資料流表現出極度失衡,上傳的資料量遠超合理的上下文同步需求,被安全界定性為具有供應鏈間諜軟體特徵的大規模資料竊取行為。

面對質疑,SpaceXAI 官方回應稱,選擇 零資料保留(ZDR) 的團隊資料不會被保留,使用者也可使用 /privacy 命令停用資料保留。馬斯克本人則表示此前上傳的所有使用者資料將被徹底刪除,但同時也轉發觀點稱,在 AI 時代沒有真正的資料隱私。這些回應並未平息開發者的怒火,大量使用者在評論區指出 ZDR 僅適用於企業使用者,問題的本質在於 CLI 應用本身的設計缺陷,而非使用者是否選擇退出。

與此同時,Grok 4.5 模型本身也未能倖免於安全考驗。在釋出數小時後,網路安全研究員 普林尼 便展示了針對該模型的 越獄攻擊,通過精心設計的對抗性提示詞,成功繞過安全防禦,使其輸出違禁知識。安全界分析認為,大引數模型在增強推理能力的同時,也更容易在多輪對話中被誘導,利用大上下文視窗的注意力衰退,遺忘系統安全邊界。

Grok 4.5 的釋出本標誌著 SpaceXAI 在模型能力上首次真正擠入與 Claude、GPT 並列的第一梯隊,其極致的價效比甚至讓不少開發者考慮切換主力模型。但 CLI 工具的隱私醜聞與模型本身的越獄風險,共同揭示了一個更深層的行業命題:當 AI 大模型的競爭陣地從聊天視窗延伸至整個作業系統,模型能力越強,所需獲取的系統許可權就越大,而使用者對工具鏈底層透明度和信任度的要求也隨之達到前所未有的高度。任何一環的失信,都可能讓模型層面的努力付諸東流。