xAI Grok 4.7 發布分析:後訓練受限致綜合性價比不如預期,但專攻 Agentic Coding 與企業級長任務
- —Grok 4.7 歷經三週延期後發布,整體評測雖微幅進步至 46 分但落後 GPT-5.6,且每任務成本翻倍導致性價比偏低。受限於後訓練時間緊迫,團隊策略性聚焦於企業核心場景,在 TerminalBench 4.0 的 Agentic Coding 及知識工作評測表現亮眼,但能力高度依賴 Grok Build 與 Cursor 等特定環境。Grok 4.7 透過原生架構強化 Grok Bot 執行長任務之穩定度,雖未登頂通用模型,但有助降低企業實際多輪調用之綜合成本
xAI 雖在 Grok 4.7 的通用基準與性價比未達市場期待,但背靠 SpaceX 的強勁現金流,同時握有 X 平台的專屬資料、充足算力儲備與優秀人才團隊。短線模型迭代受制於後訓練時間不足,但在前沿算力競逐中仍具備追趕最前線的完整資源。SpaceX 與 xAI 同時擁有龐大算力、真實資料與充沛資金三大要素,前沿模型的長期研發實力不容忽視