xAI 推出 Grok 4.7,專為編碼及知識型工作而設
xAI 已推出 Grok 4.7,這是其專為編碼及知識型工作而設的新模型。該模型可透過 Cursor、Grok API 及其他軟件工具使用。Grok 4.7 經過更長時間的強化學習訓練,專注於解決需時數小時才能完成的困難任務。xAI 將 Grok 4.7 與 GPT-5.6 Sol 和 Fable 5.1 Max 等競爭對手進行了基準測試,在各種專業任務中顯示出不同的結果。
xAI 推出 Grok 4.7,顯示開發者工作流程的競爭日益激烈。雖然 Grok 4.7 在所有報告的基準測試中都比其前身 Grok 4.6 有所改進,但並未持續領先。例如,Grok 4.7 在 CursorBench 4.0 的長編碼任務中得分為 46.3%,落後於 Fable 5.1 Max 的 51.8%。這反映出市場上供應商越來越多地在成本、速度和保障措施與特定領域的峰值性能之間進行權衡。
該模型的定價為標準版本每百萬輸入代幣 2 美元,使其在亞洲不斷增長的開發者市場中直接參與競爭。像阿里巴巴雲和騰訊雲這樣提供自家 AI 模型和開發者平台的公司,將面臨新的壓力,需要達到或超越 Grok 4.7 在專業任務中的表現,例如在電機工程領域,Grok 4.7 得分為 64.0%,而 GPT-5.6 Sol 則為 39.4%。這將推動亞洲雲端供應商增強其開發者工具和模型能力。
Grok 4.7 針對網絡安全合作夥伴提供邀請制紅隊功能,這是一個關鍵發展。這表明 xAI 旨在滲透安全測試市場。對於亞洲網絡安全公司而言,考驗將是 Grok 4.7 在 HackerBench v0.3 上允許危險雙重用途提示的 3.3% 比率是否優於現有工具。這可能會推動其在亞洲龐大網絡安全領域的採用。
相關文章
6 則
華為 Ascend 960 SuperPoD 旨在超越 Nvidia 在中國的 AI 硬體 — 960E 配備逾 4,000 個 NPU 及升級版 UnifiedBus 互連,目標為 10 萬億參數
The escalating competition for AI developer workflows also drives hardware innovation, as seen with Huawei's Ascend 960 SuperPoD.

近半新加坡人樂意讓AI申請信貸

交易快訊:新加坡 dtcpay 完成 A 輪融資,01F Group 投資 Dana,十項中國投資等

中國力推微型「漢信碼」挑戰美國標準,冀在晶片產業佔一席位

LexisNexis 推出 AI 工具,能適應不斷變化的詐騙模式

