GMAsia
    🇸🇬新加坡·政策·2026年9月21日·來源: It Brief Asia

    xAI 推出 Grok 4.7,專為編碼及知識型工作而設

    xAI 已推出 Grok 4.7,這是其專為編碼及知識型工作而設的新模型。該模型可透過 Cursor、Grok API 及其他軟件工具使用。Grok 4.7 經過更長時間的強化學習訓練,專注於解決需時數小時才能完成的困難任務。xAI 將 Grok 4.7 與 GPT-5.6 Sol 和 Fable 5.1 Max 等競爭對手進行了基準測試,在各種專業任務中顯示出不同的結果。

    Nexa 摘要

    xAI 推出 Grok 4.7,顯示開發者工作流程的競爭日益激烈。雖然 Grok 4.7 在所有報告的基準測試中都比其前身 Grok 4.6 有所改進,但並未持續領先。例如,Grok 4.7 在 CursorBench 4.0 的長編碼任務中得分為 46.3%,落後於 Fable 5.1 Max 的 51.8%。這反映出市場上供應商越來越多地在成本、速度和保障措施與特定領域的峰值性能之間進行權衡。

    該模型的定價為標準版本每百萬輸入代幣 2 美元,使其在亞洲不斷增長的開發者市場中直接參與競爭。像阿里巴巴雲和騰訊雲這樣提供自家 AI 模型和開發者平台的公司,將面臨新的壓力,需要達到或超越 Grok 4.7 在專業任務中的表現,例如在電機工程領域,Grok 4.7 得分為 64.0%,而 GPT-5.6 Sol 則為 39.4%。這將推動亞洲雲端供應商增強其開發者工具和模型能力。

    Grok 4.7 針對網絡安全合作夥伴提供邀請制紅隊功能,這是一個關鍵發展。這表明 xAI 旨在滲透安全測試市場。對於亞洲網絡安全公司而言,考驗將是 Grok 4.7 在 HackerBench v0.3 上允許危險雙重用途提示的 3.3% 比率是否優於現有工具。這可能會推動其在亞洲龐大網絡安全領域的採用。

    #technology
    延伸閱讀
    原文報道: It Brief Asia我們不轉載全文, 閱讀原文 →

    相關文章

    6 則