AI 新聞·2026年10月2日·來源: Techtimes
Gemini 4 Argon 在知識型工作上領先:承諾使用前仍有不足之處
Google DeepMind 推出了 Gemini 4 Argon,據報這款全新 AI 模型在 19 項內部基準測試中,有 13 項的表現優於 GPT-6 Astra 和 Claude Opus 5.5。該模型於 2026 年 9 月 30 日發佈,其輸出代幣上限為 100 萬,而入門級 API 價格為每百萬輸入代幣 2 美元。
Nexa 摘要
Gemini 4 Argon 的優勢主要集中在企業知識型工作和長文本檢索。它在 Vals Index 等基準測試中表現領先,該指數根據金融、編碼、法律和稅務工作對美國 GDP 的貢獻來衡量各行業的表現。它處理和檢索多達 100 萬個代幣提示資訊的能力,在 GraphWalks BFS F1 上領先 Astra 12.4 個百分點,這對於需要大量文件或程式碼庫分析的應用程式來說意義重大。
儘管有這些領先優勢,Argon 在特定領域仍落後於競爭對手。在兩項已發佈的軟件工程評估中,它在較難的一項上落後 GPT-6 Astra 10.5 個百分點,在終端驅動代理工作上落後 Claude Opus 5.5 9 個百分點。對於構建基於 shell 的自動化管道的團隊來說,這些都是關鍵的不足之處,因為 AI 代理必須在多個步驟中驅動終端或 shell 環境。
對於潛在採用者來說,一個關鍵的財務不確定性是規模化後的實際每項任務成本。Google 尚未確認模型的內部推理代幣是否按輸出費率計費。這意味著,雖然輸入代幣價格已知,但需要大量內部處理的複雜操作的全部成本仍未確定,這會影響大規模部署的預算可預測性。
分享這篇文章
延伸閱讀






