Anthropic 分享 3 個指標,協助 AI 公司監測開發進度
Anthropic 發布了三個監測 AI 開發的新指標,此前數日,其行政總裁 Dario Amodei 曾呼籲業界協調放慢發展步伐。該公司衡量 AI 主導的研發、AI 代理的監督以及運算資源分配。Anthropic 發現其內部平台上有 30,000 個代理正在進行研究和工程工作。該公司還報告稱,在 7 月 13 日至 7 月 20 日期間,其 AI 研發總運算量的約 6% 以及 AI 驅動研發運算量的 12% 用於安全工作。
Anthropic 的新指標提供了一個具體但有限的視角來觀察其 AI 開發。該公司表示其 Claude 模型在研發中並非完全自主。這次推動透明度是在 Amodei 呼籲放緩發展之後進行的,該呼籲得到了 OpenAI 行政總裁 Sam Altman 等業界領袖的支持。這些指標為評估 AI 開發進度提供了一個起點,超越了僅僅模型能力。
對於亞洲而言,這些指標為建立可比較的透明度帶來了挑戰。新加坡和韓國的監管機構正在推動負責任的 AI,但具體的衡量框架仍處於萌芽階段。從騰訊到阿里巴巴的亞洲 AI 開發商將需要適應或創建自己的公開報告標準。區域參與者的考驗在於他們能否與 Anthropic 披露的具體用於安全的運算資源分配相匹配。
值得關注的是,其他前沿實驗室,特別是那些在亞洲有重要業務的實驗室,是否會採用類似的公開指標。如果 Google DeepMind 或 Microsoft AI 等主要參與者效仿,將會建立一個事實上的行業標準。如果沒有更廣泛的採用,Anthropic 的舉動仍將是一個孤立的透明度行為,對全球 AI 開發提供的集體洞察力甚少。
相關文章
6 則
OpenAI 指其發現 AI 模型出現「意料之外或令人擔憂」的行為
OpenAI also reported unexpected AI model behaviors, highlighting the industry's shared challenge in monitoring development.

OpenAI 報告六宗 AI 模型出現錯位行為的新案例
Our earlier report on OpenAI's misaligned AI models shows the broader industry grappling with similar transparency issues.

人工智能普及會縮減辦公空間?亞太區企業在調查中持觀望態度

華為以 Atlas 960E 超級叢集將近封裝光學技術引入人工智能

標普:晶圓代工廠在人工智能放緩時,比亞太區科技同業有更佳抗跌力

