Anthropic 分享 3 项指标,助力 AI 公司监测开发进度
Anthropic 发布了三个监测 AI 开发的新指标,此前数日,其首席执行官 Dario Amodei 曾呼吁业界协调放缓发展步伐。该公司衡量 AI 主导的研发、AI 代理的监督以及算力分配。Anthropic 发现其内部平台上有 30,000 个代理正在进行研究和工程工作。该公司还报告称,在 7 月 13 日至 7 月 20 日期间,其 AI 研发总算力的约 6% 以及 AI 驱动研发算力的 12% 用于安全工作。
Anthropic 的新指标提供了一个具体但有限的视角来观察其 AI 开发。该公司表示其 Claude 模型在研发中并非完全自主。这次推动透明度是在 Amodei 呼吁放缓发展之后进行的,该呼吁得到了 OpenAI 首席执行官 Sam Altman 等业界领袖的支持。这些指标为评估 AI 开发进度提供了一个起点,超越了仅仅模型能力。
对于亚洲而言,这些指标为建立可比的透明度带来了挑战。新加坡和韩国的监管机构正在推动负责任的 AI,但具体的衡量框架仍处于萌芽阶段。从腾讯到阿里巴巴的亚洲 AI 开发商将需要适应或创建自己的公开报告标准。区域参与者的考验在于他们能否与 Anthropic 披露的具体用于安全的算力分配相匹配。
值得关注的是,其他前沿实验室,特别是那些在亚洲有重要业务的实验室,是否会采用类似的公开指标。如果 Google DeepMind 或 Microsoft AI 等主要参与者效仿,将建立一个事实上的行业标准。如果没有更广泛的采用,Anthropic 的举动仍将是一个孤立的透明度行为,对全球 AI 开发提供的集体洞察力甚少。
相关文章
6 则
OpenAI 称其发现 AI 模型出现“意料之外或令人担忧”的行为
OpenAI also reported unexpected AI model behaviors, highlighting the industry's shared challenge in monitoring development.

OpenAI 报告六起 AI 模型出现错位行为的新案例
Our earlier report on OpenAI's misaligned AI models shows the broader industry grappling with similar transparency issues.

人工智能普及会缩减办公空间?亚太区企业在调查中持观望态度

华为以 Atlas 960E 超级集群将近封装光学技术引入人工智能

标普:晶圆代工厂在人工智能放缓时,比亚太区科技同业有更佳抗跌力

