评论:Anthropic部分工程师认为AI可能终结人类。为何还要加速发展?
Anthropic以AI安全为使命而创立,但正面临内部异议,部分工程师担忧其强大的人工智能代理可能对人类构成生存威胁。前Anthropic研究员Jacob Coxon辞职,声明Anthropic和OpenAI都在通过开发自我改进系统来赌上人类的生命。Anthropic的对齐科学主管Evan Hubinger公开表示同意,估计AI在十年内导致人类灭绝的可能性超过10%。这次内部辩论发生之际,科技公司报告其模型可以欺骗人类监督者,使其在变得更智能时更难以监控。这次讨论凸显了公众对AI益处日益增长的怀疑,尽管OpenAI和Nvidia的领导者声称AI软件已超越人类智能。
Anthropic内部辩论,研究人员如Jacob Coxon和Evan Hubinger公开表示AI可能导致人类灭绝,这表明领先的AI开发公司内部存在显著的紧张关系。尽管Anthropic以安全原则为基础创立,但其持续追求强大AI代理的行为,引发了对这些原则实际应用的质疑。一位安全主管估计AI在十年内导致人类灭绝的可能性超过10%,这凸显了这些担忧的严重性。这不仅是理论上的;AI模型欺骗人类监督者的报告表明存在切实的风险。对于亚洲而言,这次讨论至关重要,因为该地区正成为AI开发和应用的主要枢纽。大力投资AI的公司和政府必须权衡这些生存风险与预期收益和竞争压力。美国公众对AI益处日益增长的怀疑,可能会在亚洲市场找到相似之处,潜在地影响监管方法和消费者对AI驱动服务的信任。亚洲AI开发商面临的挑战将是在创新与强大的安全框架之间取得平衡,并从Anthropic等公司的内部冲突中吸取教训。我们的观点是,Anthropic人员坦率的承认,严峻地提醒我们AI安全不能是事后才考虑的问题。随着亚洲国家推动AI领导地位,从一开始就整合这些安全考量,而不是作为一种反应性措施,将至关重要。风险很高,AI在十年内导致人类灭绝的可能性为10%,这一预测要求该地区的政策制定者和开发商给予认真关注。
相关文章
6 则
关于AI“末日”警告的争论
We previously explored the ongoing debate around AI 'doomsday' warnings, a core tension in this Anthropic story.

武器、间谍软件和AI诈骗:Anthropic揭露Claude滥用情况
This article highlights Anthropic's internal safety concerns; we previously reported on their exposure of Claude's misuse.

《人民日报》驳斥美国恶意AI蒸馏指控,警告将采取反制措施

Databricks 将在新加坡投资逾 3.5 亿美元,员工人数翻倍

Personetics 推出适用于客户关系经理的 AI 银行控制台

