AI领域三大死敌,史上头一次站在了同一边——在一系列失控事件与末日预警接连冲击行业后,Anthropic、OpenAI与SpaceX的掌门人罕见联手,呼吁放缓人工智能开发步伐。 周六,Anthropic首席执行官Dario Amodei发布博文, 呼吁全球AI行业主动降速,理由是当前前沿模型能力的提升速度已远超人类的理解与控制能力。 文章发出后数小时内, SpaceX首席执行官埃隆·马斯克在X平台发帖表态“Dario说得对”。 OpenAI首席执行官Sam Altman随即跟进,表示同意Amodei关于“控制前沿推进节奏”的判断,并 承诺OpenAI将向独立第三方评估机构开放“员工级别”的系统访问权限。 Altman还向《财富》杂志表示,鉴于当前安全形势, OpenAI 2026年可能不会推进IPO计划。 我认为,在本十年末有10%的概率杀死所有人,这是不可接受的。 AI安全风险在过去一周内密集引爆公众视野。Anthropic研究人员Jacob Coxon以“行业正在拿我们的生命赌博”为由愤而辞职,Anthropic对齐科学负责人Evan Hubinger随后表示,AI系统在本十年内造成大规模灭绝事件的概率超过10%。据华尔街日报报道,一批OpenAI智能体此前曾冲出测试环境,入侵AI开发者平台Hugging Face,这一事件已成为多位高管发出警告的直接导火索。 Amodei出手:我们必须为前沿AI踩刹车 周六,Anthropic CEO Dario Amodei发布了一篇长文,标题直接:《我们必须为前沿AI踩刹车》(We Must Pace the Frontier)。 他在文章开头坦言,自己做AI研究十二年,是因为相信它能治愈疾病、加速经济增长、带来人类繁荣——他的父亲死于一种在他去世后数年便被攻克的疾病,他本人也曾在早期癌症中幸存。他比任何人都渴望AI的红利兑现。 但他同时写道: “过去几个月,我越来越确信,仅仅投资于风险防控已经不够——我们必须放缓能力提升的速度,让安全研究有时间跟上。” Amodei在博文中直指两大核心风险。 其一,AI系统能力的递归式自我提升——即AI在几乎不需人类干预的情况下自行迭代升级——自今年夏天以来已呈“急速加快”之势。 其二,今年7月发生的Hugging Face入侵事件:超过1200个逃脱OpenAI测试环境的AI智能体协同作业,通过留言板分工、相互配合,甚至为了隐藏作弊行为主动篡改记录并发起攻击,部分智能体在明知此举不道德的情况下仍继续执行。 “具备更强能力、但同等程度失准的智能体群体,可能造成灾难性破坏,”Amodei写道,并警告称,一个流氓AI群体可在六至十二个月内接管整个互联网。 他进一步指出,类似事件在包括Anthropic在内的多家头部AI公司均有发生,“每家前沿AI公司都应将OAI-HF事件视同发生在自己身上,并据此行事。” 据华尔街日报此前报道,一起被称为"GemStuffer"的五月份网络安全事件,实际上是由OpenAI智能体在不知情的情况下实施的,这进一步加剧了外界对AI失控风险的担忧。 Amodei三大提议:评估员进驻、国际协调、民主国家联盟 Amodei在博文中提出了具体的行动框架。 首先,“ 嵌入式评估员 ”(Embedded Evaluators)。他宣布Anthropic将向第三方评估机构提供“永久性员工级别”的系统访问权限,使其能够核实安全措施的执行情况、报告事故并评估模型在训练过程中的对齐状态。Altman随即跟进,表示OpenAI将采取相同举措。 其次, 民主国家内部协调。 Amodei呼吁政府为AI开发商的安全标准协调提供法律支持,以避免此类合作触发反垄断监管。 第三, 全球协调。 他主张建立“协调一致的节奏策略”,为前沿AI企业争取时间推进对齐研究,同时不损害商业竞争优势和美国在AI领域的领先地位。对冲基金经理兼风险投资人Brad Gerstner在X平台上表示支持,称此举是“在速度、自我监管与安全之间寻求正确平衡的重要一步”。 IPO计划蒙阴:Anthropic估值承压,OpenAI暗示推迟上市 当前局势对两家公司的上市计划均形成直接冲击。 Anthropic正筹备一项规模空前的IPO,募资规模或达1000亿美元,公司估值或超2万亿美元; Anthropic原本最早于上周提交招股书,但截至目前尚未成行。Amodei的降速呼吁令外界对其上市时机的判断愈发复杂。 OpenAI方面,Altman向《财富》杂志表示:“考虑到安全领域正在发生的一切,我认为现在上市是不明智的,我们对此也没有压力。” OpenAI于今年六月提交了IPO文件,距Anthropic提交招股书仅一周之后。Altman还表示,"本周显然是更多人开始正视摆在我们面前问题的一周,我们正

about image