原标题:《美企 Anthropic 呼吁全球暂停 AI 开发,称" AI 模型正接近无需人类干预即可自我优化"》文 / 观察者网 阮佳琪
据《华尔街 · 日报》4 日报道,美国人工智能(AI)初创公司 Anthropic 周四发布公开信,呼吁全球顶尖实验室暂停或减缓前沿 AI 的研发速度。
该公司警告称,当前 AI 技术迭代速度过快,短期内可能就会出现脱离人为干预、自主优化升级的能力,由此或将衍生难以预见的重大社会风险。
Anthropic 方面宣称,为了给社会和对齐研究(alignment research,让 AI 与人类价值观、意图保持一致)留出必要缓冲时间,其主张建立一项类似于"核武器协议"的全球性协议,以约束 AI 研发节奏。同时配套核查机制,确保各国竞争者履约。
文章进一步称,核查 AI 训练情况并不容易," AI 训练项目远比导弹发射井更容易隐匿。当其他人暂停时,谁继续前进谁就可能取得领先。"
未来数月,Anthropic 计划邀请各国政策制定者、科研从业者,围绕递归自主进化技术、全球核验机制展开研讨。文章称,"共同探讨这些问题的窗口已经开启,AI 公司之外的人士也应参与到这场讨论中来。"

当地时间 4 月 17 日,Anthropic 首席执行官达里奥 · 阿莫迪被拍到现身白宫。
据报道,这篇长文由 Anthropic 内部研究机构负责人与联合创始人撰写,文章披露了内部测试数据,以佐证其旗舰模型迭代提速的情况。
文章指出,当前 AI 模型正朝着"递归式自主进化"的方向发展,届时 AI 无需人类介入便可自我优化。不少业内从业者将这一技术临界点视作潜在隐患,预判其或将引发剧烈的社会动荡。
文章认为,减缓全球 AI 发展速度"可能是一件好事","我们认为,如果世界拥有放缓或暂时中止前沿 AI 研发的选择权,以便社会结构和对齐研究能够跟上技术发展的步伐,这将是有益的。"
文中还称,递归式自我进化目前尚未发生,也并非必然发生,"但可能会比大多数机构准备得更快到来"。
《华尔街 · 日报》指出,尽管 Anthropic 自创立以来便以 AI 安全为核心标榜,但其始终深陷舆论争议,外界频频指责其推动的各类政策倡议,本质是借机打压同行、拖慢竞品的 AI 研发节奏。
白宫前加密货币和 AI 事务主管戴维 · 萨克斯就曾公开批评 Anthropic 的领导层推行"监管俘获议程",称此举或催生封杀开源 AI 模型的政策。
还有批评者认为,Anthropic 对其工具潜在危险的警告可能只是一种营销策略。在他们看来,Anthropic 限制发布网络安全模型 Mythos,其实是为了变相吹嘘其产品的能力。
也并非所有专家都认同 Anthropic 描述的生存风险或"递归自我改进"可能性。图灵奖得主、"深度学习三巨头之一"、Meta 前副总裁兼首席 AI 科学家杨立昆就相信,基于大语言模型的前沿 AI 系统永远无法对标人类的智力。在他看来,AI 只是高效工具,智能水平仅等同于猫。
宾夕法尼亚大学沃顿商学院教授、AI 领域知名学者伊桑 · 莫利克(Ethan Mollick)告诉美媒,确实不少批评者认为 Anthropic 的安全声明是"空洞的宣传和营销手段"。
莫里克还指出,作为一个估值万亿的公司,Anthropic 内部存在多方冲突:既有追求商业利益的营销团队和律师,有埋头迭代新一代模型的研发骨干,当然也有真正忧心人类未来的"哲人王"式的人。这种多重身份不免使得外界对其"安全至上"的口号有所怀疑。
对于这些争议,Anthropic 的领导层回应称,公司高度重视 AI 安全问题,并正在努力推动更多关于技术风险的讨论。
值得注意的是,本周(6 月 1 日),Anthropic 正式提交 IPO 招股材料。作为 Claude 大模型的研发企业,其上市估值有望冲破 1 万亿美元,由此加入与 OpenAI、SpaceX 的上市赛跑。这场角逐也将检验资本市场是否愿意持续投钱支撑持续烧钱的 AI 实验室。
OpenAI 最新估值达 8520 亿美元,同样即将递交 IPO;SpaceX 于上月披露招股说明书,计划未来数周挂牌上市,目标估值 1.75 万亿美元。
上周四,Anthropic 刚落地一笔 650 亿美元的新一轮融资,融资敲定前企业估值为 9000 亿美元。对比去年 3 月 600 亿美元的估值,短短 15 个月间,公司估值暴涨逾 15 倍。
商业层面,Anthropic 已先后同谷歌、博通、亚马逊签下数千亿美元规模的长期算力合作协议;上月又和 SpaceX 达成合作,承租两处超大型数据中心园区。这笔租赁业务每年可为 SpaceX 带来 15 亿美元收入。
与此同时,即便正和美国国防部处于司法纠纷之中,Anthropic 仍在协助美国国家安全局部署 Mythos 大模型用于进攻性网络作战;该公司还派驻专属工程师驻场指导,依照美方作战需求定制、优化模型。这也让这家公司的安全承诺越发缺乏说服力。