分类: AI安全

  • Anthropic向全人类发出警告:AI自我改进逼近,必须准备停止开发

    Anthropic 在最新政策文章中警告,前沿 AI 模型正在接近“递归自我改进”门槛,也就是模型可能通过编写和改进自身代码来继续提升能力。公司认为,这还没有真正发生,也并非必然发生,但一旦临界点到来,人类对模型进展的直接监督和干预空间可能迅速变小,因此全球主要 AI 实验室需要提前准备协调机制。Anthropic 提出的核心不是立刻关闭所有 AI 研究,而是在风险明显升高时,保留暂停或放缓前沿模型开发的选项,给监管、企业和社会留下调整时间。文章由 Anthropic 内部研究负责人 Marina Favaro 和政策负责人 Jack Clark 撰写,重点指向最强模型的开发节奏,而不是普通应……

    阅读全文