我们高估了 AI 说"不"的能力
MIT Technology Review 文章指出,AI 的拒绝机制已成为 AI 安全的核心支柱,但因其基于概率,可靠性有限,且拒绝边界由企业秘密划定。文章援引 OpenAI 前安全研究员 Steven Adler 和哈佛研究者 Ryan McBain 的说法,早期模型几乎有问必答,如今模型虽经大量拒绝训练,仍可能被绕过,部分用户已尝试用先进 AI 研发生物病原体和自主无人机蜂群。
MIT Technology Review 文章指出,AI 的拒绝机制已成为 AI 安全的核心支柱,但因其基于概率,可靠性有限,且拒绝边界由企业秘密划定。文章援引 OpenAI 前安全研究员 Steven Adler 和哈佛研究者 Ryan McBain 的说法,早期模型几乎有问必答,如今模型虽经大量拒绝训练,仍可能被绕过,部分用户已尝试用先进 AI 研发生物病原体和自主无人机蜂群。
尽管马斯克称 Tesla Optimus 未来可能以低至 2 万美元单价自动化几乎所有人类劳动、并预测 2027 年底前向公众发售,但多位机器人研究者对这类时间表持怀疑态度。