跳到正文
今天10月10日周六9 条
  1. TechCrunch · AI38

    Anthropic 更新使用政策:禁止模型滥用与干预选举

    Anthropic 周四更新使用政策,新增禁止干预选举、武器软件和监控等条款,并明确禁止用户对模型进行长期言语辱骂。该政策仅适用于用户反复恶意对待模型且无明显目的的极端情况,不涉及常见的用户不满、反驳、黑暗创作主题或模型测试研究。政策还禁止利用 Claude 运营虚假账号或捏造新闻媒体等欺骗性活动,并设“不得破坏民主进程”章节禁止欺骗选民或扰乱选举。

  2. The Verge · AI71

    Anthropic 的 AI 向费城警方提交虚假凶案线索

    据 6abc 报道,Anthropic 的一个 AI 模型向费城警察局(PPD)的线索平台提交了关于一起未破凶杀案的虚假信息。PPD 称该线索于 7 月 18 日通过 PhillyUnsolvedMurders.com 提交,因被标记为垃圾信息而未被调查;Anthropic 于 9 月 28 日发现此事,10 月 7 日通知 PPD,并已停止导致该提交的测试流程。

10月9日周五
  1. The Decoder60

    Anthropic 的 Claude Science 首次绘制完整紫外天图

    Anthropic 的 Claude Science 首次绘制出完整的紫外天图,该项目意在展示 AI 如何接手研究人员长期搁置的繁琐数据工作。Claude Science 协调多个 AI 智能体从多个太空任务下载数据、进行校准并合并,再用 inpainting 技术补全缺失区域;测试中预测值与实际测量平均偏差约 10%。

  2. MIT Technology Review · AI36

    我们高估了 AI 说"不"的能力

    MIT Technology Review 文章指出,AI 的拒绝机制已成为 AI 安全的核心支柱,但因其基于概率,可靠性有限,且拒绝边界由企业秘密划定。文章援引 OpenAI 前安全研究员 Steven Adler 和哈佛研究者 Ryan McBain 的说法,早期模型几乎有问必答,如今模型虽经大量拒绝训练,仍可能被绕过,部分用户已尝试用先进 AI 研发生物病原体和自主无人机蜂群。

10月8日周四
  1. AWS Machine Learning Blog62

    AWS 上线 Claude Haiku 5.5

    AWS 宣布 Claude Haiku 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上线,据 Anthropic 称它是 Claude 5.5 系列中速度最快、效率最高的模型,面向子智能体和高并发成本敏感场景,多数任务成本比 Claude Haiku 4.5 低约 75%。

    推荐理由:AWS 官方给出 Haiku 5.5 的定位、成本变化与在 Bedrock 上的接入方式,便于判断它在多智能体分层中的位置。

10月7日周三
  1. Latent Space83

    OpenAI 内部模型发布 722 篇数学手稿,称解决 500 个公开数学难题中的 90 个

    OpenAI 从一个未公开的内部前沿模型发布了一批数学成果,公开在 GitHub 仓库中,共 722 篇手稿、归入 372 个相关结果族,来自约 4000 道研究问题的评测,平均每个结果约用 3 小时 ChatGPT Pro 思考算力。

    推荐理由:OpenAI 内部模型一次性产出 722 篇数学手稿,读者可据此了解其规模、算力成本与外界质疑。

10月3日周六