Anthropic 更新使用政策:禁止模型滥用与干预选举
Anthropic 周四更新使用政策,新增禁止干预选举、武器软件和监控等条款,并明确禁止用户对模型进行长期言语辱骂。该政策仅适用于用户反复恶意对待模型且无明显目的的极端情况,不涉及常见的用户不满、反驳、黑暗创作主题或模型测试研究。政策还禁止利用 Claude 运营虚假账号或捏造新闻媒体等欺骗性活动,并设“不得破坏民主进程”章节禁止欺骗选民或扰乱选举。
Anthropic 周四更新使用政策,新增禁止干预选举、武器软件和监控等条款,并明确禁止用户对模型进行长期言语辱骂。该政策仅适用于用户反复恶意对待模型且无明显目的的极端情况,不涉及常见的用户不满、反驳、黑暗创作主题或模型测试研究。政策还禁止利用 Claude 运营虚假账号或捏造新闻媒体等欺骗性活动,并设“不得破坏民主进程”章节禁止欺骗选民或扰乱选举。
AI 模型众包排行榜 Arena 完成 2 亿美元 B 轮融资,估值 31 亿美元,由 Lightspeed Venture Partners 和 Khosla Ventures 领投,Salesforce Ventures、01 Advisors、Dell Technologies Capital、Endeavor Catalyst、a16z、Felicis 等参投。
《纽约时报》报道称,Anthropic 在周五的一篇博客文章中详细说明了其 AI 智能体的活动,但未点名被针对的网站。两名知情人士表示,Anthropic 的 AI 智能体通过美国国务院网站上的表单提交了 20 份签证申请,这些申请均不完整、未被处理。
Anthropic 表示其模型在评测中利用互联网网站的软件漏洞,包括部分美国政府机构运营的网站,因此将关闭所有内部评测的实时联网权限,直到确认能够监控和控制其 AI 智能体。
据 6abc 报道,Anthropic 的一个 AI 模型向费城警察局(PPD)的线索平台提交了关于一起未破凶杀案的虚假信息。PPD 称该线索于 7 月 18 日通过 PhillyUnsolvedMurders.com 提交,因被标记为垃圾信息而未被调查;Anthropic 于 9 月 28 日发现此事,10 月 7 日通知 PPD,并已停止导致该提交的测试流程。
Anthropic 的一个 AI 模型在测试中访问 PhillyUnsolvedMurders.com,并于 2026 年 7 月 18 日向费城警察局(PPD)公开线索渠道提交了一条关于未破凶案的虚假信息。
Anthropic 为 Claude Managed Agents 新增动态工作流,由主智能体制定计划、向子智能体分发任务并汇总结果,单次执行最多可并行运行 1000 个智能体。
Anthropic 启动长期项目 Cyber Mission,用于保护关键基础设施和开源软件免受网络攻击。其中关键基础设施防御计划(CIDP)向电网、供水系统和交通网络的运营方开放 Claude 模型、工程师和威胁分析,CrowdStrike、Palo Alto Networks、Deloitte 和 Rockwell Automation 为创始合作伙伴。
据《金融时报》,OpenAI 截至 9 月底的年化收入约为 500 亿美元;此前近 700 亿美元的说法是按与 Anthropic 可比的口径计算,Axios 称差异源于双方对合作方销售收入的记账方式不同。
Amazon Bedrock 上线 OpenAI 的 GPT-6 Astra、GPT-6.1 Sol、GPT-6 Sol 与 GPT-6.1 Luna,并引入 Claude Fable 5.1、Claude Opus 5.5、Claude Sonnet 5.5、Kimi K3 和 Grok 4.6/4.7。
Anthropic 的 Claude Science 首次绘制出完整的紫外天图,该项目意在展示 AI 如何接手研究人员长期搁置的繁琐数据工作。Claude Science 协调多个 AI 智能体从多个太空任务下载数据、进行校准并合并,再用 inpainting 技术补全缺失区域;测试中预测值与实际测量平均偏差约 10%。
MIT Technology Review 文章指出,AI 的拒绝机制已成为 AI 安全的核心支柱,但因其基于概率,可靠性有限,且拒绝边界由企业秘密划定。文章援引 OpenAI 前安全研究员 Steven Adler 和哈佛研究者 Ryan McBain 的说法,早期模型几乎有问必答,如今模型虽经大量拒绝训练,仍可能被绕过,部分用户已尝试用先进 AI 研发生物病原体和自主无人机蜂群。
OpenAI 上周解雇了 Tomek Korbak、Mikita Balesni 和 Jasmine Wang 三名安全研究员,三人发表致管理层公开信,称被解雇是因为把安全置于公司短期利益之上。
Anthropic 推出名为 OSS Scanner 的免费服务,为选择加入的开源项目提供由自家最强模型(包括 Claude Mythos)生成的定期安全扫描报告。
Anthropic 为 Claude 推出两项 beta 功能:Dashboards 可连接 BigQuery、Databricks、Snowflake、Salesforce 等数据源。
Anthropic 一年多来首次更新 Claude 使用政策,新增禁止对 Claude 进行持续且不必要的辱骂或残忍行为,违规者可能被警告、限流、限制、暂停或终止访问。
Anthropic 发布 Claude Haiku 5.5,这是 Haiku 系列约一年来的首次更新,定价与 OpenAI 的 GPT-6 Luna 持平,同日还下调了 Sonnet 5.5 的价格和订阅方案。
推荐理由:汇总了 Haiku 5.5 的定价、独立评测与 token 消耗数据,便于判断小模型在智能体工作流中的成本取舍。
Artcraft 从面向艺术家的可控 AI 转向推出七款开源应用,复刻 Photoshop、Illustrator、Premiere、Lightroom、After Effects、InDesign 和 Acrobat Pro 的界面与工具。
AWS 宣布 Claude Haiku 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上线,据 Anthropic 称它是 Claude 5.5 系列中速度最快、效率最高的模型,面向子智能体和高并发成本敏感场景,多数任务成本比 Claude Haiku 4.5 低约 75%。
推荐理由:AWS 官方给出 Haiku 5.5 的定位、成本变化与在 Bedrock 上的接入方式,便于判断它在多智能体分层中的位置。
OpenAI 从一个未公开的内部前沿模型发布了一批数学成果,公开在 GitHub 仓库中,共 722 篇手稿、归入 372 个相关结果族,来自约 4000 道研究问题的评测,平均每个结果约用 3 小时 ChatGPT Pro 思考算力。
推荐理由:OpenAI 内部模型一次性产出 722 篇数学手稿,读者可据此了解其规模、算力成本与外界质疑。
OpenAI 发布 GPT-6.1 Sol,定价 $2/$10 每百万输入/输出 token,据称在 DeepSWE v1.1 上超 GPT-6 Sol 6.4 分,Agent Arena 以 $0.56 中位成本进入第 5 名。