OpenAI 解雇三名安全研究员,当事人公开信反驳公司说法
OpenAI 解雇了三名与 Hugging Face 黑客事件调查相关的安全研究员,三人随后向公司安全委员会发出公开信,称解雇过程突然且公开,令团队人心惶惶。
OpenAI 解雇了三名与 Hugging Face 黑客事件调查相关的安全研究员,三人随后向公司安全委员会发出公开信,称解雇过程突然且公开,令团队人心惶惶。
OpenAI 就解雇三名 AI 安全研究员一事公开表态,称内部调查发现他们违反敏感信息处理政策,构成重大信任破坏,并强调解雇与三人公开谈论 AI 安全担忧无关。
Anthropic 的 Claude Science 首次绘制出完整的紫外天图,该项目意在展示 AI 如何接手研究人员长期搁置的繁琐数据工作。Claude Science 协调多个 AI 智能体从多个太空任务下载数据、进行校准并合并,再用 inpainting 技术补全缺失区域;测试中预测值与实际测量平均偏差约 10%。
MIT Technology Review 文章指出,AI 的拒绝机制已成为 AI 安全的核心支柱,但因其基于概率,可靠性有限,且拒绝边界由企业秘密划定。文章援引 OpenAI 前安全研究员 Steven Adler 和哈佛研究者 Ryan McBain 的说法,早期模型几乎有问必答,如今模型虽经大量拒绝训练,仍可能被绕过,部分用户已尝试用先进 AI 研发生物病原体和自主无人机蜂群。
OpenAI 披露并封禁了两个分别来自俄罗斯和伊朗的影响行动所用 ChatGPT 账号,二者都用虚假身份向正规媒体植入内容,而非只做社交媒体传播。
Asana 借助 Codex 中的 GPT-6 Astra,在浏览器测试中让浏览器智能体成本降低 76 倍、速度提升 5 倍,从而为客户提供能力更强的模型。
Sophos 使用 OpenAI 的 Daybreak 将网络威胁调查时间缩短 96%,并自动化处理 52% 的 MDR 案例,同时保留人工监督。
Simon Willison 发布 ttok 1.0,将默认 tokenizer 从 GPT-4 切换为 GPT-5/GPT-6。
斯坦福大学博士生 Samuel King 用生成式 AI 模型设计出微型病毒的基因蓝图,这尚非 AI 生成生命,但可能是下一步。MIT Technology Review 资深 AI 记者 James O'Donnell 将于 10 月 16 日与其对话,讨论这项工作及他入选 Innovators Under 35 的经历。
Simon Willison 的 token 计数 CLI 工具 ttok 发布 0.4 版,修复了 Click 警告、更新了 CI,并新增 --list-models 命令用于列出可用模型。该工具基于 OpenAI 开源的 tiktoken 库,可通过 uvx 直接运行,例如 cat file.txt | uvx ttok 即可统计 token 数。
OpenAI 上周解雇了 Tomek Korbak、Mikita Balesni 和 Jasmine Wang 三名安全研究员,三人发表致管理层公开信,称被解雇是因为把安全置于公司短期利益之上。
Anthropic 推出名为 OSS Scanner 的免费服务,为选择加入的开源项目提供由自家最强模型(包括 Claude Mythos)生成的定期安全扫描报告。
NVIDIA 开发者正用 GPT-6 Astra、Claude Fable 5 等前沿模型驱动 Omniverse 库构建仿真应用,覆盖人形机器人仓库、自动驾驶测试、数字孪生、机器人运动与拆解等场景。
Carson Gross 认为,编程本质上是用计算机解决问题、并在解决问题时控制复杂度这两件事。他难以想象未来掌握这两项能力会变得比今天更没价值,因此即便 AI 工具出现,编程仍会是一个可行的职业。
加州州立体育委员会向举办人机对战赛事的初创公司 Rek 发出停止函,指其 9 月 18 日让人类 Frankie LaPenna 对阵一台由人通过远程 VR 系统操控的人形机器人属于"未经批准"的拳击或综合格斗赛事。Rek CEO Cix Liv 于 9 月 30 日在 X 上公开该函件,Rek 下一场计划于周五举行,将由两台带武器的机器人互斗。
Anthropic 为 Claude 推出两项 beta 功能:Dashboards 可连接 BigQuery、Databricks、Snowflake、Salesforce 等数据源。
Anthropic 一年多来首次更新 Claude 使用政策,新增禁止对 Claude 进行持续且不必要的辱骂或残忍行为,违规者可能被警告、限流、限制、暂停或终止访问。
Incarna 借助 Amazon Bedrock AgentCore payments,让智能体通过 x402 按次向 BlockRun 支付模型推理费用,将接入 x402 支付支持的工作量从数月缩短到数天,并已上线端到端按次付费推理流程。
Periodic Labs 联合创始人 Liam Fedus 与 Ekin Dogus Cubuk 在 Latent Space 播客中提出"合成超级智能"(synthesis superintelligence)路线:以物理实验为环境的强化学习、AI 材料表征、DFT 与高通量实验室,让模型学习做科学的全过程而非只看已发表结果。
AWS 发布基于 Amazon SageMaker HyperPod 与 EKS 的多租户参考架构,让多个团队共享同一 GPU 集群并保持隔离与资源公平。
Oracle 在招聘、工程和运营场景中,用 ChatGPT Work 和 Codex 把专家知识转化为快速、可复用的工作流,将原本需要数天的工作缩短到几分钟。
《Gears of War: E-Day》已于 10 月 6 日全球发售后上线 GeForce NOW,Ultimate 会员可以 GeForce RTX 5080 级性能在云端体验,并支持 NVIDIA DLSS 与 NVIDIA Reflex。
LegalOn 将 Codex 的每日预估成本削减了 65%,同时保持开发速度不变。其做法是按任务匹配 Astra、Sol 和 Luna,并对预算进行策略性管理。
Pollo AI 借助 GPT-5.6、GPT-6 Astra 和 GPT-Image-2.5,帮助创作者将创意转化为精细图像与电影级视频广告。
Nvidia 推出面向物理 AI 的全栈安全解决方案,已有机器人公司采用,目标指向更安全的 Robotaxi 与人形机器人。该方案将安全能力覆盖物理 AI 全流程,但原文未披露具体产品名称、技术参数或合作方名单。
尽管马斯克称 Tesla Optimus 未来可能以低至 2 万美元单价自动化几乎所有人类劳动、并预测 2027 年底前向公众发售,但多位机器人研究者对这类时间表持怀疑态度。
AVEVA 首席技术专家 Arti Garg 提出,工业 AI 正从预测分析转向基础模型、物理 AI 与智能体 AI,但因其直接作用于物理系统,责任部署成为关键。AVEVA 的责任 AI 框架强调安全、效率与人类监督,主张 AI 应增强而非取代关键决策中的人,并由护栏界定自动化与人工负责的边界。Garg 还参与 IEEE 工作组,制定覆盖电力、能源、水资源与碳的 AI 环境影响测量标准方法。
Anthropic 发布 Claude Haiku 5.5,这是 Haiku 系列约一年来的首次更新,定价与 OpenAI 的 GPT-6 Luna 持平,同日还下调了 Sonnet 5.5 的价格和订阅方案。
推荐理由:汇总了 Haiku 5.5 的定价、独立评测与 token 消耗数据,便于判断小模型在智能体工作流中的成本取舍。
微软在两年来的首场线下活动中发布 Surface Laptop Ultra,起售价 $2,599,搭载 Nvidia RTX Spark SoC,可选 5120 核或 6144 核 Blackwell GPU 及最高 128GB LPDDR5x 统一内存,10 月 16 日发货并已开启预售。同时公布 Windows 11 多项改动,并展示本地 AI 与智能体工作流如何重塑个人计算体验。
OpenAI 捣毁了两起借助 AI 开展的影响力行动,这些行动利用假记者和一家智库散布地缘政治信息。
Ben Affleck 表示自己从胶片转向数字电影时期开始对计算机产生兴趣,能写"相当糟糕的 Python 脚本"。他指出视觉特效工作流多年来已包含机器学习,早期用卷积神经网络对张量做边缘检测和特征提取,以便抠出绿幕画面并替换背景,而卷积神经网络是 Transformer 的前身。
Artcraft 从面向艺术家的可控 AI 转向推出七款开源应用,复刻 Photoshop、Illustrator、Premiere、Lightroom、After Effects、InDesign 和 Acrobat Pro 的界面与工具。
AWS 宣布 Claude Haiku 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上线,据 Anthropic 称它是 Claude 5.5 系列中速度最快、效率最高的模型,面向子智能体和高并发成本敏感场景,多数任务成本比 Claude Haiku 4.5 低约 75%。
推荐理由:AWS 官方给出 Haiku 5.5 的定位、成本变化与在 Bedrock 上的接入方式,便于判断它在多智能体分层中的位置。
在旧金山微软 Windows AI 与 Surface 活动上,NVIDIA 与微软宣布为 Windows PC 上的 AI 智能体共同设计软硬件,并推出 RTX Spark。
推荐理由:英伟达与微软把智能体运行所需的系统级容器和本地算力硬件一并给出,读者可据此判断本地智能体的落地条件。
Amazon Quick 与 Amazon Bedrock Knowledge Bases 在预检索 ACL 过滤之外新增实时 ACL 校验,在查询时直接向权威数据源核实权限,避免依赖可能过期或映射错误的 ACL 数据。
一名男子因利用 1 万个机器人账号和 AI 生成的歌曲在流媒体平台刷播放量,窃取 800 万美元音乐版税,被判处 18 个月监禁。该骗局通过虚增播放量冒充 Taylor Swift 等艺人以骗取版税分成。
GitHub 发布与 Microsoft Applied Sciences 联合微调的 ModernBERT 分类器,用上下文识别无固定格式的密钥,可在 2 毫秒内评估一批候选密钥,据称能把可拦截的密钥数量提高一倍以上。
推荐理由:GitHub 用九个季度数据说明密钥泄露与代码量同步增长,并给出把检测前移到 push 环节的模型方案。
微软研究院开源 Agent Lightning v1.0,一个约 3500 行代码的轻量智能体强化学习框架,提出 Harnessed Agentic RL 范式,让部署时使用的同一 agent harness 直接参与训练,无需在训练框架内重新实现智能体。
推荐理由:微软研究院开源了可直接复用真实 harness 的轻量智能体 RL 框架,并给出 6000 样本训练编码智能体的完整流程与实测增益。
AWS 提出"智能体价值模型",用于替代为 RPA 设计的传统 ROI 算法,从时间节省、异常处理、决策质量和变更韧性四个维度衡量智能体自动化的价值。该框架引用 McKinsey 的"1:3:5 模式",并给出理赔分诊示例:20 万件理赔、每件约 12 分钟、时薪 $45,自动化 70% 常规工作可释放约 28,000 小时,但释放工时并不等于节省成本。
Qlik 基于 Amazon Bedrock 打造 Qlik Answers,为全球超 4 万名客户提供带来源引用的自然语言问答,其 Discovery Agent 上线以来已为客户发现超 10 万条异常与离群点。