今日 AI 快讯 | 一分钟速览
01 Anthropic 发布 Claude Opus 5:Anthropic 发布 Claude Opus 5,其智能水平接近 Claude Fable 5,但价格减半。该模型在 Frontier-Bench v0.1 上性能超过 Opus 4.8 两倍以上,在 ARC-AGI 3 上得分是次优模型的三倍。Opus 5 即日起成为 Claude Max 的默认模型和 Claude Pro 的最强模型。
02 OpenAI 宣布 ChatGPT Work 活跃用户数超越 Codex:Codex 负责人 Tibo 宣布,ChatGPT Work 的活跃用户数已正式超越 Codex。
03 黄仁勋牵头50家科技企业联名呼吁开放权重AI模型:英伟达CEO黄仁勋牵头,联合微软、Meta、谷歌等50家科技企业发表公开信,呼吁支持开放权重AI模型,反对因安全之名限制开源。信中指出开放模型可避免权力垄断、提升安全性。亚马逊及旗下Anthropic因坚持闭源路线,未参与联署。
04 Anthropic 更新上下文工程指南并推出配置优化命令:Claude Code 开发者 Thariq 发文,介绍其团队已为最新模型移除超 80% 的 Claude Code 系统提示词且无性能损失,并推出claude doctor 命令协助用户精简配置。
05 Andrej Karpathy 否认从 Anthropic 离职,称相关传闻为虚假信息:Andrej Karpathy 否认网传其已从 Anthropic 离职的说法,称这是虚假信息。他表示自己只是在清理个人简介,并非离职。
06 Kimi 在 Kimi Code Plan 新增 k3-256k 模型ID:Kimi 官方宣布 Kimi Code Plan 新增 k3-256k 模型ID。该模型适用于日常开发,额度消耗约为 k3 的一半,但不支持视频输入。
07 OpenAI 为 ChatGPT Work agent 上线云浏览器登录功能:OpenAI 宣布,ChatGPT Work agent 现已支持通过云浏览器登录需要认证的网站,登录状态可跨会话持久保持。目前用户只能在ChatGPT.com上接管云浏览器,且暂不支持passkey登录。
08 Elon Musk称Grok 4.6及4.7将在四周内相继发布:SpaceXAI CEO Elon Musk 宣布 Grok 4.6 将于 2 周后 发布,Grok 4.7 将于 4 周后 推出。该发布时间表目前为其个人预告,后续实际进展或发生变动。
主要日讯解读
01 Anthropic 发布 Claude Opus 5:
Anthropic推出旗舰模型 Claude Opus 5,性能较 Opus 4.8 提升一倍以上,价格保持不变。该模型定位日常高性能场景,部分能力接近更高规格的 Claude Fable 5,价格仅约为后者一半,现已作为 Claude Max 服务默认模型上线。
评测方面,Opus 5在 Frontier-Bench v0.1 测试中任务性能提升超一倍,单位成本更低;CursorBench 3.2 最高努力模式下得分仅比 Fable 5 峰值低 0.5%,成本约减半;ARC-AGI 3 测试得分约为第二名的 3 倍,Zapier AutomationBench 通过率约为成本相近模型的 1.5 倍。科研能力显著提升,有机化学任务较前代高出 10.2 个百分点,蛋白质功能预测高出 7.7 个百分点。
实际应用中,模型展现出自主验证与修复能力:可根据零件图纸生成三维模型、发现并修复开源软件包管理器实际漏洞、协助构建交易所数据接口。安全方面,安全分类器触发次数预计比 Fable 5 减少约 85% ,但仍限制二进制漏洞扫描、渗透测试及利用代码生成等高风险操作。
价格保持输入每百万词元 5 美元、输出 25 美元,同步推出速度提升 2.5 倍的 Opus 5 Fast 模式,并开放对话中途工具切换与API自动回退功能测试。
02 OpenAI 宣布 ChatGPT Work 活跃用户数超越 Codex:
Codex 负责人 Tibo 通过社交平台宣布,ChatGPT Work 的活跃用户数已正式超越 Codex。
但该消息也引发了一些用户对使用限制的抱怨。 有用户推测,Work 模式被设为默认选项可能是其用户量增长的原因之一。
此外,部分用户表达了对 ChatGPT 中 Chat、Work 和 Codex 三者定位差异的困惑。
03
黄仁勋牵头50家科技企业联名呼吁开放权重AI模型:
英伟达首席执行官黄仁勋在其社交媒体账号上发布首条推文,内容为一封题为《开放权重与美国AI领导力》的联合公开信。该信由黄仁勋牵头,最初获得英伟达、微软、Meta、IBM等25家企业和机构联署,其后谷歌、AMD、OpenAI等相继加入,签署方已增至50家。
公开信指出,开放权重模型有助于降低人工智能应用门槛,确保技术红利被社会广泛共享,避免核心能力集中于少数企业手中,防止形成垄断格局。针对开放模型可能带来安全风险的论调,信中回应称,闭源模型同样存在被破解和滥用的可能,将先进能力集中于少数黑箱模型反而会造成“单点故障”,不利于整体安全。开放生态允许更多研究者参与漏洞发现与修复,有助于提升系统的安全性与透明度。
信中还呼吁美国政策制定者审慎出台监管措施,避免对开放权重模型的研发与商用施加过度限制。
截至目前,亚马逊与人工智能公司Anthropic未签署该公开信。分析认为,这主要源于商业利益考量——Anthropic坚持闭源模型服务路线,且亚马逊为其最大投资者。这一分歧也折射出美国科技界在人工智能技术发展路径上的深层分歧。
05 Andrej Karpathy 否认从 Anthropic 离职:
网传 Andrej Karpathy 已从 Anthropic 离职,该说法在社交媒体上引发关注。
之所以会产生这样的说法,因为 Karpathy 本人在推特简介上删除了有关在 Anthropic 任职的信息。
不过他事后在 Twitter 上明确否认,称这是“奇怪的虚假信息”。他表示自己只是在清理个人简介,并指出如果真要宣布此类消息,方式应该是发布文章并与团队分享,而不是修改简介。