Py学习  »  chatgpt

Google 连夜上新三款模型;Claude Cowork 新增"录制技能"功能;OpenAI 在 ChatGPT 中正式推出广告服务

学术AI大模型 • 4 周前 • 89 次点击  
今日 AI 快讯 | 一分钟速览
01 Google 发布 Gemini 3.6 Flash、3.5 Flash-Lite 与 3.5 Flash Cyber 三款新模型:Google DeepMind 推出 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款新模型。其中 Gemini 3.6 Flash 为最新主力模型,3.5 Flash-Lite 主打更低成本与更高效率,3.5 Flash Cyber 则针对网络安全场景优化。
02 Claude Cowork 新增"录制技能"功能:Anthropic 为 Claude Cowork 推出“录制技能”功能,面向 Pro、Max 及 Teams 订阅用户开放。用户通过录屏和语音讲解演示操作流程,AI 会自动追踪屏幕活动、鼠标移动、击键及语音,并将其汇编为可复用的结构化技能,无需编写脚本即可让 AI 学习重复性电脑操作。
03 OpenAI 在 ChatGPT 中正式推出广告服务:OpenAI 在 ChatGPT 中推出原生广告服务,允许广告主在用户探索选项、比较选择和做出决策时投放相关广告。广告在体验中会被明确标注并与回答区分。
04 OpenAI 最强 AI 模型 GPT-6 测试文档曝光:@daniel_mac8 发布博文,分享了一份未经证实的测试文档内容,预估关联 OpenAI 的 GPT-6 模型。消息称 OpenAI 的 GPT-6 模型将会达到通用人工智能水平,在内部计算充足的情况下,不需要使用 Lean,也不需要使用任何特殊测试框架,有 48% 的概率完全自主地、一击即中、解决单位距离问题。
05 通义千问发布 Qwen-Image-3.0 图像生成模型:通义千问发布第三代图像生成基座模型 Qwen-Image-3.0。该模型支持最长 4.5k token 指令输入,可单次生成包含 9 个复杂信息图的 3×3 网格布局;文本渲染精度达 10px,并支持 12 种语言原生渲染,旨在将图像转化为可部署的生产力工具。
06 Karpathy 表示用语音与LLM长谈可提升其理解效率Andrej Karpathy 发现与 AI 进行10分钟左右的自由漫谈,即使内容混乱,也可以提升 LLM 的理解效率。因为 LLM 擅长从长篇不连贯的语音中重构意图,理解用户最初思路,从而减少后续修正次数、提升人机对齐效率。
07  DeepSeek 因技术原因暂不可用联网搜索:DeepSeek 今日出现联网搜索无法使用的情况,提示“由于技术原因,联网搜索暂不可用”。我们让其检索今日新闻,DeepSeek 表示内部知识截止到 2025 年 5 月,因此无法给出今天发生的实时新闻。
08 北京通用人工智能研究院院长朱松纯表示 AI 行业少不了文科生:据央视财经报道,北京通用人工智能研究院院长、北京大学智能学院院长朱松纯表示,通用人工智能本质是“造人”,这恰恰是人文社科的长项。他还寄语青年与家长:未来的 AI 时代,我们需要的是穿透文理工跨界的“通才”。

主要日讯解读:
01 Google 发布 Gemini 3.6 Flash、3.5 Flash-Lite 与 3.5 Flash Cyber 三款新模型:

7月21日,谷歌发布Gemini 3.6 Flash、Gemini 3.5 Flash-Lite和Gemini 3.5 Flash Cyber三款模型,分别面向通用任务、智能体和网络安全场景。

Gemini 3.6 Flash 提升了编程、知识工作与多模态能力,输出 Token 用量较 3.5 Flash减少17%,价格也进一步下调;Flash-Lite 则主打低延迟和高吞吐。多项人工智能基准测试显示,上一代 Gemini Flash 在编程、金融等任务中已具备较强竞争力。谷歌表示,此次推出的 Gemini 3.6 Flash 在综合能力进一步提升的同时,也降低了模型使用成本。

Flash Cyber可用于发现、验证并修复软件漏洞。谷歌称,该模型在 V8 JavaScript 引擎测试中发现55个已确认问题,其中10个未被对比模型识别。鉴于相关能力可能被滥用,该模型将先通过 CodeMender 向政府机构和可信合作伙伴限量开放。

谷歌 Gemini 团队产品管理高级总监 Tulsee Doshi 表示,这几款新的 Flash 模型旨在实现效率与性能之间的最佳平衡。

与此同时,谷歌还在开发旗舰模型 Gemini 3.5 Pro,这将是公司性能最强的 AI 系统。今年 5 月,谷歌曾表示该模型将于 6 月推出,但目前仍未正式发布。谷歌表示,Gemini 3.5 Pro 仍处于测试阶段,一旦准备就绪,将尽快向广大用户开放。

谷歌还称,已开始对 Gemini 4 进行预训练。

02 Claude Cowork 新增"录制技能"功能:

Anthropic近日为Claude Cowork推出“Record a skill”功能。用户在执行任务时,可录制屏幕并同步讲解操作步骤,Claude会将录制内容转化为可重复调用的Skill并保存。此后遇到同类任务,用户无需再次演示,只需运行相应Skill即可。

该功能位于Claude桌面应用“+”菜单,目前面向Pro、Max和Team套餐开放。此次更新降低了自动化工作流的创建门槛,让不具备编程基础的用户也能通过“示范一次”教会Claude处理重复任务,推动个人经验进一步转化为可复用的智能体能力。

03 OpenAI 在 ChatGPT 中正式推出广告服务:

OpenAI上线ChatGPT广告平台,向企业开放AI原生投放入口。根据官方网站,广告主可在用户探索方案、比较选择和作出决策时,以与对话情境相关的广告触达潜在客户。与传统关键词广告相比,ChatGPT 广告将利用更丰富的上下文信号,提高内容的相关性与实用性。

广告主注册后可进入Ads Manager,完成账户与广告系列创建、预算和目标设置、广告素材添加及上线投放。平台支持直接创建或批量上传广告信息,并提供展示量、点击量、转化等效果数据,广告主可据此调整广告系列并优化表现。OpenAI披露,Best Buy、Lowe’s和VistaPrint等品牌已参与早期投放。

OpenAI同时强调,ChatGPT广告将采取审慎推进策略:所有广告均会被明确标注,并与模型生成的回答保持区隔;用户可控制自身数据如何用于广告。OpenAI 希望借助对话、上下文和实时决策能力,建立区别于搜索与社交平台的 AI 原生广告模式,在拓展商业化收入的同时维持用户对ChatGPT的信任。

Python社区是高质量的Python/Django开发社区
本文地址:http://www.python88.com/topic/199093