01 / 创作与应用

Google AI 套餐 · 扩展办公功能

Google 汇总 AI 订阅的新功能:语音操作 Gmail、Docs、Keep,使用 Pics 创建和编辑图片,通过 Sheets canvas 把表格变成交互小应用。功能按订阅档位开放。

Gmail 与 Keep 的语音能力面向 AI Plus、Pro、Ultra,Docs 的语音能力面向 Pro 和 Ultra。Pics 可以用于海报、社交媒体配图和插画编辑;Sheets canvas 可用提示词把表格数据转成交互小应用,两项都面向 Pro 与 Ultra。 Google 另在官方公告中说明,Pics 也正向大多数 Workspace 企业客户开放。

Gemini Spark 还连接了 Chrome 和 Photos,帮助处理网页事务、编辑照片或整理相册,这部分首批面向美国的 Pro、Ultra 用户。公告同时提到符合资格的大学生可申请一年免费计划,具体资格以活动规则为准。

原始来源:Google ↗

02 / 创作与应用

Suno v6 · 让改歌更具体

Suno 发布第六代音乐模型,增加局部歌词修改、多来源混搭及多种输入。v6 和 v6-wild 面向 Pro、Premier 用户,v6-mini 面向所有用户。

Suno 在 9 月 9 日介绍 v6 系列,希望让音乐生成从一次性出歌,走向更可控的创作与修改。用户可以用自然语言改动歌曲局部、调整单句歌词,或把多个来源结合成新的作品;输入可包含文字、音频、图像和视频。

三个模型的可用范围不同:v6 与 v6-wild 面向 Pro 和 Premier,v6-mini 面向所有用户。官方还披露与 Warner Music Group、BMG、Believe 的合作,并表示旧模型会随 v6 的铺开逐步退役。

原始来源:Suno ↗

03 / 开发与工作流

Copilot · 批量修复代码问题

GitHub Code Quality 加入 agentic autofix,一次可选择最多 25 个发现项交给 Copilot。它会在分支上修复和验证,随后发起 PR,由开发者审阅合并。

这项变化把代码质量工具的发现列表,与 Copilot 的修复任务直接连接起来。开发者选择问题并分配给 Copilot 后,可以在独立分支和 PR 中检查实际改动。

功能面向启用 Code Quality 的 GitHub Team、Enterprise Cloud,使用 AI credits。一次最多选择 25 个发现项,最终合并仍由开发者决定。

原始来源:GitHub ↗

04 / 额度与服务

ChatGPT Voice · 提高使用上限

OpenAI 产品团队公告提高 GPT-Live-1 使用上限:Plus 从 1 小时增加到 3 小时,100 美元档 Pro 从 12 小时增加到 15 小时,200 美元档 Pro 继续每日不限时。

Athyuttamre 发布的产品更新明确指向 ChatGPT Voice 中的 GPT-Live-1。Plus 和 100 美元档 Pro 的使用时长得到提高,200 美元档 Pro 的每日不限时安排延续。

这些数字对应语音产品与指定订阅档位,文字模型、Codex 等其他额度仍按各自规则。

原始来源:OpenAI 产品团队 ↗

05 / 研究与行业

Anthropic 报告 · 复盘安全评测异常

Anthropic 发布四次网络安全评测异常的对齐调查,分析模型行为和评测配置,披露扩大日志调查及外部调查安排。

报告讨论的是专门的网络安全测试场景,其中包括已在 7 月披露的三次事件,以及随后发现的另一事件。部分第三方测试环境错误地连接互联网,且没有使用生产环境的网络安全防护。

Anthropic 分析了偏向任务完成、冒进等行为模式,并介绍扩大日志筛查后的结果与 METR 的独立调查安排。报道这些事件时,应把模型行为与评测环境条件一并保留。

原始来源:Anthropic ↗

06 / 研究与行业

Defense Factory · AI 参与安全修复循环

OpenAI 公开 Defense Factory 的工程实践:用 AI Agent 参与资产清点、漏洞发现、验证、修复与复测,形成连续的安全修复循环。

OpenAI 表示,这项工作动员了超过 250 人,涉及大量内部系统。公开材料介绍如何组织任务、保存可复现的验证环境,并把发现的问题交给相应团队处理。

Agent 的作用覆盖发现与修复循环中的多个环节,验证在隔离环境中进行,代码改动仍保留人工审查。这是一份公司自身的工程案例与实践指南。

原始来源:OpenAI ↗

07 / 创作与应用

H3 Max · 单图调整视角

fal 为 H3 Max 上线 Multi-angle 功能:输入单张图片,设置水平、垂直镜头角度,生成视角变化。官方重点展示场景形状、位置和材质的连续性。

fal 的公告把这项功能定位为单图多角度控制。用户以角度数值指定水平和垂直方向,模型据此移动观察视角,用于商品、空间或场景的不同角度展示。

本期画面使用 fal 官方演示并静音。公告中的速度和一致性描述来自厂商展示;实际效果会随输入和场景变化。

原始来源:fal ↗

08 / 模型与算力

IBM Granite · 专注时间序列预测

IBM Research 发布 PatchTST-FM-r2 时间序列模型,约 3.85 亿参数,支持零样本预测、概率区间和缺失值补全,采用 Apache 2.0 或 OpenMDW 1.0 双许可。

与生成对话不同,时间序列模型处理按时间排列的数据,如需求、能源和其他业务指标。PatchTST-FM-r2 可接收最多 8192 个输入时间步,并输出 99 个分位数,帮助描述预测的不确定性。

IBM 发布了开放权重,并提供 Apache 2.0 或 OpenMDW 1.0 的许可选择。官方报告包含特定日期的基准成绩,使用时应结合自己的数据验证。

原始来源:IBM Research ↗

09 / 额度与服务

Codex 额度异常 · 提供重置补偿

OpenAI 团队确认 Codex / ChatGPT Work 的储备重置在一段时间内未完整生效。受影响期间使用过重置的用户将获得额外一次重置,并收到说明邮件。

Thibault Sottiaux 的说明将问题定位在已经使用的储备重置未能完整应用,影响 Codex 和 ChatGPT Work 的相应使用者。团队安排额外一次重置作为补偿。

适用范围是受此次异常影响、在相关窗口使用过重置的用户。正式通知通过说明邮件传达,本条不把它扩展为面向所有账号的普遍赠送。

原始来源:OpenAI / Thibault Sottiaux ↗

10 / 模型与算力

CUDA 13.4 · 加入 Windows on Arm

CUDA Toolkit 13.4 新增 Windows on Arm 支持,并提供更细的共享 GPU 资源控制;Rubin 架构相关支持以预览形式加入。

NVIDIA 的工具包更新扩大了开发平台范围。共享 GPU 场景中,MPS v3 的资源命名空间和内存限制等功能,为多个进程使用同一套计算资源提供更细的控制。

Rubin 部分属于预览支持。准备升级的开发者需要结合实际平台、驱动和依赖进行适配验证。

原始来源:NVIDIA ↗

11 / 额度与服务

Astra 需求旺盛 · Pro 新订阅或暂缓

OpenAI 的 Thibault Sottiaux 表示 Astra 需求异常旺盛,团队优先保障现有用户;如果需求压力持续,可能短暂暂停接受新的 Pro 订阅。

这段公开说明将 Astra 的需求描述为前所未见,团队正在采取措施维持服务。其首要目标是保障已经订阅的用户获得良好体验。

关于新增 Pro,原文使用“可能不得不暂缓”的条件性表达,并未在这条公告中宣布暂停已经生效。

原始来源:OpenAI / Thibault Sottiaux ↗

12 / 研究与行业

Paul Christiano · 加入基金会董事会

AI 对齐研究者 Paul Christiano 加入 OpenAI Foundation 董事会及安全与安保委员会,同时担任 OpenAI Group PBC 董事会的无投票权观察员。

Paul Christiano 是 Alignment Research Center 的创办者,长期从事 AI 对齐研究。OpenAI 的公告表示,他将为基金会的安全治理和关键决策监督带来独立视角。

两个组织中的身份需要区分:在 OpenAI Foundation,他是董事并加入安全与安保委员会;在 OpenAI Group PBC,他担任没有投票权的观察员。

原始来源:OpenAI ↗

13 / 额度与服务

DeepSeek 新公告 · 价格与路由将调整

DeepSeek 官方平台公告称,计划在 9 月 10 日前后发布 V4.1 Flash。Flash 新价自北京时间 9 月 10 日 12:00 起调整;V4.1 Flash 正式上线后、V4.1 Pro 上线前,Pro 请求将转至 Flash 并按其价格计费。

平台公告列出的人民币空闲时段单价,按每百万 tokens 计算,依次为:输入缓存命中 0.02 元、输入缓存未命中 1 元、输出 4 元;高峰时段各项价格为空闲时段的两倍。官方文档给出的高峰窗口是北京时间周一至周五 9:00—12:00、14:00—18:00,其余为空闲时段。

模型上线与路由切换另有时间条件。公告计划在 9 月 10 日前后正式发布 V4.1 Flash,并在它正式上线后、V4.1 Pro 上线前,将发往 V4 Pro 的请求路由到 V4.1 Flash、按 Flash 单价计费。DeepSeek 团队成员 Tianyi Cui 的公开说明与这段安排一致;本稿记录公告计划,未将未来路由写成已经切换。

原始来源:DeepSeek ↗

14 / 创作与应用

Kimi Work · 手机接续任务

Kimi 官方展示 Kimi Work 的远程控制:电脑上的任务保持运行,用户可以从手机继续推进工作,减少离开桌面造成的中断。

Kimi 的新演示围绕同一个正在运行的桌面任务展开。用户把 Kimi Work 留在电脑上工作,再通过手机继续查看和控制任务。

这里的关键是跨设备接续,电脑仍承担原先的工作环境。原帖未完整说明各操作系统和订阅档位的开放范围,本期不增加这些未披露条件。

原始来源:Kimi ↗

15 / 模型与算力

Ling 视觉模型 · 新增 API 体验入口

Novita 接入 inclusionAI 的 Ling-3.0-flash-VL,并宣布提供 14 天免费体验。模型支持原生图像、视频输入与视觉推理,可通过兼容 OpenAI 的 API 调用。

Ling-3.0-flash-VL 是建立在 Ling-3.0-flash 上的多模态 MoE 模型,官方模型卡列出约 124B 总参数、每 token 激活约 5.5B 参数,支持图像和视频理解;权重采用 MIT 许可。

本条新的使用入口来自 Novita:平台提供兼容 OpenAI 的无服务器 API,并列出函数调用、推理及 Anthropic API 支持。14 天免费属于 Novita 此次上线活动,其他平台条件分别适用。模型卡对上下文长度的概述存在差异,本期不引用该数字。

原始来源:Novita / inclusionAI ↗

16 / 模型与算力

千问模型 · 新增 NVIDIA 部署方案

NVIDIA 发布 Qwen3.8-Flash-Next 在 GB300 NVL72 上用于 Agent 编程的部署指南,覆盖 SGLang、vLLM、TensorRT-LLM 以及相关调优工具。

这篇新指南围绕模型服务和 Agent 编程场景,说明 NVIDIA 的推理工具与硬件如何配合部署 Qwen3.8-Flash-Next,也介绍与 NeMo 相关的微调路径。

本条的新进展是部署方案与基础设施适配,模型权重发布更早。文章的吞吐性能来自厂商指定的测试环境,本期不把它概括成所有部署都能达到的指标。

原始来源:NVIDIA ↗

17 / 开发与工作流

Qoder 移动端:语音下任务、手机验收成果

Qoder 在 9 月 8 日宣布,移动端已支持连接全新桌面端,并改进语音下任务、过程查看、锁屏授权和成果预览。任务基于电脑上的本地文件与环境运行。

用户可以通过 Q 达鸭实时语音提出需求,查看步骤、待办、子智能体及待处理事项,也能把历史消息放回输入框修改。多任务通知会显示任务名称、状态和结果摘要。

遇到授权请求,可在支持的锁屏卡片上查看具体操作并允许或拒绝;这项能力目前仅支持 iOS 和部分安卓机型。图片、PDF、Markdown、HTML、文档和 PPT 等成果可以在手机查看,HTML 可预览和检查源码。

企业管理员可管理产物下载、分享,以及成员的移动端和网页远程任务权限。这次报道的是 9 月 8 日对新版桌面端和移动体验的更新,早期远程控制能力已有发布。

原始来源:Qoder ↗

把关注,变成持续的探索。

回看其他期次,或在你习惯的平台继续关注。

回到日报归档 ↗