搜索

Grok 进入 Word、Excel 和 PowerPoint 的 Copilot,OpenAI 将美国政府机构的 ChatGPT 许可费降至零,DeepSeek 保留 V4 Pro

由人工智能生成的文章
Grok 进入 Word、Excel 和 PowerPoint 的 Copilot,OpenAI 将美国政府机构的 ChatGPT 许可费降至零,DeepSeek 保留 V4 Pro

ai-powered-markdown-translator

使用 gpt-5.6-sol 将文章从法语翻译成中文。

在 GitHub 上查看项目 ↗

本周六没有新的旗舰模型,但对于已经在使用这些工具的人来说,却有一些切实的变化。继 Grok Bot 进入 Teams 的第二天,Microsoft 开始在 Word、Excel 和 PowerPoint 的 Copilot 中部署 SpaceXAI 的 Grok 模型;OpenAI 将美国所有政府机构的 ChatGPT 许可价格降至零,同时呼吁制定联邦法律;DeepSeek 文档则取消了原定于 9 月 14 日实施的 V4 Pro 重定向。开发工具方面,Amp 对自带算力和模型的用户免费,而 Gemini CLI 和 Vibe CLI 则收紧了安全控制。


Grok 进驻 Microsoft 套件,从 Word、Excel 和 PowerPoint 的 Copilot 到 Teams

9 月 12 日 — Microsoft 宣布在 Word、Excel 和 PowerPoint 的 Copilot 中部署 SpaceXAI 的 Grok 模型。此次发布具有针对性:首批仅面向 Microsoft Frontier 计划的客户,Microsoft 将其定位为扩大 Copilot 所提供的模型选择。不到一小时后,@grok 账号转发了这则公告。

Launching even more models in Copilot. Grok models from SpaceXAI are rolling out in Copilot in Word, Excel, and PowerPoint—starting with a focused release to customers in the Microsoft Frontier program.

🇨🇳 更多模型正在进入 Copilot。SpaceXAI 的 Grok 模型正逐步部署到 Word、Excel 和 PowerPoint 的 Copilot 中,首先面向 Microsoft Frontier 计划的客户进行定向发布。@Microsoft365 在 X 上

这里的区别很重要:SpaceXAI 自 6 月和 7 月起就已为 Word、Excel、PowerPoint 和 Outlook 提供自己的 Grok 加载项,而自 8 月底以来,用户也可以在 Microsoft Foundry 上使用 Grok 4.6。这一次,则是 Grok 模型进入 Microsoft 自己的 Copilot。公告既未说明涉及哪个 Grok 版本,也未说明价格以及 Frontier 计划之后的时间表。

🔗 Grok 在 X 上转发公告

Grok Bot 在 Microsoft Teams 中搜索并执行操作

9 月 11 日 — 在 Microsoft 公告发布的前一天,@bot 账号表示,SpaceXAI 的持久化智能体产品 Grok Bot 现在可以代表用户在 Microsoft Teams 中搜索并执行操作。太平洋时间 9 月 10 日傍晚发布的一则消息已经开始面向销售团队:Grok Bot 可连接 Salesforce、HubSpot、Gong、Clay 和 Granola,以跟踪客户账户、进行后续联系并开展深入研究。这些连接器延续了 9 月初推出的功能,包括 Grok Bot for Enterprise、填写表单和撰写消息。两则消息均未说明所需套餐、价格或使用限制。

🔗 Grok Bot 在 X 上发布的 Microsoft Teams 公告


OpenAI 面对美国政府:一边参与公共采购,一边呼吁立法

9 月 9 日和 10 日 — OpenAI 在本周中发布的两篇文章未被我们此前的版本收录,它们展现了这家公司以两种方式面对美国公权力:既向政府出售服务,也要求立法者对其加以监管。

OneGov 2.0:面向所有政府机构的零美元 ChatGPT 许可

9 月 10 日 — OpenAI for Government 与美国联邦总务管理局(General Services Administration,GSA)签署了一项新的多年期协议,延续去年的联邦优惠方案。通常每位用户每月收费 15 美元的许可现降至零,无最低承诺要求,使用费则减半。该优惠如今不再局限于联邦层级:各州、地方政府和部落政府首次获得使用资格。通过现有协议,已有超过 100 万名政府工作人员可以使用 ChatGPT;符合资格的人数将扩大至约 2,300 万,GPT-6 Astra 也属于所提供的工具之一。

协议项目公布内容
每位用户的许可0 美元,而非每月 15 美元,无最低承诺要求
模型使用优惠 50%
符合资格的政府机构联邦政府、各州、地方政府和部落政府
网络防御部分Daybreak Blue 按商业价格的 50% 收费,Daybreak Red 可按需以标准价格提供
协议期限27 个月,自 2026 年 10 月 1 日至 2028 年 12 月 31 日

网络防御部分延续了前一周宣布、规模达 10 亿美元的 Daybreak for Frontline Defenders。OpenAI 重申,ChatGPT Enterprise 不会使用组织的输入或输出数据来训练模型。产品介绍网络研讨会定于 9 月 14 日举行。

🔗 扩大联邦、州、地方和部落政府的人工智能使用及网络防御能力

一篇呼吁联邦立法并支持四项加州法案的评论文章

9 月 9 日 — OpenAI 全球事务负责人(Chief Global Affairs Officer)Chris Lehane 在一篇认为政治窗口期已经开启的评论文章中,呼吁国会在本届会期结束前通过一项基于模型能力的强制性全国监管制度。这些义务应针对开发能力最强系统的少数实验室,而非初创公司或小型开发者;安全政策也不应演变为反对开放权重模型的政策。与此同时,OpenAI 正式支持加州立法机构通过并提交给州长 Newsom 的四项法案。SB 1119 就是其中之一:OpenAI 已于 8 月底宣布支持该法案。

加州法案法案内容
SB 813独立安全评估框架
AB 1405适用于人工智能审计人员的标准
SB 1119保护使用陪伴型聊天机器人的未成年人
AB 1864防范人工智能助长的生物威胁

Some of these bills we did not endorse in the past, and are now supporting after reconsidering in light of the recent jump in capabilities we have seen.

🇨🇳 我们过去并未支持其中某些法案,但在根据近期观察到的能力跃升重新审视后,我们现在决定支持它们。 — OpenAI 全球事务负责人 Chris Lehane

文章还呼吁制定监测失调(misalignment)的行业标准:如果模型在开发或评估期间未经授权绕过相关组织的安全控制,应迅速向这些组织发出书面通知。对于 Astra,OpenAI 表示会监测完整轨迹,包括思维链,并在扩大任何内部部署之前强制进行对齐评估。文章称,目前尚未发生完全自主的递归式自我改进(recursive self-improvement),在能够确保安全之前,也不应追求这种能力。

🔗 人工智能政策窗口已经开启。我们需要采取行动。


DeepSeek 最终决定在 9 月 14 日后继续提供 V4 Pro API

9 月 12 日发现 — DeepSeek 的 API 文档如今给出了与 9 月 10 日公告相反的信息。当天,随着 V4.1-Flash 发布,DeepSeek 原计划终止 V4 Pro:从 9 月 14 日 04:00 UTC 起,所有发送至 deepseek-v4-pro 的请求都将被重定向至 V4.1-Flash,并按 Flash 费率计费,直至 V4.1-Pro 发布。Models & Pricing 页面上的一则注释现在表示,为满足用户需求,DeepSeek 将在 9 月 14 日后继续提供 V4 Pro API,计费保持不变;如果日后再次调整,公司将提前通知。

同一段内容也出现在 9 月 10 日的更新日志(Change Log)条目中,英文版和中文版均是如此。DeepSeek 没有注明此次改弦更张的日期,也未在 X 上转发相关消息,而 9 月 10 日的公告文章仍显示原有时间表:两个相互矛盾的版本目前仍同时在线。

每百万 tokens 的计费项目deepseek-flash,非高峰时段deepseek-flash,高峰时段deepseek-v4-pro,非高峰时段deepseek-v4-pro,高峰时段
缓存命中的输入(cache hit)0,003 美元0,006 美元0,022 美元0,044 美元
缓存未命中的输入(cache miss)0,15 美元0,30 美元0,66 美元1,32 美元
输出 tokens0,60 美元1,20 美元1,98 美元3,96 美元
并发请求数2 5002 500500500
图像理解

因此,API 用户不会遭遇自动重定向:两种模型将同时存在,均具有 100 万 tokens 的上下文窗口和最高 384K 的输出长度。根据计费项目不同,V4 Pro 的价格为 Flash 的 3.3 至 7.3 倍。高峰时段为周一至周五的 01:00 至 04:00 和 06:00 至 10:00 UTC,其余时段按半价计费。

🔗 DeepSeek API 的 Models & Pricing 🔗 DeepSeek API 更新日志


Amp 对自带算力和模型订阅的用户免费

9 月 12 日 — Amp 发布了一篇题为 Free Agent、网站标注日期为 9 月 13 日的文章,改变了其编程智能体的计费逻辑。只要用户自带算力以及模型订阅或密钥,即可免费使用。连接 ChatGPT 订阅不再需要月度套餐;对于 Enterprise 以外的所有客户,自带个人 API 密钥(Bring Your Own Key,BYOK)也不再收取按 token 计算的费用或设置上限。Amp 现在会对 orbs 收费,这是其供智能体自主并行工作的远程机器;安装在用户自有机器上的执行器(runners)则可免费替代它们。用户仍可通过 Amp 购买推理服务,且不加价。

Amp 套餐标示价格套餐内容
Hobby(新)免费所有功能、按使用量付费的 orbs 或免费的个人执行器、无费用且无上限的 BYOK
Individual(Megawatt 或 Gigawatt)Megawatt 每月 20 美元45 000 分钟的 orb 使用时间、不限数量的公开和私有仓库
Teams(新)不额外收费成员可使用不同套餐、共享线程和门户、共用额度、SAML/OIDC SSO
Enterprise询价无付费席位的共用额度、SCIM、支出上限、审计日志

对团队而言,入门成本已经消失:所有人都可以免费受邀加入工作区,而高频用户可升级到付费套餐,以获得使用费折扣;据 Amp 称,Megawatt 平均优惠 60%,Gigawatt 平均优惠 65%。只要有一名成员付费,整个工作区即可免费使用 SAML/OIDC 单点登录;此前仅通过合同向 Enterprise 客户保证的零数据保留或最少数据保留政策,也扩展至所有用户。最后,Megawatt 和 Gigawatt 将获得另外八家提供商的抢先使用权,其中包括 OpenRouter、Amazon Bedrock 和 Ollama Cloud。

🔗 Amp 的 Free Agent 文章


ChatGPT 桌面版 26.908:可通过 Pets 发起快速对话,Appshots 登陆 Windows

9 月 11 日 — OpenAI 发布以 Pets 为重点的 ChatGPT 桌面应用 26.908 版。这些可选的动画伙伴会悬浮在 macOS 和 Windows 的其他窗口之上,此前用于跟踪进行中的对话。现在,它们也成为对话起点:用户可通过宠物下方的控制栏输入快速对话(Quick Chat),按回车键发送,无需打开主窗口。全局快捷键可以调出这些控制栏,macOS 上为 Option+空格,Windows 上为 Windows+Alt+P;Mini 模式沿用相同的快捷键和通知,但屏幕上不会显示宠物。

宠物会显示四种状态:对话进行中、等待决定、已完成或因错误受阻,并会优先展示等待回复的线程。通过这些控制栏发起的对话将在任何项目之外创建;自定义宠物仍存储在本机,不会与网页版 ChatGPT 同步。

此外,8 月底在 macOS 上推出的 Appshots 现已登陆 Windows:同时按下两个 Alt 键,即可将前台窗口以屏幕截图及可用文本的形式发送给 ChatGPT,并选择发送到哪个对话。该快捷键可以自定义;在 Windows 上,appshot 会在主应用中打开。

🔗 ChatGPT 在 X 上的公告 🔗 ChatGPT 应用更新日志


Gemini CLI nightly 隔离沙箱并监控构建文件

9 月 12 日 — 在 9 月 10 日和 11 日连续两个 nightly 未发生代码变更后,Gemini CLI 的 v0.61.0-nightly.20260912 带来了两项变化,均聚焦于安全性,延续了 9 月 2 日、4 日和 5 日 nightly 的方向。stable(v0.59.0)和 preview(v0.60.0-preview.0)渠道保持不变。

第一项(PR #29250)针对构建文件引发的间接提示词注入(indirect prompt injection):经过恶意构造的外部内容诱使代理修改 Makefilepackage.json,然后启动构建。CLI 现在会跟踪会话期间创建或修改的构建配置文件,之后运行的任何构建或测试命令(npm runmakecargoblaze)都需要明确确认。当命令使用来自不可信外部内容的参数时,同样适用此规则:Google Docs、Buganizer、通过 web fetch 获取的页面或 MCP 服务器的响应。

第二项(PR #29214,45 个 commits)将沙箱(sandbox)与用户配置和凭据隔离。Gemini CLI 会拒绝从用户主目录、系统根目录或 ~/.gemini 启动沙箱,也拒绝将这些路径挂载到容器中;容器现在只能获得一份经过清理的设置副本,其中不含 hooks 或 API 密钥。在 macOS 上,Seatbelt 配置文件禁止写入 ~/.gemini 和敏感文件(oauth_creds.jsontrustedFolders.json.env),同时禁止读取凭据存储和 hooks 定义。

🔗 nightly v0.61.0-nightly.20260912 说明


Vibe CLI 2.25.4 要求对高风险 shell 语法进行批准

9 月 12 日 — Mistral 发布 Vibe CLI 2.25.4,这是四天内的第四个版本。这个修复版本首先涉及安全性:对于可能绕过工作区检查和拒绝列表(denylist)的高风险命令语法及选项,shell 权限检查现在要求用户批准。版本说明将此项加固与四个标识符关联起来,即 CVE-2026-87984 至 CVE-2026-87987,以及 CVE-2026-87988 的残留变体。截至 9 月 12 日,该代码仓库中没有安全公告,这些漏洞的严重程度也未注明。

智能批准(smart approve)的行为再次发生变化;2.25.1 已经禁止它自动批准可能显示秘密信息的 git 命令。现在,当系统再次请求执行高风险操作时,它不再只是阻止该操作,而是会请求确认并显示原因。由它自动批准的调用现在显示为普通提示,而不再是警告;当渐进式部署启用此模式时,它也会出现在 Vibe Desktop 的模式选择器中。

其余改动提升了日常使用的可靠性:无效连接器不再阻止其他连接器加载,通过 @ 引用文件的功能可用于 --add-dir 添加的所有根目录,Zed 和 JetBrains 等 ACP 客户端也始终会显示当前模式。

🔗 GitHub 上的 2.25.4 版本说明


Wringer:每个权重 2.655 bits 的 40 亿参数推理模型

9 月 12 日 — weiciao wu 在 Hugging Face 社区博客上发布 Wringer,这是一种在 InternScience/Agents-A1-4B 上测试的量化方法;该模型采用 Qwen3.5 混合架构,拥有 40 亿参数,专用于推理。这是个人贡献,并非实验室发布成果。模型主体降至每个权重 2.655 bits,在 IFEval、HumanEval 和 GSM8K 上平均保留了原始分数的 93.7%;相比之下,同一模型的 GGUF 量化曲线经插值计算,在相同比特率下会降至 52.7%。

该方法分为三个步骤。首先使用完整协方差矩阵执行 GPTQ 闭式量化,即可达到 81.4% 的保留率。随后,填充(fill)步骤会冻结编码,并为每个线性层加入一个秩为 128 的适配器;该适配器使用约 1 亿个 tokens 进行自蒸馏训练,在单个 GPU 上耗时约 7 小时 30 分钟。最后,压榨(wring)步骤通过重新计算编码以吸收适配器的贡献,从而移除适配器:比特预算不变,推理时也不再需要适配器。

测试配置主体每个权重的 bitsIFEval 分数HumanEval 分数GSM8K 分数平均保留率
bf16,基准1692,7994,5195,53100 %
GGUF,IQ2_M 类别2,76373,3863,4176,6575,47 %
未训练的 Wringer2,65575,9770,7383,7081,44 %
Wringer,两个周期(已发布模型)2,65588,1785,3793,4894,65 %
GGUF,IQ2_XXS 类别2,55834,3820,1236,5432,16 %

93.7% 这一数字对应单个周期的初始评估;Hub 上发布的双周期模型达到 94.65%。其局限性也已明确列出:2.655 bits 只涵盖模型主体的线性权重;若 embedding 保留为 bf16,整个模型相当于每个权重 4.69 bits。由于缺少原生低比特内核,vLLM 推理时会恢复为 bf16,因此实际运行中尚未证明能节省内存或提升速度;评估也仅限于一个模型、三个 benchmarks,以及与 GGUF 的比较。该项目在单个 GPU 上耗时约五周,由一个代理运行多组实验流程,再由一名人员选择研究方向。

🔗 Hugging Face 博客上的 Wringer


简讯

  • Cognition 和 Perplexity 将端到端测试交给 GPT-6 Astra — 两项 API 案例研究。Devin 测试 iPhone 游戏 Otter Run,并返回模拟器中的录屏以及一份区分已通过检查与未测试区域的报告;Perplexity 则让 Astra 构建一个模拟其他服务响应的小程序,用于对应用程序进行端到端测试。🔗 来源
  • OpenAI Developers 汇集了十三个使用 GPT-6 Astra 构建的项目 — 其中包括可供 3D 探索的 2,234 个解剖部件、使用 Unreal Engine 重建的 Manhattan、一幅古老火车图画转化而成的 Blender 模型(包含 3,295 个可编辑对象),以及一个用 C++ 编写并移植到 iPhone GPU 上以 Swift 运行的光线追踪器(ray tracer)。🔗 来源
  • autofinetune 将数十次 Gemma fine-tuning 实验交给代理 — 据 Google Developers Blog 介绍,Antigravity CLI 和 Gemini 3.7 Flash 会修改训练脚本,在 Cloud TPU 上启动 Tunix,并只保留取得更好结果的 commits。结果是:数小时内在 FunctionGemma 270M 上完成 20 次实验,随后用两到三天在 Gemma 3 1B 上完成 40 次 GRPO 实验,奖励提升约 10%。🔗 来源
  • ToolGrad 从答案出发生成工具使用数据 — 补记 9 月 10 日消息:Google Research 首先构建一条有效的 API 调用链,再编写请求;在 ToolBench 超过 16,000 个 API 上,成功率接近 100%。使用这些数据微调的 Gemma 3 12B 在 BFCL 上获得 83.1 分,gemini-2.5-pro 为 83.2 分,GPT-5 为 74.4 分;后两者是文章发布时的领先模型。🔗 来源
  • Gemini API 文档登陆 Google AI Studio — 补记 9 月 10 日消息:这是一个从零重建、可通过 ai.studio/docs 访问的首个预览版本;Logan Kilpatrick 称其设计同时面向人类和代理。相关消息没有说明代理如何使用它。🔗 来源
  • Google 在威尼斯电影节支持三个 Android XR 项目 — 100 ZEROS 团队参与了 Andy Serkis 的 NEVATARS 和由 Margot Robbie 旁白的 Galápagos: The Last Eden;在后者中,Gemini 会驱动与观众的对话。团队还参与了 Asylm Studios 心理惊悚片 Sedona 的预告片,将其自动从 2D 转换为 3D。文章未提供具体模型或上线日期。🔗 来源
  • Claude Code 2.1.270 修复 2.1.269 的回归问题 — 通过 Bash 工具运行的只读 git 命令,不再在会话持续一段时间后重新请求授权。这是该版本唯一的变化。🔗 来源
  • Claude Enterprise 上的智能报告(smart reports)进入测试阶段 — 补记 9 月 10 日消息:Claude 会分析一个团队最长 28 天内的部分对话记录,并撰写报告,说明已完成的工作、成本、阻碍,以及可转化为共享 skills 的重复任务。测试期间每月提供十份免费报告,功能默认关闭。🔗 来源
  • Copilot 指标开始衡量 VS Code 的 Agents 窗口 — 现已正式发布的新字段会统计该窗口在 1 天和 28 天周期内的每日活跃用户数、会话数和消息数,并可按企业、组织或用户查看。仅所有者、账单管理员以及拥有 View Copilot Metrics 权限的角色可以访问。🔗 来源
  • GitHub 再次推广 Universe 2026 门票 — 一段短视频重点展示了被称为迷你计算机的可编程徽章,该徽章仅提供给现场参与者:10 月 28 日和 29 日在 San Francisco 举行的线下活动通票价格为 1,399 美元,线上参与免费。这是一次没有产品公告的推广,与 8 月 22 日和 9 月 7 日的再次宣传一脉相承。🔗 来源
  • Fugu Ultra v2 登陆 OpenRouter — Sakana AI 的高端编排器在该平台上的价格为每百万输入 tokens 5 美元、每百万输出 tokens 30 美元,上下文长度为 100 万 tokens。超过 272,000 tokens 的 prompts 收费更高,编排本身消耗的 tokens 也按普通 tokens 计费。🔗 来源
  • ChordStream:用于符号音乐模型的每和弦 64-bit token — 该规范发布于 Hugging Face 社区博客:每个 token 包含和弦的调性、级数、低音和位置,这些信息从 MIDI 文件或 REMI 流中提取,并配套提供 captioned-ChordStream 数据集。提取器仍采用启发式方法,且尚未展示任何训练完成的模型。🔗 来源
  • Qwen3.8-27B 在 Cerebras 上以约每秒 1,850 tokens 的速度运行 — 免费访问提供 64k tokens 上下文,付费访问提供 128k;每百万输入 tokens 收费 0.99 美元,每百万输出 tokens 收费 1.49 美元。Cerebras 称其在 Artificial Analysis Intelligence Index 上获得 34 分。🔗 来源

这意味着什么

当天的第一条主线是分发。Grok 模型通过 Microsoft 进入 Word、Excel 和 PowerPoint 的 Copilot,而 SpaceXAI 此前已为这些应用提供自有插件;在此之前一天,Grok Bot 也已进入 Teams,而它此前还连接了 Salesforce 或 HubSpot 等商业工具。OpenAI 同样押注这一领域,推出桌面版 ChatGPT:用户可从悬浮助手开始对话,Windows 现在还能通过两个按键将窗口发送给 ChatGPT。Microsoft 也将 Grok 的到来描述为扩展 Copilot 中的模型选择:模型成为已打开工具中的一个选项,而不再只是一款需要另行寻找的应用。

第二条主线是政策。两天之内,OpenAI 发布了一项协议,将约 2,300 万美国公共部门工作人员使用 ChatGPT 的许可费用降至零,覆盖联邦政府至部落政府;它还发表文章,呼吁国会制定一部基于模型能力的强制性法律。这两份文本彼此呼应:该公司正在成为覆盖全美各级行政机构的供应商,同时主张义务应由少数开发最强大系统的实验室承担,而不是由 startups 或开放权重模型承担。它对四项 California 法案的支持——其中一些此前并不受其支持——体现了文章所称的逆向联邦主义(reverse federalism):在等待联邦层面行动期间,各州法律逐渐趋同。

第三条主线是使用成本。Amp 不再对用户自行提供的 tokens 收费,以无利润方式转售推理服务,并将收费重点转向运行代理的远程机器。DeepSeek 原本计划撤下 V4 Pro,改推更便宜的 V4.1-Flash,但为响应需求,仍以原价保留 V4 Pro,尽管其价格高出 3.3 至 7.3 倍:部分用户对特定模型的坚持超过了对最低价格的追求。Sakana 对自身编排消耗的 tokens 收费,而 Cerebras 则以速度作为 Qwen3.8-27B 的卖点。Wringer 最后提醒人们,只要推理时仍恢复为 bf16,将模型压缩至每个权重 2.655 bits 就还不能降低成本。

最后一条主线涉及命令行代理的安全,其核心都是同一个机制:请求批准。当会话期间有构建文件被修改,或命令使用来自网页或 MCP 服务器的参数时,Gemini CLI 会强制请求批准,同时将沙箱与用户凭据隔离。Vibe CLI 2.25.4 对能够绕过其检查的 shell 语法强制要求批准,列出了四项 CVE 和第五项 CVE 的若干变体,并将智能批准的处理方式从直接阻止改为请求确认。Claude Code 2.1.270 则展示了另一面:一次回归导致简单的只读 git 命令也会重复请求授权。在漏洞被放行与问题被过度询问之间,如何调整这些批准请求,正成为开发商工作中显而易见的一部分。


来源