搜索

Claude Opus 5,Midjourney 收购 Co-Star,Jensen Huang 为开放模型辩护

ai-powered-markdown-translator

用 gpt-5.4-mini 从法语翻译成中文的文章。

在 GitHub 上查看项目 ↗

2026 年 7 月 24 日被一件结构性大事所主导:Anthropic 发布 Claude Opus 5,Cursor、Devin、v0 和 GitHub Copilot 在当天即完成采用——模型发布与代码工具接入之间的周期如今几乎是即时的。同一天,Midjourney 宣布其有史以来首次收购(Co-Star),Jensen Huang(NVIDIA)发布个人首条 X 帖子为开放模型辩护,而 xAI 则将数百个智能体的并行编排加入 Grok Build。围绕这四个主题,还分布着十五条值得注意的新动态——从代码工具生态到 Genspark 的 Enterprise 扩张——以及九条较小公告。


Claude Opus 5:Anthropic 新模型,当天即被 Cursor、Devin、v0 和 GitHub Copilot 采用

7 月 24 日 — Anthropic 发布 Claude Opus 5,这是 Claude 5 系列的新模型,与 Sonnet 5 和 Fable 5 并列。官方定位:一款“深思熟虑且主动”的模型,在能力上接近 Claude Fable 5 的前沿智能——Anthropic 最强的模型——但价格只有一半。它从今天起已在所有付费套餐以及 API(标识符 claude-opus-5)中可用,价格与 Opus 4.8 相同:输入每百万 token 5 美元,输出每百万 token 25 美元。Fast 模式大约快 2.5 倍,收费为基础价格的两倍。Opus 5 成为 Claude Max 的默认模型,也是 Claude Pro 中提供的最强模型。

基准测试Opus 5 结果
Frontier-Bench v0.1超越所有模型,得分超过 Opus 4.8 的两倍以上,而单任务成本更低
CursorBench(最大努力)距离 Fable 5 的最佳分数仅差 0.5 分,但价格便宜一半
ARC-AGI 3(未见过的问题)分数大约是最佳竞争对手的三倍
OSWorld 2.0(计算机使用)以大约其三分之一的成本,超越 Fable 5 的最佳结果

Anthropic 还报告了生命科学方面的进展:与 Opus 4.8 相比,有机化学(分子结构推断)提升 +10.2 分,蛋白质序列变异影响预测提升 +7.7 分。重要说明:这些“最先进”结果主要涉及代码与知识工作——在进攻性网络安全方面,Opus 5 仍然有意落后于 Mythos 5(受限访问模型):其安全分类器会阻止二进制方法的漏洞扫描、渗透测试和漏洞利用生成,但仍允许对源代码进行漏洞检测。Anthropic 估计,这些分类器的触发频率将比在 Fable 5 上减少约 85%。

在对齐性方面,Anthropic 表示,依据其内部自动化行为审计,Opus 5 是目前对齐程度最高的模型(在总体不对齐行为上得分 2.3,为其近期模型中最低)。在 Claude Code 中,它可通过 /model claude-opus-5 立即使用,或者通过 /claude-api migrate 切换现有工作负载,并默认以高努力模式启动。

🔗 官方公告 — Anthropic

It’s a thoughtful and proactive model that comes close to the frontier intelligence of Fable 5 at half the price.

🇨🇳 这是一款深思熟虑且主动的模型,在能力上接近 Fable 5 的前沿智能,而且价格减半。@claudeai 在 X 上

代码工具中的首日采用。 不到半小时内,三个代码工具相继宣布集成,间隔仅几分钟,随后 GitHub Copilot 也在当天跟进:

集成工具公告时间(7 月 24 日)差异化细节
Cursor19:03在 CursorBench 上与 Fable 5 持平(默认努力下 66.7 对 66.5),价格减半,支持 Zero Data Retention
Devin(Cognition)19:07在 FrontierCode 1.1 上“接近” Fable 5 水平,价格减半
v0(Vercel)19:29可立即通过 v0.app/?opus5 使用
GitHub Copilot同一天VS Code、Visual Studio、Copilot CLI、云端 agent、JetBrains、Xcode……适用于 Pro+/Max/Business/Enterprise

Cursor 最为精确,给出了准确数字,并额外提供一项优势:兼容 Zero Data Retention,而 Fable 5 不支持。就 GitHub 而言,Copilot 强调了其在代理式编码工作流中的良好表现——自主修改、非回归验证、多工具协调——但也提醒该模型内置了护栏,可能会阻止某些与网络安全相关的请求,若遇到阻止,建议改写请求或选择其他模型。Copilot 的部署是逐步进行的;Enterprise 和 Business 管理员必须启用 Claude Opus 5 策略,才能让团队获得访问权限。

🔗 Cursor 宣布集成

🔗 Devin 宣布集成 — @cognition

🔗 v0 宣布集成

🔗 GitHub Copilot — 官方更新日志


Midjourney 收购 Co-Star,历史上的首次并购

7 月 23 日 — Midjourney 宣布其有史以来的首次收购:Co-Star,这款个性化占星应用以其直率的语气和病毒式通知而闻名。其创始人 Banu Guler 加入 Midjourney,担任新设立的 首席设计官,负责为公司的所有项目搭建一个横跨产品/设计/前端的组织。Co-Star 继续独立运行,完全处于其自身控制与管理之下。

官方博文以非常个人化的语气,将这笔收购放入更大的发展轨迹中:它提到 Midjourney Medical 是“一个不寻常研究实验室”的开端,并宣布在接下来的六个月里还将推出大约半打同样雄心勃勃的项目。Midjourney 此前一直专注于图像和视频生成,如今因此明确表明其正在核心业务之外进行战略多元化。次日在 X 上发布的转发帖在数小时内获得了超过 426,000 次浏览、1,300 个“喜欢”和 226 次转帖。

🔗 X 转发 — 数小时内 426,000 次浏览

“As an adult I find myself in the unusual position of having everything I wanted and two questions come to mind next: How can I use this opportunity to make baby David proud?”

🇨🇳 成年之后,我发现自己处在一种不寻常的位置:我拥有了曾经想要的一切,于是我有了两个问题:如何利用这个机会让小 David 为我感到骄傲?Midjourney,官方更新日志


NVIDIA:Jensen Huang 发布首条 X 帖子,一封为开放模型辩护的公开信

7 月 24 日 — NVIDIA 创始人兼首席执行官 Jensen Huang 在 X 上发布了他的首条个人消息:一封由 NVIDIA 签署、题为 “Open Weights and American AI Leadership” 的公开信,讨论开放模型(open models)的重要性。他在信中表示,AI“将改变每个行业,为每家公司提供动力,并由每个国家构建”,而开放模型能增强安全与网络安全,加速创新并实现主权——这一表态明确将 NVIDIA 及其自己发布的开源权重 Nemotron 系列,置于 open-weight 生态的一侧,与 OpenAI、Anthropic 或 Google 等封闭实验室形成对照。

这条帖子引发了不同寻常的互动量,尤其对于首条个人消息而言:在数小时内获得了超过 2360 万次浏览、98,000 个“喜欢”和 23,700 次转帖。包括 MiniMax 在内的多家开放权重 AI 参与者,都在随后公开感谢 Jensen Huang 做出的这一表态。

“Open models strengthen safety and cybersecurity, accelerate innovation and diffusion, and enable sovereignty. The world needs both frontier closed models and frontier open models.”

🇨🇳 开放模型能增强安全与网络安全,加速创新及其传播,并实现主权。世界既需要封闭的前沿模型,也需要开放的前沿模型。@JensenHuang 在 X 上


Grok Build 中的 workflows:xAI 编排数百个智能体并行工作

7 月 23 日 — xAI 在其命令行编码 agent(相当于 Claude Code 或 Codex)Grok Build 中推出 workflows。用户用自然语言描述复杂任务;Grok 自动规划一段编排脚本——工作阶段、每个阶段分配的 agent、结果如何回传——然后在后台执行,而会话本身仍可继续用于其他操作。

技术参数实测值
默认 agents 数量128
最大 agents 数量(大型任务)1024
重点展示的演示GitHub pull request 四阶段审查(Context → Review → Verify → Synthesize)
实时跟踪/workflows 命令

演示中的专门审阅者会在最终报告生成前,由独立的“怀疑者”进行对抗式验证。进度会持续保存——暂停和恢复绝不会让你重新做已经完成的工作。workflows 可以保存并复用:放在 .grok/workflows/ 中的会与团队共享,放在 ~/.grok/workflows/ 中的会随用户在任何地方使用,而每个已保存 workflow 都会变成自己可参数化的斜杠命令(例如 /pr-review 5137)。/deep-research 功能也内置提供:它会把一个研究问题拆分给多个并行调查者,并逐条用来源核实每项断言。

xAI 强调的使用场景包括:审查一个大型 pull request 的每个功能、整理最近 100 个 Linear 工单以提炼出行动清单,或审计代码库中的每个路由处理程序,查找缺失的身份验证检查。

🔗 官方公告 — xAI


代码生态:更少 prompt,更多 agents

Claude Code:Anthropic 为 Claude 5 模型删除了 80% 的 system prompt

7 月 24 日 — Anthropic 团队的 Thariq(@trq212)发布了一篇文章,详细说明 Claude Code 的 context engineering 演变:对于 Opus 5 和 Fable 5 这类 Claude 5 模型,Anthropic 删除了 Claude Code 超过 80% 的 system prompt,而代码评测并未出现可测量的损失。旧的 system prompt 会施加僵硬规则——例如绝不写多行注释——而这些规则如今已不再必要,因为新模型具备更好的判断力,能够根据上下文处理矛盾指令。文章归纳了六项方法论变化,包括:从“给出严格规则”转向“让 Claude 自行判断”;从“把所有内容一次性塞进 prompt”转向“渐进披露”。Anthropic 通过一条新命令 /doctor 将这些实践提供出来,用于审计和缩放项目的 skills 和 CLAUDE.md 文件。

🔗 完整线程 — @trq212

v0 将完整的 Figma 文件转换为应用

7 月 24 日 — v0(Vercel)扩展了其 Figma 集成,此前主要聚焦于导入单个组件:现在只需一个链接,agent 就能自动浏览文件中的所有页面和 frame,选取相关元素——设计 token、颜色、布局、文本、图标——然后将识别出的屏幕整合成一个一致的应用,无需逐帧手动选择。官方文档在 v0 Docs 的专页上详细列出了提取的全部数据。

🔗 公告 — @v0

Copilot cloud agent for Linear 正式进入 GA

7 月 23 日 — GitHub 将 Linear issue 的分配升级为 Copilot cloud agent 的正式可用:一旦被分配,agent 会分析 issue,在由 GitHub Actions 驱动的临时环境中创建一份草稿 pull request,在 Linear 的时间线中回传进度,然后请求审查。相较于预览版的新功能包括:可直接从 Linear 选择模型和自定义 agent、定义目标分支,以及仅通过评论来操控会话。适用于 Copilot Pro、Pro+、Business 和 Enterprise 套餐。

🔗 官方更新日志

GitHub MCP Server 提前适配下一版 MCP 规范

7 月 23 日 — MCP(Model Context Protocol)从 2026 年 7 月 28 日起变为 无状态stateless),而 GitHub MCP Server 已经提前支持了这一新规范,领先于其正式发布。其结果包括:移除 Redis 会话、更快的连接且无需 initialize 步骤,以及将 elicitation 的实现升级为独立的 HTTP 请求。由于一级 SDK 保持向后兼容,现有客户端无需采取任何行动。

🔗 官方更新日志

Sakana AI 发布 Fugu-Ultra v1.1 及兼容 Claude Code 的界面

7 月 24 日 — Sakana AI 发布其多模型编排引擎 Fugu-Ultra(v1.1)的更新,在 v1.0 基础上最高提升 7.9 分,尤其在 ProgramBench 和 Terminal Bench 2.1 上表现显著。Sakana 宣称其在复杂编码和推理方面的表现优于 Fable 5,且其编排的模型池中甚至未包含后者。与此同时,Sakana 提供了兼容 Claude Code 的端点,使用户可以直接从这个客户端调用 Fugu 的多 agent 智能,而无需依赖单一模型。

🔗 官方公告 — Sakana AI


Google / Gemini:Spark 扩展,Gemini CLI 安全修复

Gemini Spark 扩展至美国的 Google AI Pro 订阅用户

7月23日Gemini Spark,Google 的个人 AI 代理,24/7 在后台工作,在用户指挥下完成任务,如今迎来扩展:在面向 Google AI Ultra 订阅用户之后,它开始首先向美国范围内更广泛的 Google AI Pro 档位订阅用户部署。Google 表示,“很快”还会扩展到更多国家。严格来说,这并不是一项新功能,而是一次受众范围的变化,它让一种高端自主代理更接近付费大众用户。

🔗 公告 — @GeminiApp

Gemini CLI v0.53.0-preview.0 修复了一个 RCE 漏洞

7月22日 — Gemini CLI 发布了一个新的 preview 版本(尚未列入官方稳定版 changelog),包含两个安全相关修复:强化任务隔离以及 Agent-to-Agent 服务器中的工作区信任,以阻止 任意代码执行(RCE);同时缓解了 prompt 注入循环和无限 ReAct 循环。另有一个基于 LLM 的分诊调度器,以及在 macOS 上将 Seatbelt 配置文件加固为默认拒绝(deny-by-default)模型。

🔗 GitHub 发布 — v0.53.0-preview.0


OpenAI:ChatGPT Work 现可连接受保护网站,借助 ChatGPT 纠正的一次诊断

ChatGPT Work 现可连接需要身份验证的网站

7月24日ChatGPT Work 代理现在可以使用需要登录的网站:用户先在云端浏览器中接管并完成身份验证,然后让代理自动继续任务。关键点在于:登录 会在不同会话之间持续保留,只需一次认证即可支撑同一网站上的后续任务——这也解除了一项网络浏览代理的经典限制。此次更新将可自动化任务的范围扩展到了企业内部工具以及由凭据保护的 SaaS。

🔗 公告 — @OpenAIDevs

ChatGPT 如何帮助纠正一次癌症诊断

7月24日 — OpenAI Newsroom 讲述了 Kiley 的丈夫如何使用 ChatGPT 解读一份近期的影像报告。Kiley 在 18 岁时被诊断为胶质母细胞瘤,医生给出的预后只有几个月,而她在五年后仍然健在,却没有明确解释。这个解读把注意力带回到最初的活检结果,ChatGPT 帮助凸显出一个此前被忽略的细节:IDH1 突变。在与 Kiley 的神经肿瘤学家沟通后,这一细节使诊断被重新归类为 IDH 突变型星形细胞瘤——依然严重,但预后要好得多。

🔗 亲历者讲述 — @OpenAINewsroom


NVIDIA 与生成式视频:更快的基础设施,更协作的代理

NVIDIA 将 DeepSeek-V4 Pro 的启动时间从 8 分钟缩短到不足 2 分钟

7月24日 — NVIDIA 详细介绍了一项推理基础设施优化:通过借助 GPU-to-GPU RDMA 走最短路径将模型权重传输到 GPU 内存,DeepSeek-V4 Pro 部署的启动时间从 8 分钟降至不足 2 分钟。该机制基于 NVIDIA ModelExpress,这是一项集成在 NVIDIA Dynamo 中的权重分发与缓存管理服务,而 NVIDIA Dynamo 是其分布式推理平台。NVIDIA 还指出,同样的方法也能加速强化学习后的训练阶段。

🔗 公告 — @NVIDIAAI

Runway 为其代理加入自然语言 Workflows

7月24日 — Runway 为 Runway Agent 增加了 Workflows 功能:现在可以直接用自然语言构建、执行或修改基于节点的工作流(node-based workflows),而不是通过手动操作可视化编辑器。它不同于前一天推出的 Media Router——后者负责根据成本、质量和延迟自动选择生成模型——而 Workflows 则着眼于生产步骤本身的编排。

🔗 公告 — @runwayml

HeyGen — Companion mode:引导视频,而不是直接下达命令

7月22日 — HeyGen 为其 Video Agent 推出了 companion mode:与其用单一 prompt 直接下达视频命令,不如让用户以迭代方式引导它——代理先提出五个创意角度,展示一个用于确认的 storyboard,然后在最终生成前勾勒出需要审看的关键画面。用户在每一步都保有控制权,只有在批准后才会启动完整制作。这个功能回应了人们对“一次成片”式视频生成器的常见批评——结果不可预测、反复迭代既费时间又耗积分——并让体验更接近与真人导演协作。

🔗 公告 — @HeyGen


Genspark:与 Microsoft 合作,并在日本投资 1 亿美元

SecondBrain 集成到 Outlook、Teams 和 Microsoft Agent 365

7月24日 — 在首尔举行的 Genspark 6.0 发布会上,Genspark 详细披露了与 Microsoft 的战略合作:其代理的持久记忆层 SecondBrain 现已直接集成到 Outlook、Office、Teams,以及 Microsoft Agent 365 中——Genspark 表示自己是该产品的全球发布合作伙伴。整个系统运行在 Azure 上,被描述为可确保企业环境所需的稳健性。该帖子特别感谢了 Satya Nadella(Microsoft CEO)、Judson Althoff 和 Rodrigo Kede。这个部分并未出现在 7月20日的最初发布文章中。

🔗 公告 — @genspark_ai

Genspark 将在日本三年内投资 1 亿美元

7月24日 — 在 7月21日于东京举行、面向企业客户、行业合作伙伴和日本意见领袖的活动之后——这是 Genspark 在该国举办的第二场活动——公司宣布将在未来三年内于日本投资 1 亿美元,而此时距离其当地业务开设仅有六个月。三项重点分别是:为符合条件的客户(金融机构、政府机构、大型企业)提供数据驻留;与经销商和集成商建立端到端合作;以及在客户的语言和时区内加强本地团队。

🔗 公告 — @genspark_ai


Grok 登陆 Google Workspace

7月24日 — xAI 推出一个免费的附加模块,将 Grok 直接集成到 Sheets、Slides 和 Docs 中,可从 Google Workspace Marketplace 安装。在 Sheets 中,Grok 会引用所用单元格来回答问题并编写公式;在 Slides 中,它会在保留现有主题的前提下把提纲转换成演示文稿;在 Docs 中,它会在正在写作的位置直接起草和修正,并在连接器启用时访问最近的邮件和 Drive 文件。此次集成补齐了此前已经在 Microsoft 365 端提供的套件(Word、Excel、PowerPoint、Outlook),该套件是在 6 月至 7 月期间推出的。

🔗 官方公告 — xAI


快讯

  • Replit 汇总本月更新 — 语音代理、可从 Claude 或 Slack 创建、持久化 stack 记忆;其中至少一项能力似乎与 6月17日已发布的集成有重合。🔗 来源
  • Kimi K3 在 DeepSWE 上几乎追平 Claude Fable 5 — pass@1 仅差 1.4 个百分点,但在 pass@2/pass@4 上领先,每个已解决任务的成本低 2.8 倍(Together AI)。🔗 来源
  • 关于开放模型作为 AI 安全路径的联合声明 — 由 Hugging Face、Meta、Mistral AI、NVIDIA 和 Microsoft 等约十五家组织组成的联盟发起,并被 @huggingface 官方账号转发。🔗 来源
  • HeyGen 推出 Audio to Video API — 语音和图像一次调用生成视频,支持批量处理(例如同一张图上的 100 段配音)。🔗 来源
  • ElevenLabs 发布关于 AI 语音与选举保护的文章 — 面向重要选举节点的机构性表态。🔗 来源
  • HeyGen — HyperFrames,第 18 天,共 30 天 — 每日系列的新一集,聚焦其在 Video Agent 中的用法。🔗 来源
  • Zvec 0.6.0,通义实验室(Alibaba)的向量搜索引擎 — Group-By 检索,INT4 量化下召回提升超过 50 个点,支持扩展至 34 种语言。🔗 来源
  • xAI 在 Grok Build 中增加更多第三方插件 — Tavily 和 Exa 用于网页搜索,Grok STT 在 OpenRouter 上可用,价格为每音频小时 $0.10。🔗 来源
  • ChatGPT Pet 现可在用户之间共享 — 可通过 Web 端“个性化”设置中的可共享链接,让另一位用户接管该 pet。🔗 来源

这意味着什么

Opus 5 的发布说明了前沿模型触达用户方式上的结构性变化:Cursor、Devin 和 v0 在不到半小时内就完成集成,GitHub Copilot 也在同一天跟进。过去还以“周”为单位计算的发布→采用周期,如今对于与 Anthropic 生态连接最紧密的代码工具来说几乎为零——这种动态也相应缩短了实验室之间的差异化窗口,并把竞争从单纯的模型原始性能,转向集成速度。

同一天,反向叙事也以同样强度出现。Jensen Huang 在 X 上发布了他个人的第一次公开表态,为开放模型作为安全与主权之路辩护;由 Hugging Face 和 Meta 等约十五家组织组成的联盟提出了相近的声明;而 Sakana AI 则宣称自己在不将 Fable 5 纳入模型池的情况下,通过编排多个模型实现了超越。两种 AI 安全观——一种基于专有控制,另一种基于权重透明——在同一天公开碰撞,而没有明显一方压过另一方。

与此同时,网络安全仍然更像是审慎克制的标志,而不是纯粹性能的表现。Anthropic 有意将 Opus 5 在进攻性任务上排在 Mythos 5 之后,并用专门的分类器阻止漏洞扫描、渗透测试和漏洞利用生成。就在同一时间,Google 修复了 Gemini CLI 中一个位于 agent-to-agent 服务器侧的任意代码执行漏洞——这提醒人们:需要持续加固的攻击面,不只有代理所调用的模型本身,还包括这些代理工具本身。


来源