搜索

Qwen3.8 携 2.4 万亿参数登场,OpenAI 用 Codex 强化网络安全,开放模型顶住监管压力

Qwen3.8 携 2.4 万亿参数登场,OpenAI 用 Codex 强化网络安全,开放模型顶住监管压力

ai-powered-markdown-translator

由 gpt-5.4-mini 将文章从 fr 翻译成 zh。

在 GitHub 上查看项目 ↗

2026 年 7 月 19 日,阿里巴巴宣布 Qwen3.8 登场,这是一款拥有 2.4 万亿参数、正走向 open-weight 的模型;与此同时,OpenAI 通过一款由 cyber range 纪录支撑的网络安全插件强化了 Codex。作为背景,Hugging Face 和 Together AI 的 CEO 也在同一天公开发声,为开放模型抵御更严格监管的传闻,而开发者工具一侧则在 Copilot CLI 上继续扩展功能;需求爆满的 Kimi K3 也因此暂时关闭了新注册入口。


Qwen3.8:阿里巴巴宣布推出一款 2.4 万亿参数模型,open-weight 即将到来

7 月 19 日 — 阿里巴巴的 AI 部门 Qwen 宣布即将发布 Qwen3.8,这是一款拥有 2.4 万亿参数的新模型,其权重将在未来几周内以 open-weight 形式公开。根据公司说法,这款仍在持续演进中的模型,已跻身目前可用的最强模型之列——阿里巴巴甚至声称它的水平可与市场上的前沿模型相媲美,仅次于 Anthropic 的 Fable 5;后者于 7 月 18 日宣布,其在 Max 和 Team Premium 套餐上的标准访问权限将于 7 月 20 日生效。不过,这一比较仍只是发布方对自身新品的声明,并非经过独立验证的第三方排名。

在完整权重尚未开放之前,一个预览版——Qwen3.8-Max-Preview——已于当日同时在阿里巴巴的 Token Plan 以及 Qoder 和 QoderWork 平台上线,方便早期用户立即试用。

这则公告在社区引发了强烈反响(数小时内获得 440 万次浏览),并伴随大量呼声——尤其来自 Unsloth AI——希望同时发布更小体量的版本,以便支持本地运行。

特性公布细节
参数数量2.4 万亿
开放权重可用性即将到来(“soon”,未注明日期)
预览版Qwen3.8-Max-Preview,立即可用
预览平台Alibaba Token Plan、Qoder、QoderWork

🔗 X 上的公告


OpenAI 推出 Codex Security,由 GPT-5.6 Sol 的网络安全纪录加持

7 月 18 日 — OpenAI 推出了 Codex Security,这是一个面向 Codex(CLI 和 Desktop)的插件,专用于在真实代码中检测、验证和修复漏洞。此次公告建立在一项强势主张之上:GPT-5.6 Sol 在 “The Last Ones” 上创下了新的网络安全纪录。The Last Ones 是 AISI(AI Security Institute)用于评估模型在企业网络攻击模拟中攻防能力的 cyber range。

整个流程包含 32 个步骤,分为九个里程碑,从初始侦察(M1)一直到完全控制网络(M9),中间还包括窃取浏览器凭据或利用 Web 应用等环节。在最佳尝试中,GPT-5.6 Sol 一路登顶至 M9 里程碑,在图表中领先 Claude Mythos 5、GPT-5.5、Claude Opus 4.6、GLM-5.2 和 Sonnet 4.5;DeepSeek-V4-Pro 则明显落后。

安装后,该插件在 Desktop 和 CLI 上都遵循几乎完全一致的引导流程:安装 Codex,添加 Codex Security 插件,使用现成的分析提示词开启聊天,选择要检查的项目文件夹,然后发送提示词。随后,Codex Security 会扫描代码库,识别漏洞,对其进行验证以减少误报,并提出修复方案。

这次发布与 7 月 15 日报道的 GPT-Red 形成对比;后者聚焦于 OpenAI 自身模型的内部红队测试。Codex Security 则把同样的攻击能力用于外部防御场景,面向第三方代码库提供保护。

被评估模型(最佳尝试)在 AISI cyber range 上的位置
GPT-5.6 Sol顶部——M9 里程碑(完全控制网络)
Claude Mythos 5第 2 位,接近顶端
GPT-5.5 / Claude Opus 4.6中上
GLM-5.2 / Sonnet 4.5中下
DeepSeek-V4-Pro明显落后

🔗 X 上的公告 · Codex Security — 官方页面


开放权重实验室公开发声,反对监管

7 月 19 日 — 同一天,Hugging Face 和 Together AI 的 CEO 分别在 X 上发表立场,捍卫开放权重 AI——这也是开源生态面对更严格监管传闻时的一次动员信号。

Clément Delangue(Hugging Face)呼吁在旧金山集结

Hugging Face 联合创始人兼 CEO Clément Delangue 回应了关于即将限制开源 AI 的传闻:在他看来,反而应该有更多开放模型,让所有人都能使用。他的论点分为三点:更强的控制力和透明度、更便宜且更具适应性的 AI,以及有能力与大型参与者竞争,而不是完全依赖从他们那里租用智能。至于安全性,他认为限制开放模型只会掩盖风险,并将权力集中到少数人手中。为了支持这一立场,他在推文中分享了一个 Partiful 链接,号召于下周六在旧金山举行和平集会。

There have been rumors that open-source AI could soon be limited and regulated. I believe the opposite is what’s needed: we need more open-source AI, not less, for everyone, from all over the world, at the frontier and everywhere!

🇨🇳 有传闻称,开源 AI 可能很快会受到限制和监管。我反而认为,全球每个人、在世界各地、无论在技术前沿还是其他地方,都需要更多开源 AI,而不是更少!@ClementDelangue 在 X 上

Vipul Ved Prakash(Together AI)为开放模型的商品化辩护

Together AI 联合创始人兼 CEO Vipul Ved Prakash 同一天针对 Dean W. Ball 关于 Kimi 模型性能的帖子,展开了一套经济学论述。他的核心观点是:AI 模型的商品化已经在发生,而且这更像大宗商品市场——石油、小麦、钢铁、电力、内存——而不是计划经济。他还指出,开放权重并不会抑制资本开支,而是会把投入转向推理、数据和工具;这就像 Linux 一样,虽然对 Sun Microsystems 不利,但对几乎整个行业的其他部分都有好处。最后,他批评围绕 AI 存在性风险的所谓“security theater”,认为这类说法缺乏证据支持。

It has been clear to many of us, and now it’s becoming clear more tangibly, that AI models will commoditize to various degrees. This is of course a difficult business reality if your core business depends on exclusivity on intelligence. But commodity markets are not communism. They are the largest markets on earth. Oil, grain, steel, electricity, memory: trillions clear through them every year, priced by competition among thousands of suppliers.

🇨🇳 我们中很多人其实早就知道这一点,而现在它变得更加具体:AI 模型会在不同程度上走向商品化。对于那些主营业务依赖智能独占的人来说,这当然是个艰难的经济现实。但大宗商品市场并不是共产主义。它们是世界上最大的市场。石油、小麦、钢铁、电力、内存:每年都有数万亿美元在这些市场中流通,价格由成千上万的供应商竞争决定。@vipulved 在 X 上


GitHub Copilot CLI 现在可在终端中显示 issues、pull requests 和 gists

7 月 19 日 — GitHub 宣布,Copilot CLI 现在可以直接从命令行工具中查看当前会话、issues、pull requests 和 gists,而无需切换到浏览器或 GitHub 应用。该功能自 v1.0.58 起可用。

这一更新延续了 Copilot CLI 自发布以来的思路:在与 agent 协作的工作会话中,减少终端与网页界面之间的来回切换。它更像是一次体验层面的增强,而不是新的 agent 能力;但 CLI 仍是 Copilot 的头号覆盖重点,与 Workspace 并列。

🔗 X 上的公告


Kimi K3:Moonshot AI 暂停新的订阅

7 月 19 日 — 在 Kimi K3 发布仅三天后(该模型拥有 2.8 万亿参数,于 7 月 16 日宣布),Moonshot AI 表示,需求已经超过了其 GPU 容量预期。在过去 48 小时里,这一需求已接近可用基础设施的极限:因此公司决定暂时暂停新的订阅,以保留现有订阅用户的使用体验——这些用户不会受到暂停影响。

Moonshot AI 表示,公司正在增加额外容量,并计划分批重新开放注册。公司还宣布,未来将重组其产品方案,拆分为两个套餐:Kimi Membership(Web、应用、Work)和 Kimi Code Membership(与代码相关的工作流)。

Kimi K3 has received far more love than we expected, and our GPUs are feeling it. Over the past 48 hours, demand has pushed close to the limits of our current capacity.

🇨🇳 Kimi K3 收到的热度远超我们的预期,我们的 GPU 也因此感受到了压力。在过去 48 小时里,需求已经接近我们当前容量的极限。@Kimi_Moonshot 在 X 上


简讯

  • Claude Code CLI v2.1.215 — Claude 不再会在会话过程中自动触发 skills /verify/code-review;现在必须显式调用。🔗 更新日志
  • HeyGen 出现在世界杯电视转播中 — Telemundo Deportes 使用 HeyGen 为主持人 Pablo Mariño 制作头像,用于其 2026 FIFA 世界杯报道片段。🔗 来源
  • Kling AI 发布 “BACK SHADOW” — 一部由 AI 生成的伪纪录片,讲述足球比赛背后的人类故事,背景是 2026 FIFA 世界杯。🔗 来源

这意味着什么

开放前沿模型之争已经开始压垮现有基础设施。 Qwen3.8 以 2.4 万亿参数和接近市场顶端的公开定位亮相,而 Kimi K3——仅在三天前才发布——则因 GPU 容量不足被迫暂停新订阅。因此,开放模型的成功不再只看 benchmark,还要看发布方能否承受其带来的需求:这既是基础设施问题,也是研究问题。

网络安全正成为模型之间新的直接竞争领域。 GPT-5.6 Sol 在 “The Last Ones” cyber range 上宣称取得纪录,并且这一能力立刻被用于防御型产品(Codex Security),而不是仅仅作为营销话术,这说明一个更广泛的趋势:在内部为强化模型而开发的攻击能力,几乎在同一时间就会变成面向开发团队的产品,用来保护他们自己的代码。

开放 AI 与监管之间的张力正转向更政治化的层面。 Clément Delangue 和 Vipul Ved Prakash 在同一天各自发声,且看起来并未协调,这表明开放权重生态的领导者已不再只是发布模型:他们也在公开捍卫支撑这一生态的商业模式,只是采用了不同话语——一边是公民动员,一边是大宗商品市场的经济理论。

开发者工具仍在更多地向终端而不是浏览器里堆叠能力。 Copilot CLI 新增的 issues、pull requests 和 gists,以及 Claude Code 中对 /verify/code-review 的用户控制收紧,指向同一个方向:尽可能把更多上下文与控制权直接整合进命令行,贴近代码本身,而不是强迫用户在分离的网页界面之间来回切换。


来源