ai-powered-markdown-translator使用 gpt-5.4-mini 将文章从法语翻译成中文。
2026 年 8 月 3 日集中带来三项重大公告:阿里巴巴推出 Qwen3.8-Max 这款 2.4T 参数的新旗舰模型,Genspark 将其办公套件 GenOffice 开源,Vercel 则为 v0 开放了一个可编程 API。围绕这三项发布,Cursor、GitHub、Sakana AI、MiniMax、Runway、ElevenLabs 和 Google 也都在密集更新产品。
Qwen3.8-Max,阿里巴巴面向代码与协作工作的新旗舰模型
阿里巴巴发布了 Qwen3.8-Max,将其描述为公司迄今能力最强的模型,定位聚焦于代码和与 AI 的协作工作(cowork)。该模型拥有 2.4T 参数,并已通过 API 和 Qwen Studio 立即提供。
团队强调了四个进步方向:长时间自主开发(十天或更久的自我演化,从空白文件夹一路到生产环境,且完整项目轨迹已发布在 GitHub 上)、在众多业务场景中产出生产级交付物、面向长周期的自主规划——示例包括最多 500 轮芯片设计优化和 365 天电商策略——以及原生多模态智能,其中视觉持续为规划、执行和自我修正提供输入。
阿里巴巴宣布将在公告后一周开放 Qwen3.8-Max 的权重,同时推出更轻量版本 Qwen3.8-27B 的 open weights。该模型在发布当天也已上线 Venice 这一匿名聊天平台;同日还提到会集成到一款名为“Command Code”的工具中,但未给出更多细节。
| 指标 | 数值 |
|---|---|
| 参数 | 2,4 T |
| 输入价格 | 2,0 $ / 百万 token |
| 输出价格 | 6,0 $ / 百万 token |
| 隐式缓存 | 0,25 $ / 百万 token |
| 权重开放 | 下一周(Qwen3.8-Max + Qwen3.8-27B) |
🔗 X 上的公告
Genspark 开源 GenOffice,其 AI 办公套件
Genspark 宣布将 GenOffice 开源,称其为首个面向 PC 和 Mac 的完整开源 AI 办公套件。该工具对所有人免费且无广告。
这套办公套件覆盖了传统办公套件的常见用途——文档处理(Docs)、电子表格(Sheets)、演示文稿(Slides)和 PDF——并配备常规编辑工具。Genspark 还在其中集成了其 Super Agent,能够进行搜索、分析数据,然后撰写文档或构建演示文稿,并消耗 Genspark 积分。
在开发方式上有一条值得注意的信息:Alpha 版本由一名工程师在一周内构建完成,成本为 1 万美元的 token。
“One engineer, one week, $10,000 in tokens. That’s what it took to build the GenOffice Alpha.”
🇨🇳 一名工程师,一周时间,1 万美元的 token。这就是构建 GenOffice Alpha 版本所需的一切。 — @genspark_ai 在 X 上
该项目明确处于 Alpha 阶段:Genspark 邀请社区测试工具、反馈 bug,并通过 GenTeam 上专门的群聊提出功能需求,无需编写代码。最有帮助的贡献者将获得 1,000 多个 Genspark 积分作为感谢。该公告发布于新加坡版 AGI Playground 期间,Genspark 借此强调:随着模型越来越便宜,价值正在转向建立在其上的最佳体验。
Vercel 为 v0 推出可编程 API
Vercel 发布了新的 API v0,从今天起可用,它让原本仅限于聊天界面的应用构建能力可以通过程序访问。具体来说,开发者现在可以直接从自己的代码中驱动 v0,而不必通过网站操作。
该 API 暴露了四项操作:根据文本提示、现有代码仓库或 ZIP 压缩包启动会话;生成开发服务器预览以实时查看结果;发送后续消息对生成内容进行迭代;以及将结果直接部署到 Vercel。
这使 v0 从一个面向大众的独立产品,转变为可嵌入第三方工具链的组件——例如 agents、自动化脚本、内部集成等。此举也与 Vercel 的策略一致:让 v0 成为可供其他 agents 调用的界面生成层,包括那些无需经过其历史聊天界面、直接驱动 v0 的第三方 agents。
对于已经在构建开发 agents 的团队而言,这意味着可以把代码生成、预览和部署串联进一个完全自动化的流水线中,而无需在每一步都有人类介入。
🔗 X 上的公告
Cursor:更高效的云端 agents 与新的 Google Workspace 插件
Cursor 在同一天发布了两项不同更新,一项关于其云端 agents 的性能,另一项关于 Google Workspace 集成。
云端 agents:token 消耗减少 20% 到 30%
Cursor 宣布其云端 agents 效率显著提升:所有任务整体 token 消耗减少 20% 到 30%,而在使用计算机控制(computer use)的任务上效率最高可提升 80%。这些提升来自 agents 对 MCP 服务器、skills 和 computer use 的更好管理。官方目标是让用户能够把更有野心的任务交给 agents,同时仍控制在 token 预算之内。
🔗 X 上的公告
集成到编辑器中的 Google Workspace 插件
Cursor 现在可以通过从“Customize”页面或 Cursor Marketplace 访问的插件,直接读取、写入并操作 Google Workspace,而无需离开编辑器。
| Workspace 服务 | 功能 |
|---|---|
| Google Drive | 搜索、打开和下载文件,整理文件夹 |
| Gmail | 搜索和阅读邮件,撰写并发送消息 |
| Google Calendar | 查看日程,创建事件,查找空闲时段 |
| Google Docs | 打开、阅读、撰写和修改文档 |
| Google Sheets | 读取区域,更新单元格,创建表格 |
| Google Chat | 访问空间和消息,发送消息 |
其目标是让开发者能够直接从 Cursor 中利用邮箱或日历里的上下文,而无需在浏览器之间来回切换。
GitHub Agentic Workflows 在 Aspire 实现跨仓库文档自动化
GitHub 展示了一个 GitHub Agentic Workflows 的具体用例:Aspire 团队利用它将已合并的功能自动转换为分布在多个仓库中的文档 PR。系统采用受限权限(scoped permissions),并在合并前强制由该领域专家进行人工审查(SME review)。
| 跟踪指标 | 数值 |
|---|---|
| 已合并的文档 PR | 82 / 82 |
| 中位合并时间 | 44,8 小时 |
这一经验反馈体现了 GitHub 在 agentic 工作流上的一个优先方向:在把重复性的文档维护任务自动化的同时,始终保留人工在环。
🔗 X 上的公告
GitHub 发布 2026 年 7 月 Ship Log
GitHub 发布了 2026 年 7 月的月度发布回顾,主题聚焦于“为开发者提供选择”。
GitHub Copilot 桌面应用现已面向所有套餐开放,包括 Copilot Free 和 GitHub Education;没有订阅的开发者也可以使用自己的模型提供商密钥(bring your own key)。Copilot 的模型选择器也更加丰富:Kimi K2.7 Code 成为首个可在 picker 中选择的开源权重模型,OpenAI GPT-5.6 家族加入 Copilot,其中 GPT-5.6 Luna 价格下降 80%,GPT-5.6 Terra 价格下降 20%,Anthropic 的 Opus 5 则进入正式可用。除此之外,GitHub Projects 还获得了改进后的筛选器,以及基于多选字段的标签系统。
🔗 X 上的回顾
Sakana Namazu:专为日本市场打造的 LLM API
Sakana AI 上线了 Sakana Namazu API,这是其 Namazu 模型的服务化版本;此前该模型仅供 Sakana Chat 应用使用。该模型基于 Moonshot AI 的开源权重模型 Kimi K2.6,并由 Sakana AI 针对日语和日本业务场景进行了微调。
该 API 兼容 OpenAI 格式:只需在现有代码中修改基础 URL 和 API 密钥即可。它内置了网页搜索和代码执行工具,并具备 agentic 能力,可自动串联多个步骤。
Sakana AI 强调了三类使用场景:自动生成市场调研报告、客户支持自动化,以及一个创意应用——通过一条简单指令驱动约 1,000 条动画鱼。针对日本文化语境设计的 FairPoliticsQA 基准上,得分从 34,10% 提升到 56,30%。
🔗 官方公告
MiniMax H3:权重现已发布
MiniMax 曾在 7 月 31 日发布其开放多模态模型 H3——我们此前已在专栏中报道。8 月 3 日,权重正式以 open weights 形式发布,并在整条开源推理链上实现了其所称的“Day-0”支持。
| 推理工具 | Day-0 支持 |
|---|---|
| ComfyUI | 原生集成,发布即有一个模型和五条工作流 |
| vLLM-Omni | 兼容 OpenAI API 的视频端点 |
| SGLang / LMSYS | 可自定义的本地支持,可在 NVIDIA 和 AMD 硬件上运行 |
| fal | 可直接投入使用的生产基础设施 |
MiniMax 将这次发布描述为从公告到真实可用之间的一道门槛已经跨越:权重已开放,生产部署也已到位。第三方合作伙伴 Magnific 还展示了一个角色级别的原生口型同步演示,仅用一次生成即可完成。
🔗 X 上的公告
Runway 推出 Max 套餐,提供 7 天 Seedance 2.5 无限访问
Runway 宣布推出新的订阅档位 Max 套餐,并附带首发优惠:订阅用户在该模型上线平台后,可立即获得 7 天的 Seedance 2.5 无限访问权限。
Seedance 2.5 我们此前已在前几期中提到过,但它在 Runway 上仍未正式可用(“coming soon”):今天的真正新内容是新套餐及其抢先访问权益,而不是模型本身。
🔗 X 上的公告
ElevenAgents:ElevenLabs 面向企业规模的语音 AI
ElevenLabs 详细介绍了其语音与聊天 agents 平台 ElevenAgents 的规模和能力。
“More than 10 million conversations run on ElevenAgents every week.”
🇨🇳 ElevenAgents 每周处理超过一千万次对话。 — @ElevenLabs 在 X 上
每次对话都对应一次由自然语气的语音或聊天 agent 处理的真实交互:退款申请、预约安排、福利咨询、改签航班。该平台提供上线前的场景模拟、多渠道部署,以及通过 Spotlight 工具进行跟踪;Spotlight 会监测生产环境中的对话并提出主动改进建议。面向企业客户,ElevenLabs 强调可配置的安全护栏和区域数据驻留选项,客户范围从初创公司到政府机构和 Fortune 500 企业。
Google 与 PSG:Gemini 成为俱乐部官方 AI 助手
巴黎圣日耳曼和 Google 宣布签署一项持续至 2029 年的高级合作伙伴协议。在此框架下,Google Gemini 成为俱乐部官方 AI 助手,而 Google Pixel 则成为 PSG 的官方手机。
这是一项赞助与分销协议,至今尚未公布任何与产品功能或集成相关的技术细节。此举也契合 Google 的策略:通过与全球最受关注的足球俱乐部之一合作,将 Gemini 的大众曝光度扩展到技术爱好者圈层之外。
🔗 X 上的公告
简讯
- Vercel 和 v0 现已支持通过 ChatGPT 账户登录——登录页面新增了“Continue with ChatGPT”按钮,同时 ChatGPT 中现在也可使用 Vercel 插件。 🔗 来源
- Replit 宣布 Designathon——为所有创作者开放的一周设计竞赛,将于 8 月 4 日太平洋时间 9 点进行直播启动,并设有奖项。 🔗 来源
- Together AI 对比 Kimi K3 Max 与 Fable 5 xhigh 的单任务成本——在 DeepSWE 基准上,Kimi K3 Max 以约三分之一的每次执行成本接近 Fable 5 xhigh 的表现,也就是每花 1 美元可解决的任务数高出 2.8 倍。 🔗 来源
- GitLab 向 GitHub Enterprise Cloud 的迁移已正式可用——CLI 扩展
gh gl2gh现在允许通过自助方式,将来自 gitlab.com 或 GitLab Self-Managed 的仓库迁移到 GitHub Enterprise Cloud。 🔗 来源 - Luma Ray 3.2 已登陆第三方平台 Fuser——该视频模型集成到这款裁切工具中,并承诺在更改画面比例时保留场景动作。 🔗 来源
- NVIDIA NeMo Gym 集成 Legal Agent Bench——这个由 Harvey 共同开发的法律 agents 基准测试加入了开放的 NeMo Gym 库,以推动 open weights 模型在复杂法律场景中的进步。 🔗 来源
- NVIDIA 演示一个在 30 秒内学会的跑酷 agent——据称某个模拟系统仅凭一段非常短的参考视频片段就获得了专家级行为,未提供更多技术细节。 🔗 来源
- Kimi Slides 生成演示文稿教程——Moonshot AI 发布了围绕 Kimi Slides 的教学系列第一集;Kimi Slides 由 Kimi K3 驱动,可生成包含图表和 SmartArts 的演示文稿。 🔗 来源
这意味着什么
开放权重的竞赛正同时在多个方向上推进。尽管 Qwen3.8-Max 拥有 2.4T 参数,但它将于下周开放;MiniMax H3 也从发布公告走向真正可用,并对四种不同的推理组件提供 Day-0 支持;Together AI 对 Kimi K3 Max 的成本/性能分析则说明了这些开放模型为何正在抢占市场:在质量相近的情况下,它们的成本只是同类封闭模型的一小部分。开放模型与封闭模型之间的力量对比,正越来越多地在经济层面而非单纯的基准分数上展开。
第二个方向是开发工具的平台化,逐步拆分为可编程组件。Vercel 的 v0 API、Cursor 云端代理带来的效率提升以及 Google Workspace 集成,或者 GitHub 在 Aspire 处记录的应用场景,都指向同一趋势:厂商不再只是出售一个聊天界面,而是在提供一条可由其他代理驱动的自动化链路,并配备护栏——权限受限、人工复核——使其能够在生产环境中落地。
面向大众的部分,两个公告则采用了不同的路线:Genspark 开源 GenOffice 旨在通过免费与社区效应,推动一套完整的 AI 办公套件普及;而 Google 与 PSG 的合作更像是一种品牌曝光策略,而非技术创新——Gemini 获得了更多面向普通用户的曝光,但并未宣布任何新功能。
最后,ElevenLabs 给出的数据——ElevenAgents 上每周超过一千万次对话——以及 Runway 围绕 Seedance 2.5 的首发优惠,都印证了生产级生成式 AI,无论是语音还是视频,如今都已进入企业规模部署阶段;配套的也不再只是技术演示,而是专门的监控工具。
来源
- Qwen3.8-Max — X 上的公告
- GenOffice — X 上的公告
- API v0 — X 上的公告
- Cursor — X 上的云端代理
- Cursor — Google Workspace 插件
- GitHub 在 Aspire 的 Agentic Workflows
- GitHub Ship Log 2026 年 7 月
- Sakana Namazu — 官方公告
- MiniMax H3 — 已发布权重
- Runway — Max 套餐
- ElevenAgents — ElevenLabs 在 X 上
- Google 与 PSG — X 上的公告
- Vercel 与 v0 — 连接 ChatGPT
- Replit Designathon
- Together AI — Kimi K3 Max 对比 Fable 5 xhigh
- 从 GitLab 迁移到 GitHub Enterprise Cloud
- Fuser 上的 Luma Ray 3.2
- NVIDIA NeMo Gym — Legal Agent Bench
- NVIDIA — 跑酷演示
- Kimi Slides — 教程