搜索

Claude Managed Agents 升级,Firebird 在 CIS 开设其最大的 AI factory,Kimi K3 回归 Copilot

由人工智能生成的文章
Claude Managed Agents 升级,Firebird 在 CIS 开设其最大的 AI factory,Kimi K3 回归 Copilot

ai-powered-markdown-translator

使用 gpt-5.4-mini 将文章从法语翻译成中文。

在 GitHub 上查看项目 ↗

2026 年 8 月 8 日,Anthropic 为 Claude Managed Agents 增添会话预算、计算区域选择、技能自动加载,以及一个可在会话中调用的顾问模型。 同一天,Firebird 在亚美尼亚启用 CIS 地区最大的 AI factory,目标到 2027 年底部署超过 70,000 个 GPU;与此同时,GitHub 确认 Kimi K3 回归 Copilot,并给出其精确计费,正式将 Lite 和 Balanced 等级推广至代码审查,并发布每周摘要。另有 Warp Agent CLI 将 X Premium 订阅接入 Grok、Replit 关于 agents 大规模使用的内部总结、Meta Muse Spark 1.2 在两个排行榜上确认竞争力,以及来自 Hugging Face、Together AI 和生成式媒体的十余条简讯,共同构成当天的更新。


Claude 开发者平台:Managed Agents 的四项更新

8 月 8 日 — Anthropic 为 Claude Developer Platform 上的 Claude Managed Agents 推出了四项改进。现在可以按会话设置预算来控制开支:当会话达到上限时会以事件 budget_reached 暂停,只需提高预算即可继续。参数 model.inference_geo 现在支持 us(按 1.1x 计费,保证美国区域)或 global(标准费率,按可用容量进行推理)。Managed Agents 还会自动加载已附着仓库中 .claude/skills/ 里已有的 skills,无需额外配置。最后,Managed Agent 现在还可以接收一个更强大的“顾问”模型(advisor),可在会话中调用以获取第二意见——只需一行 roster 配置即可。

更新详情
会话预算达到上限自动暂停,事件 budget_reached
计算区域us(1.1x)或 global(标准费率)
skills 加载自动从附着仓库加载
顾问模型会话中可获得第二意见,1 行配置

🔗 @ClaudeDevs 公告


代码工具:Warp 连接 X Premium,Replit 发布其 agents 内部总结

Warp Agent CLI 新增 /connect-grok,用于关联 X Premium 订阅

8 月 7 日 — Warp 为 8 月 4 日推出的 Warp Agent CLI 增加了 /connect-grok 命令,用于关联现有的 X Premium 订阅,并在无需单独配置 API key 的情况下使用 Grok——这也是该工具已提供的“bring your own key”模式的延伸。 同一天,Warp 还发布了一段演示视频,展示了多个功能同时运作:多 agent 协同编排、带推理语法高亮的 plan 模式、语音模式(/voice)以及 shell 模式。

Run /connect-grok in the Warp Agent CLI to use your X Premium subscription with Warp!

🇨🇳 在 Warp Agent CLI 中运行 /connect-grok,即可使用你的 X Premium 订阅与 Warp!@warpdotdev 在 X 上

Replit 详述其团队如何借助 agents 将代码产出几乎提升到三倍

8 月 7 日 — Replit 发布了一份关于其内部自用 agents 的 6 个月内部总结:产出代码量几乎翻了三倍,而审查时间、回归率和事故数量保持稳定,质量则有所提升。 团队强调:这并不是单一的 AI,而是一个分布在多个职能上的 agents 系统——包括事故调查、pull request 审查、支持分流、数据分析以及商业账户调研。 另一个值得注意的点是:一个内部使用的付费 SaaS 工具已被一款完全在 Replit 上开发的应用取代,且这款应用被认为优于原始工具。 Replit 将这一变化形容为“自驱动企业”的开端。

Over the last 6 months, Replit nearly tripled its code output. Quality held. Nothing broke. We started becoming a self-driving company.

🇨🇳 在过去 6 个月里,Replit 的代码产出量几乎翻了三倍。质量保持稳定。没有任何东西出问题。我们已经成为一家自驱动企业。@Replit 在 X 上


Meta Muse Spark 1.2 在两个排行榜上确认了其竞争力

8 月 6 日 — 两个独立排行榜确认了 Meta Muse Spark 1.2 的突破。 在 Vals Index(综合排行榜)上,该模型以每次测试 0.69 美元进入前 5——大约比 Kimi 便宜 3 倍,比 Opus、Fable 或 GPT-5.6 Sol 便宜 10 倍甚至更多,同时处于相近定位。 在一个专门面向电子游戏开发的排行榜上,Muse Spark 1.2 与 GPT-5.6-Sol 持平,并列第 3 名;Meta 团队的一名工程师认为,年初时公司在这类榜单上还不可能达到这样的名次。 这两个信号,加上 8 月初已经报道过的国际科学奥林匹克金牌和 Artificial Analysis 基准测试,共同确认了 Muse Spark 家族竞争力持续上升的态势,并且成本优势明显。

排行榜Muse Spark 1.2 名次参考
Vals Index前 50.69 $/test,比 Kimi 便宜 3 倍
电子游戏(专项)第 3 名并列持平 GPT-5.6-Sol

Muse Spark 1.2 just cracked the top 5 on the Vals Index, at just $0.69 per test. This is 3x cheaper than Kimi and 10x or more cheaper than Fable, Opus, and 5.6 Sol.

🇨🇳 Muse Spark 1.2 刚刚进入 Vals Index 前 5,每次测试仅 0.69 美元。它比 Kimi 便宜 3 倍,也比 Fable、Opus 和 5.6 Sol 便宜 10 倍甚至更多。@ValsAI 在 X 上


GitHub Copilot:Kimi K3、每周新功能与代码审查

Copilot 中的 Kimi K3:先暂停再恢复部署,价格已确认

8 月 6-7 日 — GitHub 于 8 月 6 日暂停了 Kimi K3 在 Copilot 中的部署,以便解决影响 GitHub Actions 的一次故障,同时提前说明了该模型计划中的计费方式。 次日,也就是 8 月 7 日,GitHub 宣布恢复部署:Kimi K3 按供应商列表价(provider list pricing)计费,并采用按使用量计费(usage-based billing)模式,公司还将用户引向其计费文档,以查看完整的模型和请求细节。 这一事件补充了前一天宣布的 Kimi K3 在 Copilot 中全面可用的信息:它增加了准确的计费说明,以及导致部署短暂停止的技术故障细节。

Token 类型价格
输入3 $ / million
输出15 $ / million
缓存输入0.30 $ / million

🔗 部署恢复推文

8 月 3 日每周更新:App、CLI、VS Code

8 月 7 日 — GitHub Copilot 的每周回顾涵盖了桌面 App、CLI 和 VS Code 1.132。在桌面 App 中,Copilot 现在会按请求显示所使用的模型,并展示消耗的 credits 和缓存使用情况,还可以通过 /side 加入共享会话或打开并行探索。CLI 通过侧边栏支持多个并发会话(快捷键 n 用于创建,x 用于导航),新增一个用于隔离工作区的实验性命令 /worktree,以及一个无需 Git 依赖即可恢复先前状态的命令 /rewind。在 VS Code 1.132 中,多语言听写会自动检测所说语言,而 /btw 命令则允许在不中断当前对话的情况下提出后续问题。

界面核心新功能
桌面 App按请求显示模型与 credits,命令 /side
CLI多个会话,/worktree,无需 Git 的 /rewind
VS Code 1.132多语言听写,命令 /btw

🔗 8 月 3 日每周新功能

Copilot code review:Lite 和 Balanced 正式可用

8 月 7 日 — GitHub 将 Copilot code review 的两个努力等级正式推广,取代旧的 Low 和 Medium 命名。 Lite 级别面向简单变更(文档、轻微修复),并提供聚焦反馈;Balanced 级别则面向复杂逻辑、涉及安全的敏感代码以及跨服务变更,并借助增强推理模型进行更深入的分析。 该选择按单次 review 单独设置,不会修改仓库或组织的默认值;但管理员可以在组织设置中为所有仓库定义一个默认等级。 现在,所选等级会显示在 pull request 的时间线和总结评论中。 两个等级都包含在 Copilot Pro、Pro+、Max、Business 和 Enterprise 中。

等级适用场景包含套餐
Lite简单变更、文档、轻微修复Pro、Pro+、Max、Business、Enterprise
Balanced复杂逻辑、安全、跨服务Pro、Pro+、Max、Business、Enterprise

🔗 Copilot code review 努力等级正式可用


Firebird 在亚美尼亚启动 CIS 地区最大的 AI factory

8 月 8 日 — Firebird 是一家活跃于 CIS(独立国家联合体)地区的新兴 AI 云厂商,已在亚美尼亚哈兹丹启用其所称的该地区最大的 AI factory。 该基础设施基于 NVIDIA 加速计算平台和 Dell Technologies PowerEdge 服务器,并采用一套 NVIDIA DSX 平台;该平台凭借能效声称在相同占地上可多部署 40% 的 GPU。 部署计划到 2027 年底配置超过 70,000 个 GPU(Blackwell 与 Rubin 混合),目标容量为 300 兆瓦,且建设在六个多月内完成。 Perplexity 被列为早期客户。 Firebird 还公布了一项 2 吉瓦的区域路线图,并将亚美尼亚和哈萨克斯坦作为首批里程碑。

项目详情
已部署 GPU70,000+(Blackwell + Rubin),到 2027 年底
目标容量300 MW
合作伙伴NVIDIA、CoreWeave、Dell Technologies、Schneider Electric、Vertiv
早期客户Perplexity

🔗 Firebird 在亚美尼亚启动 CIS 地区最大的 AI Factory


简讯

  • Replit 允许在 workspaces 之间迁移项目 — 可在同一 team 或 enterprise 账户的 workspaces 之间转移,入口位于项目列表的下拉菜单中。 🔗 source
  • Hugging Face 发布新的 DNA 基础模型 — 一个能够读取和生成 DNA 序列的模型现已提供,并附带演示空间;模型名称和组织未披露。 🔗 source
  • NVIDIA 发布 NeMo Gym 的对话式 tool-use 资源 — 在 Hugging Face 上公开了参考 policy/工具对以及 prompt 历史,用于训练使用工具的对话 agent。 🔗 source
  • Hugging Face 转发了一项关于 AI agents 复现 ICML 2026 论文的研究 — 关于 agents 自动复现科学论文的线程,没有提供方法细节或成功率。 🔗 source
  • Hugging Face Storage Buckets 集成 Vast AI — 在 Vast AI 上租用的 GPU 实例现在可以直接读写 Hugging Face bucket,无需手动传输。 🔗 source
  • 第三方供应商声称其对 DeepSeek V4 Flash 和 Kimi K3 的推理速度最快 — 这一说法基于真实生产流量而非合成测试,需谨慎看待。 🔗 source
  • Together AI 为其文档新增 Learn 版块 — 以教学内容解释首 token 时间(TTFT)、上下文窗口、sampling、fine-tuning、quantization 以及部署权衡。 🔗 source
  • FLUX 3 已在 Together AI 上线生产环境 — Black Forest Labs 的多模态模型(视频与同步音频,最长 20 秒片段)可通过 Together AI 的托管 serverless 推理使用。 🔗 source
  • Roomote 选择 Together AI 作为其推理供应商 — 该 agents 工具现在可根据工作流阶段分配不同的开源模型:代码、规划、视觉和审查。 🔗 source
  • Copilot impact dashboard 增加了投资回报部分 — 新增部分将每位开发者的 Copilot 月成本与产出的 pull request 数量进行比较,并配有交互式薪资选择器。 🔗 source
  • 企业现在可以安装第三方 GitHub Apps — enterprise 账户所有者可以安装外部公开 GitHub Apps,并且仅限于企业账户范围内的访问,敏感权限受到限制。 🔗 source
  • MiniMax H3 在 DesignArena 三个类别中排名第一 — 这款 open weights 模型声称在 Multi-Image to Video、Image to Video 和 Video Editing 的 DesignArena Frontier 排行中位列第一。 🔗 source
  • Kimi K3——下载量和活跃用户强劲增长(SensorTower) — 自 Kimi K3 发布以来,Kimi 应用下载量几乎增长到原来的 5 倍,日活跃用户增长了约 40%。 🔗 source

这意味着什么

在大型供应商中,代理式基础设施正在走向标准化。Anthropic 为 Managed Agents 增加了 Claude Code 早已单独提供的能力——预算、区域选择、技能加载——并创新性地推出了一个可在会话过程中查询的顾问模型。GitHub 则在治理侧延续了同样的逻辑:Copilot code review 将 Lite 和 Balanced 作为组织级配置进行普及,而 CLI 则新增了可回滚的命令(/rewind),把会话视为可恢复的状态,而不是一次性流。Warp 也在拓展对第三方模型的访问(通过 X Premium 订阅使用 Grok),而无需强制使用专门的 API 密钥。共同点在于:代理式工具正在采用与传统云基础设施相同的思路——预算、区域、权限、回滚。

成本/性能比继续比原始排名更能决定采用选择。Meta Muse Spark 1.2 以每次测试 0.69 美元的价格进入 Vals Index 前 5,尽管定位相近,但比 Kimi 便宜 3 倍;与此同时,Kimi K3 根据 SensorTower 的数据下载量几乎增长了五倍,并在 GitHub Copilot 上确认了精确的按用量定价(每百万 token 3 美元 / 15 美元)。这两个信号共同描绘出一个市场:用户拉动和每次请求成本,与基准榜单上的位置同样重要。

物理基础设施的部署仍在加速,并持续向传统区域之外扩展。Firebird 选择亚美尼亚建设 CIS 地区最大的 AI factory,目标是在 2027 年底前部署超过 70,000 块 GPU,并规划 2 吉瓦的区域路线图。作为早期客户被提及的 Perplexity,体现出一种趋势:模型供应商正在主动追求计算资源的地理多样性,而不是只依赖美国或中国的枢纽。

最后,卫星工具生态正在围绕少数开放推理供应商逐步整合。Together AI 在一周内连续完成多项集成——FLUX 3 上线生产环境、Roomote 作为代理式客户端、以及一个专门介绍推理概念的教学板块——与此同时,Hugging Face 也在扩展其存储平台的角色(集成 Vast AI)以及模型分发能力。这个由简短动态而非轰动性公告组成的安静进程,正在搭建支撑更显眼日常应用的底层管道。


来源