検索

Claude Managed Agents が強化、Firebird が CIS 最大の AI factory を開設、Kimi K3 が Copilot に復帰

人工知能によって生成された記事
Claude Managed Agents が強化、Firebird が CIS 最大の AI factory を開設、Kimi K3 が Copilot に復帰

ai-powered-markdown-translator

gpt-5.4-mini によって fr から ja に翻訳された記事。

GitHub でプロジェクトを見る ↗

2026年8月8日、Anthropic は Claude Developer Platform の Claude Managed Agents を、セッション予算、計算リージョンの選択、skills の自動読み込み、そしてセッション中に参照できるコンサルタントモデルで拡張しました。同日、Firebird は CIS 地域最大の AI factory をアルメニアに開設し、2027年末までに 70,000 基超の GPU を目指す一方、GitHub は Copilot における Kimi K3 の復帰と正確な料金を確認し、コードレビューでは Lite と Balanced の各レベルを一般提供へ広げ、週次まとめも公開しました。さらに、X Premium を Grok に接続する Warp Agent CLI、Replit のエージェント大量活用に関する社内総括、2つのランキングで競争力を示した Meta Muse Spark 1.2、そして Hugging Face、Together AI、生成系メディアの短報が続きます。


Claude Developer Platform : Managed Agents 向けの4つの更新

8月8日 — Anthropic は Claude Developer Platform の Claude Managed Agents に4つの改善を提供しました。セッションごとに予算を設定できるようになり、上限に達したセッションは budget_reached というイベントとともに一時停止し、予算を引き上げれば再開できます。model.inference_geo パラメータは us(1.1倍課金、US リージョン保証)または global(標準料金、キャパシティがある場所で推論)を受け付けます。Managed Agents は、接続されたリポジトリの .claude/skills/ にすでに存在する skills も自動で読み込むため、追加設定は不要です。さらに、Managed Agent はより強力な「コンサルタント」モデル(advisor)を受け取れるようになり、セッション中に第二の意見として呼び出せます。ロスター設定は1行で済みます。

更新詳細
セッション予算上限で自動停止、イベント budget_reached
計算リージョンus(1.1倍)または global(標準料金)
skills の読み込み接続済みリポジトリから自動
コンサルタントモデルセッション中の第二意見、設定は1行

🔗 @ClaudeDevs の発表


コードツール:Warp が X Premium を接続、Replit がエージェントの社内総括を公開

Warp Agent CLI に /connect-grok を追加し、X Premium アカウントを連携可能に

8月7日 — Warp は、8月4日に公開された Warp Agent CLI に /connect-grok コマンドを追加し、既存の X Premium サブスクリプションを連携して、別途 API キーを設定せずに Grok を使えるようにしました。これは、同ツールがすでに提供していた「bring your own key」モデルの拡張です。同日、Warp は複数機能をまとめて紹介するデモ動画も公開し、マルチエージェントのオーケストレーション、推論を構文色分けする plan モード、音声モード(/voice)、shell モードを示しました。

Run /connect-grok in the Warp Agent CLI to use your X Premium subscription with Warp!

🇯🇵 Warp Agent CLI で /connect-grok を起動すると、Warp であなたの X Premium サブスクリプションを使えます!@warpdotdev の X 投稿

Replit は、エージェントでコード出力量をほぼ3倍にした経緯を社内で詳述

8月7日 — Replit は、自社エージェントの社内利用6か月分に関する内部総括を公開しました。生成されたコード量はほぼ3倍になり、一方でレビュー時間、回帰率、障害件数は安定しており、品質は向上しました。同社は、これは単一の AI ではなく、インシデント調査、プルリクエストレビュー、サポートのトリアージ、データ分析、商談アカウント調査など、複数機能に分散したエージェントシステムだと強調しています。もう1つの注目点は、社内で使われていた有料 SaaS ツールが、Replit 上で完全に開発されたアプリに置き換えられ、元の製品より優れていると評価されたことです。Replit はこの変化を「自動操縦された企業」の始まりと表現しました。

Over the last 6 months, Replit nearly tripled its code output. Quality held. Nothing broke. We started becoming a self-driving company.

🇯🇵 過去6か月で、Replit の生成コード量はほぼ3倍になりました。品質は維持されました。何も壊れていません。私たちは自動操縦された企業になりました。@Replit の X 投稿


Meta Muse Spark 1.2 が2つのランキングで競争力を証明

8月6日 — 2つの独立したランキングが Meta Muse Spark 1.2 の躍進を裏付けました。一般向けの Vals Index では、同モデルが1テストあたり 0.69 $ でトップ5入りを果たし、Kimi より約3倍安く、Opus、Fable、GPT-5.6 Sol より10倍以上安い水準で、同等の位置づけに入りました。ゲーム開発に特化したランキングでは、Muse Spark 1.2 は GPT-5.6-Sol と並び3位同着となり、Meta のエンジニアは、年初の段階ではこの種のランキングで同社が到達不可能だと考えていた位置だと述べています。これら2つのシグナルは、8月初旬にすでに報じた国際科学オリンピアードの金メダルや Artificial Analysis ベンチマークに加わり、Muse Spark ファミリーの競争力が継続的に高まっていること、そしてコスト面で大きな優位性があることを示しています。

ランキングMuse Spark 1.2 の位置目安
Vals Indexトップ50.69 $/test、Kimi より3倍安い
ゲーム(特化)3位同着GPT-5.6-Sol と同等

Muse Spark 1.2 just cracked the top 5 on the Vals Index, at just $0.69 per test. This is 3x cheaper than Kimi and 10x or more cheaper than Fable, Opus, and 5.6 Sol.

🇯🇵 Muse Spark 1.2 は、たった 0.69 ドル/テストで Vals Index のトップ5に入ったばかりです。Kimi より3倍安く、Fable、Opus、5.6 Sol より10倍以上安いのです。@ValsAI の X 投稿


GitHub Copilot : Kimi K3、週次更新、コードレビュー

Copilot の Kimi K3:展開を一時停止して再開、料金を確定

8月6日〜7日 — GitHub は、GitHub Actions に影響する障害を解消するため、8月6日に Copilot での Kimi K3 の展開を一時停止し、その際にモデルの予定料金も事前に案内しました。翌7日、GitHub は展開再開を発表し、Kimi K3 は従量課金(usage-based billing)のもとでベンダーのリスト価格(provider list pricing)で請求されると説明し、モデルやリクエストの詳細は料金ドキュメントを参照するよう案内しました。この出来事は、前日に発表された Copilot における Kimi K3 の一般提供を補完するものであり、正確な料金情報と、展開を一時的に止めた技術的障害の詳細を加えています。

トークン種別価格
入力3 $ / million
出力15 $ / million
キャッシュ入力0.30 $ / million

🔗 展開再開の投稿

8月3日の週次更新:アプリ、CLI、VS Code

8月7日 — GitHub Copilot の週次まとめは、デスクトップアプリ、CLI、VS Code 1.132 を対象にしています。デスクトップアプリでは、Copilot がリクエストごとに使用モデルを表示し、消費クレジットとキャッシュ利用の詳細も確認できるようになり、共有セッションへの参加や /side 経由での並列探索開始も可能になりました。CLI では、サイドバー内で複数セッションを同時に扱えるようになり(作成は n、移動は x のショートカット)、隔離された作業領域のための実験的コマンド /worktree と、Git に依存せず以前の状態を復元する /rewind コマンドが追加されました。VS Code 1.132 では、多言語ディクテーションが話している言語を自動検出し、/btw コマンドで会話を中断せずに追加の質問を行えます。

表示面主な新機能
デスクトップアプリモデルとクレジットをリクエストごとに表示、コマンド /side
CLI複数セッション、/worktree/rewind を Git なしで利用
VS Code 1.132多言語ディクテーション、コマンド /btw

🔗 8月3日の週次更新

Copilot code review:Lite と Balanced が一般提供に

8月7日 — GitHub は Copilot code review の2つの effort レベルを一般提供にし、従来の Low と Medium の呼称を置き換えました。Lite レベルは、ドキュメントや軽微な修正などの単純な変更を対象に、的を絞ったフィードバックを返します。Balanced レベルは、複雑なロジック、セキュリティ上センシティブなコード、サービス横断の変更を対象に、強化推論モデルを活用したより深い分析を行います。選択は各レビューごとに行われ、リポジトリや組織の既定値は変更しませんが、管理者は組織設定から全リポジトリに適用される既定レベルを設定できます。選択したレベルは、プルリクエストのタイムラインと要約コメントに表示されるようになりました。両レベルは Copilot Pro、Pro+、Max、Business、Enterprise に含まれます。

レベル対象含まれるプラン
Lite単純な変更、ドキュメント、軽微な修正Pro、Pro+、Max、Business、Enterprise
Balanced複雑なロジック、セキュリティ、サービス横断Pro、Pro+、Max、Business、Enterprise

🔗 Copilot code review の effort レベルが一般提供に


Firebird がアルメニアで CIS 地域最大の AI factory を開設

8月8日 — CIS(独立国家共同体)地域で活動する新興 AI クラウド Firebird は、アルメニアのフラズダンに、この地域最大とされる AI factory を開設しました。インフラは NVIDIA のアクセラレーテッド・コンピュート・プラットフォームと Dell Technologies PowerEdge サーバーを採用し、NVIDIA DSX プラットフォームはエネルギー効率により同じ設置面積で 40% 多い GPU を実現するとしています。展開では、2027年末までに 70,000 基超の GPU(Blackwell と Rubin の組み合わせ)を計画しており、300 メガワットの目標容量を、6か月強で立ち上げる予定です。Perplexity は初期顧客として挙げられています。Firebird は、アルメニアとカザフスタンを最初のマイルストーンとする 2 ギガワットの地域ロードマップも発表しました。

項目詳細
展開 GPU70,000 基超(Blackwell + Rubin)、2027年末までに
目標容量300 MW
パートナーNVIDIA、CoreWeave、Dell Technologies、Schneider Electric、Vertiv
初期顧客Perplexity

🔗 Firebird がアルメニアで CIS 地域最大の AI Factory を開設


短報

  • Replit でプロジェクトを workspaces 間で移動可能に — 同じ team または enterprise アカウント内で、プロジェクト一覧のドロップダウンメニューから workspaces 間の移動が可能になりました。 🔗 ソース
  • DNA 基盤モデルの新作が Hugging Face で公開 — DNA 配列を読み取り、生成できるモデルがデモスペース付きで利用可能になりました。モデル名と組織名は明示されていません。 🔗 ソース
  • NVIDIA が NeMo Gym の会話型 tool-use アセットを公開 — ツールを使う会話エージェントの学習向けに、参照用の policy/ツールペアとプロンプト履歴が Hugging Face に公開されました。 🔗 ソース
  • Hugging Face が、ICML 2026 の論文を再現する AI エージェントに関する研究を紹介 — AI エージェントによる科学論文の自動再現に関するスレッドで、方法論や成功率の詳細はありません。 🔗 ソース
  • Hugging Face Storage Buckets が Vast AI と統合 — Vast AI 上で借りた GPU インスタンスが、手動転送なしで Hugging Face バケットへ直接読み書きできるようになりました。 🔗 ソース
  • 第三者ベンダーが DeepSeek V4 Flash と Kimi K3 で最速推論を主張 — 合成テストではなく実際の本番トラフィックに基づく主張であり、慎重に受け止めるべきです。 🔗 ソース
  • Together AI がドキュメントに Learn セクションを追加 — 最初のトークンまでの時間(TTFT)、コンテキストウィンドウ、サンプリング、ファインチューニング、量子化、展開上のトレードオフを説明する教育コンテンツです。 🔗 ソース
  • FLUX 3 が Together AI の本番環境で利用可能に — Black Forest Labs のマルチモーダルモデル(動画と同期音声、最大20秒のクリップ)は、Together AI のマネージド・サーバーレス推論から利用できます。 🔗 ソース
  • Roomote が推論プロバイダーとして Together AI を採用 — エージェントツールは、コード、計画、視覚、レビューといったワークフロー段階に応じて、異なるオープンモデルを割り当てられるようになりました。 🔗 ソース
  • Copilot impact dashboard に投資対効果の項目が追加 — 開発者1人あたりの Copilot の月額コストと、生成されたプルリクエスト数を比較する新セクションが追加され、給与を選べるインタラクティブな選択機能もあります。 🔗 ソース
  • 企業がサードパーティ製 GitHub Apps をインストール可能に — enterprise アカウントの所有者は、外部の公開 GitHub Apps をインストールできるようになり、enterprise アカウントへのアクセスは制限され、機微な権限は制約されます。 🔗 ソース
  • MiniMax H3 が DesignArena の3カテゴリで1位 — open weights のこのモデルは、DesignArena Frontier の Multi-Image to Video、Image to Video、Video Editing で首位を主張しています。 🔗 ソース
  • Kimi K3 — ダウンロード数とアクティブユーザーが大きく増加(SensorTower) — Kimi アプリのダウンロード数はほぼ5倍になり、Kimi K3 の公開以降、デイリーアクティブユーザーは約40%増加しました。 🔗 ソース

その意味するところ

エージェント基盤は、大手プロバイダーのあいだで標準化しつつある。Anthropic は Managed Agents に、Claude Code がすでに単独で提供していたもの――予算、リージョン選択、スキルの読み込み――を加え、さらにセッション中に参照できるアドバイザーモデルで新機軸を打ち出している。GitHub も同じ流れをガバナンス側で延長している。Copilot code review は Lite と Balanced を組織単位の設定として一般化し、CLI はセッションを捨てられるフローではなく復元すべき状態として扱う可逆なコマンド(/rewind)を追加した。Warp は一方で、専用の API キーを強制せずにサードパーティモデルへのアクセスを広げている(X Premium サブスクリプション経由の Grok)。共通点は明快だ。エージェント系ツールが、従来のクラウド基盤と同じ発想――予算、リージョン、権限、巻き戻し――を採用し始めている。

採用の判断を左右し続けているのは、生の順位よりもコスト/性能である。Meta Muse Spark 1.2 は 1 テストあたり 0.69 $ で Vals Index のトップ 5 に入り、同等の位置づけの Kimi より 3 倍安い。Kimi K3 は、SensorTower によればダウンロード数がほぼ 5 倍になった一方で、GitHub Copilot 上では厳密な従量課金(100 万トークンあたり 3 $ / 15 $)を確認している。この 2 つのシグナルを合わせると、ユーザー獲得力と 1 リクエストあたりのコストが、参照ランキング上の位置と同じくらい重視される市場の姿が見えてくる。

物理インフラの展開は、従来の地域外で加速し続けている。Firebird は CIS 地域最大の AI factory を建設するためにアルメニアを選び、2027 年末までに 7 万台超の GPU を目標とし、2 ギガワット規模の地域ロードマップを掲げている。早期顧客として挙げられた Perplexity は、モデル提供側が米国や中国のハブだけに依存するのではなく、計算資源の地理的分散を積極的に求めている動きを示している。

最後に、衛星ツールのエコシステムは、いくつかのオープンな推論プロバイダーを中心にまとまりつつある。Together AI は 1 週間で統合を重ねている。FLUX 3 の本番投入、エージェント系クライアントとしての Roomote、推論概念に特化した教育セクションの追加だ。一方で Hugging Face は、Vast AI との統合によりストレージ基盤としての役割を広げると同時に、モデル配信の役割も拡張している。派手な発表ではなく短いニュースの積み重ねでできたこの静かな動きが、今日のより目立つユースケースを支える基盤配管を形作っている。


ソース