検索

CursorがCursor Routerを発表、OpenAIがPresenceとProject Camelliaを公開、AlibabaがQwen-Image-3.0を披露

CursorがCursor Routerを発表、OpenAIがPresenceとProject Camelliaを公開、AlibabaがQwen-Image-3.0を披露

ai-powered-markdown-translator

fr から ja に翻訳された記事、gpt-5.4-mini 使用。

GitHub でプロジェクトを見る ↗

2026年7月22日は、企業向けAIツールとエージェントが話題を独占している。CursorはCursor Routerを発表し、品質劣化を体感上ほぼ伴わずにコストを60%削減するモデルルーターを公開。OpenAIはエージェント・プラットフォームPresenceと、ジョージア州に建設する3.2ギガワット規模のProject Camelliaデータセンターを相次いで発表した。AlibabaはQwen-Image-3.0を公開し、Synthesiaは職業訓練向けにRoleplay Sessionsを開始した。これら5つの大型発表の周辺でも、米エネルギー省のGenesis Mission(Google、OpenAI、Arcee AI)から、Anthropic、GitHub Copilot、NVIDIA、Cohereの新情報まで、注目の新機能が30件ほど並んでいる。


CursorがCursor Routerを発表、60%安いインテリジェントなモデルルーティング

7月22日 — CursorはCursor Routerをリリースした。これはAutoモードに統合されたモデルルーターで、各リクエストを解析し、すべての要求を一律でフロンティアモデル(frontier)へ送るのではなく、タスクに最も適したモデルを自動で選択する。機能は本日より、TeamsとEnterpriseプラン向けに全対応面(desktop、web、iOS、CLI、SDK)で利用可能。

最適化モード目的課金
Intelligence一貫したフロンティア品質実際に使用されたモデルの料金
Balanceフロンティアに近い品質、日常利用向け実際に使用されたモデルの料金
Cost妥当な品質、トークン最適化実際に使用されたモデルの料金

管理面では、TeamsおよびEnterpriseの各チームが細かな制御を行える。チームごとにRouterを有効化/無効化し、利用可能なモードを制限し、既定モードを設定し、下位モデルの一部を許可またはブロックし、実際にルーティングされたモデル名を表示するかどうかを選べる(既定では非表示)。柔軟な適用と厳格な適用のオプションにより、組織全体でAutoモードの使い方を標準化できる。

In early access, customers observed no drop-off in quality with a lower cost per commit vs. routing all requests to Opus 4.8.

🇯🇵 早期アクセスでは、すべてのリクエストをOpus 4.8にルーティングした場合と比べて、コミットあたりのコストは低いまま、品質低下は一切確認されなかった。@cursor_ai on X

🔗 Cursor Routerの変更履歴


OpenAI Presence、企業向けの音声・テキストエージェント基盤

7月22日 — OpenAIはPresenceを発表する。これは、単なる技術デモを超えて、信頼性の高い音声・テキストエージェントを本番環境で展開するための企業向けAIエージェント・プラットフォームである。Presenceは、モデルの推論にポリシー、ガードレール、人間へのエスカレーション規則を組み合わせる。

各導入は、請求、保険金請求、社内IT問い合わせといった明確な業務から始まる。エージェントには必要な知識とシステムアクセスだけが与えられ、顧客企業が、何を実行できるのか、いつ人間の承認が必要なのか、いつ人が引き継ぐのかを定義する。本番投入後は、実際のセッションやエスカレーション事例によってシステムの弱点が明らかになる。そこでCodexが更新案を提示し、チームがそれをテストして検証することで、エージェントはユーザー行動の変化に適応していく。

本日より、Presenceはカスタマーサポート、アウトバウンド営業、あるいは高いリスクを伴う社内フロー向けに、音声とテキストのリアルタイム体験をサポートする。製品は、限定的な一般提供プログラムを通じて対象企業顧客に提供され、OpenAIチームによる直接支援の後、継続的なフォローアップは選定されたシステムインテグレーターが担当する。

🔗 完全な発表 — OpenAI


Project Camellia、ジョージア州に建設される3.2ギガワットのOpenAIデータセンター

7月22日 — OpenAIは、ジョージア州エフィンガム郡における長期AIインフラ計画Project Camelliaの詳細を明らかにした。同社はGeorgia Powerと、2028年から2032年にかけて段階的に供給される3.2ギガワットの電力について契約した。

電力面では、OpenAIがインフラおよびサービスの全コストを負担し、住民料金に転嫁しないことを約束している。また、住宅顧客に影響が及ぶ前に、高需要時にはサイト側で先んじて消費を抑えられるよう設計されている。水については、閉ループ方式で水を再循環させ、継続的に汲み上げて排出するのではなく、同規模のオフィスビルに相当する持続的な消費に抑える。

経済面では、OpenAIはプロジェクトのライフサイクルを通じて8,000万ドルの地域利益(学校、公共安全、医療、住宅、退役軍人、中小企業)を見込む。これに加え、地方および州の税収として数億ドルが見込まれ、同社は郡内最大の納税者になると予測している。さらに、ジョージア州の対象大学、コミュニティカレッジ、工業系学校の学生に対して、最大7,100万ドル相当のCodexクレジットも提供される。各学生はChatGPTアカウントを通じて100ドル分のクレジットを受け取る。

🔗 完全な発表 — OpenAI


Alibabaの画像生成モデル第3世代Qwen-Image-3.0

7月22日 — AlibabaはQwen-Image-3.0をリリースした。これは画像生成モデルの第3世代であり、チームはその要点を一言で「Real(「实」)」と表現している。1.0版の精度、2.0版の多様性・網羅性に続くものだ。

次元具体的に何が変わるか
豊富なコンテンツ最大4.5kトークンのプロンプト;複雑なレイアウトを一発生成(新聞、ストーリーボード、試験問題、3×3インフォグラフィックのグリッド、入れ子構造のUI)
本物らしいディテール10pxまで読めるテキスト、完全なLaTeXページ、ほぼ写真級の質感(毛穴、髪の束、肌)
深い知識12言語でのネイティブレンダリング、100超のアートスタイル、リアルなUI(Web、ゲーム、配信)、ライブWeb検索

Alibabaが紹介した例は、この「水平的拡張」をよく示している。わずか3.7kトークンで、モデルはトンネル安全、空間幾何、古典中国語テキストの文体分析、投射運動、寄生虫学、医療診断、Sylowの定理、銀行管理、DNA構造という、まったく異なる9分野を扱う3×3インフォグラフィックを生成し、各マスに正確なテキストとビジュアルを配置する。Alibabaはこのモデルを、単に「見た目がきれいな」ツールではなく、デザイン、コンテンツ制作、教育、eコマースのための生産性ツールとして位置づけている。現在、Qwen Chatから利用可能。

🔗 Xでの発表


Synthesiaが職業訓練向けにRoleplay Sessionsを開始

7月22日 — Synthesiaは、将来の「Sessions」プラットフォームの第一弾として、AIによる職業訓練向けのRoleplay Sessionsを発表した。仕組みは、回答しながらリアルタイムで追い込んでくるアバターとのライブ訓練会話で、スコアリングシステム付きでユーザーをコーチし、チーム全体のスキル向上を測定する。主な対象は営業、マネジメント、カスタマーサービス、そして従業員が難しい会話の練習を必要とするあらゆる場面だ。

指標
2027年までに基礎スキルが大きく変化する割合(Synthesia調べ)従業員の44%
ギャップを埋める能力が不足していると答えた雇用主63%
平均的なスキル向上率(世界的な大手人材紹介会社)約30%
自発的に練習に戻ってくる営業担当(Fortune 10企業)約70%

Roleplay Sessionsは、通常は別々に行われる4つの段階――情報提供、練習、コーチング、測定――を1つのプラットフォームにまとめようとしている。基盤にはSynthesiaのビデオ基盤があり、すでにFortune 100企業の90%が利用している。初期導入先には、欧州の大手企業とFortune 10企業が含まれる。

🔗 Xでの発表


DOEのGenesis Mission:Google、OpenAI、Arcee AIが相次いで支援を表明

7月22日 — 3つの異なる組織が同日、米エネルギー省(DOE)が10年で科学的発見の速度を倍増させることを目指す取り組みGenesis Missionへの新たな支援を発表した。

組織支援詳細
Google DeepMind4,000万ドルより多くの国立研究所の研究者がGeminiや他モデルにアクセスできるようにするためのAIトークンとGoogle Cloudクレジット
OpenAI1,700万ドル約2,000人の研究者向けCodexアクセス、2件の科学キャンペーン向けAPIサポート、250万ドルの支出に対して最大1,000万ドル分のAPI利用提供、生命科学向けGPT-Rosalindへのアクセス
Arcee AIパートナーシップ(非公開)科学計算ワークフロー向けの統制された研究ハーネスと組み合わせた、米国製のオープンウェイトモデルGenesis-Science-1(GS1)の構築

Googleは、計算生物学(AlphaFold、Isomorphic Labs)を巡ってすでに結んでいる協業を拡大する。OpenAIは、国立研究所システムとの既存の取り組みを基盤にしており、その中には9つの研究所から1,000人超の科学者が参加した「AI Jam」セッションも含まれる。Arcee AIは一方で、研究者、研究所、大学、企業、非営利組織を対象とした貢献プログラムを立ち上げる。GS1については、現時点ではリリース日もベンチマークも公表されておらず、プロジェクトはまだ初期段階にある。

🔗 Google DeepMind on X — 🔗 OpenAIの関連情報 — 🔗 Arcee AI on X


AnthropicがClaude関連の発表を連発

Claude SecurityがClaude Code向けにベータ公開

7月22日 — Anthropicは、Claude Code向けプラグインClaude Securityのベータ版を公開した。コミット前に変更中のコードをスキャンして脆弱性を探す、またはリポジトリ全体を分析する機能を、既存のClaude推論を活用しながらターミナルから実行できる(別途の第三者サービスを用意する必要はない)。このリリースにより、Claude CodeはOpenAIのCodex Securityや、強化されたGitHub Copilotのsecret scanningと同じ土俵に立つことになる。ベータ以外の価格や対象プランは明示されていない。

Claudeがconnector経由でAnthropic Economic Indexを参照可能に

7月22日 — 新しいネイティブconnectorにより、AIの経済利用を測定する公開データセットAnthropic Economic Indexへアクセスできるようになった。connectorメニューから有効化すると、Claudeは一般知識ではなくIndexのデータに直接基づいて、「どの職種が最もAIを使っているか」といった質問に答えられる。

Claude Managed Agents:effort、seeding、500 skills、webhooks

7月22日 — Anthropicは、Claude Managed Agents向けに一連の機能を展開する。エージェントごとに設定できるeffortレベル(effortを下げると応答が速く、コストも低い)、作成時点で最大50イベントまで入れた「seeded」セッション、1セッション内のすべてのエージェントを通じて合計最大500 skills、環境とメモリストア向けのwebhooks、そしてサブエージェントのイベントストリーミングが含まれる。

デスクトップ版Claude CodeがiOSシミュレーターと統合

7月21日 — デスクトップ版Claude CodeがiOSシミュレーターに対応した。アプリはClaudeによってビルド・起動され、Claudeはそれを観察し、操作し、タスク完了まで反復する。会話の横に表示されるパネルで実行される。本日よりパブリックベータとして利用可能で、macOS限定、Xcodeが必要。

🔗 Claude Security — 🔗 Economic Index — 🔗 Managed Agents — 🔗 iOSシミュレーター


コードツール:Amp、Warp、Replit

AmpがMultiplayerをリリース、orb上でのリアルタイム共同作業に対応

7月22日 — orb上でのエージェント提供開始から3週間後、AmpはMultiplayerを追加した。これにより、1つのorbをワークスペースの複数メンバーで共有し、同時に作業できる。エージェントへのメッセージ送信、ポータルの確認、ファイル変更のライブ観察、共有ターミナルが可能で、スレッドのShareメニューから有効化できる。

WarpがOSC 8ハイパーリンクをサポート

7月22日 — WarpはOSC 8のサポートを提供する。これは、CLIやコーディングエージェントがプレーンテキストではなくクリック可能なリンクを出力できるターミナル標準だ。5年前に出された要望に対し、外部コントリビューターが開発したこの機能は、ターミナルのグリッド描画エンジンに対する追加テストの間、feature flagの背後でDev版として展開される。

Replitがモバイルアプリを再始動

7月22日 — Replitはモバイルアプリ(iOS、Androidは段階的展開)の刷新版を公開した。再設計されたホーム画面、Agentに直接話しかけるための音声入力、chat・tasks・preview間のスワイプ操作、そしてアプリ外でも含めてエージェントの進行状況をリアルタイムで追跡するiOS Live Activitiesが追加されている。

🔗 Amp Multiplayer — 🔗 Warp OSC 8 — 🔗 Replitモバイル


Microsoft Asiaが軽量画像生成モデルMage-Flowを公開

7月22日 — Microsoft AsiaはHugging Face上でMage-Flowを公開した。これはわずか40億パラメータの画像生成・編集モデルで、はるかに大規模なモデルに匹敵する品質をうたっている。性能面では、1024×1024で4ステップ、1秒未満で1枚の画像を生成でき、最大4Kまで対応可能。デモはHugging Face Spacesで利用できる。

🔗 Xでの発表


Gemini:Galaxy Unpacked 2026とGemini 3.5 Pro

Samsung向けのGemini新機能3件

7月22日 — Galaxy Unpacked 2026に合わせて、GoogleはGalaxyエコシステム向けのGemini新機能3件を発表した。1つ目は、40以上の人気アプリ(買い物、予約、チケット購入など)へ対応を広げたタスク自動化で、複雑な画像を指示として扱い、バックグラウンドで実行できる。2つ目は、Gemini Notebook(旧NotebookLM)がGalaxy Z Fold8シリーズにプリインストールされ、Google AI Proの6か月トライアルが含まれる。3つ目は、Galaxy Watch 9上のGeminiで、ウェイクワードなし、手首を上げるだけで起動可能。さらに、Samsungと共同開発したスマートグラス(Gentle MonsterとWarby Parkerのフレーム)が2026年秋に予定されている。

Gemini 3.5 Proがパートナーテスト入り

7月21日 — Gemini担当VPのJosh Woodwardは、次期主力モデルGemini 3.5 Proが正式にパートナーテスト段階に入ったことを明らかにした。一般提供の時期はまだ示されていないが、この確認により、Gemini 3.5 ProはGemini系モデルの次の主要リリースとして位置づけられる。

🔗 Galaxy Unpacked 2026 — 🔗 Gemini 3.5 Pro


Manus が Plan Mode を導入

7月22日 — Manus は Plan Mode を導入しました。これは実行前の構造化されたレビューステップで、いきなり構築に取りかかるのではなく、エージェントが目標、手順、制約を含む Markdown 形式の実現可能性プランを生成し、ユーザーは承認前に編集したり再レビューに回したりできます。有効化は Web では /、モバイルでは + から行います。さらに、このモードはタスク進行中にも呼び出せるため、次のフェーズの計画にも使えます。現在、Web とモバイルの両方で、オプトインによりすべてのユーザーに即時提供されています。

🔗 発表 — Manus


GitHub Copilot:Canvas と課金

GitHub Copilot が Canvas をリリース

7月21日 — GitHub は、GitHub Copilot アプリ内で開発者とエージェントがリアルタイムに協働できるインタラクティブなワークスペースである canvas を導入しました。複雑な情報の可視化、直接操作(クリック、編集)、プロンプトの反復による洗練が可能です。作成は /create-canvas コマンドで行います。活用例としては、カードのスワイプによる issue の仕分け、対話型アーキテクチャ図、worktree のダッシュボード、プロンプト品質のコーチング、マルチプラットフォームの知識探索などが挙げられます。あるユーザーは、アプリがブラウザ canvas を自動で起動し、支払い画面までクリックして機能を検証した事例を記録しており、手書きの Playwright テストを置き換えました。

Copilot が単純な API アクセスを超えて提供するもの

7月22日 — GitHub は課金ポリシーを説明し、現在は公開 API 料金に基づいて請求される AI クレジットを土台にしています。コード補完と Next Edit Suggestions は引き続き有料プランに含まれますが、チャットとエージェント的タスクは AI クレジットを消費します。GitHub の主張は、モデルへのアクセスだけではなく、Copilot は統合されたフロー(issues、リポジトリ、pull requests、組織ポリシー)、自社評価によればタスク解決あたりで対等なトークン消費の削減、管理者向けのポリシー制御、そして Copilot SDK を通じてすでに本番環境で実証済みのエージェント基盤を提供するというものです。

🔗 Canvas — 🔗 Copilot vs. 単純な API アクセス


ElevenLabs:ElevenMusic とウクライナの公共サービス

ElevenLabs が ElevenMusic に Vocals と Styles を追加

7月22日 — ElevenLabs は、ElevenCreative の Finetunes でも利用可能な ElevenMusic に 2 つの機能を追加しました。Vocals は、自分の声またはボーカルライブラリの声でオリジナル曲を生成できる機能で、曲のアップロードによって Music v2 をその声質に合わせて調整することも、1 回の録音から即時に使うこともできます。Styles は、Vocals と組み合わせて、曲全体にわたるスタイルの一貫性を保つための機能です。ElevenLabs は、すべてのアップロードは著作権順守のために検査されると述べています。

ElevenLabs が Obrii(ウクライナ)に雇用サービス向け音声アシスタントを提供

7月22日Obrii は、ウクライナの労働市場向けの新しいデジタルエコシステムであり、最初の AI サービスを公開しました。ElevenLabs と共同開発した雇用サービス向けの音声アシスタントで、空襲警報中を含めて 24 時間 365 日利用できます。

“Together with @ElevenLabs, we launched AI voice assistant for the State Employment Service — bringing public services closer to people, 24/7, even during air raid alerts.”

🇯🇵 ElevenLabs とともに、雇用サービス向けの AI 音声アシスタントを公開しました。空襲警報中を含め、24 時間 365 日、公共サービスを市民により近づけています。@C_o_S on X

🔗 ElevenMusic の Vocals と Styles


NVIDIA:医療シミュレーション、テキサス工場、Cosmos モデル

医療物理シミュレーションのオープンソースフレームワーク

7月22日 — NVIDIA は、NVIDIA Isaac for Healthcare 内で、GPU 加速の医療物理シミュレーションフレームワークをオープンソースで公開しました。これは同種のものとしては初めてとされ、医療機器(カテーテル、ガイド)と患者の解剖学的構造との相互作用を、従来の物理シミュレーションと生成 AI(Cosmos-H Dreams)を組み合わせて扱います。8,192 環境を並列実行することで、ロボティクスのポリシー学習時間を 5 時間超から 2 分未満へ短縮したと NVIDIA は発表しています。CMR Surgical、Johnson & Johnson MedTech、XCath、Medtronic Structural Heart がすでに利用しており、現在 GitHub で入手可能です。

NVIDIA と Wistron がフォートワースにスーパー・チップ工場を開設

7月21日 — Wistron は、米国初の工場となるテキサス州フォートワースの 30,000 m² の拠点を開設しました。ここではすでに Grace Blackwell Ultra スーパー・チップを生産しており、将来的には Vera Rubin を製造する予定です。NVIDIA の米国内 AI プラットフォーム製造に向けた 5,000 億ドルの取り組みの一環として、7 億ドルを投資し、500 人超の雇用を創出(年末までに 1,000 人を目標)します。

Cosmos 3 Super、最大 25 倍の高速化

7月22日 — NVIDIA は Cosmos 3 系列の 4 ステップ版である Cosmos 3 Super を公開しました。これは元モデル比で画像と動画を最大 25 倍高速に生成しつつ、Artificial Analysis において高い順位を維持しています。画像→動画(音声なし)で 1 位、テキスト→画像で 2 位です。現在 Hugging Face で利用可能です。

Kaggle における Nemotron Model Reasoning Challenge の総括

7月22日 — NVIDIA は、Kaggle 上で行われた Nemotron Model Reasoning Challenge の総括を公開しました。オープンモデルの推論改善技術をめぐって、5,000 人超の参加者が 4,000 チーム超に分かれて参加しました。NullSira、vli、YS-L の各チームが上位 3 位を占めました。

🔗 医療シミュレーション — 🔗 Wistron 工場 — 🔗 Cosmos 3 Super — 🔗 Kaggle 総括


Kimi K3:AA-Briefcase で 2 位だが高コストかつ低速

7月21日 — Artificial Analysis は、Kimi K3(Moonshot AI)の AA-Briefcase における結果を公開しました。これはエージェント的な知識作業(スプレッドシート、プレゼンテーション、UI モックアップ)のベンチマークです。このモデルは、記録上 2 番目に高いスコアを獲得し、前世代から 700 点超の向上を示しました。

評価モデルAA-Briefcase Eloタスクあたり平均コストタスクあたり平均時間
Claude Fable 5 (max)1574
Kimi K3154310.57ドル56.4分
GPT-5.6 Sol (max)1501
Claude Sonnet 5 (max)1388
Claude Opus 4.8 (max)1347
Kimi K2.6 (参考値)816約1ドル

Kimi K3 は評価グリッドで 51 % の成功率を示し、Claude Fable 5(56 %)のすぐ後ろにつけました。分析品質は同等ですが、プレゼンテーション品質はやや劣ります。難点は、タスクあたり平均 10.57 ドルというコストで、これは Kimi K2.6 の約 10 倍です。これはモデル料金、出力トークンの多用、そしてタスクあたり平均 83 ラウンド(Claude Fable 5 は 67、GPT-5.6 Sol は 50)という結果によるものです。

🔗 X での発表


OpenAI:報道機関での利用と API の上限

報道機関は OpenAI ツールをどう使っているか

7月22日 — OpenAI は、報道機関による自社ツールの利用状況をまとめた概観を公開しました。Associated Press は、取材、検証(アップロード追跡、位置特定、画像や動画の時系列特定)、最高裁判所の数千件の記録を構造化情報へ変換する作業、記事を放送用スクリプトに変換する作業などに使用しており、判断の最終責任は記者が担っています。POLITICO は、より迅速なオリジナル報道のために大量の公開文書を分析しており、Axios も言及されています。OpenAI は American Journalism Project への支援を更新し、Lenfest Institute および WAN-IFRA とのパートナーシップも継続しています。

厳格な支出上限をすべての API アカウントへ拡大

7月22日 — OpenAI は今週、API Platform の全アカウントに厳格な支出上限(hard spend limits)へのアクセスを拡大します。これにより、各開発者はダッシュボードからリアルタイムの使用状況を追跡しながら、自分で選んだ金額まで消費を上限設定できます。

🔗 報道機関での利用 — 🔗 API 上限


Cohere:アラビア語のダイアクリティゼーションと軽量コードモデル

Speech Tashkeel 2B とコミュニティエコシステム Transcribe Arabic

7月22日 — Cohere は、Speech Tashkeel 2B を推します。これは NAMAA が開発したパートナーモデルで、素のアラビア語を完全にダイアクリティカルなテキスト(格語尾、ハラカート、タンウィーン、スクーン、シャッダ)に変換し、4 ビット量子化版も提供されています。発表は、Cohere のアラビア語音声認識モデルである Transcribe Arabic をめぐるコミュニティ貢献も伴っており、listen-habibi アプリ、Ruby ネイティブ対応、Hugging Face に公開された GGUF/ONNX 量子化版が含まれます。さらに Cohere は、この取り組みを他のリソース不足言語へ拡張するため HUMAIN との提携を発表しました。

North Mini Code、軽量で経済的なコードモデル

7月21日 — Cohere は North Mini Code を発表しました。これは、デバッグ、単体テスト作成などの反復的で複雑でないタスク向けに設計されたオープンソースのコードモデルで、大規模モデルの代替となる経済的な選択肢として、推論コストの削減を狙っています。

🔗 Speech Tashkeel 2B — 🔗 North Mini Code


速報

  • Warp が、急成長中の AI スタートアップの経済的な圧力に関する記事を公開 — 高成長スタートアップにおける今後の収益圧縮を分析。🔗 ソース
  • Hugging Face が東京で日本初のイベントを開催 — 大手町で、最近のツール群と日本市場向けの事業計画を紹介。🔗 ソース
  • Ai2 が PaperFinder の新バージョンを公開 — 常用ユーザーの研究者に高く評価された科学文献検索ツール。技術詳細は未公開。🔗 ソース
  • Sakana AI が Fugu の概要「One Model to Command Them All」を公開 — すでに取り上げた Fugu-Cyber 版を超えて、オーケストレーションモデルの射程を広げるブログ記事。🔗 ソース
  • Gemini Live — リアルタイム視覚支援のためのカメラガイド — 物や書類にカメラを向けるだけで、状況を文章で説明しなくても文脈に応じた支援を得られる。🔗 ソース
  • AlphaFold — ベース公開から 5 年を前にしたタンパク質工学での新たな応用 — Pushmeet Kohli(Google DeepMind)が、生物学における構造的な空白を埋める用途を称賛。🔗 ソース
  • Copilot 指標の影響ダッシュボードの新表示(Enterprise) — 採用コホート(Code-first、Agent-first、Multi-agent、Passive)と、ユーザーごとの速度およびマージ指標。🔗 ソース
  • Copilot Business/Enterprise — 請求サイクルごとの AI クレジット可視化 — 個別予算が割り当てられていなくても表示可能に。🔗 ソース
  • GHES — サポートバンドルのアップロードに対する今後の厳格化(2026年8月18日) — パッチ未適用インスタンスからのアップロードは拒否。3.21.3、3.20.5、3.19.9、3.18.12、または 3.17.18 への更新が必要。🔗 ソース
  • NVIDIA が Jetson Thor T2000 および T3000 モジュールを発表 — ロボティクスとエッジ AI 向けの新モジュール。現時点では詳細な仕様書は未公開。🔗 ソース
  • Cisco がコード内の脆弱性検出向け小型モデル Antares を発表 — Antares-350M と Antares-1B は Hugging Face で利用可能で、機密コードをクラウドに送らずにローカル実行できる。🔗 ソース
  • HeyGen HyperFrames — 30日中17日目:Storyboard フロー — カード、スケッチ、最終レンダリングの 3 パス計画と、フレームごとのコメントによるレビュー。🔗 ソース
  • Kling AI が、エージェントで映画的な演技を作るための MCP チュートリアルを公開 — エージェント内で完結する創作フロー:キャラクター、感情、バッチ動画生成。🔗 ソース
  • ある家族が ChatGPT を相談役にしてツリーハウスを建設 — 構造設計、材料選定、子どもたちのアイデアを実現可能な計画へ翻訳。🔗 ソース
  • Codex Live Build — ライブ構築セッション — Codex Micro キーボードの制作者たちとの配信。🔗 ソース
  • あるプレイヤーが Codex でイタリアのドロミテをゲーム内に再現 — 登山、滑空、動くロープウェイを備えたオープンワールド「Valdiluce」。🔗 ソース
  • ChatGPT Work のプロモーション — 100ドル分のクレジットを進呈 — X で ChatGPT Work の気に入っている点を投稿した先着 10,000 人に。🔗 ソース

それが意味すること

モデルのルーティングは、コードツール競争における新たな主戦場になりつつあります。Cursor Router は、リクエストごとに適切なモデルを自動選択することで、知覚できる品質の低下なしに 60 % のコスト削減を約束しています。一方で Artificial Analysis は、エージェント的な知識作業ベンチマークで 2 位となった Kimi K3 が、前世代より約 10 倍高価で、1 タスクあたり 1 時間近くかかることを示しています。両者のメッセージは同じです。モデルの生の性能だけでは、もはや利用理由として十分ではなく、コスト/品質/レイテンシのトレードオフこそが、大規模展開するチームの真の意思決定パラメータになっているのです。

企業向けエージェントは、明らかにデモ用途から本番用途へ移行しています。OpenAI Presence は、モデルの推論を取り巻くポリシー、ガードレール、人間へのエスカレーションを明示的に構造化します。Synthesia Roleplay Sessions は、実環境での具体的なスキル向上効果を数値化しています。GitHub Copilot Canvases は、エージェントが支払い画面まで自ら作業を検証し、手書きテストを置き換えた事例を記録しています。そして Claude Managed Agents は、本番環境で複雑なエージェントワークフローを想定した努力レベルと webhook を追加します。これらの発表は、エージェントを単にデモで有能に見せるだけでなく、長期にわたって信頼でき、制御可能にするという同じ要請へ収束しています。

制度面では、DOE の Genesis Mission が、Google、OpenAI、Arcee AI の 3 社による米国公共科学研究への参入競争がすでに始まっていることを示しています。それぞれに固有の論理があります。Google はトークンとクラウドクレジット、OpenAI は Codex と API へのアクセス、Arcee AI はガバナンスされたオープンモデルです。この制度的な動きは、物理インフラをめぐる競争とも重なっています。Project Camellia(ジョージア州で 3.2 ギガワット)や、Fort Worth の Wistron スーパー・チップ工場(7 億ドル、数百人規模の雇用)が示すように、計算能力と地域への定着が、数値化され詳細に公表される、独立したコミュニケーション上の論点になりつつあります。

最後に、マルチモーダル生成は上下両方向に多様化し続けています。Qwen-Image-3.0 はフロンティアモデルのリアリズムと業務用途を押し上げる一方で、Mage-Flow(Microsoft Asia、40 億パラメータ)と Cosmos 3 Super(NVIDIA、最大 25 倍高速)は、計算コストを抑えつつこれらの能力を利用可能にするため、コンパクトさと速度を重視しています。さらに、ウクライナにおける ElevenLabs/Obrii の事例は、こうした音声技術が商用用途を超えて、社会的インパクトの大きい公共サービスにも活用されていることを思い出させます。


ソース