ai-powered-markdown-translatorfr から ja に翻訳された記事、gpt-5.4-mini による。
2026年8月11日、Gemini アプリの月間ユーザー数は10億人を突破し、Google の歴史上最も急成長した製品となりました。NVIDIA は Nemotron 3.5 Lightning とルーティングライブラリ NeMo Switchyard を公開し、Mistral はサードパーティモデルにプラットフォームを開放して欧州の計算連合を結成し、Alibaba はオープンソースのアニメーションモデルを大幅に強化した Wan-Animate-2 を発表しました。さらに、ChatGPT 広告の5つの新市場への拡大、新しい開発者向けツール、そしてメディア生成に関する多数の発表もありました。
Gemini が月間ユーザー10億人を突破
Gemini アプリは、月間アクティブユーザー数が正式に10億人を超え、Google によると同社史上最速で成長した製品となりました。この発表は、公式アカウント @GeminiApp と、Google で Gemini および Labs チームを率いる Josh Woodward の双方によって共有されました。
Google は、この成長を支えた利用状況について数値を添えて発表しています。
| 測定された利用 | データ |
|---|---|
| 音声でのやり取り | ユーザーの63%が音声を利用 |
| Gemini Live セッション | 5人に1人がライブカメラまたは画面共有を利用 |
| 学校関連の依頼 | 38%に添付ファイル(ファイル)が含まれる |
| 画像生成 | 1日あたり150万枚以上の画像を生成 |
| Android 自動化 | 40以上のアプリケーションで自動化アクションを実行 |
| iOS ユーザー | Apple デバイス上で100万人以上のアクティブユーザー |
これらの数字は、テキストチャットだけにとどまらない利用の多様化を示しています。音声、カメラ、画面共有、マルチメディア生成、アプリ間自動化(レストラン予約、配車サービスの注文)が、導入拡大の重要な推進力となっているようです。
🚀One billion for Gemini! Our goal remains to make it the most personal, proactive, and powerful assistant.
🇯🇵 🚀 Gemini が10億人に到達! 私たちの目標は、これを最も個人的で、先回りして支援し、強力なアシスタントにすることです。 — @GeminiApp の X
NVIDIA が大規模エージェント向けに Nemotron 3.5 Lightning と NeMo Switchyard を発表
NVIDIA は、オープンモデル Nemotron 3 ファミリーを Nemotron 3.5 Lightning で拡張しました。これは、ツール呼び出し、結果検証、タスク委譲といった大規模なエージェント系タスクの実行向けに設計された、300億パラメータ(有効30億)のハイブリッド MoE で、複雑な推論よりも処理量の多い実行を重視しています。NVFP4 と BF16 で提供され、最大100万トークンのコンテキストを備え、同等クラスのモデル比で最大4倍の出力スループットと、タスク完了時間30%短縮を主張しています。PinchBench では、10,000タスクを完了しながら86%の精度を達成し、同等精度の Qwen3.6 35B より35%高速でした。
このモデルは、重み、学習データ、レシピとともに配布され、Hugging Face、ModelScope、OpenRouter、build.nvidia.com で利用可能です。Together AI は初日からのローンチパートナー(day-0)であり、大規模なエージェント系ワークロード向けに Dedicated Model Inference による予約済みキャパシティを提供します。
並行して NVIDIA は、各リクエストを最適なモデル(品質、レイテンシ、コスト)へ再実装なしで振り分けるオープンソースライブラリ NeMo Switchyard を公開しました。これにより、フロンティアモデルは複雑な推論に、Lightning は専用実行に割り当てられます。NVIDIA は、タスク完了コストを Opus 4.8 単体の約3分の1まで下げられるとしています。具体的なパートナーとしては、Boomi がトラフィックの59%をより高速なファインチューニング済みモデルに振り分け、Cognition は平均コストを28%削減し、Ramp はモデルとルーティングを組み合わせてコストを59%、実行時間を32%削減したとされています。
Alibaba が Wan-Animate-2 を公開、オープンソースのキャラクターアニメーションを大幅強化
Alibaba(Wan チーム)は、オープンソースのキャラクターアニメーションモデルを大幅に強化したものとして Wan-Animate-2 を公開しました。強調されているのは4つの能力です。人間、アニメ、ロボット、動物をまたいで動きと微表情を忠実に再現する高忠実度アニメーション。同一シーン内で各キャラクターが固有のアイデンティティと動きを保つマルチキャラクターアニメーション。元動画から切り離されたテキスト駆動のカメラ制御(たとえば「俯瞰」)。そして、誤差の蓄積が目立たないまま chunk ごとに任意長のシーケンスを生成するリアルタイムストリーミング生成です。
技術面では、Alibaba は明示的なポーズスケルトンをやめ、参照動画そのものを動きの事前知識として採用しています。アーキテクチャは Dual-Branch DiT(Diffusion Transformer)、Time-Align RoPE 時間エンコーディング、そして計算量を品質低下なしに抑える Sparse-Ref Attention を採用しています。カメラ制御は、約5万件の Unreal Engine マルチビューサンプルで学習した LoRA に依存しています。
このモデルはオープンソースで、現在 ModelScope、Hugging Face、GitHub で利用可能で、オンラインデモもあります。NVIDIA の8月の「Local AI」キャンペーンによると、14億パラメータのこのモデルは、RTX システム上で代替手法より16〜26倍高速に生成できるとされており、一般向けハードウェアでのローカル展開に最適化されていることが確認できます。
Mistral が地域別推論を開始し、GLM-5.2 にプラットフォームを開放し、欧州の計算連合を結成
Mistral は、地域を選べる推論とサービス保証を両立する、唯一の欧州AI研究所としての立ち位置を打ち出しています。同社はすでに OpenAI、Google、中国勢との価格・技術競争に参加していますが、ここではベンチマーク競争そのものよりも、主権性とサービスの予測可能性という異なる軸を前面に出しています。プラットフォーム面での新機能は2つです。
| 機能 | 状態 | 説明 |
|---|---|---|
| Mistral Regional Endpoints | 利用可能 | 推論実行先として欧州または米国を選択可能 |
| Mistral Priority Tier | 公開プレビュー | 稼働率 SLA とカスタムのスループット上限 |
もう1つ注目すべき点は、Mistral のプラットフォームがサードパーティモデルに開放されたことです。最初の対象は Z.ai の GLM-5.2 で、Mistral モデルと同じ地域制御とサービス条件を利用できます。これは、これまで低価格なオープンモデル分野で直接競合してきた両社の間で、初めての収束を示しています。
さらに Mistral は European Compute Units(ECU) を開始しました。これは、企業の複数年契約を同社の計算インフラへのアクセスに変換する仕組みで、2030年までに1 GW の容量 を目標としています。これは大都市が消費する電力に相当します。発表された創設パートナーは、ASML(Christophe Fouquet, CEO)、CMA CGM(Rodolphe Saadé, Chairman および CEO)、Amadeus(Luis Maroto, CEO)、Caisse des Dépôts(Olivier Sichel, CEO)で、産業、輸送、公共金融が混ざった構成は、米国のハイパースケーラーに依存しない欧州の計算産業を構築するという野心を示しています。
OpenAI が英国、メキシコ、ブラジル、日本、韓国で ChatGPT 広告を開始
OpenAI は、ChatGPT 内での広告展開に新たな段階を踏み出しました。2026年2月に米国で Free と Go 向けのテストとして開始され、3月にはカナダ、オーストラリア、ニュージーランドへ拡大された広告プログラムが、今では英国、メキシコ、ブラジル、日本、韓国の5つの新市場で正式に開始されています。Plus、Pro、Business、Enterprise、Education の各プランは引き続き広告なしで、年内にはさらに他の市場も対象となる予定です。
基本原則は変わっていません。広告が ChatGPT の応答に影響を与えることはなく、スポンサー付きであることが明確に表示され、オーガニックな応答とは視覚的に分離されます。ターゲティングは、現在の会話トピックと過去の広告インタラクション履歴に基づきますが、広告主が会話内容や個人データにアクセスすることはありません。提供されるのは集計統計(表示回数、クリック数)のみです。
ユーザー制御の面では、ChatGPT は広告を非表示にする、なぜ表示されたかを確認する、広告データをワンタップで削除する、いつでもパーソナライズを管理することができます。未成年と判定された、またはその可能性があるアカウントや、健康、メンタルヘルス、政治といったセンシティブな話題の近くには広告は表示されません。OpenAI によると、このパイロットではユーザーの信頼への測定可能な影響は見られず、それが今回の段階的拡大の理由になったとのことです。
オープンソースと推論のエコシステム
webAI Intelligence Lab が TwiL-LM3 を公開、GPT-OSS-120B を上回る 3B 推論モデル
webAI Intelligence Lab(オースティン)は、オープンソースで最初の形式推論モデル TwiL-LM3 を公開しました。パラメータはわずか30億ですが、テストされた5つの形式推論ベンチマークのうち4つで OpenAI の GPT-OSS-120B を上回ると主張しており、約40分の1のパラメータで、推論速度は2.6倍高速です。自動収集したウェブコンテンツではなく、検証済みの独自データで学習しており、エッジコンピューティング(edge)を対象としています。Raspberry Pi から iPhone まで、クラウドに依存せず動作できるとされています。
🔗 公式ツイート
Meta が Muse Spark 1.2 の重み公開版を準備
Muse Glimmer の発表スレッドで、Alexandr Wang(Meta Superintelligence Labs)は、Meta が近く Muse Spark 1.2 の重み公開版をリリースすると述べています。これまでは、ターミナル用コードエージェント Muse Code を動かしていたプロプライエタリモデルです。具体的な日付は示されていませんが、この発表は、Meta が Muse 系全体でより多くの重み公開へと舵を切っていることを示しており、Apache 2.0 ライセンスで Muse Glimmer の重みを即時公開した流れの延長にあります。
🔗 公式ツイート
Zuckerberg が Meta の AI 哲学について文章を公開
同日、Mark Zuckerberg は「誰もが superintelligence にアクセスできるべきだ」と述べ、より良い AI の未来を築くための Meta の哲学と価値観を詳しく説明する文章を公開しました。このメッセージは Muse Glimmer の発表に合わせて出され、重みの公開を単なるマーケティング上の主張ではなく基本方針として位置づけており、その週の Meta による重み公開戦略に関するより広いコミュニケーションの一部となっています。
🔗 公式ツイート
Lightricks が LTX-2.5 を発表、オープン world model を大幅アップデート
Lightricks は、映画、ロボティクス、リアルタイムワークフローですでに使われている「world model」の新バージョン LTX-2.5 を公開しました。このアップデートは、より高いピクセル忠実度、カットをまたいでも一貫性を保つマルチプレーンシーン、そして新しい Diffusion Fidelity Rendering によりさまざまな分野に合わせて fine-tune しやすいよう設計された事前学習基盤を約束しています。チームは LTX-2.5 を、貸与されるツールではなくオープンな基盤として提示しています。
🔗 公式ツイート
IBM Research が ALTK-Evolve を公開、ACE よりトークン消費の少ないエージェント記憶
IBM Research は、再学習なしで過去の失敗からエージェント AI が学習できるようにするシステム ALTK-Evolve を公開しました。これは、モデルの能力に応じて再投入する指示量を調整する仕組みで、各ステップで「playbook」全体を渡す ACE(Agentic Context Engineering)とは対照的です。AppWorld ベンチマークで DeepSeek-V3.2 を使った場合、ALTK-Evolve は1タスクあたり263K tokens で89.3%のタスク完了率を達成し、ACE の80.4%および634K tokens を上回りました。gpt-oss-120b では、ACE の推論コストの約40%で同等以上の精度を実現しています。
Together AI、IBM、NVIDIA が IBM Cloud 上の企業向け推論で提携
Together AI は、IBM および NVIDIA と提携し、Spectrum-X ネットワークを備えた NVIDIA B300 GPU の専用クラスタを通じて、IBM Cloud 上に企業向けの AI 推論を提供すると発表しました。これは、このプラットフォーム上では初の試みであり、Together AI の本番推論プラットフォームによって支えられています。この提供は、別のクラウド事業者へ移行せずに AI ワークロードを展開したい既存の IBM Cloud 顧客を対象としています。
🔗 公式ツイート
開発者向けツール:Amp、Replit、GitHub Copilot、Manus
Amp が orb 向けのグローバルなプラグインとスキルを開始
Amp(Sourcegraph)は、Amp が動作するすべての場所、特に orb で利用できる、Amp 管理のプラグインとスキルの集中管理システムを導入しました。2つのレベルが共存しています。1つは個人用で、同じ会話スレッド内での live reloading を備えた実験用サンドボックス。もう1つはワークスペースで、管理者が管理し、チーム全体にデフォルトで読み込まれます。個人用の要素はワークスペースへ共有でき、バージョン管理はネイティブに処理されます(最新バージョンへの更新、古いスキルの検出)。
Replit MCP ベータ:MCP 経由でアプリを作成、読み込み、検索、公開
Replit は、MCP(Model Context Protocol)ベータを強化し、新たにアプリを MCP 経由で直接作成、読み込み、検索、公開できるようにしました。Web インターフェースを介さずに済みます。狙いは、Replit の Web 画面に閉じず、互換性のある任意の MCP クライアント——エディタ、自律エージェント、サードパーティツール——から実際のソフトウェアを Replit 上で構築できるようにすることです。この拡張は、Replit が自社プラットフォームをエージェントワークフロー向けのプログラマブルな部品として公開する戦略を裏づけています。
🔗 公式ツイート
MAI-Code-1.1-Flash が GitHub Copilot に登場、MAI-Code-1-Flash は廃止予定
Microsoft の最新のコンパクトなコードモデル MAI-Code-1.1-Flash が、ネイティブなビジョンサポート、コード品質の向上、指示追従、ツール利用の改善を備えて GitHub Copilot に展開されます。これは MAI-Code-1-Flash より 73 % 安く、年額契約者向けのプレミアムリクエスト倍率は 0.25× です。Free と Student では自動選択され、Pro、Pro+、Max、Business、Enterprise では手動選択が可能です。あわせて GitHub は MAI-Code-1-Flash を 2026 年 9 月 10 日に廃止予定 と発表しています。
Manus が再び独立企業になる
Manus は、再び独立企業になることを発表しました。特定の法域の規制要件に対応するため、一部のユーザーは 2026 年 8 月 23 日(シンガポール時間 7:59)までにデータを保存し、その後 2026 年 8 月 25 日(シンガポール時間 8:00)から復元を開始する必要があります。対象ユーザーにはメールとアプリ内通知で案内が届きます。移行期間中の課金は予定されておらず、歓迎ボーナスも用意されています。
🔗 公式ツイート
メディア生成: Wan CLI、Motif 3、Luma Scenes、800 VDC 電源
Wan CLI: Alibaba がエージェントから Wan を直接操作可能に
Alibaba は Wan CLI を公開しました。これは、エージェントから Wan プラットフォームを直接呼び出して、画像や動画をプログラム的に生成できる新しいコマンドラインツールです。消費されるクレジットはユーザーの Wan Video アカウントと完全に同期したままで、Web インターフェースと自動化利用の間で二重に請求管理する必要がありません。インストールは、Wan パネルから取得したコマンドをエージェントに貼り付けるだけで完了し、導入用の動画チュートリアルも提供されています。
🔗 公式ツイート
Motif 3: NVIDIA B200 GPU で学習された初の韓国フロンティアモデル
韓国のスタートアップ Motif Technologies は、韓国科学省の支援を受け、NVIDIA B200 GPU で学習した、フロンティア LLM 競争に挑む最初のモデルである Motif 3 Base と Motif 3 を発表しました。Motif 3 は、NVIDIA NeMo-RL を用いた事後学習によって Motif 3 Base を基盤に構築されています。NVIDIA との協業により、チームは NVFP4 版(NVIDIA 最適化の低精度)も公開しています。全体は技術レポートとともに Hugging Face で利用可能になる予定で、NVIDIA はこの発表を韓国の AI エコシステムの勢いを示す例として称賛しました。
🔗 公式ツイート
Luma Scenes: Uni-1 搭載のシーン単位動画制作
Luma AI は Luma Scenes を発表しました。これは、最終レンダリングの前に各シーンを個別に調整し、タイミングを合わせ、検証できるツールであり、多数のバリエーションを作ってから実用的な 1 本だけを選ぶという典型的な問題に応え、1 シーンの失敗が制作全体を台無しにするリスクを減らします。このツールは Luma Layers(レイヤー単位編集、7 月下旬)を拡張するもので、ワンクリック生成よりもきめ細かな制御へ向かう Luma の方向性を裏付けており、従来の編集に近いワークフローを実現します。
🔗 公式ツイート
Ideogram Ad Resizer: 1 つのデザインであらゆる広告フォーマットに対応
Ideogram は Ad Resizer を発表しました。単一のデザインと対象となる広告枠をもとに、ツールがキャンペーン用の完全なフォーマットセット(Instagram、Facebook、YouTube、コネクテッドテレビ、屋外広告、印刷物)を自動生成し、手動ではトリミングが難しい極端な比率にも対応します。アプリと API ですぐに利用でき、自動化された広告制作パイプラインへの組み込みが可能です。マルチチャネルのクリエイティブチームにとって、実用的なマーケティング用途です。
🔗 公式ツイート
HeyGen for Real Estate: 不動産エージェント向け 3 形式の動画で正式リリース
HeyGen は HeyGen for Real Estate を正式にリリースしました。これは、カメラも編集も使わずに自分自身を画面に登場させたい不動産エージェント向けに設計された 3 つの動画フォーマットを備えています。目的は、この業界に求められる視覚的存在感を犠牲にせずに、1 日に何度も投稿できるようにすることです。特典として、発表後 12 時間以内に Creator プランへ登録した人は、White Glove アクセスを 30 日間無料で受けられます(米国のみ)。HeyGen は、不動産以外の他の中小企業への拡張の可能性にも言及しています。
🔗 公式ツイート
NVIDIA が将来の「AI factories」向け 800 VDC 電源アーキテクチャを詳説
NVIDIA は Google および Microsoft とともに、Open Compute Project を通じて 800 ボルト直流の電源アーキテクチャを詳説しました。これは、電力網から GPU までの電力変換ステップを減らし、将来世代のアクセラレータの計算密度を支えるためのものです。すでに 80 社以上のメーカーが対応製品の開発に取り組んでいます。展開は段階的で、第 2 四半期 2026 年にハイブリッド型「Power Rack」アーキテクチャ、2027 年に「Row Power Center」、その後の 10 年で 800 VDC ネイティブ設備へと進みます。
Qwen、Z.ai、OpenAI: 新モデルとエージェント同期
Qwen3.8-27B: 今週、オープンウェイトを公開予定
Alibaba Qwen は、Qwen3.8-27B のオープンウェイトが今週公開されることを確認しました。これは、すでに 8 月初旬に紹介された旗艦モデル Qwen3.8-Max に続く、Qwen3.8 ファミリーの新しいサイズです。チームはこの新モデルを、エージェント的コーディングにおいて Qwen3.6-27B を上回ると位置づけており、この中間サイズを数週間待ち望んでいた開発者コミュニティからすでに好意的に受け止められています。
🔗 公式ツイート
Z.ai: ZCode のユーザー数が 100 万人に到達、GLM Coding Plan の上限をリセット
Z.ai は、GLM モデルを基盤とするコーディングツール ZCode のユーザー数が 100 万人を超えたと発表しました。これを受けて同社は、GLM Coding Plan のすべての加入者について利用上限をリセットし、長期的な推論能力を実際に完了した作業へとよりよく変換できるようにする更新を展開しました。キャッシュ成功率は 98 % で、加入者はおよそ 1.8 倍多く利用 できます。
🔗 公式ツイート
Codex を備えた ChatGPT デスクトップアプリ、Linux のプレビュー版が利用可能に
OpenAI は、これまで macOS と Windows に限定されていたデスクトップアプリを Linux に拡張しました。プレビュー版は Ubuntu 24.04/26.04 LTS、Debian 13、Fedora 43/44 という 4 つの主要ディストリビューションを対象とし、x64 と ARM64 向けの .deb/.rpm パッケージを提供します。アプリは ChatGPT、ChatGPT Work、Codex を 1 つのネイティブインターフェースにまとめ、対応ブラウザのプロジェクトやワークフローにアクセスでき、作業環境を切り替える必要がありません。
🔗 公式ツイート
Codex と ChatGPT Work が他の AI エージェントの作業を取り込めるように
ChatGPT Work と Codex に新機能が追加されました。他の AI エージェントで行った既存の作業を OpenAI のエコシステムと同期したまま保持できます。具体的には、ユーザーはプロジェクト、会話、スキル、プラグインをインポートし、インポート履歴を確認し、設定で自動同期を有効にできます。現在は ChatGPT デスクトップアプリで利用可能で、まったく新しい構成でゼロからやり直すのではなく、ツール変更の摩擦を減らすことを目的としています。
🔗 公式ツイート
速報
- Fable の請求バグが解決、196 件の返金 — Anthropic は、誤って超過分を表示していた設定キャッシュのバグが完全に解決されたと確認しました。196 人のユーザーに返金と補償クレジットが付与されました。 🔗 ツイート
- v0(Vercel)がサイドバーを刷新 — プロジェクトごとの会話のグループ化、リアルタイムのステータス表示、ホバー時のプレビューカード。 🔗 ツイート
- Amp が orb のディスク容量を 60 Go に拡大 — 以前は 40 Go でしたが、新しい orb に追加料金はかかりません。 🔗 ツイート
- DeepSeek V4 Flash 0731 が Together AI で fine-tuning 可能に — SFT または DPO による特化の後、本番へ展開できます。 🔗 ツイート
- Together AI が専用推論の autoscaling に関する第 2 弾を詳説 — 同じ負荷で 3 つのポリシーを試したところ、実際に適応したのは 1 つだけでした。 🔗 ツイート
- Hugging Face が Open Model Series を開始 — オープンモデルとローカル利用に関する新しい教育動画シリーズです。 🔗 ツイート
- FC バルセロナが Google Pixel / Gemini パートナーシップに参加 — バイエルン・ミュンヘンとの類似の提携に続く、クラブの新しい公式パートナーです。 🔗 ツイート
- Copilot の利用レポート: モデル別トークンの詳細 — 消費された AI クレジットの裏側で、入力、出力、キャッシュのトークンが表示されるようになりました。 🔗 Changelog
- GitHub が Copilot の Rubber Duck エージェントを紹介 — ジュニア開発者のスキルに関するキャリア記事の中で、生成されたコードを批評するために 2 つ目のモデルを使用します。 🔗 ツイート
- Perplexity Computer: GitHub コネクタが最も使用されている — その大半は非開発者です(5 人中 4 人)。 🔗 ツイート
- Suno Studio 2.0(予告) — Suno の音楽制作環境の新バージョンで、追加の詳細はありません。 🔗 ツイート
- ニューヨークで 11 月 11 日に ElevenLabs Summit 開催 — テックおよびビジネスのリーダーが集まる 1 日イベント。応募受付中です。 🔗 ツイート
- FLUX 3 Video が世界第 2 位を維持 — Black Forest Labs は playground の無料アクセスを 8 月 16 日まで延長し、4K と動画編集を予告しました。 🔗 ツイート
- Runway の Seedance 2.5 に 50 の人物参照が追加 — さらに、音楽トラックに同期したクリップも。 🔗 ツイート
- P-Image-Ideogram が Runway で利用可能に — 0.6 秒という短時間で 1 枚の画像を生成でき、4 つの品質モードがあります。 🔗 ツイート
- Kimi K3 が Databricks で利用可能に — Moonshot AI のモデル向けの新しい配信チャネルです。 🔗 ツイート
- Zapier が ChatGPT Work でマーケティングを変革 — リードファネルでの離脱を削減し、自動化レポーティングを実現。 🔗 OpenAI
- Virgin Atlantic が ChatGPT Work で顧客導線を最適化 — 製品リサーチと企画が高速化しました。 🔗 OpenAI
- Cohere — Aidan Gomez がオープンソースと主権戦略を詳説 — カスタマイズ可能で、手頃で、安全なモデルを主軸に据えています。 🔗 ツイート
それが意味すること
一般向け AI の利用規模は、別の段階に入っています。月間 10 億人のユーザーを抱える Gemini は、テキストチャットをはるかに超える利用(音声、カメラ、自動化)に支えられ、Google の最も巨大な製品群のごく限られた仲間入りを果たしました。これと対照的に、OpenAI は ChatGPT の広告を 5 つの新市場に拡大しました。これは、会話型アシスタントの大規模な収益化が、ユーザー基盤が十分に大きく忠実になった段階で戦略上の優先事項になっていることを示しています。
インフラ面では、この日は、フロンティア推論だけでなく、特化したエージェント実行への移行を示しています。NVIDIA は Nemotron 3.5 Lightning と NeMo Switchyard により明確な経済モデルを提示しました。複雑な計画には高価なモデルを使い、実行量の多い処理はより軽量で安価なモデルに委ねるというもので、複数のパートナーでコスト削減効果が測定されています。IBM Research(ALTK-Evolve)と Together AI(autoscaling、IBM Cloud との提携)は推論の経済性という同じ流れを深めており、その一方で Mistral は European Compute Units と地域推論を通じて自らの主権確保の取り組みを構造化しています。
重みの公開は、より多くの主体と新しいモダリティへと広がり続けています。Alibaba の Wan-Animate-2、webAI の TwiL-LM3、今後登場する Qwen3.8-27B、Alexandr Wang が示した Meta の Muse Spark 1.2 の約束、そして NVIDIA 技術スタック上に構築された韓国初のフロンティアモデル Motif 3 まであります。この地理的・モダリティ的な多様化――テキスト、アニメーション、組み込み推論――は、オープンソースがもはや一部の西側研究所だけの専売特許ではないことを示しています。
最後に、開発者向けのエージェントツールは引き続きプロフェッショナル化しています。Amp と Replit は管理層(グローバルプラグイン、拡張 MCP)を追加し、GitHub は低コストモデルの提供を強化し、OpenAI は Codex と ChatGPT Work が他所で行った作業を取り込めるようにすることで、競合エコシステム間に明示的な橋を架けています。複数の AI エージェントを並行して使い分ける開発者が増える中、囲い込みよりも可搬性を重視する賭けです。
ソース
- Gemini — 10 億人のユーザー
- Gemini — X での発表
- NVIDIA — Nemotron 3.5 Lightning と NeMo Switchyard
- Alibaba Wan — Wan-Animate-2
- NVIDIA — Local AI の数値(Wan-Animate-2)
- Mistral — 地域推論、GLM-5.2、計算連合
- OpenAI — ChatGPT 広告
- webAI — TwiL-LM3
- Meta — Muse Spark 1.2(Alexandr Wang)
- Zuckerberg — Meta の AI 哲学
- IBM Research — ALTK-Evolve
- Together AI、IBM、NVIDIA — IBM Cloud 推論
- Amp — グローバルプラグインとスキル
- Replit — MCP ベータ
- GitHub — MAI-Code-1.1-Flash
- Manus — 独立企業
- Alibaba Wan — Wan CLI
- Motif Technologies — Motif 3
- Luma AI — Luma Scenes
- Ideogram — Ad Resizer
- HeyGen — for Real Estate
- NVIDIA — 800 VDC アーキテクチャ
- Alibaba Qwen — Qwen3.8-27B
- Z.ai — ZCode 100 万ユーザー
- OpenAI — ChatGPT デスクトップアプリ Linux
- OpenAI — Codex/ChatGPT Work へのエージェントの取り込み
- Anthropic — Fable の請求バグ解決
- v0 — サイドバーの刷新
- Amp — orbs を 60 Go に
- Together AI — DeepSeek V4 Flash 0731 fine-tuning
- Together AI — 専用推論の autoscaling
- Hugging Face — Open Model Series
- FC バルセロナ — Google Pixel / Gemini パートナーシップ
- GitHub — モデル別 Copilot 利用レポート
- GitHub — Rubber Duck エージェント
- Perplexity Computer — GitHub コネクタ
- Suno — Suno Studio 2.0
- ElevenLabs — ニューヨーク Summit
- Black Forest Labs — FLUX 3 Video
- Runway — Seedance 2.5
- Runway — P-Image-Ideogram
- Kimi Moonshot — Databricks 上の K3
- OpenAI — Zapier
- OpenAI — Virgin Atlantic
- Cohere — オープンソースと主権戦略