ai-powered-markdown-translatorgpt-5.4-मिनी के साथ फ्र से hi में अनुवादित लेख।
12 अगस्त 2026 को, NVIDIA ने अगले दशक की AI इंफ्रास्ट्रक्चर बनाने के लिए 500 अरब डॉलर से अधिक की वित्तपोषण साझेदारियों की घोषणा की, जबकि Alibaba ने Qwen3.8-2.4T-A95B के ओपन वेट्स प्रकाशित किए, जो 2,400 अरब पैरामीटर वाला उसका रीजनिंग मॉडल है। Zed ने एजेंट्स के साथ कोड करने के लिए एक मल्टीप्लेयर वातावरण Delta पेश किया, Google DeepMind ने Pixel 11 पर सांकेतिक भाषा को टेक्स्ट में अनुवाद करने के लिए SL2T लॉन्च किया, और Suno ने BMG के साथ एक वैश्विक साझेदारी की। इसके अलावा भी बहुत कुछ है: Cohere और Liquid AI में नए ओपन मॉडल, डेवलपमेंट टूल्स की तरफ प्रगति (Devin, Replit, GitHub Copilot) और एंटरप्राइज़ में AI एजेंटिक के अपनाने पर OpenAI का एक अध्ययन।
NVIDIA AI इंफ्रास्ट्रक्चर के लिए 500 अरब डॉलर से अधिक जुटाता है
12 अगस्त — NVIDIA ने वित्त और निवेश के छह बड़े खिलाड़ियों — Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs और KKR — के साथ साझेदारियों की घोषणा की है, ताकि 500 अरब डॉलर से अधिक तीसरे-पक्ष पूंजी जुटाने के लिए समर्पित स्वतंत्र वित्तपोषण प्लेटफ़ॉर्म स्थापित किए जा सकें। लक्ष्य: AI मॉडल्स के प्रशिक्षण और inference के लिए समर्पित विशाल datacenters, यानी « AI factories », के निर्माण को लंबे समय तक समर्थन देना।
NVIDIA इस कदम को उद्योग के लिए एक संरचनात्मक मोड़ के रूप में प्रस्तुत करता है: AI compute क्षमता के तैनाती का वित्तपोषण अब केवल स्वयं टेक कंपनियों की बैलेंस शीट पर निर्भर नहीं रहेगा, बल्कि अब समर्पित वित्तीय साधनों पर आधारित होगा, जिन्हें अकेले सेक्टर की बड़ी कंपनियों के बजाय अग्रणी वित्तीय संस्थान संचालित करेंगे।
यह घोषणा NVIDIA की इंफ्रास्ट्रक्चर संबंधी अन्य पहलों की निरंतरता में आती है, जिनका विस्तार हाल के दिनों में किया गया था: भविष्य की पीढ़ी के accelerators के लिए 800 वोल्ट DC power architecture, और संयुक्त राज्य अमेरिका में AI के लिए समर्पित NSF regional hubs कार्यक्रम। यह compute मांग को समर्थन देने के लिए capital की जरूरतों के पैमाने की पुष्टि करती है, ऐसे समय में जब सभी प्रमुख cloud providers के बीच AI infrastructure की दौड़ तेज़ हो रही है।
Alibaba ने Qwen3.8-2.4T-A95B के ओपन वेट्स जारी किए, 2,400 अरब पैरामीटर वाला रीजनिंग मॉडल
12 अगस्त — Alibaba ने Qwen3.8-2.4T-A95B के ओपन वेट्स प्रकाशित किए, जो अगस्त की शुरुआत में Qwen3.8-Max नाम से घोषित किया गया प्रमुख मॉडल था। यहाँ वास्तविक वेट रिलीज़ है: एक fine-grained Mixture-of-Experts मॉडल, जिसमें कुल 2,400 अरब पैरामीटर हैं, जिनमें से 95 अरब token प्रति सक्रिय होते हैं, और जिसे माँग वाले रीजनिंग तथा agentic workloads के लिए डिज़ाइन किया गया है।
इस architecture में पूर्ण attention और linear attention परतें बारी-बारी से आती हैं: पहली token-to-token interaction सुनिश्चित करती हैं, जबकि दूसरी परतें context बढ़ने के साथ memory को नियंत्रित रखने के लिए सीमित recurrent state पर आधारित हैं। मॉडल 1 million tokens तक की context window, 128K tokens तक की output length, और लागत और उत्तर-गुणवत्ता के बीच कार्य के अनुसार संतुलन बनाने के लिए configurable reasoning depth control (low/high/xhigh) का समर्थन करता है।
NVIDIA, जो एक समर्पित technical blog में deployment का विवरण देता है, बताता है कि GB300 NVL72 (72 Blackwell Ultra GPU) पर FP8 precision में native throughput 4,000 tokens प्रति second प्रति GPU से अधिक है, और NVFP4 optimizations आगे आने वाली हैं।
| मापा गया संकेतक | मापी गई मान |
|---|---|
| कुल / सक्रिय पैरामीटर | 2,400 अरब / 95 अरब |
| संदर्भ विंडो | 1 million tokens तक |
| प्रति GPU throughput | 4,000 tokens/s से अधिक (GB300 NVL72, FP8) |
| प्रति उपयोगकर्ता throughput | 350 tokens/s से अधिक |
| वेट्स की उपलब्धता | Hugging Face, ModelScope |
वेट्स Hugging Face और ModelScope पर उपलब्ध हैं, और deployment SGLang, vLLM, NVIDIA Dynamo तथा NVIDIA NIM द्वारा समर्थित है; fine-tuning NVIDIA NeMo AutoModel (LoRA और SFT) के माध्यम से संभव है।
🔗 X पर NVIDIA की घोषणा · NVIDIA की तकनीकी पोस्ट
Zed ने Delta लॉन्च किया, agents के साथ कोड करने के लिए मल्टीप्लेयर वातावरण
12 अगस्त — Zed ने Delta पेश किया, जो agents के साथ कोड करने और उनके आउटपुट की समीक्षा करने के लिए एक मल्टीप्लेयर वातावरण है। यह उत्पाद DeltaDB पर आधारित है, जिसे जुलाई की शुरुआत में « कोड के लिए Google Docs » नाम से early access में प्रस्तुत किया गया था। Delta इसका पहला वास्तविक उपयोग है, जिसमें 12 अगस्त से private beta के लिए पहली आमंत्रणें भेजी गईं।
Delta में agent के साथ बातचीत स्वयं एक document बन जाती है: cursor पूरे thread में कहीं भी काम करता है, और वही keyboard shortcuts उपयोग करता है जो code editor में होते हैं। किसी विशिष्ट बिंदु पर जवाब देने के लिए, बस उस पर cursor रखें और लिखना शुरू करें, बिना इस डर के कि thread में कुछ पहुँच से बाहर होगा।
Review उसी जगह होती है जहाँ काम हुआ था: जिस agent ने code लिखा, वह thread में मौजूद रहता है, इसलिए आप उससे सीधे प्रश्न पूछ सकते हैं, बजाय diff से उसकी मंशा फिर से बनाने के। एक thread एक क्लिक में साझा किया जा सकता है, और teammates पूर्ण भागीदारों की तरह उसमें शामिल हो सकते हैं — वे इतिहास देख सकते हैं, prompts को co-edit कर सकते हैं, या कई दिन बाद भी काम फिर से उठा सकते हैं, बिना यह सोचे कि आख़िरी code commit हुआ था या नहीं।
Delta is built on DeltaDB, which keeps your code and conversation in sync for everyone in the thread, in real-time. It works with the git repo you already have. Every edit and conversation is captured between your commits.
🇮🇳 Delta DeltaDB पर आधारित है, जो thread में सभी के लिए code और conversation को real time में synchronized रखता है। यह आपके पास पहले से मौजूद git repository के साथ काम करता है। हर edit और हर बातचीत आपके commits के बीच कैप्चर होती है। — @zeddotdev on X
Zed आने वाले हफ्तों में आमंत्रणों का विस्तार धीरे-धीरे करेगा; waitlist के लिए registration खुला है।
SL2T: Google DeepMind Pixel 11 पर सांकेतिक भाषा को टेक्स्ट में अनुवाद करता है
12 अगस्त — Google DeepMind SL2T (sign-language-to-text) प्रस्तुत करता है, एक मॉडल जो सांकेतिक भाषा को सीधे लिखित text में बदलता है। यह सुविधा Android पर आती है: उपयोगकर्ता अब web search, संदेश लिखने, या Gemini को भेजी जाने वाली queries के लिए टाइप करने के बजाय सीधे Gboard और Live Transcribe में साइन कर सकते हैं।
तकनीकी रूप से, यह प्रणाली on-device चलने वाले MediaPipe Holistic model पर आधारित है, जो कच्ची video रिकॉर्ड करने के बजाय शरीर की अवस्थाएँ (हाथ, भुजाएँ, धड़, सिर, चेहरा) ट्रैक करता है — मूल video तुरंत हटा दी जाती है, और केवल pose के geometric coordinates अनुवाद के लिए servers को भेजे जाते हैं। यह विकल्प privacy की रक्षा करता है और साथ ही coordinates से सीधे text में अनुवाद संभव बनाता है, बिना मध्यवर्ती annotations के, जो अब तक मौजूदा प्रणालियों की सटीकता सीमित करते थे।
मॉडल को 100,000 से अधिक घंटे के डेटा पर प्रशिक्षित किया गया, जिसमें 50 से अधिक सांकेतिक भाषाएँ शामिल हैं, और इनमें लगभग 25% American Sign Language (ASL) में है। FLEURS-ASL benchmark पर, SL2T 70 BLEURT का zero-shot score हासिल करता है, जिसे Google DeepMind पहले रिपोर्ट किए गए किसी भी score से उल्लेखनीय रूप से बेहतर बताता है।
विकास के हर चरण में, एक समर्पित advisory committee के माध्यम से बधिर समुदाय को शामिल किया गया, जिसने प्रणाली की क्षमताओं और सीमाओं का विस्तृत संयुक्त impact report सह-लेखित किया। यह सुविधा Pixel 11 पर ASL से अंग्रेज़ी के साथ शुरू होती है, और आगे अन्य devices तथा सांकेतिक भाषाओं की योजना है।
SL2T is state-of-the-art on academic benchmarks, plus it’s optimized for real-world use like one-handed signing while holding a phone. To protect privacy, it tracks body poses on-device, while our servers translate them into text.
🇮🇳 SL2T शैक्षणिक benchmarks पर state of the art है, और इसे वास्तविक उपयोग के लिए अनुकूलित किया गया है, जैसे फोन पकड़ते हुए एक हाथ से साइन करना। privacy की रक्षा के लिए, यह device पर body poses को ट्रैक करता है, जबकि हमारे servers इन data को text में अनुवाद करते हैं। — @GoogleDeepMind on X
🔗 Google DeepMind की आधिकारिक घोषणा
Suno ने BMG के साथ वैश्विक साझेदारी की घोषणा की
12 अगस्त — Suno ने BMG (Bertelsmann Music Group) के साथ एक वैश्विक साझेदारी की घोषणा की है, जो दुनिया की प्रमुख रिकॉर्ड लेबल और संगीत प्रकाशन कंपनियों में से एक है। कंपनी इस समझौते को कलाकारों और गीतकारों को दरकिनार करने के बजाय उन्हें साथ लेकर चलने वाले एक रचनात्मक पारिस्थितिकी तंत्र के निर्माण के लिए एक « landmark » (मील का पत्थर) बताती है।
यह साझेदारी एक विशेष संदर्भ में आती है: 2024-2025 में Suno पर तीन प्रमुख रिकॉर्ड कंपनियों — Universal Music Group, Warner Music Group और Sony Music — ने अपने मॉडलों के प्रशिक्षण में संरक्षित रिकॉर्डिंग के अनधिकृत उपयोग को लेकर मुकदमे दायर किए थे। इसलिए BMG के साथ समझौता संगीत उद्योग के साथ negotiated licensing संबंधों की दिशा में एक रणनीतिक मोड़ का संकेत देता है, बजाय न्यायिक टकराव के, एक प्रवृत्ति जो जुलाई में Runway और Bertelsmann के बीच हुए समझौते के साथ वीडियो पक्ष में पहले ही शुरू हो चुकी थी — और जिसमें BMG वास्तव में हिस्सा है।
प्रेस विज्ञप्ति में वित्तीय शर्तों या समझौते की सटीक सीमा का विवरण नहीं दिया गया है (प्रशिक्षण के लिए उपलब्ध catalogue, अधिकार धारकों का पारिश्रमिक, BMG कलाकारों के लिए प्रस्तावित tools)। ये तत्व आने वाले समय में Suno और BMG के आधिकारिक संचार के माध्यम से स्पष्ट होने बाकी हैं।
Agentic विकास उपकरण: Devin, Replit, VS Code और JetBrains
कई AI-सहायित विकास उपकरण 12 अगस्त को समानांतर रूप से आगे बढ़ रहे हैं, नए उपलब्ध मॉडलों, infrastructure control और agent plugins के standardization के बीच।
Devin में Grok 4.6 उपलब्ध, Cognition इसे Opus 5 और Fable 5 से नीचे रखता है
Cognition Grok 4.6 (xAI, उसी दिन घोषित) को Devin में उपलब्ध मॉडल के रूप में जोड़ता है। टीम इसे Grok 4.5 की तुलना में एक महत्वपूर्ण सुधार के रूप में रखती है, अपने आंतरिक ranking में इसे GPT-5.6 Sol से ऊपर और Opus 5 तथा Fable 5 से ठीक नीचे रखती है। Cognition code की गहन exploration और किसी भी संशोधन से पहले root-cause analysis पर विशेष मजबूती को रेखांकित करता है — यह जटिल debugging कार्यों के लिए उपयोगी बिंदु है, जहाँ Devin को सिस्टम को छूने से पहले उसे समझना होता है।
Replit workspaces के hosting region चुनने देता है (Pro/Enterprise)
Replit Pro और Enterprise ग्राहकों के लिए नए workspaces के hosting region का चयन खोलता है, जिसमें North America, Europe और Asia के विकल्प हैं। लक्ष्य दोहरा है: development के दौरान महसूस होने वाली latency को कम करना और प्रकाशित applications के data तथा previews की location पर नियंत्रण देना, जो enterprise context में अक्सर आवश्यक होता है (compliance, उपयोगकर्ताओं की निकटता)। यह सुविधा पहले से मौजूद published applications के region चुनने की क्षमता में जुड़ती है, और eligible accounts के लिए तुरंत उपलब्ध हो जाती है।
Agent Plugins 1.0 VS Code, Copilot CLI और Copilot app में आता है
6 अगस्त को AWS, Anysphere (Cursor), Microsoft, OpenAI और Vercel के साथ प्रकाशित खुला मानक Agent Plugins 1.0 — और अब Google के maintainer के रूप में जुड़ने के बाद — अब VS Code, Copilot CLI और Copilot app में आ रहा है। एक बार पैकेज किया गया plugin (agent skills + MCP servers) Awesome Copilot marketplace से install किया जा सकता है और बिना किसी संशोधन के कई compatible clients में काम करता है, और मौजूदा Copilot plugins के लिए किसी अनिवार्य migration की आवश्यकता नहीं होती। उद्यमों के लिए, governance managed-settings.json के माध्यम से होती है, जो Copilot Business और Enterprise plans पर उपलब्ध है।
JetBrains के लिए Copilot में persistent memory और local Ollama access जुड़ता है
GitHub Copilot for JetBrains को एक बड़ा अपडेट मिलता है: persistent memory अब एक agent chat session से दूसरी session तक उपयोगी जानकारी को सहेजने और याद दिलाने देती है, जिससे project context या प्राथमिकताओं को बार-बार दोहराने की आवश्यकता नहीं रहती। एक और उल्लेखनीय जोड़, Ollama अब एक BYOK (Bring Your Own Key) provider बन जाता है, जो JetBrains के model selector में सीधे स्थानीय रूप से चलने वाले मॉडल्स तक पहुँच देता है। कंपनियों को plugins की उपलब्धता, MCP access और permission bypass व्यवहार पर server-side controls भी मिलते हैं।
ओपन मॉडल और embedded AI
मॉडल्स की तरफ, कई प्रयोगशालाएँ एक के बाद एक ऐसे खुले संस्करण जारी कर रही हैं जिन्हें स्थानीय inference और दस्तावेज़ों की समझ के लिए अनुकूलित किया गया है।
Hugging Face: Transformers.js हर महीने 10 मिलियन डाउनलोड से आगे
Hugging Face के CEO Clément Delangue घोषणा करते हैं कि Transformers.js, ब्राउज़र में सीधे AI मॉडल चलाने वाली library, 10 million monthly downloads का आँकड़ा पार कर चुकी है — केवल छह महीनों में लगभग 10x वृद्धि, जिसे पिछले तीन वर्षों से आंतरिक रूप से विकसित किया गया था। Delangue इस वृद्धि को एक व्यापक प्रवृत्ति से जोड़ते हैं: लागत, गोपनीयता और compute की कमी के प्रति resilience के कारण AI workloads के एक बढ़ते हिस्से का local की ओर स्थानांतरण। संदेश में कोई अतिरिक्त तकनीकी विवरण नहीं है: यह एक मौजूदा project पर traction की घोषणा है।
Ai2: OlmoEarth Studio अब custom embeddings का export देता है
Ai2 (Allen Institute for AI) OlmoEarth Studio में Earth observation embeddings vectors की गणना और export जोड़ता है, तीन variants में: Nano (128 dimensions, 1.4 million parameters), Tiny (192 dimensions, 6.2 million), और Base (768 dimensions, 89 million)। Cloud-Optimized GeoTIFF में संग्रहीत ये vectors मानक GIS tools (QGIS, GDAL, rasterio) में सीधे उपयोग किए जा सकते हैं। प्रदर्शित उपयोग के मामलों में similarity search, few-shot segmentation — 60 annotated pixels पर प्रशिक्षित land-cover map 0.84 का weighted F1 प्राप्त करता है — और temporal change detection शामिल हैं। मॉडल और code Hugging Face और GitHub पर प्रकाशित हैं।
Liquid AI: LFM2.5-VL-3B, edge के लिए vision-language मॉडल
Liquid AI LFM2.5-VL-3B प्रकाशित करता है, जो device पर inference के लिए अनुकूलित 3.1 अरब पैरामीटर वाला vision-language model है। यह SigLIP2 400M visual encoder को 2.6 अरब पैरामीटर वाले text backbone के साथ जोड़ता है, जिसे लगभग 34,000 अरब tokens पर प्रशिक्षित किया गया है। benchmarks पर, यह MMBench पर 81.0% (पिछले संस्करण के 80.0% के मुकाबले), RefCOCO anchoring पर 87.9% और DocVQA पर 91.1% प्राप्त करता है। गति की बात करें तो: CPU (M5 Max) पर 228 tokens/second और mobile (Galaxy S26 Ultra) पर 20 tokens/second, लगभग 3 GB memory footprint के साथ। मॉडल Hugging Face पर उपलब्ध है, llama.cpp, MLX, vLLM और SGLang integrations के साथ।
Cohere ने लॉन्च किया North Micro Vision, अपना सबसे छोटा vision-language मॉडल
Cohere अपने North मॉडल परिवार का विस्तार North Micro Vision के साथ कर रहा है, जो अब तक उसका सबसे छोटा vision-language मॉडल है। 2.4 अरब पैरामीटर वाला यह मॉडल परिष्कृत दस्तावेज़ समझने के लिए बनाया गया है और Apache 2.0 लाइसेंस के तहत open source में जारी किया गया है, इसके weights Hugging Face पर उपलब्ध हैं। अपने छोटे आकार के बावजूद, इसमें native resolution पर visual processing, image और text को मिलाकर multi-turn conversations, spatial reasoning, और multilingual image understanding शामिल है। Cohere का कहना है कि यह visual understanding benchmarks की एक विस्तृत श्रृंखला में Gemma 4 E2B और Ministral 3 3B से बेहतर प्रदर्शन करता है, हालांकि घोषणा में उसने कोई सटीक आंकड़े साझा नहीं किए।
जुड़े हुए assistants: Gemini और Runway ने अपने integrations का विस्तार किया
Gemini ने 14 नए connected applications जोड़े
Google settings से सीधे Gemini से connect की जा सकने वाली applications की सूची का विस्तार कर रहा है: 14 नई services catalog में शामिल हो रही हैं, जिनमें Zoho Bigin, Granola, Wix, GetYourGuide, Ticketmaster, OpenTable, Pandora, iHeartRadio, Thumbtack, Zocdoc और Otter.ai शामिल हैं। service connect होने के बाद, बस Gemini से, उदाहरण के लिए, “काम के पास Zocdoc पर eye doctor का एक appointment ढूँढो” कहने की ज़रूरत है, और assistant सीधे service के साथ interact करेगा। rollout अगले कुछ हफ्तों में धीरे-धीरे किया जाएगा, जो third-party services की कई सेवाओं के लिए Gemini को एक single entry point बनाने की Google की रणनीति को आगे बढ़ाता है।
Runway ने Agent को Figma, Dropbox और Notion से जोड़ा
Runway अपनी platform-integrated production assistant Agent में Figma, Dropbox और Notion connectors जोड़ रहा है, ताकि creative assets अलग-अलग tools में बंद न रहें। अब Agent इन third-party platforms से designs, files और documents को सीधे एक ही workspace में synchronize कर सकता है। यह सुविधा सभी paid plans पर उपलब्ध है, और यह Runway की उस रणनीति को जारी रखती है जिसमें Agent को media production के लिए एक central hub बनाया जा रहा है, जो creative teams के मौजूदा tool ecosystem से जुड़ा हो।
कंपनी में agentic AI adoption पर OpenAI का अध्ययन
OpenAI enterprise use of AI पर दो पूरक studies प्रकाशित कर रहा है: “Enterprise Signals”, जो उसके ग्राहकों में agentic AI का व्यावहारिक panorama है, और एक companion working paper जो कंपनियों, भूमिकाओं और seniority levels के अनुसार adoption के प्रसार पर है। मुख्य निष्कर्ष: उपयोग सहायता से execution की ओर बढ़ रहा है। जून में, Codex ने 64% enterprise ग्राहकों के बीच Codex और ChatGPT द्वारा उत्पन्न combined token volume का निर्माण किया। सबसे आगे की कंपनियों और बाकी के बीच अंतर बढ़ रहा है: “frontier firms” (monthly usage में top 10%) अब typical कंपनियों की तुलना में active user प्रति 8.3 गुना अधिक output tokens उत्पन्न कर रही हैं, जबकि जनवरी में यह अनुपात 2.6 था। फरवरी से, enterprise में Codex के weekly users legal में 108 गुना और sales में 41 गुना बढ़ गए हैं, जबकि engineering में यह factor 5 है।
संक्षिप्त खबरें
- Grok 4.6 v0 (Vercel) में उपलब्ध — xAI द्वारा घोषणा के उसी दिन, v0 ऐप जनरेशन के लिए अपने model selector में Grok 4.6 जोड़ रहा है। 🔗 Tweet
- Open_MOSS ने MOSS-VL के FP8/NF4 संस्करण प्रकाशित किए — स्थानीय inference के लिए MOSS-VL-Instruct और MOSS-VL-Realtime के quantized संस्करण, केवल 24 GB VRAM के साथ। 🔗 Tweet
- Google AI Studio ने 12 अगस्त के कुल solar eclipse के लिए 3D viewer दिया — Reykjavík या Valencia से local sky simulation के साथ चाँद की छाया की real-time tracking। 🔗 Tweet
- GitHub Enterprise Server 3.22 release candidate में — disconnected environment में Copilot CLI, Enterprise Teams generally available, secret scanning और rulesets के लिए अधिक सूक्ष्म controls। 🔗 Changelog
- Rule insights organization level पर उपलब्ध (public preview) — rulesets का audit dashboard repository level से आगे बढ़ता है, CSV export के साथ। 🔗 Changelog
- Branch protection rules का rulesets में automatic migration — “Convert to ruleset” button एक पारंपरिक rule को अपने आप equivalent ruleset में बदल देता है। 🔗 Changelog
- Seedance 2.5 Genspark के AI video agent में आया — एक ही pass में 30 seconds generation, reference में 30 images और 10 video/audio clips तक। 🔗 Tweet
- Grant Thornton में Genspark — प्रस्ताव generation तेज़ हुई — firm एक single prompt से tender responses तैयार करती है, हमेशा human review के साथ। 🔗 Tweet
- GitHub Monthly Enterprise Roundup — अगस्त 2026 संस्करण — roundup code completion से governed end-to-end engineering workflows की ओर AI के बदलाव को रेखांकित करता है। 🔗 Tweet
- LTX-2.5 Runway पर उपलब्ध — Lightricks का open world model, 11 अगस्त को प्रकाशित, Runway के model catalog में शामिल हो गया। 🔗 Tweet
- FLUX 3 Luma पर उपलब्ध — Black Forest Labs का पहला unified multimodal model (image, video, audio) Luma पर आ रहा है, native video-to-audio generation के साथ। 🔗 Tweet
- Nemotron 3.5 Lightning Perplexity के Agent API में उपलब्ध — NVIDIA का open 30B MoE model Perplexity agents की high-volume execution layer में शामिल हो रहा है। 🔗 Tweet
- Qwen-Image-3.0 OpenArt पर उपलब्ध — Alibaba का image generation model एक नए third-party platform तक अपनी distribution बढ़ाता है। 🔗 Tweet
- Qwen3.8-Max Legal Research Bench में 4वें स्थान पर पहुँचा — यह model इस specialized legal research ranking में 22वें से 4वें स्थान पर आ गया है। 🔗 Tweet
- Daybreak मॉडल (cybersecurity) Amazon Bedrock के माध्यम से उपलब्ध — OpenAI के Daybreak Blue और Daybreak Red अधिकृत defenders के लिए सीधे Bedrock console से सुलभ हैं। 🔗 OpenAI
इसका क्या मतलब है
AI infrastructure के वित्तपोषण का पैमाना बदल रहा है: NVIDIA द्वारा पारंपरिक वित्तीय संस्थानों (Apollo, BlackRock, Goldman Sachs, KKR…) से जुटाए गए 500 अरब डॉलर यह दिखाते हैं कि अब मॉडल केवल तकनीकी balance sheets से नहीं, बल्कि समर्पित capital vehicles से भी funded हो रहे हैं। यह macro-economic बदलाव एक अधिक ठोस वास्तविकता के साथ जुड़ता है: उसी दिन प्रकाशित Qwen3.8-2.4T-A95B NVIDIA GB300 infrastructure पर native रूप से 4,000 से अधिक tokens प्रति second और प्रति GPU पर चलता है — capital की भूख और compute की मांग एक-दूसरे को बढ़ावा देती हैं, और हर नया विशाल model घोषित निवेशों को और अधिक औचित्य देता है।
Open weights का विस्तार हर scale पर जारी है: Alibaba के 2,400 अरब पैरामीटर वाले frontier model से लेकर Cohere के 2.4 अरब वाले छोटे vision-language model तक, और Liquid AI के LFM2.5-VL-3B तक, जिसे mobile पर चलने के लिए डिज़ाइन किया गया है। आकार — और केवल प्रदर्शन नहीं — के आधार पर यह diversification Hugging Face द्वारा मापी गई traction की पुष्टि करती है: Transformers.js प्रति माह 10 million बार डाउनलोड किया गया, जो छह महीने पहले की तुलना में लगभग 10 गुना अधिक है, और यह साबित करता है कि local inference अब प्रयोगात्मक चरण से निकलकर production के एक पूर्ण विकल्प के रूप में उभर रहा है।
AI-assisted development tools अधिक समृद्ध collaboration formats की ओर converge कर रहे हैं। Zed Delta के साथ agent के साथ होने वाले exchange को versioned shared document में बदल रहा है, GitHub Agent Plugins 1.0 के माध्यम से VS Code, Copilot CLI और JetBrains में agent plugins को standardize कर रहा है, और Devin तथा v0 दोनों xAI पर उसकी release के दिन ही Grok 4.6 को integrate कर रहे हैं। साझा बिंदु: ये tools अब केवल isolated assistants नहीं रह रहे, बल्कि interoperable infrastructure layers बन रहे हैं, जहाँ underlying model का चुनाव और sessions के बीच memory, code generation जितने ही महत्वपूर्ण हैं।
अंततः, AI रोज़मर्रा के उपयोगों और औद्योगिक संबंधों में और गहराई से एकीकृत हो रही है, और ये संबंध थोपे जाने के बजाय बातचीत से तय हो रहे हैं। Google DeepMind का SL2T privacy-focused architecture के साथ सीधे Pixel 11 पर sign language का अनुवाद करता है, Gemini और Runway अपने connectors को दर्जनों third-party services तक विस्तारित कर रहे हैं, और Suno ने BMG के साथ एक licensing agreement किया है जो 2024-2025 के मुकदमों से अलग रुख दिखाता है — यह संकेत है कि music industry अब generative models से व्यवस्थित रूप से लड़ने के बजाय उनके साथ बातचीत कर रही है। enterprise की ओर, OpenAI का अध्ययन पुष्टि करता है कि agentic execution की ओर यह बदलाव पहले ही सबसे आगे की organizations और बाकी के बीच काफी गहराई तक बढ़ चुका है।
स्रोत
- NVIDIA — 500 अरब डॉलर के financing partnerships
- NVIDIA — X पर Qwen3.8-2.4T-A95B घोषणा
- NVIDIA — Qwen3.8-2.4T-A95B तकनीकी लेख
- Zed — X पर Delta घोषणा
- Zed — X पर DeltaDB
- Google DeepMind — SL2T, sign language
- Google DeepMind — X पर SL2T
- Suno — BMG साझेदारी
- Cognition — Devin में Grok 4.6
- Replit — workspace region चयन
- GitHub — Agent Plugins 1.0
- GitHub — Copilot JetBrains, memory और Ollama
- Hugging Face — Transformers.js 10 million downloads
- Ai2 — OlmoEarth Studio embeddings
- Liquid AI — LFM2.5-VL-3B
- Cohere — North Micro Vision
- Google — Gemini से जुड़ी 14 नई applications
- Runway — Figma, Dropbox, Notion connectors
- OpenAI — enterprise में agentic AI adoption study
- v0 — Grok 4.6
- Open_MOSS — FP8/NF4 versions
- Google AI Studio — eclipse 3D viewer
- GitHub — GHES 3.22 RC
- GitHub — organization rule insights
- GitHub — branch protection से rulesets में migration
- Genspark — Seedance 2.5
- Genspark — Grant Thornton
- GitHub — Monthly Enterprise Roundup अगस्त 2026
- Runway — LTX-2.5
- Luma — FLUX 3
- Perplexity — Nemotron 3.5 Lightning
- Alibaba Qwen — OpenArt पर Qwen-Image-3.0
- Alibaba Qwen — Legal Research Bench
- OpenAI — Amazon Bedrock पर Daybreak