खोजें

Gemini ने सक्रिय उपयोगकर्ताओं में एक अरब का आंकड़ा पार किया, NVIDIA ने Nemotron 3.5 Lightning लॉन्च किया, Mistral ने यूरोपीय कंप्यूट गठबंधन बनाया

कृत्रिम बुद्धिमत्ता द्वारा जनित लेख
Gemini ने सक्रिय उपयोगकर्ताओं में एक अरब का आंकड़ा पार किया, NVIDIA ने Nemotron 3.5 Lightning लॉन्च किया, Mistral ने यूरोपीय कंप्यूट गठबंधन बनाया

ai-powered-markdown-translator

gpt-5.4-mini के साथ fr से hi में अनूदित लेख।

GitHub पर प्रोजेक्ट देखें ↗

11 अगस्त 2026 को, Gemini ऐप मासिक उपयोगकर्ताओं में एक अरब का आंकड़ा पार कर जाता है, और Google के इतिहास में सबसे तेज़ी से बढ़ने वाला उत्पाद बन जाता है। NVIDIA Nemotron 3.5 Lightning और अपनी रूटिंग लाइब्रेरी NeMo Switchyard जारी करती है, Mistral अपने प्लेटफ़ॉर्म को तृतीय-पक्ष मॉडल्स के लिए खोलती है और एक यूरोपीय कंप्यूट गठबंधन बनाती है, और Alibaba Wan-Animate-2 का अनावरण करती है, जो उसके open source एनीमेशन मॉडल का एक बड़ा उन्नयन है। मेन्यू में और भी है: पाँच नए बाज़ारों में विस्तारित ChatGPT विज्ञापन, डेवलपर्स के लिए नए टूल और media generation में घोषणाओं की लंबी सूची।


Gemini ने मासिक उपयोगकर्ताओं में एक अरब का आंकड़ा पार किया

Gemini ऐप ने आधिकारिक रूप से मासिक सक्रिय उपयोगकर्ताओं में एक अरब का आंकड़ा पार कर लिया है, जिससे यह Google के अनुसार कंपनी के पूरे इतिहास में सबसे तेज़ी से बढ़ने वाला उत्पाद बन गया है। यह घोषणा आधिकारिक @GeminiApp अकाउंट और Josh Woodward, जो Google में Gemini और Labs टीमों का नेतृत्व करते हैं, दोनों द्वारा साझा की गई।

Google इस घोषणा के साथ उन उपयोगों पर एक संख्यात्मक रिपोर्ट भी देता है जिनके कारण यह वृद्धि हुई:

मापा गया उपयोगडेटा
आवाज़ के इंटरैक्शन63 % उपयोगकर्ता आवाज़ का उपयोग करते हैं
Gemini Live सत्र5 में से 1 कैमरा लाइव या स्क्रीन शेयरिंग का उपयोग करता है
स्कूल संबंधी अनुरोध38 % में एक संलग्नक (फ़ाइल) शामिल होता है
इमेज जनरेशनहर दिन 150 मिलियन से अधिक इमेज बनाई जाती हैं
Android ऑटोमेशन40 से अधिक ऐप्लिकेशन में स्वचालित क्रियाएँ
iOS उपयोगकर्ताApple डिवाइसों पर 100 मिलियन से अधिक सक्रिय उपयोगकर्ता

ये आँकड़े केवल टेक्स्ट चैट से आगे उपयोगों के विविधीकरण को दिखाते हैं: आवाज़, कैमरा, स्क्रीन शेयरिंग, मल्टीमीडिया जनरेशन और ऐप्लिकेशन-से-ऐप्लिकेशन ऑटोमेशन (रेस्तरां बुकिंग, VTC ऑर्डर) अपनाने के महत्वपूर्ण चालक के रूप में उभरते हैं।

🚀One billion for Gemini! Our goal remains to make it the most personal, proactive, and powerful assistant.

🇮🇳 🚀 Gemini के लिए एक अरब! हमारा लक्ष्य इसे सबसे व्यक्तिगत, सक्रिय और शक्तिशाली सहायक बनाना जारी रखना है।@GeminiApp on X

🔗 Google ब्लॉग पर आधिकारिक घोषणा


NVIDIA ने उच्च-वॉल्यूम एजेंटों के लिए Nemotron 3.5 Lightning और NeMo Switchyard लॉन्च किए

NVIDIA अपने खुले Nemotron 3 मॉडल परिवार को Nemotron 3.5 Lightning के साथ बढ़ाती है, जो 30 अरब पैरामीटर वाला एक हाइब्रिड MoE है (3 अरब सक्रिय) और जिसे उच्च-वॉल्यूम agentic कार्यों के निष्पादन — टूल कॉल, परिणाम सत्यापन, कार्य प्रत्यायोजन — के लिए डिज़ाइन किया गया है, न कि जटिल तर्क के लिए। NVFP4 और BF16 में, 1 मिलियन tokens तक के context के साथ उपलब्ध यह मॉडल समान मॉडलों की तुलना में आउटपुट throughput में 4 गुना तक और task completion में 30 % समय बचत का दावा करता है। PinchBench पर, यह 10,000 कार्यों को पूरा करते हुए 86 % सटीकता प्राप्त करता है और समान सटीकता पर Qwen3.6 35B से 35 % तेज़ है।

मॉडल वजन, प्रशिक्षण डेटा और recipes के साथ वितरित किया गया है, और Hugging Face, ModelScope, OpenRouter तथा build.nvidia.com पर उपलब्ध है। Together AI पहले दिन से लॉन्च पार्टनर (day-0) है, और अपने Dedicated Model Inference ऑफ़र के माध्यम से उच्च-वॉल्यूम agentic workloads के लिए आरक्षित क्षमता प्रदान करता है।

साथ ही, NVIDIA NeMo Switchyard जारी करती है, जो एक open source लाइब्रेरी है और हर अनुरोध को सबसे उपयुक्त मॉडल (गुणवत्ता, latency, लागत) तक application को पुनर्लेखन किए बिना रूट करती है — frontier मॉडल्स को जटिल तर्क के लिए और Lightning को विशेष निष्पादन के लिए सुरक्षित रखते हुए। NVIDIA Opus 4.8 अकेले की तुलना में task completion लागत को लगभग एक-तिहाई तक घटाने का दावा करती है। ठोस साझेदारों के उदाहरण दिए गए हैं: Boomi अपने ट्रैफ़िक का 59 % एक तेज़ fine-tuned मॉडल की ओर रूट करता है, Cognition अपनी औसत लागत 28 % घटाता है, और Ramp मॉडल तथा routing को मिलाकर 59 % लागत और 32 % कम execution time प्राप्त करता है।

🔗 NVIDIA की आधिकारिक पोस्ट · X पर मॉडल की घोषणा


Alibaba ने Wan-Animate-2 का अनावरण किया, जो उसके open source character animation का एक बड़ा उन्नयन है

Alibaba (Wan टीम) Wan-Animate-2 जारी करती है, जिसे उसके open source character animation मॉडल का एक बड़ा उन्नयन बताया गया है। चार क्षमताएँ प्रमुख हैं: उच्च-निष्ठा animation जो मानवों, कार्टून, रोबोट और जानवरों में movement और micro-expressions को पुन: प्रस्तुत करता है; multi-character animation, जहाँ प्रत्येक character एक ही scene में अपनी पहचान और अपना movement बनाए रखता है; text-driven camera control (उदाहरण के लिए “top view”), जो source video से अलग है; और real-time streaming generation, जो chunk by chunk किसी भी लंबाई की sequences बनाती है बिना किसी दिखाई देने वाले error accumulation के।

तकनीकी दृष्टि से, Alibaba explicit pose skeletons को छोड़कर reference video को ही motion prior के रूप में उपयोग करती है, जिसमें Dual-Branch DiT (Diffusion Transformer), Time-Align RoPE temporal encoding और Sparse-Ref Attention (Sparse-Ref Attention) architecture है ताकि गुणवत्ता खोए बिना गणना कम की जा सके। camera control लगभग 50,000 multi-view Unreal Engine samples पर प्रशिक्षित एक LoRA पर आधारित है।

मॉडल open source है, और अभी ModelScope, Hugging Face तथा GitHub पर demo के साथ उपलब्ध है। NVIDIA की अगस्त की “Local AI” campaign के अनुसार, इसके 14 अरब पैरामीटर RTX systems पर विकल्पों की तुलना में 16 से 26 गुना तेज़ generate करते हैं — जो उपभोक्ता हार्डवेयर पर स्थानीय deployment के लिए इसके optimization की पुष्टि करता है।

🔗 तकनीकी विवरण और NVIDIA आँकड़े · X पर घोषणा


Mistral ने regional inference लॉन्च किया, अपने प्लेटफ़ॉर्म को GLM-5.2 के लिए खोला और एक यूरोपीय compute coalition बनाई

Mistral खुद को एकमात्र यूरोपीय AI laboratory के रूप में स्थापित करती है जो regional inference choice और service guarantees दोनों को जोड़ती है। कंपनी, जो पहले से OpenAI, Google और चीनी खिलाड़ियों के सामने मूल्य और तकनीकी दौड़ में शामिल है, यहाँ एक अलग स्थिति पर दाँव लगाती है: sovereignty और service predictability, न कि केवल benchmarks की दौड़। प्लेटफ़ॉर्म की तरफ दो नई चीजें:

सुविधास्थितिविवरण
Mistral Regional Endpointsउपलब्धinference निष्पादन के लिए Europe या United States का चयन
Mistral Priority Tierसार्वजनिक previewउपलब्धता SLA और कस्टम throughput सीमाएँ

एक और उल्लेखनीय पहलू: Mistral प्लेटफ़ॉर्म तीसरे पक्ष के मॉडल्स के लिए खुलता है, जिसकी शुरुआत Z.ai के GLM-5.2 से हो रही है, जिसे Mistral मॉडल्स की तरह ही regional controls और service commitments मिलेंगे — दोनों खिलाड़ियों के बीच एक पहली convergence, जो अब तक किफायती खुले मॉडल्स के segment में सीधे प्रतिद्वंद्वी थे।

अंत में, Mistral European Compute Units (ECU) लॉन्च करती है, एक तंत्र जो कंपनियों की बहुवर्षीय commitments को उसके compute infrastructure तक पहुँच में बदलता है, जिसका लक्ष्य 2030 तक 1 GW क्षमता है — यानी एक बड़े शहर द्वारा उपभोग की जाने वाली शक्ति के बराबर। घोषित founding partners हैं ASML (Christophe Fouquet, CEO), CMA CGM (Rodolphe Saadé, Chairman et CEO), Amadeus (Luis Maroto, CEO) और Caisse des Dépôts (Olivier Sichel, CEO) — उद्योग, परिवहन और सार्वजनिक वित्त का ऐसा मिश्रण जो अमेरिकी hyperscalers से स्वतंत्र एक यूरोपीय compute ecosystem बनाने की महत्वाकांक्षा को दर्शाता है।

🔗 Mistral की आधिकारिक घोषणा


OpenAI ने ChatGPT विज्ञापन यूनाइटेड किंगडम, मेक्सिको, ब्राज़ील, जापान और दक्षिण कोरिया में लॉन्च किए

OpenAI ChatGPT के भीतर विज्ञापन तैनात करने में एक नया चरण पार करती है। फ़रवरी 2026 में संयुक्त राज्य अमेरिका में Free और Go ऑफ़र के लिए परीक्षण के रूप में शुरू किया गया, फिर मार्च में कनाडा, ऑस्ट्रेलिया और न्यूज़ीलैंड तक विस्तारित यह विज्ञापन कार्यक्रम अब आधिकारिक रूप से पाँच नए बाज़ारों में लॉन्च हो गया है: United Kingdom, Mexico, Brazil, Japan और South Korea। Plus, Pro, Business, Enterprise और Education ऑफ़र विज्ञापन-मुक्त रहते हैं, और वर्ष के अंत तक अन्य बाज़ारों को लक्षित किया गया है।

सिद्धांत अपरिवर्तित रहता है: विज्ञापन कभी भी ChatGPT के उत्तरों को प्रभावित नहीं करते, वे स्पष्ट रूप से sponsored के रूप में लेबल किए जाते हैं और ऑर्गेनिक उत्तर से दृश्य रूप से अलग रहते हैं। targeting चल रही बातचीत के विषय और पिछले विज्ञापन इंटरैक्शन के इतिहास पर आधारित है, बिना कभी विज्ञापनदाताओं को बातचीत या व्यक्तिगत डेटा तक पहुँच दिए — उन्हें केवल aggregated आँकड़े (views, clicks) मिलते हैं।

उपयोगकर्ता नियंत्रण के लिहाज़ से, ChatGPT विज्ञापन छिपाने, वह क्यों दिखाया गया यह देखने, एक ही क्रिया में विज्ञापन डेटा हटाने, और किसी भी समय personalization प्रबंधित करने की सुविधा देता है। पहचान किए गए या अनुमानित नाबालिग खातों पर, या संवेदनशील विषयों (स्वास्थ्य, मानसिक स्वास्थ्य, राजनीति) के आसपास कोई विज्ञापन नहीं दिखाया जाता। OpenAI के अनुसार, pilot में उपयोगकर्ता विश्वास पर कोई मापनीय प्रभाव नहीं दिखा, जिसने इस क्रमिक विस्तार को प्रेरित किया।

🔗 OpenAI की आधिकारिक घोषणा


ओपन source ecosystem और inference

webAI Intelligence Lab ने TwiL-LM3 जारी किया, 3B reasoning model जो GPT-OSS-120B से बेहतर है

webAI Intelligence Lab (Austin) TwiL-LM3 जारी करता है, जो formal reasoning का उसका पहला open source model है। केवल 3 अरब parameters के साथ, यह परीक्षण किए गए 5 formal reasoning benchmarks में से 4 पर OpenAI के GPT-OSS-120B को पीछे छोड़ने का दावा करता है — यानी लगभग 40 गुना कम parameters के साथ 2.6 गुना तेज़ inference। स्वचालित रूप से एकत्र किए गए web content के बजाय सत्यापित और proprietary डेटा पर प्रशिक्षित, यह model edge computing को लक्षित करता है: इसे Raspberry Pi से लेकर iPhone तक चलने में सक्षम बताया गया है, cloud पर निर्भर हुए बिना।

🔗 आधिकारिक ट्वीट

Meta Muse Spark 1.2 का open-weights संस्करण तैयार कर रहा है

Muse Glimmer की घोषणा वाले thread में, Alexandr Wang (Meta Superintelligence Labs) संकेत देते हैं कि Meta जल्द ही Muse Spark 1.2 का open-weights संस्करण जारी करेगा — अब तक वही proprietary model जो terminal code agent Muse Code को शक्ति देता है। कोई सटीक तारीख नहीं दी गई है, लेकिन यह घोषणा पुष्टि करती है कि Meta अपनी पूरी Muse श्रृंखला में अधिक open weights की ओर झुक रहा है, Muse Glimmer weights को Apache 2.0 license के तहत तुरंत खोलने की निरंतरता में।

🔗 आधिकारिक ट्वीट

Zuckerberg ने Meta की AI दर्शन पर एक लेख प्रकाशित किया

उसी दिन, Mark Zuckerberg एक लेख प्रकाशित करते हैं जिसमें कहा गया है कि “हर किसी के पास superintelligence तक पहुँच होनी चाहिए”, और AI का एक सकारात्मक भविष्य बनाने के लिए Meta की philosophy और values का विवरण दिया गया है। यह संदेश Muse Glimmer के launch के साथ आता है, जो weights की openness को केवल marketing argument नहीं बल्कि एक मूलभूत विकल्प के रूप में स्थापित करता है, और उस सप्ताह Meta की open weights strategy पर एक व्यापक communication का हिस्सा है।

🔗 आधिकारिक ट्वीट

Lightricks ने LTX-2.5 पेश किया, अपने open world model का एक बड़ा अपडेट

Lightricks LTX-2.5 जारी करती है, जो उसके “world model” का नया संस्करण है, जिसका उपयोग पहले ही cinema, robotics और real-time workflows में किया जा रहा है। यह अपडेट बेहतर pixel fidelity, ऐसे multi-shot scenes का वादा करता है जो एक cut से दूसरे cut तक सुसंगत रहते हैं, और विभिन्न domains के अनुसार fine-tune करने के लिए तैयार एक pre-trained base, जिसे Diffusion Fidelity Rendering नामक एक नए rendering के माध्यम से प्रस्तुत किया गया है। टीम LTX-2.5 को किराए के टूल के बजाय एक open foundation के रूप में प्रस्तुत करती है।

🔗 आधिकारिक ट्वीट

IBM Research ने ALTK-Evolve प्रकाशित किया, ACE की तुलना में कम tokens वाली agentic memory

IBM Research ALTK-Evolve जारी करती है, एक ऐसी प्रणाली जो AI agents को पुनः प्रशिक्षण के बिना अपनी पिछली विफलताओं से सीखने देती है, और उपयोग किए गए model की क्षमता के अनुसार पुनः इंजेक्ट की गई instructions की मात्रा को समायोजित करती है — ACE (Agentic Context Engineering) के विपरीत, जो हर चरण में अपना पूरा “playbook” प्रदान करता है। DeepSeek-V3.2 के साथ AppWorld benchmark पर, ALTK-Evolve 263K tokens प्रति task के लिए 89.3 % tasks complete करता है, जबकि ACE 80.4 % और 634K tokens देता है। gpt-oss-120b के साथ, यह लगभग ACE inference लागत के 40 % पर समान या बेहतर सटीकता प्राप्त करता है।

🔗 Hugging Face पोस्ट

Together AI, IBM और NVIDIA ने IBM Cloud पर enterprise inference के लिए साझेदारी की

Together AI IBM और NVIDIA के साथ एक साझेदारी की घोषणा करती है ताकि IBM Cloud पर enterprise-grade AI inference लाया जा सके, NVIDIA B300 GPUs के एक समर्पित cluster और Spectrum-X network के माध्यम से — इस platform पर अपनी तरह का पहला, जिसे Together AI के production inference platform द्वारा संचालित किया गया है। यह ऑफ़र उन enterprises को लक्षित करता है जो पहले से IBM Cloud के ग्राहक हैं और cloud provider बदले बिना AI workloads deploy करना चाहते हैं।

🔗 आधिकारिक ट्वीट


डेवलपर टूलिंग: Amp, Replit, GitHub Copilot और Manus

Amp ने orbs के लिए global plugins और skills लॉन्च किए

Amp (Sourcegraph) Amp द्वारा होस्ट किए गए plugins और skills की एक केंद्रीकृत प्रणाली पेश करता है, जो हर जगह उपलब्ध है जहाँ Amp चलता है, विशेष रूप से orbs में। दो स्तर साथ-साथ मौजूद हैं: एक व्यक्तिगत स्तर, जो उसी चर्चा-थ्रेड में live reloading वाला प्रयोगात्मक sandbox है, और एक workspace स्तर, जिसे प्रशासकों द्वारा प्रबंधित किया जाता है और पूरी टीम के लिए डिफ़ॉल्ट रूप से लोड किया जाता है। व्यक्तिगत तत्वों को workspace में साझा किया जा सकता है, और versioning native रूप से प्रबंधित होता है (नवीनतम version में अपडेट, obsolete skills का detection)।

🔗 Global Plugins and Skills

Replit MCP beta: MCP के माध्यम से app बनाना, लोड करना, खोजना और प्रकाशित करना

Replit अपनी MCP (Model Context Protocol) beta को नई क्षमताओं के साथ मज़बूत करता है: web interface के बिना सीधे MCP के माध्यम से एक application बनाना, लोड करना, खोजना और प्रकाशित करना। घोषित उद्देश्य यह है कि किसी भी compatible MCP client — editor, autonomous agent या third-party tool — से Replit पर वास्तविक software बनाया जा सके, बजाय Replit के अपने interface तक सीमित रहने के। यह विस्तार Replit की उस रणनीति की पुष्टि करता है जिसमें वह अपने platform को agentic workflows के लिए एक programmable building block के रूप में प्रस्तुत कर रहा है।

🔗 आधिकारिक ट्वीट

MAI-Code-1.1-Flash GitHub Copilot में आ रहा है, MAI-Code-1-Flash अप्रचलित किया गया

Microsoft का नवीनतम कॉम्पैक्ट कोड मॉडल, MAI-Code-1.1-Flash, नेटिव विज़न सपोर्ट तथा कोड गुणवत्ता, निर्देश-पालन और टूल उपयोग में सुधारों के साथ GitHub Copilot में तैनात किया जा रहा है। इसकी कीमत MAI-Code-1-Flash से 73 % कम है, और वार्षिक सब्सक्राइबरों के लिए प्रीमियम क्वेरी मल्टीप्लायर 0,25× है। Free और Étudiant पर स्वतः चयनित, तथा Pro, Pro+, Max, Business और Enterprise पर मैन्युअल चयन के लिए उपलब्ध। साथ ही, GitHub 10 सितंबर 2026 को MAI-Code-1-Flash के अप्रचलन की घोषणा कर रहा है।

🔗 GitHub चेंजलॉग

Manus फिर से एक स्वतंत्र कंपनी बनने जा रहा है

Manus घोषणा करता है कि वह फिर से एक स्वतंत्र कंपनी बनेगा। कुछ न्यायक्षेत्रों की नियामकीय आवश्यकताओं के अनुरूप, उपयोगकर्ताओं के एक हिस्से को 23 अगस्त 2026 (7:59, सिंगापुर समय) से पहले अपना डेटा सहेजना होगा, फिर 25 अगस्त 2026 (8:00, सिंगापुर समय) से एक पुनर्स्थापना शुरू करनी होगी। प्रभावित उपयोगकर्ताओं को ई-मेल और इन-ऐप सूचना के माध्यम से पहले ही बताया जाएगा; संक्रमण अवधि के दौरान किसी बिलिंग की योजना नहीं है, और साथ में स्वागत बोनस भी दिए जाएंगे।

🔗 आधिकारिक ट्वीट


मीडिया जनरेशन: Wan CLI, Motif 3, Luma Scenes और 800 VDC पावर सप्लाई

Wan CLI: Alibaba एजेंटों से सीधे Wan को नियंत्रित करना संभव बनाता है

Alibaba Wan CLI जारी करता है, जो एक नया कमांड-लाइन टूल है जो एजेंटों से सीधे Wan प्लेटफ़ॉर्म को कॉल करके प्रोग्रामेटिक तरीके से इमेज और वीडियो जनरेट करने देता है। उपयोग किए गए क्रेडिट पूरी तरह उपयोगकर्ता के Wan Video खाते के साथ सिंक रहते हैं, जिससे वेब इंटरफ़ेस और स्वचालित उपयोग के बीच बिलिंग का दोहरा प्रबंधन टल जाता है। इंस्टॉलेशन Wan पैनल से एक कमांड लेकर और उसे अपने एजेंट में पेस्ट करके किया जाता है, और शुरुआती उपयोग के लिए एक वीडियो ट्यूटोरियल भी दिया गया है।

🔗 आधिकारिक ट्वीट

Motif 3: NVIDIA B200 GPU पर प्रशिक्षित पहला कोरियाई फ्रंटियर मॉडल

कोरियाई स्टार्टअप Motif Technologies Motif 3 Base और Motif 3 लॉन्च करता है, जो फ्रंटियर LLM दौड़ को लक्षित उसके पहले मॉडल हैं, जिन्हें कोरियाई विज्ञान मंत्रालय के समर्थन से विकसित किया गया और NVIDIA B200 GPU पर प्रशिक्षित किया गया। Motif 3, NVIDIA NeMo-RL का उपयोग करते हुए पोस्ट-ट्रेनिंग के माध्यम से Motif 3 Base पर बनाया गया है। NVIDIA के साथ सहयोग में, टीम एक NVFP4 संस्करण भी प्रकाशित कर रही है (अनुकूलित निम्न-प्रिसिशन)। पूरा पैकेज तकनीकी रिपोर्ट के साथ Hugging Face पर उपलब्ध होगा, और NVIDIA ने इस लॉन्च को कोरियाई AI इकोसिस्टम की गति का एक उदाहरण बताया है।

🔗 आधिकारिक ट्वीट

Luma Scenes: Uni-1 द्वारा संचालित, सीन-आधारित वीडियो प्रोडक्शन

Luma AI Luma Scenes लॉन्च करता है, एक ऐसा टूल जो अंतिम रेंडरिंग से पहले हर सीन को अलग-अलग परिष्कृत करने, समयबद्ध करने और सत्यापित करने देता है — यह उस पारंपरिक समस्या का समाधान है जिसमें बहुत-सी वैरिएंट्स बनाकर अंत में केवल एक उपयोगी संस्करण चुना जाता है, और जोखिम रहता है कि एक खराब सीन पूरी प्रोडक्शन को प्रभावित कर दे। यह टूल Luma Layers (लेयर-आधारित संपादन, जुलाई के अंत में) को आगे बढ़ाता है, और यह पुष्टि करता है कि Luma का रुझान एक-क्लिक जनरेशन के बजाय सूक्ष्म नियंत्रण की ओर है, एक ऐसे वर्कफ़्लो के साथ जो पारंपरिक एडिटिंग के अधिक निकट है।

🔗 आधिकारिक ट्वीट

Ideogram Ad Resizer: एक डिज़ाइन, सभी विज्ञापन फ़ॉर्मैट

Ideogram Ad Resizer लॉन्च करता है: एकल डिज़ाइन और लक्षित विज्ञापन प्लेसमेंट से, यह टूल अपने-आप अभियान के लिए तैयार फ़ॉर्मैट्स का पूरा सेट जनरेट करता है (Instagram, Facebook, YouTube, कनेक्टेड TV, डिस्प्ले, प्रिंट), जिसमें ऐसे चरम अनुपात भी शामिल हैं जिन्हें मैन्युअली क्रॉप करना कठिन होता है। यह तुरंत ऐप में और API के माध्यम से उपलब्ध है, ताकि स्वचालित विज्ञापन प्रोडक्शन पाइपलाइनों में एकीकरण किया जा सके — क्रिएटिव मल्टीचैनल टीमों के लिए एक ठोस मार्केटिंग उपयोग-केस।

🔗 आधिकारिक ट्वीट

HeyGen for Real Estate: रियल एस्टेट एजेंटों के लिए तीन वीडियो फ़ॉर्मैट के साथ आधिकारिक लॉन्च

HeyGen आधिकारिक रूप से HeyGen for Real Estate लॉन्च करता है, जिसमें रियल एस्टेट एजेंटों के लिए सोचे गए तीन वीडियो फ़ॉर्मैट शामिल हैं, जो बिना कैमरा या एडिटिंग के स्वयं स्क्रीन पर दिखाई देते हैं — उद्देश्य: उन्हें दिन में कई बार पोस्ट करने में सक्षम बनाना, बिना उस दृश्य उपस्थिति का त्याग किए जिसकी इस क्षेत्र में आवश्यकता होती है। प्रोत्साहन ऑफर: घोषणा के 12 घंटे के भीतर Creator प्लान में साइन अप करने वालों को 30 दिनों के लिए मुफ्त White Glove एक्सेस मिलता है (केवल संयुक्त राज्य)। HeyGen रियल एस्टेट से आगे अन्य छोटे व्यवसायों तक विस्तार की संभावना का उल्लेख करता है।

🔗 आधिकारिक ट्वीट

NVIDIA भविष्य के « AI factories » की 800 VDC पावर आर्किटेक्चर का विवरण देता है

NVIDIA, Google और Microsoft के साथ, Open Compute Project के माध्यम से 800-वोल्ट DC पावर आर्किटेक्चर का विवरण देता है, जो नेटवर्क और GPU के बीच विद्युत रूपांतरण चरणों को कम करता है ताकि भविष्य की पीढ़ियों के एक्सेलरेटरों की गणनात्मक घनता का समर्थन किया जा सके। 80 से अधिक निर्माता पहले ही अनुरूप उत्पादों पर काम कर रहे हैं। कई चरणों में तैनाती: 2026 की दूसरी छमाही से हाइब्रिड « Power Rack » आर्किटेक्चर, 2027 में « Row Power Center », फिर आने वाले दशक में 800 VDC-नेटिव इंस्टॉलेशन।

🔗 NVIDIA आधिकारिक पोस्ट


Qwen, Z.ai और OpenAI: नए मॉडल और एजेंट सिंक्रोनाइज़ेशन

Qwen3.8-27B: इस सप्ताह ओपन वेट्स की घोषणा

Alibaba Qwen पुष्टि करता है कि Qwen3.8-27B के ओपन वेट्स इस सप्ताह जारी किए जाएंगे, Qwen3.8 परिवार में एक नया आकार, पहले से कवर किए गए फ्लैगशिप मॉडल Qwen3.8-Max के बाद। टीम इस नए मॉडल को एजेंटिक कोडिंग में Qwen3.6-27B से बेहतर बताती है, जो डेवलपर समुदाय द्वारा अच्छी तरह स्वीकार किया गया प्रदर्शन है, और यह मध्यवर्ती आकार कई हफ्तों से प्रतीक्षित था।

🔗 आधिकारिक ट्वीट

Z.ai: ZCode ने 10 लाख उपयोगकर्ताओं का आंकड़ा पार किया, GLM Coding Plan की सीमाएँ रीसेट

Z.ai घोषणा करता है कि ZCode, उसका GLM मॉडलों पर आधारित कोडिंग टूल, 10 लाख से अधिक उपयोगकर्ताओं तक पहुँच गया है। आभार स्वरूप, कंपनी GLM Coding Plan के सभी सब्सक्राइबरों की उपयोग सीमाएँ रीसेट कर रही है, और एक अपडेट तैनात कर रही है जिसका उद्देश्य लंबी-क्षितिज तर्क क्षमताओं को वास्तव में पूर्ण किए गए कार्य में बेहतर रूप से बदलना है, 98 % कैश सफलता दर के साथ, जो सब्सक्राइबरों के लिए लगभग 1,8 गुना अधिक उपयोग प्रदान करता है।

🔗 आधिकारिक ट्वीट

ChatGPT desktop app Linux पर प्रीव्यू में उपलब्ध, Codex के साथ

OpenAI अपने desktop एप्लिकेशन को Linux तक विस्तारित कर रहा है, जो अब तक macOS और Windows तक सीमित था। यह प्रीव्यू चार प्रमुख वितरणों को कवर करता है — Ubuntu 24.04/26.04 LTS, Debian 13 और Fedora 43/44 — x64 और ARM64 के लिए .deb/.rpm पैकेजों के साथ। ऐप ChatGPT, ChatGPT Work और Codex को एक ही नेटिव इंटरफ़ेस में जोड़ता है, समर्थित ब्राउज़र प्रोजेक्ट्स और वर्कफ़्लोज़ तक पहुँच के साथ, बिना कार्य-परिवेश बदले।

🔗 आधिकारिक ट्वीट

Codex और ChatGPT Work अन्य AI एजेंटों का काम आयात करते हैं

ChatGPT Work और Codex के लिए नई सुविधा: अन्य AI एजेंटों से किए गए अपने मौजूदा काम को OpenAI इकोसिस्टम के साथ सिंक में रखना। व्यावहारिक रूप से, उपयोगकर्ता प्रोजेक्ट, बातचीत, skills और plugins आयात कर सकते हैं, आयात इतिहास देख सकते हैं, और सेटिंग्स में स्वचालित सिंक्रोनाइज़ेशन सक्रिय कर सकते हैं। यह अब ChatGPT desktop ऐप में उपलब्ध है, ताकि टूल बदलने की घर्षण कम हो, बजाय पूरी तरह नई कॉन्फ़िगरेशन के साथ फिर से शुरू करने के।

🔗 आधिकारिक ट्वीट


संक्षिप्त समाचार

  • Fable बिलिंग बग हल हुआ, 196 रिफंड — Anthropic पुष्टि करता है कि कॉन्फ़िगरेशन कैश के उस बग का पूरा समाधान कर दिया गया है जो गलत तरीके से ओवररन दिखा रहा था; 196 उपयोगकर्ताओं को रिफंड और मुआवजे के रूप में क्रेडिट दिया गया। 🔗 ट्वीट
  • v0 (Vercel) अपनी साइडबार को फिर से डिज़ाइन कर रहा है — परियोजना के अनुसार समूहित वार्तालाप, रीयल-टाइम स्थिति संकेतक, होवर पर प्रीव्यू कार्ड। 🔗 ट्वीट
  • Amp orb डिस्क आकार को 60 Go तक बढ़ाता है — पहले 40 Go था, नए orbs के लिए बिना अतिरिक्त लागत के। 🔗 ट्वीट
  • DeepSeek V4 Flash 0731 Together AI पर fine-tuning के लिए उपलब्ध — SFT या DPO के माध्यम से विशेषज्ञीकरण, फिर उत्पादन में तैनाती। 🔗 ट्वीट
  • Together AI अपने समर्पित inference के autoscaling पर दूसरा भाग विस्तार से बताता है — एक ही लोड के तहत तीन नीतियों का परीक्षण, केवल एक वास्तव में अनुकूलित हुई। 🔗 ट्वीट
  • Hugging Face Open Model Series लॉन्च करता है — खुले मॉडलों और उनके स्थानीय उपयोग पर नई शैक्षिक वीडियो श्रृंखला। 🔗 ट्वीट
  • FC Barcelone Google Pixel / Gemini साझेदारी में शामिल होता है — क्लब के नए आधिकारिक साझेदार, Bayern Munich के साथ समान साझेदारी के बाद। 🔗 ट्वीट
  • Copilot उपयोग रिपोर्ट: मॉडल के अनुसार token विवरण — इनपुट, आउटपुट और कैश token अब खपत किए गए AI क्रेडिट्स के पीछे दिखाई देते हैं। 🔗 Changelog
  • GitHub Copilot के Rubber Duck agent को सामने लाता है — जूनियर डेवलपर कौशल पर एक करियर लेख में; यह agent जनरेट किए गए कोड की आलोचना करने के लिए दूसरे मॉडल का उपयोग करता है। 🔗 ट्वीट
  • Perplexity Computer: GitHub, सबसे अधिक उपयोग किया जाने वाला connector — अधिकतर गैर-डेवलपर्स द्वारा (5 में से 4)। 🔗 ट्वीट
  • Suno Studio 2.0 (teaser) — Suno के संगीत प्रोडक्शन वातावरण का नया संस्करण, बिना अतिरिक्त विवरण के। 🔗 ट्वीट
  • न्यूयॉर्क में 11 नवंबर को ElevenLabs Summit — तकनीकी और व्यापारिक नेताओं को एकत्र करने वाला सम्मेलन दिवस; आवेदन खुले हैं। 🔗 ट्वीट
  • FLUX 3 Video विश्व में #2 स्थान की पुष्टि करता है — Black Forest Labs 16 अगस्त तक playground की मुफ्त पहुँच बढ़ाता है और 4K तथा वीडियो संपादन का टीज़र देता है। 🔗 ट्वीट
  • Runway पर Seedance 2.5 में 50 कैरेक्टर संदर्भ जोड़े गए — और एक संगीत ट्रैक पर सिंक किए गए क्लिप्स। 🔗 ट्वीट
  • Runway पर P-Image-Ideogram उपलब्ध — केवल 0,6 सेकंड में एक इमेज जनरेट करता है, चार गुणवत्ता मोड्स के साथ। 🔗 ट्वीट
  • Databricks पर Kimi K3 उपलब्ध — Moonshot AI मॉडल के लिए नया वितरण चैनल। 🔗 ट्वीट
  • OpenAI, ChatGPT Work के साथ अपने मार्केटिंग को रूपांतरित करता है — लीड फ़नल में त्याग कम, स्वचालित रिपोर्टिंग। 🔗 OpenAI
  • Virgin Atlantic ChatGPT Work के साथ अपने ग्राहक प्रवाहों का अनुकूलन करता है — तेज़ उत्पाद खोज और योजना। 🔗 OpenAI
  • Cohere — Aidan Gomez ओपन सोर्स और संप्रभु रणनीति का विवरण देते हैं — अनुकूलन योग्य, किफायती और सुरक्षित मॉडल केंद्रीय सूत्र के रूप में। 🔗 ट्वीट

इसका क्या मतलब है

जन-उपयोग AI का पैमाना अब एक नए स्तर पर जा रहा है: मासिक एक अरब उपयोगकर्ताओं के साथ, Gemini Google के सबसे विशाल उत्पादों के बेहद सीमित क्लब में शामिल हो जाता है, ऐसे उपयोग-प्रसंगों से संचालित जो केवल टेक्स्ट चैट से कहीं आगे जाते हैं (आवाज़, कैमरा, स्वचालन)। इसके समानांतर, OpenAI अपने ChatGPT विज्ञापनों को पाँच नए बाज़ारों तक बढ़ा रहा है — यह संकेत है कि जब उपयोगकर्ता आधार पर्याप्त बड़ा और वफ़ादार हो जाता है, तब संवादात्मक सहायकों का बड़े पैमाने पर मुद्रीकरण एक रणनीतिक प्राथमिकता बन जाता है।

इन्फ्रास्ट्रक्चर की ओर, यह दिन विशेषीकृत एजेंटिक निष्पादन की ओर झुकाव को दर्शाता है, केवल फ्रंटियर तर्क तक सीमित न रहते हुए। NVIDIA Nemotron 3.5 Lightning और NeMo Switchyard के साथ एक स्पष्ट आर्थिक मॉडल प्रस्तुत करता है: महंगे मॉडलों को जटिल योजना के लिए सुरक्षित रखना और उच्च-आयतन निष्पादन को हल्के तथा सस्ते मॉडलों को सौंपना, तथा कई साझेदारों के यहाँ मापे गए लागत लाभ हासिल करना। IBM Research (ALTK-Evolve) और Together AI (autoscaling, IBM Cloud साझेदारी) इन्फ़रेंस के उसी आर्थिक मार्ग को आगे बढ़ाते हैं, जबकि Mistral European Compute Units और क्षेत्रीय inference के साथ अपने संप्रभु प्रयास को आकार दे रहा है।

वज़न का खुलापन नए खिलाड़ियों और नई विधाओं तक लगातार फैल रहा है: Alibaba का Wan-Animate-2, webAI का TwiL-LM3, आने वाला Qwen3.8-27B, Meta का Muse Spark 1.2 का वादा, और यहाँ तक कि NVIDIA तकनीकी स्टैक पर निर्मित एक पहला कोरियाई फ्रंटियर मॉडल (Motif 3)। यह भौगोलिक और बहु-माध्यमी विविधीकरण — टेक्स्ट, एनिमेशन, एम्बेडेड तर्क — पुष्टि करता है कि open source अब पश्चिमी प्रयोगशालाओं के एक छोटे समूह की बपौती नहीं रहा।

अंततः, डेवलपर एजेंटिक टूलिंग का पेशेवर होना जारी है: Amp और Replit प्रबंधन की परतें जोड़ रहे हैं (global plugins, विस्तारित MCP), GitHub कम लागत वाले मॉडलों की अपनी पेशकश को और मजबूत कर रहा है, और OpenAI Codex तथा ChatGPT Work को कहीं और किए गए काम को आयात करने की अनुमति देकर प्रतिस्पर्धी इकोसिस्टमों के बीच स्पष्ट सेतु बना रहा है — यह पोर्टेबिलिटी पर दाँव है, न कि बंदीकरण पर, उस समय में जब डेवलपर्स कई AI एजेंटों के बीच समानांतर रूप से काम कर रहे हैं।


स्रोत