खोजें

Claude ने चैट और Cowork को एक किया, Zed ने Delta को सभी के लिए खोला और Vera Rubin ने MLPerf में शुरुआत की

कृत्रिम बुद्धिमत्ता द्वारा जनित लेख
Claude ने चैट और Cowork को एक किया, Zed ने Delta को सभी के लिए खोला और Vera Rubin ने MLPerf में शुरुआत की

ai-powered-markdown-translator

लेख का फ़्रेंच से हिंदी में अनुवाद gpt-5.6-sol के साथ किया गया।

GitHub पर प्रोजेक्ट देखें ↗

इस बुधवार Anthropic ने चैट और Cowork को एक ही Claude में मिला दिया, जो अपने उपकरण स्वयं चुनता है, और Claude Docs तथा Claude Slides को बीटा में लॉन्च किया। Zed ने pull request की जगह थ्रेड के भीतर समीक्षा लाकर Delta को सभी के लिए खोल दिया, और जिस समय बिजली AI फैक्ट्रियों की प्रमुख बाधा बन रही है, NVIDIA ने MLPerf Inference v6.1 में Vera Rubin NVL72 की शुरुआत की। ब्रांड एजेंट भी ChatGPT और YouTube दोनों पर विज्ञापनों में प्रवेश कर रहे हैं, जबकि Cohere ने Aleph Alpha के साथ अंतिम समझौते पर हस्ताक्षर किए और Mistral Firefox में आ गया।


एक ही Claude: चैट और Cowork का विलय, Claude Docs और Claude Slides बीटा में उपलब्ध

16 सितंबर — Anthropic ने चैट और Claude Cowork का विलय कर दिया: अब मोड चुनने की आवश्यकता नहीं है, Claude स्वयं तय करता है कि वेब पर खोजना है, फ़ाइलें पढ़नी हैं या कोड चलाना है, और तैयार फ़ाइलें प्रदान करता है। कंप्यूटर बंद होने पर भी लंबे कार्य क्लाउड में जारी रहते हैं, लेकिन स्थानीय फ़ाइलों, अंतर्निहित ब्राउज़र और कंप्यूटर नियंत्रण (computer use, Pro तथा Max पर बीटा में) के लिए Claude Desktop का खुला होना आवश्यक है।

Today, chat and Cowork start merging into one Claude. The direction: one Claude that carries context across everything you’re working on, wherever you are.

🇮🇳 आज चैट और Cowork का एक ही Claude में विलय शुरू हो रहा है। दिशा यह है: एक ऐसा Claude, जो आप जहाँ भी हों, आपके द्वारा किए जा रहे हर काम का संदर्भ बनाए रखे।X पर Boris Cherny (Anthropic)

नए Claude Docs और Claude Slides दस्तावेज़ तथा प्रस्तुतियाँ बनाते हैं, और अप्रैल में लॉन्च हुआ Claude Design अब बातचीत के भीतर काम करता है। तीनों सशुल्क योजनाओं पर बीटा में हैं और Enterprise प्रशासक इन्हें वैकल्पिक रूप से सक्षम कर सकते हैं। प्रत्येक रचना लिंक से साझा की जा सकती है और प्रस्तुतियाँ PowerPoint या PDF में निर्यात की जा सकती हैं। डिफ़ॉल्ट सेटिंग वाले मैन्युअल मोड में Claude प्रत्येक कार्रवाई से पहले अनुमति माँगता है; ऑटो मोड में प्रत्येक कार्रवाई से पहले स्वचालित सुरक्षा जाँच की जाती है।

योजना या संबंधित उपयोगकर्ताघोषित समय-सारणी
Pro और Max (वेब, डेस्कटॉप, मोबाइल)« आने वाले सप्ताहों में », कुछ भी सक्रिय करने की आवश्यकता नहीं
Team और Free« जल्द », कोई तारीख नहीं
Enterpriseकिसी भी बदलाव से कम-से-कम 30 दिन पहले सूचना

बदलाव स्थायी है, लेकिन Cowork के कार्य, प्रोजेक्ट, कनेक्टर, skills और artifacts सुरक्षित रखे जाते हैं। लॉन्च के समय सहायता केंद्र ने कुछ सीमाएँ बताईं: GitHub से जोड़ने या बातचीत की शाखा बनाने की सुविधा नहीं है, incognito बातचीत पुराने अनुभव में खुलती है, पुराने Cowork कार्य खोज में दिखाई नहीं देते और Dispatch नए उपयोगकर्ताओं के लिए बंद है। चैट और Cowork पहले से ही 7 जुलाई से प्रोजेक्ट तथा artifacts और 25 अगस्त से मेमोरी साझा कर रहे थे।

🔗 Anthropic का आलेख 🔗 सहायता केंद्र

Design, Slides और Docs Claude Code में भी काम करते हैं

उसी दिन @ClaudeDevs ने बताया कि Claude Design, Claude Slides और Claude Docs Claude Code में भी काम करते हैं: इसमें Claude को रिपॉज़िटरी की वास्तविक फ़ाइलों और RFC की ओर निर्देशित करके डिज़ाइन समीक्षा प्रस्तुति (design review deck) या इंटरफ़ेस का प्रारूप माँगा जा सकता है, परिणाम को स्वयं या बातचीत में बदला जा सकता है और फिर लिंक साझा किया जा सकता है। Design के लिए यह पहली बार नहीं है, क्योंकि /design कमांड 17 अगस्त से प्रारंभिक शोध में उपलब्ध है: नई बात Slides और Docs की है। ट्वीट में न तो न्यूनतम संस्करण, न योजनाएँ और न ही दस्तावेज़ीकरण बताया गया है, और नवीनतम प्रकाशित संस्करण की टिप्पणियों में भी इसका उल्लेख नहीं है।

🔗 X पर @ClaudeDevs की घोषणा


Zed ने Delta को सार्वजनिक बीटा में खोला और pull request की जगह थ्रेड के भीतर समीक्षा दी

16 सितंबर — Zed ने Delta को सभी के लिए खोल दिया। 12 अगस्त को पंजीकरण के साथ लॉन्च होने और फिर 4 सितंबर को पंजीकृत उपयोगकर्ताओं के लिए Windows पर आने के बाद, अब यह उपकरण macOS, Linux और Windows पर स्वतंत्र रूप से डाउनलोड किया जा सकता है, बिना इंस्टॉलेशन वेब पर उपयोग किया जा सकता है और इसके चर्चा-थ्रेड (threads) मोबाइल से देखे जा सकते हैं।

मुख्य विचार commit या push के बिना सहयोग करना है। एजेंट के साथ बातचीत में आमंत्रित सहकर्मी उन्हीं कार्यशील प्रतियों (worktrees) को देखता है, उन्हें अपनी मशीन पर आगे बढ़ा सकता है, एजेंट से उसके निर्णयों के बारे में पूछ सकता है या लेखक के डिस्कनेक्ट होने पर काम जारी रख सकता है। 10 सितंबर को पूर्वावलोकन में दिखाई गई कोड समीक्षा pull request की जगह लेती है: मूल एजेंट के संदर्भ के साथ एक उप-थ्रेड समीक्षक को शाखा के बदलावों से परिचित कराता है और यह worktrees की एक अलग प्रति पर चलता है। इसके बाद /land कमांड एजेंट को सभी बदलाव एक commit में समेटने, CI चलाने, टीम की स्वीकृति के बाद विलय करने और शाखा हटाने का कार्य सौंपता है।

Delta की रिपॉज़िटरी में घोषणा से एक सप्ताह पहले ही pull requests बंद कर दिए गए थे और तब से वहाँ 33 लोगों ने 570 बदलावों का विलय किया है; Zed संपादक की रिपॉज़िटरी « फिलहाल » GitHub पर बनी हुई है। आंतरिक रूप से DeltaDB, Git के संस्करण नियंत्रण को वृद्धिशील deltas से पूरा करता है, जो दो commits के बीच मनुष्यों और एजेंटों के बदलाव तथा संदेश सुरक्षित रखते हैं; commit नियंत्रण-बिंदु बना रहता है, इसलिए जो सहकर्मी कभी Delta नहीं खोलता, उसे एक सामान्य Git रिपॉज़िटरी दिखाई देती है।

Zed का कहना है कि वह GitHub.com की जगह लेना चाहता है और इस कार्य-पद्धति को सतत इंजीनियरिंग (continuous engineering) कहता है; उसकी बिना तारीख वाली रूपरेखा में DeltaDB में Git भंडारण की योजना है और भविष्य में थ्रेड के भीतर CI जैसी जाँच पर भी विचार किया गया है। बीटा के दौरान Delta निःशुल्क है, सशुल्क पेशकशों की घोषणा « जल्द » के लिए की गई है, लेकिन कीमत या तारीख नहीं बताई गई, और Zed ने निःशुल्क संस्करण बनाए रखने का वादा किया है।

🔗 Delta के सार्वजनिक बीटा पर Zed का आलेख 🔗 /land कमांड पर Zed का थ्रेड


Vera Rubin NVL72 ने MLPerf Inference v6.1 में GB300 NVL72 से 3.7 गुना अधिक थ्रूपुट के साथ शुरुआत की

16 सितंबर — NVIDIA ने अपने अगली पीढ़ी के rack प्लेटफ़ॉर्म Vera Rubin NVL72 को MLPerf Inference v6.1 में पेश किया, जिसके परिणाम MLCommons ने प्रकाशित किए हैं और जिसमें पूर्वावलोकन (preview) प्रस्तुतियाँ शामिल हैं। NVIDIA द्वारा अपनी ही प्रस्तुतियों की तुलना के अनुसार, vLLM और NVIDIA Dynamo के साथ ऑफ़लाइन, सर्वर तथा इंटरैक्टिव परिदृश्यों में rack ने Qwen3-VL पर GB300 NVL72 से 3.7 गुना तक और TensorRT-LLM के साथ DeepSeek-R1 पर 2.5 गुना तक अधिक थ्रूपुट प्राप्त किया। Nebius ने भी Vera Rubin NVL72 के पूर्वावलोकन परिणाम प्रस्तुत किए।

NVIDIA इन लाभों का श्रेय हार्डवेयर और सॉफ़्टवेयर की संयुक्त अभिकल्पना को देता है: weights, attention और KV cache के लिए NVFP4 परिशुद्धता, prefill और decoding को अलग करने वाली पृथक सेवा, बड़े पैमाने का expert parallelism और छठी पीढ़ी का NVLink domain, जिसके बारे में NVIDIA का दावा है कि उसका packet throughput मानक Ethernet से 10 गुना अधिक है। वर्तमान पीढ़ी के आँकड़े भी प्रकाशित किए गए हैं:

MLPerf Inference v6.1 परीक्षणप्रस्तुत प्रणालीNVIDIA द्वारा प्रकाशित परिणाम
DeepSeek-R1 ऑफ़लाइन, 72 से 288 GPUGB300 NVL72, 1 से 4 racks99% scaling दक्षता
WAN 2.2, टेक्स्ट से वीडियोGB300 NVL72प्रति सेकंड 0.65 720p वीडियो, प्रति वीडियो 5.7 सेकंड
Qwen3-VL, v6.1 की तुलना v6.0 सेGB300 NVL72सॉफ़्टवेयर के कारण 1.6 गुना तक
Edge-Agentic, नया परीक्षण (Qwen3.6-27B)Jetson AGX Thor, TensorRT Edge-LLMआलेख में आँकड़े के बिना प्रस्तुति

NVIDIA ने अंतिम तारीख के बाद GPT-OSS-120B और DLRMv3 पर प्राप्त लाभों की भी जानकारी दी है, जिन्हें MLCommons ने अभी सत्यापित नहीं किया है। कंपनी 19 साझेदारों का दावा करती है, जिनमें आठ Blackwell NVL72 multi-node प्रणालियों पर हैं, और MLCommons के भावी MLPerf Endpoints परीक्षण का उल्लेख करती है, जिसका उद्देश्य agentic inference के मापन को मानकीकृत करना है।

🔗 MLPerf Inference v6.1 की शुरुआत में NVIDIA Vera Rubin NVL72 ने अग्रणी प्रदर्शन दिया


AI फैक्ट्रियों के केंद्र में बिजली: Lambda में DSX MaxLPS और AEMA गठबंधन

15 और 16 सितंबर — NVIDIA की दो घोषणाओं ने AI की तैनाती में विद्युत ग्रिड को केंद्रीय स्थान दिया, और दोनों में Emerald AI शामिल है: उसके सॉफ़्टवेयर द्वारा संचालित एक AI फैक्ट्री ने बिजली प्रदाता की माँग पर खपत घटाई, फिर Emerald AI, Google और NVIDIA ने लचीले data centers के लिए एक गठबंधन शुरू किया।

AI Infra Summit: Lambda ने DSX MaxLPS को सत्यापित किया, AI फैक्ट्री ने ग्रिड की माँग पर खपत घटाई

15 सितंबर — AI Infra Summit में Ian Buck (NVIDIA) की keynote AI फैक्ट्रियों (AI factories) में प्रति megawatt उत्पादित tokens पर केंद्रित थी। Lambda ने NVIDIA के उस सॉफ़्टवेयर DSX MaxLPS को सत्यापित किया, जो GPU और racks की बिजली खपत पर नज़र रखता है तथा कार्यभार के अनुसार बिजली का पुनर्वितरण करता है: 19 HGX B200 nodes, पूरी क्षमता से चल रहे 16 nodes के विद्युत बजट में संचालित हुए, जिससे थ्रूपुट लगभग 4 से बढ़कर 5 मिलियन tokens प्रति सेकंड (+24%) और प्रति watt प्रदर्शन 23% बढ़ गया। NVIDIA का अनुमान है कि « उपयुक्त वातावरणों में » इसी बजट के भीतर Vera Rubin NVL72 के लिए 40% तक अधिक GPU क्षमता मिल सकती है। अगस्त की एक शाम Silicon Valley Power के संकेत ने Emerald AI Conductor द्वारा संचालित Santa Clara की एक AI फैक्ट्री की खपत प्राथमिक inference को बाधित किए बिना स्वचालित रूप से 4 से घटाकर 3 MW कर दी; तब से 200 से अधिक संकेतों का एक मिनट से कम समय में पालन किया गया है। इस प्रकार के संकेतों को संभालने वाले DSX Flex की पहली समर्पित व्यावसायिक तैनाती Virginia के Manassas में 96 MW की Vera Rubin फैक्ट्री में होगी।

🔗 NVIDIA का लाइव ब्लॉग

AEMA, ग्रिड के अनुरूप ढलने वाले data centers के लिए गठबंधन

16 सितंबर — Emerald AI, Google और NVIDIA ने AI Energy Management Alliance (AEMA) शुरू किया, जो ऐसे data centers के लिए गठबंधन है जो ग्रिड की स्थिति के अनुसार अपनी खपत बदल सकें: कार्यभार स्थानांतरित करना, भंडारण से ऊर्जा लेना, संबद्ध उत्पादन पर निर्भर होना या घटनाओं पर प्रतिक्रिया देना। इसके सिद्धांत हैं: कनेक्शन से पहले सेवा बनाए रखने (ride-through), खपत घटाने (curtailment) और घटनाओं पर प्रतिक्रिया की बाध्यताएँ तय करना, metrics को मानकीकृत करना, सत्यापन योग्य लचीलेपन की प्रतिबद्धताओं के लिए तेज़ कनेक्शन मार्ग खोलना और वास्तविक प्रभावों के अनुसार लागत बाँटना। गठबंधन का लक्ष्य संयुक्त राज्य अमेरिका है और उसके शुरुआती साझेदारों के नाम नहीं बताए गए हैं। अपनी वेबसाइट पर वह दो संभावनाएँ बताता है: मध्यम रूप से लचीले data centers से मौजूदा ग्रिड पर 100 GW क्षमता खोली जा सकती है, और नए लचीले data centers के प्रत्येक GW पर 733 मिलियन डॉलर की लागत बचाई जा सकती है। NVIDIA और Emerald AI ने 31 मार्च को CERAWeek में पहले ही लचीली AI फैक्ट्रियाँ प्रस्तुत की थीं।

🔗 AEMA पर NVIDIA का आलेख 🔗 AEMA की वेबसाइट


ब्रांड एजेंट ChatGPT और YouTube के विज्ञापनों में आए

16 सितंबर — उसी दिन OpenAI और Google ने संयुक्त राज्य अमेरिका में ब्रांड के संवादात्मक एजेंट को विज्ञापन प्रारूप में शामिल किया: OpenAI में चुनिंदा विज्ञापनदाताओं के साथ परीक्षण और Google में व्यापारियों के लिए पंजीकरण-आधारित बीटा।

ChatGPT Ads ने Sponsored Agents का परीक्षण किया और HubSpot तथा Shopify से जुड़ा

OpenAI ने अपनी ChatGPT Ads विज्ञापन व्यवस्था के दोनों पक्षों में AI जोड़ा। Sponsored Agents के साथ ChatGPT में किसी विज्ञापन पर क्लिक करने से ब्रांड द्वारा प्रायोजित एजेंट के साथ स्पष्ट रूप से चिह्नित बातचीत खुल सकती है, जिसके बाद उसकी वेबसाइट का लिंक मिलता है। OpenAI ने स्पष्ट किया कि यह संवाद ChatGPT के स्वतंत्र उत्तरों से अलग और मूल बातचीत से पृथक है।

ChatGPT Ads की नई सुविधा16 सितंबर की स्थिति
Sponsored Agentsसंयुक्त राज्य अमेरिका में चुनिंदा विज्ञापनदाताओं के साथ परीक्षण में
Plugin Ads Manager, prompts द्वारा संचालित अभियानतैनाती जारी
Ads Manager में सुझाए गए टेक्स्ट और दृश्यतैनाती जारी
टेक्स्ट का वैयक्तिकरण और अनुवादलॉन्च हो चुके, विकल्प चुनकर सक्रिय किए जा सकते हैं (opt-in)
HubSpot एकीकरणउपलब्ध
Shopify के लिए ChatGPT Ads अनुप्रयोगअमेरिकी व्यापारी, 23 सितंबर से ChatGPT Ads के अन्य बाज़ार

आलेख में न तो कीमत दी गई है और न विज्ञापनदाताओं की संख्या। फरवरी में ChatGPT के भीतर परीक्षण किए गए विज्ञापन को मई में बीटा और self-service Ads Manager मिला, फिर OpenAI ने इस self-service का विस्तार करते हुए 31 अगस्त को एक अरब डॉलर की वार्षिकीकृत आय का दावा किया।

🔗 AI के साथ विज्ञापन की पुनर्कल्पना

Google ने Business Agent को YouTube विज्ञापनों में रखा और agentic commerce का विस्तार किया

Google ने त्योहारों के मौसम के लिए अपने agentic commerce अपडेट प्रकाशित किए। Google के अनुसार « इस वर्ष पहले » Search में आया Business Agent अब व्यापारियों के पंजीकरण पर संयुक्त राज्य अमेरिका के YouTube विज्ञापनों में बीटा के रूप में उपलब्ध है: दर्शक YouTube छोड़े बिना एजेंट से उत्पादों के बारे में पूछ सकता है। AI performance insights, जो AI Mode और AI Overviews में किसी ब्रांड की उपस्थिति के हिस्से (share of voice) की तुलना करता है, अब Australia, Canada, India, New Zealand और संयुक्त राज्य अमेरिका के Merchant Center में उपलब्ध है। Merchant Center में UCP (Universal Commerce Protocol) का integration hub—Google द्वारा 11 जनवरी को प्रस्तुत protocol—व्यापारी की वेबसाइट पर cart transfer और checkout journey के परीक्षण जोड़ता है, जबकि analytics « जल्द » आएँगे; ये सुविधाएँ संयुक्त राज्य अमेरिका में धीरे-धीरे लागू हो रही हैं और फिर Australia तथा Canada में « अगले वर्ष की शुरुआत में » आएँगी। Tapestry (Coach, Kate Spade) पहले से ही Search और Gemini अनुप्रयोग में UCP के माध्यम से बिक्री कर रहा है। Google के अनुसार, product feed की अच्छी कार्य-पद्धतियाँ अगले महीने औसतन 5% अधिक conversions देती हैं और lululemon के साथ परीक्षणों में ब्रांड की conversational attributes को AI Mode की 50% प्रासंगिक recommendations में शामिल किया गया।

🔗 agentic commerce पर Google का आलेख


Cohere ने Aleph Alpha के साथ हस्ताक्षर किए और Model Vault में Confidential Computing लॉन्च किया

16 सितंबर — Cohere ने कई घोषणाएँ कीं, जिनमें से दो उन ग्राहकों के लिए हैं जो अपने डेटा और तकनीक पर नियंत्रण बनाए रखना चाहते हैं।

Aleph Alpha: अंतिम समझौता और Berlin व Toronto में दोहरे मुख्यालय

Cohere और Aleph Alpha ने एकीकरण के अंतिम समझौते (definitive business combination agreement) पर हस्ताक्षर कर दिए हैं, जिसकी योजना की घोषणा 24 अप्रैल को की गई थी। संयुक्त इकाई Cohere नाम से काम करेगी, जिसमें 1,000 से अधिक कर्मचारी होंगे, Berlin और Toronto में दोहरे मुख्यालय तथा Aleph Alpha के परिसर में Heidelberg स्थित एक अनुसंधान केंद्र होगा। इस लेनदेन की राशि का खुलासा नहीं किया गया है और यह अभी अंतिम नियामकीय स्वीकृतियों के अधीन है; इसके “इस वर्ष के अंत में” पूर्ण होने की उम्मीद है। इसके बाद Aleph Alpha के सह-CEO Ilhan Scheer, Cohere के संचालन निदेशक और सह-संस्थापक Samuel Weinbach अनुसंधान निदेशक बनेंगे। Schwarz समूह के साथ उसके संप्रभु cloud STACKIT पर साझेदारी जारी रहेगी।

No government or enterprise should have to choose between capable AI and control over their tech. That belief is exactly why we’re joining forces with Aleph Alpha. Together, we’ll meet the rising global demand for frontier AI that’s both powerful and secure.

🇮🇳 किसी भी सरकार या कंपनी को शक्तिशाली AI और अपनी तकनीक पर नियंत्रण के बीच चुनाव नहीं करना चाहिए। ठीक इसी विश्वास ने हमें Aleph Alpha के साथ हाथ मिलाने के लिए प्रेरित किया है। साथ मिलकर हम शक्तिशाली और सुरक्षित, दोनों तरह के frontier AI की बढ़ती वैश्विक माँग पूरी करेंगे। — Aidan Gomez (Cohere), X पर @cohere द्वारा उद्धृत

🔗 समझौते पर Cohere की पोस्ट

Model Vault में Confidential Computing की प्रारंभिक पहुँच

Cohere अपने समर्पित और पूर्णतः प्रबंधित inference प्लेटफ़ॉर्म Model Vault में Confidential Computing शुरू कर रहा है, ताकि डेटा को केवल संग्रहित और स्थानांतरित अवस्था में ही नहीं, बल्कि प्रसंस्करण के दौरान भी सुरक्षित रखा जा सके। इसमें तीन तंत्र बताए गए हैं: आरंभ से अंत तक encrypted inference, NVIDIA Confidential Computing के साथ GPU तक विस्तारित hardware-प्रवर्तित isolation, और अनुरोध पर उपलब्ध एक हस्ताक्षरित attestation token, जिसे hardware निर्माता की public keys से सत्यापित किया जा सकता है। किसी third-party audit का उल्लेख किए बिना Cohere का दावा है कि “हम भी नहीं”, कोई भी ग्राहक के workloads तक पहुँच नहीं सकता। प्रारंभिक पहुँच beta ग्राहकों के एक सीमित समूह के लिए आरक्षित है; कीमत, सामान्य उपलब्धता की तारीख या models की सूची नहीं दी गई है, और घोषणा केवल tweets तथा एक product page तक सीमित है। इस सुविधा के जल्द आने की घोषणा 9 सितंबर को की गई थी।

🔗 X पर Cohere की घोषणा 🔗 Model Vault का product page


Mistral ने Firefox के AI सहायक Smart Window को शक्ति दी

16 सितंबर — एक संयुक्त पोस्ट में Mistral AI और Mozilla ने घोषणा की है कि अभी beta में मौजूद Firefox का AI browsing सहायक Smart Window अब Mistral models पर चलता है, हालाँकि यह स्पष्ट नहीं किया गया कि किन models पर। यह सहायक जटिल शोध को सुलझाने और खुले tabs से स्रोत एकत्र करने में मदद करता है। Mistral शुरुआत में France और North America के उपयोगकर्ताओं के लिए इसे शक्ति दे रहा है, जबकि United Kingdom और Germany में इसके “इस वर्ष के अंत में” आने की उम्मीद है। डिफ़ॉल्ट रूप से बातचीत Mozilla के servers पर संग्रहीत नहीं होती, और Mistral जैसे साझेदार डेटा को बिल्कुल न रखने (zero data retention) की प्रतिबद्धता जताते हैं। Mistral के अनुसार, जो “परंपरागत रूप से” व्यवसायों को सेवाएँ देता आया है, यह समझौता आम जनता तक पहुँच खोलता है। Mistral के सह-संस्थापक और CEO Arthur Mensch इसे open source के दो समर्थकों का साथ मिलकर काम करना बताते हैं, जबकि Mozilla Corporation के CEO Anthony Enzor-DeMeo का मानना है कि browser को एकतरफ़ा funnel नहीं होना चाहिए।

🔗 Mistral और Mozilla की संयुक्त पोस्ट


Grok Build एक session से दूसरे session तक परियोजना की परंपराएँ और निर्णय याद रखता है

16 सितंबर — SpaceXAI ने अपने coding agent Grok Build को memory दी है। हर पूर्ण turn के बाद Grok, session को रोके बिना, पृष्ठभूमि में उसे दोबारा पढ़ता है और स्थायी बातों को Markdown note में दर्ज करता है: team conventions, निर्णय और उनके औचित्य, तथा परियोजना से जुड़े तथ्य, जैसे tests चलाने वाला command। कार्यों की स्थिति, अस्थायी निष्कर्ष, secrets और repository या उसके documentation में पहले से शामिल जानकारी को बाहर रखा जाता है। Notes को परियोजना के अनुसार व्यवस्थित किया जाता है और हर जगह लागू होने वाली प्राथमिकताओं के लिए एक global set होता है। Command /dream इन्हें विषयगत files में समूहित करता है और समय-समय पर स्वयं भी चलता है, जबकि /memory read-only browser खोलता है। किसी परियोजना पर लौटने पर Grok उस क्षेत्र से जुड़े विषय पढ़ता है जहाँ वह काम करने वाला है, लेकिन वर्तमान conversation को notes पर प्राथमिकता मिलती है। Memory केवल नए sessions पर लागू होती है। 25 मई की beta सूची में sessions के बीच decisions को बनाए रखने की सुविधा पहले से शामिल थी; यह पोस्ट उसके तंत्र का विवरण देती है।

🔗 Grok Build में Memory


Qwen Code v0.24.0 Linux में agent को kernel स्तर पर सीमित करता है और bash hooks बदलता है

16 सितंबर — v0.23.4 के दो दिन बाद, Qwen Code v0.24.0 ने Linux में bubblewrap (bwrap) के माध्यम से kernel-आधारित sandbox जोड़ा है, जिसके लिए container, root permissions, daemon या image की आवश्यकता नहीं है। विकल्प सक्रिय करने पर यह CLI को filesystem के read-only view के पीछे दोबारा चलाता है, जहाँ केवल workspace और कुछ directories (temporary, cache, Qwen, Git) में लिखा जा सकता है; qwen sandbox configuration दिखाता है और --verify confinement का परीक्षण करता है। PR के लेखक ने इसकी सीमाएँ बताई हैं: अलग PID namespace नहीं है, host के Unix sockets तक पहुँचा जा सकता है, और Git तथा Qwen settings बदली जा सकती हैं। असंगत बदलाव (breaking change): bash में चलने वाले hooks में environment से पढ़े जाने वाले $QWEN_PROJECT_DIR और उसके Claude तथा Gemini equivalents को, substitution के बजाय, double quotes में रखना होगा। web_search की प्रति session सीमा तय है (डिफ़ॉल्ट रूप से 200, अधिकतम 10,000), message में +500k जैसा budget पूरे turn का आकार निर्धारित करता है, और sessions के बीच messaging डिफ़ॉल्ट रूप से सक्रिय है।

🔗 Release notes


Devin ने Code Scans पेश किया, जो किसी लक्ष्य से निर्देशित संपूर्ण codebase audits करता है

16 सितंबर — Cognition ने Devin में Code Scans पेश किया है: इसमें किसी विशिष्ट बदलाव के बजाय एक व्यापक लक्ष्य से शुरुआत होती है, जिसमें आवश्यकता पड़ने पर अपने मानदंड (team standards, accessibility checklist, migration requirements) दिए जा सकते हैं, और Devin codebase की जाँच करता है, अपने निष्कर्षों को प्राथमिकता देता है, उन पर चर्चा करता है और फिर माँगी गई pull requests खोलता है। Web application में /scan से शुरू होने वाला यह scan, जिसका उल्लेख 2 सितंबर के release notes में पहले ही किया गया था, जुलाई में प्रस्तुत Devin Security Swarm की agentic MapReduce (Agentic MapReduce) architecture को चार चरणों में अपनाता है: planning, batches में विभाजन, समानांतर exploration और synthesis। Cognition ने दो परीक्षण प्रकाशित किए हैं: Dioxus पर 22 crates का पूरा debug build 58.6 से घटकर 21.0 seconds रह गया, यानी 64% कम; devin.ai और cognition.com के SEO scan में 44 निष्कर्ष मिले, जिसके बाद devin.ai का Ahrefs score 87 से बढ़कर 92 हो गया और उसके धीमे pages की संख्या 73% घट गई। कोई कीमत नहीं बताई गई है।

🔗 Code Scans का परिचय


Claude for Small Business में अब 43 workflows और 27 नए integrations

15 सितंबर — हमारी 15 सितंबर की समीक्षा में छूट गई एक पोस्ट में Anthropic ने Claude for Small Business का विस्तार किया है। छोटे व्यवसायों के लिए यह plugin मई में 15 workflows के साथ शुरू किया गया था। अब इसमें 43 workflows हैं, साथ ही Shopify, Salesforce, TikTok, Atlassian, Zoom, Xero, Gusto, Square, Stripe और Zapier सहित 27 नए integrations हैं, और कंपनी 900,000 से अधिक installations का दावा करती है। प्रत्येक workflow approval mode में शुरू होता है और autonomy को हर workflow के लिए अलग-अलग तथा वापस बदले जा सकने वाले तरीके से समायोजित किया जा सकता है। Anthropic ने training को भी फिर शुरू किया है: Tenex के साथ 10 अमेरिकी शहरों में autumn tour, 750 से अधिक workshops के लिए 150 से अधिक मान्यताप्राप्त training organizations, और 14 partner webinars। यह पेशकश सभी paid plans पर उपलब्ध है; spring tour का आकलन 10 सितंबर को प्रकाशित किया गया था।

🔗 Claude for Small Business पर Anthropic की पोस्ट


ElevenLabs ने छोटे व्यवसायों के लिए AI receptionist Reception पेश किया

16 सितंबर — ElevenLabs ने अपने ElevenAgents प्लेटफ़ॉर्म पर निर्मित छोटे व्यवसायों के लिए AI receptionist Reception पेश किया है। यह सेवाओं, समय-सारणी या पते से जुड़े प्रश्नों का कॉल करने वाले की भाषा में चौबीसों घंटे उत्तर देता है और फिर calendar में appointment बुक करता है। इसे तब overflow के रूप में उपयोग किया जा सकता है जब team फ़ोन न उठाए, या बंद होने के बाद। सेवा की अपनी website reception.ai है और इसे 30 मिनट की calls के साथ 14 दिनों तक निःशुल्क आज़माया जा सकता है।

Reception योजनाकर रहित मासिक मूल्यशामिल call minutes
Basic29 डॉलर75
Plus79 डॉलर275
Premium199 डॉलर1 000
Enterpriseअनुमान के आधार परआवश्यकता के अनुसार

सभी योजनाओं में 70 से अधिक भाषाएँ, Google Calendar, Calendly, Zapier, webhooks और एक MCP server शामिल हैं।

🔗 ElevenAgents द्वारा Reception का परिचय 🔗 Reception की कीमतें


Synthesia ने अपना Interactive Avatar API जारी किया, real-time avatars 0.10 euro प्रति minute पर

16 सितंबर — Synthesia ने अपने Interactive Avatar API को सामान्य रूप से उपलब्ध करा दिया है, जो किसी product में सुनने, बोलने और real time में जवाब देने में सक्षम avatars को जोड़ता है। ग्राहक अपना LLM, knowledge base और logic देता है; Synthesia चेहरा, आवाज़ और lip synchronization संभालता है। Avatar एक plugin की मदद से video participant के रूप में LiveKit room में शामिल होता है, जो FAQ के अनुसार फिलहाल केवल Python में लिखे LiveKit agents को support करता है। API का usage-based शुल्क 0.10 euro प्रति minute है, कोई प्रतिबद्धता नहीं है और 500 minutes निःशुल्क दिए जाते हैं। Pipecat plugin और पूरी तरह प्रबंधित LLM, knowledge तथा voice वाली end-to-end पेशकश की घोषणा “जल्द” के लिए की गई है, लेकिन कोई तारीख नहीं दी गई। Synthesia ने जुलाई में अपने interactive avatar models का research framework प्रकाशित किया था।

🔗 X पर Synthesia की घोषणा 🔗 Synthesia का Interactive Avatars page


Koa, Nemotron 3 Super पर निर्मित Salesforce का CRM model

15 सितंबर — Dreamforce में Salesforce ने Koa पेश किया, जो customer relationship management (CRM) के लिए उसका पहला समर्पित reasoning model है। इसे synthetic dataset पर NeMo RL, NeMo Gym और NeMo AutoModel के साथ NVIDIA Nemotron 3 Super को post-training देकर बनाया गया है। Salesforce weights को नियंत्रित करता है और model को अपने infrastructure पर चलाता है; Salesforce के अनुसार न तो training में किसी customer data का उपयोग हुआ और न inference में होता है। अपने benchmark CRM Bench (opportunity update, case routing, follow-up scheduling) पर Koa अग्रणी models की बराबरी करता है या उनसे बेहतर प्रदर्शन करता है और तीन गुना कम errors करता है, हालाँकि तुलना में शामिल models के नाम नहीं बताए गए हैं। Slack में पहले से आंतरिक रूप से उपयोग हो रहा Koa, October में Agentforce में चुनने योग्य model के रूप में pilot चरण में प्रवेश करेगा, जिसमें Formula 1 और Xero भी शामिल हैं। इसके बाद अमेरिकी क्षेत्रों में winter 2026 में सामान्य उपलब्धता की उम्मीद है।

🔗 Dreamforce में Jensen Huang पर NVIDIA की पोस्ट


Runway ने अपने भावी video models के real-time moderation का विवरण दिया

16 सितंबर — Runway “आने वाले महीनों में” real-time video generation models लॉन्च करने की योजना बना रहा है और उसने बताया है कि वह उनका moderation कैसे करेगा। निरंतर प्रसारण (streaming) में उपयोगकर्ता किसी भी अंतिम जाँच से पहले video देखता है। इसलिए Runway ने एक तेज़ व्यवस्था बनाई और परखी है: inputs की त्वरित जाँच, synchronous moderation जो stream की images का विश्लेषण करेगा और समस्याग्रस्त content दिखते ही प्रसारण रोक देगा, फिर किसी भी download या share से पहले पूरे video की जाँच। Classifier, Zentropi का CoPE-B है, जो Gemma-4-26B-A4B-it पर एक LoRA adapter है। यह 25.2 billion parameters वाला mixture of experts है, जिनमें 3.8 billion सक्रिय रहते हैं; verification में औसतन 0.5 second से कम समय लगता है। परीक्षण में कुछ सीमांत inputs के कारण रोक लगाए जाने से पहले प्रतिबंधित content थोड़ी देर के लिए दिखाई दिया। यह व्यवस्था Runway की मौजूदा protections में जोड़ी जाएगी और उसके अन्य creations की तरह real-time videos में भी C2PA provenance signals होंगे।

🔗 Real Time में Moderation


संक्षिप्त समाचार

  • Zed 1.20.1 में Gemini 3.8 Flash जोड़ा गया — एडिटर के साप्ताहिक स्थिर संस्करण में वैकल्पिक कर्सर एनिमेशन, Markdown फ़ाइलों को रेंडर किए गए पूर्वावलोकन में खोलने की सुविधा और लगभग 25% छोटे macOS तथा Linux बाइनरी भी शामिल हैं; साथ ही उस खामी को ठीक किया गया है जो प्रोजेक्ट खोज के ज़रिए सहयोगियों के सामने निजी फ़ाइलें उजागर कर सकती थी। 🔗 स्रोत
  • Replit ने कस्टम कनेक्टर (Custom Connectors) बीटा में उपलब्ध कराए — किसी कार्यक्षेत्र के व्यवस्थापक इसमें API कुंजी से प्रमाणित HTTPS वाली REST API घोषित कर सकते हैं, ताकि Agent आधिकारिक कनेक्टरों के अतिरिक्त उसका उपयोग कर सके; दस्तावेज़ में Pro और Enterprise ग्राहकों का उल्लेख है, लेकिन एक सूचना-पट्टिका बीटा को केवल Enterprise तक सीमित बताती है। 🔗 स्रोत
  • NVIDIA ने TileGym को cuTile Rust पर पोर्ट करने का काम एजेंटों को सौंपा — CUDA Rust के लॉन्च के आठ दिन बाद, TileGym में उपलब्ध कराई गई एक बहु-एजेंट skill ने लाइब्रेरी के सभी 24 सार्वजनिक ऑपरेटर पोर्ट कर दिए; DGX B200 पर मापी गई 347 कॉन्फ़िगरेशन में उन्होंने औसतन cuTile Python के 99.5% प्रदर्शन को बनाए रखा। 🔗 स्रोत
  • OpenAI ने Admin Console के विश्लेषणों की मार्गदर्शिका प्रकाशित की — Usage, Insights और Outcomes दृश्य, जिनमें अंतिम दृश्य Codex के योगदान वाले मर्ज किए गए कमिटों का अनुपात मापता है, ChatGPT Work और Codex के उपयोग को परिणामों से जोड़ने के लिए बनाए गए हैं; उद्धृत 245% निवेश प्रतिफल को स्पष्ट रूप से काल्पनिक बताया गया है, और हमारे अवलोकन के समय संबद्ध दस्तावेज़ नहीं मिला। 🔗 स्रोत
  • OpenAI API ने कुंजियों के निर्माण पर नियंत्रण जोड़े — समाप्ति तिथियाँ आने के पाँच दिन बाद, 15 सितंबर को चेंजलॉग में जोड़ा गया API Key Governance अनुभाग व्यवस्थापकों को केवल सेवा-खाता कुंजियाँ या केवल किसी उपयोगकर्ता के स्वामित्व वाली प्रोजेक्ट कुंजियाँ अधिकृत करने अथवा सभी नई कुंजियों को अवरुद्ध करने देता है; मौजूदा कुंजियाँ नहीं बदलतीं। 🔗 स्रोत
  • Copilot: अतिरिक्त बजट के अनुरोध सामान्य उपलब्धता में पहुँचे — उपयोग-आधारित बिलिंग वाले Copilot Business और Enterprise में, अपने AI क्रेडिट समाप्त कर चुका सदस्य अतिरिक्त बजट माँग सकता है; स्वामी और बिलिंग प्रबंधक राशि निर्धारित करके अनुरोध स्वीकृत करते हैं, जिससे पहुँच तुरंत बहाल हो जाती है। 🔗 स्रोत
  • पुल रिक्वेस्ट के AI Scan के लिए अब CodeQL की डिफ़ॉल्ट कॉन्फ़िगरेशन आवश्यक नहीं — पुल रिक्वेस्ट में AI-आधारित भेद्यता पहचान अब इस कॉन्फ़िगरेशन के बिना भी पात्र रिपॉज़िटरी तक विस्तारित हो रही है; यह github.com पर GitHub Advanced Security ग्राहकों के लिए सार्वजनिक पूर्वावलोकन में है, जबकि GitHub Enterprise Server समर्थित नहीं है। 🔗 स्रोत
  • GitHub Advanced Security कॉन्फ़िगरेशन अब संगठनों पर भी लागू किए जा सकते हैं — 15 सितंबर से एंटरप्राइज़ व्यवस्थापक न केवल रिपॉज़िटरी स्वामियों, बल्कि संगठन व्यवस्थापकों को भी एंटरप्राइज़ स्तर पर निर्धारित सुरक्षा कॉन्फ़िगरेशन बदलने से रोक सकते हैं। 🔗 स्रोत
  • GitHub ने HTTPS में SHA-1 निष्क्रिय किया — 20 अप्रैल को की गई घोषणा के अनुरूप, 15 सितंबर का चेंजलॉग github.com और उसके साझेदार CDN से HTTPS कनेक्शन में SHA-1 की समाप्ति की पुष्टि करता है, जिसमें GitHub Enterprise Cloud भी शामिल है; ब्राउज़र, API क्लाइंट और HTTPS पर Git इससे प्रभावित हैं, लेकिन GitHub Enterprise Server नहीं। 🔗 स्रोत
  • MiniMax H3, Together AI पर सर्वर-रहित (serverless) रूप में उपलब्ध हुआ — 15 सितंबर को प्रशांत समयानुसार शाम 4:58 बजे किए गए एक ट्वीट में घोषित यह 33 अरब पैरामीटर वाला खुला वीडियो मॉडल मूल स्टीरियो ध्वनि के साथ 2K तक के 4 से 15 सेकंड लंबे क्लिप बनाता है और वहाँ इसकी कीमत प्रति वीडियो 0.1391 डॉलर दिखाई गई है। 🔗 स्रोत
  • MiniMax ने H3 IP Edition पेश किया — KAGAMI AI के साथ अपने Tokyo सम्मेलन का सार प्रस्तुत करते हुए MiniMax ने कहा कि उसने आधिकारिक लाइसेंस वाली जापानी बौद्धिक संपदाओं से संबद्ध H3 का एक संस्करण प्रदर्शित किया, लेकिन लाइसेंस सूची, तारीख या मूल्य नहीं बताया। 🔗 स्रोत
  • Runway ने अपने Fall 2026 संग्रह में पाँच तृतीय-पक्ष मॉडल जोड़े — Fish Audio S2.1 Pro, Cartesia Sonic 3.6, MiniMax H3 Max, FLUX Video Upscale और FLUX Video Edit मंच पर आ गए हैं, लेकिन कीमत घोषित नहीं हुई; इनमें से कई पहले से अन्यत्र उपलब्ध थे, जैसे FLUX Video Upscale, Black Forest Labs पर 20 अगस्त से और H3 Max 27 अगस्त से। 🔗 स्रोत
  • Luma ने Camera Angles लॉन्च किया — 15 सितंबर को प्रशांत समयानुसार शाम 4:26 बजे जारी Luma Agents की यह सुविधा किसी एक फ़ोटो के विषय को चुने गए कोणों से, विवरण सुरक्षित रखते हुए, फिर से बनाती है; किसी मॉडल का नाम या आँकड़ा नहीं दिया गया। 🔗 स्रोत
  • Grok Voice अब fal पर उपलब्ध है — इनफ़रेंस मंच SpaceXAI के वॉइस मॉडल को Speech to Speech और रीयल टाइम में उपलब्ध कराता है; fal के अनुसार यह 0.70 सेकंड में उत्तर देता है और इसकी लागत प्रति सेकंड 0.00083 डॉलर है, तथा SpaceXAI के साथ एक लाइव कार्यशाला 22 सितंबर को निर्धारित है। 🔗 स्रोत
  • OpenText और Cohere ने विनियमित क्षेत्रों के लिए साझेदारी की — Montréal के ALL IN AI सम्मेलन में घोषित इस साझेदारी के तहत North और Cohere मॉडल को OpenText Aviator एजेंटों में एकीकृत किया जाएगा, जिन्हें ऑन-प्रिमाइसेस या निजी, सार्वजनिक अथवा संप्रभु क्लाउड पर तैनात किया जा सकेगा; संयुक्त पेशकश के 2027 की शुरुआत में ग्राहकों तक पहुँचने की अपेक्षा है। 🔗 स्रोत
  • Manus ने Singapore में प्रशिक्षण साझेदारियाँ कीं — यह एजेंट SkillsFuture AI Subscription में शामिल है, जो चुनिंदा AI पाठ्यक्रमों में नामांकित पात्र Singapore निवासियों को छह महीने की निःशुल्क पहुँच देता है, और Singtel AI Pass में भी उपलब्ध है; एक अंतर-परिसर चुनौती में 1,100 से अधिक पंजीकरण हुए तथा Manus ने सीखने से जुड़े साझेदारों के लिए वैश्विक आमंत्रण जारी किया है। 🔗 स्रोत
  • University of Manchester ने Earth-2 से वायु प्रदूषण का पूर्वानुमान लगाया — Isambard-AI सुपरकंप्यूटर के 8 GPU वाले एक नोड पर दो दिनों में दोबारा प्रशिक्षित Earth-2 CorrDiff पूरे United Kingdom को 2 से 3 किमी² के रिज़ॉल्यूशन पर कवर करता है, और टीम ने डेटा तथा वर्कफ़्लो को ओपन सोर्स में प्रकाशित करने का वादा किया है। 🔗 स्रोत
  • Children’s Hospital of Philadelphia कुछ सेकंड में हृदयों के मॉडल बनाता है — ओपन-सोर्स MONAI फ़्रेमवर्क पर निर्मित CHOP की सेवा ऐसे हृदय मॉडल तैयार करती है जिनमें पहले लगभग चार घंटे का काम लगता था; इस वर्ष लगभग 200 मामलों की योजना है, और एकीकरणाधीन Newton-आधारित उपकरण डिवाइस लगाने के सिमुलेशन को लगभग रीयल टाइम तक ला सकते हैं। 🔗 स्रोत
  • Google ने अमेरिकी किशोरों और AI पर अध्ययन प्रकाशित किया — RXN के साथ 13 से 17 वर्ष के 1,000 से अधिक युवाओं पर किए गए U.S. Future Report अध्ययन के अनुसार उनमें से 94% ने पिछले वर्ष AI का उपयोग किया और 55% उत्तरों की अन्य स्रोतों से पुष्टि करते हैं; किसी उत्पाद की घोषणा नहीं हुई। 🔗 स्रोत
  • Perplexity ने AI टेक्स्ट डिटेक्टरों पर मार्गदर्शिका प्रकाशित की — काल्पनिक बताए गए उसके उदाहरण में, मानवीय लेखों में 2% बार गलती करने वाला डिटेक्टर 1,000 में से 64 लेखों को चिह्नित कर सकता है, जिनमें 19 मनुष्यों द्वारा लिखे गए होंगे, यानी त्रुटियों का अनुपात लगभग 30% होगा; मार्गदर्शिका किसी संकेत को समीक्षा की शुरुआत मानने की सलाह देती है। 🔗 स्रोत
  • GiniGEN AI ने OpenRouter के 425 मॉडलों की रैंकिंग की — Hugging Face ब्लॉग पर प्रकाशित इस सामुदायिक लेख की रैंकिंग में 329 मॉडलों पर मापी गई पहले टोकन की लेटेंसी और कोरियाई भाषा की गुणवत्ता का अंक जोड़ा गया है; अंकित मॉडलों में केवल 8.5% को आदरसूचक रूपों पर और 9.4% को कोरियाई संस्थानों पर A मिला। 🔗 स्रोत

इसका क्या अर्थ है

एजेंट अब इंटरफ़ेस बन रहा है और मोड चुनने की आवश्यकता समाप्त हो रही है। नए Claude में अब बातचीत और कार्यक्षेत्र के बीच चयन नहीं करना पड़ता: Claude वेब खोज, फ़ाइलों और कोड में से स्वयं चुनता है, फिर कोई दस्तावेज़ या प्रस्तुति तैयार करता है। Delta कोड की डिलीवरी पर यही तर्क लागू करता है—थ्रेड के भीतर समीक्षा और पुल रिक्वेस्ट के स्थान पर कमिट, CI तथा मर्ज को क्रम से चलाने वाली /land कमांड के साथ। Devin Code Scans किसी बदलाव के बजाय एक लक्ष्य से शुरू होता है, और Grok Build अलग-अलग सत्रों के बीच किसी प्रोजेक्ट की परंपराएँ और निर्णय याद रखता है। मानवीय नियंत्रण समाप्त नहीं होता, बल्कि उसकी जगह बदलती है: Claude में डिफ़ॉल्ट रूप से Manual मोड, Zed में मर्ज से पहले टीम की मंज़ूरी और Devin में किसी भी पुल रिक्वेस्ट से पहले निष्कर्षों पर चर्चा।

एजेंट व्यावसायिक प्रक्रिया में भी प्रवेश कर रहे हैं। OpenAI ऐसे Sponsored Agents का परीक्षण कर रहा है जो किसी विज्ञापन से आगे की बातचीत संभालते हैं, Google ने Business Agent को YouTube विज्ञापनों में शामिल किया है और UCP से भुगतान की सुविधा देता है; दोनों ब्रांड एजेंट को बाकी अनुभव से अलग रखते हैं—एक ओर वह बातचीत चिह्नित होती है और ChatGPT के स्वतंत्र उत्तरों से पृथक रहती है, तो दूसरी ओर व्यापारियों के लिए पंजीकरण-आधारित बीटा है। छोटे व्यवसायों के लिए Claude for Small Business 43 वर्कफ़्लो और 900,000 से अधिक इंस्टॉलेशन का दावा करता है, जबकि ElevenLabs प्रति माह 29 डॉलर से ऐसा रिसेप्शनिस्ट बेचता है जो मुलाकातें तय करता है। Synthesia अपने ग्राहकों के उत्पाद में बोलने वाले अवतार के लिए प्रति मिनट 0.10 यूरो लेता है और Salesforce ने Koa को Agentforce में चयन योग्य मॉडल बनाया है: एजेंट अब केवल कंपनी की सहायता नहीं करता, बल्कि उसके नाम पर ग्राहकों से संवाद भी करता है।

विश्वास बिक्री का तर्क बन रहा है और प्रकाशक उसे सत्यापन योग्य बनाने का प्रयास कर रहे हैं। Cohere और Aleph Alpha Berlin तथा Toronto में दोहरे मुख्यालय के साथ संप्रभुता पर ज़ोर देते हैं, जबकि Model Vault ऐसा सत्यापन टोकन जारी करता है जिसे ग्राहक हार्डवेयर निर्माता की सार्वजनिक कुंजियों से स्वयं जाँच सकता है। Mistral, Firefox के लिए शून्य डेटा-प्रतिधारण की प्रतिबद्धता देता है, Salesforce Koa के वेट अपने बुनियादी ढाँचे पर रखता है, Runway समस्याग्रस्त सामग्री दिखाई देते ही वीडियो स्ट्रीम रोकने की योजना बनाता है, OpenAI व्यवस्थापकों को API कुंजियों के निर्माण पर प्रतिबंध लगाने देता है, और Qwen Code अपनी सीमाओं की सूची प्रकाशित करते हुए एजेंट को कर्नेल स्तर पर सीमित करता है। सबसे मज़बूत आश्वासन वे हैं जिन्हें ग्राहक स्वयं सत्यापित कर सकता है; CRM Bench जैसा आंतरिक बेंचमार्क या किसी उल्लिखित तृतीय-पक्ष ऑडिट के बिना “हम भी नहीं” जैसा दावा केवल कथन ही रहता है।

अंततः, कंप्यूटिंग बिजली की सीमा से टकराती है। NVIDIA के अनुसार Vera Rubin NVL72, GB300 NVL72 से 3.7 गुना तक अधिक थ्रूपुट देता है, लेकिन इन दो दिनों की सबसे ठोस घोषणाएँ मेगावाट से संबंधित हैं: Lambda, 16 नोड के विद्युत बजट में 19 नोड समायोजित करता है; Santa Clara की एक AI फ़ैक्टरी अपने आपूर्तिकर्ता के अनुरोध पर 4 से घटकर 3 MW पर आती है; और AEMA सत्यापन योग्य लचीलेपन के बदले तेज़ ग्रिड कनेक्शन की माँग करता है। प्रति रैक थ्रूपुट अब भी तकनीकी तर्क है, लेकिन ग्रिड तक पहुँच तय करती है कि ये रैक कितनी जल्दी सेवा में आ सकेंगे।


स्रोत