ai-powered-markdown-translatorअनुवादित लेख फ्र से hi में gpt-5.4-mini के साथ।
22 जुलाई 2026 पर कॉरपोरेट एआई टूल्स और एजेंट्स का दबदबा है: Cursor ने Cursor Router लॉन्च किया, जो एक मॉडल राउटर है और गुणवत्ता में दिखने वाली किसी भी हानि के बिना लागत 60% घटाता है; OpenAI ने एक के बाद एक अपनी एजेंट प्लेटफ़ॉर्म Presence और जॉर्जिया में 3.2 गीगावाट वाले Project Camellia डेटा सेंटर का खुलासा किया; Alibaba ने Qwen-Image-3.0 पेश किया; और Synthesia ने पेशेवर प्रशिक्षण के लिए Roleplay Sessions लॉन्च किए। इन पाँच बड़ी घोषणाओं के आसपास करीब तीस अन्य उल्लेखनीय नवाचार भी हैं — अमेरिकी ऊर्जा विभाग की Genesis Mission (Google, OpenAI, Arcee AI) से लेकर Anthropic, GitHub Copilot, NVIDIA और Cohere की नई चीज़ों तक।
Cursor ने Cursor Router लॉन्च किया, 60% कम कीमत में बुद्धिमान मॉडल रूटिंग
22 जुलाई — Cursor ने Cursor Router लॉन्च किया, जो Auto मोड में एकीकृत मॉडल राउटर है और हर अनुरोध का विश्लेषण करके कार्य के लिए सबसे उपयुक्त मॉडल को स्वतः चुनता है, बजाय इसके कि सभी अनुरोधों को हमेशा एक frontier मॉडल (frontier) पर भेजा जाए। यह सुविधा आज से सभी सतहों (desktop, web, iOS, CLI, SDK) पर Teams और Enterprise प्लान के लिए उपलब्ध है।
| अनुकूलन मोड | लक्ष्य | बिलिंग |
|---|---|---|
| Intelligence | सुसंगत frontier गुणवत्ता | वास्तव में उपयोग किए गए मॉडल का शुल्क |
| Balance | frontier के करीब गुणवत्ता, दैनिक उपयोग | वास्तव में उपयोग किए गए मॉडल का शुल्क |
| Cost | उचित गुणवत्ता, tokens में अनुकूलित | वास्तव में उपयोग किए गए मॉडल का शुल्क |
प्रशासन की ओर से, Teams और Enterprise टीमों को सूक्ष्म नियंत्रण मिलते हैं: प्रति टीम Router को चालू या बंद करना, उपलब्ध मोड सीमित करना, डिफ़ॉल्ट मोड तय करना, कुछ अंतर्निहित मॉडलों को अनुमति देना या रोकना, और यह चुनना कि वास्तव में रूट किए गए मॉडल का नाम दिखाया जाए या नहीं (डिफ़ॉल्ट रूप से छिपा हुआ)। सॉफ़्ट या सख्त लागूकरण विकल्प संगठन के भीतर Auto मोड के उपयोग को मानकीकृत करने में मदद करते हैं।
In early access, customers observed no drop-off in quality with a lower cost per commit vs. routing all requests to Opus 4.8.
🇮🇳 अर्ली ऐक्सेस में, ग्राहकों ने गुणवत्ता में कोई गिरावट नहीं देखी, और प्रति commit लागत सभी अनुरोधों को Opus 4.8 पर रूट करने की तुलना में कम रही। — @cursor_ai पर X
OpenAI Presence, उद्यमों के लिए वॉइस और टेक्स्ट एजेंट प्लेटफ़ॉर्म
22 जुलाई — OpenAI Presence लॉन्च कर रहा है, जो उद्यमों के लिए एक एआई एजेंट प्लेटफ़ॉर्म है और तकनीकी डेमो से आगे बढ़कर विश्वसनीय वॉइस और टेक्स्ट एजेंटों को उत्पादन में तैनात करने के लिए बनाया गया है। Presence मॉडल की reasoning को नीतियों, सुरक्षा-घेरों और मानव एस्केलेशन नियमों के साथ जोड़ता है।
हर तैनाती एक स्पष्ट कार्य से शुरू होती है (बिलिंग, बीमा दावे, आंतरिक IT अनुरोध): एजेंट को केवल आवश्यक ज्ञान और सिस्टम एक्सेस मिलता है, और ग्राहक कंपनी तय करती है कि वह क्या कर सकता है, कब मानव सत्यापन जरूरी है, और कब किसी व्यक्ति को नियंत्रण संभालना चाहिए। उत्पादन में जाने के बाद, वास्तविक सत्र और एस्केलेशन केस सिस्टम की कमियों को उजागर करते हैं; तब Codex अपडेट प्रस्तावित करता है जिन्हें टीमें परीक्षण और सत्यापित करती हैं, जिससे एजेंट उपयोगकर्ता व्यवहार के विकास के अनुसार ढल सकता है।
आज से, Presence ग्राहक समर्थन, आउटबाउंड बिक्री, या उच्च-जोखिम वाले आंतरिक प्रवाहों के लिए वास्तविक समय की वॉइस और टेक्स्ट अनुभवों का समर्थन करता है। यह उत्पाद योग्य enterprise ग्राहकों के लिए सीमित सामान्य उपलब्धता कार्यक्रम के माध्यम से उपलब्ध है, OpenAI टीमों के सीधे सहयोग के साथ, और आगे चलकर चुने गए system integrators द्वारा निरंतर समर्थन के साथ।
Project Camellia, जॉर्जिया में 3.2 गीगावाट का OpenAI डेटा सेंटर
22 जुलाई — OpenAI Project Camellia का विवरण दे रहा है, जो जॉर्जिया के Effingham काउंटी में एक दीर्घकालिक एआई अवसंरचना परियोजना है। कंपनी ने Georgia Power के साथ 3.2 गीगावाट बिजली के लिए अनुबंध किया है, जिसकी आपूर्ति 2028 से 2032 के बीच चरणों में होगी।
बिजली के मामले में, OpenAI पूरी अवसंरचना और सेवा लागत वहन करने के लिए प्रतिबद्ध है, जिसका निवासियों की दरों पर कोई बोझ नहीं डाला जाएगा, और साइट को उच्च माँग की स्थिति में सक्रिय रूप से अपनी खपत घटाने के लिए डिज़ाइन किया गया है, इससे पहले कि आवासीय ग्राहकों पर प्रभाव पड़े। पानी के मामले में, एक बंद लूप पानी को लगातार निकालने और छोड़ने के बजाय पुनः परिसंचारित करता है, ताकि एक समान कार्यालय इमारत के बराबर लगातार खपत रहे।
आर्थिक दृष्टि से, OpenAI परियोजना के जीवनकाल में 80 मिलियन डॉलर के सामुदायिक लाभ की घोषणा करता है (स्कूल, सार्वजनिक सुरक्षा, स्वास्थ्य, आवास, पूर्व सैनिक, छोटे व्यवसाय), साथ ही स्थानीय और राज्य कर राजस्व में सैकड़ों मिलियन डॉलर की अपेक्षा भी — कंपनी को उम्मीद है कि वह काउंटी की सबसे बड़ी करदाता बनेगी। इसके अलावा, जॉर्जिया के योग्य college, community college और तकनीकी स्कूलों के छात्रों के लिए 71 मिलियन डॉलर तक के Codex क्रेडिट भी हैं, जिनमें से प्रत्येक को अपने ChatGPT खाते के माध्यम से 100 डॉलर के क्रेडिट मिलेंगे।
Qwen-Image-3.0, Alibaba के इमेज जनरेशन मॉडल की तीसरी पीढ़ी
22 जुलाई — Alibaba ने Qwen-Image-3.0 लॉन्च किया, जो उसके इमेज जनरेशन मॉडल की तीसरी पीढ़ी है, और टीम ने इसे एक ही शब्द में समेटा: « Real » (« 实 »), 1.0 संस्करण की सटीकता और 2.0 की विविधता/समग्रता के बाद।
| आयाम | इससे व्यवहार में क्या बदलता है |
|---|---|
| समृद्ध सामग्री | 4.5k tokens तक prompts; एक ही पास में जटिल लेआउट (अख़बार, storyboard, परीक्षा विषय, 3×3 इन्फोग्राफिक ग्रिड, nested interfaces) |
| प्रामाणिक विवरण | 10px तक पढ़ने योग्य टेक्स्ट, पूर्ण LaTeX पृष्ठ, लगभग फोटोरियलिस्टिक टेक्सचर (छिद्र, बालों की लटें, त्वचा) |
| गहरी जानकारी | 12 भाषाओं में native rendering, 100 से अधिक कलात्मक शैलियाँ, यथार्थवादी interfaces (web, games, streams), live web retrieval |
Alibaba द्वारा प्रदर्शित एक उदाहरण इस « horizontal expansion » को दिखाता है: केवल 3.7k tokens के साथ, मॉडल एक 3×3 इन्फोग्राफिक बनाता है जो नौ बहुत अलग क्षेत्रों को कवर करता है (टनल सुरक्षा, स्थानिक ज्यामिति, एक शास्त्रीय चीनी पाठ का शैलीगत विश्लेषण, प्रक्षेप्य गति, परजीविविज्ञान, चिकित्सा निदान, Sylow प्रमेय, बैंकिंग नियंत्रण, DNA संरचना), और हर बॉक्स में सटीक टेक्स्ट और दृश्य देता है। Alibaba मॉडल को सिर्फ एक « देखने में सुंदर » उपकरण नहीं, बल्कि डिज़ाइन, सामग्री निर्माण, शिक्षा और e-commerce के लिए उत्पादकता उपकरण के रूप में स्थापित करता है। यह अभी Qwen Chat के माध्यम से उपलब्ध है।
Synthesia ने पेशेवर प्रशिक्षण के लिए Roleplay Sessions लॉन्च किए
22 जुलाई — Synthesia Roleplay Sessions लॉन्च कर रहा है, जो उसकी आने वाली « Sessions » प्लेटफ़ॉर्म की पहली कड़ी है, और यह एआई-संचालित पेशेवर प्रशिक्षण के लिए बनाया गया है। सिद्धांत: एक live प्रशिक्षण बातचीत जिसमें एक avatar जवाब देता है और वास्तविक समय में प्रेरित करता है, स्कोर सिस्टम के साथ उपयोगकर्ता को कोच करता है, और फिर टीम स्तर पर कौशल प्रगति को मापता है। घोषित लक्ष्य बिक्री, प्रबंधन, ग्राहक सेवा और कोई भी ऐसी स्थिति है जहाँ कर्मचारी को कठिन बातचीत का अभ्यास करना हो।
| संकेतक | मान |
|---|---|
| 2027 तक बुनियादी कौशल में बड़ा बदलाव (Synthesia स्रोत) | 44 % कर्मचारी |
| अंतर भरने की क्षमता की कमी बताने वाले नियोक्ता | 63 % |
| औसत कौशल उन्नयन (एक बड़ा वैश्विक भर्ती फर्म) | लगभग 30 % |
| स्वेच्छा से अभ्यास के लिए लौटने वाले salespeople (Fortune 10 कंपनी) | लगभग 70 % |
Roleplay Sessions एक ही प्लेटफ़ॉर्म में आम तौर पर अलग-अलग बिखरे चार चरणों — जानकारी देना, अभ्यास करना, कोचिंग करना और मापना — को एक साथ लाने की कोशिश करता है, Synthesia के वीडियो आधार पर, जिसका पहले से ही Fortune 100 की 90 % कंपनियाँ उपयोग करती हैं। शुरुआती तैनातियाँ एक बड़े यूरोपीय समूह और Fortune 10 की एक कंपनी में हो रही हैं।
DOE की Genesis Mission: Google, OpenAI और Arcee AI ने प्रतिबद्धताएँ बढ़ाईं
22 जुलाई — तीन अलग-अलग खिलाड़ियों ने उसी दिन Genesis Mission के आसपास नई प्रतिबद्धताओं की घोषणा की, जो अमेरिकी ऊर्जा विभाग (DOE) की पहल है, जिसका लक्ष्य एक दशक में वैज्ञानिक खोज की गति को दोगुना करना है।
| संगठन | प्रतिबद्धता | विवरण |
|---|---|---|
| Google DeepMind | 40 मिलियन डॉलर | अधिक शोधकर्ताओं को Gemini और अन्य मॉडलों तक पहुँच देने के लिए राष्ट्रीय प्रयोगशालाओं के लिए एआई tokens और Google Cloud credits |
| OpenAI | 17 मिलियन डॉलर | लगभग 2,000 शोधकर्ताओं के लिए Codex पहुँच, दो वैज्ञानिक अभियानों के लिए API support, 2.5 मिलियन खर्च करने पर 10 मिलियन डॉलर तक का API उपयोग, जीवविज्ञान के लिए GPT-Rosalind तक पहुँच |
| Arcee AI | भागीदारी (राशि घोषित नहीं) | Genesis-Science-1 (GS1) का निर्माण, एक open-weight अमेरिकी मॉडल जो वैज्ञानिक गणना workflows के लिए governed research harness से जुड़ा है |
Google पहले से स्थापित computational biology सहयोग (AlphaFold, Isomorphic Labs) का विस्तार कर रहा है। OpenAI राष्ट्रीय प्रयोगशालाओं की प्रणाली के साथ पहले से किए गए कार्यों पर आधारित है, जिसमें नौ प्रयोगशालाओं के 1,000 से अधिक वैज्ञानिकों को एक साथ लाने वाला एक « AI Jam » session शामिल था। दूसरी ओर, Arcee AI शोधकर्ताओं, प्रयोगशालाओं, विश्वविद्यालयों, कंपनियों और गैर-लाभकारी संगठनों के लिए एक योगदान कार्यक्रम खोल रहा है; यह परियोजना अभी शुरुआती चरण में है, और इस समय GS1 के लिए न तो कोई रिलीज़ तिथि और न ही कोई benchmark बताया गया है।
🔗 Google DeepMind पर X — 🔗 OpenAI विषय पर — 🔗 Arcee AI पर X
Anthropic ने Claude पर घोषणाओं की झड़ी लगाई
Claude Security, Claude Code के लिए bêta में
22 जुलाई — Anthropic Claude Code के लिए Claude Security plugin को beta संस्करण में लॉन्च कर रहा है: commit करने से पहले vulnerabilities की तलाश में मौजूदा बदलावों का scan, या पूरे repository का विश्लेषण, वह भी terminal से, और पहले से उपयोग हो रही Claude inference पर आधारित (तैनात करने के लिए अलग third-party सेवा नहीं)। यह लॉन्च Claude Code को OpenAI के Codex Security या GitHub Copilot के मज़बूत secret scanning के समान स्तर पर रखता है। beta स्थिति से आगे pricing या प्रभावित plans के बारे में कुछ नहीं बताया गया है।
Claude connector के जरिए Anthropic Economic Index से पूछ सकता है
22 जुलाई — एक नया native connector Anthropic Economic Index तक पहुँच देता है, जो अर्थव्यवस्था में एआई उपयोग को मापने वाला सार्वजनिक dataset है। एक बार connectors menu से सक्रिय करने के बाद, Claude « कौन से पेशे सबसे अधिक एआई का उपयोग करते हैं » जैसे प्रश्नों का उत्तर सीधे Index के डेटा के आधार पर दे सकता है, न कि केवल अपनी सामान्य जानकारी के आधार पर।
Claude Managed Agents: effort, seeding, 500 skills और webhooks
22 जुलाई — Anthropic Claude Managed Agents के लिए सुविधाओं का एक समूह जारी कर रहा है: प्रति agent कॉन्फ़िगर किए जा सकने वाले effort स्तर (कम effort पर तेज़ और सस्ते उत्तर), निर्माण के समय सीधे 50 घटनाओं तक वाले « seeded » sessions, एक session के सभी agents में कुल 500 skills तक, environments और memory stores के लिए webhooks, और sub-agents की घटनाओं की streaming।
desktop पर Claude Code iOS simulator के साथ एकीकृत
21 जुलाई — desktop पर Claude Code iOS simulator का समर्थन करता है: ऐप को Claude द्वारा build और launch किया जा सकता है, जो उसे observe करता है, उसके साथ interact करता है और कार्य पूरा होने तक iterate करता है, conversation के बगल वाले panel में। आज से public beta में उपलब्ध, केवल macOS के लिए और Xcode आवश्यक।
🔗 Claude Security — 🔗 Economic Index — 🔗 Managed Agents — 🔗 iOS simulator
Code टूल्स: Amp, Warp और Replit
Amp ने Multiplayer लॉन्च किया, orbs पर real-time collaboration
22 जुलाई — orbs पर agents के लॉन्च के तीन सप्ताह बाद, Amp Multiplayer जोड़ रहा है: अब एक ही orb को एक workspace के कई सदस्य एक साथ साझा और काम कर सकते हैं, agent को संदेश भेज सकते हैं, portal देख सकते हैं, live file changes देख सकते हैं और shared terminal का उपयोग कर सकते हैं, जिसे एक thread के Share menu से सक्रिय किया जा सकता है।
Warp ने OSC 8 hyperlink support जोड़ा
22 जुलाई — Warp OSC 8 का समर्थन जारी कर रहा है, जो एक terminal मानक है और CLI तथा coding agents को plain text के बजाय क्लिक करने योग्य links निकालने देता है। पाँच साल से खुले एक अनुरोध पर एक बाहरी contributor द्वारा विकसित यह सुविधा, terminal grid rendering engine पर अतिरिक्त परीक्षण के लिए, अभी feature flag के पीछे Dev संस्करण में तैनात की जा रही है।
Replit ने अपना mobile application फिर से लॉन्च किया
22 जुलाई — Replit अपने mobile application का नया रूप जारी कर रहा है (iOS, Android पर क्रमिक rollout): पुनः डिज़ाइन किया गया home screen, Agent से सीधे बात करने के लिए voice input, chat, tasks और preview के बीच swipe-आधारित navigation, और iOS Live Activities जो ऐप से बाहर होने पर भी agent की प्रगति को live ट्रैक करती हैं।
🔗 Amp Multiplayer — 🔗 Warp OSC 8 — 🔗 Replit mobile
Microsoft Asia ने Mage-Flow प्रकाशित किया, image generation का कॉम्पैक्ट मॉडल
22 जुलाई — Microsoft Asia Hugging Face पर Mage-Flow प्रकाशित करता है, जो केवल 4 बिलियन parameters वाला image generation और editing मॉडल है, और जो अपने से कहीं बड़े मॉडलों के बराबर गुणवत्ता का दावा करता है। प्रदर्शन की दृष्टि से, मॉडल 1024×1024 पर 4 चरणों में एक छवि एक सेकंड से कम समय में बनाता है, और 4K तक जा सकता है। एक demo Hugging Face Spaces के माध्यम से उपलब्ध है।
Gemini: Galaxy Unpacked 2026 और Gemini 3.5 Pro
Samsung के पक्ष में Gemini की तीन नई चीज़ें
22 जुलाई — Galaxy Unpacked 2026 के अवसर पर, Google Galaxy ecosystem के लिए Gemini की तीन नई चीज़ों का विवरण देता है: 40 से अधिक लोकप्रिय apps तक विस्तारित task automation (खरीदारी, reservations, टिकट खरीद, जटिल images को instructions के रूप में संभालने और background में चलने में सक्षम); Galaxy Z Fold8 series पर पहले से preinstalled Gemini Notebook (पुराना NotebookLM), जिसमें छह महीने का Google AI Pro trial शामिल है; और Galaxy Watch 9 पर Gemini (सिर्फ़ wrist उठाने से activation, बिना wake word के), साथ ही Samsung के साथ विकसित smart glasses (Gentle Monster और Warby Parker frames) जो autumn 2026 में अपेक्षित हैं।
Gemini 3.5 Pro partner test में प्रवेश करता है
21 जुलाई — Gemini के VP Josh Woodward पुष्टि करते हैं कि अगला प्रमुख model, Gemini 3.5 Pro, आधिकारिक रूप से partners के साथ testing phase में प्रवेश कर चुका है। सामान्य उपलब्धता की कोई तारीख नहीं दी गई है, लेकिन यह पुष्टि Gemini 3.5 Pro को Gemini models की अगली बड़ी अपेक्षित रिलीज़ के रूप में स्थापित करती है।
🔗 Galaxy Unpacked 2026 — 🔗 Gemini 3.5 Pro
Manus ने Plan Mode लॉन्च किया
22 जुलाई — Manus ने Plan Mode पेश किया है, जो निष्पादन से पहले एक संरचित समीक्षा चरण है: सीधे निर्माण शुरू करने के बजाय, एजेंट Markdown प्रारूप में एक व्यवहार्यता योजना बनाता है, जिसमें उद्देश्य, चरण और बाधाएँ होती हैं, जिसे उपयोगकर्ता अनुमोदन से पहले संपादित कर सकता है या समीक्षा के लिए भेज सकता है। इसे वेब पर / या मोबाइल पर + के जरिए चालू किया जाता है; यह मोड कार्य के बीच में भी अगले चरणों की योजना बनाने के लिए शुरू किया जा सकता है। यह अभी सभी उपयोगकर्ताओं के लिए, वेब और मोबाइल पर, ऑप्ट-इन के रूप में उपलब्ध है।
GitHub Copilot: Canvases और बिलिंग
GitHub Copilot ने Canvases लॉन्च किए
21 जुलाई — GitHub ने canvases पेश किए हैं, जो GitHub Copilot ऐप के भीतर इंटरैक्टिव कार्यक्षेत्र हैं, जहाँ डेवलपर्स और एजेंट वास्तविक समय में सहयोग करते हैं: जटिल जानकारी का दृश्यांकन, प्रत्यक्ष इंटरैक्शन (क्लिक्स, संपादन), और prompts के पुनरावृत्त परिष्करण। निर्माण /create-canvas कमांड के जरिए किया जाता है। उदाहरणित उपयोग: कार्ड ब्राउज़िंग द्वारा issues की छँटाई, इंटरैक्टिव आर्किटेक्चर डायग्राम, worktrees के डैशबोर्ड, prompts की गुणवत्ता पर coaching, बहु-प्लेटफ़ॉर्म ज्ञान खोज। एक उपयोगकर्ता ने एक ऐसा मामला दस्तावेज़ किया जहाँ ऐप ने स्वतः एक browser canvas शुरू किया, भुगतान स्क्रीन तक क्लिक करने और एक सुविधा की पुष्टि करने के लिए, जिससे हाथ से लिखा गया Playwright test बदल गया।
API तक सीधे पहुँच से परे Copilot क्या देता है
22 जुलाई — GitHub अपनी बिलिंग नीति समझाता है, जो अब मॉडलों की प्रकाशित API दरों पर बिल किए जाने वाले AI credits पर आधारित है। code completions और Next Edit Suggestions paid plans में शामिल रहते हैं; chat और agentic tasks AI credits consume करते हैं। GitHub का तर्क: मॉडल तक पहुँच से परे, Copilot एक एकीकृत flow देता है (issues, repositories, pull requests, संगठन नीतियाँ), अपने मूल्यांकन के अनुसार task-resolution parity पर token खपत कम करता है, प्रशासकों के लिए नीति नियंत्रण, और production में पहले से सिद्ध agent infrastructure, Copilot SDK के माध्यम से।
🔗 Canvases — 🔗 Copilot बनाम सीधे API पहुँच
ElevenLabs: ElevenMusic और यूक्रेनी सार्वजनिक सेवा
ElevenLabs ने ElevenMusic पर Vocals और Styles पेश किए
22 जुलाई — ElevenLabs ने ElevenMusic में दो सुविधाएँ जोड़ी हैं, जो ElevenCreative के Finetunes में भी उपलब्ध हैं: Vocals, जो अपनी आवाज़ या vocal library की आवाज़ के साथ मूल गीत बनाने की अनुमति देती हैं (अपने timbre पर Music v2 को परिष्कृत करने के लिए गाने अपलोड करना, या एक ही रिकॉर्डिंग से एक-बार का mode) ; और Styles, जो पूरे tracks पर stylistic consistency के लिए हैं, Vocals के साथ compatible। ElevenLabs स्पष्ट करता है कि सभी uploads को copyright compliance के लिए जाँचा जाता है।
ElevenLabs ने Obrii (यूक्रेन) को रोजगार सार्वजनिक सेवा के लिए एक voice assistant से सुसज्जित किया
22 जुलाई — Obrii, यूक्रेनी labour market का नया digital ecosystem, अपनी पहली AI सेवा लॉन्च करता है: ElevenLabs के साथ विकसित एक voice assistant, जो employment public service के लिए है, और 24 घंटे उपलब्ध है, हवाई हमले की चेतावनियों के दौरान भी।
“Together with @ElevenLabs, we launched AI voice assistant for the State Employment Service — bringing public services closer to people, 24/7, even during air raid alerts.”
🇮🇳 ElevenLabs के साथ, हमने रोजगार सार्वजनिक सेवा के लिए एक AI voice assistant लॉन्च किया है — जो सार्वजनिक सेवाओं को नागरिकों के और करीब ला रहा है, 24 घंटे और 7 दिन, हवाई हमले की चेतावनियों के दौरान भी। — @C_o_S on X
🔗 ElevenMusic Vocals और Styles
NVIDIA: चिकित्सा सिमुलेशन, टेक्सास फ़ैक्ट्री और Cosmos मॉडल
चिकित्सा भौतिकी सिमुलेशन के लिए open source framework
22 जुलाई — NVIDIA, NVIDIA Isaac for Healthcare में, एक GPU-accelerated medical physics simulation framework open source में जारी करता है, जिसे इस तरह का पहला बताया गया है: medical device (catheter, guide) और patient anatomy के बीच interactions, classic physics simulation और generative AI (Cosmos-H Dreams) के संयोजन के साथ। 8,192 environments को parallel में चलाकर, NVIDIA ने robotic policies training time को पाँच घंटे से अधिक से घटाकर दो मिनट से कम करने का दावा किया है। CMR Surgical, Johnson & Johnson MedTech, XCath और Medtronic Structural Heart पहले से ही इसका उपयोग कर रहे हैं; अभी GitHub पर उपलब्ध।
NVIDIA और Wistron ने Fort Worth में superchips फ़ैक्ट्री खोली
21 जुलाई — Wistron अपनी पहली अमेरिकी फ़ैक्ट्री खोलता है, Fort Worth (Texas) में 30,000 m² का एक स्थल, जो पहले से Grace Blackwell Ultra superchips का उत्पादन कर रहा है और अंततः Vera Rubin बनाएगा। 700 million dollars का निवेश, 500 से अधिक नौकरियाँ सृजित (वर्ष के अंत तक 1,000 का लक्ष्य), संयुक्त राज्य अमेरिका में AI platform निर्माण के लिए NVIDIA की 500 billion dollars की प्रतिबद्धता के हिस्से के रूप में।
Cosmos 3 Super, 25 गुना तक तेज़
22 जुलाई — NVIDIA Cosmos 3 Super जारी करता है, जो उसकी Cosmos 3 family का 4-step variant है, जो original models की तुलना में images और videos 25 गुना तक तेज़ी से बनाता है, जबकि Artificial Analysis पर उच्च रैंक बनाए रखता है: image-to-video (बिना audio) में पहला स्थान, text-to-image में दूसरा स्थान। अभी Hugging Face पर उपलब्ध।
Kaggle पर Nemotron Model Reasoning Challenge का सारांश
22 जुलाई — NVIDIA Kaggle पर अपने Nemotron Model Reasoning Challenge का सारांश प्रकाशित करता है: 5,000 से अधिक प्रतिभागी, 4,000 से अधिक teams में विभाजित, खुले models के reasoning सुधारने की तकनीकों के आसपास। NullSira, vli और YS-L teams क्रमशः पहले तीन स्थानों पर समाप्त होती हैं।
🔗 चिकित्सा सिमुलेशन — 🔗 Wistron फ़ैक्ट्री — 🔗 Cosmos 3 Super — 🔗 Kaggle सारांश
Kimi K3: AA-Briefcase पर दूसरा, लेकिन महँगा और धीमा
21 जुलाई — Artificial Analysis Kimi K3 (Moonshot AI) के AA-Briefcase पर परिणाम प्रकाशित करता है, जो उसका agentic knowledge work benchmark है (spreadsheets, presentations, interface mockups)। मॉडल को दूसरा सर्वोत्तम दर्ज़ा प्राप्त हुआ, पिछली generation की तुलना में 700 से अधिक points की छलांग।
| मूल्यांकित मॉडल | Elo AA-Briefcase | प्रति task औसत लागत | प्रति task औसत समय |
|---|---|---|---|
| Claude Fable 5 (max) | 1574 | — | — |
| Kimi K3 | 1543 | 10,57 dollars | 56,4 minutes |
| GPT-5.6 Sol (max) | 1501 | — | — |
| Claude Sonnet 5 (max) | 1388 | — | — |
| Claude Opus 4.8 (max) | 1347 | — | — |
| Kimi K2.6 (reference) | 816 | ~1 dollar | — |
Kimi K3 evaluation grids पर 51 % सफलता दर दिखाता है, Claude Fable 5 (56 %) से बस पीछे, तुलनीय analytical quality के साथ लेकिन presentation quality में कमी। दूसरी ओर, प्रति task 10,57 dollars की औसत लागत, Kimi K2.6 की तुलना में लगभग दस गुना अधिक, model pricing, output tokens के उच्च उपयोग और प्रति task 83 turns के औसत का परिणाम है (Claude Fable 5 के लिए 67 और GPT-5.6 Sol के लिए 50 के मुकाबले)।
OpenAI: प्रेस उपयोग और API सीमाएँ
मीडिया संस्थाएँ OpenAI tools का उपयोग कैसे करती हैं
22 जुलाई — OpenAI अपनी tools के उपयोग का एक अवलोकन प्रेस संगठनों द्वारा प्रकाशित करता है। Associated Press इन्हें reporting, verification (upload tracing, geolocation, images और videos की chronolocation), Supreme Court के हजारों dossiers को structured information में बदलने, और articles को broadcast scripts में परिवर्तित करने के लिए उपयोग करती है, जबकि पत्रकार editorial judgment पर नियंत्रण बनाए रखते हैं। POLITICO तेज़ original reporting के लिए बड़े volumes of public documents का विश्लेषण करता है; Axios का भी उल्लेख है। OpenAI American Journalism Project के लिए अपना समर्थन नवीनीकृत करता है और Lenfest Institute तथा WAN-IFRA के साथ अपनी भागीदारी जारी रखता है।
सख्त खर्च सीमाएँ सभी API खातों तक विस्तारित
22 जुलाई — OpenAI इस सप्ताह API Platform के सभी खातों तक strict spend limits (hard spend limits) की पहुँच बढ़ा रहा है, जिससे प्रत्येक developer अपनी खपत को अपनी पसंद की राशि तक सीमित कर सकता है, dashboard से real-time usage tracking के साथ।
🔗 प्रेस उपयोग — 🔗 API सीमाएँ
Cohere: अरबी diacritization और हल्का code model
Speech Tashkeel 2B और Transcribe Arabic समुदाय ecosystem
22 जुलाई — Cohere Speech Tashkeel 2B को उजागर करता है, जो NAMAA द्वारा विकसित एक partner model है, जो unvocalized Arabic को पूरी तरह diacritized text में बदलता है (case grammatical marks, harakāt, tanwīn, sukūn, shadda), 4-bit quantized version के साथ। घोषणा के साथ Transcribe Arabic, Cohere के Arabic speech recognition model, के आसपास community contributions भी शामिल हैं: listen-habibi app, native Ruby support, और Hugging Face पर प्रकाशित GGUF/ONNX quantizations। Cohere आगे HUMAIN के साथ साझेदारी की घोषणा करता है ताकि इस काम को अन्य resource-scarce languages तक बढ़ाया जा सके।
North Mini Code, हल्का और किफायती code model
21 जुलाई — Cohere North Mini Code प्रस्तुत करता है, जो एक open source code model है, जिसे दोहरावदार और कम जटिल tasks — debugging, unit tests बनाना — के लिए डिज़ाइन किया गया है, और inference costs को सीमित करने के लिए बड़े models के किफायती विकल्प के रूप में स्थित है।
🔗 Speech Tashkeel 2B — 🔗 North Mini Code
संक्षिप्त समाचार
- Warp IA startup hypergrowth की आर्थिक तनावों पर एक लेख प्रकाशित करता है — तेज़ी से बढ़ती startups के लिए आने वाले revenue tightening का विश्लेषण। 🔗 स्रोत
- Hugging Face टोक्यो, जापान में अपना पहला कार्यक्रम आयोजित करता है — Otemachi में recent tooling और जापानी बाज़ार के लिए कंपनी की योजनाओं की प्रस्तुति। 🔗 स्रोत
- Ai2 PaperFinder का नया संस्करण प्रकाशित करता है — वैज्ञानिक दस्तावेज़ खोज उपकरण, जिसे एक नियमित उपयोगकर्ता researcher ने सराहा, बिना तकनीकी विवरण के। 🔗 स्रोत
- Sakana AI Fugu, “One Model to Command Them All” का एक सामान्य अवलोकन प्रकाशित करता है — blog post जो orchestration model के दायरे को पहले कवर किए गए Fugu-Cyber संस्करण से आगे बढ़ाता है। 🔗 स्रोत
- Gemini Live — वास्तविक समय दृश्य सहायता के लिए camera guide — किसी वस्तु या दस्तावेज़ पर camera इंगित करके स्थिति को लिखकर बताने की आवश्यकता के बिना contextual सहायता प्राप्त करना। 🔗 स्रोत
- AlphaFold — आधार के 5 वर्षों के करीब प्रोटीन engineering में नया अनुप्रयोग — Pushmeet Kohli (Google DeepMind) जीवविज्ञान में संरचनात्मक अंधे क्षेत्रों को भरने के लिए उपयोग की सराहना करते हैं। 🔗 स्रोत
- Copilot metrics impact का नया dashboard (Enterprise) — adoption cohorts (Code-first, Agent-first, Multi-agent, Passifs) के साथ प्रति उपयोगकर्ता velocity और merge indicators। 🔗 स्रोत
- Copilot Business/Enterprise — बिलिंग चक्र के अनुसार AI credits की दृश्यता — अब संभव है, भले ही कोई individual budget assigned न हो। 🔗 स्रोत
- GHES — support bundles upload पर आने वाला सख्तीकरण (18 अगस्त 2026) — unpatched instances से uploads अस्वीकृत होंगे; 3.21.3, 3.20.5, 3.19.9, 3.18.12 या 3.17.18 में अद्यतन आवश्यक। 🔗 स्रोत
- NVIDIA ने Jetson Thor T2000 और T3000 modules लॉन्च किए — robotics और edge AI के लिए नए modules, इस चरण में कोई विस्तृत तकनीकी datasheet उपलब्ध नहीं। 🔗 स्रोत
- Cisco ने Antares लॉन्च किया, code में vulnerabilities detection के लिए छोटे models — Antares-350M और Antares-1B, Hugging Face पर उपलब्ध, स्थानीय रूप से चलाने योग्य ताकि संवेदनशील code cloud को न भेजना पड़े। 🔗 स्रोत
- HeyGen HyperFrames — दिन 17/30: Storyboard flow — तीन-pass plan (cards, sketches, final render) with frame-by-frame comment review। 🔗 स्रोत
- Kling AI ने agents के साथ cinematic performances बनाने के लिए MCP tutorial प्रकाशित किया — एक agent में पूर्ण creative flow: character, emotion, batch video generation। 🔗 स्रोत
- एक परिवार ChatGPT को consultant बनाकर पेड़ों पर झोपड़ी बनाता है — structural design, material selection, और बच्चों के विचारों को लागू योजनाओं में अनुवाद करना। 🔗 स्रोत
- Codex Live Build — लाइव निर्माण session — Codex Micro keyboards के creators के साथ प्रसारण। 🔗 स्रोत
- एक खिलाड़ी Codex के साथ वीडियो गेम में इतालवी Dolomites को फिर से बनाती है — खुली दुनिया “Valdiluce” जिसमें climbing, gliding और काम करने वाला cable car है। 🔗 स्रोत
- ChatGPT Work promotion — 100 dollars के मुफ़्त credits — X पर ChatGPT Work के बारे में जो वे सराहते हैं उसे पोस्ट करने वाले पहले 10,000 प्रतिभागियों के लिए। 🔗 स्रोत
इसका क्या मतलब है
Model routing code tools में प्रतिस्पर्धा का नया मैदान बन रहा है: Cursor Router प्रति request सही model स्वतः चुनकर बिना किसी दिखाई देने वाली quality हानि के 60 % बचत का वादा करता है, जबकि Artificial Analysis दूसरी ओर दिखाता है कि अपने agentic knowledge work benchmark पर दूसरा सर्वोच्च score पाने वाला Kimi K3 अपनी पिछली generation की तुलना में लगभग दस गुना अधिक महँगा है और प्रति task लगभग एक घंटा लेता है। दोनों ओर संदेश एक ही है: model की कच्ची शक्ति अब उसके उपयोग को सही ठहराने के लिए पर्याप्त नहीं है, cost/quality/latency का संतुलन उन teams के लिए वास्तविक निर्णय मानदंड बन रहा है जो इन tools को बड़े पैमाने पर लागू करती हैं।
Enterprise agents स्पष्ट रूप से demo logic से production logic की ओर बढ़ रहे हैं। OpenAI Presence मॉडलों के reasoning के आसपास policies, guardrails और human escalation को स्पष्ट रूप से संरचित करता है; Synthesia Roleplay Sessions वास्तविक परिस्थितियों में skill-up gains को मापता है; GitHub Copilot Canvases एक ऐसे मामले का दस्तावेज़ीकरण करता है जहाँ एक agent ने payment screen तक अपना काम स्वयं सत्यापित किया, हाथ से लिखे tests को बदलते हुए; और Claude Managed Agents production में जटिल agentic workflows के लिए सोचकर बनाए गए effort levels और webhooks जोड़ता है। ये घोषणाएँ एक ही आवश्यकता की ओर इशारा करती हैं: agents को लंबे समय तक विश्वसनीय और नियंत्रित करने योग्य बनाना, न कि केवल एक demonstration पर सक्षम।
संस्थागत क्षेत्र में, DOE की Genesis Mission अब एक खुली तीन-तरफ़ा दौड़ को दर्शाती है — Google, OpenAI और Arcee AI — अमेरिकी सार्वजनिक वैज्ञानिक अनुसंधान में अपनी जगह बनाने के लिए, प्रत्येक अपनी अलग logic के साथ: Google के लिए tokens और cloud credits, OpenAI के लिए Codex और API पहुँच, Arcee AI के लिए एक governed open model। यह संस्थागत गतिशीलता एक भौतिक infrastructure दौड़ से भी जुड़ती है, जिसमें Project Camellia (Georgia में 3.2 gigawatts) और Fort Worth में Wistron की superchips फ़ैक्ट्री (700 million dollars, कई सौ नौकरियाँ) दिखाती है कि computing capacity और क्षेत्रीय anchoring स्वयं में संचार के तर्क बन गए हैं, सार्वजनिक रूप से संख्याबद्ध और विस्तृत।
अंततः, multimodal generation नीचे और ऊपर दोनों दिशाओं में विविध हो रही है: Qwen-Image-3.0 एक frontier model के यथार्थवाद और पेशेवर उपयोगिता को आगे बढ़ाता है, जबकि Mage-Flow (Microsoft Asia, 4 billion parameters) और Cosmos 3 Super (NVIDIA, 25 गुना तक तेज़) कम गणनात्मक लागत पर इन क्षमताओं को सुलभ बनाने के लिए compactness और speed पर दाँव लगाते हैं। यूक्रेन में ElevenLabs/Obrii का use case भी याद दिलाता है कि ये voice technologies, केवल व्यावसायिक उपयोगों से परे, उच्च सामाजिक प्रभाव वाली public service uses में भी जगह बना रही हैं।
स्रोत
- Cursor Router — परिवर्तन-सूची
- OpenAI Presence
- Project Camellia
- Qwen-Image-3.0
- Synthesia भूमिका-अभिनय सत्र
- Google DeepMind — Genesis Mission
- OpenAI — Genesis Mission
- Arcee AI — Genesis-Science-1
- Claude सुरक्षा
- Anthropic Economic Index — कनेक्टर
- Claude Managed Agents
- Claude Code — iOS सिम्युलेटर
- Amp Multiplayer
- Warp — OSC 8 लिंक
- Replit — मोबाइल ऐप्लिकेशन
- Microsoft Asia — Mage-Flow
- Galaxy Unpacked 2026 — Gemini
- Gemini 3.5 Pro — पार्टनर परीक्षण
- Manus Plan Mode
- GitHub Copilot — Canvases
- GitHub Copilot बनाम कच्ची API पहुँच
- ElevenLabs — Vocals और Styles
- ElevenLabs — Obrii Ukraine
- NVIDIA — चिकित्सा भौतिकी सिमुलेशन
- NVIDIA/Wistron — फोर्ट वर्थ कारखाना
- NVIDIA — Cosmos 3 Super
- NVIDIA — Nemotron Reasoning Challenge का सारांश
- Kimi K3 — AA-Briefcase
- OpenAI — प्रेस उपयोग
- OpenAI — API खर्च सीमाएँ
- Cohere — Speech Tashkeel 2B
- Cohere — North Mini Code