ai-powered-markdown-translatorfr से hi में अनुवादित लेख gpt-5.4-mini के साथ।
22 अगस्त को Anthropic Claude Code Remote Control को फोन से सत्र शुरू करने की सुविधा के साथ जारी करता है, जबकि Google अपने एजेंटों को दूर से नियंत्रित करने के लिए Antigravity में एक समकक्ष सुविधा जोड़ता है। मॉडलों की बात करें तो Together AI के दो तुलनात्मक परीक्षण दिखाते हैं कि Zhipu/Z.ai का खुला मॉडल GLM-5.3 DeepSWE बेंचमार्क पर GPT-5.6 Sol और Claude Fable 5 के बराबर या उनसे बेहतर प्रदर्शन करता है, वह भी लागत के एक अंश पर। Perplexity इसके अलावा Brain की संरचना का विवरण देता है, जो Git के साथ संस्करणित उसकी agentic memory है, और NotebookLM अब Google Search के AI Mode में एकीकरण के साथ सभी उपयोगकर्ताओं के लिए उपलब्ध हो जाता है। अन्य समाचारों में: Replit अपने agent modes पर पुनर्विचार करता है, Runway एक model license पेशकश खोलता है, OpenAI अपने API लागत नियंत्रण और Codex सुरक्षा सूट को मजबूत करता है, और Grok Bot अपनी पहुँच का विस्तार करता है।
Claude Code Remote Control : बढ़ी हुई विश्वसनीयता और फोन से सत्र शुरू करना
22 अगस्त — Anthropic X पर एक थ्रेड प्रकाशित करता है जिसमें Remote Control के लिए कई विश्वसनीयता सुधारों का विवरण दिया गया है, यह वह सुविधा है जो किसी दूरस्थ कंप्यूटर पर चल रहे Claude Code सत्र को फोन से नियंत्रित करने देती है। फोन और मशीन के बीच स्थिति समन्वय अब Claude Code बंद होने के बाद कोई भूतिया सत्र दिखाए बिना रह जाता है, नेटवर्क कटाव (Wi‑Fi बदलना, ढक्कन बंद होना) अब स्वचालित पुनःकनेक्शन को ट्रिगर करते हैं, और बड़े सत्रों का खुलना iOS पर काफी तेज़ हो गया है। तीन slash कमांड्स को एक समर्पित मोबाइल व्यवहार मिलता है (/clear, /compact, /diff)। उत्पाद में नई बात: अब सीधे फोन से सत्र शुरू करना संभव है — claude remote-control चलाने वाली कोई भी मशीन Code टैब में एक डिवाइस कार्ड के रूप में दिखाई देती है, जिसे चुनकर दूर से सत्र शुरू किया जा सकता है।
Your phone now stays in sync with what’s running on your machine. Resuming a session on your laptop keeps the phone on the live session instead of archiving it. When Claude Code exits, your phone shows it offline within seconds instead of leaving a stale session hanging around.
🇮🇳 अब आपका फोन आपके मशीन पर चल रही चीज़ों के साथ सिंक रहता है। अपने लैपटॉप पर किसी सत्र को फिर से लेने पर फोन उसे आर्काइव करने के बजाय सक्रिय सत्र पर बनाए रखता है। जब Claude Code बंद हो जाता है, तो आपका फोन कुछ सेकंड में उसे ऑफ़लाइन दिखाता है, बजाय इसके कि एक पुराना सत्र दिखता रहे। — @ClaudeDevs sur X
🔗 X पर पूरा थ्रेड 🔗 Remote Control दस्तावेज़
Replit : Conversations, Agent modes के नाम बदले गए (Power/Max), और Routines तथा Memories बीटा में
22 अगस्त — Replit अपना साप्ताहिक सारांश This Week in Replit प्रकाशित करता है, जिसमें तीन नई घोषणाएँ शामिल हैं। Conversations किसी ऐप विचार को पहले बातचीत-आधारित शोध और विचार-मंथन चरण से शुरू करने देता है, फिर निर्माण पर स्विच करता है, बिना संचित संदर्भ खोए — एक आम समस्या जब यह चरण किसी दूसरे AI सहायक में शुरू होता था। Agent modes के नाम बदले गए हैं: पुराना Economy mode अब Power है, और पुराना Power mode अब Max है, दोनों की लागत समान है। अंत में, Routines और Memories बीटा में आ गए हैं: Routines किसी बातचीत से कार्य के निष्पादन को समयबद्ध करती हैं और परिणाम स्वतः लौटाती हैं, जो एक persistent memory प्रणाली पर आधारित है। ये घोषणाएँ Replit के Friday Showcase के दौरान लाइव प्रस्तुत की गईं।
Together AI ने DeepSWE पर GLM-5.3 की तुलना GPT-5.6 Sol और Claude Fable 5 से की
21 अगस्त — Together AI उसी दिन दो स्वतंत्र तुलनात्मक परीक्षण प्रकाशित करता है, जिनमें GLM-5.3, Zhipu/Z.ai का नवीनतम खुला मॉडल, DeepSWE पर दो बंद संदर्भ मॉडलों के मुकाबले रखा गया है, जो उसका software engineering बेंचमार्क है (113 कार्य, प्रति कॉन्फ़िगरेशन 4 प्रयास, अधिकतम प्रयास, कुल 904 रन)। GPT-5.6 Sol के मुकाबले GLM-5.3 पहला प्रयास थोड़ा पीछे छोड़ता है, लेकिन दूसरे प्रयास तक बराबरी कर लेता है और चौथे पर उससे आगे निकल जाता है, वह भी बहुत कम लागत पर। Claude Fable 5 के मुकाबले शुरुआती अंतर लगभग शून्य है और बहु-प्रयासों के साथ GLM-5.3 के पक्ष में स्पष्ट रूप से बढ़ जाता है — Claude Fable 5 तुलना में सबसे महँगा कॉन्फ़िगरेशन निकलता है। GLM-5.3 से Sol की एक cascade, जो केवल test failure की स्थिति में ही escalation करती है, 6,61 डॉलर प्रति कार्य की लागत पर 85,9 % सफलता दर हासिल करती है, जो एक परिपूर्ण oracle router (83,8 %) से भी बेहतर परिणाम है।
| परीक्षण की गई तुलना | पहले प्रयास में स्कोर | 4 प्रयासों के बाद स्कोर | प्रति रन लागत |
|---|---|---|---|
| GLM-5.3 बनाम GPT-5.6 Sol | 69,0 % बनाम 72,7 % | 87,6 % बनाम 85,8 % | 3,99 $ बनाम 8,37 $ (2,1× सस्ता) |
| GLM-5.3 बनाम Claude Fable 5 | 69,0 % बनाम 69,7 % | 87,6 % बनाम 84,1 % | 3,99 $ बनाम 21,63 $ (5,4× सस्ता) |
Don’t pick one. Run GLM-5.3 first, escalate to GPT-5.6 Sol when the tests fail. That cascade solves 85.9% of DeepSWE tasks at $6.61 each. Sol alone solves 72.7% at $8.37. Thirteen points better, 21% cheaper.
🇮🇳 एक ही मॉडल मत चुनिए। पहले GLM-5.3 चलाइए, और जब परीक्षण विफल हों तो GPT-5.6 Sol पर escalade कीजिए। यह cascade DeepSWE के 85,9 % कार्यों को 6,61 डॉलर प्रति कार्य की लागत पर हल करती है। केवल Sol 72,7 % को 8,37 डॉलर पर हल करता है। तेरह अंक बेहतर, 21 % सस्ता। — Together AI, आधिकारिक ब्लॉग
🔗 GLM-5.3 बनाम Claude Fable 5 तुलना
NotebookLM सभी उपयोगकर्ताओं के लिए उपलब्ध, Google Search के AI Mode में एकीकृत
21 अगस्त — NotebookLM का X खाता, जिसका नाम बदलकर Gemini Notebook कर दिया गया है, घोषणा करता है कि पुनःडिज़ाइन किया गया « Notebook » अनुभव अब वेब पर सभी उपयोगकर्ताओं के लिए उपलब्ध है (मोबाइल संस्करण आने वाला है), चरणबद्ध रोलआउट के बाद। एक और संरचनात्मक बदलाव: notebooks अब सीधे Google Search के AI Mode से उपलब्ध हैं, जिससे यह दस्तावेज़-सारांश उपकरण Google के मुख्य खोज इंजन के और करीब आ जाता है। घोषणा में Chat पक्ष के दो सुधार भी शामिल हैं: गणितीय समीकरणों का बेहतर रेंडरिंग और कॉपी-पेस्ट, तथा उस बग का सुधार जो दाएँ से बाएँ लिखी जाने वाली भाषाओं (अरबी, हिब्रू) में अंकों को उल्टा दिखाता था। आने वाले हफ्तों में अन्य नई सुविधाएँ वादा की गई हैं।
OpenAI ने Usage and Spend डैशबोर्ड में API key स्तर पर खर्च ट्रैकिंग जोड़ी
21 अगस्त — OpenAI अपने डेवलपर प्लेटफ़ॉर्म के Usage and Spend डैशबोर्ड में API key-स्तरीय सूक्ष्मता जोड़ता है। अब तक संगठन या प्रोजेक्ट स्तर पर समेकित रहने वाला खर्च ट्रैकिंग अब प्रत्येक व्यक्तिगत API key का योगदान अलग से दिखा सकता है, ताकि ठीक-ठीक पहचाना जा सके कि कौन-से ऐप्स या workflows बिल को सबसे अधिक प्रभावित करते हैं। इस सुविधा के साथ संगठन या प्रोजेक्ट स्तर पर कॉन्फ़िगर की जा सकने वाली खर्च सीमाएँ भी आती हैं, जिनमें सख्त सीमाएँ तय करने का विकल्प है जो सीमा पहुँचते ही ट्रैफ़िक को स्वतः रोक देती हैं। ये नियंत्रण API Platform इंटरफ़ेस और Admin API से उपलब्ध हैं, ताकि इन्हें प्रोग्रामेटिक workflows में जोड़ा जा सके। OpenAI इस अपडेट को उसी दिन घोषित GPT-5.6 Sol की मूल्य कटौती का पूरक बताता है।
Codex Security : साइबर रक्षा के लिए व्यावहारिक गाइड और open source CLI (Daybreak)
21 अगस्त — OpenAI Daybreak ecosystem का विवरण देने वाला एक गाइड प्रकाशित करता है, जो उसका AI-सहायित cyber defense प्लेटफ़ॉर्म है, ChatGPT में प्रारंभिक triage से लेकर सत्यापित fix के उत्पादन तक। डेवलपर्स के लिए सबसे ठोस बिंदु Codex Security CLI है, जो npm package (@openai/codex-security) के रूप में प्रकाशित एक open source उपकरण है, जिसे स्थानीय repository स्कैन करने (npx @openai/codex-security scan .) के लिए इस्तेमाल किया जा सकता है और SARIF प्रारूप में export के साथ CI/CD (GitHub Actions, GitLab CI/CD) में एकीकृत किया जा सकता है। एक उल्लेखनीय नई सुविधा: bulk-scan, जो CSV inventory से पूरे repository portfolio का audit करती है, interruption पर resume और configurable concurrency parameters के साथ। OpenAI दो access levels भी अलग करती है: Daybreak Blue (vulnerability triage, fix validation) approved defenders के लिए, और Daybreak Red (advanced vulnerability research, red teaming), जो अधिक सीमित अधिकृत उपयोगों के लिए आरक्षित है। Codex Security cloud पहले ही 30,000 से अधिक codebases पर 30 मिलियन से अधिक commits का विश्लेषण कर चुका है।
Grok Bot ने अपनी पहुँच और फ़ॉरफ़ाइट्स तक बढ़ाई, और परीक्षण के लिए मुफ़्त हो गया
21 अगस्त — बीटा लॉन्च के दस दिन बाद, Grok Bot अपनी पहुँच को अधिक व्यापक फ़ॉरफ़ाइट्स तक बढ़ाता है: SuperGrok Plus, SuperGrok Heavy, साथ ही Cursor ऑफ़र (Pro+, Ultra और सभी Teams योजनाएँ)। इन फ़ॉरफ़ाइट्स के बाहर के उपयोगकर्ताओं को अब सीमित उपयोग वाला मुफ़्त परीक्षण मिलता है। ये autonomous AI agents अपने स्वयं के cloud environment के साथ आते हैं, जिसमें browser और terminal पहुँच है, ताकि व्यावसायिक prospecting, पूर्ण वेबसाइट निर्माण (डोमेन खरीद और deployment सहित), ईमेल inbox sorting, ग्राहक सहायता, या मीटिंग नोट्स लेने जैसे कार्य किए जा सकें। एक ही समूह में कई Bots समानांतर चल सकते हैं, और “routine” mode Bot को पहली बार उपयोगकर्ता को कार्य करते हुए देखकर उसे सीखने देता है। बड़े पैमाने पर deployment के लिए एक enterprise waitlist खुली है।
Runway ने अपनी enterprise रणनीति और model license ऑफ़र का विवरण दिया
21 अगस्त — Runway के नए मुख्य वाणिज्यिक अधिकारी Sean Holcombe एक पोस्ट में कंपनी की enterprise रणनीति का विवरण देते हैं: वर्ष-दर-वर्ष राजस्व दोगुने से भी अधिक, net retention 300 % से ऊपर, और अंतरराष्ट्रीय विस्तार मजबूत (Europe enterprise base के 20 % से ऊपर, Japan एशिया का पहला बाज़ार बन गया)। सबसे संरचनात्मक घोषणा model license ऑफ़र का उद्घाटन है: API के माध्यम से उपयोग-आधारित भुगतान वाले access के बजाय, कुछ enterprise ग्राहक closed model weights और एक proprietary training/inference framework प्राप्त कर सकेंगे, जिसे वे अपने स्वयं के environment में सीधे host और fine-tune कर सकेंगे। Runway चार प्रकार के ग्राहकों को लक्ष्य करता है: अपनी रचनात्मक intellectual property वाली कंपनियाँ, जिन प्लेटफ़ॉर्म्स के पास पहले से compute क्षमता है, कड़े नियामकीय प्रतिबंधों वाले संगठन, और बहुत बड़े volume वाले खिलाड़ी।
Perplexity ने Computer की agentic memory प्रणाली Brain का विवरण दिया
19 अगस्त — Perplexity Computer, अपने स्थानीय agent, की persistent memory प्रणाली Brain के काम करने का तरीका समझाता है। पारंपरिक vector database के बजाय, Brain memory को Git-संस्करणित knowledge wiki के रूप में व्यवस्थित करता है, जो sandbox file system में तीन परतों में फैला है: knowledge/ (wiki), notes/ (distilled excerpts) और sessions/ (raw transcriptions)। एक समर्पित “Memory Agent” पूरे tree को हर startup पर कॉपी करने के बजाय आवश्यक फ़ाइलों को माँग पर लोड करता है, जबकि “Dream” नामक background agents wiki को offline चार चरणों में बनाए रखते हैं, प्रकाशन से पहले जाँचों के साथ।
| मूल्यांकित मीट्रिक | Brain के बिना | Brain के साथ |
|---|---|---|
| शुद्धता (आंतरिक benchmark, 640 प्रश्न) | 0,600 | 0,661 |
| साक्ष्य स्मरण (आंतरिक benchmark) | 0,573 | 0,625 |
| उत्पादन में शुद्धता (पिछले 30 दिन) | संदर्भ | +9,3 अंक |
संक्षेप
- Devin (Cognition) — GPT-5.6 Sol पर अतिरिक्त 20 % छूट — OpenAI GPT-5.6 Sol की कीमत में 20 % की कटौती 3 महीने के लिए जोड़ता है, जो 18 अगस्त से पहले से लागू 70 % छूट के ऊपर है: Devin Desktop और CLI पर संयुक्त छूट अब 3 अक्टूबर 2026 तक 76 % तक पहुँचती है। 🔗 घोषणा
- Google Antigravity 2.9.1 — दूर से एजेंटों को नियंत्रित करने के लिए Remote Control — नई सुविधा जो किसी भी ब्राउज़र से स्थानीय agent सत्र शुरू करने और निगरानी करने देती है, प्रदर्शन में सुधार और त्रुटि के बाद बेहतर पुनर्प्राप्ति के साथ। 🔗 Changelog
- Copilot Max के लिए auto model selection पर -30 % — Copilot Max सब्सक्राइबरों के लिए model selection (Claude, GPT या Microsoft AI) पर प्रमोशन, 30 सितंबर 2026 तक मान्य। 🔗 घोषणा · 🔗 समाप्ति तिथि
- GitHub Universe 2026 — टिकट बिक्री पुनः शुरू — GitHub Universe 2026 सम्मेलन के लिए छोटी वीडियो के माध्यम से marketing relaunch, बिना किसी संबद्ध product घोषणा के। 🔗 वीडियो
- Midjourney — साइट alpha के लिए बड़ा changelog — alpha.midjourney.com पर दो हफ्तों के UX सुधार: project folders, Upscale/Zoom/Vary की वापसी, settings persistence और performance fixes। 🔗 Changelog
- MiniMax ने SambaNova पर M3 model लॉन्च का संकेत दिया — SambaNova की एक रहस्यमयी घोषणा के जवाब में, MiniMax निकट भविष्य में M3 model के आने का संकेत देता है, बिना किसी specification या release date के। 🔗 Tweet
- Grok 4.6 Google Enterprise Agent Platform पर उपलब्ध — model Model Garden (पूर्व Vertex AI) में शामिल होता है, 500,000 token context window और input/output के लिए 2 $ / 6 $ प्रति million token pricing के साथ। 🔗 घोषणा
- Cohere ने superwhisper के माध्यम से voice dictation के लिए local mode सक्रिय किया — “Go Local” mode Cohere Transcribe और superwhisper के खुले S1-mini model (0.6 billion parameters) को जोड़ता है, पूरी तरह device पर transcription के साथ। 🔗 घोषणा
इसका क्या मतलब है
दो स्वतंत्र, आपस में असंबद्ध घोषणाएँ आज एक ही दिशा की ओर इशारा कर रही हैं: किसी AI एजेंट के संचालन को उस मशीन से अलग करना जिस पर वह वास्तव में चलता है। Anthropic में, Claude Code Remote Control अब फोन से सीधे एक सत्र शुरू करने की सुविधा देता है, जिसमें डिवाइसों के बीच स्वतः पुनः कनेक्शन और स्थिति समन्वय शामिल है। Google में, Antigravity अपनी खुद की “Remote Control” सुविधा पेश करता है: किसी भी ब्राउज़र से एक स्थानीय एजेंट सत्र को नियंत्रित और निगरानी करना। दोनों मामलों में, गणना और निष्पादन कार्यस्थल पर ही बने रहते हैं — मोबाइल बनने वाली चीज़ नियंत्रण विंडो है। यह अलगाव अब एक सामान्य उपयोग-स्थिति को संबोधित करता है: अपनी डेवलपमेंट मशीन पर एक लंबा काम शुरू करना, फिर किसी दूसरे उपकरण से उसका अनुसरण करना और नियंत्रण फिर से संभाल लेना, बिना चल रहे निष्पादन को कभी बाधित किए।
आज दिखाई देने वाला दूसरा बदलाव मॉडलों की अर्थव्यवस्था से जुड़ा है। Together AI के दो तुलनात्मक परीक्षण GLM-5.3 को दिखाते हैं, जो Zhipu/Z.ai का एक खुला मॉडल है, जो एक ही सॉफ़्टवेयर इंजीनियरिंग बेंचमार्क पर GPT-5.6 Sol और Claude Fable 5 की बराबरी करता है या उनसे आगे निकल जाता है, वह भी 2 से 5 गुना कम लागत पर। यह कोई अलग-थलग मामला नहीं है: उसी सप्ताह xAI Grok 4.6 के लिए क्लाउड इंटीग्रेशन बढ़ाता है (GitHub Copilot और Amazon Bedrock के बाद Google Enterprise Agent Platform), OpenAI Devin उपयोगकर्ताओं के लिए GPT-5.6 Sol पर 76% की संचयी छूट देता है, और Replit अपने स्वयं के एजेंट मोड का विस्तार करता है। प्रतिस्पर्धा अब केवल मॉडलों की कच्ची क्षमता पर नहीं, बल्कि लागत-प्रभावशीलता और बहु-प्लेटफ़ॉर्म उपलब्धता पर भी है — एक ऐसा क्षेत्र जहाँ खुले मॉडल, मॉडलों के बीच कैस्केड रणनीतियों के साथ मिलकर, बंद मॉडलों के सामने अपने-आप में व्यावसायिक तर्क बन जाते हैं।
एक तीसरा, थोड़ा अधिक सूक्ष्म धागा भी आज के दिन से होकर गुजरता है: स्थायी मेमोरी AI एजेंटों के लिए पूर्ण-स्तरीय अवसंरचना घटक बन रही है। Perplexity Brain की आर्किटेक्चर का विवरण देता है, जो Git के साथ संस्करणित एक ज्ञान-विकी है, जो अपने Computer एजेंट की मेमोरी को पारंपरिक वेक्टर डेटाबेस में ढेर करने के बजाय संरचित करती है, और प्रमाणों की शुद्धता तथा पुनःस्मरण में मापनीय लाभ देती है। उसी समय, Google NotebookLM के पुनर्निर्मित Notebook अनुभव तक पहुँच का विस्तार करता है और उसे सीधे Google Search के AI Mode में एकीकृत करता है, जिससे दस्तावेज़-संक्षेपण उपकरण मुख्य खोज इंजन के और करीब आ जाता है। दोनों मामलों में, अतिरिक्त मूल्य अब केवल अंतर्निहित मॉडल से नहीं आता, बल्कि इस बात से आता है कि संचित इतिहास और ज्ञान को कैसे व्यवस्थित, पुनः प्राप्त और एक सत्र से दूसरे सत्र में पुनः उपयोग किया जाता है।
एक अंतिम कोण उन उपकरणों की परिपक्वता से संबंधित है जो उद्यम में तकनीकी और सुरक्षा टीमों के लिए बनाए गए हैं। OpenAI अपने डैशबोर्ड में API key के अनुसार खर्च की ट्रैकिंग और सख्त कॉन्फ़िगर करने योग्य सीमाएँ जोड़ता है, ठीक उसी समय जब वह Codex Security पर एक विस्तृत गाइड प्रकाशित करता है, जिसमें पूरे रिपॉज़िटरी पोर्टफ़ोलियो का ऑडिट करने में सक्षम एक open source CLI शामिल है। एक ही टीम द्वारा उसी दिन प्रकाशित ये दो घोषणाएँ उन संगठनों की साझा चिंता के प्रति एक सुसंगत प्रतिक्रिया रेखांकित करती हैं जो बड़े पैमाने पर AI एजेंट तैनात करते हैं: इन उपकरणों द्वारा वादा की गई गति से समझौता किए बिना, लागत और सुरक्षा-क्षेत्र पर सूक्ष्म नियंत्रण बनाए रखना।
स्रोत
- Claude Code Remote Control — पूरा थ्रेड
- Claude Code Remote Control — सिंक्रोनाइज़ेशन उद्धरण
- Remote Control दस्तावेज़ीकरण
- Replit — This Week in Replit
- Together AI — DeepSWE पर GLM-5.3 बनाम GPT-5.6 Sol
- Together AI — DeepSWE पर GLM-5.3 बनाम Claude Fable 5
- NotebookLM — X पर घोषणा
- OpenAI — Usage and Spend प्रति API key
- OpenAI — Codex Security और Daybreak
- Grok Bot — X पर घोषणा
- Grok Bot — x.ai विवरण
- Runway — एंटरप्राइज़ रणनीति और मॉडल लाइसेंस
- Perplexity — Brain, Computer की एजेंटिक मेमोरी
- Devin — GPT-5.6 Sol पर अतिरिक्त छूट
- Google Antigravity — changelog 2.9.1
- GitHub — Auto model selection पर -30 %
- GitHub — Auto model selection, समाप्ति तिथि
- GitHub Universe 2026 — टिकट बिक्री पुनः शुरू
- Midjourney — alpha changelog
- MiniMax — M3 मॉडल की घोषणा
- Grok 4.6 — Google Enterprise Agent Platform
- Cohere — स्थानीय मोड superwhisper