ai-powered-markdown-translatorgpt-5.4-mini के साथ fr से hi में अनूदित लेख।
19 अगस्त 2026 को, Anthropic एक शोध अध्ययन प्रकाशित करता है जिसमें Claude जैविक लक्ष्यों से जुड़ने वाले प्रोटीनों को स्वायत्त रूप से डिज़ाइन करता है, जिसे Adaptyv Bio और Twist Bioscience द्वारा प्रयोगात्मक रूप से सत्यापित किया गया। Google छात्रों के लिए एक बैक-टू-स्कूल ऑफ़र लॉन्च करता है जिसमें एक वर्ष का Google AI निःशुल्क मिलता है और Gemini ऐप में एक नया student hub शामिल है, जबकि Replit GPT-5.6 Luna by OpenAI द्वारा संचालित सॉफ़्टवेयर निर्माण के लिए असीमित पहुँच वाला Free Mode खोलता है। इन प्रमुख घोषणाओं के बीच, Cursor अपने cloud agents को और मज़बूत करता है, ElevenLabs अपने real-time voice model को व्यापक बनाता है, और सत्रह अन्य नई सुविधाएँ विकास, खुले शोध और मीडिया प्लेटफ़ॉर्म को कवर करती हैं।
Claude प्रोटीन डिज़ाइन को तेज करता है, Adaptyv Bio और Twist Bioscience द्वारा सत्यापित
19 अगस्त — Anthropic एक शोध प्रयोग के परिणाम प्रकाशित करता है, जिसमें Claude की यह क्षमता परखी गई कि वह स्वायत्त रूप से “minibinders” डिज़ाइन कर सकता है — छोटी प्रोटीनें जो किसी जैविक लक्ष्य से मज़बूती से जुड़ सकती हैं, जो दवा विकास का एक प्रमुख चरण है और सामान्यतः प्रति लक्ष्य विशेषज्ञ कार्य के हफ्तों से महीनों तक की माँग करता है।
Claude Science के माध्यम से, विशेषीकृत डिज़ाइन मॉडल्स (Opus 4.8 और Mythos Preview) तक पहुँच के साथ, Claude ने एक मानव विशेषज्ञ द्वारा लिखे गए साधारण prompt से परीक्षण किए गए 15 में से 14 प्रोटीन लक्ष्यों के विरुद्ध सफलतापूर्वक binders डिज़ाइन किए। सफलता दर multi-target मोड में मॉडल के अनुसार 22,6 % से 26,7 % के बीच रही, और mono-target मोड में 35,1 % तक पहुँची — जबकि वर्तमान डिज़ाइन अभियानों में सामान्य दर 10 से 15 % रहती है। RBX1 लक्ष्य पर, Claude ने 40 % सफलता हासिल की, जबकि संदर्भ प्रतियोगिता के मानव प्रतिभागियों के लिए यह 3,7 % थी।
अलग से, Claude Opus 5 ने मालिकाना software के बिना कच्ची NMR और LC-MS spectrometry फ़ाइलों को संसाधित किया: ±0,08 इकाई की सटीकता के साथ 18 NMR peaks की तालिका के लिए 23 मिनट, और 96,4 % शुद्धता गणना वाले LC-MS chromatogram के लिए 19 मिनट, जबकि प्रयोगशाला परिणाम 96,33 % था।
Anthropic याद दिलाता है कि उच्च-affinity binder दवा की दिशा में केवल पहला चरण है, और ये क्षमताएँ अभी भी दोहरे उपयोग वाली हैं: प्रोटीन डिज़ाइन Claude Fable 5 पर खुले उपयोग में उपलब्ध नहीं है। पूर्ण तकनीकी रिपोर्ट Hugging Face पर open source में प्रकाशित की गई है।
With a protein design prompt written by a human expert, Claude autonomously designed protein binders against 14 out of 15 targets. We then worked with Adaptyv Bio and Twist Bioscience, who independently built and tested the proteins Claude designed.
🇮🇳 एक मानव विशेषज्ञ द्वारा लिखे गए डिज़ाइन prompt से, Claude ने 15 में से 14 लक्ष्यों के विरुद्ध स्वायत्त रूप से प्रोटीन binders डिज़ाइन किए। इसके बाद हमने Adaptyv Bio और Twist Bioscience के साथ काम किया, जिन्होंने Claude द्वारा डिज़ाइन की गई प्रोटीनों को स्वतंत्र रूप से बनाया और परीक्षण किया। — @AnthropicAI X पर
🔗 anthropic.com पर पूर्ण अध्ययन
Gemini के लिए बैक-टू-स्कूल: student hub, study notebooks और Google AI का एक वर्ष निःशुल्क
19 अगस्त — Google 2026 के बैक-टू-स्कूल के लिए एक वैश्विक छात्र ऑफ़र लॉन्च करता है, जिसे Gemini ऐप में एक नए student hub के साथ जोड़ा गया है।
| क्षेत्र | ऑफ़र | योजना की सामग्री |
|---|---|---|
| संयुक्त राज्य अमेरिका | Google AI Pro का 1 वर्ष निःशुल्क (मूल्य 19,99 $/माह) | उपयोग सीमाएँ x4, Gemini Spark, Gmail/Docs एकीकरण, 5 TB संग्रहण |
| 140+ देश | Google AI Plus का 1 वर्ष निःशुल्क | Gemini Omni, दोगुनी सीमाएँ, 400 GB संग्रहण |
यह ऑफ़र पात्र छात्रों के लिए आरक्षित है, इसमें वैध भुगतान कार्ड की आवश्यकता होती है (निःशुल्क अवधि के बाद स्वचालित नवीनीकरण), और दावा विंडो 31 दिसंबर 2026 तक खुली रहती है।
student hub कई नई सुविधाएँ पेश करता है: study notebooks, एक अनुकूली सीखने का वातावरण जिसमें diagnostic quizzes, छात्र की कक्षा सामग्री से बने पाठ और प्रगति डैशबोर्ड शामिल हैं; interactive visualizations — 3D simulations और chat में “Show me…” से prompt शुरू करके बनाए गए dynamic tables; और Gemini Live में Deep Research, जो voice से multi-step research report शुरू करने, background में शोध चलते समय फ़ोन लॉक करने, और फिर परिणामों पर मौखिक रूप से बातचीत करने देता है।
Talk through research with Gemini Live. You can now kick off multi-step research reports with your voice: 1) Ask Gemini Live to Deep Research a complex topic 2) Lock your phone or switch tasks while it works in the background 3) Get notified when it’s done, then seamlessly talk through the findings hands-free.
🇮🇳 Gemini Live के साथ अपने शोध पर चर्चा करें। अब आप voice से multi-step research reports शुरू कर सकते हैं: 1) Gemini Live से किसी जटिल विषय पर Deep Research करने को कहें 2) जब वह background में काम कर रहा हो, तब अपने फ़ोन को लॉक करें या कोई और कार्य करें 3) पूरा होने पर एक notification प्राप्त करें, फिर hands-free mode में परिणामों पर मौखिक रूप से बातचीत करें। — @GeminiApp X पर
Replit, OpenAI के GPT-5.6 Luna द्वारा संचालित Free Mode लॉन्च करता है
18-19 अगस्त — Replit Free Mode लॉन्च करता है, जो रोज़मर्रा के software निर्माण कार्यों के लिए OpenAI के GPT-5.6 Luna द्वारा संचालित एक निःशुल्क और असीमित पहुँच है। यह घोषणा Fortune को विशेष रूप से एक सशक्त साझेदारी के परिणाम के रूप में प्रस्तुत की गई, जिसमें आगे और साझा उत्पाद आने वाले हैं।
| मोड | उपयोग |
|---|---|
| Free Mode | असीमित दैनिक कार्य, कोई credit खर्च नहीं (GPT-5.6 Luna) |
| Power Mode | नियमित उपयोग के लिए cost/speed के अनुसार अनुकूलित मॉडल |
| Max Mode | जटिल builds के लिए उच्च-प्रदर्शन मॉडल |
Replit के अनुसार, Free Mode वही subscription लेकर “30 गुना तक अधिक” बनाने देता है, जिसमें प्रति माह 30 घंटे तक की chat शामिल है और हर 5 घंटे में limits रीसेट होती हैं। जब किसी कार्य को अधिक reasoning की आवश्यकता होती है, Replit GPT-5.6 Sol पर route कर सकता है और फिर project context बनाए रखते हुए Free Mode पर लौट सकता है। Free Mode Core (20 $/माह) और Pro योजनाओं में शामिल है, और Replit के CEO Amjad Masad के अनुसार यह OpenAI द्वारा GPT-5.6 श्रृंखला पर हाल की मूल्य कटौती के कारण संभव हुआ।
Replit के लिए, यह vibe coding के एक ज्ञात friction point का सीधा उत्तर है: usage credits की अप्रत्याशित लागत, जो प्रयोग को धीमा करती है। OpenAI के लिए, यह GPT-5.6 Luna के लिए एक नया showcase है, जिसे frontier model की बजाय बड़े पैमाने के आर्थिक model के रूप में स्थापित किया गया है।
If we can get to a world where anyone with access to the internet can build a product, build a startup, and just kind of get started and get going, I think we’re going to see another renaissance-level entrepreneurial boom like we’ve never seen before.
🇮🇳 यदि हम ऐसी दुनिया तक पहुँच जाते हैं जहाँ इंटरनेट तक पहुँच रखने वाला हर व्यक्ति एक उत्पाद बना सकता है, एक startup शुरू कर सकता है, और बस शुरू करके आगे बढ़ सकता है, तो मुझे लगता है कि हम एक renaissance-स्तर का entrepreneurial उछाल देखेंगे, जैसा हमने पहले कभी नहीं देखा। — Sam Altman, OpenAI CEO, OpenAI द्वारा उद्धृत
Cursor /goal, पृथक sub-agents और Custom Modes के साथ अपने cloud agents को मज़बूत करता है
19 अगस्त — Cursor ऐसी सुविधाओं की एक श्रृंखला प्रकाशित करता है जो उसके cloud agents को अधिक autonomy की ओर धकेलती हैं, और लक्ष्य यह है कि उन्हें हर iteration पर फिर से चलाए जाने वाले उपकरणों के बजाय “एक system की तरह” काम कराया जाए।
/goal: agent को एक स्थायी लक्ष्य देता है जिस पर वह पूर्ण completion तक काम कर सकता है (उदा./goal fix all flaky tests and make CI green), पहली कोशिश पर रुकने के बजाय।- स्वचालित subscriptions : cloud agents अब pull requests, Slack threads और scheduled tasks की निगरानी करते हैं, और जो PR वे स्वयं बनाते हैं उनमें स्वतः subscribe होकर उनकी completion को संचालित करते हैं (CI correction, bots के feedback को संभालना)।
- पृथक machines पर sub-agents : प्रत्येक sub-agent अपने स्वयं के virtual machine पर परियोजना की अलग प्रति के साथ चल सकता है, जो नए वातावरण में परिवर्तन परखने या conflicts के बिना corrections को parallel करने के लिए उपयोगी है।
- Custom Modes : कोई भी skill chat में हमेशा-सक्रिय mode के रूप में pin की जा सकती है, और ⌥⏎ (Mac) या Alt+Entrée (Windows) से सुलभ है।
- बेहतर steering : जब कोई agent काम कर रहा हो तब भेजा गया संदेश उसकी मौजूदा action को बाधित नहीं करता — उसे queue में रखा जाता है और अगले tool call पर लिया जाता है।
यह अद्यतन Cursor (Origin, cloud agents) की उस रणनीति को आगे बढ़ाता है, जिसका उद्देश्य editor को एक साधारण interactive assistant के बजाय autonomous agents के orchestration platform में बदलना है।
ElevenLabs ने Eleven v3 Conversational को सामान्य उपलब्धता में लॉन्च किया
19 अगस्त — ElevenLabs अपने real-time voice के लिए सबसे expressive model Eleven v3 Conversational की सामान्य उपलब्धता की घोषणा करता है, जो अब ElevenAgents और ElevenAPI पर उपलब्ध है।
| विशेषता | विवरण |
|---|---|
| आवाज़ों की लाइब्रेरी | 11 000 से अधिक voices |
| समर्थित भाषाएँ | 70 से अधिक भाषाएँ |
| प्रारंभिक मूल्य | 1 000 characters के लिए 0,05 $ (घटता हुआ) |
मॉडल को विशेष रूप से real-time उपयोग के लिए अनुकूलित किया गया है, streaming generations पर लगातार गुणवत्ता के साथ। यह audio tags पेश करता है जो भावना और स्वर पर सूक्ष्म नियंत्रण देते हैं: आवाज़ों को हँसने, फुसफुसाने, व्यंग्यात्मक स्वर अपनाने या जिज्ञासा व्यक्त करने के लिए निर्देशित किया जा सकता है। प्रदर्शन विशेष रूप से जर्मन, स्पेनिश, फ़्रेंच, पुर्तगाली और हिंदी पर उजागर किया गया है।
यह लॉन्च real-time conversational voice में ElevenLabs की स्थिति को मज़बूत करता है, ऐसा segment जहाँ latency और expressiveness प्रतिस्पर्धी मॉडलों के विरुद्ध भेदक मानदंड हैं। मॉडल के एकीकरण में डेवलपर्स की सहायता के लिए ElevenLabs Devs टीम द्वारा एक पूर्ण walkthrough प्रकाशित किया गया है।
Claude अब Gmail ईमेल भेज सकता है और Google Drive संभाल सकता है
18 अगस्त — Claude अब सीधे Gmail और Google Drive में काम कर सकता है: किसी discussion thread का उत्तर तैयार करना और भेजना, या Drive में फ़ाइलों का प्रबंधन करना, बिना उपयोगकर्ता को सामग्री को मैन्युअल रूप से copy-paste किए। यह सुविधा connectors मेनू के माध्यम से आती है, जहाँ इसे सक्रिय करने के लिए केवल Gmail या Google Drive खाते को जोड़ना होता है।
Anthropic उपयोगकर्ता नियंत्रण पर ज़ोर देता है: वही उपयोगकर्ता तय करता है कि Claude द्वारा ईमेल भेजने या फ़ाइल संशोधित करने से पहले मैन्युअल approval कब आवश्यक है। यह सुविधा अब सभी paid plans पर उपलब्ध है, जो Claude.ai के agentic दायरे का सिर्फ़ chat से आगे एक उल्लेखनीय विस्तार है, और पहले से उपलब्ध connectors (Slack, GitHub) की निरंतरता में है।
Code tools: Amp में remote MCP, Zed 1.16 और GE Aerospace में Devin
तीन editor और code agents 19 अगस्त को उल्लेखनीय updates प्रकाशित करते हैं।
Amp MCP दूरस्थ servers को orbs, TUI और Puck से जोड़ता है
19 अगस्त — Amp (Sourcegraph) अपने सभी interfaces में remote MCP servers के लिए support जोड़ता है: orbs (agents के लिए cloud machines), local TUI और voice assistant Puck। configuration ampcode.com/settings/mcp-servers से की जाती है, OAuth या Bearer token authentication के साथ, व्यक्तिगत configuration या workspace स्तर पर। हालाँकि, MCP Apps, Resources और Prompts अभी supported नहीं हैं — फिलहाल केवल classical MCP tools ही हैं। यह feature मध्य-अगस्त में शुरू की गई Amp की “orbs” strategy को पूरा करता है।
Amp टीम को orb में सहयोग के लिए आमंत्रित करने देता है
19 अगस्त — Amp किसी orb में सहयोगियों को @ के साथ उल्लेख करके आमंत्रित करने की क्षमता जोड़ता है। टैग किए जाने के बाद, व्यक्ति thread देख सकता है, नियंत्रण (“drive”) संभाल सकता है, और agent के साथ बातचीत में सीधे संदेशों का आदान-प्रदान कर सकता है। घोषणा कई ठोस उपयोग मामलों को दर्शाती है: design asset माँगना, diff पर code review माँगना, या production rollout निर्णय तय करना। यह Amp के “orbs” model का एक तार्किक विकास है: किसी agent के लिए समर्पित ये cloud machines अब एक साझा कार्यक्षेत्र बन जाती हैं, न कि केवल एक डेवलपर के workstation पर अलग-थलग उपकरण।
Zed v1.16: foldable Git Panel, named stashes और Gemini 3.6 Flash
19 अगस्त — Zed अपने editor का संस्करण 1.16 जारी करता है। Git Panel की change sections अब foldable हैं, git: stash all command एक stash को नाम देने देती है, और gutter.git_gutter_width setting diff indicators की चौड़ाई समायोजित करती है। Markdown Preview और Agent Panel में, Mermaid diagrams अब zoom और horizontal scrolling का समर्थन करते हैं। मॉडल पक्ष पर, Gemini 3.6 Flash Zed में उपलब्ध Google AI models में शामिल हो जाता है, OpenCode Zen और OpenCode Go के नए models के साथ। यह एक सामान्य maintenance update है, जबकि Zed अपनी प्रमुख feature, Delta, को private beta में जारी रखना जारी रखता है।
Cognition ने GE Aerospace को Devin के ग्राहक के रूप में सामने रखा
17 अगस्त — Cognition (Devin) एक customer testimonial प्रकाशित करता है जिसमें GE Aerospace को सामने रखा गया है, जो अपने aircraft engines से संबंधित embedded software development को तेज़ करने के लिए Devin का उपयोग करता है। Cognition के अनुसार, एक टीम ने उपकरण की मदद से अपने engineering output को लगभग दोगुना कर लिया; संबंधित software flight routes को optimize करते हैं, fuel consumption कम करते हैं और engine anomalies की निगरानी करते हैं। इस घोषणा के साथ कोई विस्तृत लेख नहीं है (न ब्लॉग, न पूर्ण case study): यह X पर एक तात्कालिक संचार है, और इसे उसी रूप में लिया जाना चाहिए — इस स्तर पर सार्वजनिक रूप से बिना विस्तार के एक marketing number।
Liquid AI ने quantization-aware distillation (QAD) से LFM2.5 Q4_0 checkpoints प्रकाशित किए
19 अगस्त — Liquid AI Hugging Face पर LFM2.5 के चार आकारों (230M, 350M, 1,2B-Instruct और 2,6B) के लिए Q4_0 में quantized GGUF checkpoints प्रकाशित करता है, जिन्हें quantization-aware distillation (QAD) से प्राप्त किया गया है: एक high-precision teacher model को सीधे एक quantized student model में distill किया जाता है, बजाय इसके कि बाद में quantization लागू की जाए।
घोषित परिणाम: ये checkpoints classical quantization से खोई औसत सटीकता का 97 % वापस प्राप्त करते हैं, GPQA Diamond, MMLU-Pro और IFEval जैसे benchmarks पर। MacBook Pro, NucBox EVO-X2, Samsung Galaxy S26 Ultra और Raspberry Pi 5 पर परीक्षण में, 230M/350M variants Q5_K_M की गुणवत्ता के बराबर हैं, जबकि throughput 4 से 33 % अधिक है। चारों variants अब उपलब्ध हैं, और llama.cpp के माध्यम से तैनात किए जा सकते हैं।
Gemini: संयुक्त राज्य अमेरिका में Android पर Chrome, Waymo assistant को समाहित करता है
Google Gemini को मुख्य app के बाहर दो नए संपर्क बिंदुओं तक बढ़ाता है।
Gemini अब संयुक्त राज्य अमेरिका में Android पर Chrome में उपलब्ध है
18 अगस्त — Gemini in Chrome, browser में एकीकृत AI assistant, संयुक्त राज्य अमेरिका में Android उपयोगकर्ताओं के लिए खुलता है। बुनियादी सुविधाएँ (लंबे pages का सारांश, Google apps से कनेक्शन, browser में image generation) सभी US Android उपयोगकर्ताओं के लिए उपलब्ध हैं। Google AI Pro और Ultra subscribers को इसके अलावा auto browse सुविधा मिलती है, जो parking जगह बुक करने या online order अपडेट करने जैसे repetitive tasks को पूरा कर सकती है।
Waymo अपने Ojai वाहनों में Gemini को एकीकृत करता है
19 अगस्त — Waymo अपने Ojai स्वायत्त वाहनों में Gemini को एक ऑनबोर्ड AI सहायक के रूप में एकीकृत कर रहा है। यात्री वॉइस कमांड का उपयोग करके केबिन के साथ इंटरैक्ट कर सकते हैं (उदाहरण के लिए, एयर कंडीशनिंग समायोजित करना), आसपास के स्थानों की खोज कर सकते हैं, या अपनी यात्रा के बारे में संदर्भात्मक जानकारी प्राप्त कर सकते हैं। यह एकीकरण Waymo Driver ड्राइविंग सिस्टम से स्वतंत्र रूप से काम करता है: Gemini तब तक निष्क्रिय रहता है जब तक यात्री इसे समर्पित आइकन के माध्यम से स्वेच्छा से सक्रिय नहीं करता, जिससे संवादात्मक सहायक और स्वायत्त ड्राइविंग स्टैक के बीच अलगाव बना रहता है। घोषणा में न तो तैनाती की तिथि बताई गई है, न ही प्रभावित शहरों का उल्लेख है।
GitHub: कोड गुणवत्ता की प्रवृत्तियाँ और Copilot सत्रों का संचालन
दो अपडेट टीमों के काम के गवर्नेंस और ट्रैकिंग पर केंद्रित हैं।
संगठनात्मक Code Quality डैशबोर्ड में Trends टैब जोड़ा गया
19 अगस्त — GitHub का संगठनात्मक Code Quality डैशबोर्ड अब एक Trends टैब से समृद्ध हो गया है। अब तक यह पूरे संगठन के सभी रिपॉज़िटरीज़ में findings के एक स्थिर स्नैपशॉट तक सीमित था; अब इसमें 7, 14 या 30 दिनों का ट्रेंड ग्राफ़ जोड़ा गया है, जिसे health score या severity के अनुसार समूहित किया जा सकता है। दो तालिकाएँ ग्राफ़ को पूरा करती हैं, जो खुली findings की संख्या में बदलाव के आधार पर रिपॉज़िटरीज़ को रैंक करती हैं। यह सुविधा GitHub Enterprise Cloud और Code Quality सक्रिय GitHub Team पर सामान्य उपलब्धता में है, लेकिन GitHub Enterprise Server पर नहीं।
GitHub Copilot ऐप अपने सत्रों के संचालन के लिए My work पैनल का विवरण देता है
19 अगस्त — GitHub एक गाइड प्रकाशित करता है जो GitHub Copilot ऐप के My work पैनल का विवरण देती है, जो Copilot सत्रों से जुड़े pull requests और issues को ट्रैक करने के लिए केंद्रीय हब है। यह चार डिफ़ॉल्ट दृश्य (All, Active, Review requests, Done) और कस्टम दृश्य GitHub फ़िल्टर सिंटैक्स या एक इंटरफ़ेस बिल्डर के माध्यम से प्रदान करता है। दो प्रदर्शन मोड प्रस्तावित हैं — कार्ड जैसी सूची या कस्टमाइज़ेबल कॉलम वाली तालिका — और चुने गए issue या PR से सीधे नया Copilot सत्र शुरू करना भी संभव है, जिसमें bulk में भी शामिल है।
मीडिया जनरेशन: SkillEvaluator, वीडियो distillation और Runway पर असीमित पहुँच
तीन नई चीज़ें क्रमशः एजेंट मूल्यांकन, वीडियो जनरेशन में अनुसंधान और मॉडलों तक पहुँच को प्रभावित करती हैं।
NVIDIA ने SkillEvaluator जारी किया, एजेंट skills के प्रभाव को मापने के लिए एक open source टूल
19 अगस्त — NVIDIA SkillEvaluator जारी करता है, एक open source टूल जो AI एजेंट skills के वास्तविक प्रभाव को मापता है। टीम ने 30+ उत्पादों पर 300 से अधिक सत्यापित NVIDIA skills का मूल्यांकन किया, एक ही एजेंट के प्रदर्शन की तुलना एक ही कार्य पर, skill इंस्टॉल होने के साथ और बिना skill के की। पाँच आयामों पर मापे गए परिणाम: correction +41 अंक (46→87), discoverability +40, efficiency +39, efficacy +35, safety +1 — सभी आयामों को मिलाकर औसतन +31 अंकों का लाभ। NVIDIA बताता है कि skill का डोमेन एजेंट harness के चयन से कहीं अधिक महत्वपूर्ण है (उत्पाद के अनुसार +2 से +46 अंकों तक का बदलाव, जबकि harness के अनुसार लगभग 5 अंक)।
Context-Matched Distillation (CMD): तेज़ और नियंत्रित autoregressive वीडियो जनरेशन
14 अगस्त — एक शोधकर्ता (Hmrishav Bandyopadhyay), जिसे NVIDIA AI ने साझा किया, Context-Matched Distillation (CMD) प्रस्तुत करता है, जो तेज़ और नियंत्रित autoregressive वीडियो जनरेशन के लिए एक framework है। यह विधि Prefix Scoring के माध्यम से teacher model के मूल्यांकन को student model के जनरेशन context से संरेखित करती है: एक causal teacher भविष्य के frames तक पहुँच के बिना प्रत्येक target का मूल्यांकन करता है, पारंपरिक bidirectional तरीकों के विपरीत। CMD image-by-image या block-based generation की अनुमति देता है, प्रत्येक frame पर camera trajectory के इंटरैक्टिव नियंत्रण और कुछ चरणों में कुशल inference के साथ, जो real time के लिए उपयुक्त है।
MiniMax H3 Runway पर असीमित जनरेशन में जाता है (सीमित ऑफ़र)
19 अगस्त — Runway घोषणा करता है कि वीडियो मॉडल MiniMax H3 Max योजना के उपयोगकर्ताओं के लिए सीमित अवधि के लिए असीमित जनरेशन में जा रहा है: इस मॉडल के साथ जनरेशन पर अब कोई सीमा या गिनती नहीं होगी। MiniMax_AI ने भी अपनी ओर से वही घोषणा साझा की, जिससे दोनों प्लेटफ़ॉर्मों के बीच क्रॉस ऑफ़र की पुष्टि हुई। कोई नया मॉडल लॉन्च नहीं किया गया है: यह पहले से उपलब्ध मॉडल के उपयोग की शर्तों में एक अस्थायी बदलाव है, जिसका उद्देश्य Runway पर MiniMax H3 को अपनाने को बढ़ावा देना है।
GLM-5.3: ऑनलाइन API और benchmarks का सारांश
18 अगस्त — GLM-5.3 (Z.ai) का API ऑनलाइन है, आधिकारिक API और साझेदार gateways के माध्यम से उपलब्ध, GLM-5.2 के समान ही मूल्य पर। Artificial Analysis एक विस्तृत संख्यात्मक सारांश प्रकाशित करता है:
| मीट्रिक | GLM-5.2 | GLM-5.3 |
|---|---|---|
| AA Intelligence Index | 53 | 60 |
| GDPval-AA v2 (Elo, agentic) | 1524 | 1770 |
| प्रति कार्य लागत | 0,44 $ | 0,68 $ |
मॉडल समान आर्किटेक्चर (753 अरब पैरामीटर, MoE में 40 अरब सक्रिय), 1 मिलियन tokens की context window, MIT लाइसेंस, और इनपुट में प्रति मिलियन tokens 1,40 $ तथा आउटपुट में 4,40 $/million की दर बनाए रखता है। प्रति कार्य 0,68 $ की लागत पर, GLM-5.3 अभी भी Kimi K3 से 19 % सस्ता और GPT-5.6 Sol से 45 % सस्ता है। Terminal-Bench 3.0 पर, मॉडल 4,6 % से 32,4 % तक छलांग लगाता है। Z.ai के अनुसार खुले weights « एक सप्ताह के भीतर » अपेक्षित हैं।
🔗 Artificial Analysis विश्लेषण
OpenAI: API गोपनीयता सुदृढ़ और यूरोप में विज्ञापन विस्तार
19 अगस्त की OpenAI की दो घोषणाएँ क्रमशः enterprise डेटा की गोपनीयता और विज्ञापन कार्यक्रम के विस्तार को प्रभावित करती हैं।
OpenAI Zero Data Retention को फिर से लॉन्च करता है और Private Safety Processing का पूर्वावलोकन करता है
19 अगस्त — OpenAI योग्य API ग्राहकों के लिए Zero Data Retention (ZDR) के प्रति अपनी प्रतिबद्धता दोहराता है: मॉडलों के prompts और उत्तरों को प्रसंस्करण के बाद संग्रहीत नहीं किया जाता, और सामग्री OpenAI कर्मियों के लिए सुलभ नहीं होती। कंपनी Private Safety Processing का भी पूर्वावलोकन करती है, जिसे कई जुड़ी हुई अंतःक्रियाओं के माध्यम से दुरुपयोग के पैटर्न पहचानने के लिए डिज़ाइन किया गया है (दुर्भावनापूर्ण इरादे, guardrails की बार-बार जाँच) बिना OpenAI कर्मियों को अंतर्निहित सामग्री तक पहुँच दिए — चाहे वह सामग्री ग्राहक के infrastructure पर रहे या ग्राहक-नियंत्रित कुंजियों के साथ एन्क्रिप्टेड रूप में संग्रहीत हो। स्वचालित प्रणालियाँ संभावित दुरुपयोग की पहचान करती हैं और सीमित सुरक्षा संकेत लौटाती हैं।
ChatGPT Ads 31 यूरोपीय बाज़ारों में विस्तारित
19 अगस्त — OpenAI अगले सप्ताह ChatGPT Ads को 31 यूरोपीय देशों तक विस्तारित करने की घोषणा करता है (जर्मनी, फ़्रांस, स्पेन, इटली, स्वीडन, नॉर्वे, डेनमार्क, नीदरलैंड, ऑस्ट्रिया, आदि) — फरवरी में अमेरिका में पायलट के रूप में शुरू हुए विज्ञापन कार्यक्रम का अब तक का सबसे बड़ा विस्तार। विज्ञापन केवल Free और Go योजनाओं के उपयोगकर्ताओं को दिखाए जाएंगे — Plus, Pro और Enterprise सदस्यताएँ विज्ञापन-मुक्त रहेंगी। OpenAI ने लक्ष्यीकरण को CPM/CPC से आगे बढ़ाकर conversion optimization तक विस्तारित किया है, जिसमें geotargeting, custom audiences और OpenAI Pixel के माध्यम से measurement शामिल है।
DeepSeek V4 Pro Perplexity Computer में उपलब्ध, अमेरिका में होस्ट किया गया
18 अगस्त — Perplexity DeepSeek V4 Pro को Perplexity Computer में जोड़ता है, अमेरिका में स्थानीयकृत होस्टिंग के साथ — यह उन ग्राहकों के लिए महत्वपूर्ण है जो डेटा स्थानीयकरण को लेकर चिंतित हैं, न कि चीन में DeepSeek पर होस्टिंग के लिए। टीम बताती है कि उसने मॉडल का अपने आंतरिक benchmark WANDR पर मूल्यांकन किया, जहाँ यह प्रति कार्य 0,75 $ की लागत के लिए 0,359 का स्कोर प्राप्त करता है, यानी लागत-प्रदर्शन सीमा पर अगले मॉडल की तुलना में 62 % सस्ता। यह घोषणा अन्य प्रदाताओं (Together AI, Novita) पर देखे गए DeepSeek V4 Pro के व्यापक तैनाती के अनुरूप है, यहाँ Perplexity ecosystem के लिए एक विशिष्ट संख्यात्मक डेटा के साथ।
संक्षेप
- Claude Desktop लगभग दो गुना तेज़ शुरू होता है — पृष्ठभूमि throttling में एक सुधार ने एक महीने पहले पहचानी गई startup मंदी को ठीक कर दिया। 🔗 Tweet
- GPT-5.6 Sol Devin Desktop और Devin CLI में 3 अक्टूबर तक -70 % — Cognition का एक प्रचार, FrontierCode 1.1 benchmark पर प्रदर्शनकारी माने गए मॉडल पर। 🔗 Tweet
- Replit नए enterprise governance टूल तैयार कर रहा है — पूर्ण audit logs, enterprise workspace सेटिंग्स और बड़े पैमाने पर administration API, बिना किसी निर्दिष्ट उपलब्धता तिथि के। 🔗 Tweet
- DeepSeek V4 Flash 1,000 शोध पत्रों का सार 4 USD में करता है — एक तृतीय-पक्ष डेवलपर ने वर्ष के सर्वश्रेष्ठ पत्रों का सारांश और दृश्यांकन कुल 4 $ की लागत पर किया। 🔗 Tweet
- Higgsfield AI वीडियो inference के लिए Together AI की ग्राहक बनती है — Cinema Studio के पीछे का प्लेटफ़ॉर्म, 400 M$ की फंडिंग के तुरंत बाद, अपने वीडियो मॉडलों को Dedicated Container Inference पर चलाता है। 🔗 Tweet
- Gemini ऐप में BTS की चार इंटरैक्टिव experiences — संगीत क्विज़, टूर ट्रैकिंग और कोरियाई सीखना, code 7777 के माध्यम से उपलब्ध। 🔗 Google घोषणा
- JetBrains में GitHub Copilot के लिए enterprise-managed settings — प्लगइन गवर्नेंस, MCP servers की allowlist, OpenTelemetry configuration और permission modes का नियंत्रण। 🔗 Changelog
- टोकन प्रकार के अनुसार credentials की revocation और deauthorization — सुरक्षा incident के दौरान GitHub PAT, SSH keys, OAuth tokens या GitHub App को लक्षित करने देता है। 🔗 Changelog
- HeyGen रियल एस्टेट विज्ञापन वीडियो के लिए 4K upscale लॉन्च करता है — बिना नए शूट के धुंधले वीडियो को 4K में बदलना। 🔗 Tweet
- HeyGen समाचार रियल एस्टेट वीडियो का स्वचालित अनुवाद करता है — गैर-अंग्रेज़ी खरीदारों तक पहुँचने के लिए 175 से अधिक भाषाएँ। 🔗 Tweet
- Synthesia व्यक्तिगत lookalikes निर्माण को बढ़ावा देता है — अपने ही चेहरे से उत्पन्न एक डिजिटल avatar, जो कुछ ही मिनटों में किसी भी उपयोगकर्ता के लिए उपलब्ध है। 🔗 Tweet
- Suno web और mobile पर playlists प्रबंधन में सुधार करता है — shuffle, गानों का पुन: क्रम निर्धारण और playlists फ़िल्टरिंग, mobile बाद में आएगा। 🔗 Tweet
- Kimi K3 Ollama Cloud के माध्यम से उपलब्ध, Claude Code और OpenCode में एकीकृत — सीधे
ollama launch claude --model kimi-k3:cloudके साथ तैनात किया जा सकता है। 🔗 Tweet - Advanced Account Security में तकनीकी समस्या कुछ उपयोगकर्ताओं से Daybreak Blue की पहुँच छीन लेती है — प्रभावित खातों को 1 सितंबर की समय-सीमा से पहले फिर से सत्यापित करना होगा। 🔗 Tweet
- NVIDIA ChatGPT Work के साथ अपनी टीमों को कैसे सक्षम बनाता है — GTM और solutions architecture टीमें स्वचालित workflows पर प्रति सप्ताह 16 घंटे तक बचाती हैं। 🔗 OpenAI केस स्टडी
इसका क्या अर्थ है
बड़े मॉडल अब केवल बेंचमार्क पर नहीं, बल्कि प्रयोगशाला में मापे गए परिणाम देने लगे हैं। प्रोटीन डिज़ाइन पर Anthropic का अनुभव अब एक नए स्तर पर पहुँचता है: Claude अब केवल संभावित पाठ नहीं बनाता, उसके protein binders को Adaptyv Bio और Twist Bioscience द्वारा स्वतंत्र रूप से निर्मित और परीक्षण किया गया है, और सफलता दर क्षेत्र के मानकों से आगे निकल जाती है। एक अलग संदर्भ में, NVIDIA का SkillEvaluator coders के agents के skills पर उसी नियंत्रित परीक्षण तर्क को लागू करता है — वही कार्य, वही मॉडल, केवल स्थापित skill चर है — और +41 अंकों तक के लाभ को वस्तुनिष्ठ बनाता है। ये दोनों घोषणाएँ एक साझा सिद्धांत साझा करती हैं: किसी AI क्षमता के वास्तविक योगदान को मापना, न कि उसके मूल्य को मान लेना।
सॉफ़्टवेयर विकास का agentic infrastructure लंबी स्वायत्तता के इर्द-गिर्द घना होता जा रहा है। Cursor एक persistent लक्ष्य (/goal) और पृथक मशीनों पर उप-agents लाता है, Amp अपने orbs को दूरस्थ MCP servers और टीम सहयोग के लिए खोलता है, और Zed अपने रखरखाव को जारी रखता है जबकि इसकी प्रमुख सुविधा Delta private beta में बनी रहती है। दूसरी ओर, Devin GE Aerospace के साथ एयरोनॉटिक्स में अपनी पकड़ बनाता है। ये अपडेट एक ही लक्ष्य की ओर अभिसरण करते हैं: agents को हर iteration पर पुनः शुरू किए जाने वाले टूल के बजाय एक सतत प्रणाली के रूप में काम कराना। Replit इस तर्क को पहुँच तक बढ़ाता है: GPT-5.6 Luna द्वारा संचालित Free Mode, रोज़मर्रा के कार्यों के लिए software निर्माण को मुफ्त बनाता है, एक निर्णय जो frontier models की inference लागत में निरंतर गिरावट से संभव हुआ है।
डेटा और पहुँच का गवर्नेंस एक अलग बिक्री तर्क बनता जा रहा है। OpenAI ग्राहक सामग्री को उजागर किए बिना दुरुपयोग का पता लगाने के लिए Private Safety Processing का पूर्वावलोकन करता है, अपने Zero Data Retention commitment के पूरक के रूप में। GitHub, अपनी ओर से, अब किसी incident के दौरान token प्रकार के अनुसार credentials को revoke करने की अनुमति देता है, JetBrains में Copilot के लिए enterprise-managed settings जोड़ता है, और अपने संगठनात्मक Code Quality dashboard को कई हफ्तों की Trends दृश्य से समृद्ध करता है। तीनों मामलों में, मुद्दा किसी एक सुविधा से परे है: सुरक्षा और अनुपालन टीमों को सूक्ष्म नियंत्रण के उपकरण देना, जो enterprise में AI adoption के लिए एक बढ़ती हुई सामान्य शर्त है।
लागत-प्रदर्शन अनुपात मॉडलों के बीच प्रतिस्पर्धा को लगातार आकार देता है। Z.ai का GLM-5.3, Artificial Analysis Intelligence Index पर Kimi K3 के करीब पहुँचता है, जबकि GPT-5.6 Sol की तुलना में प्रति कार्य सस्ता रहता है, अपने खुले weights के प्रकाशन की प्रतीक्षा करते हुए। DeepSeek V4 Pro Perplexity में अमेरिकी होस्टिंग और एक लागत-प्रदर्शन स्कोर के साथ स्थापित होता है जो सीमा पर अगले मॉडल से 62 % कम है। इसके विपरीत, Liquid AI निचले स्तर को अनुकूलित करता है: इसके LFM2.5 checkpoints, distillation quantization-aware द्वारा quantized, एक पारंपरिक quantization से खोई गई सटीकता का 97 % वापस प्राप्त करते हैं, ताकि Raspberry Pi 5 पर चल सकें। और Kimi K3 Ollama के cloud में शामिल हो जाता है, जिसे सीधे Claude Code से उपयोग किया जा सकता है — यह संकेत है कि अब tools के बीच portability भी मॉडल जितनी ही महत्वपूर्ण है।
स्रोत
- Anthropic — प्रोटीन डिज़ाइन को तेज़ करता Claude
- ट्वीट @AnthropicAI
- ट्वीट @claudeai — Gmail और Google Drive
- ट्वीट @ClaudeDevs — 2x स्टार्टअप
- Cursor — 19 अगस्त का चेंजलॉग
- Replit — Free Mode
- OpenAI — Replit
- Amp — orbs में MCP
- Amp — एक orb में सहयोग करना
- ट्वीट @zeddotdev — Zed v1.16
- ट्वीट @cognition — GE Aerospace
- ट्वीट @devindesktop — GPT-5.6 Sol प्रमोशन
- ट्वीट @Replit — एंटरप्राइज़ गवर्नेंस
- Hugging Face — LFM2.5 QAD
- ट्वीट @nutlope — DeepSeek V4 Flash
- ट्वीट @togethercompute — Higgsfield AI
- Google — Gemini छात्र ऑफ़र
- ट्वीट @GeminiApp — Gemini Live में Deep Research
- ट्वीट @googlechrome — Chrome Android में Gemini
- Google — Waymo में Gemini
- Google — BTS इंटरैक्टिव अनुभव
- GitHub Changelog — कोड गुणवत्ता प्रवृत्तियाँ
- GitHub Blog — My work पैनल
- GitHub Changelog — JetBrains प्रबंधित पैरामीटर
- GitHub Changelog — credentials का निरस्तीकरण
- ट्वीट @ElevenLabs — Eleven v3 Conversational
- ट्वीट @NVIDIAAI — SkillEvaluator
- ट्वीट @hmrishavbandy — Context-Matched Distillation
- ट्वीट @runwayml — असीमित MiniMax H3
- ट्वीट @HeyGen — 4K अपस्केल
- ट्वीट @HeyGen — रियल एस्टेट वीडियो अनुवाद
- ट्वीट @synthesiaIO — lookalikes
- ट्वीट @suno — playlists
- ट्वीट @ArtificialAnlys — GLM-5.3 का सारांश
- ट्वीट @ollama — Ollama Cloud पर Kimi K3
- OpenAI — Zero Data Retention और Private Safety Processing
- OpenAI — यूरोप में ChatGPT Ads
- ट्वीट @OpenAIDevs — Daybreak Blue
- OpenAI — NVIDIA ChatGPT Work केस स्टडी
- ट्वीट @perplexity_ai — DeepSeek V4 Pro