खोजें

Alibaba में Qwen3.8-Max, GenOffice ओपन सोर्स, API v0: 3 अगस्त की घोषणाएँ

कृत्रिम बुद्धिमत्ता द्वारा जनित लेख
Alibaba में Qwen3.8-Max, GenOffice ओपन सोर्स, API v0: 3 अगस्त की घोषणाएँ

ai-powered-markdown-translator

फ्र से हिंदी में अनूदित लेख gpt-5.4-mini के साथ।

GitHub पर प्रोजेक्ट देखें ↗

3 अगस्त 2026 तीन प्रमुख घोषणाओं को समेटे हुए है: Alibaba ने Qwen3.8-Max पेश किया, जो उसके 2.4 T पैरामीटर वाले नए फ्लैगशिप मॉडल के रूप में सामने आया; Genspark ने अपनी ऑफिस सूट GenOffice को ओपन सोर्स कर दिया; और Vercel ने v0 के लिए एक प्रोग्रामेटिक API खोली। इन तीन रिलीज़ के इर्द-गिर्द Cursor, GitHub, Sakana AI, MiniMax, Runway, ElevenLabs और Google ने उत्पाद अपडेट की झड़ी लगा दी।


Qwen3.8-Max, कोड और सह-कार्य के लिए Alibaba का नया फ्लैगशिप मॉडल

Alibaba ने Qwen3.8-Max पेश किया, जिसे कंपनी का अब तक का सबसे सक्षम मॉडल बताया गया है, और जिसका फोकस कोड तथा AI के साथ सहयोगी काम (cowork) पर है। इस मॉडल में 2.4 T पैरामीटर हैं और यह API तथा Qwen Studio के माध्यम से तुरंत उपलब्ध है।

टीम चार प्रगति क्षेत्रों पर ज़ोर देती है: दीर्घकालिक स्वायत्त विकास (दस दिन या उससे अधिक का स्व-विकास, खाली फ़ोल्डर से उत्पादन तक, और परियोजना का पूरा ट्रेस GitHub पर प्रकाशित), कई व्यवसायों में प्रोडक्शन-गुणवत्ता वाले आउटपुट, लंबी क्षितिज वाली स्वायत्त योजना — उदाहरण के तौर पर चिप डिज़ाइन के 500 राउंड तक के अनुकूलन और e-commerce रणनीति के 365 दिन — और मूलभूत मल्टीमोडल बुद्धिमत्ता, जहाँ vision लगातार योजना, निष्पादन और स्व-सुधार को पोषण देती है।

Alibaba घोषणा के बाद वाले सप्ताह में Qwen3.8-Max के weights जारी करने का ऐलान करती है, साथ ही एक हल्के संस्करण Qwen3.8-27B को open weights के रूप में उपलब्ध कराने की भी। यह मॉडल घोषणा के दिन से ही Venice, एक anonymous chat प्लेटफ़ॉर्म, पर भी उपलब्ध है, और उसी दिन बिना अतिरिक्त विवरण के एक “Command Code” नामक उपकरण में एकीकरण का उल्लेख भी किया गया।

संकेतकमूल्य
पैरामीटर2.4 T
इनपुट मूल्य2.0 $ / million tokens
आउटपुट मूल्य6.0 $ / million tokens
निहित cache0.25 $ / million tokens
weights खोलनाअगला सप्ताह (Qwen3.8-Max + Qwen3.8-27B)

🔗 X पर घोषणा


Genspark ने GenOffice का कोड खोला, अपनी AI ऑफिस सूट

Genspark ने GenOffice को open source करने की घोषणा की है, जिसे PC और Mac के लिए पहली पूर्ण, open source AI ऑफिस सूट के रूप में प्रस्तुत किया गया है। यह उपकरण सभी के लिए मुफ़्त है और इसमें कोई विज्ञापन नहीं है।

यह सूट एक सामान्य ऑफिस पैक के सभी उपयोगों को कवर करता है — वर्ड प्रोसेसिंग (Docs), स्प्रेडशीट (Sheets), प्रेज़ेंटेशन (Slides) और PDF — साथ ही सामान्य संपादन उपकरण भी देता है। Genspark इसमें अपना Super Agent जोड़ता है, जो शोध कर सकता है, डेटा का विश्लेषण कर सकता है, फिर एक दस्तावेज़ लिख सकता है या एक प्रेज़ेंटेशन बना सकता है, और इसके लिए Genspark क्रेडिट्स खर्च होते हैं।

विकास पद्धति की दृष्टि से एक उल्लेखनीय तथ्य: Alpha संस्करण केवल एक इंजीनियर ने एक सप्ताह में बनाया, और इसकी लागत 10,000 डॉलर के tokens थी।

“One engineer, one week, $10,000 in tokens. That’s what it took to build the GenOffice Alpha.”

🇮🇳 एक इंजीनियर, एक हफ़्ता, 10,000 डॉलर के tokens। GenOffice के Alpha संस्करण को बनाने में इतनी मेहनत लगी।@genspark_ai on X

परियोजना को स्पष्ट रूप से Alpha चरण में रखा गया है: Genspark समुदाय को उपकरण आज़माने, bugs रिपोर्ट करने और GenTeam पर समर्पित group chat के माध्यम से सुविधा अनुरोध भेजने के लिए आमंत्रित करता है, बिना code लिखे। सबसे उपयोगी योगदानकर्ताओं को धन्यवादस्वरूप 1,000 से अधिक Genspark क्रेडिट्स मिलते हैं। घोषणा Singapore संस्करण वाले AGI Playground में हुई, जहाँ Genspark यह तर्क देता है कि जैसे-जैसे मॉडल सस्ते होते जाते हैं, मूल्य सबसे अच्छे अनुभव की ओर स्थानांतरित हो जाता है जो उनके ऊपर बनाया गया हो।


Vercel ने v0 के लिए एक प्रोग्रामेटिक API लॉन्च की

Vercel ने एक नया API v0 खोला है, जो आज से उपलब्ध है, और जो अब तक केवल chat interface तक सीमित क्षमताओं तक programmatic पहुँच देता है। व्यावहारिक रूप से, अब एक developer अपने स्वयं के code से v0 को नियंत्रित कर सकता है, बजाय website के माध्यम से जाने के।

चार operations उपलब्ध हैं: text prompt, मौजूदा code repository या ZIP archive से conversation शुरू करना; development server का preview तैयार करना ताकि परिणाम live देखा जा सके; generation पर iterating के लिए follow-up messages भेजना; और परिणाम को सीधे Vercel पर deploy करना।

यह API v0 को third-party toolchains में जोड़े जा सकने वाले एक घटक में बदल देती है — agents, automation scripts, internal integrations — न कि केवल एक standalone consumer product में। यह Vercel की उस strategy के अनुरूप है जिसमें v0 को interfaces की एक generation layer बनाया जा रहा है, जिसे अन्य agents उपयोग कर सकें, यहाँ तक कि ऐसे third-party agents भी जो उसके ऐतिहासिक chat के बिना v0 को संचालित करें।

उन टीमों के लिए जो पहले से development agents बना रही हैं, यह code generation, preview और deployment को एक पूरी तरह automated pipeline में जोड़ने की संभावना खोलता है, बिना हर चरण पर मानवीय हस्तक्षेप के।

🔗 X पर घोषणा


Cursor: अधिक प्रभावी cloud agents और नए Google Workspace plugins

Cursor ने उसी दिन दो अलग-अलग अपडेट प्रकाशित किए, एक अपने cloud agents के प्रदर्शन पर, दूसरा Google Workspace integration पर।

Cloud agents: 20 से 30 % कम tokens

Cursor अपने cloud agents के लिए महत्वपूर्ण efficiency gains की घोषणा करता है: सभी tasks में 20 से 30 % कम tokens consumed, और computer control (computer use) का उपयोग करने वाले tasks पर 80 % तक अधिक efficiency। ये gains MCP servers, skills और computer use के बेहतर प्रबंधन से आए हैं। घोषित उद्देश्य उपयोगकर्ताओं को अधिक महत्वाकांक्षी tasks delegate करने देना है, जबकि वे अपने token budget के भीतर रहें।

🔗 X पर घोषणा

Editor में integrated Google Workspace plugins

Cursor अब “Customize” page या Cursor Marketplace से उपलब्ध plugins के माध्यम से, editor छोड़े बिना, सीधे Google Workspace को पढ़, लिख और उस पर कार्य कर सकता है।

Workspace सेवाक्षमताएँ
Google Driveफ़ाइलें खोजना, खोलना और डाउनलोड करना, फ़ोल्डर व्यवस्थित करना
Gmailमेल खोजना और पढ़ना, संदेश लिखना और भेजना
Google Calendarकैलेंडर देखना, घटनाएँ बनाना, खाली समय-स्लॉट ढूँढ़ना
Google Docsदस्तावेज़ खोलना, पढ़ना, लिखना और संशोधित करना
Google Sheetsरेंज पढ़ना, सेल अपडेट करना, शीट बनाना
Google Chatस्पेस और संदेशों तक पहुँच, संदेश भेजना

उद्देश्य यह है कि developer अपनी मेल या कैलेंडर के context का लाभ सीधे Cursor से उठा सके, बिना browser पर बार-बार जाने के।

🔗 Cursor changelog


GitHub Agentic Workflows, Aspire में cross-repo documentation को स्वचालित करता है

GitHub, GitHub Agentic Workflows के एक ठोस use case पर ज़ोर देता है: Aspire टीम इसका उपयोग merged features को automatically documentation pull requests में बदलने के लिए करती है, जो कई repositories में वितरित होती हैं। यह system सीमित permissions (scoped permissions) लागू करता है और merge से पहले विषय-विशेषज्ञ द्वारा human review (SME review) अनिवार्य करता है।

ट्रैक किया गया मीट्रिकमूल्य
merged documentation PRs82 / 82
median merge delay44.8 घंटे

यह अनुभव GitHub की agentic workflows संबंधी प्राथमिकताओं में से एक को स्पष्ट करता है: दोहराए जाने वाले documentary maintenance tasks को automate करते हुए human को loop में बनाए रखना।

🔗 X पर घोषणा


GitHub ने अपना जुलाई 2026 Ship Log प्रकाशित किया

GitHub जुलाई 2026 की अपनी मासिक रिलीज़-सारांश प्रकाशित करता है, जिसका केंद्र developer choice का विषय है।

GitHub Copilot desktop application अब सभी plans के लिए उपलब्ध है, जिनमें Copilot Free और GitHub Education शामिल हैं; बिना subscription वाले developer भी अपनी खुद की model provider key (bring your own key) का उपयोग कर सकते हैं। Copilot का model selector और समृद्ध हुआ है: Kimi K2.7 Code picker में चयन योग्य पहला open-weight model बन गया है, OpenAI GPT-5.6 family Copilot में शामिल हो गई है, जिसमें GPT-5.6 Luna के लिए 80 % और GPT-5.6 Terra के लिए 20 % मूल्य कटौती हुई है, और Anthropic का Opus 5 सामान्य उपलब्धता में आ गया है। GitHub Projects को बेहतर filters और multiple-selection fields पर आधारित tags system भी मिला है।

🔗 X पर सारांश


Sakana Namazu, जापानी बाज़ार के लिए तैयार एक LLM API

Sakana AI ने Sakana Namazu API ऑनलाइन जारी की है, जो अब तक Sakana Chat application तक सीमित उसके Namazu model का सेवा-आधारित संस्करण है। यह model Moonshot AI के open-weight model Kimi K2.6 पर आधारित है, जिसे Sakana AI ने जापानी भाषा और व्यापारिक उपयोगों के लिए fine-tune किया है।

यह API OpenAI format के साथ compatible है: मौजूदा code में केवल base URL और API key बदलनी होती है। इसमें web search और code execution के integrated tools शामिल हैं, साथ ही कई चरणों को स्वायत्त रूप से जोड़ने की agentic क्षमताएँ भी हैं।

Sakana AI तीन उपयोग-परिदृश्यों पर ज़ोर देती है: बाज़ार-अध्ययन रिपोर्टों का स्वायत्त generation, customer support automation, और एक creative application जो एक साधारण निर्देश से लगभग 1,000 animated fish को नियंत्रित करती है। जापानी सांस्कृतिक संदर्भ के लिए समर्पित FairPoliticsQA benchmark पर स्कोर 34.10 % से बढ़कर 56.30 % हो जाता है।

🔗 आधिकारिक घोषणा


MiniMax H3: weights अब प्रकाशित हैं

MiniMax ने 31 जुलाई को अपना खुला multimodal model H3 घोषित किया था — जिसे पहले ही इन कॉलमों में कवर किया जा चुका है। 3 अगस्त को, weights वास्तव में open weights के रूप में प्रकाशित किए गए, और open source inference chain के पूरे दायरे पर “Day-0” support का दावा किया गया।

inference toolDay-0 support
ComfyUIमूल एकीकरण, रिलीज़ के साथ ही एक model और पाँच workflows
vLLM-OmniOpenAI API-compatible वीडियो endpoint
SGLang / LMSYSअनुकूलनीय स्थानीय समर्थन, NVIDIA और AMD hardware पर execution
falउपयोग के लिए तैयार production infrastructure

MiniMax इस रिलीज़ को घोषणा और वास्तविक उपलब्धता के बीच की एक अवस्था के पार जाने के रूप में प्रस्तुत करता है: weights खुले हैं, और production deployment भी उपलब्ध है। तीसरे-पक्ष partner Magnific ने भी एक ही generation में, character-by-character native lip-sync demo प्रस्तुत किया है।

🔗 X पर घोषणा


Runway ने Seedance 2.5 के 7 दिनों के unlimited access के साथ Max plan लॉन्च किया

Runway ने subscription की एक नई tier, Max plan, की घोषणा की है, और launch offer के साथ: पंजीकरण करने वालों को प्लेटफ़ॉर्म पर उपलब्ध होते ही Seedance 2.5 model तक 7 दिनों का unlimited access मिलता है।

Seedance 2.5, जिसका पहले से हमारी पिछली editions में उल्लेख हो चुका है, अभी Runway पर उपलब्ध नहीं है (“coming soon”): आज की नवीनता वास्तव में नया plan और उसकी early access offer है, न कि model स्वयं।

🔗 X पर घोषणा


ElevenAgents: enterprise स्तर पर ElevenLabs की voice AI

ElevenLabs अपनी voice agents और chat platform ElevenAgents की scale और क्षमताओं का विवरण देती है।

“More than 10 million conversations run on ElevenAgents every week.”

🇮🇳 हर सप्ताह ElevenAgents पर दस मिलियन से अधिक conversations processed होती हैं।@ElevenLabs on X

हर conversation एक वास्तविक interaction से मेल खाती है, जिसे natural-tone वाली आवाज़ या chat agent संभालता है: refund request, appointment booking, benefits-related सवाल, flight change। प्लेटफ़ॉर्म production में जाने से पहले scenario simulation, multichannel deployment, और Spotlight tool के माध्यम से monitoring प्रदान करता है, जो production conversations पर नज़र रखता है और proactive improvement recommendations देता है। enterprise पक्ष में, ElevenLabs configurable guardrails और regional data residency options पर ज़ोर देती है, और इसके ग्राहक startups से लेकर governments और Fortune 500 enterprises तक हैं।


Google और PSG: Gemini क्लब का आधिकारिक AI assistant बना

Paris Saint-Germain और Google ने 2029 तक चलने वाले Premium partnership पर हस्ताक्षर करने की घोषणा की है। इस ढाँचे के तहत, Google Gemini क्लब का आधिकारिक AI assistant बनता है, जबकि Google Pixel PSG का आधिकारिक smartphone बन जाता है।

यह एक sponsorship और distribution समझौता है, जिसमें आज तक किसी संभावित product functionality या integration के बारे में कोई तकनीकी विवरण नहीं दिया गया है। यह operation Google की उस strategy का हिस्सा है, जिसका उद्देश्य Gemini की जनसामान्य दृश्यता को तकनीकी उपयोगकर्ताओं के दायरे से बाहर बढ़ाना है, और उसे दुनिया के सबसे अधिक देखे जाने वाले football clubs में से एक के साथ जोड़ना है।

🔗 X पर घोषणा


संक्षिप्त समाचार

  • Vercel और v0 अब ChatGPT account से कनेक्शन स्वीकार करते हैं — login pages पर अब “Continue with ChatGPT” button जोड़ दिया गया है, और साथ ही Vercel plugin भी अब ChatGPT में उपलब्ध है। 🔗 स्रोत
  • Replit ने Designathon की घोषणा की — एक सप्ताह का design contest, सभी creators के लिए खुला, 4 अगस्त को 9 बजे (Pacific time) एक live launch और पुरस्कारों के साथ। 🔗 स्रोत
  • Together AI ने Kimi K3 Max और Fable 5 xhigh की प्रति-task लागत की तुलना की — DeepSWE benchmark पर, Kimi K3 Max लगभग एक-तिहाई run cost पर Fable 5 xhigh के प्रदर्शन के करीब पहुँचता है, यानी खर्च किए गए प्रति डॉलर 2.8 गुना अधिक tasks हल होते हैं। 🔗 स्रोत
  • GitLab से GitHub Enterprise Cloud में migration सामान्य उपलब्धता में — CLI extension gh gl2gh अब gitlab.com या GitLab Self-Managed से repositories को self-service तरीके से GitHub Enterprise Cloud में migrate करने देता है। 🔗 स्रोत
  • Luma Ray 3.2 तीसरे-पक्ष प्लेटफ़ॉर्म Fuser पर उपलब्ध — video model इस cropping tool में एकीकृत है, और promise है कि image format बदलने पर scene action बनी रहेगी। 🔗 स्रोत
  • NVIDIA NeMo Gym में Legal Agent Bench एकीकृत — Harvey के साथ विकसित यह legal agents benchmark, जटिल legal use cases पर open-weight models को आगे बढ़ाने के लिए खुले NeMo Gym library में शामिल हो गया है। 🔗 स्रोत
  • 30 सेकंड में सीखा गया parkour agent का NVIDIA demo — एक simulation ने बहुत छोटे reference video clip से expert व्यवहार हासिल कर लिया, हालांकि कोई अतिरिक्त तकनीकी विवरण नहीं दिया गया। 🔗 स्रोत
  • प्रस्तुतियाँ बनाने के लिए Kimi Slides ट्यूटोरियल — Moonshot AI Kimi Slides पर एक शैक्षिक श्रृंखला का पहला episode प्रकाशित करता है, जो Kimi K3 द्वारा संचालित presentation generation है, जिसमें charts और SmartArts शामिल हैं। 🔗 स्रोत

इसका मतलब क्या है

खुले वज़नों की दौड़ कई मोर्चों पर एक साथ जारी है। 2.4 T पैरामीटर होने के बावजूद Qwen3.8-Max अगले हफ़्ते से ही खुला होगा; MiniMax H3 घोषणा से वास्तविक उपलब्धता तक पहुँच रहा है, और चार अलग-अलग inference blocks पर Day-0 समर्थन दे रहा है; और Kimi K3 Max पर Together AI का लागत/प्रदर्शन विश्लेषण दिखाता है कि ये खुले मॉडल क्यों आगे बढ़ रहे हैं: लगभग समान गुणवत्ता पर, इनकी लागत समकक्ष बंद मॉडलों की कीमत का एक अंश होती है। खुले और बंद मॉडलों के बीच शक्ति-संतुलन अब केवल benchmark स्कोर के बजाय अधिकाधिक इस आर्थिक मैदान पर तय हो रहा है।

दूसरा रुझान विकास उपकरणों का programmable blocks में platformization है। Vercel का v0 API, Cursor के cloud agents की दक्षता में बढ़ोतरी और Google Workspace का एकीकरण, या फिर Aspire में GitHub द्वारा दस्तावेज़ित use case — ये सब एक ही प्रवृत्ति को दर्शाते हैं: विक्रेता अब सिर्फ़ एक chat interface नहीं बेच रहे, बल्कि अन्य agents द्वारा संचालित की जा सकने वाली automation chain बेच रहे हैं, जिसमें guardrails — सीमित permissions, human review — शामिल हैं, ताकि उसे production में उपयोगी बनाया जा सके।

सामान्य उपभोक्ता पक्ष पर, दो घोषणाएँ अलग तरह के रजिस्टर में काम करती हैं: Genspark द्वारा GenOffice का code खुला करना, मुफ़्त उपलब्धता और community effect पर दाँव लगाकर, एक पूर्ण AI office suite को लोकतांत्रिक बनाने की कोशिश करता है; जबकि Google और PSG के बीच साझेदारी innovation के बजाय brand visibility की logic से जुड़ी है — Gemini को आम उपभोक्ता स्तर पर अधिक exposure मिलता है, बिना किसी नई functionality की घोषणा के।

अंत में, ElevenLabs द्वारा दिए गए आँकड़े — ElevenAgents पर प्रति सप्ताह दस मिलियन से अधिक conversations — और Seedance 2.5 के आसपास Runway की launch offer यह पुष्टि करती है कि voice और video दोनों में production-grade generative AI अब enterprise scale पर स्थापित हो रही है, dedicated supervision tools के साथ, न कि केवल तकनीकी demonstrations के रूप में।


स्रोत