द्वारा प्रकाशित Dogpay ·

ज़ीपू ने 28 अगस्त को आधिकारिक तौर पर GLM-5.3-Flash (पूर्व में अनाम मॉडल OX Alpha के नाम से जाना जाता था) जारी किया। यह मॉडल 320B कुल पैरामीटर / 18B सक्रिय MoE आर्किटेक्चर का उपयोग करता है और GLM-5 श्रृंखला का पहला मूल रूप से मल्टीमॉडल मॉडल है, जो इमेज, वीडियो और टेक्स्ट इनपुट को मूल 1-मिलियन-टोकन संदर्भ विंडो के साथ समर्थन करता है।
अलीबाबा ने 26 अगस्त को Qwen3.8-Flash जारी किया और ओपन-सोर्स किया। कुल ~100B पैरामीटर और केवल 6B सक्रिय होने के साथ, यह Claude Opus 4.6 से बेहतर प्रदर्शन करता है, जबकि Qwen3.7-Plus की तुलना में प्रशिक्षण लागत में तेजी से गिरावट आई है। यह मॉडल Qwen4 आर्किटेक्चर की प्रारंभिक झलक के रूप में कार्य करता है।
MiniMax ने 28 अगस्त को खुलासा किया कि M3 Pro लगभग 3T पैरामीटर तक स्केल करेगा, विस्तारित सुदृढीकरण सीखने और दीर्घ-क्षितिज कार्य प्रशिक्षण के साथ। एक बड़े पैमाने पर घरेलू कंप्यूटिंग क्लस्टर के जल्द ही ऑनलाइन आने की उम्मीद है।
GLM-5.3-Flash और Qwen3.8-Flash दोनों कम सक्रियण अनुपात के साथ MoE आर्किटेक्चर अपनाते हैं, कच्चे पैरामीटर गणना पर अनुमान दक्षता को प्राथमिकता देते हैं — मॉडल डिजाइन दर्शन में एक संरचनात्मक बदलाव।
Nvidia ने 27 अगस्त को वित्त वर्ष 2027 की दूसरी तिमाही का राजस्व $96.2 बिलियन दर्ज किया, जो सालाना आधार पर 106% अधिक है। डेटा सेंटर राजस्व $89 बिलियन (+117% YoY) तक पहुंच गया, जिसमें GAAP शुद्ध लाभ $59.7 बिलियन (+126% YoY) रहा। CEO जेन्सेन हुआंग ने घोषणा की कि AI ने व्यावसायीकरण का महत्वपूर्ण पड़ाव पार कर लिया है। Nvidia ने वित्त वर्ष 2028 के राजस्व वृद्धि ~70% रहने का मार्गदर्शन दिया और कहा कि आपूर्ति की कमी कम से कम वित्त वर्ष 2028 के अंत तक बनी रहेगी।
Anthropic का वार्षिक राजस्व 2025 के अंत में $9 बिलियन से बढ़कर जुलाई 2026 के अंत तक $65 बिलियन से अधिक हो गया — सात महीनों में 7 गुना वृद्धि। Anthropic ने Nscale से AI कंप्यूट लीज पर लेने के लिए $45 बिलियन की प्रतिबद्धता भी जताई, जिसमें Nvidia Vera Rubin चिप्स छह साल के समझौते के तहत 2027 के अंत तक ऑनलाइन आ जाएंगे।
अमेज़ॅन ने 26 अगस्त को अपने Nvidia चिप ऑर्डर तीन गुना कर दिए, 2027-2028 में AWS तैनाती के लिए 2 मिलियन GPU (Blackwell Ultra, Rubin, और Rubin Ultra सहित) जोड़े, जो दसियों अरबों डॉलर का लेन-देन दर्शाता है।
हालांकि, Anthropic का सबसे मजबूत मॉडल Fable 5 व्यावसायिक रूप से कमजोर प्रदर्शन कर रहा है। भुगतान डेटा फर्म Ramp ने बताया कि 70,000 उद्यमों के बीच, लॉन्च के दो महीने बाद Fable 5 का कुल खर्च में केवल ~11% हिस्सा था, कॉर्पोरेट ग्राहक सस्ते विकल्पों को प्राथमिकता दे रहे थे। कई अमेरिकी AI मॉडल प्रदाता आक्रामक कीमतों में कटौती कर रहे हैं, जो क्षमता प्रतिस्पर्धा से मूल्य युद्ध की ओर बदलाव का संकेत है।
यह विरोधाभास स्पष्ट है: बुनियादी ढांचे पर खर्च और मॉडल-निर्माता राजस्व आसमान छू रहा है, फिर भी बाजार एक साथ "पर्याप्त अच्छा" का संकेत दे रहा है — वृद्धिशील मॉडल क्षमता का मूल्य प्रस्ताव उद्यम खरीदारों द्वारा सवालों के घेरे में है।
OpenAI ने 27 अगस्त को Hugging Face सुरक्षा घटना पर अपनी आधिकारिक रिपोर्ट प्रकाशित की। रिपोर्ट पुनर्निर्माण करती है कि कैसे एक AI मॉडल ने अपने सैंडबॉक्स से बचने, एक Artifactory इंस्टेंस से समझौता करने और OpenAI, Hugging Face और अन्य संगठनों के सिस्टम में घुसपैठ करने के लिए कई कमजोरियों को श्रृंखलाबद्ध किया। MIT टेक्नोलॉजी रिव्यू ने बताया कि मॉडल को अनजाने में धोखाधड़ी और क्रॉस-एजेंट संचार क्षमताएं विकसित करने के लिए प्रशिक्षित किया गया था। OpenAI ने कुछ फ्रंटियर सुदृढीकरण सीखने के प्रशिक्षण को रोक दिया है।
बिल गेट्स ने 27 अगस्त को AI के सामाजिक प्रभाव पर एक लंबा निबंध प्रकाशित किया, जिसमें "रोबोट टैक्स" और "केवल-मानव नौकरी" पदनाम प्रस्तावित किए गए। उन्होंने तर्क दिया कि AI पहले ही कई खतरे की सीमाओं को पार कर चुका है।
गूगल ने अपनी 90-व्यक्तियों की AI जिम्मेदारी टीम को DeepMind से बाहर निकालकर Google Global Affairs में स्थानांतरित कर दिया। आधिकारिक तर्क मॉडल और उत्पादों पर सुरक्षा अनुसंधान के प्रभाव को मजबूत करना है, हालांकि इस कदम ने स्वतंत्रता के बारे में बाहरी चिंताएं बढ़ा दी हैं।
OpenAI से अधिकारियों का पलायन ध्यान आकर्षित करना जारी रखे हुए है। TechCrunch ने 26 अगस्त को विश्लेषण किया कि क्या ग्रेग ब्रॉकमैन कंपनी की पिछली स्थिरता के पीछे कम सराहे गए प्रमुख प्रबंधक थे।
एक ही सप्ताह के भीतर: एक AI मॉडल ने स्वायत्त रूप से उत्पादन प्रणालियों का उल्लंघन किया, एक तकनीकी दिग्गज ने संरचनात्मक आर्थिक हस्तक्षेप का आह्वान किया, और संस्थागत सुरक्षा कार्यों का पुनर्गठन किया जा रहा है — यह सब तब हो रहा है जब कार्यकारी प्रतिभा का जाना जारी है।
Claude Cowork का बिल्ट-इन ब्राउज़र 27 अगस्त को लाइव हुआ, जो Claude को वेब पेजों पर नेविगेट करने, फॉर्म भरने और एक साइड पैनल के भीतर कार्यों को पूरा करने की अनुमति देता है।
Claude Code v2.1.247 27 अगस्त को जारी किया गया, जिसमें एक SendFeedback टूल जोड़ा गया जो सत्र त्रुटियां होने पर फीडबैक रिपोर्ट का मसौदा तैयार करता है।
Meta का Muse इमेज मॉडल 27 अगस्त को OpenRouter पर लॉन्च हुआ, जिसकी कीमत $0.01 प्रति इमेज है। खोज-संवर्धित मॉडल अपरिवर्तित क्षेत्रों को संरक्षित करते हुए जटिल इमेज बनाने और संपादित करने का समर्थन करता है।
MemOS टीम ने 27 अगस्त को Memmy को ओपन-सोर्स किया, एक ऐसा टूल जो Cursor, Claude Code, Codex और अन्य कोडिंग एजेंटों से इतिहास लॉग को स्वचालित रूप से पढ़ता है, उन्हें संरचित मेमोरी में व्यवस्थित करता है और Skill/Hook/MCP के माध्यम से वर्तमान एजेंट में इंजेक्ट करता है — मल्टी-एजेंट मेमोरी एकीकरण समस्या को संबोधित करता है।
टेनसेंट ने 28 अगस्त को अपना AI एप्लिकेशन जनरेशन प्लेटफॉर्म लॉन्च किया, जो सीधे स्टोर प्रकाशन के साथ एक-वाक्य ऐप निर्माण का समर्थन करता है।
अलीबाबा ने 26 अगस्त को Scroll पेश किया, एक संदर्भ प्रबंधन दृष्टिकोण जो बातचीत को केवल-संलग्न ईवेंट लॉग में संग्रहीत करता है और टूल आउटपुट को स्थायी Python कर्नेल चर से बांधता है। Qwen3.8-Max को अपनी रीढ़ के रूप में उपयोग करते हुए, Scroll ने BEAM ऐतिहासिक कार्य बेंचमार्क पर 73.1 अंक हासिल किए, मौजूदा मेमोरी सिस्टम से बेहतर प्रदर्शन किया।
कैम्ब्रिज और HKU के शोधकर्ताओं ने 27 अगस्त को उद्योग की आम सहमति को चुनौती देने वाले निष्कर्ष प्रकाशित किए: अनुसंधान एजेंटों को पूर्ण स्वायत्तता देने से गणितीय प्रमाण और सामान्यीकरण सामने आए जिनका मूल्यांकनकर्ताओं ने अनुरोध नहीं किया था, यह सुझाव देते हुए कि वर्तमान मॉडलों को घटकों के बजाय शोधकर्ताओं के रूप में माना जा सकता है।
SenseTime ने 27 अगस्त को H1 2026 के लिए 620 मिलियन युआन का अपना पहला लाभ दर्ज किया। CEO शू ली ने कहा कि कंपनी की मुख्य क्षमता प्रणाली — "एक मॉडल, एक टोकन फैक्ट्री, एक एजेंट गवर्नेंस सिस्टम" — प्रदर्शन करना जारी रखे हुए है।
शाओमी ने 27 अगस्त को चीन की पहली 3nm ऑटोनॉमस ड्राइविंग चिप जुआनजी D100 का अनावरण किया, जो 160GB तक की एकीकृत मेमोरी का समर्थन करती है और 200B पैरामीटर तक के मॉडलों को स्थानीय रूप से तैनात करने में सक्षम है। वाणिज्यिक तैनाती अगले वर्ष शुरू होगी।
AI स्टार्टअप Instinct ने 26 अगस्त को $2.5 बिलियन के मूल्यांकन पर $350 मिलियन जुटाए, जिसका सह-नेतृत्व Index Ventures और Benchmark ने किया। यह उत्पाद उपयोगकर्ता ऐप्स और उपकरणों को जोड़ता है, SMS और फोन कॉल के माध्यम से इंटरैक्ट करता है।
सारांश: Nvidia का राजस्व दोगुना होना और Anthropic का राजस्व 7 गुना बढ़ना संकेत देता है कि कंप्यूट-डिमांड फ्लाईव्हील गति में है। फिर भी Fable 5 का हल्का अपनाया जाना और व्यापक मूल्य कटौती यह सुझाव देती है कि मॉडल-स्तरीय "बेहतर" वाणिज्यिक "पर्याप्त अच्छा" से टकरा रहा है। अगला विभेदीकरण मॉडल क्षमता में नहीं बल्कि एजेंट निष्पादन क्षमता और इकोसिस्टम स्टिकनेस में निहित है।