
ऊपर अंग्रेज़ी संस्करण है, नीचे चीनी संस्करण है।
14 अगस्त को, Zhipu AI ने GLM-5.3 जारी किया, जिसमें GLM-5.2 जैसा ही बेस मॉडल रखा गया और पूरी तरह पोस्ट-ट्रेनिंग स्केलिंग पर निर्भर रहा। इसके आंतरिक बेंचमार्क में कोडिंग क्षमता 50% बढ़ी, Terminal-Bench 3.0 4.6 से 28.3 पर पहुंच गया, और DeepSWE v1.1 46.2 से 66.9 हो गया। Zhipu ने कहा कि सुरक्षा समीक्षा के बाद रिलीज़ के दो सप्ताह बाद वह वेट्स को सार्वजनिक करेगा।
यह रिलीज़ ओपन-सोर्स कोडिंग मॉडलों की एक श्रृंखला के साथ आई। DeepSeek ने V4 Pro जारी किया, जो 49B सक्रिय पैरामीटर और 1M-टोकन कॉन्टेक्स्ट वाला 1.6T-पैरामीटर मिश्रित विशेषज्ञ (MoE) मॉडल है। LiveCodeBench पर इसने 93.5 स्कोर किया और Codeforces रेटिंग 3206 रही। Alibaba ने 14 अगस्त की शाम Qwen3.8-27B को ओपन-सोर्स किया, जो 270B-पैरामीटर वाला नेटिव मल्टीमॉडल डेंस मॉडल है और कोडिंग व कार्यालय कार्यों में Qwen3.7-Plus से बेहतर है। Alibaba के अनुसार Qwen के 3 अरब से अधिक डाउनलोड हो चुके हैं, 300,000 से अधिक व्युत्पन्न मॉडल हैं, और 460+ ओपन-सोर्स मॉडल हैं।
यह बदलाव एकसमान है: तीनों में से किसी ने भी बेस मॉडल नहीं बदला। लाभ पोस्ट-ट्रेनिंग और आर्किटेक्चर से आया। GLM-5.3 Z.ai Code Bench पर प्रति कार्य केवल 50,000 आउटपुट टोकन का उपयोग करता है, जबकि Claude Opus 4.8 लगभग 120,000 का; यह 31.4% सटीकता प्राप्त करता है, जबकि Opus 4.8 की सटीकता 29.5% है।
13 अगस्त की रात, DeepSeek ने बिना कोई नया मॉडल लाए MIT लाइसेंस के तहत DeepSeek Harness को ओपन-सोर्स किया। यह फ्रेमवर्क पूरे एजेंट ढांचे — मुख्य लूप, स्थिति प्रबंधन, सत्र संग्रहण, कार्य शेड्यूलिंग, सैंडबॉक्स, इवेंट, यूज़र इंटरफ़ेस (UI) — को प्लग करने योग्य घटकों में विभाजित करता है, "Everything is a Plugin" डिज़ाइन के अंतर्गत। यह एक कस्टम Cordis प्लगइन बेस पर चलता है, जिसमें हॉट लोड/अनलोड और रोलबैक है, साथ ही Preset स्कोपिंग है जो एक ही प्रक्रिया में कई आइसोलेटेड एजेंटों को चलाती है।
Harness-V4 Pro की जोड़ी वाली उसी रात, Honor ने 15 अगस्त को घोषणा की कि YOYO Claw (इसका "Shrimp Brain") अब GLM-5.3 चलाता है, जो एक ओपन मॉडल का सीधा उपभोक्ता-पक्ष रोलआउट है। यह बदलाव स्पष्ट है: मॉडल स्कोर अभिसरित हो रहे हैं, और विभेदीकरण की परत रनटाइम और मॉडलों को रैप करने वाली टूलिंग की ओर स्थानांतरित हो रही है।
14 अगस्त को, SpaceX ने Cursor का 60 अरब डॉलर का अधिग्रहण पूरा किया, जो अब तक के सबसे बड़े टेक सौदों में से एक है। Cursor के ब्लॉग ने कम लागत वाले मॉडल बनाने के लिए सबसे बड़े ग्राफ़िक्स प्रोसेसिंग यूनिट (GPU) क्लस्टर तक पहुँच का हवाला दिया। दोनों ने जुलाई में संयुक्त Grok 4.5 मॉडल और उसके बाद Grok 4.6 पहले ही जारी कर दिया था, और मस्क ने कर्मचारियों से कहा कि सितंबर तक कृत्रिम बुद्धिमत्ता (AI) राजस्व SpaceX के अन्य सभी कारोबार से अधिक हो जाएगा।
इसी अवधि में Nvidia अपने निवेश एक्सपोज़र पर पुनर्विचार कर रही थी। Nvidia के पास लगभग 21 अरब डॉलर की SpaceX हिस्सेदारी है, जो SpaceX विलय के बाद उसकी xAI पोज़ीशन से परिवर्तित हुई है, और SpaceX डेटा सेंटर विशेष रूप से Nvidia का उपयोग करते हैं। अलग से, रिपोर्टों के अनुसार Nvidia OpenAI की ओहायो 10GW परियोजना पर अपनी गारंटी घटा रही है — 250 अरब डॉलर से घटाकर 120 अरब डॉलर से कम, जो केवल पहले 5GW को कवर करेगी — और OpenAI का वार्षिक राजस्व 40 अरब डॉलर पार कर गया है, जो उसकी पिछली रन रेट का लगभग दोगुना है। Anthropic, जिसने मई में कहा था कि उसकी रन रेट 47 अरब डॉलर के पार पहुँच गई है, कथित तौर पर Decart के लगभग 6 अरब डॉलर के अधिग्रहण के करीब है; Decart एक ऐसी कंपनी है जिसका सॉफ़्टवेयर चिप्स पर प्रशिक्षण और इन्फ़्रेंस अधिक कुशलता से चलाता है।
इस बीच, 14 अगस्त को, Anthropic के मुख्य कार्यकारी अधिकारी (CEO) डारियो अमोदेई ने AI विनियमन पर पोस्ट किया और तर्क दिया कि निष्पक्ष संस्थागत प्रक्रिया स्वयं शक्ति का विकेंद्रीकरण कर सकती है, और विनियमन को फ्रंटियर कंपनियों को बाध्य करना चाहिए जबकि ओपन मॉडलों और छोटे खिलाड़ियों के लिए गुंजाइश छोड़नी चाहिए।
14 अगस्त की एक रिपोर्ट में विस्तार से बताया गया कि कैसे पेकिंग यूनियन मेडिकल कॉलेज अस्पताल के न्यूरोसर्जरी रेज़िडेंट फिजिशियन जिनशानमु ने OpenAI के GPT-5.6-Sol का उपयोग करके लगभग 16 घंटों में क्रूज़ेक्स अनुमान को सिद्ध किया — एक समस्या जो 2004 से अनसुलझी थी। अनुमान प्रस्तुत करने वाले मिशेल क्रूज़ेक्स तथा गणितज्ञ एलेक्स टाउनसेंड और ऐनी ग्रीनबाम ने पांडुलिपि की समीक्षा की और प्रमाण की पुष्टि की। इससे पहले का सर्वश्रेष्ठ स्थिरांक 2.414 था, जो एक सप्ताह लंबी कार्यशाला के बाद 2017 में तय हुआ था; स्वयं क्रूज़ेक्स ने 2007 में 11.08 सिद्ध किया था। आठ दिन बाद, गणितज्ञ एमील लोरिस्ट और फेलिक्स श्वेनिंगर ने एक अलग विधि का उपयोग करते हुए पाँच पृष्ठों का स्वतंत्र प्रमाण पोस्ट किया, जिसमें ChatGPT 5.6 से भी सहायता मिली।
Nvidia ने 14 अगस्त को कुशलता की दिशा में हार्डवेयर जोड़ा और Spectrum-X CPO स्विच के पूर्ण उत्पादन की घोषणा की — यह पहला बड़े पैमाने पर उत्पादित 200G/लेन को-पैकेज्ड ऑप्टिक्स ईथरनेट स्विच है। बिजली की खपत घटकर पाँचवाँ हिस्सा रह जाती है, लेज़र की संख्या घटकर एक-चौथाई रह जाती है, और AI एप्लिकेशन का अपटाइम पाँच गुना बढ़ जाता है। SN6810 एक 2U चेसिस में 800 Gb/s के 128 पोर्ट समेटता है (102.4 Tb/s), तथा आपूर्ति श्रृंखला में TSMC, SPIL, Lumentum और Foxconn शामिल हैं।