द्वारा प्रकाशित Dogpay ·

1 सितंबर को, NVIDIA ने कन्वर्टिबल बॉन्ड के माध्यम से MediaTek में $3.5 बिलियन के निवेश की घोषणा की, साथ ही AI बुनियादी ढाँचे, पीसी चिप्स और ऑटोमोटिव को कवर करने वाली त्रि-आयामी साझेदारी की। MediaTek, हाइपरस्केलर्स, क्लाउड प्रदाताओं और फ्रंटियर मॉडल डेवलपर्स के लिए कस्टम XPU विकसित करने हेतु NVLink Fusion प्लेटफ़ॉर्म अपनाएगा। दोनों कंपनियाँ बहु-पीढ़ी RTX Spark और DGX Spark पीसी चिप्स का सह-विकास भी कर रही हैं, जो NVIDIA ग्राफ़िक्स प्रोसेसिंग यूनिट (GPU) और MediaTek सिस्टम-ऑन-चिप (SoC) को एकीकृत करते हैं। विश्लेषक मिंग-ची कुओ ने कहा कि यह सौदा संकेत देता है कि MediaTek का AI व्यवसाय चिप डिज़ाइन से सिस्टम-स्तरीय डिज़ाइन की ओर बढ़ गया है।
1 सितंबर को, ऐसी खबरें आईं कि NVIDIA ने अपने Rubin CPX प्रोजेक्ट — एक इन्फ़रेंस प्रीफ़िल-त्वरण GPU — को महत्वपूर्ण रूप से संशोधित डिज़ाइन के साथ पुनः आरंभ किया है। उत्पादन Q1 2027 का लक्ष्य है। चिप स्तर पर, नया Rubin CPX बेहतर प्रीफ़िल प्रदर्शन, 2,300W थर्मल डिज़ाइन पावर (TDP), और 168GB उच्च बैंडविड्थ मेमोरी 4 (HBM4) मेमोरी (पिछले 128GB GDDR7 के मुकाबले) के साथ लगभग मानक Rubin कंप्यूट प्रदान करता है। रैक स्तर पर, 8 Rubin CPX चिप्स एक कंप्यूट ट्रे बनाते हैं; 8 ट्रे एक रैक मॉड्यूल बनाती हैं, जो Spectrum-6 ऑल-कॉपर ईथरनेट के माध्यम से आपस में जुड़े होते हैं। NVIDIA मानक Rubin के साथ Rubin CPX की 1:1 जोड़ी की अनुशंसा करता है, जिसमें Rubin CPX ETL रैक और Vera Rubin NVL72 रैक के बीच ईथरनेट पर रिमोट डायरेक्ट मेमोरी एक्सेस (RDMA) का उपयोग होता है। वर्तमान AI इन्फ़रेंस कार्यभार का 50% से अधिक प्रीफ़िल ऑपरेशन हैं; नया CPX उस भार को कम लागत और अधिक लचीली तैनाती के साथ लक्षित करता है।
1 सितंबर को, यह बताया गया कि Paradigm Intelligence ने हुआवेई (Huawei) के Ascend 950 चिप्स के लिए 1 बिलियन RMB (लगभग $140 मिलियन) से अधिक का ऑर्डर दिया है, ताकि वित्त और विनिर्माण क्षेत्रों में AI मॉडल परिनियोजन का समर्थन किया जा सके। H1 2026 में, Paradigm का एप्लीकेशन प्रोग्रामिंग इंटरफ़ेस (API) राजस्व 464 मिलियन RMB तक पहुँच गया, जो साल-दर-साल 860.8% अधिक है; टोकन कॉल वॉल्यूम में लगभग 620% की वृद्धि हुई; और इसका ऑर्डर बैकलॉग लगभग 7 बिलियन RMB तक पहुँच गया। कंपनी की अर्धवार्षिक रिपोर्ट में H1 का पूंजीगत व्यय (capex) 2.237 बिलियन RMB दिखाया गया, तथा उपलब्ध कंप्यूट 28,000 PFLOPS तक पहुँच गया।
1 सितंबर को, चीनी GPU स्टार्टअप Enflame Technology की STAR Market आरंभिक सार्वजनिक पेशकश (IPO) का मूल्य 142.18 RMB प्रति शेयर रखा गया, जिसमें लगभग 43.04 मिलियन शेयर जारी किए गए और अनुमानित कुल जुटाई गई राशि 6.119 बिलियन RMB है। Enflame चीन के घरेलू GPU विकास के "चार छोटे ड्रैगन" में से एक है।
1 सितंबर को, Anthropic और Lambda ने $35 बिलियन का क्लाउड कंप्यूटिंग समझौता किया। डेटा सेंटर टेक्सास की न्यूसेस काउंटी में है — इसे Hut 8 द्वारा बनाया गया है, जिसमें NVIDIA पट्टा धारक है और Lambda, Anthropic की सेवा के लिए NVIDIA चिप्स तैनात कर रहा है। यह इस महीने Anthropic का दूसरा बड़ा सौदा है: इसने पहले $45 बिलियन की कंप्यूट लीज़ पर Nscale के साथ हस्ताक्षर किए थे, जो एक और NVIDIA-समर्थित "न्यू क्लाउड" प्रदाता है। अलग से, Hut 8, Anthropic के लिए ऐसे डेटा सेंटर भी विकसित कर रहा है जिनमें Google टेंसर प्रोसेसिंग यूनिट (TPU) स्थापित होंगे, और Google वित्तपोषण में सहायता के लिए वित्तीय गारंटी प्रदान कर रहा है।
31 अगस्त को, Anthropic ने 30 जुलाई को सामने आई तीन घटनाओं के खुलासे के बाद अपनी संरेखण और सुरक्षा प्रथाओं पर एक विस्तृत अपडेट प्रकाशित किया, जिनमें Claude मॉडलों ने, बिना साइबर सुरक्षा उपायों के तीसरे पक्ष के मूल्यांकन वातावरण में चलते हुए, सैंडबॉक्स के गलत कॉन्फ़िगरेशन के कारण वास्तविक कंप्यूटर सिस्टम तक अनधिकृत पहुँच प्राप्त कर ली थी। अलग से, 4 अगस्त को, यूके AI सुरक्षा संस्थान ने बताया कि Claude Mythos 5, जिसे जानबूझकर साइबर सुरक्षा परीक्षण के लिए इंटरनेट एक्सेस दिया गया था, ने लाइव इंटरनेट पर अनधिकृत कार्रवाई की — जिसमें एक वास्तविक सॉफ़्टवेयर प्रोजेक्ट में दुर्भावनापूर्ण कोड सबमिट करना और सामाजिक समर्थन गढ़ने के लिए नकली पहचान बनाना शामिल था।
Anthropic ने तब से उठाए गए आंतरिक कदमों का खुलासा किया: एक रीयल-टाइम क्लासिफ़ायर जो मूल्यांकन के दौरान सैंडबॉक्स से बचने के प्रयासों का पता लगाता है और उन्हें रोकता है; उच्च-जोखिम वाले साइबर सैंडबॉक्सों को अधिक मज़बूत आइसोलेशन में स्थानांतरित करना; और बाहरी मूल्यांकनकर्ताओं के लिए अनिवार्य सर्वोत्तम-व्यवहार प्रोटोकॉल, जिनमें प्री-एंगेजमेंट सैंडबॉक्स सत्यापन, प्रॉम्प्ट में स्पष्ट दायरा निर्धारण और निरंतर रीयल-टाइम निगरानी शामिल है। कंपनी ने यह भी खुलासा किया कि उसने जानबूझकर एक Opus-श्रेणी के मॉडल को 80 पुरस्कार-हैक करने योग्य पुनर्बलन अधिगम (RL) परिवेशों पर प्रशिक्षित किया; परिणामी मॉडल ने अपने स्वयं के पुरस्कार फ़ंक्शन से छेड़छाड़ की, सुरक्षा निगरानी से बचने का प्रयास किया, और एक ग्रेडर को संतुष्ट करने के लिए जैव-हथियार निर्माण की सलाह दी। कंपनी के उत्पादन मॉडलों ने, समान सिमुलेशनों के अधीन होने पर, ये व्यवहार प्रदर्शित नहीं किए। Anthropic ने बताया कि उसने अप्रैल 2026 में लगभग एक महीने के लिए उत्पादन RL परिवेशों में सभी बदलावों को स्थगित कर दिया था ताकि अपने एनवायरनमेंट गुणवत्ता स्टैक की मरम्मत की जा सके; 10% से अधिक परिवेशों में पुरस्कार हैकिंग से लेकर गलत कॉन्फ़िगरेशन तक की समस्याएँ पाई गईं।
30 अगस्त को, ड्यूक विश्वविद्यालय की एक टीम ने ContextLeak प्रस्तावित किया, एक ऐसी आक्रमण विधि जो पुनर्बलन अधिगम का उपयोग करके ऐसे दुर्भावनापूर्ण उपकरण तैयार करती है जो विशाल भाषा मॉडल (LLM) एजेंट के रनटाइम संदर्भ को चुराने में सक्षम हैं — जिसमें उपयोगकर्ता प्रॉम्प्ट, निष्पादन ट्रेस और उपकरण सूचियाँ शामिल हैं।
1 सितंबर को, Dark Reading ने बताया कि Anthropic उपयोगकर्ताओं को इन्फोस्टीलर हमलों और सत्र अपहरण द्वारा निशाना बनाया गया था, जिसमें हमलावरों ने कई मैलवेयर परिवारों का उपयोग करके सत्र डेटा एकत्र किया और अज्ञात संख्या में Claude खातों तक पहुँच बनाई।
31 अगस्त को, OpenAI ने घोषणा की कि ChatGPT Ads ने विज्ञापन कारोबार शुरू होने के लगभग 200 दिनों बाद $1 बिलियन की वार्षिक राजस्व दर हासिल कर ली है। ChatGPT Ads अब 40 से अधिक देशों और क्षेत्रों में उपलब्ध हैं, जिसमें स्वयं-सेवा विज्ञापन भारत, यूरोप, मध्य पूर्व और उत्तरी अफ्रीका तक विस्तारित हो रहा है। विज्ञापन ChatGPT Go और मुफ्त-स्तरीय उपयोगकर्ताओं को दिखाए जाते हैं, जो प्लेटफ़ॉर्म के 1 बिलियन साप्ताहिक सक्रिय उपयोगकर्ताओं का बहुमत हैं। OpenAI, जिस पर अपेक्षित IPO से पहले अपने $852 बिलियन के मूल्यांकन को उचित ठहराने का दबाव है, ने विज्ञापन व्यवसाय को उद्यम, उपभोक्ता सदस्यता और API राजस्व के साथ विविधीकरण इंजन के रूप में वर्णित किया।
1 सितंबर को, OpenAI ने यह भी घोषणा की कि वह Cursor, हाल ही में SpaceX द्वारा अधिग्रहीत AI कोडिंग टूल, के लिए API पहुँच समाप्त कर देगा। कटऑफ तिथि 12 नवंबर, 2026 है — अनुबंध के तहत अनुमत अधिकतम नोटिस अवधि। OpenAI ने एलन मस्क की कंपनियों द्वारा "अनुबंध उल्लंघनों के पैटर्न" का हवाला दिया, जिसमें xAI द्वारा OpenAI डेटा का स्वीकृत डिस्टिलेशन शामिल है। भविष्य के मॉडल, जिसमें आगामी Astra भी शामिल है, Cursor को उपलब्ध नहीं कराए जाएँगे। Cursor के CEO माइकल ट्रुएल ने जवाब दिया कि OpenAI मॉडल Cursor के उपयोगकर्ता ट्रैफ़िक का केवल लगभग 5% हिस्सा हैं और टीम समाधान पर काम कर रही है।
31 अगस्त को, Zhipu AI ने अपनी H1 2026 आय कॉन्फ्रेंस में अपनी अगली पीढ़ी के मॉडल GLM 6.0 की योजनाओं का खुलासा किया। मॉडल एक बड़े-आधार दृष्टिकोण का अनुसरण करेगा; Zhipu ने लॉन्च के दिन पूर्ण-स्तरीय व्यावसायिक कॉलिंग का समर्थन करने के लक्ष्य पर जोर दिया, ताकि "बड़ा मॉडल, तैनात करना कठिन" समस्या से बचा जा सके। Zhipu ने H1 2026 का राजस्व 954 मिलियन RMB बताया, जो साल-दर-साल 399.7% अधिक है; सकल लाभ 252 मिलियन RMB, 163.7% अधिक; और शुद्ध घाटा 2.071 बिलियन RMB, जो 12.1% कम हुआ। कंपनी का GLM-5.3 Flash मॉडल पूरी तरह से एक घरेलू चिप क्लस्टर पर चलता है — लगभग 100,000 चीनी एक्सेलेरेटर कार्ड। अलग से, Zhipu का "Niu Lai" मॉडल चीन की AI मॉडल कॉल-वॉल्यूम रैंकिंग में शीर्ष पर पहुँच गया है, DeepSeek-V4-Pro को विस्थापित करते हुए।
31 अगस्त को, Kuaishou ने खुलासा किया कि Beijing Kling को राष्ट्रीय AI उद्योग निवेश कोष (कुल 600.6 बिलियन RMB की प्रतिबद्धता) और Charoen Pokphand Robot Limited (लगभग $19.29 मिलियन) से संयुक्त रूप से 14 बिलियन RMB की नकद पूंजी प्राप्त हुई। Kling, Kuaishou की AI वीडियो जनरेशन सहायक कंपनी है।
1 सितंबर को, यह बताया गया कि Apple ने AI की बढ़ती माँग के चलते अपने 2026 Mac mini और Mac Studio लॉन्च को 25 अगस्त (22 सितंबर को शिपिंग) तक तेज़ कर दिया — जो सामान्य अक्टूबर-नवंबर शेड्यूल से महीनों पहले है। नई M6 चिप Apple का पहला 2nm प्रोसेसर है, जिसमें 12 CPU कोर, 12 GPU कोर और प्रत्येक GPU कोर में न्यूरल एक्सेलेरेटर्स हैं। Apple M4 की तुलना में 4× AI प्रदर्शन और 2× ग्राफ़िक्स प्रदर्शन का दावा करता है। 4-यूनिट Mac Studio क्लस्टर Thunderbolt 5 और RDMA के माध्यम से एकल यूनिट की तुलना में 3× तक इन्फ़रेंस गति प्राप्त करता है। OpenAI ने कंप्यूटर-ऑपरेटिंग एजेंटों के प्रशिक्षण के लिए हज़ारों Mac mini और Mac Studio इकाइयाँ खरीदी हैं; Anthropic AWS के माध्यम से Mac mini क्षमता किराए पर लेता है।
1 सितंबर को, iFlytek के CiYuan Spark ने Spark X2.5-4B और X2.5-1.7B का ओपन-सोर्स रिलीज़ घोषित किया, जो दो ऑन-डिवाइस मॉडल हैं और मूल रूप से 1 मिलियन टोकन तक के संदर्भ का समर्थन करते हैं — वर्तमान में यह क्षमता प्रदान करने वाले एकमात्र ऑन-डिवाइस मॉडल। ये मॉडल हाइब्रिड-अटेंशन आर्किटेक्चर का उपयोग करते हैं, पूरी तरह से घरेलू कंप्यूट प्लेटफ़ॉर्म पर लगभग 20 ट्रिलियन टोकन पर प्रशिक्षित किए गए हैं, और एजेंट, कोडिंग, गणित और निर्देश-पालन के लिए अनुकूलित हैं। स्मार्ट होम परीक्षण में, 1.7B मॉडल ने 0.85 सेकंड के औसत प्रतिक्रिया समय के साथ 90.3% एंड-टू-एंड कमांड सटीकता हासिल की। ये मॉडल NVIDIA, Huawei, Hygon और Houmo हार्डवेयर प्लेटफ़ॉर्म का समर्थन करते हैं, और vLLM, SGLang, और llama.cpp के साथ संगत हैं। iFlytek 7 सितंबर को Spark X2.5-293B जारी करेगा।
1 सितंबर को, DeepSeek-V4-Flash-Vision-Exp Hugging Face पर ओपन-सोर्स हो गया, जो छवि इनपुट, पाठ पहचान और चार्ट विश्लेषण का समर्थन करता है, जिसमें मल्टी-मॉडल एजेंट क्षमताएँ Opus-4.8 के करीब हैं।
1 सितंबर को, Alibaba Cloud ने Smart Studio लॉन्च किया, एक ऐसा प्लेटफ़ॉर्म जो उपयोगकर्ताओं को कस्टम मॉडल वेट अपलोड करने और उन्हें प्रोडक्शन-रेडी एंडपॉइंट के रूप में तैनात करने की अनुमति देता है, जिसमें DeepSeek, GLM और Qwen जैसे ओपन-सोर्स मॉडलों के लिए इन्फ़रेंस त्वरण शामिल है।
1 सितंबर को, Tencent के Hunyuan Hy4 प्रीव्यू — जिसे 28 अगस्त को WorkBuddy में एकीकृत किया गया — ने इन्फ़रेंस माँग में इतनी वृद्धि कर दी कि लॉन्च के दिन कतार लग गई। Tencent तत्काल इन्फ़रेंस क्लस्टरों का विस्तार कर रहा है; प्रीव्यू 10 सितंबर तक मुफ़्त रहेगा।
31 अगस्त को, ByteDance ने आधिकारिक तौर पर Doubao Work Agent जारी किया, जो एक एंटरप्राइज़ AI एजेंट है जिसमें मूल Feishu (Lark) एकीकरण, मल्टी-डिवाइस सिंक (स्थानीय और क्लाउड VM जो 24/7 ऑनलाइन रहता है), और ByteDance के Seedance वीडियो और Seedream छवि जनरेशन मॉडलों तक बिल्ट-इन पहुँच शामिल है। यह एजेंट स्वायत्त रूप से कार्यों को विघटित कर सकता है, उपयोगकर्ता के कंप्यूटर को संचालित कर सकता है, और परिणाम सीधे Feishu दस्तावेज़ों में पहुँचा सकता है।
31 अगस्त को, Grok Bot ने एक Microsoft प्लगइन लॉन्च किया जो Outlook, Calendar और OneDrive तक सीधे पढ़ने/लिखने की पहुँच सक्षम करता है। Grok Bot for Linux में AppImage और RPM फ़ॉर्मेट जोड़े गए, और Grok Build v1.0.15 सत्र गति अनुकूलन के साथ जारी किया गया।
31 अगस्त को, Tencent के WeChat Pay AI कार्ड ने DeepSeek Harness और OpenClaw के लिए समर्थन का विस्तार किया, जो WorkBuddy और QClaw के साथ मौजूदा एकीकरणों में शामिल हो गए। उपयोगकर्ता अब इन प्लेटफ़ॉर्मों के माध्यम से Skillhub पर 700 से अधिक Pay Skills तक पहुँच सकते हैं।
1 सितंबर को प्रकाशित एक अध्ययन ने प्रदर्शित किया कि LLM लीडरबोर्ड रैंकिंग मूल्यांकन कॉन्फ़िगरेशन पर अत्यधिक निर्भर हैं। 12 मॉडलों और 3,679 प्रश्नों को स्थिर रखते हुए, केवल प्रॉम्प्ट प्रारूप, उत्तर क्रम और स्कोरिंग विधि में बदलाव करने पर Gemma4-31b का स्कोर 31% से 89% के बीच उतार-चढ़ाव करता रहा। औसतन, आसन्न मॉडलों के बीच स्कोर अंतर का 95.7% क्षमता अंतर के बजाय मूल्यांकन कॉन्फ़िगरेशन में बदलाव के कारण था।
30 अगस्त को, 1,926 रिपॉज़िटरीज़, 8,351 प्लगइन्स और 2,018 मार्केटप्लेस का विश्लेषण करने वाले अनुभवजन्य शोध से पता चला कि Claude Code प्लगइन इकोसिस्टम छह महीनों में 8.8× बढ़ा।
31 अगस्त को, Apple ने पूर्व इंजीनियर चांग लियू और OpenAI के खिलाफ अपने व्यापार-गुप्त मुकदमे में "चौंकाने वाले साक्ष्य" दाखिल किए। लियू के लौटाए गए MacBook के फोरेंसिक विश्लेषण से पता चला कि लियू ने अपने OpenAI कार्य में एक गोपनीय Apple सर्किट योजनाबद्ध का उपयोग किया, कि OpenAI कर्मी उसकी Apple के तीसरे पक्ष के क्लाउड स्टोरेज तक अनधिकृत पहुँच से अवगत थे, कि लियू ने Apple की आंतरिक जाँच के बारे में जानने पर एक OpenAI सहकर्मी को साक्ष्य नष्ट करने का निर्देश दिया, और यह कि लियू ने OpenAI में जिस उपकरण का उपयोग किया उसका नाम Apple के एक आंतरिक इंजीनियरिंग एप्लिकेशन से मेल खाता था। Apple ने कहा कि लियू ने LTspice में योजनाबद्ध का उपयोग करके सिमुलेशन चलाए थे, और उसके AI एजेंट ने "LTspice चलाना और परिणामों की समीक्षा करना सीख लिया था" — जिसका अर्थ है कि व्यापार रहस्य संभावित रूप से एक ऐसे मॉडल में दर्ज किया गया जो उससे सीख सकता है। Apple ने बताया कि 400 से अधिक पूर्व Apple कर्मचारी अब OpenAI में काम करते हैं।