
13 अगस्त को, OpenAI और Cerebras ने Ultrafast Mode लॉन्च किया, जो Cerebras के Wafer-Scale Engine द्वारा संचालित एक सेवा श्रेणी है और GPT-5.6 Sol को अधिकतम 750 आउटपुट टोकन प्रति सेकंड पर चलाती है। Cerebras का कहना है कि यह Fast mode में Fable 5 से 11 गुना तेज़ और Opus 4.8 से 5 गुना तेज़ है, तथा गुणवत्ता में कोई गिरावट नहीं है। केवल पीएचडी-स्तर के विशेषज्ञों द्वारा उत्तर दिए जा सकने वाले 2,500 प्रश्नों वाले बेंचमार्क Humanity's Last Exam पर, Ultrafast ने 11 घंटे 11 मिनट में पूरा किया, जबकि Claude Fable 5 को 78 घंटे 27 मिनट लगे। आर्थिक रूप से मूल्यवान ज्ञान कार्य के बेंचमार्क GDP-Val पर, Ultrafast ने 5.6 गुना एंड-टू-एंड स्पीडअप दिया। यह सेवा सबसे पहले OpenAI एपीआई (API) में चुनिंदा ग्राहकों के समूह के लिए उपलब्ध है।
13 अगस्त को, Google ने Gemini 3.7 Flash जारी किया, जो कोडिंग और एजेंट उपयोग मामलों के लिए बना है, 3.6 Flash के ठीक तीन सप्ताह बाद। 31 दिसंबर तक, इस मॉडल की कीमत 3.6 Flash की तुलना में आधी रखी गई है — प्रति मिलियन इनपुट टोकन पर $0.75 और प्रति मिलियन आउटपुट टोकन पर $3.75। Google इस मॉडल को 160 से अधिक क्षेत्रों के एआई (AI) Pro और Ultra सब्सक्राइबरों के लिए Gemini Spark में भी शामिल कर रहा है।
14 अगस्त को, DeepSeek ने 17 अगस्त से प्रभावी पीक-वैली एपीआई मूल्य निर्धारण की घोषणा की, जिसमें ऑफ-पीक घंटों की दरें पीक दर की आधी होंगी। कुछ मॉडलों में 3 गुना से अधिक की मूल्य वृद्धि देखी गई है। फ्लैगशिप deepseek-v4-pro में पीक घंटों के दौरान प्रति मिलियन टोकन की कीमत में उल्लेखनीय वृद्धि हुई है। यह कदम कम लागत वाले प्रदाता के रूप में DeepSeek की पहले की स्थिति को उलट देता है।
13 अगस्त को, Lenovo ने वित्त वर्ष 2026 की पहली तिमाही के नतीजे जारी किए: एआई-संबंधित राजस्व साल-दर-साल 60% बढ़कर $8.5 अरब हो गया, जो कुल राजस्व का 35% है। चेयरमैन यांग युआनकिंग ने मीडिया से कहा कि कंप्यूट आवंटन प्रारंभिक चरण के '80% प्रशिक्षण' से '80% इन्फ़्रेंस, 20% प्रशिक्षण' के लक्ष्य की ओर बढ़ रहा है, और वर्तमान विभाजन लगभग 50/50 है।
एक ही दिन के घोषणा-समूह — 750 टोकन प्रति सेकंड वाला फ्रंटियर मॉडल, आधी कीमत वाला Flash मॉडल, और एक चीनी प्रदाता द्वारा कीमतें बढ़ाना जबकि अन्य कम कर रहे हैं — दिखाते हैं कि प्रतिस्पर्धा 'कौन सबसे मजबूत है' से बदलकर 'कौन सबसे तेज़ और सबसे सस्ता है' पर आ गई है।
14 अगस्त को, DeepSeek ने V4-Pro का आधिकारिक संस्करण जारी किया, जो 1.6 ट्रिलियन-पैरामीटर वाला मॉडल है, जिसके वेट एमआईटी लाइसेंस के तहत जारी किए गए हैं, OpenAI Responses API के लिए नेटिव समर्थन है, और Codex के लिए लक्षित अनुकूलन है। Harness प्लगइन इकोसिस्टम सार्वजनिक परीक्षण में प्रवेश कर गया।
उसी दिन, Zhipu के GLM-5.3 के बारे में बताया गया कि इसके 743B बेस मॉडल ने CyberGym पर 84.5 स्कोर किया, जो GPT-5.6 Sol से ऊपर है, और इसे साइबर रक्षा और कोडिंग के लिए बनाया गया है। Meituan ने LongCat-2.0 लॉन्च किया, जो 1.6T-पैरामीटर वाला MoE मॉडल है, जिसमें 1M संदर्भ विंडो है, और इसने Terminal-Bench 2.1 पर 70.8 स्कोर किया; यह एजेंटिक कोडिंग पर केंद्रित है।
14 अगस्त को, Grok 4.6 ने CursorBench वास्तविक-विश्व कोडिंग लीडरबोर्ड में शीर्ष स्थान प्राप्त किया, और Claude Opus 5 तथा GPT-5.6 Sol से आगे रहा। xAI ने Phoenix के वेट भी ओपन-सोर्स किए, जो उसका X-रैंकिंग एल्गोरिदम है; यह Grok-आधारित ट्रांसफॉर्मर है, जिसके सिंथेटिक-स्कोर वेट प्रसार इरादे और वास्तविक बातचीत को प्राथमिकता देते हैं, और लाइक को सबसे सस्ता संकेत माना जाता है।
13 अगस्त को, एक Meta/Oxford अध्ययन में पाया गया कि मल्टीमॉडल प्रीट्रेनिंग के लिए केवल 5% छवि-निर्माण डेटा की आवश्यकता होती है, और इष्टतम मिश्रण 70% भाषा, 25% छवि समझ और 5% छवि निर्माण है — जिससे छवि-निर्माण टोकन 5 गुना कम हो जाते हैं।
DeepSeek, Meituan और xAI की ओर से ओपन-वेट पर जोर, और कोडिंग तथा साइबर रक्षा के लिए विशेष बेंचमार्क, सामान्य क्षमता के दावों के बजाय संकीर्ण, मापने योग्य कार्यों पर प्रतिस्पर्धा करने वाले क्षमता-विशिष्ट मॉडलों की ओर बदलाव को दर्शाते हैं।
13 अगस्त को, Fortune ने बताया कि Anthropic अक्टूबर में $2 खरब मूल्यांकन पर आरंभिक सार्वजनिक निर्गम (IPO) की योजना बना रही है, जो 12 जून को SpaceX के $1.77 खरब के आईपीओ को पीछे छोड़ते हुए अब तक का सबसे बड़ा आईपीओ होगा। Anthropic का वार्षिक राजस्व मई में $47 अरब को पार कर गया, और उसने जून में अमेरिकी प्रतिभूति एवं विनिमय आयोग (SEC) के पास गोपनीय फाइलिंग की।
14 अगस्त को, Nikkei ने बताया कि Tencent एआई डेवलपर Manus में Meta की हिस्सेदारी का अधिग्रहण करके उसका सबसे बड़ा शेयरधारक बन जाएगा। मार्च 2025 में Butterfly Effect द्वारा लॉन्च किए गए Manus ने अमेरिकी निवेश के बाद अपना मुख्यालय सिंगापुर स्थानांतरित कर लिया और चीन में परिचालन बंद कर दिया। अप्रैल में, चीन की विदेशी-निवेश सुरक्षा समीक्षा ने Meta-Manus अधिग्रहण पर रोक लगा दी; 11 अगस्त को, Manus ने Meta से अलग होने और स्वतंत्र संचालन बहाल करने की घोषणा की।
14 अगस्त को, मीडिया ने बताया कि Google DeepMind फ्रंटियर-मॉडल अनुसंधान से हटकर लागत-कुशल Flash-श्रेणी के मॉडलों की ओर पुनर्गठन कर रही है, और छंटनी संभावित रूप से एक-तिहाई या उससे अधिक तक पहुँच सकती है। Demis Hassabis ने 5 अगस्त को मुख्य कार्यकारी अधिकारी (CEO) पद छोड़ दिया, और वह चेयरमैन तथा Alphabet के मुख्य वैज्ञानिक बन गए। यह पुनर्गठन Google के अगले फ्लैगशिप Gemini मॉडल की देरी और विकास प्राथमिकताओं पर आंतरिक विवादों से जुड़ा है।
14 अगस्त को, Reuters ने बताया कि Apple ने Alibaba के साथ चीन-बाज़ार-विशिष्ट बड़ा भाषा मॉडल (LLM) को प्रशिक्षित किया है, जिससे तीसरे पक्ष के मॉडलों पर उसकी पिछली निर्भरता समाप्त हुई है। 15 जुलाई को 'Apple Intelligence' ऑन-डिवाइस जनरेटिव एआई सेवा की नियामकों के पास फाइलिंग के बाद, Apple Intelligence के कुछ महीनों के भीतर चीन में लॉन्च होने की उम्मीद है।
13 अगस्त को, Musk ने SpaceX कर्मचारियों से कहा कि SpaceXAI (पूर्व में xAI) डेटा सेंटर की विद्युत क्षमता 2027 के अंत तक मौजूदा 1.4GW से लगभग 7 गुना बढ़कर 10GW हो जाएगी, जो अभी मेम्फिस और साउथएवन में फैली है। उन्होंने अनुमान लगाया कि 10GW से $300 अरब से $500 अरब तक का वार्षिक राजस्व प्राप्त हो सकता है।
उसी दिन दो $2 खरब-स्तर के संकेत और चीन बाज़ार से जुड़े दो कदम सामने आए: Anthropic का आईपीओ मूल्यांकन, और Apple की चीन-मॉडल रणनीति — जबकि Tencent ने Manus को समाहित किया और Google फ्रंटियर से पीछे हट गया।
13 अगस्त को, बाल्टीमोर में USENIX सुरक्षा सम्मेलन में, बर्मिंघम विश्वविद्यालय और डरहम विश्वविद्यालय के शोधकर्ताओं ने 'Download More RAM' का खुलासा किया, जो DDR4/DDR5 SPD चिप्स में राइट-प्रोटेक्शन की कमी वाले दोष का फायदा उठाकर बिना भौतिक पहुँच के Windows 11 की सुरक्षा को भेदता है। यह दोष सॉफ़्टवेयर को मेमोरी-कॉन्फ़िगरेशन डेटा को फिर से लिखने देता है, जिससे Windows रैम (RAM) को 2 गुना क्षमता पर गलत रिपोर्ट करता है और संरक्षित क्षेत्रों को पढ़ने या संशोधित करने के लिए मेमोरी एलियासेस बनाता है। यह एंटीवायरस को अक्षम कर सकता है, लॉक किए गए एंटरप्राइज़ सिस्टम से समझौता कर सकता है, और कर्नेल एंटी-चीट को बायपास कर सकता है। Microsoft ने CVE-2026-23670 असाइन किया और अप्रैल 2026 सुरक्षा अपडेट में समाधान जोड़ा; Secure Boot सक्षम वाले सिस्टम सुरक्षित हैं। Corsair, G.Skill और ADATA में से प्रत्येक की कम से कम एक उपभोक्ता उत्पाद श्रृंखला प्रभावित थी।
6 अगस्त को, ACM AI Leadership Summit में स्वीकृत एक पेपर में पाया गया कि व्यावसायिक एआई डिटेक्टर एआई संपादन को पूर्ण ड्राफ्ट से विश्वसनीय रूप से अलग नहीं कर सकते। हल्के 'केवल सार को परिष्कृत करने वाले' संपादन 64–80% (Pangram/GPTZero) पर फ़्लैग किए गए, जबकि 2023–2025 के असंशोधित मूल पाठ 9–15% पर फ़्लैग किए गए। 'Undetectable AI' मानवीकरण के बाद, एआई-लेबल वाले पुनर्लेखन में 4% से भी कम फ़्लैग रह जाते हैं। ईमानदार एआई संपादन में मानवीकरण-सहायता प्राप्त बचाव की तुलना में दंड का अधिक जोखिम होता है।
इसी सप्ताह, एक तकनीकी विश्लेषण ने तर्क दिया कि टेक्स्ट एआई वॉटरमार्क को हटाना हमेशा आसान रहेगा, जबकि यूरोपीय संघ एआई अधिनियम (EU AI Act) के अनुच्छेद 50 की आवश्यकता है कि आउटपुट 'कृत्रिम रूप से उत्पन्न के रूप में पहचाने जा सकें', जो अगस्त 2026 से लागू होगी। SynthID-शैली के टोकन सैंपलिंग को किसी भी कमजोर एलएलएम के माध्यम से पैराफ्रेज़ करके हटाया जा सकता है, और यूनिकोड होमोग्लिफ़ वॉटरमार्क को वर्ण बदलकर हटाया जा सकता है। विश्लेषण में कहा गया है कि Claude Code पहले कुछ अनुरोधों को टैग करने के लिए होमोग्लिफ़ स्टेग्नोग्राफ़ी का उपयोग करता था।
13 अगस्त को, OpenAI ने ChatGPT Mac ऐप के लिए Computer History लॉन्च किया, जो Chronicle के स्क्रीनशॉट-आधारित पूर्वावलोकन को macOS एक्सेसिबिलिटी इवेंट लॉगिंग (क्लिक, टाइपिंग, शॉर्टकट, ऐप स्विच) से बदल देता है। इवेंट स्थानीय रूप से अधिकतम 48 घंटे तक संग्रहीत होते हैं, और सर्वर-साइड मेमोरी जनरेशन के बाद हटा दिए जाते हैं। प्राइवेसी-मोड गतिविधि को बाहर रखा गया है। यह सुविधा Pro, Business और Enterprise उपयोगकर्ताओं के लिए उपलब्ध है, जिसमें यूरोपीय आर्थिक क्षेत्र (EEA), स्विट्ज़रलैंड और यूके शामिल नहीं हैं।
14 अगस्त को, ChatGPT को टैब बदले बिना Google Docs, Sheets और Slides को सीधे संपादित करने की क्षमता मिल गई, जो Plus, Pro, Business और Enterprise उपयोगकर्ताओं के लिए जारी की जा रही है।
हार्डवेयर-स्तर का हमला, विफल हो रहे डिटेक्टर और आसानी से हटाया जा सकने वाला वॉटरमार्क एक साझा आधार दर्शाते हैं: एआई सामग्री की पुष्टि करने और सिस्टम को सुरक्षित करने का बुनियादी ढांचा स्वयं मॉडलों से पीछे चल रहा है।