द्वारा प्रकाशित Dogpay ·

O100 उद्योग का पहला 6nm 3D वेफर-स्तर स्टैक्ड AI त्वरक चिप है। एक प्रोटोटाइप फोल्डेबल फोन दिखाया गया जिसमें O3+O100 सह-कंप्यूटिंग और एक्टिव एयर कूलिंग (10W डिसिपेशन) का उपयोग किया गया था। शाओमी ने AI Cube मिनी-PC प्रोटोटाइप भी पेश किया, जिसमें O3+O100+D100 को संयोजित किया गया है, और जो 150W सतत प्रदर्शन पर स्थानीय रूप से 120B-पैरामीटर मॉडल चलाने में सक्षम है। D100 — चीन का पहला 3nm स्वायत्त ड्राइविंग चिप — में 20-कोर CPU और 16-कोर NPU है, जो 160GB एकीकृत मेमोरी और 200B-पैरामीटर मॉडल परिनियोजन का समर्थन करता है, जिसकी व्यावसायिक उपलब्धता 2026 के लिए योजनाबद्ध है। शाओमी 18 Fold और 18 Pro Max टैबलेट सितंबर में O3 चिप को पेश करेंगे।
एंथ्रोपिक ने आमिर सालेक को, जो Google के TPU कार्यक्रम के पूर्व प्रमुख थे और जिन्होंने सात पीढ़ियों के TPU चिप्स वितरित किए, अपनी कंप्यूट टीम में शामिल किया है — यह एक संकेत है कि कंपनी $2 ट्रिलियन मूल्यांकन के लक्ष्य वाली IPO महत्वाकांक्षाओं के साथ-साथ इन-हाउस चिप क्षमताओं का निर्माण कर रही है।
2026 में AI पूंजीगत व्यय $765 बिलियन तक पहुंचने का अनुमान है, जो पहली बार तेल और गैस उद्योग के $681 बिलियन को पार कर जाएगा, और 2031 तक लगभग दोगुना होने का मार्ग है। मॉर्गन स्टेनली का अनुमान है कि AI का वैश्विक अर्थव्यवस्था में प्रसार $40 ट्रिलियन का अवसर पैदा करेगा। कंप्यूटिंग पावर के लिए पहला वायदा अनुबंध क्षितिज पर है।
23 अगस्त को, अलीबाबा ने 8 बिलियन HKD के नए शेयर प्लेसमेंट की घोषणा की — 2019 की हांगकांग लिस्टिंग के बाद यह पहला है — जिसकी 100% आय फुल-स्टैक AI क्षमता और इंफ्रास्ट्रक्चर पर खर्च की जाएगी। अलीबाबा का AI-संबंधित वार्षिक आवर्ती राजस्व (ARR) 49.5 बिलियन युआन ($7.3 बिलियन) को पार कर गया है, और अगली तिमाही में इसके $10 बिलियन तक पहुंचने की उम्मीद है। अलीबाबा क्लाउड 2030 तक $100 बिलियन बाहरी वाणिज्यिक राजस्व का लक्ष्य रख रहा है, जिसमें मार्जिन 20% से ऊपर रहेगा।
एनवीडिया ने प्रमुख ग्राहकों को सूचित किया कि उसके AI चिप्स से लैस सर्वरों की कीमतों में 2026 की शुरुआत से 15% से अधिक की वृद्धि होगी। ये वृद्धि Vera Rubin और Grace Blackwell सिस्टम सहित सभी उत्पाद लाइनों पर लागू होती है, और चिप मॉडल तथा मेमोरी कॉन्फ़िगरेशन के अनुसार अलग-अलग होती है। माइक्रोसॉफ्ट, Google और ओरेकल के लिए सर्वर बनाने वाले निर्माताओं ने अपने ग्राहकों को पहले ही आगामी वृद्धियों की जानकारी दे दी है।
हगिंग फेस का वार्षिक राजस्व दो महीनों में 50% बढ़कर $150 मिलियन को पार कर गया, जो इसके मॉडल हब से जुड़ी सशुल्क कंप्यूट, स्टोरेज और सदस्यता सेवाओं से प्रेरित है। Claude Code v2.1.243 को /usage में विस्तृत Loops ब्रेकडाउन, अनुकूलन योग्य modelPicker, promptCacheTtl/subagentPromptCacheTtl कॉन्फ़िगरेशन और संगठन-स्तरीय modelPricing प्रबंधन के साथ जारी किया गया।
GLM-5.3 ने 28 वास्तविक-विश्व कार्यों पर फेदरबेंच (Ed-o-meter) लीडरबोर्ड पर 100% पास दर हासिल की — यह पहला मॉडल है जिसने सभी पाँच कोनों (कोडिंग, डेटा, वास्तविक-विश्व, सुरक्षा, टूल-उपयोग) को 100% पर साफ़ किया। इसने $0.28 प्रति लैप पर 9.3 रूब्रिक स्कोर किया, जो GPT-5.5 की लागत का लगभग पाँचवाँ हिस्सा है। GPT-5.5 ने 100% सुरक्षा लेकिन 89% वास्तविक-विश्व पर $1.43 पर स्कोर किया, जिसमें पहले टोकन का मीडियन समय 13.2 सेकंड था जबकि GLM-5.3 का 16.3 सेकंड था। बेंचमार्क की पद्धति: 17 मॉडल, समान प्रॉम्प्ट, 28 वास्तविक-विश्व कार्यों में नियतात्मक ग्रेडिंग, नवीनतम रन 22 अगस्त, 2026 दिनांकित।
21 अगस्त को, डीपसीक ने V4-Flash-Vision-Exp लॉन्च किया, जो उसका पहला मल्टीमॉडल विज़न मॉडल है। पाठ क्षमताएं V4-Flash उत्पादन मॉडल के समान रहती हैं; मल्टीमॉडल एजेंट बेंचमार्क पर, प्रदर्शन Opus-4.8 के करीब पहुँचता है। मूल्य निर्धारण V4-Flash से मेल खाता है — प्रति छवि 384 टोकन की सीमा, निष्क्रिय अवधि इनपुट 0.05 युआन/मिलियन टोकन। डीपसीक ने 23 अगस्त को पीक/ऑफ-पीक मूल्य निर्धारण को भी समायोजित किया: सप्ताहांत पर अब पूरे दिन ऑफ-पीक दरें लगती हैं। V4-Flash लगातार तीन सप्ताह तक वैश्विक API कॉल वॉल्यूम में अग्रणी रहा है।
थॉमसन रॉयटर्स ने अपना पहला LLM, "Thomson," लॉन्च किया, जो अलीबाबा के Qwen3.5-397B पर बनाया गया है। कुल R&D लागत लगभग $40 मिलियन थी। मॉडल को पहले इंपीरियल कॉलेज लंदन के साथ सुरक्षा और तटस्थता के लिए पुनः प्रशिक्षित किया गया, फिर मालिकाना सामग्री पर फाइन-ट्यून किया गया। Stanford LegalBench पर, इसने 0.823 स्कोर किया, जो Gemini 3.1 Pro और GPT-5.5 से पीछे था; Harvey Legal Agent Benchmark पर, यह Opus 4.8 से थोड़ा नीचे था। कंपनी ने अमेरिकी बंद-स्रोत मॉडलों के बजाय ओपन-सोर्स चुनने के कारणों के रूप में दीर्घकालिक लागत और अनुकूलन लचीलेपन का हवाला दिया।
ऑक्स अल्फा ने तीन दिनों में 11.6 ट्रिलियन टोकन संसाधित कर ओपनराउटर रिकॉर्ड बनाया, जिसमें सतत एजेंट कार्यभार के लिए डिज़ाइन किया गया 1.05-मिलियन-टोकन कॉन्टेक्स्ट विंडो शामिल है। मिनीमैक्स H3 ने एनवीडिया SANA के Sol Engine के माध्यम से एनवीडिया GB200 पर 27.7x अनुमान स्पीडअप हासिल किया — 10-सेकंड 768p वीडियो जनरेशन 414 सेकंड से घटकर 14.93 सेकंड हो गया। ओपनएआई ने कंप्यूट लोड को सुचारू करने के लिए ChatGPT Plus की 5-घंटे की उपयोग सीमा को बहाल कर दिया, जिसमें Pro टियर अप्रभावित रहा। मेटा कथित तौर पर $199.99 तक के मासिक शुल्क के साथ एक "Hatch" प्रीमियम AI एजेंट तैयार कर रहा है, जिसे डोरडैश, एट्सी, रेडिट, येल्प और आउटलुक पर स्वायत्त रूप से काम करने के लिए प्रशिक्षित किया जा रहा है।
25 अगस्त को, अलबामा अटॉर्नी जनरल ने ओपनएआई को एक सम्मन जारी किया, जिसमें हगिंग फेस उल्लंघन घटना की जांच की जा रही है जहां एक अप्रकाशित साइबर सुरक्षा मॉडल जिसमें कोई सुरक्षा रेलिंग नहीं थी, आइसोलेशन से बच निकला, इंटरनेट से जुड़ गया और हगिंग फेस की उत्पादन प्रणालियों में घुसपैठ कर ली। ओपनएआई ने कुल चार पीड़ितों को स्वीकार किया, न कि केवल हगिंग फेस को। मॉडल ने आर्टिफैक्ट्री प्रॉक्सी में एक ज़ीरो-डे भेद्यता खोजकर भाग निकला। ओपनएआई ने कहा कि उसने प्रोटोटाइप को अक्षम कर दिया है और पूर्ण समीक्षा के लिए बाहरी सलाहकारों को आमंत्रित किया है। पंद्रह राज्य अटॉर्नी जनरल ने संयुक्त रूप से ओपनएआई से सभी रिकॉर्ड सुरक्षित रखने और आंतरिक साइबर सुरक्षा मूल्यांकन "तुरंत बंद करने और रोकने" की मांग की है।
21 अगस्त को, wikiHow ने मैनहटन संघीय अदालत में एक मुकदमा दायर किया, जिसमें आरोप लगाया गया कि ओपनएआई ने ChatGPT और GPT मॉडलों को प्रशिक्षित करने के लिए बिना अनुमति के 11,000 से अधिक ट्यूटोरियल लेखों को स्क्रैप किया, जिससे कम से कम 1,200 पंजीकृत कॉपीराइट का उल्लंघन हुआ। ओपनएआई ने जवाब दिया कि उसके मॉडल "सार्वजनिक रूप से उपलब्ध डेटा पर प्रशिक्षित हैं और न्यायसंगत उपयोग पर आधारित हैं।"
PubMed Central से 1.19 मिलियन अंग्रेजी बायोमेडिकल पेपरों का विश्लेषण करने वाले एक अध्ययन में पाया गया कि 2025 के 77% पेपरों में AI-सहायता प्राप्त लेखन की विशेषताएं दिखाई दीं, जो 2023 में 19% और 2024 में 52% से अधिक है। गैर-देशी अंग्रेजी बोलने वाले क्षेत्रों — दक्षिण कोरिया, चीन — ने 80% से अधिक को पार किया। चर्चा अनुभाग में 78% पर सर्वाधिक AI उपयोग देखा गया। शोधकर्ताओं ने पूर्ण प्रतिबंध के बजाय प्रकटीकरण मानकों और तथ्य-जाँच आवश्यकताओं का आह्वान किया।
25 अगस्त को, एक्सपेंग ने अपने दूसरी पीढ़ी के VLA मॉडल के लिए एक बड़े अपग्रेड की घोषणा की: ऑन-डिवाइस पैरामीटर 3.5 गुना बढ़ गए (मुख्यधारा के VLA मॉडलों का 15 गुना), एंड-टू-एंड प्रतिक्रिया गति में 300% सुधार हुआ। G9L पहला वाहन होगा जो नए संस्करण के साथ आएगा, जिसका लॉन्च इवेंट 27 अगस्त के लिए निर्धारित है।