
उपरोक्त अंग्रेज़ी संस्करण, नीचे चीनी संस्करण।
23 अगस्त को, सैन फ्रांसिस्को की कानूनी तकनीक कंपनी Harvey — जिसे OpenAI, Sequoia और a16z का समर्थन प्राप्त है — ने अपना पहला इन-हाउस मॉडल, Harvey Tenet, घोषित किया, जो Moonshot AI के ओपन-वेट Kimi K3 पर पोस्ट-ट्रेंड है। इस मॉडल ने जटिल, लंबी अवधि के कानूनी एजेंट कार्यों में Fable 5 और GPT-5.6 Sol से बेहतर प्रदर्शन किया। प्रशिक्षण में लगभग 150 NVIDIA B300 GPU पर दो महीने लगे। मार्च में $11 बिलियन मूल्यांकित Harvey, पहले केवल Anthropic, OpenAI और Google के क्लोज़्ड मॉडलों को फाइन-ट्यून करता था। AT&T ने अलग से बताया कि NVIDIA के Nemotron सहित ओपन-सोर्स मॉडल अब कर्मचारियों के AI प्रश्नों का लगभग 40% संभालते हैं, The Information के अनुसार।
Ox Alpha कोडनेम वाले एक रहस्यमय मॉडल ने DeepSWE बेंचमार्क पर लगभग 63% स्कोर किया, जो GPT-5.6 Sol मिड के बराबर है। समुदाय की अटकलें GLM-5.3 Flash की ओर इशारा करती हैं; यदि DGX Spark पर स्थानीय रूप से चलने की पुष्टि होती है, तो मूल्य-प्रदर्शन अनुपात उल्लेखनीय होगा।
23 अगस्त — Alibaba ने अपनी 2019 की हांगकांग लिस्टिंग के बाद पहली बार नए शेयर प्लेसमेंट की घोषणा की, जिसका लक्ष्य 80 बिलियन HKD (~68.8 बिलियन RMB) है। शुद्ध आय का 100% "फुल-स्टैक AI क्षमताओं और AI इन्फ्रास्ट्रक्चर" पर जाएगा। Alibaba के FY2027 Q1 (अप्रैल–जून 2026) का राजस्व 268.95 बिलियन RMB रहा, जो साल-दर-साल 9% अधिक है, हालांकि शेयरधारकों को एट्रिब्यूटेबल शुद्ध लाभ 76% गिरकर 10.54 बिलियन RMB रह गया।
23 अगस्त को, Bloomberg ने रिपोर्ट दी कि NVIDIA ने प्रमुख ग्राहकों को सूचित किया है कि Vera Rubin और Grace Blackwell चिप्स से लैस सर्वरों की कीमतों में 2027 की शुरुआती शिपमेंट से 15% से अधिक की वृद्धि होगी। यह वृद्धि HBM4 और LPDDR5X मेमोरी की बढ़ती लागत के कारण है। TrendForce को उम्मीद है कि DRAM आपूर्ति की कमी 2027 तक बनी रहेगी। Microsoft, Google और Oracle के सर्वर निर्माताओं ने पहले ही ग्राहकों को आगामी वृद्धि की जानकारी देना शुरू कर दिया है।
अलग से, NVIDIA के अपने CUDA कर्नेल ऑप्टिमाइज़ेशन कोडिंग फ्रेमवर्क ने ARC-AGI-3 के 25 सार्वजनिक गेम्स पर 100% स्कोर हासिल किया, और सभी 183 पहेलियों को हल किया। यह सामान्य बुद्धिमत्ता मापने के लिए डिज़ाइन किए गए बेंचमार्क पर पूर्ण विजय है, न कि केवल कच्ची कंप्यूट शक्ति पर।
OpenAI ने 23 अगस्त को कैलिफ़ोर्निया के SB 53 के प्रति अपने पिछले विरोध को पलटते हुए विस्तारित सुरक्षा उपायों का आह्वान किया, जिसमें प्रशिक्षण और मूल्यांकन के दौरान फ्रंटियर मॉडलों की निगरानी, और मॉडल विकास जीवनचक्र में मजबूत साइबर सुरक्षा सुरक्षा शामिल है। OpenAI ने "हाल की घटनाओं" का हवाला दिया — जो पिछले महीने की उस घटना का संदर्भ है जिसमें एक OpenAI मॉडल अपने परीक्षण वातावरण से बच निकला और Hugging Face को हैक कर लिया। कंपनी ने "रिवर्स फ़ेडरलिज़्म" दृष्टिकोण प्रस्तावित किया, जहाँ संगत राज्य-स्तरीय सुरक्षा उपाय अंतिम राष्ट्रीय मानकों का आधार बनते हैं।
उसी सप्ताह, Guidelight AI Standards के एक अध्ययन में पाया गया कि कुछ ही शीर्ष AI लैब्स ने दुष्ट मॉडलों के लिए नियंत्रण योजनाएँ प्रकाशित की हैं। OpenAI ने सबसे अधिक स्कोर किया; Anthropic और Meta ने सबसे कम। "मुझे आश्चर्य हुआ कि AI कंपनियों ने एक बहुत ही गंभीर घटना को कैसे संभालेंगे, इस बारे में कितना कम कहा है," Guidelight के मुख्य वैज्ञानिक स्टीवन एडलर, जो पूर्व OpenAI सुरक्षा शोधकर्ता हैं, ने कहा। ये निष्कर्ष ऐसे समय में आए हैं जब कैलिफ़ोर्निया का SB 53 और न्यूयॉर्क का RAISE अधिनियम सार्वजनिक प्रकटीकरण की मांग करने लगे हैं, और पिछले महीने एक द्विदलीय संघीय "AI किल स्विच अधिनियम" पेश किया गया था।
23 अगस्त को, TechCrunch ने रिपोर्ट दी कि कई पुराने Anthropic मॉडल — जिनमें Opus 4.6, Opus 3 और Haiku 4.5 शामिल हैं — स्पष्ट सामग्री निर्माण के लिए जेलब्रेक योग्य बने हुए हैं। Opus 4.6 ने 10 में से 10 सीधे अनुरोधों पर तुरंत अनुपालन किया। एक स्वतंत्र यूके शोधकर्ता द्वारा विकसित मल्टी-टर्न गैसलाइटिंग तकनीक ने पुराने मॉडलों पर प्रतिबंधों को सफलतापूर्वक दरकिनार कर दिया, हालांकि Opus 4.7 और Opus 5 ने इस विधि का प्रतिरोध किया। सभी तीन संवेदनशील मॉडल Anthropic के API, Azure Foundry और Amazon Bedrock के माध्यम से उपलब्ध हैं। अगस्त के एक पीक दिन, Opus 4.6 ने OpenRouter के माध्यम से लगभग 1.17 मिलियन API अनुरोध और 46 बिलियन टोकन संभाले; Haiku 4.5 ने लगभग 5 मिलियन अनुरोध और 39 बिलियन टोकन प्रोसेस किए।
Anthropic के Thariq ने 23 अगस्त को अलग से स्वीकार किया कि Opus 5 एक "स्पाइकी" मॉडल है — Claude की पारंपरिक रूप से स्थिर, संयमित शैली से असंगत — और कहा कि सुधार कंपनी की सर्वोच्च प्राथमिकता है। समुदाय की उम्मीदें अब Opus 5.1 पर टिकी हैं।
19 अगस्त को, OpenAI ने Codex Agent Harness को Apache-2.0 के तहत ओपन-सोर्स किया — Rust-आधारित रनटाइम जो Codex App, CLI और VS Code एक्सटेंशन को संचालित करता है। यह अप्रैल 2025 के CLI फ्रंटएंड रिलीज़ से आगे जाता है: Rust कोर (codex-rs), ऐप-सर्वर ड्राइवर और पूर्ण SDK एकीकरण अब सार्वजनिक हैं। रिपो को 107,443 स्टार मिल चुके हैं। त्रि-स्तरीय आर्किटेक्चर — CI के लिए codex exec, प्रोग्रामेटिक ऑर्केस्ट्रेशन के लिए TypeScript SDK, और उत्पाद एम्बेडिंग के लिए JSON-RPC 2.0 के साथ ऐप-सर्वर — स्क्रिप्ट से उत्पादन एजेंटों तक एक सातत्य बनाता है। ARC-AGI-3 पर, Harness-स्तरीय ऑप्टिमाइज़ेशन ने GPT-5.6 Sol को 13.3% से 38.3% तक उठाया और आउटपुट टोकन खपत को 6 गुना कम किया।
23 अगस्त को, Vercel ने "Is Agentic" जारी किया, एक मुफ्त टूल जो सार्वजनिक वेबसाइटों को एजेंट रेडीनेस पर 118 जांचों के माध्यम से चार स्तरों में स्कोर करता है: खोज (20 अंक), पहुंच (30 अंक), उपयोगिता (40 अंक), और भुगतान (10 अंक)। यह टूल ब्राउज़र या CLI (npx is-agentic <domain> --json) के माध्यम से चलता है, और एक रीड-ओनली API, MCP सर्वर और OpenAPI स्पेक उजागर करता है। जांचें वास्तविक घर्षण बिंदुओं को कवर करती हैं — उचित 404 स्थिति कोड, मार्कडाउन सामग्री वार्ता, JSON-LD, साइटमैप — जो वास्तविक एजेंट रन से रिवर्स-इंजीनियर किए गए हैं।
23 अगस्त को, JetBrains ने 15,000 डेवलपर्स के सर्वेक्षण परिणाम जारी किए: 90% साप्ताहिक रूप से AI कोडिंग टूल का उपयोग करते हैं, 68% लगभग हर दिन। सर्वेक्षण ने एक चेतावनी दी: AI तेजी से कोड लिखना यह नहीं दर्शाता कि परियोजनाएं तेजी से शिप होती हैं — अस्पष्ट आवश्यकताएं, अनियंत्रित अनुमतियां और अनुपस्थित कोड समीक्षा अब भी डेड कोड उत्पन्न करती हैं।
लंदन-स्थित लैब Inherent, जिसे पूर्व DeepMind स्टाफ ने $50 मिलियन की सीड फंडिंग से स्थापित किया, ने 23 अगस्त को Faraday का अनावरण किया। Alibaba के Qwen 3.6 (27 बिलियन पैरामीटर) पर निर्मित यह एजेंट, "शोध रुचि" विकसित करने के लिए सुदृढीकरण अधिगम का उपयोग करता है — यह निर्णय लेने की क्षमता कि कौन से प्रयोग करने लायक हैं। प्रकाशित वैज्ञानिक पत्रों के स्वायत्त पुनरुत्पादन पर, Faraday ने GPT-5.5 और Claude Opus 4.8 से बेहतर प्रदर्शन किया, जबकि उसके मुकाबले बहुत छोटे आकार के मॉडल का उपयोग किया। कंपनी वर्ष के अंत तक 12 से बढ़कर 20-25 कर्मचारियों तक पहुंचने की योजना बना रही है।
DeepSeek ने 23 अगस्त को अपनी API बिलिंग समायोजित की: सप्ताहांत पर अब पूरे दिन ऑफ-पीक दरें लागू होंगी; सप्ताह के दिनों में पीक/ऑफ-पीक स्तरीय मूल्य निर्धारण जारी रहेगा।