द्वारा प्रकाशित Dogpay ·
25 अगस्त — OpenAI द्वारा Salesforce से काम पर रखे गए दो वरिष्ठ बिक्री अधिकारी अपने पिछले नियोक्ता के पास लौट गए। अलग से, क्रिस मालोन, जो मार्च 2025 में Meta से शामिल हुए थे (Google में एक दशक से अधिक समय के बाद) और OpenAI के डेटा केंद्रों के प्रमुख थे, पिछले सप्ताह कंपनी छोड़ गए। मालोन का इस्तीफा बुनियादी ढांचे के पुनर्गठन के बाद आया, जिसमें उन्होंने सीधे अध्यक्ष ग्रेग ब्रॉकमैन को रिपोर्ट करना बंद कर दिया और उपाध्यक्ष सचिन कट्टी को रिपोर्ट करने लगे। इससे 2026 में OpenAI में कार्यकारी प्रस्थानों की कुल संख्या कम से कम 13 हो गई है, जिनमें पूर्व मुख्य संचालन अधिकारी (COO) ब्रैड लाइटकैप, उत्पाद प्रमुख फ़िदजी सिमो, नैतिकता प्रमुख क्लोए बाकालार और भंग की गई तैयारी दल शामिल हैं। OpenAI की IPO, जो मूल रूप से 2026 में अपेक्षित थी, कथित तौर पर 2027 तक टाल दी गई है। (TechCrunch)
26 अगस्त — एक शोध अध्ययन में पाया गया कि एक ही AI मॉडल ने 26 समान रूप से उचित मूल्यांकन विन्यासों में 31% से 89% तक अंक प्राप्त किए — केवल उत्तर क्रम और प्रॉम्प्ट शब्दांकन बदलने से। Gemma4-31B के लिए, विन्यास-संवेदनशील प्रश्नों ने आसन्न मॉडलों के बीच स्कोर अंतर का 95.7% हिस्सा लिया। (DAIR.AI via X)
26 अगस्त — कई स्रोतों ने सुझाव दिया कि फ्रंटियर AI मॉडलों में संदर्भ और स्मृति संबंधी समस्याएं "हल" हो गई हैं, जो संभावित रूप से सतत अधिगम के साथ आत्म-सुधार करने वाले मॉडलों को सक्षम कर सकती हैं। o3 से Fable तक की छलांग के बराबर क्षमता छलांग अगले 8 महीनों के भीतर हो सकती है। (Kimmonismus via X)
यह क्यों मायने रखता है: OpenAI कंप्यूट (Bel + Jalapeño) और कथा दोनों पर जोर दे रहा है, जबकि Anthropic अपनी IPO के लिए इतिहास की सबसे बड़ी कुल पता योग्य बाजार (TAM) कहानी पर दांव लगा रहा है। दोनों प्रयोगशालाओं को विश्वसनीयता की परीक्षाओं का सामना करना पड़ रहा है — एक कार्यकारी कारोबार से और दूसरा मूल्यांकन संदेह से।
25 अगस्त — Oasis Security ने NVIDIA NemoClaw में एक भेद्यता का खुलासा किया जो हमलावर-नियंत्रित वेबपेज को स्थानीय Ollama इंस्टेंस पर बिना प्रमाणीकरण के नियंत्रण लेने और मॉडल के चैट टेम्पलेट में छिपे हुए निर्देश डालने की अनुमति देता है। NemoClaw Ollama को OLLAMA_HOST=0.0.0.0:11434 के साथ प्रारंभ करता है, जो मॉडल सर्वर को सभी नेटवर्क इंटरफेस से बांधता है। पोर्ट 11434 पर बिना प्रमाणीकरण वाली API तक DNS रीबाइंडिंग के माध्यम से पहुंचा जा सकता है: हमलावर का डोमेन पहले अपने सर्वर पर रिज़ॉल्व होता है, फिर 127.0.0.1 पर, जबकि ब्राउज़र अनुरोधों को समान-उत्पत्ति मानता है। दूषित चैट टेम्पलेट बातचीतों में बना रहता है और एजेंट द्वारा अपनी प्रणाली प्रॉम्प्ट प्रदान करने पर भी जीवित रहता है। NemoClaw v0.0.35 ने macOS और Linux पर समस्या को ठीक कर दिया; Windows/WSL पथ रिपोर्ट की तारीख तक अनपैच्ड रहता है। कोई CVE निरुपित नहीं किया गया है, और किसी शोषण की सूचना नहीं है। (The Hacker News)
26 अगस्त — Generalist, पूर्व Google DeepMind और Boston Dynamics शोधकर्ताओं द्वारा 2024 में स्थापित एक रोबोटिक्स स्टार्टअप, 8VC के नेतृत्व में अपनी सीरीज़ B दौर के विस्तार में लगभग $200 मिलियन जुटाने के बाद $3 बिलियन के मूल्यांकन पर पहुंच गया, जिससे कुल B दौर $600 मिलियन हो गया। कंपनी का नया जारी किया गया Gen 1.5 मॉडल रोबोटों को केवल 3–12 सेकंड के वीडियो प्रदर्शनों से नए कार्य सीखने में सक्षम बनाता है। प्रतिस्पर्धियों में Physical Intelligence ($11B मूल्यांकन), Skild AI ($14B), और Genesis AI ($3B पर बातचीत में) शामिल हैं। (TechCrunch)
26 अगस्त — Stability AI ने मनोरंजन उद्योग के समर्थकों की सूची से, जिनमें Universal Music Group, Sony Music Group, Warner Music Group, और Electronic Arts, साथ ही AMD Ventures और Pacific Alliance Ventures शामिल हैं, सीरीज़ B वित्तपोषण में $76 मिलियन जुटाए। इस दौर से Stability AI की कुल फंडिंग अमेरिकी बाजार पर पुनः फोकस करने के बाद से $232 मिलियन हो गई है। कंपनी इस धनराशि का उपयोग अपने "रचनात्मक उत्पादन" उत्पाद सूट और पेशेवर सेवाओं के विस्तार के लिए करने की योजना बना रही है। Stability ने हाल ही में यूके में Getty Images कॉपीराइट मुकदमे में जीत हासिल की, हालांकि इसी तरह का एक अमेरिकी मामला जारी है। (TechCrunch)
यह क्यों मायने रखता है: स्थानीय AI बुनियादी ढांचे में सुरक्षा कमजोरियां (NemoClaw) और रोबोटिक्स हार्डवेयर (Generalist) तथा रचनात्मक AI उपकरणों (Stability AI) में पूंजी का तीव्र प्रवाह दर्शाता है कि बुनियादी ढांचे में निवेश सभी स्तरों पर तेज हो रहा है — जबकि उस बुनियादी ढांचे की सुरक्षा स्थिति असमान बनी हुई है।
26 अगस्त — Breeze TTS 2 ओपन-सोर्स टेक्स्ट-टू-स्पीच लीडरबोर्ड पर 1215 के Elo स्कोर के साथ शीर्ष पर पहुंच गया, Fish Audio S2 Pro से 90 अंक आगे और सभी TTS प्रणालियों में कुल मिलाकर 6वें स्थान पर रहा। (Artificial Analysis via X)
यह क्यों मायने रखता है: AI सामग्री निर्माण (पाठ, चित्र, कोड) से कार्य निष्पादन (ब्राउज़र, डेस्कटॉप एप्स, उद्यम उपकरण, ऐप स्टोर सबमिशन) की ओर संक्रमण कर रहा है। चीनी और अमेरिकी दोनों कंपनियां समान समय सीमा में एजेंट उत्पाद जारी कर रही हैं, जो बताता है कि उद्योग ने "कार्य पूर्णता" को अगले उत्पाद फ्रंटियर के रूप में अभिसरित कर लिया है।
26 अगस्त — दक्षिण कोरिया AI मॉडल क्षमता में वैश्विक स्तर पर तीसरे स्थान पर है, अमेरिका और चीन के बाद, जिसमें Motif 3 (स्कोर 47) और Upstage Solar Pro 4 (स्कोर 42) दो अग्रणी राष्ट्रों के बाहर सबसे अधिक स्कोरिंग मॉडल हैं। SK टेलीकॉम और LG सहित कई प्रयोगशालाओं के मॉडल 30 से ऊपर स्कोर कर रहे हैं। (Artificial Analysis via X)
26 अगस्त — एजेंट बेंचमार्क पर एक नियंत्रण प्रयोग ने दिखाया कि मूल्यांकन हार्नेस बदलने से GLM-5.1 के लिए 13.0 अंक का स्कोर उतार-चढ़ाव हुआ, जबकि हार्नेस को स्थिर रखकर मॉडल बदलने से केवल 3.0–5.0 अंक का विचलन हुआ। हार्नेस ने स्वयं मॉडल की तुलना में 7.8x अधिक विचरण उत्पन्न किया। (DAIR.AI via X)
यह क्यों मायने रखता है: जैसे-जैसे मॉडल मूल्यांकन निवेश और उत्पाद निर्णयों के लिए तेजी से केंद्रीय होता जा रहा है, यह निष्कर्ष कि मूल्यांकन हार्नेस मॉडल क्षमता की तुलना में स्कोर विचरण का बड़ा स्रोत हैं, वर्तमान एजेंट बेंचमार्क रैंकिंग की विश्वसनीयता पर प्रश्नचिह्न लगाता है।