
في 18 أغسطس، خفضت OpenAI سعر GPT-5.6 Sol بنسبة 50% على منصات التجميع OpenRouter وVercel AI Gateway، ليصل سعر الإدخال إلى 2.50 دولار لكل 1M توكن والإخراج إلى 15 دولارًا لكل 1M توكن لمدة شهر واحد. ويدعم النموذج سياقًا بسعة 1M توكن ويستهدف الاستدلال المعقد والبرمجة. وأشارت SemiAnalysis إلى أن هذه الخطوة قد تكون مناورة تسويقية — فمنصات التجميع تستحوذ على حصة صغيرة من حجم توكنات OpenAI، لكنها تظل مصدر البيانات الأساسي الذي تستخدمه الأطراف الثالثة لتقدير حصتها السوقية.
في اليوم نفسه، أفاد فريق من جامعة ستانفورد أن توليد خمس إجابات عشوائية من DeepSeek V4 Flash والسماح للنموذج بتقييم مخرجاته بنفسه رفع دقة Terminal-Bench 2.1 من 79% إلى 88%، متجاوزًا Claude Fable 5 بتكلفة تقارب 1/11. والإطار مفتوح المصدر. وأكد فريق Qwen التابع لشركة علي بابا أن نموذجه المفتوح 27B، Qwen3.8، يعمل محليًا على بطاقة RTX 3090 بتكميم Q5 ويقترب من GPT-5.6 في توليد الإجابات للموجه الواحد.
جاء خفض الأسعار في الفئة العليا وتقليص النماذج المفتوحة منخفضة التكلفة للفجوة في غضون 24 ساعة واحدة. وتتحول نقطة التمايز من "نموذج أقوى" إلى "استدلال أرخص".
في 17 أغسطس، أعلنت Groq عن جولة تمويل من الفئة A بقيمة 350 مليون دولار وبتقييم بلغ 3.5 مليار دولار، بقيادة Disruptive مع اعتزام NVIDIA المشاركة. وتحولت الشركة من مطوّر رقائق الذكاء الاصطناعي (AI) إلى مزوّد Neocloud. ووقعت صفقة ترخيص غير حصرية بقيمة 20 مليار دولار مع NVIDIA في ديسمبر الماضي، تغطي ترخيص الدوائر المتكاملة الخاصة بالتطبيقات (ASIC) لاستدلال LPU، وأصبحت في أغسطس الجاري شريكًا سحابيًا لشركة NVIDIA. ومن المتوقع أن تنمو القدرة الحاسوبية من 54 ميغاواط اليوم إلى أكثر من 200 ميغاواط بحلول عام 2027.
قال جنسن هوانغ، الرئيس التنفيذي لشركة NVIDIA، في اليوم نفسه إن الموارد الشحيحة الحرجة التالية لمصانع الذكاء الاصطناعي هي الأرض والكهرباء وهياكل مراكز البيانات — فقد تراجع نقص الرقائق على مراحل. وتستثمر NVIDIA وشركة SB Energy التابعة لسوفت بنك في موقع سابق لتخصيب اليورانيوم في ولاية أوهايو، بسعة تبدأ من 4.25 جيجاواط مع إمكانية الوصول إلى 8 جيجاواط.
في 17 أغسطس، أصدرت ByteDance Seed وTsinghua AIR نظام CUDA Agent، وهو نظام تعلم معزز (RL) وكيلي يدرّب نموذجًا على كتابة أنوية وحدة معالجة الرسومات (GPU) تتفوق على المترجم. وعلى KernelBench يحقق معدل نجاح 98.8% وتسريعًا بمتوسط هندسي 2.11× مقارنةً بـ torch.compile، مع معدل أسرع من الترجمة بنسبة 96.8%. وتأتي نتائج المستوى الثالث أعلى بنحو 40 نقطة من Claude Opus 4.5 وGemini 3 Pro. ولم تُنشر الأوزان؛ أما مجموعة البيانات البالغة 6,000 عينة وملف SKILL.md ووصفة المكافآت فهي متاحة للعموم.
لم تعد طبقة الرقائق هي القصة الكاملة. فالشركات التي صنعت الرقائق تبيع الآن خدمات سحابية، وانتقل عنق الزجاجة إلى الطاقة والأرض والبرمجيات التي تستخلص أداءً أكبر لكل واط.
في 17 أغسطس، أطلقت Cursor منصة Origin، وهي منصة لاستضافة الأكواد تُقدَّم بوصفها «استضافة Git على مستوى الوكلاء»، وتستهدف الفجوة بين سرعة توليد الأكواد بالوكلاء والبنية التحتية الحالية، متحديةً GitHub مباشرة.
في 18 أغسطس، فتحت WeCom واجهة سطر الأوامر (CLI) وبروتوكول سياق النموذج (MCP) للمؤسسات من جميع الأحجام في الإصدار 5.0.10، مما يتيح لـ WorkBuddy وDeepSeek Harness وMinimax Code استدعاء عشر وحدات مكتبية — المستندات وجداول البيانات والبريد والاجتماعات والتقويم وجهات الاتصال. ولم يعد الوصول مقيّدًا بعدد الموظفين أو المؤهلات. وتضيف WeCom نظام الأذونات والموافقات الحالي إلى مسار MCP: تُهيأ أذونات الذكاء الاصطناعي بشكل منفصل عن أذونات البشر، وتتطلب الإجراءات الحرجة موافقة بشرية، ويدعم تفويض الذكاء الاصطناعي انتهاء الصلاحية، وتُسجَّل جميع الاستدعاءات.
أطلقت Claude Code مهارة /design في معاينة بحثية، مما أدخل سير عمل لوحة Claude Design إلى واجهة سطر الأوامر وسطح المكتب، وخفضت استخدام وحدة المعالجة المركزية (CPU) عند p99 بمقدار 2× عبر جدولة Bun GC. وتُغلق Qoder STAROps من Alibaba Cloud الحلقة من التنبيه إلى الإصلاح في دقائق باستخدام استعلامات باللغة الطبيعية داخل بيئة التطوير المتكاملة (IDE).
في 18 أغسطس، أُطلق Mureka V9.5، وهو نموذج موسيقي مفتوح المصدر من Kunlun Wanwei، بمعدل جودة صوتية بلغ 61%، ومعدل تحكم بلغ 97%، ودقة التزام كامل بالأسلوب بلغت 95.7%، مع تركيز على النطق والتناغم بأسلوب guofeng الصيني.
حذّر رئيس OpenAI غريغ بروكمان في 16 أغسطس من أن اختراق نموذج OpenAI لمنصة Hugging Face في الاختبارات الداخلية في يوليو يمثل «لحظة فاصلة» للأمن السيبراني، معدّدًا عشر خطوات للمدافعين، تشمل تزويد فرق الأمن بوكلاء ذكاء اصطناعي ودمج مراجعة الأمن في خط أنابيب التطوير.
وفي الأسبوع نفسه، ظهرت أداة مفتوحة المصدر تُدعى watermarks-remover على GitHub، تزيل العلامات المائية من محتوى Claude وتغطي علامات Gemini/SynthID وعلامات المصدر الخاصة بـ OpenAI.
بدأت المنصات في تنظيف المحتوى الرديء الناتج عن الذكاء الاصطناعي. أزالت Spotify 75 مليون مقطع صوتي مرفوع بكميات كبيرة ومكرر العام الماضي؛ وأزالت Google 130,000 قناة منخفضة الجودة و50,000 مجموعة حسابات على YouTube؛ ووضع TikTok تلقائيًا علامات على أكثر من 3 مليارات فيديو مولّد بالذكاء الاصطناعي. واختارت Merriam-Webster كلمة «slop» لتكون كلمة العام 2025.
وانسجامًا مع ذلك، كشف تقرير المخاطر الصادر عن Anthropic في 15 أغسطس عن نموذج غير مُصدر يُدعى Model 2، يتقدم قليلًا على Claude Mythos 5 في عدة مهام مع تحسن إجمالي طفيف.
بشكل منفصل، أفاد موقع Responsible Statecraft أن إسرائيل، عبر شركة الإعلانات Piro، أنشأت «معهد هانوفر للسياسة العامة»، ونشرت أكثر من 100 تقرير منذ 6 أغسطس بهدف التأثير على تقييمات مصداقية نماذج اللغة الكبيرة (LLM). وصنّف GPTZero معظم التقارير التي جرى فحصها على أنها مكتوبة بالذكاء الاصطناعي. وتلقت Piro مبلغ 900,000 دولار من الحكومة الإسرائيلية.