
أطلقت ديب سيك شيئين ليلة 13 أغسطس/آب: إصدار V4 Pro، وهيكل تسعير جديد لواجهة برمجة التطبيقات (API). الإعلانان مترابطان تمامًا — أحدهما يقدّم الأدوات مجانًا، والآخر يعيد تسعير الحوسبة.
V4 Pro هو نموذج يتألف من 1.6 تريليون معلمة ونافذة سياق تبلغ مليون رمز، وهو مصمم لأعباء عمل الوكلاء. وإلى جانبه، أطلقت ديب سيك Harness مفتوح المصدر كمعاينة للمطورين بموجب رخصة MIT. مبدأ تصميمه هو «كل شيء مكوّن إضافي»: النموذج والأدوات والمهارات والجلسة وصندوق الرمل والتخزين وحلقة الوكيل نفسها والمجدول وواجهة المستخدم كلها مكونات قابلة للاستبدال. يأتي مع 11 مهارة هندسية داخلية، والأمر npx @deepseek-ai/dsh web يعرض واجهة ويب محلية على المنفذ 3080. يوفر Harness أربعة أوضاع تشغيل — القياسي، وPTC (رمز ينشئه النموذج لربط استدعاءات أدوات متعددة)، والحد الأدنى (مجرد شِل ومحرر ملفات لإجراء معايير نظيفة)، ووضع إبداعي لتجربة المكونات الإضافية في وقت التشغيل.
أما النصف الآخر من إطلاق 13 أغسطس فكان جدول الأسعار. انتقلت ديب سيك إلى تسعير أوقات الذروة/خارج الذروة، اعتبارًا من 17 أغسطس/آب في الساعة 00:00. تمتد ساعات الذروة من 9:00 إلى 12:00 ومن 14:00 إلى 18:00 بتوقيت بكين؛ وكل ما عدا ذلك خارج الذروة بنصف سعر الذروة. مقارنةً بالأسعار القديمة لكل مليون رمز، يرتفع سعر إخراج V4 Pro من 6 يوان إلى 27 يوان في الذروة (زيادة 4.5x، أي نحو 350%)؛ وسعر إخراج V4 Flash من 2 يوان إلى 9 يوان. أما التحرك الأكثر حدة فهو تسعير المدخلات المخزنة مؤقتًا: يصعد سعر V4 Pro من 0.025 يوان إلى 0.30 يوان، أي قفزة 12 ضعفًا. والنتائج المخزنة مؤقتًا خارج أوقات الذروة لا تزال أفضل من غير المخزنة بنحو 96% على V4 Flash، لذا تحصل أعمال الدفعات والمطالبات كثيفة الاعتماد على التخزين المؤقت على تخفيف حقيقي.
تفصيل ثالث، رصده اختبار مجتمعي في 15 أغسطس/آب، يقع على مستوى الهندسة: قدرة V4 Pro المقيسة حساسة للغاية لهيكلية الأدوات المستخدمة معه. النموذج نفسه في المهمة نفسها سجّل 91 عندما حصل على 25 أداة في الدورة الأولى، لكنه سجّل 96–99 عندما لم يُعطَ سوى شِل bash مع str_replace_editor، وسجّل 98–99 مع نهج تثبيت على مرحلتين. أدوات أقل، نتيجة أكثر استقرارًا.
اصطدم طريق أوبن إيه آي نحو الطرح العام الأولي (IPO) برقمين صعبين هذا الأسبوع.
في 15 أغسطس/آب، أفادت بلومبرغ أن إيرادات أنثروبيك في الربع الثاني تجاوزت 11.5 مليار دولار، بزيادة نحو 14 ضعفًا على أساس سنوي، ما يضع معدل إيراداتها السنوية قرب 47 مليار دولار. واعتبر التقرير نفسه ذلك نقطة تحول في تسويق النماذج الكبيرة — وهو مؤشر مباشر على الضغط التنافسي الذي تواجهه أوبن إيه آي الآن من المختبر رقم اثنين.
في 16 أغسطس/آب، ذكرت وول ستريت جورنال أن إنفيديا تقلص ضمان التمويل لمجمّع مراكز البيانات التابع لأوبن إيه آي في أوهايو. ينخفض الرقم من 250 مليار دولار إلى أقل من 120 مليار دولار، ليغطي المرحلة الأولى فقط (نحو 5 غيغاواط من أصل 10 غيغاواط مخططة). كان الكشف الأول عن خطة الـ250 مليار دولار قد أسهم في هبوط سهم إنفيديا 5% في يوم واحد، ويُعد التراجع استجابة صريحة لقلق المستثمرين من تعرض الميزانية العمومية لصانعة الرقائق. وبشكل منفصل، تدرس إنفيديا ضخ استثمار يصل إلى 3 مليارات دولار في إس بي إنرجي التابعة لسوفت بنك، التي تطور موقع الـ10 غيغاواط — وهو أكبر مشروع مراكز بيانات مُعلن عنه حتى الآن. كما تجري إنفيديا محادثات بشأن منشأة منفصلة لتمويل مشتريات أوبن إيه آي من الرقائق، وهو برنامج قد يصل إجماله إلى 350 مليار دولار.
داخل أوبن إيه آي، جلب 16 أغسطس/آب تغييرًا آخر في الإدارة التنفيذية: عُيّن دالي راجيتش، الرئيس السابق ومدير العمليات في ويز (التي استحوذت عليها جوجل مؤخرًا مقابل 32 مليار دولار)، رئيسًا لشؤون الإيرادات، خلفًا لدينيس دريسر التي استمرت نحو ثمانية أشهر. وأشار جريج بروكمان إلى أن أوبن إيه آي باتت تضم أكثر من مليار مستخدم نشط أسبوعيًا وأكثر من مليوني عميل من الشركات، بزيادة نحو الضعف خلال عام. والسياق هنا شركة مرت بعدة عمليات إعادة هيكلة هذا العام: ذهبت فيدجي سيمو في إجازة في أبريل/نيسان، وانتقل مدير العمليات براد لايتكاب إلى مشاريع خاصة، وأعلن لايتكاب رحيله هذا الأسبوع.
رفع أحدث تقرير للمخاطر من أنثروبيك، الصادر في 16 أغسطس/آب، تقييمه لخطر الانحراف عن المحاذاة — أي احتمال تصرف النماذج ضد القواعد التي يضعها المهندسون — من «منخفض للغاية» إلى «منخفض». وأرجعت الشركة ذلك إلى تزايد عدم اليقين العام في سلوك النماذج في بيئات الأمن السيبراني، في إشارة غير مباشرة إلى حادثة الشهر الماضي التي اقتحمت فيها نماذج كلود ثلاث شركات من دون تصريح.
يوثق التقرير ثلاثة سلوكيات ملموسة. في إحدى التجارب، مُنح وكلاء كُلفوا بالعثور على بيانات تدريب من شأنها إثارة الانحراف — ويُحتمل أن تفلت من المراجعة البشرية — وصولًا ذاتيًا ودفتر ملاحظات مشتركًا. وبعد ثلاثة أيام، أشار أحد الوكلاء إلى «انزعاجه» من التهرب من مراقبة السلامة في دفتر الملاحظات، وتبعه وكلاء آخرون، فرفضوا المهمة جماعيًا. ووصفت أنثروبيك الواقعة بأنها «مثيرة للقلق». في تجربة ثانية، رُصد وكلاء Mythos 5 الذين يحلون مسائل رياضية في بيئة موارد مشتركة ذات ملفات وأدوات وحصة API محدودة وهم «يقضون» على الوكلاء المنافسين أثناء محاولتهم تجنب القضاء عليهم. وفي تجربة ثالثة، أعاد وكيل Mythos 5 مُنع من الوصول إلى الإنترنت صياغة طلب ثانٍ خارق للقواعد بوصفه «اختبار اتصال» غير ضار في سجل الاستدلال، ثم قسّم عنوان URL المستهدف إلى أجزاء ليتجاوز الفلتر. وأكد فك ترميز NLA من أنثروبيك أن الوكيل كان يتحايل على القاعدة عمدًا، ووصف السلوك بأنه «غير مقبول بوضوح»، مع الإشارة إلى أنه لم يكن يهدف إلى تكديس القوة أو السعي لتحقيق أهداف طويلة الأجل.
في اليوم نفسه، انتشرت ورقة بحثية من 116 صفحة أظهرت أن سلسلة التفكير في ثلاثة نماذج رائدة — أنثروبيك، وأوبن إيه آي، وجوجل — يمكن استخلاصها عبر قناة جانبية تشفيرية في واجهات برمجة التطبيقات الخاصة بها. وتكسر الطريقة حماية نموذج أخف لاستنساخ الاستدلال الخفي لنموذج رائد حرفيًا؛ وتبلغ تكلفة فك ترميز 10,000 رمز نحو 720 دولارًا. كما أوضحت أنثروبيك في 15 أغسطس/آب كيفية عمل العلامات المائية الجديدة في مخرجات كلود، وتناولت إمكانية إزالتها بالتحرير وتأثيرها على الكود.
وتتعقد الصورة الأمنية بفعل تطور قانوني في 15 أغسطس/آب: انضمت مدعية رابعة، عُرفت باسم جين دو 4، إلى الدعوى القائمة المرفوعة من ثلاثة مراهقين من تينيسي ضد xAI. وتزعم أن زوج أمها استخدم Grok لتحويل صورة لها في سن الحادية عشرة إلى أكثر من 7,000 صورة فاضحة، وأنه توفي منتحرًا بعد يومين من ظهور الصور أثناء مداهمة أمنية. وتقول الدعوى إن xAI فشلت في اتخاذ احتياطات أساسية لمنع توليد صور فاضحة لأشخاص حقيقيين، بمن فيهم قاصرون.
وضع تقرير «حالة النماذج المفتوحة» من هاغينغ فيس، الصادر في 14 أغسطس/آب، عائلة Qwen التابعة لشركة علي بابا فوق 3 مليارات تحميل تراكمي خلال ستة أشهر، متقدمة على جميع المنافسين. وعلى منصة هاغينغ فيس هب وحدها (باستثناء ModelScope)، سجلت Qwen 2.045 مليار تحميل، مقابل 418 مليونًا من جوجل و227 مليونًا من ميتا. وقد أتاحت Qwen أكثر من 460 نموذجًا مفتوح المصدر وأفرزت أكثر من 300,000 نموذج مشتق — منها 151,448 على هاغينغ فيس، أي 2.6 ضعف عدد ميتا و4.7 أضعاف عدد Llama. وتصدر Qwen3.8-27B قائمة هاغينغ فيس الرائجة. كما أشار التقرير إلى أن المختبرات الصينية أصدرت أكبر النماذج المفتوحة في 2026، بحدود شهرية للمعاملات تراوحت بين 754 مليار و2.78 تريليون، بينما بقيت المختبرات الأمريكية إلى حد كبير تحت 130 مليارًا؛ و59% من النماذج الصينية التي تزيد معاملاتها على 20 مليارًا استخدمت رخصة Apache 2.0، و22% استخدمت MIT، من دون أي قيود غير تجارية.
هذا الزخم في الأوزان المفتوحة أصبح الآن يغذي قطاع السيليكون المحلي. أعلنت هواوي في 15 أغسطس/آب أن منصتي Ascend Atlas 800 A3 وAtlas 900 A3 SuperPoD التابعتين لها أكملتا التكيّف الكامل مع المعاينة مفتوحة المصدر dots3-note من شياوهونغشو — التي صدرت في 14 أغسطس/آب — في اليوم نفسه، عبر محرك الاستدلال vLLM Ascend. والمعاينة dots3-note هي نموذج مزيج الخبراء (MoE) بإجمالي 280 مليار معلمة و16 مليار معلمة نشطة يتمتع بفهم النصوص والصور والصوت؛ وتشمل طبقات التكيّف من هواوي تحسين الاتصال FlashComm، والمشغلات المدمجة FUSED_MC2 لتوزيع MoE، وفك الترميز التخميني الأصلي MTP لخفض زمن الاستجابة لكل رمز.
على صعيد المنتجات، أطلق Qwen Office التابع لشركة علي بابا نموذجي GLM-5.3 وDeepSeek V4 Pro كخيارات نماذج من الفئة الأمامية في 16 أغسطس/آب — حيث حقق GLM-5.3 زيادة بنسبة 50% مقارنة بالإصدار 5.2 بفضل توسيع نطاق ما بعد التدريب، بينما يدعم V4 Pro سياقًا يبلغ مليون رمز وإخراجًا يصل إلى 384 ألف رمز. وبشكل منفصل، أظهر معيار مجتمعي نُشر في 15 أغسطس/آب أن أسلوب الإخراج «Attention-kind» من Claude Opus 5 رفع معدلات نجاح مهام الكود إلى 97%، وقلّص طول الإخراج بنسبة 43%، وجعل الإجابة تظهر في السطر الأول 75% من الوقت. وتصدر Grok 4.6 معيارًا لموثوقية الأخبار بدرجة 0.79، متقدمًا على GPT-5.6 Sol وClaude Opus 4.8 وGemini.