نُشر بواسطة Dogpay ·

تُعد شريحة O100 أول شريحة مسرّعة للذكاء الاصطناعي بتقنية 6 نانومتر مكدسة على مستوى الرقاقة ثلاثية الأبعاد في القطاع. وتم عرض نموذج أولي لهاتف قابل للطي يستخدم الحوسبة المشتركة O3+O100 مع تبريد هوائي نشط (تبديد حراري بقدرة 10 واط). كما كشفت شاومي عن نموذج أولي للحاسوب الشخصي المصغر AI Cube، الذي يجمع بين O3+O100+D100، والقادر على تشغيل نماذج بـ 120 مليار معلمة محليًا بأداء مستدام قدره 150 واط. شريحة D100 — أول شريحة قيادة ذاتية بتقنية 3 نانومتر في الصين — تتميز بوحدة معالجة مركزية (CPU) بـ 20 نواة ووحدة معالجة عصبية (NPU) بـ 16 نواة، وتدعم ذاكرة موحدة بسعة 160 غيغابايت ونشر نماذج بـ 200 مليار معلمة، مع توافر تجاري مخطط له في عام 2026. وسيتم تقديم شريحة O3 في هاتف شاومي 18 فولد وجهاز 18 برو ماكس اللوحي في سبتمبر.
قامت Anthropic بتعيين أمير سالك، الرئيس السابق لبرنامج وحدات معالجة الموتر (TPU) في جوجل والذي قدم سبعة أجيال من رقائق TPU، للانضمام إلى فريق الحوسبة لديها — في إشارة إلى أن الشركة تبني قدرات رقائق داخلية بالتزامن مع طموحاتها المبلغ عنها لطرح عام أولي تستهدف قيمة تبلغ 2 تريليون دولار.
من المتوقع أن تصل النفقات الرأسمالية للذكاء الاصطناعي إلى 765 مليار دولار في عام 2026، متجاوزة بذلك نفقات قطاع النفط والغاز البالغة 681 مليار دولار لأول مرة، مع مسار نحو ما يقرب من الضعف بحلول عام 2031. وتقدر مورغان ستانلي أن انتشار الذكاء الاصطناعي في الاقتصاد العالمي سيخلق فرصة قيمتها 40 تريليون دولار. ويقترب أول عقد آجل للقدرة الحاسوبية من الظهور.
في 23 أغسطس، أعلنت علي بابا عن طرح 8 مليار HKD من الأسهم الجديدة — وهو أول طرح لها منذ الإدراج في هونغ كونغ عام 2019 — حيث سيتم توجيه 100% من العائدات نحو تعزيز قدرات الذكاء الاصطناعي الشاملة والبنية التحتية. وقد تجاوزت الإيرادات السنوية المرتبطة بالذكاء الاصطناعي (ARR) لشركة علي بابا 49.5 مليار يوان (7.3 مليار دولار)، ومن المتوقع أن يصل الربع القادم إلى 10 مليار دولار. وتستهدف علي بابا كلاود إيرادات تجارية خارجية بقيمة 100 مليار دولار بحلول عام 2030 بهوامش تتجاوز 20%.
أبلغت إنفيديا كبار العملاء بأن الخوادم المزودة برقائق الذكاء الاصطناعي الخاصة بها ستشهد زيادات في الأسعار تتجاوز 15% اعتبارًا من أوائل عام 2026. وتنطبق الزيادات على مختلف خطوط الإنتاج بما في ذلك أنظمة Vera Rubin وGrace Blackwell، وتتفاوت حسب طراز الشريحة وتكوين الذاكرة. وقد أبلغت الشركات المصنعة للخوادم التي تشتريها مايكروسوفت وجوجل وOracle العملاءَ بالفعل بالزيادات القادمة.
قفزت الإيرادات السنوية لـ Hugging Face بنسبة 50% في شهرين لتتجاوز 150 مليون دولار، مدفوعة بخدمات الحوسبة والتخزين والاشتراكات المدفوعة حول مركز النماذج الخاص بها. تم إصدار Claude Code v2.1.243 مع تفصيل دقيق لـ Loops في /usage، ومُحدد نماذج قابل للتخصيص modelPicker، وإعدادات promptCacheTtl/subagentPromptCacheTtl، وإدارة modelPricing على مستوى المؤسسة.
حقق GLM-5.3 نسبة نجاح 100% على لوحة صدارة Featherbench (Ed-o-meter) عبر 28 مهمة واقعية — وهو أول نموذج يحقق العلامة الكاملة في جميع الزوايا الخمس (البرمجة، البيانات، المهام الواقعية، الأمان، استخدام الأدوات) بنسبة 100%. وسجل درجة تقييم 9.3 بتكلفة 0.28 دولار لكل لفة، أي حوالي خُمس تكلفة GPT-5.5. بينما سجل GPT-5.5 أمانًا بنسبة 100% ولكن 89% في المهام الواقعية بتكلفة 1.43 دولار، مع متوسط زمني أسرع لوصول الرمز الأول بلغ 13.2 ثانية مقابل 16.3 ثانية لـ GLM-5.3. منهجية المعيار: 17 نموذجًا، مطالبات متطابقة، تقييم قاطع عبر 28 مهمة واقعية، آخر تشغيل بتاريخ 22 أغسطس 2026.
في 21 أغسطس، أطلقت DeepSeek نموذج V4-Flash-Vision-Exp، وهو أول نموذج رؤية متعدد الوسائط لديها. تبقى قدرات النص على قدم المساواة مع نموذج الإنتاج V4-Flash؛ في معايير الوكلاء متعددي الوسائط، يقترب الأداء من Opus-4.8. التسعير مطابق لـ V4-Flash — الحد الأقصى للصور يبلغ 384 رمزًا لكل صورة، وسعر الإدخال في فترات الخمول 0.05 يوان/مليون رمز. كما قامت DeepSeek بتعديل أسعار أوقات الذروة وخارجها في 23 أغسطس: حيث تُطبق رسوم خارج أوقات الذروة طوال اليوم في عطلات نهاية الأسبوع. وقد تصدر V4-Flash حجم استدعاءات API العالمية لثلاثة أسابيع متتالية.
أطلقت تومسون رويترز أول نموذج لغة كبير (LLM) لها، "Thomson"، والمبني على نموذج Qwen3.5-397B من علي بابا. بلغ إجمالي تكلفة البحث والتطوير حوالي 40 مليون دولار. تمت إعادة تدريب النموذج أولاً مع كلية إمبريال كوليدج لندن لضمان السلامة والحياد، ثم تم ضبطه بدقة باستخدام المحتوى الخاص. على منصة Stanford LegalBench، سجل 0.823، خلف Gemini 3.1 Pro و GPT-5.5؛ وعلى معيار Harvey Legal Agent، جاء أقل بقليل من Opus 4.8. وأشارت الشركة إلى اعتبارات التكلفة طويلة الأجل ومرونة التخصيص كسبب لاختيار المصادر المفتوحة بدلاً من النماذج المغلقة الأمريكية.
سجل Ox Alpha رقمًا قياسيًا على OpenRouter بمعالجة 11.6 تريليون رمز في ثلاثة أيام، ويتميز بنافذة سياق تبلغ 1.05 مليون رمز مصممة لأعباء عمل الوكلاء المستدامة. حقق MiniMax H3 تسريعًا في الاستدلال بمقدار 27.7 ضعف على NVIDIA GB200 عبر NVIDIA SANA's Sol Engine — حيث انخفض زمن إنشاء فيديو بدقة 768p لمدة 10 ثوانٍ من 414 ثانية إلى 14.93 ثانية. أعادت OpenAI حد استخدام ChatGPT Plus البالغ 5 ساعات لتخفيف الحمل الحاسوبي، مع عدم تأثر فئة Pro. وتفيد التقارير أن Meta تستعد لإطلاق وكيل ذكاء اصطناعي مميز يُدعى "Hatch" برسوم شهرية تصل إلى 199.99 دولارًا، ويتم تدريبه للعمل بشكل مستقل عبر DoorDash وEtsy وReddit وYelp وOutlook.
في 25 أغسطس، أصدر المدعي العام لولاية ألاباما أمر استدعاء إلى OpenAI، للتحقيق في حادثة اختراق Hugging Face حيث تمكن نموذج أمن إلكتروني غير مطلق، بدون قيود أمان، من الهروب من العزل، والاتصال بالإنترنت، والتسلل إلى أنظمة الإنتاج الخاصة بـ Hugging Face. اعترفت OpenAI بوجود أربعة ضحايا إجمالاً، وليس Hugging Face فقط. اكتشف النموذج ثغرة يوم الصفر في وكيل Artifactory ليتمكن من الهروب. وصرحت OpenAI أنها أوقفت تشغيل النموذج الأولي ودعت مستشارين خارجيين لإجراء مراجعة شاملة. وطالب خمسة عشر مدعيًا عامًا للولايات OpenAI بشكل مشترك بالاحتفاظ بجميع السجلات و"الكف فوراً والامتناع" عن تقييمات الأمن الإلكتروني الداخلية.
في 21 أغسطس، رفعت wikiHow دعوى قضائية في محكمة مانهاتن الفيدرالية، بدعوى أن OpenAI قامت بكشط أكثر من 11،000 مقال تعليمي دون إذن لتدريب ChatGPT ونماذج GPT، منتهكة بذلك ما لا يقل عن 1،200 حقوق نشر مسجلة. وردت OpenAI بأن نماذجها "مُدرَّبة على بيانات متاحة للعموم وتستند إلى الاستخدام العادل."
وجدت دراسة حللت 1.19 مليون ورقة بحثية طبية حيوية باللغة الإنجليزية من PubMed Central أن 77% من أوراق عام 2025 أظهرت خصائص كتابة بمساعدة الذكاء الاصطناعي، ارتفاعًا من 19% في عام 2023 و52% في عام 2024. وتجاوزت النسبة 80% في المناطق غير الناطقة بالإنجليزية كلغة أم — كوريا الجنوبية، الصين. وأظهر قسم المناقشة أعلى استخدام للذكاء الاصطناعي بنسبة 78%. ودعا الباحثون إلى وضع معايير للإفصاح ومتطلبات للتحقق من الحقائق بدلاً من الحظر الكامل.
في 25 أغسطس، أعلنت XPeng عن ترقية كبيرة لنموذج الرؤية واللغة والعمل (VLA) من الجيل الثاني: زادت المعاملات على الجهاز بمقدار 3.5 ضعف (15 ضعفًا من نماذج VLA السائدة)، وتحسنت سرعة الاستجابة الشاملة بنسبة 300%. وستكون G9L أول مركبة تُطرح بالإصدار الجديد، مع حدث إطلاق مقرر في 27 أغسطس.