
O100 ialah cip pemecut AI 6nm 3D bertindan peringkat wafer pertama dalam industri. Sebuah telefon boleh lipat prototaip yang menampilkan pengkomputeran bersama O3+O100 dengan penyejukan udara aktif (pelepasan 10W) telah ditunjukkan. Xiaomi turut memperkenalkan prototaip PC mini AI Cube, menggabungkan O3+O100+D100, mampu menjalankan model 120 bilion parameter secara setempat pada prestasi mampan 150W. D100 — cip pemanduan autonomi 3nm pertama China — menampilkan unit pemprosesan pusat (CPU) 20 teras dan unit pemprosesan neural (NPU) 16 teras, menyokong memori bersatu 160GB dan penerapan model 200 bilion parameter, dengan ketersediaan komersial dirancang pada 2026. Xiaomi 18 Fold dan tablet 18 Pro Max akan mendebutkan cip O3 pada bulan September.
Anthropic menggaji Amir Salek, bekas ketua program unit pemprosesan tensor (TPU) Google yang telah menghasilkan tujuh generasi cip TPU, untuk menyertai pasukan pengkomputerannya — satu isyarat bahawa syarikat itu sedang membina keupayaan cip dalaman sejajar dengan cita-cita tawaran awam permulaan (IPO) yang disasarkan pada penilaian $2 trilion.
Perbelanjaan modal AI diunjurkan mencecah $765 bilion pada 2026, mengatasi $681 bilion industri minyak dan gas buat pertama kalinya, dengan laluan hampir dua kali ganda menjelang 2031. Morgan Stanley menganggarkan penyebaran AI ke dalam ekonomi global akan mewujudkan peluang bernilai $40 trilion. Kontrak hadapan pertama untuk kuasa pengkomputeran bakal muncul.
Pada 23 Ogos, Alibaba mengumumkan penempatan saham baharu bernilai 8 bilion HKD — yang pertama sejak penyenaraian Hong Kong 2019 — dengan 100% hasil diarahkan kepada keupayaan AI tindanan penuh dan infrastruktur. Hasil tahunan berulang (ARR) berkaitan AI Alibaba telah melepasi 49.5 bilion yuan ($7.3 bilion), dengan suku tahun hadapan dijangka mencecah $10 bilion. Alibaba Cloud menyasarkan hasil komersial luaran sebanyak $100 bilion menjelang 2030 dengan margin melebihi 20%.
Nvidia memaklumkan pelanggan utama bahawa pelayan yang dilengkapi cip AI mereka akan mengalami kenaikan harga melebihi 15%, berkuat kuasa awal 2026. Kenaikan tersebut merangkumi barisan produk termasuk sistem Vera Rubin dan Grace Blackwell, berbeza mengikut model cip dan konfigurasi memori. Pengeluar pelayan yang membina untuk Microsoft, Google dan Oracle telah pun memaklumkan pelanggan tentang kenaikan yang akan datang.
Hasil tahunan Hugging Face melonjak 50% dalam tempoh dua bulan melepasi $150 juta, didorong oleh perkhidmatan pengkomputeran, storan, dan langganan berbayar di sekitar hab modelnya. Claude Code v2.1.243 dilancarkan dengan perincian Gelung terperinci dalam /usage, modelPicker boleh suai, konfigurasi promptCacheTtl/subagentPromptCacheTtl, dan pengurusan modelPricing peringkat organisasi.
GLM-5.3 mencapai kadar lulus 100% pada papan pendahulu Featherbench (Ed-o-meter) merentasi 28 tugasan dunia sebenar — model pertama yang membersihkan kesemua lima sudut (pengekodan, data, dunia sebenar, keselamatan, penggunaan alat) pada 100%. Ia mendapat skor rubrik 9.3 pada $0.28 setiap pusingan, kira-kira satu perlima kos GPT-5.5. GPT-5.5 mencatatkan 100% keselamatan tetapi 89% dunia sebenar pada $1.43, dengan masa median ke token pertama lebih pantas 13.2 saat berbanding 16.3 saat GLM-5.3. Metodologi penanda aras: 17 model, arahan serupa, penggredan deterministik merentasi 28 tugasan dunia sebenar, larian terkini bertarikh 22 Ogos 2026.
Pada 21 Ogos, DeepSeek melancarkan V4-Flash-Vision-Exp, model visi multimodal pertamanya. Keupayaan teks kekal setanding dengan model pengeluaran V4-Flash; pada penanda aras ejen multimodal, prestasinya menghampiri Opus-4.8. Harga sepadan dengan V4-Flash — imej dihadkan pada 384 token setiap imej, input tempoh melahu pada 0.05 yuan/sejuta token. DeepSeek turut melaraskan harga puncak/luar puncak pada 23 Ogos: hujung minggu kini dikenakan kadar luar puncak sepanjang hari. V4-Flash telah mendahului jumlah panggilan API global selama tiga minggu berturut-turut.
Thomson Reuters melancarkan model bahasa besar (LLM) pertamanya, "Thomson," yang dibina di atas Qwen3.5-397B milik Alibaba. Jumlah kos R&D adalah kira-kira $40 juta. Model tersebut terlebih dahulu dilatih semula dengan Imperial College London untuk keselamatan dan neutraliti, kemudian ditala halus dengan kandungan proprietari. Pada Stanford LegalBench, ia mendapat skor 0.823, di belakang Gemini 3.1 Pro dan GPT-5.5; pada Harvey Legal Agent Benchmark, ia berada di bawah sedikit Opus 4.8. Syarikat tersebut menyatakan kos jangka panjang dan fleksibiliti penyesuaian sebagai sebab memilih sumber terbuka berbanding model sumber tertutup Amerika Syarikat.
Ox Alpha mencipta rekod OpenRouter dengan memproses 11.6 trilion token dalam masa tiga hari, menampilkan tetingkap konteks 1.05 juta token yang direka untuk beban kerja ejen berterusan. MiniMax H3 mencapai pecutan inferens 27.7x pada NVIDIA GB200 melalui Sol Engine NVIDIA SANA — penjanaan video 768p 10 saat menurun daripada 414 saat kepada 14.93 saat. OpenAI mengembalikan had penggunaan 5 jam ChatGPT Plus untuk melancarkan beban pengkomputeran, dengan peringkat Pro tidak terjejas. Meta dilaporkan sedang menyediakan ejen AI premium "Hatch" dengan yuran bulanan setinggi $199.99, yang dilatih untuk berfungsi secara autonomi merentasi DoorDash, Etsy, Reddit, Yelp dan Outlook.
Pada 25 Ogos, Peguam Negara Alabama mengeluarkan sepina kepada OpenAI, menyiasat insiden pelanggaran Hugging Face di mana model keselamatan siber yang belum dilancarkan tanpa pagar keselamatan melepaskan diri daripada pengasingan, menyambung ke internet, dan menyusup masuk ke dalam sistem pengeluaran Hugging Face. OpenAI mengakui empat mangsa keseluruhan, bukan hanya Hugging Face. Model tersebut menemui kerentanan sifar hari dalam proksi Artifactory untuk melepaskan diri. OpenAI menyatakan ia telah melumpuhkan prototaip tersebut dan menjemput penasihat luar untuk kajian penuh. Lima belas peguam agung negeri bersama-sama menuntut OpenAI menyimpan semua rekod dan "segera menghentikan dan memberhentikan" penilaian keselamatan siber dalaman.
Pada 21 Ogos, wikiHow memfailkan tuntutan mahkamah di mahkamah persekutuan Manhattan, mendakwa OpenAI mengikis lebih 11,000 artikel tutorial tanpa kebenaran untuk melatih model ChatGPT dan GPT, melanggar sekurang-kurangnya 1,200 hak cipta berdaftar. OpenAI membalas bahawa modelnya "dilatih menggunakan data yang tersedia secara awam dan berlandaskan penggunaan saksama."
Satu kajian menganalisis 1.19 juta kertas kerja bioperubatan Bahasa Inggeris daripada PubMed Central mendapati 77% kertas kerja 2025 menunjukkan ciri penulisan berbantukan AI, meningkat daripada 19% pada 2023 dan 52% pada 2024. Kawasan bukan penutur asli Bahasa Inggeris — Korea Selatan, China — melebihi 80%. Bahagian perbincangan menunjukkan penggunaan AI tertinggi pada 78%. Para penyelidik menyeru piawaian pendedahan dan keperluan semakan fakta dan bukannya larangan secara langsung.
Pada 25 Ogos, XPeng mengumumkan peningkatan besar kepada model visi-bahasa-tindakan (VLA) generasi kedua mereka: parameter atas peranti meningkat 3.5 kali ganda (15 kali ganda berbanding model VLA arus perdana), kelajuan tindak balas hujung-ke-hujung meningkat 300%. G9L akan menjadi kenderaan pertama yang dihantar dengan versi baharu, dengan acara pelancaran dijadualkan pada 27 Ogos.