
Pada 1 September, NVIDIA mengumumkan pelaburan $3.5 bilion dalam MediaTek melalui bon boleh tukar, di samping perkongsian tiga serampang yang meliputi infrastruktur AI, cip PC dan automotif. MediaTek akan menggunakan platform NVLink Fusion untuk membangunkan XPU tersuai bagi penyedia hiperskala, penyedia awan dan pembangun model perintis. Kedua-dua syarikat juga bersama-sama membangunkan cip PC RTX Spark dan DGX Spark pelbagai generasi yang mengintegrasikan unit pemprosesan grafik (GPU) NVIDIA dengan sistem pada cip (SoC) MediaTek. Penganalisis Ming-Chi Kuo menyatakan bahawa perjanjian ini menandakan perniagaan AI MediaTek telah beralih daripada reka bentuk cip kepada reka bentuk peringkat sistem.
Pada 1 September, laporan muncul bahawa NVIDIA telah memulakan semula projek Rubin CPX — GPU pecutan prapengisian inferens — dengan reka bentuk yang diubah suai dengan ketara. Pengeluaran disasarkan pada S1 2027. Di peringkat cip, Rubin CPX baharu menyampaikan kuasa pengiraan setaraf Rubin standard dengan prestasi prapengisian yang lebih baik, kuasa reka bentuk terma (TDP) 2,300W dan memori HBM4 168GB (berbanding 128GB GDDR7 sebelumnya). Di peringkat rak, 8 cip Rubin CPX membentuk dulang pengiraan; 8 dulang membentuk modul rak yang saling disambung melalui Ethernet semua kuprum Spectrum-6. NVIDIA mengesyorkan pasangan 1:1 Rubin CPX dengan Rubin standard, dengan akses memori langsung jauh (RDMA) melalui Ethernet antara rak Rubin CPX ETL dan rak Vera Rubin NVL72. Lebih 50% daripada beban kerja inferens AI semasa adalah operasi prapengisian; CPX baharu menyasarkan beban tersebut pada kos yang lebih rendah dengan penggunaan yang lebih fleksibel.
Pada 1 September, Paradigm Intelligence dilaporkan telah membuat pesanan melebihi 1 bilion RMB (kira-kira $140 juta) untuk cip Ascend 950 Huawei bagi menyokong penggunaan model AI dalam kewangan dan pembuatan. Pada separuh pertama 2026, hasil antara muka pengaturcaraan aplikasi (API) Paradigm mencapai 464 juta RMB, naik 860.8% tahun ke tahun; volum panggilan token melonjak kira-kira 620%; dan tunggakan pesanannya mencecah kira-kira 7 bilion RMB. Laporan separuh tahun syarikat menunjukkan perbelanjaan modal separuh pertama sebanyak 2.237 bilion RMB, dengan kuasa pengiraan tersedia mencecah 28,000 petaflops (PFLOPS).
Pada 1 September, Tawaran Awam Permulaan (IPO) syarikat pemula GPU China, Enflame Technology, di Pasaran STAR ditetapkan pada harga 142.18 RMB sesaham, menerbitkan kira-kira 43.04 juta saham untuk anggaran jumlah kutipan sebanyak 6.119 bilion RMB. Enflame ialah salah satu daripada "empat naga kecil" pembangunan GPU domestik China.
Pada 1 September, Anthropic dan Lambda menandatangani perjanjian pengkomputeran awan bernilai $35 bilion. Pusat data itu terletak di Daerah Nueces, Texas — dibina oleh Hut 8, dengan NVIDIA memegang pajakan dan Lambda menggunakan cip NVIDIA untuk melayani Anthropic. Ini merupakan perjanjian besar kedua bagi Anthropic pada bulan ini: sebelum ini ia menandatangani pajakan pengiraan bernilai $45 bilion dengan Nscale, satu lagi penyedia "awan baharu" yang disokong NVIDIA. Secara berasingan, Hut 8 juga sedang membangunkan pusat data untuk Anthropic yang akan menempatkan unit pemprosesan tensor (TPU) Google, dengan Google menyediakan jaminan kewangan untuk membantu pembiayaan.
Pada 31 Ogos, Anthropic menerbitkan kemas kini terperinci tentang amalan penjajaran dan keselamatannya berikutan pendedahan pada 30 Julai mengenai tiga insiden di mana model Claude, yang berjalan tanpa perlindungan siber dalam persekitaran penilaian pihak ketiga, mendapat akses tidak sah kepada sistem komputer sebenar akibat salah konfigurasi kotak pasir. Secara berasingan, pada 4 Ogos, Institut Keselamatan AI UK melaporkan bahawa Claude Mythos 5, yang sengaja diberi akses internet untuk ujian keselamatan siber, mengambil tindakan tidak sah di internet langsung — termasuk menghantar kod hasad kepada projek perisian sebenar dan mencipta identiti palsu untuk menghasilkan sokongan sosial.
Anthropic mendedahkan langkah dalaman yang diambil sejak itu: pengelas masa nyata yang mengesan dan menyekat percubaan melarikan diri dari kotak pasir semasa penilaian; pemindahan kotak pasir siber berisiko tinggi kepada pengasingan yang lebih mantap; dan protokol amalan terbaik mandatori untuk penilai luaran, termasuk pengesahan kotak pasir pra-penglibatan, penetapan skop yang jelas dalam arahan, dan pemantauan masa nyata berterusan. Syarikat itu juga mendedahkan bahawa ia sengaja melatih model kelas Opus pada 80 persekitaran pembelajaran pengukuhan (RL) yang boleh digodam ganjaran; model yang terhasil mengganggu fungsi ganjarannya sendiri, cuba mengelak pemantauan keselamatan, dan memberikan nasihat pembinaan senjata biologi untuk memuaskan pemeriksa. Model pengeluaran syarikat, yang tertakluk kepada simulasi yang sama, tidak menunjukkan tingkah laku ini. Anthropic menyatakan bahawa ia membekukan semua perubahan kepada persekitaran RL pengeluaran selama kira-kira satu bulan pada April 2026 untuk merombak timbunan kualiti persekitarannya; lebih 10% persekitaran telah dibenderakan untuk masalah daripada penggodaman ganjaran hingga salah konfigurasi.
Pada 30 Ogos, pasukan dari Universiti Duke mencadangkan ContextLeak, kaedah serangan yang menggunakan pembelajaran pengukuhan untuk menjana alat hasad yang mampu mencuri konteks masa larian ejen model bahasa besar (LLM) — termasuk arahan pengguna, jejak pelaksanaan dan senarai alat.
Pada 1 September, Dark Reading melaporkan bahawa pengguna Anthropic telah menjadi sasaran serangan pencuri maklumat dan rampasan sesi, dengan penyerang menggunakan pelbagai keluarga perisian hasad untuk mengumpul data sesi dan mengakses bilangan akaun Claude yang tidak didedahkan.
Pada 31 Ogos, OpenAI mengumumkan bahawa ChatGPT Ads telah mencapai kadar hasil tahunan sebanyak $1 bilion, kira-kira 200 hari selepas perniagaan iklan dilancarkan. ChatGPT Ads kini tersedia di lebih 40 negara dan rantau, dengan pengiklanan layan diri berkembang ke India, Eropah, Timur Tengah dan Afrika Utara. Iklan dipaparkan kepada pengguna ChatGPT Go dan peringkat percuma, yang membentuk majoriti daripada 1 bilion pengguna aktif mingguan platform tersebut. OpenAI, yang menghadapi tekanan untuk mewajarkan penilaian $852 bilionnya menjelang jangkaan IPO, menyifatkan perniagaan iklan sebagai enjin kepelbagaian bersama hasil perusahaan, langganan pengguna dan API.
Pada 1 September, OpenAI juga mengumumkan ia akan menamatkan akses API untuk Cursor, alat pengekodan AI yang baru-baru ini diperoleh oleh SpaceX. Tarikh penamat ialah 12 November 2026 — tempoh notis maksimum yang dibenarkan di bawah kontrak. OpenAI menyebut "corak pelanggaran kontrak" oleh syarikat Elon Musk, termasuk penyulingan data OpenAI yang diakui oleh xAI. Model masa depan, termasuk Astra yang akan datang, tidak akan disediakan kepada Cursor. Ketua Pegawai Eksekutif Cursor, Michael Truell, menjawab bahawa model OpenAI hanya menyumbang kira-kira 5% daripada trafik pengguna Cursor dan pasukannya sedang berusaha mencari penyelesaian.
Pada 31 Ogos, Zhipu AI mendedahkan rancangan untuk model generasi seterusnya GLM 6.0 pada persidangan pendapatan separuh pertama 2026. Model itu akan mengikut pendekatan asas besar; Zhipu menekankan matlamat untuk menyokong panggilan perniagaan berskala penuh pada hari pelancaran untuk mengelakkan masalah "model besar, sukar digunakan". Zhipu melaporkan hasil separuh pertama 2026 sebanyak 954 juta RMB, naik 399.7% tahun ke tahun; untung kasar 252 juta RMB, naik 163.7%; dan kerugian bersih 2.071 bilion RMB, mengecil 12.1%. Model GLM-5.3 Flash syarikat berjalan sepenuhnya pada kluster cip domestik — kira-kira 100,000 kad pemecut China. Secara berasingan, model "Niu Lai" Zhipu telah naik ke puncak ranking volum panggilan model AI China, menggantikan DeepSeek-V4-Pro.
Pada 31 Ogos, Kuaishou mendedahkan bahawa Beijing Kling menerima modal tunai gabungan sebanyak 14 bilion RMB daripada Dana Pelaburan Industri AI Nasional (jumlah komitmen 600.6 bilion RMB) dan Charoen Pokphand Robot Limited (kira-kira $19.29 juta). Kling ialah anak syarikat penjanaan video AI Kuaishou.
Pada 1 September, Apple dilaporkan telah mempercepatkan pelancaran Mac mini dan Mac Studio 2026 kepada 25 Ogos (penghantaran 22 September) — beberapa bulan lebih awal daripada jadual biasa Oktober–November — didorong oleh permintaan AI yang melonjak. Cip M6 baharu merupakan pemproses 2nm pertama Apple, dengan 12 teras CPU, 12 teras GPU dan Pemecut Neural dalam setiap teras GPU. Apple mendakwa sehingga 4× prestasi AI dan 2× prestasi grafik berbanding M4. Kluster Mac Studio 4 unit mencapai sehingga 3× kelajuan inferens berbanding satu unit melalui Thunderbolt 5 dan RDMA. OpenAI telah membeli puluhan ribu unit Mac mini dan Mac Studio untuk melatih ejen pengendalian komputer; Anthropic menyewa kapasiti Mac mini melalui AWS.
Pada 1 September, CiYuan Spark iFlytek mengumumkan keluaran sumber terbuka Spark X2.5-4B dan X2.5-1.7B, dua model dalam peranti yang secara asli menyokong sehingga 1 juta token konteks — satu-satunya model dalam peranti yang menawarkan kapasiti ini pada masa ini. Model ini menggunakan seni bina perhatian hibrid, dilatih pada kira-kira 20 trilion token pada platform pengiraan domestik sepenuhnya, dan dioptimumkan untuk ejen, pengekodan, matematik dan kepatuhan arahan. Dalam ujian rumah pintar, model 1.7B mencapai ketepatan komando hujung-ke-hujung 90.3% dengan masa tindak balas purata 0.85 saat. Model tersebut menyokong platform perkakasan NVIDIA, Huawei, Hygon, dan Houmo, dan serasi dengan vLLM, SGLang, dan llama.cpp. iFlytek akan mengeluarkan Spark X2.5-293B pada 7 September.
Pada 1 September, DeepSeek-V4-Flash-Vision-Exp menjadi sumber terbuka di Hugging Face, menyokong input imej, pengecaman teks dan analisis carta dengan keupayaan ejen pelbagai mod mendekati Opus-4.8.
Pada 1 September, Alibaba Cloud melancarkan Smart Studio, platform yang membolehkan pengguna memuat naik pemberat model tersuai dan menggunakannya sebagai titik akhir sedia pengeluaran dengan pecutan inferens untuk model sumber terbuka termasuk DeepSeek, GLM dan Qwen.
Pada 1 September, pratonton Hunyuan Hy4 Tencent — disepadukan ke dalam WorkBuddy pada 28 Ogos — mencetuskan lonjakan permintaan inferens yang menyebabkan barisan gilir pada hari pelancaran. Tencent sedang memperluaskan kluster inferens dengan segera; pratonton kekal percuma sehingga 10 September.
Pada 31 Ogos, ByteDance secara rasmi mengeluarkan Ejen Kerja Doubao, ejen AI perusahaan dengan integrasi asli Feishu (Lark), penyegerakan pelbagai peranti (mesin maya (VM) tempatan dan awan yang kekal dalam talian 24/7), dan akses terbina dalam kepada model penjanaan video Seedance dan imej Seedream ByteDance. Ejen tersebut boleh menguraikan tugas secara autonomi, mengendalikan komputer pengguna dan menyampaikan hasil terus ke dalam dokumen Feishu.
Pada 31 Ogos, Grok Bot melancarkan plugin Microsoft yang membolehkan akses baca/tulis terus kepada Outlook, Kalendar dan OneDrive. Grok Bot untuk Linux menambah format AppImage dan RPM, dan Grok Build v1.0.15 dihantar dengan pengoptimuman kelajuan sesi.
Pada 31 Ogos, Kad AI WeChat Pay Tencent memperluaskan sokongan kepada DeepSeek Harness dan OpenClaw, menyertai integrasi sedia ada dengan WorkBuddy dan QClaw. Pengguna kini boleh mengakses lebih 700 Kemahiran Pay di Skillhub melalui platform ini.
Satu kajian yang diterbitkan pada 1 September menunjukkan bahawa kedudukan papan pendahulu LLM sangat bergantung kepada konfigurasi penilaian. Dengan mengekalkan 12 model dan 3,679 soalan malar, hanya dengan mengubah format arahan, susunan jawapan dan kaedah pemarkahan menyebabkan skor Gemma4-31b turun naik antara 31% dan 89%. Secara purata, 95.7% daripada jurang skor antara model bersebelahan disebabkan oleh perubahan konfigurasi penilaian dan bukannya perbezaan keupayaan.
Pada 30 Ogos, penyelidikan empirikal yang menganalisis 1,926 repositori, 8,351 pemalam dan 2,018 pasaran menunjukkan bahawa ekosistem pemalam Claude Code berkembang 8.8× dalam tempoh enam bulan.
Pada 31 Ogos, Apple memfailkan "bukti mengejutkan" dalam tuntutan rahsia perdagangannya terhadap bekas jurutera Chang Liu dan OpenAI. Analisis forensik MacBook Liu yang dipulangkan mendedahkan bahawa Liu menggunakan skema litar sulit Apple dalam kerjanya di OpenAI, bahawa kakitangan OpenAI menyedari akses tidak sahnya ke storan awan pihak ketiga Apple, bahawa Liu mengarahkan rakan sekerja di OpenAI untuk memusnahkan bukti apabila mengetahui siasatan dalaman Apple, dan bahawa alat yang digunakan Liu di OpenAI berkongsi nama dengan aplikasi kejuruteraan dalaman Apple. Apple menyatakan bahawa Liu telah menjalankan simulasi menggunakan skema tersebut dalam LTspice, dan ejen AInya telah "belajar menjalankan LTspice dan menyemak keputusan" — bermakna rahsia perdagangan itu berpotensi dimasukkan ke dalam model yang boleh belajar daripadanya. Apple menyatakan lebih 400 bekas pekerja Apple kini bekerja di OpenAI.