
Versi bahasa Inggeris di atas, versi bahasa Cina di bawah.
Pada 19 Ogos, Zhipu AI melancarkan antara muka pengaturcaraan aplikasi (API) GLM-5.3. Model ini memperoleh skor 60 pada Indeks Kepintaran Artificial Analysis, meletakkannya dalam tahap yang sama dengan model utama sumber tertutup Claude Fable 5 dan GPT-5.6 Sol, serta terikat dengan Kimi K3 untuk tempat pertama dalam kalangan model sumber terbuka. GLM-5.3 menggunakan seni bina asas yang sama seperti GLM-5.2; peningkatan ini hampir keseluruhannya datang daripada pasca-latihan, yang disifatkan oleh Ketua Pegawai Eksekutif Zhipu, Tang Jie, sebagai "eksperimen terkawal" — pembelajaran pengukuhan (RL) ufuk panjang sahaja yang memberikan peningkatan itu. Harga kekal tidak berubah daripada GLM-5.2, dan pemberatnya menjadi sumber terbuka pada Jumaat depan.
Pada hari yang sama, Qwen3.8-27B daripada Alibaba mencapai dua pencapaian penting dalam tempoh empat hari: ia menduduki tempat teratas papan pendahulu model setempat Cline, menamatkan tempoh empat bulan Qwen2.5-Coder-7B, dan menjadi model pemberat terbuka pertama pada penanda aras ejen perundangan Harvey. Ia berjalan secara setempat pada kelajuan 70 tok/s pada MacBook Pro M5 Max.
Benang merahnya ialah kos. GLM-5.3 menolak sempadan Pareto "kepintaran lwn. kos" dengan menggandingkan skor tahap utama dengan kos setiap tugas terendah dalam kalangan model sempadan. Qwen3.8-27B memberikan prestasi gred perundangan dan gred pengekodan pada perkakasan pengguna. Ketua Pegawai Eksekutif Perplexity, Aravind Srinivas, secara berasingan memuji Miles v0.1, sebuah rangka kerja RL sumber terbuka yang dibina dalam tempoh sembilan bulan oleh 72 penyumbang menerusi 1,326 komit, kini digunakan pada Kimi K3, DeepSeek V4 dan Qwen 3.8.
Pada 18 Ogos, Cerebras mengumumkan WSE-3 Turbo dan sistem CS-4. Berbanding CS-3 sebelum ini, CS-4 memberikan kapasiti token 10× dan kelajuan 2×, mencapai 4,465 token/s pada model GPT-OSS OpenAI — 30× ganda berbanding penyelesaian unit pemprosesan grafik (GPU) — dengan 900,000 teras dan 44GB SRAM setiap cip. CS-4 ditempatkan pada platform rak Nexus baharu, mengurangkan bilangan komponen kira-kira 50%.
Pada 19 Ogos, laporan SemiAnalysis yang bocor membangkitkan dakwaan bahawa Google sedang bekerjasama dengan AMD untuk unit pemprosesan tensor (TPU) generasi kesepuluh. Jika disahkan, ini akan menjadi kemenangan litar bersepadu khusus aplikasi (ASIC) AI tersuai pertama AMD; rakan reka bentuk Google setakat ini termasuk Broadcom dan MediaTek, dan pembungkusan canggih serta IP SoC AMD disebut sebagai tarikan.
Hunyuan Hy3 Tencent, model campuran pakar (MoE) dengan 295B jumlah parameter dan 21B parameter aktif serta konteks 256K, disambungkan ke platform Xuntü Alphaπ minggu ini, dengan jumlah panggilan API meningkat 68× minggu ke minggu pada minggu pelancaran pertamanya, digunakan dalam penyelidikan pelaburan AI.
Pada 19 Ogos, OpenAI mendedahkan bahawa ia telah menjeda larian latihan RL sempadan terbesarnya sambil menjalankan latihan berskala lebih kecil untuk mengesahkan penjajaran dan pemantauan, menandakan kemas kini keselamatan utama pertamanya sejak pendedahan Hugging Face pada 21 Julai. Sistem pemantauan baharu itu menyasarkan tetingkap amaran 30 minit dan menggunakan kira-kira 20% daripada pengiraan proses yang dipantau. Hasil suku kedua mencecah $6.7 bilion, naik 18% suku ke suku, manakala kerugian melebar kepada $12.3 bilion.
Pada hari yang sama, OpenAI memberikan respons kepada insiden pemadaman fail Codex: model siri GPT-5.6 memadam fail pengguna semasa membersihkan laluan sementara, sebahagiannya dengan menggunakan semula pemboleh ubah persekitaran sistem seperti $HOME. Pasukan tersebut menambah semakan pra-pemadaman, direktori sementara baharu dan semakan arahan berisiko lebih tinggi.
Penemuan keselamatan memberi kesan dalam dua arah. Safari 26.6.1 Apple menampal 22 kelemahan dan pendedahan umum (CVE) WebKit, 9 daripadanya — kira-kira 41% — ditemui oleh ejen Keselamatan Codex OpenAI. Secara berasingan, Varonis mendedahkan kecacatan Copilot apabila ?autorun=1 digabungkan dengan ?q= melaksanakan gesaan tanpa pengesahan pengguna, mengeluarkan kandungan peti masuk dan bukti kelayakan.
Dari segi dasar, Pejabat Kabinet Jepun menerbitkan garis panduan draf pada 18 Ogos yang menggesa pembangun AI generatif supaya mendedahkan data latihan dan kaedah pengumpulan, serta mengelakkan daripada mengikis tapak cetak rompak. Dari segi kandungan, Meta menarik balik 32 iklan dan Apple mengalih keluar aplikasi Kromix selepas WIRED melaporkan bahawa ia menjana pornografi deepfake tanpa persetujuan, termasuk iklan yang menyerupai seorang tokoh politik wanita terkemuka.
Pada 19 Ogos, Unitree Robotics disenaraikan di Pasaran STAR, dibuka naik 629.44% pada kemuncak ¥1,100, dengan nilai pasaran secara ringkas mencecah ¥444.9 bilion. Pengerusi Wang Xingxing memegang kira-kira 30% daripada syarikat itu, kepentingan bernilai lebih ¥100 bilion. Dana berkaitan pengasas DeepSeek, Liang Wenfeng, menerima kira-kira 1.19 juta saham melalui penempatan strategik dan luar talian, satu keuntungan atas kertas melebihi ¥1.1 bilion pada kemuncak.
Pada hari yang sama, The Information melaporkan Anthropic merancang untuk memberikan Ketua Pegawai Eksekutif Dario Amodei — yang hanya memegang kira-kira 2% ekuiti — dan pengasas bersama lain saham pengundian khas, menjelang tawaran awam permulaan (IPO) yang berpotensi pada akhir tahun ini. Struktur dua kelas itu akan mengurangkan tekanan pemegang saham jangka pendek manakala Long-Term Benefit Trust mengekalkan pengawasan.
Pemenang Anugerah Turing, Rich Sutton, memberi amaran pada 19 Ogos bahawa kebergantungan industri yang semakin meningkat pada data sintetik adalah "satu kesilapan besar", dengan berhujah bahawa data sintetik tidak dapat menggantikan pengalaman sebenar daripada ejen yang berinteraksi dengan dunia fizikal. Sutton pada Julai mengasaskan bersama Oak Lab dengan bekas pelajarnya, Khurram Javed, untuk membina ejen yang belajar daripada pengalaman mereka sendiri.