
Pada 13 Ogos, OpenAI dan Cerebras melancarkan Mod Ultrapantas, satu peringkat perkhidmatan yang dikuasakan oleh Wafer-Scale Engine Cerebras dan menjalankan GPT-5.6 Sol pada kelajuan sehingga 750 token output sesaat. Cerebras menyatakan ini 11x lebih pantas daripada Fable 5 dan 5x lebih pantas daripada Opus 4.8 pada mod Fast, tanpa kemerosotan kualiti. Pada Humanity's Last Exam, tanda aras 2,500 soalan yang hanya boleh dijawab oleh pakar peringkat PhD, Mod Ultrapantas selesai dalam 11 jam 11 minit, manakala Claude Fable 5 memerlukan 78 jam 27 minit. Pada GDP-Val, tanda aras untuk kerja pengetahuan yang bernilai ekonomi, Mod Ultrapantas memberikan pecutan hujung ke hujung 5.6x. Perkhidmatan ini tersedia terlebih dahulu dalam API OpenAI kepada sekumpulan pelanggan terpilih.
Pada 13 Ogos, Google mengeluarkan Gemini 3.7 Flash, disasarkan untuk kes penggunaan pengekodan dan ejen, hanya tiga minggu selepas 3.6 Flash. Sehingga 31 Disember, model ini ditetapkan harga separuh daripada 3.6 Flash — $0.75 bagi setiap juta token input dan $3.75 bagi setiap juta token output. Google turut menyertakan model ini ke dalam Gemini Spark untuk pelanggan AI Pro dan Ultra di lebih 160 rantau.
Pada 14 Ogos, DeepSeek mengumumkan penetapan harga API puncak-lembah berkuat kuasa 17 Ogos, dengan waktu luar puncak pada separuh kadar puncak. Sesetengah model mengalami kenaikan harga lebih daripada 3x. Model utama deepseek-v4-pro mengalami kenaikan harga per-juta-token yang ketara semasa waktu puncak. Langkah ini membalikkan pendirian awal DeepSeek sebagai penyedia kos rendah.
Pada 13 Ogos, Lenovo melaporkan keputusan suku pertama TK2026: hasil berkaitan kecerdasan buatan (AI) meningkat 60% tahun ke tahun kepada $8.5 bilion, iaitu 35% daripada jumlah hasil. Pengerusi Yang Yuanqing memberitahu media bahawa peruntukan pengiraan sedang beralih daripada "80% latihan" pada peringkat awal ke arah sasaran "80% inferens, 20% latihan", dengan pembahagian semasa sekitar 50/50.
Kumpulan pengumuman pada hari yang sama — model sempadan 750 token sesaat, model Flash separuh harga, dan penyedia China yang menaikkan harga manakala yang lain menurunkan harga — menunjukkan persaingan telah beralih daripada "siapa paling kuat" kepada "siapa paling pantas dan paling murah".
Pada 14 Ogos, DeepSeek mengeluarkan versi rasmi V4-Pro, model dengan 1.6 trilion parameter dengan pemberat yang dikeluarkan di bawah lesen MIT, sokongan asli untuk API Responses OpenAI, dan penyesuaian disasarkan untuk Codex. Ekosistem pemalam Harness memasuki ujian awam.
Pada hari yang sama, GLM-5.3 daripada Zhipu dilaporkan dengan model asas 743B yang mencatat skor 84.5 pada CyberGym, mengatasi GPT-5.6 Sol, dibina untuk pertahanan siber dan pengekodan. Meituan melancarkan LongCat-2.0, model campuran pakar (MoE) dengan 1.6T parameter dengan tetingkap konteks 1M, mencatat skor 70.8 pada Terminal-Bench 2.1, tertumpu pada pengekodan ejen.
Pada 14 Ogos, Grok 4.6 mendahului papan pendahulu pengekodan dunia sebenar CursorBench, mengatasi Claude Opus 5 dan GPT-5.6 Sol. xAI turut membuka sumber pemberat Phoenix, algoritma penarafan X miliknya, sebuah transformer berasaskan Grok yang pemberat skor sintetiknya mengutamakan niat penyebaran dan perbualan tulen, dengan tanda suka dianggap sebagai isyarat paling murah.
Pada 13 Ogos, satu kajian Meta/Oxford mendapati pralatihan multimodal hanya memerlukan 5% data penjanaan imej, dengan campuran optimum pada 70% bahasa, 25% pemahaman imej, dan 5% penjanaan imej — mengurangkan token penjanaan imej sebanyak 5x.
Dorongan pemberat terbuka daripada DeepSeek, Meituan dan xAI, bersama-sama tanda aras khusus untuk pengekodan dan pertahanan siber, menandakan peralihan ke arah model pengkhususan keupayaan yang bersaing pada tugas sempit dan boleh diukur, bukannya tuntutan keupayaan umum.
Pada 13 Ogos, Fortune melaporkan Anthropic merancang tawaran awam permulaan (IPO) pada Oktober dengan penilaian $2 trilion, yang akan mengatasi IPO SpaceX bernilai $1.77 trilion pada 12 Jun sebagai yang terbesar dalam sejarah. Hasil tahunan Anthropic melepasi $47 bilion pada Mei, dan ia memfailkan secara sulit dengan Suruhanjaya Sekuriti dan Bursa (SEC) pada Jun.
Pada 14 Ogos, Nikkei melaporkan Tencent akan memperoleh pegangan Meta dalam pemaju AI Manus untuk menjadi pemegang saham terbesarnya. Manus, yang dilancarkan pada Mac 2025 oleh Butterfly Effect, memindahkan ibu pejabatnya ke Singapura dan mengurangkan operasi China selepas pelaburan Amerika Syarikat (AS). Pada April, semakan keselamatan pelaburan asing China melarang pengambilalihan Meta-Manus; pada 11 Ogos, Manus mengumumkan ia memisahkan diri daripada Meta dan memulihkan operasi bebas.
Pada 14 Ogos, media melaporkan Google DeepMind sedang menyusun semula daripada penyelidikan model sempadan ke arah model kelas Flash yang cekap kos, dengan pemberhentian pekerja berpotensi mencecah satu pertiga atau lebih. Demis Hassabis meletakkan jawatan sebagai CEO pada 5 Ogos, menjadi pengerusi dan ketua saintis Alphabet. Penyusunan semula itu dikaitkan dengan kelewatan model Gemini utama Google yang seterusnya dan pertikaian dalaman mengenai keutamaan pembangunan.
Pada 14 Ogos, Reuters melaporkan Apple telah melatih model bahasa besar (LLM) khusus pasaran China dengan Alibaba, menamatkan pergantungan sebelumnya pada model pihak ketiga. Apple Intelligence dijangka dilancarkan di China dalam beberapa bulan, selepas pemfailan perkhidmatan AI generatif pada peranti "Apple Intelligence" dengan pengawal selia pada 15 Julai.
Pada 13 Ogos, Musk memberitahu pekerja SpaceX bahawa kapasiti kuasa pusat data SpaceXAI (dahulunya xAI) akan meningkat kira-kira 7x kepada 10GW menjelang akhir 2027, daripada 1.4GW semasa di Memphis dan Southaven. Beliau menganggarkan 10GW boleh menghasilkan hasil tahunan antara $300 bilion hingga $500 bilion.
Hari yang sama membawa dua isyarat berskala $2 trilion dan dua langkah pasaran China: penilaian IPO Anthropic, dan strategi model China Apple — manakala Tencent menyerap Manus dan Google berundur daripada barisan hadapan.
Pada 13 Ogos, di Simposium Keselamatan USENIX di Baltimore, penyelidik dari Universiti Birmingham dan Universiti Durham mendedahkan "Download More RAM", satu serangan yang mengeksploitasi kelemahan perlindungan tulis yang hilang dalam cip SPD DDR4/DDR5 untuk memintas pertahanan Windows 11 tanpa akses fizikal. Kelemahan ini membolehkan perisian menulis semula data konfigurasi memori, menyebabkan Windows melaporkan RAM secara salah pada kapasiti 2x dan mencipta alias memori untuk membaca atau mengubah suai kawasan yang dilindungi. Ia boleh melumpuhkan antivirus, menjejaskan sistem perusahaan yang dikunci, dan memintas anti-penipuan kernel. Microsoft menetapkan CVE-2026-23670 dan menambah mitigasi dalam kemas kini keselamatan April 2026; sistem dengan Secure Boot diaktifkan dilindungi. Corsair, G.Skill dan ADATA masing-masing mempunyai sekurang-kurangnya satu barisan produk pengguna yang terjejas.
Pada 6 Ogos, satu kertas yang diterima di Sidang Kemuncak Kepimpinan AI ACM mendapati pengesan AI komersial tidak dapat membezakan suntingan AI daripada draf penuh dengan boleh dipercayai. Suntingan ringan "perhalusi abstrak sahaja" dibenderakan pada 64–80% (Pangram/GPTZero), manakala karya asal 2023–2025 yang tidak diubah suai dibenderakan pada 9–15%. Selepas pemanusiaan "Undetectable AI", kurang daripada 4% penulisan semula berlabel AI kekal dibenderakan. Suntingan AI yang jujur membawa risiko sekatan yang lebih tinggi daripada pengelakan berbantukan alat pemanusia.
Juga minggu ini, satu analisis teknikal berhujah bahawa tera air AI teks akan sentiasa mudah dibuang, mendahului keperluan Perkara 50 Akta AI Kesatuan Eropah (EU) bahawa output perlu "boleh dikesan sebagai dijana secara buatan", yang boleh dikuatkuasakan mulai Ogos 2026. Persampelan token gaya SynthID boleh dilucutkan dengan memparafrasa melalui mana-mana LLM yang lemah, dan tera air homoglif Unicode boleh dibuang dengan menggantikan aksara. Analisis itu menyatakan Claude Code sebelum ini menggunakan steganografi homoglif untuk menandai permintaan tertentu.
Pada 13 Ogos, OpenAI melancarkan Computer History untuk aplikasi ChatGPT Mac, menggantikan pratonton berasaskan tangkapan skrin Chronicle dengan pembalakan peristiwa kebolehcapaian macOS (klik, penaipan, pintasan, pertukaran aplikasi). Peristiwa disimpan secara setempat sehingga 48 jam, kemudian dipadamkan selepas penjanaan memori di sisi pelayan. Aktiviti mod privasi dikecualikan. Ciri ini disediakan kepada pengguna Pro, Business dan Enterprise, tidak termasuk Kawasan Ekonomi Eropah (EEA), Switzerland dan United Kingdom (UK).
Pada 14 Ogos, ChatGPT mendapat keupayaan untuk menyunting terus Google Docs, Sheets dan Slides tanpa bertukar tab, dilancarkan kepada pengguna Plus, Pro, Business dan Enterprise.
Serangan peringkat perkakasan, pengesan yang gagal, dan tera air yang mudah dibuang berkongsi satu premis yang sama: infrastruktur untuk mengesahkan kandungan AI dan melindungi sistem ketinggalan berbanding model-model itu sendiri.