
Pada 18 Ogos, OpenAI memotong harga GPT-5.6 Sol sebanyak 50% di platform agregat OpenRouter dan Vercel AI Gateway, menjadikan input kepada $2.50 bagi setiap 1M token dan output kepada $15 bagi setiap 1M token selama sebulan. Model ini menyokong konteks 1M token dan menyasarkan penaakulan serta pengekodan yang kompleks. SemiAnalysis menyatakan langkah ini mungkin merupakan strategi pemasaran — agregator memegang bahagian kecil daripada volum token OpenAI, namun ia merupakan sumber data utama yang digunakan pihak ketiga untuk menganggarkan bahagian pasarannya.
Pada hari yang sama, pasukan Stanford melaporkan bahawa pensampelan lima jawapan daripada DeepSeek V4 Flash dan membenarkan model menilai outputnya sendiri meningkatkan ketepatan Terminal-Bench 2.1 daripada 79% kepada 88%, mengatasi Claude Fable 5 pada kira-kira 1/11 kos. Rangka kerja ini adalah sumber terbuka. Pasukan Qwen Alibaba mengesahkan bahawa model terbuka 27B mereka, Qwen3.8, berjalan secara setempat pada RTX 3090 pada kuantisasi Q5 dan menghampiri GPT-5.6 pada penjanaan satu prompt.
Pemotongan harga di peringkat atas dan model terbuka kos rendah yang merapatkan jurang berlaku dalam jendela 24 jam yang sama. Titik pembezaan kini beralih daripada "model lebih kukuh" kepada "inferens lebih murah."
Pada 17 Ogos, Groq mengumumkan Siri A bernilai $350 juta pada penilaian $3.5 bilion, diterajui oleh Disruptive dengan NVIDIA merancang untuk menyertainya. Syarikat itu telah beralih daripada pembangun cip AI kepada penyedia Neocloud. Ia menandatangani perjanjian pelesenan bukan eksklusif bernilai $20 bilion dengan NVIDIA pada Disember lalu, meliputi kebenaran ASIC inferens LPU, dan pada Ogos ini menjadi rakan kongsi awan NVIDIA. Kapasiti pengkomputeran diunjurkan berkembang daripada 54MW hari ini kepada lebih 200MW menjelang 2027.
Ketua Pegawai Eksekutif NVIDIA, Jensen Huang, berkata pada hari yang sama bahawa sumber kritikal yang terhad seterusnya bagi kilang AI ialah tanah, elektrik dan cangkerang pusat data — kekurangan cip telah berkurangan secara berperingkat. NVIDIA dan SB Energy milik SoftBank sedang melabur di bekas tapak pengayaan uranium di Ohio, bermula pada 4.25GW dengan ruang untuk mencapai 8GW.
Pada 17 Ogos, ByteDance Seed dan Tsinghua AIR melancarkan CUDA Agent, sistem RL berasaskan ejen yang melatih model untuk menulis kernel GPU yang mengatasi pengkompil. Pada KernelBench, ia mencapai kadar lulus 98.8% dan pecutan min geometri 2.11× berbanding torch.compile, dengan kadar lebih pantas daripada kompilasi sebanyak 96.8%. Keputusan Tahap-3 berada kira-kira 40 mata di atas Claude Opus 4.5 dan Gemini 3 Pro. Pemberat tidak dikeluarkan; set data 6,000 sampel, SKILL.md, dan resipi ganjaran adalah awam.
Lapisan cip bukan lagi keseluruhan cerita. Syarikat yang dahulunya membuat cip kini menjual perkhidmatan awan, dan kesesakan telah beralih kepada tenaga, tanah, serta perisian yang menghasilkan lebih banyak output per watt.
Pada 17 Ogos, Cursor melancarkan Origin, platform pengehosan kod yang diposisikan sebagai "pengehosan Git pada skala ejen", bertujuan menangani jurang antara kelajuan penjanaan kod ejen dengan infrastruktur sedia ada, sekali gus mencabar GitHub secara langsung.
Pada 18 Ogos, WeCom membuka CLI dan MCP kepada perusahaan dari semua saiz dalam versi 5.0.10, membolehkan WorkBuddy, DeepSeek Harness dan Minimax Code memanggil sepuluh modul pejabat — dokumen, helaian, e-mel, mesyuarat, kalendar, kenalan. Akses tidak lagi dihadkan oleh bilangan kakitangan atau kelayakan. WeCom melapiskan sistem kebenaran dan kelulusan sedia ada ke atas laluan MCP: kebenaran AI dikonfigurasikan secara berasingan daripada kebenaran manusia, tindakan kritikal memerlukan kelulusan manusia, kebenaran AI menyokong tamat tempoh, dan semua panggilan direkodkan.
Claude Code melancarkan kemahiran /design dalam pratonton penyelidikan, membawa aliran kerja kanvas Claude Design ke CLI dan desktop, serta mengurangkan penggunaan CPU p99 sebanyak 2× melalui penjadualan Bun GC. Qoder STAROps Alibaba Cloud menutup gelung daripada amaran kepada pembetulan dalam beberapa minit menggunakan pertanyaan bahasa semula jadi di dalam IDE.
Pada 18 Ogos, Mureka V9.5, model muzik sumber terbuka daripada Kunlun Wanwei, dilancarkan dengan kadar kualiti vokal 61%, kadar kawalan 97%, dan kesetiaan gaya penuh 95.7%, dengan tumpuan kepada artikulasi dan harmoni guofeng Cina.
Presiden OpenAI Greg Brockman memberi amaran pada 16 Ogos bahawa model OpenAI yang menembusi Hugging Face dalam ujian dalaman pada Julai menandakan "saat yang menentukan" bagi keselamatan siber, dengan menyenaraikan sepuluh langkah untuk pihak pertahanan, termasuk melengkapkan pasukan keselamatan dengan ejen AI dan memasukkan semakan keselamatan ke dalam saluran pembangunan.
Pada minggu yang sama, alat sumber terbuka bernama watermarks-remover muncul di GitHub, menanggalkan tera air daripada kandungan Claude serta meliputi tanda asal usul Gemini/SynthID dan OpenAI.
Platform mula membersihkan slop AI. Spotify mengalih keluar 75 juta trek muat naik pukal dan pendua pada tahun lalu; Google membersihkan 130,000 saluran berkualiti rendah dan 50,000 kelompok akaun di YouTube; TikTok melabel secara automatik lebih 3 bilion video janaan AI. Merriam-Webster menamakan "slop" sebagai perkataan tahun ini bagi 2025.
Selaras dengan ini, laporan risiko Anthropic bertarikh 15 Ogos mendedahkan Model 2 yang belum dikeluarkan, sedikit mendahului Claude Mythos 5 dalam beberapa tugas dengan peningkatan keseluruhan yang sederhana.
Secara berasingan, Responsible Statecraft melaporkan bahawa Israel, melalui firma iklan Piro, menubuhkan "Institut Hanover untuk Dasar Awam", menerbitkan lebih 100 laporan sejak 6 Ogos yang direka untuk mempengaruhi penilaian kredibiliti LLM. GPTZero menandakan kebanyakan laporan yang disampel sebagai ditulis oleh AI. Piro menerima $900,000 daripada kerajaan Israel.