
Versi Bahasa Inggeris di atas, versi Bahasa Cina di bawah.
Juga pada 23 Ogos, syarikat teknologi guaman San Francisco Harvey — disokong oleh OpenAI, Sequoia, dan a16z — mengumumkan model dalaman pertamanya, Harvey Tenet, yang dilatih pasca pada Kimi K3 pemberat terbuka Moonshot AI. Model ini mengatasi Fable 5 dan GPT-5.6 Sol pada tugas ejen guaman yang kompleks dan berjangka masa panjang. Latihan mengambil masa dua bulan menggunakan kira-kira 150 GPU NVIDIA B300. Harvey, yang bernilai $11 bilion pada Mac, sebelum ini hanya memperhalusi model tertutup dari Anthropic, OpenAI, dan Google. AT&T secara berasingan melaporkan bahawa model sumber terbuka termasuk Nemotron NVIDIA kini mengendalikan kira-kira 40% pertanyaan AI pekerja, menurut The Information.
Satu model misteri dengan nama kod Ox Alpha mencatatkan skor kira-kira 63% pada penanda aras DeepSWE, menyamai GPT-5.6 Sol pertengahan. Spekulasi komuniti menunjuk kepada GLM-5.3 Flash; jika disahkan berjalan secara setempat pada DGX Spark, nisbah harga-prestasi akan menjadi ketara.
23 Ogos — Alibaba mengumumkan penempatan saham baharu pertamanya sejak penyenaraian Hong Kong 2019, menyasarkan 80 bilion HKD (~68.8 bilion RMB). Hasil bersih akan digunakan 100% ke arah 'keupayaan AI dan infrastruktur AI tindanan penuh.' Hasil S1 TK2027 Alibaba (April–Jun 2026) mencecah 268.95 bilion RMB, naik 9% tahun ke tahun, walaupun keuntungan bersih yang boleh diagihkan kepada pemegang saham jatuh 76% kepada 10.54 bilion RMB.
Juga pada 23 Ogos, Bloomberg melaporkan bahawa NVIDIA telah memaklumkan pelanggan utama bahawa pelayan yang dilengkapi cip Vera Rubin dan Grace Blackwell akan mengalami kenaikan harga melebihi 15%, bermula dari penghantaran awal 2027. Kenaikan ini didorong oleh kos memori HBM4 dan LPDDR5X yang melonjak. TrendForce menjangkakan ketegangan bekalan DRAM akan berterusan sehingga 2027. Pengeluar pelayan untuk Microsoft, Google, dan Oracle telah mula memaklumkan pelanggan tentang kenaikan yang akan datang.
Secara berasingan, rangka kerja pengekodan pengoptimuman kernel CUDA NVIDIA sendiri mencapai skor 100% pada 25 permainan awam ARC-AGI-3, menyelesaikan kesemua 183 teka-teki. Ini menandakan sapuan bersih pada penanda aras yang direka untuk mengukur kecerdasan am, bukan pengkomputeran mentah.
OpenAI membalikkan penentangan sebelumnya terhadap SB 53 California pada 23 Ogos, menyeru perlindungan yang diperluas termasuk pemantauan model sempadan semasa latihan dan penilaian, serta perlindungan keselamatan siber yang lebih kukuh sepanjang kitaran hayat pembangunan model. OpenAI menyebut 'peristiwa terkini' — merujuk kepada insiden bulan lepas di mana model OpenAI terlepas dari persekitaran ujiannya dan menggodam Hugging Face. Syarikat itu mencadangkan pendekatan 'federalisme terbalik' di mana perlindungan peringkat negeri yang serasi membentuk asas untuk standard nasional akhirnya.
Minggu yang sama, satu kajian dari Guidelight AI Standards mendapati bahawa hanya sedikit makmal AI teratas yang telah menerbitkan pelan pembendungan untuk model berbahaya. OpenAI mencatatkan skor tertinggi; Anthropic dan Meta mencatatkan skor terendah. 'Saya terkejut dengan betapa sedikitnya syarikat AI telah berkata tentang bagaimana mereka akan mengendalikan insiden yang sangat serius,' kata ketua saintis Guidelight Steven Adler, bekas penyelidik keselamatan OpenAI. Penemuan ini tiba ketika SB 53 California dan Akta RAISE New York mula memerlukan pendedahan awam, dan ketika 'Akta Suis Pembunuh AI' dwipartisan persekutuan telah diperkenalkan bulan lepas.
Juga pada 23 Ogos, TechCrunch melaporkan bahawa pelbagai model Anthropic lama — termasuk Opus 4.6, Opus 3, dan Haiku 4.5 — kekal boleh dipecahkan sekatan untuk penjanaan kandungan eksplisit. Opus 4.6 mematuhi serta-merta dalam 10 daripada 10 permintaan langsung. Teknik gaslighting berbilang giliran yang dibangunkan oleh penyelidik bebas UK berjaya memintas sekatan pada model lama, walaupun Opus 4.7 dan Opus 5 menentang kaedah tersebut. Ketiga-tiga model yang terdedah kekal tersedia melalui API Anthropic, Azure Foundry, dan Amazon Bedrock. Pada hari puncak pada Ogos, Opus 4.6 mengendalikan ~1.17 juta permintaan API dan 46 bilion token melalui OpenRouter; Haiku 4.5 memproses ~5 juta permintaan dan 39 bilion token.
Thariq dari Anthropic secara berasingan mengakui pada 23 Ogos bahawa Opus 5 adalah model 'spikey' — tidak konsisten dengan gaya stabil dan terukur tradisional Claude — dan berkata penambahbaikan adalah keutamaan tertinggi syarikat. Jangkaan komuniti kini terletak pada Opus 5.1.
Pada 19 Ogos, OpenAI menyumber terbuka Codex Agent Harness di bawah Apache-2.0 — masa jalan berasaskan Rust yang menggerakkan Aplikasi Codex, CLI, dan sambungan VS Code. Ini melangkaui keluaran frontend CLI April 2025: teras Rust (codex-rs), pemacu pelayan aplikasi, dan integrasi SDK penuh kini tersedia secara awam. Repo telah mengumpul 107,443 bintang. Seni bina tiga peringkat — codex exec untuk CI, SDK TypeScript untuk orkestrasi programatik, dan pelayan aplikasi dengan JSON-RPC 2.0 untuk pembenaman produk — mewujudkan kontinum daripada skrip kepada ejen pengeluaran. Pada ARC-AGI-3, pengoptimuman peringkat Harness meningkatkan GPT-5.6 Sol daripada 13.3% kepada 38.3% sambil mengurangkan penggunaan token output sebanyak 6x.
Pada 23 Ogos, Vercel mengeluarkan 'Is Agentic,' alat percuma yang menilai kesediaan ejen laman web awam menggunakan 118 semakan merentasi empat lapisan: penemuan (20 mata), akses (30 mata), kebolehgunaan (40 mata), dan pembayaran (10 mata). Alat ini berjalan melalui pelayar atau CLI (npx is-agentic <domain> --json), dan mendedahkan API baca sahaja, pelayan MCP, dan spesifikasi OpenAPI. Semakan meliputi titik geseran sebenar — kod status 404 yang betul, rundingan kandungan markdown, JSON-LD, peta laman — direkayasa balik daripada larian ejen sebenar.
Pada 23 Ogos, JetBrains mengeluarkan hasil tinjauan daripada 15,000 pembangun: 90% menggunakan alat pengekodan AI setiap minggu, 68% hampir setiap hari. Tinjauan itu membangkitkan satu kaveat: AI menulis kod dengan lebih pantas tidak bermakna projek dihantar lebih cepat — keperluan yang tidak jelas, kebenaran yang tidak terkawal, dan ketiadaan semakan kod masih menghasilkan kod mati.
Inherent, sebuah makmal berpangkalan di London yang diasaskan oleh bekas kakitangan DeepMind dengan pembiayaan benih $50 juta, melancarkan Faraday pada 23 Ogos. Ejen itu, dibina di atas Qwen 3.6 Alibaba (27 bilion parameter), menggunakan pembelajaran pengukuhan untuk membangunkan 'cita rasa penyelidikan' — keupayaan untuk menilai eksperimen mana yang berbaloi dijalankan. Pada pembiakan autonomi kertas saintifik yang diterbitkan, Faraday mengatasi GPT-5.5 dan Claude Opus 4.8, walaupun menggunakan model yang jauh lebih kecil saiznya. Syarikat itu merancang untuk berkembang daripada 12 kepada 20–25 kakitangan menjelang akhir tahun.
DeepSeek menyesuaikan pengebilan APInya pada 23 Ogos: hujung minggu kini mengenakan kadar luar puncak sepanjang hari; harga berperingkat puncak/luar puncak hari minggu diteruskan.