
Versi bahasa Inggeris di atas, versi bahasa Cina di bawah.
Pada 14 Ogos, Zhipu AI melancarkan GLM-5.3, mengekalkan model asas yang sama seperti GLM-5.2 dan bergantung sepenuhnya pada penskalaan pasca-latihan. Keupayaan pengekodan meningkat 50% dalam penanda aras dalamannya, Terminal-Bench 3.0 melonjak daripada 4.6 kepada 28.3, dan DeepSWE v1.1 meningkat daripada 46.2 kepada 66.9. Zhipu menyatakan ia akan membuka pemberat dua minggu selepas pelancaran, selepas semakan keselamatan.
Pelancaran itu hadir seiring dengan satu siri model pengekodan sumber terbuka. DeepSeek melancarkan V4 Pro, model MoE 1.6T parameter dengan 49B parameter aktif dan konteks token 1M. Pada LiveCodeBench, ia mencatatkan skor 93.5, dengan penarafan Codeforces 3206. Alibaba membuka sumber Qwen3.8-27B pada malam 14 Ogos, sebuah model padat multimodal natif 270B parameter yang mengatasi Qwen3.7-Plus dalam tugas pengekodan dan pejabat. Alibaba melaporkan Qwen telah melepasi 3 bilion muat turun dengan lebih 300,000 model terbitan, dan 460+ model sumber terbuka.
Anjakan ini seragam: tiada satu pun daripada tiga model asas itu diubah. Peningkatan datang daripada pasca-latihan dan seni bina. GLM-5.3 menggunakan hanya 50,000 token output bagi setiap tugas pada Z.ai Code Bench, berbanding kira-kira 120,000 untuk Claude Opus 4.8, sambil mencapai ketepatan 31.4% berbanding 29.5% bagi Opus 4.8.
Pada malam 13 Ogos, DeepSeek membuka sumber DeepSeek Harness di bawah lesen MIT, tanpa model baharu. Rangka kerja itu membahagikan keseluruhan kerangka ejen — gelung utama, pengurusan keadaan, storan sesi, penjadualan tugas, kotak pasir, peristiwa, UI — kepada komponen boleh pasang, di bawah reka bentuk "Semuanya ialah Plugin". Ia berjalan di atas asas plugin Cordis tersuai dengan muat/nyahmuat panas dan pemulihan semula, serta penentuan skop Preset yang menjalankan berbilang ejen terpencil dalam satu proses.
Pada malam yang sama dengan gandingan Harness-V4 Pro, Honor mengumumkan pada 15 Ogos bahawa YOYO Claw ("Otak Udang"nya) kini menjalankan GLM-5.3, pelancaran terus model terbuka di sisi pengguna. Anjakan ini kelihatan: skor model semakin menumpu, dan lapisan pembezaan sedang beralih kepada runtime serta peralatan yang membungkus model.
Pada 14 Ogos, SpaceX menyempurnakan pemerolehan Cursor bernilai $60 bilion, salah satu urus niaga teknologi terbesar yang pernah dicatatkan. Blog Cursor menyebut akses kepada kluster GPU terbesar untuk membina model berkos lebih rendah. Kedua-duanya telah pun melancarkan model gabungan Grok 4.5 pada bulan Julai dan Grok 4.6 selepas itu, dan Musk memberitahu pekerja bahawa hasil AI akan melebihi semua perniagaan SpaceX lain menjelang September.
Dalam tempoh yang sama, Nvidia mempertimbangkan semula pendedahannya. Nvidia memegang kepentingan SpaceX bernilai kira-kira $21 bilion yang ditukar daripada kedudukan xAI selepas penggabungan SpaceX, dengan pusat data SpaceX menggunakan Nvidia secara eksklusif. Secara berasingan, laporan menunjukkan Nvidia mengurangkan jaminannya ke atas projek Ohio 10GW OpenAI — daripada $250 bilion kepada bawah $120 bilion, meliputi hanya 5GW pertama — dan hasil disetahunkan OpenAI melepasi $40 bilion, kira-kira dua kali ganda kadar larian sebelumnya. Anthropic, yang menyatakan kadar lariannya melepasi $47 bilion pada bulan Mei, dilaporkan hampir dengan pemerolehan Decart bernilai $6 bilion, sebuah syarikat yang perisiannya menjalankan latihan dan inferens dengan lebih cekap pada cip.
Sementara itu, pada 14 Ogos, Ketua Pegawai Eksekutif Anthropic Dario Amodei menulis tentang peraturan AI, dengan berhujah bahawa proses institusi yang adil dengan sendirinya boleh menyebarkan kuasa, dan peraturan itu harus mengikat syarikat-syarikat barisan hadapan sambil memberi ruang kepada model terbuka dan pemain kecil.
Laporan bertarikh 14 Ogos memperincikan bagaimana Jinshanmu, doktor residen pembedahan saraf di Peking Union Medical College Hospital, menggunakan GPT-5.6-Sol daripada OpenAI untuk membuktikan konjektur Crouzeix dalam kira-kira 16 jam — masalah yang belum selesai sejak 2004. Perumus konjektur Michel Crouzeix, dan ahli matematik Alex Townsend serta Anne Greenbaum, menyemak manuskrip tersebut dan mengesahkan bukti itu. Pemalar terbaik sebelum ini ialah 2.414, ditetapkan pada 2017 selepas bengkel selama seminggu; Crouzeix sendiri telah membuktikan 11.08 pada 2007. Lapan hari kemudian, ahli matematik Emiel Lorist dan Felix Schwenninger menyiarkan bukti bebas lima halaman dengan menggunakan kaedah yang berbeza, juga dibantu oleh ChatGPT 5.6.
Nvidia menambah perkakasan kepada naratif kecekapan pada 14 Ogos, dengan mengumumkan pengeluaran penuh suis Spectrum-X CPO — suis Ethernet optik pakej bersama 200G/lorong pertama yang dikeluarkan secara besar-besaran. Kuasa menurun kepada satu perlima, bilangan laser kepada satu perempat, dan masa operasi aplikasi AI meningkat lima kali ganda. SN6810 memuatkan 128 port 800 Gb/s dalam casis 2U (102.4 Tb/s), dengan TSMC, SPIL, Lumentum dan Foxconn dalam rantaian bekalan.