
8 月 13 日,OpenAI 與 Cerebras 推出 Ultrafast Mode,這是一項由 Cerebras 晶圓級引擎(Wafer-Scale Engine)驅動的服務層級,可運行 GPT-5.6 Sol,最高每秒輸出 750 個 Token。Cerebras 表示,這比 Fable 5 快 11 倍,比 Opus 4.8 的 Fast 模式快 5 倍,且品質沒有下降。在僅有博士級專家才能回答的 2,500 題基準測試 Humanity's Last Exam 上,Ultrafast 用時 11 小時 11 分鐘完成,而 Claude Fable 5 則需 78 小時 27 分鐘。在衡量具經濟價值知識工作的基準測試 GDP-Val 上,Ultrafast 實現了 5.6 倍的端到端加速。這項服務將首先在 OpenAI 應用程式介面(API)中提供給特選客戶群。
8 月 13 日,Google 發布 Gemini 3.7 Flash,瞄準程式設計與代理用例,距離 3.6 Flash 發布僅三週。截至 12 月 31 日,該模型定價為 3.6 Flash 的一半——每百萬輸入 Token 0.75 美元,每百萬輸出 Token 3.75 美元。Google 也將該模型納入 Gemini Spark,供 160 多個地區的 AI Pro 和 Ultra 訂閱用戶使用。
8 月 14 日,DeepSeek 宣布將於 8 月 17 日起實施峰谷 API 定價,離峰時段價格為尖峰時段的一半。部分模型的價格漲幅超過 3 倍。旗艦模型 deepseek-v4-pro 在尖峰時段的每百萬 Token 價格明顯上漲。此舉逆轉了 DeepSeek 先前作為低成本供應商的定位。
8 月 13 日,Lenovo 公布 2026 會計年度第一季業績:人工智慧(AI)相關營收年增 60%,達 85 億美元,占總營收 35%。董事長楊元慶對媒體表示,算力配置正從早期的「80% 訓練」轉向「80% 推理、20% 訓練」的目標,目前比例約為 50/50。
同一批同日發布的消息——每秒 750 個 Token 的前沿模型、半價的 Flash 模型,以及在其他業者降價時卻調漲價格的中國供應商——顯示競爭已從「誰最強」轉向「誰最快、最便宜」。
8 月 14 日,DeepSeek 推出 V4-Pro 正式版,這是一款 1.6 兆參數模型,其權重採用 MIT 授權釋出,原生支援 OpenAI Responses API,並針對 Codex 進行調適。Harness 外掛生態系統進入公開測試。
同日,據報導,智譜的 GLM-5.3 擁有 743B 基礎模型,在 CyberGym 上得分 84.5,超過 GPT-5.6 Sol,專為網路防禦與程式設計打造。美團推出 LongCat-2.0,這是一款 1.6T 參數的混合專家(MoE)模型,具備 1M 上下文視窗,在 Terminal-Bench 2.1 上得分 70.8,專注於代理式程式設計。
8 月 14 日,Grok 4.6 在 CursorBench 真實世界程式設計排行榜上位居第一,超越 Claude Opus 5 和 GPT-5.6 Sol。xAI 也開源了 Phoenix 的權重;Phoenix 是其 X 排名演算法,一個基於 Grok 的 transformer,其合成評分權重偏好傳播意圖與真實對話,並將「喜歡」視為最廉價的訊號。
8 月 13 日,一項 Meta/牛津大學的研究發現,多模態預訓練僅需 5% 的圖像生成資料;最佳配比為 70% 語言、25% 圖像理解與 5% 圖像生成——將圖像生成 Token 減少 5 倍。
來自 DeepSeek、美團和 xAI 的開放權重推進,以及程式設計與網路防禦的專業基準測試,標誌著模型競爭正向能力專業化轉變,在狹窄且可衡量的任務上競爭,而非空泛的一般能力宣稱。
8 月 13 日,《財星》報導,Anthropic 計劃於 10 月以 2 兆美元估值進行首次公開發行(IPO),這將超越 SpaceX 在 6 月 12 日以 1.77 兆美元估值創下的史上最大 IPO。Anthropic 的年化營收在 5 月突破 470 億美元,並於 6 月向美國證券交易委員會(SEC)秘密提交申請。
8 月 14 日,《日經新聞》(Nikkei)報導,騰訊將收購 Meta 在 AI 開發商 Manus 的持股,成為其最大股東。Manus 於 2025 年 3 月由 Butterfly Effect 推出,在獲得美國投資後將總部遷至新加坡,並縮減中國業務。4 月,中國外商投資安全審查禁止 Meta-Manus 收購案;8 月 11 日,Manus 宣布脫離 Meta,恢復獨立營運。
8 月 14 日,媒體報導 Google DeepMind 正在重組,從前沿模型研究轉向具成本效益的 Flash 級模型,裁員規模可能達三分之一或更多。Demis Hassabis 於 8 月 5 日卸任執行長,轉任董事長及 Alphabet 首席科學家。此次重組與 Google 下一代旗艦 Gemini 模型的延遲,以及內部對開發優先順序的爭議有關。
8 月 14 日,路透報導,Apple 已與阿里巴巴合作訓練一款針對中國市場的大型語言模型(LLM),結束其先前依賴第三方模型的局面。Apple Intelligence 預計將在數月內於中國推出,此前該公司已於 7 月 15 日向監管機構提交「Apple Intelligence」裝置端生成式 AI 服務的申請。
8 月 13 日,馬斯克對 SpaceX 員工表示,SpaceXAI(前身為 xAI)資料中心電力容量將在 2027 年底前成長約 7 倍,達到 10GW;目前橫跨曼非斯和南黑文的容量為 1.4GW。他估計 10GW 可帶來 3,000 億至 5,000 億美元的年營收。
同日出現兩個 2 兆美元規模的訊號,以及兩個中國市場動作:Anthropic 的 IPO 估值與 Apple 的中國模型策略——同時,騰訊吸納 Manus,Google 則從前沿領域撤退。
8 月 13 日,在巴爾的摩舉行的 USENIX 安全研討會上,伯明罕大學與杜倫大學的研究人員揭露了「Download More RAM」攻擊;此攻擊利用 DDR4/DDR5 SPD 晶片中缺少寫入保護的缺陷,在沒有實體接觸的情況下繞過 Windows 11 防禦。此缺陷讓軟體可重寫記憶體配置資料,使 Windows 將 RAM 誤報為 2 倍容量,並建立記憶體別名來讀取或修改受保護區域。它可停用防毒軟體、危害已鎖定的企業系統,並繞過核心防作弊機制。Microsoft 已指派 CVE-2026-23670,並在 2026 年 4 月的安全更新中新增緩解措施;啟用 Secure Boot 的系統可受到保護。Corsair、G.Skill 和 ADATA 各自至少有一條受影響的消費級產品線。
8 月 6 日,一篇獲 ACM AI 領袖峰會接受的論文發現,商業 AI 偵測器無法可靠區分 AI 編輯與完整草稿。輕度的「僅潤飾摘要」編輯被標記的比例為 64–80%(Pangram/GPTZero),而未經修改的 2023–2025 年原稿被標記的比例為 9–15%。經過「Undetectable AI」人性化處理後,被標記為 AI 改寫的文本只剩不到 4% 仍被標記。誠實的 AI 編輯比利用人性化工具規避偵測面臨更高的處罰風險。
本週還有一篇技術分析指出,文字 AI 浮水印永遠都可以被輕易移除;歐盟《人工智慧法》第 50 條將要求輸出內容「可偵測為人工生成」,並自 2026 年 8 月起強制執行。SynthID 風格的 Token 抽樣可透過任何較弱的 LLM 改寫來去除,而 Unicode 同形字浮水印則可透過替換字元來移除。該分析指出,Claude Code 先前曾使用同形字隱寫術來標記特定請求。
8 月 13 日,OpenAI 為 ChatGPT Mac 應用程式推出 Computer History,以 macOS 輔助使用事件記錄(點擊、輸入、快捷鍵、應用程式切換)取代 Chronicle 的截圖式預覽。事件會在本機儲存最多 48 小時,並在伺服器端記憶生成後刪除。隱私模式下的活動不會被記錄。此功能將提供給 Pro、Business 和 Enterprise 使用者,但不包括歐洲經濟區(EEA)、瑞士和英國。
8 月 14 日,ChatGPT 獲得直接編輯 Google Docs、Sheets 和 Slides 的能力,無需切換分頁,並將向 Plus、Pro、Business 和 Enterprise 使用者推出。
硬體層級的攻擊、失靈的偵測器,以及可被輕易移除的浮水印,都指向同一個前提:驗證 AI 內容與保護系統的基礎設施,正落後於模型本身的發展。