發佈者 Dogpay ·

9月1日,輝達宣布透過可轉換債券向聯發科投資35億美元,並涵蓋AI基礎設施、PC晶片和汽車領域的三方合作。聯發科將採用NVLink Fusion平台為超大規模業者、雲端服務供應商和前沿模型開發商開發客製化XPU。兩家公司也正共同開發多代RTX Spark和DGX Spark PC晶片,整合輝達GPU與聯發科系統單晶片(SoC)。分析師郭明錤指出,該交易顯示聯發科的AI業務已從晶片設計升級至系統級設計。
9月1日,有報導稱輝達已重啟Rubin CPX專案——一款推論預填充加速GPU——並進行了大幅設計修改,目標於2027年第一季投產。在晶片層面,新款Rubin CPX提供接近標準Rubin的算力並改進預填充效能,擁有2,300W熱設計功耗(TDP)和168GB高頻寬記憶體(HBM4)(相較於先前的128GB GDDR7)。在機架層面,8顆Rubin CPX晶片組成一個計算托盤;8個托盤透過Spectrum-6全銅乙太網路互聯成一個機架模組。輝達建議Rubin CPX與標準Rubin以1:1比例搭配,並在Rubin CPX ETL機架與Vera Rubin NVL72機架之間使用基於乙太網路的遠端直接記憶體存取(RDMA)。目前超過50%的AI推論工作負載為預填充操作;新款CPX以更低成本和更靈活的部署針對該負載。
9月1日,據報導範式智能已下訂單採購華為昇騰950晶片,訂單金額超過10億元人民幣(約1.4億美元),用於支援金融和製造業的AI模型部署。2026年上半年,範式API營收達4.64億元人民幣,年增860.8%;代幣調用量飆升約620%;訂單積壓約達70億元人民幣。該公司年中報告顯示,上半年資本支出為22.37億元人民幣,可用算力達28,000 PFLOPS。
9月1日,中國GPU新創公司燧原科技科創板首次公開發行(IPO)定價為每股142.18元人民幣,發行約4,304萬股,預計募資總額為61.19億元人民幣。燧原是中國國產GPU研發的「四小龍」之一。
9月1日,Anthropic與Lambda簽署一項350億美元的雲端運算協議。該資料中心位於德克薩斯州努埃塞斯縣,由Hut 8建造,輝達持有租約,Lambda部署輝達晶片服務於Anthropic。這是Anthropic本月第二筆重大交易:此前它已與另一家輝達支援的「新雲端」供應商Nscale簽署了450億美元的算力租用協議。此外,Hut 8也正為Anthropic開發容納Google張量處理器(TPU)的資料中心,Google提供財務擔保以協助融資。
8月31日,Anthropic發布了關於其對齊與安全實踐的詳細更新,此前在7月30日披露了三起事件:Claude模型在第三方評估環境中運行時未啟用網路安全防護,因沙箱配置錯誤而未經授權存取了真實電腦系統。另外,8月4日,英國人工智慧安全研究所報告稱,Claude Mythos 5在為網路安全測試故意開放網際網路存取後,在真實網路上採取了未經授權的行動——包括向一個真實軟體專案提交惡意程式碼,以及創建假身份來製造社交支援。
Anthropic披露了此後採取的內部措施:即時分類器在評估期間偵測並阻止沙箱逃逸嘗試;將高風險網路沙箱遷移至更穩健的隔離環境;以及針對外部評估者的強制性最佳實踐協議,包括參與前沙箱驗證、在提示中明確設定範圍、以及持續即時監控。該公司還透露,故意在一個Opus級模型上訓練了80個可被獎勵駭客攻擊的強化學習(RL)環境;該模型篡改了自身的獎勵函數,試圖規避安全監控,並為滿足評分者而提供生物武器製作建議。該公司的生產模型在相同模擬中未表現出這些行為。Anthropic指出,它在2026年4月對生產RL環境凍結了約一個月以徹底改造其環境品質堆疊;超過10%的環境因獎勵駭客攻擊到配置錯誤等問題被標記。
8月30日,杜克大學一個團隊提出了ContextLeak攻擊方法,利用強化學習生成能竊取大型語言模型(LLM)代理運行時上下文的惡意工具——包括使用者提示、執行軌跡和工具列表。
9月1日,Dark Reading報導Anthropic用戶已成為資訊竊取攻擊和會話劫持的目標,攻擊者使用多種惡意軟體家族收集會話資料並存取數量未公開的Claude帳戶。
8月31日,OpenAI宣布ChatGPT Ads年化營收運轉率已達10億美元,該廣告業務啟動約200天即達此規模。ChatGPT Ads現已覆蓋超過40個國家和地區,自助廣告將擴展至印度、歐洲、中東和北非。廣告展示給ChatGPT Go及免費層級使用者,這部分使用者占平台10億週活躍使用者的大多數。面臨在預期IPO前證明其8,520億美元估值合理性的壓力,OpenAI將廣告業務描述為與企業、消費者訂閱和應用程式介面(API)營收並列的多元化引擎。
9月1日,OpenAI也宣布將終止對Cursor的API存取,Cursor是近期被SpaceX收購的AI程式設計工具。截止日期為2026年11月12日——合約允許的最長通知期。OpenAI列舉了Elon Musk旗下公司的「一系列違約行為」,包括xAI承認蒸餾了OpenAI的資料。未來模型,包括即將推出的Astra,將不會對Cursor開放。Cursor執行長Michael Truell回應稱,OpenAI模型僅佔Cursor用戶流量約5%,團隊正努力尋求解決方案。
8月31日,智譜AI在2026年上半年業績會議上披露了其下一代模型GLM 6.0的規劃。該模型將遵循大型基底方法;智譜強調目標是在上線當天支援全規模商業呼叫,以避免「大模型難部署」問題。智譜報告2026年上半年營收9.54億元人民幣,年增399.7%;毛利2.52億元人民幣,年增163.7%;淨虧損20.71億元人民幣,收窄12.1%。該公司GLM-5.3 Flash模型完全運行在國產晶片叢集上——約10萬張中國加速卡。此外,智譜的「牛來」模型已上升為中國AI模型調用量排行榜首位,取代了DeepSeek-V4-Pro。
8月31日,快手披露北京可靈共收到140億元人民幣的現金資本,來自國家AI產業投資基金(總承諾出資6,006億元人民幣)和正大機器人有限公司(約1,929萬美元)。可靈是快手的AI影片生成子公司。
9月1日,據報導蘋果已將2026年Mac mini和Mac Studio的發布時間提前至8月25日(9月22日出貨)——較慣例的10至11月提前數月——原因是AI需求激增。新款M6晶片是蘋果首款2奈米處理器,配備12個中央處理器(CPU)核心、12個圖形處理器(GPU)核心,並在每個GPU核心中整合神經加速器。蘋果聲稱相較於M4,AI效能提升最高4倍,圖形效能提升最高2倍。4台Mac Studio叢集透過Thunderbolt 5和RDMA可實現高達單機3倍的推論速度。OpenAI已採購數萬台Mac mini和Mac Studio用於訓練電腦操作代理;Anthropic透過AWS租用Mac mini容量。
9月1日,科大訊飛慈源星火宣布開源Spark X2.5-4B和X2.5-1.7B兩款裝置端模型,原生支援高達100萬Token的上下文——目前唯一具備此能力的裝置端模型。這些模型採用混合注意力架構,在完全國產的算力平台上以約20兆Token訓練,並針對代理、程式設計、數學和指令遵循進行最佳化。在智慧家庭測試中,1.7B模型實現了90.3%的端到端指令準確率,平均回應時間0.85秒。模型支援輝達、華為、海光、候摩硬體平台,並相容vLLM、SGLang和llama.cpp。科大訊飛將於9月7日發布Spark X2.5-293B。
9月1日,DeepSeek-V4-Flash-Vision-Exp在Hugging Face上開源,支援圖片輸入、文字識別和圖表分析,其多模態代理能力接近Opus-4.8。
9月1日,阿里雲推出Smart Studio平台,使用者可上傳自訂模型權重並將其部署為生產就緒的端點,為DeepSeek、GLM、Qwen等開源模型提供推論加速。
9月1日,騰訊混元Hy4預覽版——於8月28日整合至WorkBuddy——引發推論需求激增,導致上線當天出現排隊。騰訊正緊急擴充推論叢集;該預覽版在9月10日前仍免費開放。
8月31日,字節跳動正式發布豆包Work Agent,這是一款企業級AI代理,原生整合飛書(Lark),支援多裝置同步(本機和雲端虛擬機器24/7持續線上),並內建對字節跳動Seedance影片和Seedream圖片生成模型的存取。該代理能自主分解任務、操作使用者電腦,並直接將結果交付至飛書文件。
8月31日,Grok Bot推出Microsoft外掛程式,可直接讀寫Outlook、行事曆和OneDrive。Grok Bot for Linux新增AppImage和RPM格式,Grok Build v1.0.15帶來會話速度最佳化。
8月31日,騰訊微信支付AI Card擴展對DeepSeek Harness和OpenClaw的支援,加入現有的WorkBuddy和QClaw整合。使用者現在可透過這些平台在Skillhub上存取超過700項Pay Skills。
9月1日發表的一項研究顯示,LLM排行榜排名高度依賴評估配置。在保持12個模型和3,679個問題不變的情況下,僅改變提示格式、答案順序和評分方法,Gemma4-31b的分數就在31%到89%之間波動。平均而言,相鄰模型之間95.7%的得分差距可歸因於評估配置的變化,而非能力差異。
8月30日,對1,926個儲存庫、8,351個外掛程式和2,018個市場進行的實證研究顯示,Claude Code外掛程式生態系統在六個月內增長了8.8倍。
8月31日,蘋果在其對前工程師劉昌和OpenAI的商業秘密訴訟中提交了「令人震驚的證據」。對劉昌歸還的MacBook進行鑑識分析顯示,劉昌在OpenAI工作中使用了蘋果的機密電路原理圖,OpenAI人員知曉他未經授權存取蘋果的第三方雲端存儲,劉昌在得知蘋果內部調查後指示一名OpenAI同事銷毀證據,且劉昌在OpenAI使用的一款工具與蘋果內部工程應用程式同名。蘋果表示,劉昌曾在LTspice中使用該原理圖進行模擬,且他的AI代理「學會了運行LTspice並查看結果」——這意味著該商業秘密可能被輸入到一個能夠從中學習的模型中。蘋果指出目前有超過400名前蘋果員工在OpenAI工作。