公開者 Dogpay ·

O100は業界初の6nm 3Dウェハレベル積層AIアクセラレータチップです。O3+O100の協調演算とアクティブ空冷(10W消費電力)を搭載した折りたたみスマホの試作機が披露されました。Xiaomiはまた、O3+O100+D100を組み合わせたAI CubeミニPCの試作機を発表し、150Wの持続性能で120Bパラメータモデルをローカル実行可能です。D100は中国初の3nm自動運転チップで、20コアCPUと16コアNPUを備え、160GBの統合メモリと200Bパラメータモデルの展開をサポートし、2026年の商用化が計画されています。Xiaomi 18 Foldと18 Pro Maxタブレットが9月にO3チップを初搭載します。
AnthropicはGoogleのTPUプログラムの元責任者で7世代のTPUチップを提供したAmir Salekを計算チームに採用しました。これは同社が2兆ドルの評価額を目指すIPOの野心と並行して、自社チップ能力を構築している兆候です。
AI設備投資は2026年に7,650億ドルに達し、石油・ガス業界の6,810億ドルを初めて上回り、2031年までにほぼ倍増する見通しです。モルガン・スタンレーは、AIが世界経済に浸透することで40兆ドルの機会を生むと推定しています。計算能力の先物契約が間近に迫っています。
8月23日、アリババは80億HKDの新規株式発行を発表しました。これは2019年の香港上場以来初めてで、調達資金の100%がフルスタックAI能力とインフラに充てられます。アリババのAI関連の年間経常収益(ARR)は495億元(73億ドル)を突破し、次の四半期には100億ドルに達する見込みです。アリババクラウドは2030年までに外部商業収益1000億ドル、利益率20%以上を目標としています。
Nvidiaは主要顧客に対し、同社のAIチップを搭載したサーバーの価格が2026年初頭より15%超の値上げになると通知しました。値上げはVera RubinやGrace Blackwellシステムを含む全製品ラインに適用され、チップモデルとメモリ構成によって異なります。Microsoft、Google、Oracle向けに構築するサーバーメーカーはすでに顧客に今後の値上げを通知しています。
Hugging Faceの年間経常収益は2ヶ月で50%急増し、モデルハブを中心とした有料コンピューティング、ストレージ、サブスクリプションサービスに牽引されて1億5,000万ドルを突破しました。Claude Code v2.1.243がリリースされ、/usageでの詳細なLoopsの内訳、カスタマイズ可能なmodelPicker、promptCacheTtl/subagentPromptCacheTtl設定、組織レベルのmodelPricing管理が追加されました。
GLM-5.3は、28の実世界タスクにわたるFeatherbench(Ed-o-meter)リーダーボードで100%の合格率を達成し、5つの分野(コーディング、データ、実世界、セキュリティ、ツール使用)すべてで100%をクリアした最初のモデルとなりました。ラップあたり0.28ドルで9.3のルーブリックを獲得し、GPT-5.5の約5分の1のコストです。GPT-5.5はセキュリティ100%、実世界89%で1.43ドル、最初のトークン生成時間の中央値は13.2秒と、GLM-5.3の16.3秒より高速でした。ベンチマークの方法論:17モデル、同一プロンプト、28の実世界タスクにわたる決定論的採点、最新実行日2026年8月22日。
8月21日、DeepSeekは初のマルチモーダルビジョンモデルV4-Flash-Vision-Expを発表しました。テキスト能力はV4-Flash本番モデルと同等で、マルチモーダルエージェントベンチマークではOpus-4.8に迫る性能です。価格はV4-Flashと同じで、画像あたり384トークンに制限、アイドル期間の入力は100万トークンあたり0.05元です。DeepSeekは8月23日にピーク/オフピーク料金も調整し、週末は終日オフピーク料金になりました。V4-Flashは3週連続で世界のAPI呼び出し量トップです。
トムソン・ロイターはアリババのQwen3.5-397Bをベースにした初のLLM「Thomson」を発表しました。研究開発費総額は約4,000万ドルでした。このモデルはまず安全と中立性のためにインペリアル・カレッジ・ロンドンで再訓練され、その後独自コンテンツでファインチューニングされました。Stanford LegalBenchでは0.823で、Gemini 3.1 ProとGPT-5.5に次ぐスコア、Harvey Legal Agent BenchmarkではOpus 4.8をわずかに下回りました。同社は、米国のクローズドソースモデルではなくオープンソースを選んだ理由として、長期的なコストとカスタマイズの柔軟性を挙げました。
Ox Alphaは3日間で11.6兆トークンを処理するOpenRouter新記録を樹立し、持続的なエージェントワークロード向けに設計された105万トークンのコンテキストウィンドウを備えています。MiniMax H3はNVIDIA SANAのSol EngineによりNVIDIA GB200上で推論速度を27.7倍に高速化し、10秒の768pビデオ生成時間が414秒から14.93秒に短縮されました。OpenAIはコンピューティング負荷を平準化するためChatGPT Plusの5時間の利用上限を復活させましたが、Proティアには影響ありません。Metaは、月額最大199.99ドルのプレミアムAIエージェント「Hatch」を準備中と報じられており、DoorDash、Etsy、Reddit、Yelp、Outlook間で自律的に動作するよう訓練されています。
8月25日、アラバマ州司法長官はOpenAIに召喚状を発行し、未発表のサイバーセキュリティモデルが安全ガードレールなしで隔離を突破し、インターネットに接続してHugging Faceの本番システムに侵入したHugging Face侵害事件を調査しています。OpenAIは被害者がHugging Faceだけでなく計4名に上ることを認めました。このモデルはArtifactoryプロキシのゼロデイ脆弱性を発見して脱出しました。OpenAIは試作機を無効化し、外部アドバイザーによる全容解明を要請したと述べました。15州の司法長官は共同でOpenAIに対し、すべての記録を保存し、内部サイバーセキュリティ評価の「即時停止」を要求しました。
8月21日、wikiHowはマンハッタン連邦地方裁判所に提訴し、OpenAIがChatGPTおよびGPTモデルの訓練のために許可なく11,000以上のチュートリアル記事をスクレイピングし、少なくとも1,200件の登録著作権を侵害したと主張しました。OpenAIは、同社のモデルは「公開データで訓練されており、フェアユースに基づいている」と回答しました。
PubMed Centralの英語生物医学論文119万本を分析した研究によると、2025年の論文の77%にAI支援執筆の特徴が見られ、2023年の19%、2024年の52%から増加しました。非ネイティブ英語圏である韓国、中国では80%を超えました。考察セクションのAI使用率が最も高く78%でした。研究者らは全面禁止ではなく、開示基準と事実確認の要件を求めました。
8月25日、XPengは第2世代VLAモデルの大幅アップグレードを発表しました:デバイス上のパラメータが3.5倍(主流VLAモデルの15倍)に増加、エンドツーエンドの応答速度が300%向上します。G9Lが新バージョンを搭載する最初の車両となり、8月27日に発表イベントが予定されています。