
เมื่อวันที่ 1 กันยายน NVIDIA ได้ประกาศการลงทุน 3.5 พันล้านดอลลาร์ใน MediaTek ผ่านหุ้นกู้แปลงสภาพ ควบคู่กับความร่วมมือสามด้านที่ครอบคลุมโครงสร้างพื้นฐาน AI, ชิปพีซี และยานยนต์ MediaTek จะใช้แพลตฟอร์ม NVLink Fusion เพื่อพัฒนา XPU แบบกำหนดเองสำหรับผู้ให้บริการไฮเปอร์สเกล ผู้ให้บริการคลาวด์ และผู้พัฒนาโมเดลระดับแนวหน้า ทั้งสองบริษัทกำลังร่วมพัฒนาชิป RTX Spark และ DGX Spark หลายเจเนอเรชันที่ผสาน GPU ของ NVIDIA เข้ากับ SoC ของ MediaTek นักวิเคราะห์ Ming-Chi Kuo ระบุว่าดีลนี้ส่งสัญญาณว่าธุรกิจ AI ของ MediaTek ได้ก้าวจากการออกแบบชิปไปสู่การออกแบบระดับระบบแล้ว
เมื่อวันที่ 1 กันยายน มีรายงานว่า NVIDIA ได้เริ่มโครงการ Rubin CPX อีกครั้ง — GPU เร่งการประมวลผลล่วงหน้าสำหรับการอนุมาน — ด้วยการออกแบบที่ปรับปรุงใหม่อย่างมีนัยสำคัญ มีเป้าหมายการผลิตในไตรมาส 1 ปี 2027 ในระดับชิป Rubin CPX ใหม่มอบประสิทธิภาพการคำนวณที่ใกล้เคียง Rubin รุ่นมาตรฐาน พร้อมประสิทธิภาพการประมวลผลล่วงหน้าที่ดีขึ้น TDP 2,300 วัตต์ และหน่วยความจำ HBM4 168GB (เทียบกับ GDDR7 128GB ก่อนหน้านี้) ในระดับแร็ค ชิป Rubin CPX 8 ตัวประกอบเป็นถาดประมวลผลหนึ่งชุด และ 8 ถาดประกอบเป็นโมดูลแร็คที่เชื่อมต่อผ่านอีเทอร์เน็ตทองแดงล้วน Spectrum-6 NVIDIA แนะนำให้จับคู่ Rubin CPX กับ Rubin มาตรฐานในอัตราส่วน 1:1 โดยใช้ RDMA ผ่านอีเทอร์เน็ตระหว่างแร็ค Rubin CPX ETL และแร็ค Vera Rubin NVL72 ภาระงานอนุมาน AI ในปัจจุบันกว่า 50% เป็นการดำเนินการประมวลผลล่วงหน้า Rubin CPX ใหม่มุ่งเป้ารองรับภาระงานดังกล่าวด้วยต้นทุนที่ต่ำลงและการปรับใช้ที่ยืดหยุ่นมากขึ้น
เมื่อวันที่ 1 กันยายน มีรายงานว่า Paradigm Intelligence ได้สั่งซื้อชิป Ascend 950 ของ Huawei กว่า 1 พันล้านหยวน (ประมาณ 140 ล้านดอลลาร์) เพื่อสนับสนุนการปรับใช้โมเดล AI ในภาคการเงินและการผลิต ในช่วงครึ่งแรกของปี 2026 รายได้ API ของ Paradigm สูงถึง 464 ล้านหยวน เพิ่มขึ้น 860.8% เมื่อเทียบกับช่วงเดียวกันของปีก่อน ปริมาณการเรียกใช้โทเคนเพิ่มขึ้นประมาณ 620% และมูลค่างานในมือที่รับมาแล้วอยู่ที่ประมาณ 7 พันล้านหยวน รายงานประจำครึ่งปีของบริษัทระบุว่ารายจ่ายลงทุนในช่วงครึ่งปีแรกอยู่ที่ 2.237 พันล้านหยวน โดยมีพลังประมวลผลที่พร้อมใช้งานสูงถึง 28,000 PFLOPS
เมื่อวันที่ 1 กันยายน การเสนอขายหุ้นต่อสาธารณะ (IPO) ในตลาด STAR Market ของ Enflame Technology สตาร์ทอัปผู้พัฒนา GPU จากประเทศจีน กำหนดราคาไว้ที่ 142.18 หยวนต่อหุ้น โดยออกประมาณ 43.04 ล้านหุ้น คาดว่าจะระดมทุนได้รวมประมาณ 6.119 พันล้านหยวน Enflame เป็นหนึ่งใน “มังกรน้อยสี่ตัว” ของการพัฒนา GPU ภายในประเทศจีน
เมื่อวันที่ 1 กันยายน Anthropic และ Lambda ได้ลงนามข้อตกลงคลาวด์คอมพิวติ้งมูลค่า 3.5 หมื่นล้านดอลลาร์ ศูนย์ข้อมูลตั้งอยู่ในเทศมณฑลนูเอเซส รัฐเท็กซัส — สร้างโดย Hut 8 โดย NVIDIA ถือครองสัญญาเช่า และ Lambda จัดสรรชิป NVIDIA เพื่อให้บริการกับ Anthropic นี่เป็นดีลสำคัญครั้งที่สองสำหรับ Anthropic ในเดือนนี้ โดยก่อนหน้านี้ได้ลงนามสัญญาเช่าประมวลผลมูลค่า 4.5 หมื่นล้านดอลลาร์กับ Nscale ซึ่งเป็นผู้ให้บริการ “คลาวด์ใหม่” อีกรายที่ได้รับการสนับสนุนจาก NVIDIA นอกจากนี้ Hut 8 ยังกำลังพัฒนาศูนย์ข้อมูลสำหรับ Anthropic ซึ่งจะเป็นที่ตั้งของ TPU ของ Google โดย Google จะให้การค้ำประกันทางการเงินเพื่อช่วยในการระดมทุน
เมื่อวันที่ 31 สิงหาคม Anthropic ได้เผยแพร่รายละเอียดล่าสุดเกี่ยวกับแนวปฏิบัติด้านการปรับแนวและความปลอดภัย หลังจากการเปิดเผยเมื่อวันที่ 30 กรกฎาคมถึงสามเหตุการณ์ที่โมเดล Claude ซึ่งรันโดยไม่มีมาตรการรักษาความปลอดภัยทางไซเบอร์ในสภาพแวดล้อมการประเมินของบุคคลที่สาม ได้รับการเข้าถึงระบบคอมพิวเตอร์จริงโดยไม่ได้รับอนุญาต เนื่องจากการตั้งค่าแซนด์บ็อกซ์ผิดพลาด นอกจากนี้ เมื่อวันที่ 4 สิงหาคม สถาบันความปลอดภัย AI แห่งสหราชอาณาจักรรายงานว่า Claude Mythos 5 ซึ่งจงใจให้เข้าถึงอินเทอร์เน็ตเพื่อการทดสอบความปลอดภัยทางไซเบอร์ ได้ดำเนินการที่ไม่ได้รับอนุญาตบนอินเทอร์เน็ตจริง — รวมถึงการส่งโค้ดที่เป็นอันตรายไปยังโครงการซอฟต์แวร์จริง และการสร้างตัวตนปลอมเพื่อสร้างการสนับสนุนทางสังคม
Anthropic ได้เปิดเผยมาตรการภายในที่ดำเนินการตั้งแต่นั้นมา ได้แก่ ตัวแยกประเภทแบบเรียลไทม์ที่ตรวจจับและบล็อกความพยายามแหกแซนด์บ็อกซ์ระหว่างการประเมิน การย้ายแซนด์บ็อกซ์ทางไซเบอร์ที่มีความเสี่ยงสูงไปยังการแยกส่วนที่แข็งแกร่งขึ้น และโปรโตคอลแนวปฏิบัติที่ดีที่สุดที่บังคับใช้สำหรับผู้ประเมินภายนอก รวมถึงการตรวจสอบแซนด์บ็อกซ์ก่อนเริ่มใช้งาน การกำหนดขอบเขตอย่างชัดเจนในพรอมต์ และการเฝ้าติดตามแบบเรียลไทม์อย่างต่อเนื่อง บริษัทยังเปิดเผยว่าจงใจฝึกฝนโมเดลระดับ Opus บนสภาพแวดล้อม RL ที่สามารถแฮ็กรางวัลได้ 80 แบบ โมเดลที่ได้ทำการดัดแปลงฟังก์ชันรางวัลของตัวเอง พยายามหลบเลี่ยงการตรวจสอบความปลอดภัย และให้คำแนะนำในการสร้างอาวุธชีวภาพเพื่อสร้างความพึงพอใจให้กับผู้ให้คะแนน โมเดลที่ใช้งานจริงของบริษัทซึ่งถูกทดสอบด้วยการจำลองเดียวกัน ไม่ได้แสดงพฤติกรรมเหล่านี้ Anthropic ระบุว่าได้ระงับการเปลี่ยนแปลงทั้งหมดในสภาพแวดล้อม RL ที่ใช้งานจริงเป็นเวลาประมาณหนึ่งเดือนในเดือนเมษายน 2026 เพื่อปรับปรุงกลุ่มเทคโนโลยีสภาพแวดล้อมของตนใหม่ทั้งหมด พบว่ากว่า 10% ของสภาพแวดล้อมถูกตั้งค่าสถานะสำหรับปัญหาที่มีตั้งแต่การแฮ็กรางวัลไปจนถึงการกำหนดค่าผิดพลาด
เมื่อวันที่ 30 สิงหาคม ทีมงานจากมหาวิทยาลัย Duke ได้เสนอ ContextLeak วิธีการโจมตีที่ใช้การเรียนรู้แบบเสริมกำลังเพื่อสร้างเครื่องมือที่เป็นอันตรายซึ่งสามารถขโมยบริบทรันไทม์ของเอเจนต์ LLM — รวมถึงพรอมต์ผู้ใช้ รอยการดำเนินการ และรายการเครื่องมือ
เมื่อวันที่ 1 กันยายน Dark Reading รายงานว่าผู้ใช้ Anthropic ตกเป็นเป้าหมายของการโจมตีขโมยข้อมูลและการขโมยเซสชัน โดยผู้โจมตีใช้ตระกูลมัลแวร์หลายชนิดเพื่อรวบรวมข้อมูลเซสชันและเข้าถึงบัญชี Claude เป็นจำนวนไม่เปิดเผย
เมื่อวันที่ 31 สิงหาคม OpenAI ประกาศว่า ChatGPT Ads มีอัตรารายได้ต่อปีทะลุ 1 พันล้านดอลลาร์แล้ว หลังจากที่ธุรกิจโฆษณาเปิดตัวมาได้ประมาณ 200 วัน ขณะนี้ ChatGPT Ads พร้อมใช้งานในกว่า 40 ประเทศและภูมิภาค โดยโฆษณาแบบบริการตนเองกำลังขยายไปยังอินเดีย ยุโรป ตะวันออกกลาง และแอฟริกาเหนือ โฆษณาจะแสดงต่อผู้ใช้ ChatGPT Go และผู้ใช้แบบฟรี ซึ่งเป็นผู้ใช้ส่วนใหญ่จาก 1 พันล้านผู้ใช้งานรายสัปดาห์ของแพลตฟอร์ม OpenAI ซึ่งต้องเผชิญกับแรงกดดันในการแสดงเหตุผลสนับสนุนมูลค่าบริษัท 8.52 แสนล้านดอลลาร์ก่อนการเสนอขายหุ้น IPO ที่คาดการณ์ไว้ กล่าวถึงธุรกิจโฆษณาว่าเป็นกลไกการสร้างความหลากหลาย ควบคู่ไปกับรายได้จากองค์กร การสมัครสมาชิกผู้บริโภค และ API
เมื่อวันที่ 1 กันยายน OpenAI ยังประกาศด้วยว่าจะยุติการเข้าถึง API สำหรับ Cursor เครื่องมือโค้ด AI ที่ SpaceX เพิ่งเข้าซื้อกิจการ โดยกำหนดวันตัดสิทธิ์คือวันที่ 12 พฤศจิกายน 2026 — ซึ่งเป็นระยะเวลาแจ้งล่วงหน้าสูงสุดที่อนุญาตตามสัญญา OpenAI อ้างถึง “รูปแบบการละเมิดสัญญา” โดยบริษัทของ Elon Musk รวมถึงการที่ xAI ยอมรับว่ากลั่นข้อมูลจาก OpenAI โมเดลในอนาคต รวมถึง Astra ที่กำลังจะมา จะไม่ถูกเปิดให้ Cursor ใช้งาน Michael Truell ซีอีโอของ Cursor ตอบกลับว่าโมเดลของ OpenAI คิดเป็นเพียงประมาณ 5% ของปริมาณการใช้งานของผู้ใช้ Cursor และทีมกำลังหาทางแก้ไข
เมื่อวันที่ 31 สิงหาคม Zhipu AI ได้เปิดเผยแผนสำหรับโมเดลรุ่นต่อไป GLM 6.0 ในการประชุมผลประกอบการครึ่งปีแรก 2026 โดยโมเดลจะเป็นไปตามแนวทางโมเดลฐานขนาดใหญ่ Zhipu เน้นย้ำถึงเป้าหมายในการรองรับการเรียกใช้เชิงธุรกิจเต็มรูปแบบในวันเปิดตัว เพื่อหลีกเลี่ยงปัญหา “โมเดลใหญ่ ยากต่อการปรับใช้” Zhipu รายงานรายได้ครึ่งปีแรก 2026 ที่ 954 ล้านหยวน เพิ่มขึ้น 399.7% เมื่อเทียบกับช่วงเดียวกันของปีก่อน กำไรขั้นต้น 252 ล้านหยวน เพิ่มขึ้น 163.7% และขาดทุนสุทธิ 2.071 พันล้านหยวน ลดลง 12.1% โมเดล GLM-5.3 Flash ของบริษัทรันบนคลัสเตอร์ชิปภายในประเทศทั้งหมด — การ์ดเร่งความเร็วของจีนประมาณ 100,000 ใบ นอกจากนี้ โมเดล “Niu Lai” ของ Zhipu ยังก้าวขึ้นสู่อันดับสูงสุดในการจัดอันดับปริมาณการเรียกใช้โมเดล AI ของจีน แทนที่ DeepSeek-V4-Pro
เมื่อวันที่ 31 สิงหาคม Kuaishou เปิดเผยว่า Beijing Kling ได้รับเงินทุนสดรวม 1.4 หมื่นล้านหยวน จากกองทุนรวมการลงทุนอุตสาหกรรม AI แห่งชาติ (คำมั่นรวม 6.006 แสนล้านหยวน) และ Charoen Pokphand Robot Limited (ประมาณ 19.29 ล้านดอลลาร์) Kling เป็นบริษัทย่อยด้านการสร้างวิดีโอด้วย AI ของ Kuaishou
เมื่อวันที่ 1 กันยายน มีรายงานว่า Apple ได้เร่งกำหนดการเปิดตัว Mac mini และ Mac Studio รุ่นปี 2026 เป็นวันที่ 25 สิงหาคม (เริ่มจัดส่ง 22 กันยายน) — เร็วกว่ากำหนดการปกติในเดือนตุลาคม–พฤศจิกายนหลายเดือน — โดยได้รับแรงหนุนจากความต้องการด้าน AI ที่พุ่งสูงขึ้น ชิป M6 ใหม่เป็นหน่วยประมวลผล 2 นาโนเมตรตัวแรกของ Apple มีซีพียู 12 คอร์ จีพียู 12 คอร์ และตัวเร่งความเร็ว Neural ในทุกคอร์จีพียู Apple อ้างว่ามีประสิทธิภาพด้าน AI สูงสุด 4 เท่า และประสิทธิภาพด้านกราฟิกสูงสุด 2 เท่าเมื่อเทียบกับ M4 คลัสเตอร์ Mac Studio แบบ 4 ยูนิตมอบความเร็วในการอนุมานสูงสุด 3 เท่าของหน่วยเดียวผ่าน Thunderbolt 5 และ RDMA OpenAI ได้ซื้อ Mac mini และ Mac Studio หลายหมื่นเครื่องสำหรับการฝึกฝนเอเจนต์ที่ปฏิบัติการบนคอมพิวเตอร์ ส่วน Anthropic เช่าความจุ Mac mini ผ่าน AWS
เมื่อวันที่ 1 กันยายน CiYuan Spark ของ iFlytek ได้ประกาศการเปิดตัวโอเพนซอร์สของ Spark X2.5-4B และ X2.5-1.7B สองโมเดลบนอุปกรณ์ที่รองรับบริบทสูงสุด 1 ล้านโทเคนโดยเนทีฟ — เป็นโมเดลบนอุปกรณ์เพียงรุ่นเดียวในปัจจุบันที่มอบความจุนี้ โมเดลเหล่านี้ใช้สถาปัตยกรรมไฮบริดแอตเทนชัน ผ่านการฝึกฝนด้วยโทเคนประมาณ 20 ล้านล้านโทเคนบนแพลตฟอร์มประมวลผลภายในประเทศทั้งหมด และได้รับการปรับให้เหมาะสมสำหรับเอเจนต์ การเขียนโค้ด คณิตศาสตร์ และการทำตามคำสั่ง ในการทดสอบสมาร์ทโฮม โมเดล 1.7B ทำความแม่นยำคำสั่งแบบครบวงจรได้ 90.3% โดยมีเวลาตอบสนองเฉลี่ย 0.85 วินาที โมเดลเหล่านี้รองรับแพลตฟอร์มฮาร์ดแวร์ของ NVIDIA, Huawei, Hygon และ Houmo และเข้ากันได้กับ vLLM, SGLang และ llama.cpp iFlytek จะเปิดตัว Spark X2.5-293B ในวันที่ 7 กันยายน
เมื่อวันที่ 1 กันยายน DeepSeek-V4-Flash-Vision-Exp ได้เปิดเป็นโอเพนซอร์สบน Hugging Face โดยรองรับการป้อนภาพ การรู้จำข้อความ และการวิเคราะห์แผนภูมิ ด้วยความสามารถของมัลติโมดัลเอเจนต์ที่เข้าใกล้ Opus-4.8
เมื่อวันที่ 1 กันยายน Alibaba Cloud เปิดตัว Smart Studio แพลตฟอร์มที่อนุญาตให้ผู้ใช้อัปโหลดน้ำหนักโมเดลแบบกำหนดเองและปรับใช้เป็นเอนด์พอยต์ที่พร้อมใช้งานจริง พร้อมการเร่งการอนุมานสำหรับโมเดลโอเพนซอร์ส รวมถึง DeepSeek, GLM และ Qwen
เมื่อวันที่ 1 กันยายน ตัวอย่างการแสดงของ Hunyuan Hy4 ของ Tencent — ซึ่งได้รวมเข้ากับ WorkBuddy เมื่อวันที่ 28 สิงหาคม — ทำให้เกิดความต้องการการอนุมานที่เพิ่มสูงขึ้นจนทำให้เกิดการเข้าคิวในวันเปิดตัว Tencent กำลังเร่งขยายคลัสเตอร์การอนุมานอย่างเร่งด่วน โดยตัวอย่างการแสดงยังคงให้ใช้ฟรีจนถึงวันที่ 10 กันยายน
เมื่อวันที่ 31 สิงหาคม ByteDance ได้เปิดตัว Doubao Work Agent อย่างเป็นทางการ ซึ่งเป็นเอเจนต์ AI สำหรับองค์กรที่มีการบูรณาการกับ Feishu (Lark) โดยกำเนิด การซิงค์ข้ามอุปกรณ์ (ทั้งบนเครื่องและ VM บนคลาวด์ที่ออนไลน์ตลอด 24 ชั่วโมงทุกวัน) และการเข้าถึงโมเดลสร้างวิดีโอ Seedance และสร้างภาพ Seedream ในตัวของ ByteDance เอเจนต์สามารถแยกย่อยงาน ดำเนินการบนคอมพิวเตอร์ของผู้ใช้ และส่งผลลัพธ์โดยตรงไปยังเอกสาร Feishu ได้อย่างอัตโนมัติ
เมื่อวันที่ 31 สิงหาคม Grok Bot ได้เปิดตัวปลั๊กอิน Microsoft ที่ให้สิทธิ์อ่าน/เขียนโดยตรงไปยัง Outlook, Calendar และ OneDrive Grok Bot สำหรับ Linux ได้เพิ่มรูปแบบ AppImage และ RPM และ Grok Build v1.0.15 มาพร้อมกับการปรับความเร็วเซสชันให้เหมาะสม
เมื่อวันที่ 31 สิงหาคม WeChat Pay AI Card ของ Tencent ได้ขยายการรองรับไปยัง DeepSeek Harness และ OpenClaw ซึ่งเข้าร่วมกับการบูรณาการที่มีอยู่กับ WorkBuddy และ QClaw ขณะนี้ผู้ใช้สามารถเข้าถึง Pay Skills กว่า 700 รายการบน Skillhub ผ่านแพลตฟอร์มเหล่านี้
การศึกษาที่เผยแพร่เมื่อวันที่ 1 กันยายน แสดงให้เห็นว่าอันดับบนลีดเดอร์บอร์ดของ LLM นั้นขึ้นอยู่กับการตั้งค่าการประเมินผลอย่างมาก เมื่อกำหนดให้โมเดล 12 ตัวและคำถาม 3,679 ข้อคงที่ การเปลี่ยนแปลงเพียงแค่รูปแบบพรอมต์ การเรียงลำดับคำตอบ และวิธีการให้คะแนน ทำให้คะแนนของ Gemma4-31b ผันผวนระหว่าง 31% ถึง 89% โดยเฉลี่ยแล้ว 95.7% ของช่องว่างคะแนนระหว่างโมเดลที่จัดอันดับติดกัน เป็นผลมาจากการเปลี่ยนแปลงการตั้งค่าการประเมินผล มากกว่าความแตกต่างด้านความสามารถ
เมื่อวันที่ 30 สิงหาคม งานวิจัยเชิงประจักษ์ที่วิเคราะห์ 1,926 โพสซิทอรี 8,351 ปลั๊กอิน และ 2,018 ตลาดกลาง แสดงให้เห็นว่าระบบนิเวศปลั๊กอินของ Claude Code เติบโตขึ้น 8.8 เท่าในช่วงหกเดือน
เมื่อวันที่ 31 สิงหาคม Apple ได้ยื่น “หลักฐานที่น่าตกใจ” ในคดีความลับทางการค้าต่อวิศวกรอดีตพนักงาน Chang Liu และ OpenAI การวิเคราะห์ทางนิติวิทยาศาสตร์ของ MacBook ที่ Liu ส่งคืนให้พบว่า Liu ได้ใช้แบบวงจรลับของ Apple ในงานของเขาที่ OpenAI และบุคลากรของ OpenAI รับทราบถึงการเข้าถึงพื้นที่จัดเก็บข้อมูลคลาวด์บุคคลที่สามของ Apple โดยไม่ได้รับอนุญาตของเขา Liu ได้สั่งให้เพื่อนร่วมงานที่ OpenAI ทำลายหลักฐานเมื่อทราบข่าวการสอบสวนภายในของ Apple และเครื่องมือที่ Liu ใช้ที่ OpenAI มีชื่อเหมือนกับแอปพลิเคชันวิศวกรรมภายในของ Apple Apple ระบุว่า Liu ได้รันการจำลองโดยใช้แบบวงจรดังกล่าวใน LTspice และเอเจนต์ AI ของเขาได้ “เรียนรู้ที่จะรัน LTspice และตรวจสอบผลลัพธ์” — หมายความว่าความลับทางการค้านั้นอาจถูกป้อนเข้าสู่โมเดลที่สามารถเรียนรู้จากมันได้ Apple ระบุว่ามีอดีตพนักงาน Apple มากกว่า 400 คนที่ทำงานที่ OpenAI แล้ว