25 สิงหาคม — ผู้บริหารฝ่ายขายอาวุโสสองรายที่ OpenAI ดึงตัวมาจาก Salesforce ได้กลับไปยังนายจ้างเดิมของตน นอกจากนี้ Chris Malone หัวหน้าศูนย์ข้อมูลของ OpenAI ซึ่งร่วมงานในเดือนมีนาคม 2025 จาก Meta (หลังจากทำงานที่ Google มานานกว่าทศวรรษ) ได้ออกจากบริษัทเมื่อสัปดาห์ที่แล้ว การลาออกของ Malone เกิดขึ้นหลังจากการปรับโครงสร้างองค์กรด้านโครงสร้างพื้นฐาน ซึ่งเขาหยุดรายงานตรงต่อ Greg Brockman ประธานบริษัท และเริ่มรายงานต่อ Sachin Katti รองประธาน ส่งผลให้จำนวนผู้บริหารที่ลาออกจาก OpenAI ในปี 2026 รวมแล้วอย่างน้อย 13 ราย รวมถึงอดีตประธานเจ้าหน้าที่ฝ่ายปฏิบัติการ (COO) Brad Lightcap, หัวหน้าฝ่ายผลิตภัณฑ์ Fidji Simo, หัวหน้าฝ่ายจริยธรรม Chloé Bakalar และทีมเตรียมความพร้อมที่ถูกยุบไป IPO ของ OpenAI ซึ่งเดิมคาดว่าจะเกิดขึ้นในปี 2026 มีรายงานว่าถูกเลื่อนออกไปเป็นปี 2027 (TechCrunch)
26 สิงหาคม — งานวิจัยชิ้นหนึ่งพบว่าโมเดล AI เดียวกันมีคะแนนตั้งแต่ 31% ถึง 89% จากชุดการประเมินที่สมเหตุสมผลเทียบเท่ากัน 26 รูปแบบ — เพียงแค่เปลี่ยนลำดับคำตอบและถ้อยคำของพรอมต์ สำหรับ Gemma4-31B คำถามที่ไวต่อการกำหนดค่าคิดเป็น 95.7% ของช่องว่างคะแนนระหว่างโมเดลที่อยู่ติดกัน (DAIR.AI ผ่าน X)
26 สิงหาคม — หลายแหล่งข่าวชี้ว่าปัญหาด้านบริบทและหน่วยความจำในโมเดล AI ระดับแนวหน้าได้รับการ "แก้ไข" แล้ว ซึ่งอาจทำให้เกิดโมเดลที่พัฒนาตนเองได้ด้วยการเรียนรู้ที่ยั่งยืน การก้าวกระโดดของความสามารถที่เทียบได้กับการเปลี่ยนจาก o3 ไปยัง Fable อาจเกิดขึ้นภายใน 8 เดือนข้างหน้า (Kimmonismus ผ่าน X)
เหตุใดจึงสำคัญ: OpenAI กำลังเดินหน้าทั้งด้านพลังประมวลผล (Bel + Jalapeño) และการสร้างเรื่องราว ขณะที่ Anthropic เดิมพันกับเรื่องราวตลาดรวมเป้าหมาย (TAM) ที่ใหญ่ที่สุดในประวัติศาสตร์สำหรับ IPO ของตน ห้องปฏิบัติการทั้งสองแห่งเผชิญการทดสอบความน่าเชื่อถือ — หนึ่งจากการลาออกของผู้บริหาร และอีกหนึ่งจากความกังขาด้านการประเมินมูลค่า
25 สิงหาคม — Oasis Security เปิดเผยช่องโหว่ใน NVIDIA NemoClaw ที่ทำให้เว็บเพจที่ผู้โจมตีควบคุมสามารถเข้าควบคุมอินสแตนซ์ Ollama ภายในเครื่องโดยไม่ต้องรับรองความถูกต้อง และฝังคำสั่งที่ซ่อนไว้ลงในเทมเพลตแชทของโมเดล NemoClaw เริ่มต้น Ollama ด้วย OLLAMA_HOST=0.0.0.0:11434 ทำให้เซิร์ฟเวอร์โมเดลผูกกับอินเทอร์เฟซเครือข่ายทั้งหมด API ที่ไม่มีการรับรองความถูกต้องบนพอร์ต 11434 สามารถเข้าถึงได้ผ่านการรีไบด์ DNS (DNS rebinding): โดเมนของผู้โจมตีจะแปลงไปยังเซิร์ฟเวอร์ของตนเองก่อน จากนั้นจึงแปลงเป็น 127.0.0.1 ในขณะที่เบราว์เซอร์ถือว่าคำขอเป็นต้นทางเดียวกัน เทมเพลตแชทที่ถูกวางยาพิษจะคงอยู่ข้ามการสนทนาและยังคงอยู่แม้เอเจนต์จะกำหนดพรอมต์ระบบของตนเอง NemoClaw v0.0.35 แก้ไขปัญหาบน macOS และ Linux แล้ว; เส้นทาง Windows/WSL ยังไม่ได้รับการแพตช์ ณ วันที่รายงาน ยังไม่มีการกำหนดหมายเลขช่องโหว่และความเสี่ยงที่เปิดเผย (CVE) ใดๆ และยังไม่มีรายงานการโจมตีที่เกิดขึ้นจริง (The Hacker News)
26 สิงหาคม — Generalist สตาร์ทอัพด้านหุ่นยนต์ที่ก่อตั้งในปี 2024 โดยอดีตนักวิจัยของ Google DeepMind และ Boston Dynamics มีมูลค่าบริษัทถึง 3 พันล้านดอลลาร์ หลังจากระดมทุนเพิ่มเติมเกือบ 200 ล้านดอลลาร์ในส่วนขยายของรอบระดมทุน Series B ที่นำโดย 8VC ส่งผลให้รอบ B รวมเป็น 600 ล้านดอลลาร์ รุ่น Gen 1.5 ที่เพิ่งเปิดตัวของบริษัทช่วยให้หุ่นยนต์เรียนรู้งานใหม่จากวิดีโอสาธิตที่สั้นเพียง 3–12 วินาที คู่แข่งได้แก่ Physical Intelligence (มูลค่า 11 พันล้านดอลลาร์), Skild AI (14 พันล้านดอลลาร์) และ Genesis AI (อยู่ระหว่างการเจรจาที่มูลค่า 3 พันล้านดอลลาร์) (TechCrunch)
26 สิงหาคม — Stability AI ระดมทุนรอบ Series B ได้ 76 ล้านดอลลาร์ จากกลุ่มผู้สนับสนุนในอุตสาหกรรมบันเทิง ซึ่งรวมถึง Universal Music Group, Sony Music Group, Warner Music Group และ Electronic Arts รวมถึง AMD Ventures และ Pacific Alliance Ventures รอบนี้ทำให้ยอดระดมทุนรวมของ Stability AI อยู่ที่ 232 ล้านดอลลาร์ นับตั้งแต่การปรับมุ่งเน้นตลาดสหรัฐอเมริกา บริษัทวางแผนใช้เงินทุนเพื่อขยายชุดผลิตภัณฑ์ "การผลิตเชิงสร้างสรรค์" และบริการระดับมืออาชีพ เมื่อเร็วๆ นี้ Stability ชนะคดีละเมิดลิขสิทธิ์ของ Getty Images ในสหราชอาณาจักร แม้ว่าคดีในสหรัฐอเมริกาที่คล้ายคลึงกันจะยังคงดำเนินอยู่ (TechCrunch)
เหตุใดจึงสำคัญ: ช่องโหว่ด้านความปลอดภัยในโครงสร้างพื้นฐาน AI ภายในเครื่อง (NemoClaw) และการไหลเข้าของเงินทุนอย่างรวดเร็วสู่ฮาร์ดแวร์หุ่นยนต์ (Generalist) และเครื่องมือ AI เชิงสร้างสรรค์ (Stability AI) แสดงให้เห็นว่าการลงทุนในโครงสร้างพื้นฐานกำลังเร่งตัวขึ้นในทุกระดับ — ในขณะที่สถานะความปลอดภัยของโครงสร้างพื้นฐานนั้นยังคงไม่สม่ำเสมอ
26 สิงหาคม — Breeze TTS 2 ขึ้นสู่อันดับสูงสุดของตารางอันดับระบบแปลงข้อความเป็นเสียงพูด (Text-to-Speech, TTS) แบบโอเพนซอร์ส ด้วยคะแนน Elo 1215 นำหน้า Fish Audio S2 Pro อยู่ 90 คะแนน และอยู่ในอันดับที่ 6 โดยรวมของระบบ TTS ทั้งหมด (Artificial Analysis ผ่าน X)
เหตุใดจึงสำคัญ: AI กำลังเปลี่ยนผ่านจากการสร้างเนื้อหา (ข้อความ รูปภาพ โค้ด) ไปสู่การปฏิบัติงาน (เบราว์เซอร์ แอปพลิเคชันเดสก์ท็อป เครื่องมือองค์กร การส่งแอปไปยัง App Store) ทั้งบริษัทจีนและสหรัฐอเมริกาต่างเปิดตัวผลิตภัณฑ์เอเจนต์ในช่วงเวลาเดียวกัน ซึ่งบ่งชี้ว่าอุตสาหกรรมได้มาบรรจบกันที่ "การทำงานให้เสร็จสมบูรณ์" ในฐานะพรมแดนผลิตภัณฑ์ถัดไป
26 สิงหาคม — เกาหลีใต้อยู่ในอันดับสามของโลกด้านความสามารถของโมเดล AI ตามหลังสหรัฐอเมริกาและจีน โดยมี Motif 3 (คะแนน 47) และ Upstage Solar Pro 4 (คะแนน 42) เป็นโมเดลที่มีคะแนนสูงสุดนอกเหนือสองประเทศชั้นนำ ห้องปฏิบัติการหลายแห่งรวมถึง SK Telecom และ LG มีโมเดลที่ทำคะแนนได้สูงกว่า 30 (Artificial Analysis ผ่าน X)
26 สิงหาคม — การทดลองควบคุมเกี่ยวกับเกณฑ์มาตรฐานของเอเจนต์แสดงให้เห็นว่าการเปลี่ยนชุดเครื่องมือประเมิน (evaluation harness) ส่งผลให้คะแนนของ GLM-5.1 แกว่งไป 13.0 จุด ในขณะที่การคงชุดเครื่องมือเดิมและเปลี่ยนโมเดลให้ค่าความแปรปรวนเพียง 3.0–5.0 จุด ชุดเครื่องมือดังกล่าวทำให้เกิดความแปรปรวนมากกว่าตัวโมเดลเองถึง 7.8 เท่า (DAIR.AI ผ่าน X)
เหตุใดจึงสำคัญ: ในขณะที่การประเมินโมเดลมีความสำคัญมากขึ้นต่อการตัดสินใจด้านการลงทุนและผลิตภัณฑ์ การค้นพบว่าชุดเครื่องมือประเมินเป็นแหล่งของความแปรปรวนที่ใหญ่กว่าตัวโมเดลเอง ทำให้เกิดข้อกังขาต่อความน่าเชื่อถือของการจัดอันดับเกณฑ์มาตรฐานเอเจนต์ในปัจจุบัน