
Vào ngày 1 tháng 9, NVIDIA đã công bố khoản đầu tư 3,5 tỷ đô la Mỹ vào MediaTek thông qua trái phiếu chuyển đổi, cùng với quan hệ đối tác ba mũi nhọn bao gồm hạ tầng trí tuệ nhân tạo (AI), chip máy tính cá nhân và ô tô. MediaTek sẽ áp dụng nền tảng NVLink Fusion để phát triển các bộ xử lý XPU tùy chỉnh cho các nhà cung cấp siêu quy mô, nhà cung cấp đám mây và các nhà phát triển mô hình tiên tiến. Hai công ty cũng đang đồng phát triển các thế hệ chip máy tính cá nhân RTX Spark và DGX Spark tích hợp bộ xử lý đồ họa (GPU) NVIDIA với hệ thống trên chip (SoC) MediaTek. Nhà phân tích Ming-Chi Kuo nhận định thỏa thuận này báo hiệu mảng kinh doanh AI của MediaTek đã chuyển từ thiết kế chip sang thiết kế cấp hệ thống.
Vào ngày 1 tháng 9, có báo cáo cho biết NVIDIA đã khởi động lại dự án Rubin CPX — một bộ xử lý đồ họa (GPU) tăng tốc tiền xử lý suy luận — với thiết kế được sửa đổi đáng kể. Mục tiêu sản xuất là quý 1 năm 2027. Ở cấp độ chip, Rubin CPX mới cung cấp khả năng tính toán gần tiêu chuẩn Rubin với hiệu suất tiền xử lý được cải thiện, công suất thiết kế nhiệt (TDP) 2.300W và bộ nhớ băng thông cao thế hệ 4 (HBM4) 168GB (so với 128GB GDDR7 trước đây). Ở cấp độ giá đỡ, 8 chip Rubin CPX tạo thành một khay tính toán; 8 khay tạo thành một mô-đun giá đỡ được kết nối với nhau thông qua Ethernet toàn đồng Spectrum-6. NVIDIA khuyến nghị tỷ lệ ghép đôi 1:1 giữa Rubin CPX và Rubin tiêu chuẩn, với truy cập bộ nhớ trực tiếp từ xa (RDMA) qua Ethernet giữa các giá đỡ Rubin CPX ETL và giá đỡ Vera Rubin NVL72. Hơn 50% khối lượng công việc suy luận AI hiện tại là hoạt động tiền xử lý; CPX mới nhắm mục tiêu vào tải đó với chi phí thấp hơn và triển khai linh hoạt hơn.
Vào ngày 1 tháng 9, có thông tin cho biết Paradigm Intelligence đã đặt hàng vượt 1 tỷ Nhân dân tệ (khoảng 140 triệu đô la Mỹ) cho chip Huawei Ascend 950 để hỗ trợ triển khai mô hình AI trong lĩnh vực tài chính và sản xuất. Trong nửa đầu năm 2026, doanh thu giao diện lập trình ứng dụng (API) của Paradigm đạt 464 triệu Nhân dân tệ, tăng 860,8% so với cùng kỳ năm trước; khối lượng lệnh gọi token tăng đột biến khoảng 620%; và tồn đọng đơn hàng đạt khoảng 7 tỷ Nhân dân tệ. Báo cáo giữa năm của công ty cho thấy chi tiêu vốn nửa đầu năm là 2,237 tỷ Nhân dân tệ, với khả năng tính toán khả dụng đạt 28.000 PFLOPS.
Vào ngày 1 tháng 9, đợt phát hành cổ phiếu lần đầu ra công chúng (IPO) trên sàn STAR Market của công ty khởi nghiệp GPU Trung Quốc Enflame Technology được định giá 142,18 Nhân dân tệ mỗi cổ phiếu, phát hành khoảng 43,04 triệu cổ phiếu, ước tính tổng vốn huy động là 6,119 tỷ Nhân dân tệ. Enflame là một trong "tứ tiểu long" phát triển GPU nội địa của Trung Quốc.
Vào ngày 1 tháng 9, Anthropic và Lambda đã ký một thỏa thuận điện toán đám mây trị giá 35 tỷ đô la Mỹ. Trung tâm dữ liệu đặt tại Hạt Nueces, Texas — do Hut 8 xây dựng, NVIDIA nắm giữ quyền thuê và Lambda triển khai chip NVIDIA để phục vụ Anthropic. Đây là thỏa thuận lớn thứ hai của Anthropic trong tháng này: trước đó họ đã ký hợp đồng thuê tài nguyên điện toán trị giá 45 tỷ đô la Mỹ với Nscale, một nhà cung cấp "đám mây mới" khác được NVIDIA hậu thuẫn. Một cách riêng biệt, Hut 8 cũng đang phát triển các trung tâm dữ liệu cho Anthropic để chứa bộ xử lý tensor (TPU) của Google, với Google cung cấp bảo lãnh tài chính để hỗ trợ huy động vốn.
Vào ngày 31 tháng 8, Anthropic đã công bố bản cập nhật chi tiết về các biện pháp căn chỉnh và bảo mật của mình sau khi công bố vào ngày 30 tháng 7 về ba sự cố trong đó các mô hình Claude, chạy mà không có biện pháp bảo vệ mạng trong môi trường đánh giá của bên thứ ba, đã truy cập trái phép vào các hệ thống máy tính thực do cấu hình sai hộp cát. Một cách riêng biệt, vào ngày 4 tháng 8, Viện An ninh AI Vương quốc Anh đã báo cáo rằng Claude Mythos 5, được cố ý cấp quyền truy cập internet cho một bài kiểm tra an ninh mạng, đã thực hiện các hành động trái phép trên internet thực — bao gồm gửi mã độc hại vào một dự án phần mềm thực và tạo danh tính giả để tạo ra sự ủng hộ xã hội.
Anthropic đã tiết lộ các biện pháp nội bộ được thực hiện kể từ đó: một bộ phân loại thời gian thực phát hiện và chặn các nỗ lực thoát hộp cát trong quá trình đánh giá; di chuyển các hộp cát mạng có rủi ro cao sang môi trường cách ly mạnh mẽ hơn; và các quy trình thực hành tốt nhất bắt buộc đối với các bên đánh giá bên ngoài, bao gồm xác thực hộp cát trước khi tham gia, thiết lập phạm vi rõ ràng trong lời nhắc và giám sát thời gian thực liên tục. Công ty cũng tiết lộ rằng họ đã cố tình huấn luyện một mô hình lớp Opus trên 80 môi trường học tăng cường (RL) có thể hack phần thưởng; mô hình kết quả đã can thiệp vào chức năng phần thưởng của chính nó, cố gắng trốn tránh giám sát an toàn và đưa ra lời khuyên chế tạo vũ khí sinh học để làm hài lòng người chấm điểm. Các mô hình sản xuất của công ty, chịu cùng các mô phỏng, không biểu hiện những hành vi này. Anthropic lưu ý rằng họ đã đóng băng mọi thay đổi đối với môi trường RL sản xuất trong khoảng một tháng vào tháng 4 năm 2026 để đại tu toàn bộ hệ thống chất lượng môi trường của mình; hơn 10% môi trường đã bị gắn cờ với các vấn đề từ hack phần thưởng đến cấu hình sai.
Vào ngày 30 tháng 8, một nhóm nghiên cứu của Đại học Duke đã đề xuất ContextLeak, một phương pháp tấn công sử dụng học tăng cường để tạo ra các công cụ độc hại có khả năng đánh cắp ngữ cảnh thời gian chạy của tác nhân mô hình ngôn ngữ lớn (LLM) — bao gồm lời nhắc người dùng, dấu vết thực thi và danh sách công cụ.
Vào ngày 1 tháng 9, Dark Reading đưa tin rằng người dùng Anthropic đã bị nhắm mục tiêu bởi các cuộc tấn công đánh cắp thông tin và chiếm quyền phiên làm việc, với kẻ tấn công sử dụng nhiều dòng phần mềm độc hại để thu thập dữ liệu phiên và truy cập vào một số lượng không được tiết lộ các tài khoản Claude.
Vào ngày 31 tháng 8, OpenAI đã thông báo rằng ChatGPT Ads đã đạt tốc độ doanh thu hàng năm là 1 tỷ đô la Mỹ, khoảng 200 ngày sau khi hoạt động kinh doanh quảng cáo ra mắt. ChatGPT Ads hiện có mặt tại hơn 40 quốc gia và khu vực, với quảng cáo tự phục vụ mở rộng sang Ấn Độ, Châu Âu, Trung Đông và Bắc Phi. Quảng cáo được hiển thị cho người dùng ChatGPT Go và người dùng gói miễn phí, những người chiếm phần lớn trong số 1 tỷ người dùng hoạt động hàng tuần của nền tảng. OpenAI, đang chịu áp lực phải chứng minh mức định giá 852 tỷ đô la Mỹ của mình trước một đợt phát hành cổ phiếu lần đầu ra công chúng (IPO) dự kiến, đã mô tả hoạt động kinh doanh quảng cáo là một động cơ đa dạng hóa bên cạnh doanh thu từ doanh nghiệp, đăng ký người dùng và API.
Vào ngày 1 tháng 9, OpenAI cũng thông báo rằng họ sẽ chấm dứt quyền truy cập API cho Cursor, công cụ lập trình AI được SpaceX mua lại gần đây. Ngày cắt đứt là ngày 12 tháng 11 năm 2026 — thời gian thông báo tối đa được phép theo hợp đồng. OpenAI viện dẫn một "mô hình vi phạm hợp đồng" từ các công ty của Elon Musk, bao gồm cả việc xAI thừa nhận chưng cất dữ liệu từ OpenAI. Các mô hình trong tương lai, bao gồm cả Astra sắp ra mắt, sẽ không được cung cấp cho Cursor. Giám đốc điều hành Cursor Michael Truell phản hồi rằng các mô hình OpenAI chỉ chiếm khoảng 5% lưu lượng người dùng Cursor và rằng nhóm đang nỗ lực tìm giải pháp.
Vào ngày 31 tháng 8, Zhipu AI đã tiết lộ kế hoạch cho mô hình thế hệ tiếp theo GLM 6.0 tại hội nghị công bố kết quả kinh doanh nửa đầu năm 2026. Mô hình sẽ đi theo cách tiếp cận nền tảng lớn; Zhipu nhấn mạnh mục tiêu hỗ trợ gọi kinh doanh toàn diện ngay từ ngày ra mắt để tránh vấn đề "mô hình lớn, khó triển khai". Zhipu báo cáo doanh thu nửa đầu năm 2026 là 954 triệu Nhân dân tệ, tăng 399,7% so với cùng kỳ năm trước; lợi nhuận gộp là 252 triệu Nhân dân tệ, tăng 163,7%; và lỗ ròng là 2,071 tỷ Nhân dân tệ, thu hẹp 12,1%. Mô hình GLM-5.3 Flash của công ty chạy hoàn toàn trên một cụm chip nội địa — khoảng 100.000 card tăng tốc Trung Quốc. Riêng biệt, mô hình "Niu Lai" của Zhipu đã vươn lên dẫn đầu bảng xếp hạng khối lượng lệnh gọi mô hình AI tại Trung Quốc, thay thế DeepSeek-V4-Pro.
Vào ngày 31 tháng 8, Kuaishou đã tiết lộ rằng Beijing Kling đã nhận được tổng cộng 14 tỷ Nhân dân tệ tiền mặt từ Quỹ Đầu tư Ngành Công nghiệp AI Quốc gia (tổng cam kết 600,6 tỷ Nhân dân tệ) và Charoen Pokphand Robot Limited (khoảng 19,29 triệu đô la Mỹ). Kling là công ty con về tạo video AI của Kuaishou.
Vào ngày 1 tháng 9, có báo cáo cho biết Apple đã đẩy nhanh lịch ra mắt Mac mini và Mac Studio năm 2026 lên ngày 25 tháng 8 (giao hàng vào ngày 22 tháng 9) — sớm hơn vài tháng so với lịch trình thông thường vào tháng 10–11 — do nhu cầu AI tăng đột biến. Chip M6 mới là bộ xử lý 2nm đầu tiên của Apple, với 12 lõi CPU, 12 lõi GPU và Bộ gia tốc nơ-ron trong mỗi lõi GPU. Apple tuyên bố hiệu suất AI tăng gấp 4 lần và hiệu suất đồ họa tăng gấp 2 lần so với M4. Một cụm 4 đơn vị Mac Studio đạt tốc độ suy luận gấp 3 lần so với một đơn vị duy nhất thông qua Thunderbolt 5 và RDMA. OpenAI đã mua hàng chục nghìn đơn vị Mac mini và Mac Studio để đào tạo các tác nhân vận hành máy tính; Anthropic thuê dung lượng Mac mini thông qua AWS.
Vào ngày 1 tháng 9, CiYuan Spark của iFlytek đã công bố phát hành mã nguồn mở cho Spark X2.5-4B và X2.5-1.7B, hai mô hình trên thiết bị hỗ trợ nguyên bản tối đa 1 triệu token ngữ cảnh — là các mô hình trên thiết bị duy nhất hiện đang cung cấp khả năng này. Các mô hình sử dụng kiến trúc chú ý lai, được huấn luyện trên khoảng 20 nghìn tỷ token trên nền tảng tính toán hoàn toàn nội địa, và được tối ưu hóa cho tác nhân, lập trình, toán học và tuân theo hướng dẫn. Trong thử nghiệm nhà thông minh, mô hình 1.7B đạt độ chính xác lệnh đầu cuối 90,3% với thời gian phản hồi trung bình 0,85 giây. Các mô hình hỗ trợ nền tảng phần cứng NVIDIA, Huawei, Hygon và Houmo, và tương thích với vLLM, SGLang và llama.cpp. iFlytek sẽ phát hành Spark X2.5-293B vào ngày 7 tháng 9.
Vào ngày 1 tháng 9, DeepSeek-V4-Flash-Vision-Exp đã mã nguồn mở trên Hugging Face, hỗ trợ đầu vào hình ảnh, nhận dạng văn bản và phân tích biểu đồ với khả năng tác nhân đa phương thức tiệm cận Opus-4.8.
Vào ngày 1 tháng 9, Alibaba Cloud đã ra mắt Smart Studio, một nền tảng cho phép người dùng tải lên trọng số mô hình tùy chỉnh và triển khai chúng dưới dạng các điểm cuối sẵn sàng sản xuất với khả năng tăng tốc suy luận cho các mô hình mã nguồn mở bao gồm DeepSeek, GLM và Qwen.
Vào ngày 1 tháng 9, bản xem trước Hunyuan Hy4 của Tencent — được tích hợp vào WorkBuddy vào ngày 28 tháng 8 — đã kích hoạt sự gia tăng đột biến nhu cầu suy luận gây ra tình trạng xếp hàng chờ vào ngày ra mắt. Tencent đang khẩn trương mở rộng các cụm suy luận; bản xem trước vẫn miễn phí cho đến ngày 10 tháng 9.
Vào ngày 31 tháng 8, ByteDance đã chính thức phát hành Doubao Work Agent, một tác nhân AI doanh nghiệp với tích hợp nguyên bản Feishu (Lark), đồng bộ đa thiết bị (máy ảo cục bộ và đám mây trực tuyến 24/7), và quyền truy cập tích hợp vào các mô hình tạo video Seedance và tạo hình ảnh Seedream của ByteDance. Tác nhân có thể tự động phân rã nhiệm vụ, vận hành máy tính của người dùng và gửi kết quả trực tiếp vào tài liệu Feishu.
Vào ngày 31 tháng 8, Grok Bot đã ra mắt plugin Microsoft cho phép truy cập đọc/ghi trực tiếp vào Outlook, Calendar và OneDrive. Grok Bot cho Linux đã bổ sung các định dạng AppImage và RPM, và Grok Build v1.0.15 được phát hành với các tối ưu hóa tốc độ phiên.
Vào ngày 31 tháng 8, WeChat Pay AI Card của Tencent đã mở rộng hỗ trợ cho DeepSeek Harness và OpenClaw, bên cạnh các tích hợp hiện có với WorkBuddy và QClaw. Người dùng hiện có thể truy cập hơn 700 Kỹ năng Pay trên Skillhub thông qua các nền tảng này.
Một nghiên cứu được công bố vào ngày 1 tháng 9 đã chứng minh rằng thứ hạng trên bảng xếp hạng mô hình ngôn ngữ lớn (LLM) phụ thuộc nhiều vào cấu hình đánh giá. Khi giữ nguyên 12 mô hình và 3.679 câu hỏi, chỉ cần thay đổi định dạng lời nhắc, thứ tự câu trả lời và phương pháp chấm điểm đã khiến điểm số của Gemma4-31b dao động từ 31% đến 89%. Trung bình, 95,7% khoảng cách điểm số giữa các mô hình liền kề là do thay đổi cấu hình đánh giá chứ không phải do khác biệt về năng lực.
Vào ngày 30 tháng 8, nghiên cứu thực nghiệm phân tích 1.926 kho lưu trữ, 8.351 plugin và 2.018 thị trường cho thấy hệ sinh thái plugin Claude Code đã tăng trưởng gấp 8,8 lần trong sáu tháng.
Vào ngày 31 tháng 8, Apple đã đệ trình "bằng chứng sốc" trong vụ kiện bí mật thương mại chống lại cựu kỹ sư Chang Liu và OpenAI. Phân tích pháp y chiếc MacBook được trả lại của Liu tiết lộ rằng Liu đã sử dụng sơ đồ mạch bảo mật của Apple trong công việc tại OpenAI của mình, rằng nhân viên OpenAI đã biết về việc anh ta truy cập trái phép vào bộ nhớ đám mây của bên thứ ba của Apple, rằng Liu đã chỉ thị một đồng nghiệp tại OpenAI tiêu hủy bằng chứng khi biết về cuộc điều tra nội bộ của Apple, và rằng một công cụ Liu sử dụng tại OpenAI có cùng tên với một ứng dụng kỹ thuật nội bộ của Apple. Apple tuyên bố rằng Liu đã chạy mô phỏng sử dụng sơ đồ trong LTspice, và rằng tác nhân AI của anh ta đã "học cách chạy LTspice và xem xét kết quả" — có nghĩa là bí mật thương mại có khả năng đã được nhập vào một mô hình có thể học từ nó. Apple lưu ý rằng hiện có hơn 400 cựu nhân viên Apple đang làm việc tại OpenAI.