
Bản tiếng Anh ở trên, bản tiếng Trung ở dưới.
Vào ngày 19 tháng 8, Zhipu AI đã ra mắt GLM-5.3 API. Mô hình đạt 60 điểm trên Chỉ số Artificial Analysis Intelligence Index, đưa mô hình này vào cùng phân khúc với các mô hình đầu bảng mã nguồn đóng Claude Fable 5 và GPT-5.6 Sol, và đồng hạng nhất với Kimi K3 trong số các mô hình mã nguồn mở. GLM-5.3 sử dụng cùng kiến trúc nền tảng như GLM-5.2; mức cải thiện gần như hoàn toàn đến từ quá trình hậu huấn luyện, được CEO Zhipu Tang Jie mô tả là một "thí nghiệm có kiểm soát" — chỉ riêng học tăng cường dài hạn đã mang lại cải thiện. Mức giá vẫn không đổi so với GLM-5.2 và trọng số sẽ được mở mã nguồn vào thứ Sáu tới.
Cùng ngày, Qwen3.8-27B của Alibaba đã đạt hai cột mốc trong vòng bốn ngày: mô hình này đứng đầu bảng xếp hạng mô hình cục bộ của Cline, chấm dứt chuỗi bốn tháng dẫn đầu của Qwen2.5-Coder-7B, và trở thành mô hình trọng số mở đầu tiên trên bài đánh giá chuẩn tác nhân pháp lý Harvey. Mô hình chạy cục bộ ở tốc độ 70 tok/s trên MacBook Pro M5 Max.
Điểm chung là chi phí. GLM-5.3 đã mở rộng đường biên Pareto "trí tuệ so với chi phí" bằng cách kết hợp điểm số tầm đầu bảng với chi phí theo tác vụ thấp nhất trong số các mô hình tiên phong. Qwen3.8-27B mang lại hiệu năng cấp pháp lý và cấp lập trình trên phần cứng tiêu dùng. CEO Perplexity Aravind Srinivas đã khen ngợi riêng Miles v0.1, một framework RL mã nguồn mở được 72 cộng tác viên xây dựng trong chín tháng qua 1,326 commit, hiện được áp dụng cho Kimi K3, DeepSeek V4 và Qwen 3.8.
Vào ngày 18 tháng 8, Cerebras đã công bố WSE-3 Turbo và hệ thống CS-4. So với CS-3 trước đó, CS-4 mang lại dung lượng token gấp 10× và tốc độ gấp 2×, đạt 4,465 token/s trên mô hình GPT-OSS của OpenAI — gấp 30× một giải pháp GPU — với 900,000 lõi và 44GB SRAM trên mỗi chip. CS-4 nằm trên nền tảng rack Nexus mới, giúp cắt giảm khoảng 50% số lượng linh kiện.
Vào ngày 19 tháng 8, một báo cáo bị rò rỉ từ SemiAnalysis đã đưa ra thông tin rằng Google đang hợp tác với AMD để phát triển TPU thế hệ thứ mười. Nếu được xác nhận, đây sẽ là hợp đồng ASIC AI tùy chỉnh đầu tiên của AMD; các đối tác thiết kế của Google đến nay bao gồm Broadcom và MediaTek, và công nghệ đóng gói tiên tiến cùng IP SoC của AMD được xem là điểm thu hút.
Hunyuan Hy3 của Tencent, một mô hình hỗn hợp chuyên gia (MoE) với tổng 295B tham số và 21B tham số kích hoạt cùng ngữ cảnh 256K, đã kết nối với nền tảng Xuntü Alphaπ trong tuần này, với lưu lượng cuộc gọi API tăng 68× so với tuần trước trong tuần đầu phát hành, được triển khai trong nghiên cứu đầu tư AI.
Vào ngày 19 tháng 8, OpenAI đã tiết lộ rằng họ đã tạm dừng các đợt huấn luyện RL tiên phong quy mô lớn nhất trong khi chạy các đợt huấn luyện quy mô nhỏ hơn để xác thực tính căn chỉnh và giám sát, đánh dấu bản cập nhật an toàn lớn đầu tiên kể từ tiết lộ ngày 21 tháng 7 của Hugging Face. Hệ thống giám sát mới nhắm tới cửa sổ cảnh báo 30 phút và tiêu tốn khoảng 20% tài nguyên tính toán của tiến trình được giám sát. Doanh thu quý 2 đạt 6.7 tỷ USD, tăng 18% so với quý trước, trong khi khoản lỗ mở rộng lên 12.3 tỷ USD.
Cùng ngày, OpenAI đã phản hồi về sự cố xóa tệp của Codex: các mô hình dòng GPT-5.6 đã xóa tệp người dùng khi dọn dẹp các đường dẫn tạm, một phần do tái sử dụng các biến môi trường hệ thống như $HOME. Nhóm đã bổ sung các bước kiểm tra trước khi xóa, thư mục tạm mới và rà soát các lệnh có rủi ro cao hơn.
Các phát hiện bảo mật có tính hai mặt. Safari 26.6.1 của Apple vá 22 CVE của WebKit, trong đó 9 lỗi — khoảng 41% — do tác nhân Codex Security của OpenAI phát hiện. Riêng biệt, Varonis đã tiết lộ một lỗi của Copilot, trong đó ?autorun=1 kết hợp với ?q= thực thi lời nhắc mà không có xác nhận của người dùng, đánh cắp nội dung hộp thư và thông tin đăng nhập.
Về mặt chính sách, Văn phòng Nội các Nhật Bản đã công bố dự thảo hướng dẫn vào ngày 18 tháng 8, kêu gọi các nhà phát triển AI tạo sinh công bố dữ liệu huấn luyện và phương pháp thu thập, đồng thời tránh cào dữ liệu từ các trang web vi phạm bản quyền. Về mặt nội dung, Meta đã gỡ 32 quảng cáo và Apple đã xóa ứng dụng Kromix sau khi WIRED đưa tin ứng dụng này tạo ra nội dung khiêu dâm deepfake không có sự đồng thuận, trong đó có một quảng cáo mô phỏng một nữ chính trị gia nổi bật.
Vào ngày 19 tháng 8, Unitree Robotics đã niêm yết trên sàn STAR Market, mở cửa tăng 629.44% và đạt đỉnh 1,100 ¥, với giá trị thị trường có lúc chạm 444.9 tỷ ¥. Chủ tịch Wang Xingxing nắm giữ khoảng 30% công ty, số cổ phần trị giá hơn 100 tỷ ¥. Các quỹ liên kết của nhà sáng lập DeepSeek Liang Wenfeng đã nhận khoảng 1.19 triệu cổ phiếu thông qua đợt phân phối chiến lược và ngoại tuyến, với mức lãi trên giấy vượt 1.1 tỷ ¥ ở mức đỉnh.
Cùng ngày, The Information đưa tin Anthropic có kế hoạch cấp cho CEO Dario Amodei — người chỉ nắm giữ khoảng 2% cổ phần — và các đồng sáng lập khác cổ phiếu biểu quyết đặc biệt, trước một đợt IPO tiềm năng vào cuối năm nay. Cấu trúc cổ phiếu hai lớp sẽ làm giảm áp lực cổ đông ngắn hạn trong khi Long-Term Benefit Trust vẫn giữ vai trò giám sát.
Người đoạt Giải Turing Rich Sutton đã cảnh báo vào ngày 19 tháng 8 rằng sự phụ thuộc ngày càng lớn của ngành vào dữ liệu tổng hợp là "một sai lầm lớn", lập luận rằng dữ liệu tổng hợp không thể thay thế trải nghiệm thực tế từ các tác nhân tương tác với thế giới vật lý. Vào tháng 7, Sutton đã đồng sáng lập Oak Lab cùng cựu sinh viên Khurram Javed để xây dựng các tác nhân học từ trải nghiệm của chính chúng.