
8월 13일, OpenAI와 Cerebras는 Cerebras의 Wafer-Scale Engine으로 구동되며 GPT-5.6 Sol을 초당 최대 750개의 출력 토큰으로 실행하는 서비스 등급인 Ultrafast Mode를 출시했습니다. Cerebras는 Fast 모드에서 Fable 5보다 11배, Opus 4.8보다 5배 빠르며 품질 저하가 없다고 밝혔습니다. 박사급 전문가만 답할 수 있는 2,500문항 벤치마크인 Humanity's Last Exam에서 Ultrafast는 11시간 11분 만에 완료했고, Claude Fable 5는 78시간 27분이 필요했습니다. 경제적으로 가치 있는 지식 작업을 측정하는 벤치마크인 GDP-Val에서는 Ultrafast가 엔드투엔드 속도를 5.6배 향상시켰습니다. 이 서비스는 먼저 OpenAI API에서 일부 선정된 고객에게 제공됩니다.
8월 13일, 구글은 3.6 Flash 출시 3주 만에 코딩 및 에이전트 활용 사례를 겨냥한 Gemini 3.7 Flash를 출시했습니다. 12월 31일까지 이 모델은 3.6 Flash의 절반 가격으로 책정되며 — 입력 토큰 100만 개당 0.75달러, 출력 토큰 100만 개당 3.75달러입니다. 구글은 또한 이 모델을 160개 이상의 지역에서 AI Pro 및 Ultra 구독자를 위한 Gemini Spark에 포함시킵니다.
8월 14일, 딥시크는 8월 17일부터 적용되는 피크·비피크 API 요금제를 발표했으며, 비피크 시간대 요금은 피크 요금의 절반입니다. 일부 모델은 3배 이상의 가격 인상이 있습니다. 주력 모델인 deepseek-v4-pro는 피크 시간대에 100만 토큰당 가격이 크게 인상됩니다. 이는 저비용 제공업체로서의 딥시크의 기존 입장을 뒤집는 조치입니다.
8월 13일, 레노버는 2026 회계연도 1분기 실적을 발표했습니다. AI 관련 매출은 전년 동기 대비 60% 증가한 85억 달러로 전체 매출의 35%를 차지했습니다. 양위안칭 회장은 언론에 컴퓨팅 자원 배분이 초기 단계의 '80% 학습'에서 '80% 추론, 20% 학습' 목표로 전환되고 있으며, 현재 비율은 약 50/50이라고 밝혔습니다.
같은 날 이어진 일련의 발표들, 즉 초당 750토큰의 프런티어 모델, 절반 가격의 Flash 모델, 그리고 다른 업체들이 가격을 인하하는 가운데 가격을 올린 중국 제공업체는 경쟁이 '누가 가장 강한가'에서 '누가 가장 빠르고 저렴한가'로 이동했음을 보여줍니다.
8월 14일, 딥시크는 MIT 라이선스로 가중치를 공개한 1조 6천억 파라미터 모델로, OpenAI Responses API를 네이티브로 지원하고 Codex에 맞춰 특화된 V4-Pro 정식 버전을 출시했습니다. Harness 플러그인 생태계는 공개 테스트에 들어갔습니다.
같은 날, Zhipu의 GLM-5.3은 사이버 방어와 코딩을 위해 구축된 743B 기본 모델이 CyberGym에서 84.5점을 기록해 GPT-5.6 Sol을 넘어섰다고 알려졌습니다. 메이퇀은 1.6T 파라미터 MoE 모델로 1M 컨텍스트 윈도우를 갖추고 Terminal-Bench 2.1에서 70.8점을 기록한 LongCat-2.0을 출시했으며, 에이전트 기반 코딩에 초점을 맞췄습니다.
8월 14일, Grok 4.6은 실제 코딩 리더보드인 CursorBench에서 Claude Opus 5와 GPT-5.6 Sol을 제치고 1위를 차지했습니다. xAI는 또한 X 순위 알고리즘인 Phoenix의 가중치를 오픈소스로 공개했습니다. Phoenix는 Grok 기반 트랜스포머로, 합성 점수 가중치가 확산 의도와 진정성 있는 대화를 우대하며 '좋아요'는 가장 값싼 신호로 취급합니다.
8월 13일, 메타/옥스퍼드 연구에 따르면 멀티모달 사전학습에는 이미지 생성 데이터가 5%만 필요하며, 최적의 혼합 비율은 언어 70%, 이미지 이해 25%, 이미지 생성 5%로 이미지 생성 토큰을 5배 줄일 수 있습니다.
딥시크, 메이퇀, xAI의 개방형 가중치 추진과 코딩 및 사이버 방어를 위한 특화 벤치마크는 일반적인 역량 주장보다 좁고 측정 가능한 과제에서 경쟁하는 역량 특화 모델로의 전환을 보여줍니다.
8월 13일, 포춘은 앤트로픽이 2조 달러 가치 평가로 10월 기업공개(IPO)를 계획하고 있다고 보도했습니다. 이는 6월 12일 스페이스X의 1조 7,700억 달러 IPO를 넘어 사상 최대 규모가 될 것입니다. 앤트로픽의 연 환산 매출은 5월에 470억 달러를 넘었으며, 6월에 미국 증권거래위원회(SEC)에 비공개로 상장 신청서를 제출했습니다.
8월 14일, 닛케이는 텐센트가 AI 개발사 Manus의 메타 지분을 인수해 최대 주주가 될 것이라고 보도했습니다. 2025년 3월 Butterfly Effect가 출시한 Manus는 미국 투자 이후 본사를 싱가포르로 옮기고 중국 사업을 축소했습니다. 4월에는 중국의 외국인 투자 안보 심사가 메타-Manus 인수를 금지했으며, 8월 11일 Manus는 메타에서 분리되어 독립 운영을 회복한다고 발표했습니다.
8월 14일, 언론은 구글 딥마인드가 프런티어 모델 연구에서 비용 효율적인 Flash급 모델로 조직을 개편하고 있으며, 정리해고가 3분의 1 이상에 달할 수 있다고 보도했습니다. 데미스 허사비스는 8월 5일 CEO에서 물러나 회장 겸 알파벳 수석 과학자가 되었습니다. 이번 개편은 구글의 차기 주력 Gemini 모델 출시 지연과 개발 우선순위를 둘러싼 내부 갈등과 관련이 있습니다.
8월 14일, 로이터는 애플이 알리바바와 함께 중국 시장 특화 대규모 언어 모델(LLM)을 학습시켰으며, 이로써 기존의 타사 모델 의존을 끝냈다고 보도했습니다. Apple Intelligence는 7월 15일 규제 당국에 'Apple Intelligence' 온디바이스 생성형 AI 서비스를 신청한 이후 몇 달 내에 중국에서 출시될 것으로 예상됩니다.
8월 13일, 머스크는 스페이스X 직원들에게 SpaceXAI(구 xAI) 데이터 센터 전력 용량이 현재 멤피스와 사우스헤이븐에 걸친 1.4GW에서 2027년 말까지 약 7배인 10GW로 증가할 것이라고 말했습니다. 그는 10GW가 연간 3,000억 달러에서 5,000억 달러의 매출을 낼 수 있을 것으로 추정했습니다.
같은 날에는 2조 달러 규모의 신호 두 건과 중국 시장 관련 움직임 두 건이 나왔습니다. 앤트로픽의 IPO 가치 평가와 애플의 중국 모델 전략이 그것이며, 한편 텐센트는 Manus를 흡수했고 구글은 프런티어에서 후퇴했습니다.
8월 13일, 볼티모어에서 열린 USENIX 보안 심포지엄에서 버밍엄 대학교와 더럼 대학교의 연구진은 DDR4/DDR5 SPD 칩의 쓰기 방지 기능 누락 결함을 악용해 물리적 접근 없이 Windows 11 방어를 우회하는 공격인 'Download More RAM'을 공개했습니다. 이 결함은 소프트웨어가 메모리 구성 데이터를 다시 쓰게 하여 Windows가 RAM 용량을 2배로 잘못 보고하게 하고, 보호 영역을 읽거나 수정할 수 있는 메모리 별칭을 생성합니다. 이 공격은 안티바이러스를 비활성화하고, 잠긴 기업 시스템을 침해하며, 커널 안티치트를 우회할 수 있습니다. 마이크로소프트는 CVE-2026-23670을 할당하고 2026년 4월 보안 업데이트에 완화 조치를 추가했습니다. Secure Boot가 활성화된 시스템은 보호됩니다. Corsair, G.Skill, ADATA는 각각 최소 하나의 영향을 받는 소비자 제품군을 보유하고 있습니다.
8월 6일, ACM AI Leadership Summit에 채택된 논문에 따르면 상용 AI 탐지기는 AI 편집과 전체 초안을 안정적으로 구별하지 못합니다. 가벼운 '초록만 다듬기' 편집은 64–80% (Pangram/GPTZero) 확률로 AI로 표시된 반면, 수정되지 않은 2023–2025년 원본은 9–15% 확률로 표시되었습니다. 'Undetectable AI' 인간화 이후에는 AI로 분류된 재작성 중 4% 미만만이 계속 표시됩니다. 정직한 AI 편집이 휴머나이저를 이용한 회피보다 더 높은 제재 위험을 수반합니다.
또한 이번 주 한 기술 분석은 2026년 8월부터 시행되는 유럽연합(EU) AI법 제50조의 '인공적으로 생성된 것으로 탐지 가능해야 한다'는 요구 사항을 앞두고 텍스트 AI 워터마크는 항상 쉽게 제거될 수 있다고 주장했습니다. SynthID 방식의 토큰 샘플링은 약한 LLM을 통한 패러프레이징으로 제거될 수 있으며, Unicode 동형문자 워터마크는 문자를 교체하여 제거할 수 있습니다. 이 분석은 Claude Code가 이전에 특정 요청을 태깅하기 위해 동형문자 스테가노그래피를 사용했다고 언급합니다.
8월 13일, OpenAI는 ChatGPT Mac 앱을 위한 Computer History를 출시했습니다. 이 기능은 Chronicle의 스크린샷 기반 미리보기를 macOS 접근성 이벤트 로깅(클릭, 타이핑, 단축키, 앱 전환)으로 대체합니다. 이벤트는 로컬에 최대 48시간 저장되며, 서버 측 메모리 생성 후 삭제됩니다. 개인정보 보호 모드 활동은 제외됩니다. 이 기능은 유럽경제지역(EEA), 스위스, 영국을 제외한 Pro, Business, Enterprise 사용자에게 제공됩니다.
8월 14일, ChatGPT는 탭을 전환하지 않고 구글 문서, 스프레드시트, 슬라이드를 직접 편집할 수 있는 기능을 추가했으며, Plus, Pro, Business, Enterprise 사용자에게 배포되고 있습니다.
하드웨어 수준 공격, 한계를 드러내는 탐지기, 그리고 쉽게 제거 가능한 워터마크는 공통된 전제를 공유합니다. AI 콘텐츠를 검증하고 시스템을 보호하기 위한 인프라가 모델 자체보다 뒤처지고 있다는 것입니다.