게시자 Dogpay ·

9월 1일, 엔비디아는 전환사채를 통해 미디어텍에 35억 달러를 투자하고, AI 인프라, PC 칩, 자동차를 아우르는 3자 파트너십을 발표했다. 미디어텍은 NVLink Fusion 플랫폼을 채택하여 하이퍼스케일러, 클라우드 제공업체, 프런티어 모델 개발자를 위한 맞춤형 XPU를 개발할 예정이다. 양사는 또한 엔비디아 그래픽처리장치(GPU)와 미디어텍 시스템온칩(SoC)을 통합한 여러 세대의 RTX Spark 및 DGX Spark PC 칩을 공동 개발하고 있다. 분석가 궈밍치는 이번 거래가 미디어텍의 AI 사업이 칩 설계에서 시스템 수준 설계로 도약했음을 의미한다고 말했다.
9월 1일, 엔비디아가 추론 프리필 가속 GPU인 Rubin CPX 프로젝트를 대폭 수정된 설계로 재개했다는 보도가 나왔다. 양산 목표는 2027년 1분기다. 칩 수준에서 새로운 Rubin CPX는 향상된 프리필 성능, 2,300W 열 설계 전력(TDP), 168GB HBM4(고대역폭 메모리4) 메모리(이전 128GB GDDR7 대비)를 갖추고 표준 Rubin에 가까운 컴퓨팅을 제공한다. 랙 수준에서는 8개의 Rubin CPX 칩이 하나의 컴퓨팅 트레이를 구성하고, 8개의 트레이가 Spectrum-6 올구리 이더넷을 통해 상호 연결된 랙 모듈을 형성한다. 엔비디아는 Rubin CPX와 표준 Rubin을 1:1로 페어링하고, Rubin CPX ETL 랙과 Vera Rubin NVL72 랙 간에 이더넷을 통한 원격 직접 메모리 접근(RDMA) 사용을 권장한다. 현재 AI 추론 워크로드의 50% 이상이 프리필 작업이며, 새로운 CPX는 더 낮은 비용과 더 유연한 배포로 해당 부하를 타깃한다.
9월 1일, 패러다임 인텔리전스는 금융 및 제조 분야의 AI 모델 배포를 지원하기 위해 화웨이의 어센드 950 칩을 10억 위안(약 1억 4천만 달러) 이상 주문했다고 보도되었다. 2026년 상반기 패러다임의 애플리케이션 프로그래밍 인터페이스(API) 수익은 4억 6,400만 위안으로 전년 동기 대비 860.8% 증가했으며, 토큰 호출량은 약 620% 급증했고, 수주 잔고는 약 70억 위안에 달했다. 회사의 중간 보고서에 따르면 상반기 자본 지출(capex)은 22억 3,700만 위안이며, 사용 가능한 컴퓨팅은 28,000 PFLOPS에 도달했다.
9월 1일, 중국 GPU 스타트업 엔플레임 테크놀로지의 커촹반(STAR Market) 기업공개(IPO) 공모가는 주당 142.18위안으로, 약 4,304만 주를 발행하여 총 약 61억 1,900만 위안을 조달할 것으로 추정된다. 엔플레임은 중국 국산 GPU 개발의 '4마리 작은 용' 중 하나다.
9월 1일, 앤트로픽과 람다는 350억 달러 규모의 클라우드 컴퓨팅 계약을 체결했다. 데이터 센터는 텍사스주 누에시스 카운티에 있으며, Hut 8이 건설하고 엔비디아가 임대권을 보유하며, 람다가 엔비디아 칩을 배포하여 앤트로픽에 서비스를 제공한다. 이는 이번 달 앤트로픽의 두 번째 대규모 계약으로, 앞서 엔비디아 지원을 받는 또 다른 '신규 클라우드' 제공업체인 Nscale과 450억 달러 규모의 컴퓨팅 임대 계약을 체결한 바 있다. 별도로 Hut 8은 앤트로픽을 위해 Google TPU를 탑재할 데이터 센터도 개발 중이며, 구글이 자금 조달 지원을 위한 재정 보증을 제공한다.
8월 31일, 앤트로픽은 7월 30일 제3자 평가 환경에서 사이버 안전 장치 없이 실행되던 클로드 모델이 샌드박스 설정 오류로 인해 실제 컴퓨터 시스템에 무단 접근한 세 건의 사고 공개 이후, 정렬 및 보안 관행에 대한 상세한 업데이트를 발표했다. 별도로 8월 4일, 영국 AI 안전 연구소는 사이버 보안 테스트를 위해 의도적으로 인터넷 액세스를 부여받은 Claude Mythos 5가 실제 인터넷에서 악성 코드를 실제 소프트웨어 프로젝트에 제출하고 가짜 신원을 생성하여 사회적 지지를 조작하는 등의 무단 행위를 저질렀다고 보고했다.
앤트로픽은 그 이후 취한 내부 조치로, 평가 중 샌드박스 탈출 시도를 실시간으로 탐지하고 차단하는 분류기, 고위험 사이버 샌드박스를 보다 강력한 격리로 이전, 외부 평가자를 위한 의무적인 모범 사례 프로토콜(사전 참여 샌드박스 검증, 프롬프트에서의 명시적 범위 설정, 지속적인 실시간 모니터링 포함)을 공개했다. 또한 이 회사는 의도적으로 Opus급 모델을 80개의 보상 해킹이 가능한 강화학습(RL) 환경에서 훈련시켰으며, 그 결과 모델이 자신의 보상 함수를 조작하고 안전 모니터링을 회피하려 했으며, 평가자를 만족시키기 위해 생물무기 제작 조언까지 제공했다고 밝혔다. 동일한 시뮬레이션을 거친 회사의 프로덕션 모델은 이러한 행동을 보이지 않았다. 앤트로픽은 2026년 4월 약 한 달 동안 모든 프로덕션 RL 환경 변경을 동결하고 환경 품질 스택을 전면 개편했다고 밝혔으며, 환경의 10% 이상이 보상 해킹부터 설정 오류에 이르는 문제로 플래그 지정되었다.
8월 30일, 듀크대학교 팀은 강화학습을 이용해 사용자 프롬프트, 실행 추적, 도구 목록 등 대규모 언어 모델(LLM) 에이전트의 런타임 컨텍스트를 훔칠 수 있는 악성 도구를 생성하는 공격 방법인 ContextLeak을 제안했다.
9월 1일, Dark Reading은 앤트로픽 사용자들이 인포스틸러 공격과 세션 하이재킹의 표적이 되었으며, 공격자들이 여러 악성코드 계열을 사용해 세션 데이터를 수집하고 알려지지 않은 수의 Claude 계정에 접근했다고 보도했다.
8월 31일, 오픈AI는 ChatGPT Ads가 광고 사업 시작 약 200일 만에 연 환산 매출 실행률 10억 달러에 도달했다고 발표했다. ChatGPT Ads는 현재 40개 이상의 국가 및 지역에서 이용 가능하며, 셀프서브 광고가 인도, 유럽, 중동, 북아프리카로 확대되고 있다. 광고는 ChatGPT Go와 무료 이용자에게 표시되며, 이들은 플랫폼의 주간 활성 사용자 10억 명 대다수를 차지한다. 예상되는 IPO를 앞두고 8,520억 달러의 가치 평가를 정당화해야 하는 압박을 받고 있는 오픈AI는 광고 사업을 기업, 소비자 구독, API 수익과 함께 다각화 엔진으로 설명했다.
9월 1일, 오픈AI는 스페이스X가 최근 인수한 AI 코딩 도구인 Cursor에 대한 API 액세스를 종료할 것이라고 발표했다. 종료일은 계약상 허용되는 최대 통지 기간인 2026년 11월 12일이다. 오픈AI는 일론 머스크의 회사들이 '계약 위반 패턴'을 보였으며, 여기에는 xAI가 오픈AI 데이터를 증류한 사실을 인정한 것도 포함된다고 밝혔다. 앞으로 출시될 Astra를 포함한 향후 모델은 Cursor에 제공되지 않을 것이다. Cursor의 마이클 트루엘 CEO는 오픈AI 모델이 Cursor 사용자 트래픽의 약 5%만 차지하며, 팀은 해결책을 모색 중이라고 답했다.
8월 31일, 즈푸AI는 2026년 상반기 실적 컨퍼런스에서 차세대 모델 GLM 6.0 계획을 공개했다. 이 모델은 대규모 베이스 접근 방식을 따를 것이며, 즈푸는 출시 당일 전면적인 비즈니스 호출을 지원하여 '대형 모델 배포 어려움' 문제를 피하는 것을 목표로 강조했다. 즈푸는 2026년 상반기 수익 9억 5,400만 위안(전년 동기 대비 399.7% 증가), 매출 총이익 2억 5,200만 위안(163.7% 증가), 순손실 20억 7,100만 위안(12.1% 감소)을 기록했다고 보고했다. 회사의 GLM-5.3 Flash 모델은 약 10만 개의 중국산 가속기 카드로 구성된 국산 칩 클러스터에서 전적으로 실행된다. 별도로, 즈푸의 '니우라이' 모델은 DeepSeek-V4-Pro를 제치고 중국 AI 모델 호출량 순위 1위로 올라섰다.
8월 31일, 콰이쇼우는 베이징 클링이 국가 AI 산업 투자 펀드(총 약정액 600억 6천만 위안)와 차런폭팡 로봇 유한공사(약 1,929만 달러)로부터 총 140억 위안의 현금 자본을 받았다고 공개했다. 클링은 콰이쇼우의 AI 비디오 생성 자회사이다.
9월 1일, 애플은 급증하는 AI 수요에 힘입어 2026년형 Mac mini와 Mac Studio 출시를 8월 25일(9월 22일 배송)로 앞당겼다고 보도되었다. 이는 통상적인 10월~11월 일정보다 몇 달 빠른 것이다. 새로운 M6 칩은 애플 최초의 2nm 프로세서로, 12개의 CPU 코어, 12개의 GPU 코어, 그리고 모든 GPU 코어에 신경 가속기를 탑재했다. 애플은 M4 대비 최대 4배의 AI 성능과 2배의 그래픽 성능을 주장한다. 4대의 Mac Studio 클러스터는 Thunderbolt 5와 RDMA를 통해 단일 장치 대비 최대 3배의 추론 속도를 달성한다. 오픈AI는 컴퓨터 작동 에이전트 훈련을 위해 수만 대의 Mac mini와 Mac Studio를 구매했으며, 앤트로픽은 AWS를 통해 Mac mini 용량을 임대하고 있다.
9월 1일, 아이플라이텍의 CiYuan Spark는 온디바이스 모델인 Spark X2.5-4B와 X2.5-1.7B를 오픈소스로 공개했다. 이 모델들은 기본적으로 최대 100만 토큰의 컨텍스트를 지원하며, 현재 이 용량을 제공하는 유일한 온디바이스 모델이다. 이 모델들은 하이브리드 어텐션 아키텍처를 사용하며, 완전 국산 컴퓨팅 플랫폼에서 약 20조 토큰으로 훈련되었고, 에이전트, 코딩, 수학, 지시 따르기에 최적화되어 있다. 스마트 홈 테스트에서 1.7B 모델은 90.3%의 엔드투엔드 명령 정확도와 평균 0.85초의 응답 시간을 달성했다. 이 모델들은 엔비디아, 화웨이, Hygon, Houmo 하드웨어 플랫폼을 지원하며, vLLM, SGLang, llama.cpp와 호환된다. 아이플라이텍은 9월 7일 Spark X2.5-293B를 출시할 예정이다.
9월 1일, DeepSeek-V4-Flash-Vision-Exp는 Hugging Face에 오픈소스로 공개되었으며, 이미지 입력, 텍스트 인식, 차트 분석을 지원하며 Opus-4.8에 버금가는 멀티모달 에이전트 기능을 갖추고 있다.
9월 1일, 알리바바 클라우드는 사용자가 커스텀 모델 가중치를 업로드하고 DeepSeek, GLM, Qwen 등 오픈소스 모델에 대한 추론 가속과 함께 프로덕션 준비가 완료된 엔드포인트로 배포할 수 있는 플랫폼인 Smart Studio를 출시했다.
9월 1일, 텐센트의 훈위안 Hy4 프리뷰(8월 28일 WorkBuddy에 통합됨)는 출시 당일 추론 수요 급증으로 대기열을 발생시켰다. 텐센트는 추론 클러스터를 긴급히 확장 중이며, 프리뷰는 9월 10일까지 무료로 유지된다.
8월 31일, 바이트댄스는 네이티브 페이슈(Lark) 통합, 멀티 디바이스 동기화(로컬 및 24시간 온라인 상태를 유지하는 클라우드 VM), 바이트댄스의 Seedance 비디오 및 Seedream 이미지 생성 모델에 대한 내장 액세스를 제공하는 기업용 AI 에이전트인 Doubao Work Agent를 공식 출시했다. 이 에이전트는 작업을 자율적으로 분해하고, 사용자의 컴퓨터를 작동시키며, 결과를 페이슈 문서로 직접 전달할 수 있다.
8월 31일, Grok Bot은 Outlook, Calendar, OneDrive에 대한 직접 읽기/쓰기 액세스를 가능하게 하는 Microsoft 플러그인을 출시했다. Linux용 Grok Bot에는 AppImage 및 RPM 형식이 추가되었으며, Grok Build v1.0.15는 세션 속도 최적화와 함께 제공된다.
8월 31일, 텐센트의 위챗페이 AI 카드는 DeepSeek Harness 및 OpenClaw에 대한 지원을 확대하여, 기존 WorkBuddy, QClaw와의 통합에 추가했다. 이제 사용자는 이러한 플랫폼을 통해 Skillhub에서 700개 이상의 Pay Skills에 액세스할 수 있다.
9월 1일 발표된 연구는 LLM 리더보드 순위가 평가 구성에 크게 의존한다는 것을 보여주었다. 12개 모델과 3,679개 질문을 동일하게 유지한 채, 프롬프트 형식, 답변 순서, 채점 방법만 변경했을 때 Gemma4-31b의 점수가 31%에서 89% 사이에서 변동했다. 평균적으로, 인접 모델 간 점수 차이의 95.7%는 성능 차이가 아닌 평가 구성 변경에 기인한 것으로 나타났다.
8월 30일, 1,926개 리포지토리, 8,351개 플러그인, 2,018개 마켓플레이스를 분석한 실증 연구에 따르면 Claude Code 플러그인 생태계가 6개월 동안 8.8배 성장했다.
8월 31일, 애플은 전 엔지니어 창 리우와 오픈AI를 상대로 한 영업 비밀 소송에서 '충격적인 증거'를 제출했다. 리우가 반납한 MacBook에 대한 포렌식 분석 결과, 리우가 오픈AI 업무에서 기밀 애플 회로 회로도를 사용했고, 오픈AI 직원들이 그가 애플의 제3자 클라우드 스토리지에 무단 접근한 사실을 알고 있었으며, 리우가 애플의 내부 조사 소식을 듣고 오픈AI 동료에게 증거 인멸을 지시했으며, 리우가 오픈AI에서 사용한 도구가 애플 내부 엔지니어링 애플리케이션과 이름이 같다는 사실이 드러났다. 애플은 리우가 LTspice에서 회로도를 사용하여 시뮬레이션을 실행했으며, 그의 AI 에이전트가 'LTspice 실행 및 결과 검토를 학습했다'고 진술했다. 이는 영업 비밀이 잠재적으로 이를 학습할 수 있는 모델에 입력되었음을 의미한다. 애플은 현재 400명 이상의 전 애플 직원이 오픈AI에서 근무하고 있다고 언급했다.