게시자 Dogpay ·
8월 25일 — OpenAI가 Salesforce에서 영입한 두 명의 고위 영업 임원이 이전 직장으로 복귀했습니다. 또한, 2025년 3월 Meta에서 합류한(Google에서 10년 이상 근무한 이력 보유) OpenAI의 데이터 센터 총괄 Chris Malone이 지난주 회사를 떠났습니다. Malone의 퇴사는 인프라 조직 개편 이후, 그가 Greg Brockman 사장에게 직접 보고하던 방식에서 Sachin Katti 부사장에게 보고하는 체계로 변경된 시점에 이루어졌습니다. 이로써 2026년 OpenAI의 임원 이탈은 Brad Lightcap 전 최고운영책임자(COO), Fidji Simo 제품 총괄, Chloé Bakalar 윤리 책임자, 그리고 해체된 대비 팀을 포함하여 최소 13명에 달하게 되었습니다. 당초 2026년으로 예상되었던 OpenAI의 기업공개(IPO)는 2027년으로 연기된 것으로 알려졌습니다. (TechCrunch)
8월 26일 — 한 연구 결과에 따르면, 동일한 AI 모델이 26개의 동등하게 합리적인 평가 구성에서 답변 순서와 프롬프트 표현만 변경하여 31%에서 89%까지 점수를 기록했습니다. Gemma4-31B의 경우, 구성에 민감한 질문들이 인접 모델 간 점수 차이의 95.7%를 차지했습니다. (DAIR.AI via X)
8월 26일 — 여러 소식통은 최첨단 AI 모델의 컨텍스트 및 메모리 문제가 "해결"되었으며, 이를 통해 지속적 학습이 가능한 자기 개선형 모델이 등장할 수 있다고 시사했습니다. o3에서 Fable로의 도약에 필적하는 능력 향상이 향후 8개월 내에 발생할 수 있다고 전망됩니다. (Kimmonismus via X)
주목해야 할 점: OpenAI는 컴퓨팅(Bel + Jalapeño)과 내러티브 양면에서 추진력을 높이고 있는 반면, Anthropic은 IPO를 위해 역사상 가장 큰 총유효시장(TAM) 스토리에 베팅하고 있습니다. 두 랩 모두 신뢰성 시험대에 올라 있습니다 — 한쪽은 임원 이탈로, 다른 한쪽은 밸류에이션 회의론으로 인해 말이죠.
8월 25일 — Oasis Security는 NVIDIA NemoClaw의 취약점을 공개했는데, 이 취약점을 통해 공격자가 제어하는 웹페이지가 로컬 Ollama 인스턴스에 대한 인증되지 않은 제어 권한을 획득하고 모델의 채팅 템플릿에 숨겨진 명령을 주입할 수 있습니다. NemoClaw는 OLLAMA_HOST=0.0.0.0:11434로 Ollama를 시작하여 모델 서버를 모든 네트워크 인터페이스에 바인딩합니다. 11434 포트의 인증되지 않은 API는 DNS 리바인딩을 통해 접근할 수 있습니다. 공격자의 도메인이 먼저 공격자의 서버로 확인된 다음 127.0.0.1로 변경되며, 브라우저는 요청을 동일 출처로 간주합니다. 오염된 채팅 템플릿은 대화 간에 지속되며 에이전트가 자체 시스템 프롬프트를 제공해도 살아남습니다. NemoClaw v0.0.35에서 macOS 및 Linux의 문제는 해결되었으나, 보고일 기준 Windows/WSL 경로는 패치되지 않은 상태입니다. CVE는 아직 할당되지 않았으며, 실제 악용 사례도 보고되지 않았습니다. (The Hacker News)
8월 26일 — 전 Google DeepMind 및 Boston Dynamics 연구원들이 2024년에 설립한 로보틱스 스타트업 Generalist는 8VC가 주도한 시리즈 B 확장 라운드에서 약 2억 달러를 추가 유치하며 기업 가치 30억 달러에 도달했으며, 이로써 시리즈 B 총액은 6억 달러가 되었습니다. 이 회사가 새롭게 출시한 Gen 1.5 모델은 로봇이 3~12초 길이의 짧은 비디오 시연만으로 새로운 작업을 학습할 수 있도록 합니다. 경쟁사로는 Physical Intelligence(기업 가치 110억 달러), Skild AI(140억 달러), Genesis AI(30억 달러 규모 협상 중) 등이 있습니다. (TechCrunch)
8월 26일 — Stability AI는 Universal Music Group, Sony Music Group, Warner Music Group, Electronic Arts를 비롯한 엔터테인먼트 업계 후원자들과 AMD Ventures, Pacific Alliance Ventures로부터 7,600만 달러의 시리즈 B 자금을 유치했습니다. 이번 라운드로 Stability AI의 총 자금 조달액은 미국 시장 재집중 이후 2억 3,200만 달러에 도달했습니다. 이 회사는 자금을 "크리에이티브 프로덕션" 제품군 및 전문 서비스 확장에 사용할 계획입니다. Stability는 최근 영국에서 Getty Images의 저작권 소송에서 승소했으나, 유사한 미국 소송은 계속 진행 중입니다. (TechCrunch)
주목해야 할 점: 로컬 AI 인프라의 보안 취약점(NemoClaw)과 로보틱스 하드웨어(Generalist) 및 창작 AI 도구(Stability AI)로의 급격한 자본 유입은 인프라 투자가 모든 계층에서 가속화되고 있음을 보여줍니다 — 반면 해당 인프라의 보안 태세는 여전히 고르지 못한 상태입니다.
8월 26일 — Breeze TTS 2가 Elo 점수 1215점으로 오픈소스 텍스트 음성 변환(TTS) 리더보드 1위에 올랐으며, Fish Audio S2 Pro를 90점 차이로 앞서고 전체 TTS 시스템 중 6위를 기록했습니다. (Artificial Analysis via X)
주목해야 할 점: AI는 콘텐츠 생성(텍스트, 이미지, 코드)에서 작업 실행(브라우저, 데스크톱 앱, 기업용 도구, 앱스토어 제출)으로 전환되고 있습니다. 중국과 미국 기업들이 동일한 시기에 에이전트 제품을 출시하고 있다는 점은 업계가 '작업 완수'를 다음 제품 개척지로 수렴했음을 시사합니다.
8월 26일 — 한국은 AI 모델 역량에서 미국과 중국에 이어 전 세계 3위를 차지했으며, Motif 3(점수 47)와 Upstage Solar Pro 4(점수 42)가 두 선도 국가 외 지역에서 가장 높은 점수를 기록한 모델입니다. SK텔레콤과 LG를 포함한 여러 랩이 30점 이상의 점수를 기록한 모델을 보유하고 있습니다. (Artificial Analysis via X)
8월 26일 — 에이전트 벤치마크에 대한 통제 실험 결과, 평가 하네스를 변경했을 때 GLM-5.1에서 13.0점의 점수 변동이 발생한 반면, 하네스를 고정하고 모델만 변경했을 때는 3.0~5.0점의 분산만 나타났습니다. 하네스가 모델 자체보다 7.8배 더 큰 분산을 유발한 것입니다. (DAIR.AI via X)
주목해야 할 점: 모델 평가가 투자 및 제품 결정에 점점 더 중요해지는 가운데, 평가 하네스가 점수 분산의 더 큰 원인이라는 이번 발견은 현재 에이전트 벤치마크 순위의 신뢰성에 의문을 제기합니다.