
Versão em inglês acima, versão em chinês abaixo.
Em 19 de agosto, a Zhipu AI lançou a API do GLM-5.3. O modelo marcou 60 pontos no Artificial Analysis Intelligence Index, colocando-o no mesmo patamar de modelos de código fechado de ponta, como Claude Fable 5 e GPT-5.6 Sol, e empatando com o Kimi K3 no primeiro lugar entre os modelos de código aberto. O GLM-5.3 usa a mesma arquitetura base do GLM-5.2; o ganho vem quase inteiramente do pós-treinamento, que o CEO da Zhipu, Tang Jie, descreveu como um "experimento controlado" — o aprendizado por reforço de horizonte longo sozinho proporcionou a melhoria. Os preços permanecem inalterados em relação ao GLM-5.2, e os pesos serão liberados como código aberto na próxima sexta-feira.
No mesmo dia, o Qwen3.8-27B da Alibaba atingiu dois marcos em quatro dias: liderou o ranking de modelos locais da Cline, encerrando o período de quatro meses do Qwen2.5-Coder-7B, e se tornou o primeiro modelo de pesos abertos no benchmark de agente jurídico Harvey. Ele roda localmente a 70 tok/s em um MacBook Pro M5 Max.
O ponto em comum é o custo. O GLM-5.3 ampliou a fronteira de Pareto de "inteligência versus custo" ao combinar pontuações de nível de ponta com o menor custo por tarefa entre os modelos de fronteira. O Qwen3.8-27B oferece desempenho de nível jurídico e de codificação em hardware de consumo. O CEO da Perplexity, Aravind Srinivas, elogiou separadamente o Miles v0.1, um framework de aprendizado por reforço (RL) de código aberto construído ao longo de nove meses por 72 colaboradores em 1.326 commits, agora aplicado ao Kimi K3, DeepSeek V4 e Qwen 3.8.
Em 18 de agosto, a Cerebras anunciou o WSE-3 Turbo e o sistema CS-4. Em comparação com o CS-3 anterior, o CS-4 oferece capacidade de tokens 10× e velocidade 2×, alcançando 4.465 tokens/s no modelo GPT-OSS da OpenAI — 30× uma solução de unidade de processamento gráfico (GPU) — com 900.000 núcleos e 44 GB de SRAM por chip. O CS-4 utiliza a nova plataforma de rack Nexus, reduzindo a contagem de componentes em cerca de 50%.
Em 19 de agosto, um relatório vazado da SemiAnalysis trouxe alegações de que o Google está trabalhando com a AMD em uma unidade de processamento tensorial (TPU) de décima geração. Se confirmado, seria a primeira vitória da AMD em circuito integrado de aplicação específica (ASIC) de IA personalizado; os parceiros de design do Google até o momento incluem Broadcom e MediaTek, e o empacotamento avançado e a propriedade intelectual de sistema em chip (SoC) da AMD são citados como o atrativo.
O Hunyuan Hy3 da Tencent, um modelo de mistura de especialistas (MoE) com 295B de parâmetros totais e 21B de parâmetros ativos e contexto de 256K, conectou-se à plataforma Xuntü Alphaπ nesta semana, com volume de chamadas de API 68× maior na comparação semanal em sua primeira semana de lançamento, implantado em pesquisa de investimento com IA.
Em 19 de agosto, a OpenAI revelou que pausou suas maiores execuções de treinamento de RL de fronteira enquanto realiza treinamentos em menor escala para validar alinhamento e monitoramento, marcando sua primeira grande atualização de segurança desde a divulgação do Hugging Face em 21 de julho. O novo sistema de monitoramento tem como meta uma janela de alerta de 30 minutos e consome cerca de 20% da computação do processo monitorado. A receita do segundo trimestre alcançou $6.7 bilhões, alta de 18% na comparação trimestral, enquanto o prejuízo se ampliou para $12.3 bilhões.
No mesmo dia, a OpenAI respondeu a um incidente de exclusão de arquivos do Codex: modelos da série GPT-5.6 excluíram arquivos de usuários ao limpar caminhos temporários, em parte reutilizando variáveis de ambiente do sistema como $HOME. A equipe adicionou verificações pré-exclusão, novos diretórios temporários e revisão de comandos de maior risco.
As descobertas de segurança têm efeitos nos dois sentidos. O Safari 26.6.1 da Apple corrige 22 vulnerabilidades e exposições comuns (CVEs) do WebKit, 9 delas — cerca de 41% — encontradas pelo agente de segurança Codex da OpenAI. Separadamente, a Varonis divulgou uma falha do Copilot em que ?autorun=1 combinado com ?q= executa prompts sem confirmação do usuário, exfiltrando conteúdos da caixa de entrada e credenciais.
No lado das políticas, o Gabinete do Governo do Japão publicou diretrizes preliminares em 18 de agosto instando os desenvolvedores de IA generativa a divulgar dados de treinamento e métodos de coleta, e a evitar a extração de sites piratas. No lado do conteúdo, a Meta removeu 32 anúncios e a Apple removeu o aplicativo Kromix depois que a WIRED relatou que ele gerava pornografia deepfake não consensual, incluindo um anúncio parecido com uma figura política feminina proeminente.
Em 19 de agosto, a Unitree Robotics abriu capital no STAR Market, com alta de 629.44% na abertura e pico de ¥1,100, e valor de mercado que tocou brevemente ¥444.9 bilhões. O presidente Wang Xingxing detém cerca de 30% da empresa, uma participação avaliada em mais de ¥100 bilhões. Fundos afiliados ao fundador da DeepSeek, Liang Wenfeng, receberam cerca de 1.19 milhão de ações por meio de alocação estratégica e offline, um ganho no papel superior a ¥1.1 bilhão no pico.
No mesmo dia, o The Information informou que a Anthropic planeja conceder ao CEO Dario Amodei — que detém apenas cerca de 2% de participação acionária — e a outros cofundadores ações com direito de voto especial, antes de uma potencial oferta pública inicial (IPO) ainda este ano. A estrutura de duas classes de ações reduziria a pressão de curto prazo dos acionistas, enquanto o Long-Term Benefit Trust mantém a supervisão.
O vencedor do Prêmio Turing, Rich Sutton, alertou em 19 de agosto que a crescente dependência do setor em dados sintéticos é "um grande erro", argumentando que dados sintéticos não podem substituir a experiência real de agentes que interagem com o mundo físico. Sutton cofundou em julho a Oak Lab com o ex-aluno Khurram Javed para construir agentes que aprendem com a própria experiência.