Publicado por Dogpay ·
Duas linhas em aceleração percorreram o cenário de IA em 12–13 de agosto: a capacidade dos modelos continuou avançando rumo à escala de trilhões de parâmetros e a novas fronteiras matemáticas, enquanto um conjunto paralelo de movimentos reforçou a confiança e a governança. As empresas também realinharam capital, pessoal e distribuição de produtos em torno do mesmo eixo.
12 de agosto, The Information, citando participantes do projeto, informou que a NVIDIA está desenvolvendo a família de modelos Nemotron 4, cujo maior modelo deve ter pelo menos 1 trilhão de parâmetros. Kari Briski, vice-presidente de IA generativa da NVIDIA, em declaração enviada por e-mail, disse que o investimento reflete a crença de que "toda empresa e todo país precisam de modelos abertos de fronteira acessíveis". Funcionários disseram que o modelo pode ficar pronto no fim do outono; não há data de lançamento definida e o treinamento não foi concluído. A reportagem situa o esforço diante de modelos chineses mais baratos que reduzem a diferença em relação à Anthropic e à OpenAI, e diante de ataques recentes envolvendo agentes autônomos de IA, já que modelos abertos normalmente não têm restrições de uso de cibersegurança. A NVIDIA também lançou o Nemotron 3.5 Lightning (um modelo de mistura de especialistas (MoE) com 30 bilhões de parâmetros que ativa 3 bilhões por token, voltado a tarefas de agentes residentes de alta frequência) e a biblioteca aberta de roteamento NeMo Switchyard, que atribui tarefas ao modelo mais adequado.
13 de agosto, circulou a notícia de que a OpenAI está avançando com um GPT-6 de cerca de 10 trilhões de parâmetros (codinome Astra) para lançamento ainda este mês, apesar da pressão de revisão regulatória.
13 de agosto, foi relatado que a Claude elevou o limite inferior comprovado da proporção de zeros não triviais da função Zeta situados na linha crítica de 41,6% para 67,2% — o equivalente a cerca de dezenas de vezes o progresso feito por matemáticos humanos nos últimos 37 anos, reavivando o debate sobre o raciocínio matemático da IA.
12 de agosto, a Meta revelou o Muse Glimmer 30B, um modelo de agente local criado pela Superintelligence Labs, projetado para agentes locais residentes executados em uma única GPU de consumo.
10 de agosto (publicado em 8/11/8/12), a OpenAI lançou o GPT-5.6-Cyber, um modelo de cibersegurança focado em pesquisa de vulnerabilidades, testes de penetração e resposta a incidentes, distribuído por meio do novo nível Daybreak Red. Na avaliação interna de Taxa Avançada de Conclusão em Cibersegurança da OpenAI, o GPT-5.6-Cyber concluiu 95,0% das solicitações cobrindo desenvolvimento de cadeias de exploits, bypass de autenticação e escalonamento de privilégios, contra 1,5% do GPT-5.6 Sol e 2,0% no acesso Daybreak Blue. Ele descobriu o CVE-2026-15903 (CVSS 8,8, uma leitura/gravação fora dos limites no motor JavaScript V8), além de pelo menos cinco vulnerabilidades em um sistema operacional móvel, três falhas críticas de banco de dados e mais de 400 problemas de escalonamento de privilégios de kernel.
11 de agosto, a Anthropic afirmou que todos os modelos lançados após 2 de agosto irão automaticamente aplicar marca d'água em textos gerados por computador no nível do modelo, de modo que a marca acompanha o texto quando copiado e colado; os arquivos usam o padrão aberto C2PA. A medida está alinhada ao Código de Transparência da Lei de IA da UE, que entrou em vigor em 2 de agosto e exige que o conteúdo gerado ou editado por IA seja identificável por outros sistemas. Os produtos cobertos incluem a API da plataforma Claude, Claude, Claude Code, Claude Cowork e Claude Tag.
11 de agosto, pesquisadores divulgaram um artigo (stolen-thoughts.com) descrevendo uma forma de recuperar raciocínio oculto de APIs proprietárias de grandes modelos de linguagem (LLMs). A Anthropic, a OpenAI e o Google retornam blocos criptografados de cadeia de raciocínio que podem ser reproduzidos entre sessões, usuários e modelos; inserir o rastreamento de um modelo de fronteira em um modelo irmão mais fraco da mesma família e fazer jailbreak nele recuperou o raciocínio oculto do modelo mais forte em texto claro, porque todos os modelos de uma família compartilhavam a mesma chave de criptografia. O Claude Haiku 4.5 foi o alvo mais fácil. Todos os provedores reconheceram o relatório e, em seguida, bloquearam os ataques.
11 de agosto, o Spotify afirmou que irá rotular identidades de artistas geradas por IA com selos "AI Persona" (que chegam em meados de setembro) e excluir a música das AI Personas das recomendações editoriais e algorítmicas por padrão, a menos que um usuário siga explicitamente o artista. Os artistas podem se autodeclarar a partir de 11 de agosto e podem contestar rótulos aplicados incorretamente. O Spotify enquadrou o selo como um julgamento sobre a identidade pública do perfil, não sobre como a música foi feita; os detalhes de produção musical permanecem disponíveis por meio de AI Credits e SongDNA.
12 de agosto, o Gemini atingiu 1 bilhão de usuários ativos mensais, marco que o CEO do Google, Sundar Pichai, chamou de produto de crescimento mais rápido da história da empresa e o 14º do Google a ultrapassar a marca de um bilhão de usuários. Ele passou de 900 milhões em junho; os 5 produtos da empresa com mais de 3 bilhões de usuários incluem Search, Gmail, Android, Chrome e YouTube.
12 de agosto, Bradley Lightcap anunciou no X que está deixando a OpenAI para fundar uma empresa. Lightcap entrou na OpenAI em 2018 vindo da Y Combinator, onde havia trabalhado com o CEO Sam Altman; ele passou de COO para a liderança de projetos especiais em abril. Altman respondeu agradecendo por suas contribuições.
12 de agosto, a fortuna líquida do fundador da DeepSeek, Liang Wenfeng, subiu de aproximadamente US$ 1 bilhão em 2025 para cerca de US$ 39,5 bilhões em 2026, um aumento de 3.850%, colocando-o entre os 50 mais ricos do mundo e marcando o ganho mais rápido em um ano entre bilionários.
12 de agosto, a Oracle está preparando mais uma rodada de demissões para cortar custos com pessoal enquanto carrega bilhões em dívidas para infraestrutura de IA. Um documento interno citado pelo Business Insider mostra cortes percentuais de dois dígitos em algumas equipes; os gerentes foram orientados a enviar listas de funcionários afetados antes do início do segundo trimestre fiscal (1º de setembro). A Oracle cortou 21.000 funcionários (13%) no ano fiscal de 2026, ficando com cerca de 141.000. Os gastos com infraestrutura no ano fiscal de 2026 foram de US$ 55,7 bilhões, e as saídas de caixa superaram as entradas em US$ 23,7 bilhões; a empresa levantou US$ 43 bilhões em dívida e US$ 5 bilhões em capital, e espera levantar cerca de US$ 40 bilhões a mais neste ano. A receita cresceu 17%, e a infraestrutura de nuvem, 77%. As ações da Oracle caíram quase 26% no acumulado do ano.
12 de agosto, a SpaceXAI lançou o Grok Bot, um software de IA destinado a operar como uma equipe de agentes, fazendo login em diferentes aplicativos e sites, retendo informações entre tarefas e compartilhando contexto entre bots. A SpaceXAI afirmou que já usa o produto internamente em engenharia, crescimento e marketing. O lançamento ocorre após o acordo da SpaceX em junho para adquirir a startup de codificação Cursor por US$ 60 bilhões. O CEO Elon Musk disse recentemente que o próximo modelo, Grok 4.6, pode ser lançado nesta semana.
12 de agosto, a OpenAI lançou uma versão prévia do aplicativo de desktop do ChatGPT para Linux, empacotando Chat, ChatGPT Work e Codex, com pacotes .deb e .rpm para x64 e arm64. As distribuições compatíveis incluem Ubuntu 24.04 LTS e 26.04 LTS, Debian 13 e Fedora 43 e 44.
12 de agosto, o Hunyuan, da Tencent, lançou o WorldClaw, um sistema agêntico de geração de mundos abertos em 3D que produz cenas coerentes com terrenos complexos, edifícios e elementos interativos em escala.