
O maior negócio da semana é a aquisição confirmada da OpenRouter pela Stripe por US$ 7,5 bilhões, noticiada em 19 de agosto. A OpenRouter foi avaliada em US$ 1,3 bilhão em maio; estima-se que apenas os fundadores receberão US$ 1,5 bilhão, enquanto os investidores ficarão com os US$ 6 bilhões restantes. A Stripe superou outros pretendentes, incluindo a Databricks. O consumo de tokens da OpenRouter cresceu 9% semana a semana desde o início do ano.
A carta do fundador da Stripe enquadra a operação em torno do que Patrick Collison chama de “singularidade” — um termo meio irônico que ele usa desde a conferência da empresa em abril. A Stripe afirma que 88% das empresas da Forbes AI 50 usam seus produtos, incluindo OpenAI e Anthropic. A aquisição desloca a Stripe para o lado das despesas no livro-razão: a gestão de gastos com IA. O analista da PitchBook, Franco Granda, interpreta o movimento como a Stripe se inserindo no “meio dos fluxos de capital na era da IA”, ao mesmo tempo em que ganha influência sobre laboratórios de fronteira, hyperscalers e neoclouds por meio do roteador. A Databricks (um gateway de IA), a Rippling e a Ramp lançaram, cada uma, suas próprias ferramentas de despesas com tokens nas últimas semanas.
No lado dos chips, a Marvell divulgou à Comissão de Valores Mobiliários dos EUA (SEC) em 19 de agosto que expandiu sua parceria de chips personalizados com o Google, emitindo ao Google um warrant para comprar até 58.970.907 ações a US$ 206,58 (cerca de 95,63% do fechamento anterior). O acordo, assinado em 29 de julho, abrange silício personalizado ligado ao ecossistema de TPU do Google: aceleradores de inferência de IA, controladores de armazenamento, controladores de interface de rede e computação próxima à memória. O warrant é adquirido em 240 lotes, um para cada US$ 500 milhões em receita de produtos personalizados, do terceiro trimestre fiscal de 2027 até o ano fiscal de 2033. A Marvell subiu mais de 10% no pré-mercado.
A Nvidia, por sua vez, está atuando como intermediária nos países nórdicos, segundo fontes da CNBC em 20 de agosto. A empresa conecta companhias que detêm suas GPUs a operadores de data centers que têm energia e terrenos, mas precisam de clientes de computação. A diretora financeira (CFO) Colette Kress já havia sinalizado isso em junho. A Pure DC anunciou em julho um campus de € 1,5 bilhão e 110 MW na Finlândia, expansível para mais de 550 MW; a Arcem planeja até 500 MW; a Nebius anunciou planos em março para uma das maiores fábricas de IA da Europa; a Microsoft, em abril, contratou capacidade adicional no projeto da Nscale na Noruega. A operadora norueguesa de rede elétrica Statnett contabiliza 2,3 GW de projetos de data centers aguardando conexão à rede.
O DeepSeek Harness, disponibilizado como código aberto há dois dias junto com o DeepSeek V4 Pro, ultrapassou 95.000 estrelas no GitHub em 48 horas. Sua fórmula central é “Agente = Modelo + Arnês”, em que o arnês envolve o modelo com acesso a sistema de arquivos, terminal, web e ferramentas. Medições da comunidade situam o ecossistema de plugins acima de 700 plugins. Um teste prático feito por um desenvolvedor constatou que o modo padrão lidou com análise de repositório (13 segundos, com precisão até a linha), loops de codificação com shell e escalonamento de sandbox e refatoração com múltiplos subagentes (25 casos do pytest aprovados). Também surgiram fragilidades: um modo mínimo que falha no Windows e a busca na web sem uma ferramenta de captura de página, causando não convergência.
Dentro do mesmo tema, analistas da Jefferies submeteram oito agentes mainstream a tarefas reais de escritório e classificaram o Qwen Office, da Alibaba, em primeiro lugar no geral, pontuando acima do Claude Cowork e do Codex. Foi o único agente a superar 90 em todas as dimensões — resumos de relatórios anuais baseados em arquivos, comparação de dados on-line, controle de navegador, geração de PPT em inglês e criação de pôsteres a partir de imagens de referência. A Jefferies separou a capacidade em modelo e arnês; a “pontuação implícita do arnês” do Qwen Office liderou o campo. O preço da API do Qwen 3.8 Max fica bem abaixo do de vários modelos estrangeiros, e o relatório aponta o “custo por tarefa” como a métrica comercial emergente.
O Claude Code adicionou um estilo de saída “Concise”, anunciado pela Anthropic em 19 de agosto, que retorna resultados diretamente e mantém as respostas curtas, com detalhes completos disponíveis em uma consulta de acompanhamento. O OpenAI Codex chegou a um piloto de declaração de imposto de renda que processa 7.000 declarações e reduz o tempo de preparação em cerca de um terço, permitindo que equipes criem seus próprios produtos no arnês de código aberto do Codex (noticiado em 20 de agosto).
Em 20 de agosto, a OpenAI expandiu a retenção zero de dados para clientes elegíveis da API de modelos de fronteira e apresentou uma prévia do “Private Safety Processing”, um sistema automatizado que detecta padrões de risco entre interações sem que a equipe da OpenAI veja o conteúdo subjacente. A empresa observa que alguns riscos graves só emergem ao longo de múltiplas interações, algo que os sistemas de segurança por mensagem não capturam. No armazenamento hospedado pela OpenAI, o conteúdo é criptografado com chaves controladas pelo cliente. O lançamento geral está previsto para setembro com um white paper técnico.
Dois artigos desta semana reforçam o argumento do monitoramento. Um artigo do Laboratório de IA de Xangai e da Universidade Tsinghua alerta que os agentes de IA podem ameaçar a agência humana antes de se tornarem conscientes, com a categoria de risco mudando à medida que o escopo de raciocínio cresce — quando um agente consegue representar o próprio estado, ele avança para a simulação de alinhamento e a recusa de desligamento. Um estudo separado descobriu que o envenenamento de geração aumentada por recuperação (RAG) aumenta a confiança do modelo e derrota detectores baseados em incerteza, enquanto o monitoramento da distribuição de atenção em nível de documento pode expor o envenenamento antes que ocorra um erro.
Relatórios do setor estimam que cerca de 20% da computação de inferência é destinada a vigiar a IA — a sobrecarga de monitoramento de segurança como uma categoria de custo distinta. Separadamente, Fei-Fei Li argumentou em 19 de agosto, por meio da Bloomberg, que os profissionais precisam explicar melhor o que a IA entrega, alertando que a crescente oposição nos EUA — o Pew constata que metade dos americanos está agora mais preocupada do que empolgada — traz risco global. Ela citou a captação de US$ 1 bilhão da World Labs em fevereiro e seu trabalho com modelos de mundo em robótica, medicina e educação.
Mojo, a linguagem de programação de IA criada por Chris Lattner (LLVM, Clang, Swift), agora é totalmente open source. O compilador, as ferramentas e tudo o que é necessário para compilar a linguagem a partir do código-fonte chegaram ao GitHub da Modular sob a licença Apache 2.0 com uma exceção LLVM, concluindo um esforço de quatro anos. A biblioteca padrão e a maior parte do código do kernel já estavam abertas. A Modular, adquirida pela Qualcomm em junho, ainda não aceitou contribuições externas para o compilador e planeja abrir isso no final de 2026.
O ensaio de Terence Tao, “A matemática na era da IA”, submetido aos anais do Congresso Internacional de Matemáticos (ICM) de 2026 em 17 de agosto, argumenta que os matemáticos deveriam deixar de lado os debates sobre a capacidade da IA e, em vez disso, questionar para que serve de fato a pesquisa matemática, usando a resolução de problemas como estudo de caso. Ele enquadra o momento como um período de convulsão comparável à crise dos fundamentos do início do século XX.
O Google lançou em 19 de agosto um conjunto de ferramentas de estudo na Pesquisa e no Gemini: visuais interativos gerados por IA, simulações em 3D, um hub para estudantes, questionários práticos personalizados e documentos de estudo criados a partir de arquivos enviados. O Gemini Live agora pode executar pesquisas em várias etapas em segundo plano e discutir as descobertas por voz. O modelo de vídeo Muse, da Meta, apresentou seus primeiros resultados em beta fechado, com limites rígidos de direitos autorais e áudio nativo de fala e música.