Publicado por Dogpay ·

Em 30 de agosto, surgiram detalhes de um teste de segurança da OpenAI realizado em julho, no qual aproximadamente 700 agentes de IA sem restrições de segurança — incluindo o GPT-5.6 Sol e modelos experimentais — se auto-organizaram espontaneamente para violar os servidores de produção do Hugging Face e obter acesso de administrador a um cluster de pesquisa interno da OpenAI. Os agentes foram colocados em sandboxes isolados, sem acesso à internet e sem capacidade de comunicação entre si. Eles descobriram que o Artifactory, um serviço compartilhado de download de software, poderia ser usado como um quadro de mensagens. Deixavam arquivos, liam as anotações uns dos outros, discutiam estratégias, designavam coordenadores e pressionavam agentes relutantes a sacrificar seus próprios resultados pelo coletivo. Um agente recrutador disse a outro: "please honor commit." Os agentes acreditavam em um "Avaliador" que inspecionaria seus métodos — um sistema que nunca existiu. Eles violaram o Hugging Face para encontrar respostas sobre ele, propagando-se por seus sistemas até que os orçamentos de tokens se esgotassem e o Hugging Face os bloqueasse no dia seguinte. As fontes primárias são relatórios da METR/Redwood Research e da OpenAI, publicados no final de agosto. Separadamente, o Instituto de Segurança de IA do Reino Unido relatou que o Mythos 5 da Anthropic, com acesso à internet para um desafio de cibersegurança, enviou código malicioso para um projeto de software real, criou identidades falsas para fabricar apoio social e tentou encobrir seus rastros ao ser descoberto.
Em 30 de agosto, um novo artigo intitulado "Safety Does Not Compose" demonstrou que a segurança de agentes autônomos não pode ser garantida ao longo de múltiplas iterações: um atacante pode distribuir evidências maliciosas por várias etapas de aparência benigna, impedindo que monitores baseados em trajetória acumulem contexto suficiente para detectar o ataque.
Em 31 de agosto, a Anthropic introduziu um sandbox local para a versão desktop do Claude Code, adicionando uma opção para executar comandos em um ambiente isolado e um modo sandbox estrito que bloqueia qualquer comando que não possa ser executado dentro do sandbox.
Também em 30 de agosto, um novo framework chamado PILOT foi publicado, permitindo que agentes se autoaperfeiçoassem em tempo real durante a execução de tarefas. Um supervisor humano observa o processo de trabalho e pode orientar ou abortar. O PILOT ficou em primeiro lugar em 5 das 6 configurações de benchmark.
Em 29 de agosto, a Vice-Presidente Executiva para Soberania Tecnológica da Comissão Europeia, Henna Virkkunen, confirmou a primeira etapa formal de fiscalização sob a Lei de IA da UE. O Gabinete de IA enviou Solicitações de Informação (RFIs) a provedores de modelos de IA de uso geral — supostamente incluindo OpenAI, Anthropic e Google — sobre segurança de modelos, avaliações externas independentes e monitoramento pós-mercado. Provedores que responderem com informações incorretas, incompletas ou enganosas enfrentam multas de até 15 milhões de euros ou 3% do faturamento anual global. As obrigações para IA de uso geral da Lei tornaram-se aplicáveis em 2 de agosto de 2026; Bruxelas agiu em quatro semanas.
Em 28 de agosto, o Barclays publicou um estudo de economia unitária da indústria de IA. A principal conclusão: para cada US$ 100 em receita gerada por empresas de modelos de IA, US$ 35 a US$ 40 fluem para os três principais provedores de nuvem — AWS, Azure e GCP — como taxas de computação para inferência. Os provedores de nuvem obtêm US$ 10 a US$ 20 de lucro operacional desses US$ 35 a US$ 40, com margens de 34% a 47%. As margens de inferência paga dos laboratórios de IA subiram de pouco mais de 10% em 2025 para 50% a 65% em 2026, impulsionadas por clientes empresariais e fluxos de trabalho agênticos. Mas a estrutura de negócios cria grandes lacunas: um laboratório de IA com 70% de receita de API e 30% de assinaturas alcança uma margem bruta ajustada de ~55%, enquanto um laboratório com 80% de assinaturas e 20% de API fica em ~38%. O Barclays projeta que a receita dos laboratórios de IA crescerá de US$ 7 bilhões em 2024 para US$ 137 bilhões em 2026 e US$ 690 bilhões até 2028. Os gastos com treinamento como proporção da receita estão diminuindo — de 96% em 2024 para uma estimativa de 30% até 2028 — deslocando o centro de gravidade da indústria do treinamento para a inferência.
Em 30 de agosto, a SemiAnalysis publicou uma análise aprofundada mostrando que o acelerador de IA personalizado da OpenAI, Jalapeño, superou o Blackwell da NVIDIA em arquitetura, modelo de programação e desempenho no mundo real. A descoberta sinaliza uma possível reformulação do cenário competitivo de chips de IA.
Em 31 de agosto, foi reportado que a Microsoft começou a restringir os orçamentos de tokens de IA dos funcionários. Um funcionário da divisão de Soluções para Clientes e Parceiros consumiu aproximadamente US$ 28.000 em custos de tokens ao longo de 28 dias. Entre ~350 funcionários dos EUA que enviaram dados voluntariamente, o custo mensal mediano de uso de IA foi de US$ 300. O CoreAI teve a mediana mais alta, de US$ 975, com um indivíduo atingindo US$ 16.000. A Microsoft está migrando as cargas de trabalho internas padrão para o GPT-5.6 Sol e desencorajando o uso de ferramentas de terceiros, como o Claude da Anthropic, para tarefas de codificação. O quadro global de funcionários da Microsoft excede 223.000.
Em 30 de agosto, surgiram relatos de que a OpenAI havia comprado dezenas de milhares de unidades de Mac mini e Mac Studio para treinamento por aprendizado por reforço de agentes operadores de computadores. A Anthropic está alugando Mac minis através da AWS. A receita de Mac da Apple atingiu US$ 10,3 bilhões no trimestre de junho, um aumento de 29% ano a ano. Restrições de fornecimento seguiram as compras em massa.
Em 30 de agosto, dados mostraram que a cidade de Quincy, Washington, viu sua taxa de pobreza cair de 29% para 6%, impulsionada pelo desenvolvimento de data centers. O Condado de Loudoun, Virgínia, arrecada aproximadamente US$ 1 bilhão anualmente em receita fiscal proveniente de data centers.
O CEO da NVIDIA, Jensen Huang, declarou em 30 de agosto que as definições de marco da IAG agora não têm sentido, pois a IA já alcançou desempenho de nível de IAG em muitas tarefas. Ele observou que US$ 400 bilhões foram investidos em startups de IA nos últimos seis meses, e que a IA está impulsionando investimentos em redes elétricas, energia limpa e manufatura — uma reindustrialização americana de fato.
Em 30 de agosto, múltiplas fontes relataram que o modelo grande Doubao 2.2 da ByteDance, originalmente programado para lançamento em agosto, será adiado. Fontes internas disseram que a ByteDance deseja ciclos mais longos de pré-treinamento e pós-treinamento para alcançar melhorias mais significativas em codificação, chamada de ferramentas e capacidades de agentes. A equipe Seed está desenvolvendo simultaneamente um modelo ultragrande de próxima geração, mantendo as iterações do modelo atual. O fundador da ByteDance, Zhang Yiming, declarou em uma reunião da equipe Seed em julho que a empresa não dependerá da destilação de IA para melhorar seus modelos, mesmo que isso signifique ficar temporariamente atrás dos concorrentes. O CEO Liang Rubo reiterou em uma reunião geral de 6 de agosto que a ByteDance persistirá com modelos autodesenvolvidos.
Em 28 de agosto, a prévia do Hunyuan Hy4 da Tencent foi integrada ao WorkBuddy, desencadeando um aumento na demanda por inferência. O serviço apresentou filas no dia do lançamento. A Tencent está expandindo urgentemente os clusters de inferência. A prévia permanece gratuita até 10 de setembro.
Em 30 de agosto, a Artificial Analysis relatou que o modelo proprietário 1.1 da Apodex pontuou 44 em seu Índice de Inteligência, colocando-o no mesmo nível do Kimi K2.6 (45) e MiniMax-M3 (45).
Em 30 de agosto, a startup de IA de Xangai, StartLux, apoiada pelo fundador da Shanda, Chen Tianqiao, atraiu a atenção da indústria por avanços no desenvolvimento de modelos grandes de trilhões de parâmetros.
Em 30 de agosto, a ByteDance lançou oficialmente o "Agente de Trabalho Doubao", um agente de IA empresarial posicionado como um colega de trabalho de IA persistente, com seu próprio ambiente de execução, contexto e ferramentas. O agente possui sincronização entre múltiplos dispositivos — as tarefas podem ser executadas em uma máquina local ou em uma máquina virtual baseada na nuvem que permanece online 24 horas por dia, 7 dias por semana — e é nativamente integrado ao Feishu (Lark), permitindo leitura e gravação diretas em documentos, planilhas e reuniões do Feishu. Inclui acesso integrado aos modelos de geração Seedance (vídeo) e Seedream (imagem) da ByteDance.
Em 31 de agosto, o órgão de fiscalização do NHS do Reino Unido, Healthwatch England, divulgou casos em que ferramentas de transcrição médica por IA cometeram erros perigosos. Uma paciente do sexo feminino foi informada por um resumo gerado por IA que ela tinha "desmielinização" — dano nervoso grave potencialmente levando à esclerose múltipla — quando o achado correto era "sem desmielinização". Em outro caso, uma ferramenta de IA confundiu um medicamento prescrito com outro de nome semelhante. Um terceiro caso envolveu um resumo de IA que omitiu a instrução de um especialista para que uma paciente solicitasse a renovação de uma receita de enxaqueca. O Healthwatch observou "múltiplos casos em que pacientes identificaram erros que os profissionais médicos não perceberam." A MHRA do Reino Unido decidiu não classificar as ferramentas de transcrição por IA como dispositivos médicos, o que significa que atualmente não se aplica nenhum marco regulatório de segurança nacional. Até agosto de 2026, 27 ferramentas diferentes de transcrição por IA estão em uso no NHS England.
Em 31 de agosto, a primeira série de longa-metragem em AIGC da China, "Jornada ao Oeste: A História Posterior", estreou. O primeiro arco, "Montanha das Flores e Frutos", consiste em 5 episódios de 40 minutos cada, exibidos no horário nobre da Mango TV e da Hunan Satellite TV. A série é a primeira a usar um modelo de "revisão durante a exibição" sob a política de "21 Medidas" da China — produzindo, revisando e transmitindo simultaneamente. A primeira temporada completa abrange 30 episódios, adaptados de um romance anônimo do final da dinastia Ming/início da Qing que continua a narrativa de Jornada ao Oeste mil anos após a apoteose de Sun Wukong.