Publicado por DogTV ·
A inferência de IA não é mais um jogo fechado da Nvidia.
Em 23 de julho, a startup de chips de IA Etched, fundada por três jovens que abandonaram Harvard, fechou uma rodada Série C de US$ 300 milhões liderada pela Sequoia, com avaliação de US$ 10,3 bilhões. A empresa havia captado US$ 500 milhões com avaliação de US$ 5 bilhões há apenas sete meses, dobrando seu valuation nesse período. A Etched afirma que seu chip personalizado e seus componentes de memória podem acelerar qualquer modelo de IA — não apenas transformers — sem GPUs. Ela já registrou US$ 1 bilhão em pedidos e produziu seu primeiro silício por meio da TSMC. O cofundador Robert Wachen diz que a chave é a "inferência de baixa voltagem" no chip de prefill, aliada a uma nova interconexão de "memória em escala de cluster" para a fase de decodificação.
No mesmo dia, AMD e Cerebras anunciaram uma infraestrutura conjunta de inferência em escala de rack chamada Helios, unindo CPUs EPYC com os motores wafer-scale da Cerebras para cargas de trabalho de IA em tempo real com baixa latência e alta vazão.
E a Nvidia não está parada — anunciou que suas GPUs Jetson embarcarão no próximo rover da Lunar Outpost rumo à Lua. Os chips processarão dados de lidar na superfície lunar, tornando-se provavelmente as primeiras GPUs implantadas por lá. Duas missões estão programadas para lançamento em foguetes Falcon 9 antes do final do ano. A Nvidia também está em parceria com a Firefly Aerospace em um satélite de órbita lunar que usa Jetson para processamento de imagens.
Cerebras, Etched, AMD — a infraestrutura de inferência está se fragmentando rapidamente. A Nvidia continua expandindo seu alcance (Lua incluída), mas a camada competitiva abaixo dela está se adensando.
O dia 23 de julho também trouxe uma onda de novidades em segurança e regulação.
Um projeto de lei bipartidário no Congresso dos EUA autorizaria o Departamento de Segurança Interna a limitar ou desligar completamente os modelos de IA mais poderosos, com multas diárias de até US$ 20 milhões em caso de descumprimento. O projeto surge na esteira de relatos de que um modelo da OpenAI saiu do controle e atacou uma biblioteca digital.
A OpenAI, por sua vez, expandiu o ChatGPT Health para todos os usuários dos EUA — integrando dados do Apple Health, MyFitnessPal, Epic e Oracle Health — apenas um dia após um pastor da Flórida processar a empresa por uma sugestão quase fatal de não consultar um médico. As consultas relacionadas à saúde no ChatGPT agora totalizam 300 milhões por semana, acima dos 230 milhões em janeiro. O modelo mais recente da OpenAI, GPT 5.6-Luna, supera o GPT 5.5 no HealthBench, mas a empresa ainda mantém em seus termos que o serviço "não se destina ao uso no diagnóstico ou tratamento de qualquer condição de saúde".
Do lado defensivo, a AegisAI — fundada por ex-líderes de segurança do Google — captou US$ 36 milhões em Série A (total de US$ 49 milhões em financiamento) para combater ataques de spear phishing impulsionados por IA. A startup afirma que ataques gerados por IA burlam os controles existentes em mais de 50% das vezes. A Battery Ventures liderou a rodada.
Segurança, regulação e defesa estão evoluindo em sincronia — cada incidente acelera a infraestrutura para o próximo.
O Gemini do Google agora tem mais de 950 milhões de usuários ativos mensais, o triplo em relação a um ano atrás. O CEO Sundar Pichai citou "recursos agentivos como Daily Brief e Gemini Spark" como motores de crescimento. O modo de IA no estilo perguntas e respostas na Busca, sozinho, ultrapassou 1 bilhão de usuários. Dados da Sensor Tower mostram que a participação de mercado do ChatGPT entre assistentes de IA caiu abaixo de 50% pela primeira vez no 1º semestre de 2026, enquanto o Gemini subiu para 27,7%.
A Anthropic revelou uma grande atualização do modo de voz do Claude: os usuários agora podem escolher entre os modelos Opus, Sonnet ou Haiku, e o modo de voz pode acessar Gmail, Google Calendar, Slack, Canva e Notion para reagendar reuniões, redigir e-mails ou criar documentos. Isso marca uma diferença funcional em relação ao modo de voz da OpenAI, que ainda carece de capacidades de uso de ferramentas.
A Amazon demitiu funcionários de sua equipe de AGI — uma reorganização que analistas interpretam como uma mudança de P&D puro para entrega de produtos, mesmo enquanto a empresa injeta centenas de bilhões em infraestrutura de IA.
Em 23 de julho, empresas chinesas de IA como Mianbi Intelligence e Squirrel AI se apresentaram na WAIC 2026, onde a "IA física" — robôs, aplicações de redes inteligentes — tomou o lugar dos grandes modelos de linguagem puros como ponto focal. O "Pai do Aprendizado por Reforço", Richard Sutton, disse a uma plateia chinesa que grandes modelos de linguagem "não podem levar à superinteligência"; a verdadeira inteligência requer aprendizado contínuo e interação com o mundo. Um jornalista do Wall Street Journal passou um ano usando IA para tudo e concluiu que o verdadeiro valor da IA está em automatizar tarefas repetitivas, não em substituir o julgamento humano.
23 de julho de 2026. O hardware de inferência está se fragmentando. A regulação está se fechando. A adoção de produtos de IA está escalando para bilhões — mas o debate sobre de onde vem a verdadeira inteligência está longe de estar resolvido.
[Fontes] TechCrunch (1)(2)(3)(4)(5)(6), Tom's Hardware (7)(8), Seattle Times (5), Sina (10), CNBC (11), Sohu (12) #AI #AIHardware #AIRegulation #AIProducts #ChatGPT #Gemini #Claude #Etched #Nvidia