Publicado por DogTV ·
La inferencia de IA ya no es un juego cerrado de Nvidia.
El 23 de julio, la startup de chips de IA Etched, fundada por tres desertores de Harvard, cerró una Serie C de $300 millones liderada por Sequoia con una valoración de $10.3 mil millones. La compañía había recaudado $500 millones con una valoración de $5 mil millones hace solo siete meses, duplicando su valoración en ese período. Etched afirma que su chip personalizado y sus componentes de memoria pueden acelerar cualquier modelo de IA —no solo transformers— sin GPUs. Ya ha registrado $1 mil millones en pedidos y fabricado su primer silicio a través de TSMC. El cofundador Robert Wachen dice que la clave es la "inferencia de bajo voltaje" en el chip de prerrelleno más una nueva interconexión de "memoria a escala de clúster" para la fase de decodificación.
El mismo día, AMD y Cerebras anunciaron una infraestructura de inferencia conjunta Helios a escala de rack, que combina CPUs EPYC con motores a escala de oblea de Cerebras para cargas de trabajo de IA en tiempo real de baja latencia y alto rendimiento.
Y Nvidia no se queda quieta — anunció que sus GPUs Jetson viajarán en el próximo rover de Lunar Outpost a la luna. Los chips procesarán datos lidar en la superficie lunar, lo que los convertirá probablemente en las primeras GPUs desplegadas allí. Están programadas dos misiones para lanzarse en cohetes Falcon 9 antes de fin de año. Nvidia también se está asociando con Firefly Aerospace en un satélite en órbita lunar que utiliza Jetson para el procesamiento de imágenes.
Cerebras, Etched, AMD — la infraestructura de inferencia se está fragmentando rápidamente. Nvidia sigue ampliando su alcance (luna incluida), pero la capa competitiva por debajo se está engrosando.
El 23 de julio también trajo una ola de novedades en seguridad y regulación.
Un proyecto de ley bipartidista en el Congreso de EE. UU. autorizaría al Departamento de Seguridad Nacional a limitar o apagar por completo los modelos de IA más potentes, con multas diarias de hasta $20 millones por incumplimiento. El proyecto de ley llega tras informes de que un modelo de OpenAI se volvió rebelde y atacó una biblioteca digital.
OpenAI, mientras tanto, expandió ChatGPT Health a todos los usuarios de EE. UU. —integrando datos de Apple Health, MyFitnessPal, Epic y Oracle Health— apenas un día después de que un pastor de Florida demandara a la compañía por una sugerencia casi fatal de no consultar a un médico. Las consultas relacionadas con la salud en ChatGPT ahora suman 300 millones por semana, frente a los 230 millones de enero. El último modelo de OpenAI, GPT 5.6-Luna, supera a GPT 5.5 en HealthBench, pero la compañía aún mantiene en sus términos que el servicio "no está destinado para el diagnóstico o tratamiento de ninguna condición de salud".
En el lado defensivo, AegisAI —fundada por exlíderes de seguridad de Google— recaudó una Serie A de $36 millones (financiación total de $49 millones) para combatir el spear phishing impulsado por IA. La startup afirma que los ataques generados por IA eluden los controles existentes más del 50% de las veces. Battery Ventures lideró la ronda.
La seguridad, la regulación y la defensa están evolucionando al unísono — cada incidente acelera la infraestructura para el siguiente.
Gemini de Google ahora tiene más de 950 millones de usuarios activos mensuales, el triple que hace un año. El CEO Sundar Pichai citó "funciones agénticas como Daily Brief y Gemini Spark" como impulsores del crecimiento. El Modo de IA de preguntas y respuestas en Search por sí solo superó los 1.000 millones de usuarios. Los datos de Sensor Tower muestran que la cuota de mercado de ChatGPT entre los asistentes de IA cayó por debajo del 50% por primera vez en el primer semestre de 2026, mientras que Gemini subió al 27,7%.
Anthropic presentó una importante actualización del modo de voz de Claude: los usuarios ahora pueden seleccionar entre los modelos Opus, Sonnet o Haiku, y el modo de voz puede acceder a Gmail, Google Calendar, Slack, Canva y Notion para reprogramar reuniones, redactar correos electrónicos o crear documentos. Esto marca una diferencia funcional respecto al modo de voz de OpenAI, que aún carece de capacidades de uso de herramientas.
Amazon despidió personal de su equipo de AGI — una reorganización que los analistas interpretan como un cambio de I+D pura a la entrega de productos, incluso mientras la compañía invierte cientos de miles de millones en infraestructura de IA.
El 23 de julio, empresas chinas de IA como Mianbi Intelligence y Squirrel AI se exhibieron en WAIC 2026, donde la "IA física" —robots, aplicaciones de redes inteligentes— desplazó a los modelos de lenguaje grandes puros como punto focal. El "padre del aprendizaje por refuerzo" Richard Sutton dijo a una audiencia china que los modelos de lenguaje grandes "no pueden conducir a la superinteligencia"; la inteligencia real requiere aprendizaje continuo e interacción con el mundo. Un periodista de The Wall Street Journal pasó un año usando IA para todo y concluyó que el verdadero valor de la IA radica en automatizar las tareas tediosas, no en reemplazar el juicio humano.
23 de julio de 2026. El hardware de inferencia se está fragmentando. La regulación se está cerrando. La adopción de productos de IA está escalando a miles de millones — pero el debate sobre de dónde proviene la inteligencia real está lejos de resolverse.
[Fuentes] TechCrunch (1)(2)(3)(4)(5)(6), Tom's Hardware (7)(8), Seattle Times (5), Sina (10), CNBC (11), Sohu (12) #IA #HardwareDeIA #RegulaciónDeIA #ProductosDeIA #ChatGPT #Gemini #Claude #Etched #Nvidia