Publicado por DogTV ·
Los modelos de IA de código abierto igualan o se acercan al rendimiento de la frontera de código cerrado a una fracción del coste, mientras el ecosistema abierto de China gana impulso.
El 31 de julio, DeepSeek lanzó la versión oficial de V4-Flash a través de la documentación de su API. Los resultados de referencia publicados el 1 de agosto por Artificial Analysis otorgan a V4-Flash 0731 una puntuación de Índice de Inteligencia de 50, un punto por debajo de los 51 de GPT-5.6 Luna, pero con un coste por tarea un 60 % inferior en la propia API de DeepSeek. La diferencia proviene de un descuento por acierto de caché de aproximadamente el 98 %, muy por encima del estándar de la industria del 90 %. En la Frontend Code Arena de Arena.ai, un referente de preferencia humana para desarrollo web, V4-Flash-High alcanzó 1586 puntos, ocupando el séptimo puesto general y el tercero entre los modelos abiertos. Precio: 0,14 dólares por millón de tokens.
El 4 de agosto, Alibaba anunció Qwen3.8-Max, un modelo de 2,4 billones de parámetros con 95 000 millones de parámetros activos. Qwen afirma que publicará los pesos en código abierto la próxima semana, la primera vez que un modelo de nivel Max de la serie Qwen se publica abiertamente. El precio de la API se fija en 2 dólares por millón de tokens de entrada y 6 dólares por millón de tokens de salida.
MiniMax lanzó H3, un modelo de código abierto que encabeza los referentes de generación de video tanto en tareas de texto a video como de imagen a video. H3 maneja texto, imagen, video y audio en un contexto multimodal unificado, produciendo hasta 15 segundos de video 2K nativo de doble canal con audio.
El 3 de agosto, el director ejecutivo de Hugging Face, Clément Delangue, declaró a CNBC que China está «ganando la carrera de la IA», citando un ecosistema donde los modelos abiertos y el desarrollo colaborativo generan un progreso más rápido que el enfoque aislado de los laboratorios de frontera estadounidenses. Predijo que China podría dominar tanto los modelos abiertos como la IA de frontera para finales de este año o el próximo. Delangue señaló que cuando un agente no publicado de OpenAI atacó la plataforma de Hugging Face en julio, la empresa utilizó el GLM 5.2 de código abierto de Zhipu para la defensa; los modelos cerrados no pudieron aprovecharse debido a las barreras de seguridad de la API. Por otra parte, a finales de julio, más de veinte empresas, incluidas Nvidia, Microsoft, Meta y OpenAI, enviaron una carta conjunta al gobierno de EE. UU. instando a no restringir los modelos de IA de pesos abiertos.
Los ingresos en la nube impulsados por la IA están llevando las valoraciones de los hiperescaladores a nuevos máximos, mientras las startups de chips y las firmas de capital de riesgo invierten miles de millones en el despliegue de infraestructura.
El 4 de agosto, la capitalización de mercado de Amazon superó los 3 billones de dólares por primera vez, impulsada por resultados del segundo trimestre mejores de lo esperado. La compañía reportó un beneficio por acción ajustado de 1,97 dólares frente a las expectativas de 1,82, con ingresos de 200 600 millones de dólares. El director ejecutivo, Andy Jassy, elevó la previsión de gasto de capital para 2026 de 200 000 a 220 000 millones de dólares, citando necesidades de infraestructura de IA y el aumento de los precios de los chips de almacenamiento. Jassy dijo a los inversores que la empresa aún carece de capacidad suficiente para satisfacer la demanda de 2026 y calificó la demanda de 2028 como «ya asombrosa». El fundador Jeff Bezos presentó una solicitud para vender 15 millones de acciones por un valor aproximado de 4100 millones de dólares.
El 3 de agosto, la startup británica de chips Olix anunció una ronda de serie B de 312 millones de dólares con una valoración de 3300 millones, más del triple de su valoración de 1000 millones de febrero. Fundada por James Dacombe, de 25 años, Olix está desarrollando un procesador digital óptico con una «novedosa arquitectura de memoria e interconexión» para inferencia de IA. La empresa sostiene que el uso de chips de propósito general para cada etapa de la producción de tokens está alcanzando los límites de eficiencia, y que un cambio hacia chips especializados por etapa desbloqueará un cambio radical en el coste y el rendimiento de la IA. Entre los inversores se encuentran Arm, Hudson River Trading, el cofundador de Netflix, Reed Hastings, y el fondo Sovereign AI del gobierno británico. El exdirector financiero de Wise, Matt Briers, se incorporó como director financiero; el profesor de Stanford y exejecutivo de Intel, Nick McKeown, se unió a la junta. Olix planea entregar sus primeros productos a los clientes el próximo año.
El 1 de agosto, Index Ventures anunció que recaudó 2000 millones de dólares en nuevo capital a través de fondos semilla, de capital riesgo y de crecimiento, elevando el capital total disponible a 3500 millones. La firma con sede en Londres calificó la IA como una tecnología que está «poniendo el poder de construir en más manos que nunca» y ya ha invertido en Mistral, Cohere y la startup del exinvestigador de DeepMind, David Silver, Ineffable Intelligence.
La Ley de IA de la UE entra en vigor y el director ejecutivo de Palantir lanza una dura advertencia sobre los laboratorios de frontera: dos acontecimientos que configuran la forma en que las empresas adoptan la IA.
El 2 de agosto entraron en vigor las disposiciones de transparencia y clasificación de riesgos de la Ley de IA de la UE. Las empresas ahora deben etiquetar el contenido generado por IA e informar a los usuarios cuando interactúan con una IA en lugar de un humano. Las ultrafalsificaciones deben llevar marcadores legibles por máquina. La Oficina de IA supervisa a los proveedores de modelos de IA de propósito general, mientras que los reguladores nacionales manejan la mayoría de los demás sistemas de IA. Las infracciones pueden conllevar multas de hasta el 3 % del volumen de negocios global anual. Peter Van Dyck, socio del bufete de abogados A&O Shearman, afirmó que las normas están «causando una gran preocupación a los laboratorios de IA de EE. UU.» y que cualquier laboratorio con clientes europeos entra ahora dentro del ámbito de aplicación.
El 3 de agosto, Palantir reportó ingresos del segundo trimestre de 1900 millones de dólares, un 93 % más interanual, con 1100 millones de beneficios, más beneficio en un solo trimestre que los ingresos totales del mismo trimestre del año anterior. En su carta a los accionistas, el director ejecutivo Alex Karp describió la industria de la IA con «connotaciones marxistas», argumentando que los laboratorios de IA de frontera «pretenden, conscientemente o no, apoderarse de los medios de producción de sus supuestos socios». En la llamada de resultados, advirtió a las empresas que pagar por tokens de IA equivale a financiar la migración de su propiedad intelectual y experiencia a modelos competidores. Palantir se posiciona como agnóstico en cuanto a modelos, permitiendo a las organizaciones controlar tanto sus datos como su «escape» de IA.
Por otra parte, el 2 de agosto surgieron informes de que Microsoft está probando MAI Realtime, su primer modelo de voz de IA nativamente dúplex completo. El modelo admite 16 idiomas, incluidos chino, japonés y coreano, y ofrece dos estilos de voz. A diferencia de los sistemas por turnos, puede escuchar y hablar simultáneamente con detección automática de idioma y cambio a mitad de conversación. No se ha fijado una fecha de lanzamiento público.
En la frontera de la investigación, OpenAI reveló que una versión interna de su modelo Astra logró avances en diez problemas matemáticos y de informática teórica que habían permanecido sin resolver durante al menos una década, con un coste total en tokens de aproximadamente 2000 dólares.