
Englische Version oben, chinesische Version unten.
Am 17. August trat die Spitzen-/Nebenzeiten-API-Preisgestaltung von DeepSeek in Kraft. Während der Spitzenzeiten (9:00–12:00, 14:00–18:00 Uhr Pekinger Zeit) kostet die Nutzung das Doppelte des Nebenzeiten-Tarifs; der Spitzenpreis für den v4-flash-Modell-Output liegt bei 9,0 Yuan pro Million Token. IT Home berichtete, dass in den fünf Stunden nach der Preiserhöhung das Flash-Modell-Anrufvolumen von OpenCode Go um 94 % zurückging. Vor der Anpassung lag der Preis für Cache-Treffer-Eingaben bei DeepSeek V4 Pro bei 0,025 Yuan pro Million Token, nicht zwischengespeicherte Eingaben bei 3 Yuan und die Ausgabe bei 6 Yuan.
Am selben Tag veröffentlichte DeepSeek Harness, eine MIT-lizenzierte, pluginbasierte Agenten-Laufzeitumgebung, die auf dem Cordis-Meta-Framework aufbaut. Das Kernkonzept lautet „Alles ist ein Plugin“: das Modell, Werkzeuge, Fähigkeiten, Sitzungen, die Sandbox, die Agenten-Schleife und sogar die Web-Benutzeroberfläche sind austauschbare Module. Vier voreingestellte Modi – Standard, PTC (TypeScript-komponierte Werkzeugaufrufe), Minimal und Kreativ – stellen verschiedene Werkzeug- und Fähigkeitssätze auf derselben Laufzeitumgebung zusammen. Das Projekt befindet sich in der Entwicklervorschau, mit dem offiziellen Hinweis, dass Breaking Changes folgen können.
Am 16. August berichtete Bloomberg, dass Stripe kurz davor steht, OpenRouter für über 7 Milliarden US-Dollar zu kaufen. OpenRouter hat 8 Millionen Nutzer und bietet Zugang zu mehr als 400 Modellen; der Kaufpreis liegt mehr als das Fünffache über der letzten Finanzierungsrunde.
Diese drei Punkte bewegen sich auf derselben Achse. Vor zwei Jahren lautete die KI-Geschichte noch, welches Labor das größte Modell veröffentlicht hat; jetzt liegt der Fokus darauf, wer die Schicht zwischen dem Modell und seiner Arbeit besitzt – Preishebel, Laufzeit-Frameworks und Modell-Gateways.
OpenAI löste Ende Juli sein Preparedness-Risikobewertungsteam auf, berichtete die Financial Times am 17. August. Die Zuständigkeiten des Teams – die Bewertung großer Modellrisiken und die Entwicklung von Gegenmaßnahmen – wurden nach Teilbereichen in Biosicherheit, Cybersicherheit und andere operative Teams aufgeteilt. Dies folgt auf die frühere Auflösung der Teams für AGI-Bereitschaft und Superalignment. Die Ethik-Leiterin Chloe Bakalar, der Chief Futurist Josh Achiam und der Sicherheitschef Johannes Heidecke haben das Unternehmen kürzlich verlassen. Dylan Scandinaro, der im Februar von Anthropic kam, um Preparedness zu leiten, konzentriert sich nun auf rekursive Selbstverbesserung.
Am 17. August berichtete IT Home außerdem, dass Anthropic einen Börsengang im September plant. CEO Dario Amodei veröffentlichte einen seltenen langen Beitrag, in dem er auf die Kritik an der „Vertrauenskrise“ einging, vorhersagte, dass KI innerhalb von fünf bis zehn Jahren die meisten Krankheiten heilen werde, und dies mit dem Tod seines Vaters im Jahr 2006 an Hepatitis C verknüpfte, bevor die Heilungsraten 2010 auf 95 % stiegen. Der Fidelity-Investor Gavin Baker sagte, Amodei habe einmal angedeutet, dass Anthropic das einzige private Unternehmen der Welt werden könnte; Sholto Douglas von Anthropic nannte diese Behauptung Unsinn, und Amodei argumentierte, dass die Darstellung „Regulierung = regulatorische Vereinnahmung“ eine falsche Dichotomie sei.
Nvidia reduzierte seine Garantie für die Finanzierung des Rechenzentrums von OpenAI in Ohio. Reuters berichtete am 14. August unter Berufung auf das Wall Street Journal, dass die anfängliche Garantie nun voraussichtlich unter 120 Milliarden US-Dollar liegt, nachdem zuvor von 250 Milliarden US-Dollar die Rede war – getrieben von Bedenken der Investoren hinsichtlich des Risikoengagements.
Alibaba verkaufte seine Spielesparte Lingxi Interactive Entertainment für mindestens 1,5 Milliarden US-Dollar an Trustar Capital, berichtete IT Home am 17. August, und beschleunigt damit seinen Wandel hin zur KI.
Anthropic begann damit, SynthID-Text-Wasserzeichen in von Claude generierte Texte für Modelle einzubetten, die ab dem 2. August veröffentlicht wurden. Das Wasserzeichen ist maschinenlesbar, übersteht Kopieren und Einfügen und widersteht leichten Bearbeitungen. Ein dazu veröffentlichtes Paper beschreibt „Mind-Viren“, die selbstmodifizierende SOUL.md-Dateien zwischen KI-Agenten verbreiten; vier Testnutzlasten bestanden einen 20-Hop-Stresstest.
Am 17. August bestätigte das Internet-Informationsbüro von Shenzhen, dass ein weit verbreitetes Video eines „großflächigen Straßeneinbruchs mit einem umgestürzten Fahrzeug“ KI-generiert und zusammengeschnitten war. Das tatsächliche Ereignis am 4. August war ein Schlagloch von über 10 Kubikmetern auf einer Hauptverkehrsstraße der Binhai Avenue, ohne dass ein Fahrzeug umkippte.
McAfee Labs stellte fest, dass KI den Standort von Reisefotos mit einer Genauigkeit von 87%–91% anhand visueller Hinweise – Gebäude, Ladenschilder, Straßenmarkierungen, Vegetation, Wahrzeichen – identifizieren kann, selbst nachdem GPS- und EXIF-Daten entfernt wurden. Forscher wiesen auf die Kombination mit Phishing als steigendes Risiko für personalisierten Betrug hin.
Am 17. August erlitt Claude einen schwerwiegenden Ausfall, der gegen 5:58 Uhr Pekinger Zeit begann und Claude.ai, Claude Code und Claude Cowork betraf; Anthropic stufte dies als schwerwiegenden Ausfall ein, während Console und API weiterhin betriebsbereit blieben, und der Dienst wurde noch am selben Morgen wiederhergestellt.
Am 17. August reichte Biren Technology eine Ankündigung an der Hongkonger Börse ein, in der ein Umsatz im ersten Halbjahr 2026 von 1.15–1.3 Milliarden Yuan prognostiziert wurde, ein Anstieg um 1.852 %–2.107 % gegenüber 58,9 Millionen Yuan im Vorjahr. Der bereinigte Verlust verringerte sich um 35 %–47 %, und das Unternehmen führt das Wachstum auf die Nachfrage nach Grafikprozessoren für allgemeine Berechnungen (GPGPU) durch KI-Codierung, langfristige Agentenaufgaben und generative KI zurück.
Der KI-Index 2026 von Stanford, veröffentlicht am 16. August, ergab, dass 84 % der chinesischen Befragten von KI begeistert sind, verglichen mit 38 % in den Vereinigten Staaten; das Vertrauen liegt laut Edelman-Umfrage bei 72 % zu 32 %. Der Bericht stellt außerdem fest, dass sich die Leistungslücke zwischen den USA und China seit Anfang 2025 weitgehend geschlossen hat und die Modelle sich in der Führung abwechseln.
First Financial berichtete, dass Guangdong ein „Token-Darlehen“-Produkt eingeführt hat, bei dem die Token-Ausgabe/der Token-Verbrauch eines Unternehmens und der Wert von Compute-Dienstleistungsverträgen als Kreditgrundlage dienen. Die Zhangjiagang Rural Commercial Bank vergab im Mai ihr erstes „Compute-Darlehen“ über 1 Million Yuan, mit einem Basiskredit von bis zu 10 Millionen Yuan und bis zu 50 Millionen Yuan mit Compute-Gutschein-Verbesserung.