Ein Startup startet sechs KI-Teams, die Ihren kompletten Kundenservice-Software-Stack ersetzen
Stellen Sie sich vor, Sie brauchen kein Telefon mehr, kein Ticketsystem, kein Planungstool und kein Qualitäts-Dashboard, sondern stattdessen sechs virtuelle Mitarbeitende, die all das übernehmen. Das ist die Wette von Crescendo, die am 25. August CXP startet: sechs spezialisierte KI-Agenten (Concierge, Agent Assist, Quality, Workforce, Optimisation, Knowledge) ersetzen sechs klassische Software-Tools. Für ein 50-Personen-Unternehmen mit 500 Tickets pro Tag ändert sich konkret: Statt sieben Abos und drei Integrationspartner zu zahlen, konfigurieren Sie in vier Wochen sechs Agenten. Ob die Wette über 90 Tage hält, bleibt abzuwarten. Quelle : https://crescendo.ai/news/crescendo-launches-the-ai-native-customer-experience-platform/
NVIDIA liefert seinen ersten Prozessor, der für KI-Agenten gebaut ist -- OpenAI, Anthropic und AWS haben ihren bereits
NVIDIAs Vera-Prozessor, entworfen für die ununterbrochenen Aufgaben von KI-Agenten, geht jetzt in großem Maßstab in die Auslieferung. AWS erhielt seine erste Maschine am 27. August in Seattle. Oracle stellt bereits in großem Maßstab bereit. OpenAI, Anthropic und ein Raumfahrt-Akteur erhielten ihre Geräte zwischen Mai und Juli. Für Teams, die einen Kundenservice-Agenten betreiben, ist die konkrete Änderung diese: Weil jeder Agenten-Aufruf viel mehr Rechenleistung verbraucht als ein einfacher Chat, ist die CPU wieder der Engpass. NVIDIA verspricht 1,8x schneller pro Kern bei Agenten-Workloads. Quelle : https://blogs.nvidia.com/blog/vera-cpu-delivery/
China veröffentlicht ein freies KI-Modell, das GPT in Cybersicherheit schlägt -- fünfte chinesische Veröffentlichung in fünf Tagen
Das chinesische Labor Z.ai hat am 29. August die offenen Gewichte von GLM-5.3 veröffentlicht: ein Modell mit 753 Milliarden Parametern, von denen pro Frage nur 40 Milliarden aktiv sind. Für nicht-technische Leser: Sie können es herunterladen und zu Hause laufen lassen, ohne Abonnement. Es führt zwei Cybersicherheits-Benchmarks an (84,5 % auf CyberGym, Rekord auf Terminal Bench 3.0). Der Preis ist veröffentlicht: einige Cent pro Million gelesener Wörter, weniger als ein Kaffee für ein ganzes Gespräch. Das ist die fünfte große chinesische Veröffentlichung in fünf Tagen -- die Maschine macht am Wochenende keine Pause mehr. Quelle : https://huggingface.co/zai-org/GLM-5.3
NVIDIA veröffentlicht ein kleines energieeffizientes KI-Modell und einen intelligenten Router -- damit Agenten im falschen Moment nicht abstürzen
Am 11. August hat NVIDIA Nemotron 3.5 Lightning kostenlos veröffentlicht: ein Modell mit 31 Milliarden Parametern, von denen pro Frage nur 3,6 Milliarden aktiv sind, gedacht für einen einzigen Server. Dazu gehört NeMo Switchyard, ein Router, der für jede eingehende Aufgabe das passende Tool auswählt (schnelle Antwort oder tiefe Analyse), damit man nicht für alles den Premiumpreis zahlt. Für ein Startup, das Support automatisiert, kann die Cloud-Rechnung laut ersten Erfahrungen um mehr als die Hälfte sinken. Das Modell erreicht 51,6 % im SWE-bench-Test. Quelle : https://blogs.nvidia.com/blog/nemotron-lightning-switchyard-rtx-dgx/
US-Richter entscheidet: 1,5 Milliarden Dollar für 7 Millionen Bücher ohne Erlaubnis -- neue Spielregel für die gesamte KI-Branche
Der Vergleich im Verfahren Bartz gegen Anthropic erhielt am 20. Juli die endgültige gerichtliche Zustimmung, die Zahlungen begannen am 10. August. Anthropic hatte rund 7 Millionen Werke ohne Zustimmung heruntergeladen, was im Durchschnitt etwa 3.100 Dollar pro Buch ausmacht, und wird die Kopien vernichten. Für einen Unternehmer, der KI in einem Produkt einsetzen will, ändert sich konkret: Die Frage „Darf ich dieses Modell in Europa überhaupt nutzen?“ hat jetzt einen offiziellen Preis. Google, Meta, Midjourney und OpenAI stehen vor ähnlichen Klagen -- ein Markt für Trainingsdaten-Versicherungen ist jetzt lösbar. Quelle : https://anthropiccopyrightsettlement.com/
Seit dem 2. August muss jeder professionelle Chatbot sich als KI zu erkennen geben und jedes erzeugte Bild muss mit Wasserzeichen versehen werden. Der Digital Omnibus (EU-Verordnung 2026/1744) verschiebt die schwersten Pflichten auf Dezember 2027, aber die Transparenzregeln greifen sofort. Für jedes kleine Unternehmen, das in Europa verkauft, ist es an der Zeit, einen rechtlichen Hinweis in den Chatbot einzubauen. 78 % der europäischen Organisationen sind noch nicht bereit. Quelle : https://digital-strategy.ec.europa.eu/
Linux-Sicherheitspatch vor Bundes-Frist fällig
Am 28. August hat die US-Behörde CISA die Ausnutzung eines Linux-Kernels durch einen KI-Agenten (CVE-2026-53362) in ihren offiziellen Katalog von zwingend zu patchenden Schwachstellen aufgenommen. Bundesbehörden müssen den Patch bis zum 30. August anwenden. Es ist der erste Vorfall, in dem ein KI-Agent eine bundesweite Patch-Pflicht ausgelöst hat. Beobachtenswert für jede Organisation, die Agenten auf Standard-Hardware betreibt. Quelle : https://www.cisa.gov/known-exploited-vulnerabilities-catalog
Chinesische Veröffentlichungs-Kadenz lässt nicht nach -- nächste Welle diese Woche erwartet
Nach fünf Lieferungen in fünf Tagen (GLM-5.3-Flash, Qwen3.8 Flash, Ling 3.0 Fin, Tencent Hy4, vollständiges GLM-5.3) werden die Labore DeepSeek, Qwen-Team, Moonshot oder ByteDance wahrscheinlich in den folgenden fünf Tagen nachziehen. Der durchschnittliche Nutzungspreis ist bei den wettbewerbsstärksten Releases unter 1 Euro pro Million gelesener Wörter gefallen -- ein Game-Changer für die Integration in europäische KMU. Quelle : https://huggingface.co/zai-org/GLM-5.3-Flash
Erste großflächige Bereitstellung von Vera + Rubin bei Oracle Cloud
Oracle wird der erste große Cloud-Anbieter, der das neue Paar Vera CPU + Rubin GPU im industriellen Maßstab bereitstellt. Angepeiltes Ziel: Hunderttausende Vera-CPUs bis Ende 2026 in Betrieb. Für Teams, die ihre Agenten in der Cloud hosten, sollte der Preis pro Million Wörter in den kommenden Monaten sinken -- zu überprüfen anhand unabhängiger Benchmarks. Quelle : https://blogs.nvidia.com/blog/vera-cpu-delivery/
📊 Trend
Sonntag, 30. August 2026: Das Wochenende stoppt die Maschine nicht mehr. Chinesische Labore haben den westlichen Kalender Uebersprungen und ihre fuenfte Open-Weight-Veroeffentlichung in fuenf Tagen ausgeliefert (vollstaendiges GLM-5.3, nach Tencent Hy4 und Qwen3.8 Flash). Gleichzeitig verteilt NVIDIA in grossem Massstab eine CPU, die speziell fuer Agenten entwickelt wurde -- Hardware ist jetzt ein anerkannter Engpass. Kundenseitige Unternehmen nehmen ihre eigene Wendung: Crescendo setzt darauf, den gesamten Kundenservice-Stack durch sechs spezialisierte Agenten zu ersetzen, statt eine duenne KI-Schicht darueberzulegen. Und die US-Gerichte haben erstmals den Preis fuer Buecher festgelegt, die ohne Erlaubnis zum Training eines Modells verwendet wurden: 1,5 Milliarden Dollar -- ein Massstab, der jede kommende Verhandlung im Sektor beeinflussen wird.