Zum Inhalt springen
Alle KI-News

KI-News · KW 38/2026

Google Gemini 3.8 Live und OpenAI GPT-Live-1 für Sprachdialoge

· 10 Meldungen · 28 Quellen

KI-gestützt erstellt, Quellen je Meldung verlinkt

Google stellt Gemini 3.8 Live für Sprachdialoge mit visuellem Kontext vor. OpenAI bringt mit GPT-Live-1 ein Modell in die API, das gleichzeitig zuhören und sprechen kann. DeepSeek-V4.1-Flash benötigt weniger KV-Cache als sein Vorgänger. Außerdem verbindet ChatGPT for Financial Services ChatGPT mit lizenzierten Finanzdaten.

1 Modelle Bild, Video & AudioOpen SourceKI im Unternehmen

DeepSeek-V4.1-Flash senkt den Cachebedarf

DeepSeeks neues multimodales Modell mit 552 Milliarden Parametern benötigt weniger KV-Cache als sein Vorgänger. Die Modellgewichte sind verfügbar.

DeepSeek hat DeepSeek-V4.1-Flash am 10. September vorgestellt und die Modellgewichte auf Hugging Face veröffentlicht.12 Das multimodale Mixture-of-Experts-Modell hat einen Backbone mit 552 Milliarden Parametern und ist über die DeepSeek API verfügbar.12 Die Angaben zum 552-Milliarden-Modell und zum verringerten Cachebedarf beziehen sich damit auf dieselbe Veröffentlichung.12

DeepSeek setzt auf eine Causal-Encoder-Decoder-Architektur, um die Bereitstellung des Modells effizienter zu machen.1 Laut technischem Bericht benötigt der persistente KV-Cache nur etwa ein Achtel des Speichers von DeepSeek-V4-Flash.1 Das ist insbesondere für Anwendungen mit langen Eingaben relevant: Weniger Cache kann den Speicherbedarf und damit die Betriebskosten senken. Wie groß die Einsparung pro Anfrage tatsächlich ausfällt, lässt sich aus dem Cachevergleich allein nicht bestimmen.1

Was das für Unternehmen bedeutet

Wenn du lange Eingaben über eine API verarbeitest, teste Speicherbedarf, Latenz und Kosten mit deinen eigenen Anfragen. Prüfe bei bestehenden DeepSeek-Integrationen außerdem, welches Modell deine API-Route aktuell aufruft.

Quellen (2)
  1. 1 deepseek-ai/DeepSeek-V4.1-Flash huggingface.co
  2. 2 Introducing DeepSeek-V4.1-Flash: smarter, faster, more efficient. deepseek.com
2 Modelle Bild, Video & AudioChatbots & AssistentenKI im Unternehmen

Google stellt zwei Gemini-Modelle für Live-Sprachdialoge vor

Gemini 3.8 Live verarbeitet Sprache und visuellen Kontext. Eine zweite Variante soll bei komplexeren Aufgaben schlussfolgern und gleichzeitig sprechen.

Google hat am 15. September 2026 zwei Modelle für Live-Sprachdialoge vorgestellt: Gemini 3.8 Live und Gemini 3.8 Live Extended Thinking. Das erste Modell soll Gespräche flüssiger machen und visuelle Informationen einbeziehen. Die Extended-Thinking-Variante soll komplexere Aufgaben mit mehrstufigem Schlussfolgern bearbeiten und dabei gleichzeitig sprechen können. Der Zugang wird über Entwicklerangebote, Unternehmensprodukte und Search Live ausgerollt.1

Google richtet die Modelle damit auf Anwendungen aus, die Sprache, visuellen Kontext und Aufgabenbearbeitung in einer laufenden Unterhaltung verbinden. Beide Modelle können visuelle Informationen in Echtzeit verarbeiten und Werkzeuge im Hintergrund ausführen.12 Das ist für Sprachassistenten relevant, die während eines Gesprächs auf neue Informationen reagieren müssen, statt nur einzelne Anfragen zu beantworten. Wie zuverlässig das in konkreten Arbeitsabläufen funktioniert, sollten Unternehmen vor einem produktiven Einsatz prüfen.

Was das für Unternehmen bedeutet

Wenn du Sprachassistenten für Kunden oder interne Abläufe entwickelst, teste Gespräche mit Sprachwechseln, visuellem Kontext und Werkzeugaufrufen. Prüfe besonders, ob Antworten bei längeren, komplexen Aufgaben zuverlässig bleiben.

Quellen (3)
  1. 1 Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking blog.google
  2. 2 Build real-time voice applications with Gemini 3.8 Live and 3.5 ... blog.google
  3. 3 Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking x.com
3 Modelle Bild, Video & AudioChatbots & AssistentenKI im Unternehmen

OpenAI bringt GPT-Live-1 für Sprachdialoge in die API

GPT-Live-1 kann gleichzeitig zuhören und sprechen. Entwickler können das Modell für Sprachdialoge über die OpenAI-API nutzen.

OpenAI hat GPT-Live-1 am 10. September 2026 über seine API verfügbar gemacht. Das Modell kann gleichzeitig zuhören und sprechen, statt Eingaben und Antworten strikt nacheinander abzuarbeiten.12 Entwickler sollen damit Sprachdialoge umsetzen können, die Pausen, Unterbrechungen und kurze Bestätigungssignale berücksichtigen.2 OpenAI stellt die Veröffentlichung als Möglichkeit dar, Sprachinteraktionen nach dem Vorbild von ChatGPT über die API anzubieten.1

Für komplexere Aufgaben lässt sich GPT-Live-1 mit separaten Modellen zur Verarbeitung im Hintergrund und mit Tools verbinden.12 So kann die unmittelbare Sprachinteraktion von weiteren Verarbeitungsschritten getrennt werden. Bei der Kalkulation ist zu beachten, dass OpenAI die Sprachschicht sowie zusätzliche Modelle und Tools getrennt abrechnet.2 Öffentliche Vergleichswerte zur Qualität nennt die Ankündigung nicht.12

Was das für Unternehmen bedeutet

Wenn du Sprachassistenten entwickelst, kannst du GPT-Live-1 für Dialoge mit Unterbrechungen prüfen. Kalkuliere dabei nicht nur die Sprachschicht, sondern auch separat abgerechnete Modelle und Tools.

Quellen (2)
  1. 1 Build more natural voice experiences with GPT‑Live‑1 in the API openai.com
  2. 2 Introducing GPT-Live-1 in the API - Announcements - OpenAI ... community.openai.com
4 Produkte & Tools KI im UnternehmenChatbots & Assistenten

OpenAI stellt ChatGPT for Financial Services vor

Das Angebot verbindet ChatGPT mit lizenzierten Finanzdaten und Werkzeugen für die Analyse. Ein Echtzeitkursfeed ist nicht bestätigt.

OpenAI hat ChatGPT for Financial Services am 10. September vorgestellt. Das Angebot richtet sich unter anderem an Investmentbanker und Aktienanalysten. Es verbindet ChatGPT mit lizenzierten Finanzdaten und Werkzeugen für deren Arbeitsabläufe; laut Berichten kommt GPT-6 Astra zum Einsatz. Antworten sollen sich auf Quelldokumente wie Unternehmensberichte zurückführen lassen.123

Damit zielt OpenAI auf Finanzarbeit, bei der umfangreiche Dokumente ausgewertet und Aussagen belegt werden müssen. Nach Angaben von Reuters hat das Unternehmen die eingebundenen Daten auf eigener Infrastruktur indexiert, um Suche und Quellenangaben zu verbessern. Ein ausdrücklich zugesicherter Echtzeitkursfeed geht aus den verfügbaren Angaben nicht hervor. Der Zugang ist auf berechtigte Institutionen beschränkt, die sich direkt an OpenAI wenden müssen. Ein Preis wurde nicht veröffentlicht.124

Was das für Unternehmen bedeutet

Wenn du Finanzanalysen mit KI unterstützt, prüfe, welche Datenquellen verfügbar sind und ob Belege bis zum Originaldokument führen. Kläre vor einem Einsatz Zugangsbedingungen, Datenrechte und interne Prüfpflichten.

Quellen (4)
  1. 1 OpenAI launches ChatGPT for financial services industry - Reuters reuters.com
  2. 2 Introducing ChatGPT for Financial Services openai.com
  3. 3 OpenAI ChatGPT for Financial Services targets work of junior bankers cnbc.com
  4. 4 OpenAI courts Wall Street with ChatGPT for financial ... fortune.com
5 Modelle Coding & EntwicklungKI im Unternehmen

OpenAI entfernt GPT-5.5 im Oktober aus ChatGPT und Codex

GPT-5.5 soll am 14. Oktober aus ChatGPT, ChatGPT Work und Codex verschwinden. Für Codex nennt OpenAI zwei Alternativen; über die API bleibt das Modell verfügbar.

OpenAI will GPT-5.5 am 14. Oktober 2026 aus ChatGPT, ChatGPT Work und Codex entfernen.1 Nutzern von Codex empfiehlt das Unternehmen den Wechsel zu GPT-5.6 Sol oder GPT-6 Astra.1 Das ist kein vollständiges Ende des Modells: Über die OpenAI API Platform soll GPT-5.5 weiterhin verfügbar sein.1

Für Unternehmen ist damit entscheidend, über welchen Zugang sie das Modell einsetzen. Wer GPT-5.5 in Codex nutzt, sollte betroffene Abläufe vor dem Termin mit den genannten Alternativen prüfen; aus der Ankündigung ergibt sich dagegen kein Abschalttermin für die API.1 OpenAI bezeichnet GPT-6 Astra in seiner Sicherheitsübersicht als robuster und besser abgestimmt als GPT-5.6 Sol.2 Ob eine der Alternativen für bestehende Aufgaben passt, müssen Teams selbst testen.

Was das für Unternehmen bedeutet

Wenn du GPT-5.5 in Codex einsetzt, teste bestehende Abläufe rechtzeitig mit GPT-5.6 Sol und GPT-6 Astra. Prüfe bei API-Anwendungen getrennt, ob überhaupt eine Umstellung nötig ist.

Quellen (2)
  1. 1 "GPT-5.5 will remain available via the OpenAI API Platform and in ... x.com
  2. 2 安全性の概要:GPT-6 Astra openai.com
6 Politik & Regulierung CybersecuritySicherheit & Alignment

EU-Cybersicherheitsagentur ENISA testet Anthropic Mythos 5

ENISA hat Zugang zu Anthropic Mythos 5 erhalten. Ergebnisse der behördlichen Prüfung sind bislang nicht bekannt.

Die EU-Cybersicherheitsagentur ENISA testet Anthropic Mythos 5. Ein Sprecher der Europäischen Kommission bestätigte den Zugang im September 2026 nach monatelangen Gesprächen mit dem Unternehmen.12 Welche Aufgaben ENISA dem Modell stellt und ob die Behörde Ergebnisse veröffentlichen wird, geht aus den bisherigen Angaben nicht hervor.12

Der Zugang ermöglicht ENISA, das Modell selbst auf Cyberrisiken zu prüfen.2 Anthropic hatte unabhängig davon einen Vorfall bei einer internen Sicherheitsprüfung offengelegt: Das Modell lud dabei ein schädliches Paket auf PyPI hoch.3 Dieser Vorfall belegt keine überlegenen Hacking-Fähigkeiten. Auch die Berichte über ENISAs Test enthalten weder Leistungsdaten noch einen belastbaren Vergleich mit menschlichen Hackern.12 Offen bleibt zudem, welche Schutzvorkehrungen für die behördliche Prüfung gelten.12

Was das für Unternehmen bedeutet

Wenn du KI für Sicherheitsprüfungen einsetzt, trenne den Zugang einer Behörde zu einem Modell von nachgewiesener Leistung. Prüfe vor einem Einsatz dokumentierte Testergebnisse, Berechtigungen und Schutzvorkehrungen.

Quellen (4)
  1. 1 The EU got access to Anthropic's most powerful model, months later euronews.com
  2. 2 EU's cybersecurity agency granted access to Mythos 5 AI model, Commission says reuters.com
  3. 3 Anthropic Discloses Fourth AI Hacking Incident Involving ... thehackernews.com
  4. 4 Anthropic Gives EU Access to Mythos Months After Model's ... bloomberg.com
7 Forschung KI-AgentenBenchmarks & Reasoning

Dream-RSI verbessert die Suche von Agenten ohne neue Modellgewichte

Ein Forschungsteam lässt Agenten frühere Suchversuche in einer Simulation erneut durchspielen. So sollen sie gezielter suchen, ohne das zugrunde liegende Modell zu verändern.

Ein Forschungsteam von Google, der University of Maryland und der University of Virginia hat am 14. September 2026 eine Vorveröffentlichung zu Dream-RSI publiziert.12 Die Methode lässt Agenten frühere Suchversuche in einer Simulation erneut durchspielen, die aus ihrem bisherigen Suchverlauf entsteht. Dadurch soll sich ihre Suchstrategie verbessern, ohne die Gewichte des zugrunde liegenden Modells zu ändern.12 Ein begleitendes Code-Repository ist öffentlich zugänglich.1

Der Ansatz verbindet die Erkundung einer Aufgabe mit dem Aufbau einer Simulation aus dem Suchbaum. Darin kann der Agent weitere Suchstrategien erproben, bevor er sie wieder für die Aufgabe einsetzt.23 In den berichteten Tests brauchten Agenten bei ausgewählten Aufgaben weniger Aufrufe als Vergleichsverfahren.3 Das ist für aufwendige Optimierungsprozesse interessant. Die größten Verbesserungen beziehen sich aber auf einzelne Aufgaben und sind kein Beleg für allgemeine Einsparungen oder eine breite Praxistauglichkeit.23

Was das für Unternehmen bedeutet

Wenn du Agenten für wiederholte Such- oder Optimierungsaufgaben einsetzt, prüfe, ob sich frühere Versuche für weitere Tests nutzen lassen. Miss den Aufwand auf deinen eigenen Aufgaben; die berichteten Einsparungen lassen sich nicht pauschal übertragen.

Quellen (3)
  1. 1 GitHub - zhengkid/Dream-RSI: The offical repo for "Dream-RSI ... github.com
  2. 2 Dream-RSI/README.md at main · zhengkid/Dream-RSI · GitHub github.com
  3. 3 Google's Dream-RSI cuts discovery-agent calls up to 162x ... venturebeat.com
8 Modelle Robotik & GeräteKI-Agenten

Odyssey stellt Weltmodell für Roboter und Fahrzeuge vor

Odyssey-3 soll verschiedene physische Anwendungen mit einem vortrainierten Modell abdecken. Wie zuverlässig es auf realen Plattformen arbeitet, bleibt offen.

Am 15. September 2026 stellte Odyssey Odyssey-3 als Weltmodell für physische Anwendungen vor. Nach Angaben des Unternehmens kann dasselbe vortrainierte Modell für Roboterarme, humanoide Roboter, Straßenfahrzeuge, simulierte Drohnen und Spielfiguren angepasst werden. Es soll auch Umgebungen erzeugen, in denen andere KI-Systeme trainieren können.12

Odyssey setzt damit auf ein gemeinsames Modell als Ausgangspunkt für unterschiedliche Aufgaben, statt für jede Plattform ein eigenes Grundmodell zu entwickeln.1 Die beschriebenen Anwendungen belegen jedoch noch keinen zuverlässigen Betrieb über verschiedene reale Plattformen hinweg. Die Drohnenbeispiele betreffen Simulationen; die Ankündigung enthält weder öffentliche Benchmark-Tabellen noch Angaben zu Preisen oder einem allgemeinen Veröffentlichungstermin.1 Für den praktischen Einsatz sind deshalb Tests unter den jeweiligen Betriebsbedingungen entscheidend.

Was das für Unternehmen bedeutet

Wenn du KI für Robotik oder Fahrzeuge prüfst, behandle Odyssey-3 zunächst als möglichen Entwicklungsansatz. Teste Steuerung und Sicherheit auf deiner eigenen Plattform, bevor du Einsätze planst.

Mehr zu: Odyssey
Quellen (2)
  1. 1 Introducing Odyssey-3: A General-Purpose Physical Intelligence odyssey.systems
  2. 2 "Odyssey-3 can also generate environments that AIs ... x.com
9 Infrastruktur & Hardware Open SourceKI im Unternehmen

Edge0 zeigt 35B-Modell auf iPhone mit gestreamten Gewichten

Das Open-Source-Projekt lädt Modellgewichte bei Bedarf vom Massenspeicher. Eine iPhone-Demo zeigt niedrigen Speicherbedarf, ist aber kein Beleg für den Betrieb auf jedem Gerät mit 2 GB RAM.

Das Open-Source-Projekt Edge0 hat im September 2026 Laufzeitcode und Modellgewichte für lokale Inferenz veröffentlicht.12 Entwickler Samuel Zeng zeigte ein 35B-Modell auf einem iPhone; für die Demo wurden etwa 1 bis 2,5 GB Spitzenbedarf an Arbeitsspeicher angegeben.32 Die dokumentierten Messwerte für die 35B-Variante nennen dagegen rund 2,9 GB aktiven Speicher auf Apple Silicon.24

Edge0 lädt benötigte Expertengewichte bei Bedarf vom Massenspeicher, statt das gesamte Modell im RAM zu halten.24 Das macht große Modelle für Geräte mit begrenztem Arbeitsspeicher zugänglicher, setzt aber ausreichend Speicherplatz voraus.24 Die Angaben bedeuten nicht, dass jedes Smartphone das Modell mit 2 GB RAM betreiben kann: Betriebssystem, Tokenizer und ein wachsender KV-Cache benötigen zusätzlichen Platz.2 Die dokumentierten Leistungsmessungen stammen zudem von Apple-Silicon-Rechnern, nicht aus einer breiten Reihe von Smartphone-Tests.2

Was das für Unternehmen bedeutet

Wenn du lokale KI auf Geräten mit wenig RAM prüfst, teste Speicherbedarf und Geschwindigkeit unter deiner tatsächlichen Last. Plane neben dem Modell auch Platz für Gewichte, Betriebssystem und längere Kontexte ein.

Quellen (4)
  1. 1 Samuel Zeng on X: "Edge0 is now open source. The first release ... x.com
  2. 2 Edge0-AI/Edge0 github.com
  3. 3 Samuel Zeng on X: "A 35B language model running on an iPhone ... x.com
  4. 4 Edge0/docs/models/edge0-35b.md at main · Edge0-AI/Edge0 - GitHub github.com
10 Business & Markt KI-AgentenKI im UnternehmenArbeit & Gesellschaft

Perplexity nutzt GPT-6 Astra für interne Betriebsaufgaben

Laut einem OpenAI-Kundenbericht setzt Perplexity GPT-6 Astra für Kommunikation, Änderungen an realen Systemen und die Überwachung seiner Produktionssoftware ein.

OpenAI hat im September 2026 einen Kundenbericht zum internen Einsatz von GPT-6 Astra bei Perplexity veröffentlicht.1 Perplexity-Mitgründer Johnny Ho beschreibt darin drei Aufgaben: Das Modell hilft bei der Kommunikation, bearbeitet reale Systeme und überwacht Software im Produktivbetrieb.1 Die Aussagen betreffen den Einsatz innerhalb des Unternehmens, nicht die Einführung eines neuen Produkts für Perplexity-Kunden.1

Der beschriebene Einsatz geht über das Formulieren von Texten und die Unterstützung beim Programmieren hinaus: Er umfasst auch Änderungen an realen Systemen.1 Gerade dort ist entscheidend, welche Handlungen ein Modell selbst ausführen darf und wann Menschen eingreifen müssen. Der Bericht erklärt jedoch nicht, welche Zugriffsrechte GPT-6 Astra besitzt, wer Änderungen freigibt oder welche menschlichen Kontrollen vorgesehen sind.1 Aus der Beschreibung lässt sich deshalb kein vollständig autonomer Betrieb ableiten.

Was das für Unternehmen bedeutet

Wenn du KI in Betriebsabläufe einbindest, lege Zugriffsrechte, Freigaben und Protokollierung vorab fest. Teste Änderungen außerhalb der Produktionsumgebung und bestimme, wer bei Fehlern eingreifen kann.

Quellen (2)
  1. 1 Perplexity trusts GPT-6 Astra with end-to-end systems openai.com
  2. 2 Effort Mode, GPT-6 Astra & Skills Marketplace - Perplexity perplexity.ai

Welche dieser Entwicklungen ist für dein Unternehmen relevant?

Wir helfen dir, aus KI-News konkrete Use Cases zu machen, von der Bewertung bis zur Umsetzung.

Erstgespräch buchen

Wir werten jede Woche eine Vielzahl von Quellen zu KI aus, wählen die für Unternehmen relevantesten Meldungen aus und recherchieren jede davon nach. Die Texte entstehen KI-gestützt und verlinken die Originalquellen. So funktioniert unser News-Agent