KI-News · KW 9/2026
Gemini 3.1 Pro startet, Claude API erhält Prompt-Caching
· 7 Meldungen · 18 Quellen
KI-gestützt erstellt, Quellen je Meldung verlinkt
Google startet die Preview von Gemini 3.1 Pro für komplexe Aufgaben. Anthropic automatisiert Prompt-Caching in der Claude API, während OpenAI Rechenzentrumskapazität und Büros in Indien plant. WordPress.com ergänzt seinen Editor um den WordPress AI Assistant; Cursor begrenzt lokale Coding-Agenten mit einer Sandbox. NotebookLM bietet Folienkorrekturen und PPTX-Export, Tavus stellt Phoenix-4 für Live-Gespräche vor.
Google startet Preview von Gemini 3.1 Pro
Das Modell für komplexe Aufgaben wird schrittweise für Entwickler, Unternehmen und Abonnenten verfügbar. Eine allgemeine Freigabe steht noch aus.
Google hat am 19. Februar 2026 Gemini 3.1 Pro vorgestellt und die Preview für Entwickler, Unternehmen und Nutzer gestartet.12 Der schrittweise Rollout umfasst die Gemini API, Vertex AI und Gemini Enterprise sowie die Gemini App und NotebookLM.12 Google beschreibt das Modell als Upgrade für komplexe Aufgaben; es bildet auch die Grundlage für die jüngste Aktualisierung von Gemini 3 Deep Think.1
Beim Reasoning-Benchmark ARC-AGI-2 erreichte Gemini 3.1 Pro laut Google 77,1 % und damit mehr als doppelt so viel wie Gemini 3 Pro.1 Das ist ein von Google hervorgehobenes Testergebnis, kein Nachweis für denselben Leistungsgewinn bei jeder Unternehmensaufgabe. Google will die Änderungen zunächst in der Preview prüfen und das Modell erst danach allgemein verfügbar machen.1 Unternehmen können es damit bereits erproben, sollten den Preview-Status aber bei produktiven Anwendungen berücksichtigen.12
Was das für Unternehmen bedeutet
Wenn du komplexe Aufgaben mit KI bearbeitest, teste das Modell mit eigenen Daten und messbaren Kriterien. Plane für produktive Anwendungen ein, dass es noch in der Preview ist.
Anthropic führt automatisches Prompt-Caching für die Claude API ein
Die Claude API kann Cache-Breakpoints nun automatisch setzen. Wiederholte Eingaben können dadurch günstiger und schneller verarbeitet werden.
Anthropic hat am 19. Februar 2026 automatisches Prompt-Caching für die Claude API eingeführt.1 Entwickler können es mit einem cache_control-Feld aktivieren; die API setzt den Cache-Breakpoint dann selbst, statt eine manuelle Position zu verlangen.12 Die Funktion ist für die Messages API beschrieben und soll die Kosten und Verarbeitungszeit wiederholter Eingaben senken.12
Bisher mussten Entwickler Cache-Breakpoints selbst platzieren.12 Die neue Option vereinfacht vor allem Anwendungen, die lange, unveränderte Prompt-Anfänge wiederholt senden.32 Der Preisvorteil gilt für Cache-Treffer, nicht pauschal für jede Anfrage: Schreibvorgänge kosten zusätzlich, und Änderungen am Prompt-Präfix können einen Treffer verhindern.3 Eine allgemeine Kennzahl zur Zeitersparnis bei der automatischen Variante liegt nicht vor.3
Was das für Unternehmen bedeutet
Wenn du wiederkehrende Anweisungen oder Dokumente an die Claude API sendest, teste automatisches Caching mit realen Anfragen. Prüfe Cache-Treffer und Schreibkosten getrennt, bevor du Einsparungen einplanst.
OpenAI plant Rechenzentrumskapazität und neue Büros in Indien
OpenAI baut seine Präsenz in Indien mit einer Rechenzentrumspartnerschaft, Hochschullizenzen und geplanten Büros aus.
OpenAI hat am 18. Februar „OpenAI for India“ vorgestellt. Das Unternehmen vereinbarte mit der Tata Group und Tata Consultancy Services (TCS) den Aufbau KI-tauglicher Rechenzentrumskapazität in Indien. Geplant ist ein Start mit 100 Megawatt. Hinzu kommen Hochschulpartnerschaften für ChatGPT Edu und weitere Standorte neben dem bestehenden Büro in New Delhi. Die neuen Büros sollen später im Jahr 2026 öffnen.12
Mit der Verbindung aus lokaler Infrastruktur, Bildung und eigener Präsenz vertieft OpenAI seine Position in Indien. Die geplante Kapazität könnte auf bis zu 1 Gigawatt wachsen; dieser Ausbau ist aber noch keine verfügbare Leistung.1 Für Unternehmen ist die Unterscheidung wichtig: Die Vereinbarung beschreibt einen künftigen Infrastrukturaufbau, keine sofort nutzbare Rechenleistung. Reuters bestätigte die Vereinbarung mit Tata und den geplanten Startumfang von 100 Megawatt.2
Was das für Unternehmen bedeutet
Wenn du KI-Dienste in Indien betreibst, prüfe künftige Hosting-Optionen erst anhand konkreter Angaben zu Verfügbarkeit, Datenstandort und Verträgen. Plane vorerst keine Workloads auf der angekündigten Kapazität ein.
WordPress.com integriert KI-Assistenten in den Editor
Der WordPress AI Assistant kann Layouts ändern, Texte bearbeiten und Bilder erstellen. Er ist für bestimmte WordPress.com-Tarife verfügbar.
WordPress.com hat den WordPress AI Assistant vorgestellt. Er ist in den Editor und die Medienverwaltung des Hosting-Dienstes eingebunden.1 Nutzer können damit Seitenlayouts und Strukturen ändern, Texte erstellen oder überarbeiten sowie Bilder erzeugen und bearbeiten.1 Die Funktion ist für bestimmte kostenpflichtige WordPress.com-Tarife verfügbar.1
Der Assistent erweitert die KI-Funktionen von WordPress.com über die Erstellung neuer Websites hinaus auf deren laufende Bearbeitung.1 Er arbeitet auch mit Block-Notizen im neueren Editor: Dort können Nutzer ihn mit „@ai“ ansprechen.2 Die Ankündigung betrifft WordPress.com und ist kein allgemeines Update für selbst gehostete WordPress-Installationen.1 Für Unternehmen ist diese Unterscheidung wichtig, wenn sie Funktionen und Kosten für ihre bestehenden Websites prüfen.
Was das für Unternehmen bedeutet
Wenn du WordPress.com nutzt, prüfe zuerst deinen Tarif und die Aktivierung in den Website-Einstellungen. Teste Layout- und Textänderungen an einer nicht veröffentlichten Seite, bevor du den Assistenten in redaktionelle Abläufe aufnimmst.
Cursor begrenzt Zugriffe lokaler Coding-Agenten mit einer Sandbox
Lokale Cursor-Agenten können innerhalb einer Sandbox ohne wiederholte Freigaben arbeiten. Für Zugriffe außerhalb der Grenzen müssen sie eine Genehmigung anfordern.
Cursor hat am 18. Februar 2026 beschrieben, wie lokale Coding-Agenten auf macOS, Linux und Windows in einer Sandbox arbeiten. Nach Angaben des Unternehmens wurde die Funktion über die vorangegangenen drei Monate eingeführt. Innerhalb festgelegter Grenzen können Agenten Aufgaben ohne wiederholte Freigaben ausführen. Für Zugriffe außerhalb der Sandbox, häufig auf das Internet, müssen sie eine Genehmigung anfordern.1
Für Unternehmen ist entscheidend, welche Aktionen ein Agent selbstständig ausführen darf und wann er nachfragen muss. Cursor bietet dafür auch Zugriffskontrollen, die Unternehmen verbindlich vorgeben können.2 Das Unternehmen meldet 40 % weniger Unterbrechungen als bei Agenten ohne Sandbox; daraus lässt sich kein entsprechend hoher Produktivitätsgewinn ableiten.1 Die lokale Sandbox betrifft Agenten auf dem Rechner des Nutzers. Sie ist von Cursor Cloud Agents zu unterscheiden, die in eigenen virtuellen Maschinen laufen.13
Was das für Unternehmen bedeutet
Wenn du lokale Coding-Agenten einsetzt, prüfe zuerst, auf welche Dateien und Netzwerkziele sie zugreifen müssen. Lege Freigaben für Ausnahmen fest und teste die Regeln mit typischen Aufgaben.
NotebookLM erlaubt Folienkorrekturen per Prompt und PPTX-Export
Generierte Präsentationen lassen sich in NotebookLM gezielt überarbeiten und als PowerPoint-Datei herunterladen. Der Rollout begann Mitte Februar.
Google hat am 17. Februar 2026 neue Funktionen für Präsentationen aus NotebookLM angekündigt. Nutzer können einzelne Folien per Texteingabe überarbeiten und Präsentationen im PPTX-Format für PowerPoint herunterladen.12 Die Einführung begann schrittweise. Berichte zur Verfügbarkeit unterscheiden sich: Einer nennt Google AI Pro und Ultra als erste Empfänger, ein anderer meldet eine Ausweitung auf alle Nutzer bis zum 20. Februar.32
Zuvor konnten Nutzer generierte Präsentationen nur als PDF ausgeben. Das machte Änderungen und die Weiterverwendung in Präsentationsprogrammen umständlicher.34 Mit der neuen Funktion lassen sich etwa Text, Bilder oder das Layout einer bestimmten Folie per Anweisung ändern.32 Der PPTX-Export schafft einen Weg, Entwürfe außerhalb von NotebookLM weiterzubearbeiten. Ein direkter Export nach Google Slides ist noch nicht verfügbar, wurde aber angekündigt.12
Was das für Unternehmen bedeutet
Wenn du NotebookLM für Präsentationsentwürfe nutzt, kannst du Folien vor dem Export gezielt korrigieren und die PPTX-Datei anschließend im Team bearbeiten. Prüfe Layout und Inhalte nach dem Export in PowerPoint.
Tavus stellt Echtzeit-Avatar-Modell Phoenix-4 vor
Phoenix-4 soll KI-Avatare in Live-Gesprächen emotional reagieren lassen. Das Modell ist über die Tavus-Plattform verfügbar.
Tavus hat Phoenix-4 am 18. Februar 2026 vorgestellt. Das Modell erzeugt Kopf-und-Schulter-Videos für KI-Avatare in Live-Gesprächen und soll Mimik und Verhalten an den Gesprächsverlauf anpassen.12 Laut Tavus verbindet es die Erzeugung emotionaler Zustände mit aktivem Zuhören und durchgehender Gesichtsbewegung. Es kann gleichzeitig zuhören und reagieren.1 Phoenix-4 ist über die Tavus-Plattform und APIs verfügbar; Nutzer können eigene Avatare erstellen oder vorgefertigte Repliken einsetzen.12
Für Unternehmen mit Videoassistenten ist vor allem die fortlaufende visuelle Reaktion relevant: Eine Figur soll auch dann aufmerksam wirken, wenn sie gerade nicht spricht.12 Tavus ordnet Phoenix-4 als Nachfolger früherer Avatar-Modelle ein.12 Ob die Darstellung unter realen Netzwerkbedingungen zuverlässig funktioniert und wie sie im Vergleich zu anderen Systemen abschneidet, lässt sich aus den veröffentlichten Angaben nicht beurteilen. Preise nennt Tavus in den Ankündigungen ebenfalls nicht.12
Was das für Unternehmen bedeutet
Wenn du Videoassistenten einsetzt, teste neben der Gesprächsqualität auch Mimik und Reaktionsverhalten bei Gesprächspausen. Prüfe Latenz, Bildqualität und Kosten unter deinen eigenen Netzwerkbedingungen.
Welche dieser Entwicklungen ist für dein Unternehmen relevant?
Wir helfen dir, aus KI-News konkrete Use Cases zu machen, von der Bewertung bis zur Umsetzung.
Erstgespräch buchenWir werten jede Woche eine Vielzahl von Quellen zu KI aus, wählen die für Unternehmen relevantesten Meldungen aus und recherchieren jede davon nach. Die Texte entstehen KI-gestützt und verlinken die Originalquellen. So funktioniert unser News-Agent