Zum Inhalt springen
Alle KI-News

KI-News · KW 26/2026

Gemini 3.5 Flash bedient Software, OpenAI stellt Jalapeño vor

· 9 Meldungen · 30 Quellen

KI-gestützt erstellt, Quellen je Meldung verlinkt

Gemini 3.5 Flash kann nun Softwareoberflächen bedienen. OpenAI und Broadcom stellen mit Jalapeño einen Inferenzchip vor, der Betriebskosten senken soll. OpenAI gibt zudem ausgewählten Partnern Zugang zu GPT-5.6 Sol und erweitert Codex Security um die Entwicklung und Prüfung von Patches. Googles Interactions API bündelt den Zugriff auf Gemini-Modelle und Agenten.

1 Produkte & Tools KI-AgentenKI im Unternehmen

Google integriert Computer Use in Gemini 3.5 Flash

Gemini 3.5 Flash kann nun Softwareoberflächen bedienen. Google stellt die Funktion Entwicklern und Unternehmen über seine Plattformen bereit.

Google hat am 24. Juni 2026 Computer Use als integriertes Werkzeug für Gemini 3.5 Flash vorgestellt. Das Modell kann damit Bildschirminhalte erfassen, Aktionen planen und Softwareoberflächen bedienen. Die Funktion ist für Entwickler und Unternehmen über Googles Plattformen zugänglich.1

Damit verbindet Google die Bedienung grafischer Oberflächen direkt mit dem Flash-Modell, statt dafür auf ein separates Computer-Use-Modell zu setzen.12 Das ist für Agenten relevant, die Aufgaben nicht nur beschreiben, sondern in Anwendungen ausführen sollen. Google spricht von seiner bisher besten Leistung bei solchen Aufgaben; die Ankündigung enthält jedoch keine detaillierte Benchmark-Tabelle.1 Auch Preise und regionale Verfügbarkeit gehen aus den vorliegenden Angaben nicht hervor.1 Für Unternehmen bleibt entscheidend, ob die Bedienung in ihren eigenen Anwendungen zuverlässig funktioniert.

Was das für Unternehmen bedeutet

Wenn du Agenten für wiederkehrende Aufgaben in Softwareoberflächen einsetzt, teste die Funktion zuerst in deinen konkreten Anwendungen. Prüfe besonders, welche Aktionen der Agent ausführen darf und wo eine Freigabe nötig ist.

Quellen (2)
  1. 1 Introducing computer use in Gemini 3.5 Flash blog.google
  2. 2 グーグル「Gemini 3.5 Flash」、Computer useを統合 PC操作を強化 watch.impress.co.jp
2 Infrastruktur & Hardware Chips & RechenzentrenKI im Unternehmen

OpenAI und Broadcom stellen Inferenzchip Jalapeño vor

OpenAI hat seinen ersten eigenen Chip für den Betrieb von Sprachmodellen vorgestellt. Jalapeño soll die Kosten senken, ist aber noch nicht breit im Einsatz.

OpenAI und Broadcom haben am 24. Juni 2026 Jalapeño vorgestellt, OpenAIs ersten eigens entwickelten Chip für die Ausführung großer Sprachmodelle.1 OpenAI entwarf den Prozessor und brachte ihn mit Broadcom zur Produktionsreife.12 Er soll den Betrieb von ChatGPT, Codex und der API günstiger und effizienter machen.2 Breit eingesetzt wird Jalapeño noch nicht; der erste Einsatz ist bis Ende 2026 geplant.13

Mit dem Chip will OpenAI die Infrastruktur für die Ausführung seiner Modelle stärker selbst gestalten.1 Ob daraus niedrigere API-Preise entstehen, ist offen. Die Angaben zu Leistung und Kosten stammen aus ersten Tests der Unternehmen, nicht aus unabhängigen Vergleichen.34 Öffentliche Benchmarks und detaillierte technische Daten fehlen bislang.35 Wie Jalapeño im praktischen Betrieb gegenüber anderen KI-Chips abschneidet, lässt sich daher noch nicht verlässlich beurteilen.

Was das für Unternehmen bedeutet

Wenn du KI-Modelle in größerem Umfang nutzt, behalte die Betriebskosten im Blick. Plane vorerst nicht mit Einsparungen durch Jalapeño: Dafür fehlen unabhängige Messwerte und Angaben zu möglichen API-Preisen.

Quellen (5)
  1. 1 OpenAI and Broadcom Unveil LLM-Optimized Intelligence ... investors.broadcom.com
  2. 2 OpenAI on X: "We've designed and built our first AI chip x.com
  3. 3 OpenAI unveils custom chip it designed with Broadcom to ... reuters.com
  4. 4 OpenAI, Broadcom Unveil Chip to Run Models Faster ... bloomberg.com
  5. 5 OpenAI unveils its first custom chip, built by Broadcom techcrunch.com
3 Produkte & Tools CybersecurityCoding & EntwicklungKI im Unternehmen

OpenAI erweitert Codex Security um Prüfung und Behebung von Schwachstellen

Codex Security soll Schwachstellen nicht nur melden, sondern auch Patches entwickeln und prüfen. Das Sicherheitsmodell GPT-5.5-Cyber bleibt geprüften Verteidigern vorbehalten.

OpenAI hat am 22. Juni 2026 seine Sicherheitsinitiative Daybreak erweitert: mit einem aktualisierten Codex Security Plugin und der vollständigen Freigabe von GPT-5.5-Cyber für geprüfte Verteidiger.12 Codex Security soll mögliche Schwachstellen finden, ihre Erreichbarkeit prüfen, Belege sammeln sowie gezielte Patches entwickeln und verifizieren. Damit geht das Werkzeug über das reine Melden von Funden hinaus.1

GPT-5.5-Cyber soll größere Codebasen eingehend analysieren, Funde in kontrollierten Umgebungen validieren und bei der Entwicklung und Prüfung von Patches helfen. Der Zugang ist auf geprüfte Verteidiger beschränkt.23 Mit „Patch the Planet“ unterstützt OpenAI zudem die Behebung von Schwachstellen in Open-Source-Projekten.4 Für Unternehmen ist entscheidend, ob sich bestätigte Funde und geprüfte Korrekturen zuverlässig in bestehende Sicherheitsprozesse übernehmen lassen.

Was das für Unternehmen bedeutet

Wenn du Codex Security einsetzt, prüfe, wie Funde validiert und Patches vor der Übernahme getestet werden. Kläre außerdem, ob dein Team Zugang zu GPT-5.5-Cyber erhalten kann und wie die Ergebnisse in eure Sicherheitsprozesse passen.

Quellen (5)
  1. 1 Daybreak: Tools for securing every organization in the world openai.com
  2. 2 OpenAI expands 'Daybreak' cyber program: New tools ... itpro.com
  3. 3 OpenAI Expands Daybreak With GPT-5.5-Cyber to Help ... thehackernews.com
  4. 4 Patch the Planet: a Daybreak initiative to support open ... openai.com
  5. 5 OpenAI Refocuses Cybersecurity Efforts on Patching Over Discovery securityweek.com
4 Produkte & Tools KI-AgentenKI im UnternehmenBild, Video & Audio

Google macht Interactions API für Gemini-Modelle und Agenten allgemein verfügbar

Googles Interactions API ist allgemein verfügbar. Sie bündelt den Zugriff auf Gemini-Modelle und Agenten und unterstützt verwaltete Agenten sowie Hintergrundaufgaben.

Google hat die Interactions API am 22. Juni 2026 allgemein verfügbar gemacht und bezeichnet sie als zentrale Schnittstelle für Gemini-Modelle und Agenten.1 Neu sind Managed Agents zur Orchestrierung und die Ausführung längerer Aufgaben im Hintergrund.12 Die API verbindet Modellaufrufe und Agenten über einen gemeinsamen Endpunkt; sie unterstützt auch Tool-Nutzung, serverseitigen Zustand und multimodale Generierung.1

Für Entwicklungsteams bedeutet das, dass sie Modell- und Agentenfunktionen über dieselbe Schnittstelle einbinden können, statt dafür getrennte Integrationen aufzubauen.1 Die allgemeine Verfügbarkeit gilt allerdings für die Interactions API, nicht automatisch für jede geplante Funktion. Unterstützung für Gemini Omni stellte Google zum Zeitpunkt der Ankündigung erst für später in Aussicht.1 Wer bestehende Anwendungen umstellt, sollte daher prüfen, welche benötigten Funktionen bereits verfügbar sind.

Was das für Unternehmen bedeutet

Wenn du Gemini in Anwendungen einsetzt, prüfe, ob sich Modellaufrufe und Agenten über die Interactions API zusammenführen lassen. Teste Hintergrundaufgaben und Managed Agents zunächst mit deinen eigenen Abläufen und prüfe die Verfügbarkeit benötigter Funktionen.

Quellen (2)
  1. 1 Interactions API: our primary interface for Gemini models and agents blog.google
  2. 2 Google for Developers on X: "The Interactions API ... x.com
5 Modelle Chatbots & AssistentenKI im Unternehmen

OpenAI verbessert GPT-5.5 Instant bei Absichtserkennung und Vorgaben

GPT-5.5 Instant soll Fragen besser einordnen und Anfragen mit mehreren Vorgaben zuverlässiger beantworten. Die Aktualisierung wird schrittweise ausgerollt.

OpenAI hat am 24. Juni 2026 eine überarbeitete Version von GPT-5.5 Instant vorgestellt. Sie soll die Absicht hinter Fragen besser erkennen und Antworten daran ausrichten. Auch bei Anfragen mit mehreren Vorgaben soll das Modell zuverlässiger reagieren. Die Veröffentlichung für ChatGPT erfolgt gestaffelt für zahlende und kostenlose Nutzer.1

OpenAI verspricht außerdem passendere Empfehlungen für Einkäufe und Orte sowie einen angenehmeren Gesprächsstil.1 GPT-5.5 Instant ist laut Engadget das Standardmodell in ChatGPT.2 Damit betreffen Änderungen am Antwortverhalten einen zentralen Teil der ChatGPT-Nutzung, nicht nur eine Spezialfunktion. Wie groß die Verbesserungen ausfallen, lässt sich aus der Ankündigung nicht unabhängig beurteilen: OpenAI veröffentlicht dafür keine neuen Vergleichswerte.1

Was das für Unternehmen bedeutet

Wenn du ChatGPT für Kundenanfragen oder interne Abläufe nutzt, teste Prompts mit mehreren Vorgaben erneut. Prüfe, ob Empfehlungen und Antwortstil deinen Anforderungen entsprechen, bevor du Vorlagen änderst.

Quellen (3)
  1. 1 OpenAI on X: "We have a new version of GPT-5.5 Instant for you ... x.com
  2. 2 OpenAI's free GPT-5.5 model makes ChatGPT better at ... engadget.com
  3. 3 OpenAI's updated GPT-5.5 Instant is better at shopping, complex constraints, and understanding user intent — and it's already in the API venturebeat.com
6 Modelle KI-AgentenCoding & EntwicklungKI im Unternehmen

OpenAI startet begrenzte Vorschau auf GPT-5.6 Sol

Ausgewählte Partner können GPT-5.6 Sol über API und Codex testen. Ein „ultra“-Modus delegiert schwierige Aufgaben an koordinierte Subagenten.

OpenAI hat am 26. Juni 2026 eine begrenzte Vorschau auf GPT-5.6 angekündigt. Das Spitzenmodell Sol ist zunächst nur für ausgewählte Partner und Organisationen über die API und Codex zugänglich, nicht für einzelne Nutzer über ChatGPT.12 Zur Modellfamilie gehören auch Terra und Luna. Sol bietet einen „ultra“-Modus, der schwierige Aufgaben an koordinierte Subagenten delegiert.13

OpenAI sieht Sol für anspruchsvolle Aufgaben unter anderem in Programmierung, Biologie und Cybersicherheit vor. Terra ist als ausgewogenes Modell positioniert, Luna als günstigere Option für große Nutzungsmengen.12 Die Vorschau ist noch kein allgemeiner Marktstart: Öffentlicher Self-Service-Zugang ist vorerst nicht vorgesehen. OpenAI stellt eine breitere Verfügbarkeit für die kommenden Wochen in Aussicht, ohne einen konkreten Termin zu nennen.12

Was das für Unternehmen bedeutet

Wenn du Agenten für komplexe Aufgaben planst, prüfe, ob delegierte Arbeitsschritte zu deinen Kontroll- und Testprozessen passen. Kalkuliere die Ausgabe-Tokens ein und plane noch nicht mit einem allgemeinen Zugang.

Quellen (3)
  1. 1 Previewing GPT-5.6 Sol: a next-generation model | OpenAI openai.com
  2. 2 A preview of GPT-5.6 Sol, Terra, and Luna | OpenAI Help Center help.openai.com
  3. 3 OpenAI limits GPT-5.6 rollout after government request, says restrictions shouldn’t be the norm | TechCrunch techcrunch.com
7 Produkte & Tools KI-AgentenKI im UnternehmenArbeit & Gesellschaft

Codex macht vorgeführte Arbeitsabläufe zu wiederverwendbaren Skills

Mit Record & Replay können Nutzer Codex einen Ablauf auf dem Mac vorführen und ihn als Skill speichern. Die Verfügbarkeit ist zunächst eingeschränkt.

OpenAI hat am 18. Juni 2026 Record & Replay für die Codex-Desktop-App auf macOS vorgestellt.12 Nutzer können einen Arbeitsablauf vorführen, den Codex in einen wiederverwendbaren Skill umwandelt.13 Der erstellte Skill lässt sich prüfen und später erneut ausführen.3 Die Funktion ist zunächst nur für bestimmte ChatGPT-Abos und nicht in allen Regionen verfügbar.42

Damit lassen sich wiederkehrende Abläufe durch eine Vorführung erfassen, statt sie allein als Anweisungen zu beschreiben.13 Der Skill kann nach der Aufzeichnung bearbeitet werden; Unternehmen können ihn also prüfen, bevor sie ihn erneut einsetzen.32 Das ist keine belegte Aussage darüber, dass Codex sein Grundmodell durch die Vorführung weitertrainiert. Beschrieben wird ein gespeicherter, wiederverwendbarer Ablauf.13

Was das für Unternehmen bedeutet

Wenn du wiederkehrende Arbeit mit Codex automatisierst, kannst du prüfen, ob sich ein vorgeführter Ablauf als Skill speichern lässt. Kontrolliere den Skill vor dem erneuten Einsatz und beachte die regionale Verfügbarkeit.

Quellen (4)
  1. 1 Show Codex a workflow once. Reuse it as a skill. Record ... x.com
  2. 2 OpenAI、Codexが作業を見て覚える「Record& Replay」 watch.impress.co.jp
  3. 3 Introducing Record & Replay - Codex community.openai.com
  4. 4 OpenAI Codex Automation Gains Record and Replay: Show It Once, Skip the Script techtimes.com
8 Modelle KI-AgentenOpen SourceBenchmarks & Reasoning

Qwen veröffentlicht AgentWorld-Modell zur Simulation von Agentenumgebungen

Qwen-AgentWorld soll Reaktionen digitaler Umgebungen auf Aktionen von KI-Agenten vorhersagen. Modellgewichte und ein passender Benchmark sind öffentlich verfügbar.

Alibaba hat mit Qwen-AgentWorld ein Sprachmodell vorgestellt, das Zustandsänderungen in digitalen Umgebungen nach Aktionen eines KI-Agenten simulieren soll.1 Die Gewichte der Variante Qwen-AgentWorld-35B-A3B und der zugehörige AgentWorldBench wurden am 24. Juni 2026 veröffentlicht.2 Das Modell deckt MCP, Search, Terminal, SWE, Web, OS und Android ab.12 Statt als klassischer Chatbot zu dienen, soll es mögliche Reaktionen einer Umgebung vorhersagen.1

Der Ansatz könnte helfen, das Verhalten von Agenten anhand simulierter Rückmeldungen aus Werkzeugen und Oberflächen zu untersuchen.1 Qwen trainierte das Modell in mehreren Phasen auf realen Interaktionsverläufen.1 AgentWorldBench prüft Aufgaben in den unterstützten Bereichen, sagt aber nicht automatisch aus, wie zuverlässig die Simulation in einem konkreten Unternehmensprozess ist.2 Dafür sind Tests mit den eigenen Abläufen und Systemen nötig.

Was das für Unternehmen bedeutet

Wenn du Agenten für Terminal- oder Webaufgaben einsetzt, teste die Simulation zunächst gegen echte Abläufe. Prüfe besonders, ob Fehler und Zustandswechsel korrekt nachgebildet werden.

Quellen (2)
  1. 1 Qwen-AgentWorld: Language World Models for General Agents qwen.ai
  2. 2 Qwen-AgentWorld: Language World Models for General Agents github.com
9 Modelle Open SourceKI im Unternehmen

Krea veröffentlicht Gewichte für Krea 2 Raw und Turbo

Krea stellt zwei Varianten seines Bildmodells bereit: Raw zum Anpassen und Turbo für die schnelle Bilderzeugung. Die Gewichte können heruntergeladen werden.

Krea hat am 23. Juni 2026 die Gewichte von Krea 2 Raw und Krea 2 Turbo veröffentlicht.12 Raw ist ein nicht destillierter Zwischenstand des Trainings für Fine-Tuning, Post-Training und LoRA-Training.2 Turbo wurde destilliert und nachtrainiert; die Variante ist für schnelle Bilderzeugung aus Text ausgelegt.2

Krea sieht die beiden Checkpoints als Ergänzung: Anpassungen sollen auf Raw erfolgen, während Turbo für die spätere Bilderzeugung gedacht ist.12 Das gibt Entwicklern getrennte Ausgangspunkte für das Training und den Betrieb eines Bildmodells.2 Laut technischem Bericht stehen die Gewichte und die Inferenz unter einer freizügigen Lizenz.3 Es handelt sich allerdings um eine eigene Lizenz, nicht um eine standardisierte Open-Source-Lizenz.23

Was das für Unternehmen bedeutet

Wenn du Bildmodelle für eigene Zwecke anpassen willst, teste Raw für das Training und Turbo separat für die Bilderzeugung. Prüfe vor dem lokalen Einsatz Hardwarebedarf, Bildqualität und Lizenzbedingungen.

Quellen (4)
  1. 1 "today, we release the open weights of Krea 2. ... x.com
  2. 2 Krea 2 Open-Source: RAW and Turbo Image Models krea.ai
  3. 3 Krea 2: A From-Scratch Foundation Image Model With Style Control rits.shanghai.nyu.edu
  4. 4 Krea 2 Open-Source Models are now available in ComfyUI blog.comfy.org

Welche dieser Entwicklungen ist für dein Unternehmen relevant?

Wir helfen dir, aus KI-News konkrete Use Cases zu machen, von der Bewertung bis zur Umsetzung.

Erstgespräch buchen

Wir werten jede Woche eine Vielzahl von Quellen zu KI aus, wählen die für Unternehmen relevantesten Meldungen aus und recherchieren jede davon nach. Die Texte entstehen KI-gestützt und verlinken die Originalquellen. So funktioniert unser News-Agent