KI-Modelle im September: mehr Agenten, Stimme und Kontrolle
Im September verschoben mehrere Anbieter den Schwerpunkt vom reinen Antworten hin zu längeren, multimodalen Arbeitsabläufen. Der Überblick trennt verfügbare Funktionen von begrenzten Tests und Ankündigungen.
Überblick des Monats
Berichtszeitraum: 1.–30. September 2026. Recherche-Stichtag: 2. Oktober 2026 (Fulda-Zeit). Der Monat brachte nicht nur neue Modellnamen. Auffällig waren Funktionen, die Modelle in längere Arbeitsabläufe einbinden: Browser- und Werkzeugnutzung, Echtzeit-Stimme, Bildbearbeitung und Agenten. Die Herstellerankündigungen beschreiben Fähigkeiten und geplante Einsatzwege; sie ersetzen keine unabhängige Prüfung im eigenen Arbeitsalltag.
Konkrete Neuerungen je Anbieter
OpenAI. Im API-Changelog erschienen GPT-6 Sol und GPT-6 Luna sowie GPT-6 Astra; der Changelog weist zudem Computer Use als neue Agents-API-Funktion aus.[1] OpenAI führte außerdem die Agents API in öffentlicher Beta ein; sie bietet dauerhafte Sitzungen, Fortschrittsausgabe und Verbindungen zu eigenen Werkzeugen und MCP-Servern. Das ist eine Beta, keine pauschale Verfügbarkeit jeder Agentenfunktion in ChatGPT. Ebenfalls im September kamen GPT Image 2.5 Sunburst und Flare mit neuen Qualitätsstufen für Bildgenerierung und -bearbeitung in die API. Die Quellen belegen damit vor allem API- und Entwicklerneuheiten; hier wird nicht behauptet, dass jede Funktion allen ChatGPT-Konten offensteht.[1]
Anthropic. Claude Fable 5.1 wurde am 1. September vorgestellt und ist laut Anthropic allgemein verfügbar. Claude Mythos 5.1 ist dagegen auf vertrauenswürdige Zugangsprogramme für ausgewählte Organisationen beschränkt. Das sind ausdrücklich unterschiedliche Verfügbarkeitsstufen, obwohl beide laut Hersteller dasselbe Modell mit unterschiedlichen Schutzmaßnahmen verwenden.[2] Am 22. September folgte Opus 5.5, am 28. September Sonnet 5.5; Anthropic meldet beide auf seinen Plattformen und bei Cloud-Partnern als verfügbar. Sonnet positioniert der Anbieter als schnellere und kostengünstigere Variante für viele Aufgaben; diese Leistungs- und Kostenvergleiche sind Herstellerangaben, keine unabhängigen Ergebnisse.[3][4]
Google/Gemini. Gemini 3.8 Flash wurde am 2. September vorgestellt und in Google-Produkte und Entwicklerangebote ausgerollt; 3.8 Flash Cyber ist ausschließlich für geprüfte Verteidiger über das Fairwind-Programm vorgesehen.[5] Am 15. September kündigte Google Gemini 3.8 Live und Live Extended Thinking für natürlichere Sprachdialoge, Echtzeit-Bildkontext und Hintergrundaufgaben an. Google nennt API, Workspace und Gemini-App als Einsatzwege; konkrete Verfügbarkeit kann je Produkt und Konto variieren.[6] Lyria 3.5 zur Musikgenerierung wurde ebenfalls in Gemini und der API verfügbar gemacht.[7] Gemini 4 Argon wurde am 30. September angekündigt, befand sich zum Recherche-Stichtag aber noch im schrittweisen Zugang für geprüfte Cyberabwehr-Teams; die breite Freigabe war lediglich angekündigt.[8]
Meta. Meta stellte am 8. September Muse vor, einen persönlichen Agenten, der Aufgaben über genutzte Apps hinweg übernehmen soll. Der Rollout begann in den USA für iOS, Android und muse.ai; Unterstützung für AI-Brillen wurde als künftig angekündigt, nicht als bereits verfügbar beschrieben.[9] Am 28. September kündigte Meta außerdem eine Enterprise Platform an, um Unternehmen den Aufbau und die Verwaltung von KI-Agenten zu ermöglichen. Das ist als Unternehmensplattform-Ankündigung einzuordnen, nicht als Nachweis einer allgemein verfügbaren Modellfunktion.[10]
Praktische Bedeutung und Grenzen
Für Unternehmen wird wichtiger, nicht nur die Antwortqualität, sondern auch Übergaben, Berechtigungen, Protokollierung und menschliche Freigaben eines Agenten zu prüfen. Bei Stimme und Bildkontext zählen zusätzlich Einwilligung, Umgang mit Aufnahmen und Fehlerfolgen. Eine öffentliche Beta oder ein Rollout in den USA ist nicht automatisch für jedes Konto, Land oder Tarif verfügbar. Bei eingeschränkten Programmen wie Mythos 5.1 und Gemini 3.8 Flash Cyber ist der Zugang ausdrücklich begrenzt. Auch Herstellerbenchmarks und Werbevergleiche sind zunächst Aussagen des Anbieters; die passende Entscheidung entsteht erst durch einen kontrollierten Test mit eigenen Aufgaben und Daten.
Kurze Einordnung für Adversum
Der Monat bestätigt eine Verschiebung: KI wird zunehmend als Teil eines Arbeitsprozesses angeboten, nicht nur als Chatfenster. Für Bildung und Unternehmen liegt der sinnvolle nächste Schritt deshalb nicht im reflexhaften Modellwechsel, sondern in klar begrenzten Anwendungsszenarien: Welche Aufgabe darf automatisiert werden, welche Daten dürfen hinein, wer prüft das Ergebnis und wie lässt sich der Ablauf stoppen? Solche Fragen bleiben wichtiger als ein neuer Modellname.
Quellen
- OpenAI API Changelog · OpenAI Developers
- Introducing Claude Fable 5.1 and Claude Mythos 5.1 · Anthropic
- Introducing Claude Opus 5.5 · Anthropic
- Introducing Claude Sonnet 5.5 · Anthropic
- Introducing Gemini 3.8 Flash and 3.8 Flash Cyber · Google
- Introducing Gemini 3.8 Live and Gemini 3.8 Live Extended Thinking · Google
- Create your best tracks yet with Lyria 3.5 in Gemini · Google
- Gemini 4 Argon: our next era of frontier intelligence · Google
- Introducing Muse: The World’s First Personal AI Agent Built for Everyone · Meta
- Launching Meta Enterprise Platform · Meta