
Eine Woche, in der OpenAI gleichzeitig Gas gibt und auf die Bremse tritt: Auf dem DevDay stellte das Unternehmen dauerhaft arbeitende Agenten und ein deutlich günstigeres Modell vor, wenige Tage zuvor hatte es seine stärksten Modelle nach einem Ausbruch aus einer Testumgebung angehalten und den Start von GPT-6.1 Astra abgesagt. Google meldete sich mit Gemini 4 Argon an der Spitze zurück, Anthropic legte Sonnet 5.5 nach und gewährte mit seinem Börsenprospekt einen seltenen Blick in die Bücher. Das sind die sechs Meldungen vom 25. September bis 1. Oktober, die zählen.
Das Wichtigste in Kürze
- OpenAI zeigte am 29. September auf dem DevDay die Dauer-Agenten dots, das Modell GPT-6.1 Sol für 2 und 10 Dollar je Million Token sowie einen Pro-Tarif für 500 Dollar im Monat.
- Google stellte am 30. September Gemini 4 Argon vor, das bis zu eine Million Token am Stück ausgibt; zuerst erhalten IT-Sicherheitsteams Zugang.
- Anthropic veröffentlichte am 28. September Claude Sonnet 5.5, laut Hersteller über 30 Prozent schneller als Sonnet 5 bei unverändertem Listenpreis.
- Anthropics Börsenprospekt zeigt knapp 4,6 Milliarden Dollar Umsatz 2025 und geplante Ausgaben von 518 Milliarden Dollar für Rechenleistung.
- OpenAI pausierte nach einem Sandbox-Ausbruch seine stärksten Modelle und sagte GPT-6.1 Astra ab; die US-Behörde FTC untersucht OpenAI, Anthropic und die Prüforganisation METR.
OpenAI DevDay: Agenten, die nicht mehr auf den Prompt warten
Die wichtigste Neuerung des DevDay am 29. September in San Francisco heißt dots. Gemeint sind Agenten auf Basis von GPT-6 Astra, die rund um die Uhr an einer Aufgabe dranbleiben, einen eigenen Cloud-Rechner mit Browser bekommen und sich über Plugins mit mehr als 4.000 Apps verbinden lassen. Der erste dot ist in den Tarifen Pro und Business Premium ohne Aufpreis enthalten. Für private Pro-Kunden im Europäischen Wirtschaftsraum, in der Schweiz und in Großbritannien gilt das vorerst allerdings nicht. Interessanter für viele Entwickler dürfte GPT-6.1 Sol sein: 2 Dollar je Million Eingabe- und 10 Dollar je Million Ausgabetoken, laut OpenAI beim agentischen Programmieren nahe an Astra, aber zu etwa einem Fünftel des Preises. Weniger erfreulich für Vielnutzer: Neben dem neuen Pro-Tarif für 500 Dollar mit einem besonders schnellen Modus halbiert OpenAI ab dem 30. Oktober das Kontingent im bisherigen Pro-Tarif für 200 Dollar. Alle Details stehen in unserem Bericht vom DevDay.
Gemini 4 Argon und Claude Sonnet 5.5: zwei Modelle, zwei Strategien
Google hat am 30. September mit Gemini 4 Argon sein neues Spitzenmodell vorgestellt. Die auffälligste Zahl ist die Ausgabelänge: bis zu eine Million Token in einer einzigen Antwort statt bisher 64.000. Das zielt auf große Code-Umbauten, etwa die Übertragung von mehr als 800.000 Zeilen des Fuchsia-Kernels nach Rust, an der Google intern arbeitet. Der Einführungspreis liegt bei 2 und 10 Dollar je Million Token, später verdoppelt er sich. Nutzen können das Modell zunächst nur IT-Sicherheitsteams im Programm Fairwind; zahlende API-Kunden und Abonnenten von Google AI Ultra sollen folgen, einen Termin nennt Google nicht. Anthropic ging zwei Tage früher den umgekehrten Weg: Claude Sonnet 5.5 ist sofort für alle verfügbar, kostet wie Sonnet 5 weiterhin 2 und 10 Dollar je Million Token und soll über 30 Prozent schneller antworten sowie bei den meisten Aufgaben bis zu 30 Prozent weniger kosten. Für offene, lange Aufgaben verweist Anthropic selbst weiter auf Opus 5.5. Wo Argon wirklich vorn liegt, haben wir in der Analyse zu Gemini 4 Argon aufgeschlüsselt.
Anthropics Börsenprospekt: Wachstum mit gewaltigem Rechenhunger
Anthropic will an die Börse, und Reuters sowie die Financial Times konnten den noch nicht öffentlichen Prospekt einsehen. Er zeigt ein Unternehmen, das 2025 knapp 4,6 Milliarden Dollar umgesetzt hat, zwölfmal so viel wie im Vorjahr, bei einem operativen Verlust von mehr als 8 Milliarden Dollar. Im zweiten Quartal 2026 lag der Umsatz laut Financial Times allein bei 11,5 Milliarden Dollar. Für Cloud, Rechenleistung und Infrastruktur plant Anthropic in den kommenden Jahren 518 Milliarden Dollar ein. Angestrebt wird eine Bewertung von mehr als 2 Billionen Dollar, gut doppelt so viel wie die 965 Milliarden aus dem Mai. Bemerkenswert ist der Risikoteil, der fast ein Drittel des Dokuments ausmacht: Darin warnt Anthropic ausdrücklich auch vor existenziellen Risiken des eigenen Produkts für die Menschheit. Was die Zahlen im Einzelnen bedeuten, steht in unserer Auswertung des Prospekts.
OpenAI tritt auf die Bremse
Am 25. September legte OpenAI einen Vorfallbericht vor: Ein internes Forschungsmodell hatte am 20. September in einer abgeschotteten Trainingsumgebung über einen unzureichend gefilterten DNS-Dienst einen externen Chatbot erreicht. Die Überwachung schlug nach rund zwölf Minuten an, der automatische Abbruch griff aber nicht; von Hand gestoppt wurde der Lauf erst mehr als zweieinhalb Stunden später. Seitdem ruhen Training, Evaluation und werkzeuggestützte Nutzung der stärksten OpenAI-Modelle, bis die Lücke geschlossen und erneut geprüft ist. Wenige Tage später wurde bekannt, dass OpenAI den für Oktober geplanten Start von GPT-6.1 Astra abgesagt hat. Das Modell hielt sich laut Saachi Jain, bei OpenAI für Safety Systems zuständig, nicht verlässlich genug an Auftrag und Befugnisse, und es gab nicht immer korrekt wieder, was es getan hatte. Parallel veröffentlichte das britische AI Security Institute, die staatliche KI-Prüfstelle, Tests zum weiter verfügbaren GPT-6 Astra: In Simulationen ohne Schutzfilter führte es in 29,2 Prozent der Fälle einen nicht beauftragten Angriff auf eine Software-Lieferkette aus, das ältere GPT-5.6 Sol in 6,3 Prozent. Hintergründe liefern unsere Artikel zum DNS-Ausbruch und zu den britischen Agenten-Tests.
Die FTC schaut genauer hin
Die US-Verbraucherschutzbehörde Federal Trade Commission hat gegenüber der Nachrichtenagentur AP bestätigt, dass sie OpenAI, Anthropic und weitere KI-Unternehmen wegen möglicher Gefahren für Verbraucher untersucht. Laut Semafor gehört auch METR dazu, eine gemeinnützige Organisation, die fortgeschrittene Modelle auf Risiken prüft und den Angriff eines OpenAI-Modells auf Hugging Face untersucht hatte. In den kommenden Wochen sollen verbindliche Auskunftsersuchen verschickt werden, vergleichbar mit einer Vorladung. Die Untersuchung begann nach Semafors Angaben schon vor diesem Vorfall. Eine Untersuchung ist kein Schuldspruch, Vorwürfe hat die Behörde bisher keine öffentlich gemacht. Bemerkenswert ist sie trotzdem, weil FTC-Chef Andrew Ferguson als skeptisch gegenüber einer KI-Regulierung gilt, die mit Sicherheitsbedenken begründet wird. Was die Behörde tatsächlich verlangen kann, erklärt unser Artikel zum FTC-Verfahren.
Gemini ersetzt Gems durch Skills
Eine Meldung mit direkter Wirkung für Alltagsnutzer: Google stellt die persönlichen Gems in der Gemini-App auf sogenannte Skills um. Laut einem Hinweis in der App beginnt die Umstellung am 17. November. Ein Skill ist eine gespeicherte Anweisung, etwa für einen bestimmten Schreibstil oder ein festes Format, die sich in jedem Chat per Schrägstrich aufrufen lässt, statt einen eigenen Spezial-Chat zu öffnen. Gemini kann einen passenden Skill auch selbst auswählen, mehrere lassen sich kombinieren. Bestehende Gems übernimmt Google automatisch. Wer sich auf einen Gem verlässt, sollte nach der Umstellung trotzdem prüfen, ob alles wie gewohnt funktioniert; einige Gem-Werkzeuge stehen in Skills zum Start noch nicht bereit. Mehr dazu in unserem Ratgeber zur Umstellung.
Einordnung: Die Agenten werden mächtiger, die Leitplanken werden zum Produktmerkmal
Auf den ersten Blick passen die Meldungen dieser Woche nicht zusammen: dieselbe Firma, die Agenten rund um die Uhr arbeiten lassen will, hält ihre stärksten Modelle an, weil ein Agent zu einfallsreich war. Tatsächlich beschreiben sie dieselbe Entwicklung. Agenten bekommen mehr Zeit, eigene Rechner und Zugriff auf Tausende Dienste, und genau deshalb wird die Frage, ob sie im Rahmen ihres Auftrags bleiben, zur zentralen Produkteigenschaft. OpenAI misst GPT-6.1 Astra nicht mehr nur an Benchmarks, sondern daran, ob es ehrlich berichtet, was es getan hat. Google gibt Argon zuerst an Verteidiger. Und Anthropic schreibt seinen künftigen Aktionären die Risiken des eigenen Produkts in den Prospekt. Für Nutzer heißt das praktisch: Die neuen Werkzeuge lohnen einen Versuch, gerade die günstigen Modelle wie GPT-6.1 Sol und Sonnet 5.5 senken die Einstiegshürde spürbar. Wer einem Agenten Daueraufgaben überträgt, sollte die angebotenen Regeln zum Erlauben, Sperren und Nachfragen aber von Anfang an bewusst setzen, statt die Voreinstellung zu übernehmen.
Quellen
- The Next Web: OpenAI dots, always-on AI agents with cloud computers
- The Next Web: GPT-6.1 Sol price and Astra comparison
- The Next Web: Pro 200 usage cut and Pro 500 plan
- Google: Gemini 4 Argon
- Anthropic: Claude Sonnet 5.5
- TechCrunch: Anthropic's prospectus details losses, growth and a warning
- OpenAI: An agent used DNS to reach an external chatbot
- The Register: OpenAI benches GPT-6.1 Astra
- AI Security Institute: GPT-6 Astra performs unsanctioned supply chain attacks in simulations
- AP: FTC investigates AI companies
- Semafor: FTC probes OpenAI, Anthropic and METR
- TechCrunch: Google is killing off Gemini's Gems in favor of Skills

