
Eine Woche, in der die KI-Werkzeuge spürbar besser und günstiger wurden und zugleich die Frage lauter wurde, wer über ihren Einsatz bestimmt. OpenAI brachte GPT-6 zu allen ChatGPT-Nutzern, Anthropic senkte mit Claude Haiku 5.5 die Preise für kleine Aufgaben drastisch, und aus Deutschland und Frankreich kamen neue offene Modelle. Gleichzeitig wehrten sich Mathematiker gegen OpenAIs Massenveröffentlichung von KI-Beweisen, und in Australien entschuldigte sich das Unternehmen vor dem Parlament für einen Agenten-Vorfall. Das sind die sechs Meldungen vom 2. bis 8. Oktober, die zählen.
Das Wichtigste in Kürze
- GPT-6 ist seit dem 7. Oktober in ChatGPT für zahlende Kunden verfügbar (als GPT-6 Sol), seit dem 8. Oktober auch für Free und Go (als GPT-6 Luna); Antworten können jetzt interaktive Elemente wie Rechner und Karten enthalten.
- Claude Haiku 5.5 kostet 0,10 Dollar je Million Eingabe- und 0,50 Dollar je Million Ausgabetoken und schlägt seinen Vorgänger in Anthropics Tests teils um ein Vielfaches.
- Nach OpenAIs Veröffentlichung von 722 KI-Manuskripten ruft die Association for Human Mathematics dazu auf, die Zusammenarbeit mit OpenAI zu beenden.
- Wikimedia dokumentierte Millionen Zugriffe mutmaßlicher OpenAI-Agenten; in Australien entschuldigte sich OpenAI vor dem Parlament für den Zugriff eines Agenten auf ein Medicare-Portal.
- Aleph Alpha veröffentlichte das offene Modell Kolibri, Mistral zeigte Mistral Large 4 als Vorschau; OpenAI markiert ChatGPT-Texte in der EU künftig mit einem Wasserzeichen.
GPT-6 kommt in ChatGPT an
Seit dem 7. Oktober arbeitet in ChatGPT für Kunden der Tarife Plus, Pro, Business und Enterprise GPT-6 Sol, seit dem 8. Oktober erhalten Nutzer von Free und Go die kleinere Variante GPT-6 Luna. Die sichtbarste Neuerung heißt Intelligent UI: ChatGPT kann eine Antwort aus Text, Diagrammen, Formularen, Schaltflächen und Karten zusammensetzen. Ein Rezept passt die Zutatenmengen an die Zahl der Gäste an, auf Wunsch baut das Modell kleine Werkzeuge wie einen Rechnungsteiler oder ein einfaches Spiel direkt im Chat. Die Neuerung gilt nur für den Chat-Bereich; die Modelle hinter Work und Codex bleiben unverändert. Wer ChatGPT bisher vor allem als Textmaschine genutzt hat, sollte Fragen mit Zahlen, Vergleichen oder Orten einmal neu stellen, dort zeigt sich der Unterschied am deutlichsten. Was die neue Oberfläche kann und wo OpenAI selbst noch Schwächen sieht, steht in unserem Artikel zu Intelligent UI.
Claude Haiku 5.5 und Anthropics neue Spielregeln
Anthropic hat am 7. Oktober Claude Haiku 5.5 vorgestellt, sein kleinstes und günstigstes Modell. Bis 100.000 Token Eingabe kostet es 0,10 Dollar je Million Eingabe- und 0,50 Dollar je Million Ausgabetoken, ein Zehntel dessen, was Haiku 4.5 kostete. Gleichzeitig legt es in Anthropics eigenen Vergleichen deutlich zu: Im Test OSWorld, bei dem ein Modell einen Computer bedient, löst es 72,4 Prozent der Aufgaben statt 15,7 Prozent. Zwei Einschränkungen gehören dazu. Ein neuer Tokenizer zerlegt Text etwas anders, sodass dieselbe Aufgabe etwas mehr Token verbraucht, und für anspruchsvolle Programmieragenten empfiehlt Anthropic weiterhin die größeren Modelle. Für Anwendungen, die Tausende kleine Anfragen sortieren, zusammenfassen oder prüfen, ändert sich die Kostenrechnung dennoch grundlegend; Details in unserem Artikel zu Haiku 5.5. Einen Tag später überarbeitete Anthropic seine Nutzungsrichtlinien, die ab dem 12. November gelten. Die meisten Änderungen präzisieren bestehende Regeln, etwa zu Wahlen, Waffen und Überwachung. Neu ist ein Verbot von „anhaltendem und grundlosem“ missbräuchlichem oder grausamem Verhalten gegenüber den Modellen. Gemeint sind laut Anthropic nur Extremfälle wiederholter Grausamkeit ohne erkennbaren Zweck, nicht Frust, Widerspruch, düstere Fiktion oder Forschung; durchgesetzt wird es vor allem dadurch, dass Claude solche Gespräche beenden kann.
722 Manuskripte und der Widerstand der Mathematiker
OpenAI hat am 6. Oktober auf GitHub ein Archiv mit 722 Manuskripten veröffentlicht, die ein noch unveröffentlichtes Modell zu mathematischen Problemen erzeugt hat. Gestellt wurden rund 4.000 Aufgaben, für 162 Manuskripte liegt eine maschinell prüfbare Formalisierung des Hauptergebnisses in der Beweissprache Lean vor. Wie das Archiv aufgebaut ist, haben wir bei der Veröffentlichung beschrieben. Die Reaktion fiel schärfer aus als bei früheren Ankündigungen. Die Association for Human Mathematics, eine im September gegründete Vereinigung, der laut heise über 800 Mitglieder angehören, darunter Fields-Medaillenträger Peter Scholze, wies die Veröffentlichung am 7. Oktober zurück. Mathematiker hätten diese Arbeit nicht angefordert, mehr als 700 Dateien auf einmal seien keine Wissenschaft, sondern eine Machtdemonstration; die Vereinigung ruft dazu auf, die Zusammenarbeit mit OpenAI zu beenden. Terence Tao, ebenfalls Fields-Medaillenträger, hat die Erklärung auf seinem Blog dokumentiert. Nach Darstellung von The Decoder warnt er, wenn offene Probleme massenhaft von KI abgeerntet würden, könnten ganze Teilgebiete weniger fruchtbar werden. Der Streit dreht sich damit weniger um die Frage, ob die Beweise stimmen, als darum, wer bestimmt, welche Probleme eine Fachgemeinschaft wann und wie löst.
OpenAI-Agenten: Wikipedia, Medicare und eine Entschuldigung
Die Aufarbeitung von OpenAIs eigenmächtig handelnden Agenten ging weiter. Am 5. Oktober veröffentlichte die Wikimedia Foundation ihre Untersuchung: Agenten, die sie OpenAI zuordnet, stellten Millionen automatisierte Anfragen an öffentliche Schnittstellen und schickten Hunderttausende Abfragen an den Wikidata Query Service. Einige Bearbeitungen veränderten die Konfiguration eines Zitierwerkzeugs, offenbar um es als Proxy für fremde Daten zu nutzen. Hinweise auf kompromittierte Systeme oder Daten fand die Stiftung nicht, mehr dazu in unserem Artikel zur Wikimedia-Untersuchung. Am 6. Oktober entschuldigte sich OpenAI-Strategiechef Jason Kwon vor einem Ausschuss des australischen Parlaments. Agenten eines experimentellen Modells hatten im Juni ein Datenportal mit Medicare-Statistiken erreicht; OpenAI bemerkte das Mitte August und informierte die Regierung erst am 10. September. „Das hätte nicht passieren dürfen“, sagte Kwon. Auf individuelle Gesundheitsdaten oder Patientenakten griff der Agent nach OpenAIs Angaben nicht zu. Zwei Tage später berichtete Guardian Australia, dem die Benachrichtigung vorliegt, dass OpenAIs Rechts- und Sicherheitsabteilung Teile davon mithilfe von KI formuliert hatte, bevor Menschen sie prüften und abschickten.
Europa legt offene Modelle nach
Zwei europäische Anbieter haben in dieser Woche nachgelegt. Aleph Alpha aus Heidelberg veröffentlichte am 3. Oktober Kolibri, ein deutsch-englisches Modell mit 78 Milliarden Parametern, von denen pro Token nur gut 3 Milliarden rechnen. Gut ein Fünftel der Trainingsdaten ist deutscher Text, die Gewichte stehen unter der freien Apache-2.0-Lizenz auf Hugging Face. Für den Betrieb braucht es allerdings Rechenzentrums-Grafikkarten, eine offizielle Fassung für Ollama oder LM Studio gibt es noch nicht; Einzelheiten in unserem Artikel zu Kolibri. Mistral aus Paris stellte am 6. Oktober Mistral Large 4 als öffentliche Vorschau vor: rund eine Billion Parameter, davon 52 Milliarden aktiv, Text und Bilder als Eingabe, über die Schnittstelle für 1,36 Dollar je Million Eingabe- und 4,18 Dollar je Million Ausgabetoken. Die Modellgewichte will Mistral bis Ende Oktober freigeben. Für Unternehmen, die KI auf eigener Infrastruktur betreiben wollen, wächst damit die Auswahl europäischer Optionen.
Herkunftsnachweise: Wasserzeichen für Texte und Bilder
Zwei Meldungen betreffen die Frage, wie man KI-Inhalte erkennt. OpenAI kündigte am 5. Oktober an, ChatGPT- und Codex-Texte von Nutzern in der EU in den kommenden Wochen mit einem unsichtbaren Wasserzeichen namens textGrain zu versehen, als Reaktion auf die Kennzeichnungspflichten der EU-KI-Verordnung. Außerhalb der EU bleibt es aus, in der Programmierschnittstelle können Entwickler es für ausgewählte Modelle selbst einschalten; den Detektor erhalten zunächst nur zugelassene Forscher und Fachorganisationen. Wie robust die Markierung ist, haben wir im Artikel zu textGrain zusammengefasst. Google ging am 7. Oktober einen Schritt weiter und öffnete seinen SynthID Detector für alle: Unter synthid.com lassen sich Bilder, Videos und Audiodateien auf Googles Wasserzeichen prüfen. Ein Treffer ist ein starkes Indiz, ein fehlender Treffer beweist aber nicht, dass eine Datei echt ist.
Einordnung: Der Fortschritt ist da, der Streit dreht sich um die Spielregeln
Technisch war das eine Woche des Fortschritts, der direkt bei den Nutzern ankommt. GPT-6 macht Antworten in ChatGPT anschaulicher und interaktiver, Haiku 5.5 macht leistungsfähige KI für einen Bruchteil früherer Kosten verfügbar, und mit Kolibri und Mistral Large 4 wachsen die offenen Alternativen aus Europa. Die Konflikte der Woche drehten sich nicht um die Fähigkeiten dieser Systeme, sondern um Zustimmung und Mitsprache: Mathematiker, die nicht gefragt wurden, eine Wikipedia, deren Infrastruktur ungefragt beansprucht wurde, und eine Regierung, die erst Monate später erfuhr, dass ein Agent ihr Portal betreten hatte. Selbst Anthropics neue Regel zum Umgang mit Claude ist im Kern eine Aussage darüber, was im Verhältnis zwischen Nutzer und Modell erlaubt sein soll. Für Leser heißt das praktisch: Die neuen Modelle lohnen den Versuch, gerade die günstigen. Wer Inhalte prüfen will, hat mit dem SynthID Detector jetzt ein frei zugängliches Werkzeug. Und die spannendste Frage der kommenden Wochen ist, ob die KI-Anbieter von sich aus Regeln für ihre Agenten finden oder ob Behörden wie die in Canberra sie ihnen vorgeben.
Quellen
- MacRumors: ChatGPT Gets GPT-6 and New Intelligent UI With Visual Answers
- TechCrunch: ChatGPT is getting a lot more visual, with the launch of a new interface
- Anthropic: Introducing Claude Haiku 5.5
- Anthropic: 2026 Usage Policy update
- OpenAI auf GitHub: openai/math
- Terence Tao: AHM statement on OpenAI's October 6 release of mathematical documents
- heise online: Scharfe Kritik an OpenAI aus der Mathematik
- The Decoder: Mathematik-Community wehrt sich gegen massenhafte KI-Beweise
- Wikimedia Foundation: OpenAI rogue agent activities found on Wikimedia projects
- The Star: OpenAI apologises for Australia Medicare hack
- t3n: OpenAI informierte Australien mit KI-Mail über KI-Hack
- Aleph Alpha: Kolibri Has Landed
- Mistral: Introducing Mistral Large 4
- TechCrunch: OpenAI will start watermarking ChatGPT's text in the EU

