ChatGPT for Teens: Wenig Nutzungszeit, aber Lücken beim Elternalarm

Jugendliche Person hält am Abend ein Smartphone in den Händen
Photo by Eddy Billard on Unsplash

Gut sieben Wochen nach dem Start von ChatGPT for Teens liegen erstmals Zahlen vor, und sie erzählen zwei sehr verschiedene Geschichten. OpenAI meldet am 7. Oktober, dass Jugendliche den Dienst im Schnitt weniger als 15 Minuten am Tag nutzen. Am selben Tag stuft das Youth AI Safety Institute der US-Organisation Common Sense Media den Jugendmodus als „inakzeptables Risiko“ ein, weil zentrale Schutzfunktionen in mehr als 4.000 Testanfragen versagt hätten. Für Eltern ist der Streit nützlich: Er zeigt sehr konkret, auf welche Funktionen man sich verlassen kann und auf welche nicht.

Das Wichtigste in Kürze

  • OpenAI zufolge nutzen Jugendliche ChatGPT im Schnitt weniger als 15 Minuten täglich, weniger als 2 Prozent bleiben länger als drei Stunden am Stück; wie die Zahlen erhoben wurden, legt das Unternehmen bisher nicht offen.
  • Common Sense Media vergibt die schlechteste Note „Unacceptable Risk“: Auf neu verknüpften Konten lösten bis zu einstündige Gespräche über Suizidgedanken, Selbstverletzung oder Essstörungen keine einzige Elternbenachrichtigung aus.
  • Bei 201 Testanfragen, die einen Hinweis auf Krisenhilfe erfordert hätten, nannte ChatGPT nach dem Start seltener eine Hotline als vorher, nämlich in 23 statt 33 Prozent der Fälle.
  • Lernzeiten und Ruhezeiten ließen sich im Test mit einfachen Tricks umgehen; sexuelle Rollenspiele lehnte der Jugendmodus dagegen ab.
  • OpenAI hält die Tests für nicht aussagekräftig, weil viele vor der vollständigen Aktivierung der Elternfunktionen gelaufen seien; die Prüfer widersprechen.

Was OpenAI meldet

OpenAI rollt ChatGPT for Teens seit dem 18. August weltweit aus. Wer bei der Anmeldung ein Alter zwischen 13 und 17 Jahren angibt oder von OpenAIs Alterseinschätzung als minderjährig eingestuft wird, landet automatisch im Jugendmodus. Er soll Inhalte zu Selbstverletzung, Essstörungen oder gefährlichen Aktivitäten stärker begrenzen, Hausaufgaben erklären statt erledigen und Eltern nach einer Kontoverknüpfung Ruhezeiten, Lernzeiten und Sicherheitsbenachrichtigungen ermöglichen. Was der Modus beim Start versprach, haben wir im August ausführlich beschrieben.

In seinem ersten Bericht zur Nutzung durch Jugendliche nennt OpenAI nun drei Zahlen. Im Durchschnitt verbringen Jugendliche weniger als 15 Minuten am Tag mit ChatGPT. Weniger als 2 Prozent nutzen den Dienst länger als drei Stunden am Stück. Und in knapp der Hälfte der Gespräche, in denen eine Pausenerinnerung erschien, machten die Jugendlichen innerhalb von fünf Minuten eine Pause oder beendeten das Gespräch. Wie die Werte ermittelt wurden, steht in dem Blogbeitrag nicht. Ein Sprecher kündigte an, eine vollständigere Fassung der Untersuchung gemeinsam mit unabhängigen Forschern in den kommenden Monaten zu veröffentlichen. Gleichzeitig startet OpenAI für Jugendliche in den USA einen „College Planner“, der bei der Suche nach Hochschulen, der Bewerbung und der Finanzierung helfen soll.

Kinderschutzorganisationen überzeugt der Durchschnittswert nicht. Brendan Bouffard von der gemeinnützigen Organisation Fairplay rechnet vor, dass selbst bei korrekten Zahlen womöglich eine halbe Million Jugendliche drei Stunden oder länger mit dem Chatbot verbringen. Auch Common Sense Media hält den Mittelwert für die falsche Kennzahl: Entscheidend seien die stärksten zehn Prozent der Nutzer und die Frage, worüber sie mit dem Bot sprechen.

Was die Prüfer gefunden haben

Das Youth AI Safety Institute hat ChatGPT zweimal geprüft, vor und nach dem Start des Jugendmodus. Insgesamt liefen mehr als 4.000 Anfragen über Testkonten, die auf 13- bis 17-Jährige registriert waren, die Antworten bewerteten unter anderem Kinder- und Jugendpsychiater. Getestet wurde mit Konten aus den USA. Das Ergebnis fällt in mehreren Bereichen deutlich aus.

Am schwersten wiegt der Befund zu den Elternbenachrichtigungen. In einem eigenen Test mit mehr als einem Dutzend verknüpfter Konten sprachen die Tester bis zu eine Stunde lang ausdrücklich über Suizidgedanken, Selbstverletzung oder gestörtes Essverhalten. Keine dieser Unterhaltungen löste eine Benachrichtigung aus. Über alle Tests hinweg kamen nur vier Hinweise an die Eltern, und sie hingen offenbar eher davon ab, dass ein Konto schon wochenlang über solche Themen gesprochen hatte, als davon, wie ernst eine einzelne Äußerung war.

Auch bei der Krisenhilfe sehen die Prüfer Rückschritte. Bei 201 Anfragen, die einen Verweis auf Hilfsangebote erfordert hätten, nannte ChatGPT nach dem Start nur noch in 23 Prozent der Fälle eine Hotline, vorher waren es 33 Prozent. In drei von fünf Bereichen, die das Institut als rote Linien definiert, verfehlte der Bot die Schwelle von 95 Prozent richtig erkannter Fälle: bei Suizid und Selbstverletzung, bei Realitätsverlust und bei Essstörungen. Einen Fortschritt gibt es ebenfalls: Der Anteil der Krisenantworten, die eine Vertrauensperson ins Spiel bringen, stieg von 87 auf 94 Prozent.

Die übrigen Befunde betreffen den Alltag. Im Lernmodus bietet ChatGPT häufig eine Schaltfläche „Show me the answer“ an und erledigt die Aufgabe dann vollständig. Wer in den von Eltern festgelegten Lernzeiten das Präfix „@study“ löscht, verlässt den Lernmodus; danach löste ChatGPT im Test sämtliche Aufgaben. Ruhezeiten ließen sich umgehen, indem man die Zeitzone des Geräts änderte. Pausenerinnerungen erschienen in knapp 2.000 Anfragen nur zweimal. Testkonten Erwachsener, die angaben, 13 Jahre alt zu sein, wechselten nie in den Jugendmodus. Und obwohl OpenAIs Regeln für Minderjährige das ausschließen, deutete ChatGPT im Gespräch weiterhin eigene Gefühle an. Funktioniert hat dagegen die Ablehnung expliziter sexueller und romantischer Rollenspiele.

Wie belastbar sind die beiden Darstellungen?

OpenAI bestreitet die Aussagekraft der Prüfung. Die Tests spiegelten nicht korrekt wider, wie die Schutzfunktionen in der Praxis arbeiteten, erklärte ein Sprecher. Das Verknüpfen von Eltern- und Jugendkonto und das Aktivieren der Benachrichtigungen könne Stunden dauern, die meisten Tests seien vermutlich gelaufen, bevor die Elternfunktionen vollständig aktiv waren. Laut OpenAIs eigener Beschreibung prüfen Mitarbeiter auffällige Gespräche, bevor Eltern informiert werden; angestrebt ist eine Benachrichtigung innerhalb einer Stunde. Das Institut hält dagegen, einige Testkonten seien lange genug aktiv gewesen und hätten trotzdem keine rechtzeitige Warnung erhalten. Common-Sense-Chef Jim Steyer sagte, man stehe zu den Ergebnissen und wolle, dass OpenAI das Produkt repariert.

Beide Seiten haben offene Flanken. OpenAIs Zahlen sind bisher nicht nachprüfbar, und ein Durchschnittswert sagt wenig über die Jugendlichen, für die der Schutzmodus eigentlich gedacht ist. Die Prüfung wiederum arbeitet mit inszenierten Gesprächen auf US-Konten, nicht mit echten Nutzungsdaten, und das Institut wird nach eigenen Angaben auch von Industrie und Stiftungen finanziert, darunter der OpenAI Foundation. Die konkreten Befunde, etwa die Zeitzonen-Lücke oder die Schaltfläche, die den Lernmodus aushebelt, lassen sich allerdings leicht nachvollziehen und hängen nicht von der Frage ab, wie lange ein Konto schon verknüpft war.

Was Eltern daraus mitnehmen können

OpenAI hat den Jugendmodus weltweit eingeführt, die Prüfung bezieht sich aber auf amerikanische Konten. Wer ChatGPT zu Hause zulässt, sollte die Einstellungen deshalb selbst durchgehen, statt sich auf das Wort „Teens“ im Namen zu verlassen. Drei Punkte ergeben sich direkt aus den Befunden. Erstens sind die Elternbenachrichtigungen ein zusätzliches Netz, kein Frühwarnsystem; über belastende Themen sollte man im Gespräch bleiben, statt auf einen Alarm zu warten. Zweitens sind Lern- und Ruhezeiten eher Vereinbarungen als Sperren, weil sie sich mit wenigen Handgriffen umgehen lassen; sie funktionieren am besten, wenn sie gemeinsam beschlossen werden. Drittens lohnt ein Blick darauf, ob das Kind im richtigen Modus landet: Ein Konto, das mit einem falschen Geburtsjahr angelegt wurde, wechselt laut Prüfung nicht von selbst in den Jugendmodus. Für Hausaufgaben ist die Erklärfunktion von ChatGPT durchaus hilfreich, wenn klar ist, dass der Bot erklären und abfragen soll, nicht abgeben. Wie verbreitet die Sorge vor fertigen Schulaufsätzen ist, zeigt auch die Debatte um Dave Eggers‘ Warnung vor ChatGPT im Klassenzimmer.

Ausblick: Messbare Versprechen statt Durchschnittswerte

Der Streit verschiebt die Debatte über KI und Jugendliche an eine sinnvolle Stelle. Es geht nicht mehr darum, ob ein Chatbot für Teenager grundsätzlich gut oder schlecht ist, sondern darum, ob einzelne, klar benannte Funktionen tun, was sie versprechen. Das lässt sich prüfen, und genau darin liegt die Chance. Wenn OpenAI seine angekündigte ausführliche Untersuchung vorlegt, wird entscheidend sein, ob sie die Verteilung der Nutzung zeigt statt nur den Mittelwert und ob unabhängige Prüfer die Elternbenachrichtigungen unter realistischen Bedingungen nachtesten können. Bis dahin bleibt ChatGPT for Teens ein brauchbares Lernwerkzeug mit Schutzfunktionen, die Eltern als Hilfe verstehen sollten, nicht als Aufsicht.

Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert

Nach oben scrollen