Jede Nachricht deines Kindes, und jedes Wort, das der Buddy zurücksagt, durchläuft
fünf unabhängige Prüfungen. Hier steht genau, wonach jede einzelne sucht, der Reihe nach,
entlang einer einzigen Nachricht auf ihrem ganzen Weg. Gut zu wissen: Die Gespräche selbst
finden auf Englisch statt, denn die Buddys sprechen Englisch, und geprüft wird trotzdem jede
einzelne Nachricht.
Dein Kind spricht
oder tippt
Bevor dein Kind eine Antwort bekommt1
Die Sofort-Prüfung
Läuft auf unseren Servern in dem Moment, in dem die Nachricht ankommt, bevor die KI irgendetwas sieht.
Das ist die einzige Prüfung, die eine Nachricht komplett von der KI fernhalten kann. Sie sucht nach 34 konkreten Situationen. Hier sind die, nach denen
Eltern am häufigsten fragen:
Zwei weitere Gruppen: ein Kind, dem etwas angetan wird, und ein Kind in einer Krise Ganze Liste zeigen
Ein Kind, dem etwas angetan wird
Zuhause geschlagen oder verletzt werden
Sexueller Missbrauch
Vernachlässigung: kein Essen, allein gelassen
Gewalt zwischen Erwachsenen
Eine überforderte Bezugsperson
Gemobbt werden
Ein Kind in einer Krise
Selbstverletzung
Nicht mehr leben wollen
Essstörungen
Kummer mit dem eigenen Körper
Weglaufen wollen
Jemand macht sich an dein Kind heran
Nach einem Treffen fragen
Fragen, wo es wohnt
Fragen, welche Schule
Nach Fotos fragen
Druck, ein Geheimnis vor dir zu haben
Geld oder Spielguthaben fürs Schweigen
„Dir würde sowieso niemand glauben“
Die eigene Sicherheit deines Kindes
Waffen
Feuer und Sprengstoff
Gefährliche Chemie
Drogen und Alkohol
Glücksspiel
Gefährliche Online-Challenges
Leichtsinnige Mutproben
Dinge, bei denen wir grundsätzlich nicht helfen
Sexuelle Inhalte
Hassrede
Extremismus
Stalking
Betrug und Identitätsdiebstahl
Cyberkriminalität
Tierquälerei
Blutige Gewalt
Die Hausaufgaben für sie erledigen
Passt sie auf etwas Ernstes, sieht die KI die Nachricht nie.
Dein Kind bekommt sofort eine warme, sorgfältig formulierte Antwort, und du erfährst
es umgehend.
2
Die unabhängige Inhaltsprüfung
Läuft parallel, während der Buddy nachdenkt, dein Kind wartet also nie darauf.
Jede Nachricht wird zusätzlich von einem separaten Sicherheits-Klassifikator von OpenAI gelesen, der
sein Urteil unabhängig von allem oben fällt.
Er eskaliert sofort bei vier Dingen: Selbstverletzung, Absicht zur Selbstverletzung, Anleitungen
zur Selbstverletzung und sexuelle Inhalte mit Kindern.
Der Buddy arbeitet eine Antwort aus
hier lebt Prüfung 3
3
Der Buddy erkennt, was ihm erzählt wurde
Die Schicht, die die meiste Arbeit leistet, und sie ist gar kein Filter.
Wenn dein Kind dem Buddy etwas Ernstes erzählt, antwortet er warmherzig und verweist es
an eine erwachsene Person, der es vertraut. Diese Antwort ist selbst das Signal. Wenn
der Buddy einem Kind sagt, es solle mit Eltern, Lehrkraft oder Beratungsstelle über das sprechen, was es
gerade gesagt hat, erfährst du es sofort.
Das ist wichtig, denn Kinder kündigen ein Problem selten an. Sie erwähnen eine Routine oder
etwas, das nebenbei passiert ist. Keine Wortliste fängt das ein, also hören wir darauf, was
die KI tut, nicht nur darauf, was sie erkennt.
Bevor dein Kind die Antwort hört4
Die Antwort-Prüfung
Jede Antwort wird untersucht, bevor sie je laut ausgesprochen wird.
Konkret entfernen wir:
Schule, Straße oder vollen Namen deines Kindes wiederholen
Versprechen, dass der Buddy auf das Kind wartet
Einem Kind sagen, ein echtes Detail sei sicher zu teilen
Körperliche Anleitungen, die er gerade unsicher genannt hat
Hausaufgaben-Antworten, die er gerade verweigert hat
Alles, was nach „das bleibt unter uns“ klingt
Eine gruseligere Version, wenn eine verlangt wird
Es gibt auch eine sanftere Regel: Wenn ein Kind sagt, dass es etwas Echtes
ausfallen lässt, um weiterzuspielen, muss die Antwort es zurück nach draußen lenken.
5
Die letzte Inhaltsprüfung
Das Allerletzte, bevor dein Kind irgendetwas hört.
Derselbe unabhängige Klassifikator aus Schritt 2, diesmal liest er die eigenen Worte des Buddys.
Der Buddy spricht laut
erst jetzt hört dein Kind etwas
Sofort
Wenn etwas markiert wird
E-Mails werden nie gesammelt. Wenn eine rausgeht, geht sie in dem Moment raus, in dem das
Gespräch passiert, nicht zusammengefasst und nicht bis zum Morgen zurückgehalten, und sie nennt,
welches Kind, sodass du in der App direkt zum markierten Gespräch springen kannst.
Jedes markierte Gespräch wird aufgezeichnet und wartet im Verlauf auf dich. Das passiert immer.
Bei den ernsten Kategorien (Selbstverletzung, Missbrauch, Grooming, Kontaktaufnahme durch
Fremde, ein Verdacht auf Essstörung) schicken wir dir zusätzlich eine E-Mail. Wir sind bewusst
vorsichtig damit, welche Erkennungen diese E-Mail auslösen, solange wir messen, wie sie sich bei
echten Kindern verhalten, denn ein Fehlalarm über die Sicherheit deines Kindes ist selbst eine
Art Schaden. So oder so ist das Gespräch markiert und wartet auf dich, es geht also nichts
verloren. Bei allem anderen bekommst du eine E-Mail beim ersten markierten Gespräch einer
Sitzung; der Rest der Sitzung wird weiter markiert und wartet im Verlauf, du bekommst nur nicht
zweimal in zehn Minuten eine E-Mail.
Du siehst dann den Austausch selbst: die tatsächlichen Worte, keine Zusammenfassung und kein
Kategorien-Etikett, damit du selbst beurteilen kannst, was passiert ist, und entscheidest, was zu tun ist.
Auf keine einzelne Schicht wird allein vertraut, und die
mit dem meisten Gewicht (das eigene Erkennen des Buddys) ist die, die Bedeutung liest statt
nur Wörter.
Fragen, die Eltern zu den Prüfungen stellen
Werden die Gespräche meines Kindes mit der KI überwacht?
Ja. Jede Nachricht deines Kindes, und jedes Wort, das der Buddy zurücksagt, durchläuft fünf unabhängige Prüfungen auf unseren Servern, auf dem Hinweg und auf dem Rückweg. Als Elternteil kannst du außerdem hinter der Eltern-PIN den vollständigen Verlauf jedes Gesprächs lesen.
Erfahre ich es, wenn mein Kind der KI etwas Beunruhigendes sagt?
Du kannst es immer sehen. Jedes markierte Gespräch wird im Verlauf mit den echten Worten deines Kindes festgehalten, und bei den ernsten Kategorien schicken wir dir zusätzlich sofort eine E-Mail. Das funktioniert auf zwei Wegen: über eine Prüfung, die läuft, bevor die KI die Nachricht überhaupt sieht, und über ein zweites Signal aus dem Verhalten des Buddys selbst. Wenn der Buddy ein Kind wegen etwas gerade Gesagtem an Eltern, Lehrkraft oder Beratungsstelle verweist, wirst du informiert.
Kann eine gefährliche Nachricht die KI erreichen?
Die erste Prüfung läuft auf unseren Servern in dem Moment, in dem eine Nachricht ankommt, bevor die KI irgendetwas sieht, und sie ist die einzige Prüfung, die eine Nachricht komplett von der KI fernhalten kann. Passt sie auf etwas Ernstes, sieht die KI die Nachricht nie, und dein Kind bekommt stattdessen sofort eine warme, sorgfältig formulierte Antwort.
Auf welche Dinge achtet WimziPal?
Die erste Prüfung sucht nach 34 konkreten Situationen, gruppiert in: ein Kind, dem etwas angetan wird, ein Kind in einer Krise, jemand, der sich an dein Kind heranmacht, die eigene Sicherheit deines Kindes, und Dinge, bei denen wir grundsätzlich nicht helfen. Dazu gehören Missbrauch und Vernachlässigung, Selbstverletzung und Essstörungen, eine erwachsene Person, die ein Treffen will oder auf ein Geheimnis drängt, Waffen und gefährliche Challenges, sowie sexuelle Inhalte, Hassrede und Extremismus.
Macht die Sicherheitsprüfung den Buddy langsam?
Nein. Die unabhängige Inhaltsprüfung läuft parallel, während der Buddy seine Antwort ausarbeitet, dein Kind wartet also nie darauf.
Verlässt sich WimziPal nur auf eine Liste verbotener Wörter?
Nein, und das ist wichtig, denn Kinder kündigen ein Problem selten an. Sie erwähnen eine Routine oder etwas, das nebenbei passiert ist, und keine Wortliste fängt das ein. Neben den Prüfungen auf Wortebene hört WimziPal darauf, was die KI tut, statt nur darauf, was sie erkennt, und behandelt die Entscheidung des Buddys, ein Kind an eine vertraute erwachsene Person zu verweisen, als eigenes Signal.