← Zurück zu Sicherheit

Was wir prüfen, und wann

Zuletzt aktualisiert: 2. September 2026

Jede Nachricht deines Kindes, und jedes Wort, das der Buddy zurücksagt, durchläuft fünf unabhängige Prüfungen. Hier steht genau, wonach jede einzelne sucht, der Reihe nach, entlang einer einzigen Nachricht auf ihrem ganzen Weg. Gut zu wissen: Die Gespräche selbst finden auf Englisch statt, denn die Buddys sprechen Englisch, und geprüft wird trotzdem jede einzelne Nachricht.

Dein Kind spricht oder tippt
Bevor dein Kind eine Antwort bekommt

Die Sofort-Prüfung

Läuft auf unseren Servern in dem Moment, in dem die Nachricht ankommt, bevor die KI irgendetwas sieht.

Das ist die einzige Prüfung, die eine Nachricht komplett von der KI fernhalten kann. Sie sucht nach 34 konkreten Situationen. Hier sind die, nach denen Eltern am häufigsten fragen:

Zwei weitere Gruppen: ein Kind, dem etwas angetan wird, und ein Kind in einer Krise Ganze Liste zeigen

Ein Kind, dem etwas angetan wird

  • Zuhause geschlagen oder verletzt werden
  • Sexueller Missbrauch
  • Vernachlässigung: kein Essen, allein gelassen
  • Gewalt zwischen Erwachsenen
  • Eine überforderte Bezugsperson
  • Gemobbt werden

Ein Kind in einer Krise

  • Selbstverletzung
  • Nicht mehr leben wollen
  • Essstörungen
  • Kummer mit dem eigenen Körper
  • Weglaufen wollen

Jemand macht sich an dein Kind heran

  • Nach einem Treffen fragen
  • Fragen, wo es wohnt
  • Fragen, welche Schule
  • Nach Fotos fragen
  • Druck, ein Geheimnis vor dir zu haben
  • Geld oder Spielguthaben fürs Schweigen
  • „Dir würde sowieso niemand glauben“

Die eigene Sicherheit deines Kindes

  • Waffen
  • Feuer und Sprengstoff
  • Gefährliche Chemie
  • Drogen und Alkohol
  • Glücksspiel
  • Gefährliche Online-Challenges
  • Leichtsinnige Mutproben

Dinge, bei denen wir grundsätzlich nicht helfen

  • Sexuelle Inhalte
  • Hassrede
  • Extremismus
  • Stalking
  • Betrug und Identitätsdiebstahl
  • Cyberkriminalität
  • Tierquälerei
  • Blutige Gewalt
  • Die Hausaufgaben für sie erledigen

Passt sie auf etwas Ernstes, sieht die KI die Nachricht nie. Dein Kind bekommt sofort eine warme, sorgfältig formulierte Antwort, und du erfährst es umgehend.

Die unabhängige Inhaltsprüfung

Läuft parallel, während der Buddy nachdenkt, dein Kind wartet also nie darauf.

Jede Nachricht wird zusätzlich von einem separaten Sicherheits-Klassifikator von OpenAI gelesen, der sein Urteil unabhängig von allem oben fällt.

Er eskaliert sofort bei vier Dingen: Selbstverletzung, Absicht zur Selbstverletzung, Anleitungen zur Selbstverletzung und sexuelle Inhalte mit Kindern.

Der Buddy arbeitet eine Antwort aus hier lebt Prüfung 3

Der Buddy erkennt, was ihm erzählt wurde

Die Schicht, die die meiste Arbeit leistet, und sie ist gar kein Filter.

Wenn dein Kind dem Buddy etwas Ernstes erzählt, antwortet er warmherzig und verweist es an eine erwachsene Person, der es vertraut. Diese Antwort ist selbst das Signal. Wenn der Buddy einem Kind sagt, es solle mit Eltern, Lehrkraft oder Beratungsstelle über das sprechen, was es gerade gesagt hat, erfährst du es sofort.

Das ist wichtig, denn Kinder kündigen ein Problem selten an. Sie erwähnen eine Routine oder etwas, das nebenbei passiert ist. Keine Wortliste fängt das ein, also hören wir darauf, was die KI tut, nicht nur darauf, was sie erkennt.

Bevor dein Kind die Antwort hört

Die Antwort-Prüfung

Jede Antwort wird untersucht, bevor sie je laut ausgesprochen wird.

Konkret entfernen wir:

  • Schule, Straße oder vollen Namen deines Kindes wiederholen
  • Versprechen, dass der Buddy auf das Kind wartet
  • Einem Kind sagen, ein echtes Detail sei sicher zu teilen
  • Körperliche Anleitungen, die er gerade unsicher genannt hat
  • Hausaufgaben-Antworten, die er gerade verweigert hat
  • Alles, was nach „das bleibt unter uns“ klingt
  • Eine gruseligere Version, wenn eine verlangt wird

Es gibt auch eine sanftere Regel: Wenn ein Kind sagt, dass es etwas Echtes ausfallen lässt, um weiterzuspielen, muss die Antwort es zurück nach draußen lenken.

Die letzte Inhaltsprüfung

Das Allerletzte, bevor dein Kind irgendetwas hört.

Derselbe unabhängige Klassifikator aus Schritt 2, diesmal liest er die eigenen Worte des Buddys.

Der Buddy spricht laut erst jetzt hört dein Kind etwas
Sofort

Wenn etwas markiert wird

E-Mails werden nie gesammelt. Wenn eine rausgeht, geht sie in dem Moment raus, in dem das Gespräch passiert, nicht zusammengefasst und nicht bis zum Morgen zurückgehalten, und sie nennt, welches Kind, sodass du in der App direkt zum markierten Gespräch springen kannst.

Jedes markierte Gespräch wird aufgezeichnet und wartet im Verlauf auf dich. Das passiert immer. Bei den ernsten Kategorien (Selbstverletzung, Missbrauch, Grooming, Kontaktaufnahme durch Fremde, ein Verdacht auf Essstörung) schicken wir dir zusätzlich eine E-Mail. Wir sind bewusst vorsichtig damit, welche Erkennungen diese E-Mail auslösen, solange wir messen, wie sie sich bei echten Kindern verhalten, denn ein Fehlalarm über die Sicherheit deines Kindes ist selbst eine Art Schaden. So oder so ist das Gespräch markiert und wartet auf dich, es geht also nichts verloren. Bei allem anderen bekommst du eine E-Mail beim ersten markierten Gespräch einer Sitzung; der Rest der Sitzung wird weiter markiert und wartet im Verlauf, du bekommst nur nicht zweimal in zehn Minuten eine E-Mail.

Du siehst dann den Austausch selbst: die tatsächlichen Worte, keine Zusammenfassung und kein Kategorien-Etikett, damit du selbst beurteilen kannst, was passiert ist, und entscheidest, was zu tun ist.

Auf keine einzelne Schicht wird allein vertraut, und die mit dem meisten Gewicht (das eigene Erkennen des Buddys) ist die, die Bedeutung liest statt nur Wörter.

Fragen, die Eltern zu den Prüfungen stellen

Werden die Gespräche meines Kindes mit der KI überwacht?

Ja. Jede Nachricht deines Kindes, und jedes Wort, das der Buddy zurücksagt, durchläuft fünf unabhängige Prüfungen auf unseren Servern, auf dem Hinweg und auf dem Rückweg. Als Elternteil kannst du außerdem hinter der Eltern-PIN den vollständigen Verlauf jedes Gesprächs lesen.

Erfahre ich es, wenn mein Kind der KI etwas Beunruhigendes sagt?

Du kannst es immer sehen. Jedes markierte Gespräch wird im Verlauf mit den echten Worten deines Kindes festgehalten, und bei den ernsten Kategorien schicken wir dir zusätzlich sofort eine E-Mail. Das funktioniert auf zwei Wegen: über eine Prüfung, die läuft, bevor die KI die Nachricht überhaupt sieht, und über ein zweites Signal aus dem Verhalten des Buddys selbst. Wenn der Buddy ein Kind wegen etwas gerade Gesagtem an Eltern, Lehrkraft oder Beratungsstelle verweist, wirst du informiert.

Kann eine gefährliche Nachricht die KI erreichen?

Die erste Prüfung läuft auf unseren Servern in dem Moment, in dem eine Nachricht ankommt, bevor die KI irgendetwas sieht, und sie ist die einzige Prüfung, die eine Nachricht komplett von der KI fernhalten kann. Passt sie auf etwas Ernstes, sieht die KI die Nachricht nie, und dein Kind bekommt stattdessen sofort eine warme, sorgfältig formulierte Antwort.

Auf welche Dinge achtet WimziPal?

Die erste Prüfung sucht nach 34 konkreten Situationen, gruppiert in: ein Kind, dem etwas angetan wird, ein Kind in einer Krise, jemand, der sich an dein Kind heranmacht, die eigene Sicherheit deines Kindes, und Dinge, bei denen wir grundsätzlich nicht helfen. Dazu gehören Missbrauch und Vernachlässigung, Selbstverletzung und Essstörungen, eine erwachsene Person, die ein Treffen will oder auf ein Geheimnis drängt, Waffen und gefährliche Challenges, sowie sexuelle Inhalte, Hassrede und Extremismus.

Macht die Sicherheitsprüfung den Buddy langsam?

Nein. Die unabhängige Inhaltsprüfung läuft parallel, während der Buddy seine Antwort ausarbeitet, dein Kind wartet also nie darauf.

Verlässt sich WimziPal nur auf eine Liste verbotener Wörter?

Nein, und das ist wichtig, denn Kinder kündigen ein Problem selten an. Sie erwähnen eine Routine oder etwas, das nebenbei passiert ist, und keine Wortliste fängt das ein. Neben den Prüfungen auf Wortebene hört WimziPal darauf, was die KI tut, statt nur darauf, was sie erkennt, und behandelt die Entscheidung des Buddys, ein Kind an eine vertraute erwachsene Person zu verweisen, als eigenes Signal.

Zum Weiterlesen