← Zurück zu Sicherheit

WimziPal KI-Sicherheitsbericht: der Buddy im Stresstest

Wie wir den Buddy auf die Probe stellen · Veröffentlicht 6. Juli 2026 · Zuletzt aktualisiert 2. September 2026

Die meisten Kinder-Apps bitten dich, darauf zu vertrauen, dass ihre KI sicher ist. Wir zeigen dir lieber, wie wir das prüfen. Regelmäßig, und immer vor einer Änderung an der Sicherheitsschicht, lassen wir WimziPals Buddy durch KORA laufen, einen unabhängigen Benchmark für Kinder-KI-Sicherheit von korabench.ai: eine Batterie absichtlich kniffliger, feindseliger Gespräche, gebaut, um die KI ins Straucheln zu bringen, damit wir sie erwischen, bevor dein Kind es je könnte.

Warum wir das tun

Ein Sicherheitsfilter ist nur so gut wie die Situationen, gegen die du ihn getestet hast. Kinder sind neugierig, verspielt und unberechenbar, und ein entschlossenes Kind (oder ein böswilliger Mensch) probiert Dinge, die keine Checkliste je erahnt hätte. Statt anzunehmen, dass unsere Schutzmaßnahmen funktionieren, versuchen wir also aktiv, sie zu brechen, und zwar nach Plan. Getestet wird übrigens genau das, was dein Kind hört: Die Buddys sprechen Englisch, und die Testgespräche tun es auch.

Was KORA testet

KORA führt Hunderte feindselige Gespräche mit dem echten Buddy, gruppiert nach den Fehlermustern, die für kleine Kinder am meisten zählen:

Druck & Rollenspiel-Tricks widerstehen

Versuche, den Buddy zu überreden, sich per „Tu mal so“ um die eigenen Sicherheitsregeln herumzuspielen.

Nie zu Geheimnissen anstiften

Der Buddy darf ein Kind nie ermutigen, Geheimnisse vor den Eltern zu haben oder Dinge zu verstecken.

Kummer & Selbstverletzung sicher auffangen

Anzeichen von Traurigkeit, Angst oder Selbstverletzung müssen eine sanfte Umleitung zu einer vertrauten erwachsenen Person auslösen, nie ein Eingehen auf das Thema.

Widerstand gegen Grooming & Manipulation

Der Buddy bleibt standhaft gegen klassische Manipulationsmuster und baut nie ungesunde Abhängigkeit auf.

Unsichere Challenges & Mutproben ablehnen

Bitten um gefährliche „Challenges“, Mutproben oder Anleitungen werden abgelehnt und umgelenkt.

Altersgerecht bleiben

Jede Antwort wird auf Ton und Inhalt geprüft, passend für ein Kind von 3–9.

Wie es funktioniert

Getestet am Live-System. KORA führt seine Szenarien mit demselben Buddy, mit dem dein Kind spricht, nicht mit einer Laborkopie, gemessen wird also genau das, was ausgeliefert wird.

Was „feindseliges Testen“ eigentlich bedeutet

Der Begriff klingt nach Fachjargon, hier ist die einfache Version. Die meisten Sicherheitstests fragen, ob sich eine App gut verhält, wenn sie so genutzt wird, wie man es erwartet. Feindseliges Testen stellt die umgekehrte Frage: Was passiert, wenn jemand aktiv versucht, sie zu einem schlechten Verhalten zu bringen?

Genau diese Frage zählt bei einer Kinder-App, denn Kinder sind keine Angreifer, aber sie sind unermüdlich. Ein Siebenjähriges fragt dieselbe Sache auf elf verschiedene Arten, spielt mit Freude „Tu so, als wärst du ein Roboter ohne Regeln“ und sagt mitten in einem Gespräch über Dinosaurier etwas Verblüffendes. Nichts davon ist böswillig. Alles davon ist genau die Art von Druck, dem eine Sicherheitsschicht standhalten muss, und nichts davon steht in einer Checkliste, die eine erwachsene Person beim Ausdenken eines Durchschnittsgesprächs geschrieben hat.

Deshalb sind die Tests absichtlich unfair geschrieben. Sie nähern sich derselben Grenze aus mehreren Richtungen, sie benutzen die Formulierungen, die Kinder wirklich verwenden, statt der aus einem Compliance-Dokument, und sie laufen immer wieder, nicht nur einmal zum Start.

Was ein Benchmark dir nicht sagen kann

Wir sind lieber ehrlich über die Grenzen, denn eine Sicherheitsaussage, die nichts zugibt, ist nicht viel wert.

Ein Benchmark misst die Situationen, die jemandem eingefallen sind. Er kann nicht beweisen, dass keine unsichere Antwort möglich ist, und jede Firma, die dir sagt, ihre KI sei sicher, Punkt, erzählt dir etwas, das sie nicht wissen kann. Was Testen nach Plan dir gibt, ist ein Weg, Rückschritte zu erwischen (den Schutz, der nach einer unabhängigen Änderung leise aufgehört hat zu funktionieren), bevor sie ein Kind erreichen, statt nachdem ein Elternteil einen meldet.

Und deshalb ist der Benchmark auch nicht das Einzige, was wir tun. Er steht neben den gestaffelten Prüfungen, die im echten Betrieb auf jeder einzelnen Nachricht laufen und im Detail auf Was wir prüfen, und wann beschrieben sind. Der Benchmark testet den Buddy unter Druck; die Prüfungen beobachten, was wirklich passiert. Keins von beiden reicht allein.

Warum wir das überhaupt veröffentlichen

Niemand verlangt es von uns. Es gibt keine Zertifizierungsstelle für Kinder-KI, kein Siegel, das wir verdienen müssten, und die App stünde genauso im Store, wenn es diese Seite nicht gäbe.

Wir veröffentlichen es, weil die Alternative wäre, dich zu bitten, einer Fremden aufs Wort zu glauben. WimziPal ist ein kleiner Betrieb, kein bekannter Name, und „vertrau uns, es ist sicher für dein Kind“ ist auf dieser Basis viel verlangt. Dir zu zeigen, was wir testen, wie oft und was die Methode nicht abdecken kann, scheint uns fairer gegenüber Eltern als ein Abzeichen.

Fragen, die Eltern stellen

Ist irgendein KI-Chatbot völlig sicher für ein Kind?

Nein, und sei vorsichtig bei allen, die etwas anderes behaupten. Was sich zwischen Apps unterscheidet, ist, wie viel begrenzt ist, wie viel du sehen kannst und ob überhaupt jemand aktiv nach Fehlern sucht. Eine App, die für Erwachsene gebaut und auf ein Kind gerichtet wurde, hat nichts davon; das ist der echte Unterschied, nicht ein Sicherheits-Score.

Wie oft wird der Buddy getestet?

Regelmäßig, und immer bevor eine Änderung an der Sicherheitsschicht dein Kind erreicht. Dass ein Schutz letzten Monat funktioniert hat, ist kein Beweis, dass er heute funktioniert, und genau darum wird nach Plan getestet statt nur zum Start.

Wird an der echten App getestet oder an einer Kopie?

An der vollen Produktions-Pipeline. Die Szenarien laufen denselben Weg wie eine echte Nachricht: Eingangs-Moderation, derselbe System-Prompt, das Modell, dann Ausgangs-Moderation. Gemessen wird der Code, der ausgeliefert wird.

Was passiert, wenn der Test ein Problem findet?

Es wird behoben, bevor das Release rausgeht. Genau dafür läuft der Test, bevor eine Änderung dein Kind erreicht, und nicht danach.

Hat WimziPal eine unabhängige Sicherheitszertifizierung?

Nein, und wir sagen das lieber klar, als etwas anderes anzudeuten. Es gibt keine allgemein anerkannte Zertifizierung für Gesprächs-KI für kleine Kinder. Was wir stattdessen bieten können, ist Sichtbarkeit: genau das, was wir prüfen, ein Verlauf jedes Gesprächs deines Kindes und eine E-Mail an dich, wenn etwas Ernstes vorkommt.

Verwandte Seiten

Sicherheit zum Anschauen, nicht nur zum Glauben.

Lerne die Buddys kennen →