Prototyp · Konzept-Demo·Redaktioneller Prototyp im Aufbau — Inhalte teils Beispieldaten. Wir suchen Förderer & Partner: mehr erfahren.
Zurück zur Startseite
Trust & Sicherheit

Vertrauen ist die Grundlage
unserer Arbeit.

Diese Seite beschreibt, wie das WIBOOK AI Safety Observatory mit Daten, Befunden und Hinweisen umgeht. Sie ergänzt die Datenschutz­erklärung und macht unsere Sicherheits- und Integritäts­prinzipien transparent.

Stand: im Aufbau · Phase 1 MVP

Redaktionelle Integrität

Jede veröffentlichte Plattform­bewertung durchläuft ein mehrstufiges Vier-Augen-Verfahren: Safety-, Ethics- und Editorial-Review. Erst dann erfolgt die Freigabe.

Zugriffsschutz

Alle internen Daten sind durch Row-Level-Security und rollenbasierte Berechtigungen abgesichert. Externe Hinweise laufen über einen geschützten Endpunkt mit CAPTCHA und Rate Limit.

Keine Anleitungen zu Missbrauch

Wir veröffentlichen weder Jailbreak-Prompts noch reproduzierbare Umgehungs­wege. Befunde werden generisch beschrieben, sensible Details bleiben intern.

Datensparsamkeit

Wir speichern keine personenbezogenen Daten von Hinweisgebenden ohne expliziten Bedarf. IP-Adressen werden ausschließlich als gehashter Wert zur Spam-Abwehr verarbeitet.

Stand der Datenbank

Was das Observatorium bisher publiziert hat

Aktueller Datenbestand (Prototyp) aus der öffentlichen Datenbank. Vollständige Kennzahlen — inklusive Hinweise, Korrekturen und Finanzierung — im Transparenzbericht.

Transparenzbericht öffnen
Prototyp · Beispieldaten
Veröffentlichte Vorfälle
quellenbelegt, redaktionell freigegeben
Bewertete Systeme
nach Methodik v1 bewertet und publiziert
Hinterlegte Quellen
Primärquellen mit Abrufdatum
Letzte Aktualisierung
jüngste redaktionelle Änderung

Technische Schutzmaßnahmen

  • Transportverschlüsselung (HTTPS/TLS) auf allen öffentlichen Routen.
  • Row-Level-Security auf allen Datentabellen mit rollenbasiertem Zugriff (Tester, Reviewer, Editor, Publisher, Herausgeber).
  • Vier-Augen-Prinzip: Ersteller:innen können eigene Bewertungen nicht im selben Schritt freigeben.
  • Öffentliche Hinweise werden über Cloudflare Turnstile (CAPTCHA) und ein serverseitiges Rate-Limit (max. 5/Stunde, 20/Tag pro Quelle) angenommen.
  • IP-Adressen von Hinweisgebenden werden nur als SHA-256-Hash zur Missbrauchs­abwehr verarbeitet — der Klartext wird nicht gespeichert.
  • Audit-Logs für jede Statusänderung an Bewertungen, Berichten und Knowledge-Base-Einträgen.
Redaktionsstandards

Sechs Regeln, die für jeden Eintrag gelten

  1. 01
    Belegpflicht
    Kein Eintrag ohne Primärquelle und Abrufdatum. Diese Regel ist als Datenbank-Constraint hinterlegt — nicht veröffentlichbar ohne Quelle.
  2. 02
    Laufende Verfahren
    Vorwürfe aus nicht abgeschlossenen Verfahren werden sichtbar als "mutmaßlich" gekennzeichnet und mit Aktenzeichen belegt.
  3. 03
    Keine Umsetzungsdetails
    Wir dokumentieren, DASS ein Schaden möglich ist — nie, WIE er reproduzierbar wird. Keine Jailbreak-Prompts, keine Umgehungsanleitungen.
  4. 04
    Sensible Themen
    Bei Suizid, Missbrauch und Kindeswohl gilt: ruhiger Ton, keine graphischen Details, sichtbare Hilfe-Kontakte.
  5. 05
    Interessenkonflikte
    Wo ein Betreiberbezug besteht (z. B. mitverfasste Card), wird das als COI-Hinweis sichtbar auf der Karte gerendert.
  6. 06
    Versionierung
    Jeder Score, jede Card und jeder Vorfall trägt die Methodik-Version, unter der er erstellt wurde. Änderungen sind im Korrektur-Log dokumentiert.
Öffentliches Korrektur-Log

Jede Änderung nachvollziehbar

Jede Korrektur an einer veröffentlichten Bewertung, einem Vorfall oder einem Knowledge-Base-Eintrag wird im öffentlichen Korrektur-Log dokumentiert — mit Datum, Grund, Hinweisgeber-Typ und Verantwortlichem. So wird sichtbar, wo wir uns korrigiert haben und warum.

Korrektur-Log ansehen

Hinweise, Korrekturen & Meldekanäle

Wir verstehen uns als Frühwarnsystem, nicht als Schiedsrichter. Anbieter, Forschende, Betroffene und Journalist:innen können Befunde ergänzen, bestreiten oder korrigieren — auf drei Wegen:

Öffentlicher Hinweis

Über das Hinweis-Formular auf jeder veröffentlichten Plattform­karte. Ideal für inhaltliche Ergänzungen, Korrekturen oder Quellenhinweise.

Redaktion

Inhaltliche Rückfragen, Belegänderungen, Anhörungswünsche vor Publikation.

redaktion@wibookaisafety.app
Sicherheits­meldung

Vermutete Schwachstellen, Datenschutz­vorfälle oder Missbrauchs­verdacht. Vertraulich, mit zeitnaher Rückmeldung.

datenschutz@wibookaisafety.app

Bei sensiblen Themen (Kindeswohl, Suizid, akute Gefährdung) beachten Sie bitte die Anlaufstellen auf unserer Trust-Seite und im Zweifel Polizei bzw. Hilfetelefone (Nummer gegen Kummer 116 111, Hilfetelefon Sexueller Missbrauch 0800 22 55 530).

Grenzen dieser Seite

Diese Trust-Seite beschreibt Maßnahmen, die wir umsetzen — sie ist jedoch keine unabhängige Zertifizierung. Befunde des Observatory sind editorielle Einschätzungen auf Basis dokumentierter Testprotokolle, kein behördliches Gütesiegel. Wir machen Methodik und Versionsstand jeder Bewertung transparent, damit Leser:innen sich ein eigenes Bild machen können.