01 — DER KONTROLLRAUM FÜR IHRE INHALTEjede Nachricht geprüft, kommentiert, klassifiziert

Inhalte
kommen rein.
Böswillige Akteure
nicht.

Ihre Moderatoren sortieren keinen Spam mehr von Hand. Sie sehen nur noch, was die Pipeline nicht allein entscheiden konnte.

[ AUF DIE WARTELISTE ]

ModShield ist eine Content-Moderations-API, die jeden Beitrag, jede Registrierung und jede Nachricht Ihrer Community durch acht Erkennungs-Engines bewertet — ML, Regeln, Trust und Identitätsreputation — und in unter 100 ms ein nachvollziehbares Urteil liefert: erlauben, prüfen oder blockieren.

ERKLÄRBARE INHALTSMODERATION API-FIRST · FAIL-OPEN · SCHATTENMODUS
ERKENNUNGS-PIPELINE · LIVE-TRACE
EINGEHENDE NACHRICHT1/4 · lang=de
"Ihr Konto wird in 24 Stunden gesperrt — jetzt verifizieren: bit.ly/kt0-verify"
RAW INPUT· · ·
TOKENIZE· · ·
ML CLASSIFY· · ·
RULES ENGINE· · ·
TRUST ENGINE· · ·
VERDICT· · ·
02 — DREI MÖGLICHE URTEILEjede Entscheidung wird erklärt, nicht nur verkündet

ALLOW

Sauberer Inhalt, vertrauenswürdiger Autor, themenbezogen. Geht reibungslos durch.
"Muy buen artículo — explicación clarísima de los pasos de migración. Me lo guardo."
score
7
confidence
0.93
action
allow

REVIEW

Uneindeutige Signale. Wird vor der Veröffentlichung einem Moderator vorgelegt.
"Great post! Check my profile for more tips — link in bio 🔗"
SELF_PROMOTIONFIRST_POST_LINK
score
55
confidence
0.41
action
send_to_review

BLOCK

Spam mit hoher Konfidenz. Abgelehnt, bevor er die Community erreicht.
"Je vends des comptes vérifiés, offre limitée, contactez-moi en DM"
COMMERCE_OFFERURGENCY_TRIGGEROFFSITE_REDIRECT
score
94
confidence
0.96
action
block
03 — FÜR WEN

Gebaut für die Leute, die hinter den Spammern aufräumen müssen.

ModShield richtet sich an Teams, die bereits von Hand moderieren und nicht mehr hinterherkommen — nicht an Seiten, die eine Blackbox für sich entscheiden lassen wollen.

COMMUNITY-FOREN

Ehrenamtliche Moderatoren löschen abends immer dieselben Account-Verkaufsbeiträge, und eine Registrierungswelle um 3 Uhr nachts bleibt bis zum Morgen unbeantwortet.

Flarum, Discourse, phpBB — Konnektor oder REST-API
SAAS MIT NUTZERGENERIERTEN INHALTEN

Kommentare, Profile und Kontaktformulare sind ein offenes Tor, und eine Sperrwortliste trifft Ihre echten Kunden genauso oft wie die Spammer.

REST-API, ein Aufruf pro Ereignis
TEAMS MIT NACHWEISPFLICHTEN

Sie müssen eine Löschung gegenüber Nutzern, Kunden oder einer Aufsicht begründen — und „der Filter hat das entschieden“ ist keine Antwort.

Maschinenlesbare Gründe, vollständiger Audit-Trail, Schattenmodus
04 — 8 ERKENNUNGS-ENGINES IN REIHEfail-open — ein Ausfall mindert den Score, niemals den Traffic

Jede Nachricht durchläuft eine vollständige Kette, bevor eine Entscheidung fällt.

Die Engines laufen nacheinander und ergänzen einander. Jede Stufe kann Gründe hinzufügen. Die endgültige Entscheidung spiegelt die gesamte Kette wider, nicht ein einzelnes Signal.

01
FEATURE EXTRACTION
Strukturelle & normalisierte Textmerkmale, die vor der Bewertung mit dem Ereignis zusammengeführt werden.
40+ features
02
ML CLASSIFIER
Mehrsprachiges fastText-Spam-Modell mit Keyword-Heuristik-Stub als Fallback. Fail-open.
multilingual fastText
03
TOPIC FIT
Relevanz pro Community — themenfremde Inhalte, ungewöhnliches Posting-Profil, unbekannte Domains.
per-community
04
RULES ENGINE
Vom Mandanten erstellte Regeln, angewendet nach dem ML-Schritt. Gibt Communities direkte Richtlinienkontrolle.
tenant-defined
05
TRUST ENGINE
Freigabe-, Spam- und False-Positive-Historie pro Akteur, zeitlich gewichtet.
decays over time
06
IDENTITY REPUTATION
Mandantenübergreifendes Verzeichnis HMAC-gehashter Identifikatoren und IPs. Bestätigt, dann abklingend.
cross-tenant
07
SCORING ENGINE
Kombiniert ML + Regeln + Trust + Reputation zu einem einzigen numerischen Score.
weighted combine
08
DECISION ENGINE
Gleicht den Score mit den SitePolicy-Schwellenwerten ab. Gibt Urteil, Aktion, Schweregrad und Gründe aus.
per-site policy
Private Beta geöffnet — sichern Sie sich Ihren Platz.AUF DIE WARTELISTE →
05 — EIN ENDPUNKT. EINE ERKLÄRBARE ANTWORT.

POST.
Ein Urteil erhalten.
Das Warum erfahren.

Ein API-Aufruf liefert nicht nur ein Urteil — sondern die Score-Aufschlüsselung und jeden Grund, der zur Entscheidung beigetragen hat. Ihr Moderationsteam kann vom ersten Tag an prüfen, überschreiben und trainieren.

AUTHENTIFIZIERUNG
API-Schlüssel pro Website
FORMAT
JSON, REST
LATENZZIEL
< 100ms p95
BEI ML-AUSFALL
Fail-open, Grund protokolliert
REQUEST
POST /api/v1/check HTTP/1.1
Host: api.modshield.net
X-Api-Key: ms_live_Kx9vTmL4pRqN8hZ2
Content-Type: application/json
{
"event_id": "post-842",
"platform": "flarum",
"event_type": "post.created",
"actor": { "external_id": "usr_4f2a9c" },
"content": { "body": "Je vends des comptes vérifiés,
offre limitée, contactez-moi en DM" }
}
RESPONSE
HTTP/1.1 200 OK
Content-Type: application/json
{
"decision_id": "dec_9f31c2",
"score": 94,
"computed_verdict": "block",
"effective_action": "block",
"assessment": "violating",
"severity": "high",
"confidence": 0.96,
"shadow": false,
"reasons": [
"COMMERCE_OFFER",
"OFFSITE_REDIRECT",
"URGENCY_TRIGGER",
"VELOCITY_BURST"
],
"model_version": "fasttext-multilingual-v1"
}

06 — WAS ZÄHLT

< 100ms
p95-Latenzziel
8
Engines in Reihe pro Nachricht
100%
Entscheidungen mit maschinenlesbaren Gründen
0
Blockierter Traffic bei nicht verfügbarem ML-Modell

Die Latenzangabe ist das Engineering-Ziel, gegen das wir während der privaten Beta entwickeln und testen, gemessen auf unserer eigenen Infrastruktur — kein vertragliches SLA. Gemessene Produktionswerte veröffentlichen wir, sobald das Beta-Volumen sie aussagekräftig macht. Die anderen drei Zahlen sind Eigenschaften des Designs: acht Engines, ein Grund an jeder Entscheidung und kein blockierter Traffic, wenn das Modell ausfällt.

06 — GRUNDSÄTZLICH FAIL-OPEN

Ein Ausfall blockiert niemals Ihren Traffic.

Ist das ML-Modell nicht verfügbar, mindert ModShield die Qualität des Scores — niemals die Verfügbarkeit. Jede Minderung wird in reasonsJson mit dem genauen Grund festgehalten.

ML CLASSIFIERstub fallback · score=0.5DOWN
TOPIC FITtopic_fit=0.71OK
RULES ENGINE1 rule matchedOK
TRUST ENGINEtrust_score=+0.2OK
DECISION ENGINEreason: ml_unavailableDEGRADED
URTEILPRÜFEN (eingeschränkt)

08 — FRAGEN

Was passiert mit Inhalten, die ModShield markiert?

Nichts, was Sie nicht ausdrücklich wollen. Jede Website hat einen Modus: Im Schattenmodus werden Entscheidungen aufgezeichnet, aber nie durchgesetzt — so können Sie sie mit dem vergleichen, was Ihre Moderatoren getan hätten. Wenn Sie zur Durchsetzung wechseln, steuert das Urteil die Aktion, die Ihr Connector ausführt.

Was wird es kosten?

Der Zugang zur privaten Beta ist kostenlos, und es ist noch keine Zahl veröffentlicht: Die Stufen werden an der tatsächlichen Beta-Nutzung bemessen statt vorab geschätzt. Die Preise werden vor der allgemeinen Verfügbarkeit angekündigt, zuerst an die Warteliste, und nichts aus der Beta-Nutzung wird in Rechnung gestellt.

Speichern Sie personenbezogene Daten meiner Nutzer?

E-Mail-Adressen, Benutzernamen, Telefonnummern und Link-Domains werden vor der Speicherung mit HMAC-SHA256 gehasht — mit einem geheimen Pepper, den Ihre Instanz verwahrt. Die Reputation baut auf diesen Hashes auf, nicht auf den Rohwerten. IP-Adressen werden gesondert behandelt: Sie werden nie bei einzelnen Ereignissen gespeichert, und eine Adresse wird nur dann erfasst, wenn sie eigene Reputation aufbaut oder aus einer Sperrliste stammt, die Sie oder ein öffentlicher Feed bereitgestellt haben.

Welche Sprachen unterstützt die Erkennung?

Das ausgelieferte Modell ist ein fastText-Klassifikator, trainiert auf englischen, französischen und chinesischen Beispielen — kein rein englisches Regelwerk. In diesen drei Sprachen ist die Abdeckung am stärksten; darüber hinaus greifen weiterhin die Signale aus Reputation, Frequenz und Regeln, und Sie können eigene Regeln für sprachspezifische Muster anlegen.

Woher stammt der Wert von unter 100 ms?

Es ist das Engineering-Ziel, gegen das die API gebaut und lastgetestet wird, gemessen auf unserer eigenen Infrastruktur — kein vertragliches SLA und keine Zahl aus Kunden-Produktionstraffic, den es noch nicht gibt. Ihr eigener Client misst den Roundtrip, und das Dashboard zeigt die beobachtete Modell-Latenz Ihres Traffics — Sie können die Aussage also prüfen statt sie zu glauben. Gemessene p95-Werte veröffentlichen wir, sobald das Beta-Volumen sie aussagekräftig macht.

Mit welchen Plattformen funktioniert ModShield?

Ein offizieller Flarum-Konnektor ist in privater Beta. Jede andere Plattform — Discourse, phpBB, ein eigenes Forum oder jede Website mit Nutzerinhalten — integriert sich über die REST-API: ein POST-Aufruf pro Inhalt, eine JSON-Antwort mit Urteil, Score und Gründen.

Was passiert, wenn das ML-Modell ausfällt?

Nichts Blockierendes: ModShield ist grundsätzlich fail-open. Ist das Modell nicht verfügbar, arbeiten die übrigen Engines — Regeln, Reputation, Frequenz — weiter. Die Score-Qualität sinkt, die Verfügbarkeit nie, und jede Einschränkung wird mit ihrem genauen Grund protokolliert.

Wie lange dauert die Integration?

Ein einziger Endpunkt. Mit dem Flarum-Konnektor: Minuten — eine Composer-Installation und ein API-Schlüssel. Über die REST-API: etwa ein Tag, um Ihre Ereignisse — Beiträge, Registrierungen, Nachrichten — anzubinden und alles im Schattenmodus zu testen, bevor etwas durchgesetzt wird.

Wie bekomme ich Zugang?

ModShield ist in privater Beta. Tragen Sie sich mit Ihrer E-Mail in die Warteliste ein — Ihre Plattform und Ihr Schutzbedarf helfen uns, Ihren Zugang zu priorisieren. Wir öffnen schrittweise, wer zuerst kommt, mahlt zuerst.

Kann ich es ausprobieren, ohne meine Community zu beeinträchtigen?

Ja — genau dafür gibt es den Schattenmodus. Senden Sie echten Traffic, erhalten Sie echte Entscheidungen, setzen Sie nichts durch. Die Berichte zeigen Ihnen genau, was blockiert worden wäre.

Schützen Sie Ihre Community. Erklären Sie jede Entscheidung.

PRIVATE BETA — WARTELISTE
IHRE PLATTFORM — OPTIONAL
WAS SOLL GESCHÜTZT WERDEN? — OPTIONAL

Wir speichern Ihre E-Mail-Adresse, um Sie zum ModShield-Zugang zu kontaktieren, und sonst nichts. Kein Newsletter, keine Dritten, Abmeldung per Antwortmail. Datenschutzerklärung

Der Zugang zur privaten Beta ist kostenlos. Die Preise werden vor der allgemeinen Verfügbarkeit veröffentlicht — Warteliste zuerst.

ZUR FAQ →
IN MINUTEN EINSATZBEREIT
# 1. Install the Flarum connector
composer require modshield/flarum-connector
# 2. Add your site API key
php flarum modshield:configure \
--key=ms_live_Kx9vTmL4pRqN8hZ2
# 3. Every post is now checked.

Konnektoren in privater Beta — API-Zugang kommt zuerst, Konnektoren folgen.