01 — LE POSTE DE COMMANDE DE VOS CONTENUSchaque message inspecté, annoté, classé

Le contenu
entre.
Les indésirables
non.

Vos modérateurs ne trient plus le spam à la main. Ils ne voient que ce que le pipeline n'a pas pu trancher seul.

[ REJOINDRE LA LISTE D'ATTENTE ]

ModShield est une API de modération de contenu qui analyse chaque publication, inscription et message envoyé à votre communauté via huit moteurs de détection — ML, règles, confiance et réputation des identités — et renvoie en moins de 100 ms un verdict explicable : autoriser, examiner ou bloquer.

MODÉRATION DE CONTENU EXPLICABLE API-FIRST · FAIL-OPEN · MODE OBSERVATION
PIPELINE DE DÉTECTION · TRACE EN DIRECT
MESSAGE ENTRANT1/4 · lang=fr
"Je vends des comptes vérifiés, offre limitée, contactez-moi en DM"
RAW INPUT· · ·
TOKENIZE· · ·
ML CLASSIFY· · ·
RULES ENGINE· · ·
TRUST ENGINE· · ·
VERDICT· · ·
02 — TROIS VERDICTS POSSIBLESchaque décision est expliquée, pas seulement prononcée

ALLOW

Contenu sain, auteur de confiance, dans le sujet. Passe sans friction.
"Muy buen artículo — explicación clarísima de los pasos de migración. Me lo guardo."
score
7
confidence
0.93
action
allow

REVIEW

Signaux ambigus. Retenu pour un modérateur avant publication.
"Great post! Check my profile for more tips — link in bio 🔗"
SELF_PROMOTIONFIRST_POST_LINK
score
55
confidence
0.41
action
send_to_review

BLOCK

Spam à forte confiance. Rejeté avant d'atteindre la communauté.
"Je vends des comptes vérifiés, offre limitée, contactez-moi en DM"
COMMERCE_OFFERURGENCY_TRIGGEROFFSITE_REDIRECT
score
94
confidence
0.96
action
block
03 — POUR QUI

Pensé pour ceux qui nettoient derrière les spammeurs.

ModShield s'adresse aux équipes qui modèrent déjà à la main et n'arrivent plus à suivre — pas aux sites qui veulent une boîte noire décidant à leur place.

FORUMS COMMUNAUTAIRES

Des modérateurs bénévoles passent leurs soirées à supprimer les mêmes annonces de vente de comptes, et une vague d'inscriptions à 3 h du matin reste sans réponse jusqu'au lendemain.

Flarum, Discourse, phpBB — connecteur ou API REST
SAAS AVEC CONTENU UTILISATEUR

Commentaires, profils et formulaires de contact sont une porte ouverte, et une liste de mots interdits bloque vos vrais clients aussi souvent que les spammeurs.

API REST, un appel par événement
ÉQUIPES SOUMISES À UNE OBLIGATION DE CONFORMITÉ

Vous devez justifier une suppression auprès d'un utilisateur, d'un client ou d'un régulateur — et « le filtre l'a décidé » n'est pas une réponse.

Raisons exploitables, piste d'audit complète, mode observation
04 — 8 MOTEURS DE DÉTECTION EN SÉRIEfail-open — une panne dégrade le score, jamais le trafic

Chaque message parcourt une chaîne complète avant toute décision.

Les moteurs s'exécutent en séquence et s'enrichissent mutuellement. Chaque étape peut ajouter des raisons. La décision finale reflète l'ensemble de la chaîne, et non un seul signal.

01
FEATURE EXTRACTION
Caractéristiques structurelles et de texte normalisé fusionnées sur l'événement avant le scoring.
40+ features
02
ML CLASSIFIER
Modèle anti-spam multilingue fastText avec repli heuristique par mots-clés. Fail-open.
multilingual fastText
03
TOPIC FIT
Pertinence par communauté — contenu hors sujet, profil de publication inhabituel, domaines inconnus.
per-community
04
RULES ENGINE
Règles rédigées par le tenant, appliquées après le ML. Donne aux communautés un contrôle direct de leur politique.
tenant-defined
05
TRUST ENGINE
Historique d'approbations, de spam et de faux positifs par acteur, pondéré dans le temps.
decays over time
06
IDENTITY REPUTATION
Annuaire inter-tenant d'identifiants et d'IP hachés en HMAC. Corroboré, puis décru.
cross-tenant
07
SCORING ENGINE
Combine ML + règles + confiance + réputation en un unique score numérique.
weighted combine
08
DECISION ENGINE
Compare le score aux seuils de la SitePolicy. Émet un verdict, une action, une gravité et des raisons.
per-site policy
Bêta privée ouverte — réservez votre place.REJOINDRE LA LISTE D'ATTENTE →
05 — UN SEUL ENDPOINT. UNE RÉPONSE EXPLICABLE.

POST.
Obtenez un verdict.
Sachez pourquoi.

Un seul appel API renvoie non seulement un verdict, mais aussi le détail du score et chaque raison ayant contribué à la décision. Votre équipe de modération peut auditer, surcharger et s'entraîner dès le premier jour.

AUTHENTIFICATION
Clé API par site
FORMAT
JSON, REST
OBJECTIF DE LATENCE
< 100ms p95
EN CAS DE PANNE ML
Fail-open, raison journalisée
REQUEST
POST /api/v1/check HTTP/1.1
Host: api.modshield.net
X-Api-Key: ms_live_Kx9vTmL4pRqN8hZ2
Content-Type: application/json
{
"event_id": "post-842",
"platform": "flarum",
"event_type": "post.created",
"actor": { "external_id": "usr_4f2a9c" },
"content": { "body": "Je vends des comptes vérifiés,
offre limitée, contactez-moi en DM" }
}
RESPONSE
HTTP/1.1 200 OK
Content-Type: application/json
{
"decision_id": "dec_9f31c2",
"score": 94,
"computed_verdict": "block",
"effective_action": "block",
"assessment": "violating",
"severity": "high",
"confidence": 0.96,
"shadow": false,
"reasons": [
"COMMERCE_OFFER",
"OFFSITE_REDIRECT",
"URGENCY_TRIGGER",
"VELOCITY_BURST"
],
"model_version": "fasttext-multilingual-v1"
}

06 — CE QUI COMPTE

< 100ms
Objectif de latence p95
8
Moteurs en série sur chaque message
100%
Décisions avec raisons exploitables par machine
0
Trafic bloqué quand le modèle ML est indisponible

Le chiffre de latence est l'objectif d'ingénierie sur lequel nous construisons et testons pendant la bêta privée, mesuré sur notre propre infrastructure — ce n'est pas un SLA contractuel. Les mesures de production seront publiées quand le volume de la bêta les rendra significatives. Les trois autres chiffres sont des propriétés de conception : huit moteurs, une raison attachée à chaque décision, et aucun trafic bloqué quand le modèle est indisponible.

07 — FAIL-OPEN PAR CONCEPTION

Une panne ne bloque jamais votre trafic.

Si le modèle ML est indisponible, ModShield dégrade la qualité du score — jamais la disponibilité. Chaque dégradation est enregistrée dans reasonsJson avec la raison exacte.

ML CLASSIFIERstub fallback · score=0.5DOWN
TOPIC FITtopic_fit=0.71OK
RULES ENGINE1 rule matchedOK
TRUST ENGINEtrust_score=+0.2OK
DECISION ENGINEreason: ml_unavailableDEGRADED
VERDICTEXAMEN (dégradé)

08 — QUESTIONS

Qu'advient-il des contenus signalés par ModShield ?

Rien que vous n'ayez demandé. Chaque site a un mode : en mode observation, les décisions sont enregistrées mais jamais appliquées, ce qui vous permet de les comparer à ce que vos modérateurs auraient fait. Quand vous passez en mode application, le verdict pilote l'action exécutée par votre connecteur.

Combien cela coûtera-t-il ?

L'accès à la bêta privée est gratuit, et aucun tarif n'est encore publié : les paliers sont dimensionnés à partir de l'usage réel de la bêta plutôt que devinés à l'avance. Les tarifs seront annoncés avant la disponibilité générale, d'abord aux inscrits sur la liste d'attente, et rien de ce qui a été consommé pendant la bêta ne sera facturé.

Stockez-vous les données personnelles de mes utilisateurs ?

Les e-mails, noms d'utilisateur, numéros de téléphone et domaines de liens sont hachés en HMAC-SHA256 avant stockage, avec un secret (« pepper ») détenu par votre instance, et la réputation est construite sur ces empreintes plutôt que sur les valeurs brutes. Les adresses IP sont traitées à part : elles ne sont jamais stockées sur les événements individuels, et une adresse n'est enregistrée que lorsqu'elle acquiert une réputation propre ou provient d'une liste de blocage fournie par vous ou par un flux public.

Quelles langues la détection prend-elle en charge ?

Le modèle livré est un classifieur fastText entraîné sur des exemples en anglais, en français et en chinois, et non un ensemble de règles limité à l'anglais. La couverture est la plus solide dans ces trois langues ; ailleurs, les signaux de réputation, de vélocité et de règles s'appliquent toujours, et vous pouvez ajouter des règles pour des motifs propres à une langue.

D'où vient le chiffre « moins de 100 ms » ?

C'est l'objectif d'ingénierie sur lequel l'API est construite et testée en charge, mesuré sur notre propre infrastructure ; ce n'est ni un SLA contractuel ni un chiffre relevé sur du trafic client en production — il n'y en a pas encore. Votre propre client mesure l'aller-retour, et le tableau de bord affiche la latence du modèle observée sur votre trafic : vous pouvez donc vérifier l'affirmation plutôt que la croire sur parole. Nous publierons des p95 mesurés dès que le volume de la bêta les rendra significatifs.

Avec quelles plateformes ModShield fonctionne-t-il ?

Un connecteur Flarum officiel est en bêta privée. Toute autre plateforme — Discourse, phpBB, un forum maison ou tout site avec du contenu utilisateur — s'intègre via l'API REST : un appel POST par contenu à vérifier, une réponse JSON avec le verdict, le score et les raisons.

Que se passe-t-il si le modèle ML tombe en panne ?

Rien de bloquant : ModShield est fail-open par conception. Si le modèle est indisponible, les autres moteurs — règles, réputation, vélocité — continuent de fonctionner. La qualité du score se dégrade, jamais la disponibilité, et chaque dégradation est journalisée avec sa raison exacte.

Combien de temps prend l'intégration ?

Un seul endpoint à appeler. Avec le connecteur Flarum, quelques minutes : une installation composer et une clé API. Via l'API REST, comptez environ une journée pour brancher vos événements — publications, inscriptions, messages — et tout tester en mode observation avant d'appliquer quoi que ce soit.

Comment obtenir un accès ?

ModShield est en bêta privée. Inscrivez-vous sur la liste d'attente avec votre email — nous indiquer votre plateforme et ce que vous devez protéger nous aide à prioriser votre accès. L'ouverture est progressive, premiers arrivés, premiers servis.

Puis-je l'essayer sans impacter ma communauté ?

Oui — c'est exactement le rôle du mode observation. Envoyez du trafic réel, obtenez de vraies décisions, n'appliquez rien. Les rapports vous montrent précisément ce qui aurait été bloqué.

Protégez votre communauté. Expliquez chaque décision.

BÊTA PRIVÉE — REJOIGNEZ LA LISTE D'ATTENTE
VOTRE PLATEFORME — FACULTATIF
QUE FAUT-IL PROTÉGER ? — FACULTATIF

Nous conservons votre adresse e-mail pour vous contacter au sujet de l'accès à ModShield, et rien d'autre. Pas de newsletter, pas de tiers, désinscription en répondant. Politique de confidentialité

L'accès à la bêta privée est gratuit. Les tarifs seront publiés avant la disponibilité générale, et les inscrits sur la liste d'attente les connaîtront en premier.

VOIR LA FAQ →
DÉPLOYEZ EN QUELQUES MINUTES
# 1. Install the Flarum connector
composer require modshield/flarum-connector
# 2. Add your site API key
php flarum modshield:configure \
--key=ms_live_Kx9vTmL4pRqN8hZ2
# 3. Every post is now checked.

Connecteurs en bêta privée — l'accès API arrive en premier, les connecteurs suivent.