Le contenu
entre.
Les indésirables
non.
Vos modérateurs ne trient plus le spam à la main. Ils ne voient que ce que le pipeline n'a pas pu trancher seul.
[ REJOINDRE LA LISTE D'ATTENTE ]ModShield est une API de modération de contenu qui analyse chaque publication, inscription et message envoyé à votre communauté via huit moteurs de détection — ML, règles, confiance et réputation des identités — et renvoie en moins de 100 ms un verdict explicable : autoriser, examiner ou bloquer.
ALLOW
REVIEW
BLOCK
Pensé pour ceux qui nettoient derrière les spammeurs.
ModShield s'adresse aux équipes qui modèrent déjà à la main et n'arrivent plus à suivre — pas aux sites qui veulent une boîte noire décidant à leur place.
Des modérateurs bénévoles passent leurs soirées à supprimer les mêmes annonces de vente de comptes, et une vague d'inscriptions à 3 h du matin reste sans réponse jusqu'au lendemain.
Commentaires, profils et formulaires de contact sont une porte ouverte, et une liste de mots interdits bloque vos vrais clients aussi souvent que les spammeurs.
Vous devez justifier une suppression auprès d'un utilisateur, d'un client ou d'un régulateur — et « le filtre l'a décidé » n'est pas une réponse.
Chaque message parcourt une chaîne complète avant toute décision.
Les moteurs s'exécutent en séquence et s'enrichissent mutuellement. Chaque étape peut ajouter des raisons. La décision finale reflète l'ensemble de la chaîne, et non un seul signal.
POST.
Obtenez un verdict.
Sachez pourquoi.
Un seul appel API renvoie non seulement un verdict, mais aussi le détail du score et chaque raison ayant contribué à la décision. Votre équipe de modération peut auditer, surcharger et s'entraîner dès le premier jour.
Le chiffre de latence est l'objectif d'ingénierie sur lequel nous construisons et testons pendant la bêta privée, mesuré sur notre propre infrastructure — ce n'est pas un SLA contractuel. Les mesures de production seront publiées quand le volume de la bêta les rendra significatives. Les trois autres chiffres sont des propriétés de conception : huit moteurs, une raison attachée à chaque décision, et aucun trafic bloqué quand le modèle est indisponible.
Une panne ne bloque jamais votre trafic.
Si le modèle ML est indisponible, ModShield dégrade la qualité du score — jamais la disponibilité. Chaque dégradation est enregistrée dans reasonsJson avec la raison exacte.
Qu'advient-il des contenus signalés par ModShield ?
Rien que vous n'ayez demandé. Chaque site a un mode : en mode observation, les décisions sont enregistrées mais jamais appliquées, ce qui vous permet de les comparer à ce que vos modérateurs auraient fait. Quand vous passez en mode application, le verdict pilote l'action exécutée par votre connecteur.
Combien cela coûtera-t-il ?
L'accès à la bêta privée est gratuit, et aucun tarif n'est encore publié : les paliers sont dimensionnés à partir de l'usage réel de la bêta plutôt que devinés à l'avance. Les tarifs seront annoncés avant la disponibilité générale, d'abord aux inscrits sur la liste d'attente, et rien de ce qui a été consommé pendant la bêta ne sera facturé.
Stockez-vous les données personnelles de mes utilisateurs ?
Les e-mails, noms d'utilisateur, numéros de téléphone et domaines de liens sont hachés en HMAC-SHA256 avant stockage, avec un secret (« pepper ») détenu par votre instance, et la réputation est construite sur ces empreintes plutôt que sur les valeurs brutes. Les adresses IP sont traitées à part : elles ne sont jamais stockées sur les événements individuels, et une adresse n'est enregistrée que lorsqu'elle acquiert une réputation propre ou provient d'une liste de blocage fournie par vous ou par un flux public.
Quelles langues la détection prend-elle en charge ?
Le modèle livré est un classifieur fastText entraîné sur des exemples en anglais, en français et en chinois, et non un ensemble de règles limité à l'anglais. La couverture est la plus solide dans ces trois langues ; ailleurs, les signaux de réputation, de vélocité et de règles s'appliquent toujours, et vous pouvez ajouter des règles pour des motifs propres à une langue.
D'où vient le chiffre « moins de 100 ms » ?
C'est l'objectif d'ingénierie sur lequel l'API est construite et testée en charge, mesuré sur notre propre infrastructure ; ce n'est ni un SLA contractuel ni un chiffre relevé sur du trafic client en production — il n'y en a pas encore. Votre propre client mesure l'aller-retour, et le tableau de bord affiche la latence du modèle observée sur votre trafic : vous pouvez donc vérifier l'affirmation plutôt que la croire sur parole. Nous publierons des p95 mesurés dès que le volume de la bêta les rendra significatifs.
Avec quelles plateformes ModShield fonctionne-t-il ?
Un connecteur Flarum officiel est en bêta privée. Toute autre plateforme — Discourse, phpBB, un forum maison ou tout site avec du contenu utilisateur — s'intègre via l'API REST : un appel POST par contenu à vérifier, une réponse JSON avec le verdict, le score et les raisons.
Que se passe-t-il si le modèle ML tombe en panne ?
Rien de bloquant : ModShield est fail-open par conception. Si le modèle est indisponible, les autres moteurs — règles, réputation, vélocité — continuent de fonctionner. La qualité du score se dégrade, jamais la disponibilité, et chaque dégradation est journalisée avec sa raison exacte.
Combien de temps prend l'intégration ?
Un seul endpoint à appeler. Avec le connecteur Flarum, quelques minutes : une installation composer et une clé API. Via l'API REST, comptez environ une journée pour brancher vos événements — publications, inscriptions, messages — et tout tester en mode observation avant d'appliquer quoi que ce soit.
Comment obtenir un accès ?
ModShield est en bêta privée. Inscrivez-vous sur la liste d'attente avec votre email — nous indiquer votre plateforme et ce que vous devez protéger nous aide à prioriser votre accès. L'ouverture est progressive, premiers arrivés, premiers servis.
Puis-je l'essayer sans impacter ma communauté ?
Oui — c'est exactement le rôle du mode observation. Envoyez du trafic réel, obtenez de vraies décisions, n'appliquez rien. Les rapports vous montrent précisément ce qui aurait été bloqué.
Protégez votre communauté. Expliquez chaque décision.
L'accès à la bêta privée est gratuit. Les tarifs seront publiés avant la disponibilité générale, et les inscrits sur la liste d'attente les connaîtront en premier.
VOIR LA FAQ →Connecteurs en bêta privée — l'accès API arrive en premier, les connecteurs suivent.