El contenido
entra.
Los malos actores
no.
Tus moderadores dejan de filtrar spam a mano. Solo ven lo que el pipeline no ha podido decidir por sí solo.
[ UNIRME A LA LISTA DE ESPERA ]ModShield es una API de moderación de contenido que puntúa cada publicación, registro y mensaje enviado a tu comunidad mediante ocho motores de detección — ML, reglas, confianza y reputación de identidades — y devuelve en menos de 100 ms un veredicto explicable: permitir, revisar o bloquear.
ALLOW
REVIEW
BLOCK
Hecho para quienes limpian detrás de los spammers.
ModShield está dirigido a equipos que ya moderan a mano y no dan abasto, no a sitios que quieren una caja negra que decida por ellos.
Moderadores voluntarios pasan las tardes borrando los mismos anuncios de venta de cuentas, y una oleada de registros a las 3 de la madrugada queda sin respuesta hasta la mañana siguiente.
Comentarios, perfiles y formularios de contacto son una puerta abierta, y una lista de palabras prohibidas bloquea a tus clientes reales tan a menudo como a los spammers.
Tienes que justificar una eliminación ante un usuario, un cliente o un regulador — y «lo decidió el filtro» no es una respuesta.
Cada mensaje recorre una cadena completa antes de una decisión.
Los motores se ejecutan en secuencia y se enriquecen entre sí. Cada etapa puede añadir motivos. La decisión final refleja toda la cadena, no una sola señal.
POST.
Obtén un veredicto.
Sabe por qué.
Una sola llamada a la API devuelve no solo un veredicto, sino el desglose de la puntuación y cada motivo que contribuyó a la decisión. Tu equipo de moderación puede auditar, anular y entrenar desde el primer día.
La cifra de latencia es el objetivo de ingeniería con el que construimos y probamos durante la beta privada, medido en nuestra propia infraestructura: no es un SLA contractual. Publicaremos cifras de producción medidas cuando el volumen de la beta las haga significativas. Las otras tres son propiedades del diseño: ocho motores, un motivo adjunto a cada decisión y ningún tráfico bloqueado cuando el modelo no está disponible.
Una caída nunca bloquea tu tráfico.
Si el modelo de ML no está disponible, ModShield degrada la calidad de la puntuación, nunca la disponibilidad. Cada degradación se registra en reasonsJson con el motivo exacto.
¿Qué pasa con el contenido que ModShield marca?
Nada que no hayas pedido. Cada sitio tiene un modo: en modo sombra las decisiones se registran pero nunca se aplican, para que puedas compararlas con lo que habrían hecho tus moderadores. Cuando activas la aplicación, el veredicto determina la acción que ejecuta tu conector.
¿Cuánto costará?
El acceso a la beta privada es gratuito y todavía no hay ninguna cifra publicada: los planes se están dimensionando con el uso real de la beta en lugar de adivinarlos por adelantado. Los precios se anunciarán antes de la disponibilidad general, primero a quienes estén en la lista de espera, y no se cobrará nada de lo consumido durante la beta.
¿Se almacenan datos personales de mis usuarios?
Los correos, nombres de usuario, números de teléfono y dominios de enlaces se cifran con HMAC-SHA256 antes de almacenarse, usando un secreto (pepper) que guarda tu instancia, y la reputación se construye sobre esos hashes, no sobre los valores originales. Las direcciones IP se tratan aparte: nunca se almacenan en eventos individuales, y una dirección solo se registra cuando acumula reputación propia o proviene de una lista de bloqueo tuya o de un feed público.
¿Qué idiomas cubre la detección?
El modelo incluido es un clasificador fastText entrenado con ejemplos en inglés, francés y chino, no un conjunto de reglas exclusivo del inglés. La cobertura es más sólida en esos tres idiomas; en los demás, las señales de reputación, velocidad y reglas siguen aplicándose, y puedes añadir reglas para patrones específicos de cada idioma.
¿De dónde sale la cifra de menos de 100 ms?
Es el objetivo de ingeniería con el que se construye y se somete a pruebas de carga la API, medido en nuestra propia infraestructura; no es un SLA contractual ni una cifra tomada de tráfico de producción de clientes, porque todavía no lo hay. Tu propio cliente mide el ida y vuelta, y el panel muestra la latencia del modelo observada en tu tráfico, de modo que puedes comprobar la afirmación en lugar de creerla; publicaremos p95 medidos cuando el volumen de la beta los haga significativos.
¿Con qué plataformas funciona ModShield?
Un conector oficial para Flarum está en beta privada. Cualquier otra plataforma — Discourse, phpBB, un foro propio o cualquier sitio con contenido de usuarios — se integra mediante la API REST: una llamada POST por contenido, una respuesta JSON con el veredicto, la puntuación y las razones.
¿Qué pasa si el modelo ML se cae?
Nada bloqueante: ModShield es fail-open por diseño. Si el modelo no está disponible, los demás motores — reglas, reputación, velocidad — siguen funcionando. La calidad de la puntuación se degrada, la disponibilidad nunca, y cada degradación queda registrada con su razón exacta.
¿Cuánto tarda la integración?
Un solo endpoint. Con el conector de Flarum, minutos: una instalación con composer y una clave API. Mediante la API REST, calcula alrededor de un día para conectar tus eventos — publicaciones, registros, mensajes — y probarlo todo en modo sombra antes de aplicar nada.
¿Cómo consigo acceso?
ModShield está en beta privada. Apúntate a la lista de espera con tu email — indicarnos tu plataforma y qué necesitas proteger nos ayuda a priorizar tu acceso. Abrimos de forma progresiva, por orden de llegada.
¿Puedo probarlo sin afectar a mi comunidad?
Sí — para eso existe el modo sombra. Envía tráfico real, recibe decisiones reales, sin aplicar nada. Los informes te muestran exactamente qué se habría bloqueado.
Protege tu comunidad. Explica cada decisión.
El acceso a la beta privada es gratuito. Los precios se publicarán antes de la disponibilidad general y quienes estén en la lista de espera los conocerán primero.
VER LA FAQ →Conectores en beta privada — el acceso API llega primero, los conectores después.