Guía · 28 de julio de 2026 · 6 min de lectura
Moderación automática en Discord: spam, insultos y publicidad salvaje
Ningún equipo aguanta la noche. Esta guía explica qué se puede automatizar de verdad en un servidor de Discord, por qué las listas de palabras prohibidas fracasan desde siempre, y cómo ajustar una moderación que proteja sin ahogar las conversaciones.
Contenido
Las cuatro molestias que hay que tratar
En un servidor activo, la moderación diaria se reduce casi siempre a cuatro cosas:
- El spam — repetición del mismo mensaje, envío en ráfaga, muros de mayúsculas, menciones masivas, emojis en cadena.
- La toxicidad — insultos, acoso a un miembro, discurso de odio. Es la categoría que de verdad hace marcharse a la gente, mucho más que el spam.
- La publicidad salvaje — enlaces de invitación a otros servidores, promoción de canales, captación por mensaje privado.
- Los enlaces y archivos peligrosos — tratados aparte en las guías sobre las estafas y los archivos maliciosos.
Las tres primeras se parecen en un punto: son repetitivas. Es exactamente lo que una máquina gestiona mejor que un humano, siempre que no se aborde como en 2015.
Lo que hace AutoMod y dónde se detiene
Discord incluye AutoMod de forma nativa, gratis y para activar en primer lugar. Sabe:
- bloquear las menciones masivas por encima de un umbral;
- bloquear palabras o expresiones listadas explícitamente;
- bloquear los enlaces de invitación a otros servidores;
- aplicar los filtros de contenido sexual o insultante que proporciona Discord.
Donde se detiene:
- No entiende el contexto. Una palabra está prohibida o no lo está; el sentido de la frase no entra en juego.
- No cuenta a lo largo del tiempo. Un miembro que envía un mensaje al límite cada diez minutos durante dos horas no dispara nada.
- No escala. Bloquea el mensaje, pero no lleva historial por miembro y no sanciona la reincidencia.
- Se esquiva con mucha facilidad en cuanto se sale de la lista exacta.
Conclusión práctica: AutoMod es una buena primera capa. No sustituye a una moderación completa.
Por qué fracasan las listas de palabras
Es lo que todo el mundo descubre en tres días. Una palabra filtrada se reescribe al instante: letras dobladas, cifras sustituidas, tildes añadidas, un espacio insertado en medio, un carácter de otro alfabeto que se parece al correcto. Cada variante exige una regla nueva, y la lista crece indefinidamente sin alcanzar jamás la imaginación de los miembros.
El verdadero problema, sin embargo, está en el otro extremo: una lista que crece bloquea cada vez más mensajes legítimos. Una palabra prohibida tumba todas las palabras que la contienen, y el equipo pasa entonces el tiempo atendiendo reclamaciones por frases perfectamente inocentes. La moderación acaba molestando más que lo que filtra.
Una lista de palabras es demasiado estricta y demasiado laxa al mismo tiempo: bloquea frases normales y deja pasar los insultos ligeramente deformados.
El enfoque por aprendizaje
OriusMod, el módulo de moderación de OriusBot, no trabaja sobre una lista sino sobre la forma de los mensajes. Combina dos niveles:
- Una heurística multilingüe que detecta los patrones de insulto y de acoso al margen de la ortografía exacta: sustituciones de caracteres, repeticiones, espaciados, alfabetos mezclados.
- Un clasificador entrenado localmente sobre secuencias de caracteres en lugar de palabras enteras. Una palabra deformada conserva la mayoría de sus secuencias: eso es lo que la hace reconocible pese a la deformación.
El equipo del servidor cierra el círculo: cada decisión puede marcarse como correcta o errónea, y el modelo se ajusta. Una moderación que se equivoca una vez no debe equivocarse indefinidamente de la misma manera.
Un punto que importa a muchos servidores: el análisis se ejecuta en la infraestructura de Orius. Ningún mensaje de tu servidor se transmite a un proveedor de IA externo, lo que no ocurre con los bots que se apoyan en una API de análisis de terceros.
Graduar las sanciones
Detectar no sirve de nada sin una respuesta proporcionada. El mecanismo más sólido es el aviso con escalada automática por umbrales: cada desliz añade un aviso al expediente del miembro, y la sanción se dispara en escalones definidos de antemano.
| Avisos | Sanción | Intención |
|---|---|---|
| 1 | Solo aviso | Señalar el límite, sin castigar |
| 3 | Silencio de 1 hora | Romper la dinámica de un mal momento |
| 5 | Silencio de 24 horas | El último aviso de verdad |
| 7 | Expulsión | Volver sigue siendo posible |
| 10 | Baneo | Fin del recorrido |
Tres ventajas, a menudo infravaloradas. La regla es idéntica para todo el mundo, lo que desactiva la acusación de favoritismo. Se aplica de noche, cuando el equipo duerme. Y deja un rastro escrito: cuando un miembro protesta, se relee su historial en vez de discutir sobre recuerdos.
Ajustar sin sobremoderar
Una moderación demasiado estricta hace tanto daño como una moderación ausente: los miembros se autocensuran, las conversaciones mueren. Algunos ajustes que lo evitan:
- Exime los canales apropiados. Un canal de desahogo o el canal de texto de una sala de voz no tiene las mismas reglas que la entrada.
- Exime los roles de confianza. Un miembro presente desde hace dos años no necesita el mismo filtro que una cuenta de diez minutos.
- Empieza en modo alerta. Durante una semana, deja que el bot avise sin sancionar, y lee lo que habría hecho. Es la única forma honesta de calibrar un umbral.
- Prevé un derecho de respuesta. Un canal o un sistema de tickets donde impugnar una sanción evita que un falso positivo se convierta en una marcha definitiva.
- Explica las reglas en público. Un miembro sancionado sin entender por qué no corrige su comportamiento: se va.
Y no hay que olvidar lo evidente: un servidor bien ordenado se modera solo en gran parte. Quitar el derecho a enviar enlaces al rol por defecto, limitar los adjuntos a un canal, poner modo lento en los canales muy activos — tres ajustes nativos que suprimen el problema en lugar de filtrarlo.
Preguntas frecuentes
¿Basta con AutoMod?
Gestiona los casos simples: menciones masivas, palabras listadas exactamente, enlaces de invitación. No entiende el contexto y se esquiva cambiando la ortografía. Buena primera capa, no una moderación completa.
¿Por qué fracasan las listas de palabras prohibidas?
Una palabra filtrada se reescribe en tres segundos. Cada rodeo exige una regla nueva, y la lista acaba bloqueando mensajes normales mientras deja pasar las variantes.
¿Cómo moderar sin sobremoderar?
Graduando: primero aviso, silencio en la repetición, expulsión ante el rechazo manifiesto, baneo en último lugar. Una escalada automática aplica la misma regla a todo el mundo.
¿Un bot detecta la ironía?
De forma imperfecta, como un humano que lee un mensaje fuera de contexto. De ahí la importancia de una sensibilidad ajustable, de exenciones por canal y por rol, y de una corrección posible.
¿Los mensajes salen del servidor?
Con muchos bots, sí: llaman a una API de análisis de terceros. OriusBot analiza en local, ningún mensaje se transmite a un proveedor externo.
Leer después : Captcha y verificación, Comparativa de bots de seguridad, Checklist de seguridad.
