Guia · 28 de julho de 2026 · 6 min de leitura
Moderação automática no Discord: spam, insultos e publicidade selvagem
Nenhuma equipa aguenta a noite. Este guia explica o que se pode mesmo automatizar num servidor Discord, porque as listas de palavras proibidas falham desde sempre, e como afinar uma moderação que protege sem sufocar as conversas.
Índice
Os quatro incómodos a tratar
Num servidor ativo, a moderação do dia a dia resume-se quase sempre a quatro coisas:
- O spam — repetição da mesma mensagem, envio em rajada, muros de maiúsculas, menções em massa, emojis em cadeia.
- A toxicidade — insultos, assédio a um membro, discurso de ódio. É a categoria que realmente faz as pessoas saírem, muito mais do que o spam.
- A publicidade selvagem — ligações de convite para outros servidores, promoção de canais, angariação por mensagem privada.
- As ligações e ficheiros perigosos — tratados à parte nos guias sobre as burlas e os ficheiros maliciosos.
As três primeiras assemelham-se num ponto: são repetitivas. É exatamente o que uma máquina gere melhor do que um humano, desde que não se faça como em 2015.
O que o AutoMod faz, e onde pára
O Discord inclui o AutoMod de origem, gratuito e a ativar em primeiro lugar. Sabe:
- bloquear as menções em massa acima de um limiar;
- bloquear palavras ou expressões listadas explicitamente;
- bloquear as ligações de convite para outros servidores;
- aplicar os filtros de conteúdo sexual ou insultuoso fornecidos pelo Discord.
Onde pára:
- Não percebe o contexto. Uma palavra está proibida ou não está; o sentido da frase não conta.
- Não conta ao longo do tempo. Um membro que envia uma mensagem no limite de dez em dez minutos durante duas horas não desencadeia nada.
- Não escala. Bloqueia a mensagem, mas não guarda histórico por membro e não sanciona a reincidência.
- É muito fácil de contornar assim que se sai da lista exata.
Conclusão prática: o AutoMod é uma boa primeira camada. Não substitui uma moderação completa.
Porque falham as listas de palavras
É o ponto que toda a gente descobre em três dias. Uma palavra filtrada reescreve-se num instante: letras dobradas, algarismos substituídos, acentos acrescentados, um espaço no meio, um carácter de outro alfabeto parecido com o certo. Cada variante exige uma regra nova, e a lista cresce indefinidamente sem nunca apanhar a imaginação dos membros.
O verdadeiro problema está, contudo, na outra ponta: uma lista que cresce bloqueia cada vez mais mensagens legítimas. Uma palavra proibida derruba todas as palavras que a contêm, e a equipa passa então o tempo a tratar reclamações por frases perfeitamente inocentes. A moderação acaba por chatear mais do que aquilo que filtra.
Uma lista de palavras é demasiado rígida e demasiado permissiva ao mesmo tempo: bloqueia frases normais e deixa passar os insultos ligeiramente deformados.
A abordagem por aprendizagem
O OriusMod, o módulo de moderação do OriusBot, não trabalha sobre uma lista mas sobre a forma das mensagens. Combina dois andares:
- Uma heurística multilingue que deteta os padrões de insulto e de assédio independentemente da ortografia exata: substituições de caracteres, repetições, espaçamentos, alfabetos misturados.
- Um classificador treinado localmente sobre sequências de caracteres em vez de palavras inteiras. Uma palavra deformada mantém a maior parte das suas sequências: é isso que a torna reconhecível apesar da deformação.
A equipa do servidor fecha o ciclo: cada decisão pode ser marcada como certa ou errada, e o modelo ajusta-se. Uma moderação que se engana uma vez não deve enganar-se indefinidamente da mesma maneira.
Um ponto que conta para muitos servidores: a análise corre na infraestrutura da Orius. Nenhuma mensagem do teu servidor é transmitida a um fornecedor de IA externo, o que não acontece com os bots que assentam numa API de análise de terceiros.
Graduar as sanções
Detetar não serve de nada sem uma resposta proporcionada. O mecanismo mais sólido é o aviso com escalada automática por limiares: cada deslize acrescenta um aviso ao processo do membro, e a sanção dispara em patamares definidos de antemão.
| Avisos | Sanção | Intenção |
|---|---|---|
| 1 | Só aviso | Assinalar o limite, sem castigar |
| 3 | Silêncio de 1 hora | Quebrar a dinâmica de um mau momento |
| 5 | Silêncio de 24 horas | O verdadeiro último aviso |
| 7 | Expulsão | Voltar continua possível |
| 10 | Banimento | Fim de percurso |
Três vantagens, muitas vezes subestimadas. A regra é igual para toda a gente, o que desarma a acusação de favoritismo. Aplica-se de noite, quando a equipa dorme. E deixa um rasto escrito: quando um membro contesta, relê-se o seu historial em vez de discutir sobre memórias.
Afinar sem moderar a mais
Uma moderação demasiado rígida faz tantos estragos como uma moderação ausente: os membros autocensuram-se, as conversas morrem. Algumas definições que evitam isso:
- Isenta os canais apropriados. Um canal de desabafo ou o canal de texto de uma sala de voz não tem as mesmas regras que a entrada.
- Isenta os cargos de confiança. Um membro presente há dois anos não precisa de ser filtrado como uma conta de dez minutos.
- Começa em modo alerta. Durante uma semana, deixa o bot assinalar sem sancionar, e lê o que teria feito. É a única forma honesta de calibrar um limiar.
- Prevê um direito de resposta. Um canal ou um sistema de tickets onde contestar uma sanção evita que um falso positivo se transforme numa saída definitiva.
- Explica as regras em público. Um membro sancionado sem perceber porquê não corrige o comportamento: vai-se embora.
E não esquecer o óbvio: um servidor bem arrumado modera-se sozinho em grande parte. Retirar o direito de enviar ligações ao cargo por omissão, limitar os anexos a um canal, pôr modo lento nos canais muito ativos — três definições nativas que suprimem o problema em vez de o filtrar.
Perguntas frequentes
O AutoMod chega?
Trata os casos simples: menções em massa, palavras listadas exatamente, ligações de convite. Não percebe o contexto e contorna-se mudando a ortografia. Boa primeira camada, não uma moderação completa.
Porque falham as listas de palavras proibidas?
Uma palavra filtrada reescreve-se em três segundos. Cada desvio exige uma regra nova, e a lista acaba por bloquear mensagens normais enquanto deixa passar as variantes.
Como moderar sem moderar a mais?
Graduando: primeiro aviso, silêncio na repetição, expulsão perante a recusa manifesta, banimento em último lugar. Uma escalada automática aplica a mesma regra a toda a gente.
Um bot deteta a ironia?
De forma imperfeita, como um humano que lê uma mensagem fora de contexto. Daí a importância de uma sensibilidade regulável, de isenções por canal e por cargo, e de uma correção possível.
As mensagens saem do servidor?
Com muitos bots, sim: chamam uma API de análise de terceiros. O OriusBot analisa localmente, nenhuma mensagem é transmitida a um fornecedor externo.
Ler a seguir : Captcha e verificação, Comparação de bots de segurança, Checklist de segurança.
