ModerationFlow AI
Sistema de moderação assistida por IA com revisão humana, auditoria e avaliação comparativa de estratégias.
Os links abrem a demonstração pública somente leitura. Para operar como moderador, use o login administrativo e acesse as rotas protegidas.
Fila de moderação
Recomendação assistida e decisão humana
Decisão humana
Aprovar, sinalizar, remover ou solicitar edição. Divergências ficam auditáveis.
Problema
Moderação precisa de escala sem perder julgamento humano.
Comentários em plataformas educacionais podem conter spam, ataques pessoais, linguagem ofensiva, discriminação, críticas legítimas ou pedidos de suporte.
Automatizar tudo aumenta o risco de falsos positivos. Depender apenas de revisão manual reduz escala. O projeto organiza uma recomendação assistida, fundamentada por regras, antes da decisão humana final.
Fluxo de moderação
A IA recomenda. O moderador decide.
A interface operacional foi desenhada para manter a decisão humana acima da recomendação automatizada.
Comentário
Análise e recomendação
Regras relacionadas
Decisão humana
Auditoria
Vídeo de demonstração
Veja o ModerationFlow AI em funcionamento
Uma demonstração curta do fluxo de moderação assistida por IA, da revisão humana e da área de avaliações técnicas do projeto.
Vídeo demonstrativo hospedado no YouTube.
Demo guiada
Três cenários demonstráveis
Os cards apontam para a demonstração pública, onde a recomendação da IA pode ser comparada com a decisão humana registrada.
Crítica ambígua
seed_case: ambiguous_sarcasm
Distingue crítica forte, sarcasmo e risco de remoção indevida.
A decisão em jogo é aprovar, sinalizar ou pedir revisão com contexto.
Abrir na filaSpam explícito
seed_case: clear_spam
Mostra sinais de promoção externa, regras relacionadas e ação sugerida.
O risco em jogo é diferenciar flag e remove sem automatizar a decisão final.
Abrir na filaConteúdo discriminatório
seed_case: potentially_discriminatory
Evidencia casos sensíveis em que falso positivo e falso negativo importam.
O moderador revisa R-004, justificativa, risco e trilha de auditoria.
Abrir na filaHuman-in-the-Loop
A recomendação não executa a decisão final.
O sistema ajuda a priorizar e justificar, mas a decisão operacional fica com o moderador.
O moderador pode aprovar, sinalizar, remover ou solicitar edição.
Divergências entre IA e moderador são registradas como evidência auditável.
Feedback humano vira insumo para avaliação futura, sem automatizar novas regras.
Avaliação e experimentação
Estrategias medidas fora da fila operacional
A landing mostra a leitura técnica resumida; os detalhes ficam no dashboard de avaliações.
Heuristico
Fluxo principal atual: determinístico, rápido e auditável.
Baseline LLM
Estratégia principal de pesquisa para comparar generalização sem exemplos.
Few-shot
Experimento isolado com exemplos humanos curados, sem promoção automática.
Dynamic few-shot
Seleciona exemplos de forma determinística e ajuda a analisar cenários específicos.
Guardrail R-004
Camada experimental forte em safety, com trade-offs avaliados separadamente.
Decisão técnica
ADR-001 resume a estratégia atual
A decisão separa fluxo principal, pesquisa e experimentos para evitar promover LLM por uma métrica isolada.
Fluxo principal
Heuristico + Human-in-the-Loop
Pesquisa
Baseline LLM
Experimentos
Dynamic few-shot e guardrail R-004
Referencia: docs/architecture/adr-001-moderation-strategy-decision.md. O modelo recomenda; o moderador decide.
Tecnologias
Stack usado no projeto
A lista reflete o que existe no repositório e na documentação técnica.
Explore o produto em funcionamento
Comece pela fila demonstrativa e depois abra as avaliações para discutir a decisão técnica.