toxicity detection
Categoria: guardrails e regras
Capacidade de identificar linguagem tóxica, ofensiva ou hostil em textos processados pelo agente, usando modelos classificadores que atribuem uma pontuação de toxicidade ao conteúdo.
Experimente 5 minutos
Comece com um caso seu ou escolha na nossa biblioteca e comece a praticar.