enguard/small-guard-32m-en-prompt-hate-speech-binary-moderation
Text Classification • 32.4M • Updated • 6
Tiny guardrails for 'prompt-hate-speech-binary' trained on https://huggingface.co/datasets/enguard/multi-lingual-prompt-moderation.