enguard/small-guard-32m-en-prompt-harmfulness-multilabel-moderation
Text Classification • 32.4M • Updated • 5
Tiny guardrails for 'prompt-harmfulness-multilabel' trained on https://huggingface.co/datasets/enguard/multi-lingual-prompt-moderation.