meta/llama-guard-4-12b
Moderate text prompts, model responses, and images for safety compliance. Accepts text with optional multiple images and...
Found 8 models (showing 1-8)
Moderate text prompts, model responses, and images for safety compliance. Accepts text with optional multiple images and...
Classifies content in LLM prompts and responses for safety and harm detection. Built on Llama 3 with 8 billion parameter...
Moderate text prompts and assistant responses for safety and policy compliance. Accepts a user message (prompt) and/or a...
Classify text content for safety and content moderation based on the MLCommons hazards taxonomy. Built on Llama-3.1-8B a...
Classify the safety of multimodal inputs (image and user message) for content moderation. Accepts an image (required) an...
Classifies text content based on custom safety policies written in plain English. Trained specifically for safety reason...
Classifies text content for safety and moderation, analyzing user prompts and assistant responses to determine if they a...
Classify text content based on custom safety policies you provide. Takes a text prompt and your written safety policy as...