mirror of https://github.com/meta-llama/llama-stack.git synced 2025-12-18 17:19:46 +00:00

History

Jash Gulabrai b1d941e1f0 Merge branch 'main' into nvidia-e2e-notebook		2025-05-06 11:12:34 -04:00
..
__init__.py	feat: added nvidia as safety provider (#1248 )	2025-03-17 14:39:23 -07:00
config.py	Merge branch 'main' into nvidia-e2e-notebook	2025-05-06 11:12:34 -04:00
nvidia.py	chore: enable pyupgrade fixes (#1806 )	2025-05-01 14:23:50 -07:00
README.md	docs: Add NVIDIA platform distro docs (#1971 )	2025-04-17 05:54:30 -07:00

README.md

NVIDIA Safety Provider for LlamaStack

This provider enables safety checks and guardrails for LLM interactions using NVIDIA's NeMo Guardrails service.

Features

Run safety checks for messages

Getting Started

Prerequisites

LlamaStack with NVIDIA configuration
Access to NVIDIA NeMo Guardrails service
NIM for model to use for safety check is deployed

Setup

Build the NVIDIA environment:

llama stack build --template nvidia --image-type conda

Basic Usage using the LlamaStack Python Client

Initialize the client

import os

os.environ["NVIDIA_API_KEY"] = "your-api-key"
os.environ["NVIDIA_GUARDRAILS_URL"] = "http://guardrails.test"

from llama_stack.distribution.library_client import LlamaStackAsLibraryClient

client = LlamaStackAsLibraryClient("nvidia")
client.initialize()

Create a safety shield

from llama_stack.apis.safety import Shield
from llama_stack.apis.inference import Message

# Create a safety shield
shield = Shield(
    shield_id="your-shield-id",
    provider_resource_id="safety-model-id",  # The model to use for safety checks
    description="Safety checks for content moderation",
)

# Register the shield
await client.safety.register_shield(shield)

Run safety checks

# Messages to check
messages = [Message(role="user", content="Your message to check")]

# Run safety check
response = await client.safety.run_shield(
    shield_id="your-shield-id",
    messages=messages,
)

# Check for violations
if response.violation:
    print(f"Safety violation detected: {response.violation.user_message}")
    print(f"Violation level: {response.violation.violation_level}")
    print(f"Metadata: {response.violation.metadata}")
else:
    print("No safety violations detected")