AI Engineering / Working with LLMsSafety, Guardrails & Responsible AI

89 items

1

Transparency and AI Disclosure

Quiz
2

Guardrail Frameworks

Quiz
3

System Prompt Hardening

Quiz
4

Content Moderation APIs

Quiz
5

Output Validation and Filtering

Quiz
6

Human-in-the-Loop Review

Quiz
7

Grounding to Reduce Unsafe Outputs

Quiz
8

Rate Limiting and Abuse Prevention

Quiz
9

PII Detection and Redaction

Quiz
10

Logging and Auditability

Quiz
11

Red-Teaming LLM Applications

Quiz
12

Copyright and IP Risks

Quiz
13

Jailbreaking and Defenses

Quiz
14

Prompt Injection Attacks

Quiz
15

Refusal and Over-Refusal

Quiz
16

Input vs Output Guardrails

Quiz
17

What Guardrails Are

Quiz
18

Toxicity and Bias in Outputs

Quiz
19

Categories of Harmful Content

Quiz
20

Hallucination as a Safety Risk

Quiz
21

Responsible AI Principles

Quiz
22

Data Privacy and Compliance

Quiz
23

RLHF and Alignment Basics

Quiz
24

Sensitive-Topic Restrictions

Quiz
25

Human-in-the-Loop Review and Escalation

Slides / Video
26

Guardrail Frameworks and Libraries

Slides / Video
27

Bias and Fairness in LLM Outputs

Slides / Video
28

Handling Hallucinations Responsibly

Slides / Video
29

PII Detection and Redaction

Slides / Video
30

Topic and Scope Restriction

Slides / Video
31

Blocklists, Allowlists and Keyword Filtering

Slides / Video
32

System Prompt Hardening for Safety

Slides / Video
33

Moderation APIs and Content Classifiers

Slides / Video
34

Output Filtering and Moderation

Slides / Video
35

Input Validation for User Prompts

Slides / Video
36

Handling Model Refusals

Code Quiz
37

Jailbreaking and How Models Are Bypassed

Slides / Video
38

Prompt Injection Attacks

Slides / Video
39

Categories of LLM Safety Risks

Slides / Video
40

System Safety Instruction Role

Code Quiz
41

Rate Limiting Requests

Code Quiz
42

Delimiting Untrusted Content

Code Quiz
43

Validating Output Schema

Code Quiz
44

Grounding to Source Context

Code Quiz
45

LLM-as-Judge Guardrail

Code Quiz
46

Preventing System Prompt Leakage

Code Quiz
47

Denylist Keyword Filter

Code Quiz
48

Sanitizing Untrusted Input

Code Quiz
49

max_tokens Output Limit

Code Quiz
50

Calling the Moderation API

Code Quiz
51

Safe Fallback on Guardrail

Code Quiz
52

Redacting PII

Code Quiz
53

Prompt Injection Detection

Code Quiz
54

Blocking Flagged Responses

Code Quiz
55

Topic Allow-List Scope

Code Quiz
56

Logging Flagged Requests

Code Quiz
57

Reading Flagged Categories

Code Quiz
58

Two-Pass Moderation Flow

Code Quiz
59

What Guardrails Are and Why They Matter

Slides / Video
60

Data Privacy in LLM Apps

Slides / Video
61

Logging and Monitoring for AI Safety

Slides / Video
62

Input Validation and Prompt Filtering

Flashcard
63

Data Leakage and Training Data Exposure

Flashcard
64

Responsible AI Principles

Flashcard
65

Structured Output Constraints for Safety

Flashcard
66

System Prompt Hardening

Flashcard
67

Grounding Responses to Reduce Fabrication

Flashcard
68

Bias and Fairness in LLM Outputs

Flashcard
69

Data Privacy and Compliance

Flashcard
70

Defending Against Prompt Injection

Flashcard
71

Jailbreaking and Adversarial Prompts

Flashcard
72

Content Moderation APIs

Flashcard
73

What Guardrails Are and Why They Matter

Flashcard
74

Audit Logging and Traceability

Flashcard
75

Red Teaming LLM Applications

Flashcard
76

Rate Limiting and Abuse Prevention

Flashcard
77

Guardrail Frameworks and Libraries

Flashcard
78

Toxicity and Harmful Content Detection

Flashcard
79

Model Cards and Transparency

Flashcard
80

Human-in-the-Loop Oversight

Flashcard
81

Hallucination Mitigation Strategies

Flashcard
82

Topic and Scope Restriction

Flashcard
83

Refusals and Safe Completion Behavior

Flashcard
84

PII Detection and Redaction

Flashcard
85

Prompt Injection Attacks

Flashcard
86

Output Filtering and Moderation

Flashcard
87

Responsible AI Principles

Slides / Video
88

Layered Defense: Combining Multiple Guardrails

Slides / Video
89

Refusal Behavior and Graceful Declines

Slides / Video
FlashcardIntermediate

What Guardrails Are and Why They Matter

Guardrails are safety controls that constrain LLM inputs and outputs to prevent harmful or unwanted behavior.

Question

What are guardrails in an LLM application, and why do they matter?

Click to reveal answer