Explore Library
AI Engineering / Working with LLMsSafety, Guardrails & Responsible AI

89 items

1

Guardrail Frameworks

Quiz
2

Copyright and IP Risks

Quiz
3

Transparency and AI Disclosure

Quiz
4

Red-Teaming LLM Applications

Quiz
5

Logging and Auditability

Quiz
6

Rate Limiting and Abuse Prevention

Quiz
7

Grounding to Reduce Unsafe Outputs

Quiz
8

Sensitive-Topic Restrictions

Quiz
9

Data Privacy and Compliance

Quiz
10

Responsible AI Principles

Quiz
11

RLHF and Alignment Basics

Quiz
12

Output Validation and Filtering

Quiz
13

Human-in-the-Loop Review

Quiz
14

Refusal and Over-Refusal

Quiz
15

System Prompt Hardening

Quiz
16

Hallucination as a Safety Risk

Quiz
17

Toxicity and Bias in Outputs

Quiz
18

PII Detection and Redaction

Quiz
19

Categories of Harmful Content

Quiz
20

Content Moderation APIs

Quiz
21

Jailbreaking and Defenses

Quiz
22

Prompt Injection Attacks

Quiz
23

Input vs Output Guardrails

Quiz
24

What Guardrails Are

Quiz
25

Human-in-the-Loop Review and Escalation

Slides / Video
26

Guardrail Frameworks and Libraries

Slides / Video
27

Bias and Fairness in LLM Outputs

Slides / Video
28

Handling Hallucinations Responsibly

Slides / Video
29

PII Detection and Redaction

Slides / Video
30

Topic and Scope Restriction

Slides / Video
31

Blocklists, Allowlists and Keyword Filtering

Slides / Video
32

System Prompt Hardening for Safety

Slides / Video
33

Moderation APIs and Content Classifiers

Slides / Video
34

Output Filtering and Moderation

Slides / Video
35

Input Validation for User Prompts

Slides / Video
36

Handling Model Refusals

Code Quiz
37

Jailbreaking and How Models Are Bypassed

Slides / Video
38

Prompt Injection Attacks

Slides / Video
39

Categories of LLM Safety Risks

Slides / Video
40

Prompt Injection Detection

Code Quiz
41

Safe Fallback on Guardrail

Code Quiz
42

Topic Allow-List Scope

Code Quiz
43

Redacting PII

Code Quiz
44

Logging Flagged Requests

Code Quiz
45

Reading Flagged Categories

Code Quiz
46

Two-Pass Moderation Flow

Code Quiz
47

Preventing System Prompt Leakage

Code Quiz
48

Grounding to Source Context

Code Quiz
49

Validating Output Schema

Code Quiz
50

Calling the Moderation API

Code Quiz
51

LLM-as-Judge Guardrail

Code Quiz
52

Denylist Keyword Filter

Code Quiz
53

Sanitizing Untrusted Input

Code Quiz
54

System Safety Instruction Role

Code Quiz
55

max_tokens Output Limit

Code Quiz
56

Rate Limiting Requests

Code Quiz
57

Blocking Flagged Responses

Code Quiz
58

Delimiting Untrusted Content

Code Quiz
59

What Guardrails Are and Why They Matter

Slides / Video
60

Data Privacy in LLM Apps

Slides / Video
61

Logging and Monitoring for AI Safety

Slides / Video
62

Rate Limiting and Abuse Prevention

Flashcard
63

Output Filtering and Moderation

Flashcard
64

Prompt Injection Attacks

Flashcard
65

PII Detection and Redaction

Flashcard
66

Refusals and Safe Completion Behavior

Flashcard
67

Topic and Scope Restriction

Flashcard
68

Hallucination Mitigation Strategies

Flashcard
69

Human-in-the-Loop Oversight

Flashcard
70

Model Cards and Transparency

Flashcard
71

Toxicity and Harmful Content Detection

Flashcard
72

Guardrail Frameworks and Libraries

Flashcard
73

Red Teaming LLM Applications

Flashcard
74

Audit Logging and Traceability

Flashcard
75

What Guardrails Are and Why They Matter

Flashcard
76

Input Validation and Prompt Filtering

Flashcard
77

Content Moderation APIs

Flashcard
78

Jailbreaking and Adversarial Prompts

Flashcard
79

Defending Against Prompt Injection

Flashcard
80

Data Privacy and Compliance

Flashcard
81

Bias and Fairness in LLM Outputs

Flashcard
82

Grounding Responses to Reduce Fabrication

Flashcard
83

System Prompt Hardening

Flashcard
84

Structured Output Constraints for Safety

Flashcard
85

Responsible AI Principles

Flashcard
86

Data Leakage and Training Data Exposure

Flashcard
87

Responsible AI Principles

Slides / Video
88

Layered Defense: Combining Multiple Guardrails

Slides / Video
89

Refusal Behavior and Graceful Declines

Slides / Video
Code QuizIntermediate

Two-Pass Moderation Flow

A missing await leaves the moderation result as an unresolved promise.

Codejavascript
const mod = openai.moderations.create({ input });
if (mod.results[0].flagged) {
  return block();
}
const answer = await generate(input);

What is the bug in this moderation-then-generation flow?