Skip to main content

Papers about red teaming LLMs and Multimodal models.

173
GitHub Stars
287
Curated Resources
21
Categories
20 hours ago
Last Refreshed
SurveysTaxonomiesPositionsPhenomenonsCompletion ComplianceInstruction IndirectionGeneralization GlideModel ManipulationSuffix SearchersPrompt SearchersTraining Time DefensesInference Time DefensesEvaluation MetricsEvaluation BenchmarksApplication DomainsApplication RisksAttack StrategiesAttack SearchersDefenseApplicationBenchmarks

Use this list with your AI agent

Add the Context Awesome MCP server to Claude, Cursor, or any MCP client, then ask:

"Show me surveys on attacks resources from openredteaming"

Installation instructions →

What's inside

Evaluation Benchmarks

Surveys

Attack Strategies

  • PaperCompletion Compliance

  • PaperCompletion Compliance

  • PaperInstruction Indirection

Generalization Glide

Showing a sample of 287 resources. View the full list on GitHub →