AI red teaming — topics
LLM- and agent-shaped attack surfaces. See ai-red-teaming for path ordering.
Foundations
Agent attacks
SE-adjacent
Source-review angle
- llm-application-source-review
- prompt-injection-sinks-in-source
- rag-pipeline-injection-points
- llm-tool-call-validation
Prompt-layer
- direct-prompt-injection · indirect-prompt-injection
- jailbreaks · adversarial-suffixes
- multimodal-attacks
Agent and tool
- tool-confusion · mcp-attacks
- mcp-tool-poisoning-rug-pull
- mcp-server-supply-chain-attacks
- agentic-tool-chain-confused-deputy
- copilot-zero-click-echoleak
- chain-of-trust-confusion
- exfiltration-via-rendered-content
- cursor-windsurf-ide-prompt-injection
- agentic-credential-exfiltration-via-tool-use
RAG and memory
- rag-poisoning · memory-poisoning
- poisonedrag-five-doc
- phantom-rag-backdoor
- embedding-inversion-algen
Model-level
- model-extraction · training-data-extraction
- membership-inference
- supply-chain-attacks-on-models
- slopsquatting
- ai-model-watermark-bypass
- llm-eval-pipeline-poisoning