A leakage-verified prompt-injection benchmark for measuring and improving agent robustness (defensive).

13 Open Issues Need Help Last updated: Jul 14, 2026

Open Issues Need Help

View All on GitHub
good first issue type: test area: agent-safety size: S

A leakage-verified prompt-injection benchmark for measuring and improving agent robustness (defensive).

Python
good first issue type: test area: agent-safety size: S

A leakage-verified prompt-injection benchmark for measuring and improving agent robustness (defensive).

Python
good first issue type: docs area: infra size: S

A leakage-verified prompt-injection benchmark for measuring and improving agent robustness (defensive).

Python
good first issue mentored type: bug area: infra size: S

A leakage-verified prompt-injection benchmark for measuring and improving agent robustness (defensive).

Python
good first issue mentored type: bug area: infra size: S

A leakage-verified prompt-injection benchmark for measuring and improving agent robustness (defensive).

Python
good first issue mentored type: test area: agent-safety size: S

A leakage-verified prompt-injection benchmark for measuring and improving agent robustness (defensive).

Python
good first issue type: bug area: agent-safety size: S

A leakage-verified prompt-injection benchmark for measuring and improving agent robustness (defensive).

Python
good first issue type: feature area: infra size: S

A leakage-verified prompt-injection benchmark for measuring and improving agent robustness (defensive).

Python
good first issue type: feature area: infra size: S

A leakage-verified prompt-injection benchmark for measuring and improving agent robustness (defensive).

Python
good first issue type: docs area: infra size: S

A leakage-verified prompt-injection benchmark for measuring and improving agent robustness (defensive).

Python
good first issue type: docs area: infra size: S

A leakage-verified prompt-injection benchmark for measuring and improving agent robustness (defensive).

Python
good first issue type: test area: agent-safety size: S

A leakage-verified prompt-injection benchmark for measuring and improving agent robustness (defensive).

Python
good first issue type: feature area: llm size: S

A leakage-verified prompt-injection benchmark for measuring and improving agent robustness (defensive).

Python