Measuring harmful refusals in AI models

0 stars 0 forks 0 watchers Python Apache License 2.0
ai-benchmark cybersecurity false-refusal llm-evaluation responsible-ai
2 Open Issues Need Help Last updated: Sep 20, 2026

Open Issues Need Help

View All on GitHub
help wanted expert review

Measuring harmful refusals in AI models

Python
#ai-benchmark#cybersecurity#false-refusal#llm-evaluation#responsible-ai
documentation good first issue

Measuring harmful refusals in AI models

Python
#ai-benchmark#cybersecurity#false-refusal#llm-evaluation#responsible-ai