Open Issues Need Help
View All on GitHub Collaboration task: Turkish and Chinese clinical safety wording review about 2 months ago
help wanted synthetic-case collaboration language review
Clinician-built benchmark and live leaderboard for medical AI safety evaluation.
Python
#ai-benchmark#ai-safety#clinical-nlp#clinician-review#evaluation-framework#failure-analysis#failure-atlas#healthcare-ai#huggingface-spaces#language-model-evaluation#llm-evaluation#llm-safety#medfailbench#medical-ai#medical-ai-safety#medical-language-models#medical-llm#patient-safety#source-verification#turkish-medical-ai
documentation help wanted collaboration community
Clinician-built benchmark and live leaderboard for medical AI safety evaluation.
Python
#ai-benchmark#ai-safety#clinical-nlp#clinician-review#evaluation-framework#failure-analysis#failure-atlas#healthcare-ai#huggingface-spaces#language-model-evaluation#llm-evaluation#llm-safety#medfailbench#medical-ai#medical-ai-safety#medical-language-models#medical-llm#patient-safety#source-verification#turkish-medical-ai
help wanted tr-medllm collaboration adapter
Clinician-built benchmark and live leaderboard for medical AI safety evaluation.
Python
#ai-benchmark#ai-safety#clinical-nlp#clinician-review#evaluation-framework#failure-analysis#failure-atlas#healthcare-ai#huggingface-spaces#language-model-evaluation#llm-evaluation#llm-safety#medfailbench#medical-ai#medical-ai-safety#medical-language-models#medical-llm#patient-safety#source-verification#turkish-medical-ai
help wanted assurance-lab collaboration standards
Clinician-built benchmark and live leaderboard for medical AI safety evaluation.
Python
#ai-benchmark#ai-safety#clinical-nlp#clinician-review#evaluation-framework#failure-analysis#failure-atlas#healthcare-ai#huggingface-spaces#language-model-evaluation#llm-evaluation#llm-safety#medfailbench#medical-ai#medical-ai-safety#medical-language-models#medical-llm#patient-safety#source-verification#turkish-medical-ai
help wanted synthetic-examples collaboration model teams
Clinician-built benchmark and live leaderboard for medical AI safety evaluation.
Python
#ai-benchmark#ai-safety#clinical-nlp#clinician-review#evaluation-framework#failure-analysis#failure-atlas#healthcare-ai#huggingface-spaces#language-model-evaluation#llm-evaluation#llm-safety#medfailbench#medical-ai#medical-ai-safety#medical-language-models#medical-llm#patient-safety#source-verification#turkish-medical-ai
help wanted collaboration adapter
Clinician-built benchmark and live leaderboard for medical AI safety evaluation.
Python
#ai-benchmark#ai-safety#clinical-nlp#clinician-review#evaluation-framework#failure-analysis#failure-atlas#healthcare-ai#huggingface-spaces#language-model-evaluation#llm-evaluation#llm-safety#medfailbench#medical-ai#medical-ai-safety#medical-language-models#medical-llm#patient-safety#source-verification#turkish-medical-ai
good first issue data
Clinician-built benchmark and live leaderboard for medical AI safety evaluation.
Python
#ai-benchmark#ai-safety#clinical-nlp#clinician-review#evaluation-framework#failure-analysis#failure-atlas#healthcare-ai#huggingface-spaces#language-model-evaluation#llm-evaluation#llm-safety#medfailbench#medical-ai#medical-ai-safety#medical-language-models#medical-llm#patient-safety#source-verification#turkish-medical-ai
documentation good first issue
Clinician-built benchmark and live leaderboard for medical AI safety evaluation.
Python
#ai-benchmark#ai-safety#clinical-nlp#clinician-review#evaluation-framework#failure-analysis#failure-atlas#healthcare-ai#huggingface-spaces#language-model-evaluation#llm-evaluation#llm-safety#medfailbench#medical-ai#medical-ai-safety#medical-language-models#medical-llm#patient-safety#source-verification#turkish-medical-ai