0 "ai-safety" Awesome Lists
awesome-llm-unlearning
A resource repository for machine unlearning in large language models
ai-safety alignment awesome awesome-list evaluation knowledge-erasure large-language-model llm llm-safety llm-unlearning
627 stars
33 forks
770 projects
Last updated: 21 Sep 2026
awesome-ai-safety
📚 A curated list of papers & technical articles on AI Quality & Safety
ai ai-alignment ai-quality ai-safety artificial-intelligence awesome awesome-list computer-vision ethical-ai llm
220 stars
41 forks
40 projects
Last updated: 31 Jul 2026
AwesomeResponsibleAI
A curated list of awesome academic research, books, code of ethics, courses, databases, data sets, frameworks, institutes, maturity models, newsletters, principles, podcasts, regulations, reports, responsible scale policies, tools and standards related to Responsible, Trustworthy, and Human-Centered AI.
ai ai-alignment ai-governance ai-regulation ai-safety ai-standards awesome-list ethical-ai explainable-ai fairness-ai
142 stars
66 forks
791 projects
Last updated: 12 Aug 2026
Awesome-Embodied-AI-Safety
Safety in Embodied AI: A Survey of Risks, Attacks, and Defenses | 500+ Papers | Perception, Cognition, Planning, Interaction, Agentic System
adversarial-attacks adversarial-robustness agent-safety ai-safety autonomous-driving awesome-list backdoor-attacks embodied-agents embodied-ai jailbreak
141 stars
4 forks
580 projects
Last updated: 17 Sep 2026
awesome-activation-engineering
A curated list of resources for activation engineering
activation-engineering ai-safety concept concept-activation-vector concept-rep control interpretability large-language-models llm llm-aligment
139 stars
10 forks
85 projects
Last updated: 26 Jul 2026
awesome-auditable-ai
Auditing AI agents: a curated list of papers, tools, datasets, benchmarks, and standards covering reliability, monitoring, failure attribution, and decision records.
agent-evaluation agent-reliability agentic-ai ai-agents ai-safety auditable auditing awesome awesome-list failure-attribution
105 stars
17 forks
209 projects
Last updated: 21 Aug 2026
awesome-safety-critical-ai
When the stakes are high, intelligence is only half the equation - reliability is the other ⚠️
ai-privacy ai-safety artificial-intelligence awesome awesome-list awesome-lists compliance determinism explainability genai
65 stars
18 forks
539 projects
Last updated: 27 Aug 2026
awesome-ai-agent-attacks
A curated timeline of real AI agent security incidents, breaches, and vulnerabilities (2024-2026). Every entry sourced and dated.
adversarial-attacks agent-security agentic-ai ai-agent-security ai-agents ai-attacks ai-safety ai-security awesome-list cve
65 stars
8 forks
438 projects
Last updated: 17 Aug 2026
awesome-llm-agent-papers
A curated, continuously updated reading list of 200+ papers on LLM agents: planning, memory, tool use, multi-agent, evaluation & safety. Companion to the survey 'LLM Agents: A Survey'.
agent-benchmark agent-survey agents ai-agents ai-safety autonomous-agents awesome awesome-list large-language-models llm
61 stars
15 forks
567 projects
Last updated: 08 Aug 2026
awesome-ai-agent-testing
🤖 A curated list of resources for testing AI agents - frameworks, methodologies, benchmarks, tools, and best practices for ensuring reliable, safe, and effective autonomous AI systems
agent-evaluation agentic-ai ai-agents ai-benchmark ai-safety artificial-intelligence awesome-list benchmark chaos chaos-engineering
46 stars
18 forks
168 projects
Last updated: 12 Aug 2026
awesome-mllm-guardrails
A curated list of LLM/MLLM guardrails, safety benchmarks, guard models, jailbreak attacks, moderation datasets, and evaluation tools.
ai-safety awesome-list content-moderation guardrails jailbreak llm llm-guardrails llm-safety mllm multimodal-safety
31 stars
6 forks
179 projects
Last updated: 25 Sep 2026
awesome-ai-agents
A curated list of AI agent frameworks, tools, platforms, research papers, and resources
agent-framework agents ai ai-agents ai-safety ai-tools autonomous-agents awesome awesome-list chatgpt
29 stars
40 forks
221 projects
Last updated: 19 Aug 2026
awesome-ai-safety
A curated list of AI safety resources: alignment, interpretability, governance, verification, and responsible deployment of frontier AI systems.
ai-safety ai-systems awesome awesome-list
28 stars
6 forks
119 projects
Last updated: 19 Sep 2026
awesome-ai-safety-alignment
A curated list of research, frameworks, tools, evaluations, and resources focused on AI alignment, safety, robustness, red-teaming, model governance, and responsible development.
ai ai-alignment ai-safety awesome awesome-list awesome-lists
12 stars
6 forks
45 projects
Last updated: 11 Sep 2026
awesome-llm-security-alignment
A curated list of research papers, experiments, and resources related to LLM security and alignment.
adversarial-attacks ai-safety ai-security alignment awesome jailbreak llm prompt-injection red-teaming
12 stars
3 forks
92 projects
Last updated: 01 Sep 2026
awesome-multimodal-unlearning
This repo presents a survey of multimodal unlearning across vision, language, video, and audio, covering papers, datasets, benchmarks, and open problems.
ai-safety diffusion-models foundation-models llm machine-unlearning multimodal-learning multimodal-unlearning survey-review trustworthy-ai vision-language-models
8 stars
0 forks
137 projects
Last updated: 17 Aug 2026
awesome-llm-agent-privacy
A curated list of papers on privacy, security, and compliance in LLM-based agent systems — attacks, defenses, benchmarks, and regulatory frameworks.
ai-safety awesome-list benchmark compliance llm llm-agents machine-learning multi-agent nlp paper-list
4 stars
1 forks
51 projects
Last updated: 27 Aug 2026
awesome-ipi-defense
A curated list of prompt injection defense papers with D1-D6 taxonomy for LLMs and AI agents
agentic-ai ai-safety awesome-list large-language-models llm-security prompt-injection
1 stars
0 forks
165 projects
Last updated: 14 Apr 2026
ai-llmops-index
Comprehensive LLMOps reference index: observability platforms, inference cost intelligence, failure mode taxonomy, stack compatibility matrices, and regulatory compliance mapping for LLMs in production.
ai-compliance ai-governance ai-infrastructure ai-observability ai-safety awesome-list llm-benchmarks llm-cost-comparison llm-evaluation llm-failure-modes
1 stars
0 forks
95 projects
Last updated: 12 Mar 2026
awesome-assured-autonomy
Curated research, tools, benchmarks, standards, and open-source systems for assuring autonomous systems.
aerospace ai-safety assured-autonomy autonomous-systems awesome awesome-list formal-verification robotics runtime-assurance safe-reinforcement-learning
0 stars
0 forks
77 projects
Last updated: 16 Aug 2026