AI Safety and Alignment Group
Popular repositories Loading
-
PostTrainBench
PostTrainBench PublicMeasuring how well CLI agents like Claude Code or Codex CLI can post-train base LLMs on a single H100 GPU in 10 hours
-
tue-ai-safety-course
tue-ai-safety-course PublicAI safety course at the University of Tübingen (Summer Semester 2026)
-
skill-inject
skill-inject PublicSkill-Inject: Measuring Agent Vulnerability to Skill File Attacks
-
InferenceBench
InferenceBench PublicBenchmarking Open-Ended Inference Optimization by AI Agents
-
promptinject-agent-skills
promptinject-agent-skills PublicAgent Skills Enable a New Class of Realistic and Trivially Simple Prompt Injections
-
decomposing-eval-awareness
decomposing-eval-awareness PublicDecomposing and measuring evaluation awareness in existing benchmarks and our proposed EvalAwareBench.
Repositories
- researcharena-website Public
- PostTrainBench Public
Measuring how well CLI agents like Claude Code or Codex CLI can post-train base LLMs on a single H100 GPU in 10 hours
- ResearchArena Public
- em-generalization Public
- promptinject-agent-skills Public
Agent Skills Enable a New Class of Realistic and Trivially Simple Prompt Injections
- inferencebench-site Public
Top languages
Loading…
Most used topics
Loading…