Llm-Agents
Llm-Agents
- slurm-rca-bench
A public incident-diagnosis benchmark for HPC schedulers — ten reproducible failure scenarios with measured ground truth and degenerate baselines.
- cluster-sre-agent
Multi-agent diagnosis over an explicit cluster dependency graph — five ablatable configurations, specified before results existed.