Failure Diagnosis on Distributed Systems
70.67Match RateGoS
Evaluation Results
| Method | Links | |||
|---|---|---|---|---|
| GoSAgent Architecture=Multi-Agent, Evaluation=LLM-as-a-Judge2026.03 | 70.67 | 88 | 0.1 | |
| CoTAgent Architecture=Multi-Agent, Framework=D-Bot, Evaluation=LLM-as-a-Judge2026.03 | 34 | 82.67 | 0.05 | |
| FoTAgent Architecture=Single-Agent, Evaluation=LLM-as-a-Judge2026.03 | 28.67 | 84 | 0.45 | |
| GoTAgent Architecture=Multi-Agent, Framework=D-Bot, Evaluation=LLM-as-a-Judge2026.03 | 28 | 80.67 | 0.18 | |
| FoTAgent Architecture=Multi-Agent, Framework=D-Bot, Evaluation=LLM-as-a-Judge2026.03 | 28 | 86.67 | 0.94 | |
| GoTAgent Architecture=Single-Agent, Evaluation=LLM-as-a-Judge2026.03 | 27.33 | 80 | 0.11 | |
| CoTAgent Architecture=Single-Agent, Evaluation=LLM-as-a-Judge2026.03 | 26.67 | 81.33 | 0.03 | |
| ToTAgent Architecture=Single-Agent, Evaluation=LLM-as-a-Judge2026.03 | 25.33 | 78 | 0.14 | |
| ToTAgent Architecture=Multi-Agent, Framework=D-Bot, Evaluation=LLM-as-a-Judge2026.03 | 25.33 | 81.33 | 0.13 |