Categories
Companies
Research
Sign in
Join
Loading the SOTA2 catalog…
WizWand is now SOTA2 Research
SOTA2
Research
Papers
Benchmarks
Datasets
Tasks
Agents & Tool Use AI research – Page 23 · SOTA2 Research
Back to Research
Research domain
Agents & Tool Use
Search tasks
Search
1 benchmarks · 1 papers
Intent Alignment
1 benchmarks · 1 papers
Task 1-2 (L)
1 benchmarks · 1 papers
Task 1-3 (L)
1 benchmarks · 1 papers
Task 1-4 (L)
1 benchmarks · 1 papers
Task 2-2 (M)
1 benchmarks · 1 papers
UAV Command Generation
1 benchmarks · 1 papers
Task 2-3 (L)
1 benchmarks · 1 papers
Task 3-2 (M)
1 benchmarks · 1 papers
Task 3-3 (M)
1 benchmarks · 1 papers
Task 4-1 (S)
1 benchmarks · 1 papers
Task 4-2 (S)
1 benchmarks · 1 papers
Multi-agent cooperation sustainability simulation
1 benchmarks · 5 papers
Web Navigation Task Success
1 benchmarks · 1 papers
Task 4-3 (S)
1 benchmarks · 1 papers
Task 4-4 (S)
1 benchmarks · 1 papers
Task 6-1 (M)
1 benchmarks · 1 papers
Task 7-3 (S)
1 benchmarks · 1 papers
Task 8-2 (S)
1 benchmarks · 1 papers
Mobile GUI Agent Task
1 benchmarks · 1 papers
Task 9-1 (L)
1 benchmarks · 1 papers
Task 9-2 (L)
1 benchmarks · 1 papers
Tool-use decision-making
1 benchmarks · 1 papers
Multi-agent Game Playing
1 benchmarks · 1 papers
Mobile GUI Agents
1 benchmarks · 1 papers
Task 10-1 (L)
1 benchmarks · 1 papers
Agentic Memory Recall
1 benchmarks · 2 papers
Visual Agentic Reasoning
1 benchmarks · 1 papers
Multi-agent assistant system evaluation
1 benchmarks · 1 papers
Conversational Agent Interaction
1 benchmarks · 1 papers
GUI agent clicking task
1 benchmarks · 1 papers
High-level instruction following
1 benchmarks · 1 papers
Multi-agent aggregation
Page 23 of 49
Previous
Next