Categories
Companies
Research
Sign in
Join
Loading the SOTA2 catalog…
WizWand is now SOTA2 Research
SOTA2
Research
Papers
Benchmarks
Datasets
Tasks
Agents & Tool Use AI research – Page 3 · SOTA2 Research
Back to Research
Research domain
Agents & Tool Use
Search tasks
Search
8 benchmarks · 3 papers
Language Agent Task
8 benchmarks · 6 papers
Agentic Task Performance
8 benchmarks · 1 papers
Autonomous Agent Task Solving
8 benchmarks · 1 papers
Character Relationship Network Updating
8 benchmarks · 4 papers
Agentic task solving
8 benchmarks · 6 papers
Interactive Reasoning
8 benchmarks · 2 papers
Tool-using
8 benchmarks · 1 papers
Multi-tool Threshold Poisoning Attack
8 benchmarks · 1 papers
Multi-turn task completion
8 benchmarks · 1 papers
Global resource management and long-term strategic planning
8 benchmarks · 1 papers
Multi-player game search
7 benchmarks · 3 papers
Multi-Agent Reasoning
7 benchmarks · 1 papers
Mobile App Task Automation
7 benchmarks · 5 papers
Web Interaction
7 benchmarks · 4 papers
Multi-agent planning
7 benchmarks · 1 papers
Agentic Retrieval
7 benchmarks · 1 papers
Self-Healing Tool Routing
7 benchmarks · 1 papers
Computer-use Task Execution
7 benchmarks · 3 papers
Task Routing
7 benchmarks · 3 papers
Browser Use
7 benchmarks · 1 papers
Tool Routing
7 benchmarks · 2 papers
Agentic Task Execution
7 benchmarks · 6 papers
Agentic Performance
7 benchmarks · 6 papers
Web Research
7 benchmarks · 1 papers
Agent Safety Judgment
7 benchmarks · 1 papers
Discrimination between Good Faith and Problematic agents (Summarization)
7 benchmarks · 4 papers
Tool-Integrated Reasoning
7 benchmarks · 6 papers
Agentic Task Success
7 benchmarks · 2 papers
Tool Identification
7 benchmarks · 14 papers
Mobile GUI Automation
7 benchmarks · 1 papers
Search-augmented Multi-turn Tool Calling
7 benchmarks · 3 papers
Goal-oriented planning
Page 3 of 49
Previous
Next