Categories
Companies
Research
Sign in
Join
Loading the SOTA2 catalog…
WizWand is now SOTA2 Research
SOTA2
Research
Papers
Benchmarks
Datasets
Tasks
Agents & Tool Use AI research – Page 15 · SOTA2 Research
Back to Research
Research domain
Agents & Tool Use
Search tasks
Search
2 benchmarks · 1 papers
Inquire-driven GUI Navigation
2 benchmarks · 1 papers
GUI Execution
2 benchmarks · 1 papers
Sub-task Completion
2 benchmarks · 1 papers
Collaborative software engineering
2 benchmarks · 2 papers
Multi-tool calling
2 benchmarks · 1 papers
Mobile GUI Agent Execution
2 benchmarks · 1 papers
Skill Evaluation
2 benchmarks · 1 papers
Tool Sequence Recommendation
2 benchmarks · 1 papers
End-to-End Environment Interaction
2 benchmarks · 1 papers
Conversational web navigation
2 benchmarks · 1 papers
Personalized Agentic Social Support
2 benchmarks · 1 papers
Multi-Agent Construction
2 benchmarks · 1 papers
Web-based Agent Task Completion
2 benchmarks · 1 papers
Single-turn Tool Calling
2 benchmarks · 1 papers
Textual Environment Interaction
2 benchmarks · 1 papers
Slide Automation
2 benchmarks · 1 papers
E-commerce Navigation and Search
2 benchmarks · 1 papers
Spreadsheet Understanding and Manipulation
2 benchmarks · 2 papers
Role-playing agent evaluation
2 benchmarks · 4 papers
GUI planning
2 benchmarks · 1 papers
Safety and Action Blocking
2 benchmarks · 1 papers
Price Negotiation
2 benchmarks · 1 papers
Multi-step reasoning and knowledge retrieval
2 benchmarks · 1 papers
device control
2 benchmarks · 3 papers
GUI Task Completion
2 benchmarks · 1 papers
Agent Recommendation (Summarization)
2 benchmarks · 2 papers
Multi-agent Scenario Generation
2 benchmarks · 1 papers
Agent-team recommendation
2 benchmarks · 1 papers
Multi-agent contract design
2 benchmarks · 1 papers
Single-agent contract design
2 benchmarks · 1 papers
Steering Validation
2 benchmarks · 1 papers
User-aligned task completion
Page 15 of 49
Previous
Next