Categories
Companies
Research
Sign in
Join
Loading the SOTA2 catalog…
WizWand is now SOTA2 Research
SOTA2
Research
Papers
Benchmarks
Datasets
Tasks
LLM (Chat & Instruction) AI research – Page 56 · SOTA2 Research
Back to Research
Research domain
LLM (Chat & Instruction)
Search tasks
Search
2 benchmarks · 1 papers
Clarifying Questions
2 benchmarks · 1 papers
Long-horizon dialogue
2 benchmarks · 1 papers
Chit-chat Dialogue
2 benchmarks · 1 papers
Medical Knowledge Editing
2 benchmarks · 1 papers
Agent Planning and API Calling
2 benchmarks · 1 papers
Therapeutic Dialogue Generation
2 benchmarks · 2 papers
General Model Capability
2 benchmarks · 1 papers
Prompt Optimization Evaluation
2 benchmarks · 2 papers
Knowledge & QA
2 benchmarks · 2 papers
Engineering problem-solving
2 benchmarks · 1 papers
Pluralistic Reward Model Learning
2 benchmarks · 1 papers
Pair-wise Research Idea Comparison
2 benchmarks · 2 papers
General Alignment
2 benchmarks · 2 papers
Professional Reasoning
2 benchmarks · 1 papers
Deception Evaluation
2 benchmarks · 2 papers
Tutoring Evaluation
2 benchmarks · 2 papers
LLM-as-Judge evaluation
2 benchmarks · 2 papers
RLHF Alignment
2 benchmarks · 1 papers
Episodic Memory
2 benchmarks · 2 papers
Biomedical Reasoning
2 benchmarks · 2 papers
Long-context Multimodal Understanding
2 benchmarks · 1 papers
Sequential Multi-Task Learning
2 benchmarks · 4 papers
Multi-task Knowledge Understanding
2 benchmarks · 3 papers
Long-term Memory Retrieval
2 benchmarks · 2 papers
Veracity Explanation Ranking
2 benchmarks · 1 papers
Knowledge-intensive Dialogue
2 benchmarks · 1 papers
Free-language reasoning
2 benchmarks · 1 papers
Interactive query answering
2 benchmarks · 1 papers
Long-Horizon Search Intelligence
2 benchmarks · 2 papers
Free-form Question Answering
2 benchmarks · 3 papers
Personality control
2 benchmarks · 1 papers
Long-term preference alignment
Page 56 of 154
Previous
Next