Categories
Companies
Research
Sign in
Join
Loading the SOTA2 catalog…
WizWand is now SOTA2 Research
SOTA2
Research
Papers
Benchmarks
Datasets
Tasks
LLM (Chat & Instruction) AI research – Page 126 · SOTA2 Research
Back to Research
Research domain
LLM (Chat & Instruction)
Search tasks
Search
1 benchmarks · 1 papers
Memory admission
1 benchmarks · 1 papers
Oral Argument Simulation
1 benchmarks · 1 papers
General Competence
1 benchmarks · 1 papers
Multi-step reasoning grounded in visual information
1 benchmarks · 1 papers
Legal Inquisitive Dialogue
1 benchmarks · 1 papers
Interactive Scientific Reasoning
1 benchmarks · 1 papers
Direct Verifier Evaluation
1 benchmarks · 1 papers
Knowledge-Grounded Dialogue Generation (Fluency)
1 benchmarks · 2 papers
LaMP-1 Personalization
1 benchmarks · 1 papers
Long-context Summary
1 benchmarks · 1 papers
Finetuning with implicit harmful data
1 benchmarks · 1 papers
Routing for Question Answering
1 benchmarks · 1 papers
GUI Action Critiquing
1 benchmarks · 1 papers
Multi-turn response addition
1 benchmarks · 1 papers
Latent Concept Detection
1 benchmarks · 1 papers
Multi-turn response refinement
1 benchmarks · 1 papers
Commonsense Multi-hop QA
1 benchmarks · 2 papers
LaMP-3 Personalization
1 benchmarks · 1 papers
Value Alignment Text Rewriting
1 benchmarks · 1 papers
Personalized Generative Recall
1 benchmarks · 1 papers
Aggregate LLM Evaluation
1 benchmarks · 1 papers
Multi-domain Language Understanding and Reasoning
1 benchmarks · 1 papers
Stateful Agent-User Interaction
1 benchmarks · 1 papers
Web of Lies
1 benchmarks · 1 papers
LaMP-4 Personalization
1 benchmarks · 1 papers
General Chat Evaluation
1 benchmarks · 1 papers
Lifelong Safety Adaptation
1 benchmarks · 1 papers
RLHF Training
1 benchmarks · 1 papers
Multi-modal Long-context Benchmarking
1 benchmarks · 1 papers
beauty live-commerce dialogue generation
1 benchmarks · 1 papers
NIAH
1 benchmarks · 1 papers
Pareto prompt set identification
Page 126 of 154
Previous
Next