Effectiveness Scoring on AMI Corpus Scenario Meetings
0.6594Spearman's RhoQwen3-32B
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| Qwen3-32BReasoning mode=non-reasoning, Input configuration=ground truth inputs, Context window size=12026.04 | 0.6594 | 0.4939 | |
| Llama3.3-70B-InstructInput configuration=ground truth inputs, Context window size=12026.04 | 0.6558 | 0.5381 | |
| GPT-4oInput configuration=ground truth inputs, Context window size=12026.04 | 0.6518 | 0.4923 | |
| DeepSeek-R1-70BInput configuration=ground truth inputs, Context window size=12026.04 | 0.6298 | 0.4905 | |
| Qwen3-32BReasoning mode=reasoning, Input configuration=ground truth inputs, Context window size=12026.04 | 0.6278 | 0.4805 | |
| Gemini-2.5-FlashInput configuration=ground truth inputs, Context window size=12026.04 | 0.5793 | 0.4262 |