Knowledge-intensive generation on ELI5 (dev)
26.6ROUGE-L ScoreKID
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| KIDBackbone=GPT2-medium, Parameters=345M, Evaluation Protocol=fine-tuned, Decoding Strategy=KID2022.04 | 26.6 | 27.9 | |
| KIDBackbone=BART-large, Parameters=406M, Evaluation Protocol=fine-tuned, Decoding Strategy=KID2022.04 | 26.3 | 27.4 | |
| RAGRole=Published SotA2022.04 | 26.2 | — | |
| GPT2-mediumBackbone=GPT2-medium, Parameters=345M, Evaluation Protocol=fine-tuned, Decoding Strategy=Sampling2022.04 | 25.4 | 23.8 | |
| BART-largeBackbone=BART-large, Parameters=406M, Evaluation Protocol=fine-tuned, Decoding Strategy=Sampling2022.04 | 25.1 | 25.8 | |
| BART-largeBackbone=BART-large, Parameters=406M, Evaluation Protocol=fine-tuned, Decoding Strategy=Beam2022.04 | 24.7 | 25.6 | |
| GPT2-mediumBackbone=GPT2-medium, Parameters=345M, Evaluation Protocol=fine-tuned, Decoding Strategy=Beam2022.04 | 24.6 | 22.9 | |
| BART-largeBackbone=BART-large, Parameters=406M, Evaluation Protocol=zero-shot2022.04 | 20.6 | 21.4 | |
| GPT2-mediumBackbone=GPT2-medium, Parameters=345M, Evaluation Protocol=zero-shot2022.04 | 16.1 | 14.6 |