Clinical NLP Tasks on MTSamples
3.64GPT-4 ScoreGPT-3.5-turbo
Evaluation Results
| Method | Links | |
|---|---|---|
| GPT-3.5-turboModel Size=175B, Sample Size=1012023.09 | 3.64 | |
| Asclepius-RModel Size=13B, Sample Size=1012023.09 | 3.61 | |
| Asclepius-RModel Size=7B, Sample Size=1012023.09 | 3.58 | |
| AsclepiusModel Size=7B, Sample Size=1012023.09 | 3.57 | |
| AsclepiusModel Size=13B, Sample Size=1012023.09 | 3.51 | |
| Clinical-CamelModel Size=13B, Sample Size=1012023.09 | 3.39 | |
| VicunaModel Size=13B, Sample Size=1012023.09 | 3.21 | |
| ChatDoctorModel Size=7B, Sample Size=1012023.09 | 2.85 | |
| AlpacaModel Size=7B, Sample Size=1012023.09 | 2.73 | |
| MedAlpacaModel Size=7B, Sample Size=1012023.09 | 1.61 |