Sales Automation on Sales Automation
57.9Coverage ScoreMEMENTO + Qwen
Evaluation Results
| Method | Links | |
|---|---|---|
| MEMENTO + QwenBackbone=Qwen, Evaluation Protocol=Learning from web, Memory Augmentation=Full MEMENTO2026.05 | 57.9 | |
| AET + QwenBackbone=Qwen, Evaluation Protocol=Learning from web, Memory Augmentation=AET-only2026.05 | 55.2 | |
| MEMENTO + GPT-5-miniBackbone=GPT-5-mini, Evaluation Protocol=Learning from web, Memory Augmentation=Full MEMENTO2026.05 | 54.7 | |
| AET + GPT-5-miniBackbone=GPT-5-mini, Evaluation Protocol=Learning from web, Memory Augmentation=AET-only2026.05 | 53.2 | |
| ReAct + GPT-5-mini + MEMENTOBackbone=GPT-5-mini, Evaluation Protocol=Web as a tool (ReAct), Memory Augmentation=MEMENTO2026.05 | 52.5 | |
| ReAct + GPT-5-miniBackbone=GPT-5-mini, Evaluation Protocol=Web as a tool (ReAct), Memory Augmentation=None2026.05 | 52.2 | |
| 5-shot GPT-5-mini + MEMENTOBackbone=GPT-5-mini, Evaluation Protocol=In-context learning, Memory Augmentation=MEMENTO2026.05 | 47.6 | |
| ReAct + Qwen + MEMENTOBackbone=Qwen, Evaluation Protocol=Web as a tool (ReAct), Memory Augmentation=MEMENTO2026.05 | 46.9 | |
| 5-shot GPT-5-miniBackbone=GPT-5-mini, Evaluation Protocol=In-context learning, Memory Augmentation=None2026.05 | 46.2 | |
| ReAct + QwenBackbone=Qwen, Evaluation Protocol=Web as a tool (ReAct), Memory Augmentation=None2026.05 | 46.1 | |
| Qwen + MEMENTOBackbone=Qwen, Evaluation Protocol=LLM (only parametric knowledge), Memory Augmentation=MEMENTO2026.05 | 43.7 | |
| QwenBackbone=Qwen, Evaluation Protocol=LLM (only parametric knowledge), Memory Augmentation=None2026.05 | 41.6 | |
| GPT-5-mini + MEMENTOBackbone=GPT-5-mini, Evaluation Protocol=LLM (only parametric knowledge), Memory Augmentation=MEMENTO2026.05 | 39.8 | |
| GPT-5-miniBackbone=GPT-5-mini, Evaluation Protocol=LLM (only parametric knowledge), Memory Augmentation=None2026.05 | 39.1 | |
| 5-shot Qwen + MEMENTOBackbone=Qwen, Evaluation Protocol=In-context learning, Memory Augmentation=MEMENTO2026.05 | 38.2 | |
| 5-shot QwenBackbone=Qwen, Evaluation Protocol=In-context learning, Memory Augmentation=None2026.05 | 37.5 |