Curiosity on G2U Curiosity
1.402MeanV-JEPA2
Evaluation Results
| Method | Links | |||
|---|---|---|---|---|
| V-JEPA2Paradigm=World Model Group, Optimization Objective (@)=curiosity2025.11 | 1.402 | 15.6 | 16.5 | |
| GenieReduxParadigm=World Model Group, Optimization Objective (@)=curiosity2025.11 | 1.374 | 12.5 | 9.8 | |
| GenieReduxParadigm=World Model Group, Optimization Objective (@)=utility2025.11 | 1.248 | 12.4 | 14.6 | |
| GenieReduxParadigm=World Model Group, Optimization Objective (@)=survival2025.11 | 1.198 | 12.5 | 11 | |
| Qwen3-VL-8BParadigm=Interactive Physical Reasoner Group, Interactive Physical Reasoner (IPR) Status=w/ IPR2025.11 | 1.173 | 13.1 | 13.4 | |
| DreamerV3Paradigm=World Model Group, Optimization Objective (@)=curiosity2025.11 | 1.161 | 13.1 | 14 | |
| V-JEPA2Paradigm=World Model Group, Optimization Objective (@)=survival2025.11 | 1.15 | 15.6 | 17.7 | |
| V-JEPA2Paradigm=World Model Group, Optimization Objective (@)=utility2025.11 | 1.136 | 14.5 | 22.6 | |
| DreamerV3Paradigm=World Model Group, Optimization Objective (@)=survival2025.11 | 1.12 | 12.5 | 16.5 | |
| HumanParadigm=Control Group2025.11 | 1 | 7.9 | 14 | |
| DreamerV3Paradigm=World Model Group, Optimization Objective (@)=utility2025.11 | 0.964 | 15.4 | 11 | |
| Qwen3-VL-30B-A3BParadigm=Multimodal Large Language Model (MLLM) Group, Optimization Objective (@)=curiosity2025.11 | 0.878 | 20.5 | 2.4 | |
| DQNParadigm=Reinforcement Learning (RL) Group, Optimization Objective (@)=survival2025.11 | 0.856 | 14.4 | 8.5 | |
| Qwen3-VL-8B-BCParadigm=Imitation Learning (IL) Group2025.11 | 0.812 | 12.8 | 9.1 | |
| ACT-BCParadigm=Imitation Learning (IL) Group2025.11 | 0.793 | 15.1 | 12.8 | |
| DQNParadigm=Reinforcement Learning (RL) Group, Optimization Objective (@)=curiosity2025.11 | 0.772 | 13.4 | 7.9 | |
| DQNParadigm=Reinforcement Learning (RL) Group, Optimization Objective (@)=utility2025.11 | 0.62 | 14.2 | 4.9 | |
| Qwen3-VL-30B-A3BParadigm=Multimodal Large Language Model (MLLM) Group, Optimization Objective (@)=utility2025.11 | 0.528 | 21.3 | 4.9 | |
| GPT-4oParadigm=Multimodal Large Language Model (MLLM) Group, Optimization Objective (@)=curiosity2025.11 | 0.368 | 15.3 | 5.5 | |
| Qwen3-VL-30B-A3BParadigm=Multimodal Large Language Model (MLLM) Group, Optimization Objective (@)=survival2025.11 | 0.325 | 23 | 0 | |
| Qwen3-VL-8BParadigm=Interactive Physical Reasoner Group, Interactive Physical Reasoner (IPR) Status=w/o IPR2025.11 | 0.325 | 15 | 4.3 | |
| GPT-4oParadigm=Multimodal Large Language Model (MLLM) Group, Optimization Objective (@)=utility2025.11 | 0.319 | 14.6 | 3.7 | |
| GPT-5Paradigm=Multimodal Large Language Model (MLLM) Group, Optimization Objective (@)=curiosity2025.11 | 0.298 | 16.4 | 7.3 | |
| PPOParadigm=Reinforcement Learning (RL) Group, Optimization Objective (@)=survival2025.11 | 0.233 | 16.5 | 3.7 | |
| PPOParadigm=Reinforcement Learning (RL) Group, Optimization Objective (@)=utility2025.11 | 0.22 | 16.8 | 3 | |
| PPOParadigm=Reinforcement Learning (RL) Group, Optimization Objective (@)=curiosity2025.11 | 0.19 | 17.3 | 2.4 | |
| GPT-5Paradigm=Multimodal Large Language Model (MLLM) Group, Optimization Objective (@)=utility2025.11 | 0.185 | 16.5 | 0.6 | |
| GPT-5Paradigm=Multimodal Large Language Model (MLLM) Group, Optimization Objective (@)=survival2025.11 | 0.127 | 18.3 | 1.8 | |
| GPT-4oParadigm=Multimodal Large Language Model (MLLM) Group, Optimization Objective (@)=survival2025.11 | 0.039 | 17.2 | 0.6 | |
| RandomParadigm=Control Group2025.11 | 0 | 18.1 | 3 |