Depth Estimation on KITTI improved dense ground truth
0.059Abs RelBTS
Evaluation Results
| Method | Links | |||||||
|---|---|---|---|---|---|---|---|---|
| BTSSupervision=D (Depth), Test frames=12024.07 | 0.059 | 0.245 | 2.756 | 0.096 | 0.956 | 0.993 | 0.998 | |
| ProDepthSupervision=M (Monocular self-supervision), Test frames=2 (-1, 0)2024.07 | 0.059 | 0.308 | 3.06 | 0.097 | 0.959 | 0.992 | 0.997 | |
| DCPI-DepthResolution=192 x 640, Data=M2024.05 | 0.066 | 0.326 | 3.257 | 0.107 | 0.949 | 0.99 | 0.997 | |
| DynamicDepthSupervision=M (Monocular self-supervision), Test frames=2 (-1, 0)2024.07 | 0.068 | 0.362 | 3.454 | 0.111 | 0.943 | 0.991 | 0.998 | |
| ManyDepthSupervision=M (Monocular self-supervision), Test frames=2 (-1, 0)2024.07 | 0.07 | 0.399 | 3.455 | 0.113 | 0.941 | 0.989 | 0.997 | |
| AQUANetYear=2024, Resolution=192 x 640, Data=M2024.05 | 0.07 | 0.285 | 2.988 | 0.107 | 0.948 | 0.992 | 0.998 | |
| SENSEYear=2023, Resolution=192 x 640, Data=M2024.05 | 0.071 | 0.339 | 3.175 | 0.109 | 0.945 | 0.99 | 0.998 | |
| Guizilimi et al.Supervision=D (Depth), Test frames=12024.07 | 0.072 | 0.34 | 3.265 | 0.116 | 0.934 | — | — | |
| DORNSupervision=D (Depth), Test frames=12024.07 | 0.072 | 0.307 | 2.727 | 0.12 | 0.932 | 0.984 | 0.994 | |
| Yin et al.Supervision=D (Depth), Test frames=12024.07 | 0.072 | — | 3.258 | 0.117 | 0.938 | 0.99 | 0.998 | |
| MonoDiffusionYear=2024, Resolution=192 x 640, Data=M2024.05 | 0.073 | 0.377 | 3.451 | 0.115 | 0.935 | 0.988 | 0.997 | |
| DIFFNet+Year=2021, Resolution=192 x 640, Data=M2024.05 | 0.076 | 0.414 | 3.492 | 0.119 | 0.936 | 0.988 | 0.996 | |
| Lite-Mono+Year=2023, Resolution=192 x 640, Data=M2024.05 | 0.077 | 0.413 | 3.482 | 0.119 | 0.933 | 0.988 | 0.997 | |
| Lite-Mono-8M+Year=2023, Resolution=192 x 640, Data=M2024.05 | 0.077 | 0.423 | 3.527 | 0.119 | 0.934 | 0.988 | 0.997 | |
| Packnet-SFMSupervision=M (Monocular self-supervision), Test frames=12024.07 | 0.078 | 0.42 | 3.485 | 0.121 | 0.931 | 0.986 | 0.996 | |
| Monodepth2Year=2019, Resolution=192 x 640, Data=MS2024.05 | 0.08 | 0.466 | 3.681 | 0.127 | 0.926 | 0.985 | 0.995 | |
| Johnston et al.Supervision=M (Monocular self-supervision), Test frames=12024.07 | 0.081 | 0.484 | 3.716 | 0.126 | 0.927 | 0.985 | 0.996 | |
| Wang et al.Supervision=M (Monocular self-supervision), Test frames=2 (-1, 0)2024.07 | 0.082 | 0.462 | 3.739 | 0.127 | 0.923 | 0.984 | 0.996 | |
| Patil et al.Supervision=M (Monocular self-supervision), Test frames=N2024.07 | 0.087 | 0.495 | 3.775 | 0.133 | 0.917 | 0.983 | 0.995 | |
| Monodepth2Supervision=M (Monocular self-supervision), Test frames=12024.07 | 0.09 | 0.545 | 3.942 | 0.137 | 0.914 | 0.983 | 0.995 | |
| DCPI-DepthResolution=320 x 1024, Data=M2024.05 | 0.09 | 0.655 | 4.113 | 0.167 | 0.914 | 0.969 | 0.985 | |
| DaCCNYear=2023, Resolution=320 x 1024, Data=M2024.05 | 0.094 | 0.624 | 4.145 | 0.169 | 0.909 | 0.97 | 0.985 | |
| MonoDiffusionYear=2024, Resolution=320 x 1024, Data=M2024.05 | 0.095 | 0.67 | 4.219 | 0.171 | 0.909 | 0.968 | 0.984 | |
| MonoViT-tinyYear=2022, Resolution=320 x 1024, Data=M2024.05 | 0.096 | 0.714 | 4.292 | 0.172 | 0.908 | 0.968 | 0.984 | |
| DIFFNetYear=2021, Resolution=320 x 1024, Data=M2024.05 | 0.097 | 0.722 | 4.435 | 0.174 | 0.907 | 0.967 | 0.984 | |
| Gan et al.Supervision=D (Depth), Test frames=12024.07 | 0.098 | 0.666 | 3.933 | 0.173 | 0.89 | 0.964 | 0.985 | |
| SENSEYear=2023, Resolution=320 x 1024, Data=M2024.05 | 0.099 | 0.617 | 4.079 | 0.172 | 0.902 | 0.968 | 0.985 | |
| Kuznietsov et al.Supervision=D (Depth), Test frames=12024.07 | 0.113 | 0.741 | 4.621 | 0.189 | 0.862 | 0.96 | 0.986 | |
| Monodepth2Year=2019, Resolution=320 x 1024, Data=M2024.05 | 0.115 | 0.882 | 4.701 | 0.19 | 0.879 | 0.961 | 0.982 |