Depth Estimation on KITTI improved ground truth 2015 (93% Eigen split)
0.055Abs RelManyDepth
Evaluation Results
| Method | Links | |||||||
|---|---|---|---|---|---|---|---|---|
| ManyDepthWxH=1024 x 320, Test frames=2 (-1, 0), Semantics=None, TTR=true, Backbone=ResNet50, Resolution=High2021.04 | 0.055 | 0.305 | 2.945 | 0.094 | 96.3 | 99.2 | 99.7 | |
| ManyDepthWxH=1024 x 320, Test frames=2 (-1, 0), Semantics=None, TTR=true, Resolution=High2021.04 | 0.056 | 0.322 | 3.034 | 0.096 | 96.1 | 99.2 | 99.7 | |
| ManyDepthWxH=640 x 192, Test frames=2 (-1, 0), Semantics=None, TTR=true, Resolution=Medium2021.04 | 0.058 | 0.334 | 3.137 | 0.101 | 95.8 | 99.1 | 99.7 | |
| ManyDepthWxH=1024 x 320, Test frames=2 (-1, 0), Semantics=None, TTR=false, Backbone=ResNet50, Resolution=High2021.04 | 0.062 | 0.343 | 3.139 | 0.102 | 95.3 | 99.1 | 99.7 | |
| ManyDepthWxH=1024 x 320, Test frames=2 (-1, 0), Semantics=None, TTR=false, Resolution=High2021.04 | 0.064 | 0.345 | 3.116 | 0.103 | 94.9 | 98.9 | 99.7 | |
| ManyDepthWxH=640 x 192, Test frames=2 (-1, 0), Semantics=None, TTR=false, Resolution=Medium2021.04 | 0.07 | 0.399 | 3.455 | 0.113 | 94.1 | 98.9 | 99.7 | |
| Packnet-SFMWxH=640 x 192, Test frames=1, Semantics=None, TTR=false2021.04 | 0.078 | 0.42 | 3.485 | 0.121 | 93.1 | 98.6 | 99.6 | |
| Monodepth2supervision=Self-supervised mono + stereo supervision (MS)2018.06 | 0.08 | 0.466 | 3.681 | 0.127 | 92.6 | 98.5 | 99.5 | |
| Johnston et al.WxH=640 x 192, Test frames=1, Semantics=None, TTR=false2021.04 | 0.081 | 0.484 | 3.716 | 0.126 | 92.7 | 98.5 | 99.6 | |
| Wang et al.WxH=640 x 192, Test frames=2 (-1, 0), Semantics=None, TTR=false2021.04 | 0.082 | 0.462 | 3.739 | 0.127 | 92.3 | 98.4 | 99.6 | |
| Monodepth2supervision=Self-supervised stereo supervision (S)2018.06 | 0.085 | 0.537 | 3.868 | 0.139 | 91.2 | 97.9 | 99.3 | |
| Patil et al.WxH=640 x 192, Test frames=N (evaluated on whole sequences), Semantics=None, TTR=false2021.04 | 0.087 | 0.495 | 3.775 | 0.133 | 91.7 | 98.3 | 99.5 | |
| Monodepth2supervision=Self-supervised mono supervision (M)2018.06 | 0.09 | 0.545 | 3.942 | 0.137 | 91.4 | 98.3 | 99.5 | |
| SuperDepthsupervision=Self-supervised stereo supervision (S), post-processing=true2018.06 | 0.09 | 0.542 | 3.967 | 0.144 | 90.1 | 97.6 | 99.3 | |
| Monodepth2WxH=640 x 192, Test frames=1, Semantics=None, TTR=false2021.04 | 0.09 | 0.545 | 3.942 | 0.137 | 91.4 | 98.3 | 99.5 | |
| Monodepth2WxH=1024 x 320, Test frames=1, Semantics=None, TTR=false2021.04 | 0.091 | 0.531 | 3.742 | 0.135 | 91.6 | 98.4 | 99.5 | |
| 3netsupervision=Self-supervised stereo supervision (S), backbone=ResNet-502018.06 | 0.102 | 0.675 | 4.293 | 0.159 | 88.1 | 96.9 | 99.1 | |
| Monodepth2supervision=Self-supervised mono + stereo supervision (MS), pre-training=false2018.06 | 0.107 | 0.72 | 4.345 | 0.161 | 89 | 97.1 | 98.9 | |
| Monodepthsupervision=Self-supervised stereo supervision (S)2018.06 | 0.109 | 0.811 | 4.568 | 0.166 | 87.7 | 96.7 | 98.8 | |
| Monodepth2supervision=Self-supervised stereo supervision (S), pre-training=false2018.06 | 0.11 | 0.849 | 4.58 | 0.173 | 87.5 | 96.2 | 98.6 | |
| Monodepth2supervision=Self-supervised mono supervision (M), pre-training=false2018.06 | 0.112 | 0.715 | 4.502 | 0.167 | 87.6 | 96.7 | 99 | |
| 3netsupervision=Self-supervised stereo supervision (S), backbone=VGG2018.06 | 0.119 | 0.92 | 4.824 | 0.182 | 85.6 | 95.7 | 98.5 | |
| EPC++supervision=Self-supervised mono supervision (M)2018.06 | 0.12 | 0.789 | 4.755 | 0.177 | 85.6 | 96.1 | 98.7 | |
| EPC++WxH=832 x 256, Test frames=1, Semantics=None, TTR=false2021.04 | 0.12 | 0.789 | 4.755 | 0.177 | 85.6 | 96.1 | 98.7 | |
| Ranjansupervision=Self-supervised mono supervision (M)2018.06 | 0.123 | 0.881 | 4.834 | 0.181 | 86 | 95.9 | 98.5 | |
| EPC++supervision=Self-supervised mono + stereo supervision (MS)2018.06 | 0.123 | 0.754 | 4.453 | 0.172 | 86.3 | 96.4 | 98.9 | |
| RanjanWxH=832 x 256, Test frames=1, Semantics=None, TTR=false2021.04 | 0.123 | 0.881 | 4.834 | 0.181 | 86 | 95.9 | 98.5 | |
| DDVOsupervision=Self-supervised mono supervision (M)2018.06 | 0.126 | 0.866 | 4.932 | 0.185 | 85.1 | 95.8 | 98.6 | |
| Zhan FullNYUsupervision=Auxiliary depth supervision + Self-supervised mono + stereo supervision (D*MS)2018.06 | 0.13 | 1.52 | 5.184 | 0.205 | 85.9 | 95.5 | 98.1 | |
| GeoNetsupervision=Self-supervised mono supervision (M)2018.06 | 0.132 | 0.994 | 5.24 | 0.193 | 83.3 | 95.3 | 98.5 | |
| Mahjouriansupervision=Self-supervised mono supervision (M)2018.06 | 0.134 | 0.983 | 5.501 | 0.203 | 82.7 | 94.4 | 98.1 | |
| Zhousupervision=Self-supervised mono supervision (M), source=Newer online implementation2018.06 | 0.176 | 1.532 | 6.129 | 0.244 | 75.8 | 92.1 | 97.1 |