{"as_of":"2026-08-18T20:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2af000dd06ce895ae1fdbf53754ae65299adf053001fb50c1c657c28d9a66fbe","coverage":[{"denominator":140,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T10:35:23.733936Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T17:18:51.726719Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T07:06:00.733358Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"cited_work":{"arxiv_id":"2504.17787","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.17787","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The fourth monocular depth estimation challenge","venue":null,"work_id":"2dd4cf82-ff9e-41c5-bebd-f3194f7f4ab8","year":2025},"citing_paper":{"arxiv_id":"2604.09352","last_updated":"2026-04-10T14:24:07Z","snapshot_observed_at":"2026-08-16T04:48:09.636147Z","submitted_at":"2026-04-10T14:24:07Z","title":"LuMon: A Comprehensive Benchmark and Development Suite with Novel Datasets for Lunar Monocular Depth Estimation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-10T17:18:51.726719Z"},"links":{"cited_paper":"/paper/2504.17787","citing_paper":"/paper/2604.09352"},"observation_digest":"sha256:e2984ad8c1e3b5e59453a165084650f6ee2124cd2ebfc50db8c96d271aba72bd","observation_id":"e39779de-59ae-4b82-8045-a4f3f6af8182","resolution":{"observed_at":"2026-05-11T07:06:00.740348Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.17787/citation-record","integrity":"/paper/2504.17787/integrity","json":"/paper/2504.17787/citation-record.json","paper":"/paper/2504.17787"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.368307Z","title":"The Southampton-York Natural Scenes (SYNS) dataset: Statis- tics of surface attitude","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.368307Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:7c3172b8b53d5be6d0daa905c124cff99a2938c9ca3cf570b6253ef8d148b7c3","observation_id":"1c46480b-4cc5-4330-9f3f-502fc805a285","resolution":{"observed_at":"2026-08-16T10:35:23.368307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.372766Z","title":"Attention attention everywhere: Monocular depth prediction with skip atten- tion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.372766Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:23ac48cc6a537465d85fa73b639d8c366c1fdcb73cbec8cb36bdfa8b98d079ca","observation_id":"deae1f43-33b6-48ba-9848-8e8806308e92","resolution":{"observed_at":"2026-08-16T10:35:23.372766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.377122Z","title":"Generative adversarial networks for unsupervised monocular depth prediction","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.377122Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:27b45ec71c2a0fd2cbc6cf121da10e4827c44581162cb24d134edcace729a441","observation_id":"bad5d69a-8023-4fb9-9a79-106e5584bd68","resolution":{"observed_at":"2026-08-16T10:35:23.377122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.381556Z","title":"Real-time single image depth perception in the wild with handheld devices","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.381556Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:2dbf2689ef7b0786afef3f1226a71951331380ab37c336224420da2ba3aa98dd","observation_id":"9311074e-f22a-419c-af16-06333f4a9856","resolution":{"observed_at":"2026-08-16T10:35:23.381556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.385538Z","title":"Enhancing self-supervised monocular depth estimation with traditional visual odometry","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.385538Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:0f1fc1d73a70712e2553f229971112ee3a6362b95d2963ebb5ab3e2787542e2f","observation_id":"feeb7d54-901a-40b6-9938-c12db3679860","resolution":{"observed_at":"2026-08-16T10:35:23.385538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.389380Z","title":"Adabins: Depth estimation using adaptive bins","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.389380Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:b95bba335bb5821dc28bff8af42c6f5614e3ba9e333f2a4ca5889664fca332ce","observation_id":"81c796ce-1e10-4a25-8a8a-27c09ef13f86","resolution":{"observed_at":"2026-08-16T10:35:23.389380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.393106Z","title":"Localbins: Improving depth estimation by learning local distributions","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.393106Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:b7a3cbc0893f84769fb9e8179a8eec840dbe9178a1e93659b4b4ac052f653423","observation_id":"94efd523-388e-454e-9198-7c17488b47b7","resolution":{"observed_at":"2026-08-16T10:35:23.393106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12288","last_updated":"2023-02-23T19:13:10Z","snapshot_observed_at":"2026-07-06T14:55:15.719380Z","submitted_at":"2023-02-23T19:13:10Z","title":"ZoeDepth: Zero-shot Transfer by Combining Relative and Metric Depth","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12288","snapshot_observed_at":"2026-08-16T10:35:23.396582Z","title":"Zoedepth: Zero-shot trans- fer by combining relative and metric depth","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.396582Z"},"links":{"cited_paper":"/paper/2302.12288","citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:f889fabd492c62b13306562bb8dc2cbb3820bd0a84d09e2e17851893afa1407b","observation_id":"5484d999-f652-4423-8af7-801ccc45dfab","resolution":{"observed_at":"2026-08-16T10:35:23.396582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.400627Z","title":"Unsu- pervised Scale-consistent Depth and Ego-motion Learning from Monocular Video","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.400627Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:fcfd6e42f0d02d455f07db6d3d789c738d8f793afd8209e4e8e8058e28363dd9","observation_id":"20732930-cb93-40c4-b27a-240b0c6fa3bb","resolution":{"observed_at":"2026-08-16T10:35:23.400627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02073","last_updated":"2025-04-21T12:09:08Z","snapshot_observed_at":"2026-08-02T06:32:26.688405Z","submitted_at":"2024-10-02T22:42:20Z","title":"Depth Pro: Sharp Monocular Metric Depth in Less Than a Second","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02073","snapshot_observed_at":"2026-08-16T10:35:23.404061Z","title":"Depth pro: Sharp monocular metric depth in less than a second","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.404061Z"},"links":{"cited_paper":"/paper/2410.02073","citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:17e764ec408e4be8ea01832132661221a81807ba1a06d528500f74eb48208066","observation_id":"9913d1ed-0330-4fec-a016-2fe3060bd1c7","resolution":{"observed_at":"2026-08-16T10:35:23.404061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.10773","last_updated":"2020-01-29T12:13:20Z","snapshot_observed_at":"2026-07-06T08:53:28.193420Z","submitted_at":"2020-01-29T12:13:20Z","title":"Virtual KITTI 2","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.10773","snapshot_observed_at":"2026-08-16T10:35:23.408088Z","title":"Virtual kitti 2","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.408088Z"},"links":{"cited_paper":"/paper/2001.10773","citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:58e8f82630946a7a319977b1ddae5e2674f1fc501153a151e2bc37dd3ab70afe","observation_id":"04261a63-ba0b-4533-911e-1467f6b03a60","resolution":{"observed_at":"2026-08-16T10:35:23.408088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.412318Z","title":"Depth prediction without the sensors: Lever- aging structure for unsupervised learning from monocular videos","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.412318Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:5a4418527ed37ed309cf07026ff36853f02ab3f5669826a30741bf2fb41b8f63","observation_id":"ab3548b4-3ccc-4ed6-b8c5-7fbc82deab78","resolution":{"observed_at":"2026-08-16T10:35:23.412318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12375","last_updated":"2025-06-15T03:50:49Z","snapshot_observed_at":"2026-08-17T14:42:35.609667Z","submitted_at":"2025-01-21T18:53:30Z","title":"Video Depth Anything: Consistent Depth Estimation for Super-Long Videos","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12375","snapshot_observed_at":"2026-08-16T10:35:23.416031Z","title":"Video depth anything: Consistent depth estimation for super-long videos","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.416031Z"},"links":{"cited_paper":"/paper/2501.12375","citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:cea612ed0b649cb21dec0e619e3c4b26951f892ee497160765b39e197edc8f8b","observation_id":"3c617dd1-171c-4307-90be-8dbb2edd7ed2","resolution":{"observed_at":"2026-08-16T10:35:23.416031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.419863Z","title":"Single- image depth perception in the wild","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.419863Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:f50a2dac7fe9dbd9e6049e7e7368c469a35046458f0f1e680c0e0285f9ea0d9b","observation_id":"166487a0-6216-4c62-9033-1d23ebdc986e","resolution":{"observed_at":"2026-08-16T10:35:23.419863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.423408Z","title":"OASIS: A large-scale dataset for single image 3d in the wild","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.423408Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:f912223f7e4e9049459f94c79f8e1c3a16f375b82a76f189159b6da32c40d9dc","observation_id":"7204b4c3-81e2-4961-a8b7-cd66d095ef76","resolution":{"observed_at":"2026-08-16T10:35:23.423408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.426753Z","title":"Swin-depth: Us- ing transformers and multi-scale fusion for monocular-based depth estimation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.426753Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:a6350592f4f04bdcf6b3ddab225e4c52faf72cbbfdc5cba022b85d30d389cd97","observation_id":"648ef781-330b-4da8-aece-10405935cb1a","resolution":{"observed_at":"2026-08-16T10:35:23.426753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.11590","last_updated":"2021-10-22T05:12:42Z","snapshot_observed_at":"2026-08-18T18:55:04.642902Z","submitted_at":"2021-10-22T05:12:42Z","title":"DIML/CVL RGB-D Dataset: 2M RGB-D Images of Natural Indoor and Outdoor Scenes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.11590","snapshot_observed_at":"2026-08-16T10:35:23.430071Z","title":"Diml/cvl rgb-d dataset: 2m rgb-d im- ages of natural indoor and outdoor scenes","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.430071Z"},"links":{"cited_paper":"/paper/2110.11590","citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:fc27453fbe0c741963d03e2ac1159d3d7c3d8c8e2a5f1760ca054a2db7f87b5a","observation_id":"f6b67b22-195c-4361-a303-4474e869403e","resolution":{"observed_at":"2026-08-16T10:35:23.430071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.433718Z","title":"Adaptive confidence thresholding for monocular depth es- timation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.433718Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:4e8a38feabf74725b98e49582a3e61cd0fd9190040e5794c239afef07ffbc146","observation_id":"89e8ab0e-5699-4054-8d32-8b716f7b12ec","resolution":{"observed_at":"2026-08-16T10:35:23.433718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.437106Z","title":"Energy-quality scalable monocular depth estimation on low- power cpus","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.437106Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:e97bbaa25cc6262df15bc06c9d833dc59f693c8e3a43a0fcafafb1275602da37","observation_id":"af9b6c30-f8f5-450f-9d12-475ebda56ec8","resolution":{"observed_at":"2026-08-16T10:35:23.437106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.440777Z","title":"The cityscapes dataset for semantic urban scene understanding","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.440777Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:6a82e3043fc8a360cdb407122d9f8d7936b03179118b5eabc57117104d5c18f9","observation_id":"aa2a4ce1-979e-42b0-96ff-0f818021b03e","resolution":{"observed_at":"2026-08-16T10:35:23.440777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.444488Z","title":"Learn- ing depth estimation for transparent and mirror surfaces","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.444488Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:b670f4ca31178a337942097664c0420eaee63594d6a42a9ad584b4956a658896","observation_id":"1f6040db-f581-4633-8a9b-807c88ba361e","resolution":{"observed_at":"2026-08-16T10:35:23.444488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.448384Z","title":"Self-supervised object motion and depth estimation from video","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.448384Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:979046ab123a43e2b59dd0e718f612e5c9d818a9aa4ea62106db4b4e15e0b3b9","observation_id":"4d1d2809-8d1d-4671-834f-75ae770dda83","resolution":{"observed_at":"2026-08-16T10:35:23.448384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.452391Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.452391Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:a4cabb13b37f829d1a396997f80ae344263528466402638cab75b12a50182f38","observation_id":"edb8049b-f458-4aca-a438-ff8700b5dfa8","resolution":{"observed_at":"2026-08-16T10:35:23.452391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05021","last_updated":"2023-08-29T05:20:36Z","snapshot_observed_at":"2026-08-16T15:49:38.385073Z","submitted_at":"2023-03-09T03:48:24Z","title":"DiffusionDepth: Diffusion Denoising Approach for Monocular Depth Estimation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05021","snapshot_observed_at":"2026-08-16T10:35:23.455908Z","title":"DiffusionDepth: Diffusion denoising approach for monocular depth estima- tion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.455908Z"},"links":{"cited_paper":"/paper/2303.05021","citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:e3b49548e23f085c3b2cec271a006953078731884b52ca40c01d33cbb79561e7","observation_id":"d0431982-3556-40f8-bc18-288c1791afa0","resolution":{"observed_at":"2026-08-16T10:35:23.455908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.459607Z","title":"Omnidata: A scalable pipeline for making multi-task mid-level vision datasets from 3d scans","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.459607Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:7b8ad34c5e910d5dae14962ecd5c18ed19c63559ee959c30cb5dd25baab9d295","observation_id":"662cb665-3108-496d-9084-1759b14d91b7","resolution":{"observed_at":"2026-08-16T10:35:23.459607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.462882Z","title":"Predicting Depth, Surface Normals and Semantic Labels with a Common Multi-scale Convolutional Architecture","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.462882Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:8eb8499feecedfc8a9bba466266739d4b584c0013521517e8a81a9efbeaf70b5","observation_id":"5775c734-af80-4b93-8b99-20fdc95b9482","resolution":{"observed_at":"2026-08-16T10:35:23.462882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.466357Z","title":"Deep ordinal regression network for monocular depth estimation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.466357Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:8c7a02f8fd9e9555c499f6dce4157ae3aa1dbe3ecb4f2a533e48c342e6aaf78f","observation_id":"a58d2f9f-18af-46b7-8b3d-4533010e2d30","resolution":{"observed_at":"2026-08-16T10:35:23.466357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.470276Z","title":"Geowizard: Unleashing the diffusion priors for 3d geometry estimation from a single image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.470276Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:445dc90e231dd0fe79384b65502c0abca4062fc8439c13e3464148320146dbf3","observation_id":"03b93051-a276-4be9-8f70-7af5cdf9647a","resolution":{"observed_at":"2026-08-16T10:35:23.470276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.473929Z","title":"Unsupervised CNN for Single View Depth Estimation: Ge- ometry to the Rescue","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.473929Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:303d711e9beeddb778d9f2ee5d0fe9e7278e1b8992adadaf3f25e6eaa9aaf769","observation_id":"2ff1848a-16ab-46b0-8905-efc57ffa5f13","resolution":{"observed_at":"2026-08-16T10:35:23.473929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.477353Z","title":"R4dyn: Exploring radar for self-supervised monocular depth estima- tion of dynamic scenes","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.477353Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:de1bb5101a7eea7ba23d33b9224a80060240deefff3de950d025f813636d1067","observation_id":"206a3122-5a32-4eab-946c-0a0a2bdeef83","resolution":{"observed_at":"2026-08-16T10:35:23.477353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.480732Z","title":"Robust monocular depth estimation under challenging conditions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.480732Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:4e8d5587727127db14704c08ae6587071f58ac9707d941a8fbe93143f58f4d5c","observation_id":"0a70c986-f97a-4bcd-87e1-73353d66153b","resolution":{"observed_at":"2026-08-16T10:35:23.480732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.484250Z","title":"Vision meets robotics: The KITTI dataset","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.484250Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:cbb07a87105afcfc07416cef8480d58cd5222fba8c2fbd8d319e3cb06dc7f7ab","observation_id":"101f24fc-c6d9-4661-9688-00f37adb03ab","resolution":{"observed_at":"2026-08-16T10:35:23.484250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.488298Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.488298Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:15287f37a00e2262e2714d41ca6654a703aaefc29df24c62cb903552d8d06dab","observation_id":"4b18e114-07cb-4df7-80d3-21581a71de4e","resolution":{"observed_at":"2026-08-16T10:35:23.488298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.491948Z","title":"Digging Into Self-Supervised Monocular Depth Estimation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.491948Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:296051ecce1b235fb4e31975b6dffa7ef1afe8612fc09cba81e440d6ec84c879","observation_id":"1d2d33ad-78f7-4d5e-ab10-be48cb06806a","resolution":{"observed_at":"2026-08-16T10:35:23.491948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.495838Z","title":"PLADE-Net: Towards Pixel-Level Accuracy for Self-Supervised Single- View Depth Estimation with Neural Positional Encoding and Distilled Matting Loss","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.495838Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:e5c5d62914d20d9e1319c4eda2ec2cf229691eef5a5b59bc94c29e9df5bdf05b","observation_id":"57ca657a-0633-482b-9f80-31d55539ac1c","resolution":{"observed_at":"2026-08-16T10:35:23.495838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.499831Z","title":"Depth from videos in the wild: Unsupervised monocular depth learning from unknown cameras","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.499831Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:863d08b2dce30f172b4f135209193e9b7156202d739aa21aa2d7f633d7664266","observation_id":"953443da-519b-43bf-b889-409b99ee96bf","resolution":{"observed_at":"2026-08-16T10:35:23.499831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.503549Z","title":"3D packing for self- supervised monocular depth estimation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.503549Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:ea7e38467a46057b4c966c51f0839a4c4580faf8893e448e81c1cdcb22d0986b","observation_id":"706dee01-cdc3-457b-ab04-b9cb5cb02038","resolution":{"observed_at":"2026-08-16T10:35:23.503549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.506897Z","title":"Towards zero-shot scale-aware monoc- ular depth estimation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.506897Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:02993641f70663db04cab4c702e5f8a883d5e87f8b7289c8326d78c37e009334","observation_id":"958fb6f6-2079-4a5d-92c2-08d77dedcb17","resolution":{"observed_at":"2026-08-16T10:35:23.506897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18124","last_updated":"2025-01-18T20:14:54Z","snapshot_observed_at":"2026-08-16T13:15:00.975439Z","submitted_at":"2024-09-26T17:58:55Z","title":"Lotus: Diffusion-based Visual Foundation Model for High-quality Dense Prediction","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18124","snapshot_observed_at":"2026-08-16T10:35:23.510421Z","title":"Lotus: Diffusion-based visual foundation model for high-quality dense prediction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.510421Z"},"links":{"cited_paper":"/paper/2409.18124","citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:cfdbad843dfca59ca791e6c6bcb11caeb2bd18d886da50482b6f575a4bb18b99","observation_id":"546d5089-38df-4a4a-9964-2d8508b8266c","resolution":{"observed_at":"2026-08-16T10:35:23.510421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.514148Z","title":"Denoising diffu- sion probabilistic models, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.514148Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:de6fed955f797e25d12e3e344151adaffcfc51420de0981caab7aefc21314bd5","observation_id":"d1e52c16-53e5-4f19-8d54-a20d3a75767e","resolution":{"observed_at":"2026-08-16T10:35:23.514148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.517789Z","title":"Metric3d v2: A versatile monocular geometric foundation model for zero-shot metric depth and surface normal estimation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.517789Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:f9db3c2b99d3aa4ce089d810146f990a31e0eb6b0f668b0a2749e2a866e607e4","observation_id":"e04337c2-3be8-4f5d-9740-1fbc19b839f3","resolution":{"observed_at":"2026-08-16T10:35:23.517789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02095","last_updated":"2024-11-27T07:59:25Z","snapshot_observed_at":"2026-08-16T18:10:25.611057Z","submitted_at":"2024-09-03T17:52:03Z","title":"DepthCrafter: Generating Consistent Long Depth Sequences for Open-world Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02095","snapshot_observed_at":"2026-08-16T10:35:23.521098Z","title":"Depthcrafter: Generating consistent long depth sequences for open-world videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.521098Z"},"links":{"cited_paper":"/paper/2409.02095","citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:3742a3f1369c1b934b461256d5e417a2ff6fdadffb473e3d849aac2a48a5bd32","observation_id":"b3c5cfee-2254-4ee3-bff2-3d9a63b4c63a","resolution":{"observed_at":"2026-08-16T10:35:23.521098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.524870Z","title":"Densely connected convolutional net- works","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.524870Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:1030846532c382cd25f899ce085935bcc00fbf240ee3df6dee96c3872e634c28","observation_id":"6af11b9b-f6a7-49be-90cb-dc5731434a87","resolution":{"observed_at":"2026-08-16T10:35:23.524870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.528786Z","title":"The apolloscape open dataset for autonomous driving and its application","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.528786Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:8c1c1066d7c05c9a2377cf6ba93a689a199fcd6799fd30212db7cb7ae71e049e","observation_id":"b9da6459-fa9f-401c-8585-b9048039360c","resolution":{"observed_at":"2026-08-16T10:35:23.528786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.532262Z","title":"Lightweight monocular depth with a novel neural architecture search method","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.532262Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:afb1c638261db318ec23fe9b343b4ec7c7572de997c6aee52f1a8e7e4094ec18","observation_id":"23e2e659-9c04-4d99-ab66-cd61c886d267","resolution":{"observed_at":"2026-08-16T10:35:23.532262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.535748Z","title":"DDP: Diffusion model for dense visual prediction","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.535748Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:e6609b78c09eb3126d3f8b36823bc3cfd0ceb62d3462d4bac1708b01f575d806","observation_id":"ec103e15-fd06-43b6-942a-66d1b5e07888","resolution":{"observed_at":"2026-08-16T10:35:23.535748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.539345Z","title":"Self-Supervised Monocular Trained Depth Estimation Using Self-Attention and Discrete Disparity V olume","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.539345Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:30d2597f7def046d5303f7fbee940db5b7f90859bbf5e325ebba52fa8a85582e","observation_id":"ae990da1-0d01-4219-8540-8693dfeb7fc9","resolution":{"observed_at":"2026-08-16T10:35:23.539345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.542713Z","title":"Video depth without video models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.542713Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:d4cf62584a237de13b324bf31d352201ee4874f425759fde6b14d94b54bce636","observation_id":"2f080520-833a-42f9-9e07-06c250817a89","resolution":{"observed_at":"2026-08-16T10:35:23.542713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.546185Z","title":"Repurpos- ing diffusion-based image generators for monocular depth estimation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.546185Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:2bb22feb31584817e289a0f80c77d3bb7d65c0787a6b899432b7a01639663570","observation_id":"703eaba9-1693-44d4-801c-d808cb285ede","resolution":{"observed_at":"2026-08-16T10:35:23.546185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.550034Z","title":"Supervising the New with the Old: Learning SFM from SFM","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.550034Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:f103ccd6a0dfb7791d443c4608cfe0fcb26d3491b93e3adecc8800a0c8ee7450","observation_id":"d57f5965-3be7-4d5c-b24d-843174b9f1ee","resolution":{"observed_at":"2026-08-16T10:35:23.550034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.553687Z","title":"Evaluation of CNN-Based Single-Image Depth Estimation Methods","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.553687Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:ab2dad67525aa66a739117b8ef22f69171d0266bea3d2143985f006f6eae1e77","observation_id":"fef8987b-2a2b-405c-9f14-1524ecb968b5","resolution":{"observed_at":"2026-08-16T10:35:23.553687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.557411Z","title":"Deeper depth prediction with fully convolutional residual networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.557411Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:c496253f4e196e7612b722eef1839b2d5f203991be05bc7fdc89d309f3788543","observation_id":"d59ca31f-5fdb-4a7c-9a99-40713e3ae983","resolution":{"observed_at":"2026-08-16T10:35:23.557411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.560881Z","title":"Deep attention-based classification network for robust depth prediction","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.560881Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:10a951dbd13567feeaf285c92d7e059408bc76503d620e109580973c9b5253e0","observation_id":"21cb63ec-daec-48fb-a5a1-3cbd07437e72","resolution":{"observed_at":"2026-08-16T10:35:23.560881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.564552Z","title":"Mannequin- challenge: Learning the depths of moving people by watch- 10 ing frozen people","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.564552Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:1dbceccc15a452df63e34919d8c39bbe4e5cdd0a6f039d2fb04debe07abe23e6","observation_id":"80ea7f65-23ba-439d-a1c8-e460d4133280","resolution":{"observed_at":"2026-08-16T10:35:23.564552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.568083Z","title":"Megadepth: Learning single- view depth prediction from internet photos","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.568083Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:c36af0b8a004a4f12c0668b321577a59201dd6384f9d8f5f48875f23fe7415f1","observation_id":"9236048d-23a2-4437-9fbd-3d53f17a835d","resolution":{"observed_at":"2026-08-16T10:35:23.568083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.571458Z","title":"Deep con- volutional neural fields for depth estimation from a single image","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.571458Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:0bca940d66967ae778f5637aa2ac1d8d3b713ee9b71a780d83ac4a87934feb48","observation_id":"f4a7f405-4e18-467b-ae64-ad06d1656d0a","resolution":{"observed_at":"2026-08-16T10:35:23.571458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.574597Z","title":"Sm4depth: Seamless monoc- ular metric depth estimation across multiple cameras and scenes by one model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.574597Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:320dd40aba0594ff253765d4dd41c1ef5221965b1128b628cf51c8cb22e503f0","observation_id":"28283c71-e894-42aa-be89-1c5fe55fe3fd","resolution":{"observed_at":"2026-08-16T10:35:23.574597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.578029Z","title":"Swiftdepth: An efficient hybrid cnn-transformer model for self-supervised monocular depth estimation on mobile devices","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.578029Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:101274401febb6784cbd6e0fd832f60c85e62089bf11368eb333c6f6cd9e91bf","observation_id":"976a9247-12ac-4adb-9d08-6f73f404ba4b","resolution":{"observed_at":"2026-08-16T10:35:23.578029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14177","last_updated":"2024-08-26T10:50:14Z","snapshot_observed_at":"2026-08-16T13:23:51.722191Z","submitted_at":"2024-08-26T10:50:14Z","title":"NimbleD: Enhancing Self-supervised Monocular Depth Estimation with Pseudo-labels and Large-scale Video Pre-training","version":1},"cited_work":{"arxiv_id":"2408.14177","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.14177","snapshot_observed_at":"2026-08-16T10:35:24.014661Z","title":"NimbleD: Enhancing Self-supervised Monocular Depth Estimation with Pseudo-labels and Large-scale Video Pre-training","venue":"cs.CV","work_id":"e471303e-d45f-4b45-8747-615c7eb6acc2","year":2024},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.581268Z"},"links":{"cited_paper":"/paper/2408.14177","citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:020dd242824aba1713749c4567efcee985daac8def317174732df79b9246075c","observation_id":"55f77466-c165-48de-9f0f-5755ef960f72","resolution":{"observed_at":"2026-08-16T10:35:24.020822Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.585198Z","title":"Every pixel counts ++: Joint learning of geometry and motion with 3d holistic understanding","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.585198Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:7cc88d609ca1edff528edf42bb31f8f206887d8962c95a32c4ef98a080d706cc","observation_id":"0f654a77-29ce-4245-86d2-1c6a8cd1d704","resolution":{"observed_at":"2026-08-16T10:35:23.585198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.588568Z","title":"HR-Depth: High Resolution Self-Supervised Monocular Depth Estima- tion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.588568Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:dda61445927b16435a896ad4d16b370bae9520906dde6079dd79238f20038e8a","observation_id":"1306d380-35e4-458f-8881-8a3a316aa359","resolution":{"observed_at":"2026-08-16T10:35:23.588568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.592047Z","title":"Un- supervised Learning of Depth and Ego-Motion from Monoc- ular Video Using 3D Geometric Constraints","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.592047Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:d61e24200c14991b535def60198a73b155980b699a8dc84f659f18dfb1773860","observation_id":"cafcae42-6085-499b-b423-31410d0ee43c","resolution":{"observed_at":"2026-08-16T10:35:23.592047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.595325Z","title":"Fine-tuning image-conditional diffusion models is easier than you think","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.595325Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:e098f087468a4b3ca5b784fd18a790cfb07ae90d394645f1218da9e0e8beb987","observation_id":"6fac093f-c398-4910-9c4a-baff12c60c26","resolution":{"observed_at":"2026-08-16T10:35:23.595325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.598703Z","title":"Boosting monocular depth estimation models to high-resolution via content-adaptive multi-resolution merging","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.598703Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:26fe54f67ccef200a5af87539017ebdd0fc36e71600f5ebd793336c616a1001e","observation_id":"365c8493-6638-4b22-a29a-c64fd0fa1cdf","resolution":{"observed_at":"2026-08-16T10:35:23.598703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.602474Z","title":"Indoor segmentation and support inference from rgbd images","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.602474Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:8da3f1620637cf09164c315dede19af7fe1e04d253a5c181bc0eb68b22ab4217","observation_id":"09a990e3-3fd7-4b8b-8f59-4355b25726e5","resolution":{"observed_at":"2026-08-16T10:35:23.602474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-17T13:03:40.359628Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-16T10:35:23.605899Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.605899Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:48b3c30e944219f65ce833f144f16a972d288dc95aeae5e8d59a430d35431b52","observation_id":"b6571dea-b183-40db-9bfc-a000274d18ae","resolution":{"observed_at":"2026-08-16T10:35:23.605899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.609775Z","title":"From 2D to 3D: Re-thinking Benchmarking of Monocular Depth Prediction","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.609775Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:e5b17a182feb628a8abd04d21f63382911700509dd1068dd845a8ff470fe5864","observation_id":"1adb4238-0c37-487c-83bc-d5786bdea3ad","resolution":{"observed_at":"2026-08-16T10:35:23.609775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.613705Z","title":"Codalab competitions: An open source platform to organize scientific challenges","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.613705Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:6c86bb3261e4e5fb1f81f9d95542ee5da056281c935c0f3a2c8155054382bf36","observation_id":"f30596e7-2302-498b-931c-4317a7e7a082","resolution":{"observed_at":"2026-08-16T10:35:23.613705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.617875Z","title":"Monocular depth perception on microcontrollers for edge applications","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.617875Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:56f5e62dc4b70002dac743ff0585a54802a0a7312cd5f24f1ac5ea97b46e28cf","observation_id":"da9149d7-2f1d-4633-a45f-5a4a2ef987c7","resolution":{"observed_at":"2026-08-16T10:35:23.617875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.621590Z","title":"Enabling energy-efficient unsupervised monocular depth estimation on armv7-based platforms","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.621590Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:cedb41aee834e151f753fb56a49150089eb73eee135d87462a9ab9e63bd25a5f","observation_id":"996beac3-2e87-4d31-8691-7b586608fdff","resolution":{"observed_at":"2026-08-16T10:35:23.621590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:24.997753Z","title":"Excavating the potential capacity of self- supervised monocular depth estimation","venue":null,"work_id":"f03a704e-c154-4895-9975-37c517e93250","year":2021},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.625245Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:0412a60f909f6f9ebc48d6bd41e8909f2d5db7d234f3d9ed65e4c5da5ad6c48e","observation_id":"c9d451b8-5465-4001-9e18-4ee69f32333d","resolution":{"observed_at":"2026-08-16T10:35:25.004095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20110","last_updated":"2025-12-18T09:32:11Z","snapshot_observed_at":"2026-08-15T12:55:42.301021Z","submitted_at":"2025-02-27T14:03:15Z","title":"UniDepthV2: Universal Monocular Metric Depth Estimation Made Simpler","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20110","snapshot_observed_at":"2026-08-16T10:35:23.629006Z","title":"Unidepthv2: Universal monocular metric depth estimation made simpler","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.629006Z"},"links":{"cited_paper":"/paper/2502.20110","citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:6c12a96b23a6dcd6c3924c77a20678316b3706b703bbd2b73a3ba9c60be9b91e","observation_id":"a9e49475-1fc7-4e19-8011-ccbe0d29d5b0","resolution":{"observed_at":"2026-08-16T10:35:23.629006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:24.982790Z","title":"Unidepth: Universal monocular metric depth estimation","venue":null,"work_id":"4752651a-87cd-430a-ba1b-0d7459179817","year":2024},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.632964Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:a0b6c8b2862c546cbedbb53beb724ccee5c4e329ec669543311039ddae9e0a44","observation_id":"7479ce21-6d92-4e0c-b836-05abef5e74d1","resolution":{"observed_at":"2026-08-16T10:35:24.989018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:24.967399Z","title":"Su- perDepth: Self-Supervised, Super-Resolved Monocular Depth Estimation","venue":null,"work_id":"c2b029dd-34b3-4e3a-8e1f-0ea8a945f3a8","year":2019},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.636563Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:b6326dc2055ccd71b6d93d09492ff169db4c8f8eec84054f37a25f067753b22c","observation_id":"c2ddc3c7-3d08-4473-b3cc-ef09f4bde678","resolution":{"observed_at":"2026-08-16T10:35:24.973094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:24.953084Z","title":"Towards real-time unsupervised monocular depth es- timation on cpu","venue":null,"work_id":"07973058-30b7-4854-bf6f-e2c60ebb98db","year":2018},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.640406Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:a87c4dc794feca6a78e433336ea6d628efe7e38097daafeae745e0d08a6e90e7","observation_id":"a7dcebc7-4778-4e3b-a118-3a4f6cfbd5d9","resolution":{"observed_at":"2026-08-16T10:35:24.957357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:24.937715Z","title":"On the Uncertainty of Self-Supervised Monocular Depth Estimation","venue":null,"work_id":"6ce3f066-5302-4f06-abd2-ef65c1bb9d93","year":2020},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.644421Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:e68d76a38b0270f7cfc1cf025308d76552b66c0c1117815904a356df9859fff9","observation_id":"9f17d099-9cf1-45f4-909b-6293bb5c463d","resolution":{"observed_at":"2026-08-16T10:35:24.942189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:24.922716Z","title":"On the synergies between machine learning and binocular stereo for depth estimation from images: a survey","venue":null,"work_id":"344caea2-831f-4491-8dd8-ca3aa8868570","year":2021},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.648556Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:bfd3ad9fb47f1b30787f84e530d502a308b96cafe9ee877545897a05014b2f74","observation_id":"16068b08-3cdd-438f-9980-bae4f50d1bdf","resolution":{"observed_at":"2026-08-16T10:35:24.928167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:24.910298Z","title":"Learning Monocular Depth Estimation with Unsupervised Trinocular Assumptions","venue":null,"work_id":"9b1ba1d9-9fcf-41b8-b6d3-2eadc9d80d64","year":2018},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.652500Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:3641c5a83e1b1c26ae782ca56d8baca4f21c271c8d1381599f5a0ce8b235bbc3","observation_id":"2e64b0af-fd8b-4c0c-9b01-8a3dec494d72","resolution":{"observed_at":"2026-08-16T10:35:24.914096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:24.894287Z","title":"Booster: a benchmark for depth from images of specular and transparent surfaces","venue":null,"work_id":"6191df96-a300-4d70-8567-cb06dd81cbb1","year":2023},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.655976Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:04e314cdddd9717e307561bacc60719a41a840159d3b325b9307a0d5c0257d0d","observation_id":"a561d9e0-610a-486a-b90b-6d3da78d82fa","resolution":{"observed_at":"2026-08-16T10:35:24.899275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:24.876329Z","title":"Open chal- lenges in deep stereo: the booster dataset","venue":null,"work_id":"cc674e92-6e2b-4abb-acef-6e2456750b22","year":2022},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.659719Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:d150363f28a860b5f0cf321b69cd007de8a746758ef7dd507122166783b14079","observation_id":"6fb14381-5a1b-409d-934c-ae464ef774e7","resolution":{"observed_at":"2026-08-16T10:35:24.880937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:24.860687Z","title":"Vi- sion transformers for dense prediction","venue":null,"work_id":"bb7ad556-ddba-4c97-8fb9-e77e4e2406ae","year":2021},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.663351Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:30e66684dbc1cf85a624ed4714f80cc81e3ac99d3a7e5c3861cbb4a8c4b98b91","observation_id":"36d94958-9877-47c6-92a7-d2ecf6013ba3","resolution":{"observed_at":"2026-08-16T10:35:24.865687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:24.836547Z","title":"Towards robust monocu- lar depth estimation: Mixing datasets for zero-shot cross- dataset transfer","venue":null,"work_id":"b1d1c722-a93a-466e-9716-16577abbeef8","year":2020},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.666918Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:8807212874f30e69a66cfe918e37a8a7c72f26ae58099c2cb52393572e0a7bc2","observation_id":"d49d1fa0-aeec-4867-9f4a-6cbf5b3551ce","resolution":{"observed_at":"2026-08-16T10:35:24.849200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:24.814592Z","title":"Competitive collaboration: Joint unsupervised learning of depth, camera motion, optical flow and motion segmentation","venue":null,"work_id":"cea88659-1337-4fde-9f80-3aa7516be897","year":2019},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.670577Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:5129f7530199aa05c3e3287e02129d4a1b44b50d1708950bfdaa3ac516792adf","observation_id":"4a245c41-9e94-4d2d-ba88-10449f491999","resolution":{"observed_at":"2026-08-16T10:35:24.821905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:24.798288Z","title":"Hypersim: A photorealistic syn- thetic dataset for holistic indoor scene understanding","venue":null,"work_id":"d96ae28d-5c73-499e-8897-4ddc177daf7c","year":2021},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.674688Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:a45901c607c7004d777b22fdce96b3eaee146e91c80475bc74696bc9c36e56bd","observation_id":"51719ae8-59ad-472b-b21b-118d7c582d1b","resolution":{"observed_at":"2026-08-16T10:35:24.804257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:23.678188Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.678188Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:8a53c45f18a11ade7baf7f5d85b086663b04ad6ac70913a766a0a77be103acdd","observation_id":"ec6cb7e7-3943-479f-b70b-402b07d2570f","resolution":{"observed_at":"2026-08-16T10:35:23.678188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:24.774068Z","title":"Monocular depth esti- mation using neural regression forest","venue":null,"work_id":"85024563-3ef3-4f95-a699-4dcdbd713f28","year":2016},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.681820Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:97a402bc53af66d2c8b1aeeb0833bd03c01a48e0ef35a9958682d909180b663d","observation_id":"a524a705-cc5f-4902-be36-391e3e8c11a5","resolution":{"observed_at":"2026-08-16T10:35:24.778602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:24.759564Z","title":"Deep Virtual Stereo Odometry: Leveraging Deep Depth Pre- diction for Monocular Direct Sparse Odometry","venue":null,"work_id":"a87d7bc0-0213-4a28-990c-410aecf1164d","year":2018},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.685337Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:249cbfdb9cc520a5a110007073ecb55b3a1da2a260d69291412f38b706d2c184","observation_id":"90d27e17-aaf1-4931-8e4d-d9d333502137","resolution":{"observed_at":"2026-08-16T10:35:24.764781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01923","last_updated":"2023-12-06T04:19:29Z","snapshot_observed_at":"2026-08-16T15:26:59.595247Z","submitted_at":"2023-06-02T21:26:20Z","title":"The Surprising Effectiveness of Diffusion Models for Optical Flow and Monocular Depth Estimation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.01923","snapshot_observed_at":"2026-08-16T10:35:23.688685Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.688685Z"},"links":{"cited_paper":"/paper/2306.01923","citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:9af0c28c857e021567f4fa42e30ad9bdd6ff6259588630782e7673fad9d4e4f5","observation_id":"46a6cb29-5dfa-4f39-a5ce-bd8d2f869526","resolution":{"observed_at":"2026-08-16T10:35:23.688685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.14816","last_updated":"2023-02-28T18:08:21Z","snapshot_observed_at":"2026-08-16T15:51:59.080096Z","submitted_at":"2023-02-28T18:08:21Z","title":"Monocular Depth Estimation using Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.14816","snapshot_observed_at":"2026-08-16T10:35:23.692379Z","title":"Monocular depth estimation using diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.692379Z"},"links":{"cited_paper":"/paper/2302.14816","citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:cb7b0f80f559a07ba4b1c9f6d32e22efdc03423595743b2c0ed61c052078fec0","observation_id":"557c2d8d-dc93-495d-962f-f911bb896539","resolution":{"observed_at":"2026-08-16T10:35:23.692379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:24.744448Z","title":"Swiftformer: Efficient additive attention for transformer- based real-time mobile vision applications","venue":null,"work_id":"26392077-466c-40a9-9b57-fb907aed96a1","year":2023},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.696061Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:5505fabdf9f96f7e0130109381cdd64e3721590a2cb7434316ef307322a9c6c8","observation_id":"95f594d0-4914-40c8-a9c6-831b297bdc13","resolution":{"observed_at":"2026-08-16T10:35:24.748630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:24.727437Z","title":"Learning temporally consistent video depth from video diffusion priors","venue":null,"work_id":"8edd411e-f72d-4dfe-92ac-31d5586cac92","year":2025},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.700062Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:185c29015b0863c70368db47fdf521c31b8a43d91ad7e70e9d1f0402311440da","observation_id":"3e1be777-134e-4778-aa7c-f28c3ab04bb8","resolution":{"observed_at":"2026-08-16T10:35:24.733194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-16T10:35:23.703686Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.703686Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:036b0071444f320e1e8a42740adaa0f2f6d7223bab1ecd17f5423ac46987070b","observation_id":"256e6756-84af-4895-9967-2e6fa7d947b9","resolution":{"observed_at":"2026-08-16T10:35:23.703686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:24.709109Z","title":"DeFeat-Net: General monocular depth via simultaneous unsupervised representation learning","venue":null,"work_id":"b9150c12-c21e-4934-8ba3-a47283065f32","year":2020},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.708025Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:1d74b4c7788b77ca73b819f5f96388d4faa6fac4985995f4b720df9479929d92","observation_id":"2b0a770c-3fa3-4d2b-a7c3-a109c0249169","resolution":{"observed_at":"2026-08-16T10:35:24.715205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:24.692772Z","title":"The monoc- ular depth estimation challenge","venue":null,"work_id":"385f9286-60ae-4f68-a272-3e6d81ec4e00","year":2023},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.711751Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:976a6490a5f85b6949d51fd3948b00b87515b7fd785e5be5adb771b981cd5029","observation_id":"0bc43264-4f92-4a73-aeee-99a8bc1fe446","resolution":{"observed_at":"2026-08-16T10:35:24.697331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:24.670308Z","title":"The second monocular depth estimation challenge","venue":null,"work_id":"f762984e-279c-428e-a6cf-08fe96ac125a","year":2023},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.715499Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:31ee42c84698cd3b1dfa38a6228b85ca6b88d770bcf22602f39decc1c1652dd7","observation_id":"de930263-bdc5-4885-9515-43cf3f355746","resolution":{"observed_at":"2026-08-16T10:35:24.676291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:24.655650Z","title":"Deconstructing self-supervised monocular recon- struction: The design decisions that matter","venue":null,"work_id":"8da6f433-df8d-4bf4-b5c4-57c5aa0612fc","year":2022},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.719029Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:7bdfe76885a69e0819621ec62917ed6ed2bcf52c1857c64d20b91e7ca118cc7a","observation_id":"0acf9325-fe5d-497c-b459-ddf967426344","resolution":{"observed_at":"2026-08-16T10:35:24.659840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:24.641538Z","title":"Kick back & relax: Learning to reconstruct the world by watching slowtv","venue":null,"work_id":"b8977bf4-fdc1-4f3c-b0a2-39b21222caf7","year":2023},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.722639Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:d9d9375cf2fa369b0faac2469979c9ffb6b84a3de12ab338014779880656c8e7","observation_id":"75ae5ac5-f663-4aec-9adc-bb42c5c2b8b4","resolution":{"observed_at":"2026-08-16T10:35:24.646951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01569","last_updated":"2024-03-03T17:29:03Z","snapshot_observed_at":"2026-08-17T11:30:03.358659Z","submitted_at":"2024-03-03T17:29:03Z","title":"Kick Back & Relax++: Scaling Beyond Ground-Truth Depth with SlowTV & CribsTV","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01569","snapshot_observed_at":"2026-08-16T10:35:23.726288Z","title":"Kick back & relax++: Scaling beyond ground- truth depth with slowtv & cribstv","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.726288Z"},"links":{"cited_paper":"/paper/2403.01569","citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:8b4b0d58deb3d9aab7162cf5bf8f9e955c85be49c62032aaa9c4944a3eca4605","observation_id":"f82bd0c7-c1d1-4e3f-b7e8-fe0c6cf4fcbb","resolution":{"observed_at":"2026-08-16T10:35:23.726288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:24.626971Z","title":null,"venue":null,"work_id":"d53debb6-868f-403e-be10-9d4d2b75e19f","year":2024},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.730135Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:58a06a81c7acddaead0eb997c349b6db912b084320c36827b66d447230e86823","observation_id":"ed9cdcb4-696d-4dfc-bb22-82ef7a4419cc","resolution":{"observed_at":"2026-08-16T10:35:24.632555Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:35:24.611113Z","title":"Sturm, N","venue":null,"work_id":"b0559a77-f8c4-46c1-a3a7-cfb875c65a81","year":2012},"citing_paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-16T10:35:23.733936Z"},"links":{"citing_paper":"/paper/2504.17787"},"observation_digest":"sha256:c3ce4e726336c95cd9b1a4985066a7207c5993b3c94ae22851bb76bdda603d40","observation_id":"e055eaa4-742f-40b8-9a72-5bd5773d8c53","resolution":{"observed_at":"2026-08-16T10:35:24.616073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.17787","last_updated":"2025-04-24T17:59:52Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T18:55:52.240064Z","submitted_at":"2025-04-24T17:59:52Z","title":"The Fourth Monocular Depth Estimation Challenge"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":76,"verified_exact":1,"verified_fuzzy":23},"total_outbound_references":140},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 100 of 140 outbound references and 1 inbound Pith citation observation for arXiv:2504.17787."}