{"as_of":"2026-08-15T17:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4c455bc46730f38753f47d5a8aa5c1d91b7778d8a635899f9f95167769a5d3e9","coverage":[{"denominator":93,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":93,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T12:14:37.473052Z","state":"measured"},{"denominator":93,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":93,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.17385/citation-record","integrity":"/paper/2411.17385/integrity","json":"/paper/2411.17385/citation-record.json","paper":"/paper/2411.17385"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.026925Z","title":"Monocular depth es- timation using cues inspired by biological vision systems","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.026925Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:37478e569f5a4f636a955d48e26cf2eeb253b9866b94c689e90e65f517371c8b","observation_id":"e05f48c6-47ed-4620-bb4e-73afd925ad5b","resolution":{"observed_at":"2026-08-12T12:14:37.026925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.15551","last_updated":"2024-03-22T18:05:33Z","snapshot_observed_at":"2026-08-15T11:08:15.235048Z","submitted_at":"2024-03-22T18:05:33Z","title":"Language-Based Depth Hints for Monocular Depth Estimation","version":1},"cited_work":{"arxiv_id":"2403.15551","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.15551","snapshot_observed_at":"2026-08-12T12:14:37.653505Z","title":"Language-Based Depth Hints for Monocular Depth Estimation","venue":"cs.CV","work_id":"9368e44a-7c91-4c79-a407-c3220010a883","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.032874Z"},"links":{"cited_paper":"/paper/2403.15551","citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:d1552475550e1d4e511c2d17fe76cd6641dbd984d05b8414b6c2df74e60c4b95","observation_id":"d8ee6f5c-7b41-4dcc-8ae8-952c4cf6f1cf","resolution":{"observed_at":"2026-08-12T12:14:37.658789Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.038529Z","title":"Enhancing 2d represen- tation learning with a 3d prior","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.038529Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:c6febff35808385be6395cd4e28ffa1f5624aa6826e60ab27eeee3cbf816e177","observation_id":"44b537a1-f758-4e3f-a74c-92f78f8a7f16","resolution":{"observed_at":"2026-08-12T12:14:37.038529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11748","last_updated":"2025-04-25T15:56:39Z","snapshot_observed_at":"2026-08-15T00:10:09.950936Z","submitted_at":"2024-08-21T16:16:18Z","title":"Understanding Depth and Height Perception in Large Visual-Language Models","version":5},"cited_work":{"arxiv_id":"2408.11748","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.11748","snapshot_observed_at":"2026-08-12T12:14:37.627394Z","title":"Understanding Depth and Height Perception in Large Visual-Language Models","venue":"cs.CV","work_id":"e101cd6e-3b8f-4f28-9e66-205f59069635","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.043868Z"},"links":{"cited_paper":"/paper/2408.11748","citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:bb22016ad3d49e231408c98c5df42c274398af0f6a51441b4b9270d274686703","observation_id":"bea1c90b-7d57-4d7a-bb72-ecfcdea5cee2","resolution":{"observed_at":"2026-08-12T12:14:37.635621Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.049496Z","title":"Revisiting feature prediction for learning visual rep- resentations from video","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.049496Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:243f5629d5b67b1b1e32ff103292fab07184af00e3007a9888408636e52104ab","observation_id":"70c5b2c6-9680-4c6f-8771-9866c0313d82","resolution":{"observed_at":"2026-08-12T12:14:37.049496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.055216Z","title":"Adabins: Depth estimation using adaptive bins","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.055216Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:01367cba44d6852b0ece8ba79a7c197f7d51703a1a8b93ed802df7d756c65300","observation_id":"0853f4e1-92db-4d54-8842-3b33020c8a76","resolution":{"observed_at":"2026-08-12T12:14:37.055216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.060798Z","title":"Depth perception of surgeons in minimally invasive surgery.Surgi- cal innovation, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.060798Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:ba07394698f933598fcff1c1a1941e9bc58dad3074219b47dfacb1e39e3fa309","observation_id":"4f9dd450-3f12-4512-a25d-b8089ec835e4","resolution":{"observed_at":"2026-08-12T12:14:37.060798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.066172Z","title":"Tenenbaum, and Alexei A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.066172Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:19b20966aeb1b2b36360e04b0c32d74b9797b567c8a0abfc65c28172a588233a","observation_id":"e223606a-2db7-4e2f-b24b-e3c8c7e6c5fd","resolution":{"observed_at":"2026-08-12T12:14:37.066172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.071439Z","title":"Intelligent image and video com- pression: communicating pictures","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.071439Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:15d2721f0177fecbdb02fafef78730dc840bd48758af25f9b2cd0f34c2ad9c0a","observation_id":"8f4777cd-7901-4073-8cba-025f28889dd4","resolution":{"observed_at":"2026-08-12T12:14:37.071439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.076943Z","title":"Mvsformer++: Revealing the devil in transformer’s details for multi-view stereo","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.076943Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:0533c28e55979f7608634c6592f63715028c2efb149b4f53acca06eb4fbe6f9b","observation_id":"b3886ff7-c75b-4a8d-8d1b-a840e9f938db","resolution":{"observed_at":"2026-08-12T12:14:37.076943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.081675Z","title":"Emerg- ing properties in self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.081675Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:c425b8ea402e922c3a2aef266830dfc0c8c8e80dd233468dd503f94dd3ac256f","observation_id":"135847b3-415b-46e9-bd3d-205cbddab256","resolution":{"observed_at":"2026-08-12T12:14:37.081675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.087059Z","title":"Single- image depth perception in the wild","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.087059Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:b83d003874dc6979508db8cec91fdeb083fb16b465d9e03bd93bfd1d1a8fbf21","observation_id":"1168e1b1-9bd2-4752-94e7-fc49f0c3d54f","resolution":{"observed_at":"2026-08-12T12:14:37.087059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.091958Z","title":"Cimpoi, S","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.091958Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:054d7d49dc9fe93d816746d549fdb2bf73072b81dc3ea844314faf2d91c23a47","observation_id":"f68445e6-8415-42e0-a14f-bc1f78cab160","resolution":{"observed_at":"2026-08-12T12:14:37.091958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.097133Z","title":"Objaverse-xl: A universe of 10m+ 3d objects","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.097133Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:25203385da34bd3509fef8eb6115b8815ecace6f8eeb3c042f527476e0670fbf","observation_id":"d463da72-d186-40f4-a424-ec18d624cf7a","resolution":{"observed_at":"2026-08-12T12:14:37.097133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.101749Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.101749Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:05ff1106bfee6e77134efdcdd9ad154719563e31a8ea5af1e78f0c0bb8fc278d","observation_id":"1556a904-3f65-4664-bef8-fb70d8efd5ec","resolution":{"observed_at":"2026-08-12T12:14:37.101749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.670542Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"b4bd4321-09ab-4fae-86f1-7a5add15bbe0","year":2021},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.106679Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:317148eef6c02756269519e7836b00014c11ef3e0c787be94ca71769ce0790d9","observation_id":"594db69e-a0ea-49ce-86a1-5630da918c08","resolution":{"observed_at":"2026-08-12T12:14:38.675883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.655403Z","title":"Depth map prediction from a single image using a multi-scale deep net- work","venue":null,"work_id":"ceee6496-a955-4107-96b5-92b9d51b923c","year":2014},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.111362Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:44ec5aeb2f0e1f759304bcf98d5d1ed8f9d2f733d25e461fccfafedb248cfe65","observation_id":"558dbafb-1fcc-4ac0-b60a-602d8f563d99","resolution":{"observed_at":"2026-08-12T12:14:38.660233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.115974Z","title":"Prob- ing the 3d awareness of visual foundation models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.115974Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:fbe75f25a675c604765fcdc3832cfda00ff042e31f2077b2fe01446bd21ad520","observation_id":"8c27ecc4-5943-4973-8600-b35bc69da5d7","resolution":{"observed_at":"2026-08-12T12:14:37.115974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.616826Z","title":"Scalable pre- training of large autoregressive image models","venue":null,"work_id":"dc8cb5dc-caaa-454a-aa62-5d7a7ff8653f","year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.125401Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:7454fb5e21ea2712521646a9633487a62ef8b3a429ac89615d9b25d534506691","observation_id":"3aa027f6-d91f-4170-834f-122043e487a8","resolution":{"observed_at":"2026-08-12T12:14:38.621358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.130577Z","title":"Deep ordinal regression net- work for monocular depth estimation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.130577Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:6ff33904926f9e6085aa1723300f6ca61cee75b0aa3611a97f3bc7830950ec3f","observation_id":"50c2652c-b0bc-4a06-87b0-7a55a8d9be01","resolution":{"observed_at":"2026-08-12T12:14:37.130577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.591782Z","title":"Dream- sim: Learning new dimensions of human visual similarity using synthetic data","venue":null,"work_id":"f8c4842c-587b-449c-88e2-dade850d25ff","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.135650Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:24114c2c85c1cc8651ff38977185f7509d5ffd85a84dc5ffe2b121cd5905998e","observation_id":"2f2687c2-3df2-4494-83dc-07bf887a0b1b","resolution":{"observed_at":"2026-08-12T12:14:38.596495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.577747Z","title":"Unsupervised cnn for single view depth estimation: Geome- try to the rescue","venue":null,"work_id":"d05b7c62-40ca-4c32-86af-3c50534f0b4f","year":2016},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.140120Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:2fcd599eba6381439919e52467d4febfdb4ffa409f0018ede6bb2d8412677067","observation_id":"b53b2fed-4526-45e8-ae51-0c7503626cf9","resolution":{"observed_at":"2026-08-12T12:14:38.582498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12671","last_updated":"2024-06-21T02:45:10Z","snapshot_observed_at":"2026-08-12T23:40:01.265126Z","submitted_at":"2024-06-18T14:44:12Z","title":"GeoBench: Benchmarking and Analyzing Monocular Geometry Estimation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12671","snapshot_observed_at":"2026-08-12T12:14:37.144770Z","title":"Geobench: Benchmarking and analyzing monocular geome- try estimation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.144770Z"},"links":{"cited_paper":"/paper/2406.12671","citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:492e4c18c5464ac7fda7de1f4165b78fbbce77d20e5d6262a577cca3e13b8b0a","observation_id":"4818f94e-4cd5-41a8-be39-a1f00ec3c50f","resolution":{"observed_at":"2026-08-12T12:14:37.144770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.563114Z","title":"Are we ready for autonomous driving? the kitti vision benchmark suite","venue":null,"work_id":"e0083e21-9a9a-40aa-bd28-87e3bfbfbaff","year":2012},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.149614Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:96a3724876c17b00ce0f5e69b2c9db9b3e37b90d3d641c0322722b46c3a6b197","observation_id":"d11c7fe8-96e9-4c9b-8071-ae874bc7cb56","resolution":{"observed_at":"2026-08-12T12:14:38.568204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.548153Z","title":"Wichmann, and Wieland Brendel","venue":null,"work_id":"7bf6e7ae-13ca-4553-b112-9d69640ae524","year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.154774Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:5368ed213329240537c7da875fbcccff5845d2ce4d7962b152e7364fb32ed7b5","observation_id":"30f4e189-3643-426f-8fd6-22106b45b0b5","resolution":{"observed_at":"2026-08-12T12:14:38.552776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.533876Z","title":"Unsupervised monocular depth estimation with left- right consistency","venue":null,"work_id":"10b7b0d9-1a5b-4a66-b41e-1753a63710a6","year":2017},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.159745Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:60fc708529c1a57dfaa9a368b234349779bf349f9558e3d0bf722751db8f5aa0","observation_id":"b5159a78-8b68-4c90-a6b6-01e97c7535c6","resolution":{"observed_at":"2026-08-12T12:14:38.538616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.165317Z","title":"Digging into self-supervised monocular depth estimation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.165317Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:5e1b531d555525b6654fc26230cec9c1186fd7df89d49f4eee70d34f91e68ead","observation_id":"8238833d-b12b-4644-a9ec-3e6f6f29b644","resolution":{"observed_at":"2026-08-12T12:14:37.165317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.510290Z","title":"Depth from videos in the wild: Unsupervised monocular depth learning from unknown cameras","venue":null,"work_id":"7694785a-03dd-4daf-96de-72b92d1b3042","year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.170683Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:041fe82768087026efbdb9fc46b7ae1f545909c4dc7de0d1e911abc188b3c913","observation_id":"bc14b216-6d40-4f75-9268-14112640d3bd","resolution":{"observed_at":"2026-08-12T12:14:38.515096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13788","last_updated":"2024-12-19T17:51:42Z","snapshot_observed_at":"2026-08-14T11:27:40.014871Z","submitted_at":"2024-03-20T17:51:53Z","title":"DepthFM: Fast Monocular Depth Estimation with Flow Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13788","snapshot_observed_at":"2026-08-12T12:14:37.176099Z","title":"Depthfm: Fast monocular depth estimation with flow match- ing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.176099Z"},"links":{"cited_paper":"/paper/2403.13788","citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:62b17aa791a6c3c7797b68da183ee6b6ac0c76b6a2ae98ec1d11b2824abb9d17","observation_id":"8b75096f-af4a-4ce3-b314-56dc0ad8c5cc","resolution":{"observed_at":"2026-08-12T12:14:37.176099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.180769Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.180769Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:c945b5fdb6ca19385cb7bcbd172fdd530594148c2dc8e3026f5bf4339cb84e78","observation_id":"3b2e73b8-b082-4b4a-a795-11522911603d","resolution":{"observed_at":"2026-08-12T12:14:37.180769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.484973Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"3d1adc83-4fa8-4af2-828e-36b9c980881a","year":2022},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.185416Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:598ebf1bf840533a21c05a6a926edd41f370f6b6542aa29961d0b457903e4cad","observation_id":"45a7cb5f-7999-43fe-be4d-97cc2c615781","resolution":{"observed_at":"2026-08-12T12:14:38.490337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.189803Z","title":"The organization of behavior: A neu- ropsychological theory","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.189803Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:cbdb9651c46006b51708dbfd89a5fc9a74b3dcd7040cb2c75661d276648c9ae9","observation_id":"e721aac8-8bdc-415e-a3be-2a8f88a4191b","resolution":{"observed_at":"2026-08-12T12:14:37.189803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-08-13T19:48:28.322536Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-12T12:14:37.194121Z","title":"Gaussian error linear units (gelus)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.194121Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:fd5a74f1b8ebeaf2da4795109fa6da1e8704a32c570de98a5a0f5fbb65958a12","observation_id":"453dea97-b72d-4a64-8b94-f943dfd7060e","resolution":{"observed_at":"2026-08-12T12:14:37.194121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.461998Z","title":"Lrm: Large reconstruction model for single image to 3d","venue":null,"work_id":"4a89d243-90d3-4a2d-ad08-d95c3611d554","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.199669Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:f155f4057d443c1d6957bd3793a3dfcad958c869d0b5ea420d909ab84486774c","observation_id":"5b843ee7-da6b-4d8a-9254-3bdcf72c28ac","resolution":{"observed_at":"2026-08-12T12:14:38.466813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.448625Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":"482e79b9-279a-4079-8268-2ec68adb9860","year":2022},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.203955Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:eb8f2d30091f92949a746071c49012ef6c19d707fd680151def233c967ae35c6","observation_id":"52f1548f-39bf-4415-ad1a-3dfe1ad69f3c","resolution":{"observed_at":"2026-08-12T12:14:38.452848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.435224Z","title":"Squeeze-and-excitation net- works","venue":null,"work_id":"12b72956-c405-483a-968c-da3ed8707d30","year":2018},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.208264Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:f1cd4df43a710718a1216f79e8b31cadb6b501dc71071dfe96461228412cb436","observation_id":"e0de06bf-ad51-4b5f-a4dc-8afedce4726d","resolution":{"observed_at":"2026-08-12T12:14:38.439793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.419950Z","title":"Monodtr: Monocular 3d object detection with depth-aware transformer","venue":null,"work_id":"005956ca-f883-4962-b409-a0bbcc74e500","year":2022},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.212514Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:a5d83371b15daa26f81f04a3a64cd0873a2b56f1f1f4cfcb25c887a5698033e9","observation_id":"e241a5c7-42a7-4420-b70e-1a9f43bc5185","resolution":{"observed_at":"2026-08-12T12:14:38.424875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.405484Z","title":"Receptive fields and functional architecture of monkey striate cortex.The Journal of Physiology, 1968","venue":null,"work_id":"99b99764-4fa4-49dd-a44a-a0c2944a21bd","year":1968},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.216824Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:fef9483c11179b0ddd7a0ff2760641191b886fecdf9f6101cd241918105b7799","observation_id":"e7263066-896c-4d43-98b8-9b77e62500a6","resolution":{"observed_at":"2026-08-12T12:14:38.410285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.391304Z","title":"Brostow, and Jamie Watson","venue":null,"work_id":"26b2de35-e8b4-45a4-82c6-175df38a9eeb","year":2025},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.221199Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:741d73f6af2f918238ce5f302f4dff224136522ca2a739765611942a111581bb","observation_id":"897813cf-f8f4-48b8-938a-fa66d43a67b3","resolution":{"observed_at":"2026-08-12T12:14:38.395917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.375907Z","title":"The perception of depth","venue":null,"work_id":"ab62673b-b287-4891-b3b9-af746b57ab66","year":2011},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.226169Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:a0d6d0569ffff911544d902b5d47d03d552a75e0b62b6235afabe862d1ac02a8","observation_id":"84a7c5f1-91fa-4010-88be-41693e046e7e","resolution":{"observed_at":"2026-08-12T12:14:38.381046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.362078Z","title":"Repurpos- ing diffusion-based image generators for monocular depth estimation","venue":null,"work_id":"c22a652b-c9ae-4b17-9f3b-5132a9e0cd55","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.230589Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:8a44f97af4d9770a1cc77013a327dcc057b3ba1441379f2d04e6a4acfcca6bf5","observation_id":"a1707475-a7c5-4fff-ade4-eb655a015eaf","resolution":{"observed_at":"2026-08-12T12:14:38.366510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.348474Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":"51ee99a3-cb3a-4e52-92ba-8c7a50b79db4","year":2015},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.235931Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:4a61d4f1ddb926055ed2c64627e0dad3f51146b2d4fddee563052af08fc4cf9d","observation_id":"14642ff0-b590-4ac2-91a1-87e35ddcc8fb","resolution":{"observed_at":"2026-08-12T12:14:38.352933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.334670Z","title":"Segment any- thing","venue":null,"work_id":"8308d376-6e83-4ce8-8691-ed7d5b420d4d","year":2023},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.240430Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:d6e037b6ac7ca500125a165bafeec46d1081d89d95af4f9dbbb26619567f30a3","observation_id":"14c27e97-cfe2-490f-a794-695cd8f40931","resolution":{"observed_at":"2026-08-12T12:14:38.339112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.321432Z","title":"Temporally consistent horizon lines","venue":null,"work_id":"02e4d505-1387-4b13-a904-d4bdcca4e8f9","year":2020},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.244662Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:1cb02bc1cb2dfe32b2b000a71310bebec1206db950b7b96045e69c178023f44f","observation_id":"d16fa6f6-db1e-4b87-8fe9-9c29b8c07df8","resolution":{"observed_at":"2026-08-12T12:14:38.325842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.307276Z","title":"On the viability of monocular depth pre-training for semantic segmentation","venue":null,"work_id":"5c31665b-53b6-435e-b1dd-4358acd3a579","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.249493Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:03cb5ea5f43e72558551bb0493b8fb7c3adaf9c65bbbffc6585f20149ca26b49","observation_id":"76935e37-5113-4f7c-8856-440651efb0ba","resolution":{"observed_at":"2026-08-12T12:14:38.312220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.294196Z","title":"Perceptual depth indicator for s-3d con- tent based on binocular and monocular cues","venue":null,"work_id":"282e04fe-274f-4e84-8287-776b726eaa0b","year":2012},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.254812Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:03a9a40ebf39b57c15070753a544e67ba55fbfb63346f15ba9f368c41c80a871","observation_id":"1f4c526b-45d1-4133-8a0c-4d5732345662","resolution":{"observed_at":"2026-08-12T12:14:38.298724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.280651Z","title":"Multi-task learning with 3d-aware regulariza- tion","venue":null,"work_id":"59f73602-cd39-4834-b255-6e864d9817e9","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.259718Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:9de36521b5346c006dd151f2b4d3857ec4f53c44d4579daa23ed33598da154cd","observation_id":"7208957d-52f5-4415-aaba-4aba7661f24a","resolution":{"observed_at":"2026-08-12T12:14:38.285014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.266577Z","title":"Movideo: Motion-aware video generation with diffusion models","venue":null,"work_id":"ea2c0c75-1bd1-410b-a362-64786d233680","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.264051Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:62ed20fb81c1b0adf9b77ee003306a44ccdea721933cace857854e01ad89282c","observation_id":"a87ec203-7d68-4ccc-8e33-d50046ccb163","resolution":{"observed_at":"2026-08-12T12:14:38.271466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04138","last_updated":"2025-02-28T14:49:44Z","snapshot_observed_at":"2026-08-13T13:53:08.314191Z","submitted_at":"2024-06-06T14:59:39Z","title":"The 3D-PC: a benchmark for visual perspective taking in humans and machines","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04138","snapshot_observed_at":"2026-08-12T12:14:37.268443Z","title":"The 3d-pc: a benchmark for visual per- spective taking in humans and machines","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.268443Z"},"links":{"cited_paper":"/paper/2406.04138","citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:b68c5fe6e099552a29504ef9c7f50c3eae1917be5fe96ff38c0236e873cb277b","observation_id":"8ca620d4-e994-404c-bce2-28dbba1cc9f5","resolution":{"observed_at":"2026-08-12T12:14:37.268443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.252847Z","title":"Vapid: A rapid vanishing point detector via learned optimizers","venue":null,"work_id":"45e33abe-cf63-4c9c-a264-a6118181175b","year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.273235Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:dc40a3352b6105624cbfc8003395241f950c4ec64d2f78a72591a4dc006f7fdc","observation_id":"85d06987-565d-4e83-98da-6be66bf5cdfe","resolution":{"observed_at":"2026-08-12T12:14:38.257606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.238579Z","title":"A convnet for the 2020s","venue":null,"work_id":"b4228194-89c1-4e52-b3c9-02e1313c7fc4","year":2022},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.277756Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:fecfc7a14c903b428b1858f601adae8566014cf721f3b304baca0069ea54a95e","observation_id":"22046a66-5083-4f13-af85-30ca8679b123","resolution":{"observed_at":"2026-08-12T12:14:38.243794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.224333Z","title":"Ima- genet3d: Towards general-purpose object-level 3d under- standing","venue":null,"work_id":"5a615cc0-2997-4cb5-ae17-5a91473e9d4a","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.282120Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:614876cfdb50f0e97ab9506f84e30de991ba32a8697370b10d5152d0e7f5714f","observation_id":"83a3804a-720f-4993-bba2-6459c66312ef","resolution":{"observed_at":"2026-08-12T12:14:38.229103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.209689Z","title":"Lexicon3d: Probing visual foundation models for complex 3d scene understand- ing","venue":null,"work_id":"293cd18b-307e-4efa-a7c0-de53c0ff680e","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.286712Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:eba60ae3532e5d39bcc1ce7531ea8fe0d3585fbe6878a0c8cc4c2679c86c35b3","observation_id":"cb11e874-bc37-4d60-b8fc-4e0bb5923420","resolution":{"observed_at":"2026-08-12T12:14:38.214308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.194814Z","title":"Im- proving semantic correspondence with viewpoint-guided spherical maps","venue":null,"work_id":"8b21e58c-aacc-4525-8c5a-c740695c5cce","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.291301Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:5ff07e9081eb6ccf287c4bfccc31ec818c6b0a19a467f25f5a36db0971e4c883","observation_id":"f178694a-b51a-4677-a141-a659ef013ee9","resolution":{"observed_at":"2026-08-12T12:14:38.199954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.180450Z","title":"Indoor segmentation and support inference from rgbd images","venue":null,"work_id":"af699e0c-e413-4278-8fbd-6aa84936cd0a","year":2012},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.295764Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:20b0bd01dc14f6bab35d2824a9665b13fdfb85ddb3daabc346b5df1a63118805","observation_id":"848c6ed3-91c3-4025-a4b8-73b44d8b6e70","resolution":{"observed_at":"2026-08-12T12:14:38.185084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11300","last_updated":"2023-09-07T21:18:15Z","snapshot_observed_at":"2026-08-13T10:29:52.575350Z","submitted_at":"2023-08-22T09:29:05Z","title":"Approaching human 3D shape perception with neurally mappable models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.11300","snapshot_observed_at":"2026-08-12T12:14:37.300096Z","title":"Approaching human 3d shape perception with neurally mappable models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.300096Z"},"links":{"cited_paper":"/paper/2308.11300","citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:8c1afc33be23e13ab500a3616a262e662aa41be4d2d30589e487146280e54f41","observation_id":"bd317d2a-ac7f-4d93-88b0-e6fede04873f","resolution":{"observed_at":"2026-08-12T12:14:37.300096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.166069Z","title":null,"venue":null,"work_id":"01e81291-1421-4c91-974d-f70ddabda09b","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.304579Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:1e447ac6f82541b84f1f8700f5ab117b0fd3040cba622aa961a312d6c81fc8ba","observation_id":"8da013da-92e2-48d3-95c6-8abed814c080","resolution":{"observed_at":"2026-08-12T12:14:38.170598Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.150562Z","title":"The hippocampus as a cognitive map, 1978","venue":null,"work_id":"748f5a8e-5b87-461a-92e2-aff18c8c0393","year":1978},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.309688Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:901f77163e19813f5d970d189d19c83686af037e158ff61c510d903a48a4e40c","observation_id":"dc3b1ca4-ddcc-4699-ad7f-79ef79af8526","resolution":{"observed_at":"2026-08-12T12:14:38.156194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.136449Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"4f08e676-84b8-4785-8135-d347952f8219","year":2021},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.314372Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:e738550d5ef3dfb2544f44c8c9df6cffca41455d070e076bcd34ab4eb0676f65","observation_id":"f93acfe4-f329-4330-a509-16aeec0ab8b2","resolution":{"observed_at":"2026-08-12T12:14:38.141130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.121077Z","title":"Large-scale, high-resolution comparison of the core visual object recogni- tion behavior of humans, monkeys, and state-of-the-art deep artificial neural networks","venue":null,"work_id":"783f52b8-5fdb-4805-820f-91f0f409af60","year":2018},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.318994Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:6d2038cade90b544c198fb9d8edf410370365ac2674f4f85376c4602efc20d33","observation_id":"56345b51-f593-4862-a5cb-43de0b875ad0","resolution":{"observed_at":"2026-08-12T12:14:38.126668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.106179Z","title":"Towards robust monocular depth estimation: Mixing datasets for zero-shot cross-dataset transfer","venue":null,"work_id":"2f2ea2d9-7000-40b6-bf6d-643c1ba5cef7","year":2020},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.324148Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:b6964aa02e82449a4f22a815471ed41e49de571935df18f9e8929d6f50930b9e","observation_id":"58f01b6d-5d36-4e97-b356-3dfe05b1eb7f","resolution":{"observed_at":"2026-08-12T12:14:38.110855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.092430Z","title":"Vi- sion transformers for dense prediction","venue":null,"work_id":"7ec996af-7a73-46a4-977b-e9e5871d709b","year":2021},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.329589Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:9b95f469abbd8b7d7179dcd6a6538a6c7d9a565894f274bbc6bd06ebbbccbf06","observation_id":"d0727c5b-18b4-46f5-8ddb-3b02fe9bfb4f","resolution":{"observed_at":"2026-08-12T12:14:38.097037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.077984Z","title":"High-resolution image syn- 10 thesis with latent diffusion models","venue":null,"work_id":"cd44bd46-9cc4-47d3-974c-026d68a76dec","year":2022},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.334824Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:c781dcffe1d3e3476723b76b601c52d71d0d5846818c52a6ffef0965a11c5714","observation_id":"642d484a-e3a6-422e-b56d-f9d93ff3ae90","resolution":{"observed_at":"2026-08-12T12:14:38.082992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.062895Z","title":"Laion-5b: An open large-scale dataset for training next generation image-text models","venue":null,"work_id":"d24d7830-22ab-41ab-a3ed-8dc149dd28c4","year":2022},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.339536Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:919ad9a9abe8026add3c16f350a3d577b31bc9525128fdef8161506c84cbdbe1","observation_id":"70a0a757-fd4f-4c3d-800c-ae06459589c3","resolution":{"observed_at":"2026-08-12T12:14:38.067808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.047848Z","title":"Indoor segmentation and support inference from rgbd images","venue":null,"work_id":"8b62fd10-2c1c-4785-b314-2fcd43fe30e7","year":2012},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.344417Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:e90da7dce2571b17c0ed8b36dfcd3c6176c8a72e6a8cfd0d40acf9593020912f","observation_id":"8420dafa-910d-4d9f-8fdd-440981593642","resolution":{"observed_at":"2026-08-12T12:14:38.052348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.033050Z","title":"Sun rgb-d: A rgb-d scene understanding benchmark suite","venue":null,"work_id":"993065a3-5400-4560-865e-9709c2a9fbfa","year":2015},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.349397Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:b982883ddf8ca7668b0f94e48738c1186895883259b3f1e661b4a2880302bf10","observation_id":"3a75e0da-93ec-4243-a33e-92f5ccbf0399","resolution":{"observed_at":"2026-08-12T12:14:38.038094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.017092Z","title":"Deconstructing self-supervised monocular recon- struction: The design decisions that matter","venue":null,"work_id":"22a3522c-dbc1-4f14-a592-e6739c03bbef","year":2022},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.354184Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:482d72adfc4c987b46f58e022777fa3ff85e37b2941e39e10e6ee7f9bf37de3a","observation_id":"a71ed343-8f3f-4937-b514-abf62010ecc0","resolution":{"observed_at":"2026-08-12T12:14:38.022356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.002986Z","title":"An- alyzing results of depth estimation models with monocular criteria","venue":null,"work_id":"2b10915f-88ca-4ebb-926d-dcfe5f74b9c8","year":2023},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.358953Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:b5d34d7456518e83ea09e3fd66cb58ac415c6b214bc7e983db1223407c36d98f","observation_id":"977ddd42-cd2b-4bd9-b987-b87907d6ba29","resolution":{"observed_at":"2026-08-12T12:14:38.007662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.988885Z","title":"Transformer based line segment classifier with image context for real-time vanishing point detection in man- hattan world","venue":null,"work_id":"bd683543-1664-45db-890d-cae1d809a9ac","year":2022},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.363612Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:b9bfa9177e4bf36f89f5ce7a531a12e3505a2266fa7ccdf23b16b8a3d59b54bc","observation_id":"68c14ea1-2514-4fce-85b8-56781ee5803e","resolution":{"observed_at":"2026-08-12T12:14:37.993626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.973935Z","title":"Deit iii: Revenge of the vit","venue":null,"work_id":"9865b5ef-ef94-4931-a54f-c56106f0a7e9","year":2022},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.368010Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:fd72f20bba972331e6583a2a3ab806fd8e4233de737b0e58393d78d3218d5290","observation_id":"b94e7e94-61ea-4de7-b42f-2b0e5808cb06","resolution":{"observed_at":"2026-08-12T12:14:37.978642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19115","last_updated":"2025-04-15T06:33:45Z","snapshot_observed_at":"2026-08-15T15:18:35.331457Z","submitted_at":"2024-10-24T19:29:02Z","title":"MoGe: Unlocking Accurate Monocular Geometry Estimation for Open-Domain Images with Optimal Training Supervision","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19115","snapshot_observed_at":"2026-08-12T12:14:37.372660Z","title":"Moge: Unlocking accurate monocular geometry estimation for open-domain images with optimal training supervision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.372660Z"},"links":{"cited_paper":"/paper/2410.19115","citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:6dd8f08b0e2f2b82e7954e4da9f3012b0c7ef0de4129fb63fad114cc05098c49","observation_id":"109d4f70-2336-4731-918c-90f36854a552","resolution":{"observed_at":"2026-08-12T12:14:37.372660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.958933Z","title":"Dust3r: Geometric 3d vi- sion made easy","venue":null,"work_id":"4ed0b49c-1061-4fbe-a52f-67f8cb0c0f35","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.378283Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:5f9331f8cb7c6e241545349ac3ace80c888637705bf8cb44e269bbd92d41ac73","observation_id":"b84a3379-ac0d-44d9-95ae-66787f8f81b4","resolution":{"observed_at":"2026-08-12T12:14:37.964658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.945021Z","title":"Instance shadow detection","venue":null,"work_id":"c59bdd91-09d7-49df-91cf-1d60448f30f1","year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.382987Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:ec3b5b41e200b92d6e1aa55a8e2a2454a24f58329cf99bb5b3722a787b23f4a4","observation_id":"7bcf84a2-baf3-4df7-ac03-780e5a1b4177","resolution":{"observed_at":"2026-08-12T12:14:37.949839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.930639Z","title":"Croco: Self-supervised pre-training for 3d vision tasks by cross-view completion","venue":null,"work_id":"4338a498-6592-4fc8-9585-68e2c6052ed9","year":2022},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.388087Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:268f256ae5c99dedf84612bf0843ab6dd1180ecd09df629e95f697b19aeb234f","observation_id":"d6b851ef-17bd-4224-9543-a3d6384b3f58","resolution":{"observed_at":"2026-08-12T12:14:37.935851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.915266Z","title":"Pytorch image models","venue":null,"work_id":"4021c0ce-ae57-453e-8d0e-a3aca6a0e614","year":2019},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.392448Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:93f44aa5d7bbbb5040306a9fac459556f5f21884cb9e9fa07a549f1db8985da2","observation_id":"85cc3a59-9644-4806-a438-4a9559e9fa5c","resolution":{"observed_at":"2026-08-12T12:14:37.920580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.901618Z","title":null,"venue":null,"work_id":"cf575524-cf0a-47df-a006-b36d741553b1","year":2020},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.396730Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:e3139b44ced93c91fa67f3dc206f7758db81b2a53c7e8a891a58bb7a0a3c283f","observation_id":"85d10efb-ed2f-4e8a-8af0-b1074719d274","resolution":{"observed_at":"2026-08-12T12:14:37.906086Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.887285Z","title":"Horizon lines in the wild","venue":null,"work_id":"1d7d0809-82b6-44a9-a18b-be814488bf40","year":2016},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.401240Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:3e55922e94d96f5b06e8c0be9281c916f5b2165941efad6bb11bd237e4b6cb11","observation_id":"f5d8237b-40be-4a98-a31b-a29383f73991","resolution":{"observed_at":"2026-08-12T12:14:37.891873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.872768Z","title":"Aggregated residual transformations for deep neural networks","venue":null,"work_id":"fff4596c-47de-46c2-ab2d-36b4bbe3d254","year":2017},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.405604Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:7d3f8872d2286e8ce7b86c274e165b663c7bd5f972a0e58fa3aff02141ef603b","observation_id":"1d3078a7-b066-4bed-83fd-450f9289b519","resolution":{"observed_at":"2026-08-12T12:14:37.877626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.856285Z","title":"Depth anything: Unleashing the power of large-scale unlabeled data","venue":null,"work_id":"c8966307-e9be-4c4e-bad0-68d2d2803971","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.410548Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:01652446dd895afcdc9040dd7cf48d9acd132f30ef33f1cc65b9579b19f546de","observation_id":"b40228f4-dd74-4958-b195-a1070ab847a1","resolution":{"observed_at":"2026-08-12T12:14:37.861747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.840152Z","title":"Depth any- thing v2","venue":null,"work_id":"f2b82620-4551-481c-a856-0e63f46ba746","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.415157Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:08e6686056bf99ee8416c43f3192fcb529d540453b331686736ac76ee419e0a8","observation_id":"c5c0224a-27cd-47bd-beba-ed2224fdbe9e","resolution":{"observed_at":"2026-08-12T12:14:37.845120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.824238Z","title":"Improving 2d feature representations by 3d-aware fine-tuning","venue":null,"work_id":"253388d7-4ef6-407c-ae54-26e2d8060581","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.419763Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:fcf27627fce7f827af546eb66c8afb21a1643fb21722697d4c4fe7bedfa02912","observation_id":"f9a6c2f8-13d2-4a02-b34c-1b30b45ae9a0","resolution":{"observed_at":"2026-08-12T12:14:37.830086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.808636Z","title":"Detect- ing vanishing points using global image context in a non- manhattan world","venue":null,"work_id":"3bfda3a1-c3dc-49be-9b35-7863c918ea4b","year":2016},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.424680Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:8c47ab5a7828937ac6ace7405028b42987a87b2ea485c6b23b9d5efe3b2de68a","observation_id":"e5a23698-e02c-4f3b-a5aa-1055203192f7","resolution":{"observed_at":"2026-08-12T12:14:37.813642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.792186Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":"4388a8ff-c67c-498c-9412-d0773e487986","year":2023},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.429270Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:2a52c6d8e2df3e7ebe2201814aa0f0256e8b90f58d5fdc1ef3a1ce646647992b","observation_id":"12a6993b-794f-4b60-833c-a6bcdbd788d5","resolution":{"observed_at":"2026-08-12T12:14:37.797664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.775616Z","title":"A general protocol to probe large vision models for 3d physical understanding","venue":null,"work_id":"80609477-dc16-4963-8827-7dc6b2afc057","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.434334Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:462f0a4c80a2dcc30a0a552b542f51e20694899052f3af3ff2858b35eaabb0d9","observation_id":"552dedff-1068-436f-943e-70a47c5fc1d9","resolution":{"observed_at":"2026-08-12T12:14:37.780759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.439454Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.439454Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:2f0e2d45a1232660fb71b4f2a9183b6ce12326bf3b91bd3e7593d2dbd8eb692a","observation_id":"0dab749c-87e5-4654-802c-aaedd28ac533","resolution":{"observed_at":"2026-08-12T12:14:37.439454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.749065Z","title":"ConDense: Consistent 2d/3d pre- training for dense and sparse features from multi-view im- ages","venue":null,"work_id":"8701d961-d0b6-40c7-b748-97eb5379c5b7","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.444037Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:db5a5b09922a83adf4c1848924f569fc6bf1a0491f7d1b54234dc06417e6f03a","observation_id":"e10e2a01-d775-4c25-97cd-a58e9682ed76","resolution":{"observed_at":"2026-08-12T12:14:37.753893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.733259Z","title":"ibot: Image bert pre-training with online tokenizer","venue":null,"work_id":"3575b444-ebc3-4a1b-82ab-3e7d9e44caed","year":2022},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.448381Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:b8fd235f5f493e40eef04df6d97686c63ccf47fb1c8b58194349b3595dae3231","observation_id":"a831ba42-f4cb-4e24-ab3a-182f7426ccec","resolution":{"observed_at":"2026-08-12T12:14:37.738798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.717483Z","title":"Unsupervised learning of depth and ego-motion from video","venue":null,"work_id":"879e4e3c-18c7-4577-b323-eef921be41e2","year":2017},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.452964Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:f9e157931ceda0f621c73bf4c0f2dbb92a6d4f3f6fe57ce4c1c38b30f5b5ab84","observation_id":"0be2abc9-6888-4d96-b121-21f04dd9b053","resolution":{"observed_at":"2026-08-12T12:14:37.722385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.701808Z","title":"Detect- ing dominant vanishing points in natural scenes with appli- cation to composition-sensitive image retrieval.Transactions on Multimedia, 2017","venue":null,"work_id":"316799ce-70b8-45e8-9429-0a638aecbabf","year":2017},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.457408Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:e8b4f8161fc089e6d96fbc356fd810c65284ef913c17662648061565d3405866","observation_id":"63aed1ab-7625-404f-81b4-f1823724e00f","resolution":{"observed_at":"2026-08-12T12:14:37.707043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18125","last_updated":"2025-04-27T06:50:23Z","snapshot_observed_at":"2026-08-12T22:36:38.589325Z","submitted_at":"2024-09-26T17:59:11Z","title":"LLaVA-3D: A Simple yet Effective Pathway to Empowering LMMs with 3D-awareness","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18125","snapshot_observed_at":"2026-08-12T12:14:37.463309Z","title":"LLaV A-3D: A simple yet effective pathway to empowering LMMs with 3d-awareness","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.463309Z"},"links":{"cited_paper":"/paper/2409.18125","citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:ab3e9d94f64496337417ee21cc9b8cafa27b8b8802d65c6984afa3eda14194c6","observation_id":"5665a978-8a58-45e4-b63a-a3a5dbf64faa","resolution":{"observed_at":"2026-08-12T12:14:37.463309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.686580Z","title":"Semantic amodal segmentation","venue":null,"work_id":"bbf525e9-a687-40dd-80fd-97ec0b4497ed","year":2017},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.468786Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:dc3ef38a98e124b7b1b45cc7180cdaf98f02ce35da03cbd2b4117d345cd56361","observation_id":"b91b9e6f-14f0-46c5-a8a2-c58505ea7000","resolution":{"observed_at":"2026-08-12T12:14:37.691281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.670392Z","title":"patch size-14","venue":null,"work_id":"d164636b-d122-4551-a9d9-411fe832f5d0","year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.473052Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:5d29c8dea76223436f1607e88b7faec246921aab0640d6030774207b2e314689","observation_id":"9867cbe0-7f86-43b2-9cd9-f6401bf14d3b","resolution":{"observed_at":"2026-08-12T12:14:37.676162Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.630587Z","title":null,"venue":null,"work_id":"0517d783-f624-4523-be6b-e26aa5c74846","year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.120825Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:645d75f9430b64c8a6ec73815157fc704b3355d4b8033ee78d08ddc994915b24","observation_id":"adbc3f6b-10eb-4a6d-8f0d-39cdee3f5c11","resolution":{"observed_at":"2026-08-12T12:14:38.635686Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T14:45:29.407521Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models"},"reference_resolution":{"displayed":93,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":2,"verified_fuzzy":61},"total_outbound_references":93},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 93 of 93 outbound references and 0 inbound Pith citation observations for arXiv:2411.17385."}