{"as_of":"2026-08-22T11:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1bdf06e353e1146729080ea7e2edd81824ac635ff6bd71e1d15a9c65dfcf59ef","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:48:22.070954Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.02704/citation-record","integrity":"/paper/2505.02704/integrity","json":"/paper/2505.02704/citation-record.json","paper":"/paper/2505.02704"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:21.369024Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.369024Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:2f98aa6eb2b2967235cfcb5f9b4070d8985b150db06d518fd7c997587648fa7a","observation_id":"6ac7e056-6fec-404e-9db2-18f122e2781d","resolution":{"observed_at":"2026-08-16T00:48:21.369024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:21.423922Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.423922Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:1b10d1b3b37db047682a0e5fa33f3a40beae97f59f92b5d4ab4dae79f232403e","observation_id":"88b7041d-3b19-4a10-83a9-0bd652e8c862","resolution":{"observed_at":"2026-08-16T00:48:21.423922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:23.449846Z","title":null,"venue":null,"work_id":"6ca60704-4593-4d73-abf3-1ec638bca18e","year":2023},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.473282Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:c2b529b68a93a5f0d987ad2d4d0f001ffbf8976036175bb1b1520f2c778f01f0","observation_id":"86d03885-e2b6-486d-b88a-446b28d7b9a2","resolution":{"observed_at":"2026-08-16T00:48:23.453891Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:23.367325Z","title":"F.; Alhashim, I.; and Wonka, P","venue":null,"work_id":"4370df1d-38d9-41ae-8dad-afb9db14b6b2","year":2021},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.477360Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:988193b770fec37c301686bb7937533d6ea71f7139906495f776ad7e651150b9","observation_id":"df61cddd-1edd-4e4a-a36b-18876ac1eead","resolution":{"observed_at":"2026-08-16T00:48:23.425409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:23.354377Z","title":"F.; Alhashim, I.; and Wonka, P","venue":null,"work_id":"ba810710-ade3-402b-9b54-8d7cdf3245a1","year":2022},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.481581Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:a5458b8939fb4b90ef6fae664f7a0ada83b72ca69b603cfd657486d347b256e8","observation_id":"5b603949-a476-40d7-ab5b-9b2683109e66","resolution":{"observed_at":"2026-08-16T00:48:23.358973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12288","last_updated":"2023-02-23T19:13:10Z","snapshot_observed_at":"2026-07-06T14:55:15.719380Z","submitted_at":"2023-02-23T19:13:10Z","title":"ZoeDepth: Zero-shot Transfer by Combining Relative and Metric Depth","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12288","snapshot_observed_at":"2026-08-16T00:48:21.485909Z","title":"F.; Birkl, R.; Wofk, D.; Wonka, P.; and M \\\"u ller, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.485909Z"},"links":{"cited_paper":"/paper/2302.12288","citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:bad6180403e9fb06083cc0023375fd86097c9b1d4977361b6b568d32a1fb55c3","observation_id":"1b6d2ef2-eb4f-4e82-a606-41b08ed093a4","resolution":{"observed_at":"2026-08-16T00:48:21.485909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.11590","last_updated":"2021-10-22T05:12:42Z","snapshot_observed_at":"2026-08-18T18:55:04.642902Z","submitted_at":"2021-10-22T05:12:42Z","title":"DIML/CVL RGB-D Dataset: 2M RGB-D Images of Natural Indoor and Outdoor Scenes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.11590","snapshot_observed_at":"2026-08-16T00:48:21.489798Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.489798Z"},"links":{"cited_paper":"/paper/2110.11590","citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:11d7ae6dcdbe3b39f89b9b757e85d94bd2b17f25aca25b30b53cabfce228d9c2","observation_id":"95899573-2f5d-40eb-9ea5-7b05d99f92f5","resolution":{"observed_at":"2026-08-16T00:48:21.489798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:23.341520Z","title":null,"venue":null,"work_id":"eb3bc83f-d073-427f-a078-d28c079405bc","year":2014},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.494754Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:d8b295bcf4e79b6bfc48d56c9563c2510083d3760c75939656e93878cde52ce1","observation_id":"76257cb6-9f96-4a38-88d1-03dac576bb67","resolution":{"observed_at":"2026-08-16T00:48:23.346328Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:23.329914Z","title":null,"venue":null,"work_id":"d82189c3-2a77-4afc-aa12-b7c34bd71eec","year":2024},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.498942Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:de16d168e9ab5a99571fdf05884145b0dd71ea82ef5c68c4f87d00aea98d8a30","observation_id":"b781d3fb-f76d-4006-ad5c-f4454a29fb47","resolution":{"observed_at":"2026-08-16T00:48:23.334149Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.14437","last_updated":"2023-10-22T22:47:51Z","snapshot_observed_at":"2026-08-16T14:49:58.094774Z","submitted_at":"2023-10-22T22:47:51Z","title":"Mobile AR Depth Estimation: Challenges & Prospects -- Extended Version","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.14437","snapshot_observed_at":"2026-08-16T00:48:21.503478Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.503478Z"},"links":{"cited_paper":"/paper/2310.14437","citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:5a560f2964808b1dd35c75f2d74018a1681b27dbe4e3d8b912a2a0e1162d6c23","observation_id":"4548185b-757a-41e0-abaa-c8c72a1fec48","resolution":{"observed_at":"2026-08-16T00:48:21.503478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:23.196139Z","title":null,"venue":null,"work_id":"d42c2445-be43-428a-8676-08de54d545f4","year":2012},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.507662Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:c156d25980c34bcb2d1b2d3b2a5b255d8c122936337d8c0c747b0fc38b97644a","observation_id":"a32abeeb-83a3-4d61-979b-3a907cd08777","resolution":{"observed_at":"2026-08-16T00:48:23.321718Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:21.511874Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.511874Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:90519edb3d20b08be4453f78cd7cbe6041ed6e0f00a47b235bdd5411a13b4def","observation_id":"1bf91f09-c4ce-4f49-b179-5e50f5365e64","resolution":{"observed_at":"2026-08-16T00:48:21.511874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:23.066981Z","title":null,"venue":null,"work_id":"9273d845-b74c-4cd0-a89f-8bc16925d09c","year":2023},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.515567Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:8d3c3f3ccb3d5ec66ce31f70460a9e10f4ab96c0c147511622f47d28f8dc510a","observation_id":"ba1cbd56-f76b-4910-ac0e-3b0712f4adcb","resolution":{"observed_at":"2026-08-16T00:48:23.071280Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15506","last_updated":"2025-01-03T15:39:16Z","snapshot_observed_at":"2026-08-18T02:00:31.409489Z","submitted_at":"2024-03-22T02:30:46Z","title":"Metric3Dv2: A Versatile Monocular Geometric Foundation Model for Zero-shot Metric Depth and Surface Normal Estimation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15506","snapshot_observed_at":"2026-08-16T00:48:21.519430Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.519430Z"},"links":{"cited_paper":"/paper/2404.15506","citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:c6a94d027a099930de288003e534c511544f43e8b5facd3c8d97c1a33a5d31df","observation_id":"9d703763-2b88-40c7-98e8-ea5e56d0fccc","resolution":{"observed_at":"2026-08-16T00:48:21.519430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:23.055636Z","title":null,"venue":null,"work_id":"41b49d72-8a7d-4554-b2db-33e4838b6a17","year":2024},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.523227Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:40e40d4c46356cf50df0f1ef1bae06808f3e2130e74ed7c58ab886a8d79e18e9","observation_id":"37190a69-a162-4be3-b65a-6fcb923700a1","resolution":{"observed_at":"2026-08-16T00:48:23.059541Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:23.043810Z","title":null,"venue":null,"work_id":"ce9562c9-c0fc-4743-9a35-d168e2bb80f7","year":2023},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.527503Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:caaa0d9715d3987fcced9297233198c5d87aacdcb2b80c5885cc0364394bb8a6","observation_id":"961f6f43-107e-4ada-99fd-49f25cc887c9","resolution":{"observed_at":"2026-08-16T00:48:23.047394Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:23.030096Z","title":null,"venue":null,"work_id":"7e0257a4-7119-4b7e-bfd2-a6cc0f68cee6","year":2022},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.531246Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:92232868076f0e650430f21c67892cf89abb9fdcf2492f29201b01649303ea19","observation_id":"0c70c97c-c19b-4a26-81ae-187e2cb80c9e","resolution":{"observed_at":"2026-08-16T00:48:23.035522Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:21.534736Z","title":"C.; and Schindler, K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.534736Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:6163803ca8c5a9e00e21de53e71e0845143bb3bc981e95702f4fd78adf61fef5","observation_id":"ce541600-e268-425a-9eb6-543406dee601","resolution":{"observed_at":"2026-08-16T00:48:21.534736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2402.03251","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:22.504032Z","title":null,"venue":null,"work_id":"f042ac81-b7d8-4853-8ca1-9c6c54e586c7","year":2024},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.540004Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:87ecde78255e779da664047b0e33f8ce893b90bbb5725113e6ade09cd01d74c9","observation_id":"63ec8955-d51a-47e7-a398-574ab815ea5e","resolution":{"observed_at":"2026-08-16T00:48:22.534442Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:23.010438Z","title":null,"venue":null,"work_id":"afdacc9c-a10f-47af-9df1-37f7cda71356","year":2024},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.543428Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:bd7412d8dfd7795042c836bcfc35b1d18e363395e78a9099d611d17d3d8c453d","observation_id":"b15629ca-0344-4256-8c2a-5df8293ffaaa","resolution":{"observed_at":"2026-08-16T00:48:23.015558Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08548","last_updated":"2023-12-13T22:20:45Z","snapshot_observed_at":"2026-08-21T20:25:43.450627Z","submitted_at":"2023-12-13T22:20:45Z","title":"EVP: Enhanced Visual Perception using Inverse Multi-Attentive Feature Refinement and Regularized Image-Text Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08548","snapshot_observed_at":"2026-08-16T00:48:21.547520Z","title":"F.; M \\\"u ller, M.; and Wonka, P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.547520Z"},"links":{"cited_paper":"/paper/2312.08548","citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:4b0d1535c3f99e636028fb600ebc6f86664c160a1a63e5f4762d8b3be55bf248","observation_id":"3985018a-7176-4432-a4eb-c13ff6759a2c","resolution":{"observed_at":"2026-08-16T00:48:21.547520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.10326","last_updated":"2021-09-23T10:23:51Z","snapshot_observed_at":"2026-08-19T15:38:00.383979Z","submitted_at":"2019-07-24T09:31:24Z","title":"From Big to Small: Multi-Scale Local Planar Guidance for Monocular Depth Estimation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.10326","snapshot_observed_at":"2026-08-16T00:48:21.551810Z","title":"H.; Han, M.-K.; Ko, D","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.551810Z"},"links":{"cited_paper":"/paper/1907.10326","citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:b7e6863bb7e82f142f2393c91efd7b820545b8ae2bfebe1cff288337336900ba","observation_id":"4245d455-e257-40ab-98ef-9c18ef982e79","resolution":{"observed_at":"2026-08-16T00:48:21.551810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:21.588865Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.588865Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:590a859583697497f47dfceef860860698be81afdc64801dde8edfd1c5a733e2","observation_id":"7bd65f16-f47a-4e34-b368-0772ba9c4d54","resolution":{"observed_at":"2026-08-16T00:48:21.588865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:22.985221Z","title":null,"venue":null,"work_id":"88ec4510-8765-4a57-b4ee-4500defea173","year":2024},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.622976Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:b7e889ad1fb4dc1d4b30957ef9b4a0432e940a3023fe83932383260538e43a4d","observation_id":"c090bb9f-ef28-4359-8d97-9173ea0353d2","resolution":{"observed_at":"2026-08-16T00:48:22.991361Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:21.651292Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.651292Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:0e74e91469ab3dff226c111628c5e68cd847f982315b8f7e1f0ca2cc9d567e7d","observation_id":"e3691377-0c87-4bd1-977f-e9d7e609d400","resolution":{"observed_at":"2026-08-16T00:48:21.651292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:21.700616Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.700616Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:66c4dca53d47ff577bf95d831efcd54a55e889afd85e12e35ace25ee18528223","observation_id":"c1c22274-2c11-4b26-a99c-0da7a76990aa","resolution":{"observed_at":"2026-08-16T00:48:21.700616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:22.865955Z","title":null,"venue":null,"work_id":"26a902b1-ada6-4b8e-8e8d-a83240928bc3","year":2023},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.730336Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:a2803f14e3bcf7fb50cd663ece36a4c7070ae9c2aaa63e6cf5dfff4e28e5ed28","observation_id":"27f6c317-b9e6-48be-9d68-6cae3a959633","resolution":{"observed_at":"2026-08-16T00:48:22.887060Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:22.852361Z","title":null,"venue":null,"work_id":"0825a556-24de-4f58-9eb9-e9059a395808","year":2024},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.751098Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:2a7c043ced25d8e46a12014736ed160dc81b603cd6b3e39de7190995b5ec9ab1","observation_id":"dcff6493-6bbd-44a3-b1c4-183d99d9a64d","resolution":{"observed_at":"2026-08-16T00:48:22.856973Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:22.793345Z","title":null,"venue":null,"work_id":"dcfc8f98-422a-4fd3-89f1-c0584a38d398","year":2018},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.774868Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:b96c2217d9352f113056495bf234de17d46118737b121dd2e92d75bb83c715f7","observation_id":"e4b00e85-2187-4f2b-9927-0a68d00cea85","resolution":{"observed_at":"2026-08-16T00:48:22.843256Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:21.789654Z","title":"W.; Hallacy, C.; Ramesh, A.; Goh, G.; Agarwal, S.; Sastry, G.; Askell, A.; Mishkin, P.; Clark, J.; et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.789654Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:d5672b841a2a7db3fbf0fb4ef13797717663919da99dffabcf8785ee6dcbc4ad","observation_id":"d5d3c8c7-1500-4702-80a3-a314d58c40cd","resolution":{"observed_at":"2026-08-16T00:48:21.789654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:21.808356Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.808356Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:73ba91fca1e665854ab65cc5ea4df7e6346ca37de5e7fb8be3f8cb4534780ed0","observation_id":"629e6370-71bc-4846-8084-25031f93f9bd","resolution":{"observed_at":"2026-08-16T00:48:21.808356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:22.767099Z","title":null,"venue":null,"work_id":"a728c442-c067-4dce-8bb0-d49aac417e5b","year":2020},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.835859Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:63a281e637513027175a6eef6bebf363ed90d15f4331b1fe838b6d14d95daa11","observation_id":"580ba261-aa18-4d72-bf28-bea14ec8fff9","resolution":{"observed_at":"2026-08-16T00:48:22.770975Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.14460","last_updated":"2023-07-26T19:01:49Z","snapshot_observed_at":"2026-08-18T20:33:24.789198Z","submitted_at":"2023-07-26T19:01:49Z","title":"MiDaS v3.1 -- A Model Zoo for Robust Monocular Relative Depth Estimation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.14460","snapshot_observed_at":"2026-08-16T00:48:21.843376Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.843376Z"},"links":{"cited_paper":"/paper/2307.14460","citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:d80aaa872ce3cce84534119eec735f80a870b0ffe137053a1162e0f360b8b39a","observation_id":"62b4c1cf-1451-46b8-8467-0412d739d14e","resolution":{"observed_at":"2026-08-16T00:48:21.843376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:22.754227Z","title":null,"venue":null,"work_id":"42d1997f-cce6-4d39-81b1-0cf22ae2a1df","year":2021},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.847925Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:95fe237735c50176337ac57b0dcb8afcccd15a31e61324b5add315cbbf57cca0","observation_id":"15ecc8bf-f4fe-4923-97ed-90aa04363647","resolution":{"observed_at":"2026-08-16T00:48:22.758732Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:22.742811Z","title":null,"venue":null,"work_id":"e901538f-0b86-4ce4-833f-6b6bc626bf26","year":2023},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.853062Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:ea834aa40b51eec3afc191d6cb6f4f2d797f610eedff7d064a06df56fb5166b1","observation_id":"c27070a0-6042-47c0-adb0-3d3dd0dee545","resolution":{"observed_at":"2026-08-16T00:48:22.746721Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:21.857619Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.857619Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:d9ae9eb8b4274b2ec59a54f6c586d9a34c7cd446a82716895c2a88d79613a7f2","observation_id":"db6c22c1-d112-4196-ad6c-9cce250d98dd","resolution":{"observed_at":"2026-08-16T00:48:21.857619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:22.723445Z","title":null,"venue":null,"work_id":"4947d8ea-5f3b-4351-90cb-aef23203eee5","year":2015},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.861541Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:e0ff9af8cc8462522db5b8a49fbf9ec0150cd5d372dbf9411dd94cf36d5a1de2","observation_id":"4692a88a-3cd4-4ea4-85ef-eb0590a04d55","resolution":{"observed_at":"2026-08-16T00:48:22.727252Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-17T03:35:45.144163Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02576","snapshot_observed_at":"2026-08-16T00:48:21.865316Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.865316Z"},"links":{"cited_paper":"/paper/2501.02576","citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:4ca155eec91d7dce39a1c71b016b9bc6d0baa13b814ef5aaf85d6650e0bcde9d","observation_id":"f03fbb9f-d18c-47b8-a55f-0e421ebcb438","resolution":{"observed_at":"2026-08-16T00:48:21.865316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:22.711885Z","title":null,"venue":null,"work_id":"147c419e-83c0-4d44-a2c5-a3c651c0e2e1","year":2017},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.869229Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:cb9ab125c3d4fb8d497c9a7c847b735451361dc5a4991e5681c7226ffdfbaab7","observation_id":"d0a99aff-7d6e-4eab-8009-eafedc3e79fe","resolution":{"observed_at":"2026-08-16T00:48:22.715703Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13389","last_updated":"2025-09-14T11:15:24Z","snapshot_observed_at":"2026-08-14T02:05:57.291421Z","submitted_at":"2024-12-18T00:06:41Z","title":"Marigold-DC: Zero-Shot Monocular Depth Completion with Guided Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13389","snapshot_observed_at":"2026-08-16T00:48:21.873424Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.873424Z"},"links":{"cited_paper":"/paper/2412.13389","citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:1b97f7712b30f66fe7ec9b1b5103798c04593343fba0756a68fe2905456d9abc","observation_id":"eafdf675-af19-43fc-893f-16ef23a7ed23","resolution":{"observed_at":"2026-08-16T00:48:21.873424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:22.699585Z","title":null,"venue":null,"work_id":"0df7b5d8-7a99-45d4-b349-46f88a356ceb","year":2023},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.877231Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:5f154516d0b5a9ce88a754fb475fd35dd3469b807ae91d80ad88f4f3f2193b34","observation_id":"cc9f0b57-5336-449a-b687-7c0e49645280","resolution":{"observed_at":"2026-08-16T00:48:22.703717Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:21.881219Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.881219Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:a14ec5a66f85972af12f4a019f0907c0512027a8bf09ddcdbfc56b30c6b197df","observation_id":"b81275b5-f101-48f0-be5d-e13fe5d9aeec","resolution":{"observed_at":"2026-08-16T00:48:21.881219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09414","last_updated":"2024-10-20T11:24:09Z","snapshot_observed_at":"2026-07-06T18:30:32.982860Z","submitted_at":"2024-06-13T17:59:56Z","title":"Depth Anything V2","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09414","snapshot_observed_at":"2026-08-16T00:48:21.890199Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.890199Z"},"links":{"cited_paper":"/paper/2406.09414","citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:e8e7f9cc40ff757b7b6678fdbd39ec2d6a9c6a88beb51e2b0635d4b968078b09","observation_id":"4f2efeed-ad6d-4d2d-8a23-5948aff28a6c","resolution":{"observed_at":"2026-08-16T00:48:21.890199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.00569","last_updated":"2020-03-28T08:26:57Z","snapshot_observed_at":"2026-08-20T04:50:08.671987Z","submitted_at":"2020-02-03T05:38:33Z","title":"DiverseDepth: Affine-invariant Depth Prediction Using Diverse Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.00569","snapshot_observed_at":"2026-08-16T00:48:21.947691Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.947691Z"},"links":{"cited_paper":"/paper/2002.00569","citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:002e62660c6976e5b5d9555fed28648728aff45f2d32759287c6db45c76fd71c","observation_id":"e34da7ad-6b31-43cb-aea8-03d129f5043e","resolution":{"observed_at":"2026-08-16T00:48:21.947691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:22.680489Z","title":null,"venue":null,"work_id":"84a35131-934d-497e-8f05-ae1c35808608","year":2023},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:21.968811Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:754b037f686c7f8c6d11383c783fd00549f80a0505bb6f066b487a382e4e0fd2","observation_id":"268b355e-ad1c-489d-9dcc-5a2b0864d068","resolution":{"observed_at":"2026-08-16T00:48:22.684011Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:22.668191Z","title":null,"venue":null,"work_id":"cd0c1c23-65be-4e57-b5df-67f2ff1fbaaa","year":2024},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:22.017028Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:0cc7d8e018acc076c92cb92a0e86a5a7d8555a735bf7132971876d35305d1d68","observation_id":"ead061a1-0828-4013-90ef-fbf802d35bc9","resolution":{"observed_at":"2026-08-16T00:48:22.672305Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02924","last_updated":"2024-11-03T02:20:28Z","snapshot_observed_at":"2026-08-16T13:12:49.137777Z","submitted_at":"2024-10-03T19:18:13Z","title":"RSA: Resolving Scale Ambiguities in Monocular Depth Estimators through Language Descriptions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02924","snapshot_observed_at":"2026-08-16T00:48:22.037990Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:22.037990Z"},"links":{"cited_paper":"/paper/2410.02924","citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:ee41ca74db488ceaa67aac07208843e35e7f894ae11954c6ee7d276b57e10ec6","observation_id":"7b7fd5f3-96d3-4df6-99fb-02e524f27f3d","resolution":{"observed_at":"2026-08-16T00:48:22.037990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:22.060349Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:22.060349Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:42402617e1b53e00d6fd161e6fec658f8ed0ee47e9c764a7af2d67aa842879dc","observation_id":"d8768285-42e0-4493-ba00-fdbadc5ecb92","resolution":{"observed_at":"2026-08-16T00:48:22.060349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17952","last_updated":"2024-11-06T14:58:17Z","snapshot_observed_at":"2026-08-16T13:31:08.811976Z","submitted_at":"2024-07-25T11:16:37Z","title":"BetterDepth: Plug-and-Play Diffusion Refiner for Zero-Shot Monocular Depth Estimation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17952","snapshot_observed_at":"2026-08-16T00:48:22.063763Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:22.063763Z"},"links":{"cited_paper":"/paper/2407.17952","citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:5976d34eac1c46e99a8ca11eb564ad501cf01c432d0e4189f2a1437625cde3ba","observation_id":"39115beb-4459-4f97-89e6-09228b957035","resolution":{"observed_at":"2026-08-16T00:48:22.063763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:22.608409Z","title":null,"venue":null,"work_id":"7264d2b3-3134-41fd-8302-9a4a186c1c38","year":2023},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:22.067619Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:751ede3c707fe4a219310a6a14654611298830c9a4c0230a89636ad44bb42719","observation_id":"8f7a28de-da2d-43b0-b1aa-a09a0366381f","resolution":{"observed_at":"2026-08-16T00:48:22.633246Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:48:22.070954Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery","version":3},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-16T00:48:22.070954Z"},"links":{"citing_paper":"/paper/2505.02704"},"observation_digest":"sha256:f7d2d4fd3c5a562dd40c301f09f0821ee984cf077bac33487b9e04b2c7416a56","observation_id":"69694f92-e28a-434d-856b-1e8fa7638c91","resolution":{"observed_at":"2026-08-16T00:48:22.070954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.02704","last_updated":"2025-07-13T06:16:51Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T21:43:07.129029Z","submitted_at":"2025-05-05T14:57:16Z","title":"VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":48,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2505.02704."}