{"as_of":"2026-08-11T15:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b513d56b47c8d72167782556043cbc0b1a0829dfd5624755189f514b6f4dfa1b","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:48:56.733671Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.17585/citation-record","integrity":"/paper/2507.17585/integrity","json":"/paper/2507.17585/citation-record.json","paper":"/paper/2507.17585"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:49:01.107717Z","title":"Command-driven articulated object understanding and manipulation","venue":null,"work_id":"72fae573-5a49-443d-8634-4563787f5aa4","year":2023},"citing_paper":{"arxiv_id":"2507.17585","last_updated":"2025-07-23T15:20:31Z","snapshot_observed_at":"2026-08-09T09:28:54.729548Z","submitted_at":"2025-07-23T15:20:31Z","title":"From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:54.914882Z"},"links":{"citing_paper":"/paper/2507.17585"},"observation_digest":"sha256:f52c5f89150ac054652e1538b0f8d05645a6e4bfc45e4dd17328b65eb950fe46","observation_id":"50eb4cf8-ffe7-4cb0-8142-320b81ebb47a","resolution":{"observed_at":"2026-08-06T14:49:01.234540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:49:00.857239Z","title":"Chang, Manolis Savva, Maciej Hal- ber, Thomas Funkhouser, and Matthias Nießner","venue":null,"work_id":"a1cc0004-0df3-4c97-9909-8dd7eaa55c85","year":2017},"citing_paper":{"arxiv_id":"2507.17585","last_updated":"2025-07-23T15:20:31Z","snapshot_observed_at":"2026-08-09T09:28:54.729548Z","submitted_at":"2025-07-23T15:20:31Z","title":"From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:54.977550Z"},"links":{"citing_paper":"/paper/2507.17585"},"observation_digest":"sha256:33e54fc3cab05bbebf8fee147969c479f7b69485f9b9ddab817877975b8503af","observation_id":"b5c818a5-6fdc-465b-95ce-38d4675e3879","resolution":{"observed_at":"2026-08-06T14:49:00.968167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:49:00.515077Z","title":"ProcTHOR: Large-Scale Embodied AI Using Procedural Generation","venue":null,"work_id":"37fa7e89-155c-4990-acf1-a23256442378","year":2022},"citing_paper":{"arxiv_id":"2507.17585","last_updated":"2025-07-23T15:20:31Z","snapshot_observed_at":"2026-08-09T09:28:54.729548Z","submitted_at":"2025-07-23T15:20:31Z","title":"From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:55.056189Z"},"links":{"citing_paper":"/paper/2507.17585"},"observation_digest":"sha256:e0b44d824a58fcca63efe82c85172e8c356685f2478aa16f3c29c58db368b2ce","observation_id":"46397d25-a9f3-4095-9db9-e7b5ab09926e","resolution":{"observed_at":"2026-08-06T14:49:00.665507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:49:00.266378Z","title":"Objaverse-xl: A universe of 10m+ 3d objects","venue":null,"work_id":"2ffea68f-59ac-4c72-b318-dfcff3e6391c","year":2023},"citing_paper":{"arxiv_id":"2507.17585","last_updated":"2025-07-23T15:20:31Z","snapshot_observed_at":"2026-08-09T09:28:54.729548Z","submitted_at":"2025-07-23T15:20:31Z","title":"From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:55.135998Z"},"links":{"citing_paper":"/paper/2507.17585"},"observation_digest":"sha256:fbc5d63e8e256a33abdb7045da4414e7beebc73f1d12f87740671b6ad4c824dc","observation_id":"917fcb75-871f-4b36-a347-c1f2e85cf127","resolution":{"observed_at":"2026-08-06T14:49:00.385044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:49:00.029639Z","title":"SceneFun3D: Fine-Grained Functionality and Affordance Understanding in 3D Scenes","venue":null,"work_id":"e8dd9d01-ec13-4506-98c3-f65bd16ec5ba","year":2024},"citing_paper":{"arxiv_id":"2507.17585","last_updated":"2025-07-23T15:20:31Z","snapshot_observed_at":"2026-08-09T09:28:54.729548Z","submitted_at":"2025-07-23T15:20:31Z","title":"From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:55.195827Z"},"links":{"citing_paper":"/paper/2507.17585"},"observation_digest":"sha256:7fe0aea5bb2ceab33b8e4d1f6ecc2b3be17304fd05aaceeebd8a523b7b216ea7","observation_id":"1c214c70-4827-4bbd-9734-df171d502668","resolution":{"observed_at":"2026-08-06T14:49:00.145132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11870","last_updated":"2024-09-18T10:52:16Z","snapshot_observed_at":"2026-08-10T21:26:09.594538Z","submitted_at":"2024-09-18T10:52:16Z","title":"SpotLight: Robotic Scene Understanding through Interaction and Affordance Detection","version":1},"cited_work":{"arxiv_id":"2409.11870","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.11870","snapshot_observed_at":"2026-08-06T14:48:56.881489Z","title":"SpotLight: Robotic Scene Understanding through Interaction and Affordance Detection","venue":"cs.RO","work_id":"d27656f3-12b5-436c-a28c-debd38b4a199","year":2024},"citing_paper":{"arxiv_id":"2507.17585","last_updated":"2025-07-23T15:20:31Z","snapshot_observed_at":"2026-08-09T09:28:54.729548Z","submitted_at":"2025-07-23T15:20:31Z","title":"From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:55.312900Z"},"links":{"cited_paper":"/paper/2409.11870","citing_paper":"/paper/2507.17585"},"observation_digest":"sha256:226364803177c65302891295a4d7d1e3569e64717485197485d7b1f21615c168","observation_id":"a19684f8-be13-433d-90d3-78f6c93761d9","resolution":{"observed_at":"2026-08-06T14:48:56.938223Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:59.740475Z","title":null,"venue":null,"work_id":"a36ec838-2d1e-44af-9069-e1e56073c0f5","year":null},"citing_paper":{"arxiv_id":"2507.17585","last_updated":"2025-07-23T15:20:31Z","snapshot_observed_at":"2026-08-09T09:28:54.729548Z","submitted_at":"2025-07-23T15:20:31Z","title":"From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:55.369971Z"},"links":{"citing_paper":"/paper/2507.17585"},"observation_digest":"sha256:7bef1c67096562860195f325f87dd34db9d6cc98a8f57f636b109cb4b74c08b9","observation_id":"c9a3a716-65d6-4672-8389-d784e8346a3e","resolution":{"observed_at":"2026-08-06T14:48:59.905568Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:59.429914Z","title":"Shepherd, and Saurabh Gupta","venue":null,"work_id":"798eef8d-a9b6-4e55-acfa-ae4d09e9e321","year":null},"citing_paper":{"arxiv_id":"2507.17585","last_updated":"2025-07-23T15:20:31Z","snapshot_observed_at":"2026-08-09T09:28:54.729548Z","submitted_at":"2025-07-23T15:20:31Z","title":"From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:55.472365Z"},"links":{"citing_paper":"/paper/2507.17585"},"observation_digest":"sha256:27c4583d8e90f2a1530ec118266bc8ed262535b0d82262bd639b9a1e94b5a748","observation_id":"29a5c63e-f2f5-47cd-9c2b-076f2c4c0d01","resolution":{"observed_at":"2026-08-06T14:48:59.562291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01398","last_updated":"2025-07-02T12:33:12Z","snapshot_observed_at":"2026-08-09T22:02:38.931888Z","submitted_at":"2024-12-02T11:33:55Z","title":"Articulate3D: Holistic Understanding of 3D Scenes as Universal Scene Description","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01398","snapshot_observed_at":"2026-08-06T14:48:55.590252Z","title":"Holistic understanding of 3d scenes as universal scene description","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17585","last_updated":"2025-07-23T15:20:31Z","snapshot_observed_at":"2026-08-09T09:28:54.729548Z","submitted_at":"2025-07-23T15:20:31Z","title":"From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:55.590252Z"},"links":{"cited_paper":"/paper/2412.01398","citing_paper":"/paper/2507.17585"},"observation_digest":"sha256:b1a0dcf7295b26bc9b1cc744a3804ada8da3574e422f0cc16753317fd4de5554","observation_id":"8e0b1b26-3b2f-4f73-baf6-4b029de318c1","resolution":{"observed_at":"2026-08-06T14:48:55.590252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:59.183129Z","title":"Chang, and Manolis Savva","venue":null,"work_id":"58c1975d-65cc-4a1a-bfca-8db8d0eaf76b","year":2024},"citing_paper":{"arxiv_id":"2507.17585","last_updated":"2025-07-23T15:20:31Z","snapshot_observed_at":"2026-08-09T09:28:54.729548Z","submitted_at":"2025-07-23T15:20:31Z","title":"From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:55.685714Z"},"links":{"citing_paper":"/paper/2507.17585"},"observation_digest":"sha256:f87d070137e593fd21dea557649fff83f5243fcb2f81892e225b91581ecc06c4","observation_id":"5898aaab-bbfc-47d3-8a3f-1733ace4cf58","resolution":{"observed_at":"2026-08-06T14:48:59.305905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:58.892726Z","title":"Multiscan: Scalable rgbd scan- ning for 3d environments with articulated objects","venue":null,"work_id":"2c10d512-9b4f-4915-9b14-e6c59e6b6116","year":2022},"citing_paper":{"arxiv_id":"2507.17585","last_updated":"2025-07-23T15:20:31Z","snapshot_observed_at":"2026-08-09T09:28:54.729548Z","submitted_at":"2025-07-23T15:20:31Z","title":"From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:55.789935Z"},"links":{"citing_paper":"/paper/2507.17585"},"observation_digest":"sha256:67a3df1a8d441a5c10ef25b9508387b2758e75752af5bcf1f609bf9bd69a842d","observation_id":"d7dc6a30-a17c-4b22-9d6d-2eb66efafeff","resolution":{"observed_at":"2026-08-06T14:48:59.007383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:58.615020Z","title":"Orbit: A unified simulation framework for interactive robot learning environments","venue":null,"work_id":"f06aaa16-5404-4c14-acaa-0276be71542a","year":2023},"citing_paper":{"arxiv_id":"2507.17585","last_updated":"2025-07-23T15:20:31Z","snapshot_observed_at":"2026-08-09T09:28:54.729548Z","submitted_at":"2025-07-23T15:20:31Z","title":"From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:55.893772Z"},"links":{"citing_paper":"/paper/2507.17585"},"observation_digest":"sha256:2c02e2b904f27c15ead2dfda8f782ca2bd2c3d02e70d52f90e7472ff09264f40","observation_id":"9dc04ca6-e6f5-4369-b82a-8297cb708523","resolution":{"observed_at":"2026-08-06T14:48:58.709928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:58.354569Z","title":"Robocasa: Large-scale simulation of every- day tasks for generalist robots","venue":null,"work_id":"d630545f-f585-4f4e-9df5-3cf265195470","year":2024},"citing_paper":{"arxiv_id":"2507.17585","last_updated":"2025-07-23T15:20:31Z","snapshot_observed_at":"2026-08-09T09:28:54.729548Z","submitted_at":"2025-07-23T15:20:31Z","title":"From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:55.966846Z"},"links":{"citing_paper":"/paper/2507.17585"},"observation_digest":"sha256:2268d2a4b64a40dbe86a1ee037eb107c45d4c1f2aa30b341236ecafcf76c5451","observation_id":"aa2766cf-05c2-4d04-9d8d-bebf3d7fefa5","resolution":{"observed_at":"2026-08-06T14:48:58.498815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:58.133626Z","title":"Where2explore: Few-shot affordance learning for unseen novel categories of articulated objects","venue":null,"work_id":"22853fe8-ed89-4c6c-a108-206a6ab3b0e8","year":2024},"citing_paper":{"arxiv_id":"2507.17585","last_updated":"2025-07-23T15:20:31Z","snapshot_observed_at":"2026-08-09T09:28:54.729548Z","submitted_at":"2025-07-23T15:20:31Z","title":"From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:56.048268Z"},"links":{"citing_paper":"/paper/2507.17585"},"observation_digest":"sha256:d9c5458df48fc496108c379b903950e4834309b5a66e20bd89ba2865a9025f29","observation_id":"e46f2edf-8231-4898-9d4f-3554398dcc3d","resolution":{"observed_at":"2026-08-06T14:48:58.246706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:57.833620Z","title":"GPT-4o mini: advancing cost-efficient intelligence","venue":null,"work_id":"89cdd31c-8cf7-4d3a-bf58-ef2d2727fbef","year":null},"citing_paper":{"arxiv_id":"2507.17585","last_updated":"2025-07-23T15:20:31Z","snapshot_observed_at":"2026-08-09T09:28:54.729548Z","submitted_at":"2025-07-23T15:20:31Z","title":"From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:56.135067Z"},"links":{"citing_paper":"/paper/2507.17585"},"observation_digest":"sha256:237d7bf9830405c4d3b6495f6fbc8b20a7d499ce2bfdf5dde4b8981f91c1c6f5","observation_id":"ca7887d3-0e1c-45b2-98d9-2474b1a8fbb9","resolution":{"observed_at":"2026-08-06T14:48:57.958074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:57.500861Z","title":"Hello GPT-4o","venue":null,"work_id":"9d696fc9-12f2-49b5-a842-112b1e4f9133","year":2024},"citing_paper":{"arxiv_id":"2507.17585","last_updated":"2025-07-23T15:20:31Z","snapshot_observed_at":"2026-08-09T09:28:54.729548Z","submitted_at":"2025-07-23T15:20:31Z","title":"From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:56.296103Z"},"links":{"citing_paper":"/paper/2507.17585"},"observation_digest":"sha256:89e7a8645240ae76337f2bb088132adaccfa5c56b78b95479075c548b83c0684","observation_id":"11e11179-79bd-4c99-b8f4-2e13cc161df4","resolution":{"observed_at":"2026-08-06T14:48:57.566052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02590","last_updated":"2025-05-12T01:53:46Z","snapshot_observed_at":"2026-08-09T21:27:51.827337Z","submitted_at":"2025-02-04T18:59:55Z","title":"Articulate AnyMesh: Open-Vocabulary 3D Articulated Objects Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02590","snapshot_observed_at":"2026-08-06T14:48:56.375837Z","title":"Articulate anymesh: Open-vocabulary 3d articulated objects modeling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17585","last_updated":"2025-07-23T15:20:31Z","snapshot_observed_at":"2026-08-09T09:28:54.729548Z","submitted_at":"2025-07-23T15:20:31Z","title":"From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:56.375837Z"},"links":{"cited_paper":"/paper/2502.02590","citing_paper":"/paper/2507.17585"},"observation_digest":"sha256:b9f53a47c99b2df30e3cfbd620deeececa8413dec4058ee720a66cb47a395e14","observation_id":"4fddc3a4-f89a-48fb-8718-07ac2842d47b","resolution":{"observed_at":"2026-08-06T14:48:56.375837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T14:48:56.460471Z","title":"Proximal policy optimiza- tion algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.17585","last_updated":"2025-07-23T15:20:31Z","snapshot_observed_at":"2026-08-09T09:28:54.729548Z","submitted_at":"2025-07-23T15:20:31Z","title":"From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:56.460471Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.17585"},"observation_digest":"sha256:e85d5ca72e8fb3da93243491db6b1862de1d990099d08431184803fef045b034","observation_id":"babb0fb0-9a91-4c17-b712-8fd46e5b5a02","resolution":{"observed_at":"2026-08-06T14:48:56.460471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:57.343519Z","title":"Rec- onciling Reality through Simulation: A Real-To-Sim-to-Real Approach for Robust Manipulation","venue":null,"work_id":"8b26cabf-85aa-4cda-b894-70bd4f9087f7","year":2024},"citing_paper":{"arxiv_id":"2507.17585","last_updated":"2025-07-23T15:20:31Z","snapshot_observed_at":"2026-08-09T09:28:54.729548Z","submitted_at":"2025-07-23T15:20:31Z","title":"From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:56.549977Z"},"links":{"citing_paper":"/paper/2507.17585"},"observation_digest":"sha256:2a891710804611c41d7957b835074e7444fdaef70fb9afa809595a783a6d25f7","observation_id":"3316de47-ee2b-49c5-a300-6f8605d9b2a0","resolution":{"observed_at":"2026-08-06T14:48:57.389672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:57.191455Z","title":"Neural implicit representation for building digital twins of unknown articulated objects","venue":null,"work_id":"4fad7f8f-6b7f-42e2-8286-990cad5282b1","year":2024},"citing_paper":{"arxiv_id":"2507.17585","last_updated":"2025-07-23T15:20:31Z","snapshot_observed_at":"2026-08-09T09:28:54.729548Z","submitted_at":"2025-07-23T15:20:31Z","title":"From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:56.653110Z"},"links":{"citing_paper":"/paper/2507.17585"},"observation_digest":"sha256:99925d80d77be4d162241c3ea0a564c1cc2c2220fd1779ca4f01310153e7b0f7","observation_id":"599a8057-81bf-4e44-a128-e55831029938","resolution":{"observed_at":"2026-08-06T14:48:57.258884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:57.020238Z","title":"Scannet++: A high-fidelity dataset of 3d indoor scenes","venue":null,"work_id":"1d91a3b0-ae54-45b7-a074-65ebab08ce4f","year":2023},"citing_paper":{"arxiv_id":"2507.17585","last_updated":"2025-07-23T15:20:31Z","snapshot_observed_at":"2026-08-09T09:28:54.729548Z","submitted_at":"2025-07-23T15:20:31Z","title":"From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:56.733671Z"},"links":{"citing_paper":"/paper/2507.17585"},"observation_digest":"sha256:d608ad7c8cb5622e7971d30ff86be7a3c2b7713dab8489c7813925a398715fcb","observation_id":"47a6b18e-fe15-406f-bacf-62469dbfac58","resolution":{"observed_at":"2026-08-06T14:48:57.084477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:57.663664Z","title":null,"venue":null,"work_id":"1bcafc09-d1a6-4bf9-922b-8a1c213358ab","year":2024},"citing_paper":{"arxiv_id":"2507.17585","last_updated":"2025-07-23T15:20:31Z","snapshot_observed_at":"2026-08-09T09:28:54.729548Z","submitted_at":"2025-07-23T15:20:31Z","title":"From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:56.202038Z"},"links":{"citing_paper":"/paper/2507.17585"},"observation_digest":"sha256:77b19d98921bd37124b7691bd1673c8352d417c7599fb478c8a5ec3fd6119986","observation_id":"24c6a90a-4d83-45d7-a782-1452bc194762","resolution":{"observed_at":"2026-08-06T14:48:57.721488Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.17585","last_updated":"2025-07-23T15:20:31Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T09:28:54.729548Z","submitted_at":"2025-07-23T15:20:31Z","title":"From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":4,"verified_exact":1,"verified_fuzzy":16},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 0 inbound Pith citation observations for arXiv:2507.17585."}