{"as_of":"2026-08-16T18:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:64677232ca786f9d890a509277f0583d06b06130eaa75f5e969b439e3fb83c81","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:35:20.069930Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T19:39:16.162199Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T17:49:59.931721Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24257","snapshot_observed_at":"2026-08-04T19:39:16.162199Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09154","last_updated":"2025-09-11T05:23:22Z","snapshot_observed_at":"2026-08-06T15:36:44.934159Z","submitted_at":"2025-09-11T05:23:22Z","title":"Mind Meets Space: Rethinking Agentic Spatial Intelligence from a Neuroscience-inspired Perspective","version":1},"reference_index":169,"source":"pdf_text","source_observed_at":"2026-08-04T19:39:16.162199Z"},"links":{"cited_paper":"/paper/2505.24257","citing_paper":"/paper/2509.09154"},"observation_digest":"sha256:f023749db231edaa1adf542308f22e9db8f9cfeaa68a44f30beb2f742903b4e4","observation_id":"101bdc7f-b9b1-4780-b22d-52aa5939f731","resolution":{"observed_at":"2026-08-04T19:39:16.162199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"cited_work":{"arxiv_id":"2505.24257","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24257","snapshot_observed_at":"2026-07-04T17:49:59.931721Z","title":"arXiv preprint arXiv:2505.24257 (2025), https://arxiv.org/abs/2505.242574","venue":null,"work_id":"3bb1e2b8-fa54-4659-af6b-36eaf46084ea","year":2025},"citing_paper":{"arxiv_id":"2604.22409","last_updated":"2026-05-29T04:03:02Z","snapshot_observed_at":"2026-08-13T16:50:51.534283Z","submitted_at":"2026-04-24T10:06:41Z","title":"SpaMEM: Benchmarking Dynamic Spatial Reasoning via Perception-Memory Integration in Embodied Environments","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-08T12:34:49.199471Z"},"links":{"cited_paper":"/paper/2505.24257","citing_paper":"/paper/2604.22409"},"observation_digest":"sha256:a721a3904b98052ce0b3fd35e08fd1a0deed138ce59cd9880da912c25630ae66","observation_id":"d150985a-831d-4cd3-9035-5e636074bcc4","resolution":{"observed_at":"2026-05-11T19:06:11.691203Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"cited_work":{"arxiv_id":"2505.24257","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24257","snapshot_observed_at":"2026-07-04T17:49:59.931721Z","title":"arXiv preprint arXiv:2505.24257 (2025), https://arxiv.org/abs/2505.242574","venue":null,"work_id":"3bb1e2b8-fa54-4659-af6b-36eaf46084ea","year":2025},"citing_paper":{"arxiv_id":"2604.22409","last_updated":"2026-05-29T04:03:02Z","snapshot_observed_at":"2026-08-13T16:50:51.534283Z","submitted_at":"2026-04-24T10:06:41Z","title":"SpaMEM: Benchmarking Dynamic Spatial Reasoning via Perception-Memory Integration in Embodied Environments","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-04T17:47:13.102516Z"},"links":{"cited_paper":"/paper/2505.24257","citing_paper":"/paper/2604.22409"},"observation_digest":"sha256:2f4343fc96954569415962aa28b8d1d206f8605515af078956bd46a2339ecec3","observation_id":"42bec9f8-b6b4-4110-8e6e-85f698c0c1ec","resolution":{"observed_at":"2026-07-04T17:49:59.933230Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.24257/citation-record","integrity":"/paper/2505.24257/integrity","json":"/paper/2505.24257/citation-record.json","paper":"/paper/2505.24257"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:15.899401Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:15.899401Z"},"links":{"citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:d2c1e7f2fc2d98aad502e4ef92f8de217a3fbfc21ff32d33a1772ce1168bfb86","observation_id":"c1df4f04-256e-4a12-91d3-e17be3633e7d","resolution":{"observed_at":"2026-08-07T12:35:15.899401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:15.995179Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:15.995179Z"},"links":{"citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:89f54070c08085689050ebc65dbd13b10ade8a50ff8367a83f3346bc5e791cb6","observation_id":"3c8997e6-ddc1-412b-a936-2c1e70857a35","resolution":{"observed_at":"2026-08-07T12:35:15.995179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-acl.908","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"0e2de1d9-d4a9-4e5f-9391-c016c699e702","year":2024},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:16.105924Z"},"links":{"citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:fce3a34fe857eceb09cd12bfe1392223956ac84fcddda8e0a778578b5e0a6370","observation_id":"2ae6b289-f377-4d2e-9018-4aa6a26a220f","resolution":{"observed_at":"2026-08-07T12:35:20.591961Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13642","last_updated":"2025-03-19T05:09:14Z","snapshot_observed_at":"2026-08-16T13:41:24.654042Z","submitted_at":"2024-06-19T15:41:30Z","title":"SpatialBot: Precise Spatial Understanding with Vision Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13642","snapshot_observed_at":"2026-08-07T12:35:16.202407Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:16.202407Z"},"links":{"cited_paper":"/paper/2406.13642","citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:bafbf081ee12eea3a713b3f156468e54a9e784876dbf86c39b1505385024f9ab","observation_id":"a02f28ca-6b43-4393-b617-ad0ba9419286","resolution":{"observed_at":"2026-08-07T12:35:16.202407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:22.834978Z","title":null,"venue":null,"work_id":"15440530-67a5-4c4f-9c75-660dff7f50e1","year":2024},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:16.314468Z"},"links":{"citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:894d7456d2c262cc7a5d582e8f63ffe590ec8aeafb0711f770a84d533ed79c52","observation_id":"de8eb4c3-90d4-47fa-bb7e-a9a69d7c66a4","resolution":{"observed_at":"2026-08-07T12:35:22.879638Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:16.441969Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:16.441969Z"},"links":{"citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:e907049d5640e0b312541a4da170deefc75dedae79aaf2bcc1ec9abd69badfc0","observation_id":"607fa2d7-aa7d-4284-bbf3-fd3301f72f14","resolution":{"observed_at":"2026-08-07T12:35:16.441969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:22.724339Z","title":null,"venue":null,"work_id":"81a132a2-4fc1-4c3a-ad3d-a6646a25e021","year":2023},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:16.556900Z"},"links":{"citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:85b77b574a937fbd2febe83953802c27eef7408e2c2c1764a5bf6d9a50b9ad70","observation_id":"2d6801a5-3065-4438-8c9b-5c423e241eb5","resolution":{"observed_at":"2026-08-07T12:35:22.780208Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:22.599831Z","title":null,"venue":null,"work_id":"96037e84-bd5e-4d95-b4a9-fbc34ade0c00","year":2018},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:16.671315Z"},"links":{"citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:1862a048e2b574828a5a5c4bc61e9b8e61875556801afbbceba8bfdba4630a53","observation_id":"f54c130c-f951-4ec7-b26a-6b985c5fb027","resolution":{"observed_at":"2026-08-07T12:35:22.663662Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:16.843509Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:16.843509Z"},"links":{"citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:6d7ddbf110069243a73af9f6d48fb7e2cb8aa8688c80176a86b78f3f6f1a3035","observation_id":"8fc8b8f4-375a-41c1-9a62-65e09f4b8670","resolution":{"observed_at":"2026-08-07T12:35:16.843509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21075","last_updated":"2025-05-30T13:08:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:59:47Z","title":"Video-MME: The First-Ever Comprehensive Evaluation Benchmark of Multi-modal LLMs in Video Analysis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21075","snapshot_observed_at":"2026-08-07T12:35:16.993134Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:16.993134Z"},"links":{"cited_paper":"/paper/2405.21075","citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:a22dd2890c97cf502f7e1855aabe3af9bb166168ab190ddb04faa39d408d91ac","observation_id":"dbddbca0-84da-4710-b7c4-3050595eb9dc","resolution":{"observed_at":"2026-08-07T12:35:16.993134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:22.474764Z","title":null,"venue":null,"work_id":"9c894698-c134-4893-bc4d-8c3fef58cf8b","year":2022},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:17.125902Z"},"links":{"citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:4a72f43e7044ea16ae45f3e96c326d0c1d905de58237d5eb5b29d4ba822d0b4d","observation_id":"9b25fd43-d96a-4a80-8740-db983e4dbb7d","resolution":{"observed_at":"2026-08-07T12:35:22.523815Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02955","last_updated":"2026-05-12T15:02:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-06T11:57:38Z","title":"MotionBench: Benchmarking and Improving Fine-grained Video Motion Understanding for Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02955","snapshot_observed_at":"2026-08-07T12:35:17.230520Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:17.230520Z"},"links":{"cited_paper":"/paper/2501.02955","citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:e435500cbbd475fe78e364b168cf0a01248e84c8c0fca07a52c79028020f6afe","observation_id":"8918b6ba-96ce-472d-9399-16ed01e35041","resolution":{"observed_at":"2026-08-07T12:35:17.230520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T12:35:17.359402Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:17.359402Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:82c3bdab79fb5814897f33bb8218a99f53c4eb33d1c8c3df9233e9b00ce1546c","observation_id":"eb89d23e-a168-4380-90df-ad42d1da8141","resolution":{"observed_at":"2026-08-07T12:35:17.359402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:22.333072Z","title":null,"venue":null,"work_id":"03d733d9-20d8-40ca-9226-00f51b75453c","year":2025},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:17.467108Z"},"links":{"citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:a067d1d2b1dea7d0c66f0d0e6affb4ea53dbea961d27eb2b6c6e1ced920c3477","observation_id":"641594ad-994d-4041-84b1-d7c1ca5d8d1b","resolution":{"observed_at":"2026-08-07T12:35:22.396801Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:22.215261Z","title":"what” and “where","venue":null,"work_id":"f523449e-3f40-436b-8391-f2d8d30a9f13","year":1993},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:17.607705Z"},"links":{"citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:fe46f3fefea0772fe8dd808b2e4522f5b2967c3d6ed374ad2a661daf65a7a43f","observation_id":"ddb352ee-a02f-48da-ad78-10eb824c87af","resolution":{"observed_at":"2026-08-07T12:35:22.266674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-07T12:35:17.712616Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:17.712616Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:13342db944e61dfc5f8f1152ea4d4065bf1610deac8651b2e1fe3ded53306249","observation_id":"2caffad4-d247-47d8-8d19-72917d1f1d27","resolution":{"observed_at":"2026-08-07T12:35:17.712616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:22.120583Z","title":null,"venue":null,"work_id":"188c13ca-20c1-46aa-a153-446b2df12c17","year":2024},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:17.802724Z"},"links":{"citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:262851c550617b7a06d93310880db3e19e633f9a735ffb8b7af8ab5c31bf86b1","observation_id":"962f5bfe-1aa1-4246-9535-3be41658c642","resolution":{"observed_at":"2026-08-07T12:35:22.171918Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-16T12:44:54.414224Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-08-07T12:35:17.956196Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:17.956196Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:6616832c8dc3476e348ded364789c769c9e045c41f20314320dfa6b6c7a8a474","observation_id":"292307aa-50aa-4b8e-ad88-d44a0372db00","resolution":{"observed_at":"2026-08-07T12:35:17.956196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00754","last_updated":"2024-11-21T18:52:31Z","snapshot_observed_at":"2026-08-16T13:29:08.779838Z","submitted_at":"2024-08-01T17:57:12Z","title":"Coarse Correspondences Boost Spatial-Temporal Reasoning in Multimodal Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00754","snapshot_observed_at":"2026-08-07T12:35:18.039306Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:18.039306Z"},"links":{"cited_paper":"/paper/2408.00754","citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:b09ad7be1d2c410b15261842622bc6585264393f6ce4dd05f36e771785d90603","observation_id":"68399f19-443a-4216-9391-869add710de0","resolution":{"observed_at":"2026-08-07T12:35:18.039306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:18.170925Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:18.170925Z"},"links":{"citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:b07a6305a32cba713591b62d6ca2fe3c076ba7a9b0a98fc8d1fc553dae10e641","observation_id":"021c3289-287d-4576-81e2-5117fd9cfc06","resolution":{"observed_at":"2026-08-07T12:35:18.170925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:21.988165Z","title":null,"venue":null,"work_id":"8cdc8b93-664c-411c-979a-b6a57ba7633c","year":2024},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:18.278541Z"},"links":{"citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:1a32af288ad65550b82d1ea9d378a66b0422b02974c21ad99ed01589129a7095","observation_id":"1689a9ba-50ae-441e-b045-de024cdc05a0","resolution":{"observed_at":"2026-08-07T12:35:22.041372Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:21.851366Z","title":null,"venue":null,"work_id":"54c6829c-f633-4638-9ffe-21af5ebb9752","year":2023},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:18.351356Z"},"links":{"citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:25daf109544b3579de05ea520a0a126a3269362a20629673ac62476e91bf2497","observation_id":"29b776a0-286c-4c27-9c3b-6024ca40b515","resolution":{"observed_at":"2026-08-07T12:35:21.923965Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:21.729231Z","title":"Newcombe","venue":null,"work_id":"f3ede4c8-9d2e-4cd7-b30e-513a8e0f016e","year":2024},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:18.485230Z"},"links":{"citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:c1268a2c43cf1bc11acfb7bc36212a29f472cfcaafef0c7e690740de30de5e11","observation_id":"45d25082-3dfd-4655-b6e1-7ed52ddf7010","resolution":{"observed_at":"2026-08-07T12:35:21.787856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16103","last_updated":"2023-11-28T18:16:29Z","snapshot_observed_at":"2026-08-16T14:39:55.654977Z","submitted_at":"2023-11-27T18:59:58Z","title":"Video-Bench: A Comprehensive Benchmark and Toolkit for Evaluating Video-based Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16103","snapshot_observed_at":"2026-08-07T12:35:18.562580Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:18.562580Z"},"links":{"cited_paper":"/paper/2311.16103","citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:3c792d800922fafcc3a73e79cfc1ac7c3e1e0024bc0382e7faff14c2ad6f1ac6","observation_id":"64cc6b8b-9e79-4452-8c8f-43cbbc82b203","resolution":{"observed_at":"2026-08-07T12:35:18.562580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11345","last_updated":"2025-03-14T12:21:26Z","snapshot_observed_at":"2026-08-16T12:50:02.273421Z","submitted_at":"2025-03-14T12:21:26Z","title":"EgoSplat: Open-Vocabulary Egocentric Scene Understanding with Language Embedded 3D Gaussian Splatting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11345","snapshot_observed_at":"2026-08-07T12:35:18.667952Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:18.667952Z"},"links":{"cited_paper":"/paper/2503.11345","citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:97caefe242cccaeb35a27197d1ce265a56c2a8bf0c6b1e0340cf904c691b5cab","observation_id":"c247fffc-2e12-47d7-bb92-50bb17d12841","resolution":{"observed_at":"2026-08-07T12:35:18.667952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.naacl-long.105","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"024b6682-d70b-48bb-acd6-95f85fbdd926","year":2024},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:18.757376Z"},"links":{"citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:c37bd018c89a7c2498552386adf3f61c2f30663cde0e655ccc952a2b8707b829","observation_id":"fa831099-4d4e-4cb3-9332-4e1ebc8a0e67","resolution":{"observed_at":"2026-08-07T12:35:20.396695Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:21.621420Z","title":null,"venue":null,"work_id":"d384d91f-7899-4e9d-b9a1-49d60766a025","year":2009},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:18.850530Z"},"links":{"citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:1b95fd328ec6eeae959b3afa08d3b60ecaa3fd22d9c0d839f73695df2e6beab5","observation_id":"f05b21c1-1d15-452f-86db-053e3882a44c","resolution":{"observed_at":"2026-08-07T12:35:21.667501Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-emnlp.649","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Part, Ioannis Papaioannou, Arash Eshghi, Ioannis Konstas, and Oliver Lemon","venue":null,"work_id":"e7b8cdc4-cc18-4aa2-96f9-05dfa67b4319","year":2024},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:18.929337Z"},"links":{"citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:e2d5a40c42c7033bbdccb5599b6c70471040f6a2384c911e77f8a61beda75ab4","observation_id":"f24b02b5-07eb-49ea-a185-794767cc69ec","resolution":{"observed_at":"2026-08-07T12:35:20.250837Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-08-14T18:15:53.516440Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T12:35:19.045072Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:19.045072Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:672336ff8bd6c0537b208481168945e749f7c957c8b469fae5f5e98a833cb038","observation_id":"21dc22f5-b8fc-4ad2-9110-bb8f96481437","resolution":{"observed_at":"2026-08-07T12:35:19.045072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.14258","last_updated":"2021-09-30T18:02:23Z","snapshot_observed_at":"2026-08-16T18:36:12.003499Z","submitted_at":"2021-03-26T04:43:04Z","title":"Learning to Track with Object Permanence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.14258","snapshot_observed_at":"2026-08-07T12:35:19.124162Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:19.124162Z"},"links":{"cited_paper":"/paper/2103.14258","citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:36ef2738c5e3859c70c8c7b10dbead4c05b472d0e279a7c98bea3ab639d5ca2c","observation_id":"e5b0e286-2158-4ce8-9709-251078985dc8","resolution":{"observed_at":"2026-08-07T12:35:19.124162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T12:35:19.191392Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:19.191392Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:2018405995ee71571dc4722c1843f67e1c61c6f520bb7d97e89c9571ea14bf49","observation_id":"07aea13a-23aa-4eb9-adc2-af4fea87ce9a","resolution":{"observed_at":"2026-08-07T12:35:19.191392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:21.503657Z","title":"Spelke, Frances Ranxiao, and Wang","venue":null,"work_id":"d01a6931-70b4-4061-bdd8-e76b5d615c2f","year":2002},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:19.307637Z"},"links":{"citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:65100bc2c4f3a8a0cf33153efbd07d2979ce26719143c6c620a3f5f415018ef2","observation_id":"61383a7d-f345-47fe-a115-7a9a6573a9d5","resolution":{"observed_at":"2026-08-07T12:35:21.556160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10188","last_updated":"2024-12-13T02:32:06Z","snapshot_observed_at":"2026-08-16T04:27:36.181491Z","submitted_at":"2024-08-19T17:48:08Z","title":"LongVILA: Scaling Long-Context Visual Language Models for Long Videos","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10188","snapshot_observed_at":"2026-08-07T12:35:19.402144Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:19.402144Z"},"links":{"cited_paper":"/paper/2408.10188","citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:b2983cebdd28df93665fd7b93c413140d4c440699200fca73790ad41afb94089","observation_id":"1a27a710-b5f4-41e5-9d5d-e78a4c032497","resolution":{"observed_at":"2026-08-07T12:35:19.402144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11441","last_updated":"2023-11-06T07:39:49Z","snapshot_observed_at":"2026-08-12T21:25:32.312122Z","submitted_at":"2023-10-17T17:51:31Z","title":"Set-of-Mark Prompting Unleashes Extraordinary Visual Grounding in GPT-4V","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11441","snapshot_observed_at":"2026-08-07T12:35:19.493634Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:19.493634Z"},"links":{"cited_paper":"/paper/2310.11441","citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:77bd227350584f5ab9059aa5334eb1a89bc8fb50e2cfa796b5637afdf16fcaf8","observation_id":"696499ed-097f-428f-9e0d-8d269e8e2a7e","resolution":{"observed_at":"2026-08-07T12:35:19.493634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:21.369756Z","title":null,"venue":null,"work_id":"36f357da-151d-444f-ba41-c90b2a0c19b1","year":2024},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:19.580898Z"},"links":{"citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:636912ada6854f5a2b65072d85f09b3c147ed1669eccc386b80b8300f3357cb6","observation_id":"65b8fd3d-f386-4265-9fa1-1527edb8d324","resolution":{"observed_at":"2026-08-07T12:35:21.438484Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14171","last_updated":"2025-07-02T21:00:36Z","snapshot_observed_at":"2026-08-14T22:29:28.847917Z","submitted_at":"2024-12-18T18:59:54Z","title":"Thinking in Space: How Multimodal Large Language Models See, Remember, and Recall Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14171","snapshot_observed_at":"2026-08-07T12:35:19.670582Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:19.670582Z"},"links":{"cited_paper":"/paper/2412.14171","citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:9f79b78468f88f61ee9e0d51bf4a46f7d2675f587b5753091d0d68c63679180a","observation_id":"76ba3cf8-36d9-43a8-88d2-a4a7ab3297d8","resolution":{"observed_at":"2026-08-07T12:35:19.670582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:21.200243Z","title":null,"venue":null,"work_id":"f4ac8625-8e73-44b4-8438-31fdd6008313","year":2024},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:19.765700Z"},"links":{"citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:4677160b5edc41a9691939061c19269b06b95ac2ad6e6b5741b8f748085a441b","observation_id":"5807e897-3a23-4b75-9f96-1bb60033d704","resolution":{"observed_at":"2026-08-07T12:35:21.276197Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15037","last_updated":"2025-06-03T08:29:23Z","snapshot_observed_at":"2026-08-16T11:32:38.450516Z","submitted_at":"2025-04-21T11:48:39Z","title":"Scaling and Beyond: Advancing Spatial Reasoning in MLLMs Requires New Recipes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15037","snapshot_observed_at":"2026-08-07T12:35:19.838336Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:19.838336Z"},"links":{"cited_paper":"/paper/2504.15037","citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:58e77238d4da15613c68ef3d705bfd01e8b094e669ce40f3391b92be4580d00d","observation_id":"d53d132d-96fb-4e93-88c5-ec371e804f19","resolution":{"observed_at":"2026-08-07T12:35:19.838336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:21.050568Z","title":null,"venue":null,"work_id":"84bd52b1-9d11-4fd5-888b-78e928b6a28b","year":2024},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:19.912321Z"},"links":{"citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:a5c99282d659a9a2a9d135176867549092872c088cf39f068fa630d02f21ab96","observation_id":"3e622cc6-2957-4461-9695-cfa5ae4cfc4e","resolution":{"observed_at":"2026-08-07T12:35:21.099967Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:19.988511Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:19.988511Z"},"links":{"citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:5cc0055d9538e77ddf7fd725ab11447869c22c1123039962035079d5e95938b0","observation_id":"2bd18a94-cd19-4feb-b1c7-cd134dfab159","resolution":{"observed_at":"2026-08-07T12:35:19.988511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18125","last_updated":"2025-04-27T06:50:23Z","snapshot_observed_at":"2026-08-16T13:15:01.097068Z","submitted_at":"2024-09-26T17:59:11Z","title":"LLaVA-3D: A Simple yet Effective Pathway to Empowering LMMs with 3D-awareness","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18125","snapshot_observed_at":"2026-08-07T12:35:20.069930Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:20.069930Z"},"links":{"cited_paper":"/paper/2409.18125","citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:562f9c52839397e5b6e947da46942d571f5ddec505304c7bb32de7df733ef5df","observation_id":"e9eba971-990b-4037-98c2-afd389d58a14","resolution":{"observed_at":"2026-08-07T12:35:20.069930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T16:57:27.213555Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":3,"verified_fuzzy":3},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 3 inbound Pith citation observations for arXiv:2505.24257."}