{"as_of":"2026-08-19T11:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5d1ca02626e31f0317278e2499fbffa63856b333b3a83de4c455972b0219f060","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T04:59:39.999600Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T03:36:29.315436Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2205.00363","last_updated":"2023-03-22T15:42:50Z","snapshot_observed_at":"2026-08-16T17:03:26.678147Z","submitted_at":"2022-04-30T23:03:49Z","title":"Visual Spatial Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.00363","snapshot_observed_at":"2026-08-11T04:59:39.999600Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18224","last_updated":"2024-12-24T07:13:17Z","snapshot_observed_at":"2026-08-15T04:42:40.391400Z","submitted_at":"2024-12-24T07:13:17Z","title":"Expand VSR Benchmark for VLLM to Expertize in Spatial Rules","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T04:59:39.999600Z"},"links":{"cited_paper":"/paper/2205.00363","citing_paper":"/paper/2412.18224"},"observation_digest":"sha256:e31423453cccf4aa259881a097ab3bc0186639a8792a47bc17f6b8b19904d8ae","observation_id":"e4212fd5-fa7b-476d-889f-a33958c21491","resolution":{"observed_at":"2026-08-11T04:59:39.999600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.00363","last_updated":"2023-03-22T15:42:50Z","snapshot_observed_at":"2026-08-16T17:03:26.678147Z","submitted_at":"2022-04-30T23:03:49Z","title":"Visual Spatial Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.00363","snapshot_observed_at":"2026-08-10T21:10:18.996958Z","title":"Visual spatial reasoning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.05901","last_updated":"2025-01-13T02:34:19Z","snapshot_observed_at":"2026-08-14T04:25:59.263298Z","submitted_at":"2025-01-10T11:53:46Z","title":"Valley2: Exploring Multimodal Models with Scalable Vision-Language Design","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T21:10:18.996958Z"},"links":{"cited_paper":"/paper/2205.00363","citing_paper":"/paper/2501.05901"},"observation_digest":"sha256:a76b4a925fd9614172be891df3cfff5041f06241113d14d21ce65da9bf01672a","observation_id":"b87fee95-0856-495a-8e22-3c68b60d4298","resolution":{"observed_at":"2026-08-10T21:10:18.996958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.00363","last_updated":"2023-03-22T15:42:50Z","snapshot_observed_at":"2026-08-16T17:03:26.678147Z","submitted_at":"2022-04-30T23:03:49Z","title":"Visual Spatial Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.00363","snapshot_observed_at":"2026-08-06T19:54:48.062289Z","title":"Visual spatial reasoning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13362","last_updated":"2025-07-06T10:51:12Z","snapshot_observed_at":"2026-08-14T19:11:09.144427Z","submitted_at":"2025-07-06T10:51:12Z","title":"Enhancing Spatial Reasoning in Vision-Language Models via Chain-of-Thought Prompting and Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:48.062289Z"},"links":{"cited_paper":"/paper/2205.00363","citing_paper":"/paper/2507.13362"},"observation_digest":"sha256:5f66977ce174115934cf4435ec16436dc94a72b69846bc23d265a0b268673712","observation_id":"660692e1-7f6f-4f16-a9a7-57b0b0c008ba","resolution":{"observed_at":"2026-08-06T19:54:48.062289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.00363","last_updated":"2023-03-22T15:42:50Z","snapshot_observed_at":"2026-08-16T17:03:26.678147Z","submitted_at":"2022-04-30T23:03:49Z","title":"Visual Spatial Reasoning","version":3},"cited_work":{"arxiv_id":"2205.00363","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.00363","snapshot_observed_at":"2026-07-02T03:36:29.315436Z","title":"Visual spatial reasoning","venue":null,"work_id":"404d74c4-a16d-48b5-93c2-a7876fb1c36e","year":2022},"citing_paper":{"arxiv_id":"2605.18746","last_updated":"2026-05-25T08:34:52Z","snapshot_observed_at":"2026-08-13T04:10:30.913352Z","submitted_at":"2026-05-18T17:59:02Z","title":"ESI-Bench: Towards Embodied Spatial Intelligence that Closes the Perception-Action Loop","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T10:52:22.778489Z"},"links":{"cited_paper":"/paper/2205.00363","citing_paper":"/paper/2605.18746"},"observation_digest":"sha256:29239617cb2989aded7e33e2d7f2f6ec7e94a6b7af16ae971955bbf4097dce24","observation_id":"930a480e-c318-4cff-8405-3e955752ee41","resolution":{"observed_at":"2026-05-20T10:53:13.203023Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.00363","last_updated":"2023-03-22T15:42:50Z","snapshot_observed_at":"2026-08-16T17:03:26.678147Z","submitted_at":"2022-04-30T23:03:49Z","title":"Visual Spatial Reasoning","version":3},"cited_work":{"arxiv_id":"2205.00363","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.00363","snapshot_observed_at":"2026-07-02T03:36:29.315436Z","title":"Visual spatial reasoning","venue":null,"work_id":"404d74c4-a16d-48b5-93c2-a7876fb1c36e","year":2022},"citing_paper":{"arxiv_id":"2605.18746","last_updated":"2026-05-25T08:34:52Z","snapshot_observed_at":"2026-08-13T04:10:30.913352Z","submitted_at":"2026-05-18T17:59:02Z","title":"ESI-Bench: Towards Embodied Spatial Intelligence that Closes the Perception-Action Loop","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T18:25:17.831116Z"},"links":{"cited_paper":"/paper/2205.00363","citing_paper":"/paper/2605.18746"},"observation_digest":"sha256:1397aded29f9188d3e31c9efcab7793a717f3fa1587a703bdbfccdd5502a2ef0","observation_id":"a3cc8f74-b0ca-4e8d-9efc-44f4c07c7dfc","resolution":{"observed_at":"2026-07-01T15:05:47.179017Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.00363","last_updated":"2023-03-22T15:42:50Z","snapshot_observed_at":"2026-08-16T17:03:26.678147Z","submitted_at":"2022-04-30T23:03:49Z","title":"Visual Spatial Reasoning","version":3},"cited_work":{"arxiv_id":"2205.00363","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.00363","snapshot_observed_at":"2026-07-02T03:36:29.315436Z","title":"Visual spatial reasoning","venue":null,"work_id":"404d74c4-a16d-48b5-93c2-a7876fb1c36e","year":2022},"citing_paper":{"arxiv_id":"2605.21642","last_updated":"2026-05-20T18:55:16Z","snapshot_observed_at":"2026-08-18T09:46:06.144403Z","submitted_at":"2026-05-20T18:55:16Z","title":"Ablate-to-Validate: Are Vision-Language Models Really Using Continuous Thought Tokens?","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-22T09:17:02.856444Z"},"links":{"cited_paper":"/paper/2205.00363","citing_paper":"/paper/2605.21642"},"observation_digest":"sha256:8df64d344ec1ba03c68482daa05796579f2f66e47dffdacf3edd3c6c60153de2","observation_id":"cc05d644-998e-4048-8566-ef62ac20e6a3","resolution":{"observed_at":"2026-05-22T09:24:46.733273Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.00363","last_updated":"2023-03-22T15:42:50Z","snapshot_observed_at":"2026-08-16T17:03:26.678147Z","submitted_at":"2022-04-30T23:03:49Z","title":"Visual Spatial Reasoning","version":3},"cited_work":{"arxiv_id":"2205.00363","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.00363","snapshot_observed_at":"2026-07-02T03:36:29.315436Z","title":"Visual spatial reasoning","venue":null,"work_id":"404d74c4-a16d-48b5-93c2-a7876fb1c36e","year":2022},"citing_paper":{"arxiv_id":"2606.03988","last_updated":"2026-06-03T04:16:22Z","snapshot_observed_at":"2026-08-15T12:04:32.061180Z","submitted_at":"2026-06-02T17:59:17Z","title":"Imaginative Perception Tokens Enhance Spatial Reasoning in Multimodal Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T09:56:05.047862Z"},"links":{"cited_paper":"/paper/2205.00363","citing_paper":"/paper/2606.03988"},"observation_digest":"sha256:aa022815a94497883cc403f9296e7c77f830855282d3d7f31433c821b35904c7","observation_id":"876be2bb-6beb-4ad1-a6d6-2ecb23f3aca4","resolution":{"observed_at":"2026-07-02T03:36:29.317195Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.00363","last_updated":"2023-03-22T15:42:50Z","snapshot_observed_at":"2026-08-16T17:03:26.678147Z","submitted_at":"2022-04-30T23:03:49Z","title":"Visual Spatial Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.00363","snapshot_observed_at":"2026-07-12T11:31:14.532101Z","title":"Visual spatial reasoning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.02551","last_updated":"2026-06-26T16:05:57Z","snapshot_observed_at":"2026-08-17T17:47:52.705809Z","submitted_at":"2026-06-26T16:05:57Z","title":"DELTAVID: Enhancing Fine-Grained Spatiotemporal Perception with Cross-Video Differences","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-12T11:31:14.532101Z"},"links":{"cited_paper":"/paper/2205.00363","citing_paper":"/paper/2607.02551"},"observation_digest":"sha256:12592d306cc1a64fd4f12e7587763749b3c642ff0c44d137faa55f0d43d9e1f5","observation_id":"5b06c5fe-346d-4cc1-94ea-82f67970a17f","resolution":{"observed_at":"2026-07-12T11:31:14.532101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2205.00363/citation-record","integrity":"/paper/2205.00363/integrity","json":"/paper/2205.00363/citation-record.json","paper":"/paper/2205.00363"},"outbound":[],"paper":{"arxiv_id":"2205.00363","last_updated":"2023-03-22T15:42:50Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T17:03:26.678147Z","submitted_at":"2022-04-30T23:03:49Z","title":"Visual Spatial Reasoning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2205.00363."}