{"as_of":"2026-08-10T14:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7cf3e9dc94c16751a275edd7e2f9d4fd823f37b08fb5de38647740ce6a8bbb17","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:22:35.417608Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04759/citation-record","integrity":"/paper/2608.04759/integrity","json":"/paper/2608.04759/citation-record.json","paper":"/paper/2608.04759"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:31.080406Z","title":"Aho and Jeffrey D","venue":null,"work_id":null,"year":1972},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.080406Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:58a6b4fc1c6b5cab9c4a44467567e1de1b49222e6b54b05dfd8ca090b7828cb2","observation_id":"5be2299a-f721-4ec1-8309-150a2b810c77","resolution":{"observed_at":"2026-08-06T17:22:31.080406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:31.139121Z","title":null,"venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.139121Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:7de3752bd1ff1dbf0955ac3c140cfeb5b486ac4623cade6f1292033b60980900","observation_id":"8d7ec0fe-a125-422b-82f0-4120a930e7db","resolution":{"observed_at":"2026-08-06T17:22:31.139121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:31.199238Z","title":"Chandra and Dexter C","venue":null,"work_id":null,"year":1981},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.199238Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:7d5745e70463b2401ffe04d87d818d01ec30936478a5d3d2d302641097a278ee","observation_id":"84136e11-a39b-45fe-951b-dc0a05ec5328","resolution":{"observed_at":"2026-08-06T17:22:31.199238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:31.255551Z","title":"Scalable training of","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.255551Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:47d22a57a2fa232bbfc5ed1f93dc321daca7deef7f7d4005ba49fff827862b5e","observation_id":"cf6c0830-59e2-4108-9875-6db0f12dabd4","resolution":{"observed_at":"2026-08-06T17:22:31.255551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:31.294351Z","title":null,"venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.294351Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:f0930de6a46a0373965859e2f9e3f03e54eda582460e7165f244144833615ad5","observation_id":"2b74ec59-d5d4-4d31-8d50-ff92a84d22e4","resolution":{"observed_at":"2026-08-06T17:22:31.294351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:31.369726Z","title":"Tetreault , title =","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.369726Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:de5197bbb2ab4e549607b2d0bbd06ce60b836c794b1a6875f1076a13a6ba8e62","observation_id":"a8e5cb42-981f-44bf-a48b-9bb896913c2f","resolution":{"observed_at":"2026-08-06T17:22:31.369726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:31.425996Z","title":"A Framework for Learning Predictive Structures from Multiple Tasks and Unlabeled Data , Volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.425996Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:387a065b44d2f52a373fbbff8dbbeb41ed2282dc8ee300132318f713acfc836d","observation_id":"722fb0ff-3343-42dc-aea2-91bf5e1dee9d","resolution":{"observed_at":"2026-08-06T17:22:31.425996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:39.639586Z","title":"ACM Computing Surveys , volume=","venue":null,"work_id":"18c3c86c-ba21-49a2-bbbf-515a57bbc0d1","year":2025},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.489562Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:67dc079486f9df33c88d74a1c92bcda3e09a152f560122e1e09326a8baaa347d","observation_id":"6c538dbb-f1be-4725-a8b2-bf06baf624b1","resolution":{"observed_at":"2026-08-06T17:22:39.692827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:39.514361Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"98ec8646-5523-4294-ae8b-1afd1276931d","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.526543Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:c3e84b41a524eeb2412b4a0edd3de1d4bf0536d674a5f6d2586d61921b189053","observation_id":"8bad8126-4349-4e09-8cee-8c97f0d1c9d6","resolution":{"observed_at":"2026-08-06T17:22:39.569113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.08758","last_updated":"2026-06-29T18:48:00Z","snapshot_observed_at":"2026-08-06T02:33:07.002390Z","submitted_at":"2026-01-13T17:42:27Z","title":"M3CoTBench: Benchmark Chain-of-Thought of MLLMs in Medical Image Understanding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.08758","snapshot_observed_at":"2026-08-06T17:22:31.612375Z","title":"arXiv preprint arXiv:2601.08758 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.612375Z"},"links":{"cited_paper":"/paper/2601.08758","citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:b9315d09f508045f7b770305b14785f5768d4eec6c08e9cc18da8698b3ba099c","observation_id":"e0cf3826-eafb-48e3-947e-111aaeaaa301","resolution":{"observed_at":"2026-08-06T17:22:31.612375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:39.374981Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":"2c82f157-c4f6-440a-9dd9-9a0002546267","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.647200Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:cc9564716c02db65494ae768d9ed6da5c6ba47bcdaec497510bf45677711af37","observation_id":"f367b28e-03b8-4f75-b200-54eba89f48a0","resolution":{"observed_at":"2026-08-06T17:22:39.431434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:31.694970Z","title":"arXiv preprint arXiv:2602.04486 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.694970Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:0aee7640798244f8fdf8821f54054a9714fcd603dc624cf661255e7217dd3cb5","observation_id":"888ad18b-240e-444c-8c56-1e133ef24a0d","resolution":{"observed_at":"2026-08-06T17:22:31.694970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:39.243298Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages=","venue":null,"work_id":"0190574a-7395-4b8f-969e-93faa599a56f","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.788965Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:4de1e48110f8bc73446b82b6226e795d00b1723c0e19451ddce4f9152226491c","observation_id":"d044efa0-8084-41f7-a07b-ab5ec757a29b","resolution":{"observed_at":"2026-08-06T17:22:39.298602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:31.826864Z","title":"arXiv preprint arXiv:2601.11659 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.826864Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:449cd69732e15c9322df7789707eca041774b523bb8854e71c1f9367163fa658","observation_id":"d85f94cc-f080-43e1-ac2b-8d3b495b2767","resolution":{"observed_at":"2026-08-06T17:22:31.826864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.25979","last_updated":"2026-05-25T15:54:04Z","snapshot_observed_at":"2026-07-06T23:35:50.787324Z","submitted_at":"2026-05-25T15:54:04Z","title":"LLaVA-OneVision-2: Towards Next-Generation Perceptual Intelligence","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.25979","snapshot_observed_at":"2026-08-06T17:22:31.939898Z","title":"arXiv preprint arXiv:2605.25979 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.939898Z"},"links":{"cited_paper":"/paper/2605.25979","citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:7e6c4c4e4f1e43c13c21db0722ca36465d795393c13249bf6cc641e89cabcd38","observation_id":"e5460fb8-f207-4ee5-bc9f-a1a267c7fb62","resolution":{"observed_at":"2026-08-06T17:22:31.939898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:32.003696Z","title":"arXiv preprint arXiv:2509.06266 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.003696Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:0ffff956a2d3fc8dad66aebba7096635e3a24bb8a33a3b85c3f27258c8bb4451","observation_id":"7d9e88d4-7c8e-4ab7-bb62-357ac24e0047","resolution":{"observed_at":"2026-08-06T17:22:32.003696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:32.041786Z","title":"arXiv preprint arXiv:2512.16561 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.041786Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:f9b6c49b70e1f9387dc0017c7616a5ff5890206ada6c9b9c95ca5f8e9a0c9ad9","observation_id":"056a02c2-7874-4f77-91b8-221bd6bde87c","resolution":{"observed_at":"2026-08-06T17:22:32.041786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:39.130480Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages=","venue":null,"work_id":"74addedb-a618-496d-bdbd-a3d9bcce998b","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.130080Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:4d25debf799e2e5b6ada340fd2e54741d2ff41bae67960e1e7e0ccb7a4382dec","observation_id":"118d4e22-7421-4b0f-8aa6-427b552c60f8","resolution":{"observed_at":"2026-08-06T17:22:39.184414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:39.019710Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"8e189756-0a5c-4449-bbe5-4a912bf85e1e","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.188582Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:7bbfdf0368cb02e073dc0fc32599b2516465f4dc140a86ddcc906be9c4a9c4ee","observation_id":"e99f9e4b-6cf3-402d-af7e-2b3c17c37488","resolution":{"observed_at":"2026-08-06T17:22:39.073644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:38.880787Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":"02cee432-9287-46ac-8b22-3044d948d0b2","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.269406Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:05ca9d8663f42dcdb12590b354d123f36d57fd33bce3dade355cd17e2fb29480","observation_id":"45dc518e-32ed-4bcc-ab70-47a8c16b3931","resolution":{"observed_at":"2026-08-06T17:22:38.933856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:38.692404Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"66ae2848-a2a9-412a-8c2d-7fe56195ea65","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.392307Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:cb3991d680d7c3f105fdc0b969a562d67408c510e062ebcb3f9bc5b109f58da1","observation_id":"b1871c32-418a-4107-ad59-c7d66c9dde88","resolution":{"observed_at":"2026-08-06T17:22:38.784033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:38.540409Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages=","venue":null,"work_id":"344f4984-eede-4e4d-a345-8bd5ace815a4","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.479508Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:8241872f5fa94e71074207a2a1a5581972e10a276cf966982244b36fe5866159","observation_id":"247693e8-9b14-4530-b3b4-47c81516523a","resolution":{"observed_at":"2026-08-06T17:22:38.611525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:38.447949Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"198ca9d6-5871-431a-aeeb-963f840d47c4","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.535871Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:f4da979e3ad269f12fc4e0e3e540e30df4fd277333a2cf3d6c09e6722f1c8687","observation_id":"5f224dbf-ef03-469e-8e2c-8b60aad3d86a","resolution":{"observed_at":"2026-08-06T17:22:38.478761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:32.607464Z","title":"arXiv preprint arXiv:2509.16087 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.607464Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:554e9b60f2ecf03e0c80ad8d06139f98f9a1d696d9601c635f6a0407941b2184","observation_id":"140df947-3c4d-4997-bcf3-3236940b954e","resolution":{"observed_at":"2026-08-06T17:22:32.607464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:38.367701Z","title":"Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"8bbe3ee4-a460-44cb-b7f2-33869ca21c96","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.676013Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:3685e1381e42c68146b070ad08ee3294cc865e40ff4d412259fece4660b56c62","observation_id":"f27169ca-91aa-4429-bee9-d2b487b48779","resolution":{"observed_at":"2026-08-06T17:22:38.403166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:32.763559Z","title":"arXiv preprint arXiv:2602.07833 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.763559Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:357bd82f8db2717428c7d4ad704e53d92d423651345578da677e329caa6a1a52","observation_id":"ab4145a8-5cb9-459a-a510-d730161d377c","resolution":{"observed_at":"2026-08-06T17:22:32.763559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:38.271128Z","title":"Findings of the Association for Computational Linguistics: ACL 2026 , pages=","venue":null,"work_id":"10dcd688-8be2-44c9-a317-5e86709c7151","year":2026},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.878405Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:dafc6ccc224bb67681fcd071023014f04bfe6533ceb8f26ce0c273dba08df185","observation_id":"dd9e4f0a-cee7-4657-a1e1-ff18bb8f8b23","resolution":{"observed_at":"2026-08-06T17:22:38.318990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:32.999630Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.999630Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:d135bb8ad3ff8bb4d02c453e729bf4856c9bfe653cebf5d4c2eb41a96d333e49","observation_id":"0e5f81b5-4b01-499c-8048-448ded90800d","resolution":{"observed_at":"2026-08-06T17:22:32.999630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:33.109218Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:33.109218Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:3c2e844571d0b75f179af57673632049f4abdf18a6f7fa94839159c25cda839b","observation_id":"7e3b74ab-fbf6-48a0-8573-d6d58437ca25","resolution":{"observed_at":"2026-08-06T17:22:33.109218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:38.139304Z","title":"ICRA 2025 Workshop: Human-Centered Robot Learning in the Era of Big Data and Large Models , year=","venue":null,"work_id":"44803311-0e46-4945-b0ac-892d98497e6d","year":2025},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:33.187354Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:47d1892da3f889d49255c6af4c4b340ee164e1dd75cdde084c3b382de19ff728","observation_id":"3dee3c6c-56db-4df7-8742-8bd5573df326","resolution":{"observed_at":"2026-08-06T17:22:38.184767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:37.990561Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"ece54fd5-a37b-407c-94a5-8dff6a364334","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:33.272945Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:ab3b1f216de9a28bd65c8f1c215bc3279a98a56f6cc9853d303c5ea37fc36568","observation_id":"122ba67e-93a3-4206-be47-c217e2b8d109","resolution":{"observed_at":"2026-08-06T17:22:38.061972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11441","last_updated":"2023-11-06T07:39:49Z","snapshot_observed_at":"2026-08-04T03:29:49.409446Z","submitted_at":"2023-10-17T17:51:31Z","title":"Set-of-Mark Prompting Unleashes Extraordinary Visual Grounding in GPT-4V","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11441","snapshot_observed_at":"2026-08-06T17:22:33.391898Z","title":"arXiv preprint arXiv:2310.11441 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:33.391898Z"},"links":{"cited_paper":"/paper/2310.11441","citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:be6dfc787acf3177de49e5ee3418b274ce92a9d22efc1d2730b5bc9126867d27","observation_id":"bdd95ac7-d3f7-40ff-be9b-ab3dd3dc1e38","resolution":{"observed_at":"2026-08-06T17:22:33.391898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.06663","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:36.099697Z","title":"arXiv preprint arXiv:2603.06663 , year=","venue":null,"work_id":"461b5454-6cc2-46e0-b382-31e3ebf4fcb8","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:33.503601Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:245495e427e64e7939c58f845e3ca1941d2031c9ec93018a974d7017feade574","observation_id":"17303e19-1c60-4a2b-878d-085eeb5b87a5","resolution":{"observed_at":"2026-08-06T17:22:36.124898Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11779","last_updated":"2025-02-23T15:14:47Z","snapshot_observed_at":"2026-08-10T13:18:33.995677Z","submitted_at":"2024-10-15T16:57:44Z","title":"MLLM can see? Dynamic Correction Decoding for Hallucination Mitigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11779","snapshot_observed_at":"2026-08-06T17:22:33.626317Z","title":"arXiv preprint arXiv:2410.11779 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:33.626317Z"},"links":{"cited_paper":"/paper/2410.11779","citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:5696a7f978c2322c2699edc86d45609353c1beded034db3c62b64467d99e7c37","observation_id":"92afc358-f664-430e-a548-9a712500d23c","resolution":{"observed_at":"2026-08-06T17:22:33.626317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:37.878885Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":"11353afc-5201-4a7b-811c-95e091393aa5","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:33.695598Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:341bcd1f82fa832ddb23e26cb3d5d52f1d100388f914026d2bcb47f10eba38f9","observation_id":"c0695129-3bbe-4115-99fa-b240cccfe967","resolution":{"observed_at":"2026-08-06T17:22:37.925589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:37.788062Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"b48d1147-2e33-4233-a4e9-d326ca05c4c6","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:33.773296Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:7c7ac48d3ef247e76b6ee88238dd37f33642319b03a69d0c39991b73fa0937d0","observation_id":"e1d3bf70-c276-475b-a3a1-9b24e42109b0","resolution":{"observed_at":"2026-08-06T17:22:37.834207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:33.835555Z","title":"arXiv preprint arXiv:2508.00378 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:33.835555Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:4be73df29022828b569d39017737e878b3a40ec299a2131b8120f15afa55d7ad","observation_id":"de28aa3f-aa18-4cf5-a38e-9777b799c0a3","resolution":{"observed_at":"2026-08-06T17:22:33.835555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:33.912921Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:33.912921Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:fee80b709aac0b8ace05251518c147840f37ff52c510749c2f5de583906af209","observation_id":"15adbcb8-b524-440e-a0ce-a324a0791e7f","resolution":{"observed_at":"2026-08-06T17:22:33.912921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:37.567909Z","title":null,"venue":null,"work_id":"3972af12-e935-4f2a-98c9-882cd0ca0f5d","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:33.971096Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:7e0a4e36c77f294a46f93842d99b99607b8da1733c0c047a760fcfc9109c7588","observation_id":"b6c3fc76-1e7a-4dd2-9a0f-717aa9e795d9","resolution":{"observed_at":"2026-08-06T17:22:37.658623Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:34.045096Z","title":"Proceedings of the 2023 conference on empirical methods in natural language processing , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:34.045096Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:7c97f599ab5ecb644af4a39fc72ea0fbc01d6b816a14569dc039e0f021cb7357","observation_id":"78d72f53-3c8d-4094-8938-40cc9f624151","resolution":{"observed_at":"2026-08-06T17:22:34.045096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:34.126253Z","title":"Proceedings of the IEEE/CVF conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:34.126253Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:cd23a99a132f76b51b1c88f64b413d616ca616e1f26bd72cf52c798fd7e62324","observation_id":"1ec12373-fb50-49b7-acc9-b8871e71bf2f","resolution":{"observed_at":"2026-08-06T17:22:34.126253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:34.191686Z","title":"Findings of the Association for Computational Linguistics: ACL 2024 , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:34.191686Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:4defffcdf0afd4605e094eed8b505bcfb697b8e51fb8a15ba7cb3de32d7b7ac0","observation_id":"42f13357-1257-48f6-97f0-632f67ada602","resolution":{"observed_at":"2026-08-06T17:22:34.191686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-06T17:22:34.255093Z","title":"arXiv preprint arXiv:2511.21631 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:34.255093Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:2e0b17d27105d72d6c0e553b2e0684c003b9ffe0821d53e25d8257110a4d624c","observation_id":"824d7f47-a638-4582-b8f7-e36c5e863960","resolution":{"observed_at":"2026-08-06T17:22:34.255093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-06T17:22:34.324511Z","title":"5: Advancing open-source multimodal models in versatility, reasoning, and efficiency , author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:34.324511Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:51339ebc4b6d4c516994e3bac6ad0266aca410e66b808ae74115a48c4688f65c","observation_id":"c5b77986-8490-48ea-9ea6-7524e67ab46e","resolution":{"observed_at":"2026-08-06T17:22:34.324511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T17:22:34.408128Z","title":"arXiv preprint arXiv:2407.21783 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:34.408128Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:fb59dcaba799c7235d5d4d67a89735f1819924dcddbc37b6761c82852d0d68e6","observation_id":"97b3c6ec-0c76-4c96-bda0-a8e678b5d8fa","resolution":{"observed_at":"2026-08-06T17:22:34.408128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T17:22:34.525172Z","title":"arXiv preprint arXiv:2410.21276 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:34.525172Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:514abc472bddfbe2d2b5fc3a5df5e59e6bb82de6240403461dd71f95eea3c85f","observation_id":"33fe9acf-6578-4a94-9398-1c74ac8f74f7","resolution":{"observed_at":"2026-08-06T17:22:34.525172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:34.590402Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:34.590402Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:b63b5e62a32a72fcacd43e6ea0becfc45cc734140e526d85e53ae760e40334bf","observation_id":"e0087af7-1185-4712-b239-776bc215da04","resolution":{"observed_at":"2026-08-06T17:22:34.590402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:37.392907Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":"b3cd6c75-5268-4095-8988-8a9988cfa6a2","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:34.706368Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:ba414e43b87ef5c2415d093655a08dcc06658dbada990edab89c772c1b5cfc65","observation_id":"f1a5998d-feaa-4693-9bed-bf1e045466c2","resolution":{"observed_at":"2026-08-06T17:22:37.463089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:34.801869Z","title":"European conference on computer vision , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:34.801869Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:591d6b2b69d05d728e242154733211199b72793a5409e51fc913ce267a524359","observation_id":"a6efbf36-e90d-4981-a323-759b57798d42","resolution":{"observed_at":"2026-08-06T17:22:34.801869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:34.876379Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:34.876379Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:e3f6940b9face746bed895571d98b93bb65d2df5106d07f23cafbe54762c05f9","observation_id":"855f16af-dedc-47d1-812c-6ffd5acb8d66","resolution":{"observed_at":"2026-08-06T17:22:34.876379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:34.967562Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:34.967562Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:f9b8bf9bd3a0c448e3adde9fbdbeef5dfdd19e092e0ca72607675d6241b7de9b","observation_id":"7e8c5fda-7f06-487f-af06-cb856f2ab594","resolution":{"observed_at":"2026-08-06T17:22:34.967562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.07809","last_updated":"2026-04-09T01:41:48Z","snapshot_observed_at":"2026-07-06T22:32:07.945004Z","submitted_at":"2025-10-09T05:34:57Z","title":"Invisible to Humans, Triggered by Agents: Stealthy Jailbreak Attacks on Mobile Vision-Language Agents","version":4},"cited_work":{"arxiv_id":"2510.07809","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.07809","snapshot_observed_at":"2026-08-06T17:22:35.654147Z","title":"Invisible to Humans, Triggered by Agents: Stealthy Jailbreak Attacks on Mobile Vision-Language Agents","venue":"cs.CR","work_id":"479eca1b-fa5f-413f-a567-d076cf572500","year":2025},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:35.066731Z"},"links":{"cited_paper":"/paper/2510.07809","citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:f68b947b9c7f657003103fc3a08351666ab95024aeee3cbeed75dce1851eca88","observation_id":"1f57a89e-4166-480e-a1c7-3c80a0023ef9","resolution":{"observed_at":"2026-08-06T17:22:35.750550Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:37.137507Z","title":"Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"66ca41a2-d9a4-4fa0-98c8-080e1be1539f","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:35.188130Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:0a55cdde74396eacbef81290b80f036130b3c47b455b08c6fe880f1142df97af","observation_id":"bd01ea6a-5749-4289-903b-9b4a7faf1c74","resolution":{"observed_at":"2026-08-06T17:22:37.220739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:35.281502Z","title":"arXiv preprint arXiv:2604.01618 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:35.281502Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:7ed7f911016afea7327190b19f5078722e44a923a95f619b7ac19cf13f8b419f","observation_id":"bb0c0a50-bff5-4b12-994a-3b2ac318e278","resolution":{"observed_at":"2026-08-06T17:22:35.281502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:36.851494Z","title":"Proceedings of the 32nd ACM international conference on multimedia , pages=","venue":null,"work_id":"21afb8c5-745b-4f0e-a48c-ba8e8d06a261","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:35.359514Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:26a9d04f80e68ee9a94a4535111b276e3738bd0dc5e0869f5b5248e8c4d2dcdb","observation_id":"a079389d-390d-4a95-bf0a-1f64cccdd653","resolution":{"observed_at":"2026-08-06T17:22:36.991699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.13026","last_updated":"2026-05-14T09:07:42Z","snapshot_observed_at":"2026-08-08T16:39:03.225299Z","submitted_at":"2025-11-17T06:25:12Z","title":"REVISOR: Beyond Textual Reflection, Towards Multimodal Introspective Reasoning in Long-Form Video Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.13026","snapshot_observed_at":"2026-08-06T17:22:35.417608Z","title":"arXiv preprint arXiv:2511.13026 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:35.417608Z"},"links":{"cited_paper":"/paper/2511.13026","citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:d99a033601336f130a54f511af2b817b46c1428bbad784aa5fc5059e285ce6ae","observation_id":"adea3195-b96a-4fb5-8423-b426ce956209","resolution":{"observed_at":"2026-08-06T17:22:35.417608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T02:12:26.574076Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":35,"verified_exact":1,"verified_fuzzy":19},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 0 inbound Pith citation observations for arXiv:2608.04759."}