{"as_of":"2026-08-10T00:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:14c697154cdde97615f9fd0b3f88868259af29d032a916f0a970c38733a1935c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":23,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:13:42.676327Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-10T12:15:01.137692Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.23765","last_updated":"2025-07-17T03:46:15Z","snapshot_observed_at":"2026-08-07T16:26:03.329437Z","submitted_at":"2025-03-31T06:30:35Z","title":"STI-Bench: Are MLLMs Ready for Precise Spatial-Temporal World Understanding?","version":6},"cited_work":{"arxiv_id":"2503.23765","doi":"10.48550/arxiv.2503.23765","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.23765","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Sti-bench: Are mllms ready for precise spatial-temporal world understanding?","venue":null,"work_id":"6bd4a227-e128-413c-b77b-7ed56d05c109","year":2025},"citing_paper":{"arxiv_id":"2504.01805","last_updated":"2025-05-21T09:38:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-02T15:12:17Z","title":"SpaceR: Reinforcing MLLMs in Video Spatial Reasoning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-15T15:18:43.724432Z"},"links":{"cited_paper":"/paper/2503.23765","citing_paper":"/paper/2504.01805"},"observation_digest":"sha256:5d2701af571076b98ca11c6a0d9c6638e7db0db0965f35862651ffc33b089fe1","observation_id":"e89c9018-c955-431b-b14c-e23c264773f3","resolution":{"observed_at":"2026-05-15T15:18:43.867380Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23765","last_updated":"2025-07-17T03:46:15Z","snapshot_observed_at":"2026-08-07T16:26:03.329437Z","submitted_at":"2025-03-31T06:30:35Z","title":"STI-Bench: Are MLLMs Ready for Precise Spatial-Temporal World Understanding?","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23765","snapshot_observed_at":"2026-08-07T15:13:42.676327Z","title":"Sti-bench: Are mllms ready for precise spatial-temporal world understanding? arXiv preprint arXiv:2503.23765, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-09T06:40:36.946957Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:42.676327Z"},"links":{"cited_paper":"/paper/2503.23765","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:7b12cc09369d39102fef40a9d1cc834a58ff9bb0c6abb2fb485d48df44b3f32f","observation_id":"2347f6aa-ac5a-4b8b-a3da-97312c56f293","resolution":{"observed_at":"2026-08-07T15:13:42.676327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23765","last_updated":"2025-07-17T03:46:15Z","snapshot_observed_at":"2026-08-07T16:26:03.329437Z","submitted_at":"2025-03-31T06:30:35Z","title":"STI-Bench: Are MLLMs Ready for Precise Spatial-Temporal World Understanding?","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23765","snapshot_observed_at":"2026-08-07T14:25:36.284175Z","title":"Sti- bench: Are mllms ready for precise spatial-temporal world understanding? arXiv preprint arXiv:2503.23765, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19000","last_updated":"2025-05-25T06:41:28Z","snapshot_observed_at":"2026-08-07T14:19:46.017791Z","submitted_at":"2025-05-25T06:41:28Z","title":"VerIPO: Cultivating Long Reasoning in Video-LLMs via Verifier-Gudied Iterative Policy Optimization","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:36.284175Z"},"links":{"cited_paper":"/paper/2503.23765","citing_paper":"/paper/2505.19000"},"observation_digest":"sha256:0e13df64a12699f6f0379f91552ec73e7411c9bbdb842a83f2c8b39e84af4b75","observation_id":"41962da8-18cf-4446-99e1-a953da3e28de","resolution":{"observed_at":"2026-08-07T14:25:36.284175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23765","last_updated":"2025-07-17T03:46:15Z","snapshot_observed_at":"2026-08-07T16:26:03.329437Z","submitted_at":"2025-03-31T06:30:35Z","title":"STI-Bench: Are MLLMs Ready for Precise Spatial-Temporal World Understanding?","version":6},"cited_work":{"arxiv_id":"2503.23765","doi":"10.48550/arxiv.2503.23765","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.23765","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Sti-bench: Are mllms ready for precise spatial-temporal world understanding?","venue":null,"work_id":"6bd4a227-e128-413c-b77b-7ed56d05c109","year":2025},"citing_paper":{"arxiv_id":"2505.23747","last_updated":"2026-05-19T02:23:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-29T17:59:04Z","title":"Spatial-MLLM: Boosting MLLM Capabilities in Visual-based Spatial Intelligence","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-16T08:34:36.824053Z"},"links":{"cited_paper":"/paper/2503.23765","citing_paper":"/paper/2505.23747"},"observation_digest":"sha256:45475cffada809546a50f6e3dda4ad7e74ea79d642d84a0ed612dbc7dc12ce68","observation_id":"09605819-077f-4d67-9920-7b2a6992d53d","resolution":{"observed_at":"2026-05-16T08:34:36.938612Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23765","last_updated":"2025-07-17T03:46:15Z","snapshot_observed_at":"2026-08-07T16:26:03.329437Z","submitted_at":"2025-03-31T06:30:35Z","title":"STI-Bench: Are MLLMs Ready for Precise Spatial-Temporal World Understanding?","version":6},"cited_work":{"arxiv_id":"2503.23765","doi":"10.48550/arxiv.2503.23765","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.23765","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Sti-bench: Are mllms ready for precise spatial-temporal world understanding?","venue":null,"work_id":"6bd4a227-e128-413c-b77b-7ed56d05c109","year":2025},"citing_paper":{"arxiv_id":"2505.23747","last_updated":"2026-05-19T02:23:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-29T17:59:04Z","title":"Spatial-MLLM: Boosting MLLM Capabilities in Visual-based Spatial Intelligence","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-22T00:59:13.826054Z"},"links":{"cited_paper":"/paper/2503.23765","citing_paper":"/paper/2505.23747"},"observation_digest":"sha256:36325d36cb5e04afce7ad7b3d654e2cc3f5f5109deb8cb7afe0554b1939801c0","observation_id":"bb8d9f1c-d264-4eb8-8157-e750ada9dbc4","resolution":{"observed_at":"2026-05-22T01:00:51.280287Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23765","last_updated":"2025-07-17T03:46:15Z","snapshot_observed_at":"2026-08-07T16:26:03.329437Z","submitted_at":"2025-03-31T06:30:35Z","title":"STI-Bench: Are MLLMs Ready for Precise Spatial-Temporal World Understanding?","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23765","snapshot_observed_at":"2026-08-07T10:29:42.647173Z","title":"Sti-bench: Are mllms ready for precise spatial-temporal world understanding?arXiv preprint arXiv:2503.23765, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05287","last_updated":"2025-06-05T17:44:12Z","snapshot_observed_at":"2026-08-09T15:14:29.691315Z","submitted_at":"2025-06-05T17:44:12Z","title":"EOC-Bench: Can MLLMs Identify, Recall, and Forecast Objects in an Egocentric World?","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T10:29:42.647173Z"},"links":{"cited_paper":"/paper/2503.23765","citing_paper":"/paper/2506.05287"},"observation_digest":"sha256:5a7ae6658c41a939f1d6cbb63d394dd14f38a5bc790b0a545670f0d2e03d2dcb","observation_id":"7c68a152-e7db-4071-b81e-cfc0a44eaa7f","resolution":{"observed_at":"2026-08-07T10:29:42.647173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23765","last_updated":"2025-07-17T03:46:15Z","snapshot_observed_at":"2026-08-07T16:26:03.329437Z","submitted_at":"2025-03-31T06:30:35Z","title":"STI-Bench: Are MLLMs Ready for Precise Spatial-Temporal World Understanding?","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23765","snapshot_observed_at":"2026-08-05T18:48:03.400031Z","title":"Sti-bench: Are mllms ready for precise spatial-temporal world understanding?arXivpreprintarXiv:2503.23765, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.14157","last_updated":"2025-08-19T18:00:00Z","snapshot_observed_at":"2026-08-08T15:03:21.583227Z","submitted_at":"2025-08-19T18:00:00Z","title":"The high-speed X-ray camera on AXIS: design and performance updates","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T18:48:03.400031Z"},"links":{"cited_paper":"/paper/2503.23765","citing_paper":"/paper/2508.14157"},"observation_digest":"sha256:6c50c75b2bda185517b475131098704fc6883b081652ffb13c8509eb2cd54715","observation_id":"2d21fb99-1494-4ff9-9b69-2d621a7edce3","resolution":{"observed_at":"2026-08-05T18:48:03.400031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23765","last_updated":"2025-07-17T03:46:15Z","snapshot_observed_at":"2026-08-07T16:26:03.329437Z","submitted_at":"2025-03-31T06:30:35Z","title":"STI-Bench: Are MLLMs Ready for Precise Spatial-Temporal World Understanding?","version":6},"cited_work":{"arxiv_id":"2503.23765","doi":"10.48550/arxiv.2503.23765","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.23765","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Sti-bench: Are mllms ready for precise spatial-temporal world understanding?","venue":null,"work_id":"6bd4a227-e128-413c-b77b-7ed56d05c109","year":2025},"citing_paper":{"arxiv_id":"2511.21471","last_updated":"2026-05-07T07:59:46Z","snapshot_observed_at":"2026-08-02T23:27:20.204280Z","submitted_at":"2025-11-26T15:04:18Z","title":"SpatialBench: Benchmarking Multimodal Large Language Models for Spatial Cognition","version":4},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-17T04:54:59.903644Z"},"links":{"cited_paper":"/paper/2503.23765","citing_paper":"/paper/2511.21471"},"observation_digest":"sha256:b3c0addc20fcecc38e4a8cf869d0d52debb760458065ec31881e530a74b1954f","observation_id":"2bd7c452-e556-4171-8c3d-a06dcd6c19c2","resolution":{"observed_at":"2026-05-17T04:59:04.296499Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23765","last_updated":"2025-07-17T03:46:15Z","snapshot_observed_at":"2026-08-07T16:26:03.329437Z","submitted_at":"2025-03-31T06:30:35Z","title":"STI-Bench: Are MLLMs Ready for Precise Spatial-Temporal World Understanding?","version":6},"cited_work":{"arxiv_id":"2503.23765","doi":"10.48550/arxiv.2503.23765","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.23765","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Sti-bench: Are mllms ready for precise spatial-temporal world understanding?","venue":null,"work_id":"6bd4a227-e128-413c-b77b-7ed56d05c109","year":2025},"citing_paper":{"arxiv_id":"2512.10719","last_updated":"2026-07-12T18:02:23Z","snapshot_observed_at":"2026-08-03T17:07:38.286115Z","submitted_at":"2025-12-11T14:59:07Z","title":"SpaceDrive: Infusing Spatial Awareness into VLM-based Autonomous Driving","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-22T12:17:54.325055Z"},"links":{"cited_paper":"/paper/2503.23765","citing_paper":"/paper/2512.10719"},"observation_digest":"sha256:414dcee9ab26a3233cb5f22342eddf67d12261b9b9a43b3594fcfd6e089d025c","observation_id":"0db04dbc-4cc4-4ee5-8d21-1e2a28e23039","resolution":{"observed_at":"2026-05-22T12:21:31.382952Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23765","last_updated":"2025-07-17T03:46:15Z","snapshot_observed_at":"2026-08-07T16:26:03.329437Z","submitted_at":"2025-03-31T06:30:35Z","title":"STI-Bench: Are MLLMs Ready for Precise Spatial-Temporal World Understanding?","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23765","snapshot_observed_at":"2026-08-03T17:07:43.319564Z","title":"Sti-bench: Are mllms ready for precise spatial-temporal world understanding?arXiv preprint arXiv:2503.23765, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10719","last_updated":"2026-07-12T18:02:23Z","snapshot_observed_at":"2026-08-03T17:07:38.286115Z","submitted_at":"2025-12-11T14:59:07Z","title":"SpaceDrive: Infusing Spatial Awareness into VLM-based Autonomous Driving","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T17:07:43.319564Z"},"links":{"cited_paper":"/paper/2503.23765","citing_paper":"/paper/2512.10719"},"observation_digest":"sha256:71bbe95db6adc2961106575f1c8c222d457ec198e36ce3ebf2dafd9e0cdbe7c0","observation_id":"c1482195-fb45-4349-9de8-55d321ef351d","resolution":{"observed_at":"2026-08-03T17:07:43.319564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23765","last_updated":"2025-07-17T03:46:15Z","snapshot_observed_at":"2026-08-07T16:26:03.329437Z","submitted_at":"2025-03-31T06:30:35Z","title":"STI-Bench: Are MLLMs Ready for Precise Spatial-Temporal World Understanding?","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23765","snapshot_observed_at":"2026-08-03T14:57:29.129862Z","title":"Sti-bench: Are mllms ready for precise spatial-temporal world understanding?arXiv preprint arXiv:2503.23765, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.18735","last_updated":"2026-05-25T12:55:14Z","snapshot_observed_at":"2026-08-07T05:11:54.627363Z","submitted_at":"2025-12-21T13:50:26Z","title":"$M^3-Verse$: A \"Spot the Difference\" Challenge for Large Multimodal Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T14:57:29.129862Z"},"links":{"cited_paper":"/paper/2503.23765","citing_paper":"/paper/2512.18735"},"observation_digest":"sha256:2ca061ef731f43874d4b65e997d06726825094a0c498d240fc7bda52cfee0c18","observation_id":"c4d1d119-d33f-4bd3-a308-897e33bc2a2c","resolution":{"observed_at":"2026-08-03T14:57:29.129862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23765","last_updated":"2025-07-17T03:46:15Z","snapshot_observed_at":"2026-08-07T16:26:03.329437Z","submitted_at":"2025-03-31T06:30:35Z","title":"STI-Bench: Are MLLMs Ready for Precise Spatial-Temporal World Understanding?","version":6},"cited_work":{"arxiv_id":"2503.23765","doi":"10.48550/arxiv.2503.23765","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.23765","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Sti-bench: Are mllms ready for precise spatial-temporal world understanding?","venue":null,"work_id":"6bd4a227-e128-413c-b77b-7ed56d05c109","year":2025},"citing_paper":{"arxiv_id":"2603.03944","last_updated":"2026-04-03T20:11:12Z","snapshot_observed_at":"2026-07-06T22:47:46.409064Z","submitted_at":"2026-03-04T11:09:39Z","title":"SCP: Spatial Causal Prediction in Video","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-15T16:47:44.523606Z"},"links":{"cited_paper":"/paper/2503.23765","citing_paper":"/paper/2603.03944"},"observation_digest":"sha256:098b9e64f3b77a32b3014abbac54c8140d6592944f1ae972248047a98f90985d","observation_id":"3bfd95b4-fbf8-4e1b-b685-8985553b8e4f","resolution":{"observed_at":"2026-05-15T16:50:11.225647Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23765","last_updated":"2025-07-17T03:46:15Z","snapshot_observed_at":"2026-08-07T16:26:03.329437Z","submitted_at":"2025-03-31T06:30:35Z","title":"STI-Bench: Are MLLMs Ready for Precise Spatial-Temporal World Understanding?","version":6},"cited_work":{"arxiv_id":"2503.23765","doi":"10.48550/arxiv.2503.23765","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.23765","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Sti-bench: Are mllms ready for precise spatial-temporal world understanding?","venue":null,"work_id":"6bd4a227-e128-413c-b77b-7ed56d05c109","year":2025},"citing_paper":{"arxiv_id":"2603.27437","last_updated":"2026-05-02T17:42:29Z","snapshot_observed_at":"2026-08-02T12:27:33.147868Z","submitted_at":"2026-03-28T22:49:40Z","title":"SpatialStack: Layered Geometry-Language Fusion for 3D VLM Spatial Reasoning","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-14T22:04:18.591594Z"},"links":{"cited_paper":"/paper/2503.23765","citing_paper":"/paper/2603.27437"},"observation_digest":"sha256:4db746e90a61c7a81ccad9a98e2d32ee1a6f28b08a9e0b470cc23fee86053b9f","observation_id":"d8f2f974-741a-475e-bb0e-f760f5eb2ab1","resolution":{"observed_at":"2026-05-14T22:08:04.700971Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23765","last_updated":"2025-07-17T03:46:15Z","snapshot_observed_at":"2026-08-07T16:26:03.329437Z","submitted_at":"2025-03-31T06:30:35Z","title":"STI-Bench: Are MLLMs Ready for Precise Spatial-Temporal World Understanding?","version":6},"cited_work":{"arxiv_id":"2503.23765","doi":"10.48550/arxiv.2503.23765","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.23765","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Sti-bench: Are mllms ready for precise spatial-temporal world understanding?","venue":null,"work_id":"6bd4a227-e128-413c-b77b-7ed56d05c109","year":2025},"citing_paper":{"arxiv_id":"2604.09712","last_updated":"2026-04-08T06:28:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T06:28:03Z","title":"LAST: Leveraging Tools as Hints to Enhance Spatial Reasoning for Multimodal Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T19:26:23.660206Z"},"links":{"cited_paper":"/paper/2503.23765","citing_paper":"/paper/2604.09712"},"observation_digest":"sha256:476171863cbae1c3c1d04bbca0918563a84c6a495d0f2a28309ea703265a4332","observation_id":"c84b84c9-beb7-4d1e-927c-fb0bc8bf13ba","resolution":{"observed_at":"2026-05-10T23:00:47.753493Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23765","last_updated":"2025-07-17T03:46:15Z","snapshot_observed_at":"2026-08-07T16:26:03.329437Z","submitted_at":"2025-03-31T06:30:35Z","title":"STI-Bench: Are MLLMs Ready for Precise Spatial-Temporal World Understanding?","version":6},"cited_work":{"arxiv_id":"2503.23765","doi":"10.48550/arxiv.2503.23765","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.23765","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Sti-bench: Are mllms ready for precise spatial-temporal world understanding?","venue":null,"work_id":"6bd4a227-e128-413c-b77b-7ed56d05c109","year":2025},"citing_paper":{"arxiv_id":"2605.10106","last_updated":"2026-05-11T07:20:09Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:20:09Z","title":"ViSRA: A Video-based Spatial Reasoning Agent for Multi-modal Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-12T04:00:23.681682Z"},"links":{"cited_paper":"/paper/2503.23765","citing_paper":"/paper/2605.10106"},"observation_digest":"sha256:0a081f561b4591e09c3edb791298861209d5aef926d2db1596e433c6b5dc3d31","observation_id":"2ae6e612-d86f-48cd-af6d-69d084997e39","resolution":{"observed_at":"2026-05-12T06:46:35.632369Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23765","last_updated":"2025-07-17T03:46:15Z","snapshot_observed_at":"2026-08-07T16:26:03.329437Z","submitted_at":"2025-03-31T06:30:35Z","title":"STI-Bench: Are MLLMs Ready for Precise Spatial-Temporal World Understanding?","version":6},"cited_work":{"arxiv_id":"2503.23765","doi":"10.48550/arxiv.2503.23765","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.23765","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Sti-bench: Are mllms ready for precise spatial-temporal world understanding?","venue":null,"work_id":"6bd4a227-e128-413c-b77b-7ed56d05c109","year":2025},"citing_paper":{"arxiv_id":"2605.20165","last_updated":"2026-05-19T17:50:25Z","snapshot_observed_at":"2026-07-06T23:30:49.211483Z","submitted_at":"2026-05-19T17:50:25Z","title":"CaMo: Camera Motion Grounded Evaluation and Training for Vision-Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-20T05:27:30.938311Z"},"links":{"cited_paper":"/paper/2503.23765","citing_paper":"/paper/2605.20165"},"observation_digest":"sha256:f776b39d4461be59686f9dfc34abbc0f13257627fee715b66a264279ef891228","observation_id":"34bfc2b2-2a13-4f1c-b304-398a50681a7e","resolution":{"observed_at":"2026-05-20T05:28:04.441525Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23765","last_updated":"2025-07-17T03:46:15Z","snapshot_observed_at":"2026-08-07T16:26:03.329437Z","submitted_at":"2025-03-31T06:30:35Z","title":"STI-Bench: Are MLLMs Ready for Precise Spatial-Temporal World Understanding?","version":6},"cited_work":{"arxiv_id":"2503.23765","doi":"10.48550/arxiv.2503.23765","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.23765","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Sti-bench: Are mllms ready for precise spatial-temporal world understanding?","venue":null,"work_id":"6bd4a227-e128-413c-b77b-7ed56d05c109","year":2025},"citing_paper":{"arxiv_id":"2605.21625","last_updated":"2026-05-20T18:36:57Z","snapshot_observed_at":"2026-07-06T23:32:01.202542Z","submitted_at":"2026-05-20T18:36:57Z","title":"Flat-Pack Bench: Evaluating Spatio-Temporal Understanding in Large Vision-Language Models through Furniture Assembly","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-22T09:20:32.920925Z"},"links":{"cited_paper":"/paper/2503.23765","citing_paper":"/paper/2605.21625"},"observation_digest":"sha256:bae8ea1c4460b0bd3792c96b9b4fc9c534bbef8bc89a218988625bc069d40479","observation_id":"d8b1592a-580c-4e30-ae30-f68d7d18df7f","resolution":{"observed_at":"2026-05-22T09:21:20.665146Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23765","last_updated":"2025-07-17T03:46:15Z","snapshot_observed_at":"2026-08-07T16:26:03.329437Z","submitted_at":"2025-03-31T06:30:35Z","title":"STI-Bench: Are MLLMs Ready for Precise Spatial-Temporal World Understanding?","version":6},"cited_work":{"arxiv_id":"2503.23765","doi":"10.48550/arxiv.2503.23765","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.23765","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Sti-bench: Are mllms ready for precise spatial-temporal world understanding?","venue":null,"work_id":"6bd4a227-e128-413c-b77b-7ed56d05c109","year":2025},"citing_paper":{"arxiv_id":"2605.27318","last_updated":"2026-07-06T17:18:57Z","snapshot_observed_at":"2026-07-12T15:54:07.137141Z","submitted_at":"2026-05-26T17:26:29Z","title":"Q-GeoMem: Question-Guided Geometric Memory for Video Spatial Reasoning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T18:15:28.261185Z"},"links":{"cited_paper":"/paper/2503.23765","citing_paper":"/paper/2605.27318"},"observation_digest":"sha256:6705e12ebf1b191155f0d7885ab0263fe39b4d0b117e4c2faeb1c7b999173dd1","observation_id":"dd3f9979-95c4-4dc4-a1f1-cd4eb25cc115","resolution":{"observed_at":"2026-06-29T18:23:50.980272Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23765","last_updated":"2025-07-17T03:46:15Z","snapshot_observed_at":"2026-08-07T16:26:03.329437Z","submitted_at":"2025-03-31T06:30:35Z","title":"STI-Bench: Are MLLMs Ready for Precise Spatial-Temporal World Understanding?","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23765","snapshot_observed_at":"2026-07-12T15:54:12.909974Z","title":"STI-Bench : Are MLLMs Ready for Precise Spatial-Temporal World Understanding ? arXiv:2503.23765, 2025 b","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27318","last_updated":"2026-07-06T17:18:57Z","snapshot_observed_at":"2026-07-12T15:54:07.137141Z","submitted_at":"2026-05-26T17:26:29Z","title":"Q-GeoMem: Question-Guided Geometric Memory for Video Spatial Reasoning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-12T15:54:12.909974Z"},"links":{"cited_paper":"/paper/2503.23765","citing_paper":"/paper/2605.27318"},"observation_digest":"sha256:882eed63d40070019519531cca015629e0e748067e905ea2cd35b9f32e8cf0d7","observation_id":"1920eedb-05f3-40f7-b2e6-3633131927b2","resolution":{"observed_at":"2026-07-12T15:54:12.909974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23765","last_updated":"2025-07-17T03:46:15Z","snapshot_observed_at":"2026-08-07T16:26:03.329437Z","submitted_at":"2025-03-31T06:30:35Z","title":"STI-Bench: Are MLLMs Ready for Precise Spatial-Temporal World Understanding?","version":6},"cited_work":{"arxiv_id":"2503.23765","doi":"10.48550/arxiv.2503.23765","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.23765","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Sti-bench: Are mllms ready for precise spatial-temporal world understanding?","venue":null,"work_id":"6bd4a227-e128-413c-b77b-7ed56d05c109","year":2025},"citing_paper":{"arxiv_id":"2605.30231","last_updated":"2026-05-28T17:00:52Z","snapshot_observed_at":"2026-07-06T23:39:34.232661Z","submitted_at":"2026-05-28T17:00:52Z","title":"Beyond 3D VQAs: Injecting 3D Spatial Priors into Vision-Language Models for Enhanced Geometric Reasoning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-29T07:47:52.739735Z"},"links":{"cited_paper":"/paper/2503.23765","citing_paper":"/paper/2605.30231"},"observation_digest":"sha256:bb0e26f433d1cf191f9e9bc720aaa393b2b60e8cd293977746ffc3a20923f37e","observation_id":"41f59920-a41d-4fce-844a-118668491ab0","resolution":{"observed_at":"2026-06-29T07:53:13.667132Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23765","last_updated":"2025-07-17T03:46:15Z","snapshot_observed_at":"2026-08-07T16:26:03.329437Z","submitted_at":"2025-03-31T06:30:35Z","title":"STI-Bench: Are MLLMs Ready for Precise Spatial-Temporal World Understanding?","version":6},"cited_work":{"arxiv_id":"2503.23765","doi":"10.48550/arxiv.2503.23765","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.23765","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Sti-bench: Are mllms ready for precise spatial-temporal world understanding?","venue":null,"work_id":"6bd4a227-e128-413c-b77b-7ed56d05c109","year":2025},"citing_paper":{"arxiv_id":"2606.05677","last_updated":"2026-06-04T04:00:12Z","snapshot_observed_at":"2026-08-02T16:24:06.015782Z","submitted_at":"2026-06-04T04:00:12Z","title":"LongSpace: Exploring Long-Horizon Spatial Memory from Perception to Recall in Video","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-28T02:16:25.730555Z"},"links":{"cited_paper":"/paper/2503.23765","citing_paper":"/paper/2606.05677"},"observation_digest":"sha256:829c0f3b191c88b3f98743df8ac135f30898ee8b56e78cc0247065c2eb86a1d7","observation_id":"29da8a06-3bb5-4983-9a59-bf92699eb05a","resolution":{"observed_at":"2026-07-02T12:16:57.229619Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23765","last_updated":"2025-07-17T03:46:15Z","snapshot_observed_at":"2026-08-07T16:26:03.329437Z","submitted_at":"2025-03-31T06:30:35Z","title":"STI-Bench: Are MLLMs Ready for Precise Spatial-Temporal World Understanding?","version":6},"cited_work":{"arxiv_id":"2503.23765","doi":"10.48550/arxiv.2503.23765","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.23765","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Sti-bench: Are mllms ready for precise spatial-temporal world understanding?","venue":null,"work_id":"6bd4a227-e128-413c-b77b-7ed56d05c109","year":2025},"citing_paper":{"arxiv_id":"2606.11683","last_updated":"2026-06-10T05:52:14Z","snapshot_observed_at":"2026-07-06T23:50:44.713490Z","submitted_at":"2026-06-10T05:52:14Z","title":"Reason, Then Re-reason: Cross-view Revisiting Improves Spatial Reasoning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-27T10:41:41.697216Z"},"links":{"cited_paper":"/paper/2503.23765","citing_paper":"/paper/2606.11683"},"observation_digest":"sha256:7d2ce9067e52bbb5992f17a4c9b4b464ae0b86c3134cdee421bbd068b91f3ae7","observation_id":"3c809614-428b-44b5-80de-97df429d3699","resolution":{"observed_at":"2026-07-03T08:57:47.477127Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23765","last_updated":"2025-07-17T03:46:15Z","snapshot_observed_at":"2026-08-07T16:26:03.329437Z","submitted_at":"2025-03-31T06:30:35Z","title":"STI-Bench: Are MLLMs Ready for Precise Spatial-Temporal World Understanding?","version":6},"cited_work":{"arxiv_id":"2503.23765","doi":"10.48550/arxiv.2503.23765","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.23765","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Sti-bench: Are mllms ready for precise spatial-temporal world understanding?","venue":null,"work_id":"6bd4a227-e128-413c-b77b-7ed56d05c109","year":2025},"citing_paper":{"arxiv_id":"2606.28049","last_updated":"2026-06-26T12:51:22Z","snapshot_observed_at":"2026-07-07T00:02:09.217954Z","submitted_at":"2026-06-26T12:51:22Z","title":"AirGroundBench: Probing Spatial Intelligence in Multimodal Large Models under Heterogeneous Multi-View Embodied Collaboration","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:40.202508Z"},"links":{"cited_paper":"/paper/2503.23765","citing_paper":"/paper/2606.28049"},"observation_digest":"sha256:73e71ee4b382780061d5229c9d010bff8b089b3234682193bcf1a5ee2ba93eae","observation_id":"124f1882-f6c3-404f-b165-96ff428db523","resolution":{"observed_at":"2026-06-29T04:43:06.920476Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2503.23765/citation-record","integrity":"/paper/2503.23765/integrity","json":"/paper/2503.23765/citation-record.json","paper":"/paper/2503.23765"},"outbound":[],"paper":{"arxiv_id":"2503.23765","last_updated":"2025-07-17T03:46:15Z","latest_version":6,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T16:26:03.329437Z","submitted_at":"2025-03-31T06:30:35Z","title":"STI-Bench: Are MLLMs Ready for Precise Spatial-Temporal World Understanding?"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 23 inbound Pith citation observations for arXiv:2503.23765."}