{"as_of":"2026-08-09T09:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9591bf632c05d032dc459e9adb3a58c2d37d536e79277f438728fb16be61534c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":26,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:31:18.424642Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T16:18:37.298889Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":"2504.00883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-07-03T16:18:37.298889Z","title":"Improved visual-spatial reasoning via r1-zero-like training","venue":null,"work_id":"57345232-ffec-48ff-ac2c-e58800253c84","year":2025},"citing_paper":{"arxiv_id":"2503.13377","last_updated":"2025-06-29T08:11:35Z","snapshot_observed_at":"2026-08-02T21:01:10.455745Z","submitted_at":"2025-03-17T17:04:20Z","title":"Time-R1: Post-Training Large Vision Language Model for Temporal Video Grounding","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-17T02:40:06.454859Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2503.13377"},"observation_digest":"sha256:bf6b02cf4654f7ae5cd3ee865ef4f89ddb6967609f92bc4e69fabae6eb38d947","observation_id":"cfa03b87-9845-4c98-a800-14a7f564b40f","resolution":{"observed_at":"2026-05-17T02:40:06.550790Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-08-07T14:31:18.424642Z","title":"Improved visual-spatial reasoning via r1-zero-like training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18536","last_updated":"2025-05-24T06:01:48Z","snapshot_observed_at":"2026-08-07T22:01:21.366221Z","submitted_at":"2025-05-24T06:01:48Z","title":"Reinforcement Fine-Tuning Powers Reasoning Capability of Multimodal Large Language Models","version":1},"reference_index":108,"source":"pdf_text","source_observed_at":"2026-08-07T14:31:18.424642Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2505.18536"},"observation_digest":"sha256:d800902cffd26656cf04fe7825e499c5b429daf5c8b297ec0538d883144a0f19","observation_id":"f7b0dbec-41e6-4426-b8ee-c8dd450953f1","resolution":{"observed_at":"2026-08-07T14:31:18.424642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":"2504.00883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-07-03T16:18:37.298889Z","title":"Improved visual-spatial reasoning via r1-zero-like training","venue":null,"work_id":"57345232-ffec-48ff-ac2c-e58800253c84","year":2025},"citing_paper":{"arxiv_id":"2505.21374","last_updated":"2025-05-27T16:05:01Z","snapshot_observed_at":"2026-08-06T04:32:21.352745Z","submitted_at":"2025-05-27T16:05:01Z","title":"Video-Holmes: Can MLLM Think Like Holmes for Complex Video Reasoning?","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-17T05:40:55.944288Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2505.21374"},"observation_digest":"sha256:62783f65d1ddd0ca89a8fa0e545cf4bf49851ac6e27fef25cafd7c6ed526b4d7","observation_id":"ff15f0c3-de02-41ae-b59b-5e0d8646e711","resolution":{"observed_at":"2026-05-17T05:40:56.029917Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-08-07T12:35:17.956196Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24257","last_updated":"2025-05-30T06:32:26Z","snapshot_observed_at":"2026-08-08T14:01:51.003077Z","submitted_at":"2025-05-30T06:32:26Z","title":"Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:17.956196Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2505.24257"},"observation_digest":"sha256:1415e5adec45b3f3e53a3c93aef728fbdb6fe111cb23fe1f1c4e49745fd9aecc","observation_id":"292307aa-50aa-4b8e-ad88-d44a0372db00","resolution":{"observed_at":"2026-08-07T12:35:17.956196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-08-07T10:55:14.722576Z","title":"Improved visual-spatial reasoning via r1-zero-like training.arXiv preprint arXiv:2504.00883, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04034","last_updated":"2025-06-04T14:56:57Z","snapshot_observed_at":"2026-08-07T10:46:30.489099Z","submitted_at":"2025-06-04T14:56:57Z","title":"Rex-Thinker: Grounded Object Referring via Chain-of-Thought Reasoning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T10:55:14.722576Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2506.04034"},"observation_digest":"sha256:e01dbdee03f9fc5b8a16cfddc46c8c0f464f5af649d5c35f4944cf136f26b124","observation_id":"d04d06b1-776c-47a2-be9f-0e489c873a9d","resolution":{"observed_at":"2026-08-07T10:55:14.722576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-08-07T05:27:05.114508Z","title":"Improved visual-spatial reasoning via r1-zero-like training.arXiv preprint arXiv:2504.00883, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07905","last_updated":"2025-06-09T16:20:54Z","snapshot_observed_at":"2026-08-07T21:24:53.935343Z","submitted_at":"2025-06-09T16:20:54Z","title":"WeThink: Toward General-purpose Vision-Language Reasoning via Reinforcement Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T05:27:05.114508Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2506.07905"},"observation_digest":"sha256:8ea592ef6841910e6e07574606679e1a80005e3eb2911d5a0bbf8b6383caf848","observation_id":"900592f3-cb75-485e-8f6d-57cc9329113b","resolution":{"observed_at":"2026-08-07T05:27:05.114508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":"2504.00883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-07-03T16:18:37.298889Z","title":"Improved visual-spatial reasoning via r1-zero-like training","venue":null,"work_id":"57345232-ffec-48ff-ac2c-e58800253c84","year":2025},"citing_paper":{"arxiv_id":"2507.00748","last_updated":"2026-04-12T11:20:16Z","snapshot_observed_at":"2026-08-08T09:01:59.914584Z","submitted_at":"2025-07-01T13:48:57Z","title":"Improving the Reasoning of Multi-Image Grounding in MLLMs via Reinforcement Learning","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-19T06:50:02.607136Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2507.00748"},"observation_digest":"sha256:335ec4e2e8a800d24fe636435af4028b23c3a221e71c6c73797b7a32bd9fbba1","observation_id":"1d5a5c88-f935-41fe-ae91-41cd19f4e1c3","resolution":{"observed_at":"2026-05-19T06:52:08.116778Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-08-06T19:54:48.103936Z","title":"Improved visual-spatial reasoning via r1-zero-like training,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.13362","last_updated":"2025-07-06T10:51:12Z","snapshot_observed_at":"2026-08-08T08:07:57.477546Z","submitted_at":"2025-07-06T10:51:12Z","title":"Enhancing Spatial Reasoning in Vision-Language Models via Chain-of-Thought Prompting and Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:48.103936Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2507.13362"},"observation_digest":"sha256:d6737522f9f762171d76962d441a2d3fc0b93e9e18d7a39a8a3ec3bbd5b954cf","observation_id":"d1911141-ba6d-45a0-9592-05121f0c56cf","resolution":{"observed_at":"2026-08-06T19:54:48.103936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-08-05T11:40:22.714354Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02359","last_updated":"2025-09-02T14:22:43Z","snapshot_observed_at":"2026-08-08T06:17:37.928618Z","submitted_at":"2025-09-02T14:22:43Z","title":"Why Do MLLMs Struggle with Spatial Understanding? A Systematic Analysis from Data to Architecture","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T11:40:22.714354Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2509.02359"},"observation_digest":"sha256:1348f556a781990262287add5c50f801e7ae0ba6bca17141d4a2bcace6c6131d","observation_id":"c3a40141-58cc-4308-b02d-db22c41b6f97","resolution":{"observed_at":"2026-08-05T11:40:22.714354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-08-04T16:07:33.995648Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.16679","last_updated":"2025-09-20T13:11:28Z","snapshot_observed_at":"2026-08-04T16:07:24.699834Z","submitted_at":"2025-09-20T13:11:28Z","title":"Reinforcement Learning Meets Large Language Models: A Survey of Advancements and Applications Across the LLM Lifecycle","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-04T16:07:33.995648Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2509.16679"},"observation_digest":"sha256:9023e5af7546934abca481136d9ab734c1c63131ad34b3f193133444b59967da","observation_id":"2a7ed2cc-0db1-417c-8b68-aae1f1a6ccf7","resolution":{"observed_at":"2026-08-04T16:07:33.995648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-08-04T07:23:05.079698Z","title":"Improved visual-spatial reasoning via r1-zero-like training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.26113","last_updated":"2026-06-18T20:06:47Z","snapshot_observed_at":"2026-08-06T20:27:36.141566Z","submitted_at":"2025-10-30T03:53:22Z","title":"EgoExo-Con: Exploring View-Invariant Video Temporal Understanding","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T07:23:05.079698Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2510.26113"},"observation_digest":"sha256:9e254926f238ed2280da0c4d53b91faf55f789a8eec8234540b0528a3850759c","observation_id":"85ebea19-bc89-4b8f-a73c-c97ba66a00b4","resolution":{"observed_at":"2026-08-04T07:23:05.079698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-08-03T20:23:04.926420Z","title":"Improved visual-spatial reasoning via r1-zero-like training.arXiv preprint arXiv:2504.00883, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.20272","last_updated":"2026-07-03T06:27:17Z","snapshot_observed_at":"2026-08-03T20:22:57.328566Z","submitted_at":"2025-11-25T12:58:32Z","title":"VKnowU: Evaluating Visual Knowledge Understanding in Multimodal LLMs","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:04.926420Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2511.20272"},"observation_digest":"sha256:78007d1e521acc6ae55e56961ca5ee3625bc4940b2506724e20276ce89e34759","observation_id":"b4d6e639-687f-48bd-b459-b9d41f707997","resolution":{"observed_at":"2026-08-03T20:23:04.926420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-08-03T03:16:49.999803Z","title":"Improved Visual-Spatial Reasoning via R1- Zero-Like Training.arXiv preprint 2504.00883,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.08735","last_updated":"2026-06-10T06:24:51Z","snapshot_observed_at":"2026-08-05T01:30:16.672169Z","submitted_at":"2026-02-09T14:39:43Z","title":"From Correspondence to Actions: Human-Like Multi-Image Spatial Reasoning in Multi-modal Large Language Models","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-03T03:16:49.999803Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2602.08735"},"observation_digest":"sha256:4abb6b2627042d2bc9135c7caff777742c6870d088211f06e17c68f8898a8f21","observation_id":"87bc1d6f-4537-455f-bca5-9b40c5226ec0","resolution":{"observed_at":"2026-08-03T03:16:49.999803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":"2504.00883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-07-03T16:18:37.298889Z","title":"Improved visual-spatial reasoning via r1-zero-like training","venue":null,"work_id":"57345232-ffec-48ff-ac2c-e58800253c84","year":2025},"citing_paper":{"arxiv_id":"2603.14184","last_updated":"2026-05-20T12:33:19Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:21:05Z","title":"Deeper Thought, Weaker Aim: Understanding and Mitigating Perceptual Impairment during Reasoning in Multimodal Large Language Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-21T11:56:29.743281Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2603.14184"},"observation_digest":"sha256:cde61e3477caa2f26b72b992d9d76d732823296234c8454333589311de07056b","observation_id":"873458e3-a56d-4bd4-a4d4-ed0ab4552919","resolution":{"observed_at":"2026-05-21T12:00:04.278492Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-08-02T17:54:05.713076Z","title":"arXiv preprint arXiv:2504.00883 (2025) 11","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.19235","last_updated":"2026-07-17T06:42:00Z","snapshot_observed_at":"2026-08-07T06:53:26.100749Z","submitted_at":"2026-03-19T17:59:58Z","title":"Generation Models Know Space: Unleashing Implicit 3D Priors for Scene Understanding","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T17:54:05.713076Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2603.19235"},"observation_digest":"sha256:fb7686e6e301b0e509df70351a4ffe58ecb1782ffea66853bc0c74d13cf24bbd","observation_id":"28551100-a395-4bf3-8a26-bb319e01047b","resolution":{"observed_at":"2026-08-02T17:54:05.713076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":"2504.00883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-07-03T16:18:37.298889Z","title":"Improved visual-spatial reasoning via r1-zero-like training","venue":null,"work_id":"57345232-ffec-48ff-ac2c-e58800253c84","year":2025},"citing_paper":{"arxiv_id":"2604.03318","last_updated":"2026-05-25T15:52:36Z","snapshot_observed_at":"2026-07-13T14:39:49.573224Z","submitted_at":"2026-04-01T15:28:13Z","title":"EgoMind: Activating Spatial Cognition through Linguistic Reasoning in MLLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-13T22:41:09.840792Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2604.03318"},"observation_digest":"sha256:27e6a31ded0d7d556cf79fec545f627f07a45eb7310cbfdaa30cbe38c8fe3e80","observation_id":"a1dff7ec-a172-4dc1-b672-2ab691354125","resolution":{"observed_at":"2026-05-13T22:43:22.842223Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-07-13T14:39:55.177552Z","title":"Improved visual-spatial reasoning via r1-zero-like training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.03318","last_updated":"2026-05-25T15:52:36Z","snapshot_observed_at":"2026-07-13T14:39:49.573224Z","submitted_at":"2026-04-01T15:28:13Z","title":"EgoMind: Activating Spatial Cognition through Linguistic Reasoning in MLLMs","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-13T14:39:55.177552Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2604.03318"},"observation_digest":"sha256:43e2ae4b19a8bea2d5ca3fec79b97b152c46413cc8a464caa71c5b569a62bbb2","observation_id":"d8ac2c06-1c86-44a5-9652-b424b447625c","resolution":{"observed_at":"2026-07-13T14:39:55.177552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":"2504.00883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-07-03T16:18:37.298889Z","title":"Improved visual-spatial reasoning via r1-zero-like training","venue":null,"work_id":"57345232-ffec-48ff-ac2c-e58800253c84","year":2025},"citing_paper":{"arxiv_id":"2604.06725","last_updated":"2026-04-08T06:47:55Z","snapshot_observed_at":"2026-08-02T13:53:46.692069Z","submitted_at":"2026-04-08T06:47:55Z","title":"Enhancing MLLM Spatial Understanding via Active 3D Scene Exploration for Multi-Perspective Reasoning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T19:16:46.753641Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2604.06725"},"observation_digest":"sha256:b2630a3baeee8657363141826d6361d8a8f9c3cdb215f27b0b88d2f059bbb6d0","observation_id":"3548575d-a02f-41b1-b7c1-3d3883a46ef6","resolution":{"observed_at":"2026-05-10T23:15:47.770329Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":"2504.00883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-07-03T16:18:37.298889Z","title":"Improved visual-spatial reasoning via r1-zero-like training","venue":null,"work_id":"57345232-ffec-48ff-ac2c-e58800253c84","year":2025},"citing_paper":{"arxiv_id":"2604.12908","last_updated":"2026-04-14T15:57:16Z","snapshot_observed_at":"2026-07-06T23:01:00.830207Z","submitted_at":"2026-04-14T15:57:16Z","title":"Robotic Manipulation is Vision-to-Geometry Mapping ($f(v) \\rightarrow G$): Vision-Geometry Backbones over Language and Video Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-10T15:20:47.418874Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2604.12908"},"observation_digest":"sha256:4378cec828e459c9d9557fee75516d7e51330d1680357b71514f4e1e64ded329","observation_id":"68324a95-075f-4510-afde-f682474e04b7","resolution":{"observed_at":"2026-05-11T10:46:01.362635Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":"2504.00883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-07-03T16:18:37.298889Z","title":"Improved visual-spatial reasoning via r1-zero-like training","venue":null,"work_id":"57345232-ffec-48ff-ac2c-e58800253c84","year":2025},"citing_paper":{"arxiv_id":"2604.20705","last_updated":"2026-04-22T15:46:42Z","snapshot_observed_at":"2026-07-06T23:07:25.185196Z","submitted_at":"2026-04-22T15:46:42Z","title":"SSL-R1: Self-Supervised Visual Reinforcement Post-Training for Multimodal Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-10T01:23:32.849326Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2604.20705"},"observation_digest":"sha256:625805c944d2d8b3d16c0fd75c6efd9563b834ce0cb5518af78c53134a527a19","observation_id":"75226c71-ce97-427c-87db-a0944021055f","resolution":{"observed_at":"2026-05-11T13:36:08.748348Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":"2504.00883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-07-03T16:18:37.298889Z","title":"Improved visual-spatial reasoning via r1-zero-like training","venue":null,"work_id":"57345232-ffec-48ff-ac2c-e58800253c84","year":2025},"citing_paper":{"arxiv_id":"2605.20165","last_updated":"2026-05-19T17:50:25Z","snapshot_observed_at":"2026-07-06T23:30:49.211483Z","submitted_at":"2026-05-19T17:50:25Z","title":"CaMo: Camera Motion Grounded Evaluation and Training for Vision-Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-20T05:27:30.938311Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2605.20165"},"observation_digest":"sha256:8dc45e51fa2f333d056cb8141924445763cfceb784d930108f64db42f1c78dc2","observation_id":"1ec4db68-218b-4ec9-968b-c9b9a5e89eb6","resolution":{"observed_at":"2026-05-20T05:28:04.514201Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":"2504.00883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-07-03T16:18:37.298889Z","title":"Improved visual-spatial reasoning via r1-zero-like training","venue":null,"work_id":"57345232-ffec-48ff-ac2c-e58800253c84","year":2025},"citing_paper":{"arxiv_id":"2606.01247","last_updated":"2026-05-31T14:00:10Z","snapshot_observed_at":"2026-07-06T23:41:48.357871Z","submitted_at":"2026-05-31T14:00:10Z","title":"Where to Look: Can Foundation Models Reach a Target Viewpoint Through Active Exploration?","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-06-28T17:08:59.111306Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2606.01247"},"observation_digest":"sha256:606476c3a5a8c6b074e291b605ea98bc8a6ca9c2410ae2af57ed9dd1206176c0","observation_id":"ff9b5c72-0230-4538-ab8f-ae71625a189f","resolution":{"observed_at":"2026-06-28T17:12:24.798806Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":"2504.00883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-07-03T16:18:37.298889Z","title":"Improved visual-spatial reasoning via r1-zero-like training","venue":null,"work_id":"57345232-ffec-48ff-ac2c-e58800253c84","year":2025},"citing_paper":{"arxiv_id":"2606.07433","last_updated":"2026-06-05T16:29:13Z","snapshot_observed_at":"2026-08-01T21:05:06.439607Z","submitted_at":"2026-06-05T16:29:13Z","title":"Watch, Remember, Reason: Human-View Video Understanding with MLLMs","version":1},"reference_index":219,"source":"pdf_text","source_observed_at":"2026-06-27T22:00:28.350003Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2606.07433"},"observation_digest":"sha256:ed9c20e2aa2a699539e55d903e2a5be82dd910336e59e1ac765fa13802c15f67","observation_id":"b5b5edfe-f574-464e-9f75-e5a3662b22e0","resolution":{"observed_at":"2026-07-02T17:27:15.583697Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":"2504.00883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-07-03T16:18:37.298889Z","title":"Improved visual-spatial reasoning via r1-zero-like training","venue":null,"work_id":"57345232-ffec-48ff-ac2c-e58800253c84","year":2025},"citing_paper":{"arxiv_id":"2606.11683","last_updated":"2026-06-10T05:52:14Z","snapshot_observed_at":"2026-07-06T23:50:44.713490Z","submitted_at":"2026-06-10T05:52:14Z","title":"Reason, Then Re-reason: Cross-view Revisiting Improves Spatial Reasoning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T10:41:41.697216Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2606.11683"},"observation_digest":"sha256:bdf2f4a59ed897f5e4adc4902f1146a8f3d0d3ae27b197d4bdc03272c82074c8","observation_id":"83a601e4-40bf-4523-8d9a-22308548fa91","resolution":{"observed_at":"2026-07-03T08:47:50.499205Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":"2504.00883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-07-03T16:18:37.298889Z","title":"Improved visual-spatial reasoning via r1-zero-like training","venue":null,"work_id":"57345232-ffec-48ff-ac2c-e58800253c84","year":2025},"citing_paper":{"arxiv_id":"2607.01784","last_updated":"2026-07-02T06:56:29Z","snapshot_observed_at":"2026-08-03T11:23:56.400674Z","submitted_at":"2026-07-02T06:56:29Z","title":"SpaceEra++: A Unified Framework Towards 3D Spatial Reasoning in Video","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-03T16:16:41.412451Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2607.01784"},"observation_digest":"sha256:686db84b31def2c1fd0fc4cd1bda1a9d0d0c5b5e911bfcbb5ad2f1320bb08b1a","observation_id":"11d33447-b8ce-4e57-bc5e-7f3061ada16f","resolution":{"observed_at":"2026-07-03T16:18:37.300491Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00883","snapshot_observed_at":"2026-08-02T00:23:01.979540Z","title":"Improved visual-spatial reasoning via r1-zero-like training","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15054","last_updated":"2026-07-16T14:31:16Z","snapshot_observed_at":"2026-08-06T08:47:40.413599Z","submitted_at":"2026-07-16T14:31:16Z","title":"Beyond Single Expert: Harmonizing Diverse Visual Priors in MLLMs for Spatial Understanding","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-02T00:23:01.979540Z"},"links":{"cited_paper":"/paper/2504.00883","citing_paper":"/paper/2607.15054"},"observation_digest":"sha256:edf1988747e8f3e4b431356b576cc4d82f3de0eb703d132e42d1ff2e7af6a72a","observation_id":"8c4a1fa3-70d6-499e-b42b-d96f56b54eb2","resolution":{"observed_at":"2026-08-02T00:23:01.979540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.00883/citation-record","integrity":"/paper/2504.00883/integrity","json":"/paper/2504.00883/citation-record.json","paper":"/paper/2504.00883"},"outbound":[],"paper":{"arxiv_id":"2504.00883","last_updated":"2025-04-14T20:12:57Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T16:17:09.409469Z","submitted_at":"2025-04-01T15:11:11Z","title":"Improved Visual-Spatial Reasoning via R1-Zero-Like Training"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 26 inbound Pith citation observations for arXiv:2504.00883."}