{"as_of":"2026-08-09T21:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:830f95db788b1d18bffdc01c97e757bbee13621b3f57bcee19721f238491442d","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":23,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:50:32.927998Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T09:09:43.184299Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-08-07T13:50:32.927998Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20728","last_updated":"2025-08-26T03:25:38Z","snapshot_observed_at":"2026-08-08T14:42:44.924849Z","submitted_at":"2025-05-27T05:17:41Z","title":"Jigsaw-Puzzles: From Seeing to Understanding to Reasoning in Vision-Language Models","version":4},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T13:50:32.927998Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2505.20728"},"observation_digest":"sha256:a220b98058f8153dada24dc25c08e8d72a5eec865e2d8752466920a161e9602f","observation_id":"dc85e25c-5131-46e0-a594-a8fb0bacfe77","resolution":{"observed_at":"2026-08-07T13:50:32.927998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-08-07T13:35:59.800576Z","title":"Visualpuzzles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21327","last_updated":"2025-05-27T15:23:23Z","snapshot_observed_at":"2026-08-08T22:42:35.699276Z","submitted_at":"2025-05-27T15:23:23Z","title":"MME-Reasoning: A Comprehensive Benchmark for Logical Reasoning in MLLMs","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T13:35:59.800576Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2505.21327"},"observation_digest":"sha256:98fec50de5040c53de9d5b214757a213614888dbb2e8870ebf8d064d63259aa5","observation_id":"e8aab8db-8a7b-4c70-acd6-5180a716456b","resolution":{"observed_at":"2026-08-07T13:35:59.800576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-08-07T12:42:18.894158Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23977","last_updated":"2025-05-29T20:08:36Z","snapshot_observed_at":"2026-08-09T14:39:26.249780Z","submitted_at":"2025-05-29T20:08:36Z","title":"VisualSphinx: Large-Scale Synthetic Vision Logic Puzzles for RL","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:42:18.894158Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2505.23977"},"observation_digest":"sha256:c4afd12bd7253b63c46823184ea39c0f0b03e89291ff667669fd92ec568083c2","observation_id":"0299d2e3-07dc-4d17-91fe-4aac498c87bb","resolution":{"observed_at":"2026-08-07T12:42:18.894158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-08-06T18:31:31.285831Z","title":"Vi- sualpuzzles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07998","last_updated":"2025-08-27T07:42:56Z","snapshot_observed_at":"2026-08-07T15:21:56.692035Z","submitted_at":"2025-07-10T17:59:55Z","title":"PyVision: Agentic Vision with Dynamic Tooling","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T18:31:31.285831Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2507.07998"},"observation_digest":"sha256:6bf8a53c624d54c947a64c096fde510473c1295667cceeebfea36264695e5e84","observation_id":"1bd79913-9728-404c-a379-a26deb8e6c40","resolution":{"observed_at":"2026-08-06T18:31:31.285831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2602.18600","last_updated":"2026-07-29T09:42:45Z","snapshot_observed_at":"2026-08-02T22:00:02.664173Z","submitted_at":"2026-02-20T20:22:18Z","title":"MapTab: A Diagnostic Benchmark for Long-Horizon Multi-Criteria Multimodal Reasoning on Heterogeneous Topological Graphs","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-15T20:12:46.385646Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2602.18600"},"observation_digest":"sha256:552d7a68207e908ac843711fcbf849b0d1fb47efbf49113162fb0bdb34af0103","observation_id":"157d773d-61dd-4579-a0a3-75a727390367","resolution":{"observed_at":"2026-05-15T20:16:34.725580Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2602.18600","last_updated":"2026-07-29T09:42:45Z","snapshot_observed_at":"2026-08-02T22:00:02.664173Z","submitted_at":"2026-02-20T20:22:18Z","title":"MapTab: A Diagnostic Benchmark for Long-Horizon Multi-Criteria Multimodal Reasoning on Heterogeneous Topological Graphs","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:06.829915Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2602.18600"},"observation_digest":"sha256:c9b41b191f5237f2ce533b77e21e6c48e6a54a63e941d470a7fe2c73e035dd2b","observation_id":"14012aca-e9b3-4b09-ba82-9391edd17e32","resolution":{"observed_at":"2026-05-22T10:31:25.285893Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-08-02T22:00:09.028700Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge.arXiv preprint arXiv:2504.10342, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18600","last_updated":"2026-07-29T09:42:45Z","snapshot_observed_at":"2026-08-02T22:00:02.664173Z","submitted_at":"2026-02-20T20:22:18Z","title":"MapTab: A Diagnostic Benchmark for Long-Horizon Multi-Criteria Multimodal Reasoning on Heterogeneous Topological Graphs","version":5},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-02T22:00:09.028700Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2602.18600"},"observation_digest":"sha256:f6161a359371e9f8a44b0e33bba0bd3841fedd6fd14d0306f9e1f5be1248d919","observation_id":"36dc0cea-f4ce-4c15-8b78-2988d4cbaf90","resolution":{"observed_at":"2026-08-02T22:00:09.028700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-13T19:19:52.557913Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.26779","last_updated":"2026-05-31T01:38:33Z","snapshot_observed_at":"2026-08-06T23:53:55.163569Z","submitted_at":"2026-03-25T01:17:13Z","title":"Limits of Spatial Imagery Reasoning in Frontier LLM Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-13T19:19:52.557913Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2603.26779"},"observation_digest":"sha256:342bfa639edd3f86941e9f9965195205587d11f9d6c130383e650ab94eb5f712","observation_id":"28dea71a-aa68-40be-9c65-92537819bd3b","resolution":{"observed_at":"2026-07-13T19:19:52.557913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2604.06247","last_updated":"2026-04-06T16:29:05Z","snapshot_observed_at":"2026-07-06T22:54:48.916799Z","submitted_at":"2026-04-06T16:29:05Z","title":"SALLIE: Safeguarding Against Latent Language & Image Exploits","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T19:04:46.426969Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2604.06247"},"observation_digest":"sha256:8dbe0fda59c16dff26f9e9704db491c0a99cb6f3aaa0580eed180fb95cae742c","observation_id":"8c9eab83-c05a-49e5-9dea-746e01f64a12","resolution":{"observed_at":"2026-05-10T23:30:51.295449Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2604.10999","last_updated":"2026-06-06T02:58:48Z","snapshot_observed_at":"2026-08-08T01:31:41.325067Z","submitted_at":"2026-04-13T04:58:52Z","title":"TraversalBench: Challenging Paths to Follow for Vision Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T15:25:38.215013Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2604.10999"},"observation_digest":"sha256:4a91eb5a2ce6e35930c37d99c527a6c829cb378e2214c5dbf68e49ae4d5d926c","observation_id":"32710ea2-6bc0-4cea-a032-ea0f33c017a4","resolution":{"observed_at":"2026-05-11T10:36:02.685510Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2605.09262","last_updated":"2026-05-10T02:17:14Z","snapshot_observed_at":"2026-07-06T23:21:21.560069Z","submitted_at":"2026-05-10T02:17:14Z","title":"Reinforcing Multimodal Reasoning Against Visual Degradation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-12T04:37:21.451146Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2605.09262"},"observation_digest":"sha256:54e79a22c3db9845c95b3e771e0d9565e578e93157319b8e45b9433b076dee4a","observation_id":"7a59ac05-a125-454e-ae97-d8497ee5de87","resolution":{"observed_at":"2026-05-12T06:06:25.204696Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2605.12163","last_updated":"2026-05-13T02:23:44Z","snapshot_observed_at":"2026-08-02T15:57:40.981833Z","submitted_at":"2026-05-12T14:13:08Z","title":"Self-Consistent Latent Reasoning: Long Latent Sequence Reasoning for Vision-Language Model","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-13T07:14:48.918959Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2605.12163"},"observation_digest":"sha256:af2817c332b7e9e3fd99eb673875c4293f9474a172952e6641d1fe32e3ccea83","observation_id":"17dca504-fc9a-489b-bffe-4dcc82decf55","resolution":{"observed_at":"2026-05-13T07:17:29.199028Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2605.12163","last_updated":"2026-05-13T02:23:44Z","snapshot_observed_at":"2026-08-02T15:57:40.981833Z","submitted_at":"2026-05-12T14:13:08Z","title":"Self-Consistent Latent Reasoning: Long Latent Sequence Reasoning for Vision-Language Model","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-14T21:47:50.595481Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2605.12163"},"observation_digest":"sha256:b3b0862c624f199f60a041fb9341bb7290e1eec4ac496d5e7c5a0f236680fcd2","observation_id":"048ff051-86d8-4ffa-9f85-f94b1affb024","resolution":{"observed_at":"2026-05-14T21:48:00.572342Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2605.19342","last_updated":"2026-05-27T02:07:05Z","snapshot_observed_at":"2026-08-03T16:06:14.906537Z","submitted_at":"2026-05-19T04:29:33Z","title":"Semantic-Enriched Latent Visual Reasoning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T06:40:55.537488Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2605.19342"},"observation_digest":"sha256:f8647e7e853f5b32bb84864c931f06a08261b0a719273fdab45b864fe412c3a4","observation_id":"4cd7d506-de3d-4848-95b4-e600246450b2","resolution":{"observed_at":"2026-05-20T06:43:05.875829Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2605.19342","last_updated":"2026-05-27T02:07:05Z","snapshot_observed_at":"2026-08-03T16:06:14.906537Z","submitted_at":"2026-05-19T04:29:33Z","title":"Semantic-Enriched Latent Visual Reasoning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T18:48:04.370230Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2605.19342"},"observation_digest":"sha256:7bfffd8fa1264843938f7e74bbaaf9512559a65adb256fb0bc21520c7dd2ce4d","observation_id":"db4ee2f6-c4f7-4e38-97bb-966aba36fff3","resolution":{"observed_at":"2026-06-30T18:55:00.779176Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2606.00148","last_updated":"2026-05-29T03:20:05Z","snapshot_observed_at":"2026-07-06T23:40:51.363776Z","submitted_at":"2026-05-29T03:20:05Z","title":"StemBind: When MLLMs Get Lost Between Rules and Instances in Abstract Visual Reasoning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-28T23:15:56.598968Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2606.00148"},"observation_digest":"sha256:e77881f2d0a69a4a130d4642bd7ac0cc4e57286ddf63540d4342546b49630999","observation_id":"6b9996d1-738b-4331-a89d-f3355faf8ac1","resolution":{"observed_at":"2026-06-29T00:12:50.317499Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2606.18216","last_updated":"2026-06-16T17:46:02Z","snapshot_observed_at":"2026-08-09T07:41:33.424534Z","submitted_at":"2026-06-16T17:46:02Z","title":"Zone of Proximal Policy Optimization: Teacher in Prompts, Not Gradients","version":1},"reference_index":141,"source":"pdf_text","source_observed_at":"2026-06-27T01:08:52.981296Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2606.18216"},"observation_digest":"sha256:a6e05f3753c58070e78027c4b493d9111f571ea95aeebc135c719dd214ef3533","observation_id":"0d4afd7a-2761-4209-b41e-ba36b85a72e4","resolution":{"observed_at":"2026-07-03T20:48:56.116501Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2606.22565","last_updated":"2026-06-21T15:59:41Z","snapshot_observed_at":"2026-08-06T21:11:27.037310Z","submitted_at":"2026-06-21T15:59:41Z","title":"Look Light, Think Heavy: What Multimodal Chain-of-Thought Reasoning Can and Cannot Do","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T10:27:43.396559Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2606.22565"},"observation_digest":"sha256:53090326bb7f796a00eae044971b96e467360d94181ace5339f3811d0f14e153","observation_id":"91627fbf-52d5-4376-b522-4392b0c57f4a","resolution":{"observed_at":"2026-07-04T09:09:43.185822Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2607.02032","last_updated":"2026-07-06T17:18:28Z","snapshot_observed_at":"2026-08-06T15:12:20.089291Z","submitted_at":"2026-07-02T10:59:03Z","title":"PACE: A Proxy for Agentic Capability Evaluation","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-07-03T13:34:39.350893Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2607.02032"},"observation_digest":"sha256:7462b57c16e2e2f710e1c9970f369e58db19c4b5dd0435ee6b4428cdacb01934","observation_id":"843e4628-03f0-49c5-80f1-819965140d95","resolution":{"observed_at":"2026-07-03T13:38:18.468017Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-12T08:29:58.561496Z","title":"arXiv preprint arXiv:2504.10342 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.02032","last_updated":"2026-07-06T17:18:28Z","snapshot_observed_at":"2026-08-06T15:12:20.089291Z","submitted_at":"2026-07-02T10:59:03Z","title":"PACE: A Proxy for Agentic Capability Evaluation","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-07-12T08:29:58.561496Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2607.02032"},"observation_digest":"sha256:05ca6bb0765c25d077168c0d6bf2f0cb960270c3edc138934baf5eb0644be9a5","observation_id":"ef855c3d-5503-47e4-8adb-f9d5f82bc823","resolution":{"observed_at":"2026-07-12T08:29:58.561496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-08-01T11:47:26.293957Z","title":"VisualPuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge.arXiv preprint arXiv:2504.10342, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19790","last_updated":"2026-07-22T06:17:57Z","snapshot_observed_at":"2026-08-06T04:55:07.559078Z","submitted_at":"2026-07-22T06:17:57Z","title":"Trace: A Taxonomy-Guided Environment for Multidomain Visual Reasoning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T11:47:26.293957Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2607.19790"},"observation_digest":"sha256:7e7522f9fb2ef4a2c02fb8b21a07339b5c7c4f50ab0ea677a63bb3f806cbae78","observation_id":"ca6f6a0e-2630-43d9-9ccf-325d95d6ef81","resolution":{"observed_at":"2026-08-01T11:47:26.293957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-31T02:45:28.647722Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge.arXiv preprint arXiv:2504.10342, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28595","last_updated":"2026-07-30T17:46:55Z","snapshot_observed_at":"2026-08-03T15:42:49.918444Z","submitted_at":"2026-07-30T17:46:55Z","title":"Beacon: Knowing When and How to Perform Agentic Visual Reasoning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-31T02:45:28.647722Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2607.28595"},"observation_digest":"sha256:8471a3b075fb212a1fab5673d5249274b5b250d7d900c9a02f00b352c47dc20a","observation_id":"6b89ba06-8336-4c64-8b10-f79a53b39f0d","resolution":{"observed_at":"2026-07-31T02:45:28.647722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-08-05T00:28:16.463177Z","title":"Tong,J.;Gu,J.;Lou,Y.;Fan,L.;Zou,Y.;Wu,Y.;Ye,J.;and Li,R.2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00743","last_updated":"2026-08-01T16:27:45Z","snapshot_observed_at":"2026-08-08T13:32:58.204109Z","submitted_at":"2026-08-01T16:27:45Z","title":"LUT: Latent Utility Training for Visual Reasoning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:16.463177Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2608.00743"},"observation_digest":"sha256:5562cf1a0efde8c1f640572407d009b0e7fed9c4089eb477edd7fe7ee2b647e5","observation_id":"911b0bbe-095d-4888-802d-e7e9880745fa","resolution":{"observed_at":"2026-08-05T00:28:16.463177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.10342/citation-record","integrity":"/paper/2504.10342/integrity","json":"/paper/2504.10342/citation-record.json","paper":"/paper/2504.10342"},"outbound":[],"paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 23 inbound Pith citation observations for arXiv:2504.10342."}