{"as_of":"2026-08-06T13:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0126bda16f78ca0afc2243baaf49721c7b8183b41da3a5cf6a43c026403157f8","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":31,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T05:57:51.050490Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T09:59:44.777709Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":"2401.06805","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-07-04T09:59:44.777709Z","title":"Exploring the reasoning abilities of multimodal large language models (mllms): A comprehensive survey on emerging trends in multimodal reasoning","venue":null,"work_id":"f8488283-5738-4b2a-9d3e-86913e913cdb","year":2024},"citing_paper":{"arxiv_id":"2410.04509","last_updated":"2026-04-20T02:03:24Z","snapshot_observed_at":"2026-08-02T21:14:32.237997Z","submitted_at":"2024-10-06T14:59:09Z","title":"ErrorRadar: Benchmarking Complex Mathematical Reasoning of Multimodal Large Language Models Via Error Detection","version":3},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-05-23T20:10:59.264484Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2410.04509"},"observation_digest":"sha256:ef879bbca1f86ea80f19ff273aba6c71074eaa5b74685bc7bfe764915f9aae25","observation_id":"0b2da07f-e806-4b7e-a552-f13f425ffe47","resolution":{"observed_at":"2026-05-23T20:13:24.651777Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":"2401.06805","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-07-04T09:59:44.777709Z","title":"Exploring the reasoning abilities of multimodal large language models (mllms): A comprehensive survey on emerging trends in multimodal reasoning","venue":null,"work_id":"f8488283-5738-4b2a-9d3e-86913e913cdb","year":2024},"citing_paper":{"arxiv_id":"2502.02871","last_updated":"2026-04-20T02:18:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-05T04:05:27Z","title":"Position: Multimodal Large Language Models Can Significantly Advance Scientific Reasoning","version":2},"reference_index":198,"source":"arxiv_source","source_observed_at":"2026-05-23T04:30:38.804702Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2502.02871"},"observation_digest":"sha256:c745972b74220137fede68efcb745d519ed92ac6f0f33b60c54c33bee79fde51","observation_id":"8847d598-5b09-49ee-9377-b84a0658d1b3","resolution":{"observed_at":"2026-05-23T04:32:32.853992Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":"2401.06805","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-07-04T09:59:44.777709Z","title":"Exploring the reasoning abilities of multimodal large language models (mllms): A comprehensive survey on emerging trends in multimodal reasoning","venue":null,"work_id":"f8488283-5738-4b2a-9d3e-86913e913cdb","year":2024},"citing_paper":{"arxiv_id":"2503.07536","last_updated":"2025-03-11T03:32:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-10T17:04:14Z","title":"LMM-R1: Empowering 3B LMMs with Strong Reasoning Abilities Through Two-Stage Rule-Based RL","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-16T15:15:46.255296Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2503.07536"},"observation_digest":"sha256:7f2280751e5ae505d69e673df758368a9eab2bc635ba2df7fb656e6c36627cf2","observation_id":"c7117d9e-44c6-4bd9-9c55-afd3332f733c","resolution":{"observed_at":"2026-05-16T15:15:46.312789Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":"2401.06805","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-07-04T09:59:44.777709Z","title":"Exploring the reasoning abilities of multimodal large language models (mllms): A comprehensive survey on emerging trends in multimodal reasoning","venue":null,"work_id":"f8488283-5738-4b2a-9d3e-86913e913cdb","year":2024},"citing_paper":{"arxiv_id":"2503.16549","last_updated":"2026-04-18T11:44:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-19T11:46:19Z","title":"MathFlow: Enhancing the Perceptual Flow of MLLMs for Visual Mathematical Problems","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-22T22:55:34.238427Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2503.16549"},"observation_digest":"sha256:c6300ae6542c1e70c5787c3e5b2f9a9f3db667fdd03cf76da28da3fdeddbf03f","observation_id":"e7c99b5f-2b23-4896-81d2-441100c7da1e","resolution":{"observed_at":"2026-05-22T22:57:13.410915Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":"2401.06805","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-07-04T09:59:44.777709Z","title":"Exploring the reasoning abilities of multimodal large language models (mllms): A comprehensive survey on emerging trends in multimodal reasoning","venue":null,"work_id":"f8488283-5738-4b2a-9d3e-86913e913cdb","year":2024},"citing_paper":{"arxiv_id":"2507.01908","last_updated":"2026-05-13T06:28:00Z","snapshot_observed_at":"2026-08-02T08:01:40.249812Z","submitted_at":"2025-07-02T17:22:21Z","title":"Reasoning to Edit: Hypothetical Instruction-Based Image Editing with Visual Reasoning","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-19T05:47:19.552825Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2507.01908"},"observation_digest":"sha256:e0174e6f199d9d14f98b476389baad87bbe6fd357483d42fbe2df63c2032b2f5","observation_id":"8e9ee500-0dcb-4a2f-906c-6f50032227b7","resolution":{"observed_at":"2026-05-19T05:52:07.985526Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":"2401.06805","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-07-04T09:59:44.777709Z","title":"Exploring the reasoning abilities of multimodal large language models (mllms): A comprehensive survey on emerging trends in multimodal reasoning","venue":null,"work_id":"f8488283-5738-4b2a-9d3e-86913e913cdb","year":2024},"citing_paper":{"arxiv_id":"2507.21540","last_updated":"2026-04-08T13:05:48Z","snapshot_observed_at":"2026-07-06T22:04:26.078628Z","submitted_at":"2025-07-29T07:13:56Z","title":"PRISM: Programmatic Reasoning with Image Sequence Manipulation for LVLM Jailbreaking","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-19T03:36:24.013477Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2507.21540"},"observation_digest":"sha256:85ee86155956fffb8cd4e589531573b1e64070213131a6772eede3e141e2a6cf","observation_id":"b13c8292-0d2e-4eed-9c48-d58e99344d59","resolution":{"observed_at":"2026-05-19T03:37:01.119697Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-08-06T05:57:51.050490Z","title":"Exploring the reasoning abilities of multimodal large language models (mllms): A comprehensive survey on emerging trends in multimodal reasoning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.050490Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:08ab99b8a71987e9353064179c5a7ce8721b582bb15ecc998dea9c053e6c76d5","observation_id":"5ab7640e-addd-4be7-b2f4-2910d7d78817","resolution":{"observed_at":"2026-08-06T05:57:51.050490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-08-06T00:59:41.320388Z","title":"Exploring the reasoning abilities of multimodal large language models (mllms): A comprehensive survey on emerging trends in multimodal reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.03986","last_updated":"2025-08-06T00:39:28Z","snapshot_observed_at":"2026-08-06T00:59:40.369207Z","submitted_at":"2025-08-06T00:39:28Z","title":"The Emotional Baby Is Truly Deadly: Does your Multimodal Large Reasoning Model Have Emotional Flattery towards Humans?","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T00:59:41.320388Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2508.03986"},"observation_digest":"sha256:10a209f3979f5c0046dbf07e0c20c4c2f5a29dfe163631b4e5d85d2bd96c537d","observation_id":"15ef3c24-902a-4c0f-a59c-05fa565f8774","resolution":{"observed_at":"2026-08-06T00:59:41.320388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-08-05T21:10:36.314261Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10057","last_updated":"2025-08-12T21:38:46Z","snapshot_observed_at":"2026-08-06T04:18:07.733770Z","submitted_at":"2025-08-12T21:38:46Z","title":"Large Language Models Show Signs of Alignment with Human Neurocognition During Abstract Reasoning","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-05T21:10:36.314261Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2508.10057"},"observation_digest":"sha256:ead620c6176962e2b43fcee05b57dbf5fca4e6634d162a04dd77aa46dcf14d0c","observation_id":"cc887b9b-36c5-4070-a7e2-26956cfdb73b","resolution":{"observed_at":"2026-08-05T21:10:36.314261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-08-05T20:31:53.870257Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10399","last_updated":"2025-08-14T06:56:16Z","snapshot_observed_at":"2026-08-06T07:55:46.567033Z","submitted_at":"2025-08-14T06:56:16Z","title":"Large Model Empowered Embodied AI: A Survey on Decision-Making and Embodied Learning","version":1},"reference_index":191,"source":"pdf_text","source_observed_at":"2026-08-05T20:31:53.870257Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2508.10399"},"observation_digest":"sha256:94d0a8ba7153f224ae18894a2557f7acf22059439e17be9e4083e69bb48ce952","observation_id":"77663c75-23bc-40cf-ae45-4fea7f918f0c","resolution":{"observed_at":"2026-08-05T20:31:53.870257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-08-05T17:26:48.552058Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.16318","last_updated":"2025-09-01T08:35:27Z","snapshot_observed_at":"2026-08-05T17:26:46.427457Z","submitted_at":"2025-08-22T11:57:55Z","title":"SATORI: Static Test Oracle Generation for REST APIs","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T17:26:48.552058Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2508.16318"},"observation_digest":"sha256:82a8b4e7769d76f3c981bb6df0f9e4156cacff0873abf8137da26d75f5201cf0","observation_id":"fa318581-36f8-4249-ba9b-7d7ec939165d","resolution":{"observed_at":"2026-08-05T17:26:48.552058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-08-05T05:12:54.499516Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05695","last_updated":"2025-09-06T12:11:43Z","snapshot_observed_at":"2026-08-05T05:12:53.952670Z","submitted_at":"2025-09-06T12:11:43Z","title":"Leveraging Vision-Language Large Models for Interpretable Video Action Recognition with Semantic Tokenization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T05:12:54.499516Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2509.05695"},"observation_digest":"sha256:562198d4dc257ca164cec5a7d9faa57bb588752947964ac3872a990538e5d129","observation_id":"ca171eef-4fd3-420a-8051-9f6507910840","resolution":{"observed_at":"2026-08-05T05:12:54.499516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-08-04T22:14:15.550079Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07473","last_updated":"2025-09-09T07:51:38Z","snapshot_observed_at":"2026-08-04T22:14:06.103299Z","submitted_at":"2025-09-09T07:51:38Z","title":"SheetDesigner: MLLM-Powered Spreadsheet Layout Generation with Rule-Based and Vision-Based Reflection","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T22:14:15.550079Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2509.07473"},"observation_digest":"sha256:a9b52e18661619fa8df3a0a4d748d72f9b8a0f951afdccb744c777ab75047ef2","observation_id":"5d91e788-d584-4756-a747-a78b5a31bf85","resolution":{"observed_at":"2026-08-04T22:14:15.550079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-08-04T19:34:25.404351Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09193","last_updated":"2025-09-11T07:09:30Z","snapshot_observed_at":"2026-08-05T09:01:00.880374Z","submitted_at":"2025-09-11T07:09:30Z","title":"AI Reasoning for Wireless Communications and Networking: A Survey and Perspectives","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T19:34:25.404351Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2509.09193"},"observation_digest":"sha256:74925acc68481981ac5a134ab93d50981bd5ad4dc901a972445f92e88cc33bc1","observation_id":"e8d72ed2-dcf4-4090-b0f6-b37a42c9706b","resolution":{"observed_at":"2026-08-04T19:34:25.404351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":"2401.06805","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-07-04T09:59:44.777709Z","title":"Exploring the reasoning abilities of multimodal large language models (mllms): A comprehensive survey on emerging trends in multimodal reasoning","venue":null,"work_id":"f8488283-5738-4b2a-9d3e-86913e913cdb","year":2024},"citing_paper":{"arxiv_id":"2511.14159","last_updated":"2026-07-17T15:39:00Z","snapshot_observed_at":"2026-08-03T21:43:56.189055Z","submitted_at":"2025-11-18T05:48:08Z","title":"MVI-Bench: A Comprehensive Benchmark for Evaluating Robustness to Misleading Visual Inputs in LVLMs","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-21T19:51:04.983299Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2511.14159"},"observation_digest":"sha256:ce630546eca0e57972b3b703847f24d311e0b0b132c94fbe3fd7e856aa187f02","observation_id":"6d39f313-f117-4f59-8bd8-a882444ee909","resolution":{"observed_at":"2026-05-21T19:54:20.248281Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-08-03T21:44:02.813473Z","title":"Exploring the reasoning abilities of multimodal large language models (mllms): A compre- hensive survey on emerging trends in multimodal reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.14159","last_updated":"2026-07-17T15:39:00Z","snapshot_observed_at":"2026-08-03T21:43:56.189055Z","submitted_at":"2025-11-18T05:48:08Z","title":"MVI-Bench: A Comprehensive Benchmark for Evaluating Robustness to Misleading Visual Inputs in LVLMs","version":4},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-03T21:44:02.813473Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2511.14159"},"observation_digest":"sha256:12275b2e71198f76e054d0e1a71220b86ddaf5ce54c600180f6224f2a7865a21","observation_id":"91346b78-69ce-4cd5-9fa8-964916bcd6b3","resolution":{"observed_at":"2026-08-03T21:44:02.813473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":"2401.06805","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-07-04T09:59:44.777709Z","title":"Exploring the reasoning abilities of multimodal large language models (mllms): A comprehensive survey on emerging trends in multimodal reasoning","venue":null,"work_id":"f8488283-5738-4b2a-9d3e-86913e913cdb","year":2024},"citing_paper":{"arxiv_id":"2603.04415","last_updated":"2026-05-09T08:44:16Z","snapshot_observed_at":"2026-07-06T22:47:50.848191Z","submitted_at":"2026-02-04T04:13:39Z","title":"Dual Tuning for Reasoning Efficacy-Driven Data Curation in Multimodal LLM Training","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T08:12:25.063204Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2603.04415"},"observation_digest":"sha256:c36961ab5e1299ce0a2075e7c8419504070835072dce2fd0d9f9b887e6904137","observation_id":"91be9c46-15bf-4390-aee6-8426011432d5","resolution":{"observed_at":"2026-05-16T08:12:35.420031Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":"2401.06805","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-07-04T09:59:44.777709Z","title":"Exploring the reasoning abilities of multimodal large language models (mllms): A comprehensive survey on emerging trends in multimodal reasoning","venue":null,"work_id":"f8488283-5738-4b2a-9d3e-86913e913cdb","year":2024},"citing_paper":{"arxiv_id":"2604.07518","last_updated":"2026-04-08T18:52:27Z","snapshot_observed_at":"2026-07-06T22:55:46.307881Z","submitted_at":"2026-04-08T18:52:27Z","title":"Decompose, Look, and Reason: Reinforced Latent Reasoning for VLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T17:12:33.231488Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2604.07518"},"observation_digest":"sha256:cdaa6956daefccdaf5f1aa984ae911c34ddcc8e3ac75a24d4b084191d8e14b6f","observation_id":"22ce4050-fbb7-42bb-bc97-7b4ed160d06d","resolution":{"observed_at":"2026-05-11T07:21:00.732474Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":"2401.06805","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-07-04T09:59:44.777709Z","title":"Exploring the reasoning abilities of multimodal large language models (mllms): A comprehensive survey on emerging trends in multimodal reasoning","venue":null,"work_id":"f8488283-5738-4b2a-9d3e-86913e913cdb","year":2024},"citing_paper":{"arxiv_id":"2604.08645","last_updated":"2026-04-09T17:57:35Z","snapshot_observed_at":"2026-07-06T22:57:40.773778Z","submitted_at":"2026-04-09T17:57:35Z","title":"3D-VCD: Hallucination Mitigation in 3D-LLM Embodied Agents through Visual Contrastive Decoding","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-10T17:51:52.063238Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2604.08645"},"observation_digest":"sha256:28da35672e441d58164b12163dcc6d499e952ca69f7d93f44a39d37ae9840ab6","observation_id":"17be4f44-b564-4c49-b36b-7894eb917c0e","resolution":{"observed_at":"2026-05-11T05:56:00.234454Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-07-12T22:22:06.385856Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.10783","last_updated":"2026-05-25T13:18:36Z","snapshot_observed_at":"2026-07-12T22:21:23.393919Z","submitted_at":"2026-04-12T19:18:02Z","title":"Learning Preference-Based Objectives from Clinical Narratives for Dynamic Sepsis Treatment","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-12T22:22:06.385856Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2604.10783"},"observation_digest":"sha256:3df05bdd41dfcb32fd8f8958a40117052fa17de7abefa21d161f4ff54ae7da02","observation_id":"050fd947-b622-4700-91a6-a22fec9d2dde","resolution":{"observed_at":"2026-07-12T22:22:06.385856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":"2401.06805","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-07-04T09:59:44.777709Z","title":"Exploring the reasoning abilities of multimodal large language models (mllms): A comprehensive survey on emerging trends in multimodal reasoning","venue":null,"work_id":"f8488283-5738-4b2a-9d3e-86913e913cdb","year":2024},"citing_paper":{"arxiv_id":"2604.12335","last_updated":"2026-04-14T06:17:35Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T06:17:35Z","title":"All in One: A Unified Synthetic Data Pipeline for Multimodal Video Understanding","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-10T15:26:55.369840Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2604.12335"},"observation_digest":"sha256:3d028fd587866f93684035d9b3efc30cb3e3c47d67730c0eb84eb1934f0b3edb","observation_id":"be0cbbab-f994-47b4-adba-cbadba729324","resolution":{"observed_at":"2026-05-11T10:31:03.847437Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":"2401.06805","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-07-04T09:59:44.777709Z","title":"Exploring the reasoning abilities of multimodal large language models (mllms): A comprehensive survey on emerging trends in multimodal reasoning","venue":null,"work_id":"f8488283-5738-4b2a-9d3e-86913e913cdb","year":2024},"citing_paper":{"arxiv_id":"2604.20254","last_updated":"2026-04-22T07:03:25Z","snapshot_observed_at":"2026-07-06T23:06:44.624357Z","submitted_at":"2026-04-22T07:03:25Z","title":"Mol-Debate: Multi-Agent Debate Improves Structural Reasoning in Molecular Design","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-10T00:42:32.617355Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2604.20254"},"observation_digest":"sha256:deb327cb45742560d341a02e320d9ddfd17f4009d1f6b8047d65349676b65fca","observation_id":"57ead0d9-aa04-4116-951c-43c33b0e8f39","resolution":{"observed_at":"2026-05-10T00:49:49.012626Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":"2401.06805","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-07-04T09:59:44.777709Z","title":"Exploring the reasoning abilities of multimodal large language models (mllms): A comprehensive survey on emerging trends in multimodal reasoning","venue":null,"work_id":"f8488283-5738-4b2a-9d3e-86913e913cdb","year":2024},"citing_paper":{"arxiv_id":"2605.11931","last_updated":"2026-05-12T10:44:35Z","snapshot_observed_at":"2026-08-04T20:02:44.548803Z","submitted_at":"2026-05-12T10:44:35Z","title":"Learn to Think: Improving Multimodal Reasoning through Vision-Aware Self-Improvement Training","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-13T06:17:57.264809Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2605.11931"},"observation_digest":"sha256:20507eb331ae34c00b3d58f5aa9696ef23f243468d1315d0cada6a2eca5866db","observation_id":"de2faed8-6e47-418c-b11a-458575130d60","resolution":{"observed_at":"2026-05-13T06:22:23.494875Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":"2401.06805","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-07-04T09:59:44.777709Z","title":"Exploring the reasoning abilities of multimodal large language models (mllms): A comprehensive survey on emerging trends in multimodal reasoning","venue":null,"work_id":"f8488283-5738-4b2a-9d3e-86913e913cdb","year":2024},"citing_paper":{"arxiv_id":"2605.13375","last_updated":"2026-05-13T11:32:03Z","snapshot_observed_at":"2026-08-03T03:38:06.980857Z","submitted_at":"2026-05-13T11:32:03Z","title":"GRIP-VLM: Group-Relative Importance Pruning for Efficient Vision-Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-14T19:15:13.205594Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2605.13375"},"observation_digest":"sha256:a9ba4cb4e0a7ab72a4bc1ac8d8360f0ae1994414e1bd433354c52e272ee29d4b","observation_id":"d98ab346-77fb-4b13-9544-93c49b75b348","resolution":{"observed_at":"2026-05-14T19:17:50.811951Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":"2401.06805","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-07-04T09:59:44.777709Z","title":"Exploring the reasoning abilities of multimodal large language models (mllms): A comprehensive survey on emerging trends in multimodal reasoning","venue":null,"work_id":"f8488283-5738-4b2a-9d3e-86913e913cdb","year":2024},"citing_paper":{"arxiv_id":"2605.20950","last_updated":"2026-05-20T09:37:53Z","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T09:37:53Z","title":"Focus-then-Context: Subject-Centric Progressive Visual Token Reduction for Vision-Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-21T05:20:55.448430Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2605.20950"},"observation_digest":"sha256:175c853ebdd619cbbda204513b2cd161554244cb89b9e42f4df825b4200d4f59","observation_id":"5f725fde-596d-44d7-aec4-537f102a3482","resolution":{"observed_at":"2026-05-21T05:23:58.507985Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":"2401.06805","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-07-04T09:59:44.777709Z","title":"Exploring the reasoning abilities of multimodal large language models (mllms): A comprehensive survey on emerging trends in multimodal reasoning","venue":null,"work_id":"f8488283-5738-4b2a-9d3e-86913e913cdb","year":2024},"citing_paper":{"arxiv_id":"2605.27960","last_updated":"2026-05-27T04:54:07Z","snapshot_observed_at":"2026-08-03T00:24:19.442122Z","submitted_at":"2026-05-27T04:54:07Z","title":"Mags-RL: Wearing Multimodal LLMs a Magnifying Glass via Agentic Reinforcement Learning For Complex Scene Reasoning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-29T13:38:01.819121Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2605.27960"},"observation_digest":"sha256:df16299dd5fdec91eb12ceb9b7b6cfdb0ba98a2ed1d771311b757758cba25c44","observation_id":"fce0f2f0-498d-4079-955a-b7992d695fbd","resolution":{"observed_at":"2026-06-29T13:43:29.006421Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":"2401.06805","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-07-04T09:59:44.777709Z","title":"Exploring the reasoning abilities of multimodal large language models (mllms): A comprehensive survey on emerging trends in multimodal reasoning","venue":null,"work_id":"f8488283-5738-4b2a-9d3e-86913e913cdb","year":2024},"citing_paper":{"arxiv_id":"2606.03713","last_updated":"2026-06-02T14:34:48Z","snapshot_observed_at":"2026-08-01T18:41:34.888563Z","submitted_at":"2026-06-02T14:34:48Z","title":"Investigating Adversarial Robustness of Multi-modal Large Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-28T11:11:34.152223Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2606.03713"},"observation_digest":"sha256:d0223eaafc2052cb626f064e9673185ffb9ef73ba4b4575e1266cc22a9bbd27e","observation_id":"86fc9560-a05a-46b4-9af2-0a8545c80a21","resolution":{"observed_at":"2026-07-02T02:06:27.607029Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-08-03T02:09:36.267326Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.16639","last_updated":"2026-07-31T15:22:45Z","snapshot_observed_at":"2026-08-06T02:48:18.688611Z","submitted_at":"2026-06-15T12:27:33Z","title":"SPICE: Synergy and Partial Information Based Curriculum Evolution","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T02:09:36.267326Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2606.16639"},"observation_digest":"sha256:b15d04d8990a20d2f1f377efd67418dbfc7017bc30638a19fe967bd22a0af38c","observation_id":"7e4be221-1973-4068-8fe2-80caf02295d6","resolution":{"observed_at":"2026-08-03T02:09:36.267326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":"2401.06805","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-07-04T09:59:44.777709Z","title":"Exploring the reasoning abilities of multimodal large language models (mllms): A comprehensive survey on emerging trends in multimodal reasoning","venue":null,"work_id":"f8488283-5738-4b2a-9d3e-86913e913cdb","year":2024},"citing_paper":{"arxiv_id":"2606.22873","last_updated":"2026-06-25T18:44:01Z","snapshot_observed_at":"2026-08-02T23:29:21.699637Z","submitted_at":"2026-06-22T05:37:43Z","title":"SingGuard: A Policy-Adaptive Multimodal LLM Guardrail with Dynamic Reasoning","version":2},"reference_index":279,"source":"arxiv_source","source_observed_at":"2026-06-26T09:19:50.623741Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2606.22873"},"observation_digest":"sha256:3391354e4270753da95a385325f7aa22c718ab5bfc20a48653ddfe16012f5294","observation_id":"845c266d-a0c7-4114-b019-d98d8ccc6040","resolution":{"observed_at":"2026-07-04T09:59:44.779117Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":"2401.06805","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-07-04T09:59:44.777709Z","title":"Exploring the reasoning abilities of multimodal large language models (mllms): A comprehensive survey on emerging trends in multimodal reasoning","venue":null,"work_id":"f8488283-5738-4b2a-9d3e-86913e913cdb","year":2024},"citing_paper":{"arxiv_id":"2606.22873","last_updated":"2026-06-25T18:44:01Z","snapshot_observed_at":"2026-08-02T23:29:21.699637Z","submitted_at":"2026-06-22T05:37:43Z","title":"SingGuard: A Policy-Adaptive Multimodal LLM Guardrail with Dynamic Reasoning","version":3},"reference_index":278,"source":"arxiv_source","source_observed_at":"2026-06-29T01:18:19.195007Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2606.22873"},"observation_digest":"sha256:b0c9145a72956d49b6c65fd9b656223dd77c4b25b81d9fbde45a123a92ff7db5","observation_id":"6002f94b-0bf0-40d4-84a0-a215daebff55","resolution":{"observed_at":"2026-07-01T18:55:59.608772Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-08-01T08:33:10.377116Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21105","last_updated":"2026-08-05T03:26:54Z","snapshot_observed_at":"2026-08-06T12:30:23.745274Z","submitted_at":"2026-07-23T09:35:32Z","title":"HalluScope: Fine-grained Hallucination Diagnosis for Multimodal Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T08:33:10.377116Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2607.21105"},"observation_digest":"sha256:b1339e88f433d4fee7d2e92b619e4c2d1466434f646fd49078728d875deb5b34","observation_id":"95753894-36ad-4324-96fe-abc79050a56b","resolution":{"observed_at":"2026-08-01T08:33:10.377116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2401.06805/citation-record","integrity":"/paper/2401.06805/integrity","json":"/paper/2401.06805/citation-record.json","paper":"/paper/2401.06805"},"outbound":[],"paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 31 inbound Pith citation observations for arXiv:2401.06805."}