{"as_of":"2026-08-13T23:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d64c60cf4d03175dcbbd346e7eaf560ba823a3ad95d329c31bba3d11e831a681","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:47:36.084003Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T13:07:41.729629Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-16T10:32:44.942041Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17609","snapshot_observed_at":"2026-08-03T13:07:41.729629Z","title":"Decoupled visual interpretation and linguistic reasoning for math problem solving.arXiv preprint arXiv:2505.17609, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.00501","last_updated":"2026-05-26T22:35:38Z","snapshot_observed_at":"2026-08-13T02:05:32.120498Z","submitted_at":"2026-01-01T22:48:26Z","title":"CPPO: Contrastive Perception Policy Optimization for VLM Agents","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T13:07:41.729629Z"},"links":{"cited_paper":"/paper/2505.17609","citing_paper":"/paper/2601.00501"},"observation_digest":"sha256:e3b303b4eb060915ac4a89919e73dd1067e0dab8b09de907661b2805de80bb16","observation_id":"810f532a-3356-4d45-b17f-066ddf3c9118","resolution":{"observed_at":"2026-08-03T13:07:41.729629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"cited_work":{"arxiv_id":"2505.17609","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17609","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Decoupled visual interpretation and linguistic reasoning for math problem solving","venue":null,"work_id":"1f89a9fd-5771-4998-bf5d-9a783e810f83","year":2025},"citing_paper":{"arxiv_id":"2601.21164","last_updated":"2026-05-09T13:45:18Z","snapshot_observed_at":"2026-08-13T19:38:21.173101Z","submitted_at":"2026-01-29T02:03:33Z","title":"Concise Geometric Description as a Bridge: Unleashing the Potential of LLM for Plane Geometry Problem Solving","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T10:31:06.712428Z"},"links":{"cited_paper":"/paper/2505.17609","citing_paper":"/paper/2601.21164"},"observation_digest":"sha256:6b1bf00edf2e964e245b07b2bdf303c0309b9d3a874443be4a5f2ec3fee66df9","observation_id":"87c3c1dd-5e30-4533-b455-2fdf424e070c","resolution":{"observed_at":"2026-05-16T10:32:44.943620Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.17609/citation-record","integrity":"/paper/2505.17609/integrity","json":"/paper/2505.17609/citation-record.json","paper":"/paper/2505.17609"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:30.291808Z","title":"Flamingo: a visual language model for few-shot learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:30.291808Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:de613f3d2e6893572eca5776e0e571ead24d4a508bed8d32850d1cdc8d1e79b9","observation_id":"a7cf1643-08b3-4264-8a0d-34ff03143c1a","resolution":{"observed_at":"2026-08-07T14:47:30.291808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-07T14:47:30.390793Z","title":"Qwen technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:30.390793Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:e991983fb3458b7490c1ed0f41531bacf849facc20a8bf37ce64d9467012c1e9","observation_id":"533f91e3-e6e0-40e3-a99f-ccfd8133d26c","resolution":{"observed_at":"2026-08-07T14:47:30.390793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20330","last_updated":"2024-04-09T15:17:50Z","snapshot_observed_at":"2026-08-07T12:15:30.838846Z","submitted_at":"2024-03-29T17:59:34Z","title":"Are We on the Right Way for Evaluating Large Vision-Language Models?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20330","snapshot_observed_at":"2026-08-07T14:47:30.484426Z","title":"Are we on the right way for evaluating large vision-language models? arXiv preprint arXiv:2403.20330,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:30.484426Z"},"links":{"cited_paper":"/paper/2403.20330","citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:806d7fe7fb7d7b4968164b19838a7cbaafcfd7804605b074ca643e4fd9a184fc","observation_id":"552ad251-ec16-47e3-8ae4-0f615f32382f","resolution":{"observed_at":"2026-08-07T14:47:30.484426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:42.955044Z","title":"Comt: A novel benchmark for chain of multi-modal thought on large vision- language models, 2024","venue":null,"work_id":"5daea41c-13cf-4aa8-b4c5-45f4203dd859","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:30.637752Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:4fbb0aa600e29774d89f995ae011a35d9e4cf3de255ca68fb2c014399e3af3c6","observation_id":"56b1ef94-3b59-4823-b454-ed683db651db","resolution":{"observed_at":"2026-08-07T14:47:43.045383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:42.778166Z","title":"R-cot: Reverse chain-of-thought problem generation for geometric reasoning in large multimodal models, 2024","venue":null,"work_id":"e271abfa-d204-4049-a280-16b3ea58d71a","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:30.759765Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:6b1f7258cc7e2f69e5cea068fefacdd64e9a9bec46d0f3566787e31d33ac00cd","observation_id":"d4861593-0ad5-486e-aa9f-176f8dcd5bd1","resolution":{"observed_at":"2026-08-07T14:47:42.873009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:42.576680Z","title":"G-llava: Solving geomet- ric problem with multi-modal large language model, 2023","venue":null,"work_id":"8b2fafd1-a1f6-424f-93a4-5031f7c8824b","year":2023},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:30.892440Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:3c6617a4bb5684401389c9eed65a742bebb4484c0bdada4a234ab9ef9b8e3f9c","observation_id":"0ea2a75a-960a-4a94-a8de-75aa43244682","resolution":{"observed_at":"2026-08-07T14:47:42.677269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:42.365846Z","title":"Interleaved-modal chain-of-thought, 2024","venue":null,"work_id":"7770ca0d-7f6b-4236-971f-40bf8d06a143","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:31.048269Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:20fb75e6f429d591d12785298fb4f34b24e9eacddded9dd3e5d275f79f4ca7d1","observation_id":"9edcad66-0962-4658-9157-0d39ca24da16","resolution":{"observed_at":"2026-08-07T14:47:42.476504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-13T15:58:13.809876Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T14:47:31.177597Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:31.177597Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:162d4f6426d67d62cf8fbe901eee0a6e3cfbe4e37b40b3106f01c3d3474f485c","observation_id":"c39060a5-ecab-4cc9-b748-7be13bca7710","resolution":{"observed_at":"2026-08-07T14:47:31.177597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:42.122991Z","title":"Infimm-webmath-40b: Ad- vancing multimodal pre-training for enhanced mathematical reasoning, 2024","venue":null,"work_id":"2cd24b88-4577-4600-96d8-2a4b431f5ed6","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:31.348600Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:83ddbe4fa8fee8f475e2c291fd4990aac4069240719a0b0336f7a8da132739a0","observation_id":"42a41d0e-8bde-4065-a0c4-786dc5f47374","resolution":{"observed_at":"2026-08-07T14:47:42.241732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:41.945350Z","title":"Can mllms reason in multimodality? emma: An enhanced multimodal reasoning benchmark, 2025","venue":null,"work_id":"d0dbbc20-d48e-4349-98d6-46f8bcff071d","year":2025},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:31.462609Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:e5fd41ec04af18ad601fd1274af30725c2e4b21dfadf5de6e65b8d44ff3361ac","observation_id":"fe2b4cc8-b3ac-4878-960e-8210d466fed2","resolution":{"observed_at":"2026-08-07T14:47:42.032216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:41.762113Z","title":"V- star: Training verifiers for self-taught reasoners, 2024","venue":null,"work_id":"64516a5d-c240-4b99-a2c5-0c2eb5f29c9f","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:31.620508Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:ac062b04034b35c9c5f3992c2293f271201ad13d3c308c674a00dcfce0cf6068","observation_id":"1305a56a-5437-46ef-87c5-f29bb8916d3f","resolution":{"observed_at":"2026-08-07T14:47:41.850434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:41.547699Z","title":"Why vision language models struggle with visual arithmetic? to- wards enhanced chart and geometry understanding, 2025","venue":null,"work_id":"9dc6041a-6b15-4e58-8894-116b31e8a258","year":2025},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:31.727616Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:c4b2dfdcebd342518d31a6d8759bc74ce85d797e5cd98ce40f42149a76378426","observation_id":"337c9337-9012-49d0-8392-760a73b00c6f","resolution":{"observed_at":"2026-08-07T14:47:41.639160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:41.368872Z","title":"Co-Reyes, Avi Singh, Kate Baumli, Shariq Iqbal, Colton Bishop, Rebecca Roelofs, Lei M","venue":null,"work_id":"efec30ec-eefd-4796-97d4-b4e2bf281fe7","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:31.876835Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:9c88a366d446e3f862b573970326681921e6bb7d40ba5e204a452b71b0c7118f","observation_id":"929b7b64-f18c-47d4-bb38-57102a6fffde","resolution":{"observed_at":"2026-08-07T14:47:41.464081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:31.956475Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:31.956475Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:8edb6922876dd7b8fdef3758cc5f9581cb7f3b1725efc7d889da0067dde7b9b2","observation_id":"05f7bccb-0f31-4f0f-a28b-bbdb3b079bc7","resolution":{"observed_at":"2026-08-07T14:47:31.956475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:32.059858Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:32.059858Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:6897f8496e7c3b698092396aff54d84049ae86b05941622f3e5e3a931e932343","observation_id":"3dbb7cab-ad52-45ee-922b-f9fd6034d599","resolution":{"observed_at":"2026-08-07T14:47:32.059858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:41.144777Z","title":"Let’s verify step by step,","venue":null,"work_id":"bf3f9977-b9bd-4c35-8ead-bf7decd6423c","year":null},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:32.165273Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:e817212da08da3e95a3cdc897bd557381d1ef0a6a4c269f21962a6e2eaa33864","observation_id":"6437156d-ee2c-4780-8d24-c4bb42bacb1e","resolution":{"observed_at":"2026-08-07T14:47:41.233452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:32.289866Z","title":"Visual instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:32.289866Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:e759b9b9545367960a4a224f33e285db3e315e6125e9f2d18a9237394ffe1545","observation_id":"42862b6b-2095-4c10-8f7d-e04f9d111cce","resolution":{"observed_at":"2026-08-07T14:47:32.289866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:32.393396Z","title":"Visual instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:32.393396Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:d67e03601b9b4d0da57e6478eeefd4ac9dbf6045dd91cd562cf502b577d16aee","observation_id":"905af32e-42a9-4563-90d0-474da0734f1c","resolution":{"observed_at":"2026-08-07T14:47:32.393396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:32.549847Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:32.549847Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:77c664f2a46c0796ecbbbdf1b015ebef25d60bc886b0f6235f68506714d97315","observation_id":"88b247ec-8a59-4c65-b641-199438e0a1a9","resolution":{"observed_at":"2026-08-07T14:47:32.549847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:40.911160Z","title":"Mathvista: Evaluating mathemat- ical reasoning of foundation models in visual contexts, 2024","venue":null,"work_id":"4a7ca9c3-2798-4fa6-a742-35bfbe5f1635","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:32.631099Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:fe612aa0e704caefd0f41ebe7adf337624e860228397ed75e4360e3f5043d598","observation_id":"311bc923-e6d6-4673-bbc1-5047c0bbb309","resolution":{"observed_at":"2026-08-07T14:47:41.015915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:40.693769Z","title":"Reft: Reasoning with reinforced fine-tuning, 2024","venue":null,"work_id":"40163aeb-f260-4090-be52-efdf778d516a","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:32.788606Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:de5a5ae41ccc4a63157f0bb8cef3cbe60a1cd1e88ea228eb73392d6704f7191f","observation_id":"f8aca2f8-2b87-461c-974f-a09d66061dda","resolution":{"observed_at":"2026-08-07T14:47:40.812974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:40.512822Z","title":"Exploring the limit of outcome reward for learning mathematical reasoning, 2025","venue":null,"work_id":"0cbaf9ca-a56c-4e53-b928-6cec53264aa1","year":2025},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:32.905189Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:78eae759b6a9262b11b28f3b729e581bc84e5a437909b72422d47bea4862921d","observation_id":"b5034237-5478-4012-8de3-7ef2a51da934","resolution":{"observed_at":"2026-08-07T14:47:40.583463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:40.243438Z","title":"S1: Simple test-time scaling, 2025","venue":null,"work_id":"2924c2ec-c48f-4009-ae24-0aefa720671f","year":2025},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:33.014200Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:793d32c13737833bdce69f0cdc9b8d31af057d8a68f0b6492c93a09e6b2665e3","observation_id":"0900553d-5280-4126-a7f5-36208960ef38","resolution":{"observed_at":"2026-08-07T14:47:40.407357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:40.039944Z","title":null,"venue":null,"work_id":"2b74b2cc-757b-4c3f-9568-4d0658a4958a","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:33.130338Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:b12678888f9468dfcd54badab0baf8d5c3176163159d78627a3163179315453d","observation_id":"66ee2e16-c878-4135-a509-96ed5d231faa","resolution":{"observed_at":"2026-08-07T14:47:40.113828Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:39.904191Z","title":"Multimath: Bridging visual and math- ematical reasoning for large language models, 2024","venue":null,"work_id":"8ac4486d-8abc-4cb0-88e8-6e6714869178","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:33.237895Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:fc344fb3e63ae669be1b0035fe742583c61f240fd17def70baa55dcb306826ee","observation_id":"205eb7af-e202-46d3-96b9-9beddbaae91c","resolution":{"observed_at":"2026-08-07T14:47:39.964561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:39.769176Z","title":"Mutual reasoning makes smaller llms stronger problem-solvers, 2024","venue":null,"work_id":"8682df54-4650-4f0c-b0d3-351deeadf15a","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:33.377679Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:75fbb6f1e17fe5c67f12d0279f3804bf236bbf09674b4a5470de80620e98cde2","observation_id":"69389a61-be99-46ee-916d-8113c2bc7dba","resolution":{"observed_at":"2026-08-07T14:47:39.854576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:39.499866Z","title":"O1 replication journey: A strategic progress report – part 1, 2024","venue":null,"work_id":"9a2c851b-4962-4d11-9379-17e2274af1ed","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:33.485679Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:13a205fca8ce0fc74b0a378138de57b182d413db6018e29a959c450cbc9b7e95","observation_id":"ebd2c04a-d3f8-4f34-bb5e-9d5ed0df9b5c","resolution":{"observed_at":"2026-08-07T14:47:39.661379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:39.280395Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":"177fef50-ca46-4000-aa2f-03407ce73305","year":2023},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:33.597371Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:aea933241192e19e0d26de6eacbade41614da8f2a7bfc04bfa477b0049cee326","observation_id":"59959f09-fd48-4b1d-925e-70bd1fb2738c","resolution":{"observed_at":"2026-08-07T14:47:39.388599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T14:47:33.780681Z","title":"Deepseekmath: Pushing the limits of mathe- matical reasoning in open language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:33.780681Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:f6c06a2016fd93a70daf5a8eec23aa06b117ed0f2c278510fe04b7ab3e7f23c6","observation_id":"13fad878-7308-4af9-986b-8e6d541555d3","resolution":{"observed_at":"2026-08-07T14:47:33.780681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:38.988078Z","title":"Math- llava: Bootstrapping mathematical reasoning for multimodal large language models, 2024","venue":null,"work_id":"971a6559-b7b4-441f-bf25-57e2f17f4940","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:33.916385Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:e8659fbf43ab5d8967fe324747bc7fb69a4ebf1bda0976e0fc1fdd5ae7c7b5e2","observation_id":"beedb142-aa54-4d4d-8b22-c9eebc44eb31","resolution":{"observed_at":"2026-08-07T14:47:39.171333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:38.761287Z","title":"Scaling llm test-time compute optimally can be more effec- tive than scaling model parameters, 2024","venue":null,"work_id":"b329ecd0-8b4d-4d1a-a685-a99237a97ee1","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:34.086124Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:b1e8a216c5fc52ccb93042645267af74379b3143d98cf7372b06c45312a86541","observation_id":"f6b91cd2-8da6-4a7f-a2f4-6cb215b22f90","resolution":{"observed_at":"2026-08-07T14:47:38.873933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T14:47:34.230841Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:34.230841Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:17fd7eeb3f5d2590f59c21dad4e3b9efdcdb0ed849311ce29e2d96a7fd584978","observation_id":"1e699345-5325-494d-ba47-ecba532371d0","resolution":{"observed_at":"2026-08-07T14:47:34.230841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:38.456004Z","title":null,"venue":null,"work_id":"44da5b55-d476-4d5b-9566-e1e50047a5c7","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:34.330075Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:7087fd2edea9f7529074ef1a1f049636ebaa9ff775d0e3f1695aff666095b1a1","observation_id":"6457b7f5-58db-4579-bdde-0639d5f18a72","resolution":{"observed_at":"2026-08-07T14:47:38.621626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:38.209936Z","title":"Slow perception: Let’s perceive geometric figures step-by-step,","venue":null,"work_id":"b8e2be0c-f85f-4ae7-be17-37460b7cf0b8","year":null},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:34.447530Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:ad6b26a875779eb7519eaf3508dc75ab67ff6daf0ed3044695fc28fab70ac83a","observation_id":"75b67f35-8a69-4758-ab29-1a920dd71080","resolution":{"observed_at":"2026-08-07T14:47:38.344081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:37.952801Z","title":"Gee, and Yixin Nie","venue":null,"work_id":"3e10010d-e864-42c2-b28f-3c2941594d32","year":2023},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:34.534458Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:d80ff49e0ab33e82e6d45705412bcf2d6ef4cbb3733dbc16dd68136e68b3c2bd","observation_id":"2cf9270d-7f2a-4bae-a1ae-aaf940c3196b","resolution":{"observed_at":"2026-08-07T14:47:38.072859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:37.727895Z","title":"Atomthink: A slow thinking framework for multi- modal mathematical reasoning, 2024","venue":null,"work_id":"fae7db56-dec7-44b3-a59b-ba009dd9b562","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:34.696748Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:ea47dd28d56dac3a6506d3dc90272bbc4eabd5fc15f644acb40ea1bc5dd85de6","observation_id":"8ea95854-cd31-4c74-ba11-364496fbee7c","resolution":{"observed_at":"2026-08-07T14:47:37.825685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:37.495216Z","title":"Llava-o1: Let vision language models reason step- by-step, 2024","venue":null,"work_id":"56977758-3317-4554-b3e2-1f0c102e6b58","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:34.807611Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:fb7c4850cd8e2763242df05611f30bafcd627e813040c8ca615e0a84f03d14b0","observation_id":"3e140fd6-88b9-484c-bfb3-29cc11bfe3b0","resolution":{"observed_at":"2026-08-07T14:47:37.600994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:37.205665Z","title":"Mulberry: Em- powering mllm with o1-like reasoning and reflection via col- lective monte carlo tree search, 2024","venue":null,"work_id":"e9beefef-8487-4ec1-8a69-3a1ffb97d62b","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:34.981884Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:8abece9cb3a5c53ade5a5d0e7284bf11b5249c1e3bff55b40a45cd60ed58da48","observation_id":"f18cd552-9e7a-4032-bab2-c8f85fbe2254","resolution":{"observed_at":"2026-08-07T14:47:37.361926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12284","last_updated":"2024-05-03T17:36:07Z","snapshot_observed_at":"2026-08-13T10:57:13.012119Z","submitted_at":"2023-09-21T17:45:42Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12284","snapshot_observed_at":"2026-08-07T14:47:35.106693Z","title":"Metamath: Bootstrap your own mathe- matical questions for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:35.106693Z"},"links":{"cited_paper":"/paper/2309.12284","citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:fa20f3504f60927c3f0838f8f5cde0056eddf329f527ba15a2f7c1d72143c59f","observation_id":"4abcf3b2-5b6b-4f51-b40b-b5d214c9dc2c","resolution":{"observed_at":"2026-08-07T14:47:35.106693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-08-08T03:31:37.699253Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-08-07T14:47:35.253719Z","title":"Mm-vet: Evaluating large multimodal models for integrated capabilities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:35.253719Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:e189f0b4e1bc5a85f32cfd95fe8bcf3a354cfe8eed481c3bdffbe50f33278982","observation_id":"ec856a6f-535f-40ce-bfb6-0f840bf6e849","resolution":{"observed_at":"2026-08-07T14:47:35.253719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:36.950454Z","title":"Llama-berry: Pair- wise optimization for o1-like olympiad-level mathematical reasoning, 2024","venue":null,"work_id":"62bf599d-c7a2-476e-8594-c8e355110643","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:35.370481Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:870ee122aedc6cf5be9d15308e24ab9394a0eb95baedad1a29cbcfc8744f0bfe","observation_id":"f7e4553a-2ff7-4b7a-ac97-ea4998f64c7e","resolution":{"observed_at":"2026-08-07T14:47:37.056126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:36.730779Z","title":"Euclid: Supercharging multimodal llms with synthetic high-fidelity visual descriptions, 2024","venue":null,"work_id":"6011789d-66a9-4e5c-a1dc-910731d2b642","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:35.466112Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:4a4e593172820a3381f469e30c6799c06fd1da5a038d653a82130a5ab743b458","observation_id":"394f68ed-fa5f-4064-afee-71b6e90151e0","resolution":{"observed_at":"2026-08-07T14:47:36.828643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:36.486260Z","title":"Mathverse: Does your multi-modal llm truly see the diagrams in visual math prob- lems?, 2024","venue":null,"work_id":"f0d98da2-56a4-4142-ad31-d5ede9557b1d","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:35.613884Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:6615182ab842d86c10453eba534500632ef61dd71aaf63ffcddd43299dab2824","observation_id":"4aa23182-35f4-4281-adc2-4ccc16aebf93","resolution":{"observed_at":"2026-08-07T14:47:36.590741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16198","last_updated":"2024-10-21T17:00:06Z","snapshot_observed_at":"2026-08-12T22:18:20.809421Z","submitted_at":"2024-10-21T17:00:06Z","title":"Improve Vision Language Model Chain-of-thought Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16198","snapshot_observed_at":"2026-08-07T14:47:35.769084Z","title":"Improve vision language model chain-of- thought reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:35.769084Z"},"links":{"cited_paper":"/paper/2410.16198","citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:7aab13bf481288f7a684f23e10ea4bd367479aacbec7dbb951732d85bc19f290","observation_id":"e9448574-25cb-4b7c-b5f6-af5423f213ad","resolution":{"observed_at":"2026-08-07T14:47:35.769084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:36.314086Z","title":"How far are we from intelligent visual deductive reasoning?, 2024","venue":null,"work_id":"d4ef2d9a-7a4a-4256-9993-1df90d5391ce","year":2024},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:35.974557Z"},"links":{"citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:cd551f2438194b725bfa1917f453056dddfcd8169a8e0f0067f286f301f50068","observation_id":"9d2b6d23-6b04-4fce-b952-447ad17d3f1a","resolution":{"observed_at":"2026-08-07T14:47:36.367751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-07T14:47:36.084003Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:36.084003Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2505.17609"},"observation_digest":"sha256:109b8e9a18e9108fdd26fa47b2c307f45271b07d7be547e43d4b9928f3c66788","observation_id":"220a7715-c1b0-424b-8e53-c18b8e34f584","resolution":{"observed_at":"2026-08-07T14:47:36.084003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.17609","last_updated":"2025-08-13T03:45:38Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-12T00:23:05.030335Z","submitted_at":"2025-05-23T08:18:00Z","title":"Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":29},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 2 inbound Pith citation observations for arXiv:2505.17609."}