{"as_of":"2026-08-17T16:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d0ed0a1fd59952727b89be65762e16dcaf2caa8ee6bdba4d120047dfee6b6b4f","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T06:08:28.246141Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T04:59:38.760845Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T18:48:53.330917Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.06034","snapshot_observed_at":"2026-08-16T04:59:38.760845Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.21773","last_updated":"2025-09-14T05:13:07Z","snapshot_observed_at":"2026-08-16T13:28:38.270136Z","submitted_at":"2025-04-30T16:17:53Z","title":"MAC-Tuning: LLM Multi-Compositional Problem Reasoning with Enhanced Knowledge Boundary Awareness","version":4},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-16T04:59:38.760845Z"},"links":{"cited_paper":"/paper/2506.06034","citing_paper":"/paper/2504.21773"},"observation_digest":"sha256:e70d4385af4faf9cc6c2528900d3f733ff9e734896188efbb6c7bb38d2a5c5fd","observation_id":"1724996d-a25d-4c98-8a72-ba5310689128","resolution":{"observed_at":"2026-08-16T04:59:38.760845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.06034","snapshot_observed_at":"2026-08-15T23:21:12.632396Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.04921","last_updated":"2025-07-06T14:40:27Z","snapshot_observed_at":"2026-08-15T23:15:46.193892Z","submitted_at":"2025-05-08T03:35:23Z","title":"Perception, Reason, Think, and Plan: A Survey on Large Multimodal Reasoning Models","version":2},"reference_index":158,"source":"arxiv_source","source_observed_at":"2026-08-15T23:21:12.632396Z"},"links":{"cited_paper":"/paper/2506.06034","citing_paper":"/paper/2505.04921"},"observation_digest":"sha256:a538c8694870df7294f5d1925c1223b2a654ab6105016e8335fa9b698eb8a95f","observation_id":"589d9889-1a60-42a7-8ffc-cf3a2b2f9b8a","resolution":{"observed_at":"2026-08-15T23:21:12.632396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"cited_work":{"arxiv_id":"2506.06034","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.06034","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4d8c4719-a510-473c-be63-67bc74376b1f","year":2025},"citing_paper":{"arxiv_id":"2605.15963","last_updated":"2026-05-15T13:55:05Z","snapshot_observed_at":"2026-08-15T09:21:14.455309Z","submitted_at":"2026-05-15T13:55:05Z","title":"PAGER: Bridging the Semantic-Execution Gap in Point-Precise Geometric GUI Control","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T18:46:20.417039Z"},"links":{"cited_paper":"/paper/2506.06034","citing_paper":"/paper/2605.15963"},"observation_digest":"sha256:d40e956e2b6aa6b5b4630554ceaf7176fd71e4f987315ab6e52324981e56aaeb","observation_id":"5d4f9b23-04e4-4cda-83df-d3f0e84c26d8","resolution":{"observed_at":"2026-05-20T18:48:53.332391Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.06034/citation-record","integrity":"/paper/2506.06034/integrity","json":"/paper/2506.06034/citation-record.json","paper":"/paper/2506.06034"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1905.13319","last_updated":"2019-05-30T21:28:12Z","snapshot_observed_at":"2026-08-16T02:16:32.508169Z","submitted_at":"2019-05-30T21:28:12Z","title":"MathQA: Towards Interpretable Math Word Problem Solving with Operation-Based Formalisms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.13319","snapshot_observed_at":"2026-08-07T06:08:21.855106Z","title":"Mathqa: Towards interpretable math word problem solving with operation-based formalisms.arXiv preprint arXiv:1905.13319, 2019","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:21.855106Z"},"links":{"cited_paper":"/paper/1905.13319","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:c5621fae4b60418cc485d55ffc5731e9bf5d927b4c59b8a010038e41baa93577","observation_id":"acb883b3-5c29-4aef-bbf7-34413ea631c2","resolution":{"observed_at":"2026-08-07T06:08:21.855106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:34.310698Z","title":"Claude Sonnet","venue":null,"work_id":"0cf8fbb5-e9d7-4376-88f4-3c604095e7fd","year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:21.905044Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:2a91a9eb6afae4648350dae4fc3e8dc5820446648c214b980e6321039553f6cd","observation_id":"3c532b0d-ebde-4dbd-9019-67174cb88e00","resolution":{"observed_at":"2026-08-07T06:08:34.362771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12433","last_updated":"2023-02-24T03:28:46Z","snapshot_observed_at":"2026-08-16T15:53:03.437287Z","submitted_at":"2023-02-24T03:28:46Z","title":"ProofNet: Autoformalizing and Formally Proving Undergraduate-Level Mathematics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12433","snapshot_observed_at":"2026-08-07T06:08:21.997740Z","title":"Proofnet: Autoformalizing and formally proving undergraduate-level mathematics.arXiv preprint arXiv:2302.12433, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:21.997740Z"},"links":{"cited_paper":"/paper/2302.12433","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:eb6c239570bce146c9194d9990626b91ee90c0757a3981c36db03ca510451084","observation_id":"167569e3-65a8-40a0-b5f9-7fca7b9d3718","resolution":{"observed_at":"2026-08-07T06:08:21.997740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10631","last_updated":"2024-03-15T19:14:39Z","snapshot_observed_at":"2026-08-16T13:51:18.629241Z","submitted_at":"2023-10-16T17:54:07Z","title":"Llemma: An Open Language Model For Mathematics","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10631","snapshot_observed_at":"2026-08-07T06:08:22.093809Z","title":"Llemma: An open language model for mathematics.arXiv preprint arXiv:2310.10631, 2023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:22.093809Z"},"links":{"cited_paper":"/paper/2310.10631","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:eeef209e6c2eeedb8c876c096b9b2875ce444a1519a5543f3863c1a8571f3132","observation_id":"7d4958a9-4096-4eac-b70a-c377c00380c6","resolution":{"observed_at":"2026-08-07T06:08:22.093809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:34.143528Z","title":"Springer Science & Business Me- dia, 2013","venue":null,"work_id":"9f7890b3-4abd-4411-adf7-b5aa5eabb11e","year":2013},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:22.216322Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:bfb5c74acb4aaacd1fbb00644d9000b31ce10a9e0e5abe4f7255abab862172e1","observation_id":"51611b4a-13b8-4d83-bfff-1fbe85b86676","resolution":{"observed_at":"2026-08-07T06:08:34.231119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:33.985194Z","title":"An augmented benchmark dataset for geometric question answering through dual parallel text encoding","venue":null,"work_id":"d2b7e8f4-b579-4f6e-babd-7449e79ef31c","year":2022},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:22.366269Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:ac2916125c0cd11398ce74fdf988f29ceeca422338e04dc723a2c54efcfa8338","observation_id":"06fefbf5-c199-4210-801e-6c73f27cb789","resolution":{"observed_at":"2026-08-07T06:08:34.089762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.02746","last_updated":"2022-12-06T04:37:51Z","snapshot_observed_at":"2026-08-16T16:10:44.189376Z","submitted_at":"2022-12-06T04:37:51Z","title":"UniGeo: Unifying Geometry Logical Reasoning via Reformulating Mathematical Expression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.02746","snapshot_observed_at":"2026-08-07T06:08:22.470480Z","title":"Unigeo: Unifying geometry logical reasoning via reformulating mathematical expression.arXiv preprint arXiv:2212.02746, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:22.470480Z"},"links":{"cited_paper":"/paper/2212.02746","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:561eebe28131724aca0f57fcc430d783cd3bf576f0d2f1e4d23c8f6743115b23","observation_id":"1179a2cd-654d-4699-b767-6589a11cde83","resolution":{"observed_at":"2026-08-07T06:08:22.470480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-08-08T22:33:20.124926Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09567","snapshot_observed_at":"2026-08-07T06:08:22.574013Z","title":"Towards reasoning era: A survey of long chain-of-thought for reasoning large language models.arXiv preprint arXiv:2503.09567, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:22.574013Z"},"links":{"cited_paper":"/paper/2503.09567","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:51430bb5b40ae0b45e10928be536ecc347d90f0ae6b4c28f51951499cdba1f4e","observation_id":"0702550d-4da1-4819-bed9-5efa66ede162","resolution":{"observed_at":"2026-08-07T06:08:22.574013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:33.639175Z","title":"MIT Press, 2013","venue":null,"work_id":"e1d50a30-5b33-4304-880d-3979af90f5fd","year":2013},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:22.670481Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:b9555861fef24f0c22492c0044808f8bfd19275bfd724ef00a740663662e9c2a","observation_id":"70a54f9c-515b-4817-9044-6e1832e5a516","resolution":{"observed_at":"2026-08-07T06:08:33.843539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T06:08:22.834147Z","title":"Training verifiers to solve math word problems.arXiv preprint arXiv:2110.14168, 2021","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:22.834147Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:2e0a68d491042cea373e8985d120a684f25ad9b83570176bb0301532d4b39d57","observation_id":"5570880d-b59e-43e4-ae83-25a7980259e4","resolution":{"observed_at":"2026-08-07T06:08:22.834147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:33.393735Z","title":"Compfiles","venue":null,"work_id":"5929b56a-4364-4244-85a8-07abdc67122a","year":2023},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:22.950530Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:06dde6d951cb1c262f5967598d91d00b7f5d32f682fff514d3dcc07df50f5df6","observation_id":"e22ca28c-fe33-42ba-842b-ff10eb2eef9c","resolution":{"observed_at":"2026-08-07T06:08:33.499806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:33.239531Z","title":"Start building with gemini 2.5 flash","venue":null,"work_id":"62d94576-65b3-448e-b270-0eb6c9eb1af6","year":2025},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:23.014503Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:a619ae208da77b8a1f2d502d55f4cbbcde5d2ec187db86c5dfb8734a89b8eace","observation_id":"75df8126-e94b-4bda-a1c8-59953f60c123","resolution":{"observed_at":"2026-08-07T06:08:33.307670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:33.003718Z","title":"Mathematical capabilities of chatgpt.Advances in neural information processing systems, 36:27699–27744,","venue":null,"work_id":"6e6a96be-a52a-4733-ba63-d1258f1f04bd","year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:23.173500Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:f4b0bf5a5a8155db80e436b15a94dd046ea3a9c0b413265dc9dd27469ec8a5e9","observation_id":"1664df8e-3d06-4dba-9890-c813c0175c08","resolution":{"observed_at":"2026-08-07T06:08:33.104964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T06:08:23.581488Z","title":"Measuring massive multitask language understanding.arXiv preprint arXiv:2009.03300, 2020","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:23.581488Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:8cfe0022d884eeaf8afa55dee8c696bb401fde8f8571adcffc8148f8dc0b39be","observation_id":"76cda449-1bc7-42e0-8076-fd4cf77adfcf","resolution":{"observed_at":"2026-08-07T06:08:23.581488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-07T06:08:23.697375Z","title":"Measuring mathematical problem solving with the math dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:23.697375Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:0e1c47bb7856d14eed14ad39cbaf01a78df90d7f87cc7957bbe53595896903b2","observation_id":"3e870678-2d33-4427-a766-40a00f7f57be","resolution":{"observed_at":"2026-08-07T06:08:23.697375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09403","last_updated":"2024-11-11T00:54:32Z","snapshot_observed_at":"2026-08-16T13:43:12.869356Z","submitted_at":"2024-06-13T17:59:31Z","title":"Visual Sketchpad: Sketching as a Visual Chain of Thought for Multimodal Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09403","snapshot_observed_at":"2026-08-07T06:08:23.824053Z","title":"Visual sketchpad: Sketching as a visual chain of thought for multimodal language models.arXiv preprint arXiv:2406.09403, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:23.824053Z"},"links":{"cited_paper":"/paper/2406.09403","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:bde0804a5a153d2a80113b700193c84da708c254d002e605f384245c88404bef","observation_id":"77bd8e6a-ba53-422d-8865-9b17c424115f","resolution":{"observed_at":"2026-08-07T06:08:23.824053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.12283","last_updated":"2023-02-20T16:10:20Z","snapshot_observed_at":"2026-08-16T16:22:05.693119Z","submitted_at":"2022-10-21T22:37:22Z","title":"Draft, Sketch, and Prove: Guiding Formal Theorem Provers with Informal Proofs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.12283","snapshot_observed_at":"2026-08-07T06:08:23.894970Z","title":"Draft, sketch, and prove: Guiding formal theorem provers with informal proofs.arXiv preprint arXiv:2210.12283, 2022","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:23.894970Z"},"links":{"cited_paper":"/paper/2210.12283","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:aeebbe7145c72ad485ab872971a256b7b39c9b81fbfd7833ad7053b05254792a","observation_id":"0824c7d0-488f-4018-87c1-dc4aa55f425e","resolution":{"observed_at":"2026-08-07T06:08:23.894970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:32.578382Z","title":"Lisa: Language models of isabelle proofs","venue":null,"work_id":"928ba1b7-5aac-4d69-8b37-95125562f063","year":2021},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:23.998470Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:b1d37d7322cf5985395f4b832a06df4560015c730e31a5138680e67b0c7cefa9","observation_id":"fa850464-a228-45b4-9e60-772ec49e8481","resolution":{"observed_at":"2026-08-07T06:08:32.660889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:32.329767Z","title":"Hypertree proof search for neural theorem proving.Advances in neural information processing systems, 35:26337– 26349, 2022","venue":null,"work_id":"2ffbaf9a-c5f1-4923-b0f2-23a72d4c7e25","year":2022},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:24.130906Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:156a34734c088fe576bb9ee31ff063d796ea41934b5ffce249604026d236f599","observation_id":"54a6364c-4c60-452d-9fc2-8d3704295318","resolution":{"observed_at":"2026-08-07T06:08:32.457411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04921","last_updated":"2025-07-06T14:40:27Z","snapshot_observed_at":"2026-08-15T23:15:46.193892Z","submitted_at":"2025-05-08T03:35:23Z","title":"Perception, Reason, Think, and Plan: A Survey on Large Multimodal Reasoning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04921","snapshot_observed_at":"2026-08-07T06:08:24.242469Z","title":"Perception, reason, think, and plan: A survey on large multimodal reasoning models.arXiv preprint arXiv:2505.04921, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:24.242469Z"},"links":{"cited_paper":"/paper/2505.04921","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:f2ecffd05b51db86b12efc2fc54ec463f4d906721374fca9d200fbe6212812c4","observation_id":"1330ca35-564b-4e96-b1b6-6053bf94d57a","resolution":{"observed_at":"2026-08-07T06:08:24.242469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07640","last_updated":"2025-04-19T13:53:05Z","snapshot_observed_at":"2026-08-15T13:54:00.996017Z","submitted_at":"2025-02-11T15:27:35Z","title":"Goedel-Prover: A Frontier Model for Open-Source Automated Theorem Proving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07640","snapshot_observed_at":"2026-08-07T06:08:24.408162Z","title":"Goedel-prover: A frontier model for open-source automated theorem proving.arXiv preprint arXiv:2502.07640, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:24.408162Z"},"links":{"cited_paper":"/paper/2502.07640","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:f439268a637462658fa9fe3d08a7c65e604bae744860d89944b2fc94273c0a93","observation_id":"654347db-a614-4318-a427-e98efc433bac","resolution":{"observed_at":"2026-08-07T06:08:24.408162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.04146","last_updated":"2017-10-23T16:45:03Z","snapshot_observed_at":"2026-08-14T21:01:22.490456Z","submitted_at":"2017-05-11T13:04:47Z","title":"Program Induction by Rationale Generation : Learning to Solve and Explain Algebraic Word Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.04146","snapshot_observed_at":"2026-08-07T06:08:24.478551Z","title":"Program induction by ratio- nale generation: Learning to solve and explain algebraic word problems.arXiv preprint arXiv:1705.04146, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:24.478551Z"},"links":{"cited_paper":"/paper/1705.04146","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:63aad05000258c016bfd100e1dc761840135d57ef96f85ebb2a86e51fab574e2","observation_id":"7feea3de-c201-430f-bc5e-3b4f8599f66f","resolution":{"observed_at":"2026-08-07T06:08:24.478551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04295","last_updated":"2023-12-05T08:38:01Z","snapshot_observed_at":"2026-08-16T23:25:24.853153Z","submitted_at":"2023-09-08T12:34:28Z","title":"FIMO: A Challenge Formal Dataset for Automated Theorem Proving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04295","snapshot_observed_at":"2026-08-07T06:08:24.562226Z","title":"Fimo: A challenge formal dataset for automated theorem proving, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:24.562226Z"},"links":{"cited_paper":"/paper/2309.04295","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:5af0a0076efe1ad1e8c4cfcbeefe5594d9463ada23d70dcbfd2f9607f0bc1b50","observation_id":"fdba6ed3-a7f0-48d2-b337-eca28ea169e1","resolution":{"observed_at":"2026-08-07T06:08:24.562226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:32.012798Z","title":"Improved baselines with visual instruction tuning, 2023","venue":null,"work_id":"873e9a63-5abb-4a4f-8549-17ab05452946","year":2023},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:24.650929Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:bbaf9cb7d48508bb96887dcb3575dee6e6fb60b3c5c0276b13f8f9801ac39fa7","observation_id":"4ecda9a4-ecc5-4ac3-975b-12072c97a093","resolution":{"observed_at":"2026-08-07T06:08:32.154902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02834","last_updated":"2024-11-01T02:21:13Z","snapshot_observed_at":"2026-08-16T13:21:21.652592Z","submitted_at":"2024-09-04T16:00:21Z","title":"CMM-Math: A Chinese Multimodal Math Dataset To Evaluate and Enhance the Mathematics Reasoning of Large Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02834","snapshot_observed_at":"2026-08-07T06:08:24.733133Z","title":"Cmm-math: A chinese multimodal math dataset to evaluate and enhance the mathematics reasoning of large multimodal models.arXiv preprint arXiv:2409.02834, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:24.733133Z"},"links":{"cited_paper":"/paper/2409.02834","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:d51662f444dcceec0ed07e96610e2e04fc1dcf004da5a145f5cd64d131df4e50","observation_id":"08f2d713-e59b-4ce1-88ec-09763e6149fe","resolution":{"observed_at":"2026-08-07T06:08:24.733133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.04165","last_updated":"2021-07-20T23:22:27Z","snapshot_observed_at":"2026-08-16T18:25:56.569719Z","submitted_at":"2021-05-10T07:46:55Z","title":"Inter-GPS: Interpretable Geometry Problem Solving with Formal Language and Symbolic Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.04165","snapshot_observed_at":"2026-08-07T06:08:24.805851Z","title":"Inter-gps: Interpretable geometry problem solving with formal language and symbolic reasoning.arXiv preprint arXiv:2105.04165, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:24.805851Z"},"links":{"cited_paper":"/paper/2105.04165","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:c6450e9180010b3b5e985380b52af09b11cfb2a5dee2c1609ddc6b1cc7e72a1b","observation_id":"a2bc0fef-0689-471b-9728-ded97078fcc0","resolution":{"observed_at":"2026-08-07T06:08:24.805851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02255","last_updated":"2024-01-21T03:47:06Z","snapshot_observed_at":"2026-07-06T16:27:15.027202Z","submitted_at":"2023-10-03T17:57:24Z","title":"MathVista: Evaluating Mathematical Reasoning of Foundation Models in Visual Contexts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02255","snapshot_observed_at":"2026-08-07T06:08:24.896278Z","title":"Mathvista: Evaluating mathematical reasoning of foundation models in visual contexts.arXiv preprint arXiv:2310.02255, 2023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:24.896278Z"},"links":{"cited_paper":"/paper/2310.02255","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:8683e34d7e8995f68d16efbf2800946c899e5cd10afd985857d7129248949c22","observation_id":"8fde812d-926a-46bb-8ab2-30f19f339af1","resolution":{"observed_at":"2026-08-07T06:08:24.896278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.10244","last_updated":"2022-03-19T05:00:30Z","snapshot_observed_at":"2026-08-11T03:45:43.920485Z","submitted_at":"2022-03-19T05:00:30Z","title":"ChartQA: A Benchmark for Question Answering about Charts with Visual and Logical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.10244","snapshot_observed_at":"2026-08-07T06:08:25.001892Z","title":"Chartqa: A benchmark for question answering about charts with visual and logical reasoning.arXiv preprint arXiv:2203.10244, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:25.001892Z"},"links":{"cited_paper":"/paper/2203.10244","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:09bb8b88282edc542a32ce7a744f3950fac6bef358cd8e37f95aa2509c10d2db","observation_id":"cf742dc9-84b6-44f5-94d2-768785c543df","resolution":{"observed_at":"2026-08-07T06:08:25.001892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17517","last_updated":"2023-03-08T16:47:46Z","snapshot_observed_at":"2026-08-16T16:19:42.294096Z","submitted_at":"2022-10-31T17:41:26Z","title":"Lila: A Unified Benchmark for Mathematical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17517","snapshot_observed_at":"2026-08-07T06:08:25.116856Z","title":"Lila: A unified benchmark for mathematical reasoning.arXiv preprint arXiv:2210.17517, 2022","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:25.116856Z"},"links":{"cited_paper":"/paper/2210.17517","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:7b03af63d1420de5f767e8ebe7bc5f0e01b35a6d977a84e587a81328596b9e36","observation_id":"c396e12a-dcb1-4eeb-affc-457d8cff22d4","resolution":{"observed_at":"2026-08-07T06:08:25.116856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:25.221848Z","title":"The lean 4 theorem prover and programming language","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:25.221848Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:804af55358b2f433312cf473700dfed5a1c78a7ce6fbd715623c0981e5e7aecc","observation_id":"af94ed3b-2234-40df-b93b-aa149fee2ba2","resolution":{"observed_at":"2026-08-07T06:08:25.221848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17216","last_updated":"2024-05-27T14:35:10Z","snapshot_observed_at":"2026-08-16T13:49:01.308161Z","submitted_at":"2024-05-27T14:35:10Z","title":"Autoformalizing Euclidean Geometry","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17216","snapshot_observed_at":"2026-08-07T06:08:25.341953Z","title":"Autoformalizing euclidean geometry.arXiv preprint arXiv:2405.17216, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:25.341953Z"},"links":{"cited_paper":"/paper/2405.17216","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:8fa92f1605d564cdc6bfdbb2b23eef66035db18ef3616057b1a3e9b754d7f88f","observation_id":"d4a8acd1-bb00-4abc-a119-28f0c9f6ef44","resolution":{"observed_at":"2026-08-07T06:08:25.341953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:31.749735Z","title":"GPT-4.1.https://openai.com/index/gpt-4-1/, 2024","venue":null,"work_id":"7e0e1b74-9584-4e15-87d0-31b25d483954","year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:25.405965Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:5ce0a55831437c0df0a4eb9c48b012468e1c158b11b42438f908ebde909f9c78","observation_id":"895eebe7-1527-42c7-9204-608ea94e3d63","resolution":{"observed_at":"2026-08-07T06:08:31.885301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:31.527796Z","title":"Introducing o3 and o4-mini","venue":null,"work_id":"30c8d146-89ac-4f6c-9f24-18f836dda9e5","year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:25.460899Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:737bf22d64f6d16407640912b3ba407468d65553348e4cdbdf5b4a887e5e9ebd","observation_id":"2ebd40f4-579d-43d8-8a08-c0584261b028","resolution":{"observed_at":"2026-08-07T06:08:31.653004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03393","last_updated":"2020-09-07T19:50:10Z","snapshot_observed_at":"2026-08-15T02:27:43.801647Z","submitted_at":"2020-09-07T19:50:10Z","title":"Generative Language Modeling for Automated Theorem Proving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03393","snapshot_observed_at":"2026-08-07T06:08:25.530207Z","title":"Generative language modeling for automated theorem proving","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:25.530207Z"},"links":{"cited_paper":"/paper/2009.03393","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:2b25246a90aa8bedab8b21abf4e796eabd8bd7af91b3934b88f7c41d0c7326cb","observation_id":"95ab73d0-ed12-4361-90c3-1cd5ce07448d","resolution":{"observed_at":"2026-08-07T06:08:25.530207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:31.310619Z","title":"Artificial intelligence mathematical olympiad (aimo) prize, 2023","venue":null,"work_id":"42a3eaf3-d972-45dc-8a8b-d941ce027430","year":2023},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:25.727399Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:40f64956debd6bbef544833df0e705a1edfd0aba96b36fd6f962b4e56fe25058","observation_id":"88a9890a-34c1-4455-b04b-7add4ca06e26","resolution":{"observed_at":"2026-08-07T06:08:31.411389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:25.795135Z","title":"A survey of efficient reasoning for large reasoning models: Language, multimodality, and beyond.arXiv preprint arXiv:2503.21614, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:25.795135Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:860a6cbaa903c840684b8941918bd70469b089e8a98fec16934db1088a77b41b","observation_id":"71412192-617b-4eba-a436-b2c54db3699b","resolution":{"observed_at":"2026-08-07T06:08:25.795135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21801","last_updated":"2025-07-18T08:20:23Z","snapshot_observed_at":"2026-08-02T11:46:58.603316Z","submitted_at":"2025-04-30T16:57:48Z","title":"DeepSeek-Prover-V2: Advancing Formal Mathematical Reasoning via Reinforcement Learning for Subgoal Decomposition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21801","snapshot_observed_at":"2026-08-07T06:08:25.882735Z","title":"Deepseek-prover-v2: Advancing formal mathematical reasoning via reinforcement learning for subgoal decomposition.arXiv preprint arXiv:2504.21801, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:25.882735Z"},"links":{"cited_paper":"/paper/2504.21801","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:142d23101a1bf6b7e3f16acd36b74ad436bae175401c84103ef2530fe3d58d78","observation_id":"043df018-ce33-4d94-b359-2086772ec1a4","resolution":{"observed_at":"2026-08-07T06:08:25.882735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:31.074452Z","title":"Elsevier,","venue":null,"work_id":"4211f12a-1d89-4f6b-b798-2f907a7b329f","year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:25.957670Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:31b6130acdfd73e16b28cdb2de20b47d990775f9462d9be39bd92c706a430973","observation_id":"59268741-d604-42b1-93f7-8fd56a470ae8","resolution":{"observed_at":"2026-08-07T06:08:31.187743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:30.706735Z","title":"Imo grand challenge.URL https://imo-grand-challenge","venue":null,"work_id":"862d92e8-5efc-409d-873f-76b820eb3167","year":2020},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.111225Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:73df17823bb816a033d6b309ef7c0a87364af8e3f8408adede513aa587eeb300","observation_id":"2a222a7c-ea52-456e-88b8-673346dc9dc7","resolution":{"observed_at":"2026-08-07T06:08:30.768042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:30.535843Z","title":"Solving geometry problems: Combining text and diagram interpretation","venue":null,"work_id":"7ca8c7b2-dffa-4811-8223-397e3c553a7d","year":2015},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.188441Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:2cc17b30b5905c1a966240372605cf579acc72e4e83386e9c9f9caaa389cc05c","observation_id":"b11cb3a4-a417-42f0-8723-1fb1c0e4722c","resolution":{"observed_at":"2026-08-07T06:08:30.633467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T06:08:26.270766Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models.arXiv preprint arXiv:2402.03300, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.270766Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:d6afb58713e022070c8359fb9d7b4b9300ea2779753d151cce258eef8345c806","observation_id":"0c23ffa2-fbcb-4e59-894f-f65eea910526","resolution":{"observed_at":"2026-08-07T06:08:26.270766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-16T13:39:53.511689Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-07T06:08:26.344518Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models.arXiv preprint arXiv:2406.17294, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.344518Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:f69158b28cb4ddf8e8b7b887fd51b656b2c0d67e814078489228132f8c671864","observation_id":"2bfd9f50-6f4c-412d-a024-af64874f16a4","resolution":{"observed_at":"2026-08-07T06:08:26.344518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:30.400783Z","title":"What does clip know about a red circle? visual prompt engineering for vlms","venue":null,"work_id":"3db3921a-b168-4bc5-8725-e24306f5c1d6","year":2023},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.412194Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:9f2bdc4f441fe0e967efe8109dd35784b8cc874995567e843038f0b55b73f9c3","observation_id":"f79ce605-4d23-4551-8430-bcc1d18c50c0","resolution":{"observed_at":"2026-08-07T06:08:30.455017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:26.482320Z","title":"Qwen2.5-vl, January 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.482320Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:9f69c26f6d1b662535995563ea8fa9675ed5b809cca787134fac2016c73e6a66","observation_id":"d2c77063-030d-4d18-b78f-a08451c9678e","resolution":{"observed_at":"2026-08-07T06:08:26.482320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04353","last_updated":"2024-08-08T04:15:31Z","snapshot_observed_at":"2026-08-17T15:19:46.827734Z","submitted_at":"2023-10-06T16:21:22Z","title":"An In-Context Learning Agent for Formal Theorem-Proving","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04353","snapshot_observed_at":"2026-08-07T06:08:26.563979Z","title":"An in-context learning agent for formal theorem-proving.arXiv preprint arXiv:2310.04353, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.563979Z"},"links":{"cited_paper":"/paper/2310.04353","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:e3ce6fece0e40379f1a7bde55c055da3305d81c07d174018fa6477f8aeef8c32","observation_id":"b874b35f-e245-4960-842f-c504424062fe","resolution":{"observed_at":"2026-08-07T06:08:26.563979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:30.201224Z","title":"Solving olympiad geometry without human demonstrations.Nature, 625(7995):476–482, 2024","venue":null,"work_id":"8de21682-8f3b-4848-a727-a7773f9f6461","year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.633889Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:f50928c6d11bd1713276422850a5815157196ab1445bb7a8350b91b2aa623d3e","observation_id":"03dc5019-849f-4099-864a-cab55bc96b42","resolution":{"observed_at":"2026-08-07T06:08:30.288689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11214","last_updated":"2024-11-03T17:14:37Z","snapshot_observed_at":"2026-08-16T13:33:59.748410Z","submitted_at":"2024-07-15T19:57:15Z","title":"PutnamBench: Evaluating Neural Theorem-Provers on the Putnam Mathematical Competition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11214","snapshot_observed_at":"2026-08-07T06:08:26.694429Z","title":"Putnambench: Evaluating neural theorem-provers on the putnam mathematical competition.arXiv preprint arXiv:2407.11214, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.694429Z"},"links":{"cited_paper":"/paper/2407.11214","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:8054c91e45c2234c3be40bb1cf98baa6e04ea3d1f8a37229ea89fa4941ee00ff","observation_id":"d0cab9c9-272d-4b39-9ffc-587b1563e01b","resolution":{"observed_at":"2026-08-07T06:08:26.694429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14414","last_updated":"2024-05-23T10:35:08Z","snapshot_observed_at":"2026-08-16T13:50:16.012931Z","submitted_at":"2024-05-23T10:35:08Z","title":"Proving Theorems Recursively","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14414","snapshot_observed_at":"2026-08-07T06:08:26.801891Z","title":"Proving theorems recursively.arXiv preprint arXiv:2405.14414, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.801891Z"},"links":{"cited_paper":"/paper/2405.14414","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:374ec1c526b2b84c90c88aad3cc4ec520d709a4eeb9c44e18a12e5510f53af89","observation_id":"fcd33a01-a62e-4fd9-9be8-14d4b9b53fac","resolution":{"observed_at":"2026-08-07T06:08:26.801891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:30.042913Z","title":"Measuring multimodal mathematical reasoning with math- vision dataset.Advances in Neural Information Processing Systems, 37:95095–95169,","venue":null,"work_id":"ae5099f1-6738-4587-91a3-892c2c45f130","year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.868017Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:0ce9e4c7b4562b192382ffe2ff027015914ed9024316172c6928edac6a98abbc","observation_id":"15779d59-3c4f-42c2-9cd0-896e99a74108","resolution":{"observed_at":"2026-08-07T06:08:30.128153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20808","last_updated":"2025-08-01T13:54:16Z","snapshot_observed_at":"2026-08-16T12:54:22.643927Z","submitted_at":"2025-02-28T07:50:36Z","title":"MV-MATH: Evaluating Multimodal Math Reasoning in Multi-Visual Contexts","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20808","snapshot_observed_at":"2026-08-07T06:08:27.028489Z","title":"Mv- math: Evaluating multimodal math reasoning in multi-visual contexts.arXiv preprint arXiv:2502.20808, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:27.028489Z"},"links":{"cited_paper":"/paper/2502.20808","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:94e379d463ca255041c1cf8486a4c16f71379510adc624a18f57e3236b4c1fb7","observation_id":"bc114644-a2fc-4d2d-afaa-9d4a5207644e","resolution":{"observed_at":"2026-08-07T06:08:27.028489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03203","last_updated":"2024-10-04T03:06:26Z","snapshot_observed_at":"2026-08-16T13:37:20.638285Z","submitted_at":"2024-07-03T15:36:18Z","title":"TheoremLlama: Transforming General-Purpose LLMs into Lean4 Experts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03203","snapshot_observed_at":"2026-08-07T06:08:27.144650Z","title":"Theoremllama: Transforming general-purpose llms into lean4 experts.arXiv preprint arXiv:2407.03203, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:27.144650Z"},"links":{"cited_paper":"/paper/2407.03203","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:799d2a5fd4cd8613d384387f295543c5cd649afe091dfb49873f7bdab725775d","observation_id":"0a9a7827-cbb4-4c0c-87e6-d355e50d3b1a","resolution":{"observed_at":"2026-08-07T06:08:27.144650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.23703","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:28.517927Z","title":"Fung, and Tong Zhang","venue":null,"work_id":"e296cacc-5149-44ff-b8d5-087e55a8191b","year":2025},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:27.227184Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:c215d13dd748837e5b9f2de7fba386a965656266e752145c35fc4b1a84a55b42","observation_id":"7f4882c0-5c08-4ebb-a227-a3678941626b","resolution":{"observed_at":"2026-08-07T06:08:28.602806Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:29.699717Z","title":"The isabelle framework","venue":null,"work_id":"e44c34be-33ca-44f1-94c0-ca4d4be643c5","year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:27.313857Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:54d013aba6c2355fb23493a0abb6a30ea92d2202071cd25da4bb5317577c3eea","observation_id":"ff394c0c-ea07-48e3-86c5-7240c56add5f","resolution":{"observed_at":"2026-08-07T06:08:29.763857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:27.815011Z","title":"Leandojo: Theorem proving with retrieval-augmented language models.Advances in Neural Information Processing Systems, 36:21573–21612, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:27.815011Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:358e5737cbddb3a48c8e09c56dc674e1d185ae02ec4330dccc45187ce4421114","observation_id":"cdeb2da0-f271-4d9b-9b11-2df79c5e0364","resolution":{"observed_at":"2026-08-07T06:08:27.815011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03847","last_updated":"2025-06-18T16:07:47Z","snapshot_observed_at":"2026-08-16T13:45:38.293139Z","submitted_at":"2024-06-06T08:25:43Z","title":"Lean Workbook: A large-scale Lean problem set formalized from natural language math problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03847","snapshot_observed_at":"2026-08-07T06:08:27.915796Z","title":"Lean workbook: A large-scale lean problem set formalized from natural language math problems.arXiv preprint arXiv:2406.03847, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:27.915796Z"},"links":{"cited_paper":"/paper/2406.03847","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:292d7d77f5b3b656ed5b39f1f96a9849ce728cd706d4d7f1258570397d6e78c9","observation_id":"094cce33-edbc-4774-b7e6-68681c8359da","resolution":{"observed_at":"2026-08-07T06:08:27.915796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:29.480909Z","title":"Mmmu: A massive multi-discipline multimodal understanding and reasoning benchmark for expert agi","venue":null,"work_id":"b2bc88f6-d15d-4cee-8ce5-39989cb3f790","year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:28.013211Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:c635ae3bed20c5883725ea18656f3521903aa78d26c7c92229dd729a19ba27a3","observation_id":"0ae23a6e-440f-4b82-a9ca-6af557a91687","resolution":{"observed_at":"2026-08-07T06:08:29.601101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:29.275877Z","title":"Mathverse: Does your multi-modal llm truly see the diagrams in visual math problems? InEuropean Conference on Computer Vision, pages 169–186","venue":null,"work_id":"6e07a4fe-dc31-45e5-9d37-d1632318e913","year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:28.099080Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:fcc00d8320589c81859517c0394b71e9a377777cbe1612113ddae7c5d3884879","observation_id":"6bbee102-0225-4836-9239-3276f462bdd6","resolution":{"observed_at":"2026-08-07T06:08:29.380731Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.00110","last_updated":"2022-02-28T06:03:23Z","snapshot_observed_at":"2026-08-16T23:45:44.761660Z","submitted_at":"2021-08-31T23:21:12Z","title":"MiniF2F: a cross-system benchmark for formal Olympiad-level mathematics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.00110","snapshot_observed_at":"2026-08-07T06:08:28.160898Z","title":"Limitations","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:28.160898Z"},"links":{"cited_paper":"/paper/2109.00110","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:55c10b38fc87d4e6f3ca1059feaeb5df4daa072f4a0db9e78198031413e17420","observation_id":"7d941f0c-0830-4b49-8308-69e3209a41f7","resolution":{"observed_at":"2026-08-07T06:08:28.160898Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08152","last_updated":"2024-08-15T13:40:03Z","snapshot_observed_at":"2026-08-16T13:26:15.351308Z","submitted_at":"2024-08-15T13:40:03Z","title":"DeepSeek-Prover-V1.5: Harnessing Proof Assistant Feedback for Reinforcement Learning and Monte-Carlo Tree Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08152","snapshot_observed_at":"2026-08-07T06:08:27.508982Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:27.508982Z"},"links":{"cited_paper":"/paper/2408.08152","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:a9379bc7bdbc94761f726df2c5db4eaba1144fccf45e8cd45d0c7ab880deedfa","observation_id":"31f0da6c-8af6-4be9-8cf0-71392c1708dc","resolution":{"observed_at":"2026-08-07T06:08:27.508982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11441","last_updated":"2023-11-06T07:39:49Z","snapshot_observed_at":"2026-08-12T21:25:32.312122Z","submitted_at":"2023-10-17T17:51:31Z","title":"Set-of-Mark Prompting Unleashes Extraordinary Visual Grounding in GPT-4V","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11441","snapshot_observed_at":"2026-08-07T06:08:27.708050Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:27.708050Z"},"links":{"cited_paper":"/paper/2310.11441","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:ef0a18171a69e29aeb5f85f203479212f37b856c03b3dc0e32b7fe863db05e9c","observation_id":"aa45ff06-b898-4bc1-b725-c9796301a215","resolution":{"observed_at":"2026-08-07T06:08:27.708050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:29.137152Z","title":"Guidelines: • The answer NA means that the paper does not involve crowdsourcing nor research with human subjects","venue":null,"work_id":"9ccdd312-78c0-4953-aa82-0609531df947","year":2025},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:28.246141Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:d56e40cc60695ace11130eeaf74bd58831e211fc7bd8b9786a35388fadfd1eb0","observation_id":"e5580767-efeb-4fd3-b020-f941661aaa9b","resolution":{"observed_at":"2026-08-07T06:08:29.190739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:30.848889Z","title":null,"venue":null,"work_id":"ecf7a400-1e43-455f-8c11-e769c79b40c0","year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":2001,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.033854Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:c7ec09b2f4d0e0a739e2c83a31949d96eeb02af04a15a00b1d9522d355c2d40c","observation_id":"092f1825-15f8-44eb-884c-dda23176ad6a","resolution":{"observed_at":"2026-08-07T06:08:30.971403Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:27.379237Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:27.379237Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:7f5e1b1c694d5effe4f4927af10c170e401e2be99f2669d61fe396550ae3eb9a","observation_id":"34ed8203-6c5e-46ce-809e-84c419f43418","resolution":{"observed_at":"2026-08-07T06:08:27.379237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.01344","last_updated":"2022-02-03T00:17:00Z","snapshot_observed_at":"2026-08-16T17:23:59.526328Z","submitted_at":"2022-02-03T00:17:00Z","title":"Formal Mathematics Statement Curriculum Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.01344","snapshot_observed_at":"2026-08-07T06:08:25.636471Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:25.636471Z"},"links":{"cited_paper":"/paper/2202.01344","citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:d1f94c17839c8b04dbd114f28cab6b0f2851f673b8b87a856c60b4dc4915745c","observation_id":"d582042d-f4dd-4256-aa62-48b20b6fda73","resolution":{"observed_at":"2026-08-07T06:08:25.636471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:32.796939Z","title":null,"venue":null,"work_id":"eec85ec5-aa44-4fbf-8a58-347c9749da41","year":2023},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:23.249411Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:d0aff35c4c70751854faebed8f871d8447907c5d02455f4983bbad32d1965aeb","observation_id":"931d50d9-794f-491f-a820-75208c7e1060","resolution":{"observed_at":"2026-08-07T06:08:32.898395Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:29.854272Z","title":null,"venue":null,"work_id":"7f3338f3-41f8-4f63-80d8-f11957117058","year":2024},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:26.951158Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:c0ec5079d19c34c095993aaf22aa0b2b9780c4a47b333b99a7d5a54e0935788d","observation_id":"71a7e03a-04b1-436d-b31f-50a16ec99525","resolution":{"observed_at":"2026-08-07T06:08:29.941786Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:08:23.445192Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T06:08:23.445192Z"},"links":{"citing_paper":"/paper/2506.06034"},"observation_digest":"sha256:fff1b6c9a7888d9efe32fe8d99d69e5f369d6dc6ebcabb12c49e0758baef7379","observation_id":"c1aa5b9c-eddd-4e06-b4cc-64f5e96b9d71","resolution":{"observed_at":"2026-08-07T06:08:23.445192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.06034","last_updated":"2025-06-06T12:33:12Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T15:04:03.680821Z","submitted_at":"2025-06-06T12:33:12Z","title":"MATP-BENCH: Can MLLM Be a Good Automated Theorem Prover for Multimodal Problems?"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":1,"verified_fuzzy":22},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 3 inbound Pith citation observations for arXiv:2506.06034."}