{"as_of":"2026-08-08T22:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6f9796580140b4edb4bb046c8bb3a0b83d5ed68900a6a485953c9695a2aca945","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":21,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:55:56.665148Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T22:47:26.006183Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.08739","last_updated":"2024-11-01T22:14:24Z","snapshot_observed_at":"2026-07-06T18:45:01.801741Z","submitted_at":"2024-07-11T17:59:47Z","title":"MAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine","version":2},"cited_work":{"arxiv_id":"2407.08739","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.08739","snapshot_observed_at":"2026-07-02T22:47:26.006183Z","title":"Mavis: Mathematical visual in- struction tuning","venue":null,"work_id":"fac73d64-a4a2-4afb-8f45-33d938f9ada7","year":2024},"citing_paper":{"arxiv_id":"2403.14624","last_updated":"2024-08-18T08:10:16Z","snapshot_observed_at":"2026-08-04T04:40:00.850270Z","submitted_at":"2024-03-21T17:59:50Z","title":"MathVerse: Does Your Multi-modal LLM Truly See the Diagrams in Visual Math Problems?","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-17T01:29:30.032408Z"},"links":{"cited_paper":"/paper/2407.08739","citing_paper":"/paper/2403.14624"},"observation_digest":"sha256:195622b53a86f4bc502ee98fcc006303df74c83e816fd5104ac65a6bca400662","observation_id":"24af4123-0fd2-44b7-92f7-832014c86653","resolution":{"observed_at":"2026-05-17T01:29:30.190346Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08739","last_updated":"2024-11-01T22:14:24Z","snapshot_observed_at":"2026-07-06T18:45:01.801741Z","submitted_at":"2024-07-11T17:59:47Z","title":"MAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine","version":2},"cited_work":{"arxiv_id":"2407.08739","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.08739","snapshot_observed_at":"2026-07-02T22:47:26.006183Z","title":"Mavis: Mathematical visual in- struction tuning","venue":null,"work_id":"fac73d64-a4a2-4afb-8f45-33d938f9ada7","year":2024},"citing_paper":{"arxiv_id":"2407.07895","last_updated":"2024-07-28T19:58:08Z","snapshot_observed_at":"2026-07-06T18:44:24.873040Z","submitted_at":"2024-07-10T17:59:43Z","title":"LLaVA-NeXT-Interleave: Tackling Multi-image, Video, and 3D in Large Multimodal Models","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-11T06:01:53.730356Z"},"links":{"cited_paper":"/paper/2407.08739","citing_paper":"/paper/2407.07895"},"observation_digest":"sha256:2dba21015079cd006d0c8617e2593b9d75ea54741c0cafe842f2a7d55e55940c","observation_id":"4a21b82d-8f57-4c5d-8782-6593f43566e9","resolution":{"observed_at":"2026-05-11T06:01:54.061147Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08739","last_updated":"2024-11-01T22:14:24Z","snapshot_observed_at":"2026-07-06T18:45:01.801741Z","submitted_at":"2024-07-11T17:59:47Z","title":"MAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine","version":2},"cited_work":{"arxiv_id":"2407.08739","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.08739","snapshot_observed_at":"2026-07-02T22:47:26.006183Z","title":"Mavis: Mathematical visual in- struction tuning","venue":null,"work_id":"fac73d64-a4a2-4afb-8f45-33d938f9ada7","year":2024},"citing_paper":{"arxiv_id":"2411.10442","last_updated":"2025-04-07T09:09:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-15T18:59:27Z","title":"Enhancing the Reasoning Ability of Multimodal Large Language Models via Mixed Preference Optimization","version":2},"reference_index":115,"source":"pdf_text","source_observed_at":"2026-05-16T09:16:17.150383Z"},"links":{"cited_paper":"/paper/2407.08739","citing_paper":"/paper/2411.10442"},"observation_digest":"sha256:ef0e74cab2e276f175985efa737da503f6696d9fd288115c6a2046f4906f7d08","observation_id":"a2f6558d-bacf-40b3-9290-d6f5d0d6db7a","resolution":{"observed_at":"2026-05-16T09:16:17.557931Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08739","last_updated":"2024-11-01T22:14:24Z","snapshot_observed_at":"2026-07-06T18:45:01.801741Z","submitted_at":"2024-07-11T17:59:47Z","title":"MAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine","version":2},"cited_work":{"arxiv_id":"2407.08739","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.08739","snapshot_observed_at":"2026-07-02T22:47:26.006183Z","title":"Mavis: Mathematical visual in- struction tuning","venue":null,"work_id":"fac73d64-a4a2-4afb-8f45-33d938f9ada7","year":2024},"citing_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"reference_index":110,"source":"pdf_text","source_observed_at":"2026-05-11T10:09:21.542356Z"},"links":{"cited_paper":"/paper/2407.08739","citing_paper":"/paper/2412.10302"},"observation_digest":"sha256:8fe320dbbb2a027f092e6384ad693dc8ea4c8726f29353cf3fe9611e37b2a5bb","observation_id":"16f579f7-a6d3-4b0f-8645-548a8440880a","resolution":{"observed_at":"2026-05-11T10:09:26.732425Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08739","last_updated":"2024-11-01T22:14:24Z","snapshot_observed_at":"2026-07-06T18:45:01.801741Z","submitted_at":"2024-07-11T17:59:47Z","title":"MAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine","version":2},"cited_work":{"arxiv_id":"2407.08739","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.08739","snapshot_observed_at":"2026-07-02T22:47:26.006183Z","title":"Mavis: Mathematical visual in- struction tuning","venue":null,"work_id":"fac73d64-a4a2-4afb-8f45-33d938f9ada7","year":2024},"citing_paper":{"arxiv_id":"2503.12605","last_updated":"2025-03-23T13:47:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-16T18:39:13Z","title":"Multimodal Chain-of-Thought Reasoning: A Comprehensive Survey","version":2},"reference_index":161,"source":"pdf_text","source_observed_at":"2026-05-15T17:18:52.996467Z"},"links":{"cited_paper":"/paper/2407.08739","citing_paper":"/paper/2503.12605"},"observation_digest":"sha256:1a91571ccb154903b2369b3638f711fa421f6c5703fa5df9da3aa8c30c2b44d2","observation_id":"7d4d353c-549d-424a-8824-bc950204ba0d","resolution":{"observed_at":"2026-05-15T17:18:53.270300Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08739","last_updated":"2024-11-01T22:14:24Z","snapshot_observed_at":"2026-07-06T18:45:01.801741Z","submitted_at":"2024-07-11T17:59:47Z","title":"MAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine","version":2},"cited_work":{"arxiv_id":"2407.08739","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.08739","snapshot_observed_at":"2026-07-02T22:47:26.006183Z","title":"Mavis: Mathematical visual in- struction tuning","venue":null,"work_id":"fac73d64-a4a2-4afb-8f45-33d938f9ada7","year":2024},"citing_paper":{"arxiv_id":"2503.16549","last_updated":"2026-04-18T11:44:37Z","snapshot_observed_at":"2026-08-08T08:24:44.422314Z","submitted_at":"2025-03-19T11:46:19Z","title":"MathFlow: Enhancing the Perceptual Flow of MLLMs for Visual Mathematical Problems","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-22T22:55:34.238427Z"},"links":{"cited_paper":"/paper/2407.08739","citing_paper":"/paper/2503.16549"},"observation_digest":"sha256:f5c47dc76de02e0dc96e2584b30b35e858fde292d5d48a55b48372583c8f408c","observation_id":"c209adac-e703-4368-a0cb-5989f264fe0a","resolution":{"observed_at":"2026-05-22T22:57:13.394341Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08739","last_updated":"2024-11-01T22:14:24Z","snapshot_observed_at":"2026-07-06T18:45:01.801741Z","submitted_at":"2024-07-11T17:59:47Z","title":"MAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine","version":2},"cited_work":{"arxiv_id":"2407.08739","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.08739","snapshot_observed_at":"2026-07-02T22:47:26.006183Z","title":"Mavis: Mathematical visual in- struction tuning","venue":null,"work_id":"fac73d64-a4a2-4afb-8f45-33d938f9ada7","year":2024},"citing_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"reference_index":148,"source":"pdf_text","source_observed_at":"2026-05-10T13:41:07.991012Z"},"links":{"cited_paper":"/paper/2407.08739","citing_paper":"/paper/2504.10479"},"observation_digest":"sha256:08fe7146ea5fe34c0181757c64532e717687519cd92632cd680a427e129c9bc2","observation_id":"53cdd838-b3db-45ab-9ddc-eed5a0d2135e","resolution":{"observed_at":"2026-05-10T13:41:08.184254Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08739","last_updated":"2024-11-01T22:14:24Z","snapshot_observed_at":"2026-07-06T18:45:01.801741Z","submitted_at":"2024-07-11T17:59:47Z","title":"MAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08739","snapshot_observed_at":"2026-08-07T14:55:56.665148Z","title":"Mavis: Mathematical visual instruction tuning with an automatic data engine","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17017","last_updated":"2025-06-10T13:46:37Z","snapshot_observed_at":"2026-08-07T20:38:00.494377Z","submitted_at":"2025-05-22T17:59:49Z","title":"Delving into RL for Image Generation with CoT: A Study on DPO vs. GRPO","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T14:55:56.665148Z"},"links":{"cited_paper":"/paper/2407.08739","citing_paper":"/paper/2505.17017"},"observation_digest":"sha256:69310cc889ae960ba3d51ad85fa87955fe5ec5733e7a7dbc25889de6c0503e71","observation_id":"b529bdf1-551a-4362-aa4e-a75d6d4924ab","resolution":{"observed_at":"2026-08-07T14:55:56.665148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08739","last_updated":"2024-11-01T22:14:24Z","snapshot_observed_at":"2026-07-06T18:45:01.801741Z","submitted_at":"2024-07-11T17:59:47Z","title":"MAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08739","snapshot_observed_at":"2026-08-07T13:12:58.908022Z","title":"Mavis: Mathematical visual instruction tuning with an automatic data engine","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22334","last_updated":"2025-07-23T07:37:08Z","snapshot_observed_at":"2026-08-08T13:10:29.457567Z","submitted_at":"2025-05-28T13:21:38Z","title":"Advancing Multimodal Reasoning via Reinforcement Learning with Cold Start","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T13:12:58.908022Z"},"links":{"cited_paper":"/paper/2407.08739","citing_paper":"/paper/2505.22334"},"observation_digest":"sha256:500e29526432ff1f747d173365b66157f6fe161b3e23708a8292b66c7b1ff119","observation_id":"9bbde23e-4ac3-482c-8e41-cabfad96a542","resolution":{"observed_at":"2026-08-07T13:12:58.908022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08739","last_updated":"2024-11-01T22:14:24Z","snapshot_observed_at":"2026-07-06T18:45:01.801741Z","submitted_at":"2024-07-11T17:59:47Z","title":"MAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08739","snapshot_observed_at":"2026-08-07T13:14:40.804899Z","title":"a(n) [animal] [activity]","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22407","last_updated":"2025-05-28T14:37:21Z","snapshot_observed_at":"2026-08-07T20:36:50.345116Z","submitted_at":"2025-05-28T14:37:21Z","title":"Self-Reflective Reinforcement Learning for Diffusion-based Image Reasoning Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:40.804899Z"},"links":{"cited_paper":"/paper/2407.08739","citing_paper":"/paper/2505.22407"},"observation_digest":"sha256:2062d9164be868004bd6bc6a1c49af033fa3e0295ffd36ae5e20dc69826e27c0","observation_id":"5a67142b-43ef-49a4-a05e-f83c9a3c7073","resolution":{"observed_at":"2026-08-07T13:14:40.804899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08739","last_updated":"2024-11-01T22:14:24Z","snapshot_observed_at":"2026-07-06T18:45:01.801741Z","submitted_at":"2024-07-11T17:59:47Z","title":"MAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08739","snapshot_observed_at":"2026-08-07T11:34:12.657363Z","title":"Mavis: Mathematical visual instruction tuning with an automatic data engine","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01953","last_updated":"2025-06-02T17:59:51Z","snapshot_observed_at":"2026-08-07T11:28:25.217327Z","submitted_at":"2025-06-02T17:59:51Z","title":"Fast-in-Slow: A Dual-System Foundation Model Unifying Fast Manipulation within Slow Reasoning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:34:12.657363Z"},"links":{"cited_paper":"/paper/2407.08739","citing_paper":"/paper/2506.01953"},"observation_digest":"sha256:89c2e40c5fb040bb6462e5cfc4191d6dbc1197be98544ea31958836721d10000","observation_id":"b142e3ae-f505-4f10-8d0c-6687061a00a4","resolution":{"observed_at":"2026-08-07T11:34:12.657363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08739","last_updated":"2024-11-01T22:14:24Z","snapshot_observed_at":"2026-07-06T18:45:01.801741Z","submitted_at":"2024-07-11T17:59:47Z","title":"MAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine","version":2},"cited_work":{"arxiv_id":"2407.08739","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.08739","snapshot_observed_at":"2026-07-02T22:47:26.006183Z","title":"Mavis: Mathematical visual in- struction tuning","venue":null,"work_id":"fac73d64-a4a2-4afb-8f45-33d938f9ada7","year":2024},"citing_paper":{"arxiv_id":"2506.06856","last_updated":"2026-05-06T17:36:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-07T16:37:46Z","title":"Vision-EKIPL: External Knowledge-Infused Policy Learning for Visual Reasoning","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-19T10:34:48.849524Z"},"links":{"cited_paper":"/paper/2407.08739","citing_paper":"/paper/2506.06856"},"observation_digest":"sha256:fa20fe471fe4c9e5530191877670d33650becaa26bad07033684f34af198818a","observation_id":"8b0f0c64-a046-495b-afaf-bc5aacb038bb","resolution":{"observed_at":"2026-05-19T10:37:14.947419Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08739","last_updated":"2024-11-01T22:14:24Z","snapshot_observed_at":"2026-07-06T18:45:01.801741Z","submitted_at":"2024-07-11T17:59:47Z","title":"MAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08739","snapshot_observed_at":"2026-08-06T18:19:58.402131Z","title":"Mavis: Mathematical visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08719","last_updated":"2025-07-11T16:19:53Z","snapshot_observed_at":"2026-08-07T04:09:15.037517Z","submitted_at":"2025-07-11T16:19:53Z","title":"Multilingual Multimodal Software Developer for Code Generation","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.402131Z"},"links":{"cited_paper":"/paper/2407.08739","citing_paper":"/paper/2507.08719"},"observation_digest":"sha256:983b57bb38163b0082c45b72792d7084fdcf94c1ef9a186c31213a200ee10749","observation_id":"7abe790c-2990-4cb5-8685-08c7b2b55b60","resolution":{"observed_at":"2026-08-06T18:19:58.402131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08739","last_updated":"2024-11-01T22:14:24Z","snapshot_observed_at":"2026-07-06T18:45:01.801741Z","submitted_at":"2024-07-11T17:59:47Z","title":"MAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08739","snapshot_observed_at":"2026-08-06T15:12:02.048255Z","title":"arXiv preprint arXiv:2407.08739 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16518","last_updated":"2026-06-24T02:00:50Z","snapshot_observed_at":"2026-08-08T12:45:29.488887Z","submitted_at":"2025-07-22T12:27:08Z","title":"SyncLoop: A Multimodal Dual-Loop Framework for Self-Improving Mathematical Reasoning","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T15:12:02.048255Z"},"links":{"cited_paper":"/paper/2407.08739","citing_paper":"/paper/2507.16518"},"observation_digest":"sha256:685d9b9d476f69e7ada52cd71d02e6b5faa8cd9516842718c12617f094c20cd9","observation_id":"ebeb8b8e-d759-4132-9dd0-3cd68ed37aac","resolution":{"observed_at":"2026-08-06T15:12:02.048255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08739","last_updated":"2024-11-01T22:14:24Z","snapshot_observed_at":"2026-07-06T18:45:01.801741Z","submitted_at":"2024-07-11T17:59:47Z","title":"MAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08739","snapshot_observed_at":"2026-08-05T20:44:18.084915Z","title":"Mavis: Mathematical visual instruction tuning with an automatic data engine, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09987","last_updated":"2025-08-13T17:59:28Z","snapshot_observed_at":"2026-08-06T06:04:10.094208Z","submitted_at":"2025-08-13T17:59:28Z","title":"Echo-4o: Harnessing the Power of GPT-4o Synthetic Images for Improved Image Generation","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-05T20:44:18.084915Z"},"links":{"cited_paper":"/paper/2407.08739","citing_paper":"/paper/2508.09987"},"observation_digest":"sha256:00b97d2aa2a1a97d8587a4994eda95060a85c012a42feb30a808b152ddf3bdc0","observation_id":"1c842d2f-a386-4325-bfd3-8d7b4aa80f9d","resolution":{"observed_at":"2026-08-05T20:44:18.084915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08739","last_updated":"2024-11-01T22:14:24Z","snapshot_observed_at":"2026-07-06T18:45:01.801741Z","submitted_at":"2024-07-11T17:59:47Z","title":"MAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine","version":2},"cited_work":{"arxiv_id":"2407.08739","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.08739","snapshot_observed_at":"2026-07-02T22:47:26.006183Z","title":"Mavis: Mathematical visual in- struction tuning","venue":null,"work_id":"fac73d64-a4a2-4afb-8f45-33d938f9ada7","year":2024},"citing_paper":{"arxiv_id":"2510.21122","last_updated":"2026-04-07T14:13:33Z","snapshot_observed_at":"2026-08-08T09:08:38.146038Z","submitted_at":"2025-10-24T03:23:34Z","title":"NoisyGRPO: Incentivizing Multimodal CoT Reasoning via Noise Injection and Bayesian Estimation","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-18T04:39:58.296388Z"},"links":{"cited_paper":"/paper/2407.08739","citing_paper":"/paper/2510.21122"},"observation_digest":"sha256:f6a49b0a33242e401f6aaee4eeb153a47c0f678cc98293aab3e59df14c1a60e5","observation_id":"9f00765b-351e-4bde-8836-8bd28789fc4a","resolution":{"observed_at":"2026-05-18T04:40:53.011695Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08739","last_updated":"2024-11-01T22:14:24Z","snapshot_observed_at":"2026-07-06T18:45:01.801741Z","submitted_at":"2024-07-11T17:59:47Z","title":"MAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine","version":2},"cited_work":{"arxiv_id":"2407.08739","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.08739","snapshot_observed_at":"2026-07-02T22:47:26.006183Z","title":"Mavis: Mathematical visual in- struction tuning","venue":null,"work_id":"fac73d64-a4a2-4afb-8f45-33d938f9ada7","year":2024},"citing_paper":{"arxiv_id":"2512.07348","last_updated":"2026-04-28T10:02:14Z","snapshot_observed_at":"2026-08-06T12:32:11.849043Z","submitted_at":"2025-12-08T09:40:11Z","title":"MICo-150K: A Comprehensive Dataset Advancing Multi-Image Composition","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-17T00:20:58.483350Z"},"links":{"cited_paper":"/paper/2407.08739","citing_paper":"/paper/2512.07348"},"observation_digest":"sha256:e1ec69262860ed5724e9c91dd75a85b6c582a4262889ccdd7773e0fc54aa2e4b","observation_id":"fc019f4c-96cb-4dad-b159-2c8c190cc679","resolution":{"observed_at":"2026-05-17T00:21:23.392627Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08739","last_updated":"2024-11-01T22:14:24Z","snapshot_observed_at":"2026-07-06T18:45:01.801741Z","submitted_at":"2024-07-11T17:59:47Z","title":"MAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine","version":2},"cited_work":{"arxiv_id":"2407.08739","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.08739","snapshot_observed_at":"2026-07-02T22:47:26.006183Z","title":"Mavis: Mathematical visual in- struction tuning","venue":null,"work_id":"fac73d64-a4a2-4afb-8f45-33d938f9ada7","year":2024},"citing_paper":{"arxiv_id":"2605.19852","last_updated":"2026-06-03T11:11:28Z","snapshot_observed_at":"2026-07-06T23:30:30.141040Z","submitted_at":"2026-05-19T13:44:26Z","title":"Are Tools Always Beneficial? Learning to Invoke Tools Adaptively for Dual-Mode Multimodal LLM Reasoning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-20T06:16:47.650748Z"},"links":{"cited_paper":"/paper/2407.08739","citing_paper":"/paper/2605.19852"},"observation_digest":"sha256:126e9ac7371c906012babb561e3d282b286cbcdcd74f1a17b8a11da1cc182a26","observation_id":"638c9f27-1926-4981-a4f8-e3dc2dd532dd","resolution":{"observed_at":"2026-05-20T06:18:05.302009Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08739","last_updated":"2024-11-01T22:14:24Z","snapshot_observed_at":"2026-07-06T18:45:01.801741Z","submitted_at":"2024-07-11T17:59:47Z","title":"MAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine","version":2},"cited_work":{"arxiv_id":"2407.08739","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.08739","snapshot_observed_at":"2026-07-02T22:47:26.006183Z","title":"Mavis: Mathematical visual in- struction tuning","venue":null,"work_id":"fac73d64-a4a2-4afb-8f45-33d938f9ada7","year":2024},"citing_paper":{"arxiv_id":"2606.08728","last_updated":"2026-07-26T11:27:42Z","snapshot_observed_at":"2026-08-02T12:04:58.846884Z","submitted_at":"2026-06-07T16:50:07Z","title":"Artificial Intelligence for Mathematical Reasoning: An Integrated Survey of Language Models, Neuro-symbolic Systems, and Verified Discovery","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-27T18:39:44.696961Z"},"links":{"cited_paper":"/paper/2407.08739","citing_paper":"/paper/2606.08728"},"observation_digest":"sha256:a2c2309bb435cb0025d07e12c0fb010edac95559de53f1cf5b4a3d3a73ced2b0","observation_id":"913fe041-bf1c-4595-8295-43f8808509d4","resolution":{"observed_at":"2026-07-02T22:47:26.007669Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08739","last_updated":"2024-11-01T22:14:24Z","snapshot_observed_at":"2026-07-06T18:45:01.801741Z","submitted_at":"2024-07-11T17:59:47Z","title":"MAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08739","snapshot_observed_at":"2026-08-02T12:05:09.795947Z","title":"MA VIS: Mathematical visual instruction tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08728","last_updated":"2026-07-26T11:27:42Z","snapshot_observed_at":"2026-08-02T12:04:58.846884Z","submitted_at":"2026-06-07T16:50:07Z","title":"Artificial Intelligence for Mathematical Reasoning: An Integrated Survey of Language Models, Neuro-symbolic Systems, and Verified Discovery","version":4},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-02T12:05:09.795947Z"},"links":{"cited_paper":"/paper/2407.08739","citing_paper":"/paper/2606.08728"},"observation_digest":"sha256:d1c6ab2c0eebabc8eac6b2ec90d758e7e629f035aaafcfff0aeb0d43bc3a30e8","observation_id":"664e61c1-603b-4fdd-9fe9-9deef7b40e75","resolution":{"observed_at":"2026-08-02T12:05:09.795947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08739","last_updated":"2024-11-01T22:14:24Z","snapshot_observed_at":"2026-07-06T18:45:01.801741Z","submitted_at":"2024-07-11T17:59:47Z","title":"MAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08739","snapshot_observed_at":"2026-08-02T06:15:36.702227Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12982","last_updated":"2026-07-21T09:49:15Z","snapshot_observed_at":"2026-08-02T06:15:31.398289Z","submitted_at":"2026-07-14T17:24:57Z","title":"FormalAnalyticGeo: A Neural-Symbolic Based Framework for Multimodal Analytic Geometry Problem Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T06:15:36.702227Z"},"links":{"cited_paper":"/paper/2407.08739","citing_paper":"/paper/2607.12982"},"observation_digest":"sha256:6a0f3faa4df5cac82ddb0ff4697d07f33f93cabf061e0ca54f98a0426c421d3d","observation_id":"8ea9a2ae-b86a-4381-8109-45b8302c42c7","resolution":{"observed_at":"2026-08-02T06:15:36.702227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2407.08739/citation-record","integrity":"/paper/2407.08739/integrity","json":"/paper/2407.08739/citation-record.json","paper":"/paper/2407.08739"},"outbound":[],"paper":{"arxiv_id":"2407.08739","last_updated":"2024-11-01T22:14:24Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T18:45:01.801741Z","submitted_at":"2024-07-11T17:59:47Z","title":"MAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 21 inbound Pith citation observations for arXiv:2407.08739."}