{"as_of":"2026-08-19T12:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e7529d147b8d71ba8687648cc0af0b598ca303a327dc28f574eb88866af2f2da","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:35:34.053651Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T18:53:01.866207Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T00:32:54.660795Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"cited_work":{"arxiv_id":"2505.24714","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24714","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Finmme: Benchmark dataset for financial multi-modal reasoning evaluation.arXiv preprint arXiv:2505.24714","venue":null,"work_id":"51c89e43-6bdc-47b6-aef5-92174c2f30ec","year":2025},"citing_paper":{"arxiv_id":"2511.14998","last_updated":"2026-04-07T03:13:19Z","snapshot_observed_at":"2026-08-15T01:12:11.347044Z","submitted_at":"2025-11-19T00:41:14Z","title":"FinCriticalED: A Visual Benchmark for Financial Fact-Level OCR","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-17T20:19:52.701262Z"},"links":{"cited_paper":"/paper/2505.24714","citing_paper":"/paper/2511.14998"},"observation_digest":"sha256:095c27fbfcb66eeb9e43da9ee4e4935a8d1da6025ebf8d92f1c9fe6872f84b3d","observation_id":"f432e913-cf41-4b9d-acbe-fd43187802aa","resolution":{"observed_at":"2026-05-17T20:20:11.563240Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"cited_work":{"arxiv_id":"2505.24714","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24714","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Finmme: Benchmark dataset for financial multi-modal reasoning evaluation.arXiv preprint arXiv:2505.24714","venue":null,"work_id":"51c89e43-6bdc-47b6-aef5-92174c2f30ec","year":2025},"citing_paper":{"arxiv_id":"2605.06024","last_updated":"2026-05-07T11:17:23Z","snapshot_observed_at":"2026-08-11T03:49:09.628405Z","submitted_at":"2026-05-07T11:17:23Z","title":"Strat-LLM: Stratified Strategy Alignment for LLM-based Stock Trading with Real-time Multi-Source Signals","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T10:42:08.721879Z"},"links":{"cited_paper":"/paper/2505.24714","citing_paper":"/paper/2605.06024"},"observation_digest":"sha256:2d9074ee2ff2191f56e2e1f1175257834691e8389d6bf9ebcd64b7bd68568bd5","observation_id":"67bbb98f-4303-4c9a-9bf4-b8765afe70a7","resolution":{"observed_at":"2026-05-11T19:56:08.512517Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"cited_work":{"arxiv_id":"2505.24714","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24714","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Finmme: Benchmark dataset for financial multi-modal reasoning evaluation.arXiv preprint arXiv:2505.24714","venue":null,"work_id":"51c89e43-6bdc-47b6-aef5-92174c2f30ec","year":2025},"citing_paper":{"arxiv_id":"2605.17962","last_updated":"2026-05-18T07:18:01Z","snapshot_observed_at":"2026-08-12T16:45:12.422719Z","submitted_at":"2026-05-18T07:18:01Z","title":"FinDocMRE: A Benchmark for Document-Level Financial Multimodal Reasoning Evaluation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-20T00:28:48.871454Z"},"links":{"cited_paper":"/paper/2505.24714","citing_paper":"/paper/2605.17962"},"observation_digest":"sha256:5038c5ff708685d63ebfe420a2c6fc971ad0d7544c82e5980e1c9244749c4dae","observation_id":"9629dd8f-8fb5-47aa-bb10-a92f24c2ff51","resolution":{"observed_at":"2026-05-20T00:32:54.664118Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24714","snapshot_observed_at":"2026-08-03T00:48:03.603561Z","title":"arXiv preprint arXiv:2505.24714 , doi =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28661","last_updated":"2026-07-22T06:53:07Z","snapshot_observed_at":"2026-08-19T08:33:14.372245Z","submitted_at":"2026-07-22T06:53:07Z","title":"Are the Financial Reasoning from LLMs Credible? A Real World Test over Long-Horizon Statements","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-03T00:48:03.603561Z"},"links":{"cited_paper":"/paper/2505.24714","citing_paper":"/paper/2607.28661"},"observation_digest":"sha256:69f7098864ca37a5526a7476e1d07367e64ae950d7489957dc8247068d427398","observation_id":"909eae90-6689-45d6-94bf-624b8d8cd79b","resolution":{"observed_at":"2026-08-03T00:48:03.603561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24714","snapshot_observed_at":"2026-08-08T18:53:01.866207Z","title":"arXiv preprint arXiv:2505.24714 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04374","last_updated":"2026-08-05T02:31:48Z","snapshot_observed_at":"2026-08-18T17:13:25.641192Z","submitted_at":"2026-08-05T02:31:48Z","title":"FinReportBench: Measuring and Improving Institution-Grade Financial Report Generation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-08T18:53:01.866207Z"},"links":{"cited_paper":"/paper/2505.24714","citing_paper":"/paper/2608.04374"},"observation_digest":"sha256:f1685a93a8c2a7e7e2e4297015a6a0d6189833682643d82599fe306d8b916caa","observation_id":"95dc9f97-1f97-4eb9-948b-acd3850c3991","resolution":{"observed_at":"2026-08-08T18:53:01.866207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.24714/citation-record","integrity":"/paper/2505.24714/integrity","json":"/paper/2505.24714/citation-record.json","paper":"/paper/2505.24714"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:30.250153Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.250153Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:65a6684a0d53e498118c05d8beab99f7a48d2b61ab322d61197852ebd2b2688b","observation_id":"46a9a3f4-bc1b-479c-9f5b-d9650a48eb46","resolution":{"observed_at":"2026-08-07T12:35:30.250153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:30.300258Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.300258Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:ac2d6807b537d2cf7f0e5d041dc0d3f488c789939403b676b301cd054aa0be5b","observation_id":"30626c9e-a431-4b6a-ade8-8bff8cd64751","resolution":{"observed_at":"2026-08-07T12:35:30.300258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-08-17T03:25:04.404839Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-07T12:35:30.385403Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.385403Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:e981a9fea0f7e37847427b6477632046585c2d3cbb32f73157417db62f26b472","observation_id":"3c9b4a6e-8e04-4a02-b2e1-8392f64ba389","resolution":{"observed_at":"2026-08-07T12:35:30.385403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-07T12:35:30.451544Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.451544Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:9b0085900aee17935c18ba1110524660d74d2d5ee547de5c6a0c4d523f0cdb7f","observation_id":"ae996e5e-503d-4314-81d5-d6a4ec8ae4d5","resolution":{"observed_at":"2026-08-07T12:35:30.451544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:36.563123Z","title":null,"venue":null,"work_id":"e39f5640-4612-4982-a519-0f5b87561235","year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.577706Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:2980e482edbe8ddced0a4ea9cf621cddebea3eebdba45c43332680ffb6679768","observation_id":"b4758da1-1d6f-401b-94bf-f2e350990edb","resolution":{"observed_at":"2026-08-07T12:35:36.636367Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:36.355260Z","title":null,"venue":null,"work_id":"5ecae119-223e-408e-9e1b-8de04df0ff2d","year":2010},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.669831Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:96ee286c80217216d73b6f75a75e98644a2613af787a34ff001410f44bdf0fc2","observation_id":"a096e340-dcb0-43a5-81c2-c4c9c9467ecd","resolution":{"observed_at":"2026-08-07T12:35:36.414991Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09980","last_updated":"2024-05-16T10:53:31Z","snapshot_observed_at":"2026-08-16T13:52:13.314260Z","submitted_at":"2024-05-16T10:53:31Z","title":"FinTextQA: A Dataset for Long-form Financial Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09980","snapshot_observed_at":"2026-08-07T12:35:30.786174Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.786174Z"},"links":{"cited_paper":"/paper/2405.09980","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:5cbd3676e7eed522811016f1644824cfb70fe13ad0022d440c0f8511181b844a","observation_id":"b0e2a5d7-7c2f-4d10-875d-aea697ff2226","resolution":{"observed_at":"2026-08-07T12:35:30.786174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20330","last_updated":"2024-04-09T15:17:50Z","snapshot_observed_at":"2026-08-07T12:15:30.838846Z","submitted_at":"2024-03-29T17:59:34Z","title":"Are We on the Right Way for Evaluating Large Vision-Language Models?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20330","snapshot_observed_at":"2026-08-07T12:35:30.868617Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.868617Z"},"links":{"cited_paper":"/paper/2403.20330","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:a578286bb8f0a87732f7bde06343ba28523bd03bf25c6d7963ae23099c1bad96","observation_id":"1e1b1bab-2e11-48bb-b6bc-8b78c245ef86","resolution":{"observed_at":"2026-08-07T12:35:30.868617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1504.00325","last_updated":"2015-04-03T20:21:16Z","snapshot_observed_at":"2026-08-16T01:18:27.067382Z","submitted_at":"2015-04-01T18:13:43Z","title":"Microsoft COCO Captions: Data Collection and Evaluation Server","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1504.00325","snapshot_observed_at":"2026-08-07T12:35:30.975702Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:30.975702Z"},"links":{"cited_paper":"/paper/1504.00325","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:a26a9ec51a092567e80c9d78c2ec1fff43ed629d63da22a26716c769cb0ddd2f","observation_id":"8049285d-3b31-4852-aa3d-7f1bc9756a48","resolution":{"observed_at":"2026-08-07T12:35:30.975702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:36.012295Z","title":null,"venue":null,"work_id":"540e5603-0f17-4bb2-a09b-aab82896d495","year":2022},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.063802Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:2df88fdcb2b3c0be018e7c31b49964e9fc32bf8baa8649ac58a3404af231ca73","observation_id":"e828c486-00f1-42da-82cd-bf068d589372","resolution":{"observed_at":"2026-08-07T12:35:36.204405Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-08-07T12:35:31.132886Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.132886Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:55b603b65081d71a51214909f1f9771c072ed66b5cf98ea806e743932322ce10","observation_id":"c0a46116-05ce-42c4-bc55-125d8ee42754","resolution":{"observed_at":"2026-08-07T12:35:31.132886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05211","last_updated":"2025-05-30T12:57:16Z","snapshot_observed_at":"2026-08-16T13:27:24.086813Z","submitted_at":"2024-08-09T17:59:49Z","title":"VITA: Towards Open-Source Interactive Omni Multimodal LLM","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05211","snapshot_observed_at":"2026-08-07T12:35:31.216234Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.216234Z"},"links":{"cited_paper":"/paper/2408.05211","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:872d76fa30a750f5f2ca2b9d2e3a2a67405d3649bde76e171bed7c9dfdd47656","observation_id":"f450c3a2-f6b5-401a-9db7-6da32c58d97d","resolution":{"observed_at":"2026-08-07T12:35:31.216234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01957","last_updated":"2025-10-24T02:32:10Z","snapshot_observed_at":"2026-08-15T09:15:43.841019Z","submitted_at":"2025-01-03T18:59:52Z","title":"VITA-1.5: Towards GPT-4o Level Real-Time Vision and Speech Interaction","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01957","snapshot_observed_at":"2026-08-07T12:35:31.300260Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.300260Z"},"links":{"cited_paper":"/paper/2501.01957","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:524b3ac65cfc9e9a4f44b209f620267c2eb40709f71392e4e4e3e2e3f53ecec7","observation_id":"4b08dc92-9a58-40c5-949b-d6060879c27e","resolution":{"observed_at":"2026-08-07T12:35:31.300260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15296","last_updated":"2024-12-08T04:24:31Z","snapshot_observed_at":"2026-08-18T21:58:09.907460Z","submitted_at":"2024-11-22T18:59:54Z","title":"MME-Survey: A Comprehensive Survey on Evaluation of Multimodal LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15296","snapshot_observed_at":"2026-08-07T12:35:31.362263Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.362263Z"},"links":{"cited_paper":"/paper/2411.15296","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:f542ed98a9e5760a54447e56bf53dfb1cc87a2a7b91512869d6cfddbef74052d","observation_id":"f31ac3a0-02af-4b1c-aa28-ff6583550664","resolution":{"observed_at":"2026-08-07T12:35:31.362263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.03314","last_updated":"2024-11-05T18:59:51Z","snapshot_observed_at":"2026-08-18T20:13:18.061033Z","submitted_at":"2024-11-05T18:59:51Z","title":"MME-Finance: A Multimodal Finance Benchmark for Expert-level Understanding and Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.03314","snapshot_observed_at":"2026-08-07T12:35:31.447032Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.447032Z"},"links":{"cited_paper":"/paper/2411.03314","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:c51245e59e929c240c16d52816e795d775be6b0e604c5b789008765457d97a27","observation_id":"c2de8741-0ef5-443b-aa22-0d47aaaafa92","resolution":{"observed_at":"2026-08-07T12:35:31.447032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:31.544870Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.544870Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:9cb5e2140c2d040b27494fd5ddf442598004641aac0035e1ac81da2050aa3050","observation_id":"018c1fa4-a5f3-4832-9495-398357670cb4","resolution":{"observed_at":"2026-08-07T12:35:31.544870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06395","last_updated":"2024-06-03T08:54:38Z","snapshot_observed_at":"2026-08-12T13:10:06.472493Z","submitted_at":"2024-04-09T15:36:50Z","title":"MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06395","snapshot_observed_at":"2026-08-07T12:35:31.621908Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.621908Z"},"links":{"cited_paper":"/paper/2404.06395","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:8a903788b7126d5aaf5aae4489ca8979315b8773d9e5845808de1cc3a6ed6dac","observation_id":"2ae10eca-e090-40ea-a05c-866acca43fcc","resolution":{"observed_at":"2026-08-07T12:35:31.621908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00468","last_updated":"2025-02-27T15:10:56Z","snapshot_observed_at":"2026-08-18T22:18:56.487872Z","submitted_at":"2024-06-29T15:28:45Z","title":"MMEvalPro: Calibrating Multimodal Benchmarks Towards Trustworthy and Efficient Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00468","snapshot_observed_at":"2026-08-07T12:35:31.673244Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.673244Z"},"links":{"cited_paper":"/paper/2407.00468","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:a915c51c197a27b861baf734ecbe576910786742145250904e612a6e26da6a73","observation_id":"43819a59-7a02-4009-b212-5a7a357ef73b","resolution":{"observed_at":"2026-08-07T12:35:31.673244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:31.753764Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.753764Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:76bf222a49399542dbc0c5ed052d62dbbf23550cd302b22dcbb75e1e7f9cb792","observation_id":"f7924ab8-8164-475b-9820-5429feaa179a","resolution":{"observed_at":"2026-08-07T12:35:31.753764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11944","last_updated":"2023-11-20T17:28:02Z","snapshot_observed_at":"2026-08-13T18:35:52.271946Z","submitted_at":"2023-11-20T17:28:02Z","title":"FinanceBench: A New Benchmark for Financial Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11944","snapshot_observed_at":"2026-08-07T12:35:31.894547Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:31.894547Z"},"links":{"cited_paper":"/paper/2311.11944","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:9e15abf57ec606c4db74a1b9b243159df53141870e0666cabb1760c83fa01e5e","observation_id":"7b19a732-f152-4a6b-91da-508b6892bccd","resolution":{"observed_at":"2026-08-07T12:35:31.894547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05812","last_updated":"2024-05-21T08:37:05Z","snapshot_observed_at":"2026-08-19T06:44:51.363123Z","submitted_at":"2023-11-10T01:12:03Z","title":"CFBenchmark: Chinese Financial Assistant Benchmark for Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05812","snapshot_observed_at":"2026-08-07T12:35:32.015781Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.015781Z"},"links":{"cited_paper":"/paper/2311.05812","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:3cfd52e0908fa98e543a74b4aee30c9e9685ecb9eec58129c688d441d8cb3add","observation_id":"d43e62f6-bfd3-4309-a92f-346af62da9ac","resolution":{"observed_at":"2026-08-07T12:35:32.015781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16790","last_updated":"2024-04-25T17:39:35Z","snapshot_observed_at":"2026-08-16T13:57:47.881881Z","submitted_at":"2024-04-25T17:39:35Z","title":"SEED-Bench-2-Plus: Benchmarking Multimodal Large Language Models with Text-Rich Visual Comprehension","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16790","snapshot_observed_at":"2026-08-07T12:35:32.130801Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.130801Z"},"links":{"cited_paper":"/paper/2404.16790","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:0a2cb6099416d93cf632ceaf4893cb6d3cbeb9c8a8e2bac82f5cf02a8c114501","observation_id":"a6a1a634-b303-4b6e-b6c7-e8b03cf126b3","resolution":{"observed_at":"2026-08-07T12:35:32.130801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16125","last_updated":"2023-08-02T08:02:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-30T04:25:16Z","title":"SEED-Bench: Benchmarking Multimodal LLMs with Generative Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16125","snapshot_observed_at":"2026-08-07T12:35:32.258980Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.258980Z"},"links":{"cited_paper":"/paper/2307.16125","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:dfe363a3570b25ee5697bfef5f3c8f04402a12ef11ee44b6857b60068d220761","observation_id":"7ce7526c-13bd-4e7c-9562-7336fb5a67de","resolution":{"observed_at":"2026-08-07T12:35:32.258980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:35.586967Z","title":null,"venue":null,"work_id":"17ff9f63-f25c-460e-8f39-ac533870918c","year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.331654Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:242fae719d4b9a1249a39232f0db85c64fec946568e49cf41b45dedfae485183","observation_id":"ce077ca2-8eea-4988-a970-464b19c96896","resolution":{"observed_at":"2026-08-07T12:35:35.831999Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.03557","last_updated":"2019-08-09T17:57:13Z","snapshot_observed_at":"2026-08-07T01:39:40.489262Z","submitted_at":"2019-08-09T17:57:13Z","title":"VisualBERT: A Simple and Performant Baseline for Vision and Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.03557","snapshot_observed_at":"2026-08-07T12:35:32.435193Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.435193Z"},"links":{"cited_paper":"/paper/1908.03557","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:e4c3a1431d6c630951fa23110e6c201debf4c166886593d5d4b29a5e5b1ebfb2","observation_id":"6230c13c-89c2-4300-ba64-c992c82b2b83","resolution":{"observed_at":"2026-08-07T12:35:32.435193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:32.531062Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.531062Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:51535ed33afa62390d39fbfcb6415bdecef8329b6855064663393d5911eec56b","observation_id":"02595493-e29f-42e0-b415-cde8ecc35ec0","resolution":{"observed_at":"2026-08-07T12:35:32.531062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:32.627555Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.627555Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:3a4bb2382de68e67cf09705b13b161952b2388cb68b3fd912647c35f7f25c8c4","observation_id":"fc712e4a-7263-4d74-8a77-eb2b39696964","resolution":{"observed_at":"2026-08-07T12:35:32.627555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:35.263415Z","title":null,"venue":null,"work_id":"0aea6e64-2481-4976-8d5a-36212fad3ae4","year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.733322Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:838cf1f995a35cc46c96817bb477684340054e54d3a336a1b27284af3867b242","observation_id":"351ae998-d17c-4a67-a52e-c13e5fa00d65","resolution":{"observed_at":"2026-08-07T12:35:35.416557Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10774","last_updated":"2024-04-15T15:48:48Z","snapshot_observed_at":"2026-08-16T14:42:53.337710Z","submitted_at":"2023-11-15T23:36:42Z","title":"MMC: Advancing Multimodal Chart Understanding with Large-scale Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10774","snapshot_observed_at":"2026-08-07T12:35:32.804493Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.804493Z"},"links":{"cited_paper":"/paper/2311.10774","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:1d1fc787c718a5b4bef83b33d19b3a16303abb40ec6db952187b250ed29a14ec","observation_id":"b77ffe11-d12e-4b0c-bf52-1ce72333bc35","resolution":{"observed_at":"2026-08-07T12:35:32.804493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:34.970080Z","title":null,"venue":null,"work_id":"ba87793c-2b35-4a3a-b5d9-0ef9d52ae17a","year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.878031Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:d48d42c8fd98f80cf27c4c556c22e61a37cb4921bf7ad6aab6c3563e5fa69e0c","observation_id":"765647e4-25e9-4de1-829d-3e45ce599fdf","resolution":{"observed_at":"2026-08-07T12:35:35.082683Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21460","last_updated":"2025-03-27T12:50:17Z","snapshot_observed_at":"2026-07-06T20:59:35.694800Z","submitted_at":"2025-03-27T12:50:17Z","title":"Large Language Model Agent: A Survey on Methodology, Applications and Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21460","snapshot_observed_at":"2026-08-07T12:35:32.951314Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:32.951314Z"},"links":{"cited_paper":"/paper/2503.21460","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:545c0d575b0657c24653ca87c8f580d5a3453a06ce70072d1dbc7434d7da76aa","observation_id":"1eaefa05-4451-47a2-a956-17b1f11dbf87","resolution":{"observed_at":"2026-08-07T12:35:32.951314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.10244","last_updated":"2022-03-19T05:00:30Z","snapshot_observed_at":"2026-08-11T03:45:43.920485Z","submitted_at":"2022-03-19T05:00:30Z","title":"ChartQA: A Benchmark for Question Answering about Charts with Visual and Logical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.10244","snapshot_observed_at":"2026-08-07T12:35:33.032851Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.032851Z"},"links":{"cited_paper":"/paper/2203.10244","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:6ee361a46cd6a185cd26337ed8bab48436701cedb14718009fa5caf6ba9f85e7","observation_id":"c0c17bf7-1135-4f0d-80d9-d471607fb763","resolution":{"observed_at":"2026-08-07T12:35:33.032851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:33.100252Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.100252Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:b5633b73ed65201032725e6e3acb69d896af8b514f79c1afa6b01ab3f65a5b5a","observation_id":"a649a890-a2ae-41f9-949f-fc4452089ea5","resolution":{"observed_at":"2026-08-07T12:35:33.100252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:34.694477Z","title":null,"venue":null,"work_id":"aeb52ba2-19cf-4abe-9baa-5d567ea07c4f","year":2020},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.188206Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:8bf08b7b7f303575771ca72cd4483666aa4ee4da6866198a9c9ec4f9c8ae539a","observation_id":"cdd1da3a-cfd2-4f28-87f5-2a14b13734e3","resolution":{"observed_at":"2026-08-07T12:35:34.794795Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:34.545680Z","title":null,"venue":null,"work_id":"4568ddf8-7542-4688-8bd6-4c926f9b3d73","year":2020},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.295608Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:f6577ba2f468460a810f7d43aa928f8a9e2f87a41ef64e53f54025c3596004f3","observation_id":"8b4dde1d-9671-4586-9790-51849ae05df1","resolution":{"observed_at":"2026-08-07T12:35:34.601957Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T12:35:33.363156Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.363156Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:70590c7abf8cab3e409e038aaf3d6c75eaf5267973d8dfe1610ed4d9af1e5195","observation_id":"73083d0d-814f-4b9a-8f00-a97cb649ec96","resolution":{"observed_at":"2026-08-07T12:35:33.363156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T12:35:33.424499Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.424499Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:d98b52d5b2442b950b213544daa460b6f03185f9211a5814d911b5340dd8a7c6","observation_id":"d24b0338-a1f2-4828-aa74-2e83e0c92aaa","resolution":{"observed_at":"2026-08-07T12:35:33.424499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03079","last_updated":"2024-02-04T08:23:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-06T13:04:39Z","title":"CogVLM: Visual Expert for Pretrained Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03079","snapshot_observed_at":"2026-08-07T12:35:33.482668Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.482668Z"},"links":{"cited_paper":"/paper/2311.03079","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:9197758af54540a316a82677bf0c717c8210607653c8d113b5997c44e3f98782","observation_id":"9338ce06-acb8-4c3a-bb8c-256df082e970","resolution":{"observed_at":"2026-08-07T12:35:33.482668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-08-07T12:35:33.549590Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.549590Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:08bf91007cf036edbcd09be755f4cfd5a9ad3d145731005c74b8b40ddfb03311","observation_id":"bb422c51-2059-4a9a-a4db-d8f2096415f7","resolution":{"observed_at":"2026-08-07T12:35:33.549590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12659","last_updated":"2024-06-19T03:38:56Z","snapshot_observed_at":"2026-08-16T14:17:06.781974Z","submitted_at":"2024-02-20T02:16:16Z","title":"FinBen: A Holistic Financial Benchmark for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12659","snapshot_observed_at":"2026-08-07T12:35:33.646547Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.646547Z"},"links":{"cited_paper":"/paper/2402.12659","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:eb39543991673f60ed074ae983e2224206a078d071be0cac5220a4d210335d69","observation_id":"80fd2abe-bd96-4da6-85ee-8b42611c8015","resolution":{"observed_at":"2026-08-07T12:35:33.646547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T12:35:33.745859Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.745859Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:6aba9dd3be5e5c9f9cae7fcc48d10727dc74ca71fd31ab377b30148b4b4da3a4","observation_id":"aef175a3-a5cb-4f3d-92c4-6abd39b60f83","resolution":{"observed_at":"2026-08-07T12:35:33.745859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:34.487143Z","title":null,"venue":null,"work_id":"ac595bab-8299-4ca4-b976-5505b3ef410a","year":2021},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.819813Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:cd0c24bb00cf95d06a1dad8e6a3f1c3887acb9babe4da329f62f51bbe322f8d8","observation_id":"801eec10-b278-4453-aa22-7d28771b1e1c","resolution":{"observed_at":"2026-08-07T12:35:34.535561Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-08-18T03:16:44.825874Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-08-07T12:35:33.911928Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.911928Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:e335f5d5d3398797a272a632d83788e7a375ba0a478b21ad71cd9c01a4c8905b","observation_id":"c696ed45-e664-4492-a530-0ce48ece7a2e","resolution":{"observed_at":"2026-08-07T12:35:33.911928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:33.972789Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:33.972789Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:31e5946cedd2f7f7d17b64b8f5c15b8473aee333a891003a749c836c50c02442","observation_id":"ae8b3625-fc31-4879-9886-38472b69f91b","resolution":{"observed_at":"2026-08-07T12:35:33.972789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:34.053651Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:34.053651Z"},"links":{"citing_paper":"/paper/2505.24714"},"observation_digest":"sha256:3bffd39f7696efe710f14f463aecdd49467849e0ec0d54addafb86a6890a0d4c","observation_id":"46802361-d266-44d6-b044-e80cf70fa281","resolution":{"observed_at":"2026-08-07T12:35:34.053651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.24714","last_updated":"2025-05-30T15:36:19Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-18T07:44:27.143732Z","submitted_at":"2025-05-30T15:36:19Z","title":"FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 5 inbound Pith citation observations for arXiv:2505.24714."}