{"as_of":"2026-08-18T09:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7caa2d2fc3b0ef3fb991187ce93059bd753d3434509db02bd0636b3098868b83","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:01:17.216046Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:13:40.295752Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T04:35:57.460732Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20246","snapshot_observed_at":"2026-08-07T00:13:40.295752Z","title":"On path to multimodal historical reasoning: Histbench and histagent.arXiv preprint arXiv:2505.20246, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.14728","last_updated":"2025-06-17T17:08:32Z","snapshot_observed_at":"2026-08-16T04:45:33.901926Z","submitted_at":"2025-06-17T17:08:32Z","title":"AgentDistill: Training-Free Agent Distillation with Generalizable MCP Boxes","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:40.295752Z"},"links":{"cited_paper":"/paper/2505.20246","citing_paper":"/paper/2506.14728"},"observation_digest":"sha256:5ff7444c7c5d8cd092a4f11cff95a0dacd86bee9ed731d36b3828e09100cddec","observation_id":"c15b03d3-e3b3-4b99-8f34-2ddb2d552fd8","resolution":{"observed_at":"2026-08-07T00:13:40.295752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"cited_work":{"arxiv_id":"2505.20246","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20246","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2505.20246 , year=","venue":null,"work_id":"d65dda60-b945-4980-8d05-7eedc9ecb779","year":null},"citing_paper":{"arxiv_id":"2605.07180","last_updated":"2026-05-08T03:18:40Z","snapshot_observed_at":"2026-08-17T08:11:02.869781Z","submitted_at":"2026-05-08T03:18:40Z","title":"Learning Agent Routing From Early Experience","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-11T01:15:07.381414Z"},"links":{"cited_paper":"/paper/2505.20246","citing_paper":"/paper/2605.07180"},"observation_digest":"sha256:7fadada53e94a50c85601af4db1f0387c0261f1af2cf2cd8f577bc99468b0d7b","observation_id":"ef343a86-5934-47df-9083-f81aaa8f9e99","resolution":{"observed_at":"2026-05-11T04:35:57.472272Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.20246/citation-record","integrity":"/paper/2505.20246/integrity","json":"/paper/2505.20246/citation-record.json","paper":"/paper/2505.20246"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:14.513303Z","title":"Introducing deep research","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:14.513303Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:c181094a2df25b918cc7bc01260f0ec49e1eda8bd69e544d514bb13785b9e883","observation_id":"0bc9837f-444b-466b-b9d6-b2c19eee6362","resolution":{"observed_at":"2026-08-07T14:01:14.513303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18021","last_updated":"2025-08-21T04:15:28Z","snapshot_observed_at":"2026-08-16T13:57:18.108359Z","submitted_at":"2024-04-27T22:59:17Z","title":"CRISPR-GPT for Agentic Automation of Gene-editing Experiments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18021","snapshot_observed_at":"2026-08-07T14:01:14.598967Z","title":"Crispr-gpt: An llm agent for automated design of gene-editing experiments.arXiv preprint arXiv:2404.18021, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:14.598967Z"},"links":{"cited_paper":"/paper/2404.18021","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:cd949c2bd66747069cb28f2e928f3aabd387e912f6d3a5ede5cf0715a856d131","observation_id":"ec249d02-135e-4c8a-94be-89346ceed14b","resolution":{"observed_at":"2026-08-07T14:01:14.598967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05376","last_updated":"2023-10-02T17:03:01Z","snapshot_observed_at":"2026-08-12T21:57:52.033689Z","submitted_at":"2023-04-11T17:41:13Z","title":"ChemCrow: Augmenting large-language models with chemistry tools","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05376","snapshot_observed_at":"2026-08-07T14:01:14.651275Z","title":"Chemcrow: Augmenting large-language models with chemistry tools.arXiv preprint arXiv:2304.05376, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:14.651275Z"},"links":{"cited_paper":"/paper/2304.05376","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:04dde7061f5470a5cd88259a5b28c64bc21f0143e249c64c48807dc6e31e615f","observation_id":"1fcc7f13-1055-4c6c-a93a-908e0181c6a8","resolution":{"observed_at":"2026-08-07T14:01:14.651275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:14.776357Z","title":"Gaia: a benchmark for general ai assistants","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:14.776357Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:f4e537859235ea268e391c3a2fae52fc9625f464cace1b5f6be37e1bf2da7080","observation_id":"bff022b5-fac1-43db-8ac3-5894cd89e9c3","resolution":{"observed_at":"2026-08-07T14:01:14.776357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14249","last_updated":"2026-02-20T04:23:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-24T05:27:46Z","title":"Humanity's Last Exam","version":10},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14249","snapshot_observed_at":"2026-08-07T14:01:14.869151Z","title":"Humanity’s last exam.arXiv preprint arXiv:2501.14249, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:14.869151Z"},"links":{"cited_paper":"/paper/2501.14249","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:0fe43d8a05c72f5eeea4bd37e29e50087a1de1b7127c1cb1e9c92eb4dcfc1cd5","observation_id":"dded0a9d-1a57-45b4-a60e-b403277625fa","resolution":{"observed_at":"2026-08-07T14:01:14.869151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16074","last_updated":"2025-05-18T14:13:34Z","snapshot_observed_at":"2026-08-16T11:08:50.386562Z","submitted_at":"2025-04-22T17:53:29Z","title":"PHYBench: Holistic Evaluation of Physical Perception and Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16074","snapshot_observed_at":"2026-08-07T14:01:14.955222Z","title":"Phybench: Holistic evaluation of physical perception and reasoning in large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:14.955222Z"},"links":{"cited_paper":"/paper/2504.16074","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:eff39c5576e044be889864a960dcd17fdb85df3122407e5533575b8a957ad1bc","observation_id":"137ad425-18a0-4f6a-bb26-72eb091899c9","resolution":{"observed_at":"2026-08-07T14:01:14.955222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15665","last_updated":"2025-05-11T07:56:18Z","snapshot_observed_at":"2026-08-16T13:07:33.082996Z","submitted_at":"2024-10-21T06:09:30Z","title":"Long Term Memory: The Foundation of AI Self-Evolution","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15665","snapshot_observed_at":"2026-08-07T14:01:15.055708Z","title":"Long term memory: The foundation of ai self-evolution.arXiv preprint arXiv:2410.15665, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:15.055708Z"},"links":{"cited_paper":"/paper/2410.15665","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:210380e825f0d05d8652455956c66559d41a35ed862e0d30bea56208bc0a2fef","observation_id":"052beaae-221e-4b94-9dec-c3222f1f3565","resolution":{"observed_at":"2026-08-07T14:01:15.055708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:15.144453Z","title":"Autoagent: A fully-automated and zero-code framework for llm agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:15.144453Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:69633d7038c559f894d34839464eca223f94ffca617e234ac3a6b8c16a9a8bbf","observation_id":"41fb9f62-6e0f-45c4-a92f-08e5d09b5c25","resolution":{"observed_at":"2026-08-07T14:01:15.144453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:15.217386Z","title":"Owl: Optimized workforce learning for general multi-agent assistance in real-world task automation, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:15.217386Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:eb8c798f660c393fe2030d5ab6ea134c9f0c30d986f50f5e49aea9a026dfd3da","observation_id":"2e589176-2534-4bf7-9835-e0ec3340c9c8","resolution":{"observed_at":"2026-08-07T14:01:15.217386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:15.299896Z","title":"‘smo- lagents‘: a smol library to build great agentic systems","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:15.299896Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:5cf52a3f19b58f54eaf99a91e6607e2d370c9c56dd0818cbe79f1cbd6f69dea5","observation_id":"61188ccd-d978-4c8a-91d2-bc311452395c","resolution":{"observed_at":"2026-08-07T14:01:15.299896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:15.396169Z","title":"Towards a holistic framework for multimodal llm in 3d brain ct radiology report generation.Nature Communications, 16(1):2258, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:15.396169Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:1560eb35aeafd1b2158eeacf603ae50062c5ab8a7c8fb3c373a7367c944103de","observation_id":"aed5eb13-fc05-4cc1-af14-a2aad58a202e","resolution":{"observed_at":"2026-08-07T14:01:15.396169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:15.490523Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:15.490523Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:b0dc1d928ef06796e5fbec080db4c9a942b9af9226ae1837eef46ba6bcfe6540","observation_id":"1339e873-6fd4-42f4-97bc-21df20224e20","resolution":{"observed_at":"2026-08-07T14:01:15.490523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:19.482478Z","title":"Ds-agent: Automated data science by empowering large language models with case-based reasoning, 2024","venue":null,"work_id":"6e1e4e46-205b-40b1-a129-740607426d1e","year":2024},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:15.605895Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:72b658cce0ca9036a11775e9bef67bea2c4b5ca9a5b4b68e00f8208720f7ee09","observation_id":"82eaa517-4db8-4953-9577-0fc16629916c","resolution":{"observed_at":"2026-08-07T14:01:19.523544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17227","last_updated":"2024-01-30T18:53:30Z","snapshot_observed_at":"2026-08-16T14:39:27.969478Z","submitted_at":"2023-11-28T20:59:49Z","title":"War and Peace (WarAgent): Large Language Model-based Multi-Agent Simulation of World Wars","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17227","snapshot_observed_at":"2026-08-07T14:01:15.697950Z","title":"War and peace (waragent): Large language model-based multi-agent simulation of world wars.arXiv preprint arXiv:2311.17227, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:15.697950Z"},"links":{"cited_paper":"/paper/2311.17227","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:61610dad2fe24ac1be99b7577895fef3bc9fe89ccf462121284e65bd29d3ea20","observation_id":"e5dec6d8-c7b8-411e-bc72-e774d5916df9","resolution":{"observed_at":"2026-08-07T14:01:15.697950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15532","last_updated":"2024-04-23T21:37:22Z","snapshot_observed_at":"2026-08-16T13:58:22.158305Z","submitted_at":"2024-04-23T21:37:22Z","title":"BattleAgent: Multi-modal Dynamic Emulation on Historical Battles to Complement Historical Analysis","version":1},"cited_work":{"arxiv_id":"2404.15532","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.15532","snapshot_observed_at":"2026-08-07T14:01:17.715812Z","title":"BattleAgent: Multi-modal Dynamic Emulation on Historical Battles to Complement Historical Analysis","venue":"cs.HC","work_id":"42cb5e1b-6b64-47bc-801d-f4216d043b5e","year":2024},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:15.830715Z"},"links":{"cited_paper":"/paper/2404.15532","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:d1a0f8b91b3f45c6128c6fab49dafeac3b438a1cb3abae6e0533c5ff3a0a1914","observation_id":"3f5be54a-f5d1-4f78-a67d-8f6a89c82a77","resolution":{"observed_at":"2026-08-07T14:01:17.778914Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10635","last_updated":"2024-06-28T08:24:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-20T07:01:57Z","title":"SciBench: Evaluating College-Level Scientific Problem-Solving Abilities of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10635","snapshot_observed_at":"2026-08-07T14:01:15.917999Z","title":"Scibench: Evaluating college-level scientific problem-solving abilities of large language models.arXiv preprint arXiv:2307.10635, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:15.917999Z"},"links":{"cited_paper":"/paper/2307.10635","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:05a553455a57a525ab228881e423993145f58fdc8b542aadb446f720586318b4","observation_id":"06051994-656c-4d52-82ab-590b59395c6a","resolution":{"observed_at":"2026-08-07T14:01:15.917999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10694","last_updated":"2025-03-12T05:08:02Z","snapshot_observed_at":"2026-08-16T12:50:52.991879Z","submitted_at":"2025-03-12T05:08:02Z","title":"Medical Large Language Model Benchmarks Should Prioritize Construct Validity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10694","snapshot_observed_at":"2026-08-07T14:01:16.031771Z","title":"Medical large language model benchmarks should prioritize construct validity.arXiv preprint arXiv:2503.10694, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.031771Z"},"links":{"cited_paper":"/paper/2503.10694","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:c07acb1d04786f109710917f2a251f72f795938b3798e1528ca94e4fce7e598f","observation_id":"fedc3b9d-ed3c-44e5-bcaf-a3b49948bd5c","resolution":{"observed_at":"2026-08-07T14:01:16.031771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11790","last_updated":"2026-06-23T12:36:04Z","snapshot_observed_at":"2026-08-17T13:51:01.857174Z","submitted_at":"2025-01-20T23:41:22Z","title":"Benchmarking LLMs' Mathematical Reasoning with Unseen Random Variables Questions","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11790","snapshot_observed_at":"2026-08-07T14:01:16.103626Z","title":"Benchmarking large language models via random variables.arXiv preprint arXiv:2501.11790, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.103626Z"},"links":{"cited_paper":"/paper/2501.11790","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:efb9d60f85dc5df6431bac73cdb586e09826356c7afafa3fbcca1caa204871e4","observation_id":"1f5503c1-f13c-4a3d-929b-97409504efe5","resolution":{"observed_at":"2026-08-07T14:01:16.103626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:16.177896Z","title":"Unveiling challenges for llms in enterprise data engineering.arXiv preprint arXiv:2504.10950, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.177896Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:624d49eedc1034feb111e8bef48a36b7eeaeedefdb9343965d1a94bda5545833","observation_id":"9e66040b-4ca4-4614-ab33-9b986621eaac","resolution":{"observed_at":"2026-08-07T14:01:16.177896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:19.262896Z","title":"Legalbench: A collaboratively built benchmark for measuring legal reasoning in large language models.Advances in Neural Information Processing Systems, 36:44123–44279, 2023","venue":null,"work_id":"551f9764-2d74-4989-a66a-7553fa4e723e","year":2023},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.256780Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:b3755ffb4ab839d04afc04a3efee6f7d03b89f9329c207226628f40cb719a9a5","observation_id":"6d65848d-b5a4-4051-b5cb-89c3f322c66d","resolution":{"observed_at":"2026-08-07T14:01:19.357684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10343","last_updated":"2024-08-19T18:30:18Z","snapshot_observed_at":"2026-08-16T13:25:24.761276Z","submitted_at":"2024-08-19T18:30:18Z","title":"LegalBench-RAG: A Benchmark for Retrieval-Augmented Generation in the Legal Domain","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10343","snapshot_observed_at":"2026-08-07T14:01:16.313186Z","title":"Legalbench-rag: A benchmark for retrieval-augmented generation in the legal domain.arXiv preprint arXiv:2408.10343, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.313186Z"},"links":{"cited_paper":"/paper/2408.10343","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:16d847c783da26e658fafeb66bb09be504532191be5f613fb41128c13658223d","observation_id":"18e5eb42-7114-43be-aef7-8dfc6032a0f5","resolution":{"observed_at":"2026-08-07T14:01:16.313186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-08-18T08:11:45.716032Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-07T14:01:16.367909Z","title":"Swe-bench: Can language models resolve real-world github issues?arXiv preprint arXiv:2310.06770, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.367909Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:f458ce817bbcdd6010693db814a7e58d9fc24b14741906054940ac10b3dfb7d0","observation_id":"039aba6d-1f2d-4204-9637-a783397a3340","resolution":{"observed_at":"2026-08-07T14:01:16.367909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-07T14:01:16.420696Z","title":"Evaluating large language models trained on code","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.420696Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:019bb8c29365048359bf347a450586419acd6a219220749420650876842ac527","observation_id":"b6a0f8ea-6950-42dd-a8dd-061b30a93f90","resolution":{"observed_at":"2026-08-07T14:01:16.420696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-15T17:40:38.050939Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-07T14:01:16.514024Z","title":"Program synthesis with large language models.arXiv preprint arXiv:2108.07732, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.514024Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:693e70b5b1fd1a877da5e29aa38a37e3d7c838bc101092e1d85c59f87aeb1fc8","observation_id":"314d701d-7ce3-40eb-8ee2-f4679a220815","resolution":{"observed_at":"2026-08-07T14:01:16.514024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.06146","last_updated":"2019-09-13T11:18:20Z","snapshot_observed_at":"2026-08-17T06:10:48.003173Z","submitted_at":"2019-09-13T11:18:20Z","title":"PubMedQA: A Dataset for Biomedical Research Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.06146","snapshot_observed_at":"2026-08-07T14:01:16.573108Z","title":"Pubmedqa: A dataset for biomedical research question answering.arXiv preprint arXiv:1909.06146, 2019","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.573108Z"},"links":{"cited_paper":"/paper/1909.06146","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:33e58f9583a3dd924fa5b574a537a9b96fcd1c3575864288e2d288d534856bd1","observation_id":"925a30ba-0be0-4fbe-b55a-cace4ae8cf2b","resolution":{"observed_at":"2026-08-07T14:01:16.573108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:16.633750Z","title":"Large language models encode clinical knowledge.Nature, 620(7972):172–180, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.633750Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:3706d9c4c0a5be1132ec5c60267b0fd29661a85f0527846214cf8be40e4c1ed6","observation_id":"d6e4bafd-b2c7-4a0c-921a-b57c5e5a760d","resolution":{"observed_at":"2026-08-07T14:01:16.633750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18062","last_updated":"2025-01-30T00:06:55Z","snapshot_observed_at":"2026-08-17T02:28:10.614927Z","submitted_at":"2025-01-30T00:06:55Z","title":"FinanceQA: A Benchmark for Evaluating Financial Analysis Capabilities of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18062","snapshot_observed_at":"2026-08-07T14:01:16.726294Z","title":"Financeqa: A benchmark for evaluating financial analysis capabilities of large language models.arXiv preprint arXiv:2501.18062, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.726294Z"},"links":{"cited_paper":"/paper/2501.18062","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:400c8793059bf65cce09b872e93cc743d0e3d4a432366b1c15ee6d4c99088290","observation_id":"b5cbb368-61f5-41b7-a401-2147d79c0faa","resolution":{"observed_at":"2026-08-07T14:01:16.726294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:19.117622Z","title":"Large language models’ expert-level global history knowledge benchmark (hist-llm).Advances in Neural Information Processing Systems, 37:32336–32369, 2024","venue":null,"work_id":"4b9bc3be-a1f7-417f-bbe6-d41f6358d3ef","year":2024},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.788536Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:16a95c65cafa30818d8061c2f53e4791de3d87ac9e765ff4a63b6eaf1eb47f43","observation_id":"c834b617-7112-4e77-8e6f-ff47bcf4b454","resolution":{"observed_at":"2026-08-07T14:01:19.182384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:18.813343Z","title":"Cambridge University Press, 2011","venue":null,"work_id":"a87adc8a-6be1-4543-839d-2eaa9ccbc411","year":2011},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.845207Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:4498fd72138011b28f671dcaa6bf777851bee17c5c880779ab9ee646d23059e5","observation_id":"ff58be51-f7af-49ee-9970-5e06909beadf","resolution":{"observed_at":"2026-08-07T14:01:18.974282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:18.492703Z","title":"Arnold.History: A V ery Short Introduction","venue":null,"work_id":"f271d6cb-b9b6-4ef7-84f0-d54e1ceeb377","year":2000},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.909842Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:ade860a7418fba5e736ad292c28385916a5869671cf13b82ea07d42ad0ef82b4","observation_id":"4e90302a-f514-4dd2-935c-20a9b1182850","resolution":{"observed_at":"2026-08-07T14:01:18.644096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:16.973662Z","title":"Browser use: Enable ai to control your browser, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:16.973662Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:7c5f11883219ea4e2529a27dbb76ce56a2100b035469c63c5b8be21bcdfd37db","observation_id":"748a4dff-b3c2-4703-8e6a-37b07328b955","resolution":{"observed_at":"2026-08-07T14:01:16.973662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T14:01:17.029884Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:17.029884Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:14a2afddcbb09ebb83b6f73ad4033e942f728b3d86a27b562fe8892586db72a6","observation_id":"b4dcad80-cb48-4bfc-8d71-28c1885a9624","resolution":{"observed_at":"2026-08-07T14:01:17.029884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T14:01:17.081646Z","title":"Gpt-4o system card.arXiv preprint arXiv:2410.21276, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:17.081646Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:812fddaeaccfc1a29d9db5153dd9e61ec2d630b6345b750f6c37cea7b2501fdf","observation_id":"5f67d941-efea-44e2-b30f-00b6fb77dab6","resolution":{"observed_at":"2026-08-07T14:01:17.081646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:18.192868Z","title":"Introducing openai o3 and o4-mini, 2025","venue":null,"work_id":"d01258ee-63c0-4e25-9e69-ccd3065b01bf","year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:17.144534Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:c55e79ebadfd220381ebe6fd499d832ac1a650a55017bfdbed1d42b6bcdec07f","observation_id":"ac6db4f5-6422-48e3-ac14-9448d91fbf77","resolution":{"observed_at":"2026-08-07T14:01:18.330051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:01:17.999813Z","title":"Grok 3 beta — the age of reasoning agents, 2025","venue":null,"work_id":"c35dfb4e-4769-4fc2-8580-7db82c0dddc5","year":2025},"citing_paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:17.216046Z"},"links":{"citing_paper":"/paper/2505.20246"},"observation_digest":"sha256:f6ffb6e2f9612f84942bfb3fe52d360a161e642e429c7700e204a3e8a877e5a8","observation_id":"0ba875f7-a853-4e98-a9f6-b4376d1b4d68","resolution":{"observed_at":"2026-08-07T14:01:18.055864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.20246","last_updated":"2025-06-19T15:42:45Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-16T08:37:20.448403Z","submitted_at":"2025-05-26T17:22:20Z","title":"On Path to Multimodal Historical Reasoning: HistBench and HistAgent"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":1,"verified_fuzzy":7},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 2 inbound Pith citation observations for arXiv:2505.20246."}