{"as_of":"2026-08-23T14:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6045aed252b6a1734364c06c6cc613e0412aadd073d1eed385e611ddf8ff7b2b","coverage":[{"denominator":121,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T11:55:10.588227Z","state":"measured"},{"denominator":110,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":110,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:21:12.356599Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T05:57:41.646082Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14835","snapshot_observed_at":"2026-08-10T21:57:50.703760Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03226","last_updated":"2025-02-17T06:27:16Z","snapshot_observed_at":"2026-08-18T01:41:18.623614Z","submitted_at":"2025-01-06T18:59:13Z","title":"BoostStep: Boosting mathematical capability of Large Language Models via improved single-step reasoning","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T21:57:50.703760Z"},"links":{"cited_paper":"/paper/2412.14835","citing_paper":"/paper/2501.03226"},"observation_digest":"sha256:3445d27c89300d05545f04bbe802b8a7ad76dcea5331a045c06422c54890b4c2","observation_id":"ef22bbf5-cc1d-4843-a697-055e0af9b851","resolution":{"observed_at":"2026-08-10T21:57:50.703760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"cited_work":{"arxiv_id":"2412.14835","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.14835","snapshot_observed_at":"2026-07-03T05:57:41.646082Z","title":"Progressive multimodal reasoning via active retrieval","venue":null,"work_id":"b64bcda1-d5e4-4d1e-ba07-0652e486c35a","year":2024},"citing_paper":{"arxiv_id":"2501.05366","last_updated":"2025-01-09T16:48:17Z","snapshot_observed_at":"2026-08-15T17:19:59.096854Z","submitted_at":"2025-01-09T16:48:17Z","title":"Search-o1: Agentic Search-Enhanced Large Reasoning Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T17:36:27.515468Z"},"links":{"cited_paper":"/paper/2412.14835","citing_paper":"/paper/2501.05366"},"observation_digest":"sha256:15e213fd46c2abb27744888e452d300da6a7e8d23061858dc4fe0360c9fa4af0","observation_id":"52923baa-2771-4d73-a888-f9d0c4101d97","resolution":{"observed_at":"2026-05-13T17:36:27.685222Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14835","snapshot_observed_at":"2026-08-10T20:35:59.216223Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.07861","last_updated":"2025-01-14T05:56:26Z","snapshot_observed_at":"2026-08-15T03:54:54.866456Z","submitted_at":"2025-01-14T05:56:26Z","title":"ReARTeR: Retrieval-Augmented Reasoning with Trustworthy Process Rewarding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:59.216223Z"},"links":{"cited_paper":"/paper/2412.14835","citing_paper":"/paper/2501.07861"},"observation_digest":"sha256:cfe8e5b0f07ca22c0d4254f1928c0a6917ec28e3474954ee3cc3bf2f4fba8fe4","observation_id":"17695cb5-1572-4c3c-b8d8-e4651a3af7aa","resolution":{"observed_at":"2026-08-10T20:35:59.216223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"cited_work":{"arxiv_id":"2412.14835","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.14835","snapshot_observed_at":"2026-07-03T05:57:41.646082Z","title":"Progressive multimodal reasoning via active retrieval","venue":null,"work_id":"b64bcda1-d5e4-4d1e-ba07-0652e486c35a","year":2024},"citing_paper":{"arxiv_id":"2502.13957","last_updated":"2026-05-16T17:37:22Z","snapshot_observed_at":"2026-08-16T06:21:33.550307Z","submitted_at":"2025-02-19T18:56:03Z","title":"Supervising the search process produces reliable and generalizable information-seeking agents","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-23T02:18:27.204122Z"},"links":{"cited_paper":"/paper/2412.14835","citing_paper":"/paper/2502.13957"},"observation_digest":"sha256:1146652d6d1dd63a87224b5a5c8adba484bcb851d4e8b251c936d76cb7a982ac","observation_id":"b474680a-689b-4073-a32c-f9a38d7af50b","resolution":{"observed_at":"2026-05-23T02:22:25.466774Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"cited_work":{"arxiv_id":"2412.14835","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.14835","snapshot_observed_at":"2026-07-03T05:57:41.646082Z","title":"Progressive multimodal reasoning via active retrieval","venue":null,"work_id":"b64bcda1-d5e4-4d1e-ba07-0652e486c35a","year":2024},"citing_paper":{"arxiv_id":"2503.12605","last_updated":"2025-03-23T13:47:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-16T18:39:13Z","title":"Multimodal Chain-of-Thought Reasoning: A Comprehensive Survey","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-15T17:18:52.996467Z"},"links":{"cited_paper":"/paper/2412.14835","citing_paper":"/paper/2503.12605"},"observation_digest":"sha256:a97ac9893b7bf9977ffe014455f6087c374811a5ff072c305165760a0d0499e1","observation_id":"329a97ff-e381-48f7-941f-71427abb6f5e","resolution":{"observed_at":"2026-05-15T17:18:53.759373Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14835","snapshot_observed_at":"2026-08-15T23:21:12.356599Z","title":"Progressive multimodal reasoning via active retrieval","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04921","last_updated":"2025-07-06T14:40:27Z","snapshot_observed_at":"2026-08-21T05:30:31.348509Z","submitted_at":"2025-05-08T03:35:23Z","title":"Perception, Reason, Think, and Plan: A Survey on Large Multimodal Reasoning Models","version":2},"reference_index":105,"source":"arxiv_source","source_observed_at":"2026-08-15T23:21:12.356599Z"},"links":{"cited_paper":"/paper/2412.14835","citing_paper":"/paper/2505.04921"},"observation_digest":"sha256:cc026abfb0e5b643ac17281b4523ef9fa4d8ca96310882de33cac52ae8214a69","observation_id":"e2c9ba99-bc13-4ff1-9252-1054ac3a8b3a","resolution":{"observed_at":"2026-08-15T23:21:12.356599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14835","snapshot_observed_at":"2026-08-07T15:06:03.782011Z","title":"Progressive multimodal reasoning via active retrieval","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16410","last_updated":"2025-05-22T09:00:19Z","snapshot_observed_at":"2026-08-17T08:52:56.038060Z","submitted_at":"2025-05-22T09:00:19Z","title":"Tool-Star: Empowering LLM-Brained Multi-Tool Reasoner via Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:03.782011Z"},"links":{"cited_paper":"/paper/2412.14835","citing_paper":"/paper/2505.16410"},"observation_digest":"sha256:26b7db99e8368938f0b570ed1910fc358f2ee5787370cbbe923c470f79a375b1","observation_id":"534947a6-a771-46e7-89c1-5c0506bb8b8a","resolution":{"observed_at":"2026-08-07T15:06:03.782011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14835","snapshot_observed_at":"2026-08-06T18:04:53.233561Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09374","last_updated":"2025-07-12T18:44:32Z","snapshot_observed_at":"2026-08-17T20:53:14.310586Z","submitted_at":"2025-07-12T18:44:32Z","title":"EduFlow: Advancing MLLMs' Problem-Solving Proficiency through Multi-Stage, Multi-Perspective Critique","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T18:04:53.233561Z"},"links":{"cited_paper":"/paper/2412.14835","citing_paper":"/paper/2507.09374"},"observation_digest":"sha256:f0e15238f418b6b33a2ad14f99a23cc8979bdcc2a345641c4bc7b2c025322f71","observation_id":"63fcc778-7833-4f1a-b0c6-251f65ab815f","resolution":{"observed_at":"2026-08-06T18:04:53.233561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14835","snapshot_observed_at":"2026-08-05T20:28:55.723480Z","title":"Dong et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10955","last_updated":"2025-08-14T07:25:45Z","snapshot_observed_at":"2026-08-20T01:25:29.959449Z","submitted_at":"2025-08-14T07:25:45Z","title":"Empowering Multimodal LLMs with External Tools: A Comprehensive Survey","version":1},"reference_index":142,"source":"arxiv_source","source_observed_at":"2026-08-05T20:28:55.723480Z"},"links":{"cited_paper":"/paper/2412.14835","citing_paper":"/paper/2508.10955"},"observation_digest":"sha256:21cf38d861427cb8ab5009012e664c308a62df0c77ccdd278735f2e98113c94f","observation_id":"9570173f-06d9-463c-9556-ba3b7a5d0b1d","resolution":{"observed_at":"2026-08-05T20:28:55.723480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"cited_work":{"arxiv_id":"2412.14835","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.14835","snapshot_observed_at":"2026-07-03T05:57:41.646082Z","title":"Progressive multimodal reasoning via active retrieval","venue":null,"work_id":"b64bcda1-d5e4-4d1e-ba07-0652e486c35a","year":2024},"citing_paper":{"arxiv_id":"2606.11470","last_updated":"2026-08-10T19:13:02Z","snapshot_observed_at":"2026-08-14T23:09:31.705348Z","submitted_at":"2026-06-09T21:59:37Z","title":"The Periodic Table of LLM Reasoning: A Structured Survey of Reasoning Paradigms, Methods, and Failure Modes","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-06-27T12:59:51.091008Z"},"links":{"cited_paper":"/paper/2412.14835","citing_paper":"/paper/2606.11470"},"observation_digest":"sha256:f16393024c8b2f9d1c2e3c19ea5455655297156b0d7e50cf20db6847909461df","observation_id":"02169047-8cc0-4cab-a987-b17994f2b716","resolution":{"observed_at":"2026-07-03T05:57:41.647486Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.14835/citation-record","integrity":"/paper/2412.14835/integrity","json":"/paper/2412.14835/citation-record.json","paper":"/paper/2412.14835"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.132109Z","title":"Menick, Sebastian Borgeaud, Andy Brock, Aida Nematzadeh, Sa- hand Sharifzadeh, Mikolaj Binkowski, Ricardo Barreira, Oriol Vinyals, Andrew Zisserman, and Karén Simonyan","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.132109Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:8a000bfa1578fddeb92aa2ad40d68b787fea5e853245c3d49e4bdb799b64c42e","observation_id":"0bd93d1a-ebc1-47a7-9f54-1213bf547433","resolution":{"observed_at":"2026-08-11T11:55:10.132109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.137100Z","title":"Think- ing fast and slow with deep learning and tree search","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.137100Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:759d72627128c323a3e9d11dcc929782d289a69d42c8347ace08466a92c0a8f9","observation_id":"6e7758d8-35e4-4f38-a07a-49800c62dad2","resolution":{"observed_at":"2026-08-11T11:55:10.137100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.141658Z","title":"Lawrence Zitnick, and Devi Parikh","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.141658Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:a1ed28aed1823f212542c254d0adc6e56767d9c581066302c653e47d80097482","observation_id":"81397177-ad65-4e69-af3f-0c8c9296e9f2","resolution":{"observed_at":"2026-08-11T11:55:10.141658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.146078Z","title":"Self-rag: Learning to retrieve, generate, and critique through self-reflection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.146078Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:50a66ae0941e3fa1f714a99899f22110438ea251f8ad67e8881aa68a446c235d","observation_id":"6cfa27f9-0114-4d27-98ac-3bdb8c1ab409","resolution":{"observed_at":"2026-08-11T11:55:10.146078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.150573Z","title":"Wikiextractor","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.150573Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:6c0f9ca4810364615acd2493bf9803390cc675583d1a3ebcf4607ff734e76aff","observation_id":"5ecf4f57-1679-4615-887c-4d4400ebb32f","resolution":{"observed_at":"2026-08-11T11:55:10.150573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.154541Z","title":"Qwen-vl: A versatile vision-language model for understanding, localization, text reading, and beyond, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.154541Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:1ff55919ce4b998cd035ef967612183eca8e30b119d48a778d6b8543d9414bb8","observation_id":"d187c567-3d72-4fa7-9916-2fa370275b79","resolution":{"observed_at":"2026-08-11T11:55:10.154541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.158968Z","title":"Lucas, Peter I","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.158968Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:51b9629fe1dba4c080db0a430d716e736c5e94ca31f560a5a6ad3a5e203e0abe","observation_id":"dd22628f-fe42-4e3a-ba79-545337fdfd51","resolution":{"observed_at":"2026-08-11T11:55:10.158968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-12T16:46:46.561976Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-11T11:55:10.163257Z","title":"Internlm2 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.163257Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:a08b06f0c566e18d84c4c64c010cdd2137126be5b7a4fa914519d78c5fc36d26","observation_id":"d49438d1-e4b4-4596-969b-93f9be9f3042","resolution":{"observed_at":"2026-08-11T11:55:10.163257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03553","last_updated":"2024-09-27T08:16:28Z","snapshot_observed_at":"2026-08-19T10:59:36.515237Z","submitted_at":"2024-05-06T15:20:30Z","title":"AlphaMath Almost Zero: Process Supervision without Process","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03553","snapshot_observed_at":"2026-08-11T11:55:10.168090Z","title":"Alphamath almost zero: process supervision without process","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.168090Z"},"links":{"cited_paper":"/paper/2405.03553","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:7555f7decdcc7d9feeae654f978232345123ccc8d00eb396c06650900c834379","observation_id":"a3b583b3-1fbd-4b5c-a309-34766ebf4547","resolution":{"observed_at":"2026-08-11T11:55:10.168090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10858","last_updated":"2024-09-27T08:03:07Z","snapshot_observed_at":"2026-08-19T15:14:39.153033Z","submitted_at":"2024-06-16T09:06:17Z","title":"Step-level Value Preference Optimization for Mathematical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10858","snapshot_observed_at":"2026-08-11T11:55:10.172389Z","title":"Step-level value preference optimization for mathematical reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.172389Z"},"links":{"cited_paper":"/paper/2406.10858","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:85c527f73e2d09b26ad149e6cb6b3082442266fae4847edfdda8b9f77e27ae9a","observation_id":"29b33817-5798-4864-aa5d-e1d24d5fec9b","resolution":{"observed_at":"2026-08-11T11:55:10.172389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03216","last_updated":"2025-12-12T11:26:32Z","snapshot_observed_at":"2026-08-17T15:25:09.479397Z","submitted_at":"2024-02-05T17:26:49Z","title":"M3-Embedding: Multi-Linguality, Multi-Functionality, Multi-Granularity Text Embeddings Through Self-Knowledge Distillation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03216","snapshot_observed_at":"2026-08-11T11:55:10.176645Z","title":"BGE m3-embedding: Multi- lingual, multi-functionality, multi-granularity text em- beddings through self-knowledge distillation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.176645Z"},"links":{"cited_paper":"/paper/2402.03216","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:9bbe67214e35653245f2be4caaf8cfe425a2685cb80fdb9052dfd28fc6dcc8b9","observation_id":"c49b6ebb-3e68-4a49-b55c-d008aef7c7c7","resolution":{"observed_at":"2026-08-11T11:55:10.176645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.183235Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.183235Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:dcdf1154763c82db4b6ca319ea5ed506b9c2c0a494569f6835dc71dd6badc242","observation_id":"d505be62-001c-4bf8-959a-14b485414f5b","resolution":{"observed_at":"2026-08-11T11:55:10.183235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14238","last_updated":"2024-01-15T15:23:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-21T18:59:31Z","title":"InternVL: Scaling up Vision Foundation Models and Aligning for Generic Visual-Linguistic Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14238","snapshot_observed_at":"2026-08-11T11:55:10.187069Z","title":"Internvl: Scaling up vision foundation models and aligning for generic visual-linguistic tasks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.187069Z"},"links":{"cited_paper":"/paper/2312.14238","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:4df0d8de36480b8500b858c02617743345f95830a4302bf6bff2adcf153dde3c","observation_id":"edfdd043-34ce-4a36-be69-63c05039291c","resolution":{"observed_at":"2026-08-11T11:55:10.187069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16821","last_updated":"2024-04-29T20:24:30Z","snapshot_observed_at":"2026-08-17T14:16:52.244007Z","submitted_at":"2024-04-25T17:59:19Z","title":"How Far Are We to GPT-4V? Closing the Gap to Commercial Multimodal Models with Open-Source Suites","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16821","snapshot_observed_at":"2026-08-11T11:55:10.195053Z","title":"How far are we to gpt-4v? closing the gap to commercial multimodal models with open- source suites","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.195053Z"},"links":{"cited_paper":"/paper/2404.16821","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:9b82c5228d783e19d6ce55381f783f78a85a78e28935065bb8e10aceb1dfd6fa","observation_id":"55824e92-aeb3-4bf3-8e97-f7bb37505aae","resolution":{"observed_at":"2026-08-11T11:55:10.195053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23090","last_updated":"2024-10-30T15:06:32Z","snapshot_observed_at":"2026-08-17T22:31:10.514954Z","submitted_at":"2024-10-30T15:06:32Z","title":"CORAL: Benchmarking Multi-turn Conversational Retrieval-Augmentation Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23090","snapshot_observed_at":"2026-08-11T11:55:10.199007Z","title":"CORAL: benchmarking multi-turn conversational retrieval-augmentation generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.199007Z"},"links":{"cited_paper":"/paper/2410.23090","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:2a366ffa4f91e19341d37bb59b8641def14417fde952f3a1b8b0919347be05db","observation_id":"c53f7497-25d9-40d2-ba35-c535eadb31e6","resolution":{"observed_at":"2026-08-11T11:55:10.199007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-11T11:55:10.207731Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.207731Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:da5ea240956dad1e65b598b3ff7a726c7b13706158bc173fab75f65ff24e9a9d","observation_id":"1d819781-3b40-47d5-8d77-82951d8bc5b2","resolution":{"observed_at":"2026-08-11T11:55:10.207731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.211629Z","title":"Flashattention-2: Faster attention with better paral- lelism and work partitioning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.211629Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:b55c1add08c0a8457a3fb7b2477d089087d9b2f7499b9f898817ad909da16045","observation_id":"0f4145ab-525e-498c-95e8-94cd3c7959c5","resolution":{"observed_at":"2026-08-11T11:55:10.211629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.215445Z","title":"Bridging the kb-text gap: Lever- aging structured knowledge-aware pre-training for KBQA","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.215445Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:7c6925275c7153ed4f520c7f1099ede9abdcebc1591dc67a23551cbe5ad15822","observation_id":"e797d6fc-5c06-45c9-8aa6-e72addf85fcc","resolution":{"observed_at":"2026-08-11T11:55:10.215445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13542","last_updated":"2024-07-18T09:00:23Z","snapshot_observed_at":"2026-08-20T03:31:35.446193Z","submitted_at":"2024-06-19T13:29:53Z","title":"Self-play with Execution Feedback: Improving Instruction-following Capabilities of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13542","snapshot_observed_at":"2026-08-11T11:55:10.219278Z","title":"Self-play with execution feedback: Improving instruction-following capa- bilities of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.219278Z"},"links":{"cited_paper":"/paper/2406.13542","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:57f30b453c3735b67d9dd106b29d979febb99f26e60cde1b2f0ccdb53765eca7","observation_id":"fb3c568c-c97f-4cea-bc28-af9a7b98e8c3","resolution":{"observed_at":"2026-08-11T11:55:10.219278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09584","last_updated":"2024-10-12T16:30:51Z","snapshot_observed_at":"2026-08-16T13:10:01.688423Z","submitted_at":"2024-10-12T16:30:51Z","title":"Toward General Instruction-Following Alignment for Retrieval-Augmented Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09584","snapshot_observed_at":"2026-08-11T11:55:10.223555Z","title":"Toward general instruction-following alignment for retrieval-augmented gen- eration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.223555Z"},"links":{"cited_paper":"/paper/2410.09584","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:0165da106ea525bb29cfa8d31743b2ba3f458ba03a18ddcd158b06d6adaed11e","observation_id":"a3bf0043-03a3-4ac8-81b3-fc823ab197a1","resolution":{"observed_at":"2026-08-11T11:55:10.223555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.227842Z","title":"How abilities in large language models are affected by supervised fine-tuning data composition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.227842Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:5de972897d0773e6c5ca7b352ebd529ceb765627a6667f27d6b783066941c4ce","observation_id":"5cb632d6-926a-4b92-989a-dc7729b9bd3b","resolution":{"observed_at":"2026-08-11T11:55:10.227842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18676","last_updated":"2024-07-18T08:28:09Z","snapshot_observed_at":"2026-08-16T13:39:18.905300Z","submitted_at":"2024-06-26T18:26:53Z","title":"Understand What LLM Needs: Dual Preference Alignment for Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18676","snapshot_observed_at":"2026-08-11T11:55:10.231862Z","title":"Understand what LLM needs: Dual preference alignment for retrieval-augmented generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.231862Z"},"links":{"cited_paper":"/paper/2406.18676","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:a1047a35359d9530a6850269e4742e5626e36f75595b8526c6cc65713e606106","observation_id":"423fb247-33f8-4e66-90fb-fcb726e74770","resolution":{"observed_at":"2026-08-11T11:55:10.231862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-11T11:55:10.236018Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.236018Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:a71d3c9438a9ba27bcfbc4d96bda0b31fe2517d66a8f2db330ddd87c2686a638","observation_id":"842652ce-3c9a-410b-b1a0-6a4c07087728","resolution":{"observed_at":"2026-08-11T11:55:10.236018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.240077Z","title":"A density-based algorithm for discovering clusters in large spatial databases with noise","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.240077Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:dfe2029af63dfef97cb7fcc1324f828a09b31f88ddfcda5fddb54b434d39578d","observation_id":"11336369-52cb-45b5-a27b-0e8c2e64683f","resolution":{"observed_at":"2026-08-11T11:55:10.240077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.243935Z","title":"Beam search strate- gies for neural machine translation","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.243935Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:115f20ac8316af1c5c1502d0e55edcaa9f3800409da9fecd015d7a36749d78fa","observation_id":"d5f82f02-9081-45bd-91b9-619f628b1369","resolution":{"observed_at":"2026-08-11T11:55:10.243935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.247709Z","title":"PAL: program-aided language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.247709Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:6eceb78a4c3f5475d05dc2a1e93d290b9a80ef3812e3ad795aef3502573d2f4f","observation_id":"18fbf59e-da00-499c-88cb-526df4078383","resolution":{"observed_at":"2026-08-11T11:55:10.247709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.251442Z","title":"Interpretable contrastive monte carlo tree search reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.251442Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:645c1833f598e032217416c79e26c39113e8eba7aa3525effa7c17ce2916eaef","observation_id":"4382a0cb-b7b1-4f42-bb21-7eb2b1031912","resolution":{"observed_at":"2026-08-11T11:55:10.251442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.255212Z","title":"Tora: A tool-integrated reasoning agent for mathematical problem solving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.255212Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:bd2930977229f4640b1e7630929e059753d8bbf31ef45143514ab52700f4f062","observation_id":"2595a533-83b4-463c-99d7-304f80085553","resolution":{"observed_at":"2026-08-11T11:55:10.255212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14196","last_updated":"2024-01-26T09:23:11Z","snapshot_observed_at":"2026-08-06T22:40:28.707813Z","submitted_at":"2024-01-25T14:17:53Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14196","snapshot_observed_at":"2026-08-11T11:55:10.262605Z","title":"Deepseek-coder: When the large language model meets programming–the rise of code intelligence","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.262605Z"},"links":{"cited_paper":"/paper/2401.14196","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:9121262e088618c74195e749a89a3201a060cc50f321abb884201ed2dd3f0cb6","observation_id":"984e2451-4a25-40c8-af94-d6aef5b390c0","resolution":{"observed_at":"2026-08-11T11:55:10.262605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.266883Z","title":"Self-correction is more than refinement: A learning framework for visual and language reasoning tasks, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.266883Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:052d777f5654b10210450bf1fbfe1207d3277c61d7d41c4489072e0a0c725241","observation_id":"c768e6e3-fca3-4ba7-8e01-eafea3a99557","resolution":{"observed_at":"2026-08-11T11:55:10.266883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.270771Z","title":"Measuring mathematical problem solving with the MATH dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.270771Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:7b7ad59f375e505d3e66f7956364cd8baffd821baee3452aa90caa42ebf3387a","observation_id":"5eed50e1-9bab-42a8-8ed9-03123d4ae1fb","resolution":{"observed_at":"2026-08-11T11:55:10.270771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.274560Z","title":"Unsupervised dense information retrieval with con- trastive learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.274560Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:3f9a14415a407c2340d52ae98ae6e173d59827d802a3d348adc05d8e87f505d7","observation_id":"57c2e75e-5ac9-4c86-b50d-49d8f8788e90","resolution":{"observed_at":"2026-08-11T11:55:10.274560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13576","last_updated":"2025-02-24T02:46:52Z","snapshot_observed_at":"2026-08-18T22:02:06.160357Z","submitted_at":"2024-05-22T12:12:40Z","title":"FlashRAG: A Modular Toolkit for Efficient Retrieval-Augmented Generation Research","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13576","snapshot_observed_at":"2026-08-11T11:55:10.278260Z","title":"Flashrag: A modular toolkit for ef- ficient retrieval-augmented generation research","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.278260Z"},"links":{"cited_paper":"/paper/2405.13576","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:90db046b9720fe62775ee02796bd026aa5cb45139bb43f5491d100f7f68bd022","observation_id":"79208290-ab4b-43fb-8ca8-e44938048e51","resolution":{"observed_at":"2026-08-11T11:55:10.278260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.282490Z","title":"Billion- scale similarity search with gpus","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.282490Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:5308c17fef4ab915df95429244b830e0a496f32eaf2c8fa58a7fac693c4b7d0f","observation_id":"b5dca8a3-cdd4-46e9-aef9-c0ec15600fad","resolution":{"observed_at":"2026-08-11T11:55:10.282490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.286344Z","title":"Deep visual-semantic align- ments for generating image descriptions","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.286344Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:b320162483fa756918549e17a4b28eb01f913a5d7775c2e7b1169fc8c513aa85","observation_id":"f44a4474-8925-473f-82ad-37cb7ae5673f","resolution":{"observed_at":"2026-08-11T11:55:10.286344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20204","last_updated":"2024-06-26T12:31:48Z","snapshot_observed_at":"2026-08-20T00:26:40.432825Z","submitted_at":"2024-05-30T16:07:54Z","title":"Jina CLIP: Your CLIP Model Is Also Your Text Retriever","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20204","snapshot_observed_at":"2026-08-11T11:55:10.290249Z","title":"Jina CLIP: your CLIP model is also your text retriever","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.290249Z"},"links":{"cited_paper":"/paper/2405.20204","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:df09b7ac4c157569b263634acd510cd8eb57319084faac81a7ea1ce598b7316c","observation_id":"82cd6f0a-d026-4d91-ae4d-78054994ccac","resolution":{"observed_at":"2026-08-11T11:55:10.290249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.294855Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.294855Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:22b1cea503cbe247fa1d2790dd769912eed6f24f7de332954c7ac3a0c47c0e44","observation_id":"71c8ac8c-963d-48d6-8d3c-7c37e8ecc0e1","resolution":{"observed_at":"2026-08-11T11:55:10.294855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11911","last_updated":"2024-08-29T05:14:36Z","snapshot_observed_at":"2026-08-21T07:58:38.090790Z","submitted_at":"2023-09-21T09:22:07Z","title":"InstructERC: Reforming Emotion Recognition in Conversation with Multi-task Retrieval-Augmented Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11911","snapshot_observed_at":"2026-08-11T11:55:10.299308Z","title":"Instructerc: Reforming emotion recognition in conversation with a retrieval multi-task llms framework","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.299308Z"},"links":{"cited_paper":"/paper/2309.11911","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:2b3cd81206a30d468eecba8e2ed3a53f0095afe5176b7e01c2f488367ce75732","observation_id":"6ed3c74e-c515-4243-adb1-0919e23f4274","resolution":{"observed_at":"2026-08-11T11:55:10.299308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.303614Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.303614Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:24f1ac6c8cda8575f713e42b2b9a8c3b02c0553c78064cb97b7de3f373fdab05","observation_id":"56c96af3-d9f9-4583-a99b-973532f767d1","resolution":{"observed_at":"2026-08-11T11:55:10.303614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-08-22T00:56:08.009523Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-11T11:55:10.312257Z","title":"Llava-onevision: Easy visual task transfer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.312257Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:b13a4200e7115cf3f9b06812f77662f62de4b15d9471e4814df7207c9aaf12ea","observation_id":"c27ac01b-8481-4ccd-a77b-7a572bde8ea8","resolution":{"observed_at":"2026-08-11T11:55:10.312257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04078","last_updated":"2024-07-17T13:13:05Z","snapshot_observed_at":"2026-08-16T13:36:58.831662Z","submitted_at":"2024-07-04T17:39:16Z","title":"DotaMath: Decomposition of Thought with Code Assistance and Self-correction for Mathematical Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04078","snapshot_observed_at":"2026-08-11T11:55:10.316851Z","title":"Dotamath: Decomposi- tion of thought with code assistance and self-correction for mathematical reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.316851Z"},"links":{"cited_paper":"/paper/2407.04078","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:5a1c7d70b15e3ac23cc750eede343497ee3e46eb7223d52669200c995252fc3b","observation_id":"87eb6e33-b137-4367-87fa-07f4effb1ce7","resolution":{"observed_at":"2026-08-11T11:55:10.316851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.321113Z","title":"Llava-med: Training a large language- and-vision assistant for biomedicine in one day","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.321113Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:7ec4d44498ad834f5ea9d5ca0cb3e1658b2693908b8a0b638a5d8bdfb28aae2e","observation_id":"31b64841-7302-4a77-a8b5-10ea29b903c7","resolution":{"observed_at":"2026-08-11T11:55:10.321113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.325102Z","title":"Mugglemath: Assessing the impact of query and response augmentation on math reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.325102Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:275cab28da6441b9470386cb9fc63fd11c7b051c5bfd92b407aa21ec33f4ba29","observation_id":"c16dc3f3-ea5d-4695-b4ff-0dbcf0695043","resolution":{"observed_at":"2026-08-11T11:55:10.325102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14851","last_updated":"2025-03-04T08:38:34Z","snapshot_observed_at":"2026-08-20T16:58:09.692300Z","submitted_at":"2024-04-23T09:05:37Z","title":"From Matching to Generation: A Survey on Generative Information Retrieval","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14851","snapshot_observed_at":"2026-08-11T11:55:10.329129Z","title":"From matching to generation: A survey on generative information retrieval","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.329129Z"},"links":{"cited_paper":"/paper/2404.14851","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:3bf02a06b6587c7d3f29280ceb01bd439d1dd52c200c4a289a49b18d6d4abe41","observation_id":"0f9c067a-b742-4774-99ca-0ccd949ee7f8","resolution":{"observed_at":"2026-08-11T11:55:10.329129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.333673Z","title":"Making language mod- els better reasoners with step-aware verifier","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.333673Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:9ea76887965d0aaefad6a4c665fdbdc2da55e584150be93344977b311a3d5486","observation_id":"cf6bcbce-16ab-41a2-8e44-5648443d5291","resolution":{"observed_at":"2026-08-11T11:55:10.333673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.337514Z","title":"Let’s verify step by step","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.337514Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:0262e6e568414c13ba0b6ccc6e785f7f4463cba695afd7c603a55ee6259c1972","observation_id":"3f842ed9-3ba9-490a-a0ab-2fe8f798196c","resolution":{"observed_at":"2026-08-11T11:55:10.337514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.17006","last_updated":"2024-08-30T04:39:43Z","snapshot_observed_at":"2026-08-19T08:31:40.463504Z","submitted_at":"2024-08-30T04:39:43Z","title":"Retrieval-Augmented Natural Language Reasoning for Explainable Visual Question Answering","version":1},"cited_work":{"arxiv_id":"2408.17006","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.17006","snapshot_observed_at":"2026-08-11T11:55:11.075475Z","title":"Retrieval-Augmented Natural Language Reasoning for Explainable Visual Question Answering","venue":"cs.CV","work_id":"7da47a44-ee5b-4ff9-872e-533282682f43","year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.345662Z"},"links":{"cited_paper":"/paper/2408.17006","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:b09d4fd292d939f029018ee259c12ab833cced7dcefdb296a02df8b432b2f217","observation_id":"86e14bb5-fab9-4d47-8528-d7089c133b8d","resolution":{"observed_at":"2026-08-11T11:55:11.080051Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.341518Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.341518Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:720c19db0093840d46eff4f3e038994817cab2ce3b7cc638cf0e0fcde6c1dbb3","observation_id":"37c3fa28-2557-45d9-b3ce-ca62f64de174","resolution":{"observed_at":"2026-08-11T11:55:10.341518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01714","last_updated":"2024-03-03T06:12:44Z","snapshot_observed_at":"2026-08-23T12:36:12.040229Z","submitted_at":"2023-12-04T08:07:21Z","title":"Retrieval-augmented Multi-modal Chain-of-Thoughts Reasoning for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.01714","snapshot_observed_at":"2026-08-11T11:55:10.354192Z","title":"Retrieval-augmented multi- modal chain-of-thoughts reasoning for large language mod- els","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.354192Z"},"links":{"cited_paper":"/paper/2312.01714","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:2bef6e9ad73f188c85ac0be813dbc8b27d0ed2410b166130db88f3d4ad97411e","observation_id":"e8461524-5220-4959-aa38-d39e5934099f","resolution":{"observed_at":"2026-08-11T11:55:10.354192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.350161Z","title":"Deductive verifica- tion of chain-of-thought reasoning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.350161Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:fba97615b1fae8b16d935490f8109909ad52fe1d1f8970702f260cbb32b1b477","observation_id":"62139927-9907-4d5b-aa12-bc6e8839f499","resolution":{"observed_at":"2026-08-11T11:55:10.350161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.362502Z","title":"Visual instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.362502Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:4df85b0ab86afcab9690e82d7e1f86c02032fd72fa9285151e03e2029da97979","observation_id":"1517e8f4-e747-4802-af8f-89492d9b9c49","resolution":{"observed_at":"2026-08-11T11:55:10.362502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.358323Z","title":"Llava-next: Im- proved reasoning, ocr, and world knowledge","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.358323Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:cebc7df672f34ad319ede07cb129302591a76d9e18a6d5a3a94229e1db64104f","observation_id":"1135390a-5722-4ddb-ad61-7e506df38eb6","resolution":{"observed_at":"2026-08-11T11:55:10.358323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02338","last_updated":"2024-10-04T14:59:04Z","snapshot_observed_at":"2026-08-22T02:21:50.773328Z","submitted_at":"2024-10-03T09:48:09Z","title":"How Much Can RAG Help the Reasoning of LLM?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02338","snapshot_observed_at":"2026-08-11T11:55:10.370442Z","title":"How much can RAG help the reasoning of llm? CoRR, abs/2410.02338, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.370442Z"},"links":{"cited_paper":"/paper/2410.02338","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:69d5c5e102e08aedcd0ed585b8bfc73b0fe4a3f9c31601a8f3d7462e5dd5cba6","observation_id":"7f42fa29-23d0-490a-8063-dfb72d3e17b7","resolution":{"observed_at":"2026-08-11T11:55:10.370442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15028","last_updated":"2024-04-02T17:51:49Z","snapshot_observed_at":"2026-08-18T16:01:11.519656Z","submitted_at":"2023-09-26T15:57:57Z","title":"Don't throw away your value model! Generating more preferable text with Value-Guided Monte-Carlo Tree Search decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15028","snapshot_observed_at":"2026-08-11T11:55:10.366504Z","title":"Mak- ing PPO even better: Value-guided monte-carlo tree search decoding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.366504Z"},"links":{"cited_paper":"/paper/2309.15028","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:858ae6d04b3275d1aab19575016eee976d476bff80250252a942b1af7c8e70e3","observation_id":"49de24c8-1485-48b7-b945-1a76601e37e9","resolution":{"observed_at":"2026-08-11T11:55:10.366504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.378516Z","title":"Mathvista: Evaluating mathemat- ical reasoning of foundation models in visual contexts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.378516Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:8f828c49fad42804a39d4bf7315ba81dc0db1f6765ba540f227813a088e3c8ca","observation_id":"dc0b7782-dda3-4dea-b762-31133d7dc95c","resolution":{"observed_at":"2026-08-11T11:55:10.378516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.374649Z","title":"#instag: Instruction tagging for analyzing supervised fine-tuning of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.374649Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:7839140dcac75af2040a25747551c7b998d436853cf9882ac7caaef182b0410d","observation_id":"c7c8afde-c27a-4063-b1eb-2904cce19785","resolution":{"observed_at":"2026-08-11T11:55:10.374649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.386082Z","title":"Chatkbqa: A generate-then-retrieve framework for knowledge base ques- tion answering with fine-tuned large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.386082Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:122121a04eea84a4bd8ead023d6426bb5dd7caa97d095651b0f464c4d0428776","observation_id":"5566f89f-1cfc-4ab3-96ff-3634002f5793","resolution":{"observed_at":"2026-08-11T11:55:10.386082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09583","last_updated":"2025-06-04T08:58:56Z","snapshot_observed_at":"2026-08-02T06:48:43.121988Z","submitted_at":"2023-08-18T14:23:21Z","title":"WizardMath: Empowering Mathematical Reasoning for Large Language Models via Reinforced Evol-Instruct","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09583","snapshot_observed_at":"2026-08-11T11:55:10.382219Z","title":"Wizardmath: Empowering mathematical reasoning for large language models via re- inforced evol-instruct","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.382219Z"},"links":{"cited_paper":"/paper/2308.09583","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:2fb1497bc576d4b5fbad75a483df4b0a7088cc0dbcd9cab88c53f2973ba1bd79","observation_id":"f18a58bd-44c3-4360-8d13-a82dba6e140a","resolution":{"observed_at":"2026-08-11T11:55:10.382219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10080","last_updated":"2023-10-16T05:21:50Z","snapshot_observed_at":"2026-08-16T14:51:54.405312Z","submitted_at":"2023-10-16T05:21:50Z","title":"Let's reward step by step: Step-Level reward model as the Navigators for Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10080","snapshot_observed_at":"2026-08-11T11:55:10.400980Z","title":"Let’s reward step by step: Step-level reward model as the navigators for reasoning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.400980Z"},"links":{"cited_paper":"/paper/2310.10080","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:756fc098ed5bf8c86999a8d2c53e2633e0e0a2e69f7f413414dca362cba63e5a","observation_id":"e83ed7b3-980e-4c39-93f3-5c666e486c39","resolution":{"observed_at":"2026-08-11T11:55:10.400980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06592","last_updated":"2024-12-11T22:59:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-05T19:25:40Z","title":"Improve Mathematical Reasoning in Language Models by Automated Process Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06592","snapshot_observed_at":"2026-08-11T11:55:10.397486Z","title":"Improve mathematical reason- ing in language models by automated process supervision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.397486Z"},"links":{"cited_paper":"/paper/2406.06592","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:51777523f75d1ee77d56509ac2bb46896bb5c358e98cc45583c6584aedbefae1","observation_id":"a043b842-8c33-4a46-98d3-f46e226d39aa","resolution":{"observed_at":"2026-08-11T11:55:10.397486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.408801Z","title":"Selfcheck: Using llms to zero-shot check their own step-by-step reason- ing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.408801Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:4ec5c6753d75932ce662f66ba0c9a1455be2b5a9a013118c116fed9870b241c6","observation_id":"852db633-b6fb-4160-b3e9-79835f4f5eb7","resolution":{"observed_at":"2026-08-11T11:55:10.408801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.404827Z","title":"Self-refine: Iterative refinement with self-feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.404827Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:2bfeaabf292ec32a0f0878fe40fec001b3f24f3beb72e6d9267a0a6dcf018f8c","observation_id":"800b2282-8fe6-4d9b-a1a5-d6451c95439a","resolution":{"observed_at":"2026-08-11T11:55:10.404827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T11:55:10.420377Z","title":"GPT-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.420377Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:277ef8d36b08ab00a511cc3e9d2762364a53ac65277e658ffe42c03014aa4d3c","observation_id":"721a63e7-b15f-42e1-8d80-36f8369de662","resolution":{"observed_at":"2026-08-11T11:55:10.420377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.412831Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.412831Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:1a7f0bbea23b5003abfe39bde4149d97c33953d3646f942664bff58ea9415762","observation_id":"d63adea0-61dc-4fd9-918e-f7cd635ac196","resolution":{"observed_at":"2026-08-11T11:55:10.412831Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.433000Z","title":"Gpt-4v (ision) system card","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.433000Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:2a4367cc1feee3036a562d443628b27c101230b3a042c89753d708508894be84","observation_id":"5b683b5c-d304-46a2-a609-b6e0f35b1d3a","resolution":{"observed_at":"2026-08-11T11:55:10.433000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.424155Z","title":"Hello gpt-4o, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.424155Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:5cf1867619b7471a6117ce0741075d6e1dcfcf7a08741d6bfd74d2ca224061b9","observation_id":"fc0e58ee-2a95-47e2-a0a2-a924fdc3de80","resolution":{"observed_at":"2026-08-11T11:55:10.424155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.428436Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.428436Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:e10267f6eaa58c1ab6e889e553006cb994e1c8161ee9a1338979667c6fe224ae","observation_id":"53a54aaf-8f29-496b-b31d-0049c0eb4b63","resolution":{"observed_at":"2026-08-11T11:55:10.428436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:11.728855Z","title":"Puterman","venue":null,"work_id":"0d29ee25-f3bc-45c1-be2a-8f601548c648","year":1990},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.444784Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:1d812a2c05b34e098f48dcd597fd482637971e9baa74fdd14cbf02a8eb02ce1f","observation_id":"22f6d455-5767-4f3c-8a51-80ea740fcd6b","resolution":{"observed_at":"2026-08-11T11:55:11.733306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.440605Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.440605Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:c8f3dc336bcdd791ae114bb68b1ac7f6cb6d07ad41280f0c40da3c8b3778d722","observation_id":"564fcccc-b024-4d15-b752-37065ecf48bf","resolution":{"observed_at":"2026-08-11T11:55:10.440605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:10.456510Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.456510Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:ac9c9ca17cfb2f1d7add6e8147555d269ad8698af65ee31ff98c61b13eb1254e","observation_id":"f303c277-6fe0-4ebe-b707-b7c8dfa4aad0","resolution":{"observed_at":"2026-08-11T11:55:10.456510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01284","last_updated":"2024-07-01T13:39:08Z","snapshot_observed_at":"2026-08-12T06:11:26.786967Z","submitted_at":"2024-07-01T13:39:08Z","title":"We-Math: Does Your Large Multimodal Model Achieve Human-like Mathematical Reasoning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01284","snapshot_observed_at":"2026-08-11T11:55:10.448541Z","title":"We-math: Does your large multimodal model achieve human-like mathematical reasoning? CoRR, abs/2407.01284, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.448541Z"},"links":{"cited_paper":"/paper/2407.01284","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:33eddb1016fc89e4cd9e006a9ac8e779c0f34ac6063132b759b337856a794bc6","observation_id":"0274fb63-2f1a-469a-b6af-85c69378fd57","resolution":{"observed_at":"2026-08-11T11:55:10.448541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:11.707938Z","title":"Making visual sense of oracle bones for you and me","venue":null,"work_id":"bdc011e8-1bcc-4b1c-897b-7375126c7af9","year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.452715Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:868ea3214897846bbf53595513c2d4043d2bf0bfb842c93d8bd7206d2668a927","observation_id":"01421fb6-8c30-4580-a343-e8bd9400b414","resolution":{"observed_at":"2026-08-11T11:55:11.719472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:11.666868Z","title":"Alignment in multimodal interaction: An integrative frame- work","venue":null,"work_id":"3898c2b3-e2cc-4828-88e2-a5ac7af34cb1","year":2020},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.468028Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:8fca51ae6c0e9e6d08844707aefa56272aab47060442ad989e0a14f75fc73696","observation_id":"ee6c3771-71d5-40ee-bb82-db88d7c33948","resolution":{"observed_at":"2026-08-11T11:55:11.671907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:11.680301Z","title":"Manning, Stefano Ermon, and Chelsea Finn","venue":null,"work_id":"9eac6cd2-5506-43a3-a709-bd814a77620c","year":2023},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.464543Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:bf9e5a631e38c1c35c71b8f10193396c56aa09afe2474cd18afc864a3b29fa5d","observation_id":"ff6927ee-95ca-46d9-b89f-ed3b271906fc","resolution":{"observed_at":"2026-08-11T11:55:11.685120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:11.620095Z","title":"Preventing translation quality deterioration caused by beam search decoding in neural machine translation using statistical machine translation","venue":null,"work_id":"0f5c636c-0d42-4ad5-9e9c-38f0645934f1","year":2021},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.479649Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:4c283dcaaa04d25ce680d53076f8ff5ff0294e90583c3806d31fa1228c5a0f72","observation_id":"f8da9cb5-3554-4689-bd2a-6a9713d4de05","resolution":{"observed_at":"2026-08-11T11:55:11.625208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:11.653290Z","title":"Deepspeed: System optimizations enable train- ing deep learning models with over 100 billion parameters","venue":null,"work_id":"2f3aba4e-3b88-4783-9e8f-64c4b48d3aab","year":null},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.471735Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:9999f736a9d50e5ab574c0d8ec8e35c2c703714ebc9815912259d077e6ae78a3","observation_id":"bd3d9433-7319-4cf3-9454-dd2003436067","resolution":{"observed_at":"2026-08-11T11:55:11.658387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:11.636391Z","title":"Beyond chinchilla-optimal: Accounting for in- ference in language model scaling laws","venue":null,"work_id":"d0aedff1-2ed0-4a32-b900-9fdb708c3266","year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.475809Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:d09a305889a956822f122515fd62e6865af30c1710bb0bea4d747c6b3895e7c1","observation_id":"713110fe-f420-488c-adc9-447d43681078","resolution":{"observed_at":"2026-08-11T11:55:11.644748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08146","last_updated":"2024-10-10T17:31:23Z","snapshot_observed_at":"2026-08-13T20:49:59.656333Z","submitted_at":"2024-10-10T17:31:23Z","title":"Rewarding Progress: Scaling Automated Process Verifiers for LLM Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08146","snapshot_observed_at":"2026-08-11T11:55:10.491759Z","title":"Rewarding progress: Scaling automated process verifiers for llm reasoning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.491759Z"},"links":{"cited_paper":"/paper/2410.08146","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:4612ec1e4019bf94403436c96c4f6411ecc644ded5a59f3d1a0808d0040e55e4","observation_id":"f35fdca4-065c-4bde-beb7-d4c6c24899cb","resolution":{"observed_at":"2026-08-11T11:55:10.491759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-11T11:55:10.483517Z","title":"Proximal policy optimization algo- rithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.483517Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:8fc11c433ec5cd806002ac292907d911c210d808c8c51b78505c336d7292abe5","observation_id":"f1fd56b2-2966-436e-89af-681147815741","resolution":{"observed_at":"2026-08-11T11:55:10.483517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:11.605530Z","title":"Rewarding progress: Scaling automated process verifiers for llm reasoning","venue":null,"work_id":"f5274c0a-7ff6-4eae-8d9f-f06ab79d9bb8","year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.487486Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:899bf1d0a3d2ae3af2f0b2b0fca06752a2d440158aa43fd150d752123f1a560e","observation_id":"d5421a56-4e6c-4558-83bf-be6b7075d411","resolution":{"observed_at":"2026-08-11T11:55:11.610554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-11T11:55:10.503414Z","title":"Scaling LLM test-time compute optimally can be more effec- tive than scaling model parameters","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.503414Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:fb4447bc7ef9ff8e4a2e9d21daffbed971f8481095a66dcddb5a7a5a140df956","observation_id":"d1fb638b-8eb2-4075-a3ee-44a129f1391a","resolution":{"observed_at":"2026-08-11T11:55:10.503414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-11T11:55:10.499929Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.499929Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:8757c9df4a928ef4306b7c996d53670ccb78f8e15d618c192d052c7eb8d5326d","observation_id":"77626caf-2af0-4636-bc1a-8c10cfaf367e","resolution":{"observed_at":"2026-08-11T11:55:10.499929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:11.591647Z","title":"Kakade, and Matthias W","venue":null,"work_id":"ebb18e59-5e41-45b2-9970-88de65290f67","year":2012},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.515318Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:d28a9d39cafbeab4ea914ed5c525f39d4aed2fb79bbbc5bb17627e9d820ff387","observation_id":"d89bcc94-792d-4e9c-a100-6c5abe73b3f0","resolution":{"observed_at":"2026-08-11T11:55:11.596908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07594","last_updated":"2025-01-08T02:33:37Z","snapshot_observed_at":"2026-08-16T14:44:25.026948Z","submitted_at":"2023-11-10T09:51:24Z","title":"How to Bridge the Gap between Modalities: Survey on Multimodal Large Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07594","snapshot_observed_at":"2026-08-11T11:55:10.507395Z","title":"How to bridge the gap between modalities: A comprehensive survey on multimodal large language model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.507395Z"},"links":{"cited_paper":"/paper/2311.07594","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:8689d824ae3356d5cc16dd141b21515aa5e7f7386571817445ac1b3ba5e5bf3e","observation_id":"e744b109-3895-424b-a6b8-9b98f9fea23a","resolution":{"observed_at":"2026-08-11T11:55:10.507395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08587","last_updated":"2025-02-28T15:16:04Z","snapshot_observed_at":"2026-08-16T13:43:35.911754Z","submitted_at":"2024-06-12T18:47:28Z","title":"CS-Bench: A Comprehensive Benchmark for Large Language Models towards Computer Science Mastery","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08587","snapshot_observed_at":"2026-08-11T11:55:10.511458Z","title":"Cs-bench: A comprehen- sive benchmark for large language models towards computer science mastery","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.511458Z"},"links":{"cited_paper":"/paper/2406.08587","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:0bf5c2c9abf1d9b264999debbca3d73a56de149359026151cfdb8fe1f25031fa","observation_id":"9bb38e38-f0ba-4874-ba52-3a2ae7177061","resolution":{"observed_at":"2026-08-11T11:55:10.511458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20834","last_updated":"2024-05-31T14:23:49Z","snapshot_observed_at":"2026-08-16T16:06:34.889343Z","submitted_at":"2024-05-31T14:23:49Z","title":"Retrieval Meets Reasoning: Even High-school Textbook Knowledge Benefits Multimodal Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20834","snapshot_observed_at":"2026-08-11T11:55:10.527099Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.527099Z"},"links":{"cited_paper":"/paper/2405.20834","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:b8395acb04b10c5992bfc6f1bd0429ee8fb86dcc30205d972ce6bd77fc03ccec","observation_id":"4f687944-e211-4f18-a770-fd41e1552934","resolution":{"observed_at":"2026-08-11T11:55:10.527099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:11.574741Z","title":"Beats: Optimizing llm mathematical capabilities with backverify and adaptive disambiguate based efficient tree search","venue":null,"work_id":"95f2d608-f69a-4fee-933b-58d9060f91b8","year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.519007Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:30b517c54bbfa784af054e41cd8eb15694f82fabc7ae6d167fbed1de3cd560fa","observation_id":"add60a98-f20b-4111-9651-4d1da20a7f40","resolution":{"observed_at":"2026-08-11T11:55:11.580494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09472","last_updated":"2024-12-10T08:54:09Z","snapshot_observed_at":"2026-08-16T14:09:47.245140Z","submitted_at":"2024-03-14T15:12:38Z","title":"Easy-to-Hard Generalization: Scalable Alignment Beyond Human Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09472","snapshot_observed_at":"2026-08-11T11:55:10.523196Z","title":"Easy-to-hard generalization: Scalable alignment beyond human supervi- sion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.523196Z"},"links":{"cited_paper":"/paper/2403.09472","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:459ac0f95d42de76982cbc59fb840171b3274bf95c47fae5d4fb28e9fe6d5aec","observation_id":"e894a2fb-97ec-4661-b51c-a5b02b68a3c6","resolution":{"observed_at":"2026-08-11T11:55:10.523196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:11.550897Z","title":"Htmlrag: Html is bet- ter than plain text for modeling retrieved knowledge in rag systems, 2024","venue":null,"work_id":"ff5bc783-01cf-4fa5-9159-af3135fbcd81","year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.531023Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:8fcba53432f52193b76e1257c5bef9aa88fb560aea695aa3c4affb824cb8f073","observation_id":"5e87a313-29c3-422b-9590-7e85a51b091b","resolution":{"observed_at":"2026-08-11T11:55:11.558482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:11.537537Z","title":"Qwen2.5: A party of foundation models, 2024","venue":null,"work_id":"f733b109-e8ee-4950-a1af-77d8df22e2fd","year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.535085Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:09bebfa18adb9cdd75f1b2e83019b277cdd1e08236c2ebe8c27af4e398b4c040","observation_id":"8e99b3d6-8063-43e7-8cc9-b862653d16b0","resolution":{"observed_at":"2026-08-11T11:55:11.542178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.14275","last_updated":"2022-11-25T18:19:44Z","snapshot_observed_at":"2026-08-01T02:16:43.109337Z","submitted_at":"2022-11-25T18:19:44Z","title":"Solving math word problems with process- and outcome-based feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.14275","snapshot_observed_at":"2026-08-11T11:55:10.551060Z","title":"Fran- cis Song, Noah Y","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.551060Z"},"links":{"cited_paper":"/paper/2211.14275","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:a491becc846a148a7167e1869c57a4af06bfce7f404359aea3e784642059b1db","observation_id":"8bfab0d6-2b7c-4cd7-a473-41b76d0b8c08","resolution":{"observed_at":"2026-08-11T11:55:10.551060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12253","last_updated":"2024-12-10T18:19:29Z","snapshot_observed_at":"2026-08-21T12:06:38.208032Z","submitted_at":"2024-04-18T15:21:34Z","title":"Toward Self-Improvement of LLMs via Imagination, Searching, and Criticizing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12253","snapshot_observed_at":"2026-08-11T11:55:10.543361Z","title":"Toward self-improvement of llms via imagination, searching, and criticizing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.543361Z"},"links":{"cited_paper":"/paper/2404.12253","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:5d744184311c2585040750f53f469751f50ad3f39db5ff65b626e58270d16b7b","observation_id":"52457f07-81fa-430e-9472-b5e542fd6608","resolution":{"observed_at":"2026-08-11T11:55:10.543361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:11.524503Z","title":"Solving math word problems with process- and outcome-based feedback, 2022","venue":null,"work_id":"b9be016f-dbba-4a8c-b9a1-b3bb37830d92","year":2022},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.547087Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:8c12deebeef8882f92cb5b40a875c2e68c1b8a27b758c865e3f8857df7a51b09","observation_id":"61cd0843-986c-4d35-81fb-81ebeedcd5f9","resolution":{"observed_at":"2026-08-11T11:55:11.529441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","snapshot_observed_at":"2026-08-21T15:59:57.611635Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14283","snapshot_observed_at":"2026-08-11T11:55:10.555629Z","title":"Q*: Improving multi- step reasoning for llms with deliberative planning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":105,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.555629Z"},"links":{"cited_paper":"/paper/2406.14283","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:9b097377d4eedc26c90e639f6c96139281418d9c9754d035c13d4cb8877a4676","observation_id":"c92ef4ab-f18b-40b1-b926-a11d4760b93d","resolution":{"observed_at":"2026-08-11T11:55:10.555629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14804","last_updated":"2024-02-22T18:56:38Z","snapshot_observed_at":"2026-08-13T01:56:18.092262Z","submitted_at":"2024-02-22T18:56:38Z","title":"Measuring Multimodal Mathematical Reasoning with MATH-Vision Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14804","snapshot_observed_at":"2026-08-11T11:55:10.560027Z","title":"Measuring multimodal math- ematical reasoning with math-vision dataset","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":106,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.560027Z"},"links":{"cited_paper":"/paper/2402.14804","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:d100f9c80a73535eaaa755417f0fb0a911fb71d35c62419eec7027e17a8e75a1","observation_id":"4f058515-8dea-405d-8786-b8c6012bdd76","resolution":{"observed_at":"2026-08-11T11:55:10.560027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:11.492822Z","title":"Le, Ed H","venue":null,"work_id":"64f6a90e-5f36-4a14-8ce6-5a6bb3fe87fe","year":2023},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.576185Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:4987b8d55d89138a946ba44aad63419a2d0fbd35e836c775b2f6ab769507a7eb","observation_id":"74bdc275-6125-4223-bd52-123a7302e6a1","resolution":{"observed_at":"2026-08-11T11:55:11.497845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-11T11:55:10.568299Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":108,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.568299Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:d354daaffec6b7c0d60dcdee708c8fc08fc95794a153ebc06db518631ace60e5","observation_id":"e3cb1fb4-fd44-46e4-af5a-8cc254de473e","resolution":{"observed_at":"2026-08-11T11:55:10.568299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:11.506939Z","title":"Math- shepherd: Verify and reinforce llms step-by-step without human annotations","venue":null,"work_id":"2b4506a9-7d88-4cf3-8bc4-294e58bcea89","year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":109,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.572283Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:493c8baa98e7990b2dc9f0c5d66ae39dbf289dcc4468d98d04ff249280f09e42","observation_id":"24cd192b-10b2-4eae-bd25-aae9eba63a44","resolution":{"observed_at":"2026-08-11T11:55:11.512331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:11.462995Z","title":"Chi, Quoc V","venue":null,"work_id":"89253638-3fc2-4c58-8d51-4f88cd0a2b3a","year":2022},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":110,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.588227Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:16b93f03e74e9cadaa7e7544d9ff8de06ec39b902b7232531e077e2b4ec2210e","observation_id":"487b7ae4-3d24-40bd-8c61-c392f46cc050","resolution":{"observed_at":"2026-08-11T11:55:11.469620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:55:11.478339Z","title":"Towards self- improvement of llms via mcts: Leveraging stepwise knowl- edge with curriculum preference learning","venue":null,"work_id":"f845342a-8e4a-4a0a-9f10-504e20d98334","year":2024},"citing_paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval","version":1},"reference_index":111,"source":"pdf_text","source_observed_at":"2026-08-11T11:55:10.580128Z"},"links":{"citing_paper":"/paper/2412.14835"},"observation_digest":"sha256:fecd63ca5564639f8a40e7a61ab07bedc33f3fe415adf00b9dd49dd4a83851ff","observation_id":"a4150d83-4d47-4a43-ba27-976792713780","resolution":{"observed_at":"2026-08-11T11:55:11.483489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.14835","last_updated":"2024-12-19T13:25:39Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T00:18:31.213910Z","submitted_at":"2024-12-19T13:25:39Z","title":"Progressive Multimodal Reasoning via Active Retrieval"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":81,"verified_exact":1,"verified_fuzzy":17},"total_outbound_references":121},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 100 of 121 outbound references and 10 inbound Pith citation observations for arXiv:2412.14835."}