{"as_of":"2026-08-08T04:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:29fc40feeddb11a1269e115769e065686034d81b288f67a16b08f4673cb00eae","coverage":[{"denominator":84,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":84,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T11:35:17.065465Z","state":"measured"},{"denominator":91,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":91,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T01:02:19.508421Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-17T04:59:04.384350Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.22607","snapshot_observed_at":"2026-08-05T13:24:39.926180Z","title":"Vl-cogito: Progressive curriculum reinforcement learning for advanced multimodal reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.00676","last_updated":"2025-08-31T03:08:02Z","snapshot_observed_at":"2026-08-07T21:36:21.058533Z","submitted_at":"2025-08-31T03:08:02Z","title":"LLaVA-Critic-R1: Your Critic Model is Secretly a Strong Policy Model","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-05T13:24:39.926180Z"},"links":{"cited_paper":"/paper/2507.22607","citing_paper":"/paper/2509.00676"},"observation_digest":"sha256:2d2635a3e4a8c09571cebd05f95c981f2f9b43bb2d2da7f904d3284c22e14242","observation_id":"9c80213e-e434-4764-b9a1-dd9b0fe19e70","resolution":{"observed_at":"2026-08-05T13:24:39.926180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":"2507.22607","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.22607","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vl-cogito: Progressive curriculum reinforcement learning for advanced multimodal reasoning","venue":null,"work_id":"fc91531c-9a13-468f-873d-46824cc7fb59","year":2025},"citing_paper":{"arxiv_id":"2511.22396","last_updated":"2026-04-08T01:53:03Z","snapshot_observed_at":"2026-07-06T22:37:08.086095Z","submitted_at":"2025-11-27T12:19:37Z","title":"Asking like Socrates: Socrates helps VLMs understand remote sensing images","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-17T04:54:57.121481Z"},"links":{"cited_paper":"/paper/2507.22607","citing_paper":"/paper/2511.22396"},"observation_digest":"sha256:cd0067ee3b77f188d193ce20949532fded8b8fcdb0a5a3d540fe08c82d2be161","observation_id":"e0883df8-392f-4615-bfd3-d79f613c767b","resolution":{"observed_at":"2026-05-17T04:59:04.387061Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.22607","snapshot_observed_at":"2026-07-15T14:43:21.866055Z","title":"Vl-cogito: Progressive curricu- lum reinforcement learning for advanced multimodal reasoning.ArXiv, abs/2507.22607,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.05256","last_updated":"2026-07-02T16:41:10Z","snapshot_observed_at":"2026-08-06T04:07:42.199986Z","submitted_at":"2026-03-05T15:08:06Z","title":"Wiki-R1: Incentivizing Multimodal Reasoning for Knowledge-based VQA via Data and Sampling Curriculum","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-15T14:43:21.866055Z"},"links":{"cited_paper":"/paper/2507.22607","citing_paper":"/paper/2603.05256"},"observation_digest":"sha256:0be3594d2e724fdedc92f3bc94d75dc60197294785f4634b9f1a74c9ad22454b","observation_id":"d6797923-e4a0-476d-9806-a043a665a98b","resolution":{"observed_at":"2026-07-15T14:43:21.866055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":"2507.22607","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.22607","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vl-cogito: Progressive curriculum reinforcement learning for advanced multimodal reasoning","venue":null,"work_id":"fc91531c-9a13-468f-873d-46824cc7fb59","year":2025},"citing_paper":{"arxiv_id":"2604.10219","last_updated":"2026-05-28T16:20:33Z","snapshot_observed_at":"2026-08-01T16:49:58.717615Z","submitted_at":"2026-04-11T13:59:05Z","title":"Cognitive Pivot Points and Visual Anchoring: Unveiling and Rectifying Hallucinations in Multimodal Reasoning Models","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-10T16:03:15.222571Z"},"links":{"cited_paper":"/paper/2507.22607","citing_paper":"/paper/2604.10219"},"observation_digest":"sha256:d32346bbf7d9523cff4af7e19cd49fa051ef7aff2be1ab8b1d370d111f1c7728","observation_id":"5fcde6b4-21d1-4336-8c69-3c24414e05e9","resolution":{"observed_at":"2026-05-11T09:25:59.333264Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.22607","snapshot_observed_at":"2026-07-12T22:48:45.647588Z","title":"Vl-cogito: Progressive curriculum reinforcement learning for advanced multimodal reasoning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.10219","last_updated":"2026-05-28T16:20:33Z","snapshot_observed_at":"2026-08-01T16:49:58.717615Z","submitted_at":"2026-04-11T13:59:05Z","title":"Cognitive Pivot Points and Visual Anchoring: Unveiling and Rectifying Hallucinations in Multimodal Reasoning Models","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-07-12T22:48:45.647588Z"},"links":{"cited_paper":"/paper/2507.22607","citing_paper":"/paper/2604.10219"},"observation_digest":"sha256:d57eac66ee2685bdf8f8cd1f247261f9a77e86d1b022c9f57f1b221f46901506","observation_id":"1c4333a1-db5c-4e5d-9025-e87ed495ce24","resolution":{"observed_at":"2026-07-12T22:48:45.647588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":"2507.22607","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.22607","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vl-cogito: Progressive curriculum reinforcement learning for advanced multimodal reasoning","venue":null,"work_id":"fc91531c-9a13-468f-873d-46824cc7fb59","year":2025},"citing_paper":{"arxiv_id":"2604.20705","last_updated":"2026-04-22T15:46:42Z","snapshot_observed_at":"2026-07-06T23:07:25.185196Z","submitted_at":"2026-04-22T15:46:42Z","title":"SSL-R1: Self-Supervised Visual Reinforcement Post-Training for Multimodal Large Language Models","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-10T01:23:32.849326Z"},"links":{"cited_paper":"/paper/2507.22607","citing_paper":"/paper/2604.20705"},"observation_digest":"sha256:145aa477e96af534cf09bcfe923c6397fdc907e195179dcfe78047af9e4c7cba","observation_id":"82fd2cc8-b1da-4349-97f8-e1b19fe59164","resolution":{"observed_at":"2026-05-11T13:36:08.628351Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.22607","snapshot_observed_at":"2026-08-07T01:02:19.508421Z","title":"arXiv preprint arXiv:2507.22607","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05631","last_updated":"2026-08-06T05:58:22Z","snapshot_observed_at":"2026-08-08T04:15:16.614564Z","submitted_at":"2026-08-06T05:58:22Z","title":"ChronoVision: Temporal Reasoning via Latent State Reconstruction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T01:02:19.508421Z"},"links":{"cited_paper":"/paper/2507.22607","citing_paper":"/paper/2608.05631"},"observation_digest":"sha256:12e6a72ac6029643575f5953645ea16d2d361093bc5712cf77f2409789659786","observation_id":"e23bf316-9def-4bcc-9c1c-709b780d2bc8","resolution":{"observed_at":"2026-08-07T01:02:19.508421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.22607/citation-record","integrity":"/paper/2507.22607/integrity","json":"/paper/2507.22607/citation-record.json","paper":"/paper/2507.22607"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:10.477882Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:10.477882Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:49821f58dd45d498fbf59764115aaea7ca3ab99a9241d04645ce2cf97b32025b","observation_id":"54049b08-9391-4379-9fbf-20e52d30d42c","resolution":{"observed_at":"2026-08-06T11:35:10.477882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:10.557456Z","title":"Lawrence Zitnick, and Devi Parikh","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:10.557456Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:39c957ef98d3cef7d18cd5cff18fe99bd502cc939f73b9ae26f539bebe00cda1","observation_id":"13042578-5ec5-4f8c-944d-e5a51be5cf31","resolution":{"observed_at":"2026-08-06T11:35:10.557456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:10.638199Z","title":"Online difficulty filtering for reasoning oriented reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:10.638199Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:537a80665025527c5f5846ccd0d8a39fa7291b64053e2f6f8a83c75b877967ed","observation_id":"9f1e2dce-30c4-4672-9782-c4b5718fdb86","resolution":{"observed_at":"2026-08-06T11:35:10.638199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-06T11:35:10.725559Z","title":"Qwen2.5-vl technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:10.725559Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:7eaf97b699e80b520478e58f0f3b9698e7ef9d9f5bbbb9c19f5ad1c1c6608625","observation_id":"d7176cc5-e0ac-423c-885b-b039634e5bd4","resolution":{"observed_at":"2026-08-06T11:35:10.725559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:10.789782Z","title":"Why reasoning matters? a survey of advancements in multimodal reasoning (v1)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:10.789782Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:8919c8eb21bdaae89e366cda74af670a3a457072e35a23ebd6f4632e6b626938","observation_id":"a63931d8-ab36-4a5e-9ac2-e55b1ce0d650","resolution":{"observed_at":"2026-08-06T11:35:10.789782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-02T08:38:17.217627Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00698","snapshot_observed_at":"2026-08-06T11:35:10.875843Z","title":"Mm-iq: Benchmarking human-like abstraction and reasoning in multimodal models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:10.875843Z"},"links":{"cited_paper":"/paper/2502.00698","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:bc9f40a5033a51f6048f345e18870bccd995e36e4ace28cc50f6119b24af7f8d","observation_id":"21186ae1-501d-4c0f-aca8-09281ecef484","resolution":{"observed_at":"2026-08-06T11:35:10.875843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:10.966973Z","title":"An augmented benchmark dataset for geometric question answering through dual parallel text encoding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:10.966973Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:4719b49dba60595c4778a6849082e8719c2cda13f6ebdac8918f019f33f69d67","observation_id":"964d3a2c-fc91-4a66-8762-27fcf425b58a","resolution":{"observed_at":"2026-08-06T11:35:10.966973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16549","last_updated":"2026-04-18T11:44:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-19T11:46:19Z","title":"MathFlow: Enhancing the Perceptual Flow of MLLMs for Visual Mathematical Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16549","snapshot_observed_at":"2026-08-06T11:35:11.054606Z","title":"Mathflow: Enhancing the perceptual flow of mllms for visual mathematical problems","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:11.054606Z"},"links":{"cited_paper":"/paper/2503.16549","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:94d4508a1a4878cd3caee7b56d5709f1f7593df23cf54404dcf773d335a572d2","observation_id":"040fa2d6-44dc-4bbf-99c6-812fbc13ae04","resolution":{"observed_at":"2026-08-06T11:35:11.054606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:11.122102Z","title":"Are we on the right way for evaluating large vision-language models? In Advances in Neural Information Processing Systems, volume 37, pages 27056--27087","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:11.122102Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:5a4a8bed90e9f7255b7fbbfac04194cf7746c402b878f0979b1b8a79f967447c","observation_id":"2002dd82-d613-494e-9ef1-9728bcaa0b7a","resolution":{"observed_at":"2026-08-06T11:35:11.122102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09567","snapshot_observed_at":"2026-08-06T11:35:11.199513Z","title":"Towards reasoning era: A survey of long chain-of-thought for reasoning large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:11.199513Z"},"links":{"cited_paper":"/paper/2503.09567","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:3acf9893699adea414affd28905d6ba82077c672bbeb2dfa13ba5f9d17648d3c","observation_id":"18b332d0-2250-4ab4-8be9-6de1ac4d3f13","resolution":{"observed_at":"2026-08-06T11:35:11.199513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.16141","last_updated":"2025-06-19T08:49:13Z","snapshot_observed_at":"2026-08-07T02:35:16.534559Z","submitted_at":"2025-06-19T08:49:13Z","title":"GRPO-CARE: Consistency-Aware Reinforcement Learning for Multimodal Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.16141","snapshot_observed_at":"2026-08-06T11:35:11.261146Z","title":"Grpo-care: Consistency-aware reinforcement learning for multimodal reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:11.261146Z"},"links":{"cited_paper":"/paper/2506.16141","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:5e1e67ba9dca63fa3d710d00ea87f1c3079da7843bb06f09b24e3fe0cac2c293","observation_id":"98c1c08e-f4f6-4914-8582-a873fff20c39","resolution":{"observed_at":"2026-08-06T11:35:11.261146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-06T11:35:11.322903Z","title":"Expanding performance boundaries of open-source multimodal models with model, data, and test-time scaling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:11.322903Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:8ccb2552758d16a36931cd3993c47d669e7fbd9f22b86889ab3edaa74f88a5c5","observation_id":"741ccbd2-bd02-4fae-937f-71dfa9914d91","resolution":{"observed_at":"2026-08-06T11:35:11.322903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01456","last_updated":"2025-09-26T09:25:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-03T15:43:48Z","title":"Process Reinforcement through Implicit Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01456","snapshot_observed_at":"2026-08-06T11:35:11.396601Z","title":"Process reinforcement through implicit rewards","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:11.396601Z"},"links":{"cited_paper":"/paper/2502.01456","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:4ef6ef8e9f4fdfcbc52c8e73e6e02e8d4ade81116f4baa4e08757b262c8526bc","observation_id":"3fc652ec-75b4-4ff7-83b7-209bed591f5b","resolution":{"observed_at":"2026-08-06T11:35:11.396601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T11:35:11.478886Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:11.478886Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:27c717a12020ddd979b09fa8620b9f0e9262479b2c0c73daaf1014e9489f0bef","observation_id":"7bf97d87-532a-4cea-a4d4-6255436cb00c","resolution":{"observed_at":"2026-08-06T11:35:11.478886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17352","last_updated":"2025-11-11T08:13:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-21T17:52:43Z","title":"OpenVLThinker: Complex Vision-Language Reasoning via Iterative SFT-RL Cycles","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.17352","snapshot_observed_at":"2026-08-06T11:35:11.551556Z","title":"Openvlthinker: An early exploration to complex vision-language reasoning via iterative self-improvement","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:11.551556Z"},"links":{"cited_paper":"/paper/2503.17352","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:931709ffd980623ed8db4d5cd832d1c6420059669f85bbdc736496dcd9de6462","observation_id":"3eaa11f0-5426-4e9c-8fb3-279101544562","resolution":{"observed_at":"2026-08-06T11:35:11.551556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12272","last_updated":"2026-04-30T11:57:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-17T19:16:37Z","title":"Learning to Reason at the Frontier of Learnability","version":6},"cited_work":{"arxiv_id":"2502.12272","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.12272","snapshot_observed_at":"2026-08-06T11:35:19.254627Z","title":"Learning to Reason at the Frontier of Learnability","venue":"cs.LG","work_id":"dc38f080-bf90-4be4-994a-9744ff5a3437","year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:11.631063Z"},"links":{"cited_paper":"/paper/2502.12272","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:4e362a08055115d25532bb29db1b114c678b149c8791483d59f1c6f35ddd0c02","observation_id":"12e36423-71e4-45c6-ba43-8731c8fc571f","resolution":{"observed_at":"2026-08-06T11:35:19.260704Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:20.525082Z","title":"Training reasoning model with dynamic advantage estimation on reinforcement learning","venue":null,"work_id":"190e6516-ea6f-4891-a2cb-bc3f5a7a788d","year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:11.724692Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:86f75329ff81c5149757362cf9fa147b6c5ca5066ddcd32f2e853790fa4332c6","observation_id":"7dc2e68f-da02-49c7-99ce-323a4165054e","resolution":{"observed_at":"2026-08-06T11:35:20.532596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07062","last_updated":"2025-05-11T17:28:30Z","snapshot_observed_at":"2026-08-02T16:13:31.498470Z","submitted_at":"2025-05-11T17:28:30Z","title":"Seed1.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07062","snapshot_observed_at":"2026-08-06T11:35:11.788450Z","title":"Seed1.5-vl technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:11.788450Z"},"links":{"cited_paper":"/paper/2505.07062","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:a4a78c1564c279bf4456890e23547d6778b8d6faff69eecca952f1c676222171","observation_id":"5674d609-ce4d-4451-9ee5-3abafcfda2f3","resolution":{"observed_at":"2026-08-06T11:35:11.788450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05444","last_updated":"2025-01-09T18:55:52Z","snapshot_observed_at":"2026-08-07T17:40:59.052312Z","submitted_at":"2025-01-09T18:55:52Z","title":"Can MLLMs Reason in Multimodality? EMMA: An Enhanced MultiModal ReAsoning Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.05444","snapshot_observed_at":"2026-08-06T11:35:11.882839Z","title":"Can mllms reason in multimodality? emma: An enhanced multimodal reasoning benchmark","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:11.882839Z"},"links":{"cited_paper":"/paper/2501.05444","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:9180fbd9f795e6c3689f3278eae7b12ee099deaedcf86fb22ecffeb1b4020153","observation_id":"b7ae7c65-1c24-4eef-8281-58c46bfdc0d1","resolution":{"observed_at":"2026-08-06T11:35:11.882839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:20.497840Z","title":"Geometry3k dataset","venue":null,"work_id":"46dd0bfc-792c-48e0-bc18-96c2b6c6d034","year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:11.983279Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:cc15da093a4d87276d2e2d639b6e435333c0dcc79e4206e5c977c7070d766f38","observation_id":"070f3235-909a-44d8-9ed8-e02ccc974393","resolution":{"observed_at":"2026-08-06T11:35:20.505371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:12.073283Z","title":"Praxis-vlm: Vision-grounded decision making via text-driven reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:12.073283Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:65dbb8f97d658d3a02251360d0d95d5d4aeeb208e351d887ee94658592bb8250","observation_id":"59c27b3d-f3ee-47fc-be56-057b04bcc0d5","resolution":{"observed_at":"2026-08-06T11:35:12.073283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.35133","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:19.040126Z","title":"From pixels to insights: A survey on automatic chart understanding in the era of large foundation models","venue":null,"work_id":"67062b30-e6d0-46a4-9c51-ad68011f59f4","year":2024},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:12.174381Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:a21e09cef96d6b2b4ecbff6e3f39e37ac8e1ad35e9222d06511701bbae1b538f","observation_id":"55ae742c-f31d-4b6b-980d-f5439f9f194e","resolution":{"observed_at":"2026-08-06T11:35:19.059231Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06749","last_updated":"2026-02-28T21:10:52Z","snapshot_observed_at":"2026-08-07T18:44:26.813869Z","submitted_at":"2025-03-09T20:06:45Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06749","snapshot_observed_at":"2026-08-06T11:35:12.269450Z","title":"Vision-r1: Incentivizing reasoning capability in multimodal large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:12.269450Z"},"links":{"cited_paper":"/paper/2503.06749","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:b96f902d404f0c50ccba24516cd8f4dfdc7f241bcb56e775245f6445d4d8c81a","observation_id":"3eea1caa-c8c4-474a-adc1-dec8fc0de83b","resolution":{"observed_at":"2026-08-06T11:35:12.269450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:20.476010Z","title":"Dvqa: Understanding data visualizations via question answering","venue":null,"work_id":"3a9715c2-4117-4829-93d2-dc3a558ca20a","year":2018},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:12.368197Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:b136e3a02b8d5a6a1bb4495de6b8c26e638dc9e72642537395891eb5e06044c8","observation_id":"622e4ddf-f732-447a-a298-7713926759af","resolution":{"observed_at":"2026-08-06T11:35:20.482903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.07300","last_updated":"2018-02-22T22:50:42Z","snapshot_observed_at":"2026-08-04T06:17:25.388464Z","submitted_at":"2017-10-19T18:01:38Z","title":"FigureQA: An Annotated Figure Dataset for Visual Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.07300","snapshot_observed_at":"2026-08-06T11:35:12.431479Z","title":"Figureqa: An annotated figure dataset for visual reasoning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:12.431479Z"},"links":{"cited_paper":"/paper/1710.07300","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:fc5d2a41cf2af127fe9583ff7da0b421056daf9bd9e4e5b45f4ecf0c348b23d4","observation_id":"09ef1428-3740-44a4-a34f-bea91068c955","resolution":{"observed_at":"2026-08-06T11:35:12.431479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:20.439691Z","title":"Geomverse: A systematic evaluation of large models for geometric reasoning","venue":null,"work_id":"c5f654da-ee61-4797-88c1-13dec7fe0aed","year":2024},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:12.520852Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:4f415c099fefa02efe0f8a5a71b3638088fa980915745cf2669851cb5d9be0d9","observation_id":"b36d46da-ae96-4ffb-ad51-1332e75d90ed","resolution":{"observed_at":"2026-08-06T11:35:20.448068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1603.07396","last_updated":"2016-03-24T00:02:58Z","snapshot_observed_at":"2026-08-07T19:22:55.853637Z","submitted_at":"2016-03-24T00:02:58Z","title":"A Diagram Is Worth A Dozen Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1603.07396","snapshot_observed_at":"2026-08-06T11:35:12.624405Z","title":"A diagram is worth a dozen images","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:12.624405Z"},"links":{"cited_paper":"/paper/1603.07396","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:c7d9c24fe2cb59444d41643d2c378cec97e57698a8552bec84beeaacc419a990","observation_id":"5c6a870b-dc3e-4ef8-b08b-8261a036c6ec","resolution":{"observed_at":"2026-08-06T11:35:12.624405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:20.399396Z","title":"Are you smarter than a sixth grader? textbook question answering for multimodal machine comprehension","venue":null,"work_id":"cb32bc76-c76d-48e4-b31b-c6b0b6dd494f","year":2017},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:12.686979Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:d24aa05a142073c0c457db6e4f1cba0d10bf42cdad13c1d64a52271637dfa8ca","observation_id":"c6f4bba1-95a3-4d4f-8797-624efe99f063","resolution":{"observed_at":"2026-08-06T11:35:20.409113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07491","last_updated":"2025-06-23T13:45:50Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-10T06:48:26Z","title":"Kimi-VL Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07491","snapshot_observed_at":"2026-08-06T11:35:12.869983Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:12.869983Z"},"links":{"cited_paper":"/paper/2504.07491","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:b4ee74265a2d386e343eb9cfad16658d8426e2d72d53cf64dfe496c39e3b7ca5","observation_id":"234da070-10b5-47d5-8378-a80fbfd889af","resolution":{"observed_at":"2026-08-06T11:35:12.869983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:12.957353Z","title":"Efficient memory management for large language model serving with pagedattention","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:12.957353Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:d3bc8ad64d7ae6df96e4a6e176713b2304188119be4f1cb2267054beca1ef865","observation_id":"611e5043-5787-4838-90a4-b76be642e8ca","resolution":{"observed_at":"2026-08-06T11:35:12.957353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:20.373006Z","title":"Mmr1: Advancing the frontiers of multimodal reasoning","venue":null,"work_id":"795416e7-f27a-48b4-918b-7ebf3759b184","year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:13.052895Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:3810e30863c4ddbfc754e7b6ef10a800fbfda84be92383cc4fd4f763519f075e","observation_id":"85361d45-7f65-48c7-918a-224922dd1a17","resolution":{"observed_at":"2026-08-06T11:35:20.381844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-06T11:35:13.181649Z","title":"Llava-onevision: Easy visual task transfer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:13.181649Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:faa3560f4c87786ca2bb68f04c566cea6609f7c12b713f437506c7324c9d63e3","observation_id":"14388c57-3db9-452f-8096-6b0e5b080ed1","resolution":{"observed_at":"2026-08-06T11:35:13.181649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:20.345193Z","title":"Multimodal A r X iv: A dataset for improving scientific comprehension of large vision-language models","venue":null,"work_id":"9ee338c8-97ca-4456-9b02-6c2c23db0b85","year":2024},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:13.295210Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:f3b5e80330d355909d9460983043e69edf955953a684eaf1ffc978cf12661891","observation_id":"bd5aab48-f995-4ddb-9d12-b63be513e705","resolution":{"observed_at":"2026-08-06T11:35:20.351887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04921","last_updated":"2025-07-06T14:40:27Z","snapshot_observed_at":"2026-08-07T15:49:03.741523Z","submitted_at":"2025-05-08T03:35:23Z","title":"Perception, Reason, Think, and Plan: A Survey on Large Multimodal Reasoning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04921","snapshot_observed_at":"2026-08-06T11:35:13.370466Z","title":"Perception, reason, think, and plan: A survey on large multimodal reasoning models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:13.370466Z"},"links":{"cited_paper":"/paper/2505.04921","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:2315f41e838629262b6a0062b49a99c67eee660512b07933bb1ebc9e0dd29164","observation_id":"9d919eb4-5b50-4b83-a92f-34d7ca3bfdd8","resolution":{"observed_at":"2026-08-06T11:35:13.370466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:20.323890Z","title":null,"venue":null,"work_id":"b9648f2f-665d-475e-a761-04ef03a1a346","year":2023},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:13.449206Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:7782a9b8860ca4e96b235a6a11fa713310e1ba8d99306859da189dade3377b76","observation_id":"000d71fa-0e5f-4399-95cf-096f43ec2211","resolution":{"observed_at":"2026-08-06T11:35:20.331929Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.05358","last_updated":"2022-08-10T14:08:34Z","snapshot_observed_at":"2026-08-07T21:24:23.287695Z","submitted_at":"2022-08-10T14:08:34Z","title":"CLEVR-Math: A Dataset for Compositional Language, Visual and Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.05358","snapshot_observed_at":"2026-08-06T11:35:13.544048Z","title":"Clevr-math: A dataset for compositional language, visual and mathematical reasoning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:13.544048Z"},"links":{"cited_paper":"/paper/2208.05358","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:d1c434f74373ccc8163d1016208d1d324712487cfd7c20dce80f3b7d80cd61fb","observation_id":"a272faa2-9efb-4ed2-af7d-868140e90a10","resolution":{"observed_at":"2026-08-06T11:35:13.544048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10738","last_updated":"2024-06-16T13:26:10Z","snapshot_observed_at":"2026-07-06T17:31:13.010759Z","submitted_at":"2024-02-16T14:55:33Z","title":"Let's Learn Step by Step: Enhancing In-Context Learning Ability with Curriculum Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10738","snapshot_observed_at":"2026-08-06T11:35:13.646813Z","title":"Let's learn step by step: Enhancing in-context learning ability with curriculum learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:13.646813Z"},"links":{"cited_paper":"/paper/2402.10738","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:13e5da95fa9eeced5e0f0b9176ef84494cf27a954488d795ee70ff2b5955c40b","observation_id":"19c91810-f651-48d3-a55c-bbbe38e6c9f2","resolution":{"observed_at":"2026-08-06T11:35:13.646813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16081","last_updated":"2025-03-28T11:19:21Z","snapshot_observed_at":"2026-08-07T16:49:22.004428Z","submitted_at":"2025-03-20T12:22:18Z","title":"OThink-MR1: Stimulating multimodal generalized reasoning capabilities via dynamic reinforcement learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16081","snapshot_observed_at":"2026-08-06T11:35:13.696453Z","title":"Othink-mr1: Stimulating multimodal generalized reasoning capabilities via dynamic reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:13.696453Z"},"links":{"cited_paper":"/paper/2503.16081","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:5198a5869eaac0c8c10b744288122abf656b85711e4539f87ed5a047fa70fe1c","observation_id":"d2c639ba-576c-4690-96aa-5dc51cf17fac","resolution":{"observed_at":"2026-08-06T11:35:13.696453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:20.282472Z","title":"I nter- GPS : Interpretable geometry problem solving with formal language and symbolic reasoning","venue":null,"work_id":"aaddfc08-64cc-4f8b-87d1-16ccfb30e022","year":2021},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:13.757407Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:990958aaff10653e1ee28e8d8edb574ccfa6d680d79bc2e575c80ed73b7dcf4a","observation_id":"3e4bc9f4-029d-4427-ac69-62e27d52f372","resolution":{"observed_at":"2026-08-06T11:35:20.306826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:20.256750Z","title":"Learn to explain: Multimodal reasoning via thought chains for science question answering","venue":null,"work_id":"0ea7f1c8-f5f2-4dec-a46d-8526b90e9e1d","year":2022},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:13.842509Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:02e335c3b0ff47a583f2b32b22a7d55a096e25318413a9953b7fa2499fecf950","observation_id":"d3241435-0bc0-48cf-92ba-75d970ca1ee3","resolution":{"observed_at":"2026-08-06T11:35:20.268566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:20.231845Z","title":"Learn to explain: Multimodal reasoning via thought chains for science question answering","venue":null,"work_id":"e491275f-caae-4ea1-8e62-5ef73936b2b4","year":2022},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:13.937441Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:5a421d97a25a54a87e46263d8366cc681540eb4d17cb25718ff676764bca2fd2","observation_id":"63767ebc-06a4-452e-bba5-d17dfa11336a","resolution":{"observed_at":"2026-08-06T11:35:20.238200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:20.201305Z","title":"Dynamic prompt learning via policy gradient for semi-structured mathematical reasoning","venue":null,"work_id":"a8678c17-287c-4f17-bdf8-f228c7a02132","year":2023},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:14.041384Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:698b75e36179dcc2f670d9bee11c791cbeb64a20cd5b6ccff5afe96834920ef1","observation_id":"6e8eedeb-dd89-418b-9865-3f956500fb27","resolution":{"observed_at":"2026-08-06T11:35:20.214060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:20.169004Z","title":"Mathvista: Evaluating mathematical reasoning of foundation models in visual contexts","venue":null,"work_id":"1943c330-63a8-42a8-80ff-f8d6ce162113","year":2024},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:14.148863Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:729fdb744ab2c6db7a112f8ec200706a56cd44ae02a8644b447af57507883207","observation_id":"31fc8aab-f8ba-4cfc-b528-1a378a232163","resolution":{"observed_at":"2026-08-06T11:35:20.177552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:20.123318Z","title":"Ok-vqa: A visual question answering benchmark requiring external knowledge","venue":null,"work_id":"41641fd5-82b3-4e6e-b473-2e44c6db0132","year":2019},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:14.250362Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:15f714ab71f86b82156bd67cc0acc2a6e837168a793f13fa082fb7f3b84fe1e9","observation_id":"1f943558-6a0d-4e7a-937d-4f8a6ce7525f","resolution":{"observed_at":"2026-08-06T11:35:20.133097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:20.077709Z","title":"C hart QA : A benchmark for question answering about charts with visual and logical reasoning","venue":null,"work_id":"9f4065f8-2c83-4eea-9a1c-2a78f8eea9ab","year":2022},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:14.359394Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:3bf959e85bfbd28fb93175b3cf68c46c6c31c85b99de89d710ed27818b749fbc","observation_id":"0d402177-11f6-4b97-89de-2ddbbb68d9e9","resolution":{"observed_at":"2026-08-06T11:35:20.093124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:20.038516Z","title":null,"venue":null,"work_id":"b95c4054-020d-4c45-8d36-1c61c409002a","year":2022},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:14.417289Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:75996666ae8dc98a064023ed037cfbb8df3f8a143631cd85429e234903484a5c","observation_id":"a59bf0f9-972f-4451-ac8a-f2d9174d7803","resolution":{"observed_at":"2026-08-06T11:35:20.048947Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07365","last_updated":"2025-04-15T14:22:45Z","snapshot_observed_at":"2026-07-06T20:49:56.018809Z","submitted_at":"2025-03-10T14:23:12Z","title":"MM-Eureka: Exploring the Frontiers of Multimodal Reasoning with Rule-based Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07365","snapshot_observed_at":"2026-08-06T11:35:14.535353Z","title":"Mm-eureka: Exploring the frontiers of multimodal reasoning with rule-based reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:14.535353Z"},"links":{"cited_paper":"/paper/2503.07365","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:a1d4b5d8d3337baa37bbb8bc3bb04dc107f881320de8d592d5295f5e5d3727b0","observation_id":"dd33d92a-addf-4f10-b8af-31d4302f6014","resolution":{"observed_at":"2026-08-06T11:35:14.535353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:19.983707Z","title":"Mm-raven dataset","venue":null,"work_id":"aebe815c-5e5e-4797-ac47-e787e35ac380","year":2024},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:14.722765Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:7d8b703a28aad5109056cf008766c7271bc6029f26dc8ad017dea82cfb12fc12","observation_id":"c4da184e-e397-4b61-91b8-025377d4bb67","resolution":{"observed_at":"2026-08-06T11:35:19.991653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T11:35:14.838276Z","title":"Gpt-4o system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:14.838276Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:1ec7aee4845eff7043d14e33f66a9abbc0b6b01621a52eae6c6d3095148aa8a8","observation_id":"4b56d378-a046-44be-9a9d-881cd2bdd161","resolution":{"observed_at":"2026-08-06T11:35:14.838276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-06T11:35:14.997552Z","title":"Openai o1 system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:14.997552Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:1d34dbaebbbd235e8a49e757d4686cd21e32fe0f3f87d41c0c9c920c80fbfd5f","observation_id":"7fc021f3-3c8e-430d-b09a-ce549191cd95","resolution":{"observed_at":"2026-08-06T11:35:14.997552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:19.951994Z","title":"Introducing o3 and o4-mini, Apr 2025","venue":null,"work_id":"7cf286aa-89ff-4aa8-8ca2-ad82e245f70a","year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:15.133488Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:92a48a5d8a74ddec611872c01c4df35187900554745a2d146861065135ff6070","observation_id":"ea339a15-9d74-4cac-a8c9-e7bedbc64b86","resolution":{"observed_at":"2026-08-06T11:35:19.958427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00147","last_updated":"2024-08-30T07:37:38Z","snapshot_observed_at":"2026-07-06T19:08:26.637143Z","submitted_at":"2024-08-30T07:37:38Z","title":"MultiMath: Bridging Visual and Mathematical Reasoning for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00147","snapshot_observed_at":"2026-08-06T11:35:15.317388Z","title":"Multimath: Bridging visual and mathematical reasoning for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:15.317388Z"},"links":{"cited_paper":"/paper/2409.00147","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:fd71b15b5058e50df0b61d859def82c3a171ed6c462073d3691792197f14a028","observation_id":"aa737a75-60f6-4a30-9d21-504693cc1370","resolution":{"observed_at":"2026-08-06T11:35:15.317388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05599","last_updated":"2025-06-09T11:44:18Z","snapshot_observed_at":"2026-08-07T16:07:44.263463Z","submitted_at":"2025-04-08T01:19:20Z","title":"Skywork R1V: Pioneering Multimodal Reasoning with Chain-of-Thought","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05599","snapshot_observed_at":"2026-08-06T11:35:15.419272Z","title":"Skywork r1v: Pioneering multimodal reasoning with chain-of-thought","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:15.419272Z"},"links":{"cited_paper":"/paper/2504.05599","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:f104094f7eabded33ae70e7bc7c852368c1f827a6cd13506fc25120b749c558a","observation_id":"2515639a-a809-49df-bc4c-4378da6d87c5","resolution":{"observed_at":"2026-08-06T11:35:15.419272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07536","last_updated":"2025-03-11T03:32:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-10T17:04:14Z","title":"LMM-R1: Empowering 3B LMMs with Strong Reasoning Abilities Through Two-Stage Rule-Based RL","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07536","snapshot_observed_at":"2026-08-06T11:35:15.534226Z","title":"Lmm-r1: Empowering 3b lmms with strong reasoning abilities through two-stage rule-based rl","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:15.534226Z"},"links":{"cited_paper":"/paper/2503.07536","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:5e19d291c2fabe0948e03f28892a6031ddcd8e84091816dc96c172664eb8aea2","observation_id":"932e1a39-7e5d-4704-a762-a1fcf968494d","resolution":{"observed_at":"2026-08-06T11:35:15.534226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.02054","last_updated":"2020-05-13T06:45:15Z","snapshot_observed_at":"2026-07-06T08:27:00.558613Z","submitted_at":"2019-10-04T17:29:39Z","title":"ZeRO: Memory Optimizations Toward Training Trillion Parameter Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.02054","snapshot_observed_at":"2026-08-06T11:35:15.684127Z","title":"Zero: Memory optimizations toward training trillion parameter models","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:15.684127Z"},"links":{"cited_paper":"/paper/1910.02054","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:12bad7d2497170f9c5c4e843b41dead97094398636c743e09b82acd43f5520d0","observation_id":"22b052ad-bc5c-4820-8139-2efb1e1acaa9","resolution":{"observed_at":"2026-08-06T11:35:15.684127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:15.800325Z","title":"Lee, and Sanjeev Arora","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:15.800325Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:9ff775fb5af112f797d6437c017e49e394b5f4024681569134f97be93dd12c90","observation_id":"60b4a228-a4c9-4372-b65b-a066ffeea452","resolution":{"observed_at":"2026-08-06T11:35:15.800325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:19.915412Z","title":"No regrets: Investigating and improving regret approximations for curriculum discovery","venue":null,"work_id":"6966dde9-f662-44a1-818a-ff77ad64f942","year":2024},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:15.948744Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:05e3e3b8e4b289b320422bc49f0d2a8d8bc65b8cef3530847502aa3c5e842254","observation_id":"2323f953-4b41-44b2-86b6-0222ec7750db","resolution":{"observed_at":"2026-08-06T11:35:19.925923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T11:35:16.091115Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:16.091115Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:5d39a8a770cb3f1289b8fad53fe13779e7c96bf81f7783b17c4f8f64bb2879bc","observation_id":"1cacfd91-3944-4602-962b-b075b72b404c","resolution":{"observed_at":"2026-08-06T11:35:16.091115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:19.881745Z","title":"Solving geometry problems: Combining text and diagram interpretation","venue":null,"work_id":"5e38220b-f517-4606-a573-b142dc6de3b1","year":2015},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:16.205500Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:aa1af5f73fd840a2038b26955c4661239951fbcb47ab8d1b0e2f21778e86db35","observation_id":"d91a1e05-aef0-46a4-a680-5f1d2cbc8881","resolution":{"observed_at":"2026-08-06T11:35:19.889566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-06T11:35:16.328165Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:16.328165Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:f7f5a17a29b468c03dde3b1228760220c826f58c9cb4b41393167db70006bc10","observation_id":"a6880f23-c8ea-471f-be10-d828993de729","resolution":{"observed_at":"2026-08-06T11:35:16.328165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07615","last_updated":"2025-04-14T15:15:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-10T10:05:15Z","title":"VLM-R1: A Stable and Generalizable R1-style Large Vision-Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07615","snapshot_observed_at":"2026-08-06T11:35:16.406576Z","title":"Vlm-r1: A stable and generalizable r1-style large vision-language model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:16.406576Z"},"links":{"cited_paper":"/paper/2504.07615","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:baf64a8dd33c882d314e724fdcc8faf41f17930b4e372a1179eaf4f7647d6fc5","observation_id":"a4ccf0f3-fccc-4bd8-b1cb-9565737fa5ed","resolution":{"observed_at":"2026-08-06T11:35:16.406576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:16.522372Z","title":"Reason-rft: Reinforcement fine-tuning for visual reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:16.522372Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:40b42e6ea10117fdfb87e181e7f9c2608d5e5a1ceb611e6e4b5ca1ada04ae4b7","observation_id":"5bf90c29-76a7-4025-a890-bf8a7abcaba7","resolution":{"observed_at":"2026-08-06T11:35:16.522372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-06T11:35:16.616404Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:16.616404Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:025786fe8fbb54e7e3a07c3818b2a478bae03566d91a47311cbeacc744d71850","observation_id":"e1408843-6133-45c9-85a0-c0dea7c0eb1e","resolution":{"observed_at":"2026-08-06T11:35:16.616404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01949","last_updated":"2025-07-02T17:57:28Z","snapshot_observed_at":"2026-08-06T20:37:19.866170Z","submitted_at":"2025-07-02T17:57:28Z","title":"Kwai Keye-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01949","snapshot_observed_at":"2026-08-06T11:35:16.696524Z","title":"Kwai keye-vl technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:16.696524Z"},"links":{"cited_paper":"/paper/2507.01949","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:278247d5f63ee7077642ae8084c59a714132456020705d833aa5eca05d552958","observation_id":"1053a9d7-4770-40b1-bef5-dad6792d701f","resolution":{"observed_at":"2026-08-06T11:35:16.696524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:19.848913Z","title":"Proximal curriculum for reinforcement learning agents","venue":null,"work_id":"a9c9d355-b9f2-40be-9df6-db90195c7e5a","year":2023},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:16.847411Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:81622f0df1b176b66f48d29a7f7cce0b98400b185c36ae318d68f50d42f2ccff","observation_id":"3b7b1b29-f5c3-4b98-b8a3-4cdeeab7685f","resolution":{"observed_at":"2026-08-06T11:35:19.854685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11595","last_updated":"2025-06-13T09:03:33Z","snapshot_observed_at":"2026-08-07T14:50:56.312319Z","submitted_at":"2025-06-13T09:03:33Z","title":"EasyARC: Evaluating Vision Language Models on True Visual Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11595","snapshot_observed_at":"2026-08-06T11:35:16.862947Z","title":"Easyarc: Evaluating vision language models on true visual reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:16.862947Z"},"links":{"cited_paper":"/paper/2506.11595","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:9c31809b04b7728cb46132c2e79b72be1bee00aacc49d03091ea5828ae7299b8","observation_id":"c11ed112-8967-4abb-950b-fbefb08bb0c3","resolution":{"observed_at":"2026-08-06T11:35:16.862947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08837","last_updated":"2025-05-08T06:35:06Z","snapshot_observed_at":"2026-07-06T21:08:05.749656Z","submitted_at":"2025-04-10T17:41:56Z","title":"VL-Rethinker: Incentivizing Self-Reflection of Vision-Language Models with Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08837","snapshot_observed_at":"2026-08-06T11:35:16.911475Z","title":"Vl-rethinker: Incentivizing self-reflection of vision-language models with reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:16.911475Z"},"links":{"cited_paper":"/paper/2504.08837","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:4b4b8cbadd8ea804695e40b23e14819d1cb183de9241e024cb53454fb91c6a9e","observation_id":"2b3826cd-41d8-4fa2-9016-bc8470a27e38","resolution":{"observed_at":"2026-08-06T11:35:16.911475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:19.826583Z","title":"Measuring multimodal mathematical reasoning with MATH -vision dataset","venue":null,"work_id":"aa793af3-52d6-446d-a30b-ca414b8ba519","year":2024},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:16.924665Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:ab6902330becefd8028dd647482fec4b693d3e102df0401c591a32ee2e92a45c","observation_id":"350f6a5e-6456-4883-ae1f-e299ef20e02f","resolution":{"observed_at":"2026-08-06T11:35:19.833946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16656","last_updated":"2025-06-06T07:27:18Z","snapshot_observed_at":"2026-08-07T15:59:55.050120Z","submitted_at":"2025-04-23T12:24:10Z","title":"Skywork R1V2: Multimodal Hybrid Reinforcement Learning for Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16656","snapshot_observed_at":"2026-08-06T11:35:16.929602Z","title":"Skywork r1v2: Multimodal hybrid reinforcement learning for reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:16.929602Z"},"links":{"cited_paper":"/paper/2504.16656","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:f770fe947aac0c54e7dead730862f88254f39098a78b32eedebcc276b3d6a3ec","observation_id":"7557b985-2c27-4fa3-a62c-bb6b5b8b145b","resolution":{"observed_at":"2026-08-06T11:35:16.929602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10291","last_updated":"2025-03-13T12:03:37Z","snapshot_observed_at":"2026-08-07T21:25:47.268391Z","submitted_at":"2025-03-13T12:03:37Z","title":"VisualPRM: An Effective Process Reward Model for Multimodal Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10291","snapshot_observed_at":"2026-08-06T11:35:16.939733Z","title":"Visualprm: An effective process reward model for multimodal reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:16.939733Z"},"links":{"cited_paper":"/paper/2503.10291","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:a698e2da572a11f6d1ab11e87155b4f3b3fc5e4dbee1a1906611849cc2351f21","observation_id":"af3cbdf7-50fb-4977-a426-7995841d4cec","resolution":{"observed_at":"2026-08-06T11:35:16.939733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07934","last_updated":"2025-05-30T15:53:16Z","snapshot_observed_at":"2026-08-07T16:06:46.096701Z","submitted_at":"2025-04-10T17:49:05Z","title":"SoTA with Less: MCTS-Guided Sample Selection for Data-Efficient Visual Reasoning Self-Improvement","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07934","snapshot_observed_at":"2026-08-06T11:35:16.945350Z","title":"Sota with less: Mcts-guided sample selection for data-efficient visual reasoning self-improvement","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:16.945350Z"},"links":{"cited_paper":"/paper/2504.07934","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:1737e234142f50394cda60b83f770ff9aa2290ef53735c761f4aefcad5b915e7","observation_id":"305f264d-089d-4270-bb78-93469a4b5cfe","resolution":{"observed_at":"2026-08-06T11:35:16.945350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12605","last_updated":"2025-03-23T13:47:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-16T18:39:13Z","title":"Multimodal Chain-of-Thought Reasoning: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12605","snapshot_observed_at":"2026-08-06T11:35:16.956546Z","title":"Multimodal chain-of-thought reasoning: A comprehensive survey","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:16.956546Z"},"links":{"cited_paper":"/paper/2503.12605","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:a759a04903f0dabe7aa9c8f6cb1cbab1fd69716b055fa90e85b2ecdd9784dbfc","observation_id":"cfd4aaa5-e589-4e5d-ab01-5e612133bacc","resolution":{"observed_at":"2026-08-06T11:35:16.956546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:16.963513Z","title":"Dump: Automated distribution-level curriculum learning for rl-based llm post-training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:16.963513Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:71b940d758aa020d83d2e87cf3304c403e797107c16697e4b694323089573150","observation_id":"5e1acafe-a7de-49ba-bd59-83aa60afbf33","resolution":{"observed_at":"2026-08-06T11:35:16.963513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:16.975438Z","title":"Visionary-r1: Mitigating shortcuts in visual reasoning with reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:16.975438Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:ae6964afad26324868fdf08f6cdd0a3009f3787e3a6b0ecbc3cf5d4a2c269a4b","observation_id":"3734cd3e-b72a-4bc5-bbe5-88d40e059ab6","resolution":{"observed_at":"2026-08-06T11:35:16.975438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04973","last_updated":"2024-07-06T06:48:16Z","snapshot_observed_at":"2026-07-06T18:42:18.289966Z","submitted_at":"2024-07-06T06:48:16Z","title":"LogicVista: Multimodal LLM Logical Reasoning Benchmark in Visual Contexts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04973","snapshot_observed_at":"2026-08-06T11:35:16.981526Z","title":"Logicvista: Multimodal llm logical reasoning benchmark in visual contexts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:16.981526Z"},"links":{"cited_paper":"/paper/2407.04973","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:8a75f170be90c6d046d5ab002ed9507d19657e807fb1de2dbfbf19b191d233b3","observation_id":"b3bb9ff8-6327-49c8-8ede-e473a57a6d50","resolution":{"observed_at":"2026-08-06T11:35:16.981526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10440","last_updated":"2025-07-21T03:53:30Z","snapshot_observed_at":"2026-08-07T09:36:29.319006Z","submitted_at":"2024-11-15T18:58:31Z","title":"LLaVA-CoT: Let Vision Language Models Reason Step-by-Step","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10440","snapshot_observed_at":"2026-08-06T11:35:16.991360Z","title":"Llava-cot: Let vision language models reason step-by-step","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:16.991360Z"},"links":{"cited_paper":"/paper/2411.10440","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:888f7fe1a7abb7c9f531e78aef7415e973728072c1dc8903824def5b64139aca","observation_id":"d59c3070-7a72-4260-95e0-c1aa257b892f","resolution":{"observed_at":"2026-08-06T11:35:16.991360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10615","last_updated":"2025-03-18T08:52:34Z","snapshot_observed_at":"2026-08-07T12:50:27.666060Z","submitted_at":"2025-03-13T17:56:05Z","title":"R1-Onevision: Advancing Generalized Multimodal Reasoning through Cross-Modal Formalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10615","snapshot_observed_at":"2026-08-06T11:35:17.004209Z","title":"R1-onevision: Advancing generalized multimodal reasoning through cross-modal formalization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:17.004209Z"},"links":{"cited_paper":"/paper/2503.10615","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:b18ca237c766650e66859c81f0ca4343466b2453db410fed21c83088d411edbb","observation_id":"b170dfae-ac11-4663-a536-7f5de7a76efe","resolution":{"observed_at":"2026-08-06T11:35:17.004209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-08T00:04:35.299538Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-06T11:35:17.014678Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:17.014678Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:3d70307b8a17eba83ff75ef99d5168a425274f28f602a2ab2d0109dfa6806686","observation_id":"9e9f9bd2-7984-4338-86fd-750d3c07a831","resolution":{"observed_at":"2026-08-06T11:35:17.014678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16673","last_updated":"2025-05-22T13:39:32Z","snapshot_observed_at":"2026-08-07T14:55:04.641472Z","submitted_at":"2025-05-22T13:39:32Z","title":"R1-ShareVL: Incentivizing Reasoning Capability of Multimodal Large Language Models via Share-GRPO","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16673","snapshot_observed_at":"2026-08-06T11:35:17.026282Z","title":"R1-sharevl: Incentivizing reasoning capability of multimodal large language models via share-grpo","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:17.026282Z"},"links":{"cited_paper":"/paper/2505.16673","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:c46af74a2e30e17d03f0b8a85e57969095ec8349b004cd5cd4c9cc261dee104a","observation_id":"e0286856-2e9d-441d-a795-7a0c5e70f566","resolution":{"observed_at":"2026-08-06T11:35:17.026282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:19.805582Z","title":"Demystifying long chain-of-thought reasoning in LLM s","venue":null,"work_id":"bcb469d9-a8d1-42f8-8eee-3e4e9950806f","year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:17.037307Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:392dd73478ae3e0fc722e4ebcf0789ced8640e52a907ee1624f4dcc22c797a4a","observation_id":"b3d821ee-88a5-48d2-937f-0b350eccea1b","resolution":{"observed_at":"2026-08-06T11:35:19.812044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:19.780247Z","title":"Mmmu: A massive multi-discipline multimodal understanding and reasoning benchmark for expert agi","venue":null,"work_id":"7795bf48-7910-4a24-a9be-0d48e742c2b8","year":2024},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:17.044912Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:5dc9e7fbbc2413c99d90890c5644053ff1700107719d6b084ac16cd7d835fee2","observation_id":"d034e52f-ab65-4e9d-bfad-3c7a864347d2","resolution":{"observed_at":"2026-08-06T11:35:19.787127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12937","last_updated":"2025-08-04T04:22:09Z","snapshot_observed_at":"2026-08-06T21:34:54.534751Z","submitted_at":"2025-03-17T08:51:44Z","title":"R1-VL: Learning to Reason with Multimodal Large Language Models via Step-wise Group Relative Policy Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12937","snapshot_observed_at":"2026-08-06T11:35:17.051622Z","title":"R1-vl: Learning to reason with multimodal large language models via step-wise group relative policy optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:17.051622Z"},"links":{"cited_paper":"/paper/2503.12937","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:63f87190c74d86fd100c8fe50bc718023549b5813e64035010118d2f2fc342fa","observation_id":"ae53f1e3-2e59-4c8a-b052-dddfa5c9851e","resolution":{"observed_at":"2026-08-06T11:35:17.051622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:35:19.743976Z","title":"Mathverse: Does your multi-modal llm truly see the diagrams in visual math problems? In European Conference on Computer Vision, pages 169--186","venue":null,"work_id":"5585da9d-a185-402d-9022-e6bc1ddd6711","year":2024},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:17.058249Z"},"links":{"citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:282c34826c48ec70b1ec5479b3b1fabf6800bdffce56228c225e510b206afb6f","observation_id":"104e62ac-c4a1-4242-a08e-7463f90a3681","resolution":{"observed_at":"2026-08-06T11:35:19.754027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-06T11:35:17.065465Z","title":"Internvl3: Exploring advanced training and test-time recipes for open-source multimodal models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:17.065465Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:6382ec0bfec4c072a1a3ea933082bff57576baf96eb31d8476a1cb500958c1c1","observation_id":"c1a0e333-2281-4592-9ac8-944816137f3b","resolution":{"observed_at":"2026-08-06T11:35:17.065465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T11:35:06.948357Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning"},"reference_resolution":{"displayed":84,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":59,"verified_exact":1,"verified_fuzzy":23},"total_outbound_references":84},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 84 of 84 outbound references and 7 inbound Pith citation observations for arXiv:2507.22607."}