{"as_of":"2026-08-10T07:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:467dcae69dc07b34a4b3ff749ef76e90c3d9a0d914efe80d2831cb325aef723a","coverage":[{"denominator":76,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":76,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:35:48.656605Z","state":"measured"},{"denominator":80,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":80,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T11:47:27.883967Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-16T16:28:05.708078Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"cited_work":{"arxiv_id":"2506.02096","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.02096","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Synthrl: Scalingvisualreasoning with verifiable data synthesis","venue":null,"work_id":"aea5fc8f-926d-441d-8cfe-5278f7ce1832","year":2025},"citing_paper":{"arxiv_id":"2601.04809","last_updated":"2026-05-04T13:55:24Z","snapshot_observed_at":"2026-07-06T22:41:05.793337Z","submitted_at":"2026-01-08T10:42:04Z","title":"SCALER:Synthetic Scalable Adaptive Learning Environment for Reasoning","version":5},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-16T16:24:04.132572Z"},"links":{"cited_paper":"/paper/2506.02096","citing_paper":"/paper/2601.04809"},"observation_digest":"sha256:e3a5bdec2f7e06217d3d99b29aa2b36d8239b8b1c9c54ac8f876ccfe3dbbeca1","observation_id":"3e6ecd59-cd6a-4989-995d-28ea935f3b0c","resolution":{"observed_at":"2026-05-16T16:28:05.710085Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"cited_work":{"arxiv_id":"2506.02096","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.02096","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Synthrl: Scalingvisualreasoning with verifiable data synthesis","venue":null,"work_id":"aea5fc8f-926d-441d-8cfe-5278f7ce1832","year":2025},"citing_paper":{"arxiv_id":"2605.00371","last_updated":"2026-05-01T03:21:57Z","snapshot_observed_at":"2026-07-06T23:13:47.082550Z","submitted_at":"2026-05-01T03:21:57Z","title":"GaMMA: Towards Joint Global-Temporal Music Understanding in Large Multimodal Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-09T19:12:28.290483Z"},"links":{"cited_paper":"/paper/2506.02096","citing_paper":"/paper/2605.00371"},"observation_digest":"sha256:40698efc703ba298414c486f191c0cd74445b198f5e657f681c615cf495da020","observation_id":"a65cee66-e7eb-462a-a1eb-7559aa9d25da","resolution":{"observed_at":"2026-05-11T15:47:17.195171Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"cited_work":{"arxiv_id":"2506.02096","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.02096","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Synthrl: Scalingvisualreasoning with verifiable data synthesis","venue":null,"work_id":"aea5fc8f-926d-441d-8cfe-5278f7ce1832","year":2025},"citing_paper":{"arxiv_id":"2605.02913","last_updated":"2026-04-08T00:53:29Z","snapshot_observed_at":"2026-07-06T23:15:55.848885Z","submitted_at":"2026-04-08T00:53:29Z","title":"Generate, Filter, Control, Replay: A Comprehensive Survey of Rollout Strategies for LLM Reinforcement Learning","version":1},"reference_index":142,"source":"arxiv_source","source_observed_at":"2026-05-10T19:15:27.406778Z"},"links":{"cited_paper":"/paper/2506.02096","citing_paper":"/paper/2605.02913"},"observation_digest":"sha256:d04cf9522d271b261d9cf77104e3dfbe44c6f1c801343b5ff97d01a52b990f4e","observation_id":"6f0c6a90-80f6-4654-a8b5-00947dc73b4e","resolution":{"observed_at":"2026-05-10T23:15:49.390205Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.02096","snapshot_observed_at":"2026-08-01T11:47:27.883967Z","title":"SynthRL: Scaling visual reasoning with verifiable data synthesis.arXiv preprint arXiv:2506.02096, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19790","last_updated":"2026-07-22T06:17:57Z","snapshot_observed_at":"2026-08-06T04:55:07.559078Z","submitted_at":"2026-07-22T06:17:57Z","title":"Trace: A Taxonomy-Guided Environment for Multidomain Visual Reasoning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-01T11:47:27.883967Z"},"links":{"cited_paper":"/paper/2506.02096","citing_paper":"/paper/2607.19790"},"observation_digest":"sha256:73dee4cdb2d0622c4992857882959012b3e571391777e5eea375f3b67479a0cc","observation_id":"d658f3bf-0e1d-456a-b0ec-cbf42d7578a0","resolution":{"observed_at":"2026-08-01T11:47:27.883967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.02096/citation-record","integrity":"/paper/2506.02096/integrity","json":"/paper/2506.02096/citation-record.json","paper":"/paper/2506.02096"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:41.936149Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:41.936149Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:839d98de8954aca4b4bd8f5d4b2edabbf88126d0ede3097e8bec293104f6ff01","observation_id":"c6187cca-91c3-42de-8472-71c141a21060","resolution":{"observed_at":"2026-08-07T11:35:41.936149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:41.977593Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:41.977593Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:542c22f2bfc0237785a63135ea8c4ceac25c30e25424aee3273b9071cc55d0a0","observation_id":"38def998-febb-43b9-8077-7ad487d07064","resolution":{"observed_at":"2026-08-07T11:35:41.977593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.314361Z","title":null,"venue":null,"work_id":"4d6e9e30-b8c7-4ca0-9ef9-cb75c2576c58","year":null},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:42.069904Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:36f607be4694e83e9d83efdbf3733b83d5d759ff1dac2b1599158d68708088b1","observation_id":"06d238d5-bf6a-4608-a501-72ae996bdf8b","resolution":{"observed_at":"2026-08-07T11:35:51.317857Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21318","last_updated":"2025-04-30T05:05:09Z","snapshot_observed_at":"2026-08-08T08:43:53.657438Z","submitted_at":"2025-04-30T05:05:09Z","title":"Phi-4-reasoning Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21318","snapshot_observed_at":"2026-08-07T11:35:42.180779Z","title":"Phi-4-reasoning technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:42.180779Z"},"links":{"cited_paper":"/paper/2504.21318","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:96a241ba0715ce5b269a42bacec61b6e4e95eab48cded28e4bad0568d2b46ad5","observation_id":"7833eefd-422b-4e3d-87df-b4bf2f8ceafd","resolution":{"observed_at":"2026-08-07T11:35:42.180779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:42.252690Z","title":"Flamingo: a visual language model for few-shot learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:42.252690Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:e408a87936ae50152f98c9fa9d7db6daba586d7b8f605bda1b6b6a6384e65868","observation_id":"7ec446e8-42d1-46ff-8d8c-e3df9114472a","resolution":{"observed_at":"2026-08-07T11:35:42.252690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.295549Z","title":"Claude 3.7 sonnet","venue":null,"work_id":"8d36a17c-c927-4d06-8ac7-e0a9611d1a73","year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:42.377165Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:78173915252c975dc7f468bb20c2ae700c1b169bdd1ab3f8c6a9af4afe25a9f7","observation_id":"a53a029f-0c75-451b-9f4b-32788710af0b","resolution":{"observed_at":"2026-08-07T11:35:51.299837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T11:35:42.453668Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:42.453668Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:80625c2075e45b7571e09e0f84803b19d79eed2899b33a5efbced2c23347da2f","observation_id":"24131374-3806-4923-a548-3d4b089c74d4","resolution":{"observed_at":"2026-08-07T11:35:42.453668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16640","last_updated":"2024-07-18T09:01:52Z","snapshot_observed_at":"2026-07-06T18:20:09.790181Z","submitted_at":"2024-05-26T17:31:21Z","title":"A Survey of Multimodal Large Language Model from A Data-centric Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16640","snapshot_observed_at":"2026-08-07T11:35:42.563075Z","title":"A survey of multimodal large language model from a data-centric perspective","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:42.563075Z"},"links":{"cited_paper":"/paper/2405.16640","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:11fe56dbf18d75d72fb640dd67b8db0a8b8ca213ade593ce766ef424ecb34bd2","observation_id":"2ee0dfea-5b0c-4812-9145-a8dba7689ad3","resolution":{"observed_at":"2026-08-07T11:35:42.563075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:42.642750Z","title":"Rank analysis of incomplete block designs: I","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:42.642750Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:43076f92034f96c53b430875da6727b2db54fb1fddeaf497b11d499262a12bab","observation_id":"c22a30bb-9997-482b-914d-9d91e59d0a67","resolution":{"observed_at":"2026-08-07T11:35:42.642750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.274272Z","title":"Sft or rl? an early investigation into training r1-like reasoning large vision-language models","venue":null,"work_id":"1999612b-864b-4ecc-98ed-0062f0bbc67b","year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:42.716759Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:642366d59ab503e0c1053973ff12d984330db395f16ffb499cbb1a66f7b7e7a0","observation_id":"4bc9233c-8ceb-46ba-8cda-9ae023448025","resolution":{"observed_at":"2026-08-07T11:35:51.279167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.249355Z","title":"R1-v: Reinforcing super generalization ability in vision-language models with less than \\ 3","venue":null,"work_id":"48370c2e-0a82-42fb-8ca6-0c83429bf21e","year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:42.780766Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:7b142c1978b6563ee47fb56802c708c750513647c74d6f9eff923f274fc3785c","observation_id":"ae23a085-3fb9-4407-85a0-a934e545035e","resolution":{"observed_at":"2026-08-07T11:35:51.265716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-07T11:35:42.887829Z","title":"Expanding performance boundaries of open-source multimodal models with model, data, and test-time scaling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:42.887829Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:48ee9456846090216fbc55426719b64f48118028e204aa1d3ef7fbe94f68cdb6","observation_id":"34d88ea0-756b-4e34-ae93-b1fdaa4ed3b3","resolution":{"observed_at":"2026-08-07T11:35:42.887829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:42.993498Z","title":"Chatbot arena: An open platform for evaluating llms by human preference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:42.993498Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:9900160d5f03f616cdafd1b6d974966b3f479a484078bdc72ab9f81272d094f3","observation_id":"6e2a18e6-d565-4ba6-8acc-37d8924be19d","resolution":{"observed_at":"2026-08-07T11:35:42.993498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13173","last_updated":"2024-07-16T05:56:05Z","snapshot_observed_at":"2026-08-07T10:42:50.913308Z","submitted_at":"2024-06-19T03:07:33Z","title":"Biomedical Visual Instruction Tuning with Clinician Preference Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13173","snapshot_observed_at":"2026-08-07T11:35:43.091029Z","title":"Biomedical visual instruction tuning with clinician preference alignment, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:43.091029Z"},"links":{"cited_paper":"/paper/2406.13173","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:8ae0313a0159fdccafe85c0249fc5adb871b67b649253e2247bb44488cfb0559","observation_id":"f831c92e-44e1-4380-a5fa-01ac675de575","resolution":{"observed_at":"2026-08-07T11:35:43.091029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17885","last_updated":"2025-05-30T03:15:49Z","snapshot_observed_at":"2026-08-08T12:24:50.229970Z","submitted_at":"2024-10-23T13:58:39Z","title":"Theorem-Validated Reverse Chain-of-Thought Problem Generation for Geometric Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17885","snapshot_observed_at":"2026-08-07T11:35:43.221451Z","title":"R-cot: Reverse chain-of-thought problem generation for geometric reasoning in large multimodal models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:43.221451Z"},"links":{"cited_paper":"/paper/2410.17885","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:11bae027a6645229d2f6dd550a3a3fa73197dc869b43a3c28aa459d7d0be98a3","observation_id":"79b86d50-af30-48d0-9a86-9aad26524e5f","resolution":{"observed_at":"2026-08-07T11:35:43.221451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17352","last_updated":"2025-11-11T08:13:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-21T17:52:43Z","title":"OpenVLThinker: Complex Vision-Language Reasoning via Iterative SFT-RL Cycles","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.17352","snapshot_observed_at":"2026-08-07T11:35:43.330907Z","title":"Openvlthinker: An early exploration to complex vision-language reasoning via iterative self-improvement, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:43.330907Z"},"links":{"cited_paper":"/paper/2503.17352","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:184d698203286b4b72ba5e7e5ee28b52f2401c356f0dbf7c9cf107f3d2ab4c29","observation_id":"ed87c766-a6dc-47cb-b5cb-d88aa5d72c1b","resolution":{"observed_at":"2026-08-07T11:35:43.330907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05492","last_updated":"2024-06-07T15:51:08Z","snapshot_observed_at":"2026-07-06T16:29:39.982733Z","submitted_at":"2023-10-09T07:56:16Z","title":"How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05492","snapshot_observed_at":"2026-08-07T11:35:43.435240Z","title":"How abilities in large language models are affected by supervised fine-tuning data composition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:43.435240Z"},"links":{"cited_paper":"/paper/2310.05492","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:3c81e9e3dc0b62c0cc801fb91e98f36e3b5340fc33ce5f04611ed6b927691c72","observation_id":"0fe375c1-c7b5-484e-a161-31bcf0593054","resolution":{"observed_at":"2026-08-07T11:35:43.435240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01487","last_updated":"2025-02-05T09:06:42Z","snapshot_observed_at":"2026-08-05T04:29:05.120535Z","submitted_at":"2023-11-02T15:36:12Z","title":"What Makes for Good Visual Instructions? Synthesizing Complex Visual Reasoning Instructions for Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01487","snapshot_observed_at":"2026-08-07T11:35:43.517803Z","title":"What makes for good visual instructions? synthesizing complex visual reasoning instructions for visual instruction tuning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:43.517803Z"},"links":{"cited_paper":"/paper/2311.01487","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:2171c3d4877ef46b460b5ba78da72878ec06d9912d5b51150bbf9362a43aba42","observation_id":"4a671aa5-87d9-4126-adb4-878b76fe86be","resolution":{"observed_at":"2026-08-07T11:35:43.517803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.208528Z","title":"Solution of a ranking problem from binary comparisons","venue":null,"work_id":"dd363d8c-7404-4ee6-8860-fd46ab7adfe6","year":1957},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:43.625141Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:525ebeac12b8441e903ada2ed688fccd2c25ff7cd351fdfaaf68a9a6f9505393","observation_id":"cf0d2612-911f-4d4c-8209-2f33268bd7b4","resolution":{"observed_at":"2026-08-07T11:35:51.222509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T11:35:43.700132Z","title":"Gemini: a family of highly capable multimodal models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:43.700132Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:f32c3508f2048156bcf98ec90073bea76628b181a64f0e609cdd262ce897393c","observation_id":"650db308-b638-43f2-8d5d-8f3faaed4d97","resolution":{"observed_at":"2026-08-07T11:35:43.700132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T11:35:43.799581Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:43.799581Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:2100d3a5738fe14393bdd23bb604e3791cdf1219d4e0464422f31f9066d17a2d","observation_id":"ade4cd4c-d9ac-44d1-b66e-6ac3a711b9fc","resolution":{"observed_at":"2026-08-07T11:35:43.799581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10915","last_updated":"2026-05-01T02:07:46Z","snapshot_observed_at":"2026-07-06T19:51:28.494860Z","submitted_at":"2024-11-16T23:54:53Z","title":"Bias in Large Language Models: Origin, Evaluation, and Mitigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10915","snapshot_observed_at":"2026-08-07T11:35:43.887636Z","title":"Bias in large language models: Origin, evaluation, and mitigation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:43.887636Z"},"links":{"cited_paper":"/paper/2411.10915","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:b1fff213ba5837c70798e7b93a2723c578b342e7a8175c9350e762f14d2a66dc","observation_id":"cabece22-cff2-4f1c-a96d-23c6efec9290","resolution":{"observed_at":"2026-08-07T11:35:43.887636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.165994Z","title":"Minimax-optimal inference from partial rankings","venue":null,"work_id":"0d011fd6-ab09-4fb3-8886-e4274edb1573","year":2014},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:43.964365Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:1e78d4425d4672dadeb99dc698f1f226b7a389fc14365b3a07f56debcec9801d","observation_id":"2db529f2-7589-4f6d-8e6e-4ba01d9e4c8e","resolution":{"observed_at":"2026-08-07T11:35:51.184027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08803","last_updated":"2025-05-10T22:42:29Z","snapshot_observed_at":"2026-08-07T15:48:11.044824Z","submitted_at":"2025-05-10T22:42:29Z","title":"Multi-modal Synthetic Data Training and Model Collapse: Insights from VLMs and Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.08803","snapshot_observed_at":"2026-08-07T11:35:44.065746Z","title":"Multi-modal synthetic data training and model collapse: Insights from vlms and diffusion models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:44.065746Z"},"links":{"cited_paper":"/paper/2505.08803","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:33f02b2d3813bc9d00aec532d64144278dc772fb5e8d9903134cd8c44fd83891","observation_id":"d12f446e-6c97-4192-adc2-204a1ced061a","resolution":{"observed_at":"2026-08-07T11:35:44.065746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06749","last_updated":"2026-02-28T21:10:52Z","snapshot_observed_at":"2026-08-07T18:44:26.813869Z","submitted_at":"2025-03-09T20:06:45Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06749","snapshot_observed_at":"2026-08-07T11:35:44.142868Z","title":"Vision-r1: Incentivizing reasoning capability in multimodal large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:44.142868Z"},"links":{"cited_paper":"/paper/2503.06749","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:ad735c2cdeb5c91f8429728eeb8999e6adb890921817737a436797f857a57b83","observation_id":"bf28e19e-dbe7-4195-b91d-6aed987e7192","resolution":{"observed_at":"2026-08-07T11:35:44.142868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T11:35:44.242073Z","title":"Gpt-4o system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:44.242073Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:bebdd000a2e205f4ca3f79bf860b5ca29e15f70dace7a82c7e8a0333acc9e574","observation_id":"9ced2ab8-255d-4e7b-b565-a4a820322838","resolution":{"observed_at":"2026-08-07T11:35:44.242073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-07T11:35:44.334513Z","title":"Kimi k1.5: Scaling reinforcement learning with llms, 2025 a","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:44.334513Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:00c46d9fdbbabdbfcde5db84ef5c290bb5d890d23a472b2c00f8653f22392144","observation_id":"747b2510-aa0e-4a01-90fb-270351244842","resolution":{"observed_at":"2026-08-07T11:35:44.334513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07491","last_updated":"2025-06-23T13:45:50Z","snapshot_observed_at":"2026-08-09T09:48:45.884814Z","submitted_at":"2025-04-10T06:48:26Z","title":"Kimi-VL Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07491","snapshot_observed_at":"2026-08-07T11:35:44.484635Z","title":"Kimi-VL technical report, 2025 b","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:44.484635Z"},"links":{"cited_paper":"/paper/2504.07491","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:7548312af3501abdcaae748ea606d75b0174b887eee5a838ed3e3b58535f732b","observation_id":"3de466ae-685b-4712-88f4-c2efc8f103b9","resolution":{"observed_at":"2026-08-07T11:35:44.484635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:44.582583Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:44.582583Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:91260bb2953b63d29456ae6e9a34bb6b7e2a8b5521e955038483697c82537358","observation_id":"2fe1a62f-9281-4da4-a788-23b525eb8245","resolution":{"observed_at":"2026-08-07T11:35:44.582583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:50.997286Z","title":"Llava-next: Stronger llms supercharge multimodal capabilities in the wild, May 2024 a","venue":null,"work_id":"994fb2c1-e6c3-4cdf-9d1f-8c1c7d57e87c","year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:44.677095Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:1ab9d6a7fe22ecb0b64b57af4d20da4b7a0f692d8a9726df117273b84f382c02","observation_id":"31790328-208c-4bb1-bc96-3a1ef76af91e","resolution":{"observed_at":"2026-08-07T11:35:51.110422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-07T11:35:44.784577Z","title":"Llava-onevision: Easy visual task transfer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:44.784577Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:7fd2f1d524b76554df074e168c57f062a654c6888a58416b513557b03db15d41","observation_id":"2904867b-9b6f-4ca3-bad0-3d10a0cf5cb8","resolution":{"observed_at":"2026-08-07T11:35:44.784577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00890","last_updated":"2023-06-01T16:50:07Z","snapshot_observed_at":"2026-08-09T05:23:28.778360Z","submitted_at":"2023-06-01T16:50:07Z","title":"LLaVA-Med: Training a Large Language-and-Vision Assistant for Biomedicine in One Day","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00890","snapshot_observed_at":"2026-08-07T11:35:44.888994Z","title":"Llava-med: Training a large language-and-vision assistant for biomedicine in one day, 2023 a","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:44.888994Z"},"links":{"cited_paper":"/paper/2306.00890","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:39bad3f8bc75f1b8b374a39ffdcc46391370bb44670b5081d02cb2eb6d6812a4","observation_id":"de55569d-7d7e-4a88-ad9a-826430d87c03","resolution":{"observed_at":"2026-08-07T11:35:44.888994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08637","last_updated":"2024-06-03T13:39:40Z","snapshot_observed_at":"2026-08-04T05:50:27.406421Z","submitted_at":"2023-09-14T15:34:01Z","title":"TextBind: Multi-turn Interleaved Multimodal Instruction-following in the Wild","version":5},"cited_work":{"arxiv_id":"2309.08637","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.08637","snapshot_observed_at":"2026-08-07T11:35:49.270728Z","title":"TextBind: Multi-turn Interleaved Multimodal Instruction-following in the Wild","venue":"cs.CL","work_id":"30fee7d7-fd8c-497c-bf8c-ba5d81929e6a","year":2023},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:44.982415Z"},"links":{"cited_paper":"/paper/2309.08637","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:0146db50fdeeda0f50f8399991b95411364c4c8c4f7ba8d676f4fd9664d45d52","observation_id":"c716f602-1221-444c-be7a-4a8e7e71a635","resolution":{"observed_at":"2026-08-07T11:35:49.344555Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:50.755751Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":"94c07037-b23c-42cd-a85e-095f45fbf338","year":2023},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:45.070368Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:4ee8ddeb81a1266ac3c36bbc33be451be6f3bb1ea78fdae927716a33ced5660f","observation_id":"d630d306-b179-4a60-87f6-a214bf57fa22","resolution":{"observed_at":"2026-08-07T11:35:50.850222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09421","last_updated":"2024-10-18T07:10:38Z","snapshot_observed_at":"2026-08-09T21:21:53.791829Z","submitted_at":"2024-10-12T07:56:47Z","title":"VLFeedback: A Large-Scale AI Feedback Dataset for Large Vision-Language Models Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09421","snapshot_observed_at":"2026-08-07T11:35:45.165859Z","title":"Vlfeedback: A large-scale ai feedback dataset for large vision-language models alignment, 2024 d","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:45.165859Z"},"links":{"cited_paper":"/paper/2410.09421","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:68509ba2bc8c8e34c2dccfb4aecb3345ee0de2cfb40e0131150dd56242b371ab","observation_id":"4d4f2cae-024a-4301-a03e-21f1e91b980c","resolution":{"observed_at":"2026-08-07T11:35:45.165859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04419","last_updated":"2026-05-05T09:32:34Z","snapshot_observed_at":"2026-07-30T08:21:36.901013Z","submitted_at":"2025-02-06T15:20:58Z","title":"Understanding and Mitigating Bias Inheritance in LLM-based Data Augmentation on Downstream Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04419","snapshot_observed_at":"2026-08-07T11:35:45.240736Z","title":"Understanding and mitigating the bias inheritance in llm-based data augmentation on downstream tasks","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:45.240736Z"},"links":{"cited_paper":"/paper/2502.04419","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:7f7ed5d4552d2347f4e4cfa58823de2bfc9a56b9e36955bd281a29c100564a8f","observation_id":"510385c4-0869-43fe-8cbe-16199966b57d","resolution":{"observed_at":"2026-08-07T11:35:45.240736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11886","last_updated":"2025-02-17T15:13:29Z","snapshot_observed_at":"2026-08-09T18:20:45.496028Z","submitted_at":"2025-02-17T15:13:29Z","title":"LIMR: Less is More for RL Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11886","snapshot_observed_at":"2026-08-07T11:35:45.327280Z","title":"Limr: Less is more for rl scaling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:45.327280Z"},"links":{"cited_paper":"/paper/2502.11886","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:e998e5a8aea64bae99fe13ad716c09f33624126f610d5719581f5eff554f49a6","observation_id":"07818c08-b6e3-4a43-a672-edcb1c042834","resolution":{"observed_at":"2026-08-07T11:35:45.327280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:45.411544Z","title":"Visual instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:45.411544Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:06427ae0401249cca68cb53c4dd2680147687c51457b711c2089b7c51bdd6f6c","observation_id":"3df0d95d-4c97-4b3c-8f89-3abd196b1efb","resolution":{"observed_at":"2026-08-07T11:35:45.411544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:45.521488Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:45.521488Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:9fb4f11f526adaa0b0533c64eb36acd173b191e0063b4a27e6c6a0d8ca628978","observation_id":"7d6f53ad-e226-4e89-b634-75ebfba23a18","resolution":{"observed_at":"2026-08-07T11:35:45.521488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.15685","last_updated":"2024-04-16T02:46:58Z","snapshot_observed_at":"2026-07-06T17:07:52.197869Z","submitted_at":"2023-12-25T10:29:28Z","title":"What Makes Good Data for Alignment? A Comprehensive Study of Automatic Data Selection in Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.15685","snapshot_observed_at":"2026-08-07T11:35:45.608563Z","title":"What makes good data for alignment? a comprehensive study of automatic data selection in instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:45.608563Z"},"links":{"cited_paper":"/paper/2312.15685","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:1a7675e7757cf1bb6b7dcf1147eefb9e1e6b1625f6dbdc179ea99fc261260dfe","observation_id":"3b0fda6a-c7cb-4060-b6c8-0f1741d7eeed","resolution":{"observed_at":"2026-08-07T11:35:45.608563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:45.685696Z","title":"Noisyrollout: Reinforcing visual reasoning with data augmentation, 2025 a","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:45.685696Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:987f2c1266b9587d1eaaca766740fc5cac54b436b0ffa003c29c964991a425f6","observation_id":"ba55c519-66f4-4e96-97b8-e4c7746baaf7","resolution":{"observed_at":"2026-08-07T11:35:45.685696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20783","last_updated":"2025-10-06T09:30:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T17:59:14Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20783","snapshot_observed_at":"2026-08-07T11:35:45.759914Z","title":"Understanding r1-zero-like training: A critical perspective","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:45.759914Z"},"links":{"cited_paper":"/paper/2503.20783","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:a22675b6dbbb8f43352b6b797a76436b5d7dcbbc74b0697b7b0efe723ecc4c00","observation_id":"e4243140-b616-4e12-a060-0fa3aa769e70","resolution":{"observed_at":"2026-08-07T11:35:45.759914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02255","last_updated":"2024-01-21T03:47:06Z","snapshot_observed_at":"2026-07-06T16:27:15.027202Z","submitted_at":"2023-10-03T17:57:24Z","title":"MathVista: Evaluating Mathematical Reasoning of Foundation Models in Visual Contexts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02255","snapshot_observed_at":"2026-08-07T11:35:45.833316Z","title":"Mathvista: Evaluating mathematical reasoning of foundation models in visual contexts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:45.833316Z"},"links":{"cited_paper":"/paper/2310.02255","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:28f06619e4fae6a2fcd2d6c71d64abf1a253984c0c6a0ef0f574077ae723a78f","observation_id":"4a7f63d8-7d4d-4f82-a545-29279563f384","resolution":{"observed_at":"2026-08-07T11:35:45.833316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:45.903561Z","title":"Ursa: Understanding and verifying chain-of-thought reasoning in multimodal mathematics","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:45.903561Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:c8509e7fee2510a5296e16f4dcf8ea8e5bf235b480a354f34da827087e56116c","observation_id":"a0e4118f-8b8e-4283-ba7e-455aca61d857","resolution":{"observed_at":"2026-08-07T11:35:45.903561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05840","last_updated":"2024-12-31T14:46:47Z","snapshot_observed_at":"2026-08-01T14:19:40.337956Z","submitted_at":"2024-09-09T17:44:00Z","title":"MMEvol: Empowering Multimodal Large Language Models with Evol-Instruct","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05840","snapshot_observed_at":"2026-08-07T11:35:45.979553Z","title":"Mmevol: Empowering multimodal large language models with evol-instruct","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:45.979553Z"},"links":{"cited_paper":"/paper/2409.05840","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:0a658fafc32ac8f49d273631fb36f76bad707d0ba53d4144f3d0c1e354f13368","observation_id":"0a3c5ca4-c5d8-4559-ac15-4050a424d602","resolution":{"observed_at":"2026-08-07T11:35:45.979553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07365","last_updated":"2025-04-15T14:22:45Z","snapshot_observed_at":"2026-08-09T01:06:58.674891Z","submitted_at":"2025-03-10T14:23:12Z","title":"MM-Eureka: Exploring the Frontiers of Multimodal Reasoning with Rule-based Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07365","snapshot_observed_at":"2026-08-07T11:35:46.053056Z","title":"Mm-eureka: Exploring visual aha moment with rule-based large-scale reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:46.053056Z"},"links":{"cited_paper":"/paper/2503.07365","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:d8cd597d80dca317d7dcf4343e554c90bceb5fa1f5b6d372e640d062eec4a30a","observation_id":"a098ea00-8092-40cc-8023-b1a7c52b535b","resolution":{"observed_at":"2026-08-07T11:35:46.053056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:46.131832Z","title":"Iterative ranking from pair-wise comparisons","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:46.131832Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:ab8b3bade5da22ebad313b69ddc88da7def95a97d35823be324f9548e847c874","observation_id":"12809237-5dff-433c-aa41-d28f3afc8c38","resolution":{"observed_at":"2026-08-07T11:35:46.131832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07536","last_updated":"2025-03-11T03:32:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-10T17:04:14Z","title":"LMM-R1: Empowering 3B LMMs with Strong Reasoning Abilities Through Two-Stage Rule-Based RL","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07536","snapshot_observed_at":"2026-08-07T11:35:46.225972Z","title":"Lmm-r1: Empowering 3b lmms with strong reasoning abilities through two-stage rule-based rl","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:46.225972Z"},"links":{"cited_paper":"/paper/2503.07536","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:5201c7ad97ded4e369f7aba08b7eb28d265690fc7f97f0ca35fefcedaf966ee1","observation_id":"16ee4cb3-d35d-43bc-bbca-0e8a180b1b8f","resolution":{"observed_at":"2026-08-07T11:35:46.225972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01284","last_updated":"2024-07-01T13:39:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-01T13:39:08Z","title":"We-Math: Does Your Large Multimodal Model Achieve Human-like Mathematical Reasoning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01284","snapshot_observed_at":"2026-08-07T11:35:46.295497Z","title":"We-math: Does your large multimodal model achieve human-like mathematical reasoning? arXiv preprint arXiv:2407.01284, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:46.295497Z"},"links":{"cited_paper":"/paper/2407.01284","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:9cd8d6dc9388bf3bec403f4f6bd4a7a47b0e244472443b597874d49b82ff0116","observation_id":"b474b799-dfb0-4dc5-b822-dc123530c909","resolution":{"observed_at":"2026-08-07T11:35:46.295497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T11:35:46.364671Z","title":"Proximal policy optimization algorithms, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:46.364671Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:3e8d0dba593c63a682ff70ec0023fd50bcd65678ff464545e3e4edabd5bb1189","observation_id":"02404c31-7369-43d5-8fcc-1bd93236094a","resolution":{"observed_at":"2026-08-07T11:35:46.364671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T11:35:46.455575Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:46.455575Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:ffeefdd0311d5c0a1952ddfcfd5a85dedbf2b11393c3bb3d9b954c71b87c2a92","observation_id":"1a776c3c-4134-4707-bc44-50b7809548a0","resolution":{"observed_at":"2026-08-07T11:35:46.455575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19256","last_updated":"2024-10-02T04:01:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-28T06:20:03Z","title":"HybridFlow: A Flexible and Efficient RLHF Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19256","snapshot_observed_at":"2026-08-07T11:35:46.547506Z","title":"Hybridflow: A flexible and efficient rlhf framework","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:46.547506Z"},"links":{"cited_paper":"/paper/2409.19256","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:d581aec2f47f1f065d926677a47b5760408501b1b285f8e2bcc4e161b6078331","observation_id":"3607d390-bcba-4434-aa0f-3a24e1420cde","resolution":{"observed_at":"2026-08-07T11:35:46.547506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-08T00:41:26.316141Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-07T11:35:46.632301Z","title":"Math-llava: Bootstrapping mathematical reasoning for multimodal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:46.632301Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:a8175f905862d9d882d88399a044c7e138328a7de962a790338baaf0bf408b66","observation_id":"4a3f3a05-f5fc-4a3f-a88d-7f220ec9a4a6","resolution":{"observed_at":"2026-08-07T11:35:46.632301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:50.447721Z","title":"Some rank order tests which are most powerful against specific parametric alternatives","venue":null,"work_id":"5fc31834-c46b-4177-881d-28d5f51ffa12","year":1952},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:46.730566Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:a4eab04fcd31720b482937f933b32c6c4f77275ec354d14a056fc8462a19f282","observation_id":"814b1d37-28b1-4257-8d38-56b0aa65d387","resolution":{"observed_at":"2026-08-07T11:35:50.605631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:46.817678Z","title":"Dart-math: Difficulty-aware rejection tuning for mathematical problem-solving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:46.817678Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:9c755826ebb78ce77427511d4cf49530eb09b5129b681f546cd09e01418433dd","observation_id":"c7cd2c15-bf9d-4f7e-a6e5-441590bccb17","resolution":{"observed_at":"2026-08-07T11:35:46.817678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:50.115025Z","title":"Measuring multimodal mathematical reasoning with math-vision dataset","venue":null,"work_id":"54912601-afc3-4d2c-8e99-164a36353c0f","year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:46.908919Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:b17f00d16d8fde971591f68fb5418a35e8735aec685b1fe459efb6f322bc0a23","observation_id":"a903f51d-b1df-4c2a-b767-3e18cd230981","resolution":{"observed_at":"2026-08-07T11:35:50.271280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02158","last_updated":"2024-12-04T08:34:49Z","snapshot_observed_at":"2026-08-09T09:47:33.032566Z","submitted_at":"2024-12-03T04:34:23Z","title":"Agri-LLaVA: Knowledge-Infused Large Multimodal Assistant on Agricultural Pests and Diseases","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02158","snapshot_observed_at":"2026-08-07T11:35:46.989091Z","title":"Agri-llava: Knowledge-infused large multimodal assistant on agricultural pests and diseases, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:46.989091Z"},"links":{"cited_paper":"/paper/2412.02158","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:95b78e1f11cc3880ef92833d13c5e4116688606618e530b4522e385f46d9cb44","observation_id":"db2b616b-3222-4f49-9bcc-45395e56de21","resolution":{"observed_at":"2026-08-07T11:35:46.989091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07934","last_updated":"2025-05-30T15:53:16Z","snapshot_observed_at":"2026-08-07T16:06:46.096701Z","submitted_at":"2025-04-10T17:49:05Z","title":"SoTA with Less: MCTS-Guided Sample Selection for Data-Efficient Visual Reasoning Self-Improvement","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07934","snapshot_observed_at":"2026-08-07T11:35:47.087104Z","title":"Sota with less: Mcts-guided sample selection for data-efficient visual reasoning self-improvement, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:47.087104Z"},"links":{"cited_paper":"/paper/2504.07934","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:0d8cfed0d74108f741aca7d9ab7c351ca3b4d73566c05eddd7ae1b72cc09a707","observation_id":"04625a6a-c12b-4741-a4d4-b573b244768e","resolution":{"observed_at":"2026-08-07T11:35:47.087104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09739","last_updated":"2024-07-17T20:50:11Z","snapshot_observed_at":"2026-07-06T17:30:25.359458Z","submitted_at":"2024-02-15T06:36:07Z","title":"QuRating: Selecting High-Quality Data for Training Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09739","snapshot_observed_at":"2026-08-07T11:35:47.179506Z","title":"Qurating: Selecting high-quality data for training language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:47.179506Z"},"links":{"cited_paper":"/paper/2402.09739","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:9a1ad052ae176f3e601a4b2b72b541c3fa48159b8193268761eca1cb3042c8e9","observation_id":"1debfe81-31f3-4173-9bf5-783109667a66","resolution":{"observed_at":"2026-08-07T11:35:47.179506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-07T17:47:02.067367Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-07T11:35:47.274238Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:47.274238Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:9cbeb32813dc648124e112e0405f1aaa9aba95fa517c3c3f7e8a21bca5a32c65","observation_id":"1fd56d91-44f8-4727-9c8f-17c273d6c01f","resolution":{"observed_at":"2026-08-07T11:35:47.274238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12244","last_updated":"2025-05-27T06:49:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-24T16:31:06Z","title":"WizardLM: Empowering large pre-trained language models to follow complex instructions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.12244","snapshot_observed_at":"2026-08-07T11:35:47.349754Z","title":"Wizardlm: Empowering large language models to follow complex instructions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:47.349754Z"},"links":{"cited_paper":"/paper/2304.12244","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:c66bfbe1569fcc6c4cbd111a265b90736582c5217ba61835143ebea664e8d8fb","observation_id":"e8e5cbd9-5d77-44bd-99a1-e8527c71921b","resolution":{"observed_at":"2026-08-07T11:35:47.349754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08464","last_updated":"2024-10-07T01:45:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-12T17:52:30Z","title":"Magpie: Alignment Data Synthesis from Scratch by Prompting Aligned LLMs with Nothing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08464","snapshot_observed_at":"2026-08-07T11:35:47.442353Z","title":"Magpie: Alignment data synthesis from scratch by prompting aligned llms with nothing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:47.442353Z"},"links":{"cited_paper":"/paper/2406.08464","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:71643cf2bb693d924f2a43ce161df71609d95e42c0cb53d1e89c146f2834fb73","observation_id":"48ce8203-2fb1-4340-8e8a-e8328f62ec26","resolution":{"observed_at":"2026-08-07T11:35:47.442353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10615","last_updated":"2025-03-18T08:52:34Z","snapshot_observed_at":"2026-08-07T12:50:27.666060Z","submitted_at":"2025-03-13T17:56:05Z","title":"R1-Onevision: Advancing Generalized Multimodal Reasoning through Cross-Modal Formalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10615","snapshot_observed_at":"2026-08-07T11:35:47.538238Z","title":"R1-onevision: Advancing generalized multimodal reasoning through cross-modal formalization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:47.538238Z"},"links":{"cited_paper":"/paper/2503.10615","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:67b6b932b7f331000ecc9381cf52c5c47dd74472eded9a3bd624091f878ea04e","observation_id":"9945eb6f-2e2a-44af-a382-649b997bffdb","resolution":{"observed_at":"2026-08-07T11:35:47.538238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-10T00:19:13.518873Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-07T11:35:47.633710Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:47.633710Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:9ba02cdcf0a8c7eb8ca7b07964aa04ce349164406fa3afc8a190324a1dab48d5","observation_id":"e11d0494-ee93-48e0-b805-ec5b346c0859","resolution":{"observed_at":"2026-08-07T11:35:47.633710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-07T11:35:47.704809Z","title":"Dapo: An open-source llm reinforcement learning system at scale","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:47.704809Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:88a4adbee2cf46c38e9d69c412f9b66f7f0f2d7aa75b118c46a45cb823a890b6","observation_id":"4d6ed220-c3b6-406f-a283-3abb183608da","resolution":{"observed_at":"2026-08-07T11:35:47.704809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05118","last_updated":"2025-04-11T02:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T14:21:11Z","title":"VAPO: Efficient and Reliable Reinforcement Learning for Advanced Reasoning Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05118","snapshot_observed_at":"2026-08-07T11:35:47.789603Z","title":"Vapo: Efficient and reliable reinforcement learning for advanced reasoning tasks","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:47.789603Z"},"links":{"cited_paper":"/paper/2504.05118","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:02a930f880a9af85eb1d07ffeba9f1d312acc1290edcf81f62147c702973838a","observation_id":"5816efab-176e-4812-b4af-4645f840aa09","resolution":{"observed_at":"2026-08-07T11:35:47.789603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18892","last_updated":"2025-08-06T08:42:32Z","snapshot_observed_at":"2026-07-06T20:57:57.039376Z","submitted_at":"2025-03-24T17:06:10Z","title":"SimpleRL-Zoo: Investigating and Taming Zero Reinforcement Learning for Open Base Models in the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18892","snapshot_observed_at":"2026-08-07T11:35:47.858390Z","title":"Simplerl-zoo: Investigating and taming zero reinforcement learning for open base models in the wild, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:47.858390Z"},"links":{"cited_paper":"/paper/2503.18892","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:7ccd9ce3f50b4f159565bac1e09d2b9be9f41a35911711e4913a0e9bed861308","observation_id":"02528de9-975f-4329-9a32-8d8299e7940b","resolution":{"observed_at":"2026-08-07T11:35:47.858390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12937","last_updated":"2025-08-04T04:22:09Z","snapshot_observed_at":"2026-08-06T21:34:54.534751Z","submitted_at":"2025-03-17T08:51:44Z","title":"R1-VL: Learning to Reason with Multimodal Large Language Models via Step-wise Group Relative Policy Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12937","snapshot_observed_at":"2026-08-07T11:35:47.951687Z","title":"R1-vl: Learning to reason with multimodal large language models via step-wise group relative policy optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:47.951687Z"},"links":{"cited_paper":"/paper/2503.12937","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:465f1a0927b05ea97058000b8fc1e67a7d871770e3e3d986fd066aac5e2abc5a","observation_id":"3cdf3911-6cfc-49e3-9a6e-db665d108f64","resolution":{"observed_at":"2026-08-07T11:35:47.951687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:48.064298Z","title":"Mathverse: Does your multi-modal llm truly see the diagrams in visual math problems? In European Conference on Computer Vision, pp.\\ 169--186","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:48.064298Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:d225154b135a7ff2c097da41925115bae30f5cb0867ff524ea31704a872fcfd9","observation_id":"2b492e3b-9148-4658-aeac-c5b03ebb118c","resolution":{"observed_at":"2026-08-07T11:35:48.064298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:49.830301Z","title":"Mavis: Mathematical visual instruction tuning","venue":null,"work_id":"6dc77fc9-b798-406a-ac2a-8446c027d090","year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:48.156999Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:597ea405b4a5793fb38d53564504373d3105e5b3c648ff397adef291a8e77f99","observation_id":"85b0c8d5-e330-4b54-b0ee-0a09458f3881","resolution":{"observed_at":"2026-08-07T11:35:49.943274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:48.225424Z","title":"Easyr1: An efficient, scalable, multi-modality rl training framework","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:48.225424Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:6c10041565ad3b9e067519ef5d7c4e10fa47f373f91b619b89f512f4dd1483c3","observation_id":"0b217a9b-0c96-425e-be90-cf67935278db","resolution":{"observed_at":"2026-08-07T11:35:48.225424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:48.312203Z","title":"Lima: Less is more for alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:48.312203Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:3c7e8fe47750a7411d5edfeeed9a140bd9c85e8c24c508e120857d05a386f2d9","observation_id":"6efe3762-95b1-408a-bc3b-ca878f1a1378","resolution":{"observed_at":"2026-08-07T11:35:48.312203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12366","last_updated":"2024-09-20T01:32:35Z","snapshot_observed_at":"2026-08-10T04:46:32.758140Z","submitted_at":"2024-07-17T07:44:26Z","title":"NavGPT-2: Unleashing Navigational Reasoning Capability for Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12366","snapshot_observed_at":"2026-08-07T11:35:48.404458Z","title":"Navgpt-2: Unleashing navigational reasoning capability for large vision-language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:48.404458Z"},"links":{"cited_paper":"/paper/2407.12366","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:b4a526c8c63b3b2520ea9415cf08e1421249cf5b4acd9638ff02f1ece446ec96","observation_id":"9f7571fe-8f07-48d5-a41e-884b3b99e191","resolution":{"observed_at":"2026-08-07T11:35:48.404458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19276","last_updated":"2025-04-27T15:21:59Z","snapshot_observed_at":"2026-08-09T14:35:40.747225Z","submitted_at":"2025-04-27T15:21:59Z","title":"Anyprefer: An Agentic Framework for Preference Data Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19276","snapshot_observed_at":"2026-08-07T11:35:48.503722Z","title":"Anyprefer: An agentic framework for preference data synthesis, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:48.503722Z"},"links":{"cited_paper":"/paper/2504.19276","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:d940a95eabebc3a07595e07203b57184bf79fe5ab34108eebc7f78b4b7a25886","observation_id":"a78461e9-b9f9-4af6-bfdf-124de97dc7f6","resolution":{"observed_at":"2026-08-07T11:35:48.503722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:49.689038Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models, 2024","venue":null,"work_id":"93e6dbeb-4de1-4cc7-a836-4312435056b5","year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:48.604808Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:b56aade1e6e68e88e92d2770dbcb49c64451585f70b1bf90854b6de3b83afd14","observation_id":"78b6cf58-0845-45a2-95e5-16bb60f350e7","resolution":{"observed_at":"2026-08-07T11:35:49.749976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:48.656605Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:48.656605Z"},"links":{"citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:85c0a02f423e9bafc55b9fcb513ba960a8cb83b4bd920e84d05b129d274e5140","observation_id":"f1303788-f8f7-4a4d-a01a-64db254eba24","resolution":{"observed_at":"2026-08-07T11:35:48.656605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T12:51:05.147362Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis"},"reference_resolution":{"displayed":76,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":64,"verified_exact":1,"verified_fuzzy":11},"total_outbound_references":76},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 76 of 76 outbound references and 4 inbound Pith citation observations for arXiv:2506.02096."}