{"as_of":"2026-08-09T22:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a1320f206870386ba29bde7902b44ddeedaa788aa0e8ef683e1a67ec3cdafe87","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:07:36.826395Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T14:08:40.968105Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T14:13:30.120402Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.06573","last_updated":"2025-07-09T06:05:28Z","snapshot_observed_at":"2026-08-07T21:25:23.216182Z","submitted_at":"2025-07-09T06:05:28Z","title":"From Data-Centric to Sample-Centric: Enhancing LLM Reasoning via Progressive Optimization","version":1},"cited_work":{"arxiv_id":"2507.06573","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.06573","snapshot_observed_at":"2026-06-29T14:13:30.120402Z","title":"Fromdata-centrictosample- centric: Enhancing llm reasoning via progressive optimization","venue":null,"work_id":"5b308b3e-142b-48a5-8f7a-aa4134af79dd","year":2025},"citing_paper":{"arxiv_id":"2601.04809","last_updated":"2026-05-04T13:55:24Z","snapshot_observed_at":"2026-07-06T22:41:05.793337Z","submitted_at":"2026-01-08T10:42:04Z","title":"SCALER:Synthetic Scalable Adaptive Learning Environment for Reasoning","version":5},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T16:24:04.132572Z"},"links":{"cited_paper":"/paper/2507.06573","citing_paper":"/paper/2601.04809"},"observation_digest":"sha256:0884475027677d7d1610c78f26b87933d34aa8050b44afd89034486d70a87f20","observation_id":"23659746-3e51-4ba5-b8ca-8aac15e366d7","resolution":{"observed_at":"2026-05-16T16:28:05.756861Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06573","last_updated":"2025-07-09T06:05:28Z","snapshot_observed_at":"2026-08-07T21:25:23.216182Z","submitted_at":"2025-07-09T06:05:28Z","title":"From Data-Centric to Sample-Centric: Enhancing LLM Reasoning via Progressive Optimization","version":1},"cited_work":{"arxiv_id":"2507.06573","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.06573","snapshot_observed_at":"2026-06-29T14:13:30.120402Z","title":"Fromdata-centrictosample- centric: Enhancing llm reasoning via progressive optimization","venue":null,"work_id":"5b308b3e-142b-48a5-8f7a-aa4134af79dd","year":2025},"citing_paper":{"arxiv_id":"2605.02913","last_updated":"2026-04-08T00:53:29Z","snapshot_observed_at":"2026-07-06T23:15:55.848885Z","submitted_at":"2026-04-08T00:53:29Z","title":"Generate, Filter, Control, Replay: A Comprehensive Survey of Rollout Strategies for LLM Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-10T19:15:27.406778Z"},"links":{"cited_paper":"/paper/2507.06573","citing_paper":"/paper/2605.02913"},"observation_digest":"sha256:c52caf307363e9ca0e8ef12835f32cb9f8ea0331677925f533618a490e92ba01","observation_id":"988c29da-eaf5-464d-b870-5250a0180a72","resolution":{"observed_at":"2026-05-10T23:15:49.338226Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06573","last_updated":"2025-07-09T06:05:28Z","snapshot_observed_at":"2026-08-07T21:25:23.216182Z","submitted_at":"2025-07-09T06:05:28Z","title":"From Data-Centric to Sample-Centric: Enhancing LLM Reasoning via Progressive Optimization","version":1},"cited_work":{"arxiv_id":"2507.06573","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.06573","snapshot_observed_at":"2026-06-29T14:13:30.120402Z","title":"Fromdata-centrictosample- centric: Enhancing llm reasoning via progressive optimization","venue":null,"work_id":"5b308b3e-142b-48a5-8f7a-aa4134af79dd","year":2025},"citing_paper":{"arxiv_id":"2605.28631","last_updated":"2026-05-27T15:38:09Z","snapshot_observed_at":"2026-07-06T23:38:09.179597Z","submitted_at":"2026-05-27T15:38:09Z","title":"Single-Rollout Hidden-State Dynamics for Training-Free RLVR Data Selection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T14:08:40.968105Z"},"links":{"cited_paper":"/paper/2507.06573","citing_paper":"/paper/2605.28631"},"observation_digest":"sha256:bec71ad90e19192a3b684cfc0119667f58ec5864004c3ee37b195b3b263f055b","observation_id":"ba1428bf-2956-452f-bdb3-71112283d2dd","resolution":{"observed_at":"2026-06-29T14:13:30.122157Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.06573/citation-record","integrity":"/paper/2507.06573/integrity","json":"/paper/2507.06573/citation-record.json","paper":"/paper/2507.06573"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T19:07:35.795001Z","title":"CoRR, abs/2501.12948","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.06573","last_updated":"2025-07-09T06:05:28Z","snapshot_observed_at":"2026-08-07T21:25:23.216182Z","submitted_at":"2025-07-09T06:05:28Z","title":"From Data-Centric to Sample-Centric: Enhancing LLM Reasoning via Progressive Optimization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:07:35.795001Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.06573"},"observation_digest":"sha256:53904de1346ae2d4fbd0f89562fc9407a044f97bbfa4b5e63554297076feac63","observation_id":"ef897c4f-df5c-408d-a1dd-cdceafedd80a","resolution":{"observed_at":"2026-08-06T19:07:35.795001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:07:37.352575Z","title":"In The Twelfth In- ternational Conference on Learning Representations, ICLR 2024, Vienna, Austria, May 7-11, 2024","venue":null,"work_id":"a5ecb8a4-5464-4511-9ab6-269dcc398450","year":2024},"citing_paper":{"arxiv_id":"2507.06573","last_updated":"2025-07-09T06:05:28Z","snapshot_observed_at":"2026-08-07T21:25:23.216182Z","submitted_at":"2025-07-09T06:05:28Z","title":"From Data-Centric to Sample-Centric: Enhancing LLM Reasoning via Progressive Optimization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:07:36.199261Z"},"links":{"citing_paper":"/paper/2507.06573"},"observation_digest":"sha256:131d60687b8aecd85fa0a428ab7cf8efd61cb98cbf58431871c3ff020dc53b17","observation_id":"847c084f-a9ab-43c3-aebb-fc2e12b2151b","resolution":{"observed_at":"2026-08-06T19:07:37.413613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20783","last_updated":"2025-10-06T09:30:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T17:59:14Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20783","snapshot_observed_at":"2026-08-06T19:07:36.278237Z","title":"CoRR, abs/2503.20783","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06573","last_updated":"2025-07-09T06:05:28Z","snapshot_observed_at":"2026-08-07T21:25:23.216182Z","submitted_at":"2025-07-09T06:05:28Z","title":"From Data-Centric to Sample-Centric: Enhancing LLM Reasoning via Progressive Optimization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:07:36.278237Z"},"links":{"cited_paper":"/paper/2503.20783","citing_paper":"/paper/2507.06573"},"observation_digest":"sha256:b993c45d94df495ab099bd1f0a28d61dd98b79357d6c834396f1031e5620b1c2","observation_id":"b2e1df28-db64-4825-b65a-54c5fb249698","resolution":{"observed_at":"2026-08-06T19:07:36.278237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14768","last_updated":"2025-02-20T17:49:26Z","snapshot_observed_at":"2026-08-04T12:32:53.090165Z","submitted_at":"2025-02-20T17:49:26Z","title":"Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14768","snapshot_observed_at":"2026-08-06T19:07:36.432526Z","title":"Tian Xie, Zitian Gao, Qingnan Ren, Haoming Luo, Yuqian Hong, Bryan Dai, Joey Zhou, Kai Qiu, Zhi- rong Wu, and Chong Luo","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.06573","last_updated":"2025-07-09T06:05:28Z","snapshot_observed_at":"2026-08-07T21:25:23.216182Z","submitted_at":"2025-07-09T06:05:28Z","title":"From Data-Centric to Sample-Centric: Enhancing LLM Reasoning via Progressive Optimization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:07:36.432526Z"},"links":{"cited_paper":"/paper/2502.14768","citing_paper":"/paper/2507.06573"},"observation_digest":"sha256:1a301b02c0afd152106f2f16e560d54a306bf63a475dda914bbc698d69553f50","observation_id":"48c950b9-6541-4e7b-8811-f18eff5a7c80","resolution":{"observed_at":"2026-08-06T19:07:36.432526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-06T19:07:36.534922Z","title":"CoRR, abs/2503.14476","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.06573","last_updated":"2025-07-09T06:05:28Z","snapshot_observed_at":"2026-08-07T21:25:23.216182Z","submitted_at":"2025-07-09T06:05:28Z","title":"From Data-Centric to Sample-Centric: Enhancing LLM Reasoning via Progressive Optimization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:07:36.534922Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2507.06573"},"observation_digest":"sha256:865b18cf78d99a92882f78aad7656f08f8e9e6d75fd329ec8e95ef72396798de","observation_id":"0489ca83-0458-43a3-a87a-bb07e55e015d","resolution":{"observed_at":"2026-08-06T19:07:36.534922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14286","last_updated":"2025-04-22T10:07:13Z","snapshot_observed_at":"2026-08-09T04:45:02.412245Z","submitted_at":"2025-04-19T13:06:03Z","title":"SRPO: A Cross-Domain Implementation of Large-Scale Reinforcement Learning on LLM","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14286","snapshot_observed_at":"2026-08-06T19:07:36.624737Z","title":"arXiv preprint arXiv:2504.14286","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.06573","last_updated":"2025-07-09T06:05:28Z","snapshot_observed_at":"2026-08-07T21:25:23.216182Z","submitted_at":"2025-07-09T06:05:28Z","title":"From Data-Centric to Sample-Centric: Enhancing LLM Reasoning via Progressive Optimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:07:36.624737Z"},"links":{"cited_paper":"/paper/2504.14286","citing_paper":"/paper/2507.06573"},"observation_digest":"sha256:a8a7ffbc4f8cd4968a986b8c35409871846ed20550ca35c5949e70a333feb97d","observation_id":"3ee80aa1-e4b6-4d90-ba9b-0c678caca20c","resolution":{"observed_at":"2026-08-06T19:07:36.624737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:07:37.216043Z","title":null,"venue":null,"work_id":"07e1eff4-c56a-4861-b852-d2ed0a15eaa7","year":2022},"citing_paper":{"arxiv_id":"2507.06573","last_updated":"2025-07-09T06:05:28Z","snapshot_observed_at":"2026-08-07T21:25:23.216182Z","submitted_at":"2025-07-09T06:05:28Z","title":"From Data-Centric to Sample-Centric: Enhancing LLM Reasoning via Progressive Optimization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:07:36.738889Z"},"links":{"citing_paper":"/paper/2507.06573"},"observation_digest":"sha256:4b6bdfb72b578550f3f91a0a568144406f92e5461644bc74bb18383b006b2a12","observation_id":"06880c01-66ea-45a5-bfc6-f2f41724fff8","resolution":{"observed_at":"2026-08-06T19:07:37.268626Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:07:37.488413Z","title":"Aitor Lewkowycz, Anders Andreassen, David Dohan, Ethan Dyer, Henryk Michalewski, Vinay V","venue":null,"work_id":"9d6682c2-b1b0-4612-b091-c5ec7c49318f","year":2022},"citing_paper":{"arxiv_id":"2507.06573","last_updated":"2025-07-09T06:05:28Z","snapshot_observed_at":"2026-08-07T21:25:23.216182Z","submitted_at":"2025-07-09T06:05:28Z","title":"From Data-Centric to Sample-Centric: Enhancing LLM Reasoning via Progressive Optimization","version":1},"reference_index":626,"source":"pdf_text","source_observed_at":"2026-08-06T19:07:36.001415Z"},"links":{"citing_paper":"/paper/2507.06573"},"observation_digest":"sha256:08d083a273e17f9999350c8b3ac6e56738c458a76280009b9814982580b8b22f","observation_id":"35635517-f411-4aa6-8762-66ed6ee0b8c0","resolution":{"observed_at":"2026-08-06T19:07:37.555442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:07:37.099244Z","title":"Figure 8 illustrates the cosine similarity between the embeddings of model-generated solutions and oracle expert solutions, comparing training with and without PG-Sampling","venue":null,"work_id":"7c52e0f3-8213-457d-803a-02a12725e721","year":null},"citing_paper":{"arxiv_id":"2507.06573","last_updated":"2025-07-09T06:05:28Z","snapshot_observed_at":"2026-08-07T21:25:23.216182Z","submitted_at":"2025-07-09T06:05:28Z","title":"From Data-Centric to Sample-Centric: Enhancing LLM Reasoning via Progressive Optimization","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T19:07:36.826395Z"},"links":{"citing_paper":"/paper/2507.06573"},"observation_digest":"sha256:2d10abe3a52e7b6ba9abfee27cd3869d3523d280b9ca72f24cf5050a0fe19304","observation_id":"e9f16861-1523-4116-9bcc-19502952b717","resolution":{"observed_at":"2026-08-06T19:07:37.139709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T19:07:36.344889Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06573","last_updated":"2025-07-09T06:05:28Z","snapshot_observed_at":"2026-08-07T21:25:23.216182Z","submitted_at":"2025-07-09T06:05:28Z","title":"From Data-Centric to Sample-Centric: Enhancing LLM Reasoning via Progressive Optimization","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T19:07:36.344889Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.06573"},"observation_digest":"sha256:2d5067fcf319ba9c5c1b6780b41aefbde37662a5ae3ec681c50ef7bf310394b0","observation_id":"fbab5568-6cdb-48f6-9369-0112cd8020ae","resolution":{"observed_at":"2026-08-06T19:07:36.344889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11886","last_updated":"2025-02-17T15:13:29Z","snapshot_observed_at":"2026-08-09T18:20:45.496028Z","submitted_at":"2025-02-17T15:13:29Z","title":"LIMR: Less is More for RL Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11886","snapshot_observed_at":"2026-08-06T19:07:36.105216Z","title":"Hugging Face repository, 13:9","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.06573","last_updated":"2025-07-09T06:05:28Z","snapshot_observed_at":"2026-08-07T21:25:23.216182Z","submitted_at":"2025-07-09T06:05:28Z","title":"From Data-Centric to Sample-Centric: Enhancing LLM Reasoning via Progressive Optimization","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T19:07:36.105216Z"},"links":{"cited_paper":"/paper/2502.11886","citing_paper":"/paper/2507.06573"},"observation_digest":"sha256:b51d3f4b62ffdac6c4bc292a91cf292c5cbe4a2a059273cfc9bbc75cb736b4e5","observation_id":"b894d50c-c028-4d0c-9c0d-fb4703238dab","resolution":{"observed_at":"2026-08-06T19:07:36.105216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01456","last_updated":"2025-09-26T09:25:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-03T15:43:48Z","title":"Process Reinforcement through Implicit Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01456","snapshot_observed_at":"2026-08-06T19:07:35.753972Z","title":"CoRR, abs/2502.01456","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06573","last_updated":"2025-07-09T06:05:28Z","snapshot_observed_at":"2026-08-07T21:25:23.216182Z","submitted_at":"2025-07-09T06:05:28Z","title":"From Data-Centric to Sample-Centric: Enhancing LLM Reasoning via Progressive Optimization","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T19:07:35.753972Z"},"links":{"cited_paper":"/paper/2502.01456","citing_paper":"/paper/2507.06573"},"observation_digest":"sha256:45727b480177bb6bbcf029fc56fa1e9db0036baa3fc94bd5d074f5429aa15db4","observation_id":"219b8998-dcc0-4f6c-8368-7323e81837a5","resolution":{"observed_at":"2026-08-06T19:07:35.753972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01807","last_updated":"2025-06-19T04:19:15Z","snapshot_observed_at":"2026-08-08T01:22:30.771699Z","submitted_at":"2025-03-03T18:37:26Z","title":"Large-Scale Data Selection for Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01807","snapshot_observed_at":"2026-08-06T19:07:35.904174Z","title":"Hamish Ivison, Muru Zhang, Faeze Brahman, Pang Wei Koh, and Pradeep Dasigi","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.06573","last_updated":"2025-07-09T06:05:28Z","snapshot_observed_at":"2026-08-07T21:25:23.216182Z","submitted_at":"2025-07-09T06:05:28Z","title":"From Data-Centric to Sample-Centric: Enhancing LLM Reasoning via Progressive Optimization","version":1},"reference_index":9061,"source":"pdf_text","source_observed_at":"2026-08-06T19:07:35.904174Z"},"links":{"cited_paper":"/paper/2503.01807","citing_paper":"/paper/2507.06573"},"observation_digest":"sha256:14521d702927259de3f321402a6e05b908db137c96e72785422b8381d199b7b1","observation_id":"f738fbeb-dc33-4e5b-9782-9a22379c6465","resolution":{"observed_at":"2026-08-06T19:07:35.904174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.06573","last_updated":"2025-07-09T06:05:28Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T21:25:23.216182Z","submitted_at":"2025-07-09T06:05:28Z","title":"From Data-Centric to Sample-Centric: Enhancing LLM Reasoning via Progressive Optimization"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 3 inbound Pith citation observations for arXiv:2507.06573."}