{"as_of":"2026-08-10T19:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dc08654f36f9d29475fbf51709af279917caabe9e65dc8410d489704de435de6","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":5,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":5,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:59:41.908963Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T08:53:03.650861Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.07787","last_updated":"2025-05-12T17:39:56Z","snapshot_observed_at":"2026-08-09T17:44:41.283579Z","submitted_at":"2025-05-12T17:39:56Z","title":"Learning from Peers in Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07787","snapshot_observed_at":"2026-08-06T18:59:41.908963Z","title":"Learning from peers in reasoning models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.06829","last_updated":"2025-07-09T13:28:35Z","snapshot_observed_at":"2026-08-07T18:20:33.639424Z","submitted_at":"2025-07-09T13:28:35Z","title":"Adaptive Termination for Multi-round Parallel Reasoning: An Universal Semantic Entropy-Guided Framework","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T18:59:41.908963Z"},"links":{"cited_paper":"/paper/2505.07787","citing_paper":"/paper/2507.06829"},"observation_digest":"sha256:f8c9366b89cbd2cba73dbce7c0c4e73666d65bf6b33be352fc0833029efc904d","observation_id":"e66e0fbc-e017-4a28-bfda-b3c83cc3bc04","resolution":{"observed_at":"2026-08-06T18:59:41.908963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07787","last_updated":"2025-05-12T17:39:56Z","snapshot_observed_at":"2026-08-09T17:44:41.283579Z","submitted_at":"2025-05-12T17:39:56Z","title":"Learning from Peers in Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07787","snapshot_observed_at":"2026-08-05T20:21:08.060154Z","title":"Learning from peers in reasoning models.CoRR, abs/2505.07787, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10751","last_updated":"2025-08-14T15:34:47Z","snapshot_observed_at":"2026-08-07T12:11:52.874985Z","submitted_at":"2025-08-14T15:34:47Z","title":"Pass@k Training for Adaptively Balancing Exploration and Exploitation of Large Reasoning Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T20:21:08.060154Z"},"links":{"cited_paper":"/paper/2505.07787","citing_paper":"/paper/2508.10751"},"observation_digest":"sha256:056a9e2afdca1e4ea1935fb08f5169a57ca25904e6a544e33b749eda8666f792","observation_id":"63245719-83c1-421f-965f-4e7e4baeb7c0","resolution":{"observed_at":"2026-08-05T20:21:08.060154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07787","last_updated":"2025-05-12T17:39:56Z","snapshot_observed_at":"2026-08-09T17:44:41.283579Z","submitted_at":"2025-05-12T17:39:56Z","title":"Learning from Peers in Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07787","snapshot_observed_at":"2026-08-05T05:45:03.041044Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.05007","last_updated":"2025-09-08T03:26:03Z","snapshot_observed_at":"2026-08-05T05:45:00.604843Z","submitted_at":"2025-09-05T11:14:11Z","title":"Sticker-TTS: Learn to Utilize Historical Experience with a Sticker-driven Test-Time Scaling Framework","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T05:45:03.041044Z"},"links":{"cited_paper":"/paper/2505.07787","citing_paper":"/paper/2509.05007"},"observation_digest":"sha256:08b1b50c128b5b84a0fe216e349c63433dc5d9ca62ed5af0703ecc4bdb353a28","observation_id":"7824f657-254f-4a13-b8c3-96efb2d142a9","resolution":{"observed_at":"2026-08-05T05:45:03.041044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07787","last_updated":"2025-05-12T17:39:56Z","snapshot_observed_at":"2026-08-09T17:44:41.283579Z","submitted_at":"2025-05-12T17:39:56Z","title":"Learning from Peers in Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07787","snapshot_observed_at":"2026-08-04T14:44:14.634746Z","title":"Learning from peers in reasoning models.arXiv preprint arXiv:2505.07787,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23730","last_updated":"2026-05-28T14:53:43Z","snapshot_observed_at":"2026-08-09T17:44:40.916466Z","submitted_at":"2025-09-28T08:20:22Z","title":"EAPO: Enhancing Policy Optimization with On-Demand Expert Assistance","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T14:44:14.634746Z"},"links":{"cited_paper":"/paper/2505.07787","citing_paper":"/paper/2509.23730"},"observation_digest":"sha256:a7e8b78fe4b0c24cb19f2a8d960fb627efd4411fc6c9d9a656c9721fe2aa179b","observation_id":"c27b8e1e-b6de-48bb-b66c-bb51be424721","resolution":{"observed_at":"2026-08-04T14:44:14.634746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07787","last_updated":"2025-05-12T17:39:56Z","snapshot_observed_at":"2026-08-09T17:44:41.283579Z","submitted_at":"2025-05-12T17:39:56Z","title":"Learning from Peers in Reasoning Models","version":1},"cited_work":{"arxiv_id":"2505.07787","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.07787","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a2e37f1f-9a4d-4218-ac9c-857bf2053343","year":2025},"citing_paper":{"arxiv_id":"2604.16029","last_updated":"2026-06-02T09:15:57Z","snapshot_observed_at":"2026-08-01T17:54:40.652791Z","submitted_at":"2026-04-17T13:00:22Z","title":"Cut Your Losses! Learning to Prune Paths Early for Efficient Parallel Reasoning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-10T08:52:46.918285Z"},"links":{"cited_paper":"/paper/2505.07787","citing_paper":"/paper/2604.16029"},"observation_digest":"sha256:d7de78c7bfefdb6306d6f9a490cd7e9e62a1795550699dd4fb2de3611c9b0fe8","observation_id":"70809acb-c836-4335-8fd2-839cd2eee6eb","resolution":{"observed_at":"2026-05-10T08:53:03.652476Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.07787/citation-record","integrity":"/paper/2505.07787/integrity","json":"/paper/2505.07787/citation-record.json","paper":"/paper/2505.07787"},"outbound":[],"paper":{"arxiv_id":"2505.07787","last_updated":"2025-05-12T17:39:56Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T17:44:41.283579Z","submitted_at":"2025-05-12T17:39:56Z","title":"Learning from Peers in Reasoning Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 5 inbound Pith citation observations for arXiv:2505.07787."}