{"as_of":"2026-08-10T11:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4f2756c6afc3ade19b0a39d5979da94d569a97e8f491cc5c112716ff28a80d43","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":7,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":7,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:07:40.332763Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T20:56:13.377646Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.07291","last_updated":"2025-05-12T07:24:33Z","snapshot_observed_at":"2026-08-07T15:47:58.734802Z","submitted_at":"2025-05-12T07:24:33Z","title":"INTELLECT-2: A Reasoning Model Trained Through Globally Decentralized Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.07291","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.07291","snapshot_observed_at":"2026-07-01T20:56:13.377646Z","title":"M., Straube, J., Basra, M., Pazdera, A., Thaman, K., Ferrante, M","venue":null,"work_id":"9233b23c-abcc-4449-8d29-93e7185d2028","year":2025},"citing_paper":{"arxiv_id":"2505.24298","last_updated":"2026-03-02T03:07:29Z","snapshot_observed_at":"2026-08-02T16:10:09.199211Z","submitted_at":"2025-05-30T07:18:25Z","title":"AReaL: A Large-Scale Asynchronous Reinforcement Learning System for Language Reasoning","version":5},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-15T14:24:21.930934Z"},"links":{"cited_paper":"/paper/2505.07291","citing_paper":"/paper/2505.24298"},"observation_digest":"sha256:30eb5e7a790bdc5ad58d0ff2360a62295d7a01c9c7ba05959b10e68c62d93f42","observation_id":"a9bb1a91-530b-4c64-91dc-330177927b5a","resolution":{"observed_at":"2026-05-15T14:24:22.057134Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07291","last_updated":"2025-05-12T07:24:33Z","snapshot_observed_at":"2026-08-07T15:47:58.734802Z","submitted_at":"2025-05-12T07:24:33Z","title":"INTELLECT-2: A Reasoning Model Trained Through Globally Decentralized Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07291","snapshot_observed_at":"2026-08-07T05:07:40.332763Z","title":"INTELLECT-2: A reasoning model trained through globally decentralized reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00004","last_updated":"2025-07-10T17:08:40Z","snapshot_observed_at":"2026-08-08T16:04:02.052629Z","submitted_at":"2025-06-10T14:47:48Z","title":"A Theory of Inference Compute Scaling: Reasoning through Directed Stochastic Skill Search","version":2},"reference_index":200,"source":"pdf_text","source_observed_at":"2026-08-07T05:07:40.332763Z"},"links":{"cited_paper":"/paper/2505.07291","citing_paper":"/paper/2507.00004"},"observation_digest":"sha256:11734a32ff559339c8e1bffa55cff5fcaa025523778941a04b6a1e124368f28e","observation_id":"9a41612c-a9b6-4dce-bfc5-837b41a51cb8","resolution":{"observed_at":"2026-08-07T05:07:40.332763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07291","last_updated":"2025-05-12T07:24:33Z","snapshot_observed_at":"2026-08-07T15:47:58.734802Z","submitted_at":"2025-05-12T07:24:33Z","title":"INTELLECT-2: A Reasoning Model Trained Through Globally Decentralized Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07291","snapshot_observed_at":"2026-08-03T05:32:41.992143Z","title":"Intellect-2: A reasoning model trained through globally decentralized reinforcement learning.arXiv preprint arXiv:2505.07291, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:41.992143Z"},"links":{"cited_paper":"/paper/2505.07291","citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:dd36d10e7f550c585f3a4bc597e3f0d8a32cf2d06155d261e7e43bc1397507b3","observation_id":"8421379f-61e6-4d87-86cd-a33c9be4cd00","resolution":{"observed_at":"2026-08-03T05:32:41.992143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07291","last_updated":"2025-05-12T07:24:33Z","snapshot_observed_at":"2026-08-07T15:47:58.734802Z","submitted_at":"2025-05-12T07:24:33Z","title":"INTELLECT-2: A Reasoning Model Trained Through Globally Decentralized Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.07291","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.07291","snapshot_observed_at":"2026-07-01T20:56:13.377646Z","title":"M., Straube, J., Basra, M., Pazdera, A., Thaman, K., Ferrante, M","venue":null,"work_id":"9233b23c-abcc-4449-8d29-93e7185d2028","year":2025},"citing_paper":{"arxiv_id":"2602.03452","last_updated":"2026-05-06T05:26:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-03T12:17:25Z","title":"Beyond Variance: Prompt-Efficient RLVR via Rare-Event Amplification and Bidirectional Pairing","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T08:24:50.793194Z"},"links":{"cited_paper":"/paper/2505.07291","citing_paper":"/paper/2602.03452"},"observation_digest":"sha256:f15bde9f95f5344cb59827af690447ec2a531ea4697201ff596e7c86666736dc","observation_id":"c23806df-8fb5-41bb-9e60-f794d55cee6b","resolution":{"observed_at":"2026-05-16T08:27:36.739915Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07291","last_updated":"2025-05-12T07:24:33Z","snapshot_observed_at":"2026-08-07T15:47:58.734802Z","submitted_at":"2025-05-12T07:24:33Z","title":"INTELLECT-2: A Reasoning Model Trained Through Globally Decentralized Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.07291","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.07291","snapshot_observed_at":"2026-07-01T20:56:13.377646Z","title":"M., Straube, J., Basra, M., Pazdera, A., Thaman, K., Ferrante, M","venue":null,"work_id":"9233b23c-abcc-4449-8d29-93e7185d2028","year":2025},"citing_paper":{"arxiv_id":"2604.12160","last_updated":"2026-04-14T00:35:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-14T00:35:39Z","title":"PubSwap: Public-Data Off-Policy Coordination for Federated RLVR","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T16:05:27.319466Z"},"links":{"cited_paper":"/paper/2505.07291","citing_paper":"/paper/2604.12160"},"observation_digest":"sha256:cfe26592b9249689073d53658c89141302437b6be865bf9f82fa741c2bb08af4","observation_id":"240dbc33-de94-4ae2-981d-3980c4c9e09a","resolution":{"observed_at":"2026-05-11T09:21:00.205866Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07291","last_updated":"2025-05-12T07:24:33Z","snapshot_observed_at":"2026-08-07T15:47:58.734802Z","submitted_at":"2025-05-12T07:24:33Z","title":"INTELLECT-2: A Reasoning Model Trained Through Globally Decentralized Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.07291","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.07291","snapshot_observed_at":"2026-07-01T20:56:13.377646Z","title":"M., Straube, J., Basra, M., Pazdera, A., Thaman, K., Ferrante, M","venue":null,"work_id":"9233b23c-abcc-4449-8d29-93e7185d2028","year":2025},"citing_paper":{"arxiv_id":"2605.02964","last_updated":"2026-05-03T07:10:42Z","snapshot_observed_at":"2026-07-06T23:15:55.848885Z","submitted_at":"2026-05-03T07:10:42Z","title":"Reward Hacking Benchmark: Measuring Exploits in LLM Agents with Tool Use","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-10T15:38:41.821264Z"},"links":{"cited_paper":"/paper/2505.07291","citing_paper":"/paper/2605.02964"},"observation_digest":"sha256:c8b13dc7d41a753d3685cd717285265adf0f37044ce42d2785e8feb3d725f5b2","observation_id":"430ce64b-86bc-4aca-828c-846df1788d61","resolution":{"observed_at":"2026-05-11T10:06:03.596200Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07291","last_updated":"2025-05-12T07:24:33Z","snapshot_observed_at":"2026-08-07T15:47:58.734802Z","submitted_at":"2025-05-12T07:24:33Z","title":"INTELLECT-2: A Reasoning Model Trained Through Globally Decentralized Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.07291","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.07291","snapshot_observed_at":"2026-07-01T20:56:13.377646Z","title":"M., Straube, J., Basra, M., Pazdera, A., Thaman, K., Ferrante, M","venue":null,"work_id":"9233b23c-abcc-4449-8d29-93e7185d2028","year":2025},"citing_paper":{"arxiv_id":"2606.01249","last_updated":"2026-06-17T04:44:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-31T14:04:51Z","title":"Trust Region On-Policy Distillation","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-28T17:38:50.313305Z"},"links":{"cited_paper":"/paper/2505.07291","citing_paper":"/paper/2606.01249"},"observation_digest":"sha256:7995012106510764698d2818c052f6e41c51cbc28d02d5b04aca15359324139f","observation_id":"cb48b45a-b076-4f0c-973f-43c13f1a3d1a","resolution":{"observed_at":"2026-07-01T20:56:13.379027Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.07291/citation-record","integrity":"/paper/2505.07291/integrity","json":"/paper/2505.07291/citation-record.json","paper":"/paper/2505.07291"},"outbound":[],"paper":{"arxiv_id":"2505.07291","last_updated":"2025-05-12T07:24:33Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T15:47:58.734802Z","submitted_at":"2025-05-12T07:24:33Z","title":"INTELLECT-2: A Reasoning Model Trained Through Globally Decentralized Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 7 inbound Pith citation observations for arXiv:2505.07291."}