{"as_of":"2026-08-16T17:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a1bc44c4922e8f4e51eaaf43aae0c5f4815396c62e28c104d1a71f31cb321a45","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T19:09:54.765869Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":43,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1802.06480","last_updated":"2018-02-19T01:25:26Z","snapshot_observed_at":"2026-08-14T19:44:43.864745Z","submitted_at":"2018-02-19T01:25:26Z","title":"Accelerated Primal-Dual Policy Optimization for Safe Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.06480","snapshot_observed_at":"2026-08-11T19:09:54.765869Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.07177","last_updated":"2024-12-10T04:22:11Z","snapshot_observed_at":"2026-08-15T19:21:17.554088Z","submitted_at":"2024-12-10T04:22:11Z","title":"Effective Reward Specification in Deep Reinforcement Learning","version":1},"reference_index":192,"source":"arxiv_source","source_observed_at":"2026-08-11T19:09:54.765869Z"},"links":{"cited_paper":"/paper/1802.06480","citing_paper":"/paper/2412.07177"},"observation_digest":"sha256:5fa1430e9075e54e783838fc5a640675d45022fedc5eb6ae1edf6eea02ee1882","observation_id":"e99eb0bb-abff-4441-8cd7-6ac7fc9bdca2","resolution":{"observed_at":"2026-08-11T19:09:54.765869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.06480","last_updated":"2018-02-19T01:25:26Z","snapshot_observed_at":"2026-08-14T19:44:43.864745Z","submitted_at":"2018-02-19T01:25:26Z","title":"Accelerated Primal-Dual Policy Optimization for Safe Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.06480","snapshot_observed_at":"2026-08-11T13:25:20.457721Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.13184","last_updated":"2024-12-17T18:58:00Z","snapshot_observed_at":"2026-08-13T19:09:19.533191Z","submitted_at":"2024-12-17T18:58:00Z","title":"Tilted Quantile Gradient Updates for Quantile-Constrained Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T13:25:20.457721Z"},"links":{"cited_paper":"/paper/1802.06480","citing_paper":"/paper/2412.13184"},"observation_digest":"sha256:798e1a849932dfb0d525fb41a7b75f8c1c336f1d6981ec87833c3fa4d9268f34","observation_id":"7c2c0def-25b7-438f-bb8c-16f8304b8d18","resolution":{"observed_at":"2026-08-11T13:25:20.457721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.06480","last_updated":"2018-02-19T01:25:26Z","snapshot_observed_at":"2026-08-14T19:44:43.864745Z","submitted_at":"2018-02-19T01:25:26Z","title":"Accelerated Primal-Dual Policy Optimization for Safe Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.06480","snapshot_observed_at":"2026-08-06T21:20:29.441050Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.00485","last_updated":"2025-07-01T06:59:59Z","snapshot_observed_at":"2026-08-08T23:58:34.928099Z","submitted_at":"2025-07-01T06:59:59Z","title":"PNAct: Crafting Backdoor Attacks in Safe Reinforcement Learning","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T21:20:29.441050Z"},"links":{"cited_paper":"/paper/1802.06480","citing_paper":"/paper/2507.00485"},"observation_digest":"sha256:4199d03e9a917f01fef47612ba42a9c2f61520cf69e8ca42cb5227ad6743b1f0","observation_id":"7f1d205e-0fd2-4481-bc3e-a208e4e89b08","resolution":{"observed_at":"2026-08-06T21:20:29.441050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.06480","last_updated":"2018-02-19T01:25:26Z","snapshot_observed_at":"2026-08-14T19:44:43.864745Z","submitted_at":"2018-02-19T01:25:26Z","title":"Accelerated Primal-Dual Policy Optimization for Safe Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.06480","snapshot_observed_at":"2026-08-04T07:37:43.121038Z","title":"Accelerated Primal - Dual Policy Optimization for Safe Reinforcement Learning , February 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.25063","last_updated":"2026-06-20T16:50:19Z","snapshot_observed_at":"2026-08-15T03:20:33.816072Z","submitted_at":"2025-10-29T01:04:13Z","title":"Control Synthesis with Reinforcement Learning: A Modeling Perspective","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T07:37:43.121038Z"},"links":{"cited_paper":"/paper/1802.06480","citing_paper":"/paper/2510.25063"},"observation_digest":"sha256:45e03c8485b7ffd8573b79c06f72883e9ee85218ef032e7e98eb51fc8bd88198","observation_id":"6feb0acf-3df2-4dc7-94f5-408ca55f97ae","resolution":{"observed_at":"2026-08-04T07:37:43.121038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.06480","last_updated":"2018-02-19T01:25:26Z","snapshot_observed_at":"2026-08-14T19:44:43.864745Z","submitted_at":"2018-02-19T01:25:26Z","title":"Accelerated Primal-Dual Policy Optimization for Safe Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1802.06480","doi":"10.1007/s10462-025-11340-5","metadata_source":"pith","pith_arxiv_id":"1802.06480","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Accelerated Primal-Dual Policy Optimization for Safe Reinforcement Learning","venue":"cs.AI","work_id":"75cd0042-b756-4971-a381-fbdf7f0502f9","year":2018},"citing_paper":{"arxiv_id":"2605.30461","last_updated":"2026-05-28T18:37:16Z","snapshot_observed_at":"2026-08-07T14:57:47.349541Z","submitted_at":"2026-05-28T18:37:16Z","title":"Scalable Constrained Multi-Agent Reinforcement Learning via State Augmentation and Consensus for Separable Dynamics","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/1802.06480","citing_paper":"/paper/2605.30461"},"observation_digest":"sha256:7a09de38e0f373f6afc155851c9385d0b2716900dd6b81cb083892866d8b243b","observation_id":"2a7d1de5-8c22-4381-af1b-dfa260f81a71","resolution":{"observed_at":"2026-06-29T08:43:14.641498Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.06480","last_updated":"2018-02-19T01:25:26Z","snapshot_observed_at":"2026-08-14T19:44:43.864745Z","submitted_at":"2018-02-19T01:25:26Z","title":"Accelerated Primal-Dual Policy Optimization for Safe Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1802.06480","doi":"10.1007/s10462-025-11340-5","metadata_source":"pith","pith_arxiv_id":"1802.06480","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Accelerated Primal-Dual Policy Optimization for Safe Reinforcement Learning","venue":"cs.AI","work_id":"75cd0042-b756-4971-a381-fbdf7f0502f9","year":2018},"citing_paper":{"arxiv_id":"2606.22579","last_updated":"2026-06-21T16:29:25Z","snapshot_observed_at":"2026-08-02T07:11:59.062207Z","submitted_at":"2026-06-21T16:29:25Z","title":"Stationary Robust Mean-Field Games under Model Mismatches","version":1},"reference_index":163,"source":"arxiv_source","source_observed_at":"2026-06-26T10:50:40.841967Z"},"links":{"cited_paper":"/paper/1802.06480","citing_paper":"/paper/2606.22579"},"observation_digest":"sha256:429d72954b1d3c12cec66da347923b7f82e8cb2519624c0fd4c6dbb5637673bd","observation_id":"a1c9b681-888b-4615-b2ae-46af5d884d8f","resolution":{"observed_at":"2026-07-04T08:49:42.810841Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1802.06480/citation-record","integrity":"/paper/1802.06480/integrity","json":"/paper/1802.06480/citation-record.json","paper":"/paper/1802.06480"},"outbound":[],"paper":{"arxiv_id":"1802.06480","last_updated":"2018-02-19T01:25:26Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-14T19:44:43.864745Z","submitted_at":"2018-02-19T01:25:26Z","title":"Accelerated Primal-Dual Policy Optimization for Safe Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:1802.06480."}