{"as_of":"2026-08-16T06:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:561827ab5bcbc1a591e3b9ea5e8bab9ca8f6dcf9a37996c10c79a4c3ccef691f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":19,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:01:08.588304Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T08:49:42.827587Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-08-10T08:43:44.490290Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-08-12T05:55:14.664113Z","title":"Available: https://arxiv.org/abs/2010.03152","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2411.19809","last_updated":"2024-11-29T16:16:59Z","snapshot_observed_at":"2026-08-13T19:09:14.188608Z","submitted_at":"2024-11-29T16:16:59Z","title":"Q-learning-based Model-free Safety Filter","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-12T05:55:14.664113Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2411.19809"},"observation_digest":"sha256:fc274943a54e5ec795934cb54b767cbb6f429f6b5fa716980bc25a5ed8dcec1f","observation_id":"57d2901b-701d-40f7-88a2-c35fb3078c04","resolution":{"observed_at":"2026-08-12T05:55:14.664113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-08-10T08:43:44.490290Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-08-11T17:32:14.336803Z","title":"Projection-based constrained policy optimization,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.08920","last_updated":"2025-08-05T09:50:26Z","snapshot_observed_at":"2026-08-15T19:28:42.463216Z","submitted_at":"2024-12-12T04:06:54Z","title":"From Text to Trajectory: Exploring Complex Constraint Representation and Decomposition in Safe Reinforcement Learning","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T17:32:14.336803Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2412.08920"},"observation_digest":"sha256:b4d6f70a6c367e2c671b69a99c0c79c4639811f560b3341f2df77e7a57b28f3c","observation_id":"4d7c7c40-858a-4ad7-90ca-42aef69426f9","resolution":{"observed_at":"2026-08-11T17:32:14.336803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-08-10T08:43:44.490290Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-08-11T15:20:56.540973Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.11138","last_updated":"2024-12-15T10:05:23Z","snapshot_observed_at":"2026-08-11T15:13:55.109460Z","submitted_at":"2024-12-15T10:05:23Z","title":"Safe Reinforcement Learning using Finite-Horizon Gradient-based Estimation","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-11T15:20:56.540973Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2412.11138"},"observation_digest":"sha256:7fcbced529d583a398db6569b82cdc45b909348f3081b37ae619bec5e40728ca","observation_id":"f7d4c6dd-6a6a-4971-9ab3-bf5fcb76046f","resolution":{"observed_at":"2026-08-11T15:20:56.540973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-08-10T08:43:44.490290Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-08-11T13:25:20.519329Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.13184","last_updated":"2024-12-17T18:58:00Z","snapshot_observed_at":"2026-08-13T19:09:19.533191Z","submitted_at":"2024-12-17T18:58:00Z","title":"Tilted Quantile Gradient Updates for Quantile-Constrained Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T13:25:20.519329Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2412.13184"},"observation_digest":"sha256:2ce0b530ad860d30494774c2f294048f395f355054a25f647cd247ce40356c15","observation_id":"0d99bba0-a693-46f3-9ef9-bf4d1c4f5b14","resolution":{"observed_at":"2026-08-11T13:25:20.519329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-08-10T08:43:44.490290Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-08-11T12:40:45.599554Z","title":"Projection- based constrained policy optimization,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.14002","last_updated":"2024-12-18T16:17:25Z","snapshot_observed_at":"2026-08-14T22:23:08.376654Z","submitted_at":"2024-12-18T16:17:25Z","title":"Operator Splitting for Convex Constrained Markov Decision Processes","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T12:40:45.599554Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2412.14002"},"observation_digest":"sha256:5afa0b24498e39d6ffeaa2fd00bd21fa17d278406e4811cf276aca14fd3edd64","observation_id":"d9ca5f64-4792-4ad5-8b81-cca65e75d970","resolution":{"observed_at":"2026-08-11T12:40:45.599554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-08-10T08:43:44.490290Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-08-15T20:01:08.588304Z","title":"Projection-based constrained policy optimization","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.588304Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:aa402a33c98569014d790dfac823463365462cabbfb27fa8eddf707efbdf9ced","observation_id":"311564d5-b7e6-4960-aa54-f66b851479f6","resolution":{"observed_at":"2026-08-15T20:01:08.588304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-08-10T08:43:44.490290Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-08-06T21:20:29.464007Z","title":"[Yang et al., 2020] Tsung-Yen Yang, Justinian Rosca, Karthik Narasimhan, and Peter J","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.00485","last_updated":"2025-07-01T06:59:59Z","snapshot_observed_at":"2026-08-08T23:58:34.928099Z","submitted_at":"2025-07-01T06:59:59Z","title":"PNAct: Crafting Backdoor Attacks in Safe Reinforcement Learning","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T21:20:29.464007Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2507.00485"},"observation_digest":"sha256:e78a6110af04cf366c702b071b19ed41b5224dbbe224b023c16325d482df4d6c","observation_id":"c45262ad-fe4e-41fd-b2cf-23cf9243c6ec","resolution":{"observed_at":"2026-08-06T21:20:29.464007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-08-10T08:43:44.490290Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-08-06T05:26:39.944282Z","title":"Projection-based constrained policy optimization","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.01883","last_updated":"2025-08-06T13:50:53Z","snapshot_observed_at":"2026-08-08T13:28:02.704323Z","submitted_at":"2025-08-03T18:35:55Z","title":"Proactive Constrained Policy Optimization with Preemptive Penalty","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T05:26:39.944282Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2508.01883"},"observation_digest":"sha256:c03419ba6e124532f27723bed15af7f649d9b9ef504388e3f4dc7e68e889e2de","observation_id":"69baed02-188c-4f37-84b3-29394e97d553","resolution":{"observed_at":"2026-08-06T05:26:39.944282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-08-10T08:43:44.490290Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-08-05T19:28:42.568008Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.12518","last_updated":"2025-08-17T22:51:27Z","snapshot_observed_at":"2026-08-10T21:10:23.169256Z","submitted_at":"2025-08-17T22:51:27Z","title":"Towards Adaptive External Communication in Autonomous Vehicles: A Conceptual Design Framework","version":1},"reference_index":145,"source":"pdf_text","source_observed_at":"2026-08-05T19:28:42.568008Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2508.12518"},"observation_digest":"sha256:66a8b616b14820a84c71a64905fd194d4e5aaf026545f858425d317f62008f3e","observation_id":"5bd81fc8-9bc4-4a4e-ba30-9110a2ae3d83","resolution":{"observed_at":"2026-08-05T19:28:42.568008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-08-10T08:43:44.490290Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-08-05T16:13:08.329208Z","title":"Projection-based constrained policy optimization","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.18884","last_updated":"2025-08-26T09:59:44Z","snapshot_observed_at":"2026-08-15T01:50:44.508070Z","submitted_at":"2025-08-26T09:59:44Z","title":"HAEPO: History-Aggregated Exploratory Policy Optimization","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:08.329208Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2508.18884"},"observation_digest":"sha256:68185311fb1759590154c20078cf066fd3440ae2415c272ca0cfbc673cf68232","observation_id":"54f2db2d-3e3b-4647-bc16-4aba70695daa","resolution":{"observed_at":"2026-08-05T16:13:08.329208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-08-10T08:43:44.490290Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":"2010.03152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-07-04T08:49:42.827587Z","title":"Projection-based constrained policy optimization","venue":null,"work_id":"75762d92-0be1-48c0-853c-6ea6bcc061d7","year":2010},"citing_paper":{"arxiv_id":"2512.06600","last_updated":"2026-05-08T14:44:19Z","snapshot_observed_at":"2026-08-16T00:38:30.886980Z","submitted_at":"2025-12-06T23:57:03Z","title":"Learning Reachability of Energy Storage Arbitrage","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-17T00:09:57.342909Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2512.06600"},"observation_digest":"sha256:b33cf07c98fea6377be2b9472036a3064f0537d659450e619daf1102a591f582","observation_id":"9d66733f-0c55-4b67-b2d9-06229e753e3c","resolution":{"observed_at":"2026-05-17T00:11:23.314646Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-08-10T08:43:44.490290Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":"2010.03152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-07-04T08:49:42.827587Z","title":"Projection-based constrained policy optimization","venue":null,"work_id":"75762d92-0be1-48c0-853c-6ea6bcc061d7","year":2010},"citing_paper":{"arxiv_id":"2605.11688","last_updated":"2026-05-12T07:46:03Z","snapshot_observed_at":"2026-08-11T15:34:26.253795Z","submitted_at":"2026-05-12T07:46:03Z","title":"Shaping Zero-Shot Coordination via State Blocking","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-13T07:42:23.260464Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2605.11688"},"observation_digest":"sha256:e26a7d3e3b1eca74362a5f2352c541ace3da79a0a82db50c3f5ae80dae45a2f0","observation_id":"74cbb9dd-b34a-4e9a-a670-d1f326ae747b","resolution":{"observed_at":"2026-05-13T07:42:30.202198Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-08-10T08:43:44.490290Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":"2010.03152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-07-04T08:49:42.827587Z","title":"Projection-based constrained policy optimization","venue":null,"work_id":"75762d92-0be1-48c0-853c-6ea6bcc061d7","year":2010},"citing_paper":{"arxiv_id":"2605.11975","last_updated":"2026-05-18T06:36:11Z","snapshot_observed_at":"2026-08-11T00:08:23.241105Z","submitted_at":"2026-05-12T11:31:36Z","title":"Stochastic Minimum-Cost Reach-Avoid Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:24.455817Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2605.11975"},"observation_digest":"sha256:1c8d0072e68182948792360d0411872824bc9b99bf05d64f8528f48573b5ef98","observation_id":"3707cb9f-bf1c-4307-94ab-185a1bb1573f","resolution":{"observed_at":"2026-05-13T07:32:30.563478Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-08-10T08:43:44.490290Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":"2010.03152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-07-04T08:49:42.827587Z","title":"Projection-based constrained policy optimization","venue":null,"work_id":"75762d92-0be1-48c0-853c-6ea6bcc061d7","year":2010},"citing_paper":{"arxiv_id":"2605.11975","last_updated":"2026-05-18T06:36:11Z","snapshot_observed_at":"2026-08-11T00:08:23.241105Z","submitted_at":"2026-05-12T11:31:36Z","title":"Stochastic Minimum-Cost Reach-Avoid Reinforcement Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T22:48:55.661356Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2605.11975"},"observation_digest":"sha256:1e4572ce960ac1f5f0b17a2e17fd8f181580a5ef4a6a1fc112c173cf7b1ecc65","observation_id":"377cdaa2-8b56-4df6-8339-484b1c0cc31d","resolution":{"observed_at":"2026-05-20T22:49:10.091288Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-08-10T08:43:44.490290Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":"2010.03152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-07-04T08:49:42.827587Z","title":"Projection-based constrained policy optimization","venue":null,"work_id":"75762d92-0be1-48c0-853c-6ea6bcc061d7","year":2010},"citing_paper":{"arxiv_id":"2605.14174","last_updated":"2026-05-13T22:53:47Z","snapshot_observed_at":"2026-08-13T19:07:10.645124Z","submitted_at":"2026-05-13T22:53:47Z","title":"Safety-Constrained Reinforcement Learning with Post-Training Reachability Verification for Robot Navigation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-15T04:52:48.491036Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2605.14174"},"observation_digest":"sha256:75e368307c992864ad71512ba2ebee6aad456ff1b7521b06c3f64d9be914633f","observation_id":"b65ad3bb-b558-49a0-a9b5-dbc898cded5a","resolution":{"observed_at":"2026-05-15T04:55:03.697736Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-08-10T08:43:44.490290Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":"2010.03152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-07-04T08:49:42.827587Z","title":"Projection-based constrained policy optimization","venue":null,"work_id":"75762d92-0be1-48c0-853c-6ea6bcc061d7","year":2010},"citing_paper":{"arxiv_id":"2605.14246","last_updated":"2026-05-14T01:23:09Z","snapshot_observed_at":"2026-08-13T19:08:08.660958Z","submitted_at":"2026-05-14T01:23:09Z","title":"Action-Conditioned Risk Gating for Safety-Critical Control under Partial Observability","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-15T02:50:40.285132Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2605.14246"},"observation_digest":"sha256:bc2a8e4dfcd657e5a5ef5665a9f4011a38ab94f773e5e978f6b36457850b105c","observation_id":"5302c802-cf66-4d30-9860-41e11ba0c694","resolution":{"observed_at":"2026-05-15T02:53:33.836749Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-08-10T08:43:44.490290Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":"2010.03152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-07-04T08:49:42.827587Z","title":"Projection-based constrained policy optimization","venue":null,"work_id":"75762d92-0be1-48c0-853c-6ea6bcc061d7","year":2010},"citing_paper":{"arxiv_id":"2606.22579","last_updated":"2026-06-21T16:29:25Z","snapshot_observed_at":"2026-08-02T07:11:59.062207Z","submitted_at":"2026-06-21T16:29:25Z","title":"Stationary Robust Mean-Field Games under Model Mismatches","version":1},"reference_index":193,"source":"arxiv_source","source_observed_at":"2026-06-26T10:50:40.841967Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2606.22579"},"observation_digest":"sha256:4ac7a480b39f056d1fffffea5956ea7c2310bf3425d966e5852bf73547e5bd05","observation_id":"f72318d1-fc15-43de-9c53-e04372183f8b","resolution":{"observed_at":"2026-07-04T08:49:42.828921Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-08-10T08:43:44.490290Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":"2010.03152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-07-04T08:49:42.827587Z","title":"Projection-based constrained policy optimization","venue":null,"work_id":"75762d92-0be1-48c0-853c-6ea6bcc061d7","year":2010},"citing_paper":{"arxiv_id":"2606.27861","last_updated":"2026-06-26T08:59:38Z","snapshot_observed_at":"2026-08-14T09:55:43.968590Z","submitted_at":"2026-06-26T08:59:38Z","title":"PPO-EAL: Exact Augmented Lagrangian Proximal Policy Optimization for Safe Robotic Control","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T04:49:22.328169Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2606.27861"},"observation_digest":"sha256:3674e01d1cc0f411277759e03bc590aff1fbb832bb769f829ab9f252e79c7fce","observation_id":"72aa2f1c-96ae-495b-a307-7c421392e84d","resolution":{"observed_at":"2026-06-29T19:13:53.387161Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-08-10T08:43:44.490290Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":"2010.03152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-07-04T08:49:42.827587Z","title":"Projection-based constrained policy optimization","venue":null,"work_id":"75762d92-0be1-48c0-853c-6ea6bcc061d7","year":2010},"citing_paper":{"arxiv_id":"2606.28217","last_updated":"2026-06-26T16:08:36Z","snapshot_observed_at":"2026-08-16T00:37:44.649789Z","submitted_at":"2026-06-26T16:08:36Z","title":"Towards Value-Constrained Credit Assignment in Fully Delegated AI Cooperatives","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T04:27:10.983662Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2606.28217"},"observation_digest":"sha256:b16bc953eccf507281b7b62262f7c3349e5d57c9588d5b2c20e779dcf96e4ac1","observation_id":"358b8717-05b9-4301-89fc-6bd17154ec29","resolution":{"observed_at":"2026-07-01T16:55:51.013454Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2010.03152/citation-record","integrity":"/paper/2010.03152/integrity","json":"/paper/2010.03152/citation-record.json","paper":"/paper/2010.03152"},"outbound":[],"paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T08:43:44.490290Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 19 inbound Pith citation observations for arXiv:2010.03152."}