{"as_of":"2026-08-12T11:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9c9604ed2f4eb98d1ff238f935c651a24d1d513a10ace7e201146eaf8ea74e0a","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T19:00:00.449779Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.10431/citation-record","integrity":"/paper/2502.10431/integrity","json":"/paper/2502.10431/citation-record.json","paper":"/paper/2502.10431"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.867201Z","title":null,"venue":null,"work_id":"01b58041-2e39-423f-8c64-e96c62afe324","year":2022},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.320240Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:9c96a3b63492744506355886e81eabdb278888c1986881a2b9130a657417bdaf","observation_id":"e26ed5ac-6b5e-4cb3-9361-e30604cb35d2","resolution":{"observed_at":"2026-08-08T19:00:00.871617Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.853661Z","title":null,"venue":null,"work_id":"a1d238df-3f1a-4b31-8d3f-c5ab1929fd31","year":2017},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.325619Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:43347593be7e7eab79abc03ef596a13403bada2418fc2574ea7d8c3f7f78a550","observation_id":"9bee4a20-5f0d-4f65-9f2f-ad7b0363791c","resolution":{"observed_at":"2026-08-08T19:00:00.858089Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.838928Z","title":null,"venue":null,"work_id":"fff07ff7-1168-4cf4-a70b-2e188bf662ab","year":2019},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.330272Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:4763043e487d77b705d4a2d59997ead89f1935015471a7ec67a5dfa162dfbd11","observation_id":"0474f022-f15f-44ef-addd-ff1a774cfa78","resolution":{"observed_at":"2026-08-08T19:00:00.844003Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.823805Z","title":"C.; Ling, J.; and Kumar, A","venue":null,"work_id":"80e519b8-1877-4292-89cb-26424692b706","year":2023},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.335053Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:b9c9f8e5fd9a2cecc4a95b495ee55f7294dd9c4ad65a0e22499403251734bbd3","observation_id":"dc04cf35-734e-4b97-bbaa-614c2a4b5f39","resolution":{"observed_at":"2026-08-08T19:00:00.828322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.810149Z","title":null,"venue":null,"work_id":"116e0b66-1bab-487a-a344-51f515e9cf5b","year":2012},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.340094Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:e5213f46cfb312c855539f229840dfdcb9c472803d52980e39b2d229f1814eea","observation_id":"a18c8088-b928-49e8-9006-c1fa5ac2df42","resolution":{"observed_at":"2026-08-08T19:00:00.814543Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.796159Z","title":"H.; Sinha, A.; and Varakantham, P","venue":null,"work_id":"9426d938-9e0c-47eb-8de8-e291142fda78","year":2023},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.344922Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:d7c1a560689ddd8359f562be694c741deb3b7484f83263bf9b211b13f83a81fb","observation_id":"33f25a5b-a42f-4ace-a3bb-ba294357e50a","resolution":{"observed_at":"2026-08-08T19:00:00.800939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.08757","last_updated":"2018-01-26T11:11:18Z","snapshot_observed_at":"2026-08-09T14:33:35.632300Z","submitted_at":"2018-01-26T11:11:18Z","title":"Safe Exploration in Continuous Action Spaces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.08757","snapshot_observed_at":"2026-08-08T19:00:00.350069Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.350069Z"},"links":{"cited_paper":"/paper/1801.08757","citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:2c51cfe28f3e7f63cdca410fad2e364595e1812ed4f6708e0fa08012e1e242f9","observation_id":"e4980115-9285-4948-8370-37b959f59f20","resolution":{"observed_at":"2026-08-08T19:00:00.350069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.782931Z","title":null,"venue":null,"work_id":"d36f84f6-8446-427a-838f-aba7a0efd963","year":2016},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.355339Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:12113948464841a408b92dbee3a56d7b3ba86e2d4c3f189addaa2a2043e7c0e9","observation_id":"51f3918a-128e-4b36-80ed-5bca3c3892df","resolution":{"observed_at":"2026-08-08T19:00:00.786649Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.770440Z","title":null,"venue":null,"work_id":"d76b4635-d5b6-4e26-b22b-e7641c26d67f","year":2019},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.359777Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:be7cbab75732662f21c384128b3e34b92360127b1cb1e3dde2aeff08ca5e422f","observation_id":"5aac8e23-ea69-4ec2-b8aa-5ce0b39f39dc","resolution":{"observed_at":"2026-08-08T19:00:00.774157Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.364198Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.364198Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:46da2bc015ad07c99e0dd83cbc9af6e12becd7e3e2c57119f2230eacc9fece56","observation_id":"cca2b393-a8c0-4a25-944f-2d740ada1f84","resolution":{"observed_at":"2026-08-08T19:00:00.364198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.746776Z","title":null,"venue":null,"work_id":"5154dc74-5c18-4c2d-b8cd-58a74c47b483","year":2023},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.368883Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:a06fcad28cebeb38a7a8cdecfa5a0de7afba178cccd90b4ab4adbadfa27ce092","observation_id":"f7d1e951-b2c3-4f7e-b01d-063d7ab940fd","resolution":{"observed_at":"2026-08-08T19:00:00.751044Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.732698Z","title":null,"venue":null,"work_id":"1da8a0c5-5907-4454-af22-31f3e44dcf21","year":2020},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.373207Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:50f71df1c9e6bc4bc57af7d50965663fa069e4486a5c4e99e6e64e0e13f9d1bc","observation_id":"044a8f1e-f3ae-4178-96fd-8a99bb0c5903","resolution":{"observed_at":"2026-08-08T19:00:00.736898Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-08T19:00:00.378829Z","title":"P.; and Welling, M","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.378829Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:f03ee0a90c3d3c12ee50c97393337802c9f3c2c15bcc5126081c64e09039f778","observation_id":"ae22e4fd-3978-4176-8ca5-36821e9231e0","resolution":{"observed_at":"2026-08-08T19:00:00.378829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.718445Z","title":"P.; Hunt, J","venue":null,"work_id":"b69f94af-3415-4bf2-ae9b-7254495b0e67","year":2016},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.383476Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:a5529784017f3585cc3ea71316ca0f11a51e7fa71608d9c8e1679af10b6ded9d","observation_id":"fdfb2bb5-8ecd-4677-8a7c-2dc4338f8417","resolution":{"observed_at":"2026-08-08T19:00:00.723002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.704633Z","title":null,"venue":null,"work_id":"d62949f4-7317-4664-b903-6574169fc50f","year":2021},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.387866Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:e44e0202834c9d1f24846a85c73221982301667dcc9d91da4ec2bf4568cfe8eb","observation_id":"43e1ae76-31e5-4eb0-8b63-1b4180489a51","resolution":{"observed_at":"2026-08-08T19:00:00.709104Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.690324Z","title":null,"venue":null,"work_id":"279ac23b-4c11-4a6e-882b-7e347a418915","year":2021},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.392294Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:6a1fd21b0e0b25cb2eb52d5cfe5ac1a8f62982b58215c5e58de5b24b64fa7ee2","observation_id":"66b08cd2-fe3a-44f6-9e60-19a64d3f1df5","resolution":{"observed_at":"2026-08-08T19:00:00.695081Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.676896Z","title":null,"venue":null,"work_id":"2f42b2b3-7a25-49d5-b906-2fdd5884eb32","year":2020},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.396716Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:9a0bed48435eafa41759dc60ceed9612b61c22cfc49a83556f585115c5891bab","observation_id":"a4fb8899-01bc-436b-8142-24bbcf6a4af4","resolution":{"observed_at":"2026-08-08T19:00:00.681231Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.401038Z","title":"A.; Veness, J.; Bellemare, M","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.401038Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:3d001be687ee7ddfbc2d56b2045253e87e9f22974d15272060a1acd7f54cdad1","observation_id":"ab3ae500-cce9-410c-8934-550000fd2f88","resolution":{"observed_at":"2026-08-08T19:00:00.401038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.653244Z","title":null,"venue":null,"work_id":"3cc53a01-0657-4a4e-81a2-acec4df4e216","year":2020},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.405375Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:c1d483156ce5ee7cd569f37b625bf24d084d1b69e445d86e757ed2aab6021b33","observation_id":"59ac2035-6c26-43db-8989-27f940d4fca8","resolution":{"observed_at":"2026-08-08T19:00:00.658233Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.639044Z","title":"J.; Mohamed, S.; and Lakshminarayanan, B","venue":null,"work_id":"7dc3de6c-4877-4c7a-af7f-42d9001385f1","year":2021},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.409632Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:1eaac814a816cd07fa04527b1af3b89e65d4284e31f77895562e8a76624ea85d","observation_id":"3a91985c-5007-4b89-876d-c75bada43076","resolution":{"observed_at":"2026-08-08T19:00:00.643358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.625085Z","title":null,"venue":null,"work_id":"8f027166-fb5c-4435-b00d-5e5977596248","year":2018},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.414027Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:4a74b06868dcf2e7b011bc5e8654960e3db5fda5d848e59fc674aa6869591594","observation_id":"9ff7e777-d457-41f6-b4ad-1f475ee8e079","resolution":{"observed_at":"2026-08-08T19:00:00.629591Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.610649Z","title":null,"venue":null,"work_id":"37c04068-0aaa-4194-a86a-3340e069dfb3","year":2015},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.418270Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:91da58eb91056bb4479907ce53235564a5f6ca8afb53fc3cac7f3bf0bcf0deac","observation_id":"8a86831c-da94-40e4-b44c-63a0d5089863","resolution":{"observed_at":"2026-08-08T19:00:00.614937Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.596553Z","title":"E.; Ibarz, J.; Finn, C.; and Goldberg, K","venue":null,"work_id":"4608d941-239d-43f3-a4a4-eb4fe59bad81","year":2021},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.422603Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:14bbc2503cb52963d8cc60605e7d67699e619f2053fcd97c6cce935387a82598","observation_id":"58b77229-7eb8-45d4-ba84-13e106d7ae8e","resolution":{"observed_at":"2026-08-08T19:00:00.601108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.581357Z","title":null,"venue":null,"work_id":"6d5df4a7-deca-4ef1-ab49-82a778820f23","year":2012},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.426331Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:60569cf37c791eabb85684b8397e4b6c4ad6bb8052f3f1122defd65739a1c95f","observation_id":"30bf8d77-867f-4a52-9cdd-0b8a53b3179c","resolution":{"observed_at":"2026-08-08T19:00:00.586137Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.429902Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.429902Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:170cdcc8641bf22aab5fa704db91c45fe4e0f2e44ba1638df5fefad76124856f","observation_id":"2850a9e1-2df9-4a1e-8782-82c5ce035e38","resolution":{"observed_at":"2026-08-08T19:00:00.429902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.02771","last_updated":"2019-06-06T18:43:19Z","snapshot_observed_at":"2026-08-07T02:33:44.116188Z","submitted_at":"2019-06-06T18:43:19Z","title":"Improving Exploration in Soft-Actor-Critic with Normalizing Flows Policies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.02771","snapshot_observed_at":"2026-08-08T19:00:00.433301Z","title":"N.; Smofsky, A.; and Bose, A","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.433301Z"},"links":{"cited_paper":"/paper/1906.02771","citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:2672b40d6b6591957e2f48c0d2b89e84dd55b3938c6bb347924792be22c354a8","observation_id":"c9ded236-c6ab-493d-8c08-18b05c5384d1","resolution":{"observed_at":"2026-08-08T19:00:00.433301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.556971Z","title":null,"venue":null,"work_id":"3fc4e0d4-3b09-4432-88e8-e82a71cb5be0","year":2023},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.437060Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:66e7ce6693eca2d63d0a2648dd0d6f9b72a43dfa6665f280ebbd9c8fc950820f","observation_id":"aaa1a709-b8cf-42ad-a171-87f4c3bf124b","resolution":{"observed_at":"2026-08-08T19:00:00.562729Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03122","last_updated":"2023-06-30T19:12:31Z","snapshot_observed_at":"2026-08-11T02:09:16.770324Z","submitted_at":"2023-02-06T21:11:29Z","title":"State-wise Safe Reinforcement Learning: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03122","snapshot_observed_at":"2026-08-08T19:00:00.440808Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.440808Z"},"links":{"cited_paper":"/paper/2302.03122","citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:08643e2a1e9e9df41bf5ef4f82bc478de85437b24e72db9403f42b1f3b36777f","observation_id":"54538de1-aa23-4c20-b6c2-5bd8e2cfe1de","resolution":{"observed_at":"2026-08-08T19:00:00.440808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.445079Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.445079Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:61a441ba2c4e3a106d431b94fc0ea8af3fe632f297b93f85be66dea5f91b47ff","observation_id":"bdcbdd19-f224-41fa-8197-0b3f5f788996","resolution":{"observed_at":"2026-08-08T19:00:00.445079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:00:00.449779Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-08T19:00:00.449779Z"},"links":{"citing_paper":"/paper/2502.10431"},"observation_digest":"sha256:362e330c6ad8518ad06e9816a53bc0fc8465f40b947d789262b7a52cadc726a6","observation_id":"c922132a-b2e7-478a-8663-8b662d24f0d4","resolution":{"observed_at":"2026-08-08T19:00:00.449779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.10431","last_updated":"2025-02-08T12:58:26Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T20:59:23.882980Z","submitted_at":"2025-02-08T12:58:26Z","title":"Leveraging Constraint Violation Signals For Action-Constrained Reinforcement Learning"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2502.10431."}