{"as_of":"2026-08-22T12:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5b9f568f8336853390d34c1d47049895530faa0aa0356e532fc0c0382b2d0a7b","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T21:46:47.809846Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.04153/citation-record","integrity":"/paper/2412.04153/integrity","json":"/paper/2412.04153/citation-record.json","paper":"/paper/2412.04153"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:46:47.690685Z","title":"Constrained policy optimization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.04153","last_updated":"2025-04-18T13:37:59Z","snapshot_observed_at":"2026-08-15T10:52:17.229828Z","submitted_at":"2024-12-05T13:32:02Z","title":"A Dynamic Safety Shield for Safe and Efficient Reinforcement Learning of Navigation Tasks","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T21:46:47.690685Z"},"links":{"citing_paper":"/paper/2412.04153"},"observation_digest":"sha256:02b1a90f3cd6eaff27bd02871b2970dbccbd229514cf9e2cd8e955c14f70deb4","observation_id":"fdf42074-223c-41fb-a76f-832d17f5d8e1","resolution":{"observed_at":"2026-08-11T21:46:47.690685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:46:48.353971Z","title":"Exploring under constraints with model-based actor-critic and safety filters","venue":null,"work_id":"cc2dce9c-3b5c-42ec-8d5e-d55620628a36","year":2024},"citing_paper":{"arxiv_id":"2412.04153","last_updated":"2025-04-18T13:37:59Z","snapshot_observed_at":"2026-08-15T10:52:17.229828Z","submitted_at":"2024-12-05T13:32:02Z","title":"A Dynamic Safety Shield for Safe and Efficient Reinforcement Learning of Navigation Tasks","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T21:46:47.697056Z"},"links":{"citing_paper":"/paper/2412.04153"},"observation_digest":"sha256:b9fd76fceba4f93ad61bdeddd13cd4adb582012133372053348e808be2cb7d2d","observation_id":"35b2f30b-af06-4c7e-a3e8-9753179948df","resolution":{"observed_at":"2026-08-11T21:46:48.359758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:46:48.336431Z","title":"Control barrier functions: Theory and applications","venue":null,"work_id":"13e19df5-8091-46c3-bfc1-a5a96248a427","year":2019},"citing_paper":{"arxiv_id":"2412.04153","last_updated":"2025-04-18T13:37:59Z","snapshot_observed_at":"2026-08-15T10:52:17.229828Z","submitted_at":"2024-12-05T13:32:02Z","title":"A Dynamic Safety Shield for Safe and Efficient Reinforcement Learning of Navigation Tasks","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T21:46:47.702503Z"},"links":{"citing_paper":"/paper/2412.04153"},"observation_digest":"sha256:c4b679f2cdf7e108486ffe014905fa8d301a73dea9dec0a2508ddee468c8d44f","observation_id":"89dadc74-6225-4b55-801a-beac0ef708d4","resolution":{"observed_at":"2026-08-11T21:46:48.341772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:46:48.321170Z","title":"o m and Tore H \\","venue":null,"work_id":"f181dbb5-70aa-4c34-8b54-f8b36ca609a9","year":2006},"citing_paper":{"arxiv_id":"2412.04153","last_updated":"2025-04-18T13:37:59Z","snapshot_observed_at":"2026-08-15T10:52:17.229828Z","submitted_at":"2024-12-05T13:32:02Z","title":"A Dynamic Safety Shield for Safe and Efficient Reinforcement Learning of Navigation Tasks","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T21:46:47.707940Z"},"links":{"citing_paper":"/paper/2412.04153"},"observation_digest":"sha256:078a1526e8b5358ba7873a09f1c65384905b0629ec2a9e230686ebb7fcffe193","observation_id":"475acf9e-724e-4b35-9435-cb3c320cfc67","resolution":{"observed_at":"2026-08-11T21:46:48.325928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:46:48.304900Z","title":"Where to go next: learning a subgoal recommendation policy for navigation in dynamic environments","venue":null,"work_id":"8d66e9a4-d447-4dbe-8547-8902ceebb87d","year":2021},"citing_paper":{"arxiv_id":"2412.04153","last_updated":"2025-04-18T13:37:59Z","snapshot_observed_at":"2026-08-15T10:52:17.229828Z","submitted_at":"2024-12-05T13:32:02Z","title":"A Dynamic Safety Shield for Safe and Efficient Reinforcement Learning of Navigation Tasks","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T21:46:47.713804Z"},"links":{"citing_paper":"/paper/2412.04153"},"observation_digest":"sha256:0eab61661affbb195f8625ef1839e5274abec3f4fa890f3479b77458dc5d5968","observation_id":"8de02ea4-4d5e-4a3b-a7ee-0444ed7ae8ea","resolution":{"observed_at":"2026-08-11T21:46:48.310211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:46:48.288654Z","title":"Safe reinforcement learning via shielding under partial observability","venue":null,"work_id":"bf5aa10e-2e8a-4bad-b58e-83eaa49407aa","year":2023},"citing_paper":{"arxiv_id":"2412.04153","last_updated":"2025-04-18T13:37:59Z","snapshot_observed_at":"2026-08-15T10:52:17.229828Z","submitted_at":"2024-12-05T13:32:02Z","title":"A Dynamic Safety Shield for Safe and Efficient Reinforcement Learning of Navigation Tasks","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T21:46:47.719125Z"},"links":{"citing_paper":"/paper/2412.04153"},"observation_digest":"sha256:3bdf438efd96a27356f4b837fa2af22437671eb8f70bc494c449ca74d4b67c91","observation_id":"d159a33d-9900-4d2e-bb6a-7eca0da27359","resolution":{"observed_at":"2026-08-11T21:46:48.293847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:46:48.272059Z","title":"Pybullet, a python module for physics simulation for games, robotics and machine learning","venue":null,"work_id":"cb7863fb-7571-461f-a6cd-e38974b366f4","year":2016},"citing_paper":{"arxiv_id":"2412.04153","last_updated":"2025-04-18T13:37:59Z","snapshot_observed_at":"2026-08-15T10:52:17.229828Z","submitted_at":"2024-12-05T13:32:02Z","title":"A Dynamic Safety Shield for Safe and Efficient Reinforcement Learning of Navigation Tasks","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T21:46:47.724917Z"},"links":{"citing_paper":"/paper/2412.04153"},"observation_digest":"sha256:f36bfb7356f9dc77c2f0ba5a4882a5adc161d112b15ce8bcc9af2c0682cb7691","observation_id":"35afc550-2d84-41b9-b92c-fe203bd8da85","resolution":{"observed_at":"2026-08-11T21:46:48.277268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.08757","last_updated":"2018-01-26T11:11:18Z","snapshot_observed_at":"2026-08-15T12:58:42.845462Z","submitted_at":"2018-01-26T11:11:18Z","title":"Safe Exploration in Continuous Action Spaces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.08757","snapshot_observed_at":"2026-08-11T21:46:47.730387Z","title":"Safe exploration in continuous action spaces","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.04153","last_updated":"2025-04-18T13:37:59Z","snapshot_observed_at":"2026-08-15T10:52:17.229828Z","submitted_at":"2024-12-05T13:32:02Z","title":"A Dynamic Safety Shield for Safe and Efficient Reinforcement Learning of Navigation Tasks","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T21:46:47.730387Z"},"links":{"cited_paper":"/paper/1801.08757","citing_paper":"/paper/2412.04153"},"observation_digest":"sha256:5d12cb5cccc9ac79b9d298caf3ac9a69405146ac7b733a00363776ece7995cd5","observation_id":"17b2177e-567d-45b3-aafc-e8d564f39a66","resolution":{"observed_at":"2026-08-11T21:46:47.730387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2312.12861","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:46:48.100064Z","title":"Safe multi-agent reinforcement learning for behavior-based cooperative navigation","venue":null,"work_id":"d97e3d66-d6a2-464f-a76f-b92d9b57394f","year":2025},"citing_paper":{"arxiv_id":"2412.04153","last_updated":"2025-04-18T13:37:59Z","snapshot_observed_at":"2026-08-15T10:52:17.229828Z","submitted_at":"2024-12-05T13:32:02Z","title":"A Dynamic Safety Shield for Safe and Efficient Reinforcement Learning of Navigation Tasks","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T21:46:47.735758Z"},"links":{"citing_paper":"/paper/2412.04153"},"observation_digest":"sha256:4fe45ddecf81cbb8cc0a936313760d46cac908e72bf60000730784aa1101f9d3","observation_id":"db2338fe-5da7-4bb3-8f2e-fe10f3635950","resolution":{"observed_at":"2026-08-11T21:46:48.110539Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:46:47.740847Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.04153","last_updated":"2025-04-18T13:37:59Z","snapshot_observed_at":"2026-08-15T10:52:17.229828Z","submitted_at":"2024-12-05T13:32:02Z","title":"A Dynamic Safety Shield for Safe and Efficient Reinforcement Learning of Navigation Tasks","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T21:46:47.740847Z"},"links":{"citing_paper":"/paper/2412.04153"},"observation_digest":"sha256:4a873a3f1b23d048d771b4ee6817b000f527e060aa6654eb9ad8ceaf6b6f503e","observation_id":"e78072dd-f704-4be9-8797-e452200db7d1","resolution":{"observed_at":"2026-08-11T21:46:47.740847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.17583","last_updated":"2024-05-21T05:49:52Z","snapshot_observed_at":"2026-08-16T14:22:59.937996Z","submitted_at":"2024-01-31T03:58:28Z","title":"Agile But Safe: Learning Collision-Free High-Speed Legged Locomotion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.17583","snapshot_observed_at":"2026-08-11T21:46:47.746141Z","title":"Agile but safe: Learning collision-free high-speed legged locomotion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04153","last_updated":"2025-04-18T13:37:59Z","snapshot_observed_at":"2026-08-15T10:52:17.229828Z","submitted_at":"2024-12-05T13:32:02Z","title":"A Dynamic Safety Shield for Safe and Efficient Reinforcement Learning of Navigation Tasks","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T21:46:47.746141Z"},"links":{"cited_paper":"/paper/2401.17583","citing_paper":"/paper/2412.04153"},"observation_digest":"sha256:38c11cbedb5794fce0c4ef1a1f6c41c8bd7fcd7d14f809895f9ac3c8797dc181","observation_id":"9e25fbf4-1c99-4956-a469-a5eb116a5f8f","resolution":{"observed_at":"2026-08-11T21:46:47.746141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07176","last_updated":"2024-08-07T19:08:36Z","snapshot_observed_at":"2026-08-16T15:16:19.883933Z","submitted_at":"2023-07-14T06:00:08Z","title":"SafeDreamer: Safe Reinforcement Learning with World Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.07176","snapshot_observed_at":"2026-08-11T21:46:47.751481Z","title":"Safe dreamerv3: Safe reinforcement learning with world models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04153","last_updated":"2025-04-18T13:37:59Z","snapshot_observed_at":"2026-08-15T10:52:17.229828Z","submitted_at":"2024-12-05T13:32:02Z","title":"A Dynamic Safety Shield for Safe and Efficient Reinforcement Learning of Navigation Tasks","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T21:46:47.751481Z"},"links":{"cited_paper":"/paper/2307.07176","citing_paper":"/paper/2412.04153"},"observation_digest":"sha256:433928e98deef97880e6188e8b3de7b1571a8d5fd40199cf30b93db4b75fbf1a","observation_id":"e576be2f-df30-48da-a4f2-c6ef8a46f042","resolution":{"observed_at":"2026-08-11T21:46:47.751481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09304","last_updated":"2023-05-16T09:22:14Z","snapshot_observed_at":"2026-08-16T15:32:44.347057Z","submitted_at":"2023-05-16T09:22:14Z","title":"OmniSafe: An Infrastructure for Accelerating Safe Reinforcement Learning Research","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.09304","snapshot_observed_at":"2026-08-11T21:46:47.756731Z","title":"Omnisafe: An infrastructure for accelerating safe reinforcement learning research","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04153","last_updated":"2025-04-18T13:37:59Z","snapshot_observed_at":"2026-08-15T10:52:17.229828Z","submitted_at":"2024-12-05T13:32:02Z","title":"A Dynamic Safety Shield for Safe and Efficient Reinforcement Learning of Navigation Tasks","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T21:46:47.756731Z"},"links":{"cited_paper":"/paper/2305.09304","citing_paper":"/paper/2412.04153"},"observation_digest":"sha256:d31125fad98d1f767b5a207967d674a756c61d83a7b7d6c9c961460f78f7e6c9","observation_id":"cb1ef198-49d5-49f5-b475-be205d3957ff","resolution":{"observed_at":"2026-08-11T21:46:47.756731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01708","last_updated":"2019-10-03T20:15:55Z","snapshot_observed_at":"2026-08-14T05:35:42.838302Z","submitted_at":"2019-10-03T20:15:55Z","title":"Benchmarking Batch Deep Reinforcement Learning Algorithms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01708","snapshot_observed_at":"2026-08-11T21:46:47.761953Z","title":"Benchmarking safe exploration in deep reinforcement learning","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2412.04153","last_updated":"2025-04-18T13:37:59Z","snapshot_observed_at":"2026-08-15T10:52:17.229828Z","submitted_at":"2024-12-05T13:32:02Z","title":"A Dynamic Safety Shield for Safe and Efficient Reinforcement Learning of Navigation Tasks","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T21:46:47.761953Z"},"links":{"cited_paper":"/paper/1910.01708","citing_paper":"/paper/2412.04153"},"observation_digest":"sha256:29dd733742f44a72fa0779896df55358b7cd2decd0c6c6bdcaaccf6918207112","observation_id":"601e906b-7322-4f7b-b574-398969d00804","resolution":{"observed_at":"2026-08-11T21:46:47.761953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:46:48.245760Z","title":"Saut \\'e rl: Almost surely safe reinforcement learning using state augmentation","venue":null,"work_id":"df1775ee-4393-4dd6-bb22-5ef4b08db45d","year":2022},"citing_paper":{"arxiv_id":"2412.04153","last_updated":"2025-04-18T13:37:59Z","snapshot_observed_at":"2026-08-15T10:52:17.229828Z","submitted_at":"2024-12-05T13:32:02Z","title":"A Dynamic Safety Shield for Safe and Efficient Reinforcement Learning of Navigation Tasks","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T21:46:47.767462Z"},"links":{"citing_paper":"/paper/2412.04153"},"observation_digest":"sha256:ab02f82d031eac503ead122d53a03fd52c93b6beeccc45f17c3c323b5e1cc7cc","observation_id":"63d412ca-88d1-4863-bba3-e29ff6fe59af","resolution":{"observed_at":"2026-08-11T21:46:48.250696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:46:47.772428Z","title":"Responsive safety in reinforcement learning by pid lagrangian methods","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.04153","last_updated":"2025-04-18T13:37:59Z","snapshot_observed_at":"2026-08-15T10:52:17.229828Z","submitted_at":"2024-12-05T13:32:02Z","title":"A Dynamic Safety Shield for Safe and Efficient Reinforcement Learning of Navigation Tasks","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T21:46:47.772428Z"},"links":{"citing_paper":"/paper/2412.04153"},"observation_digest":"sha256:8640363775328129fa010c035db3428fe2293ecd643bf44380929866a0d7028c","observation_id":"c744c90c-486e-4f35-af90-783531fffb19","resolution":{"observed_at":"2026-08-11T21:46:47.772428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.11074","last_updated":"2018-12-26T11:09:40Z","snapshot_observed_at":"2026-08-14T19:10:15.765536Z","submitted_at":"2018-05-28T17:31:11Z","title":"Reward Constrained Policy Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.11074","snapshot_observed_at":"2026-08-11T21:46:47.777452Z","title":"Reward constrained policy optimization","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.04153","last_updated":"2025-04-18T13:37:59Z","snapshot_observed_at":"2026-08-15T10:52:17.229828Z","submitted_at":"2024-12-05T13:32:02Z","title":"A Dynamic Safety Shield for Safe and Efficient Reinforcement Learning of Navigation Tasks","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T21:46:47.777452Z"},"links":{"cited_paper":"/paper/1805.11074","citing_paper":"/paper/2412.04153"},"observation_digest":"sha256:b959aaa23dbbd09f1cd88dff3beba9ef61a4241accd387e78362a738b2e737bc","observation_id":"6864f15d-b65f-438b-9e96-6555df89dc23","resolution":{"observed_at":"2026-08-11T21:46:47.777452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:46:48.217794Z","title":"Recovery rl: Safe reinforcement learning with learned recovery zones","venue":null,"work_id":"e3e60545-a16a-45cb-9043-d29e2f88f5c6","year":2021},"citing_paper":{"arxiv_id":"2412.04153","last_updated":"2025-04-18T13:37:59Z","snapshot_observed_at":"2026-08-15T10:52:17.229828Z","submitted_at":"2024-12-05T13:32:02Z","title":"A Dynamic Safety Shield for Safe and Efficient Reinforcement Learning of Navigation Tasks","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T21:46:47.783134Z"},"links":{"citing_paper":"/paper/2412.04153"},"observation_digest":"sha256:0915b5894a2239b315439a5c999ba84b844e92b37b98d5aff9f1fcf77769f187","observation_id":"09b25504-6a5c-4ab0-8408-c429518b6700","resolution":{"observed_at":"2026-08-11T21:46:48.223145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:46:48.201613Z","title":"Probabilistic model predictive safety certification for learning-based control","venue":null,"work_id":"c15d8177-d827-49c6-84d3-eb9953b12001","year":2021},"citing_paper":{"arxiv_id":"2412.04153","last_updated":"2025-04-18T13:37:59Z","snapshot_observed_at":"2026-08-15T10:52:17.229828Z","submitted_at":"2024-12-05T13:32:02Z","title":"A Dynamic Safety Shield for Safe and Efficient Reinforcement Learning of Navigation Tasks","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T21:46:47.788069Z"},"links":{"citing_paper":"/paper/2412.04153"},"observation_digest":"sha256:bac5263875facebc523ea6538a2319969f09729475b3b7fa988f3b009467ffca","observation_id":"04d10399-31f3-4457-b233-67bfba3530fa","resolution":{"observed_at":"2026-08-11T21:46:48.206780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:46:48.185551Z","title":"A predictive safety filter for learning-based control of constrained nonlinear dynamical systems","venue":null,"work_id":"c292a964-2b9c-48c0-b50f-0e7b8aaab791","year":2021},"citing_paper":{"arxiv_id":"2412.04153","last_updated":"2025-04-18T13:37:59Z","snapshot_observed_at":"2026-08-15T10:52:17.229828Z","submitted_at":"2024-12-05T13:32:02Z","title":"A Dynamic Safety Shield for Safe and Efficient Reinforcement Learning of Navigation Tasks","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T21:46:47.793312Z"},"links":{"citing_paper":"/paper/2412.04153"},"observation_digest":"sha256:2b57a9b19c939ebab169e1a03e4db05fc6c30938f9b7295314cd0d8d2b822b81","observation_id":"ce486482-9077-42d9-a849-e8c74d333747","resolution":{"observed_at":"2026-08-11T21:46:48.190864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:46:48.169091Z","title":"Benchmarking reinforcement learning techniques for autonomous navigation","venue":null,"work_id":"cd483f69-7673-4d29-80eb-75ca273fe253","year":2023},"citing_paper":{"arxiv_id":"2412.04153","last_updated":"2025-04-18T13:37:59Z","snapshot_observed_at":"2026-08-15T10:52:17.229828Z","submitted_at":"2024-12-05T13:32:02Z","title":"A Dynamic Safety Shield for Safe and Efficient Reinforcement Learning of Navigation Tasks","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T21:46:47.798565Z"},"links":{"citing_paper":"/paper/2412.04153"},"observation_digest":"sha256:362353edcf946e117a43d774b217fa54eae8f65fb630c39ab05e5045fb1d8d88","observation_id":"36dda262-eca5-4f18-8bed-3af90bd56238","resolution":{"observed_at":"2026-08-11T21:46:48.174087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.12639","last_updated":"2019-12-28T03:03:04Z","snapshot_observed_at":"2026-08-10T20:31:22.283484Z","submitted_at":"2019-10-25T01:26:04Z","title":"MAMPS: Safe Multi-Agent Reinforcement Learning via Model Predictive Shielding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.12639","snapshot_observed_at":"2026-08-11T21:46:47.804510Z","title":"Mamps: Safe multi-agent reinforcement learning via model predictive shielding","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2412.04153","last_updated":"2025-04-18T13:37:59Z","snapshot_observed_at":"2026-08-15T10:52:17.229828Z","submitted_at":"2024-12-05T13:32:02Z","title":"A Dynamic Safety Shield for Safe and Efficient Reinforcement Learning of Navigation Tasks","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T21:46:47.804510Z"},"links":{"cited_paper":"/paper/1910.12639","citing_paper":"/paper/2412.04153"},"observation_digest":"sha256:4343d99f6206d750f7aa4acd558f18d6e6346155899a895483a29605ca6c2ba7","observation_id":"b9854771-a858-46b6-8fd8-74d130a7f4f4","resolution":{"observed_at":"2026-08-11T21:46:47.804510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:46:48.152648Z","title":"Spatial-temporal-aware safe multi-agent reinforcement learning of connected autonomous vehicles in challenging scenarios","venue":null,"work_id":"11ede497-f8f7-4187-a1ad-8b63c5274a76","year":2023},"citing_paper":{"arxiv_id":"2412.04153","last_updated":"2025-04-18T13:37:59Z","snapshot_observed_at":"2026-08-15T10:52:17.229828Z","submitted_at":"2024-12-05T13:32:02Z","title":"A Dynamic Safety Shield for Safe and Efficient Reinforcement Learning of Navigation Tasks","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T21:46:47.809846Z"},"links":{"citing_paper":"/paper/2412.04153"},"observation_digest":"sha256:4099eba30777f94eff5516d7c0c2a6e0488b1f4d98004644ac55089ac567f351","observation_id":"ff8352ce-f7f7-4d3c-ab4f-c6ba8ba554e6","resolution":{"observed_at":"2026-08-11T21:46:48.157922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.04153","last_updated":"2025-04-18T13:37:59Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-15T10:52:17.229828Z","submitted_at":"2024-12-05T13:32:02Z","title":"A Dynamic Safety Shield for Safe and Efficient Reinforcement Learning of Navigation Tasks"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":1,"verified_fuzzy":12},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2412.04153."}