{"as_of":"2026-08-09T15:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6e9904f14086f96782eaaf5f74f194441ecabb2ebcfd7b3084a6ebf6170837aa","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-03T12:24:53.884439Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.01794/citation-record","integrity":"/paper/2607.01794/integrity","json":"/paper/2607.01794/citation-record.json","paper":"/paper/2607.01794"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:20:50.029741Z","title":"Robust UA V path planning with obstacle avoidance for emergency rescue,","venue":null,"work_id":"62656a85-a398-45f7-9527-ded9763169b3","year":2025},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:dd5bf304339298874b5b8f343e5f3c63ce1eb78ed3eb48c387e201818e5dd0d0","observation_id":"2e083a57-d445-4daf-85f0-c514ff71548d","resolution":{"observed_at":"2026-07-05T08:20:50.031047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:20:50.031641Z","title":"UA V path planning based on deep reinforce- ment learning,","venue":null,"work_id":"5663fbb3-0251-4a55-90ae-791b5d1ac151","year":2023},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:069c42af9401da341b9515492ad8e544d9216759b921f87693bd8154b76bb0f4","observation_id":"f13cb233-0611-41d9-9b73-75af8492625a","resolution":{"observed_at":"2026-07-05T08:20:50.032954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.12021","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T12:28:07.000129Z","title":"Modified hybrid A* collision-free path-planning for automated reverse parking,","venue":null,"work_id":"bbebc5a8-3409-41dd-835d-20d8474cd6f8","year":2025},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:1e17b1e6ccf277fcb6b9e5d9995b4d9434a376ff74301722dee45e8db8d46bca","observation_id":"bceca9d4-8b47-448a-a1c1-db1e55a56ffc","resolution":{"observed_at":"2026-07-03T12:28:07.002181Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:20:50.033500Z","title":"Comparison between A* and RRT algorithms for 3D UA V path planning,","venue":null,"work_id":"a79f4733-4441-4b7b-b3ab-20696e533e6e","year":2022},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:3fed7c9aeb9b2392f8c22266e20b201b2a96903a3f5e050e617df03e31566b68","observation_id":"ffacb0e5-dc72-49a2-8c3e-423e119fb111","resolution":{"observed_at":"2026-07-05T08:20:50.034730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:20:50.035293Z","title":"Autonomous UA V navigation: A DDPG-based deep reinforcement learning ap- proach,","venue":null,"work_id":"7dae3d2b-ff54-4962-b636-35edcd0326e1","year":2020},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:61bde70082a408863e6428498c0be445db58b5ac506a0150468ac6d7d68098e6","observation_id":"46344175-2715-45a9-9eca-dee52712b745","resolution":{"observed_at":"2026-07-05T08:20:50.036559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:20:50.037259Z","title":"Autonomous navigation of UA V in multi-obstacle environments based on a deep reinforcement learning approach,","venue":null,"work_id":"bce85ece-26c4-4ed4-8665-9d3acd6f3a36","year":2022},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:d03482f8c8fb3e19199e52f7212837fcbe3e5d1881326795c91a482276a76762","observation_id":"2bd7cf20-674d-43b8-a51c-3049f7ed902d","resolution":{"observed_at":"2026-07-05T08:20:50.039139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:20:50.040106Z","title":"DRL-based UA V autonomous navigation and obstacle avoidance with LiDAR and depth camera fusion,","venue":null,"work_id":"dbeedfa7-025d-4d96-a728-aad5dd1f2ac6","year":2025},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:c83199db19f4a2bd84e558f0dece7be8bf837d6bc4482723b7841d4edb9aa59b","observation_id":"ef41861f-eb2d-4b38-ab34-6d266ac789ab","resolution":{"observed_at":"2026-07-05T08:20:50.044524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:20:50.045188Z","title":"Virtual-to-real deep reinforcement learning: Continuous control of mobile robots for mapless navigation,","venue":null,"work_id":"ad86550f-4a93-4179-9f9c-f492b832bae0","year":2017},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:d63b04692f50aba7d100d30543ebbb16a4692527ee61a1ba63982d5903e7ef78","observation_id":"2c2c8f21-9e7a-4ea5-809f-04f29e8a796e","resolution":{"observed_at":"2026-07-05T08:20:50.047409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:20:50.022113Z","title":"Enhancing autonomous driving with reinforcement learning and lidar-based object detection,","venue":null,"work_id":"b3d5f788-0edd-4589-9352-f9c412f1d8b0","year":2024},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:73b92bcaeeaf4f8df1611ceded088101b63ecdf918332304ef6949d5fa7b27a0","observation_id":"0ab01658-1be3-4f7d-8ed1-2f25452d2ae9","resolution":{"observed_at":"2026-07-05T08:20:50.023342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:20:50.024027Z","title":"Research on unmanned aerial vehicle intelligent maneuvering method based on hierarchical proximal policy optimization,","venue":null,"work_id":"9eeb7b90-f260-4cfd-9f34-5b571d2c83de","year":2025},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:20bbd444b88a843c92aff6394199167c840cdc311c5aa8b74e107f62a84d8e6b","observation_id":"c37693ac-88f8-4800-9603-74bc6fc914a2","resolution":{"observed_at":"2026-07-05T08:20:50.025343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:20:50.026052Z","title":"Hybrid machine learning and reinforce- ment learning framework for adaptive UA V obstacle avoidance,","venue":null,"work_id":"16df2a1f-e39a-4c08-bc57-91ad700743ea","year":2024},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:de11594563c233cd2460630e2c01627e426eda043131b349772fc623be5dd8b7","observation_id":"a9ddf702-1135-46ec-bb5b-0832104d1181","resolution":{"observed_at":"2026-07-05T08:20:50.027285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:20:50.027805Z","title":"Action correction-enhanced multi- agent reinforcement learning for path planning in urban environments,","venue":null,"work_id":"5f53f4ca-d1cc-4858-a5bb-1e96e44ff7f4","year":2026},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:faa963e44b0a7a8d7c918f46305a38d5bb28c7ad2c33a7224ad5c516b6b57f7a","observation_id":"b0543825-47d8-41cf-894d-8d96528832d6","resolution":{"observed_at":"2026-07-05T08:20:50.029112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17342","last_updated":"2026-04-29T10:07:30Z","snapshot_observed_at":"2026-07-06T21:28:57.440918Z","submitted_at":"2025-05-22T23:26:12Z","title":"A Survey of Safe Reinforcement Learning and Constrained MDPs: A Technical Survey on Single-Agent and Multi-Agent Safety","version":2},"cited_work":{"arxiv_id":"2505.17342","doi":"10.48550/arxiv.2505.17342","metadata_source":"pith","pith_arxiv_id":"2505.17342","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"A Survey of Safe Reinforcement Learning and Constrained MDPs: A Technical Survey on Single-Agent and Multi-Agent Safety","venue":"cs.LG","work_id":"8f286e52-bb3a-4fcf-91c0-42df318b8b9e","year":2025},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"cited_paper":"/paper/2505.17342","citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:94afaafdf466740991a68b4e37a718557534afa6a35c3688f7505dea7242f581","observation_id":"f0fc33ec-62d5-4857-9871-465c90173155","resolution":{"observed_at":"2026-07-03T12:28:07.004776Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:20:50.018553Z","title":"Constrained policy op- timization,","venue":null,"work_id":"dbaaf171-4e24-4236-b2b4-d3850cedcba9","year":2017},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:01ee12b1866e1b900aa0208ea0f415613c9a761847900e708c254210b2e3bdd8","observation_id":"fd14fa00-88fb-4eb8-9bb7-63cf726cc8c7","resolution":{"observed_at":"2026-07-05T08:20:50.019810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.13040","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T12:28:06.992165Z","title":"Tcrl: Temporal-coupled adversarial training for robust constrained reinforcement learning in worst-case scenarios,","venue":null,"work_id":"a015b01e-ab48-473f-b34f-62734169038b","year":2026},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:09e95da8c51c334fbe68015e47038561d7246f0e2e7e07b59253097635035d9e","observation_id":"1f9e7947-f916-4a4b-8239-4abdf69ea950","resolution":{"observed_at":"2026-07-03T12:28:06.994372Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.14850","last_updated":"2025-08-18T09:13:18Z","snapshot_observed_at":"2026-08-09T07:23:02.214462Z","submitted_at":"2025-07-20T07:43:18Z","title":"Hierarchical Multi-Agent Reinforcement Learning with Control Barrier Functions for Safety-Critical Autonomous Systems","version":2},"cited_work":{"arxiv_id":"2507.14850","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.14850","snapshot_observed_at":"2026-07-03T12:28:07.005988Z","title":"Hierarchical multi-agent rein- forcement learning with control barrier functions for safety-critical autonomous systems,","venue":null,"work_id":"1b06ad5e-0f38-4027-805d-5533290138b9","year":2025},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"cited_paper":"/paper/2507.14850","citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:aaedb36a3d33774116662915d9466bb1c77b776ff4b5213f23c5d0ec294206f5","observation_id":"ecfc4880-2b1f-43b4-a5f5-52646d204ced","resolution":{"observed_at":"2026-07-03T12:28:07.008072Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:20:50.013205Z","title":"Loam: Lidar odometry and mapping in real- time.,","venue":null,"work_id":"a897ab75-d40d-4629-89e9-87aab76d300e","year":2014},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:cf29613d46e24c1152bbb74879db7161b4b5b09c407a7a12a89468e0e4d54f35","observation_id":"39a827d3-76bb-4fd3-b920-28d2cd571bf4","resolution":{"observed_at":"2026-07-05T08:20:50.014637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:20:50.015274Z","title":"V oxblox: Incremental 3d euclidean signed distance fields for on- board mav planning,","venue":null,"work_id":"914b945d-ce9d-4652-9433-39607e118200","year":2017},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:376353d0b7cde28553ad21b7f3123f2ba1cb0db22d42c4b0a58ceba15ab60e50","observation_id":"68779376-f751-4134-a2ae-3f5056ff277c","resolution":{"observed_at":"2026-07-05T08:20:50.017378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.04861","last_updated":"2017-04-17T03:57:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-04-17T03:57:34Z","title":"MobileNets: Efficient Convolutional Neural Networks for Mobile Vision Applications","version":1},"cited_work":{"arxiv_id":"1704.04861","doi":"10.48550/arxiv.1704.04861","metadata_source":"pith","pith_arxiv_id":"1704.04861","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MobileNets: Efficient Convolutional Neural Networks for Mobile Vision Applications","venue":"cs.CV","work_id":"3870239a-c950-4625-bf33-c4f902d14175","year":2017},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"cited_paper":"/paper/1704.04861","citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:8533a17814d4b170f96fb5cb77f26510dc8c0c36e5e8d96c9239c2ab74d74418","observation_id":"16f78618-d841-451d-a38d-3e9116693011","resolution":{"observed_at":"2026-07-03T12:28:07.010572Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1003.2005","last_updated":"2011-09-09T20:48:35Z","snapshot_observed_at":"2026-08-06T22:07:47.821638Z","submitted_at":"2010-03-10T01:18:08Z","title":"Control of Complex Maneuvers for a Quadrotor UAV using Geometric Methods on SE(3)","version":4},"cited_work":{"arxiv_id":"1003.2005","doi":null,"metadata_source":"pith","pith_arxiv_id":"1003.2005","snapshot_observed_at":"2026-07-03T12:28:06.986458Z","title":"Control of complex maneuvers for a quadrotor uav using geometric methods on se (3)","venue":"math.OC","work_id":"2fc6f887-837e-443e-a130-b21facc0765c","year":2010},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"cited_paper":"/paper/1003.2005","citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:1a906d59e8a0583e00947af783e74c63044a6599c751e4fdb95d3da0e4fd4e68","observation_id":"1c0b3e22-68e4-40bc-a61b-02a6722700c2","resolution":{"observed_at":"2026-07-03T12:28:06.988024Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:29985478b6a9e3cff37694aec72d4aec37b1296a34e04b76f3c216fd22414c15","observation_id":"3d1cdb65-2bf9-44ce-bc50-8e0ced94f092","resolution":{"observed_at":"2026-07-03T12:28:06.990823Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:20:50.020359Z","title":"Curriculum learning,","venue":null,"work_id":"0d01617a-0793-4d93-a3d4-407913d887dd","year":2009},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:c9bdc0988a441d15dc85df2966f7adaa6438eebc05a096a1779f6f2a4a454102","observation_id":"b04ff875-52a9-4352-8379-2c103d823c92","resolution":{"observed_at":"2026-07-05T08:20:50.021544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:20:50.011075Z","title":"What matters in learning a zero-shot sim-to-real rl policy for quadrotor control? a comprehensive study,","venue":null,"work_id":"2221c261-d9df-41f4-905b-8c66d430f13f","year":2025},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:5b313f359f84b9e9403ebd100c964bf821d1155d9e4a2783b36ec7302b19fc06","observation_id":"597b2ab4-4d8c-4b08-bf0c-bcd502b7a201","resolution":{"observed_at":"2026-07-05T08:20:50.012556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.05905","last_updated":"2019-01-29T12:10:47Z","snapshot_observed_at":"2026-08-01T15:24:35.515954Z","submitted_at":"2018-12-13T04:44:29Z","title":"Soft Actor-Critic Algorithms and Applications","version":2},"cited_work":{"arxiv_id":"1812.05905","doi":"10.48550/arxiv.1812.05905","metadata_source":"pith","pith_arxiv_id":"1812.05905","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Soft Actor-Critic Algorithms and Applications","venue":"cs.LG","work_id":"bb49c9fb-03b2-4226-9edb-50186b8193e4","year":2018},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"cited_paper":"/paper/1812.05905","citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:1ba30341c2fe27b7a30e28cf6696ad58f6da25250e394edde4e8dd28a8666b94","observation_id":"62a06aaf-ec20-4ab8-9d12-b32da5dd58f3","resolution":{"observed_at":"2026-07-03T12:28:06.981828Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-09T09:49:21.584701+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T09:49:21.584701+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:20:50.006594Z","title":"Addressing function approxi- mation error in actor-critic methods,","venue":null,"work_id":"555f52cd-cfbf-410c-bb3a-973fbc0f1cab","year":2018},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:474a8057d902e5430d5e05b63e2f9f8b07232b2c33233b1bfcae966cba149b65","observation_id":"cf2c71b6-ed07-4d14-bf98-017036dbaf3b","resolution":{"observed_at":"2026-07-05T08:20:50.008176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:20:50.008880Z","title":"Autonomous defense of unmanned aerial vehicles against missile attacks using a GRU-based PPO algorithm,","venue":null,"work_id":"f498e358-eeeb-413d-9e61-99eeffc806f8","year":2024},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:650e4a66f685bef9bd497f6662f39128c7d30e94724d2589ff2c3d5f67d39293","observation_id":"941aec1b-c470-4d14-96ac-003ef99b4ad1","resolution":{"observed_at":"2026-07-05T08:20:50.010357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11461","last_updated":"2023-04-22T18:22:10Z","snapshot_observed_at":"2026-08-04T10:49:37.152635Z","submitted_at":"2023-04-22T18:22:10Z","title":"Recurrent Neural Networks and Long Short-Term Memory Networks: Tutorial and Survey","version":1},"cited_work":{"arxiv_id":"2304.11461","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.11461","snapshot_observed_at":"2026-07-03T12:28:06.995990Z","title":"\\ Ghodsi, A","venue":null,"work_id":"ad036317-5b66-4ec4-83c1-d3324ee39d6e","year":2023},"citing_paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-03T12:24:53.884439Z"},"links":{"cited_paper":"/paper/2304.11461","citing_paper":"/paper/2607.01794"},"observation_digest":"sha256:54851aff7b4c79a11a572a49df3fd8e5d9c445e826a9e4d07082e2d5de0735b1","observation_id":"cc5e3d6d-e8a8-4bd2-b71f-4399cff18112","resolution":{"observed_at":"2026-07-03T12:28:06.998299Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.01794","last_updated":"2026-07-02T07:12:24Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-07T06:56:26.678479Z","submitted_at":"2026-07-02T07:12:24Z","title":"Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":8,"verified_fuzzy":18},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2607.01794."}