{"as_of":"2026-08-09T15:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:286dbb68e6195f4f1c8ab5744c263528c6d5b2fb570511934cd2c2d93b602ba8","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T11:28:32.043923Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.24577/citation-record","integrity":"/paper/2607.24577/integrity","json":"/paper/2607.24577/citation-record.json","paper":"/paper/2607.24577"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.844934Z","title":"A hitchhiker’s guide to statistical tests for assessing randomized algorithms in software engineering,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.844934Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:8609be3438ed12f373c82bf9c1ca9e814990f7a6cf23ca64a41ac3fb6741d060","observation_id":"44ffe074-d3e0-4243-9af4-f154e92f16a1","resolution":{"observed_at":"2026-07-31T11:28:31.844934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.848785Z","title":"The pursuit of diversity: Multi-objective testing of deep rein- forcement learning agents,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.848785Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:4006d2bd6b31bb1d68d9e839999e1eacf766c3d054368a5cc671563ebbaf1488","observation_id":"c9c60b79-1ead-4537-a9fa-4379800ce4f4","resolution":{"observed_at":"2026-07-31T11:28:31.848785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.851931Z","title":"Reinforcement learning: An introduction. by richard’s sutton,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.851931Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:c2e33bb1c863ee36fdcfafdf9a302e53ccc8d065d1b122109f70c6d1206c7b98","observation_id":"cd49a837-4d7e-48ac-9f1c-739209c50e6d","resolution":{"observed_at":"2026-07-31T11:28:31.851931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.855279Z","title":"Controlling the false discovery rate: a practical and powerful approach to multiple testing,","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.855279Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:bcb227307118505a6fbcea476b714ffe00e30484c0af413548619fa680ebff17","observation_id":"50b002bf-2096-4071-bab4-4a0563eb1c5e","resolution":{"observed_at":"2026-07-31T11:28:31.855279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.858404Z","title":"Testing the plasticity of re- inforcement learning-based systems,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.858404Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:66adf67a5279019a07a795017c5cc127d7065beea9204db502ea13443b2338dd","observation_id":"764c90f8-bb5a-47c0-96c5-02020b452ae8","resolution":{"observed_at":"2026-07-31T11:28:31.858404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.861358Z","title":"Testing of deep reinforcement learning agents with surrogate models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.861358Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:f48560420126056aad6e5e4c53f94f1b6d420b980d076245cb39b65fa582e61a","observation_id":"0a97dd8b-bd51-488e-9b54-ee9657ce6573","resolution":{"observed_at":"2026-07-31T11:28:31.861358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.864496Z","title":"Coverage- based greybox fuzzing as markov chain,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.864496Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:76621969fd9166436ff264d70557b8517bcdb023e92d94c5fd8bfd43e00c6b40","observation_id":"67588500-505d-4135-a408-d8f3efac3be6","resolution":{"observed_at":"2026-07-31T11:28:31.864496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-07-31T11:28:31.867451Z","title":"Openai gym,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.867451Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:73f285c3ed5dcce3aa3b3c46df2a1c74e344a30be9052c10dfed08575b4807a5","observation_id":"a426def3-8eb5-442d-9a5f-1c5b5d82b7ad","resolution":{"observed_at":"2026-07-31T11:28:31.867451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.870729Z","title":"Exploration by random network distillation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.870729Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:241454f903308b61832040eee1346895d69fb1ba5d4e5da374280db5a3b41c80","observation_id":"97db9a99-b1be-438b-8d19-345fec9bb63c","resolution":{"observed_at":"2026-07-31T11:28:31.870729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.873587Z","title":"Drlfailuremon- itor: A dynamic failure monitoring approach for deep reinforcement learning system,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.873587Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:3939b99467dd719feddf6c0324e208c8b23ffc62b85501f27a0d9c8798e2ae73","observation_id":"c900bdfd-80f8-4fb5-9d2d-0bb9545fad45","resolution":{"observed_at":"2026-07-31T11:28:31.873587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.876459Z","title":"Cohen,Statistical Power Analysis for the Behavioral Sciences, 2nd ed","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.876459Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:b478a61ac8cb8b7f28c6499f11d3a45d7974e5cda9bf489cebca0125d02888d6","observation_id":"af0ddf2b-61f8-4916-bd49-6383a8c6434f","resolution":{"observed_at":"2026-07-31T11:28:31.876459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.879742Z","title":"Rank-biserial correlation,","venue":null,"work_id":null,"year":1956},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.879742Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:a12d401b854bb789952aeca9f58ef53c3afa5353358cf34babfc73aed341f71a","observation_id":"3db02aee-735d-4bfe-beb6-60971a3b24fa","resolution":{"observed_at":"2026-07-31T11:28:31.879742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.882539Z","title":"CARLA: an open urban driving simulator,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.882539Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:6bba0e56db3fd8a751de45128d402842bc28b5dd371faf8b78da3fbccae4972d","observation_id":"22b6b17f-cca1-4294-8959-a8cc9c677fea","resolution":{"observed_at":"2026-07-31T11:28:31.882539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.885213Z","title":"Prioritized replay for RL post-training,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.885213Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:84054872c53e061a4e7644256c75579c6f071a529676094935a493005a2c43b2","observation_id":"54fa5259-8586-4778-a32b-a33f2e67dc9d","resolution":{"observed_at":"2026-07-31T11:28:31.885213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.887954Z","title":"Reinforcement learning for online testing of autonomous driving systems: a replication and extension study,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.887954Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:021721db1bf8d642f173b78eb859ae927a3086dfb13c339c2a7cb936fea49eba","observation_id":"3ebcb2d1-b1f0-4fe6-b42a-2a385576d200","resolution":{"observed_at":"2026-07-31T11:28:31.887954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.890687Z","title":"Towards comprehensive testing on the robustness of co- operative multi-agent reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.890687Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:097a5e8f29dd4a91ff9a8a50e06ee55d8890c90003161f2d2ce1f1a94565220d","observation_id":"6b44c7e2-d5ed-4277-8b39-0a5a14a70da9","resolution":{"observed_at":"2026-07-31T11:28:31.890687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.893277Z","title":"Many-objective reinforcement learning for online testing of dnn-enabled systems,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.893277Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:d138542a35244ffe6063400b3f45e357b92228b404c5d0b3a15b4ad9b1883fc7","observation_id":"4629f195-f1d2-4aed-9226-5068c5b7b562","resolution":{"observed_at":"2026-07-31T11:28:31.893277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.896000Z","title":"Curiosity-driven testing for sequen- JOURNAL OF LATEX CLASS FILES, VOL. 18, NO. 9, SEPTEMBER 2020 13 tial decision-making process,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.896000Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:6c7449d2c3d769b70f6ac2360b6726e448d2a351a6cd3f7131a1f5332f3dd16f","observation_id":"6404fb14-7b42-4ad9-8cd6-c180e9105f80","resolution":{"observed_at":"2026-07-31T11:28:31.896000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.898643Z","title":"Deep reinforcement learning for drone navigation using sensor data,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.898643Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:3793b034817f96f6df098293b4555350666133206fe1558ccf462b901def9715","observation_id":"492f262a-ce5d-48e3-b8af-3f314b1ae917","resolution":{"observed_at":"2026-07-31T11:28:31.898643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.901463Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.901463Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:38fa994b252fd09e139f8baeb864889dbfde01c86a519e6661463c8db7b180b8","observation_id":"995f34dc-4256-43c4-a7fc-3118b9a1c41e","resolution":{"observed_at":"2026-07-31T11:28:31.901463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.903977Z","title":"A novel DDPG method with prioritized experience replay,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.903977Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:74f9d8cbf2d59d7c598aa1ef257590417a6a63041e836fcbf0df50503080b5f2","observation_id":"38e8e80d-e627-4adf-a42a-cfc6c44fb89e","resolution":{"observed_at":"2026-07-31T11:28:31.903977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.906497Z","title":"Carl: Learning scalable plan- ning policies with simple rewards,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.906497Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:5e3e21786f4498cda144d4a07304828a24dd2b75b6d67ff78080290e47fa698f","observation_id":"d7dae4ec-ee36-4f7a-92ab-2b6d79324a6e","resolution":{"observed_at":"2026-07-31T11:28:31.906497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.909065Z","title":"Residual reinforcement learning for robot control,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.909065Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:4ba9e603298372e7522f8e220d1ca8a3b71d6fd4a5b8f9faf141ae904d27e4c5","observation_id":"3ded0e88-f6af-4181-ba80-cffaf8cdbd8f","resolution":{"observed_at":"2026-07-31T11:28:31.909065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.911715Z","title":"Concept bottleneck models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.911715Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:9aa04a31a32c804571600face2214b97dba784acdbb7f3fcb4fcb0ff66e211b3","observation_id":"1290b556-73be-4ae6-9c5a-34fe8033f748","resolution":{"observed_at":"2026-07-31T11:28:31.911715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.914475Z","title":"Anatomy of a robotaxi crash: Lessons from the cruise pedestrian dragging mishap,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.914475Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:a954a09b8df947bb6aedf22da0b1ecc18026dd50d4a8adb62f1e074d3e171a34","observation_id":"914bab9f-8bde-41b1-93d5-9e2eecf07b29","resolution":{"observed_at":"2026-07-31T11:28:31.914475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-07-31T11:28:31.917130Z","title":"Offline reinforcement learning: Tutorial, review, and perspectives on open problems,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.917130Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:68fec6e6930bca9f26554ea69e87110984947c2b63823578930ab02d57c44b59","observation_id":"766340c1-a397-40cc-b3a3-a0f0018b1a84","resolution":{"observed_at":"2026-07-31T11:28:31.917130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.920077Z","title":"Faster diffusion: Rethinking the role of the encoder for diffusion model inference,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.920077Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:85348da06eba6b621d4313a95e5da2ff40642f72285b506f0fc0d6d1df97ffd3","observation_id":"aadb2ca4-271d-4f97-a43e-65a79eac7306","resolution":{"observed_at":"2026-07-31T11:28:31.920077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.922863Z","title":"Agentfuzz: Fuzzing for deep reinforcement learning systems,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.922863Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:367d520cf2ceb38bfabb71a41c9f34ebaceb7e149ec6e6d298589e260e401fcc","observation_id":"c0aeab49-5eac-4564-ac4d-c55266fe1c2a","resolution":{"observed_at":"2026-07-31T11:28:31.922863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.925649Z","title":"Generative model-based testing on decision-making policies,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.925649Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:7d9dd04c93c29ad55f1e767dd3ce9dc30d7e7f6bf79d8ae6d17e17fe2daeb064","observation_id":"5c3aa81b-cb94-43c6-8af5-6b8d1c060b80","resolution":{"observed_at":"2026-07-31T11:28:31.925649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.928533Z","title":"Todynet: temporal dynamic graph neural network for multivariate time series classification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.928533Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:898d4b643e1e9e3ae9ccb6430773a11e7b82b2984b119ceda4271c4db005b654","observation_id":"a8c1611c-3a85-4c7c-99f3-ce7a7858495f","resolution":{"observed_at":"2026-07-31T11:28:31.928533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17396","last_updated":"2023-03-30T14:08:31Z","snapshot_observed_at":"2026-08-06T18:33:38.213288Z","submitted_at":"2023-03-30T14:08:31Z","title":"Finetuning from Offline Reinforcement Learning: Challenges, Trade-offs and Practical Solutions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17396","snapshot_observed_at":"2026-07-31T11:28:31.931515Z","title":"Finetuning from offline reinforcement learning: Chal- lenges, trade-offs and practical solutions,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.931515Z"},"links":{"cited_paper":"/paper/2303.17396","citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:6a33ac77a02222e5cf78690bc06c3c67babd87408e0e4c8eede46a91c32b1173","observation_id":"87b90e74-70a7-421b-87d2-1abcf9db6afc","resolution":{"observed_at":"2026-07-31T11:28:31.931515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.934801Z","title":"Enhancing multi-agent system testing with diversity-guided exploration and adaptive critical state exploitation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.934801Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:0e7fe847fb7e06f99124e91f14142e5527b89ac5b1b3f55a98adbfac58e5f07f","observation_id":"905a8932-77b6-4046-bd20-3816d7d9309b","resolution":{"observed_at":"2026-07-31T11:28:31.934801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.937578Z","title":"Fault diversity in reinforcement learning policy testing,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.937578Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:ab9fa504ba91ad9e9c0dec8cb3846d719494bee937810a7ce6f1f32118dc8d27","observation_id":"7bfe0579-bb57-4744-a016-cc123db91682","resolution":{"observed_at":"2026-07-31T11:28:31.937578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.941052Z","title":"Policy testing with mdpfuzz (replicability study),","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.941052Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:76ede6e6f27695af15dca032c1c3bd1f2cdb970c5d03cc10098b2b501c721169","observation_id":"b7147398-87de-40c3-9837-6e605891cc05","resolution":{"observed_at":"2026-07-31T11:28:31.941052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.944422Z","title":"Learning, reward, and decision making,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.944422Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:e3765de50d9b3e6570d3ca3b8c89fea3198a482d5e4d150a54cbc3234bb13c16","observation_id":"4100263b-55d4-4eeb-873f-968ab2419a96","resolution":{"observed_at":"2026-07-31T11:28:31.944422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.947793Z","title":"Mdpfuzz: testing models solving markov decision processes,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.947793Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:2417e956fafbda6a9602968fffd95faf328086c8c4dc4e9aa5e1f92def91cf8a","observation_id":"d07ee855-edd2-493b-95c4-c5f7ca847330","resolution":{"observed_at":"2026-07-31T11:28:31.947793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.950719Z","title":"Pytorch: An imperative style, high-performance deep learning library,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.950719Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:6b768691ddc037ef7263e7a79621463f2cbfa688506cb9d127c199ff56e90183","observation_id":"27526193-f84b-401e-841d-4c3ebbda94dd","resolution":{"observed_at":"2026-07-31T11:28:31.950719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.953512Z","title":"Deepxplore: automated whitebox testing of deep learning systems,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.953512Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:b504e352211b8b5f597e4076300d93479b468f6771479cdf76e480f5554bd302","observation_id":"8b19e5bf-fbd4-4dab-a630-23a5f8519b73","resolution":{"observed_at":"2026-07-31T11:28:31.953512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.956436Z","title":"Learning and testing resilience in cooperative multi-agent systems,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.956436Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:6a2a9cdd7a2e0aa5fad00307908fcebd676f3483bb21a7de74d7f2ca711e6f5c","observation_id":"373b76dc-e8ce-42e2-b216-7f588ed9cd01","resolution":{"observed_at":"2026-07-31T11:28:31.956436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.959319Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.959319Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:94f9437f3dcb68f0216847b2a953ad111c15df5a9d948939b5b41532ee41798f","observation_id":"da0b4815-398e-40fc-a881-c2a1d8861be4","resolution":{"observed_at":"2026-07-31T11:28:31.959319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.962287Z","title":"Rl baselines3 zoo,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.962287Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:4db1493971654dc7c7cbbdb5f752015749a62bb019203b455ec791b58a4b4e69","observation_id":"7847a494-7ec7-47d6-bf0d-a74e2fd7d2e9","resolution":{"observed_at":"2026-07-31T11:28:31.962287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.965172Z","title":"Stable-baselines3: Reliable reinforce- ment learning implementations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.965172Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:5765b33f82b1e366a42aaf0e9e5940bbcf9e085db0f109fc24b3419a36c0f008","observation_id":"5f8c947c-dd42-4d59-a464-79f07c752f27","resolution":{"observed_at":"2026-07-31T11:28:31.965172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.967812Z","title":"Vuzzer: Application-aware evolutionary fuzzing,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.967812Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:43e25b9df0ea2c0477ef38718c0f3b2f359da3cb59dba94aa27845886d2ce786","observation_id":"f5bb2e66-c7a3-4552-8fda-769e96ba4333","resolution":{"observed_at":"2026-07-31T11:28:31.967812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.970910Z","title":"Prior- itized experience replay,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.970910Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:f3459050ec973e20e5939bf5eb684b3eb0488088b8387a23248ba238433c2020","observation_id":"3531f5c8-04b1-4b63-a906-47cad1f57a25","resolution":{"observed_at":"2026-07-31T11:28:31.970910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.973915Z","title":"Testing rein- forcement learning systems: A comprehensive review,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.973915Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:6a6ae4cac157e1768969ce893340aa70a40fb49fcc079fa753805a9caf958076","observation_id":"08f3b321-4ad5-4fe5-820f-45254cae9e74","resolution":{"observed_at":"2026-07-31T11:28:31.973915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.977005Z","title":"Search-based testing of reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.977005Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:191362330a223830ab643862854d807be6ff5da83a64b828c7b76bbe86ac63b2","observation_id":"7b324204-5d62-413f-92b0-bc1363edbaa0","resolution":{"observed_at":"2026-07-31T11:28:31.977005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.979989Z","title":"Learning and repair of deep reinforce- ment learning policies from fuzz-testing data,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.979989Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:647dca3e184c4070835104fbf0b49677face585378e25c68bf653fe1b93105df","observation_id":"f8de37ae-c58d-4516-88b6-72f5a3a17675","resolution":{"observed_at":"2026-07-31T11:28:31.979989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.983111Z","title":"PCLA: A framework for testing autonomous agents in the CARLA simulator,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.983111Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:9ad8f31da89c80db4808beb73c260343602de44afc31af2cef60926079c4e506","observation_id":"0e13f864-ed5a-4117-b0d8-29bc8a7bac3d","resolution":{"observed_at":"2026-07-31T11:28:31.983111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.986185Z","title":"$\\mu \\text{PRL}$: A mutation testing pipeline for deep rein- forcement learning based on real faults,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.986185Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:e06433796a9dd5a2742b32e08ccb52e2e7f8067010a4423adf9d17f0f5d79dae","observation_id":"bf78c95f-ff79-4c9c-abe3-03dc3096903f","resolution":{"observed_at":"2026-07-31T11:28:31.986185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.989197Z","title":"Does neuron coverage matter for deep reinforcement learning?: A preliminary JOURNAL OF LATEX CLASS FILES, VOL. 18, NO. 9, SEPTEMBER 2020 14 study,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.989197Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:9f10bb4bfd24fe7fed7f8ded4ec17f0c7aff330d3763e9ccd7e84feec262b52a","observation_id":"5432d385-0a19-41c6-bf9f-e07e27419d33","resolution":{"observed_at":"2026-07-31T11:28:31.989197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.992219Z","title":"Rigorous agent evaluation: An adversarial approach to uncover catastrophic failures,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.992219Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:f668c6be67ab19cbbe6752f26ef84c43e9686032d08ea9ab8dfe2ae40b95ee26","observation_id":"a5bb55b5-45e5-46f9-8a78-393c41404bfa","resolution":{"observed_at":"2026-07-31T11:28:31.992219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.12483","snapshot_observed_at":"2026-07-31T11:28:31.995734Z","title":"A survey of reinforce- ment learning for software engineering,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.995734Z"},"links":{"cited_paper":"/paper/2507.12483","citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:b6f89264dcca76193e09d7234974c9da0352c8fadbabf363af76419259e6276b","observation_id":"bc87c4b4-ffb7-4cd1-9e90-c05fe99ed2b6","resolution":{"observed_at":"2026-07-31T11:28:31.995734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:31.999124Z","title":"Fuzzing with sequence diversity inference for sequential decision- making model testing,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.999124Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:000570ac3c6df1356cf514f63e2e5dc0e8ba6eb464c908430568159870c9e2c3","observation_id":"93072774-5721-4e15-80bf-762beaec7ca3","resolution":{"observed_at":"2026-07-31T11:28:31.999124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:32.002108Z","title":"Wilcoxon signed-rank test,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:32.002108Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:ba325f8073d16b3785e0ab6de0e3ce9dde02737f0f651ffe82f79291d5f676fc","observation_id":"92c02899-5335-4e8c-8f17-3c4a1857fdf5","resolution":{"observed_at":"2026-07-31T11:28:32.002108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:32.005338Z","title":"Regression fault detection and mitigation in the evolution of deep learning systems,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:32.005338Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:9ec8a2a7df71653118144346d6d5d61cbc6299971818399812ff35adb3b6a559","observation_id":"c79987c6-a72b-4d7a-a340-000b31aa7002","resolution":{"observed_at":"2026-07-31T11:28:32.005338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:32.008601Z","title":"Regression fuzzing for deep learning systems,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:32.008601Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:ac2c203cda101d0db9861c030c941ac78f9c8228117ac693e909f4caf0aef022","observation_id":"ce60d6f8-9e0b-4c61-b7ed-6d1fe8e12891","resolution":{"observed_at":"2026-07-31T11:28:32.008601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:32.011583Z","title":"Mitigating regression faults induced by feature evolution in deep learning systems,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:32.011583Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:665311d7f4e91e7ce642b143c4fa94a04fcac97b9752926657e81f3c6a94c7ac","observation_id":"b1a82dfe-93ab-40cf-ae69-0fe4a17d2bac","resolution":{"observed_at":"2026-07-31T11:28:32.011583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:32.014311Z","title":"A comprehensive study of deep learning model fixing approaches,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:32.014311Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:9fe90f582cd1bf52a8b7a3e85b2c20bdab944bc45492921672ec7435f29f7d75","observation_id":"b7944f7f-7ef3-4dac-9072-78b81813806a","resolution":{"observed_at":"2026-07-31T11:28:32.014311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:32.017536Z","title":"Navigating the testing of evolving deep learning systems: An exploratory interview study,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:32.017536Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:9cda6a2deb072cd390943e7bb2125c78d7cbbf81b67edc6db13d21a8f1cfa8ac","observation_id":"7bcdd5fd-b297-4fb6-a408-77f48772b196","resolution":{"observed_at":"2026-07-31T11:28:32.017536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:32.020576Z","title":"A white-box testing for deep neural networks based on neuron coverage,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:32.020576Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:4099d4d754feb6331ac4a2c6614a96f5d52d76955ce512486b12348af43f4f27","observation_id":"0427b5c4-991c-46e6-a128-9b48ebceb815","resolution":{"observed_at":"2026-07-31T11:28:32.020576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:32.023582Z","title":"End-to-end urban driving by imitating a reinforcement learning coach,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:32.023582Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:0cbdf70fde0d839d56a94d3c9b7cc1c3e470d058e3a24934038083ab57630dc3","observation_id":"4db4486a-35ca-4156-89db-3d4b600c2118","resolution":{"observed_at":"2026-07-31T11:28:32.023582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:32.026763Z","title":"Iden- tifying the failure-revealing test cases in metamorphic testing: A statistical approach,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:32.026763Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:3264295b7f627a0b1c2e70eeea04a8edf67778b892ac7cf66651fde61d1eefab","observation_id":"536228ae-2ba2-4e83-b993-422e8b79c748","resolution":{"observed_at":"2026-07-31T11:28:32.026763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:32.029645Z","title":"Parallel test prioritiza- tion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:32.029645Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:5a7874fd4073cd73e176087acc520473072cf784c931d582721bd74cd41827db","observation_id":"a2af511f-0e1c-4213-aa1c-807c0a7c7e14","resolution":{"observed_at":"2026-07-31T11:28:32.029645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:32.032572Z","title":"Knowledge transfer from simple to complex: A safe and efficient reinforcement learning framework for au- tonomous driving decision-making,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:32.032572Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:b95d02c238e4397dd7079d292dcde15e552693f30b44e53f3c8c83dea29bf7c7","observation_id":"1854a9fb-cb38-4bdd-ab07-67453af9713b","resolution":{"observed_at":"2026-07-31T11:28:32.032572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:32.035433Z","title":"Robustness testing for multi-agent reinforcement learning: State perturbations on critical agents,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:32.035433Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:e03fd9f7252b98d9d4f800fa88d3a540512d4281435d5bc24677ab133ca65e6e","observation_id":"dacbe2dd-2c07-4428-9f58-ba158a1ba7d0","resolution":{"observed_at":"2026-07-31T11:28:32.035433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:32.038063Z","title":"Fuzzing: A survey for roadmap,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:32.038063Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:e729af8b95504aba5c6968b99532210f01f303378895a5da7238caa0c344a3fd","observation_id":"aa2814de-d5fb-42c6-b546-8f14d41c90f5","resolution":{"observed_at":"2026-07-31T11:28:32.038063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:32.040845Z","title":"A search-based testing approach for deep reinforcement learning agents,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:32.040845Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:02894350809523f61c930f1001812429f0d013b51354dc6eb546ff61157b8cd7","observation_id":"71bf83fc-0f88-423c-8889-c4a6f10c33a9","resolution":{"observed_at":"2026-07-31T11:28:32.040845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T11:28:32.043923Z","title":"SMARLA: A safety monitoring approach for deep reinforcement learning agents,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:32.043923Z"},"links":{"citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:bedee08bc7b4893cd51fcfb17b2bad6972ddbf6d78c5d9eba0ab3141a15e0ed0","observation_id":"009d053d-2978-44d0-8016-9ebc9a7a200a","resolution":{"observed_at":"2026-07-31T11:28:32.043923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":68,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 0 inbound Pith citation observations for arXiv:2607.24577."}