{"as_of":"2026-08-10T22:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bbed7ebb5585e29fb9388e889f10aa8b7113f410a866b2da7db336ca8fa98df5","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:47:32.539100Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T02:10:02.988190Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T02:11:15.663157Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-09T17:19:59.924102Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2507.04883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.04883","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Beyond training-time poisoning: Component-level and post-training backdoors in deep reinforcement learning.arXiv preprint arXiv:2507.04883","venue":null,"work_id":"52785530-65cf-4e33-b8d0-44cf55ef7309","year":null},"citing_paper":{"arxiv_id":"2605.09638","last_updated":"2026-05-10T16:34:16Z","snapshot_observed_at":"2026-08-02T13:49:44.882700Z","submitted_at":"2026-05-10T16:34:16Z","title":"Plan2Cleanse: Test-Time Backdoor Defense via Monte-Carlo Planning in Deep Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-12T02:10:02.988190Z"},"links":{"cited_paper":"/paper/2507.04883","citing_paper":"/paper/2605.09638"},"observation_digest":"sha256:403d6525d5add415919a32be8535c468602d8c166b5bdfdeb4ce8f8db7f37c3e","observation_id":"3d68a91a-fe1b-49f5-a350-913ddf275d47","resolution":{"observed_at":"2026-05-12T02:11:15.665346Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.04883/citation-record","integrity":"/paper/2507.04883/integrity","json":"/paper/2507.04883/citation-record.json","paper":"/paper/2507.04883"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-06T19:47:32.495768Z","title":"arXiv preprint arXiv:2312.00752","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-09T17:19:59.924102Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.495768Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:b01362b8274618c805e2028cab887b5c7ac675b781ed23560b21cae01dbc740f","observation_id":"d7b1c3e9-1521-410e-b0e8-6dd89a77e30d","resolution":{"observed_at":"2026-08-06T19:47:32.495768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:47:32.745400Z","title":"In 2020 57th ACM/IEEE Design Automation Con- ference (DAC), 1–6","venue":null,"work_id":"8780c86c-4fbd-4b6f-949a-dd1992d1eb73","year":2020},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-09T17:19:59.924102Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.499861Z"},"links":{"citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:e500cf9ee8b6a882812b721b45dfd8d211b41a1277143d42213160661f28b8dc","observation_id":"c1d34480-7bc9-4a1c-8550-f3f464906be9","resolution":{"observed_at":"2026-08-06T19:47:32.750134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:47:32.733588Z","title":"In 25th Annual Network And Distributed System Security Sym- posium (NDSS 2018)","venue":null,"work_id":"8816dde7-7f32-4466-8bfa-75495ef1e61d","year":2018},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-09T17:19:59.924102Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.507705Z"},"links":{"citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:9f25ee7a43078e62a460b401ed7039a3a5837444a2bd2ff114b6494787d815fd","observation_id":"75bc1667-a68d-4f17-a783-e410f910f1d9","resolution":{"observed_at":"2026-08-06T19:47:32.737495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13995","last_updated":"2025-06-02T18:41:35Z","snapshot_observed_at":"2026-08-10T02:44:17.652126Z","submitted_at":"2024-10-17T19:50:28Z","title":"Adversarial Inception Backdoor Attacks against Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13995","snapshot_observed_at":"2026-08-06T19:47:32.519317Z","title":"In International Conference on Machine Learning, 7974–7984","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-09T17:19:59.924102Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.519317Z"},"links":{"cited_paper":"/paper/2410.13995","citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:ba03762a6ec34b66d6fdb844032ea87e1575fb3c5bf414e30573111a54b61ebe","observation_id":"99d39d33-da79-4c51-944a-394625008cf6","resolution":{"observed_at":"2026-08-06T19:47:32.519317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T19:47:32.523289Z","title":"arXiv preprint arXiv:1707.06347","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-09T17:19:59.924102Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.523289Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:3aa7f1c712c6fa83a42f9a36bfdc578ef57b17570595aad9cc09792312907ad6","observation_id":"d7e5bf73-131c-4f1d-931f-a6c6d0559302","resolution":{"observed_at":"2026-08-06T19:47:32.523289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:47:32.720926Z","title":"In 2024 IEEE Security and Privacy Work- shops (SPW), 76–86","venue":null,"work_id":"e75578fa-4120-47f0-84ef-0ee113a74fa5","year":2024},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-09T17:19:59.924102Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.527186Z"},"links":{"citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:12fc3bb7b110996cbdcd38738f54665eb8e1d9c930c65b5b8596b04a191bb979","observation_id":"dd35e65d-d608-477d-b5be-6f6a1d6a1944","resolution":{"observed_at":"2026-08-06T19:47:32.725339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.00579","last_updated":"2021-12-12T23:22:37Z","snapshot_observed_at":"2026-08-09T08:07:41.076761Z","submitted_at":"2021-05-02T23:47:55Z","title":"BACKDOORL: Backdoor Attack against Competitive Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.00579","snapshot_observed_at":"2026-08-06T19:47:32.531262Z","title":"arXiv preprint arXiv:2105.00579","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-09T17:19:59.924102Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.531262Z"},"links":{"cited_paper":"/paper/2105.00579","citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:3299fa9b005e89a4968861ea2bcc05087c70d7756ef15fd11bbc24baae8d3c34","observation_id":"c748fc02-93b7-42d3-bc99-3714c2db734b","resolution":{"observed_at":"2026-08-06T19:47:32.531262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:47:32.709124Z","title":"In Findings of the Association for Computational Linguistics ACL 2024, 5339–5352","venue":null,"work_id":"2ac6bdcd-44ae-4503-bffb-7f33db6f0636","year":2024},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-09T17:19:59.924102Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.535123Z"},"links":{"citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:fb4439b9f7956b3553d85b112884eb4525abef9fd95d084c0e2c68cfaa5fc113","observation_id":"df8cf65f-928a-4067-a32e-98d48770f60a","resolution":{"observed_at":"2026-08-06T19:47:32.712999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:47:32.696234Z","title":"In GLOBECOM 2022-2022 IEEE Global Com- munications Conference, 2710–2715","venue":null,"work_id":"adf0a418-9f52-4e0a-aa47-720a698439f3","year":2022},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-09T17:19:59.924102Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.539100Z"},"links":{"citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:db05bd224e2af39c2b985318d1a3e129e445ee101998a5fe695d1edf5be420db","observation_id":"1f777e99-5961-462e-aaca-87fb7500c169","resolution":{"observed_at":"2026-08-06T19:47:32.700914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-06T19:47:32.511413Z","title":"arXiv preprint arXiv:1312.5602","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-09T17:19:59.924102Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.511413Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:423156d115a52761f49f7162cd551285cb996aef474b3352b2e03cd4af6ddad2","observation_id":"ec568db4-6e52-4121-980c-43aa367c6ebd","resolution":{"observed_at":"2026-08-06T19:47:32.511413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.03632","last_updated":"2017-12-11T02:58:13Z","snapshot_observed_at":"2026-07-06T06:13:41.923764Z","submitted_at":"2017-12-11T02:58:13Z","title":"Robust Deep Reinforcement Learning with Adversarial Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.03632","snapshot_observed_at":"2026-08-06T19:47:32.515321Z","title":"arXiv preprint arXiv:1712.03632","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-09T17:19:59.924102Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.515321Z"},"links":{"cited_paper":"/paper/1712.03632","citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:2913adeccfce7fcfda5dff2b5f994e39aa1e3f15f8e71bd5e4810b1187a0fc8f","observation_id":"61c55b76-66d4-4c46-9cec-3a12307ac459","resolution":{"observed_at":"2026-08-06T19:47:32.515321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:47:32.759323Z","title":"In 2018 15th interna- tional conference on ubiquitous robots (ur), 896–901","venue":null,"work_id":"2d2b942f-d267-4db3-a8a6-da51f5375a08","year":2018},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-09T17:19:59.924102Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.483100Z"},"links":{"citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:2ff6543d4ce2b92b33a369eae110a045102cd368da712d2de6944da70a42ff1e","observation_id":"6adb9cf4-a9f3-4a12-8d18-31e10f1bd7c9","resolution":{"observed_at":"2026-08-06T19:47:32.763836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.13091","last_updated":"2025-01-04T03:46:53Z","snapshot_observed_at":"2026-08-09T17:18:43.751801Z","submitted_at":"2020-12-24T04:07:36Z","title":"Auto-Agent-Distiller: Towards Efficient Deep Reinforcement Learning Agents via Neural Architecture Search","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.13091","snapshot_observed_at":"2026-08-06T19:47:32.491825Z","title":"arXiv preprint arXiv:2012.13091","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-09T17:19:59.924102Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.491825Z"},"links":{"cited_paper":"/paper/2012.13091","citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:ac29b16189407e2644972cc296b2ec5afa3ca2d9610c529c91290132ff48993f","observation_id":"91ad3e1d-1e6d-4bad-9d9e-75a10a69d546","resolution":{"observed_at":"2026-08-06T19:47:32.491825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.07798","last_updated":"2021-06-14T23:16:41Z","snapshot_observed_at":"2026-07-06T11:19:18.563623Z","submitted_at":"2021-06-14T23:16:41Z","title":"Poisoning Deep Reinforcement Learning Agents with In-Distribution Triggers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.07798","snapshot_observed_at":"2026-08-06T19:47:32.478998Z","title":"arXiv preprint arXiv:2106.07798","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-09T17:19:59.924102Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.478998Z"},"links":{"cited_paper":"/paper/2106.07798","citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:851cec6b3cca4e0d0c515b21a320cafce03be8b3dbe08a409b47280d10abba98","observation_id":"da0798f3-51ad-4443-a5ed-083a64caa3db","resolution":{"observed_at":"2026-08-06T19:47:32.478998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.00762","last_updated":"2022-07-28T17:30:20Z","snapshot_observed_at":"2026-08-10T13:52:47.881757Z","submitted_at":"2022-01-03T17:09:32Z","title":"Execute Order 66: Targeted Data Poisoning for Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2201.00762","doi":null,"metadata_source":"pith","pith_arxiv_id":"2201.00762","snapshot_observed_at":"2026-08-06T19:47:32.669219Z","title":"Execute Order 66: Targeted Data Poisoning for Reinforcement Learning","venue":"cs.LG","work_id":"2d7f1ed2-d3e7-4f73-869a-c1ef94c0db61","year":2022},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-09T17:19:59.924102Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.487428Z"},"links":{"cited_paper":"/paper/2201.00762","citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:0746c66f4465df0a96f27aaf122ed034ae3e676b4603f15a24b32335a0b623e0","observation_id":"23081c6e-d028-4110-a649-2b0d995ee678","resolution":{"observed_at":"2026-08-06T19:47:32.674104Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:47:32.772195Z","title":"In NeurIPS 2023 Workshop on Backdoors in Deep Learning-The Good, the Bad, and the Ugly","venue":null,"work_id":"69806f00-c6c7-480d-a169-9b504e77b0b7","year":2023},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-09T17:19:59.924102Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.474756Z"},"links":{"citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:fc51655683af3f6e85b95c29c7cba004d7fe77bd56426871f7e6ebc77207c503","observation_id":"c27e0c91-7957-40ce-8b40-50d51c57fc32","resolution":{"observed_at":"2026-08-06T19:47:32.776022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06957","last_updated":"2024-02-10T13:57:51Z","snapshot_observed_at":"2026-07-06T17:28:23.089590Z","submitted_at":"2024-02-10T13:57:51Z","title":"Architectural Neural Backdoors from First Principles","version":1},"cited_work":{"arxiv_id":"2402.06957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.06957","snapshot_observed_at":"2026-08-06T19:47:32.626669Z","title":"Architectural Neural Backdoors from First Principles","venue":"cs.CR","work_id":"a18dd72e-5a95-415e-80a7-1d4573cfc477","year":2024},"citing_paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","snapshot_observed_at":"2026-08-09T17:19:59.924102Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T19:47:32.503342Z"},"links":{"cited_paper":"/paper/2402.06957","citing_paper":"/paper/2507.04883"},"observation_digest":"sha256:7a7d9e02c82416d722800ce63c1659159ad671010ca4b60dac2cf23499c6b126","observation_id":"3293d2a2-c6d0-4573-adac-5eeaf31d9fdb","resolution":{"observed_at":"2026-08-06T19:47:32.632658Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.04883","last_updated":"2025-07-07T11:15:54Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T17:19:59.924102Z","submitted_at":"2025-07-07T11:15:54Z","title":"Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":8,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 1 inbound Pith citation observation for arXiv:2507.04883."}