{"as_of":"2026-08-09T13:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8d636a6adb12d5bbc175ec9a883ada3b3e98534449e55742baedf2da9f615cd4","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:58:13.783532Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.20621/citation-record","integrity":"/paper/2505.20621/integrity","json":"/paper/2505.20621/citation-record.json","paper":"/paper/2505.20621"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:10.345268Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.345268Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:1ab211219bc0a95d7d37fcd37d1555319f11d4ed9b5c7c2850c6ed42805e4a29","observation_id":"fff5ac11-2e8f-464c-8dbe-29197c94ade4","resolution":{"observed_at":"2026-08-07T13:58:10.345268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:10.395338Z","title":"Brendan McMahan, Ilya Mironov, Kunal Talwar, and Li Zhang","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.395338Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:80a63c18e36c1a40218f3d0d665bb7e279ea566267bbf0213c33cce993bf41d9","observation_id":"e47827d9-1d46-4011-89c5-ad04c65b6f87","resolution":{"observed_at":"2026-08-07T13:58:10.395338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:19.963641Z","title":"Differentially private policy evaluation","venue":null,"work_id":"332ebafa-4b07-478f-a7b1-33be96f0d6c8","year":2016},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.453612Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:e6921ae62658f1d6680cee548f0306a32a42715edbda5635cfd0ad0a1e88abb0","observation_id":"eb48bc7a-e6ce-444c-abb2-027743bdec62","resolution":{"observed_at":"2026-08-07T13:58:20.063936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.09982","last_updated":"2019-10-08T15:44:43Z","snapshot_observed_at":"2026-08-09T08:42:29.036684Z","submitted_at":"2019-05-24T00:53:24Z","title":"Hypothesis Testing Interpretations and Renyi Differential Privacy","version":2},"cited_work":{"arxiv_id":"1905.09982","doi":null,"metadata_source":"pith","pith_arxiv_id":"1905.09982","snapshot_observed_at":"2026-08-07T13:58:15.838151Z","title":"Hypothesis Testing Interpretations and Renyi Differential Privacy","venue":"cs.LG","work_id":"7f6a2bda-dc29-41be-a6bd-1ef45b2b8f60","year":2019},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.510887Z"},"links":{"cited_paper":"/paper/1905.09982","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:941a788b9c9227395f4ce708f32ec434afd7998649fe0d409157f760d89f7ced","observation_id":"394eb3f3-fa2e-4228-8a7e-37cd469125b4","resolution":{"observed_at":"2026-08-07T13:58:15.945700Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.05776","last_updated":"2021-06-20T22:23:24Z","snapshot_observed_at":"2026-08-09T08:42:28.096670Z","submitted_at":"2021-02-10T23:31:53Z","title":"Defense Against Reward Poisoning Attacks in Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2102.05776","doi":null,"metadata_source":"pith","pith_arxiv_id":"2102.05776","snapshot_observed_at":"2026-08-07T13:58:15.517872Z","title":"Defense Against Reward Poisoning Attacks in Reinforcement Learning","venue":"cs.LG","work_id":"04ec31e9-8d50-420f-9c26-67d296cb1a05","year":2021},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.575392Z"},"links":{"cited_paper":"/paper/2102.05776","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:9b773e2c3b2e4e18552b7ee514e666b7aa5e18efdb7fb8f0b164da31ba5ebc22","observation_id":"6658e4c2-1756-46ce-b56d-1a7ccccedc6b","resolution":{"observed_at":"2026-08-07T13:58:15.654771Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:19.816066Z","title":"Can M achine L earning be S ecure? In Proceedings of the 2006 ACM S ymposium on I nformation, C omputer and C ommunications S ecurity , pp.\\ 16--25, 2006","venue":null,"work_id":"e1d528f3-2bb4-45a7-9480-ec7f7c30c02a","year":2006},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.618171Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:1051417d4b521876fd54258e46c16028ee7607c0912348c70e178224db116585","observation_id":"2a541fa7-5d70-4c73-a5e8-ad70f3df3408","resolution":{"observed_at":"2026-08-07T13:58:19.889656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:19.706698Z","title":"A Distributional Perspective on Reinforcement Learning","venue":null,"work_id":"91704654-b269-46cf-98a4-e21eb0f41de8","year":2017},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.665286Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:2f505ae7e95c994ed54f503cb75ec058af5c669b3ee8c9fb6bfb457be4f0b698","observation_id":"1820ff58-aef0-407f-805b-3014c478a83b","resolution":{"observed_at":"2026-08-07T13:58:19.766424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1206.6389","last_updated":"2013-03-25T10:16:36Z","snapshot_observed_at":"2026-07-06T02:50:47.096675Z","submitted_at":"2012-06-27T19:59:59Z","title":"Poisoning Attacks against Support Vector Machines","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1206.6389","snapshot_observed_at":"2026-08-07T13:58:10.743477Z","title":"Poisoning Attacks against Support Vector Machines","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.743477Z"},"links":{"cited_paper":"/paper/1206.6389","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:08addd8b9c083e4562a22166d34a2216dee8e6f644a5ef7bb0551c60218ed567","observation_id":"3ad9621a-4b7d-4fb2-af97-580d816a663d","resolution":{"observed_at":"2026-08-07T13:58:10.743477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:19.475511Z","title":"Double Bubble, Toil and Trouble: Enhancing Certified Robustness Through Transitivity","venue":null,"work_id":"12dfc4e7-bd3e-4a91-bdf0-6b6ef95d9b22","year":2022},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.791538Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:a5104d3f4bb34b2647ca1c3b2a05a72c58f944039d786170d707223393ea9439","observation_id":"9c3c8726-1fb6-4669-9bca-dcf89c27e2a3","resolution":{"observed_at":"2026-08-07T13:58:19.575732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:10.835804Z","title":"Cullen, Paul Montague, Shijie Liu, Sarah M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.835804Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:99a3a3e162c2f3ffef9eb151db76caeff57d8b3446129f6ca597adbc28bfded9","observation_id":"0c7e1589-336b-418f-836d-fa45d714bccd","resolution":{"observed_at":"2026-08-07T13:58:10.835804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:19.365716Z","title":"Et T u C ertifications: R obustness C ertificates Y ield B etter A dversarial E xamples","venue":null,"work_id":"dbc3f2aa-61ff-47a6-b143-bbe7c66c4a3e","year":2024},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.893900Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:ac320a478e3a910d8f35e71ac4cb5a12f8cd6576be6d9744108e2746c2283cb3","observation_id":"c827b364-f57e-4602-a48b-4b228d703595","resolution":{"observed_at":"2026-08-07T13:58:19.431300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:19.163294Z","title":"Unifying pac and regret: Uniform pac bounds for episodic reinforcement learning","venue":null,"work_id":"e11ffc01-202b-430a-9eff-6b3e2587b187","year":2017},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.946046Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:e555b3c2fb02f52694130385b4c3a0205d65087e6776ecf1b78caa64bba8f1e8","observation_id":"a143930a-313a-46dc-890b-aa8017a12b1c","resolution":{"observed_at":"2026-08-07T13:58:19.260158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1604.06443","last_updated":"2019-03-15T02:31:22Z","snapshot_observed_at":"2026-08-05T15:38:13.597097Z","submitted_at":"2016-04-21T19:54:24Z","title":"Robust Estimators in High Dimensions without the Computational Intractability","version":2},"cited_work":{"arxiv_id":"1604.06443","doi":null,"metadata_source":"pith","pith_arxiv_id":"1604.06443","snapshot_observed_at":"2026-08-07T13:58:15.263383Z","title":"Robust Estimators in High Dimensions without the Computational Intractability","venue":"cs.DS","work_id":"0e479889-1982-4b20-890d-94fe4725fca7","year":2016},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:10.990606Z"},"links":{"cited_paper":"/paper/1604.06443","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:c06e54fe6be76f8f8556323efa2ec48c4b63f67c066535c5b2585fd63b7a4781","observation_id":"9a0c3942-9daf-4d22-97b5-d6abf63b58c8","resolution":{"observed_at":"2026-08-07T13:58:15.329140Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:18.884829Z","title":"Asymptotic Minimax Character of the Sample Distribution Function and of the Classical Multinomial Estimator","venue":null,"work_id":"5b8aa764-a4ea-46f9-912a-8f95f0214e51","year":1956},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.044135Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:9bcfe91eb4fa60d85490857ed25723af44e23006d9a9db4302e1865899d9e384","observation_id":"1dd4274f-52da-4f4e-8360-10c4006ac579","resolution":{"observed_at":"2026-08-07T13:58:18.990864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:18.672998Z","title":"Calibrating Noise to Sensitivity in Private Data Analysis","venue":null,"work_id":"3ece963a-05ac-4ac4-9360-37944ccf6f03","year":2006},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.103866Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:340e0adcc988d01268c5519e9893917dec8aad514cf0ef6ee3bde66d96da5f7d","observation_id":"e049882e-5244-45c9-948a-2d17167dc24d","resolution":{"observed_at":"2026-08-07T13:58:18.780176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:18.505651Z","title":"Data Mining with Differential Privacy","venue":null,"work_id":"097c23f5-fcc4-451d-8fa4-75a8e015789c","year":2010},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.162546Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:8a08f17a67c236b04d4f5503dc15e6a0b304940c1ab3cded9938d06515758585","observation_id":"34ad001b-1bc7-4cd4-a55d-6d742f0b7403","resolution":{"observed_at":"2026-08-07T13:58:18.582555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:18.371998Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning , 2020","venue":null,"work_id":"2e80aa58-cf60-4ffa-aff4-96f9a092b2d2","year":2020},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.237113Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:e9370ade31ab904b274c684fa323d8f4e4f0d4c97bd8f7b7db816d9d5d7ff292","observation_id":"3f26c35f-b011-4774-b079-67ebe023fc42","resolution":{"observed_at":"2026-08-07T13:58:18.447912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/bf03014329","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:03:45.533247Z","title":"Sugli integrali multipli","venue":"Canadian Journal of Anesthesia/Journal canadien d anesthésie","work_id":"bc0431ba-1e52-4104-a104-ccd00d767eb1","year":1907},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.288564Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:aae87991060e97d9652b3c5a53a6f06393c89b994bda8f6af753d53a7d74078b","observation_id":"67aa7d41-d589-405e-abf6-56ef7c52c8af","resolution":{"observed_at":"2026-08-07T13:58:13.921093Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:18.269837Z","title":"Local Differential Privacy for Regret Minimization in Reinforcement Learning","venue":null,"work_id":"21a5c702-8ba0-4e2a-b432-4047d487886c","year":2021},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.334231Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:e40e779cdd654ce3e24fdc3094b4ac3ee2d83ac03eba0d00560c40848d607665","observation_id":"ccd6209c-2cd5-4d85-8e34-4ad93078cd26","resolution":{"observed_at":"2026-08-07T13:58:18.286662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:18.124170Z","title":"The optimal noise-adding mechanism in differential privacy","venue":null,"work_id":"4b1bb6d3-92fa-4a78-b554-4a7d49fc295b","year":2015},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.378442Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:0f09c082854d1ee6dce0436c8426b025aee84344fb166dbd7f4d72a269ed682d","observation_id":"789f2d58-fd88-4457-8a2a-b55a68f3fa53","resolution":{"observed_at":"2026-08-07T13:58:18.188645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:17.959065Z","title":"Baffle: Hiding Backdoors in Offline Reinforcement Learning Datasets","venue":null,"work_id":"57537b8a-ab86-42d4-b05d-a21b5c0a0ec1","year":2024},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.431883Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:1e563d0d03dd83ea07ecba1aa461cedde9b1a89644453a04e0d37ebb70fa10c7","observation_id":"dc46ffc6-487f-46c0-b2d7-a1744d005eae","resolution":{"observed_at":"2026-08-07T13:58:18.019283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:11.489514Z","title":"Numerical composition of differential privacy","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.489514Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:701da96306274dd21f88f53b9a50c91650399d679605dccb03fe4efecca53452","observation_id":"589a5bf1-52e0-4d17-83c5-2025d025f924","resolution":{"observed_at":"2026-08-07T13:58:11.489514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10330","last_updated":"2024-05-24T22:33:04Z","snapshot_observed_at":"2026-08-04T09:15:33.903637Z","submitted_at":"2022-05-20T17:42:38Z","title":"A Review of Safe Reinforcement Learning: Methods, Theory and Applications","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.10330","snapshot_observed_at":"2026-08-07T13:58:11.528104Z","title":"A Review of Safe Reinforcement Learning : Methods , Theory and Applications , May 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.528104Z"},"links":{"cited_paper":"/paper/2205.10330","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:0dfad7e01cefa3761b236428fe5af807ef0b09a28bf8286bba2fe523ad1eda4d","observation_id":"4720fc79-0604-4f11-8fca-7d0a01f03ca0","resolution":{"observed_at":"2026-08-07T13:58:11.528104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15690","last_updated":"2023-07-28T17:29:49Z","snapshot_observed_at":"2026-07-06T15:59:56.179560Z","submitted_at":"2023-07-28T17:29:49Z","title":"Benchmarking Offline Reinforcement Learning on Real-Robot Hardware","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15690","snapshot_observed_at":"2026-08-07T13:58:11.564713Z","title":"u rtler, Sebastian Blaes, Pavel Kolev, Felix Widmaier, Manuel W \\","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.564713Z"},"links":{"cited_paper":"/paper/2307.15690","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:a94c0b8136c8976d87c03281dbfc230e1ecb0adb07140380dd401b9999c753f8","observation_id":"70277514-d98b-49ca-bf4b-bdab7c0f8635","resolution":{"observed_at":"2026-08-07T13:58:11.564713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.04495","last_updated":"2020-12-09T21:44:40Z","snapshot_observed_at":"2026-08-07T22:42:05.404553Z","submitted_at":"2020-08-11T03:12:42Z","title":"Intrinsic Certified Robustness of Bagging against Data Poisoning Attacks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.04495","snapshot_observed_at":"2026-08-07T13:58:11.616583Z","title":"Intrinsic Certified Robustness of Bagging against Data Poisoning Attacks","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.616583Z"},"links":{"cited_paper":"/paper/2008.04495","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:00d8ddf81a20ef8aa467614011518bd365c21913a5da083f090b53d47e99a034","observation_id":"8881ad37-41d7-4bf2-9069-efc3d7cce518","resolution":{"observed_at":"2026-08-07T13:58:11.616583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:17.878164Z","title":"Learning to Drive in a Day","venue":null,"work_id":"ba5ef41d-52ec-4cc5-bcd4-bc263ecd5eb9","year":2019},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.692610Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:f037773125e318ac94bcb07827fa8e35f26c1a2d225c06aeb7a8b2a6ad73970d","observation_id":"b2213f9f-41f4-47f0-9dba-816f334d1396","resolution":{"observed_at":"2026-08-07T13:58:17.900856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:11.741659Z","title":"TrojDRL : Evaluation of Backdoor Attacks on Deep Reinforcement Learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.741659Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:51103c8fbe0f4136051f0020fb8aa0f220a8ae88d89be52f7a13dac1fc96fa7c","observation_id":"b1c3d714-7f65-4201-b68d-a5d010f537ed","resolution":{"observed_at":"2026-08-07T13:58:11.741659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06169","last_updated":"2021-10-12T17:05:05Z","snapshot_observed_at":"2026-08-06T15:42:21.967989Z","submitted_at":"2021-10-12T17:05:05Z","title":"Offline Reinforcement Learning with Implicit Q-Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06169","snapshot_observed_at":"2026-08-07T13:58:11.789761Z","title":"Offline Reinforcement Learning with Implicit Q-learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.789761Z"},"links":{"cited_paper":"/paper/2110.06169","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:eac9f3614a88b0ecfab322d1d3d5259173fc6d24fd6df69ee5a990bcc3e1183f","observation_id":"2bad0680-e924-4e5e-a51a-14a76bd0b187","resolution":{"observed_at":"2026-08-07T13:58:11.789761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:17.795962Z","title":"Adversarial Machine Learning-Industry Perspectives","venue":null,"work_id":"24ef0eb6-3980-423a-bd17-1f8db5737c5c","year":2020},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.854978Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:25b9c07bfcdfc3b7dc6cd997fcec05db6a67c1c3974465f9d495519cff6e3103","observation_id":"8cafc824-7fae-4bbc-adcf-90d19db13da3","resolution":{"observed_at":"2026-08-07T13:58:17.838112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:17.676104Z","title":"Batch Reinforcement Learning","venue":null,"work_id":"204d1ff9-15c1-4c24-b03b-0326f6f3df4e","year":2012},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.919009Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:1d49883c0d3265aa898dc4362eb858c68bc701281d434a9dc410f05c8886a88b","observation_id":"a11dddfb-1c1f-4798-affe-1d6c6c6831ef","resolution":{"observed_at":"2026-08-07T13:58:17.735382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.03471","last_updated":"2019-05-29T15:17:39Z","snapshot_observed_at":"2026-07-06T06:22:40.962594Z","submitted_at":"2018-02-09T22:24:50Z","title":"Certified Robustness to Adversarial Examples with Differential Privacy","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.03471","snapshot_observed_at":"2026-08-07T13:58:11.963813Z","title":"Certified Robustness to Adversarial Examples with Differential Privacy","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:11.963813Z"},"links":{"cited_paper":"/paper/1802.03471","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:4c46c3aff13cde4720b32ae553ee484b6d7f3729731c82119c4f3ef4fd992614","observation_id":"1ab3b5d8-01d8-485a-bafc-cc90c18c0fd6","resolution":{"observed_at":"2026-08-07T13:58:11.963813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14768","last_updated":"2021-03-18T05:50:12Z","snapshot_observed_at":"2026-08-09T02:22:15.242901Z","submitted_at":"2020-06-26T03:16:31Z","title":"Deep Partition Aggregation: Provable Defense against General Poisoning Attacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.14768","snapshot_observed_at":"2026-08-07T13:58:12.013805Z","title":"Deep Partition Aggregation : Provable Defense against General Poisoning Attacks","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.013805Z"},"links":{"cited_paper":"/paper/2006.14768","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:cb9cd5400abe5d9986506a11ba7d124a84520cfcbc613143e7e820eac8c7dbb9","observation_id":"71ea4002-2d91-4894-99bd-3443b068e4c5","resolution":{"observed_at":"2026-08-07T13:58:12.013805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.09363","last_updated":"2021-02-23T14:03:58Z","snapshot_observed_at":"2026-07-06T09:21:36.119578Z","submitted_at":"2020-05-19T11:13:43Z","title":"Enhancing Certified Robustness via Smoothed Weighted Ensembling","version":3},"cited_work":{"arxiv_id":"2005.09363","doi":null,"metadata_source":"pith","pith_arxiv_id":"2005.09363","snapshot_observed_at":"2026-08-07T13:58:14.894447Z","title":"Enhancing Certified Robustness via Smoothed Weighted Ensembling","venue":"cs.LG","work_id":"9fb32d3e-cbdc-4a9a-8528-2079f08bbf3d","year":2020},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.074274Z"},"links":{"cited_paper":"/paper/2005.09363","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:ac270b8eae141afc689de5a98dc596da8f470abfc218bfdc8057af22fa41386e","observation_id":"e1242a9c-d548-4aec-b590-875911a1c024","resolution":{"observed_at":"2026-08-07T13:58:15.003992Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:17.531158Z","title":"Enhancing the Antidote: Improved Pointwise Certifications Against Poisoning Attacks","venue":null,"work_id":"2f9f2de3-8e5e-4203-bdf8-9d85f8272da3","year":2023},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.125904Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:307fd2ce16b903de9475298726f66de9bdf77eb98abcdd3cd5435927f795a7a1","observation_id":"ca798ca0-bc46-4a9d-a7f8-893d0f7a1bcb","resolution":{"observed_at":"2026-08-07T13:58:17.577920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08689","last_updated":"2023-11-01T03:08:01Z","snapshot_observed_at":"2026-07-06T08:38:22.401222Z","submitted_at":"2019-11-20T03:49:13Z","title":"Corruption-robust exploration in episodic reinforcement learning","version":4},"cited_work":{"arxiv_id":"1911.08689","doi":null,"metadata_source":"pith","pith_arxiv_id":"1911.08689","snapshot_observed_at":"2026-08-07T13:58:14.743958Z","title":"Corruption-robust exploration in episodic reinforcement learning","venue":"cs.LG","work_id":"b75f1b04-29d1-45ac-8fe8-a5e8adbd23c5","year":2019},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.183239Z"},"links":{"cited_paper":"/paper/1911.08689","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:2dedfc450288700017f04b86393211a19caa7b3b81a635eee37b21392ce685dc","observation_id":"7a86f304-8b4b-49c8-b2ff-0ba0007b5722","resolution":{"observed_at":"2026-08-07T13:58:14.820244Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.09860","last_updated":"2019-07-05T17:31:41Z","snapshot_observed_at":"2026-07-06T07:41:11.712588Z","submitted_at":"2019-03-23T18:20:47Z","title":"Data Poisoning against Differentially-Private Learners: Attacks and Defenses","version":2},"cited_work":{"arxiv_id":"1903.09860","doi":null,"metadata_source":"pith","pith_arxiv_id":"1903.09860","snapshot_observed_at":"2026-08-07T13:58:14.605697Z","title":"Data Poisoning against Differentially-Private Learners: Attacks and Defenses","venue":"cs.LG","work_id":"ceedba5d-86da-4e24-9191-bbe4678aa552","year":2019},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.229699Z"},"links":{"cited_paper":"/paper/1903.09860","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:853a186c08772bbd8e55537fb9c34725f2b7c48e4127da36e631517a14802edc","observation_id":"8e390ef4-365d-4800-a9f7-a5a8097c92b9","resolution":{"observed_at":"2026-08-07T13:58:14.661390Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.06963","last_updated":"2018-02-24T00:40:30Z","snapshot_observed_at":"2026-08-08T12:18:09.531945Z","submitted_at":"2017-10-18T23:46:57Z","title":"Learning Differentially Private Recurrent Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.06963","snapshot_observed_at":"2026-08-07T13:58:12.290803Z","title":"Learning Differentially Private Recurrent Language Models","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.290803Z"},"links":{"cited_paper":"/paper/1710.06963","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:2f9bfe6ddad264443b1d7025dbf9c7f283700d18f1e7dd805b1bca0cd6dfb2bc","observation_id":"14e93ff9-c68b-465f-8d43-9228d5a2e3ac","resolution":{"observed_at":"2026-08-07T13:58:12.290803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1702.07476","last_updated":"2017-08-25T23:54:30Z","snapshot_observed_at":"2026-07-06T05:31:14.242311Z","submitted_at":"2017-02-24T06:46:38Z","title":"Renyi Differential Privacy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1702.07476","snapshot_observed_at":"2026-08-07T13:58:12.360881Z","title":"Renyi Differential Privacy","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.360881Z"},"links":{"cited_paper":"/paper/1702.07476","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:4e048bae0baf7e26bdf3c8609217570cfb503988cc7a91263c5354783b746857","observation_id":"cc4baff2-2a95-4132-bf73-5079c709cd48","resolution":{"observed_at":"2026-08-07T13:58:12.360881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10530","last_updated":"2019-08-28T03:03:25Z","snapshot_observed_at":"2026-08-07T03:15:48.518041Z","submitted_at":"2019-08-28T03:03:25Z","title":"R\\'enyi Differential Privacy of the Sampled Gaussian Mechanism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.10530","snapshot_observed_at":"2026-08-07T13:58:12.413237Z","title":"Renyi Differential Privacy of the Sampled Gaussian Mechanism","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.413237Z"},"links":{"cited_paper":"/paper/1908.10530","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:8b7b86adb5d853147bf41156e400d04de768184642739abc0df16de277735754","observation_id":"49f452c2-1770-4c3d-9fdf-62e0c5b6a715","resolution":{"observed_at":"2026-08-07T13:58:12.413237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1602.01783","last_updated":"2016-06-16T16:38:45Z","snapshot_observed_at":"2026-07-06T04:45:11.148515Z","submitted_at":"2016-02-04T18:38:41Z","title":"Asynchronous Methods for Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1602.01783","snapshot_observed_at":"2026-08-07T13:58:12.489760Z","title":"Asynchronous Methods for Deep Reinforcement Learning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.489760Z"},"links":{"cited_paper":"/paper/1602.01783","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:13825b9384c3f7378ff70159b186c88f2cbca57005bafc8e02c059709d8ef986","observation_id":"ba73ae61-cfb2-491f-9418-3d1843619463","resolution":{"observed_at":"2026-08-07T13:58:12.489760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-07T13:58:12.548539Z","title":"Playing Atari with Deep Reinforcement Learning , December 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.548539Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:a8b0f80fe5ca60a9d50a1f157a3fea82d851fea626a78309208c8c68b0858842","observation_id":"b9684f96-d061-41b7-9a02-b77d68a8a7e0","resolution":{"observed_at":"2026-08-07T13:58:12.548539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:17.456030Z","title":"Reinforcement Learning for Optimized Trade Execution","venue":null,"work_id":"a7d3b0fb-6de3-4b1c-a9b4-3c1aeddb7a44","year":2006},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.599802Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:72d9234f3c5027d830c82c85c1729d6a2c55b4e6bb6d9d482d784505a1295e25","observation_id":"2a3a14f8-4fd5-463b-acde-0c206d0061a6","resolution":{"observed_at":"2026-08-07T13:58:17.486822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:17.377127Z","title":"Online Defense Strategies for Reinforcement Learning Against Adaptive Reward Poisoning","venue":null,"work_id":"21fe92aa-c238-4f23-b2d7-2f674f90d1ad","year":2023},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.656421Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:9fd7e34c8ed9e3dd258066c8e0d4cc48a4154e790274e1d7536e2a7cd4c9258c","observation_id":"6f60739e-802a-4b36-a12f-9909e98866bf","resolution":{"observed_at":"2026-08-07T13:58:17.413005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1709.07174","last_updated":"2019-08-09T10:07:01Z","snapshot_observed_at":"2026-07-06T06:00:38.265995Z","submitted_at":"2017-09-21T06:30:24Z","title":"Agile Autonomous Driving using End-to-End Deep Imitation Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.07174","snapshot_observed_at":"2026-08-07T13:58:12.769027Z","title":"Agile Autonomous Driving Using End-to-end Deep Imitation Learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.769027Z"},"links":{"cited_paper":"/paper/1709.07174","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:d79f76258be28549e51b5e9ad38a9a0a792e2632008a062680d73999d98aad8a","observation_id":"d13364f2-5c18-48ea-bbd0-4e2bcb6bf3d3","resolution":{"observed_at":"2026-08-07T13:58:12.769027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:17.268769Z","title":"Deep K-NN Defense Against Clean-label Data Poisoning Attacks","venue":null,"work_id":"a8d4dfb6-6a58-4425-8eb1-6036f27947f7","year":2020},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.821597Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:26f59741830254d6094774cf02e2cb85f2a4d81176aa2798659f6abc10d9d490","observation_id":"7acc4916-4512-45f5-b433-824142c5c1be","resolution":{"observed_at":"2026-08-07T13:58:17.318537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:12.868504Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.868504Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:5054b9daa113c68e91b07b8c035ee9cc994f58275d804ebe37c6a541d2eb5714","observation_id":"b3bd390b-7a42-4411-abd6-c24270de1d24","resolution":{"observed_at":"2026-08-07T13:58:12.868504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:17.185092Z","title":"Provably Robust Deep Learning via Adversarially Trained Smoothed Classifiers","venue":null,"work_id":"17ed05ac-370e-4bea-9893-1f863e2d1369","year":2019},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.915034Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:48a16152be61dc26e9cb8346dcf29a338fdd55ddc084c48a78b8809249be9d02","observation_id":"f7d01c77-2c05-4c21-ad04-49aa98957907","resolution":{"observed_at":"2026-08-07T13:58:17.225777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T13:58:12.951446Z","title":"Proximal Policy Optimization Algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:12.951446Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:967c38053e663e0ca773d282b8329bb9f9f727adabe08d17e3cd2325cdd760fd","observation_id":"6a535aef-ea08-4117-8a03-ebde7c499942","resolution":{"observed_at":"2026-08-07T13:58:12.951446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:17.054947Z","title":"Mastering the Game of Go Without Human Knowledge","venue":null,"work_id":"ac2b3334-a4f4-4ce5-8232-35227518c4dc","year":2017},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.003732Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:9d6846a2e50a5308911d5615d7320b4bface9aff05d038176f084ee413af7d68","observation_id":"c5df22cb-82f0-483c-b1ab-09c59223baee","resolution":{"observed_at":"2026-08-07T13:58:17.124406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:16.924274Z","title":"Policy Gradient Methods for Reinforcement Learning with Function Approximation","venue":null,"work_id":"8a0cdb1f-174c-4df6-9473-f6ffe16f6b6d","year":1999},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.043533Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:323123e33260cc7b8a7c20344f18a9c07df3303461b10ef8513736fb111d678a","observation_id":"08e662b6-0749-48a2-b188-3ec8958339b7","resolution":{"observed_at":"2026-08-07T13:58:16.970742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:13.094075Z","title":"Terry, Ariel Kwiatkowski, John U","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.094075Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:fc3f2e9e9ca96a473ed385d413eccfdaac2ea8c656f4d03360a68112cb717550","observation_id":"7f9b2d7a-d2e7-4daf-9166-b8c4360d77b7","resolution":{"observed_at":"2026-08-07T13:58:13.094075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:16.819267Z","title":"Private reinforcement learning with pac and regret guarantees","venue":null,"work_id":"05242b7f-9239-4a93-9ba8-a6cb71a5c20e","year":2020},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.133977Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:ef18d34039ab03c3fc7b23d525455f5c8cc9c660e2698032b0c626dbdb604d12","observation_id":"a9eb8d4e-018f-4a2c-bc30-04b5c7a8d79b","resolution":{"observed_at":"2026-08-07T13:58:16.869511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:16.725872Z","title":"Supervised Reinforcement Learning with Recurrent Neural Network for Dynamic Treatment Recommendation","venue":null,"work_id":"8d07940b-1268-4671-b59d-4851faa5d0a9","year":2018},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.199802Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:164565b882fb7b3c289f1747dae4eaee7efac37fa87bd21d5299df946626cf6a","observation_id":"36692d03-6505-42c3-b6d9-03a864a07656","resolution":{"observed_at":"2026-08-07T13:58:16.765612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2021.31140","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:14.125396Z","title":"Stop-and- Go : Exploring Backdoor Attacks on Deep Reinforcement Learning -based Traffic Congestion Control Systems","venue":null,"work_id":"fcef68cd-3275-4572-a8f7-cc29c114cbf4","year":2021},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.248103Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:d5b8ea9671e8aa2d12ed99ebe79ec115d7742410e6acc667f5d1d5377234d0b7","observation_id":"7540fe80-4775-4f29-b38b-60eae47e4d60","resolution":{"observed_at":"2026-08-07T13:58:14.155163Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.08398","last_updated":"2022-03-16T05:02:47Z","snapshot_observed_at":"2026-07-06T12:48:23.739370Z","submitted_at":"2022-03-16T05:02:47Z","title":"COPA: Certifying Robust Policies for Offline Reinforcement Learning against Poisoning Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.08398","snapshot_observed_at":"2026-08-07T13:58:13.290928Z","title":"COPA : Certifying Robust Policies for Offline Reinforcement Learning against Poisoning Attacks , March 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.290928Z"},"links":{"cited_paper":"/paper/2203.08398","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:2004996f4eae846efbe6c5d6ee2a0c03409e8ac3f4fb968882fb96d86dcac8ae","observation_id":"ba3d32fb-2bb7-4e76-b43a-df73ff573454","resolution":{"observed_at":"2026-08-07T13:58:13.290928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:16.595124Z","title":"Reward Poisoning Attacks on Offline Multi-agent Reinforcement Learning","venue":null,"work_id":"cfb62e76-83cb-4e06-aff3-70b885a2b852","year":2023},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.342851Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:ba3c2658b2a61c8ea39c82e470ee9d4d4b23a5d22f1c74baf5cae7f4b7735a23","observation_id":"5ffef097-7597-4449-a8d6-5b5d98e75068","resolution":{"observed_at":"2026-08-07T13:58:16.665669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12955","last_updated":"2024-03-09T17:46:44Z","snapshot_observed_at":"2026-07-06T16:35:48.413898Z","submitted_at":"2023-10-19T17:54:39Z","title":"Towards Robust Offline Reinforcement Learning under Diverse Data Corruption","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12955","snapshot_observed_at":"2026-08-07T13:58:13.401469Z","title":"Towards Robust Offline Reinforcement Learning under Diverse Data Corruption , March 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.401469Z"},"links":{"cited_paper":"/paper/2310.12955","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:31cc1f0c8d0340784edb0b1a1f0636a3b94a686b2e37775ea76db032e26c9c94","observation_id":"ed62ba83-6f84-4164-82d6-76bbb48ffb17","resolution":{"observed_at":"2026-08-07T13:58:13.401469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:16.364922Z","title":"Corruption- Robust Offline Reinforcement Learning with General Function Approximation","venue":null,"work_id":"2765e82f-8648-4690-a05d-b582f6c5030e","year":2023},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.431278Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:095b168e92864a89b6ac70f6d3bfdc835d38d8f123e18106af0bd6ab677c7d80","observation_id":"38072f5c-ea6b-4682-933a-7422a2fc3004","resolution":{"observed_at":"2026-08-07T13:58:16.482507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.12298","last_updated":"2022-08-22T20:24:50Z","snapshot_observed_at":"2026-08-06T15:46:33.397187Z","submitted_at":"2021-09-25T07:10:54Z","title":"Opacus: User-Friendly Differential Privacy Library in PyTorch","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.12298","snapshot_observed_at":"2026-08-07T13:58:13.486506Z","title":"Opacus: U ser-friendly D ifferential P rivacy L ibrary in P yTorch","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.486506Z"},"links":{"cited_paper":"/paper/2109.12298","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:77c0fa10aaea33fb5268413af6f5c363c442aeaae11ee2cbf80477d7327efa5f","observation_id":"e3968089-bdcd-4e9b-968a-9028aae86aa0","resolution":{"observed_at":"2026-08-07T13:58:13.486506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:16.154128Z","title":"Reinforcement Learning in Healthcare: A survey","venue":null,"work_id":"6e74537b-10ba-4fdf-bbed-e7245eb1da2e","year":2021},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.537023Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:6b341a176853f465060757a086d5aa44a6d10a6b033f310e44777dd0f69203f3","observation_id":"e96d09a9-bedc-43f1-9864-8a61614da9e8","resolution":{"observed_at":"2026-08-07T13:58:16.261783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.06630","last_updated":"2021-06-11T22:41:53Z","snapshot_observed_at":"2026-07-06T11:18:32.821345Z","submitted_at":"2021-06-11T22:41:53Z","title":"Corruption-Robust Offline Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.06630","snapshot_observed_at":"2026-08-07T13:58:13.577413Z","title":"Corruption- Robust Offline Reinforcement Learning , June 2021 a","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.577413Z"},"links":{"cited_paper":"/paper/2106.06630","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:bb651307785f4a08e0ce46ab3a82d7910920696141231b102b3bc4b7a1e642eb","observation_id":"fb03fb0a-7a4f-41ed-bd17-e3c4c8229bfd","resolution":{"observed_at":"2026-08-07T13:58:13.577413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.05800","last_updated":"2021-06-08T16:46:54Z","snapshot_observed_at":"2026-07-06T10:40:24.954633Z","submitted_at":"2021-02-11T01:48:38Z","title":"Robust Policy Gradient against Strong Data Corruption","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.05800","snapshot_observed_at":"2026-08-07T13:58:13.612803Z","title":"Robust Policy Gradient against Strong Data Corruption , June 2021 b","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.612803Z"},"links":{"cited_paper":"/paper/2102.05800","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:3ec8e1434edc0e915c1ed325044a76591850e7e9daf91aaeecf5da080742b4e6","observation_id":"89a41442-0c24-4b8a-9c40-0b924e3174c9","resolution":{"observed_at":"2026-08-07T13:58:13.612803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:13.652960Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.652960Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:425c40453297f0a462033e14e920df9ad439b1ea83474f49cee20a59f0499591","observation_id":"14cb29f9-f190-415d-ba4b-f112960a727a","resolution":{"observed_at":"2026-08-07T13:58:13.652960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:13.720597Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.720597Z"},"links":{"citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:27e7801af8c422afd1710dcbb2dedbd95e321b9695a1a6dfff3bcf5210eeab0c","observation_id":"d0afb212-4af5-448f-ad11-7350dcd94b20","resolution":{"observed_at":"2026-08-07T13:58:13.720597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.11718","last_updated":"2020-01-31T09:03:23Z","snapshot_observed_at":"2026-08-08T22:53:26.415902Z","submitted_at":"2020-01-31T09:03:23Z","title":"Locally Private Distributed Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2001.11718","doi":null,"metadata_source":"pith","pith_arxiv_id":"2001.11718","snapshot_observed_at":"2026-08-07T13:58:14.355059Z","title":"Locally Private Distributed Reinforcement Learning","venue":"cs.LG","work_id":"870e4abc-a3bc-4506-9b68-eb815056b845","year":2020},"citing_paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:13.783532Z"},"links":{"cited_paper":"/paper/2001.11718","citing_paper":"/paper/2505.20621"},"observation_digest":"sha256:719515e023f5bcc2974ebacace0ed123a978082e2870cbf0e06664bb7222de24","observation_id":"e3447457-77e2-4a75-a7c8-d454236472f4","resolution":{"observed_at":"2026-08-07T13:58:14.432828Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.20621","last_updated":"2025-05-27T01:59:25Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T08:42:07.900633Z","submitted_at":"2025-05-27T01:59:25Z","title":"Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":28,"verified_exact":7,"verified_fuzzy":28},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2505.20621."}