{"as_of":"2026-08-19T03:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d424a404a33a0ace5e091deac37bcbcd24f2a2f574d66734aa06ea1be2fda555","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:13:30.719721Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T08:46:26.643481Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07797","snapshot_observed_at":"2026-08-04T08:46:26.643481Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-16T04:39:50.094066Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.643481Z"},"links":{"cited_paper":"/paper/2505.07797","citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:ca40e726a01a871cec4c80dfcc13504901eff395830f317c17823cc2f31a5053","observation_id":"8fafc73c-94ae-4d1c-83ea-ff5f1f9de63f","resolution":{"observed_at":"2026-08-04T08:46:26.643481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.07797/citation-record","integrity":"/paper/2505.07797/integrity","json":"/paper/2505.07797/citation-record.json","paper":"/paper/2505.07797"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:34.354609Z","title":"Explaining individual predictions when features are dependent: More accurate approximations to S hapley values","venue":null,"work_id":"5b702e74-3eff-446e-bcad-1ac7ffd99627","year":2021},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.694553Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:1cc1a43133e605c5891cd68bb9e0e394dbb85c87fe9947696aae7b7a293ef9f5","observation_id":"b75df8c8-fe44-4e9a-bf0a-6459514df13f","resolution":{"observed_at":"2026-08-15T22:13:34.493861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:34.307521Z","title":"Agent strategy summarization","venue":null,"work_id":"723a5b30-92e7-431c-88b5-5879f8fa737a","year":2018},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.719893Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:d658b80ee010a3ed889e13e6dcaab8f6a8d9a667efbc3caa32f2dfe7f917b4d1","observation_id":"f41e524d-ed38-409a-b839-2ae1f4b2ffa8","resolution":{"observed_at":"2026-08-15T22:13:34.316762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:34.261216Z","title":"Weighted voting doesn't work: A mathematical analysis","venue":null,"work_id":"4c23a6a8-9831-417b-bc1a-eb04acbb8f44","year":1964},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.725832Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:f53884e3d2010895da2a3aa9fc3f72dfe657350b2bec1823516b4993d4b5523d","observation_id":"7da5648f-17e3-4a07-ad35-196035d937ab","resolution":{"observed_at":"2026-08-15T22:13:34.290269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:34.134173Z","title":"Verifiable reinforcement learning via policy extraction","venue":null,"work_id":"4b7d3377-a8ae-443b-9d42-cbd02743112d","year":2018},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.731775Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:b309bff5a4affc213c6051a866ca8c28a91ae5a7d95325a8a00a93f220d677ec","observation_id":"0b30c2a8-2608-4114-ad88-d28c6ee99ec2","resolution":{"observed_at":"2026-08-15T22:13:34.178154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:34.112483Z","title":"Explaining reinforcement learning with S hapley values","venue":null,"work_id":"f82c2796-fb0a-4544-9d28-e055394b9a05","year":2003},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.737781Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:520ba781eda41f71a240940db1c6757e555afdc6e1147cbbe790a4657f44aca7","observation_id":"65dd7d5f-9838-405f-a7ef-7ac20624e9fe","resolution":{"observed_at":"2026-08-15T22:13:34.118906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:33.999410Z","title":"Autonomous navigation of stratospheric balloons using reinforcement learning","venue":null,"work_id":"238f7e7c-ca17-4836-9b26-9cbfbde3c78d","year":2020},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.743089Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:38bfbe81f3ed44d73b5d6acf3813c01389959039e5a637132e29b24d53dad972","observation_id":"3db38e5a-5002-492e-b390-9d21e5ee7312","resolution":{"observed_at":"2026-08-15T22:13:34.050436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:33.975234Z","title":"Tripletree: A versatile interpretable representation of black box agents and their environments","venue":null,"work_id":"5dd7a28c-3e78-4689-8dae-8e5019b7bbd3","year":2021},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.748779Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:8dd936ca91896afc60948c6eef3da0bbf5750b52dbff4c9ee5821d5c0b66c117","observation_id":"10ac10ea-2779-495e-8a95-61fb7872fb68","resolution":{"observed_at":"2026-08-15T22:13:33.983134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:33.955702Z","title":"O pen AI Gym , 2016","venue":null,"work_id":"08e14f74-b57a-4125-a52d-960f7cc9ef84","year":2016},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.755499Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:60702b6456f38ae3bdb566ebbe13ba686566ef438092acfe1a78896e84841ab6","observation_id":"1c5d6bb9-a6ed-48a2-8954-007d4951d8d7","resolution":{"observed_at":"2026-08-15T22:13:33.961484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:33.854728Z","title":"Explainable AI for path following with model trees","venue":null,"work_id":"0ca1da0d-7068-45c0-8dd4-7ff5fa591685","year":2020},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.760782Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:d4a92880782502a149d1aa3e5b64c8be80689bd1c5a305658037e393b98e729a","observation_id":"ab3375f5-9553-438d-a70e-fa92c5907039","resolution":{"observed_at":"2026-08-15T22:13:33.919799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:29.765439Z","title":"Understanding global feature contributions with additive importance measures","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.765439Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:d329b177a95de4f95f9dc40fbd0b49ec4ad952721643a97c89651a88161d6ea9","observation_id":"ba79d6c8-171b-48a8-9a3d-2205dc1cb807","resolution":{"observed_at":"2026-08-15T22:13:29.765439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:29.770756Z","title":"Explaining by removing: A unified framework for model explanation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.770756Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:ef5a3eb5e076967778fafc844743e6a8a3a5d99afb098e4b15f43282ba387edd","observation_id":"f36a8e2f-40c3-48cf-bb5c-2d8012223a94","resolution":{"observed_at":"2026-08-15T22:13:29.770756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:29.797833Z","title":"Memory-based explainable reinforcement learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.797833Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:55eade27da012ee97c3bc16c519b018454b6037d57726416826d00ad476395ed","observation_id":"1235803a-e919-4d37-88d7-d3ebb0edf6bd","resolution":{"observed_at":"2026-08-15T22:13:29.797833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:33.733642Z","title":"Explainable robotic systems: Understanding goal-driven actions in a reinforcement learning scenario","venue":null,"work_id":"20059c25-4f33-4e95-b1d2-ff8dd43747a4","year":2023},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.855367Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:ae7643069deb7d7649c2ab067affcae0830f478dc55a3e8758ecbd84b419bfa7","observation_id":"82aa4abf-c193-46f4-8b90-165eb3b543c6","resolution":{"observed_at":"2026-08-15T22:13:33.789302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:33.667307Z","title":"Algorithmic transparency via quantitative input influence: Theory and experiments with learning systems","venue":null,"work_id":"7f10c033-0277-45ae-b660-2661a7a23888","year":2016},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.901911Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:f076b8b051a8b0642686f73908073fbfdb2069a5f9009d69bee2848b54701335","observation_id":"2ecca4b7-237c-4b40-8fd3-e2a602979028","resolution":{"observed_at":"2026-08-15T22:13:33.673208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:29.908129Z","title":"Magnetic control of tokamak plasmas through deep reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.908129Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:69e9bf111a6c9f6fcc456f693af2817a931685e5bdc53944f10ec2223b4df41a","observation_id":"a8f0c82c-7a81-412b-a0ff-81b366dccd54","resolution":{"observed_at":"2026-08-15T22:13:29.908129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:33.498426Z","title":"Hierarchical reinforcement learning with the MAXQ value function decomposition","venue":null,"work_id":"0aff8fd4-a180-4873-85c4-ea5030d640cf","year":2000},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.913141Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:abed2b2d557893b51d2f17b14e8750e8ed517adfd1f889fd7df64c5f8419562f","observation_id":"98f1a582-3d6f-4d7e-90e8-9f729b26e5f3","resolution":{"observed_at":"2026-08-15T22:13:33.576457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:33.477317Z","title":"no clear winner","venue":null,"work_id":"200c33f9-26a5-46c2-932a-0219a7b20c5a","year":2021},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.918646Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:7a3c58733ecf92960ee7129faf5ad189b75ae84615e775a5b53f5a5dbc9bc972","observation_id":"8f0789ba-8cfd-494b-afe5-2d9c89909570","resolution":{"observed_at":"2026-08-15T22:13:33.483448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:33.358419Z","title":"Shapley explainability on the data manifold","venue":null,"work_id":"a19822e7-b862-4674-8c9b-c76efcdbb1d7","year":2020},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.925016Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:a4e58c4489a57c16137577af67dcf88e791acf5171385999d9935fb6f11a75a9","observation_id":"fd872556-dd6d-4845-a926-a82d6daf2466","resolution":{"observed_at":"2026-08-15T22:13:33.463458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:33.297116Z","title":"Asymmetric S hapley values: incorporating causal knowledge into model-agnostic explainability","venue":null,"work_id":"0783836c-f6bc-497b-a818-b60213f530d8","year":2020},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.930686Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:502159a69211ad8b6c0d93f637776a02ef999acafef4fc793660a9228f3b28a3","observation_id":"338a986c-d360-4063-a34b-0b1df0033c9b","resolution":{"observed_at":"2026-08-15T22:13:33.302145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:33.165661Z","title":"Visualizing and understanding A tari agents","venue":null,"work_id":"6ed45879-12f4-4be5-9a6f-e79a1deb3179","year":2018},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.936072Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:d78113dde84f59ed581621fa171c7d56b2f8f9b5a09f0a2548e3845de4218b92","observation_id":"60a222ba-d81c-4c51-a475-4f23d8f2577d","resolution":{"observed_at":"2026-08-15T22:13:33.285669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:33.072063Z","title":"Explainable deep reinforcement learning for UAV autonomous path planning","venue":null,"work_id":"d2238973-b661-45c2-a289-48a760744881","year":2021},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.942779Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:61395992ee9b288dd87a4f70eb77702a12b671369d4c478902d1f5faf520fb46","observation_id":"661123c4-256b-4695-a960-52c24c5d2bfd","resolution":{"observed_at":"2026-08-15T22:13:33.079334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:33.004651Z","title":"Interpretable policies for reinforcement learning by genetic programming","venue":null,"work_id":"f48dbf14-6dff-4349-988c-8365476f8df6","year":2018},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.949566Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:f416dbf7b9905bb5f8bdb45f9310174742e6b20f030c369e43e9c37471e77cc5","observation_id":"8f144a6c-9495-40db-9f5d-652e5f06fd36","resolution":{"observed_at":"2026-08-15T22:13:33.058210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:32.946752Z","title":"Establishing appropriate trust via critical states","venue":null,"work_id":"f2e91d85-aecf-4a7d-b2a7-7e65c151fd2b","year":2018},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.955200Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:2f5e7d5bbbaa33b222d293054b9ab5d54c3b67d7f948b8d09e3525e37c8d23a9","observation_id":"c13af002-2734-467c-93cd-5236f198694c","resolution":{"observed_at":"2026-08-15T22:13:32.954368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:32.921295Z","title":"Feature relevance quantification in explainable AI : A causal problem","venue":null,"work_id":"11ce3a97-eac8-4887-9ff9-cfab24b9ac87","year":2020},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.960868Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:88dbf3adda8b9ab0c553e2ddff8e3b364cb7258739c609d9d644daed730cee86","observation_id":"fcff072f-3485-4e8f-a010-ab5cd5ecbe0f","resolution":{"observed_at":"2026-08-15T22:13:32.929367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:32.776050Z","title":"Fast SHAP : Real-time S hapley value estimation","venue":null,"work_id":"14d8d2f8-8da6-4df7-9523-08764d92f7d0","year":2021},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.966472Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:96397fe7783302f0d226d94264401fbd62a0f2794638bb3c9ff05f0ff78c0a82","observation_id":"0d5a7f3f-9d0f-40ee-bb60-2fcb1880f69c","resolution":{"observed_at":"2026-08-15T22:13:32.815391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:32.755998Z","title":"Policy extraction via online Q -value distillation","venue":null,"work_id":"b576ce96-892a-4c71-9857-390775f2988a","year":2019},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.972569Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:6e28044f22609e171ed57af86a8242b295af87e555b322d8524f285fe9e4587a","observation_id":"61213bc2-0c4a-4777-935e-5935e84be3d6","resolution":{"observed_at":"2026-08-15T22:13:32.763323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:32.734199Z","title":"Explainable reinforcement learning via reward decomposition","venue":null,"work_id":"e46571c1-47d9-4a96-8434-56453efc6c69","year":2019},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:29.994027Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:1457b4923646feed88adea9c4fdede588a5ce4fec63523a5e8ea79800e2a0ae1","observation_id":"a25fba5c-06af-4e40-9066-c63e93a03611","resolution":{"observed_at":"2026-08-15T22:13:32.740395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:32.545580Z","title":"Discovering symbolic policies with deep reinforcement learning","venue":null,"work_id":"ace521b6-1b4c-456d-b069-392f3f2f5283","year":2021},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.082792Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:875bed667d52c53984a3acb8ec7b27f84c4e5f10be7467e106a79faeeef38fb2","observation_id":"3dce75f7-ad98-4fb3-b13a-753b0e9c1c88","resolution":{"observed_at":"2026-08-15T22:13:32.637453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:32.524397Z","title":"Explainable reinforcement learning for longitudinal control","venue":null,"work_id":"4d8c6848-a486-4add-a35c-fea64d42e53b","year":2021},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.136653Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:ebc62b5a151863ec56f77f8ad2a75ba2baa2c4eb536d3b8afdd8f0704029e4c2","observation_id":"da4dd05e-cfb9-4488-a90c-fbffd7d275e6","resolution":{"observed_at":"2026-08-15T22:13:32.530557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:32.502129Z","title":"Analysis of regression in game theory approach","venue":null,"work_id":"5688be64-6612-4cbd-a024-a2cadd3e4b6d","year":2001},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.142106Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:e147e5264c274fcd0d1afed2abe60da665fdc8e2d86e159b340fdbe2d2e608a2","observation_id":"378ca452-4306-4e43-8c2f-f827b575d976","resolution":{"observed_at":"2026-08-15T22:13:32.509922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:32.473084Z","title":"Explainable AI methods on a deep reinforcement learning agent for automatic docking","venue":null,"work_id":"1dccc5df-04eb-4297-b1f0-bf3d90c6190f","year":2021},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.147513Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:78b17cc8a83ed04a8af642d381ea9f2f644c9a5448946a55c069025cad08534f","observation_id":"c4b7103a-b16c-489f-aa49-414ae269a473","resolution":{"observed_at":"2026-08-15T22:13:32.486906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:30.153688Z","title":"A unified approach to interpreting model predictions","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.153688Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:eac45903fee3b47c6d27e547585a0b7d80eb9666c289495b5b71c470c5c8b737","observation_id":"166fa302-e4f2-4925-940e-795c6fed9f7e","resolution":{"observed_at":"2026-08-15T22:13:30.153688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:32.307742Z","title":"From local explanations to global understanding with explainable AI for trees","venue":null,"work_id":"1a60b1e5-e52a-4ce1-9622-05097a4af872","year":2020},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.158093Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:3cb2020c292ccc7878ccb14fef02206d9edaab6b312bf800f3ef2b5a6e889f34","observation_id":"c4c4cf0e-35e9-4669-8387-3b2c5a99c48a","resolution":{"observed_at":"2026-08-15T22:13:32.376742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:32.288978Z","title":"Explainable reinforcement learning through a causal lens","venue":null,"work_id":"3a76573c-d603-44b2-b803-e1d7c8723289","year":2020},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.162951Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:d7ee6954152cff107c6b5a940a0f8cbc178ba7ada2477cfa13095e82a8e0cf73","observation_id":"48f49602-9217-4649-82da-b601489d2328","resolution":{"observed_at":"2026-08-15T22:13:32.295013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:30.168243Z","title":"Human-level control through deep reinforcement learning","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.168243Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:7de800def6f1f6a1966ac01dedbdf5d21f9d34ef67d2a8a43c5e792f40fff591","observation_id":"967709b8-5b52-40c0-bce0-d06bd8d3b4f1","resolution":{"observed_at":"2026-08-15T22:13:30.168243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:32.260032Z","title":"Sobol' indices and S hapley value","venue":null,"work_id":"39cb364c-b2d5-4625-bca0-043b6883db82","year":2014},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.173493Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:29e7a4fef28f929896ee3a8b8cfab03d7bebfe954e78a00da7882c13955b8424","observation_id":"08f87e67-fd69-432d-8fc8-121e3c5b4635","resolution":{"observed_at":"2026-08-15T22:13:32.265897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:32.146065Z","title":null,"venue":null,"work_id":"5da66fc0-280b-46e1-aa05-a4157e290e61","year":1989},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.178632Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:2a7409fe2d96d50f010818fd422cb8d4db139211c7d00ca692fc2db2df1efa3c","observation_id":"e85a4c3f-1d20-47a4-91cd-212c425e6f03","resolution":{"observed_at":"2026-08-15T22:13:32.204300Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:32.036814Z","title":"Explain your move: Understanding agent actions using specific and relevant feature attribution","venue":null,"work_id":"b0eeb921-7df0-4529-a916-1cee28aa62d0","year":2020},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.183069Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:b6d27b3ac4ae83cb1de9c029aa3ed04f51ab2cf5b4733cba1fb68dfc6d5aa009","observation_id":"4ecd31a7-4947-4723-b41b-fa3c1c0e0cc5","resolution":{"observed_at":"2026-08-15T22:13:32.084441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:32.012649Z","title":"Causal versus marginal Shapley values for robotic lever manipulation controlled using deep reinforcement learning","venue":null,"work_id":"b2892478-5381-41b9-bcd1-8428bb2fae1b","year":2022},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.188376Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:8976796b0b3c45aa14a42eb95bf6ba85e9d2e24008decea8dec97193eed98fd8","observation_id":"0da12dc9-daaf-4627-a690-9ac08418c7c1","resolution":{"observed_at":"2026-08-15T22:13:32.018796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:31.977089Z","title":"Reinforcement learning with explainability for traffic signal control","venue":null,"work_id":"00915fc0-1018-4562-8a98-778907cb4c5d","year":2019},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.193433Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:4c21ecc871c5b727dbab99a330848882e36ba5933d224fcbfc5c14a91ac7089a","observation_id":"e5594969-b9c2-44cc-8c88-3e8b93964a60","resolution":{"observed_at":"2026-08-15T22:13:31.998385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:31.818404Z","title":"Finding and visualizing weaknesses of deep reinforcement learning agents","venue":null,"work_id":"2372de56-f482-4681-94c0-ff5a43bd80a2","year":2019},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.198998Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:4523b99077efb9e5a0da72207aa17039894a0b46e65b16d303189d16e181cd3c","observation_id":"04871576-0fe3-4988-9700-8086148a1a2f","resolution":{"observed_at":"2026-08-15T22:13:31.902783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:31.794751Z","title":"Towards explainable deep reinforcement learning for traffic signal control","venue":null,"work_id":"5e7a72a7-f786-4dfb-89f6-270d6a1c03ee","year":2021},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.205015Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:40e5d4c0d2c11a16cf17a25391e73e90ffadf4ab9148dbd3d61117bef50487e3","observation_id":"cd25ee77-a084-4e0a-8faa-e49be10e0dae","resolution":{"observed_at":"2026-08-15T22:13:31.802855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:31.775782Z","title":"Mastering A tari, G o, chess and shogi by planning with a learned model","venue":null,"work_id":"d4906639-2fa8-4e84-afa1-3c8a4a95f215","year":2020},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.210678Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:f0e8514536a3287e7b146b4d0fdf369120de88cd996d80247cb7d6ab7efce76b","observation_id":"9ddc6db6-e7c0-45e0-af60-1bdddef43501","resolution":{"observed_at":"2026-08-15T22:13:31.780766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:30.216134Z","title":"Avoiding fusion plasma tearing instability with deep reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.216134Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:a67bf71c5941c507fd4df2e24806ab70740e4ecc641ee5f29e5c2677163fd47f","observation_id":"7d25d902-8174-4755-bebb-53c0ca3271f8","resolution":{"observed_at":"2026-08-15T22:13:30.216134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:30.303856Z","title":"A value for n-person games","venue":null,"work_id":null,"year":1953},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.303856Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:ff371bb3745dfbbf94f373c4f086cdfa162f943b96656e85ae5e8f6900dd42ea","observation_id":"9de1eb20-3579-47a7-b4d4-ad79f8eada99","resolution":{"observed_at":"2026-08-15T22:13:30.303856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:31.572643Z","title":"Optimization methods for interpretable differentiable decision trees applied to reinforcement learning","venue":null,"work_id":"de75abec-9456-46c8-bdd8-2e6449357b82","year":2020},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.418410Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:03751c1b6eacedadd1abe3ab560b744cfb14db0ae3d0a5b52e10063abd2f9e3b","observation_id":"06e6d9a7-f34f-45fb-b4c1-444bd4f46f03","resolution":{"observed_at":"2026-08-15T22:13:31.677539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:31.527692Z","title":"Mastering the game of G o with deep neural networks and tree search","venue":null,"work_id":"358fe5a3-c28e-4053-8134-adc01a72a515","year":2016},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.424567Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:99ea57b2f21f4c1a97c98c2e2aa49d330ae6edf5e476e4dbb09888ffdf242941","observation_id":"b359122c-0230-4f57-99c1-ec8a951ddf0f","resolution":{"observed_at":"2026-08-15T22:13:31.532906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:31.499501Z","title":"Mastering the game of G o without human knowledge","venue":null,"work_id":"511bba05-de2c-4f44-9a42-117a398a6726","year":2017},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.430712Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:a598ef6e0a1d22e076cfaec1a65d6b56c0f01e44a992d1b394f6c1ac371361ce","observation_id":"f8c49884-44cc-412e-a7ad-81c56095a7ca","resolution":{"observed_at":"2026-08-15T22:13:31.508286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:31.474886Z","title":"An efficient explanation of individual classifications using game theory","venue":null,"work_id":"60078b27-ff1f-4817-aac2-f0f71c7940ad","year":2010},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.438402Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:c4e8cc01bf5f843e2aaba85663c54c070d57319dca8ccff298daeb2990a96dd9","observation_id":"72fe805f-6f97-4acc-bcf7-b1f0c64804ab","resolution":{"observed_at":"2026-08-15T22:13:31.485611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:31.439950Z","title":"A general method for visualizing and explaining black-box regression models","venue":null,"work_id":"ac6c1321-97cb-4f0c-9f7d-5c97f10f4a3a","year":2011},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.445019Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:099bfd40f807a85b248a7d5c0622c3ce9907e9d0fcdffa552f2fa87f49e8840a","observation_id":"dbfa3f24-7c7e-43d9-9f2d-74b87fa2b4a9","resolution":{"observed_at":"2026-08-15T22:13:31.448950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:31.388608Z","title":"Explaining prediction models and individual predictions with feature contributions","venue":null,"work_id":"8f5be810-7242-422f-b5f6-d1fffb2f7911","year":2014},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.450998Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:515f35009a695329ee6ba945302109bad596903afbcc777a5e34f07c3e869e0a","observation_id":"e59857f8-ed4f-47be-a8fb-d489efdbf211","resolution":{"observed_at":"2026-08-15T22:13:31.421098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:31.326918Z","title":"Explaining instance classifications with interactions of subsets of feature values","venue":null,"work_id":"f2d63f4f-4a02-4da8-8ffa-bb2d58754a2f","year":2009},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.456664Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:343480ddc6b248c9224127b46130364da7b9d06e7d943b8d00cceaa2ae6e0e0b","observation_id":"8b3f2ff6-3deb-45f4-93a0-89437ead22ab","resolution":{"observed_at":"2026-08-15T22:13:31.332978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:31.299481Z","title":"The many S hapley values for model explanation","venue":null,"work_id":"b60ea49d-d728-4afc-a062-6eb3527c2814","year":2020},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.464999Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:40ca20cfc9d869d2b6780206b5ab2920bfabf738bf145b5b6d10f18f5fd8999b","observation_id":"a3001a63-afb2-4afc-8fce-0e4201844eb4","resolution":{"observed_at":"2026-08-15T22:13:31.305560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:31.278933Z","title":"Axiomatic attribution for deep networks","venue":null,"work_id":"86671548-3b8d-40bc-94ea-fe7bbd4a85b7","year":2017},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.557903Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:ab127f185fdb53d2df4664d905d8a70817d0ee1582f7bf1070b4232406f1a5cf","observation_id":"8152726b-1b3c-4dd0-b6d0-dd219d390be7","resolution":{"observed_at":"2026-08-15T22:13:31.285351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:30.647192Z","title":"Reinforcement learning: An introduction","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.647192Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:2753636acfb204311fbf20fbe45710e819ddd767e74bcd441a80f45f2b74e589","observation_id":"68045945-0e97-4a9a-8c91-2b1b9ca6224a","resolution":{"observed_at":"2026-08-15T22:13:30.647192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:31.244934Z","title":"Explainable deep reinforcement learning for production control","venue":null,"work_id":"ec77cc83-3299-4d8f-819d-7d63e8cecbe9","year":2022},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.652406Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:00f4e7da19cd33fe2d70f227b3b42d05bc6de081c5f1fa99c34cf4db6a1dc9f8","observation_id":"fcd8b455-561b-4d74-a147-a502720fbbd1","resolution":{"observed_at":"2026-08-15T22:13:31.252069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:31.185847Z","title":"Iterative bounding MDP s: Learning interpretable policies via non-interpretable methods","venue":null,"work_id":"89cfb359-4ea5-42c5-89e0-9584a8d47bfe","year":2021},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.657547Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:14ba4443dca47a59961fb0dd850caeac2540c03b3c1a4b46d2c86831f9d355a4","observation_id":"9e7fc8de-a479-4989-bb9b-4b93d9053d05","resolution":{"observed_at":"2026-08-15T22:13:31.230804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:31.117086Z","title":"Grandmaster level in StarCraft II using multi-agent reinforcement learning","venue":null,"work_id":"dec4f32f-3075-48a1-a8ce-d51e1d30c706","year":2019},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.664123Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:ba000ab0cd0091c6d506345b3b949c057b514a9f1364f596368075411b70edbf","observation_id":"feac85dc-334d-403b-9d4d-0ece6f97e01b","resolution":{"observed_at":"2026-08-15T22:13:31.123086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:30.670014Z","title":"von Neumann and O","venue":null,"work_id":null,"year":1947},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.670014Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:3676de0f820484d72b9309af6c2ce39e117e2945757e9da83d8a0d7e7c19978d","observation_id":"b6212d7f-1dd0-43e0-9b3e-112b19b56e55","resolution":{"observed_at":"2026-08-15T22:13:30.670014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:31.086374Z","title":"Training characteristic functions with reinforcement learning: XAI -methods play connect four","venue":null,"work_id":"ca781f0b-d477-4a45-9548-48f9c1c02599","year":2022},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.675778Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:0a8ee989f5b1d27e3b52f94962ca49e9cc5acbb27c8f02c491978c6ddbd722de","observation_id":"8b076cc3-dfdf-4754-b4e9-b3881ebedc27","resolution":{"observed_at":"2026-08-15T22:13:31.091997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:31.070964Z","title":"Attribution-based salience method towards interpretable reinforcement learning","venue":null,"work_id":"5d510477-c007-4a00-9ca4-2fc27e4ce22e","year":2020},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.681846Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:c958d9d2494f147f21e9ac7a34d972016aff236072703d11f9b81e19adc87a41","observation_id":"baf0c58a-a9c2-4529-b29c-ae174f5d523a","resolution":{"observed_at":"2026-08-15T22:13:31.075745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:31.051821Z","title":"Dueling network architectures for deep reinforcement learning","venue":null,"work_id":"136a7c76-cc6a-4c6a-881c-84daec58b873","year":1995},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.686702Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:930b1346c3182ca7e8a2c84f96b2077f041c156bf8fe97ba79640651ad3c7448","observation_id":"b46f06b3-d3c2-43da-8556-613ccd294b54","resolution":{"observed_at":"2026-08-15T22:13:31.058816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:31.032492Z","title":"Q-learning","venue":null,"work_id":"b096009e-3f3c-4e4c-b19e-d066a72f5699","year":1992},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.693852Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:aa94b68b4aa5253815c7382953fc01ba1a99783eb904763046b3d97e8b015dba","observation_id":"27ac284e-1f38-44dd-aecd-866d6f11dd1a","resolution":{"observed_at":"2026-08-15T22:13:31.038436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:31.014473Z","title":"Efficient nonparametric statistical inference on population feature importance using S hapley values","venue":null,"work_id":"513e9393-66b5-49fc-b771-aac7da33779b","year":2020},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.700433Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:fa121d31aef857b2e9119809d95e60463124fe80475f3cc76316aab992b3ac30","observation_id":"ef409d2c-d010-4a86-90bf-a070e559c57a","resolution":{"observed_at":"2026-08-15T22:13:31.020006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:30.996047Z","title":"Outracing champion G ran T urismo drivers with deep reinforcement learning","venue":null,"work_id":"870f4162-0a08-4322-ab74-561246bb8f3a","year":2022},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.707354Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:06dd3cfa5082b981aab156dccd56edd5f5de6af8cb3a5664690441c1f8024dd4","observation_id":"f90cd95c-5eae-404c-a7f2-914d8d03f1be","resolution":{"observed_at":"2026-08-15T22:13:31.001657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:30.916688Z","title":"Explainable AI in deep reinforcement learning models: A SHAP method applied in power system emergency control","venue":null,"work_id":"8aeca97c-0e67-4032-a7e7-8176b50720f0","year":2020},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.712967Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:80751e7deac656af97e950533225b899b6ec1e9e794ee3bb31d76d6e703b9388","observation_id":"ecaf061b-a616-45d0-b567-76d98cb6ef67","resolution":{"observed_at":"2026-08-15T22:13:30.982502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:13:30.766081Z","title":"Explainable AI in deep reinforcement learning models for power system emergency control","venue":null,"work_id":"61af9f3c-3221-49eb-ac71-e64d19e03d8b","year":2021},"citing_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-15T22:13:30.719721Z"},"links":{"citing_paper":"/paper/2505.07797"},"observation_digest":"sha256:fd58bac2327d74c6cf05fd2aa6b47fd40f2d5b44d8b1b983836790cf8ccc2f8b","observation_id":"a4b8b6af-4df6-4f2d-be11-eb31ee13edae","resolution":{"observed_at":"2026-08-15T22:13:30.847105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T22:05:44.738447Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":56},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 1 inbound Pith citation observation for arXiv:2505.07797."}