{"as_of":"2026-08-11T00:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1dd157d426e89207208d95038a0353f706d91ac6f0b5fd8101cef6f6fdc86e50","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:51:37.495684Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T01:13:11.483599Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T20:38:55.871103Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"cited_work":{"arxiv_id":"2507.14901","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.14901","snapshot_observed_at":"2026-07-03T20:38:55.871103Z","title":"arXiv preprint arXiv:2507.14901 , year=","venue":null,"work_id":"0ad7ef3f-d394-4143-87c9-b257ceb74b4f","year":null},"citing_paper":{"arxiv_id":"2606.18089","last_updated":"2026-07-05T17:40:26Z","snapshot_observed_at":"2026-07-12T13:34:39.011240Z","submitted_at":"2026-06-16T15:55:28Z","title":"From Reasoning Traces to Reusable Modules: Understanding Compositional Generalization in Language Model Reasoning","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-06-27T01:13:11.483599Z"},"links":{"cited_paper":"/paper/2507.14901","citing_paper":"/paper/2606.18089"},"observation_digest":"sha256:5303c1058c9ca98d68006217f936e42cb1f6d124b8ca7f8332509f1603db7ec0","observation_id":"750427c3-6156-4f82-80be-4ce14ec2e6ed","resolution":{"observed_at":"2026-07-03T20:38:55.872495Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.14901/citation-record","integrity":"/paper/2507.14901/integrity","json":"/paper/2507.14901/citation-record.json","paper":"/paper/2507.14901"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.345101Z","title":"Mastering the game of Go with deep neural networks and tree search","venue":null,"work_id":"9f0ddcf7-67e8-41ff-9ef0-bc945a76fa33","year":2016},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.266533Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:fe618325b5af80892ef86e3c848965769518805354766fc8fd2441a124652881","observation_id":"c996a0ed-63c1-43bc-acea-b116e46d4fae","resolution":{"observed_at":"2026-08-06T15:51:38.350707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-06T15:51:37.272028Z","title":"Playing atari with deep reinforcement learning","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.272028Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:0fc4ee214d4815c9e75a5bca28d0f559a99b904faf0af6533a00769c7d59350b","observation_id":"d3a92e27-364d-4403-8015-737a8d3a7b7d","resolution":{"observed_at":"2026-08-06T15:51:37.272028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.323060Z","title":"Reinforcement learning in robotics: A survey","venue":null,"work_id":"0ffd70f6-99f6-4a39-ba07-34372f35ad8c","year":2013},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.278064Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:cabeb8944e9c28ea3bfa21aa654ab9f549df251c0c8f0c7bd75576794cd8226b","observation_id":"13efe497-c48a-4eb8-b7f2-aa9cd992a0a9","resolution":{"observed_at":"2026-08-06T15:51:38.330692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.294369Z","title":"Resource management with deep reinforcement learning","venue":null,"work_id":"42e568fa-251b-4dbb-b9f4-70f3d2ff65e3","year":2016},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.283822Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:fbb5b6206c0fdb66a23d8c4f5e59701254296253e6a9182aee5db624b29945f9","observation_id":"9c5ddcdc-76b8-4b30-b285-98c9dcfb7fc1","resolution":{"observed_at":"2026-08-06T15:51:38.302120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1604.07316","last_updated":"2016-04-25T16:03:56Z","snapshot_observed_at":"2026-07-06T04:53:59.754200Z","submitted_at":"2016-04-25T16:03:56Z","title":"End to End Learning for Self-Driving Cars","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1604.07316","snapshot_observed_at":"2026-08-06T15:51:37.289123Z","title":"End to end learning for self-driving cars","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.289123Z"},"links":{"cited_paper":"/paper/1604.07316","citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:ad9e061003d4994002f92fe6e543dfb383d1ac6dbd06358136eaab83cea25ee3","observation_id":"f6bc40c8-296c-41b7-831f-8d63d4b72b9c","resolution":{"observed_at":"2026-08-06T15:51:37.289123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.271994Z","title":"Reinforcement learning based recommender systems: A survey","venue":null,"work_id":"4419be4c-c13e-4478-8b29-0f58bfcc1918","year":2022},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.294637Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:c0cd7e97d2c69527d4a8b4ab7e5b5ec4139bf2bb6c014ae4d438e7824ef6bb9b","observation_id":"5f3ee64d-9fcd-4e88-934d-8000b51c2f17","resolution":{"observed_at":"2026-08-06T15:51:38.277061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.252288Z","title":"A review on reinforcement learning: Introduction and applications in industrial process control","venue":null,"work_id":"8c245379-2f2d-4d49-8789-0a907901b5ba","year":2020},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.301545Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:af1343f85e0f393c3e23f3db7b3fe6308bab621ed60caba268688cb6fb754643","observation_id":"b8c337f6-bd16-4313-b1f4-08e289837d3c","resolution":{"observed_at":"2026-08-06T15:51:38.259262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.229654Z","title":"Targeted Reduction of Causal Models","venue":null,"work_id":"e97dd02d-7b7a-427d-9794-1a9e0218d923","year":null},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.306817Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:2f9fbf73ef10261e370049a728830010e748c34ed2312306b0f798b8e4138836","observation_id":"d5e13382-5942-4d95-a0a0-e8ae69e58dcd","resolution":{"observed_at":"2026-08-06T15:51:38.237252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.187221Z","title":"Causality","venue":null,"work_id":"7de4bc0b-6be1-445a-8f0d-2db010bbffbf","year":2009},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.316979Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:f3b607130453501cea4739b79a72df6137d6cc602c4133813e6f6b8f9c6a08ce","observation_id":"dc779504-5c2d-4899-9bac-a3eba4581158","resolution":{"observed_at":"2026-08-06T15:51:38.192843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.165159Z","title":"Elements of Causal Inference – Foundations and Learning Algorithms","venue":null,"work_id":"dab998fd-4593-472a-9358-dcc8c882a61f","year":2017},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.321785Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:d263c9d8652615bf534a049d7b161d5a78d31dcc41dc6e3f23a8c3c6e74bb159","observation_id":"3d7f21a3-a9c1-4a92-96a6-5a3cba8a0666","resolution":{"observed_at":"2026-08-06T15:51:38.171955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.143092Z","title":"Abstracting Causal Models","venue":null,"work_id":"8d4c0e75-61c3-41b4-be07-3554c5fb0729","year":2019},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.327967Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:377b33ddc10ee121daf3a43c94c948dae5d0be6f6002e281839b54e0e6774204","observation_id":"1842fbfd-2e17-4c27-baa7-6860a213115d","resolution":{"observed_at":"2026-08-06T15:51:38.151157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.123000Z","title":"Approximate Causal Abstractions","venue":null,"work_id":"e66d8b0a-284e-4e61-b608-5e1392f37abe","year":2020},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.333042Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:fbd0499f9703afda3719da1b60c802a30ebbcdaa11516de396d1bda0acbc4837","observation_id":"39bc8457-3cd2-4e20-bcb0-5b1bd2e8210a","resolution":{"observed_at":"2026-08-06T15:51:38.128006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.103001Z","title":"Causal Abstraction with Soft Interventions","venue":null,"work_id":"f7f19eb2-4527-426c-be94-04bfea1c065d","year":2023},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.337908Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:eb097b59650f1a46173fa36e8a3134d65be0955c8d382f0b9032e42ef008f9ef","observation_id":"7694d6ea-c01d-4faa-aaf3-59cc967fae51","resolution":{"observed_at":"2026-08-06T15:51:38.108359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.080873Z","title":"Compositional abstraction error and a category of causal models","venue":null,"work_id":"6aa727b0-9b5f-4f1c-a0c1-c44e276837d3","year":2021},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.343403Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:d1bfe8c3ef389c8e0f321a4c4152234d0fc8cfcad6830feadc13036e8fe6ce6c","observation_id":"e58c0533-2ce7-4186-8d35-9ec41c874277","resolution":{"observed_at":"2026-08-06T15:51:38.086804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04709","last_updated":"2025-05-08T23:00:37Z","snapshot_observed_at":"2026-08-10T18:23:22.371661Z","submitted_at":"2023-01-11T20:42:41Z","title":"Causal Abstraction: A Theoretical Foundation for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04709","snapshot_observed_at":"2026-08-06T15:51:37.348803Z","title":"Causal abstraction for faithful model interpretation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.348803Z"},"links":{"cited_paper":"/paper/2301.04709","citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:68920afb7762bc761bb81ec18f14270eea4a3ff9f4718205509c725164405ebf","observation_id":"4ecdeea4-ca1e-4230-8825-1855bc0ca1db","resolution":{"observed_at":"2026-08-06T15:51:37.348803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.056071Z","title":"Visual causal feature learning","venue":null,"work_id":"34b5ba42-62c0-4974-8aad-e18bf979e85c","year":2015},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.354099Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:1e695c3420b6aaa5ecb4d6a5acc33f8d51a4bab23829c55806c22de516583e08","observation_id":"ef440e19-8954-40df-8a91-650817e81f34","resolution":{"observed_at":"2026-08-06T15:51:38.064441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.036682Z","title":"Causal consistency of structural equation models","venue":null,"work_id":"1377acfc-46b6-469e-91ae-c7bfbd49af6e","year":2017},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.358642Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:06431a187f15b96f0b01464e57e8ba038df5167226a02a17e4c19723830522c0","observation_id":"442984d5-a9f9-4ade-b3e0-cd46dd24725e","resolution":{"observed_at":"2026-08-06T15:51:38.042834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.017739Z","title":"Homomor- phism Autoencoder–Learning Group Structured Representations from Observed Transitions","venue":null,"work_id":"d3f7faee-c43e-4f34-b4c6-b7d7e705effd","year":2023},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.363208Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:782ec61fa77b1aca869de822fea1bdad9276cb52277cfcf38182c390ee0d31b5","observation_id":"78cf3f97-fb04-412d-ad77-fc8b2fef3ff5","resolution":{"observed_at":"2026-08-06T15:51:38.024586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17032","last_updated":"2025-11-02T13:42:19Z","snapshot_observed_at":"2026-07-06T18:51:06.750136Z","submitted_at":"2024-07-24T06:35:05Z","title":"Gymnasium: A Standard Interface for Reinforcement Learning Environments","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17032","snapshot_observed_at":"2026-08-06T15:51:37.368467Z","title":"Gymnasium: A Standard Interface for Reinforcement Learning Environments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.368467Z"},"links":{"cited_paper":"/paper/2407.17032","citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:a84ae5967dcddc72102db4692cf4fb943232984114d2d1ff787ee5c6f79accb3","observation_id":"cfe8954d-212a-4e89-a73b-2bbd02d0cc79","resolution":{"observed_at":"2026-08-06T15:51:37.368467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.994536Z","title":"Learning to play table tennis from scratch using muscular robots","venue":null,"work_id":"58262990-d177-4d72-9731-cf16fc97cbc3","year":2022},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.373740Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:d4253be24e857434bc00756b3f2797228bf5bd414f84562f9e97d9405890308a","observation_id":"8191d131-a17a-4d61-8fad-91056cfc21e6","resolution":{"observed_at":"2026-08-06T15:51:38.000926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.978171Z","title":"Safe & accurate at speed with tendons: A robot arm for exploring dynamic motion","venue":null,"work_id":"5977a44e-4412-4005-9514-ad84ee70a7e8","year":2024},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.378670Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:1d89c5da162755df0de2f17a420cf62487635102168bc977a0cc03759c28e119","observation_id":"94589efd-bd16-4145-8b33-daccf0f594cf","resolution":{"observed_at":"2026-08-06T15:51:37.983185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.961650Z","title":"Explainable reinforcement learning: A survey and comparative review","venue":null,"work_id":"98598850-104c-45cd-b656-fbb760da1863","year":2024},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.383546Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:631a13f1594536d6d71dff4921bff31865cc3c1cb75cda4f78a3ac8bf04950bd","observation_id":"9cee4fc6-7cd1-419b-ab02-b0d7cbe61986","resolution":{"observed_at":"2026-08-06T15:51:37.967569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.945082Z","title":"Visualizing and understanding Atari agents","venue":null,"work_id":"00912c0d-69b3-4720-a95c-6d8b7d2112cc","year":2018},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.389396Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:b06968744b638c5bc00ff14f070bc3e531b40ef947c1910c29c230eff10c8b13","observation_id":"073134fe-be44-444b-a248-1261899fbdd7","resolution":{"observed_at":"2026-08-06T15:51:37.950030Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.928748Z","title":"Transparency and explanation in deep reinforcement learning neural networks","venue":null,"work_id":"dd9ceb53-e07c-44c1-8e85-3cd72008cdd2","year":2018},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.394262Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:9ca152cdf5a810f79711e65c15159d13bd80122860e89e1f8064174c2cb09601","observation_id":"422b1cd2-0d11-49dc-ae39-b79406e8d39f","resolution":{"observed_at":"2026-08-06T15:51:37.933941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.912353Z","title":"Towards interpretable reinforcement learning using attention augmented agents","venue":null,"work_id":"958ada96-f0fe-43ee-b566-6a2384a547c9","year":2019},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.400049Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:4bac401ef5759615f7df55e45c36ab1c19a48ce9f6ee8e7c215dcd6fc8d6f9e5","observation_id":"0d0c8e15-c119-4931-85b4-07b1195709af","resolution":{"observed_at":"2026-08-06T15:51:37.918084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.894822Z","title":"Explainable robotic systems: Under- standing goal-driven actions in a reinforcement learning scenario","venue":null,"work_id":"f25e131b-4fbd-4100-9f4e-1bdeefb46c1e","year":null},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.404901Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:a0c341556e4b5b19d2b2c240c4f2073da14ada164b2fa072de669a98dcc0b976","observation_id":"2f817359-2cf9-4f5b-b3ed-8c2149af47a4","resolution":{"observed_at":"2026-08-06T15:51:37.900836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.878856Z","title":"Explaining reinforcement learning to mere mortals: An empirical study","venue":null,"work_id":"d33264e6-e985-4d1a-a8a8-91f386608f54","year":2019},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.410288Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:da139e9355db012bf171b707624171b749368e64169dcdd856c589f1d52bf1e5","observation_id":"0731a134-e957-444a-bc9f-6ead1652a7bf","resolution":{"observed_at":"2026-08-06T15:51:37.883975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.862033Z","title":"Learning \"what-if\" explanations for sequential decision-making","venue":null,"work_id":"721e1470-060b-442d-ad56-c4326e0d5807","year":2021},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.415048Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:411617d8063893f9e1ecdc023665dd95f5a139fb24721d0a5537c1c10b852a05","observation_id":"72e5ddf2-be85-4494-929f-e2850e358765","resolution":{"observed_at":"2026-08-06T15:51:37.867244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.844229Z","title":"Graying the black box: Understanding DQNs","venue":null,"work_id":"ebb927ec-ec4b-4462-b44b-fb4408d2e943","year":null},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.419818Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:11e68607ea7c9457a0906058cde5fc5ca9c796fb30b7d7318e2af811b86f7a8c","observation_id":"a54b121b-5235-4e93-8eee-1d2dfbd287c8","resolution":{"observed_at":"2026-08-06T15:51:37.849813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.827357Z","title":"Generation of policy-level explanations for reinforcement learning","venue":null,"work_id":"c60cac84-0e01-4ee3-9724-63bf57ade5e1","year":2019},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.425178Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:093ae529691699dfad6f42d95cf7645163b048acb78df474eb38363f43662e1d","observation_id":"ee84d02c-791a-4b0f-a01d-1ece076cd3c5","resolution":{"observed_at":"2026-08-06T15:51:37.833618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.806419Z","title":"TLdR: Policy summarization for factored SSP problems using temporal abstractions","venue":null,"work_id":"414f15cf-dfcc-4986-b2b7-2fb47f5178bd","year":2020},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.430381Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:b8435ffff4a28635ff660d56f6efc6009918047db5026c84da570191a63e8c40","observation_id":"9267c37f-385a-4c34-a9c2-cec05a521d51","resolution":{"observed_at":"2026-08-06T15:51:37.812888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.788725Z","title":"Explainable reinforcement learning through a causal lens","venue":null,"work_id":"5fa47f21-558d-44dc-9dc0-9d83c26ec0bf","year":2020},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.436342Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:2195925620363de595488fb549b054080d46cba145661f4548796324bd538c32","observation_id":"f290b596-ced0-4c63-b473-c29dd69035af","resolution":{"observed_at":"2026-08-06T15:51:37.795008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.772170Z","title":"Causal abstractions of neural networks","venue":null,"work_id":"9007c8fa-7191-4e91-96e5-f6b6923979f8","year":2021},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.441148Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:f2f662f96a606a0ad5931d92188fd53d501f2c7a24ae21d004e4b3348328bff9","observation_id":"d0371ab7-c37f-4c11-9fb1-b4cd23cf7617","resolution":{"observed_at":"2026-08-06T15:51:37.777692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.755388Z","title":"Segment anything","venue":null,"work_id":"5364d725-19d4-45d1-b55a-17957f041b15","year":2023},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.446132Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:b7721761485d8e0e620f7f3d07b42cce65bcf10ef9370a1010b7b8dd90008b42","observation_id":"32c7e9ef-373c-46ad-a735-46ac73f5df31","resolution":{"observed_at":"2026-08-06T15:51:37.760111Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.739125Z","title":"Grad-CAM: Visual explanations from deep networks via gradient-based localization","venue":null,"work_id":"da5bf658-627b-4f49-ba3d-b4529a18f0df","year":null},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.453979Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:a5519f2b27c240a1bd55a667bbaf3b0c50c495a3afc432d87dc14c7b81485681","observation_id":"c6d279c7-9ac4-4e9c-96c7-7fdf2563759d","resolution":{"observed_at":"2026-08-06T15:51:37.744252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.721196Z","title":"Foundations of structural causal models with cycles and latent variables","venue":null,"work_id":"c8b14d2a-dd46-456b-8720-63dc2c4213c1","year":2021},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.459902Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:4aeac99c5fa2eb7cc535444aa0882694beaed25f10a2974ab8d415ecb4d1b8c1","observation_id":"506935a4-89b3-441b-8d66-ae28f18e397e","resolution":{"observed_at":"2026-08-06T15:51:37.727134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.704349Z","title":"Dependence, correlation and gaussianity in independent component analysis","venue":null,"work_id":"81b9d523-cf3a-4b2d-8edb-c177ad569b00","year":2003},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.466360Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:c11dbaadcdc4c8d2cee096dd1e966c065d1336deb3edb50b9c454b234bccd426","observation_id":"0f986416-cc18-4aaf-b1d5-2d6a3fa1cbeb","resolution":{"observed_at":"2026-08-06T15:51:37.709254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.686046Z","title":"Stable-Baselines 3: Reliable reinforcement learning implementations","venue":null,"work_id":"be0eec90-227c-44a7-be0c-5321ad8d6645","year":2021},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.471536Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:ff6f59b3361edb93d23b0ae74053363c510579683d522f03ebce5891e02f3723","observation_id":"1fcdcd2d-dcc3-4c41-9ec7-25fe42b0c189","resolution":{"observed_at":"2026-08-06T15:51:37.692501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T15:51:37.477154Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.477154Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:7a8579c3a96789ed3280df2cac9c578639374779d90b41ab9082ce0b93a791b8","observation_id":"814cd2cb-92ff-4d17-a93c-72f28dd5e93e","resolution":{"observed_at":"2026-08-06T15:51:37.477154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.667274Z","title":"The high-level model has (n+1) endogenous variables {Y, Z1,","venue":null,"work_id":"021025a1-ed1c-4956-b558-e2f7498f5c91","year":null},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.482934Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:faf8ee855bbf49da8efbf8e85f82cd305fdf63c845faeae664b7624858cfd78b","observation_id":"bf472ef0-6772-40db-b29b-1bce7b2d9b99","resolution":{"observed_at":"2026-08-06T15:51:37.673668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.646891Z","title":"The exogenous variables {W0, W1,","venue":null,"work_id":"a23a8f2b-8815-496c-8614-aaba361925ef","year":null},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.489483Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:14924dd55080c147d281b6b2ce2a1452cfbf33fcc94a654f86ec02f497303f08","observation_id":"c7b768c2-5b5a-4aed-b5e3-e492691afd4f","resolution":{"observed_at":"2026-08-06T15:51:37.653791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.627853Z","title":"(id − f1)−1","venue":null,"work_id":"68cd8c10-d6f3-40bd-a7df-235d9234591b","year":null},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.495684Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:3ab5274c4300d9e7ba01f9e114d9543283da01fb8170d1fa23f296fdca34d99f","observation_id":"b4eb86eb-1987-477e-bc8b-154b844b785d","resolution":{"observed_at":"2026-08-06T15:51:37.634033Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.206175Z","title":null,"venue":null,"work_id":"352110fa-cfc7-40ad-8022-145d1d82f20a","year":null},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.312001Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:c8f396e3053c57848091b82672c49bb31336e77457c9bbaa4548a37713e50164","observation_id":"824cb148-9f02-49f3-90c1-c643ed51f9a8","resolution":{"observed_at":"2026-08-06T15:51:38.211855Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","latest_version":1,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":3,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":34},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 1 inbound Pith citation observation for arXiv:2507.14901."}