{"as_of":"2026-08-10T14:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c74c1095440d65215d1a85470ba802acda27ab230948f707e7ff22af620ed143","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:36:43.205768Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T15:01:52.583181Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T11:16:11.205349Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"cited_work":{"arxiv_id":"2507.07848","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07848","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"” so, tell me about your policy...”: Distillation of interpretable policies from deep reinforcement learning agents.arXiv preprint arXiv:2507.07848","venue":null,"work_id":"6b980dea-1fe6-405b-8052-856d83b718ef","year":null},"citing_paper":{"arxiv_id":"2604.13332","last_updated":"2026-04-14T22:37:11Z","snapshot_observed_at":"2026-08-02T10:38:01.109229Z","submitted_at":"2026-04-14T22:37:11Z","title":"Selecting Feature Interactions for Generalized Additive Models by Distilling Foundation Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T15:01:52.583181Z"},"links":{"cited_paper":"/paper/2507.07848","citing_paper":"/paper/2604.13332"},"observation_digest":"sha256:e4faf3cd83d2d05a3b47dc56e0ba3a5e64032aaa3ff5e23824dd382cc017216e","observation_id":"7bde5198-5a12-4239-a8ec-c2bba0cf3aba","resolution":{"observed_at":"2026-05-11T11:16:11.210837Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.07848/citation-record","integrity":"/paper/2507.07848/integrity","json":"/paper/2507.07848/citation-record.json","paper":"/paper/2507.07848"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1912.05743","last_updated":"2020-02-20T21:40:15Z","snapshot_observed_at":"2026-08-08T05:42:44.138258Z","submitted_at":"2019-12-09T12:42:07Z","title":"Exploratory Not Explanatory: Counterfactual Analysis of Saliency Maps for Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1912.05743","doi":null,"metadata_source":"pith","pith_arxiv_id":"1912.05743","snapshot_observed_at":"2026-08-06T18:36:44.231362Z","title":"Exploratory Not Explanatory: Counterfactual Analysis of Saliency Maps for Deep Reinforcement Learning","venue":"cs.LG","work_id":"75e353e1-c3bf-4129-8c6e-f40bbde23135","year":2019},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:40.623694Z"},"links":{"cited_paper":"/paper/1912.05743","citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:9b97e8a3a4f71a5ce7098d75ac42a489bc9bedc7dcb7e8eed97edf0f3e73ae36","observation_id":"95f26998-1e1a-4156-a40e-5a588965f3ad","resolution":{"observed_at":"2026-08-06T18:36:44.309466Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:46.202769Z","title":null,"venue":null,"work_id":"15191901-d9a7-46ab-9140-8750dd7fbc03","year":2014},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:40.660920Z"},"links":{"citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:66a5770ebd4b818a9508bf74e72ba9951dacbf6b31dc248efe2d71e8183c4e09","observation_id":"f6f4d27e-7671-4d63-9e53-ab4d21e4f298","resolution":{"observed_at":"2026-08-06T18:36:46.273991Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:46.019085Z","title":"Bastani, Y","venue":null,"work_id":"dff63051-9992-47ab-b1d5-9cd3afce0416","year":2018},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:40.718851Z"},"links":{"citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:45694933a2a50a18138a5d99bcba38fb0f8651122baa93c8b39f1e69d181b306","observation_id":"104725c9-b729-4cfc-8cd3-4f41033a0f4a","resolution":{"observed_at":"2026-08-06T18:36:46.087533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:40.793229Z","title":null,"venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:40.793229Z"},"links":{"citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:3cf7ea91a6b2c2247a84d8aa11d041ceaff182cf33c9447f97020c3d566e935a","observation_id":"27e70747-2d56-420a-baef-1cbe2d3e9fd6","resolution":{"observed_at":"2026-08-06T18:36:40.793229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1603.02754","last_updated":"2016-06-10T23:23:51Z","snapshot_observed_at":"2026-07-06T04:48:50.430645Z","submitted_at":"2016-03-09T01:11:51Z","title":"XGBoost: A Scalable Tree Boosting System","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1603.02754","snapshot_observed_at":"2026-08-06T18:36:40.967804Z","title":"Chen and C","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:40.967804Z"},"links":{"cited_paper":"/paper/1603.02754","citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:7ac567d8c19c2544bb8b438116f9dcd9752f23752cb0a422ed6b40609f62f20c","observation_id":"c0e22369-6a5d-41d8-b013-eff8da762ef3","resolution":{"observed_at":"2026-08-06T18:36:40.967804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:45.808587Z","title":null,"venue":null,"work_id":"d2be5544-2e3f-4eac-84d6-88d92fb7b0bf","year":2019},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:41.043766Z"},"links":{"citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:efdd0a0b01c8266f75621888f64a0e12146e2f3d087daf50a9c811428e090b86","observation_id":"23ecd545-926a-4970-8040-937706c6b044","resolution":{"observed_at":"2026-08-06T18:36:45.889984Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.11371","last_updated":"2020-06-23T01:48:56Z","snapshot_observed_at":"2026-08-08T09:58:42.167795Z","submitted_at":"2020-06-16T02:58:10Z","title":"Opportunities and Challenges in Explainable Artificial Intelligence (XAI): A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.11371","snapshot_observed_at":"2026-08-06T18:36:41.113929Z","title":"Das and P","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:41.113929Z"},"links":{"cited_paper":"/paper/2006.11371","citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:d8caac9e0f6832fbf0b48aff4e0ae22acd5089cc09b40e5b0511bc16772a278f","observation_id":"489c0ef0-f354-42e1-a11a-235f990ce760","resolution":{"observed_at":"2026-08-06T18:36:41.113929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:45.558875Z","title":"Ernst, P","venue":null,"work_id":"c974e843-97b6-4cda-bd80-0abeb5e903ca","year":null},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:41.216849Z"},"links":{"citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:4ab9821a1945577286ad9204951f74b2c589a0c1fdc6dd1c494115d52919f587","observation_id":"16701200-0bf9-4c6f-9939-32dcf01d684c","resolution":{"observed_at":"2026-08-06T18:36:45.687095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1012.0349","last_updated":"2013-04-01T13:17:55Z","snapshot_observed_at":"2026-07-06T02:20:03.344744Z","submitted_at":"2010-12-01T23:25:03Z","title":"Limit Order Books","version":4},"cited_work":{"arxiv_id":"1012.0349","doi":null,"metadata_source":"pith","pith_arxiv_id":"1012.0349","snapshot_observed_at":"2026-08-06T18:36:44.020549Z","title":"Limit Order Books","venue":"q-fin.TR","work_id":"79d5a629-c4d7-4490-a674-4b78f051e984","year":2010},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:41.329870Z"},"links":{"cited_paper":"/paper/1012.0349","citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:9435e136ea88a0110d89251b02c3e54466e2febcc2f3bb11da6b3904fe395017","observation_id":"656f1846-0d53-4fbf-813d-e5f41bd200be","resolution":{"observed_at":"2026-08-06T18:36:44.062766Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.01290","last_updated":"2018-08-08T21:27:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-01-04T09:50:50Z","title":"Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.01290","snapshot_observed_at":"2026-08-06T18:36:41.411462Z","title":"Haarnoja, A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:41.411462Z"},"links":{"cited_paper":"/paper/1801.01290","citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:2b0d60ba7c722376e2d5732626d033ea30a1d3c651dcd662080bb11d2af0b42e","observation_id":"6ba3920d-a826-461d-bcb6-cbd1bffb587c","resolution":{"observed_at":"2026-08-06T18:36:41.411462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.03476","last_updated":"2016-06-10T20:51:29Z","snapshot_observed_at":"2026-07-06T04:59:35.089671Z","submitted_at":"2016-06-10T20:51:29Z","title":"Generative Adversarial Imitation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.03476","snapshot_observed_at":"2026-08-06T18:36:41.470280Z","title":"Ho and S","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:41.470280Z"},"links":{"cited_paper":"/paper/1606.03476","citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:73712b507fa35c66e73a8e46f90002bd6f4007589b54c2fdec23ea2c9b532777","observation_id":"e656d7bd-221f-4f68-a2ca-59e5cc2fcdf0","resolution":{"observed_at":"2026-08-06T18:36:41.470280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-06T18:36:41.556842Z","title":"Kaplan, S","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:41.556842Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:1bd2205a212bb9b06fdf4902216982019c830a55da89540a1450dc21f634e1f3","observation_id":"77dba5d7-122a-4f18-b8ce-95e62973adcf","resolution":{"observed_at":"2026-08-06T18:36:41.556842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-06T18:36:41.595975Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:41.595975Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:9abe054f70b2a9cfcf4fc06735b9a1045f852875fb9be36e94d3a62771d23101","observation_id":"f7b17c13-5645-4e65-b605-f3a140014281","resolution":{"observed_at":"2026-08-06T18:36:41.595975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:41.687392Z","title":"Likmeta, A","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:41.687392Z"},"links":{"citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:75039a970cb37b8fa73eb5a93c756081755e943f6e583f8a67c901e1a2f7fea1","observation_id":"47703804-323e-4b65-ac94-1eba4ec94ead","resolution":{"observed_at":"2026-08-06T18:36:41.687392Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.07874","last_updated":"2017-11-25T03:53:32Z","snapshot_observed_at":"2026-07-06T05:43:42.722222Z","submitted_at":"2017-05-22T17:38:10Z","title":"A Unified Approach to Interpreting Model Predictions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.07874","snapshot_observed_at":"2026-08-06T18:36:41.924890Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:41.924890Z"},"links":{"cited_paper":"/paper/1705.07874","citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:a331237f25262b3d5e816f0bfbdc69d509a5fa60932ab1dd85df4c301e23a414","observation_id":"70293423-5513-4844-baa7-0a4d62ec54de","resolution":{"observed_at":"2026-08-06T18:36:41.924890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:45.193470Z","title":"Madumal, T","venue":null,"work_id":"a9e5491b-2287-4f72-a322-247bd1a434e8","year":2020},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:42.021385Z"},"links":{"citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:7edc24dd780c6a894a74985a802218f20fa1156d6d10b6bc179401001092efa9","observation_id":"bacba575-7fc9-4467-99da-ea6302ffcf9b","resolution":{"observed_at":"2026-08-06T18:36:45.257069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:42.087560Z","title":"Milani, N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:42.087560Z"},"links":{"citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:5bc4981bc5c9b359a545e9e51f804c88ba69f32470d69a61fc937410caaf6092","observation_id":"c154b661-19aa-4164-b508-bee8ded4520d","resolution":{"observed_at":"2026-08-06T18:36:42.087560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-06T18:36:42.181918Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:42.181918Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:754a6e56bc4499b5fb0a782c1d79fc245a842d14b3709fba6cafadd215130910","observation_id":"6c056548-b9df-4bf5-807d-18451ced58ad","resolution":{"observed_at":"2026-08-06T18:36:42.181918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:44.946903Z","title":"Pirotta, M","venue":null,"work_id":"59a38468-cdd1-41c1-a8ad-5796ea114100","year":2013},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:42.277595Z"},"links":{"citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:465c85e413691e3dc79564953dd05a8649968bfbb3a290bea49ddf1550913ba1","observation_id":"b4690ba5-7521-406e-aae4-ab9fa632357d","resolution":{"observed_at":"2026-08-06T18:36:45.047639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:44.866465Z","title":"Raffin, A","venue":null,"work_id":"53bda944-4ca0-47c6-86fa-6e07ee512307","year":2021},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:42.358506Z"},"links":{"citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:441973b3efc870f748e16603154fd942a2b2d6cc426c194d7cd54d944c30fb36","observation_id":"f085db74-bd2b-42a6-a196-1ac52e376e34","resolution":{"observed_at":"2026-08-06T18:36:44.908894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:44.735979Z","title":"Ross and D","venue":null,"work_id":"04b20a75-8b7b-43c4-b88b-b1057662d297","year":2010},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:42.413581Z"},"links":{"citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:1db097d7b03e2ae0467301833cd95e857f7e575657c9128c7d9dd8fb6acb6a39","observation_id":"cb27aa3c-4d3d-4bda-9c18-0f555ee3d69e","resolution":{"observed_at":"2026-08-06T18:36:44.783928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1011.0686","last_updated":"2011-03-16T18:51:21Z","snapshot_observed_at":"2026-08-03T22:17:51.826967Z","submitted_at":"2010-11-02T17:55:55Z","title":"A Reduction of Imitation Learning and Structured Prediction to No-Regret Online Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1011.0686","snapshot_observed_at":"2026-08-06T18:36:42.485427Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:42.485427Z"},"links":{"cited_paper":"/paper/1011.0686","citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:46fd2953adbacfc29ea401526fd9460cce1952f0fab1267124966c7c43163c71","observation_id":"486bbe3a-042f-4a19-9e8f-de5fcefde6d3","resolution":{"observed_at":"2026-08-06T18:36:42.485427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06295","last_updated":"2016-01-07T18:43:03Z","snapshot_observed_at":"2026-07-06T04:37:06.738855Z","submitted_at":"2015-11-19T18:38:47Z","title":"Policy Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06295","snapshot_observed_at":"2026-08-06T18:36:42.537434Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:42.537434Z"},"links":{"cited_paper":"/paper/1511.06295","citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:00cbc453d3413932bdb32aa81d930f900779e80a7e3174e5824d00034b2694e3","observation_id":"c55ec9d5-e171-4c49-9c7f-1b1f518d4003","resolution":{"observed_at":"2026-08-06T18:36:42.537434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:42.598639Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:42.598639Z"},"links":{"citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:a68ecc608ccddf3972095477c05505a3993780db00ea41a345bceba84cdcce52","observation_id":"d18e3e25-e6a1-490b-8443-d6213004d448","resolution":{"observed_at":"2026-08-06T18:36:42.598639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:44.600647Z","title":"Silver, A","venue":null,"work_id":"5eec0e33-1a9b-4a04-9498-4394c84218a1","year":2016},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:42.677150Z"},"links":{"citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:12cec75d5cb40e28473462dfee07bc111ebad718a6cb7a4fa7ccc5fb11c453f3","observation_id":"388688a3-fd09-4b5b-949f-687de9beb5a0","resolution":{"observed_at":"2026-08-06T18:36:44.645786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:42.779161Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:42.779161Z"},"links":{"citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:2edc960637af50e4ee1a12803e06a6b6650234269685cc45bb36d195ef180297","observation_id":"e95d96f0-0bdb-4331-b3d0-b4e332e00e93","resolution":{"observed_at":"2026-08-06T18:36:42.779161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:44.402766Z","title":null,"venue":null,"work_id":"81738ad0-e688-4e46-a17b-601e1c7a32cc","year":1999},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:42.846940Z"},"links":{"citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:d1deab2a5de4b7c950e9c4bc91bbb5e9bdc06af0bd1009843d13313b7d647f84","observation_id":"f1eb5a81-083f-4518-aecf-1bafe7294808","resolution":{"observed_at":"2026-08-06T18:36:44.445279Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17032","last_updated":"2025-11-02T13:42:19Z","snapshot_observed_at":"2026-07-06T18:51:06.750136Z","submitted_at":"2024-07-24T06:35:05Z","title":"Gymnasium: A Standard Interface for Reinforcement Learning Environments","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17032","snapshot_observed_at":"2026-08-06T18:36:42.916690Z","title":"Towers, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:42.916690Z"},"links":{"cited_paper":"/paper/2407.17032","citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:d0620d6dfeabc3424b0465ccc03efadcf36a007b2decfedee55a3dc304626ef7","observation_id":"089f3cf2-aea5-43ee-9f2f-e3b3a05e0edb","resolution":{"observed_at":"2026-08-06T18:36:42.916690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:43.159262Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:43.159262Z"},"links":{"citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:c3cf977ad440ae07a7004e56c31bd7ed4202f1faaa0cf0a3fc3ce1a0a8088615","observation_id":"e26d1c88-95fd-4fcf-8e06-47c21d96bc1e","resolution":{"observed_at":"2026-08-06T18:36:43.159262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:43.205768Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:43.205768Z"},"links":{"citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:c1cab15d64a1e278de83e238ec906edf9bc88c9e7db2803b73b9820775286019","observation_id":"b86bce2e-9fc8-48d8-aea1-7379b5bca79b","resolution":{"observed_at":"2026-08-06T18:36:43.205768Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.02477","last_updated":"2019-04-10T09:09:46Z","snapshot_observed_at":"2026-07-06T06:32:12.791177Z","submitted_at":"2018-04-06T22:17:18Z","title":"Programmatically Interpretable Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.02477","snapshot_observed_at":"2026-08-06T18:36:43.074284Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:43.074284Z"},"links":{"cited_paper":"/paper/1804.02477","citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:c7dfe44a012119e810408600d84afe81e40fcd68605fa9131a19b2e3dee261f0","observation_id":"87dc3488-3b3b-4306-bec0-a90966db9e2b","resolution":{"observed_at":"2026-08-06T18:36:43.074284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:45.342988Z","title":null,"venue":null,"work_id":"5b33463a-eafb-4c61-b080-b414ab7fc068","year":null},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":2005,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:41.267103Z"},"links":{"citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:c0ba41ccb2ac28e00b12c3b06bc37d499511068ef693959551f4a737c1779d0d","observation_id":"69b28478-8241-419b-8742-e5a319229a82","resolution":{"observed_at":"2026-08-06T18:36:45.437240Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.05887","last_updated":"2018-07-16T14:31:35Z","snapshot_observed_at":"2026-07-06T06:50:27.545199Z","submitted_at":"2018-07-16T14:31:35Z","title":"Toward Interpretable Deep Reinforcement Learning with Linear Model U-Trees","version":1},"cited_work":{"arxiv_id":"1807.05887","doi":null,"metadata_source":"pith","pith_arxiv_id":"1807.05887","snapshot_observed_at":"2026-08-06T18:36:43.615919Z","title":"Toward Interpretable Deep Reinforcement Learning with Linear Model U-Trees","venue":"cs.LG","work_id":"a023148e-087b-497a-a2ee-02d209d765aa","year":2018},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:41.844751Z"},"links":{"cited_paper":"/paper/1807.05887","citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:9c399c952a4246ce699175c779647030ccc8bf986d139e742de28041590f30b5","observation_id":"84856176-ead1-4ab0-afb5-719450b71aec","resolution":{"observed_at":"2026-08-06T18:36:43.680643Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.07107","last_updated":"2023-08-19T08:10:38Z","snapshot_observed_at":"2026-07-06T10:33:27.116166Z","submitted_at":"2021-01-18T15:09:28Z","title":"Deep Reinforcement Learning for Active High Frequency Trading","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.07107","snapshot_observed_at":"2026-08-06T18:36:40.897742Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:40.897742Z"},"links":{"cited_paper":"/paper/2101.07107","citing_paper":"/paper/2507.07848"},"observation_digest":"sha256:4fda0d3b44f066e7798f640ab5cdd338411e7f632730ec9b7e231170cc7c0809","observation_id":"e18f7011-50c9-4c5c-a035-9cb088ecb4d3","resolution":{"observed_at":"2026-08-06T18:36:40.897742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.07848","last_updated":"2025-07-29T08:20:12Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T01:42:24.583381Z","submitted_at":"2025-07-10T15:27:44Z","title":"\"So, Tell Me About Your Policy...\": Distillation of interpretable policies from Deep Reinforcement Learning agents"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":3,"verified_fuzzy":7},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 1 inbound Pith citation observation for arXiv:2507.07848."}