{"as_of":"2026-08-10T03:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f3538631964eae299e16e52b7a4429e7b70db87c958a433fe5f8e55fe3119b65","coverage":[{"denominator":84,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":84,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T04:26:46.686445Z","state":"measured"},{"denominator":84,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":84,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.11607/citation-record","integrity":"/paper/2607.11607/integrity","json":"/paper/2607.11607/citation-record.json","paper":"/paper/2607.11607"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"and Dabney, Will and Munos, R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:221323277fd2c9fac391c5c0dbbabe402363287735430cf3a53e4f29d865bd73","observation_id":"07c5f6ea-14ac-4a3e-8538-f9e8d97a6ba6","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"and Munos, R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:407fe1301e518c46104c85fc1268a913d379b9aa8f3526515133304a13cf2cbc","observation_id":"4c0ef432-56cb-4992-920a-2546213e609d","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Implicit Quantile Networks for Distributional Reinforcement Learning , booktitle =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:028d06ffa340e710a33192b120971d6e85c781de288a64310f889305ffe72fb7","observation_id":"cb78d32e-b002-43f1-82a5-5f9156e5a5d1","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Advances in Neural Information Processing Systems 32 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:2af596b9261c3904fa19dffe2faa5159fccc2ec36569189822d51bcb244b0bd8","observation_id":"812b35ab-c0ab-4b5d-9862-c35307f589fd","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Proceedings of the 26th Conference on Uncertainty in Artificial Intelligence , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:c8493e1b5a64ada15b4fba8ea842199ad5ebc9c4659a5acdbf8194a0aad03fde","observation_id":"05c4d6f0-f22d-46f7-9f63-ec9107415332","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Proceedings of the 32nd AAAI Conference on Artificial Intelligence , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:22ccfc3806eb98bce5fbe7c4485520133bde08fd29ffbf90fd9c40115830e10d","observation_id":"317407dd-a447-4935-87b5-362a9947ba78","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"and Dabney, Will and Rowland, Mark , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:dd24ac9daad67e1e6499a6be0e299b417b5b174b79153a9670ba35bc6ce2ad14","observation_id":"59f324e4-62b5-4d58-88c5-4f655e0bcebe","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"and Dabney, Will and Munos, R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:81c5bfeb1efd02b55e122def704d66e8bef565074ebe50755f612540750cb588","observation_id":"1794598f-40ca-41e7-9fc6-8148abf803b0","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Statistics and Samples in Distributional Reinforcement Learning , booktitle =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:4d85ac31e81497da952670362134e882ed57f7f786faa86d9c7c5af5aa89ed0c","observation_id":"ec00b305-6452-43ec-b596-ed17731ea3b9","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"An Analysis of Quantile Temporal-Difference Learning , journal =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:87e00c5825fa5dfa7838e4b5d9bc9e6ef61abd6b64b9d0dcbafdba6989ae7bcd","observation_id":"7048172d-ea8d-4db9-bc89-4acc27e694b7","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"The Statistical Benefits of Quantile Temporal-Difference Learning for Value Estimation , booktitle =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:7475daa68015bb776c594ca5c35fc6afd64f6c99e86dff19c38dc9523cb9c62e","observation_id":"54e75638-b9a4-448b-8985-4dffcb838710","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"and Castro, Pablo Samuel , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:de70a786216241cf5273f3b4cb5ca72c9658dc4e3772cba4ccff24a13d17dc7b","observation_id":"38a2924a-2be0-42b5-8e18-65ee7b7437aa","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Proceedings of the 35th AAAI Conference on Artificial Intelligence , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:1daee549b53676af088533165fb49bb2df2b861d237a7c4b7116cadf06e9ed8b","observation_id":"2a42f21f-4212-4165-8fda-d94f621ad8b5","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Proceedings of the 36th International Conference on Machine Learning , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:3a5364d52ffd7bcfe8d8956599a5975cd7f5a87710ecff92a81251493846198f","observation_id":"512040d8-36b2-4655-aff4-b97385fc5673","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"A Distributional Code for Value in Dopamine-Based Reinforcement Learning , journal =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:419b2341fd6ead1a2a0cc5d9ac81b38a7a7ca2e50104c26f6c5f81119860d060","observation_id":"3e3de727-46f0-45bb-8910-675a70e22c7e","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.10743","last_updated":"2017-05-30T16:53:12Z","snapshot_observed_at":"2026-08-06T18:27:48.415058Z","submitted_at":"2017-05-30T16:53:12Z","title":"The Cramer Distance as a Solution to Biased Wasserstein Gradients","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.10743","snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"and Danihelka, Ivo and Dabney, Will and Mohamed, Shakir and Lakshminarayanan, Balaji and Hoyer, Stephan and Munos, R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"cited_paper":"/paper/1705.10743","citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:24ecf276d2d7ba2d118ab1db00a58f23f6a897c0ab429072c96dd7c174483b39","observation_id":"d32d4421-0f6c-4c07-b6a8-81067de06c40","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":", title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:6802d0193e4b5df0c5050f0352d7ef1b5945a452da0277499ea363ffb382419d","observation_id":"5f2a773f-cd2e-4443-9da5-0d6294117307","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Mathematical Finance , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:117bdc56cd91d1322682bb79f13714360e552a10977533284d70ee0451bce63e","observation_id":"dadb9f79-ee50-47f3-ba45-ea475530120f","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Tyrrell and Uryasev, Stanislav , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:6b4a09b1e7399065494ab94e0b9816c35507987688a277f9c9ed279d321d23c2","observation_id":"39e8d6cd-01f5-439d-9c3e-9c8618e220ba","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Proceedings of the 29th AAAI Conference on Artificial Intelligence , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:698fd1ad2d1ee0a915e32511ce88110088263b3c5aa1d9e228e8082f66e6712d","observation_id":"79bf6618-dae3-45cd-aaeb-330eebc80e0d","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Advances in Neural Information Processing Systems 28 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:5509b8a18596a3078e0738697128c7b6bc4e691422a003e295c59ec4b5edaa73","observation_id":"b713a23d-d97b-485f-b6d8-e0d0079e772e","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Proceedings of the 34th AAAI Conference on Artificial Intelligence , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:ae6a321bf7824fe34950cb0e0430e92c73b079cc2a07a6dc1a7c9879593bbd0f","observation_id":"35a59d11-368b-4855-a961-f222021114dc","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Proceedings of the 3rd Conference on Robot Learning , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:0125c8e2e83f94d9e43c13011c254c6943ed2fdc5bc1339499f7962e2f63277c","observation_id":"c7deca0e-0eb6-4c1d-af96-0b1989f54fe3","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Advances in Neural Information Processing Systems 35 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:ec1773c74d79f91af2a08f3bdd4f257f9848de3e2e949879316984e1fdd009a9","observation_id":"2ec33822-86e8-4cfd-b105-3fbe19136a99","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Advances in Neural Information Processing Systems 35 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:f6f48494aeae332e9c3059356e3d895b2e5d934df386decf080c99aca8219ddb","observation_id":"781beefc-85c9-45bd-b3ec-9ca019fb8b04","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"and Van Delft, Bastien and Robaglia, Beno","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:083740e8f62459affdfe0e5ede4eac73112046a849b9eedf34a67004915f363f","observation_id":"eea3c6c3-38f3-43ce-8910-5e38f3d98afb","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Disentangling Epistemic and Aleatoric Uncertainty in Reinforcement Learning , journal =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:af10e8058db0ee03928fa4639ece749dafd8276bb61580a8bb70e7682c3599e0","observation_id":"07a8a63d-313e-46cf-a20f-8c48453abf42","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:10ba1c2d16a06178bce4534dd468d92264dcca72d22e314260a05e6f5d58b2ea","observation_id":"701bf79a-3e98-4f06-a010-b00d8835167d","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Advances in Neural Information Processing Systems 38 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:48f5131ed63728a8d7daa15b09a7de173a4200b2b67c566834d8d19c8076e1b1","observation_id":"8740a5cb-7687-45ca-845b-a09ba0324d07","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Proceedings of the 38th Conference on Uncertainty in Artificial Intelligence , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:0e1a83c907b4a4b736c490ac001a30e7954336aa9e73731df87603a189cf8613","observation_id":"45ffda48-a7d2-445d-815b-a8be69fd7876","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Advances in Neural Information Processing Systems 29 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:e6c3d41f1b120e45849a3000a521fbc78bd31df16a80f3416b82707bed978bd3","observation_id":"040034d0-8f3e-4579-8120-75b7bc9e8cc2","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Proceedings of the 33rd International Conference on Machine Learning , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:619f316c07867ebf01647de7dfd629ae2a034ca33e35f77d6c525925b564775c","observation_id":"def8c7ba-f230-47e1-a28b-9e5b8147e781","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Advances in Neural Information Processing Systems 30 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:08dcc5066d11eecd2b10b5063ba83bbed03ed8770032323f7c9e76d135478186","observation_id":"fba58bef-3f48-4159-b438-05a503909a8d","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Advances in Neural Information Processing Systems 30 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:219b532dc833c545fe902fe4f5c79d44aededf4647f64ff0fe6c27a569dc4e60","observation_id":"cce851e6-6717-447c-af84-20b57168a41f","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Decomposition of Uncertainty in Bayesian Deep Learning for Efficient and Risk-Sensitive Learning , booktitle =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:29c51a813070da715889b5ad18045c7026f4afbdd53cd9934ed2685e8a3ba5ce","observation_id":"6fd61611-b8fd-4ae7-abd8-6d5e6e6a97ac","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":", title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:b9d2ff66645e24d377fb5f4a9c5280f296668f0e651037286b12167d11eea7dd","observation_id":"3ede77e2-a9d9-4d60-ac8a-aeb4a7d43b72","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Proceedings of the 40th International Conference on Machine Learning , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:284219918062f1b9d10e84055eabb73d79adb668558bb424b41ee9a7d86d1b54","observation_id":"d454ffb6-7758-4071-a8d7-035a3574820d","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"arXiv preprint arXiv:2309.17262 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:7201b7312a10d2a1931eb991d81f4f9eb988e59dc5afc2586aa601b0f6a00f68","observation_id":"aa72a3dc-6f60-4b4a-8174-d5526ac355bc","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"and Abate, Alessandro and Johansson, Karl Henrik , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:d8106b1b144ade824ce0a9dab809c75009aac857dc78f426a161ceb94b7d0014","observation_id":"b04f1329-1f6c-4f0d-ae03-c99da6e70bcb","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"and Bellemare, Marc G","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:020ae48f8ba73f6216391e233ce781991606adee37d7dc4bdaf39ff854cf4b18","observation_id":"a0d58206-cb1a-47ab-8803-3827d40d09eb","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"and Naddaf, Yavar and Veness, Joel and Bowling, Michael , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:aa580ff8fcd30b85e18781ce39bf04735ef95e7408fc064023a2941864127531","observation_id":"eb64b2c3-b4c5-4674-b6a6-d197f26b5dd6","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"and Veness, Joel and Bellemare, Marc G","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:a527780b9b10e06b76d206a29ec353616d87527a150944a41b47aa398af28d94","observation_id":"d30e0946-5f17-43fb-8049-9a3187441688","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Proceedings of the 32nd AAAI Conference on Artificial Intelligence , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:a1b11484db9edf5fc4322944b961da7c743a15499817b083c251df26139e6aa5","observation_id":"4a593f7b-58d9-4440-ad96-c80427895e0d","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"and Bellemare, Marc G","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:4c8d743e8bcf80b0b18268e9c4e87624200bb8840f6e12b7412b1da5d22818c2","observation_id":"998c8076-580a-4469-ab50-488027c4d8cd","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"How Many Random Seeds? Statistical Power Analysis in Deep Reinforcement Learning Experiments , journal =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:45b142a35bb02d460621117ea7aaac968c97d6cc14e4901cccb4b642802a43cc","observation_id":"ee5438b9-66ac-4710-99e0-a6a7dabf626e","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Journal of the Royal Statistical Society: Series B , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:e449360e92f4d0fe824166e4be363f6042bf6fdb216779fd967de9ddad777470","observation_id":"7538ab3d-e809-41ec-b071-fd568b1a7c71","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":", title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:42e7fcbd8869dcc23f02e3ccd9f3289823293db8f1c4235747851f4d2463f63e","observation_id":"94ec0549-ffa4-4812-aa6b-bf628031be2e","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Probability Theory and Related Fields , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:1bcf70ed334a3216acf94ae55030ef30cd6e3a6d15edb2859f1667042e15ee8a","observation_id":"e304105c-7be4-48ae-8c9d-52761d74fda4","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Bernoulli , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:35617f8d9b05b99e5cd33be736b097b7b0221c955bbf2ef7da6ad900f8761081","observation_id":"40c4f88a-4031-440e-90de-897fc21e96ae","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"On Wasserstein Two-Sample Testing and Related Families of Nonparametric Tests , journal =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:47b06cd0047ed3ce5f155c63aa1e7be3864e0a8ce927f0a4ec3b0ae30e7215b9","observation_id":"bf804891-2973-4d70-8c3c-ece579263973","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Optimal Transport: Old and New , publisher =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:4f7ec9369b9411033f0f1b728bea6afa464824b60cdb2b3e14490cec0847b0f1","observation_id":"d2ded779-633a-4dd6-8ff7-c1d6fc0da32e","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Proceedings of the 35th International Conference on Machine Learning , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:63759fcee1aa706043a4433ae14cf361f965213b0f900ff746c7a7473373d5f7","observation_id":"6dec67c0-fd86-48e6-933b-ddd83fc0713a","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Proceedings of the 8th International Conference on Learning Representations , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:43ad0522eb3e255cccb07b199d7c739b0f1e19e179069e010cea531fb0197a9f","observation_id":"820139f5-0509-4bc7-b5d0-35e8b2074508","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06565","last_updated":"2016-07-25T17:23:29Z","snapshot_observed_at":"2026-07-06T05:00:46.434335Z","submitted_at":"2016-06-21T13:37:05Z","title":"Concrete Problems in AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06565","snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"Concrete Problems in","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"cited_paper":"/paper/1606.06565","citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:e96e2098879d4ac1b35c23534b334bacef12c2db2974a1f0963da145968337ff","observation_id":"ad2d7d34-34a8-4ba0-99aa-96cbc8718a0b","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"A Comprehensive Survey on Safe Reinforcement Learning , journal =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:1bd2278034dd692ab2c8921e8b3e394cac5c951d160fa5b10272833abb00061c","observation_id":"e37426dd-f146-4fad-b8a7-fa63a32e23b8","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"S.; Courville, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:17a3b8aaf17c57f18da0aaf9ed1650a2fc4332a07a1d75ad1af360e47b0c0868","observation_id":"b1eb89aa-0021-456d-a246-723a00ebe150","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":null,"venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:4ed2f72858e18cf412d04e146d1dbeb5d96fe8d23df12300937e31680bf89dc1","observation_id":"828b0bbc-3e45-4d6e-a4e2-41d6d717e944","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:c69687afdbdd3f899dbbfc8ae1c3ad46c8d59c59512927263b135b9ca28f4458","observation_id":"bcc3bd56-4189-4293-be1c-04d68a97ce01","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"G.; Dabney, W.; and Munos, R","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:200332f7af65c24eefcde201768c3e5cc24a5c031e0db7c252198a12425964aa","observation_id":"a60218c5-8144-41be-950a-2ce3e8666505","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"G.; Dabney, W.; and Rowland, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:b05b16f87875973bdeecff39c5cd10959b49a23d9ef48a44137d63cd152b6a20","observation_id":"0c28bf15-116a-4f3a-8d9c-de26381a07e4","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":null,"venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:7663ac8b67c63b2dcf48c12ec3fdf958b291881e6b69ac060e008e89367023a7","observation_id":"f20f5549-a9c7-48cb-81ee-25552366061b","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.01558","last_updated":"2022-06-03T13:20:16Z","snapshot_observed_at":"2026-07-06T13:17:08.463007Z","submitted_at":"2022-06-03T13:20:16Z","title":"Disentangling Epistemic and Aleatoric Uncertainty in Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.01558","snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"cited_paper":"/paper/2206.01558","citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:bd83a7d6b2700019adf86e8596a2b9e3100597246c99270a5a39c09a5377612f","observation_id":"e8f4e2fa-ba1f-4f80-8d62-56ce881b50da","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.09638","last_updated":"2020-09-09T15:44:27Z","snapshot_observed_at":"2026-07-06T07:54:57.584936Z","submitted_at":"2019-05-23T13:13:56Z","title":"Estimating Risk and Uncertainty in Deep Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.09638","snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"R.; Van Delft, B.; Robaglia, B.-M.; Slaoui, R","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"cited_paper":"/paper/1905.09638","citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:21aac7bc24c05eb8442925f687327fbc9c0dd5921578f3ad73f09d3eee692004","observation_id":"81d0e5b2-0f0c-4829-9f45-d5455a0fa4ef","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:0af0be92f40958736f2d6cb9dbf06e9c5f0ae36363bbaa628e39c8eb0a146d60","observation_id":"81356bd8-e0b8-4da7-bc34-22c9337bc51c","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"G.; and Munos, R","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:d569b0816f37ca5b371d9480ab8cce6130043e259fee0db924a9bea0a8107d45","observation_id":"2ec6bdb7-7b47-4124-a132-1490326ac2b9","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:efb4f1310d8511462657abc03b79321d26e1cecba7bf0acb09c276d9700d0b55","observation_id":"3885af49-f821-402f-b59c-2d9e11246036","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:e9785dc39fb4647155586f809c2e86f6a44ee50bd05f34f1887538fa6f4d0f3e","observation_id":"5c673460-6e4e-4926-8e9d-6aedbe6b8d3a","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:69116a31966f56c954f6bb932f19d6782213cbcee233f9ba137cb3f64458983f","observation_id":"887296c3-c056-42cf-af5b-fea4ed513b5e","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:9abf0d25bbcfb610d96f3d28d566fb3b07483e259fa63690df9516bf023cd8a2","observation_id":"f2863f82-8553-4c28-9809-1351e4dabdcd","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:8fc4754d6f1f9ce4ede3a1432a2eba37898c09aa57ede279284d02a1f78a1899","observation_id":"f4e69bbe-3b2d-4697-8240-85e5cb0f0a65","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.10266","last_updated":"2021-10-17T15:46:46Z","snapshot_observed_at":"2026-08-08T07:17:04.388957Z","submitted_at":"2021-05-21T10:36:16Z","title":"Ensemble Quantile Networks: Uncertainty-Aware Reinforcement Learning with Applications in Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.10266","snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"cited_paper":"/paper/2105.10266","citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:f657a73c6b3ca5d9a81d329cd971bcc9d0ec065dbdbe0c112e23a849e28d716e","observation_id":"3a028f49-88e1-42f2-ac9a-28e10ae1065c","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:e9a6f7a4dce3e35bbb0cfe1ebe60d6871e57b4464dc5070f041303d60c1be13b","observation_id":"bf726e02-8563-4d85-a3e1-0e4662588c18","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"H.; and Malik, I","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:c10ae4d3fd736b4310fb20f9c5e294a3ff0a179055098d26d2c815b9d8d1eafc","observation_id":"a9b42d7a-50ef-4696-bde0-3f4dec8d1a95","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"G.; and Castro, P","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:354db3627cba23367cae65a761f6acc5d35ec6d90dc42911f878f571e9a5a7c6","observation_id":"f89e98c1-0b50-449f-b2ab-b19e90921d9e","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"C.; Bellemare, M","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:00ca3556b37a1bf4ebea4c159eb5139960df97725a1e89477b30bcbfd8cb4210","observation_id":"cdf5b794-6eda-42b8-980c-1e56d9b55d74","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"T.; and Uryasev, S","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:a6c8523dc6243de5e51696bc89f4f4f8e4e5231a54942348cb2c3fb88ae07488","observation_id":"5fcc8d3e-3f62-494f-9422-11b8043a0c97","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"G.; Dabney, W.; Munos, R.; and Teh, Y","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:76685d3df2df0e72d6071e34bdc0be7e4b33e14b8562ca6f3e4f7334c28517fc","observation_id":"e81bd0c3-29e4-4b66-a998-f4abc2d3b633","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04462","last_updated":"2024-05-20T10:03:58Z","snapshot_observed_at":"2026-08-05T02:21:38.292947Z","submitted_at":"2023-01-11T13:41:56Z","title":"An Analysis of Quantile Temporal-Difference Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04462","snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"G.; Tang, Y.; Ostrovski, G.; Harutyunyan, A.; Tuyls, K.; Bellemare, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"cited_paper":"/paper/2301.04462","citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:bc0f43703b09bf41648cc572d4702989fccb4b32cc83c379ec6a56263074025f","observation_id":"3880b616-7378-4dc6-a65a-d7965efe4d90","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"G.; and Dabney, W","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:bf7c7a24a2b96e6979aaf87cd9b7c0361613361c8abde8e58b12b2dc7a7c2b58","observation_id":"e4ee6e8a-aed0-4cbd-b591-d5093c420a94","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07107","last_updated":"2024-06-04T03:04:00Z","snapshot_observed_at":"2026-08-09T02:31:55.889771Z","submitted_at":"2024-02-11T05:17:56Z","title":"Echoes of Socratic Doubt: Embracing Uncertainty in Calibrated Evidential Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07107","snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"C.; Erricolo, D.; Tulabandhula, T.; and Trivedi, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"cited_paper":"/paper/2402.07107","citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:da0abcb45140d5faf55017b0112dee0f75ee1d0514f8657309621420ccddaa6b","observation_id":"b5efa899-9017-44c7-b8c6-2b07bc661970","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:d723bebbbc9e70a61ee9b9aff752af1ebf1dd5b30f635ad60622907760ebafbb","observation_id":"eabe90ef-2c07-49fb-aa22-c7a8a8db1ac9","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:708079be8b8f92bfd29d1959f389c8c6bfd2c9c15543ab7ab4efc6270513f8e3","observation_id":"c07d10c2-0144-4396-be68-27b763aa4fb6","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03176","last_updated":"2019-06-07T00:36:50Z","snapshot_observed_at":"2026-07-06T07:37:51.655095Z","submitted_at":"2019-03-07T20:34:36Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.03176","snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"cited_paper":"/paper/1903.03176","citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:92c7b2ef3bc479fb390a125f1a3104fb1a040cddf676232bdc27a259ca1c04af","observation_id":"f4c43d8d-61d7-4da8-acf0-13d5560d9f91","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":"A.; B \\\"o hmer, W.; and Spaan, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:1827c17574d3429a3f28d8fa06a1a510e18f85c4dc61687a2ce12638e30cced8","observation_id":"1e1f13d5-db31-4be3-aa16-108b803334f7","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-04T15:41:08.916718Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning"},"reference_resolution":{"displayed":84,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":84,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":84},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 84 of 84 outbound references and 0 inbound Pith citation observations for arXiv:2607.11607."}