{"as_of":"2026-08-11T12:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2b971960e1f7e9ef1455c9b7e731db1dabe1386fc139c94a981031cc0cae6d44","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T19:08:00.458822Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T02:07:54.718436Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T12:26:56.835415Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.10605","last_updated":"2025-03-07T18:35:41Z","snapshot_observed_at":"2026-08-10T18:59:48.831993Z","submitted_at":"2025-01-17T23:37:21Z","title":"Wasserstein Adaptive Value Estimation for Actor-Critic Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.10605","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.10605","snapshot_observed_at":"2026-07-02T12:26:56.835415Z","title":"arXiv preprint arXiv:2501.10605 , year =","venue":null,"work_id":"2c6d3204-1f88-4e2b-9e4a-ef5b1562a520","year":null},"citing_paper":{"arxiv_id":"2606.05883","last_updated":"2026-06-17T13:39:13Z","snapshot_observed_at":"2026-07-06T23:45:47.161248Z","submitted_at":"2026-06-04T08:53:58Z","title":"Geometry-Aware Dataset Condensation for Diffusion Model Training","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-28T02:07:54.718436Z"},"links":{"cited_paper":"/paper/2501.10605","citing_paper":"/paper/2606.05883"},"observation_digest":"sha256:a566652fdf32eb84b1267471f7a3998256889336f83ec4e477dbdc11ef51018c","observation_id":"74577a06-21c3-4cb3-89e7-1209ad3cad60","resolution":{"observed_at":"2026-07-02T12:26:56.837015Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.10605/citation-record","integrity":"/paper/2501.10605/integrity","json":"/paper/2501.10605/citation-record.json","paper":"/paper/2501.10605"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1802.03976","last_updated":"2019-07-30T23:09:21Z","snapshot_observed_at":"2026-08-10T20:56:01.314103Z","submitted_at":"2018-02-12T11:08:43Z","title":"Reinforcement Learning with Wasserstein Distance Regularisation, with Applications to Multipolicy Learning","version":2},"cited_work":{"arxiv_id":"1802.03976","doi":null,"metadata_source":"pith","pith_arxiv_id":"1802.03976","snapshot_observed_at":"2026-08-10T19:08:00.720190Z","title":"Reinforcement Learning with Wasserstein Distance Regularisation, with Applications to Multipolicy Learning","venue":"cs.LG","work_id":"4e320c67-13c5-4f6f-bf08-b67ea3cc10c3","year":2018},"citing_paper":{"arxiv_id":"2501.10605","last_updated":"2025-03-07T18:35:41Z","snapshot_observed_at":"2026-08-10T18:59:48.831993Z","submitted_at":"2025-01-17T23:37:21Z","title":"Wasserstein Adaptive Value Estimation for Actor-Critic Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T19:08:00.335175Z"},"links":{"cited_paper":"/paper/1802.03976","citing_paper":"/paper/2501.10605"},"observation_digest":"sha256:87272c221a402a2df6559111bdac7de666b048ea3d6b09339c7ed675042451c6","observation_id":"27e86555-2df3-473c-8b85-1e108c2caf0e","resolution":{"observed_at":"2026-08-10T19:08:00.726131Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.13196","last_updated":"2019-09-16T22:43:14Z","snapshot_observed_at":"2026-08-09T11:35:33.553260Z","submitted_at":"2019-07-30T19:42:52Z","title":"Wasserstein Robust Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.13196","snapshot_observed_at":"2026-08-10T19:08:00.342772Z","title":"arXiv preprint arXiv:1907.13196 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.10605","last_updated":"2025-03-07T18:35:41Z","snapshot_observed_at":"2026-08-10T18:59:48.831993Z","submitted_at":"2025-01-17T23:37:21Z","title":"Wasserstein Adaptive Value Estimation for Actor-Critic Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T19:08:00.342772Z"},"links":{"cited_paper":"/paper/1907.13196","citing_paper":"/paper/2501.10605"},"observation_digest":"sha256:2e20c4ed81d789beb9062cc7b366f9d7a91d7a6954f15fee474f99e79771de94","observation_id":"c41fbd83-e1e5-4e25-9a5d-aa8cfeb68377","resolution":{"observed_at":"2026-08-10T19:08:00.342772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06239","last_updated":"2023-09-12T13:55:01Z","snapshot_observed_at":"2026-07-06T16:17:26.924098Z","submitted_at":"2023-09-12T13:55:01Z","title":"Risk-Aware Reinforcement Learning through Optimal Transport Theory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.06239","snapshot_observed_at":"2026-08-10T19:08:00.348723Z","title":"arXiv preprint arXiv:2309.06239 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.10605","last_updated":"2025-03-07T18:35:41Z","snapshot_observed_at":"2026-08-10T18:59:48.831993Z","submitted_at":"2025-01-17T23:37:21Z","title":"Wasserstein Adaptive Value Estimation for Actor-Critic Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T19:08:00.348723Z"},"links":{"cited_paper":"/paper/2309.06239","citing_paper":"/paper/2501.10605"},"observation_digest":"sha256:ea4c5040b5487760e746d84e9a85615cd2497dba8aa631ef6183c4cb60ced411","observation_id":"80209321-f39f-48aa-8f67-f003149ed159","resolution":{"observed_at":"2026-08-10T19:08:00.348723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10949","last_updated":"2024-01-24T20:43:24Z","snapshot_observed_at":"2026-07-06T17:18:03.597390Z","submitted_at":"2024-01-18T19:34:46Z","title":"The Synergy Between Optimal Transport Theory and Multi-Agent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10949","snapshot_observed_at":"2026-08-10T19:08:00.354941Z","title":"arXiv preprint arXiv:2401.10949 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10605","last_updated":"2025-03-07T18:35:41Z","snapshot_observed_at":"2026-08-10T18:59:48.831993Z","submitted_at":"2025-01-17T23:37:21Z","title":"Wasserstein Adaptive Value Estimation for Actor-Critic Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T19:08:00.354941Z"},"links":{"cited_paper":"/paper/2401.10949","citing_paper":"/paper/2501.10605"},"observation_digest":"sha256:9ba5d260ffb239ffa1499f60e6446480fc44c89d70e9fd59f4ca2985384c298b","observation_id":"783ceb5d-8bb9-497c-9cf2-7af5edd25edc","resolution":{"observed_at":"2026-08-10T19:08:00.354941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.00833","last_updated":"2022-06-02T02:13:29Z","snapshot_observed_at":"2026-08-11T09:15:20.067239Z","submitted_at":"2022-06-02T02:13:29Z","title":"Finite-Time Analysis of Entropy-Regularized Neural Natural Actor-Critic Algorithm","version":1},"cited_work":{"arxiv_id":"2206.00833","doi":null,"metadata_source":"pith","pith_arxiv_id":"2206.00833","snapshot_observed_at":"2026-08-10T19:08:00.617467Z","title":"Finite-Time Analysis of Entropy-Regularized Neural Natural Actor-Critic Algorithm","venue":"cs.LG","work_id":"ca10a644-346e-42b7-a68c-dbc4db0ac8c3","year":2022},"citing_paper":{"arxiv_id":"2501.10605","last_updated":"2025-03-07T18:35:41Z","snapshot_observed_at":"2026-08-10T18:59:48.831993Z","submitted_at":"2025-01-17T23:37:21Z","title":"Wasserstein Adaptive Value Estimation for Actor-Critic Reinforcement Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T19:08:00.360475Z"},"links":{"cited_paper":"/paper/2206.00833","citing_paper":"/paper/2501.10605"},"observation_digest":"sha256:5978b8a7c1b2a5ffcdf602bab9349428b3e4c8f684f2ffda567bd5c095b961bc","observation_id":"390257c5-a4ee-47ef-a04d-169412e44573","resolution":{"observed_at":"2026-08-10T19:08:00.624139Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:08:00.930209Z","title":"In: International conference on machine learning","venue":null,"work_id":"0e6fd919-814b-40b4-aed6-35bae60a3d83","year":2018},"citing_paper":{"arxiv_id":"2501.10605","last_updated":"2025-03-07T18:35:41Z","snapshot_observed_at":"2026-08-10T18:59:48.831993Z","submitted_at":"2025-01-17T23:37:21Z","title":"Wasserstein Adaptive Value Estimation for Actor-Critic Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T19:08:00.366350Z"},"links":{"citing_paper":"/paper/2501.10605"},"observation_digest":"sha256:8faed9485f90e2bb262561a0ace82e6ab6c44febc4b1f83bf648711302f8e223","observation_id":"cca2d674-2f30-4142-80fa-50949992e138","resolution":{"observed_at":"2026-08-10T19:08:00.935489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:08:00.912211Z","title":"IEEE Transactions on Systems, Man, and Cybernetics, part C (applications and reviews)42(6), 1291– 1307 (2012)","venue":null,"work_id":"d38361b2-7c21-4daf-aaf4-ac442e88a0a5","year":2012},"citing_paper":{"arxiv_id":"2501.10605","last_updated":"2025-03-07T18:35:41Z","snapshot_observed_at":"2026-08-10T18:59:48.831993Z","submitted_at":"2025-01-17T23:37:21Z","title":"Wasserstein Adaptive Value Estimation for Actor-Critic Reinforcement Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T19:08:00.379061Z"},"links":{"citing_paper":"/paper/2501.10605"},"observation_digest":"sha256:2d91b5cef01109a147c95914694af4f0e4c17bcc73acd355705806d11f758aab","observation_id":"f567663e-fb89-4b3a-8d3b-ff9a89e36f4a","resolution":{"observed_at":"2026-08-10T19:08:00.918792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:08:00.892998Z","title":"Mathematical Finance 33(3), 437–503 (2023)","venue":null,"work_id":"25c82e25-6992-4fcf-b320-b2651c72f885","year":2023},"citing_paper":{"arxiv_id":"2501.10605","last_updated":"2025-03-07T18:35:41Z","snapshot_observed_at":"2026-08-10T18:59:48.831993Z","submitted_at":"2025-01-17T23:37:21Z","title":"Wasserstein Adaptive Value Estimation for Actor-Critic Reinforcement Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T19:08:00.385215Z"},"links":{"citing_paper":"/paper/2501.10605"},"observation_digest":"sha256:ea012fc82573673c602a10c7e6eeebd724375c862aa8c0fe53ebb819473d6069","observation_id":"9c7b3e0c-3a48-42bd-b1fd-e1ff2134626b","resolution":{"observed_at":"2026-08-10T19:08:00.898795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:08:00.869571Z","title":"In: Proceedings of the AAAI Conference on Artificial Intelligence","venue":null,"work_id":"2ac0f36e-0262-475f-b2c9-e5158d4286ed","year":2022},"citing_paper":{"arxiv_id":"2501.10605","last_updated":"2025-03-07T18:35:41Z","snapshot_observed_at":"2026-08-10T18:59:48.831993Z","submitted_at":"2025-01-17T23:37:21Z","title":"Wasserstein Adaptive Value Estimation for Actor-Critic Reinforcement Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T19:08:00.391373Z"},"links":{"citing_paper":"/paper/2501.10605"},"observation_digest":"sha256:8131caa318948b149f305364fad6608570c91b5da3d48fc75158b1ef9b59ce67","observation_id":"f04ea8b2-9071-4107-99f7-74ce89813bcf","resolution":{"observed_at":"2026-08-10T19:08:00.875726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.00945","last_updated":"2020-06-01T13:48:59Z","snapshot_observed_at":"2026-07-06T09:25:00.869410Z","submitted_at":"2020-06-01T13:48:59Z","title":"Robust Reinforcement Learning with Wasserstein Constraint","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.00945","snapshot_observed_at":"2026-08-10T19:08:00.396692Z","title":"arXiv preprint arXiv:2006.00945 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.10605","last_updated":"2025-03-07T18:35:41Z","snapshot_observed_at":"2026-08-10T18:59:48.831993Z","submitted_at":"2025-01-17T23:37:21Z","title":"Wasserstein Adaptive Value Estimation for Actor-Critic Reinforcement Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T19:08:00.396692Z"},"links":{"cited_paper":"/paper/2006.00945","citing_paper":"/paper/2501.10605"},"observation_digest":"sha256:581959b29cdc0fd9e07a2e0471a5287b74901bd5e69d7924f83837e7fefbc89e","observation_id":"011c81d1-7518-4cb0-97ae-24d542645976","resolution":{"observed_at":"2026-08-10T19:08:00.396692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:08:00.849399Z","title":"The International Journal of Robotics Research32(11), 1238–1274 (2013) Wasserstein Adaptive Value Estimation 13","venue":null,"work_id":"4bb3516d-a6f1-468b-8e57-421c9405d6f3","year":2013},"citing_paper":{"arxiv_id":"2501.10605","last_updated":"2025-03-07T18:35:41Z","snapshot_observed_at":"2026-08-10T18:59:48.831993Z","submitted_at":"2025-01-17T23:37:21Z","title":"Wasserstein Adaptive Value Estimation for Actor-Critic Reinforcement Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T19:08:00.404321Z"},"links":{"citing_paper":"/paper/2501.10605"},"observation_digest":"sha256:9548e8549dce3aa2dc6204d9d6975d4fa5297f7152335619b084b58043018480","observation_id":"a1375f69-eae0-44be-85b7-2d2427b22b73","resolution":{"observed_at":"2026-08-10T19:08:00.857858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:08:00.829332Z","title":"In: Proceedings of the AAAI Conference on Artificial Intelligence","venue":null,"work_id":"12bfd618-efc0-452a-9b43-311b7fc26042","year":2023},"citing_paper":{"arxiv_id":"2501.10605","last_updated":"2025-03-07T18:35:41Z","snapshot_observed_at":"2026-08-10T18:59:48.831993Z","submitted_at":"2025-01-17T23:37:21Z","title":"Wasserstein Adaptive Value Estimation for Actor-Critic Reinforcement Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T19:08:00.410129Z"},"links":{"citing_paper":"/paper/2501.10605"},"observation_digest":"sha256:e017927258c87bf029298ee59d133762b158bdb8de37d723db4d3d560c9cc8c3","observation_id":"0c480420-d8c3-4aa7-840e-819308682cad","resolution":{"observed_at":"2026-08-10T19:08:00.835770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:08:00.809586Z","title":"Advances in Neural Information Processing Systems 32 (2019)","venue":null,"work_id":"1bafe219-bc18-48cf-9fd8-0431f503642d","year":2019},"citing_paper":{"arxiv_id":"2501.10605","last_updated":"2025-03-07T18:35:41Z","snapshot_observed_at":"2026-08-10T18:59:48.831993Z","submitted_at":"2025-01-17T23:37:21Z","title":"Wasserstein Adaptive Value Estimation for Actor-Critic Reinforcement Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T19:08:00.416693Z"},"links":{"citing_paper":"/paper/2501.10605"},"observation_digest":"sha256:9888eeb7462a57b9d7a97488cd3188482825ffbe7d3f76240d2dbb162472dad2","observation_id":"6fa6680e-cd49-4565-a6e5-e58e7efb37c5","resolution":{"observed_at":"2026-08-10T19:08:00.816073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:08:00.790892Z","title":"Engineering Applications of Artificial Intelligence136, 108911 (2024)","venue":null,"work_id":"5e46aff3-40da-4b67-a83f-ddc4e3b18774","year":2024},"citing_paper":{"arxiv_id":"2501.10605","last_updated":"2025-03-07T18:35:41Z","snapshot_observed_at":"2026-08-10T18:59:48.831993Z","submitted_at":"2025-01-17T23:37:21Z","title":"Wasserstein Adaptive Value Estimation for Actor-Critic Reinforcement Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T19:08:00.424703Z"},"links":{"citing_paper":"/paper/2501.10605"},"observation_digest":"sha256:175c9628a58f5863469cec68c46160cd15a5f1a58374c61b4b8dd7a0b4101247","observation_id":"c85bfb0c-69c5-4032-b2cc-9d5d7591f883","resolution":{"observed_at":"2026-08-10T19:08:00.796877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.07185","last_updated":"2017-12-19T20:05:06Z","snapshot_observed_at":"2026-07-06T06:15:13.468978Z","submitted_at":"2017-12-19T20:05:06Z","title":"On Wasserstein Reinforcement Learning and the Fokker-Planck equation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.07185","snapshot_observed_at":"2026-08-10T19:08:00.431086Z","title":"arXiv preprint arXiv:1712.07185 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.10605","last_updated":"2025-03-07T18:35:41Z","snapshot_observed_at":"2026-08-10T18:59:48.831993Z","submitted_at":"2025-01-17T23:37:21Z","title":"Wasserstein Adaptive Value Estimation for Actor-Critic Reinforcement Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T19:08:00.431086Z"},"links":{"cited_paper":"/paper/1712.07185","citing_paper":"/paper/2501.10605"},"observation_digest":"sha256:27309b104d20f4edf5a8fe31f3ee933bc6ca0d01441136e6dbec647e59321229","observation_id":"82b555b4-9546-46d4-9335-ed480bbb0e6a","resolution":{"observed_at":"2026-08-10T19:08:00.431086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11774","last_updated":"2024-09-11T22:30:25Z","snapshot_observed_at":"2026-07-06T18:32:23.999019Z","submitted_at":"2024-06-17T17:32:25Z","title":"Optimal Transport-Assisted Risk-Sensitive Q-Learning","version":2},"cited_work":{"arxiv_id":"2406.11774","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.11774","snapshot_observed_at":"2026-08-10T19:08:00.526696Z","title":"Optimal Transport-Assisted Risk-Sensitive Q-Learning","venue":"cs.LG","work_id":"e438589a-3742-469f-bee9-8a6a51ad1a19","year":2024},"citing_paper":{"arxiv_id":"2501.10605","last_updated":"2025-03-07T18:35:41Z","snapshot_observed_at":"2026-08-10T18:59:48.831993Z","submitted_at":"2025-01-17T23:37:21Z","title":"Wasserstein Adaptive Value Estimation for Actor-Critic Reinforcement Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T19:08:00.442135Z"},"links":{"cited_paper":"/paper/2406.11774","citing_paper":"/paper/2501.10605"},"observation_digest":"sha256:5b8b377c33c460e8cdb60a85dee8342357754878cd2737079e4ce148c10addc0","observation_id":"3179028c-dd73-4255-b33a-6a3a00d6ab63","resolution":{"observed_at":"2026-08-10T19:08:00.541078Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:08:00.769993Z","title":"ACM Computing Surveys (CSUR)55(1), 1–36 (2021)","venue":null,"work_id":"991a61a2-688b-493a-84c4-8b41c9f17ff9","year":2021},"citing_paper":{"arxiv_id":"2501.10605","last_updated":"2025-03-07T18:35:41Z","snapshot_observed_at":"2026-08-10T18:59:48.831993Z","submitted_at":"2025-01-17T23:37:21Z","title":"Wasserstein Adaptive Value Estimation for Actor-Critic Reinforcement Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T19:08:00.451662Z"},"links":{"citing_paper":"/paper/2501.10605"},"observation_digest":"sha256:2512929808940d51652a1a1850ba25eeb3f506ce167bbd9a0bf0e54ab1ac7f09","observation_id":"2860e3c0-8847-497c-95af-8bee2fa9848d","resolution":{"observed_at":"2026-08-10T19:08:00.776438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:08:00.742415Z","title":"Advances in Neural Information Processing Systems34, 15993–16006 (2021)","venue":null,"work_id":"74c9ecd5-c145-4bdb-ba02-844bb968a6ec","year":2021},"citing_paper":{"arxiv_id":"2501.10605","last_updated":"2025-03-07T18:35:41Z","snapshot_observed_at":"2026-08-10T18:59:48.831993Z","submitted_at":"2025-01-17T23:37:21Z","title":"Wasserstein Adaptive Value Estimation for Actor-Critic Reinforcement Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T19:08:00.458822Z"},"links":{"citing_paper":"/paper/2501.10605"},"observation_digest":"sha256:f61000c3a31aa10dc0fcc487c13fc86537e51c2423fac74d693d616bacc36d27","observation_id":"1e5e5239-b5d4-4090-9335-b834bf49f898","resolution":{"observed_at":"2026-08-10T19:08:00.756321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.10605","last_updated":"2025-03-07T18:35:41Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T18:59:48.831993Z","submitted_at":"2025-01-17T23:37:21Z","title":"Wasserstein Adaptive Value Estimation for Actor-Critic Reinforcement Learning"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":10},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 1 inbound Pith citation observation for arXiv:2501.10605."}