{"as_of":"2026-08-17T00:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a3819a719c7161937850056fffaf857405cab235d13bb0ab5f4dc9c4f79e89d9","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":5,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":5,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:39:15.637632Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T09:57:56.240528Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2003.02894","last_updated":"2020-07-14T06:01:03Z","snapshot_observed_at":"2026-08-15T19:09:05.952832Z","submitted_at":"2020-03-05T19:56:23Z","title":"Distributional Robustness and Regularization in Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2003.02894","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2003.02894","snapshot_observed_at":"2026-07-03T09:57:56.240528Z","title":"Distributional robustness and regularization in reinforcement learning","venue":null,"work_id":"3b671203-828d-407d-82e6-72f32ea375ac","year":2020},"citing_paper":{"arxiv_id":"2506.12622","last_updated":"2026-04-18T21:54:34Z","snapshot_observed_at":"2026-08-13T08:23:08.625198Z","submitted_at":"2025-06-14T20:36:44Z","title":"DR-SAC: Distributionally Robust Soft Actor-Critic for Reinforcement Learning under Uncertainty","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-19T09:09:51.531488Z"},"links":{"cited_paper":"/paper/2003.02894","citing_paper":"/paper/2506.12622"},"observation_digest":"sha256:88afd5a9f512a0b2d00f451e91bcc7655bfc9458575678217ace66fb247cbdeb","observation_id":"85f75c8c-63bc-4c34-b9ec-0bd7e2bdbcf3","resolution":{"observed_at":"2026-05-19T09:12:14.710746Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.02894","last_updated":"2020-07-14T06:01:03Z","snapshot_observed_at":"2026-08-15T19:09:05.952832Z","submitted_at":"2020-03-05T19:56:23Z","title":"Distributional Robustness and Regularization in Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2003.02894","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2003.02894","snapshot_observed_at":"2026-07-03T09:57:56.240528Z","title":"Distributional robustness and regularization in reinforcement learning","venue":null,"work_id":"3b671203-828d-407d-82e6-72f32ea375ac","year":2020},"citing_paper":{"arxiv_id":"2602.08813","last_updated":"2026-05-12T17:22:35Z","snapshot_observed_at":"2026-08-13T02:15:10.817007Z","submitted_at":"2026-02-09T15:50:05Z","title":"Robust Policy Optimization to Prevent Catastrophic Forgetting","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T05:33:42.965249Z"},"links":{"cited_paper":"/paper/2003.02894","citing_paper":"/paper/2602.08813"},"observation_digest":"sha256:084c3474e060ea3eeeff14ebd13a6040397c35c7d82b8e38ba426c3da6aaf24c","observation_id":"919c6647-3049-4180-b935-9c4d6966324a","resolution":{"observed_at":"2026-05-16T05:37:24.433302Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.02894","last_updated":"2020-07-14T06:01:03Z","snapshot_observed_at":"2026-08-15T19:09:05.952832Z","submitted_at":"2020-03-05T19:56:23Z","title":"Distributional Robustness and Regularization in Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2003.02894","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2003.02894","snapshot_observed_at":"2026-07-03T09:57:56.240528Z","title":"Distributional robustness and regularization in reinforcement learning","venue":null,"work_id":"3b671203-828d-407d-82e6-72f32ea375ac","year":2020},"citing_paper":{"arxiv_id":"2605.17017","last_updated":"2026-05-16T14:33:34Z","snapshot_observed_at":"2026-08-16T16:26:27.955716Z","submitted_at":"2026-05-16T14:33:34Z","title":"When Dynamics Shift, Robust Task Inference Wins: Offline Imitation Learning with Behavior Foundation Models Revisited","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-19T20:37:36.030165Z"},"links":{"cited_paper":"/paper/2003.02894","citing_paper":"/paper/2605.17017"},"observation_digest":"sha256:f254b69fc31f818bca5b6b6befa5c33360f0dc18ae2d68d0c30b446c9cfa6d58","observation_id":"24e13565-6d03-4ccc-97e2-e510605aff4e","resolution":{"observed_at":"2026-05-19T20:37:45.201601Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.02894","last_updated":"2020-07-14T06:01:03Z","snapshot_observed_at":"2026-08-15T19:09:05.952832Z","submitted_at":"2020-03-05T19:56:23Z","title":"Distributional Robustness and Regularization in Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2003.02894","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2003.02894","snapshot_observed_at":"2026-07-03T09:57:56.240528Z","title":"Distributional robustness and regularization in reinforcement learning","venue":null,"work_id":"3b671203-828d-407d-82e6-72f32ea375ac","year":2020},"citing_paper":{"arxiv_id":"2606.12251","last_updated":"2026-06-10T15:53:36Z","snapshot_observed_at":"2026-08-14T14:18:22.072790Z","submitted_at":"2026-06-10T15:53:36Z","title":"Reinforcement Learning Disrupts Gradient-Based Adversarial Optimization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T10:17:01.777614Z"},"links":{"cited_paper":"/paper/2003.02894","citing_paper":"/paper/2606.12251"},"observation_digest":"sha256:f89425a9ec7716a469bfed1386d5e58d6dc4d95f05270e75eabcec8b7b3f8fc7","observation_id":"5df27fb6-df88-4fd2-8b60-d494ac7029ff","resolution":{"observed_at":"2026-07-03T09:57:56.242039Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.02894","last_updated":"2020-07-14T06:01:03Z","snapshot_observed_at":"2026-08-15T19:09:05.952832Z","submitted_at":"2020-03-05T19:56:23Z","title":"Distributional Robustness and Regularization in Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.02894","snapshot_observed_at":"2026-08-15T14:39:15.637632Z","title":"arXiv preprint arXiv:2003.02894 , year=","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2608.06545","last_updated":"2026-08-06T19:49:48Z","snapshot_observed_at":"2026-08-16T19:41:39.037201Z","submitted_at":"2026-08-06T19:49:48Z","title":"Robust Average-Reward Markov Decision Processes: Minimax-Optimal Learning via Plug-in Reductions","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-15T14:39:15.637632Z"},"links":{"cited_paper":"/paper/2003.02894","citing_paper":"/paper/2608.06545"},"observation_digest":"sha256:432603f45e574b1ffdaa0ba952b1f7daec2444176cf91cef2f7f57035d1e3e31","observation_id":"88f1c433-0416-48a4-bdf1-f5f8f2a8cef7","resolution":{"observed_at":"2026-08-15T14:39:15.637632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2003.02894/citation-record","integrity":"/paper/2003.02894/integrity","json":"/paper/2003.02894/citation-record.json","paper":"/paper/2003.02894"},"outbound":[],"paper":{"arxiv_id":"2003.02894","last_updated":"2020-07-14T06:01:03Z","latest_version":2,"primary_category":"math.OC","snapshot_observed_at":"2026-08-15T19:09:05.952832Z","submitted_at":"2020-03-05T19:56:23Z","title":"Distributional Robustness and Regularization in Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 5 inbound Pith citation observations for arXiv:2003.02894."}