{"as_of":"2026-08-20T13:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b624b3dde581aef4eb8bf343cfbea7b2f1bf292c435c6731f6b3dc4d9e055bae","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":4,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":4,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T04:47:05.597189Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T12:06:03.897585Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1907.13196","last_updated":"2019-09-16T22:43:14Z","snapshot_observed_at":"2026-08-17T13:05:45.528997Z","submitted_at":"2019-07-30T19:42:52Z","title":"Wasserstein Robust Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.13196","snapshot_observed_at":"2026-08-10T19:08:00.342772Z","title":"arXiv preprint arXiv:1907.13196 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.10605","last_updated":"2025-03-07T18:35:41Z","snapshot_observed_at":"2026-08-19T09:37:53.211367Z","submitted_at":"2025-01-17T23:37:21Z","title":"Wasserstein Adaptive Value Estimation for Actor-Critic Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T19:08:00.342772Z"},"links":{"cited_paper":"/paper/1907.13196","citing_paper":"/paper/2501.10605"},"observation_digest":"sha256:758651fa0222773dc4900274b54761aed1267f484d80246978be6c644349b5fb","observation_id":"c41fbd83-e1e5-4e25-9a5d-aa8cfeb68377","resolution":{"observed_at":"2026-08-10T19:08:00.342772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.13196","last_updated":"2019-09-16T22:43:14Z","snapshot_observed_at":"2026-08-17T13:05:45.528997Z","submitted_at":"2019-07-30T19:42:52Z","title":"Wasserstein Robust Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.13196","snapshot_observed_at":"2026-08-16T04:47:05.597189Z","title":"A., Ren, H., Ammar, H","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.00663","last_updated":"2025-05-01T17:07:01Z","snapshot_observed_at":"2026-08-18T22:23:55.093791Z","submitted_at":"2025-05-01T17:07:01Z","title":"Wasserstein Policy Optimization","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-16T04:47:05.597189Z"},"links":{"cited_paper":"/paper/1907.13196","citing_paper":"/paper/2505.00663"},"observation_digest":"sha256:e9f04491159d42cf2a67597e5afc7b93b0305a266e824ecfd947ef847dfbefaf","observation_id":"5ab9bc6b-cab4-4dbc-b48b-8645b4b1b909","resolution":{"observed_at":"2026-08-16T04:47:05.597189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.13196","last_updated":"2019-09-16T22:43:14Z","snapshot_observed_at":"2026-08-17T13:05:45.528997Z","submitted_at":"2019-07-30T19:42:52Z","title":"Wasserstein Robust Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"1907.13196","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1907.13196","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:1907.13196 , year=","venue":null,"work_id":"636b5b3e-d119-4738-be2c-1c29d5b37735","year":1907},"citing_paper":{"arxiv_id":"2604.10974","last_updated":"2026-04-15T07:15:04Z","snapshot_observed_at":"2026-08-15T07:36:05.514153Z","submitted_at":"2026-04-13T04:23:54Z","title":"Robust Adversarial Policy Optimization Under Dynamics Uncertainty","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T16:00:33.267264Z"},"links":{"cited_paper":"/paper/1907.13196","citing_paper":"/paper/2604.10974"},"observation_digest":"sha256:1a8347f2c9fecf55275d549a64e19d2de8a166121151404ba95001d8d6359673","observation_id":"762dc1de-6b4f-49e3-8cab-a97687172f07","resolution":{"observed_at":"2026-05-11T09:26:03.632733Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.13196","last_updated":"2019-09-16T22:43:14Z","snapshot_observed_at":"2026-08-17T13:05:45.528997Z","submitted_at":"2019-07-30T19:42:52Z","title":"Wasserstein Robust Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"1907.13196","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1907.13196","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:1907.13196 , year=","venue":null,"work_id":"636b5b3e-d119-4738-be2c-1c29d5b37735","year":1907},"citing_paper":{"arxiv_id":"2604.18143","last_updated":"2026-04-24T06:58:50Z","snapshot_observed_at":"2026-08-14T15:02:39.379856Z","submitted_at":"2026-04-20T12:07:33Z","title":"Distributional Off-Policy Evaluation with Deep Quantile Process Regression","version":2},"reference_index":162,"source":"arxiv_source","source_observed_at":"2026-05-10T04:10:14.476158Z"},"links":{"cited_paper":"/paper/1907.13196","citing_paper":"/paper/2604.18143"},"observation_digest":"sha256:7d8b5b6d0d11837b1dc0095bc052267f161062ec64bc0c3a0aeaec384a5b2bfc","observation_id":"c4782b70-83b6-42a7-9a89-09574af74b0b","resolution":{"observed_at":"2026-05-11T12:06:03.902817Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1907.13196/citation-record","integrity":"/paper/1907.13196/integrity","json":"/paper/1907.13196/citation-record.json","paper":"/paper/1907.13196"},"outbound":[],"paper":{"arxiv_id":"1907.13196","last_updated":"2019-09-16T22:43:14Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T13:05:45.528997Z","submitted_at":"2019-07-30T19:42:52Z","title":"Wasserstein Robust Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 4 inbound Pith citation observations for arXiv:1907.13196."}