{"as_of":"2026-08-10T19:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fa3f3dbf9b801c86bc4278da79bf92e0326e5ee1b0b7f62c01544a151719d5bc","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T17:46:07.253309Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T14:09:52.653481Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1810.00123","last_updated":"2020-01-17T23:25:22Z","snapshot_observed_at":"2026-08-09T08:49:17.514020Z","submitted_at":"2018-09-29T00:52:34Z","title":"Generalization and Regularization in DQN","version":3},"cited_work":{"arxiv_id":"1810.00123","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1810.00123","snapshot_observed_at":"2026-07-04T14:09:52.653481Z","title":"Generalization and regularization in dqn","venue":null,"work_id":"89196e62-7877-42fe-8d8e-bb80a12850ee","year":2020},"citing_paper":{"arxiv_id":"1906.09781","last_updated":"2019-06-24T08:40:58Z","snapshot_observed_at":"2026-08-03T12:45:12.143739Z","submitted_at":"2019-06-24T08:40:58Z","title":"In Hindsight: A Smooth Reward for Steady Exploration","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-25T17:38:45.913293Z"},"links":{"cited_paper":"/paper/1810.00123","citing_paper":"/paper/1906.09781"},"observation_digest":"sha256:6088d34ab441e50aed3c80ab2ba138dd619102d2e0c1eab9d634e985ec1e9193","observation_id":"5e08a654-056c-4ee5-807b-5b34b1eac042","resolution":{"observed_at":"2026-05-25T17:41:05.708898Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.00123","last_updated":"2020-01-17T23:25:22Z","snapshot_observed_at":"2026-08-09T08:49:17.514020Z","submitted_at":"2018-09-29T00:52:34Z","title":"Generalization and Regularization in DQN","version":3},"cited_work":{"arxiv_id":"1810.00123","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1810.00123","snapshot_observed_at":"2026-07-04T14:09:52.653481Z","title":"Generalization and regularization in dqn","venue":null,"work_id":"89196e62-7877-42fe-8d8e-bb80a12850ee","year":2020},"citing_paper":{"arxiv_id":"1907.01475","last_updated":"2019-07-02T16:12:34Z","snapshot_observed_at":"2026-08-05T08:52:05.087053Z","submitted_at":"2019-07-02T16:12:34Z","title":"Generalizing from a few environments in safety-critical reinforcement learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-25T10:57:45.056957Z"},"links":{"cited_paper":"/paper/1810.00123","citing_paper":"/paper/1907.01475"},"observation_digest":"sha256:84e899215b57448fd7eb8572c77a4d3213bc43973d8b74e6a2830f848b4f3740","observation_id":"a9fc6219-3c8c-4ac1-a151-91cc96beb823","resolution":{"observed_at":"2026-05-25T11:00:40.168151Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.00123","last_updated":"2020-01-17T23:25:22Z","snapshot_observed_at":"2026-08-09T08:49:17.514020Z","submitted_at":"2018-09-29T00:52:34Z","title":"Generalization and Regularization in DQN","version":3},"cited_work":{"arxiv_id":"1810.00123","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1810.00123","snapshot_observed_at":"2026-07-04T14:09:52.653481Z","title":"Generalization and regularization in dqn","venue":null,"work_id":"89196e62-7877-42fe-8d8e-bb80a12850ee","year":2020},"citing_paper":{"arxiv_id":"1907.02050","last_updated":"2019-07-03T17:35:58Z","snapshot_observed_at":"2026-07-31T19:59:12.244204Z","submitted_at":"2019-07-03T17:35:58Z","title":"Reasoning and Generalization in RL: A Tool Use Perspective","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-25T09:20:04.036102Z"},"links":{"cited_paper":"/paper/1810.00123","citing_paper":"/paper/1907.02050"},"observation_digest":"sha256:2ed0bfdc95aa16956eaf58625e6be45852ac46a0247122ec68fc8677c5135ef6","observation_id":"30d6457c-ad63-4e72-b30f-4c1d74fdf07d","resolution":{"observed_at":"2026-05-25T09:20:34.443759Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.00123","last_updated":"2020-01-17T23:25:22Z","snapshot_observed_at":"2026-08-09T08:49:17.514020Z","submitted_at":"2018-09-29T00:52:34Z","title":"Generalization and Regularization in DQN","version":3},"cited_work":{"arxiv_id":"1810.00123","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1810.00123","snapshot_observed_at":"2026-07-04T14:09:52.653481Z","title":"Generalization and regularization in dqn","venue":null,"work_id":"89196e62-7877-42fe-8d8e-bb80a12850ee","year":2020},"citing_paper":{"arxiv_id":"2210.10760","last_updated":"2022-10-19T17:56:10Z","snapshot_observed_at":"2026-07-06T14:07:50.468967Z","submitted_at":"2022-10-19T17:56:10Z","title":"Scaling Laws for Reward Model Overoptimization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-19T09:04:53.129737Z"},"links":{"cited_paper":"/paper/1810.00123","citing_paper":"/paper/2210.10760"},"observation_digest":"sha256:713299731955aaf7b55741f41124a6e6a0720c4697dba7cb5dc276113f1a09cb","observation_id":"ca5ac14d-9989-4a86-8d63-531a5dc3b7e5","resolution":{"observed_at":"2026-05-19T09:04:53.245501Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.00123","last_updated":"2020-01-17T23:25:22Z","snapshot_observed_at":"2026-08-09T08:49:17.514020Z","submitted_at":"2018-09-29T00:52:34Z","title":"Generalization and Regularization in DQN","version":3},"cited_work":{"arxiv_id":"1810.00123","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1810.00123","snapshot_observed_at":"2026-07-04T14:09:52.653481Z","title":"Generalization and regularization in dqn","venue":null,"work_id":"89196e62-7877-42fe-8d8e-bb80a12850ee","year":2020},"citing_paper":{"arxiv_id":"2309.07864","last_updated":"2023-09-19T08:29:18Z","snapshot_observed_at":"2026-08-09T18:54:02.679174Z","submitted_at":"2023-09-14T17:12:03Z","title":"The Rise and Potential of Large Language Model Based Agents: A Survey","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-11T10:47:44.152066Z"},"links":{"cited_paper":"/paper/1810.00123","citing_paper":"/paper/2309.07864"},"observation_digest":"sha256:fcdcc98bdfc8ce5623551264594a45550855059365d48df875c0726e53df6ad3","observation_id":"6cded5cc-c288-4cbe-b46c-e7aeea35f7a0","resolution":{"observed_at":"2026-05-11T10:47:50.692503Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.00123","last_updated":"2020-01-17T23:25:22Z","snapshot_observed_at":"2026-08-09T08:49:17.514020Z","submitted_at":"2018-09-29T00:52:34Z","title":"Generalization and Regularization in DQN","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.00123","snapshot_observed_at":"2026-08-09T17:46:07.253309Z","title":"C., and Bowling, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00802","last_updated":"2025-02-02T13:54:47Z","snapshot_observed_at":"2026-08-10T17:19:32.802490Z","submitted_at":"2025-02-02T13:54:47Z","title":"Fisher-Guided Selective Forgetting: Mitigating The Primacy Bias in Deep Reinforcement Learning","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-09T17:46:07.253309Z"},"links":{"cited_paper":"/paper/1810.00123","citing_paper":"/paper/2502.00802"},"observation_digest":"sha256:f0f530a349228ba9bac79ee5610e32aff93954c55612b948ed8690bee79e80be","observation_id":"63b110f6-35da-4ff4-9f02-171cea97c91b","resolution":{"observed_at":"2026-08-09T17:46:07.253309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.00123","last_updated":"2020-01-17T23:25:22Z","snapshot_observed_at":"2026-08-09T08:49:17.514020Z","submitted_at":"2018-09-29T00:52:34Z","title":"Generalization and Regularization in DQN","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.00123","snapshot_observed_at":"2026-08-09T11:22:28.868513Z","title":"C., and Bowling, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02743","last_updated":"2025-02-04T22:09:43Z","snapshot_observed_at":"2026-08-09T16:32:54.357740Z","submitted_at":"2025-02-04T22:09:43Z","title":"LLM Bandit: Cost-Efficient LLM Generation via Preference-Conditioned Dynamic Routing","version":1},"reference_index":1967,"source":"pdf_text","source_observed_at":"2026-08-09T11:22:28.868513Z"},"links":{"cited_paper":"/paper/1810.00123","citing_paper":"/paper/2502.02743"},"observation_digest":"sha256:b1994d4262481e122786b5370ac26b5b7bf0cac4fa4b953be2c5d214f3994bcb","observation_id":"ec076800-faf5-4fb0-86b8-f4e561d1f171","resolution":{"observed_at":"2026-08-09T11:22:28.868513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.00123","last_updated":"2020-01-17T23:25:22Z","snapshot_observed_at":"2026-08-09T08:49:17.514020Z","submitted_at":"2018-09-29T00:52:34Z","title":"Generalization and Regularization in DQN","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.00123","snapshot_observed_at":"2026-08-02T23:46:56.405225Z","title":"C., and Bowling, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.12753","last_updated":"2026-06-11T11:35:13Z","snapshot_observed_at":"2026-08-09T08:49:31.671297Z","submitted_at":"2026-02-13T09:32:26Z","title":"Hierarchical Successor Representation for Robust Transfer","version":2},"reference_index":2003,"source":"pdf_text","source_observed_at":"2026-08-02T23:46:56.405225Z"},"links":{"cited_paper":"/paper/1810.00123","citing_paper":"/paper/2602.12753"},"observation_digest":"sha256:53b82829a7be87dd64990d60ffdf312121ddbf95c3bec0ee0742a5ae48a0d8dc","observation_id":"91e7bc31-a76d-4b71-9efb-2ad424663a00","resolution":{"observed_at":"2026-08-02T23:46:56.405225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.00123","last_updated":"2020-01-17T23:25:22Z","snapshot_observed_at":"2026-08-09T08:49:17.514020Z","submitted_at":"2018-09-29T00:52:34Z","title":"Generalization and Regularization in DQN","version":3},"cited_work":{"arxiv_id":"1810.00123","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1810.00123","snapshot_observed_at":"2026-07-04T14:09:52.653481Z","title":"Generalization and regularization in dqn","venue":null,"work_id":"89196e62-7877-42fe-8d8e-bb80a12850ee","year":2020},"citing_paper":{"arxiv_id":"2605.21214","last_updated":"2026-05-21T13:30:53Z","snapshot_observed_at":"2026-07-06T23:31:41.930458Z","submitted_at":"2026-05-20T14:08:33Z","title":"Behavior-Consistent Deep Reinforcement Learning","version":1},"reference_index":225,"source":"arxiv_source","source_observed_at":"2026-05-21T05:37:29.919862Z"},"links":{"cited_paper":"/paper/1810.00123","citing_paper":"/paper/2605.21214"},"observation_digest":"sha256:72a9ac22c6e3e47c7a582a4d71176a2fcc8646f425ececb78c27fffc05fd048d","observation_id":"13e803c1-d8d9-416a-8132-ae5706b5c6dd","resolution":{"observed_at":"2026-05-21T05:39:40.720409Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.00123","last_updated":"2020-01-17T23:25:22Z","snapshot_observed_at":"2026-08-09T08:49:17.514020Z","submitted_at":"2018-09-29T00:52:34Z","title":"Generalization and Regularization in DQN","version":3},"cited_work":{"arxiv_id":"1810.00123","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1810.00123","snapshot_observed_at":"2026-07-04T14:09:52.653481Z","title":"Generalization and regularization in dqn","venue":null,"work_id":"89196e62-7877-42fe-8d8e-bb80a12850ee","year":2020},"citing_paper":{"arxiv_id":"2605.21214","last_updated":"2026-05-21T13:30:53Z","snapshot_observed_at":"2026-07-06T23:31:41.930458Z","submitted_at":"2026-05-20T14:08:33Z","title":"Behavior-Consistent Deep Reinforcement Learning","version":2},"reference_index":225,"source":"arxiv_source","source_observed_at":"2026-05-22T10:06:04.478006Z"},"links":{"cited_paper":"/paper/1810.00123","citing_paper":"/paper/2605.21214"},"observation_digest":"sha256:82ad4e910c474776e2661ac404c87d2589bac55a0fb1cea2b48affc89bfefe7b","observation_id":"ab828019-ff6e-41fd-8278-6b2e670873be","resolution":{"observed_at":"2026-05-22T10:06:21.822838Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.00123","last_updated":"2020-01-17T23:25:22Z","snapshot_observed_at":"2026-08-09T08:49:17.514020Z","submitted_at":"2018-09-29T00:52:34Z","title":"Generalization and Regularization in DQN","version":3},"cited_work":{"arxiv_id":"1810.00123","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1810.00123","snapshot_observed_at":"2026-07-04T14:09:52.653481Z","title":"Generalization and regularization in dqn","venue":null,"work_id":"89196e62-7877-42fe-8d8e-bb80a12850ee","year":2020},"citing_paper":{"arxiv_id":"2606.27348","last_updated":"2026-06-25T17:54:36Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:54:36Z","title":"Bridging Performance and Generalization in Reinforcement Learning for Agile Flight","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-26T04:33:20.981811Z"},"links":{"cited_paper":"/paper/1810.00123","citing_paper":"/paper/2606.27348"},"observation_digest":"sha256:e390f51ba1cd782d9a0ee2139edb5c88767b92e56922dec0966b327903bc67eb","observation_id":"0d9ae354-4fd0-407f-88ab-d791e2642e16","resolution":{"observed_at":"2026-07-04T14:09:52.655148Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1810.00123/citation-record","integrity":"/paper/1810.00123/integrity","json":"/paper/1810.00123/citation-record.json","paper":"/paper/1810.00123"},"outbound":[],"paper":{"arxiv_id":"1810.00123","last_updated":"2020-01-17T23:25:22Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T08:49:17.514020Z","submitted_at":"2018-09-29T00:52:34Z","title":"Generalization and Regularization in DQN"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:1810.00123."}