{"as_of":"2026-08-20T19:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ac8ed506f267368b983c2dc50cef28553930f8feba55501a66b7c98514bc9aef","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:16:29.010952Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":1,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.01800","last_updated":"2024-07-01T20:58:01Z","snapshot_observed_at":"2026-08-17T20:41:45.190774Z","submitted_at":"2024-07-01T20:58:01Z","title":"Normalization and effective learning rates in reinforcement learning","version":1},"cited_work":{"arxiv_id":"2407.01800","doi":"10.48550/arxiv.2407.01800","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.01800","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Normalization and effective learning rates in rein- forcement learning","venue":"arXiv (Cornell University)","work_id":"8c297aa8-be81-42e5-ac68-d6684ca7e615","year":2024},"citing_paper":{"arxiv_id":"2411.04832","last_updated":"2026-04-18T13:11:19Z","snapshot_observed_at":"2026-08-07T20:09:01.472991Z","submitted_at":"2024-11-07T16:13:54Z","title":"Plasticity Loss in Deep Reinforcement Learning: A Survey","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-23T18:02:30.199552Z"},"links":{"cited_paper":"/paper/2407.01800","citing_paper":"/paper/2411.04832"},"observation_digest":"sha256:5b6f40484c824aefaca368449d8170a1a7cb13d29fb83f4671d523998ee68c5e","observation_id":"b16c1a88-f099-4fb8-a5b1-d01825d49af2","resolution":{"observed_at":"2026-05-23T18:03:18.206344Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01800","last_updated":"2024-07-01T20:58:01Z","snapshot_observed_at":"2026-08-17T20:41:45.190774Z","submitted_at":"2024-07-01T20:58:01Z","title":"Normalization and effective learning rates in reinforcement learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01800","snapshot_observed_at":"2026-08-11T04:32:51.611027Z","title":"Normalization and effective learning rates in reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18790","last_updated":"2024-12-25T05:58:07Z","snapshot_observed_at":"2026-08-20T09:43:29.074519Z","submitted_at":"2024-12-25T05:58:07Z","title":"Torque-Aware Momentum","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T04:32:51.611027Z"},"links":{"cited_paper":"/paper/2407.01800","citing_paper":"/paper/2412.18790"},"observation_digest":"sha256:60ace39e8d8171caac559eb88136b01ecef9a8a18ba54c7b36d17f32079df891","observation_id":"2c8b0a50-84f4-4296-b9df-2e0846699123","resolution":{"observed_at":"2026-08-11T04:32:51.611027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01800","last_updated":"2024-07-01T20:58:01Z","snapshot_observed_at":"2026-08-17T20:41:45.190774Z","submitted_at":"2024-07-01T20:58:01Z","title":"Normalization and effective learning rates in reinforcement learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01800","snapshot_observed_at":"2026-08-15T19:16:29.010952Z","title":"Normalization and effective learning rates in reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17204","last_updated":"2025-06-20T17:54:24Z","snapshot_observed_at":"2026-08-19T22:11:33.663475Z","submitted_at":"2025-06-20T17:54:24Z","title":"Network Sparsity Unlocks the Scaling Potential of Deep Reinforcement Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T19:16:29.010952Z"},"links":{"cited_paper":"/paper/2407.01800","citing_paper":"/paper/2506.17204"},"observation_digest":"sha256:a2a821dff8202e677ccf3ebe12c515941a918705676a2fded2f466b723108c7a","observation_id":"16063b16-489c-4e1e-b0d4-d15d469e0a88","resolution":{"observed_at":"2026-08-15T19:16:29.010952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01800","last_updated":"2024-07-01T20:58:01Z","snapshot_observed_at":"2026-08-17T20:41:45.190774Z","submitted_at":"2024-07-01T20:58:01Z","title":"Normalization and effective learning rates in reinforcement learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01800","snapshot_observed_at":"2026-08-06T19:53:23.365768Z","title":"Normalization and effective learning rates in reinforcement learning","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.04683","last_updated":"2025-07-07T06:02:55Z","snapshot_observed_at":"2026-08-07T08:37:19.278160Z","submitted_at":"2025-07-07T06:02:55Z","title":"Recovering Plasticity of Neural Networks via Soft Weight Rescaling","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:23.365768Z"},"links":{"cited_paper":"/paper/2407.01800","citing_paper":"/paper/2507.04683"},"observation_digest":"sha256:89a422af9b4a674cd3540702cb16ce8444c562646a8d1c3a9ec096c459d88b63","observation_id":"7d3c387a-767c-41c3-92e1-f5df125c9050","resolution":{"observed_at":"2026-08-06T19:53:23.365768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01800","last_updated":"2024-07-01T20:58:01Z","snapshot_observed_at":"2026-08-17T20:41:45.190774Z","submitted_at":"2024-07-01T20:58:01Z","title":"Normalization and effective learning rates in reinforcement learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01800","snapshot_observed_at":"2026-08-06T16:56:21.673962Z","title":"Normalization and effective learning rates in reinforcement learning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-13T10:11:21.319788Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.673962Z"},"links":{"cited_paper":"/paper/2407.01800","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:b1699cd6859d90f1a9002401b86bb4b6ff3bd6234ce2976fad604bc70edc5468","observation_id":"630a4362-d18f-413f-b6a6-adf0362d1db5","resolution":{"observed_at":"2026-08-06T16:56:21.673962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01800","last_updated":"2024-07-01T20:58:01Z","snapshot_observed_at":"2026-08-17T20:41:45.190774Z","submitted_at":"2024-07-01T20:58:01Z","title":"Normalization and effective learning rates in reinforcement learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01800","snapshot_observed_at":"2026-08-06T10:21:45.188704Z","title":"Normalization and effective learning rates in reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.00212","last_updated":"2025-08-20T01:53:57Z","snapshot_observed_at":"2026-08-14T19:42:47.864806Z","submitted_at":"2025-07-31T23:25:19Z","title":"Reinitializing weights vs units for maintaining plasticity in neural networks","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T10:21:45.188704Z"},"links":{"cited_paper":"/paper/2407.01800","citing_paper":"/paper/2508.00212"},"observation_digest":"sha256:b1f13a42d2e6c9d6c6aa1b87e2129fccab169f4a362f6683d487298c9fd510f5","observation_id":"4cfc317f-fa84-4864-946b-742968a055fd","resolution":{"observed_at":"2026-08-06T10:21:45.188704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01800","last_updated":"2024-07-01T20:58:01Z","snapshot_observed_at":"2026-08-17T20:41:45.190774Z","submitted_at":"2024-07-01T20:58:01Z","title":"Normalization and effective learning rates in reinforcement learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01800","snapshot_observed_at":"2026-08-06T05:44:15.112426Z","title":"Normalization and effective learning rates in reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01329","last_updated":"2025-08-02T11:40:26Z","snapshot_observed_at":"2026-08-18T08:07:14.441688Z","submitted_at":"2025-08-02T11:40:26Z","title":"Is Exploration or Optimization the Problem for Deep Reinforcement Learning?","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T05:44:15.112426Z"},"links":{"cited_paper":"/paper/2407.01800","citing_paper":"/paper/2508.01329"},"observation_digest":"sha256:5dfb667437954cb788a3ee3e703965dd0a5f4a6cdde573c92e3e922f81966e8a","observation_id":"296b198c-6a76-4466-a25c-824730fbc677","resolution":{"observed_at":"2026-08-06T05:44:15.112426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01800","last_updated":"2024-07-01T20:58:01Z","snapshot_observed_at":"2026-08-17T20:41:45.190774Z","submitted_at":"2024-07-01T20:58:01Z","title":"Normalization and effective learning rates in reinforcement learning","version":1},"cited_work":{"arxiv_id":"2407.01800","doi":"10.48550/arxiv.2407.01800","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.01800","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Normalization and effective learning rates in rein- forcement learning","venue":"arXiv (Cornell University)","work_id":"8c297aa8-be81-42e5-ac68-d6684ca7e615","year":2024},"citing_paper":{"arxiv_id":"2604.16426","last_updated":"2026-04-04T17:50:07Z","snapshot_observed_at":"2026-08-15T07:37:41.798158Z","submitted_at":"2026-04-04T17:50:07Z","title":"Functional Similarity Metric for Neural Networks: Overcoming Parametric Ambiguity via Activation Region Analysis","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-13T17:51:29.832500Z"},"links":{"cited_paper":"/paper/2407.01800","citing_paper":"/paper/2604.16426"},"observation_digest":"sha256:aa04c727be8d79e46dc17c4262cc6d4a5838ef97013e3e0999ee300333ca8602","observation_id":"7158ce83-4d17-4c9d-b9a0-251089ee4e68","resolution":{"observed_at":"2026-05-13T17:53:05.024310Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01800","last_updated":"2024-07-01T20:58:01Z","snapshot_observed_at":"2026-08-17T20:41:45.190774Z","submitted_at":"2024-07-01T20:58:01Z","title":"Normalization and effective learning rates in reinforcement learning","version":1},"cited_work":{"arxiv_id":"2407.01800","doi":"10.48550/arxiv.2407.01800","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.01800","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Normalization and effective learning rates in rein- forcement learning","venue":"arXiv (Cornell University)","work_id":"8c297aa8-be81-42e5-ac68-d6684ca7e615","year":2024},"citing_paper":{"arxiv_id":"2605.01567","last_updated":"2026-05-02T18:37:36Z","snapshot_observed_at":"2026-08-17T02:00:18.581256Z","submitted_at":"2026-05-02T18:37:36Z","title":"Feedback-Normalized Developer Memory for Reinforcement-Learning Coding Agents: A Safety-Gated MCP Architecture","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-09T13:59:40.638085Z"},"links":{"cited_paper":"/paper/2407.01800","citing_paper":"/paper/2605.01567"},"observation_digest":"sha256:61f96f37e63aaa299f8cdcc8bf02257c9cdd16ddbbc00ceceaa602fe0679f40b","observation_id":"d0420af1-da28-4946-bc9d-e882729f7ea8","resolution":{"observed_at":"2026-05-09T22:29:06.410893Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01800","last_updated":"2024-07-01T20:58:01Z","snapshot_observed_at":"2026-08-17T20:41:45.190774Z","submitted_at":"2024-07-01T20:58:01Z","title":"Normalization and effective learning rates in reinforcement learning","version":1},"cited_work":{"arxiv_id":"2407.01800","doi":"10.48550/arxiv.2407.01800","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.01800","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Normalization and effective learning rates in rein- forcement learning","venue":"arXiv (Cornell University)","work_id":"8c297aa8-be81-42e5-ac68-d6684ca7e615","year":2024},"citing_paper":{"arxiv_id":"2605.04368","last_updated":"2026-05-06T00:10:17Z","snapshot_observed_at":"2026-08-15T07:36:45.202724Z","submitted_at":"2026-05-06T00:10:17Z","title":"Extending Differential Temporal Difference Methods for Episodic Problems","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T18:19:57.472765Z"},"links":{"cited_paper":"/paper/2407.01800","citing_paper":"/paper/2605.04368"},"observation_digest":"sha256:8ea647876f3c04137f24ec3aefbf40209309c1c47d071286653928c8bf1af697","observation_id":"004c9868-2826-4094-8edf-43234ea14c79","resolution":{"observed_at":"2026-05-09T06:35:38.886721Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01800","last_updated":"2024-07-01T20:58:01Z","snapshot_observed_at":"2026-08-17T20:41:45.190774Z","submitted_at":"2024-07-01T20:58:01Z","title":"Normalization and effective learning rates in reinforcement learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01800","snapshot_observed_at":"2026-08-01T08:32:00.072591Z","title":"arXiv preprint arXiv:2407.01800 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21120","last_updated":"2026-07-23T09:55:45Z","snapshot_observed_at":"2026-08-13T04:22:32.472683Z","submitted_at":"2026-07-23T09:55:45Z","title":"Relative Value Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-01T08:32:00.072591Z"},"links":{"cited_paper":"/paper/2407.01800","citing_paper":"/paper/2607.21120"},"observation_digest":"sha256:234d392971f69cb227ae922883c04ae514aa403c36ae303c427c307a17d1f06d","observation_id":"2ee1e8fa-4456-4f22-a346-809c2d6cfcd4","resolution":{"observed_at":"2026-08-01T08:32:00.072591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01800","last_updated":"2024-07-01T20:58:01Z","snapshot_observed_at":"2026-08-17T20:41:45.190774Z","submitted_at":"2024-07-01T20:58:01Z","title":"Normalization and effective learning rates in reinforcement learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01800","snapshot_observed_at":"2026-08-12T00:48:46.585186Z","title":"arXiv preprint arXiv:2407.01800 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07870","last_updated":"2026-08-08T02:44:43Z","snapshot_observed_at":"2026-08-15T15:49:08.325082Z","submitted_at":"2026-08-08T02:44:43Z","title":"V-Simba: Unleashing the Architectural Potential of RL in Visual Continuous Control","version":1},"reference_index":239,"source":"arxiv_source","source_observed_at":"2026-08-12T00:48:46.585186Z"},"links":{"cited_paper":"/paper/2407.01800","citing_paper":"/paper/2608.07870"},"observation_digest":"sha256:020d189ed11223ee39f2b4fdc9ff9947fd9117e92bfc5795cd847c981c18ee42","observation_id":"e0ad2ef8-2077-4a47-a307-2173c1896ac3","resolution":{"observed_at":"2026-08-12T00:48:46.585186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2407.01800/citation-record","integrity":"/paper/2407.01800/integrity","json":"/paper/2407.01800/citation-record.json","paper":"/paper/2407.01800"},"outbound":[],"paper":{"arxiv_id":"2407.01800","last_updated":"2024-07-01T20:58:01Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T20:41:45.190774Z","submitted_at":"2024-07-01T20:58:01Z","title":"Normalization and effective learning rates in reinforcement learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2407.01800."}