{"as_of":"2026-08-10T12:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c8061ab6b538f0b46ff836dc2e3e939252a7df5f5b6985aa5861ad0338381818","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:05:16.273950Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.11975/citation-record","integrity":"/paper/2507.11975/integrity","json":"/paper/2507.11975/citation-record.json","paper":"/paper/2507.11975"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.124172Z","title":"Imagenet classification with deep convolutional neural networks,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.124172Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:7361d412a6b9259c7e0c4dd7c5cb1d9fb7dd897c81b5bca5be1fe114ad532db8","observation_id":"5adbb0aa-ba8e-489f-bff9-5c7d3e1b8547","resolution":{"observed_at":"2026-08-06T17:05:16.124172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05587","last_updated":"2017-12-05T18:06:21Z","snapshot_observed_at":"2026-08-07T13:44:53.690521Z","submitted_at":"2017-06-17T22:48:57Z","title":"Rethinking Atrous Convolution for Semantic Image Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05587","snapshot_observed_at":"2026-08-06T17:05:16.127902Z","title":"Rethinking atrous convolution for semantic image segmentation,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.127902Z"},"links":{"cited_paper":"/paper/1706.05587","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:9ed9e1a9674a5b1a9e68d001813107a90888d1d3f2ffd46aa88f2159daed2bd0","observation_id":"8b2f03e3-8ac8-4b2d-abc3-d81959d4056f","resolution":{"observed_at":"2026-08-06T17:05:16.127902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.622313Z","title":"Speech recognition with deep recurrent neural networks,","venue":null,"work_id":"28d69e4b-927c-40b7-893a-f9b3eab3b0b9","year":2013},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.131915Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:023bd2cbbc534bdc40e5b3d7fbe8fd7c380351d3b88eaee8cc062469ef9ff5eb","observation_id":"e184e0a3-f345-43d8-bd51-0961048e9ce2","resolution":{"observed_at":"2026-08-06T17:05:16.625187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.136750Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.136750Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:954dae6c8b78ba03d91c3254d358540804554174fad6abb327907de717bd85c6","observation_id":"7eaf585e-f1af-4656-9a3b-3c4bcb18aaf6","resolution":{"observed_at":"2026-08-06T17:05:16.136750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.140459Z","title":"Self-supervised learning: Generative or contrastive,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.140459Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:6af7154bcfced2cc8497119eca19f6e9847650a30a550818a9d83744d8b33a0f","observation_id":"fc7e3626-3bdf-4802-949e-90c33a83b5b5","resolution":{"observed_at":"2026-08-06T17:05:16.140459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.143221Z","title":"Language models are few-shot learners,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.143221Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:4846d26280e33bdd04a331e6a05c7d4e5c19d31798a9d7a74aabb251908c163e","observation_id":"4a249cf3-76e0-4980-bce3-e15c2eeee26f","resolution":{"observed_at":"2026-08-06T17:05:16.143221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-06T17:05:16.145892Z","title":"Playing atari with deep reinforcement learning,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.145892Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:8a109a3cb359f4472eb8cfbf2813cbf788e7f2e0a3f07bedfd6a0146889bfadd","observation_id":"e03599f9-a4a9-4fbd-b82d-6fb9dafc81f6","resolution":{"observed_at":"2026-08-06T17:05:16.145892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.604686Z","title":"Human-level control through deep reinforce- ment learning,","venue":null,"work_id":"0143ed6a-658d-430f-b1d0-98276aa0042d","year":2015},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.148917Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:cfeb1bf0e95869f88eabbc406517315d0ed119e655f25a7806e8698be38d18ac","observation_id":"7a969424-75c8-430b-bc87-d71d0e714705","resolution":{"observed_at":"2026-08-06T17:05:16.607540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.597295Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor,","venue":null,"work_id":"c83bdcdc-3d34-406d-ad03-7e94be8ecf71","year":2018},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.151204Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:c3000053cd0e6f4deccd006fc97a82ad55a2fe01ebc15698338d1087e1e96953","observation_id":"612ee690-754d-435e-a18e-f42fcfba9962","resolution":{"observed_at":"2026-08-06T17:05:16.600250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.590818Z","title":"Addressing function approximation error in actor-critic meth- ods,","venue":null,"work_id":"39ff44b9-db1c-41b0-815d-549b8473991b","year":2018},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.154533Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:c08b67ffff2b74fdbf58987af73d028178a2a781194be3702c74ac5838b193a8","observation_id":"169a99c4-7aee-41fb-9ea1-f1ea79bfbafa","resolution":{"observed_at":"2026-08-06T17:05:16.593517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T17:05:16.157029Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.157029Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:ea1f687c6b7c6deaace2487f9f6c72389804e54311f2da331cbd6f8c0fadd68f","observation_id":"a24931a3-2a2e-47a1-9fbd-13bf153d8d33","resolution":{"observed_at":"2026-08-06T17:05:16.157029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.02648","last_updated":"2018-12-06T16:36:20Z","snapshot_observed_at":"2026-07-06T07:19:38.028327Z","submitted_at":"2018-12-06T16:36:20Z","title":"Deep Reinforcement Learning and the Deadly Triad","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.02648","snapshot_observed_at":"2026-08-06T17:05:16.160121Z","title":"Deep reinforcement learning and the deadly triad,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.160121Z"},"links":{"cited_paper":"/paper/1812.02648","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:f9a5cd37d8738e7b0ea6dedd6e2f20e224a37da39d067d71f27be4552b40a238","observation_id":"e8699051-7f93-4e96-a5e3-5f164f97471c","resolution":{"observed_at":"2026-08-06T17:05:16.160121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.09163","last_updated":"2020-11-27T20:22:38Z","snapshot_observed_at":"2026-07-06T10:05:35.400002Z","submitted_at":"2020-10-19T01:27:07Z","title":"D2RL: Deep Dense Architectures in Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.09163","snapshot_observed_at":"2026-08-06T17:05:16.163294Z","title":"D2rl: Deep dense architectures in reinforcement learning,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.163294Z"},"links":{"cited_paper":"/paper/2010.09163","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:b7df9f1690927c248c66f6de930561bb624503ed4dc680e92e4b06c23584c25d","observation_id":"7bfbc8f4-465a-4d32-8509-a295fe290c3d","resolution":{"observed_at":"2026-08-06T17:05:16.163294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.05990","last_updated":"2020-06-10T17:59:03Z","snapshot_observed_at":"2026-07-06T09:27:47.020846Z","submitted_at":"2020-06-10T17:59:03Z","title":"What Matters In On-Policy Reinforcement Learning? A Large-Scale Empirical Study","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.05990","snapshot_observed_at":"2026-08-06T17:05:16.167535Z","title":"What matters in on-policy reinforcement learning? a large-scale empirical study,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.167535Z"},"links":{"cited_paper":"/paper/2006.05990","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:8926ecfb4a53ef68643cfae0654df98e33e4625de1ba8ef4b827f4abf6910977","observation_id":"b0bd07b4-47d3-45fb-8dd6-c316ec3a8241","resolution":{"observed_at":"2026-08-06T17:05:16.167535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.583744Z","title":"Deterministic policy gradient algorithms,","venue":null,"work_id":"e993edfd-7ed0-4c19-87f3-1d121f1440a5","year":2014},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.170107Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:05b0bec724a15e160cc03ec8039343a887fac0f175c19877779c6538ca6070dd","observation_id":"44dd1381-2aef-49d3-bb5f-3ef10a720172","resolution":{"observed_at":"2026-08-06T17:05:16.586314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.576808Z","title":"Can increasing input dimensionality improve deep reinforcement learning?,","venue":null,"work_id":"f9743fd6-773d-4204-9f2b-214c19c140c9","year":2020},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.173158Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:75b7940f8d9c935a74dae2cfbe883362e1945e0d1d64e529f7227b0cacf2d6c3","observation_id":"a589ac17-4db4-4fb0-a82f-62b28de40bf0","resolution":{"observed_at":"2026-08-06T17:05:16.579523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.568688Z","title":"A framework for training larger networks for deep Reinforce- ment learning,","venue":null,"work_id":"693c725f-e6eb-45b6-a1ee-67b00bb95988","year":2024},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.175720Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:1252484dbefc90e528298dda1b811baa9dbcb2b6608c92b9bc7ff4a20693b907","observation_id":"812ec8fd-83c2-421b-be56-8fb4a43951ac","resolution":{"observed_at":"2026-08-06T17:05:16.571286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.561437Z","title":"Bigger, better, faster: human-level atari with human-level efficiency,","venue":null,"work_id":"453d54e9-3faa-4e65-8b0d-df2837d39a95","year":2023},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.178217Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:09c6231b91710df836d52d432126d1741bf49f6af634743a820f419012cb737e","observation_id":"656e0d66-ca70-4c26-85e2-e76f34780862","resolution":{"observed_at":"2026-08-06T17:05:16.563994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12567","last_updated":"2023-04-25T04:25:08Z","snapshot_observed_at":"2026-07-06T15:19:39.223171Z","submitted_at":"2023-04-25T04:25:08Z","title":"Proto-Value Networks: Scaling Representation Learning with Auxiliary Tasks","version":1},"cited_work":{"arxiv_id":"2304.12567","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.12567","snapshot_observed_at":"2026-08-06T17:05:16.354990Z","title":"Proto-Value Networks: Scaling Representation Learning with Auxiliary Tasks","venue":"cs.LG","work_id":"6f31d89b-3e0d-4baa-a842-f868ba0af0fa","year":2023},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.180812Z"},"links":{"cited_paper":"/paper/2304.12567","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:a795a695d8099c8824e024d44e30e69882d04635272a00009ffe1cace789e804","observation_id":"1aebfac9-46fb-4dfd-83b5-054efaf6b447","resolution":{"observed_at":"2026-08-06T17:05:16.358844Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-06T17:05:16.183468Z","title":"Mastering diverse domains through world models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.183468Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:f292377824ea45588a62da0091d6cb683e5a9e69d58a69efa317a0f92d96bf36","observation_id":"b0723549-b88f-4ace-8b6c-b87d8c3c96ef","resolution":{"observed_at":"2026-08-06T17:05:16.183468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.553434Z","title":"Learning both weights and connections for efficient neural networks,","venue":null,"work_id":"28f0d8ba-254e-44d2-8ce7-15742dcbacb6","year":2015},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.185864Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:ae34f30a02f54bbf1819df17283977c2f7d4a5338a655f8d6f03a1ee9c0a5487","observation_id":"a57f3804-d4ca-44ef-85b4-83002c95ebb4","resolution":{"observed_at":"2026-08-06T17:05:16.557017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.545407Z","title":"What is the state of neural network pruning?,","venue":null,"work_id":"17d08e7d-17bc-46f7-b0d9-d6f5188fd5f6","year":2020},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.188472Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:8394db017435f6e01ffc8d630dfded7e57cbd7d843dd98c93be416da7e082bef","observation_id":"e9fbab70-f307-4599-8c82-e46478f8d94b","resolution":{"observed_at":"2026-08-06T17:05:16.548863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1608.08710","last_updated":"2017-03-10T17:57:56Z","snapshot_observed_at":"2026-08-09T05:37:48.140401Z","submitted_at":"2016-08-31T02:29:59Z","title":"Pruning Filters for Efficient ConvNets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.08710","snapshot_observed_at":"2026-08-06T17:05:16.190846Z","title":"Pruning filters for efficient convnets,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.190846Z"},"links":{"cited_paper":"/paper/1608.08710","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:d9b7627f8d1bd663dd2d7dedd433afafc657a4f44421cd0049150ab9e9763611","observation_id":"5e4675f8-d82e-4607-86b8-8ba62b132588","resolution":{"observed_at":"2026-08-06T17:05:16.190846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.536629Z","title":"Lost in pruning: The effects of pruning neural networks beyond test accuracy,","venue":null,"work_id":"6f58081e-71f7-44a3-8f3c-db40bd21f641","year":2021},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.193478Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:c675fcce7396ed7a28e471aafb00eef593a7cc3dcf9ca44c7201543be80f0bce","observation_id":"846c6d15-1b28-4694-9cb8-e14a7470b052","resolution":{"observed_at":"2026-08-06T17:05:16.539662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.528946Z","title":"SCOP: scientific control for reliable neural network pruning,","venue":null,"work_id":"d4ef252f-0525-4faf-8fdd-9ae41af98b4a","year":2020},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.196613Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:59b7c71eb693845bf269eefd37dc888e797c7677c139fc80ad15d279f2be772b","observation_id":"743ab64d-1ee0-4e35-8d3a-75128e2fe48e","resolution":{"observed_at":"2026-08-06T17:05:16.531595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.519677Z","title":"Robust learning of parsimonious deep neural networks,","venue":null,"work_id":"52b4cc9e-1e02-444b-a144-bd40ed6b9aea","year":2024},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.199276Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:5ea83b6610883afc9a543e78003c28813d67f2051e3996300a1d07456f470066","observation_id":"5ad395b9-e524-46f5-970b-980bbcbd9cbb","resolution":{"observed_at":"2026-08-06T17:05:16.523851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.511415Z","title":"Shallowing deep networks: Layer-wise pruning based on feature representa- tions,","venue":null,"work_id":"a5207718-06a1-422c-a4a9-4d688d8d3e76","year":2019},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.201848Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:c744beabd6d5fa1387b444832695187fabdbbe4e61723b4b41e931278b5bffac","observation_id":"20484b75-ce33-41d1-b2ef-1decc143ae03","resolution":{"observed_at":"2026-08-06T17:05:16.514958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.10178","last_updated":"2019-12-21T02:11:47Z","snapshot_observed_at":"2026-07-06T08:46:12.464068Z","submitted_at":"2019-12-21T02:11:47Z","title":"DBP: Discrimination Based Block-Level Pruning for Deep Model Acceleration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.10178","snapshot_observed_at":"2026-08-06T17:05:16.204646Z","title":"Dbp: Discrimination based block-level pruning for deep model acceleration,","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.204646Z"},"links":{"cited_paper":"/paper/1912.10178","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:2b853eb8b386e0e2c46319214970d5c17367a301c2344d4d5a2729287848cb42","observation_id":"a2602985-b3b3-4641-aaa7-c1f2459c45aa","resolution":{"observed_at":"2026-08-06T17:05:16.204646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04549","last_updated":"2024-06-06T23:19:57Z","snapshot_observed_at":"2026-08-05T23:14:24.294176Z","submitted_at":"2024-06-06T23:19:57Z","title":"Concurrent Training and Layer Pruning of Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04549","snapshot_observed_at":"2026-08-06T17:05:16.207626Z","title":"Concurrent training and layer pruning of deep neural networks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.207626Z"},"links":{"cited_paper":"/paper/2406.04549","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:2aa2316a912795cd580e4136c134b25095817cf1f3f3e5dfa2fe28c3154bbead","observation_id":"fcbb66cd-9d04-47a9-9245-f88f6bc35c8c","resolution":{"observed_at":"2026-08-06T17:05:16.207626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.210505Z","title":"The lottery ticket hypothesis: Finding sparse, trainable neural networks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.210505Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:d510b26ab26035327e907a3b047eef886b150095add790f101f6643848169c9c","observation_id":"077b9460-62eb-4280-aa8b-21b325227f79","resolution":{"observed_at":"2026-08-06T17:05:16.210505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.497507Z","title":"The state of sparse training in deep reinforcement learning,","venue":null,"work_id":"329001ad-39ad-499e-9470-a92cc82491c3","year":2022},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.212910Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:83152b3e00131b5520f7276f7b9be19c1fd8e8d44e02ec882c106c28f24a0eac","observation_id":"52569f7f-427f-423a-bf02-edd2435c72e7","resolution":{"observed_at":"2026-08-06T17:05:16.500702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.490210Z","title":"Automatic noise filtering with dynamic sparse training in deep reinforcement learning,","venue":null,"work_id":"a07f42b7-fb68-44b6-b823-32d7a1b74593","year":2023},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.216448Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:50969ed053e5d9e18bbfd7e48ea15855a1a861c4b867c672498a80033951deac","observation_id":"990b365b-583c-44a0-ae0e-9d79efc4b6ce","resolution":{"observed_at":"2026-08-06T17:05:16.492813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.482182Z","title":"In value-based deep reinforcement learning, a pruned network is a good network,","venue":null,"work_id":"d3ae95db-c750-431b-948c-a47d7afce4ea","year":2024},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.220193Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:d9bffa512d2522e79a77dbee2bb5a281a6c131b301e2999ce7e3571049703ec3","observation_id":"13e34952-13ba-4ec9-bdad-9f44f194942a","resolution":{"observed_at":"2026-08-06T17:05:16.484983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.473760Z","title":null,"venue":null,"work_id":"4b2f443d-8efe-4c0c-805a-9e554679b6c0","year":2025},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.223238Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:2827bde5cd5596ae08060bcf8f3939628fe2ed96c9970cbf7aa06360ee739c71","observation_id":"b0cb0439-19f1-4dde-acae-aaa0a1c7e752","resolution":{"observed_at":"2026-08-06T17:05:16.476928Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09127","last_updated":"2025-07-16T11:39:10Z","snapshot_observed_at":"2026-08-08T22:56:33.023361Z","submitted_at":"2024-11-14T02:00:22Z","title":"Complexity-Aware Training of Deep Neural Networks for Optimal Structure Discovery","version":2},"cited_work":{"arxiv_id":"2411.09127","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.09127","snapshot_observed_at":"2026-08-06T17:05:16.321541Z","title":"Complexity-Aware Training of Deep Neural Networks for Optimal Structure Discovery","venue":"cs.LG","work_id":"bff0acfc-65a6-4c09-add8-26382a571e1c","year":2024},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.226076Z"},"links":{"cited_paper":"/paper/2411.09127","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:2da6e758a2cf7ee8e5e2ca95a4c1f62592118e099b199282fac6e9f732d27c1d","observation_id":"2f612277-8f92-4ae1-9899-32960ad99a4f","resolution":{"observed_at":"2026-08-06T17:05:16.327100Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.02975","last_updated":"2019-12-28T04:04:43Z","snapshot_observed_at":"2026-07-06T08:42:30.413190Z","submitted_at":"2019-12-06T04:52:16Z","title":"Observational Overfitting in Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.02975","snapshot_observed_at":"2026-08-06T17:05:16.229659Z","title":"Observational overfitting in reinforcement learning,","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.229659Z"},"links":{"cited_paper":"/paper/1912.02975","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:e94526b39402d47b3d6b00b5bed484ccf82a45030bfeaada1a8b6fec750e705c","observation_id":"f0db245f-0116-47fc-b940-4fb12dc81a83","resolution":{"observed_at":"2026-08-06T17:05:16.229659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.06893","last_updated":"2018-04-20T16:49:52Z","snapshot_observed_at":"2026-08-04T06:10:10.723883Z","submitted_at":"2018-04-18T19:49:13Z","title":"A Study on Overfitting in Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.06893","snapshot_observed_at":"2026-08-06T17:05:16.233411Z","title":"A study on overfitting in deep reinforcement learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.233411Z"},"links":{"cited_paper":"/paper/1804.06893","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:4cde6475306b1ad4fd2421ad111dab01507ad1c09d943413e305fd72dbcf11f8","observation_id":"e651a0b8-8fc1-4d14-ba87-a88158cbfd99","resolution":{"observed_at":"2026-08-06T17:05:16.233411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.466898Z","title":"Learning state representation for deep actor-critic control,","venue":null,"work_id":"64ea1efa-948f-465f-b9e3-d33436a359e2","year":2016},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.237333Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:38c3fc44f894807a0ef3f33e2057c64c50f51729bcfd0d26ad427d89cbb235ce","observation_id":"a0457d13-9d9c-408e-9be9-3b69210cbcc2","resolution":{"observed_at":"2026-08-06T17:05:16.469538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.239992Z","title":"Densely connected convolutional net- works,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.239992Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:5ec21e45d491aa8f7f11081c363e5dc0f9c0e8b8b1802e4afa1b05cac37316e7","observation_id":"bc746c52-0d47-4821-b9e9-c5e54baa1946","resolution":{"observed_at":"2026-08-06T17:05:16.239992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17032","last_updated":"2025-11-02T13:42:19Z","snapshot_observed_at":"2026-07-06T18:51:06.750136Z","submitted_at":"2024-07-24T06:35:05Z","title":"Gymnasium: A Standard Interface for Reinforcement Learning Environments","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17032","snapshot_observed_at":"2026-08-06T17:05:16.242243Z","title":"Gymnasium: A standard interface for reinforcement learning environ- ments,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.242243Z"},"links":{"cited_paper":"/paper/2407.17032","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:336dcfaaedf2fc67e095a36d231012cd58028714bb4a13ad232c505ff9ac52bb","observation_id":"b1d234d2-e4bd-4001-9483-4e6ec4242098","resolution":{"observed_at":"2026-08-06T17:05:16.242243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1308.3432","last_updated":"2013-08-15T15:19:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-08-15T15:19:34Z","title":"Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1308.3432","snapshot_observed_at":"2026-08-06T17:05:16.245637Z","title":"Estimating or propagating gradients through stochastic neurons for conditional computation,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.245637Z"},"links":{"cited_paper":"/paper/1308.3432","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:1fa8ea4aa32530818e438a08fa7d959b909e97deaea285d0038e94ac5784f965","observation_id":"e9a0a543-82b3-40ca-b780-9b93b0f1a161","resolution":{"observed_at":"2026-08-06T17:05:16.245637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.453279Z","title":"Dropout: a simple way to prevent neural networks from overfitting,","venue":null,"work_id":"eb080d67-5b8d-4ef1-875f-ed5ebd0d5815","year":1929},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.248770Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:2ee794d94be87f741a1d229f248510bfbbe7517aae45831031bd9f57a2d946c0","observation_id":"631b7a3f-3b58-4175-bc79-fa2e76fbbba4","resolution":{"observed_at":"2026-08-06T17:05:16.456950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.445844Z","title":"Batch normalization: Accelerating deep network training by reducing internal covariate shift,","venue":null,"work_id":"f3c0286d-bbde-49f7-986e-0841eec302fb","year":2015},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.251263Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:7e711fcc7026af1a6d76a6e6dac6c323f2d3ef547fd53e8a788e3bd3841c4e26","observation_id":"d252ee97-7557-4d17-9d46-36dbc45db5c7","resolution":{"observed_at":"2026-08-06T17:05:16.448994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.437245Z","title":"How does batch normalization help optimization?,","venue":null,"work_id":"7f75c365-0492-46ec-9b25-002739a23ea2","year":2018},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.254389Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:0402a6968f779a6eaa2fa81fea728774eb16340abb64c9cb9f6c474558d00a81","observation_id":"31a16712-0d15-4fa5-9179-46ddf9c96242","resolution":{"observed_at":"2026-08-06T17:05:16.439794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.257106Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.257106Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:ff7d4ab6cf5649d0de3ad28945de3a8bdc1c3d34560f9bee2a13bb11dcb1b236","observation_id":"2b458270-4b06-4c91-8151-8e7dd30a2443","resolution":{"observed_at":"2026-08-06T17:05:16.257106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.260023Z","title":"Deep reinforcement learning that matters,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.260023Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:14eeda32ceaa9be501542a55ac757811c1f8b425a13e2ece229b31a51be0ca8a","observation_id":"d2c10150-1c06-4875-8eba-8d718d61435e","resolution":{"observed_at":"2026-08-06T17:05:16.260023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.422343Z","title":"Dropout as a bayesian approximation: Representing model uncertainty in deep learning,","venue":null,"work_id":"d509dc7d-c975-4d4d-8c4d-e2a0c9449c56","year":2016},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.262307Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:e33e13a61a9fb4ca3f336eff62e24c65f170c390a68b4b2423f605e73789cdb7","observation_id":"c12f384d-4ab2-4c2c-a19b-4cf4650eab4f","resolution":{"observed_at":"2026-08-06T17:05:16.425769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.414312Z","title":"Dropout q-functions for doubly efficient reinforcement learning,","venue":null,"work_id":"1cd68b0c-4820-4afe-990b-0050daffb433","year":2022},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.265985Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:ff5e97b951d0bba81ab5cf3c5896cc41f2295705bba7b0eacf423ac53f23bbe6","observation_id":"5723c572-75dc-4b8d-9441-86fdeb180f28","resolution":{"observed_at":"2026-08-06T17:05:16.417015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.406570Z","title":"Regularization matters in policy optimization-an empirical study on continuous control,","venue":null,"work_id":"c01004f9-4123-418c-8bc1-e95b883ee1ca","year":2020},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.268470Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:007ab0a1b1de4029b786ef1d1bc7c38162ee8b33a67e9c3d24a9f9407dbaa4c2","observation_id":"4e3b9397-2f69-47f6-909b-7b8e43ca2c5e","resolution":{"observed_at":"2026-08-06T17:05:16.409991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.397572Z","title":"Implicit under-parameterization inhibits data-efficient deep reinforcement learning,","venue":null,"work_id":"705ef107-fe96-4289-9a97-40052bf9be7b","year":2021},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.270887Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:46eff9528d3ffaa04122c9ca6c14e8c37aab42cc60848e91bedf02ce73ceb188","observation_id":"1a174c10-caf5-4b6a-96e8-963c2e1c2e73","resolution":{"observed_at":"2026-08-06T17:05:16.401286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-06T17:05:16.273950Z","title":"A method for stochastic optimization,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.273950Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:fe13109865043ceae5336f17fe6a722beeabd0f884cc223414cb16cb1af149d7","observation_id":"9ea20eae-0311-4e67-a99a-7a6f0008e3b8","resolution":{"observed_at":"2026-08-06T17:05:16.273950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T01:06:14.440793Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":2,"verified_fuzzy":25},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2507.11975."}