{"as_of":"2026-08-10T08:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fc40d83d8748db34d5b8c4b8f7076c16a2b660953ff74ce9f7f1d26c089b234c","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-07T10:36:32.096050Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T06:35:59.192049Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.27063","snapshot_observed_at":"2026-08-02T06:35:59.192049Z","title":": Incremental self-improvement. In Proc. Workshop on Genetic Programming at ML95, pp. 42–49, 1995. Jürgen Schmidhuber. What","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13104","last_updated":"2026-07-14T09:12:57Z","snapshot_observed_at":"2026-08-08T04:02:03.304635Z","submitted_at":"2026-07-14T09:12:57Z","title":"Self-Improvements in Modern Agentic Systems: A Survey","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T06:35:59.192049Z"},"links":{"cited_paper":"/paper/2604.27063","citing_paper":"/paper/2607.13104"},"observation_digest":"sha256:1a45313c3581a698fef27824cf855ee40b793994b8a0ab59c76e75353350d438","observation_id":"fa7d2894-44a9-4820-8818-d850ac034b5b","resolution":{"observed_at":"2026-08-02T06:35:59.192049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.27063/citation-record","integrity":"/paper/2604.27063/integrity","json":"/paper/2604.27063/citation-record.json","paper":"/paper/2604.27063"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:46:43.572403Z","title":"Learning to learn by gradient descent by gradient descent","venue":null,"work_id":"10a07384-39c3-4ed9-9876-b91a06e77edc","year":2016},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:94fed32746d5d573ad4a29a5971f40694778b330f9b2eed82558a017302a9fa8","observation_id":"5c3c1824-5c21-4ae4-81ec-0016d4ea9657","resolution":{"observed_at":"2026-05-27T07:38:46.067066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On warm-starting neural network training","venue":null,"work_id":"64807fac-9b73-475b-880b-bea6cdc93804","year":2020},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:a27e26ea31c6869c78138fb5a2ce5e5f05a312e64f0003fd857611cfb6a7d13f","observation_id":"f764b2c8-294e-4863-b796-724a79947bff","resolution":{"observed_at":"2026-05-27T07:38:46.082274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"o ppel, Markus Spanring, Andreas Auer, Oleksandra Prudnikova, Michael Kopp, G \\","venue":null,"work_id":"f7795279-3a11-4b4c-9d71-c12b56172631","year":2024},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:e9a45caca8a18d1d66972103f37805fffa75369f52fb6f34d88ba740d7c88bac","observation_id":"17ead005-2814-48cf-a619-0994f554d0c7","resolution":{"observed_at":"2026-05-27T07:38:45.906488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emnist: Extending mnist to handwritten letters","venue":null,"work_id":"20426042-af88-4811-9132-b00a38319707","year":2017},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:652610e6c8c001b17aa0c2cb283546f2927b4542991de0f91d25afae37aa474a","observation_id":"a738f297-53f6-43eb-9289-598fd8d76a53","resolution":{"observed_at":"2026-05-27T07:38:45.980696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.17401","last_updated":"2024-01-30T19:35:43Z","snapshot_observed_at":"2026-07-06T17:22:45.506107Z","submitted_at":"2024-01-30T19:35:43Z","title":"Step-size Optimization for Continual Learning","version":1},"cited_work":{"arxiv_id":"2401.17401","doi":"10.48550/arxiv.2401.17401","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.17401","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Step-size optimization for continual learning","venue":"arXiv (Cornell University)","work_id":"5e4ed761-3b2a-4bdf-b5ba-0731e2dd7b25","year":2024},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"cited_paper":"/paper/2401.17401","citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:da3ba41640e04d7fea2baffa9730b525fcfe9905a917dbc095ece67d3c8f8120","observation_id":"960571c9-fdf4-4ff9-8814-7cb8836711fd","resolution":{"observed_at":"2026-05-12T09:31:26.854064Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Loss of plasticity in deep continual learning","venue":null,"work_id":"52fc12e3-67cc-4240-b0e2-5cf51b91de28","year":2024},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:5a7678112573ddc6fbc1cee9fdbd4b42f7b0280e2e36ae489defd7c1f2769df6","observation_id":"d081907f-c054-48a8-9962-379eb3691d8d","resolution":{"observed_at":"2026-05-27T07:38:45.910941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rupam Mahmood","venue":null,"work_id":"5db7fcdc-9415-4839-b1b4-edb1ca508f54","year":2024},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:34a3fd517eb29d5bcee058a0d5f0ffdda4e678ed122013d16fde5b7e83b1786c","observation_id":"79c327c3-7751-41b2-9d0e-c3a182add742","resolution":{"observed_at":"2026-05-27T07:38:45.898274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01704","last_updated":"2024-07-01T18:29:29Z","snapshot_observed_at":"2026-08-03T22:09:40.563417Z","submitted_at":"2024-07-01T18:29:29Z","title":"Weight Clipping for Deep Continual and Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2407.01704","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.01704","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rupam Mahmood","venue":null,"work_id":"14cbdceb-207d-4ee7-aa42-94b48aa93f6c","year":2024},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"cited_paper":"/paper/2407.01704","citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:0c8dc4fb5eb0ee60681dcae1fb005b1121463a92f4955883f75267e278c44d00","observation_id":"9765521e-8a8f-427d-a4b2-56f39a9d2c5b","resolution":{"observed_at":"2026-05-12T09:31:26.856993Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Catastrophic forgetting in connectionist networks","venue":null,"work_id":"2d3d8d1b-2261-4e1c-be2a-a030a31d717e","year":1999},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:db017c992072616a7a94889cf372c254d201d7b5d87cefb9b7f8432b0e0d8cb6","observation_id":"c54262ca-ab9f-409a-8ae9-00587ae27d13","resolution":{"observed_at":"2026-05-27T07:38:45.902204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to forget: Continual prediction with LSTM","venue":null,"work_id":"0a2824ec-fb6b-45f2-9d1c-21552e1287b0","year":2000},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:f571fd36577cba44d1435d9509efb7bc4d2c86a57e8b07db3529b985d8a46611","observation_id":"68f93b41-201e-4a28-840a-d237dd51527f","resolution":{"observed_at":"2026-05-27T07:38:45.926459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improving robustness with adaptive weight decay","venue":null,"work_id":"8d972bb0-5ac4-44d2-b054-c2b949966bb3","year":2023},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:d5d1128a6748d8391dc134d5c3f775679c88e339990488db7e49c480eb395f67","observation_id":"cc58d83e-0870-4f7d-b007-197fa15be499","resolution":{"observed_at":"2026-05-27T07:38:45.956336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Competitive learning: From interactive activation to adaptive resonance","venue":null,"work_id":"0e3e0096-421e-4834-81d2-faab86ddc16d","year":1987},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:89baf8631db19c3f9550c7820efc58299718914f7c60aaac76f9a7206e8ff7f5","observation_id":"b555a8fe-d4f2-484f-b9d9-092643db51b7","resolution":{"observed_at":"2026-05-27T07:38:46.074804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Comparing biases for minimal network construction with back-propagation","venue":null,"work_id":"cd479a65-e785-417a-8755-84ab909c14e7","year":1988},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:de46f1057a4a53b7f5d6ef6ed70cd01341f30d7ed907d47d19aa446870c5466d","observation_id":"530626f3-d547-4e46-9655-b008e1d4132e","resolution":{"observed_at":"2026-05-27T07:38:45.922664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Alphadecay: Module-wise weight decay for heavy-tailed balancing in LLM s","venue":null,"work_id":"7a4b9674-b205-41e3-a03e-5fe67dedcfe1","year":2025},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:de7203cd6565464005bafb7232f948233d411b7f67b7335690a3d8510f1e370b","observation_id":"edb01388-63c8-490c-947a-20814feabf23","resolution":{"observed_at":"2026-05-27T07:38:45.914668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.00212","last_updated":"2025-08-20T01:53:57Z","snapshot_observed_at":"2026-08-10T04:18:03.858690Z","submitted_at":"2025-07-31T23:25:19Z","title":"Reinitializing weights vs units for maintaining plasticity in neural networks","version":2},"cited_work":{"arxiv_id":"2508.00212","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.00212","snapshot_observed_at":"2026-06-30T11:04:37.510167Z","title":"Reinitializing weights vs units for maintaining plasticity in neural networks","venue":null,"work_id":"49d29979-121d-49fa-bb9c-aa6474007480","year":2025},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"cited_paper":"/paper/2508.00212","citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:a6a9d61447e8dc32d46d726f8567c3bc8d34f7ab6adbc3648aa671284f2ffa08","observation_id":"5791c06e-ad8a-41a1-baca-9a6b7652fb7a","resolution":{"observed_at":"2026-05-12T09:31:26.860362Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hochreiter and J","venue":null,"work_id":"6bd1b473-5d12-412d-abce-ec27b628fc8f","year":1997},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:6fb8eff47741eb1f87cc5c46f1c8704b517b6c777d4cb1f8fcd6deed192bf1d8","observation_id":"7f21998c-1166-4d32-9da9-9b9dfc8314fc","resolution":{"observed_at":"2026-05-27T07:38:45.988704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to learn using gradient descent","venue":null,"work_id":"e527cd01-3f58-4784-94a1-248ab7d9a14c","year":2001},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:4f0309fcdd51ee9c9a513f92a761c27844924234466c0e9b7914ec8218906b75","observation_id":"30f8bd2a-4edc-437a-bdc8-ccd90375edd3","resolution":{"observed_at":"2026-05-27T07:38:46.032105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Metalearning continual learning algorithms","venue":null,"work_id":"b5dd08b5-9c21-4bbe-8a74-eba780fd12ce","year":2025},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:e6c230860f9958057e9aa20983c62070f72396564860787a7400d19fb07ca397","observation_id":"0c99f0c7-f6dd-472a-a33a-9263e3e98a3b","resolution":{"observed_at":"2026-05-27T07:38:45.971915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Layer-wise weight decay for deep neural networks","venue":null,"work_id":"cc95d640-6c5c-43da-8279-cffd8539af79","year":2017},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:8b3b6f9d94d3ee25afd561e52ac0e0eb3d6b7c0b251d4abb64b4d9191c7e57ea","observation_id":"f9001e60-b7d2-485d-874b-f1a6bf2a8a27","resolution":{"observed_at":"2026-05-27T07:38:46.015093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Swifttd: A fast and robust algorithm for temporal difference learning","venue":null,"work_id":"bdf6e815-ca37-43e0-a288-d564f1372720","year":2024},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:ff1705f1778f7947ee614c0cf64b64b10884476655aa2499f8c7740161bc355f","observation_id":"dad49520-663d-4b67-938b-0103e787a995","resolution":{"observed_at":"2026-05-27T07:38:46.018343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":"1412.6980","doi":"10.1002/mrm.28086","metadata_source":"pith","pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Adam: A Method for Stochastic Optimization","venue":"cs.LG","work_id":"1910796d-9b52-4683-bf5c-de9632c1028b","year":2014},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:bdd715030fae9fe70177388a4c3977ab95a6e310aae4344310bc710510c478f2","observation_id":"ac6f027b-a32e-49f9-993c-154acd4b08ec","resolution":{"observed_at":"2026-05-12T09:31:26.862999Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Overcoming catastrophic forgetting in neural networks","venue":null,"work_id":"fc0b5f21-1844-4ab7-896a-4757dcfdeaf1","year":2017},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:4d820a9d0790e6c0910fd5c90529cd343ced01d6ad7931fc084bad8a0cc3e6e4","observation_id":"ba20d61f-87e8-49a0-8a5a-890af36aab26","resolution":{"observed_at":"2026-05-27T07:38:46.035915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A simple weight decay can improve generalization","venue":null,"work_id":"15db0a9b-f7cb-4369-b637-5dfa85e1f2a0","year":1991},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:6adb09204732aecadf62c4abf4ab3db9c097fceccc4a97fdeb7a8c974b1f4e33","observation_id":"5a3dc300-ef89-453e-a810-8112f040086f","resolution":{"observed_at":"2026-05-27T07:38:46.021742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Continual learning as computationally constrained reinforcement learning","venue":null,"work_id":"28eccd8e-f1a5-4272-b51f-93e435b15a9b","year":2025},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:7864b1541093df51d0033fc43374b5aa2d4424f513ae245a1de4619c8e87db45","observation_id":"fcf94196-6ff2-495f-a7c5-c0d0d8d138f0","resolution":{"observed_at":"2026-05-27T07:38:46.001794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Maintaining plasticity in continual learning via regenerative regularization","venue":null,"work_id":"172aad4d-767f-48e2-8a07-da66cf347328","year":2025},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:761ba8ea1c370d39d8bb0770c4a877886655ebf5b53175d8bf8d90cc2ee89417","observation_id":"3791ca0f-2bf8-4f2a-a2a1-8ad28e868459","resolution":{"observed_at":"2026-05-27T07:38:46.047721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c696866d-8eb8-40e6-a69d-b682851e0da8","year":2025},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:16d1c7e491392a6503ea5f2244f57339724922ec292d5bc48622e47d1403bd9f","observation_id":"b68e3f62-c710-4c0a-ac3e-162b297eba47","resolution":{"observed_at":"2026-05-27T07:38:45.992002Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Decoupled weight decay regularization","venue":null,"work_id":"30ece2e7-3c79-4ec7-afc1-0cb2a9c0f7d9","year":2019},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:1f18cecf8b5f5c3543909c8e5538292a7b6d501c856a27e5c76415f3916ba62b","observation_id":"68587637-6995-476f-9df4-a8fe297f8ba2","resolution":{"observed_at":"2026-05-27T07:38:45.976550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Meta-gradients in non-stationary environments","venue":null,"work_id":"28196593-88c0-45fc-a505-f9ac0a7ca2aa","year":2022},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:151cc4a6edd951abc24a5c29263eeba155ae0b005e8a15c43e8da783d8536d93","observation_id":"cf1a4350-83c5-4016-976d-0e1283e0e974","resolution":{"observed_at":"2026-05-27T07:38:45.960030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b04a9349-6f6b-4cd7-825b-1611204b8fda","year":1992},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:1a038e1e81e08a85ffc7a118ad5abbce6699c4a3ca01aa9663232e6a0ade3f11","observation_id":"7e30fb48-fe0d-47cd-bebf-db40642a79b3","resolution":{"observed_at":"2026-05-27T07:38:45.944285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ecd87546-30a1-4fa0-a2ab-58d8a0de7c9e","year":1992},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:4f7701aa9c175affc73dc27159c04a35650ba0e4d02ffc9d23463bfb918e8f10","observation_id":"04a87fdd-862a-4287-8b3a-7ab477385acf","resolution":{"observed_at":"2026-05-27T07:38:46.008200Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Catastrophic interference in connectionist networks: The sequential learning problem","venue":null,"work_id":"f60e1fe0-a13c-4a81-baa6-05baf3df269d","year":1989},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:b7f641619292dbfb257082385e6f3df9d71dad8d57c5c5d879f507d3dc0a5af5","observation_id":"3ce6a942-9b23-43a3-80ba-cb837e8c579e","resolution":{"observed_at":"2026-05-27T07:38:46.043863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"36257679-2e82-4eb5-8cd2-27b04419d54f","year":1989},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:bc5f52d48d23c5803fb24163dd51c487749b92fbf5d8dd8e50707a66ad6f4838","observation_id":"6685dd05-2196-46b8-8fb0-0ef46ce336fa","resolution":{"observed_at":"2026-05-27T07:38:46.024847Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adaptive weight decay for deep neural networks","venue":null,"work_id":"a89412a8-461b-476a-af6f-44f6d24a4768","year":2019},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:41d434fad6f1378df6d96de644fd5947eade5d143999b78a4ec7a91fc37d3e4b","observation_id":"6ea43c46-8388-460e-a4d6-af1faf6e6674","resolution":{"observed_at":"2026-05-27T07:38:45.985625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The primacy bias in deep reinforcement learning","venue":null,"work_id":"cb173ee6-fda4-427b-a9ec-000ed1fb96e3","year":2022},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:53eca36eaaeb501c51e1dad8c97516d0c9a44db5cae679cfc42034b8fdd9030c","observation_id":"746fabe3-8f43-4d77-96b8-491b8e659f9b","resolution":{"observed_at":"2026-05-27T07:38:46.078678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Torr, and Puneet K","venue":null,"work_id":"e897025e-cf94-4f0e-9e3f-5c4767f63748","year":2020},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:fa081bd87dfb05e4f49794f8faf7afa7bbe63b0272af150470e30f07cbf93caa","observation_id":"10e1fb37-2932-4e7a-9140-0ecb1014d657","resolution":{"observed_at":"2026-05-27T07:38:45.998485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Connectionist models of recognition memory: constraints imposed by learning and forgetting functions","venue":null,"work_id":"1370cd1e-6d88-4f70-9a89-af1631b3b616","year":1990},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:db4fd6f4e5ab1410717edb02cfbb6162b8a36a5cc7d2e5053b560be26c518a8e","observation_id":"be932b4c-31fc-461f-a063-9d4ab4ed676d","resolution":{"observed_at":"2026-05-27T07:38:46.011808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c4bc6035-f181-4378-b963-648747e010fa","year":1987},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:400d51ab8016ab3a2b8e8732bb1f03c0cd6cf907415cf62f8d3a46673d40ffa3","observation_id":"59c76427-7a86-4ee0-a55c-d250f692eb71","resolution":{"observed_at":"2026-05-27T07:38:46.027897Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"u r Informatik, Technische Universit\\","venue":null,"work_id":"a0a9a27f-0392-4e88-8e40-b960595cf81f","year":1987},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:a4940b1fa105adcc7fa0b4df7c39ec8b362ebb2b3b0f7b5c0915ac78957f1d8a","observation_id":"d3c7c95a-4035-480d-ba8a-6a8b0cdd93de","resolution":{"observed_at":"2026-05-27T07:38:45.929771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Schmidhuber","venue":null,"work_id":"e7fdbf19-d477-402a-8c81-b3b3122d08ec","year":1992},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:d64e7b73de52d3d42f7c23c4c305e414fc4d66083ea0b277177ff3459967d505","observation_id":"3173e0e1-742b-477b-a3e1-aacd02e3c056","resolution":{"observed_at":"2026-05-27T07:38:46.071066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Schmidhuber","venue":null,"work_id":"1fdb8e56-48c8-4e8b-ab19-1b31e8f3e288","year":1993},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:dff4bed68f0861090dd5cb4d65a4af33d4badb7abd0ba3ec2048fbc269d6e97c","observation_id":"b3b587b6-c51f-40e1-b384-95be67e87dfb","resolution":{"observed_at":"2026-05-27T07:38:45.995268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shifting inductive bias with success-story algorithm, adaptive levin search, and incremental self-improvement","venue":null,"work_id":"a8988be1-333c-4a13-abd9-5d5f83c458b2","year":1997},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:fc93e73d8cbfb811f43a4312aa39636146b02f38b30e509cb5d0f954a26aaf8d","observation_id":"53f9cfba-c804-418b-8e60-11c55a67f0af","resolution":{"observed_at":"2026-05-27T07:38:46.005189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Local gain adaptation in stochastic gradient descent","venue":null,"work_id":"6205d38a-827a-4894-b933-4572591eb43e","year":1999},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:7e30755a80118b17b1d84b6f15efe6264767b70d1550148a5d9152d55292da52","observation_id":"e83f2054-8fa2-458a-a072-366e6a97f3c6","resolution":{"observed_at":"2026-05-27T07:38:46.062823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Metaoptimize: A framework for optimizing step sizes and other meta-parameters","venue":null,"work_id":"2ef9c9d6-35c8-4feb-bdc0-3cec928aa244","year":2025},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:d1ebfb90568275c50c80eff3dd037788bcfa5a87b180072986f5e5c61c84389a","observation_id":"ff47d8e7-cf68-449c-abfd-94b89af88a74","resolution":{"observed_at":"2026-05-27T07:38:45.964131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adapting bias by gradient descent: An incremental version of delta-bar-delta","venue":null,"work_id":"d46fb38d-8877-4938-95d4-fd8609da7792","year":1992},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:843b4628b220e597cde7cdfe4a9da3c50022d84dd493e1858a44ed30241b3aca","observation_id":"b6f407e5-8937-4c7c-8e6a-75d9dba93f63","resolution":{"observed_at":"2026-05-27T07:38:46.039557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.04849","last_updated":"2018-09-13T10:55:56Z","snapshot_observed_at":"2026-07-06T06:33:15.714029Z","submitted_at":"2018-04-13T09:18:17Z","title":"The unreasonable effectiveness of the forget gate","version":3},"cited_work":{"arxiv_id":"1804.04849","doi":null,"metadata_source":"pith","pith_arxiv_id":"1804.04849","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The unreasonable effectiveness of the forget gate","venue":"cs.NE","work_id":"c602c7b5-d501-4f21-a073-f5fab7892bd2","year":2018},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"cited_paper":"/paper/1804.04849","citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:4f79601d4988e968be702bdb42db1a38c83d9e62ad0be6844366252c849ab6c6","observation_id":"89d4c289-f9ed-4fa0-8fee-3d8a3dd30ea1","resolution":{"observed_at":"2026-05-12T09:31:26.851204Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8a2842d1-1885-4b21-8869-91712afed850","year":1960},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:669245851aea25c0ad2150d5230190c2b40e3ba395a579a8c55ae6f21495350d","observation_id":"80da3e50-f688-44fe-901f-cb6950ba8aca","resolution":{"observed_at":"2026-05-27T07:38:45.933343Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A learning algorithm for continually running fully recurrent neural networks","venue":null,"work_id":"983e7357-3e2c-417f-b6c5-73ea4dfa4e0c","year":1989},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:6618ee9d952311266718a48c968e5cd2ca4e3841156840efc50a67c5dc0fb517","observation_id":"b128c752-9d28-41f1-8dea-af46ab263a74","resolution":{"observed_at":"2026-05-27T07:38:45.948083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On the overlooked pitfalls of weight decay and how to mitigate them: A gradient-norm perspective","venue":null,"work_id":"7efc0e40-6b9b-43a0-84cd-525477c3241f","year":2023},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:686d0d2f8b1672cd19448936d5d942c3bc3646399bd02107f8f035d4cdf7072a","observation_id":"35fed7bd-8afc-4047-947a-8f0e7d30e8f7","resolution":{"observed_at":"2026-05-27T07:38:45.952596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Meta-gradient reinforcement learning","venue":null,"work_id":"8ff79494-57c9-467b-a329-6f18a3a14cd1","year":2018},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:2bf8f5a62802b499e0848d2bc99b33989f862302589c4cc7862bc8fa21abc2a4","observation_id":"a77acb58-f246-43d9-aff9-7b07582c61b5","resolution":{"observed_at":"2026-05-27T07:38:46.054959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06464","last_updated":"2025-03-06T06:57:34Z","snapshot_observed_at":"2026-08-03T00:27:18.402796Z","submitted_at":"2024-12-09T13:09:04Z","title":"Gated Delta Networks: Improving Mamba2 with Delta Rule","version":3},"cited_work":{"arxiv_id":"2412.06464","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.06464","snapshot_observed_at":"2026-07-10T21:57:39.161066Z","title":"Gated Delta Networks: Improving Mamba2 with Delta Rule","venue":"cs.CL","work_id":"884939d3-e283-4625-bff4-b7e0e4cc2a6e","year":2024},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"cited_paper":"/paper/2412.06464","citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:1253075e08fceff5123c4907749015ce47b999ee3765137c132821071f9c2207","observation_id":"095cca8c-bc63-4b60-8910-4fc5610cb8d6","resolution":{"observed_at":"2026-05-13T14:50:25.025022Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A self-tuning actor-critic algorithm","venue":null,"work_id":"a41e829f-d606-49f8-b349-935a94ada79e","year":2020},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:8aa73700789f8eb0404abd2da923dd5b5a5a8c2ac45a1a29bbc9f22265498dd8","observation_id":"58ef0765-814c-47b3-b547-bc5d89a447d0","resolution":{"observed_at":"2026-05-27T07:38:45.937151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T00:05:48.311803Z","title":"write newline","venue":null,"work_id":"8e5fda61-e601-4df4-8204-015bee341570","year":null},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:24442ecc8a9560988d4978221122853bca0074c8583bf1ee5f1ddf2971ec9ac9","observation_id":"ea5eff56-8696-4c3f-afd3-7f17a5bfc3d3","resolution":{"observed_at":"2026-05-27T07:38:46.059305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T23:55:44.012295Z","title":"@esa (Ref","venue":null,"work_id":"b058608d-98d0-4821-a4ae-403d2b7cd411","year":null},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:ce044dfaa411a2f15fb944b75a3ab6e4c15ab3be27dfff483a6e4ae0db4ba464","observation_id":"db2949f6-50c2-484f-934a-2e4e28d2d612","resolution":{"observed_at":"2026-05-27T07:38:45.918992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T00:05:48.337191Z","title":null,"venue":null,"work_id":"ea79bfb8-d434-45e9-8607-416d3839ec5c","year":null},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:8625a172afdcaae626dd0d8ad018a1b492aaa4395d47f4368fe71d384b190618","observation_id":"ff52c3fe-3fee-4d55-9e56-105007c25012","resolution":{"observed_at":"2026-05-27T07:38:45.940938Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d051d6aa-efca-49eb-a66d-8ea01bf21294","year":null},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:97d0087bd393e208d75aa23b5c99850c39a04b79bd9e168aa293780e84db83a5","observation_id":"b6444c0c-b85a-4a6c-933a-59ca0cdd1fb4","resolution":{"observed_at":"2026-05-27T07:38:45.968412Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":8,"verified_exact":5,"verified_fuzzy":41},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 1 inbound Pith citation observation for arXiv:2604.27063."}