{"as_of":"2026-08-18T19:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8bd427118d6c5b2c59062515ebccd66dcd4baf9d8ebd0792c29014c62df962f0","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T05:23:19.751654Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T10:10:09.804381Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-14T10:10:10.035485Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"cited_work":{"arxiv_id":"1909.01440","doi":null,"metadata_source":"pith","pith_arxiv_id":"1909.01440","snapshot_observed_at":"2026-08-14T10:10:10.035485Z","title":"LCA: Loss Change Allocation for Neural Network Training","venue":"cs.LG","work_id":"fc93e3c0-9450-4e68-8212-6394ef6d2225","year":2019},"citing_paper":{"arxiv_id":"1908.11843","last_updated":"2020-01-05T21:15:43Z","snapshot_observed_at":"2026-08-17T23:05:52.024991Z","submitted_at":"2019-08-30T17:12:56Z","title":"Partitioned integrators for thermodynamic parameterization of neural networks","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T10:10:09.804381Z"},"links":{"cited_paper":"/paper/1909.01440","citing_paper":"/paper/1908.11843"},"observation_digest":"sha256:f6153fd4a1682e552a134fa752371c1671197cdaefb7fda6a91b465e721d5207","observation_id":"a6f5d4d0-6046-4dd4-bf8f-ac58c800683c","resolution":{"observed_at":"2026-08-14T10:10:10.041065Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1909.01440/citation-record","integrity":"/paper/1909.01440/integrity","json":"/paper/1909.01440/citation-record.json","paper":"/paper/1909.01440"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1711.08856","last_updated":"2019-02-25T11:08:56Z","snapshot_observed_at":"2026-08-17T03:04:27.775014Z","submitted_at":"2017-11-24T01:58:54Z","title":"Critical Learning Periods in Deep Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.08856","snapshot_observed_at":"2026-08-14T05:23:19.575147Z","title":"Critical learning periods in deep neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.575147Z"},"links":{"cited_paper":"/paper/1711.08856","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:668c928dd8ad90c6592c9ce33f4539d768826e7c89b3f07b57ded286d3c63c79","observation_id":"1278211e-ddab-4091-ae2c-3d7bf050033e","resolution":{"observed_at":"2026-08-14T05:23:19.575147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.365354Z","title":"Alain and Y","venue":null,"work_id":"81456ea1-965d-40bb-b94b-3790399a4271","year":2016},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.581413Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:9718930b26fa543a2ec066f163bd6f796b338fe15eb0319cb0dcb01e3d78510f","observation_id":"9eaeb2a4-4f61-47c8-b15b-3ea10fbbbc7e","resolution":{"observed_at":"2026-08-14T05:23:20.370337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.348799Z","title":"Optimization methods for large-scale machine learning","venue":null,"work_id":"75dc6dbd-ac5e-4bfb-a869-45179be90dbb","year":2018},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.586545Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:03f1638838b1bd55f41ef124386da8ac721e316869e78bcb03dc40b83923a702","observation_id":"3c24fb10-5a75-4d85-9a68-a5171f2ab56c","resolution":{"observed_at":"2026-08-14T05:23:20.353963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.331447Z","title":"The loss surfaces of multilayer networks","venue":null,"work_id":"247aabe0-12d9-4f16-b2c0-1558cbe39a73","year":2015},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.591951Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:0c7d4745272761585c17d227d5a9d6dbeea38e6481e152a712e651805903822a","observation_id":"9a02fdb2-dc21-4539-b3bf-72f5d1ba27ed","resolution":{"observed_at":"2026-08-14T05:23:20.336894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.314415Z","title":"Identifying and attacking the saddle point problem in high-dimensional non- convex optimization","venue":null,"work_id":"64f952ef-7666-4d59-bc75-bc10256fb214","year":2014},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.597175Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:760ba8fb1541b7d51f9945cc159019100d315711f0e3e1c084a3a55d17d5fd9f","observation_id":"f97b57b8-42f5-4f09-9416-2b7fe76e1a63","resolution":{"observed_at":"2026-08-14T05:23:20.319487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.03635","last_updated":"2019-03-04T15:51:11Z","snapshot_observed_at":"2026-08-14T19:37:43.556604Z","submitted_at":"2018-03-09T18:51:28Z","title":"The Lottery Ticket Hypothesis: Finding Sparse, Trainable Neural Networks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.03635","snapshot_observed_at":"2026-08-14T05:23:19.602104Z","title":"The lottery ticket hypothesis: Finding sparse, trainable neural networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.602104Z"},"links":{"cited_paper":"/paper/1803.03635","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:7ba3978687c8d391fa46cfcaf5e69809ee93059755eeda6c7efcd7c32f9f0889","observation_id":"925baf4f-c62f-4823-9a93-f90910108b47","resolution":{"observed_at":"2026-08-14T05:23:19.602104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6544","last_updated":"2015-05-21T21:44:31Z","snapshot_observed_at":"2026-08-16T10:18:43.512175Z","submitted_at":"2014-12-19T21:55:01Z","title":"Qualitatively characterizing neural network optimization problems","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6544","snapshot_observed_at":"2026-08-14T05:23:19.607676Z","title":"Qualitatively characterizing neural network optimization problems","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.607676Z"},"links":{"cited_paper":"/paper/1412.6544","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:628d80354286fe28ffbddfba7b7eb15daace2a0aab8584ab708150f31a96bd0b","observation_id":"b621a332-9368-4663-8228-9af28b056197","resolution":{"observed_at":"2026-08-14T05:23:19.607676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.296973Z","title":"A closer look at deep learning heuristics: Learning rate restarts, warmup and distillation","venue":null,"work_id":"01363e3c-c1f7-43db-940d-0ca28663e6d0","year":2019},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.612843Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:c4296fa47b515acf6a78653dc7be585edc4c9e8d23d1363d760740facf09674c","observation_id":"9ec53c71-e679-44ec-8e6e-6e9fb453721c","resolution":{"observed_at":"2026-08-14T05:23:20.303586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1512.03385","last_updated":"2015-12-10T19:51:55Z","snapshot_observed_at":"2026-07-06T04:39:28.429064Z","submitted_at":"2015-12-10T19:51:55Z","title":"Deep Residual Learning for Image Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1512.03385","snapshot_observed_at":"2026-08-14T05:23:19.617428Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.617428Z"},"links":{"cited_paper":"/paper/1512.03385","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:735104f8ba5eb04db1c76708346055ff68c7b22d68ab883aa075db2291e7a0ab","observation_id":"9ae736c1-1d52-42be-9428-1a83acb4002f","resolution":{"observed_at":"2026-08-14T05:23:19.617428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:19.622568Z","title":"Delving deep into rectiﬁers: Surpassing human-level performance on imagenet classiﬁcation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.622568Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:80c27d4a07433b0b285bf616573d72ff01aca43c6355abb87a70beebb703cf8f","observation_id":"21390072-047f-4bfb-b15f-6b651367063d","resolution":{"observed_at":"2026-08-14T05:23:19.622568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1207.0580","last_updated":"2012-07-03T06:35:15Z","snapshot_observed_at":"2026-08-15T00:54:35.320150Z","submitted_at":"2012-07-03T06:35:15Z","title":"Improving neural networks by preventing co-adaptation of feature detectors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1207.0580","snapshot_observed_at":"2026-08-14T05:23:19.627225Z","title":"Improving neural networks by preventing co-adaptation of feature detectors","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.627225Z"},"links":{"cited_paper":"/paper/1207.0580","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:693190df81b689983b6ff9b76dcae4865c7c50d95ee0cc32e931eb659807078b","observation_id":"9a40c5cd-1c44-4f4a-8ad0-a6382ad9ade9","resolution":{"observed_at":"2026-08-14T05:23:19.627225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.04540","last_updated":"2018-03-20T08:56:25Z","snapshot_observed_at":"2026-08-18T13:59:49.143654Z","submitted_at":"2018-01-14T12:00:43Z","title":"Fix your classifier: the marginal value of training the last weight layer","version":2},"cited_work":{"arxiv_id":"1801.04540","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.04540","snapshot_observed_at":"2026-08-14T05:23:19.975206Z","title":"Fix your classifier: the marginal value of training the last weight layer","venue":"cs.LG","work_id":"2652f78d-3692-49a8-b3c5-5b8e5c864466","year":2018},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.633195Z"},"links":{"cited_paper":"/paper/1801.04540","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:72c1bff3ae7defaf19c6530e749894ba6deb44f01294ab9af8bba4577de7cf0b","observation_id":"26b1cae8-1a20-4998-b194-fbb3e140c4d5","resolution":{"observed_at":"2026-08-14T05:23:19.982832Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1502.03167","last_updated":"2015-03-02T20:44:12Z","snapshot_observed_at":"2026-08-12T21:01:12.961874Z","submitted_at":"2015-02-11T01:44:18Z","title":"Batch Normalization: Accelerating Deep Network Training by Reducing Internal Covariate Shift","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1502.03167","snapshot_observed_at":"2026-08-14T05:23:19.639254Z","title":"Batch normalization: Accelerating deep network training by reducing internal covariate shift","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.639254Z"},"links":{"cited_paper":"/paper/1502.03167","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:d11d73777e96ddd3a38e3ae1b9a68bafbbc39e93cf55a4396042895f2dbed466","observation_id":"fdf194b1-1b2b-4736-bd24-987f79de429a","resolution":{"observed_at":"2026-08-14T05:23:19.639254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.05031","last_updated":"2019-12-23T12:50:22Z","snapshot_observed_at":"2026-08-14T18:52:20.944777Z","submitted_at":"2018-07-13T12:17:41Z","title":"On the Relation Between the Sharpest Directions of DNN Loss and the SGD Step Length","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.05031","snapshot_observed_at":"2026-08-14T05:23:19.643754Z","title":"On the Relation Between the Sharpest Directions of DNN Loss and the SGD Step Length","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.643754Z"},"links":{"cited_paper":"/paper/1807.05031","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:7d39a6eb0c716e9158e90286cbd0393559d454d73144d518798742abe11bb2b3","observation_id":"36797494-6ff9-4d58-837a-c079faaa5f92","resolution":{"observed_at":"2026-08-14T05:23:19.643754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.04836","last_updated":"2017-02-09T20:38:16Z","snapshot_observed_at":"2026-08-15T20:45:29.277746Z","submitted_at":"2016-09-15T20:03:06Z","title":"On Large-Batch Training for Deep Learning: Generalization Gap and Sharp Minima","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.04836","snapshot_observed_at":"2026-08-14T05:23:19.648942Z","title":"On large-batch training for deep learning: Generalization gap and sharp minima","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.648942Z"},"links":{"cited_paper":"/paper/1609.04836","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:2ab16b8818e90a0018ed8667060cd7ed03e899a61aa07cf7a59ad9b51b10c751","observation_id":"9e4aa06e-134f-4bce-aaac-0851722461a8","resolution":{"observed_at":"2026-08-14T05:23:19.648942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:19.654169Z","title":"Rusu, Kieran Milan, John Quan, Tiago Ramalho, Agnieszka Grabska-Barwinska, Demis Hassabis, Claudia Clopath, Dharshan Kumaran, and Raia Hadsell","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.654169Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:61ec7fb3d78cd6587bee25a823b70b6be904fbf341ae1ed2eeb1baaa58a6bb2c","observation_id":"fdad05f1-61f5-49f6-b02d-14877c8fc8f1","resolution":{"observed_at":"2026-08-14T05:23:19.654169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.269487Z","title":"Beitrag zur näherungweisen integration totaler differentialgleichungen","venue":null,"work_id":"7fad79c5-74fa-429a-a0ba-ba13d69408b7","year":1901},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.658983Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:ca0578ff3b6bd6839fbf1bf42b78acf38bee63915b4a40139edae85e21bf270d","observation_id":"cb2d9ab3-525e-49f9-8121-3311a0762785","resolution":{"observed_at":"2026-08-14T05:23:20.274993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:19.663521Z","title":"Gradient-based learning applied to document recognition","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.663521Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:237322d5f1d2c0a7a8e1ee262ae251105316092245627bf0ac50c34b2d694d64","observation_id":"a5c367a6-9fd6-4568-a354-2660f5a0ff75","resolution":{"observed_at":"2026-08-14T05:23:19.663521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.242160Z","title":"Measuring the Intrinsic Dimension of Objective Landscapes","venue":null,"work_id":"2ec61ef6-be9d-4563-84c1-858d8b6ab55f","year":2018},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.668158Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:b99edb792da051d657f2a7d21d1bf9628349231fd5f963b990f6c3e761e18e13","observation_id":"16221b14-f67b-41e7-b3b7-69e7022306a9","resolution":{"observed_at":"2026-08-14T05:23:20.246918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.225748Z","title":"Visualizing the loss landscape of neural nets","venue":null,"work_id":"7b06981e-9c26-448d-8908-8560219d374c","year":2018},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.673437Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:b7fff4110c2f851600ba049e5843a6c45a16af7a0c228f4400c1bf60a3263fac","observation_id":"98e3768b-3bc2-4956-9929-ffe98b8b6906","resolution":{"observed_at":"2026-08-14T05:23:20.230870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.207002Z","title":"The loss surface of deep and wide neural networks","venue":null,"work_id":"08d40465-47f8-4260-8c73-899a1e973c9c","year":2017},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.678145Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:a7323fbfd0482e95c4e3a74e4ad78cbcd69c1f889a7d218f8f088a2e44183c3b","observation_id":"561e7922-3bc0-49e3-b5e2-304c7827d9d6","resolution":{"observed_at":"2026-08-14T05:23:20.212767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.189579Z","title":"Raghu, J","venue":null,"work_id":"b1cc1011-f9ae-4741-a30a-5c1e93c6e17b","year":2017},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.683164Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:49a4de4edd48653d010edd838537b6da8a961e3bf2380f42312c3a8d628591b8","observation_id":"f0980e5d-f3ac-4391-9432-447a4b329d50","resolution":{"observed_at":"2026-08-14T05:23:20.195558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.172085Z","title":"Über die numerische auﬂösung von differentialgleichungen","venue":null,"work_id":"92317b89-1135-4a3a-8a16-01243b735fca","year":null},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.688003Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:af13f2370af184028f5e084c03800db2e8bb94d0b62ee79324f63b20dc348d84","observation_id":"5b40fb9c-34f3-4fb8-853b-1e9d7349c366","resolution":{"observed_at":"2026-08-14T05:23:20.177571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.153562Z","title":"On the quality of the initial basin in overspeciﬁed neural networks","venue":null,"work_id":"8e0cbfea-d18f-4bf3-83b0-62d152dc2a9d","year":2016},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.692652Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:10fa03ce0b906b6f2c3ecf9199484257ac4e3ff25aaefff0f44027f9fdb56e54","observation_id":"390fd79c-859f-4bee-a385-f1e3fcbfc383","resolution":{"observed_at":"2026-08-14T05:23:20.158951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.00810","last_updated":"2017-04-29T17:32:47Z","snapshot_observed_at":"2026-08-14T21:13:52.487817Z","submitted_at":"2017-03-02T14:53:14Z","title":"Opening the Black Box of Deep Neural Networks via Information","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.00810","snapshot_observed_at":"2026-08-14T05:23:19.697460Z","title":"Opening the black box of deep neural networks via information","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.697460Z"},"links":{"cited_paper":"/paper/1703.00810","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:968592cd0c40aa1b72104b3ea26edeab86051ca404f78d01d3751e5f49fcb50a","observation_id":"f1dcfb32-9651-49c3-9197-597e91c4d949","resolution":{"observed_at":"2026-08-14T05:23:19.697460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-08-17T19:17:06.411141Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-14T05:23:19.702628Z","title":"Very deep convolutional networks for large-scale image recognition","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.702628Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:d1b18bf81ab9104b9198f8ba54abd106c4a984b4a0c67daacc26b47b7faad102","observation_id":"5a924dc4-7a14-4e20-8af9-fcc461144ea0","resolution":{"observed_at":"2026-08-14T05:23:19.702628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6034","last_updated":"2014-04-19T11:54:52Z","snapshot_observed_at":"2026-08-17T14:45:30.096775Z","submitted_at":"2013-12-20T16:45:54Z","title":"Deep Inside Convolutional Networks: Visualising Image Classification Models and Saliency Maps","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6034","snapshot_observed_at":"2026-08-14T05:23:19.707362Z","title":"Deep inside convolutional networks: Visualising image classiﬁcation models and saliency maps","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.707362Z"},"links":{"cited_paper":"/paper/1312.6034","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:b3d7669ca037ee36bcc2560949285d6a00c7c3918c20ca437357ecc43f6415d5","observation_id":"18337fff-039f-4213-9008-e29644c9934e","resolution":{"observed_at":"2026-08-14T05:23:19.707362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1605.08361","last_updated":"2016-05-30T04:33:39Z","snapshot_observed_at":"2026-08-14T21:55:33.885071Z","submitted_at":"2016-05-26T16:51:05Z","title":"No bad local minima: Data independent training error guarantees for multilayer neural networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1605.08361","snapshot_observed_at":"2026-08-14T05:23:19.713359Z","title":"No bad local minima: Data independent training error guarantees for multilayer neural networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.713359Z"},"links":{"cited_paper":"/paper/1605.08361","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:d013b004be2f3f2bd11d943a9299d3f5ec71c1ca791492cb07f23586653e7efa","observation_id":"6f9bf117-3aa3-4ede-82e0-a23455d66736","resolution":{"observed_at":"2026-08-14T05:23:19.713359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6806","last_updated":"2015-04-13T07:58:17Z","snapshot_observed_at":"2026-08-18T17:02:01.677257Z","submitted_at":"2014-12-21T16:16:37Z","title":"Striving for Simplicity: The All Convolutional Net","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6806","snapshot_observed_at":"2026-08-14T05:23:19.718425Z","title":"Riedmiller","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.718425Z"},"links":{"cited_paper":"/paper/1412.6806","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:756827c57e6c2d893dec122b0c52d3173026b3ce3afc196bca8280bf0e6c593f","observation_id":"ea030a86-f11e-4fcf-9898-eabe6d4c87ca","resolution":{"observed_at":"2026-08-14T05:23:19.718425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.136978Z","title":"On the importance of initialization and momentum in deep learning","venue":null,"work_id":"64f4e4f8-a31c-44a6-9ebe-e9fe480a28c8","year":2013},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.723260Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:16e953894684d5440f68dbf1d9e59ab4cc758f7fbb9837d1de340d372e4a994a","observation_id":"97b7e272-7b30-477d-a634-f02bec09fc38","resolution":{"observed_at":"2026-08-14T05:23:20.142295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.118653Z","title":"Simpson’s rule","venue":null,"work_id":"6c700398-2d38-4fdf-a6a9-ce23bc14c5d1","year":2003},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.727944Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:bd4672bba0ac6970cf1712cf32f059e29d7b228acf3459315133e92689fc5fd2","observation_id":"0cafcc36-e7c0-4a7f-aba1-01e0662fc196","resolution":{"observed_at":"2026-08-14T05:23:20.124207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.100739Z","title":"A walk with sgd","venue":null,"work_id":"be51dfc5-f27d-4966-9946-cec4e423c098","year":2018},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.732566Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:f0ab2a3635cf8f75b2b6293587de28aa37ddd73de1ea5b2adbd4dd9d002a6697","observation_id":"79642e13-dda4-4558-8a77-355700df41aa","resolution":{"observed_at":"2026-08-14T05:23:20.106421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.084001Z","title":"Yosinski, J","venue":null,"work_id":"ec6c981b-12fa-421c-9093-f3e55a77bb8a","year":2015},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.737344Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:abe59385d81b4e77e74cd7a58c81dc464605f028d073f52be51a2644b9d13f72","observation_id":"307786b3-8e0a-43a9-a579-6a58b20c30da","resolution":{"observed_at":"2026-08-14T05:23:20.089308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.04200","last_updated":"2017-06-12T19:57:42Z","snapshot_observed_at":"2026-08-14T21:12:14.237470Z","submitted_at":"2017-03-13T00:02:48Z","title":"Continual Learning Through Synaptic Intelligence","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.04200","snapshot_observed_at":"2026-08-14T05:23:19.741886Z","title":"Improved multitask learning through synaptic intelligence","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.741886Z"},"links":{"cited_paper":"/paper/1703.04200","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:4c3dfb116bb7eef856fa91ffe56163af9cec8e7d0c19f7cbd383773aeb238cfd","observation_id":"3c229f5e-fb3e-4449-a5f8-b4d74fed3e8d","resolution":{"observed_at":"2026-08-14T05:23:19.741886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.01996","last_updated":"2022-03-08T21:16:04Z","snapshot_observed_at":"2026-08-15T10:37:49.016375Z","submitted_at":"2019-02-06T01:29:01Z","title":"Are All Layers Created Equal?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.01996","snapshot_observed_at":"2026-08-14T05:23:19.746568Z","title":"Are all layers created equal? arXiv preprint arXiv:1902.01996, 2019","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.746568Z"},"links":{"cited_paper":"/paper/1902.01996","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:c9c50c31c0e23e771f945b15d836a922884919b0f388be3182a60071fb14a1e9","observation_id":"c0c89bd2-f78f-418a-9db1-9bac5f8939c4","resolution":{"observed_at":"2026-08-14T05:23:19.746568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.01067","last_updated":"2020-03-03T05:40:51Z","snapshot_observed_at":"2026-08-17T01:19:13.238797Z","submitted_at":"2019-05-03T08:21:07Z","title":"Deconstructing Lottery Tickets: Zeros, Signs, and the Supermask","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.01067","snapshot_observed_at":"2026-08-14T05:23:19.751654Z","title":"Total error","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.751654Z"},"links":{"cited_paper":"/paper/1905.01067","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:fbf4b4b0fe91f50d1e5f33ebf15d239c0cddd8a4728b6c02c730fa20b49b7fa3","observation_id":"5c223eb3-c64b-4c70-94c8-86ab54a98166","resolution":{"observed_at":"2026-08-14T05:23:19.751654Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T22:43:39.033164Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":1,"verified_fuzzy":16},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 1 inbound Pith citation observation for arXiv:1909.01440."}