{"as_of":"2026-08-10T01:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0fc6cce5a01637f5398d257e4fc82e0bcb375ce1324f638dae0d6e4817489b77","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":29,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T11:04:17.026840Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":20,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":"2011.14522","doi":"10.48550/arxiv.2011.14522","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Hu, E","venue":"arXiv (Cornell University)","work_id":"421a60be-6eaa-4316-95cf-702cbf17f055","year":2011},"citing_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-09T05:01:39.906340Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2106.09685"},"observation_digest":"sha256:5d956698e71fd8d4e3630f766009bc966f3672f683669a10861b963579e91faf","observation_id":"0f21d264-4216-4667-9666-399343c4bdec","resolution":{"observed_at":"2026-05-09T05:01:40.837419Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":"2011.14522","doi":"10.48550/arxiv.2011.14522","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Hu, E","venue":"arXiv (Cornell University)","work_id":"421a60be-6eaa-4316-95cf-702cbf17f055","year":2011},"citing_paper":{"arxiv_id":"2303.10512","last_updated":"2023-12-20T20:56:14Z","snapshot_observed_at":"2026-07-06T15:05:16.471478Z","submitted_at":"2023-03-18T22:36:25Z","title":"AdaLoRA: Adaptive Budget Allocation for Parameter-Efficient Fine-Tuning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T21:11:32.186676Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2303.10512"},"observation_digest":"sha256:1477c6566dc02cc5b6314b53b98107807001e26e8d6c264d3cdec291b80a4df3","observation_id":"e3e65457-ffa8-4e24-b5b1-630e2e902cdd","resolution":{"observed_at":"2026-05-12T21:11:32.316909Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":"2011.14522","doi":"10.48550/arxiv.2011.14522","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Hu, E","venue":"arXiv (Cornell University)","work_id":"421a60be-6eaa-4316-95cf-702cbf17f055","year":2011},"citing_paper":{"arxiv_id":"2403.09611","last_updated":"2024-04-18T18:51:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-14T17:51:32Z","title":"MM1: Methods, Analysis & Insights from Multimodal LLM Pre-training","version":4},"reference_index":120,"source":"pdf_text","source_observed_at":"2026-05-16T04:09:36.019146Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2403.09611"},"observation_digest":"sha256:6fc5ea26afb30a6ec6e72ff3527ab2abc27fe22fbf63e5f6e00c47bba3bc4202","observation_id":"752923aa-fb38-4b86-ac90-288471cff738","resolution":{"observed_at":"2026-05-16T04:09:36.337325Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-09T11:04:17.026840Z","title":"and Hu, E","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2502.02820","last_updated":"2025-02-05T01:42:44Z","snapshot_observed_at":"2026-08-09T10:56:59.360527Z","submitted_at":"2025-02-05T01:42:44Z","title":"Slowing Learning by Erasing Simple Features","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T11:04:17.026840Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2502.02820"},"observation_digest":"sha256:bb495e36144570dc09a12576c6a823e626db143881fbca3433291d5bc9434886","observation_id":"ad2774a7-8bae-49d1-b51c-def0e9726cad","resolution":{"observed_at":"2026-08-09T11:04:17.026840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-09T05:36:55.544985Z","title":"2 Yang, G","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.03210","last_updated":"2025-05-28T12:21:28Z","snapshot_observed_at":"2026-08-09T11:52:49.208935Z","submitted_at":"2025-02-05T14:26:50Z","title":"From Kernels to Features: A Multi-Scale Adaptive Theory of Feature Learning","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T05:36:55.544985Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2502.03210"},"observation_digest":"sha256:411279e93fecf7580459ab2077e5416a3c8c5f98f323e2d116c3d4cbe0dfbb9d","observation_id":"98c70e28-7945-4490-9de6-5bd6ecabd2fc","resolution":{"observed_at":"2026-08-09T05:36:55.544985Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-08T19:58:27.079130Z","title":"Feature learning in infinite-width neural networks","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2502.05300","last_updated":"2025-05-23T17:22:54Z","snapshot_observed_at":"2026-08-09T04:49:29.861223Z","submitted_at":"2025-02-07T20:10:05Z","title":"Parameter Symmetry Potentially Unifies Deep Learning Theory","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-08T19:58:27.079130Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2502.05300"},"observation_digest":"sha256:a828303f8d41f606830d60419dbc96ed349375404569622484b336f48f4d2939","observation_id":"c537dd00-9eef-43a2-9640-cbb631fcc321","resolution":{"observed_at":"2026-08-08T19:58:27.079130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-08T11:19:07.040114Z","title":"and Hu, E","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07998","last_updated":"2025-09-10T18:21:17Z","snapshot_observed_at":"2026-08-08T11:09:21.022136Z","submitted_at":"2025-02-11T22:34:49Z","title":"Adaptive kernel predictors from feature-learning infinite limits of neural networks","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-08T11:19:07.040114Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2502.07998"},"observation_digest":"sha256:141a97727d496eeeca443a8d608a2d93535937a932d630264a14c298be72f4ca","observation_id":"ee08f366-21d2-4bfd-8f63-176e95ca622a","resolution":{"observed_at":"2026-08-08T11:19:07.040114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-07T14:57:49.676387Z","title":"Feature learning in infinite-width neural networks","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-07T14:50:14.651913Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:49.676387Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:97d9dd25276e0e10bca37f19177f7fd4d99effc8ef15ae7c2e6864be56e48345","observation_id":"79660be6-9425-4236-a8a7-163a9799a9e6","resolution":{"observed_at":"2026-08-07T14:57:49.676387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":"2011.14522","doi":"10.48550/arxiv.2011.14522","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Hu, E","venue":"arXiv (Cornell University)","work_id":"421a60be-6eaa-4316-95cf-702cbf17f055","year":2011},"citing_paper":{"arxiv_id":"2505.24333","last_updated":"2026-02-09T14:17:44Z","snapshot_observed_at":"2026-08-09T18:45:01.721579Z","submitted_at":"2025-05-30T08:18:23Z","title":"Two failure modes of deep transformers and how to avoid them: a unified theory of signal propagation at initialisation","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-22T02:42:34.938163Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2505.24333"},"observation_digest":"sha256:bef6109a12e18f74cd342e6c5a2975569b3d26479d8e59b6b1244f27bda15928","observation_id":"976af127-1b7d-4c46-98e6-6734576879a0","resolution":{"observed_at":"2026-05-22T02:44:32.183256Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-06T22:50:13.117590Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2506.20629","last_updated":"2025-06-25T17:25:02Z","snapshot_observed_at":"2026-08-09T17:54:13.192409Z","submitted_at":"2025-06-25T17:25:02Z","title":"PLoP: Precise LoRA Placement for Efficient Finetuning of Large Models","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T22:50:13.117590Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2506.20629"},"observation_digest":"sha256:5cf720d77a1ad24542c8a614b4aadf867ce02a0dbf6c9e796288911ac5425f25","observation_id":"6b15f366-c0a1-41dd-8aa3-21ed137496a3","resolution":{"observed_at":"2026-08-06T22:50:13.117590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-06T19:40:36.588862Z","title":"and Hu, E","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05035","last_updated":"2025-07-07T14:17:44Z","snapshot_observed_at":"2026-08-09T04:49:35.176543Z","submitted_at":"2025-07-07T14:17:44Z","title":"Beyond Scaling Curves: Internal Dynamics of Neural Networks Through the NTK Lens","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T19:40:36.588862Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2507.05035"},"observation_digest":"sha256:8778929ca6a3eac6da53beacea9c139d6e7e969d4cdb22c5fa611d2047a53288","observation_id":"29a2dc6d-16a0-433d-8cfb-fe976bfff7b4","resolution":{"observed_at":"2026-08-06T19:40:36.588862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-06T18:34:03.450387Z","title":"Feature Learning in Infinite-width Neural Networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07955","last_updated":"2025-07-15T09:06:11Z","snapshot_observed_at":"2026-08-09T06:19:51.410938Z","submitted_at":"2025-07-10T17:39:37Z","title":"Dynamic Chunking for End-to-End Hierarchical Sequence Modeling","version":2},"reference_index":106,"source":"pdf_text","source_observed_at":"2026-08-06T18:34:03.450387Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2507.07955"},"observation_digest":"sha256:4c5fff0262469b0bd97d6c4cb8d8316834ba387f1be092d382938e35680184a8","observation_id":"62718d9b-3306-48d3-be93-8a122b690c3f","resolution":{"observed_at":"2026-08-06T18:34:03.450387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-06T15:28:17.579005Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.16039","last_updated":"2025-07-25T13:33:48Z","snapshot_observed_at":"2026-08-09T04:48:55.301465Z","submitted_at":"2025-07-21T20:13:02Z","title":"Reactivation: Empirical NTK Dynamics Under Task Shifts","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:28:17.579005Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2507.16039"},"observation_digest":"sha256:60f749cf524fe813784ac0a6bb69e38dcb0976991ba32677cda2ed73dcc4f951","observation_id":"43791dfc-dc6d-4a8f-be0c-ea5f67e4ff93","resolution":{"observed_at":"2026-08-06T15:28:17.579005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-06T11:44:05.204798Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.22448","last_updated":"2025-07-30T07:55:33Z","snapshot_observed_at":"2026-08-09T19:06:02.138099Z","submitted_at":"2025-07-30T07:55:33Z","title":"Falcon-H1: A Family of Hybrid-Head Language Models Redefining Efficiency and Performance","version":1},"reference_index":116,"source":"arxiv_source","source_observed_at":"2026-08-06T11:44:05.204798Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2507.22448"},"observation_digest":"sha256:87bf9f3db3003402e91aee95ef40e583bd5c0edaef755de0d0e1898167527ec9","observation_id":"f03e7df4-aa39-4b71-b76b-75119ee1ea17","resolution":{"observed_at":"2026-08-06T11:44:05.204798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":"2011.14522","doi":"10.48550/arxiv.2011.14522","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Hu, E","venue":"arXiv (Cornell University)","work_id":"421a60be-6eaa-4316-95cf-702cbf17f055","year":2011},"citing_paper":{"arxiv_id":"2604.21352","last_updated":"2026-05-06T15:19:47Z","snapshot_observed_at":"2026-08-02T08:46:23.869106Z","submitted_at":"2026-04-23T07:11:24Z","title":"CARE: Counselor-Aligned Response Engine for Online Mental-Health Support","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-09T22:32:10.343501Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2604.21352"},"observation_digest":"sha256:f50438095bef8494a33599fae8a378b715c5fadb92b45e97f64c0dcee71f4068","observation_id":"e1760b30-b271-4b9b-af13-18683d1eef5e","resolution":{"observed_at":"2026-05-09T22:34:06.839953Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":"2011.14522","doi":"10.48550/arxiv.2011.14522","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Hu, E","venue":"arXiv (Cornell University)","work_id":"421a60be-6eaa-4316-95cf-702cbf17f055","year":2011},"citing_paper":{"arxiv_id":"2605.11170","last_updated":"2026-06-02T13:57:02Z","snapshot_observed_at":"2026-08-02T02:13:17.912919Z","submitted_at":"2026-05-11T19:28:33Z","title":"Unlearning with Asymmetric Sources: Improved Unlearning-Utility Trade-off with Public Data","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-13T05:56:38.042978Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2605.11170"},"observation_digest":"sha256:7ebbf2826254c5e6354b1f3a8c4a23a159c79972e0d5c567d592b2ac1dc5322d","observation_id":"09d5792c-6b32-46aa-90b7-63856e784f3e","resolution":{"observed_at":"2026-05-13T05:57:21.833247Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":"2011.14522","doi":"10.48550/arxiv.2011.14522","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Hu, E","venue":"arXiv (Cornell University)","work_id":"421a60be-6eaa-4316-95cf-702cbf17f055","year":2011},"citing_paper":{"arxiv_id":"2605.11506","last_updated":"2026-05-12T04:25:49Z","snapshot_observed_at":"2026-08-05T07:02:19.050642Z","submitted_at":"2026-05-12T04:25:49Z","title":"Principled Design of Diffusion-based Optimizers for Inverse Problems","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-13T02:35:50.993680Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2605.11506"},"observation_digest":"sha256:3d81e6d35b4f2ca0fb159be170320e20436d0ba6bdecbb207d6fd27fa04b767c","observation_id":"8f2ceda4-1569-408a-babc-d2d7d3bc38b5","resolution":{"observed_at":"2026-05-13T02:37:07.817870Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":"2011.14522","doi":"10.48550/arxiv.2011.14522","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Hu, E","venue":"arXiv (Cornell University)","work_id":"421a60be-6eaa-4316-95cf-702cbf17f055","year":2011},"citing_paper":{"arxiv_id":"2605.12492","last_updated":"2026-05-12T17:59:34Z","snapshot_observed_at":"2026-07-31T18:31:37.222688Z","submitted_at":"2026-05-12T17:59:34Z","title":"Pion: A Spectrum-Preserving Optimizer via Orthogonal Equivalence Transformation","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-13T04:53:52.898843Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2605.12492"},"observation_digest":"sha256:49ffeb3ec8352304ad6d0e92d58e9ed92ce546aeb0324fcc4829fd24de0180ec","observation_id":"312a84f1-654a-4b2c-960f-2c5c4ede6c6f","resolution":{"observed_at":"2026-05-13T04:57:17.574285Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":"2011.14522","doi":"10.48550/arxiv.2011.14522","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Hu, E","venue":"arXiv (Cornell University)","work_id":"421a60be-6eaa-4316-95cf-702cbf17f055","year":2011},"citing_paper":{"arxiv_id":"2605.22297","last_updated":"2026-05-27T10:11:58Z","snapshot_observed_at":"2026-08-01T11:19:03.524897Z","submitted_at":"2026-05-21T10:46:23Z","title":"One LR Doesn't Fit All: Heavy-Tail Guided Layerwise Learning Rates for LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-22T07:44:16.677054Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2605.22297"},"observation_digest":"sha256:e9b42cdcb6ea8eb0ec935285391490ff9dabbd9184fb51f55d659c40dcd1cb36","observation_id":"8a1767d8-f0e4-4af1-9169-ca5667995c1c","resolution":{"observed_at":"2026-05-22T07:44:42.651935Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":"2011.14522","doi":"10.48550/arxiv.2011.14522","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Hu, E","venue":"arXiv (Cornell University)","work_id":"421a60be-6eaa-4316-95cf-702cbf17f055","year":2011},"citing_paper":{"arxiv_id":"2605.22297","last_updated":"2026-05-27T10:11:58Z","snapshot_observed_at":"2026-08-01T11:19:03.524897Z","submitted_at":"2026-05-21T10:46:23Z","title":"One LR Doesn't Fit All: Heavy-Tail Guided Layerwise Learning Rates for LLMs","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T17:31:32.533941Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2605.22297"},"observation_digest":"sha256:ac3046d788c3909895f719c8e8e56298d2092b75d04755373dbd7bae4cd30560","observation_id":"1eb83793-db37-4efa-95da-fff07bd1647f","resolution":{"observed_at":"2026-06-30T17:34:57.603774Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":"2011.14522","doi":"10.48550/arxiv.2011.14522","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Hu, E","venue":"arXiv (Cornell University)","work_id":"421a60be-6eaa-4316-95cf-702cbf17f055","year":2011},"citing_paper":{"arxiv_id":"2606.21645","last_updated":"2026-06-19T17:56:44Z","snapshot_observed_at":"2026-08-05T10:02:01.473600Z","submitted_at":"2026-06-19T17:56:44Z","title":"Behavioral and Representational Evidence of Binomial Ordering Preferences in Large Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-26T14:18:11.215278Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2606.21645"},"observation_digest":"sha256:c021cb47a976de1b9de9bfc7c598389f9715e87ab429794437005ff79df5725e","observation_id":"f1463cbb-4bfd-4119-9f34-300a8a6c93fd","resolution":{"observed_at":"2026-07-04T06:39:37.863096Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":"2011.14522","doi":"10.48550/arxiv.2011.14522","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Hu, E","venue":"arXiv (Cornell University)","work_id":"421a60be-6eaa-4316-95cf-702cbf17f055","year":2011},"citing_paper":{"arxiv_id":"2606.21734","last_updated":"2026-06-19T20:43:49Z","snapshot_observed_at":"2026-08-05T18:05:51.515234Z","submitted_at":"2026-06-19T20:43:49Z","title":"HPP: Hierarchical Programmatic Probing for Long Video Understanding by Decoupling Perception and Reasoning","version":1},"reference_index":283,"source":"arxiv_source","source_observed_at":"2026-06-26T14:19:53.450263Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2606.21734"},"observation_digest":"sha256:7de4124b07ac5a92e4fcc063100ae8163012bc4ff4a47758efb90996b349413e","observation_id":"d473d474-052d-45bc-9d6d-5bc775e4ef82","resolution":{"observed_at":"2026-07-04T06:39:37.466916Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":"2011.14522","doi":"10.48550/arxiv.2011.14522","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Hu, E","venue":"arXiv (Cornell University)","work_id":"421a60be-6eaa-4316-95cf-702cbf17f055","year":2011},"citing_paper":{"arxiv_id":"2606.22019","last_updated":"2026-06-20T12:48:31Z","snapshot_observed_at":"2026-08-06T19:21:18.734073Z","submitted_at":"2026-06-20T12:48:31Z","title":"Channel Location Constrains the Auditability of Subliminal Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T11:52:03.948568Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2606.22019"},"observation_digest":"sha256:da613b8675d35adf5bc97980a66922b079125c087bf533f6a2226c972e56a2e4","observation_id":"95fdfaca-88b1-4e55-a625-a65e4732112c","resolution":{"observed_at":"2026-07-04T08:19:44.365679Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":"2011.14522","doi":"10.48550/arxiv.2011.14522","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Hu, E","venue":"arXiv (Cornell University)","work_id":"421a60be-6eaa-4316-95cf-702cbf17f055","year":2011},"citing_paper":{"arxiv_id":"2606.23364","last_updated":"2026-06-22T14:00:26Z","snapshot_observed_at":"2026-08-02T17:37:15.368213Z","submitted_at":"2026-06-22T14:00:26Z","title":"Convergence of Gradient Descent for General Neural Network Architectures Beyond the NTK Regime","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-06-26T08:53:46.285233Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2606.23364"},"observation_digest":"sha256:c218a0d16da6617593c518632f7253a619fa2a4026604ac7dc7a0e678b00c3a0","observation_id":"c433e8a7-c650-4704-918a-1b583775d2da","resolution":{"observed_at":"2026-07-04T10:29:44.301056Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":"2011.14522","doi":"10.48550/arxiv.2011.14522","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Hu, E","venue":"arXiv (Cornell University)","work_id":"421a60be-6eaa-4316-95cf-702cbf17f055","year":2011},"citing_paper":{"arxiv_id":"2606.30831","last_updated":"2026-07-23T18:53:12Z","snapshot_observed_at":"2026-08-04T02:09:09.481541Z","submitted_at":"2026-06-29T19:01:43Z","title":"Geometric Dyson Brownian Motions and the Free Log-Normal Limit for a Non-Square Gaussian Matrix Product","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-01T01:42:14.145227Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2606.30831"},"observation_digest":"sha256:60b73bb6c55cd9fff101aa76f309557766c17307d8994e231aba75ed3b3672ad","observation_id":"d7fecc01-c726-4c17-bf97-d64c97ab40ae","resolution":{"observed_at":"2026-07-01T12:45:44.986571Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-02T09:36:52.413688Z","title":"Feature Learning in Infinite-Width Neural Networks","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.30831","last_updated":"2026-07-23T18:53:12Z","snapshot_observed_at":"2026-08-04T02:09:09.481541Z","submitted_at":"2026-06-29T19:01:43Z","title":"Geometric Dyson Brownian Motions and the Free Log-Normal Limit for a Non-Square Gaussian Matrix Product","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T09:36:52.413688Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2606.30831"},"observation_digest":"sha256:b71d1ad7899ec0e1624c0ad31871957a9b1afdc4a6fd9a4249c6c4861ca52cbc","observation_id":"4fdb44ae-775f-42fe-b4f7-04789b055ce3","resolution":{"observed_at":"2026-08-02T09:36:52.413688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-07-12T06:14:03.658427Z","title":"Yang and E","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.02905","last_updated":"2026-07-03T03:04:12Z","snapshot_observed_at":"2026-08-07T12:25:44.783974Z","submitted_at":"2026-07-03T03:04:12Z","title":"Pre-Strings Lectures on Artificial Intelligence","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-12T06:14:03.658427Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2607.02905"},"observation_digest":"sha256:8484e740713a93ef0b3f896808a2d61517529b230955fb9f69262613ebfed9b9","observation_id":"da81d341-2cc6-485e-a096-40776047f9ae","resolution":{"observed_at":"2026-07-12T06:14:03.658427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-07-12T01:11:50.444218Z","title":"arXiv preprint arXiv:2011.14522 , year=","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.03613","last_updated":"2026-07-03T22:03:13Z","snapshot_observed_at":"2026-07-12T01:11:45.525555Z","submitted_at":"2026-07-03T22:03:13Z","title":"Implicit Bias of SGD in Multivariate ReLU Networks: Effective Width Collapse","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-12T01:11:50.444218Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2607.03613"},"observation_digest":"sha256:57b5aad42a71c4a4ff91754a8f7dabe084ac90af94daaf86fde24592a8b99312","observation_id":"fe6f1eb5-da8f-450e-beec-49aa75f1e250","resolution":{"observed_at":"2026-07-12T01:11:50.444218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-04T04:31:49.135791Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.02573","last_updated":"2026-08-03T17:49:40Z","snapshot_observed_at":"2026-08-08T09:09:06.432222Z","submitted_at":"2026-08-03T17:49:40Z","title":"Foundation Models for Astrophysics","version":1},"reference_index":141,"source":"pdf_text","source_observed_at":"2026-08-04T04:31:49.135791Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2608.02573"},"observation_digest":"sha256:07d8d257e4320ba2dc8182a148345e9e73b47f1a093424ea5a0a3e9659770565","observation_id":"71642c5e-b6d8-420e-b214-b7860253f3fc","resolution":{"observed_at":"2026-08-04T04:31:49.135791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2011.14522/citation-record","integrity":"/paper/2011.14522/integrity","json":"/paper/2011.14522/citation-record.json","paper":"/paper/2011.14522"},"outbound":[],"paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T04:48:30.109419Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 29 inbound Pith citation observations for arXiv:2011.14522."}