{"as_of":"2026-08-10T06:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:759c722849c9990462ee1c876dc64fcaa87aa5fc397fee4373ebfcd26588bf8a","coverage":[{"denominator":8,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T06:00:15.484909Z","state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2602.00827/citation-record","integrity":"/paper/2602.00827/integrity","json":"/paper/2602.00827/citation-record.json","paper":"/paper/2602.00827"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:00:15.170988Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.00827","last_updated":"2026-05-26T05:46:26Z","snapshot_observed_at":"2026-08-08T08:14:03.244461Z","submitted_at":"2026-01-31T17:43:02Z","title":"Over-Alignment vs Over-Fitting: The Role of Feature Learning Strength in Generalization","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T06:00:15.170988Z"},"links":{"citing_paper":"/paper/2602.00827"},"observation_digest":"sha256:9f4a32b7903d63db8da4fcdc5eb3020069929449178098e2347f5510c8b70ec0","observation_id":"1eabee19-7a0e-400e-a354-3d2bfa6eeeaa","resolution":{"observed_at":"2026-08-03T06:00:15.170988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:00:15.306784Z","title":"(2024, Appendix D.2), andβ:= (λx min)2/(32xmax)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.00827","last_updated":"2026-05-26T05:46:26Z","snapshot_observed_at":"2026-08-08T08:14:03.244461Z","submitted_at":"2026-01-31T17:43:02Z","title":"Over-Alignment vs Over-Fitting: The Role of Feature Learning Strength in Generalization","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T06:00:15.306784Z"},"links":{"citing_paper":"/paper/2602.00827"},"observation_digest":"sha256:a68760e888198df08ca14b71190de8906be37b6306cc400a6f4db30a079622d6","observation_id":"41830fe2-f680-421c-92e5-ccb2742dc407","resolution":{"observed_at":"2026-08-03T06:00:15.306784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01562","last_updated":"2025-06-02T11:38:10Z","snapshot_observed_at":"2026-08-09T17:03:07.147265Z","submitted_at":"2025-06-02T11:38:10Z","title":"Unpacking Softmax: How Temperature Drives Representation Collapse, Compression, and Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01562","snapshot_observed_at":"2026-08-03T06:00:14.874974Z","title":"S., Lucchi, A., Pascanu, R., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.00827","last_updated":"2026-05-26T05:46:26Z","snapshot_observed_at":"2026-08-08T08:14:03.244461Z","submitted_at":"2026-01-31T17:43:02Z","title":"Over-Alignment vs Over-Fitting: The Role of Feature Learning Strength in Generalization","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T06:00:14.874974Z"},"links":{"cited_paper":"/paper/2506.01562","citing_paper":"/paper/2602.00827"},"observation_digest":"sha256:538d8bff1d094076e469f1b3b0b20111e8c1eb30968cd64d54790928d43d4124","observation_id":"7eb00b84-6ccc-4e33-91f7-944b3fd7f28d","resolution":{"observed_at":"2026-08-03T06:00:14.874974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:00:15.066357Z","title":"U-shape,","venue":null,"work_id":null,"year":2063},"citing_paper":{"arxiv_id":"2602.00827","last_updated":"2026-05-26T05:46:26Z","snapshot_observed_at":"2026-08-08T08:14:03.244461Z","submitted_at":"2026-01-31T17:43:02Z","title":"Over-Alignment vs Over-Fitting: The Role of Feature Learning Strength in Generalization","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T06:00:15.066357Z"},"links":{"citing_paper":"/paper/2602.00827"},"observation_digest":"sha256:27c28b0b0740479ca289c25e8878a3f5f9e9295d9c9734d3a1f37e2fbedb9ef0","observation_id":"60233ebf-fd6a-4d52-88b8-e0fb2b91695e","resolution":{"observed_at":"2026-08-03T06:00:15.066357Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:00:15.430895Z","title":"(2022).)sign(v j(t)) = sign(vj(0))","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.00827","last_updated":"2026-05-26T05:46:26Z","snapshot_observed_at":"2026-08-08T08:14:03.244461Z","submitted_at":"2026-01-31T17:43:02Z","title":"Over-Alignment vs Over-Fitting: The Role of Feature Learning Strength in Generalization","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T06:00:15.430895Z"},"links":{"citing_paper":"/paper/2602.00827"},"observation_digest":"sha256:45b47dd9d7e5a6030fa1cefe93072b7ca3575b31601eca68985857e0ea394dc4","observation_id":"deeba83c-85ff-4928-a338-afd306d7099d","resolution":{"observed_at":"2026-08-03T06:00:15.430895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:00:15.484909Z","title":"AUXILIARYLEMMATA Before start, we define Π∥ to be a orthogonal projection onto s and Π⊥ to be the orthogonal projection onto its complement","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2602.00827","last_updated":"2026-05-26T05:46:26Z","snapshot_observed_at":"2026-08-08T08:14:03.244461Z","submitted_at":"2026-01-31T17:43:02Z","title":"Over-Alignment vs Over-Fitting: The Role of Feature Learning Strength in Generalization","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T06:00:15.484909Z"},"links":{"citing_paper":"/paper/2602.00827"},"observation_digest":"sha256:7c4b806f0e304c17245c7d7b65c4549272dbbfd471c205e78390a1d2c2c68855","observation_id":"c1886f39-d632-465e-b98b-08042dcdd6bd","resolution":{"observed_at":"2026-08-03T06:00:15.484909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15933","last_updated":"2022-01-31T12:58:39Z","snapshot_observed_at":"2026-08-08T08:13:53.762544Z","submitted_at":"2021-06-30T09:34:05Z","title":"Saddle-to-Saddle Dynamics in Deep Linear Networks: Small Initialization Training, Symmetry, and Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.15933","snapshot_observed_at":"2026-08-03T06:00:14.652992Z","title":"Saddle-to-saddle dynamics in deep linear networks: Small initialization training, symmetry, and sparsity.arXiv preprint arXiv:2106.15933,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.00827","last_updated":"2026-05-26T05:46:26Z","snapshot_observed_at":"2026-08-08T08:14:03.244461Z","submitted_at":"2026-01-31T17:43:02Z","title":"Over-Alignment vs Over-Fitting: The Role of Feature Learning Strength in Generalization","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-03T06:00:14.652992Z"},"links":{"cited_paper":"/paper/2106.15933","citing_paper":"/paper/2602.00827"},"observation_digest":"sha256:d15d5532303f818d167e7ef35d33d821be6154e8cbb3b486cf10af3244a6b59d","observation_id":"586fda19-a8a8-40da-b22c-a0822fc908b7","resolution":{"observed_at":"2026-08-03T06:00:14.652992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.08367","last_updated":"2018-03-22T14:08:58Z","snapshot_observed_at":"2026-07-06T06:29:40.070023Z","submitted_at":"2018-03-22T14:08:58Z","title":"Gradient Descent Quantizes ReLU Network Features","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.08367","snapshot_observed_at":"2026-08-03T06:00:14.707112Z","title":"Gradient de- scent quantizes relu network features.arXiv preprint arXiv:1803.08367,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.00827","last_updated":"2026-05-26T05:46:26Z","snapshot_observed_at":"2026-08-08T08:14:03.244461Z","submitted_at":"2026-01-31T17:43:02Z","title":"Over-Alignment vs Over-Fitting: The Role of Feature Learning Strength in Generalization","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-03T06:00:14.707112Z"},"links":{"cited_paper":"/paper/1803.08367","citing_paper":"/paper/2602.00827"},"observation_digest":"sha256:e1e008ad07390af5efa14cabc211ef9176db696ee594139309a0569b2ade7627","observation_id":"c268e8d9-313c-417a-bb82-179ea1854510","resolution":{"observed_at":"2026-08-03T06:00:14.707112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.00827","last_updated":"2026-05-26T05:46:26Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T08:14:03.244461Z","submitted_at":"2026-01-31T17:43:02Z","title":"Over-Alignment vs Over-Fitting: The Role of Feature Learning Strength in Generalization"},"reference_resolution":{"displayed":8,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":8},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 8 of 8 outbound references and 0 inbound Pith citation observations for arXiv:2602.00827."}