{"as_of":"2026-08-12T14:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6a8fb89bbdd320294911e9ec9e62efcb1bf3a765db6b8927a5e70f50054d959f","coverage":[{"denominator":9,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T17:03:06.024248Z","state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.00046/citation-record","integrity":"/paper/2509.00046/integrity","json":"/paper/2509.00046/citation-record.json","paper":"/paper/2509.00046"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:03:06.122594Z","title":"These research findings had improved LoRA training for large models to varying degrees","venue":null,"work_id":"aa10fc84-731d-4ef6-99e5-7f2997c227cf","year":2016},"citing_paper":{"arxiv_id":"2509.00046","last_updated":"2025-08-24T10:27:14Z","snapshot_observed_at":"2026-08-10T21:47:33.596714Z","submitted_at":"2025-08-24T10:27:14Z","title":"Exploring and Reshaping the Weight Distribution in LLM","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T17:03:06.000250Z"},"links":{"citing_paper":"/paper/2509.00046"},"observation_digest":"sha256:b95db1396ee528af551bf5d0da1d97e5ceae50bf7c1549fc68c3e59a38bc0fcd","observation_id":"a03b4629-a58f-489e-8f03-c7427b7bf793","resolution":{"observed_at":"2026-08-05T17:03:06.126082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.08863","last_updated":"2017-05-02T22:43:10Z","snapshot_observed_at":"2026-08-05T03:11:31.766011Z","submitted_at":"2017-04-28T09:57:52Z","title":"On weight initialization in deep neural networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.08863","snapshot_observed_at":"2026-08-05T17:03:06.020754Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.00046","last_updated":"2025-08-24T10:27:14Z","snapshot_observed_at":"2026-08-10T21:47:33.596714Z","submitted_at":"2025-08-24T10:27:14Z","title":"Exploring and Reshaping the Weight Distribution in LLM","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T17:03:06.020754Z"},"links":{"cited_paper":"/paper/1704.08863","citing_paper":"/paper/2509.00046"},"observation_digest":"sha256:34475f6ddeb913be1d7de60a305825a3096352ac31c2f238767482d1ee35ccce","observation_id":"b4cd6423-9a93-4676-a191-16f05256c2e6","resolution":{"observed_at":"2026-08-05T17:03:06.020754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:03:06.100440Z","title":null,"venue":null,"work_id":"285b81a3-2fec-4e8b-9824-c00a54bc4959","year":2025},"citing_paper":{"arxiv_id":"2509.00046","last_updated":"2025-08-24T10:27:14Z","snapshot_observed_at":"2026-08-10T21:47:33.596714Z","submitted_at":"2025-08-24T10:27:14Z","title":"Exploring and Reshaping the Weight Distribution in LLM","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T17:03:06.006400Z"},"links":{"citing_paper":"/paper/2509.00046"},"observation_digest":"sha256:07426585848c048e30df654182b1811280752cf72c19ac87320d9c3fd35c5893","observation_id":"c871be18-5e4c-4091-ad9c-ea217cf1f26b","resolution":{"observed_at":"2026-08-05T17:03:06.103159Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02737","last_updated":"2025-02-04T21:43:16Z","snapshot_observed_at":"2026-08-12T12:18:11.507612Z","submitted_at":"2025-02-04T21:43:16Z","title":"SmolLM2: When Smol Goes Big -- Data-Centric Training of a Small Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02737","snapshot_observed_at":"2026-08-05T17:03:06.017314Z","title":"It has with no significant difference from the loss in normal LoRA fine-tuning training","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.00046","last_updated":"2025-08-24T10:27:14Z","snapshot_observed_at":"2026-08-10T21:47:33.596714Z","submitted_at":"2025-08-24T10:27:14Z","title":"Exploring and Reshaping the Weight Distribution in LLM","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T17:03:06.017314Z"},"links":{"cited_paper":"/paper/2502.02737","citing_paper":"/paper/2509.00046"},"observation_digest":"sha256:d813332943ed29b1543f8bff4754a85f9321d9fa9e6294f9af7b111e2b1766ba","observation_id":"0be831ed-cedc-4d19-b92c-a639912cadec","resolution":{"observed_at":"2026-08-05T17:03:06.017314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13269","last_updated":"2024-04-16T17:37:12Z","snapshot_observed_at":"2026-08-11T22:31:05.477054Z","submitted_at":"2024-03-20T03:07:50Z","title":"AFLoRA: Adaptive Freezing of Low Rank Adaptation in Parameter Efficient Fine-Tuning of Large Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13269","snapshot_observed_at":"2026-08-05T17:03:06.024248Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00046","last_updated":"2025-08-24T10:27:14Z","snapshot_observed_at":"2026-08-10T21:47:33.596714Z","submitted_at":"2025-08-24T10:27:14Z","title":"Exploring and Reshaping the Weight Distribution in LLM","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-05T17:03:06.024248Z"},"links":{"cited_paper":"/paper/2403.13269","citing_paper":"/paper/2509.00046"},"observation_digest":"sha256:87cba4f49110e05ed16c8168c84132dc45bce8c812a303b9aaeb39c993d277c5","observation_id":"7b6686b6-5f02-42c6-8620-500168fdad92","resolution":{"observed_at":"2026-08-05T17:03:06.024248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:03:06.089886Z","title":"Let the weight matrix in any given layer be represented by matrix X","venue":null,"work_id":"8c0de5bd-8d5e-47a1-a831-5bae66de88f2","year":2023},"citing_paper":{"arxiv_id":"2509.00046","last_updated":"2025-08-24T10:27:14Z","snapshot_observed_at":"2026-08-10T21:47:33.596714Z","submitted_at":"2025-08-24T10:27:14Z","title":"Exploring and Reshaping the Weight Distribution in LLM","version":1},"reference_index":1980,"source":"pdf_text","source_observed_at":"2026-08-05T17:03:06.010741Z"},"links":{"citing_paper":"/paper/2509.00046"},"observation_digest":"sha256:35c6c72a0af1748bf9fbc0a5660ae7675bafe7c8bf345b87597d98f6af4e1c52","observation_id":"922da3e2-cf1f-4225-afa3-0426737c7b41","resolution":{"observed_at":"2026-08-05T17:03:06.092949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:03:06.111281Z","title":"Other distribution models, such as multivariate α-stable distribution (Li et al., 2024), were also used in modeling and analyzing model parameters","venue":null,"work_id":"06cd106b-dbb0-4e6e-9a9f-876a42d74f67","year":2024},"citing_paper":{"arxiv_id":"2509.00046","last_updated":"2025-08-24T10:27:14Z","snapshot_observed_at":"2026-08-10T21:47:33.596714Z","submitted_at":"2025-08-24T10:27:14Z","title":"Exploring and Reshaping the Weight Distribution in LLM","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-05T17:03:06.003488Z"},"links":{"citing_paper":"/paper/2509.00046"},"observation_digest":"sha256:df8ad140836b5cd6a32762c27ef7f837a8f19122d0d8e5bf185eca2d80fa4269","observation_id":"b062fb5a-e925-4b35-9e63-f91df1136b76","resolution":{"observed_at":"2026-08-05T17:03:06.114734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:03:06.134888Z","title":null,"venue":null,"work_id":"9f068c86-f4b4-45e7-8e0d-2aae7ab4d893","year":2023},"citing_paper":{"arxiv_id":"2509.00046","last_updated":"2025-08-24T10:27:14Z","snapshot_observed_at":"2026-08-10T21:47:33.596714Z","submitted_at":"2025-08-24T10:27:14Z","title":"Exploring and Reshaping the Weight Distribution in LLM","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T17:03:05.996346Z"},"links":{"citing_paper":"/paper/2509.00046"},"observation_digest":"sha256:bb00074564beb84bd3a3388a82e5509fbd564adeaf27b360e1a3a55c1bd8710d","observation_id":"dbf23cf5-02e7-463c-a302-41a2aeb15c19","resolution":{"observed_at":"2026-08-05T17:03:06.139462Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:03:06.077814Z","title":"In addition to the models themselves, the referen ce models also include SmolLM2-1.7B and LLaMA3.2-8B- Instruct, which have more weights","venue":null,"work_id":"97a0b893-61fa-430e-b7f0-c8e6eab5b8ee","year":2024},"citing_paper":{"arxiv_id":"2509.00046","last_updated":"2025-08-24T10:27:14Z","snapshot_observed_at":"2026-08-10T21:47:33.596714Z","submitted_at":"2025-08-24T10:27:14Z","title":"Exploring and Reshaping the Weight Distribution in LLM","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-05T17:03:06.013856Z"},"links":{"citing_paper":"/paper/2509.00046"},"observation_digest":"sha256:28a171f234420bd96f54d92c6f18e141657ffe9e109a6f95459acce742c5115b","observation_id":"68eadc85-7703-417f-b0d2-63e248730197","resolution":{"observed_at":"2026-08-05T17:03:06.082865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.00046","last_updated":"2025-08-24T10:27:14Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T21:47:33.596714Z","submitted_at":"2025-08-24T10:27:14Z","title":"Exploring and Reshaping the Weight Distribution in LLM"},"reference_resolution":{"displayed":9,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":9},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 9 of 9 outbound references and 0 inbound Pith citation observations for arXiv:2509.00046."}