{"as_of":"2026-08-10T04:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9b3d3986ebe5fa0273df1d6a9a55c598edf85be25e27667f4d438b0e4c2db97f","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:30:12.402648Z","state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.24469/citation-record","integrity":"/paper/2505.24469/integrity","json":"/paper/2505.24469/citation-record.json","paper":"/paper/2505.24469"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:18.093352Z","title":"Online embedding compression for text classification using low rank matrix factorization","venue":null,"work_id":"949f04e7-f591-4786-a470-11013607cab1","year":2019},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:06.115978Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:9d0665aad5f6ce307fa41dcfe9481eea2fa76c71fc54a5bfecfaea3a2c0be223","observation_id":"a92dd1a5-6e62-40f3-89c5-21273d1f2464","resolution":{"observed_at":"2026-08-07T12:30:18.201092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:17.880317Z","title":"Fluctuation-based adaptive structured pruning for large language models","venue":null,"work_id":"818d423b-1e0c-42e0-a958-5ee1e94ae139","year":2024},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:06.223019Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:fb82ffd650570af6edd9d1711bfa05993b0e6f1886c97f5dae98d3d210cda03c","observation_id":"22feda92-49c6-420b-8e81-5733894f4ebf","resolution":{"observed_at":"2026-08-07T12:30:17.984589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:17.680744Z","title":"On gradient regularizers for mmd gans.Advances in neural information processing systems, 31, 2018","venue":null,"work_id":"d33c1dc4-7bcc-4035-bd0c-cb9434ecea86","year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:06.338992Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:9be2744c98f47a0f6ae71eeb412ab7a976b60eb2b3b965c0a3a66e6183a83d05","observation_id":"c6b31d9b-53b6-4dc0-8c4f-ebd765cba2f0","resolution":{"observed_at":"2026-08-07T12:30:17.773468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:17.550559Z","title":"Slicegpt: Compress large language models by deleting rows and columns","venue":null,"work_id":"693c53f4-1c7a-4981-a5e2-50ebf3e91fd3","year":2024},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:06.463375Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:fd449b0a4543209257cf8f6e71246f0e7d3b9fce43d377df04910fc63d25e755","observation_id":"9992f729-6058-4e8a-8744-736f65062e2f","resolution":{"observed_at":"2026-08-07T12:30:17.599730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.05012","last_updated":"2018-04-16T17:07:53Z","snapshot_observed_at":"2026-07-06T06:33:20.422524Z","submitted_at":"2018-04-13T16:24:17Z","title":"Representing smooth functions as compositions of near-identity functions with implications for deep network optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.05012","snapshot_observed_at":"2026-08-07T12:30:06.566686Z","title":"Representing smooth functions as compositions of near-identity functions with implications for deep network optimization.arXiv preprint arXiv:1804.05012, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:06.566686Z"},"links":{"cited_paper":"/paper/1804.05012","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:62ef31bd29d430ef1282ed38e67832b9c32be17899dc391f053c39257c18a8cf","observation_id":"8e953837-908b-40ee-821e-c5dc1904f095","resolution":{"observed_at":"2026-08-07T12:30:06.566686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:17.271973Z","title":"Invertible residual networks","venue":null,"work_id":"41849e5c-efe2-4936-8e5d-843bd7495794","year":2019},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:06.655015Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:5e09c2e7a523a64c625c3e4484518714cbeddeee23f0a243728b954c5f1be202","observation_id":"14a5ac12-b72d-4eeb-b901-219be14c09da","resolution":{"observed_at":"2026-08-07T12:30:17.380637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.09282","last_updated":"2020-06-14T19:10:03Z","snapshot_observed_at":"2026-07-06T06:05:58.275255Z","submitted_at":"2017-10-23T20:16:55Z","title":"A Survey of Model Compression and Acceleration for Deep Neural Networks","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.09282","snapshot_observed_at":"2026-08-07T12:30:06.748067Z","title":"A survey of model compression and acceleration for deep neural networks.arXiv preprint arXiv:1710.09282, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:06.748067Z"},"links":{"cited_paper":"/paper/1710.09282","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:0d6234544b0f09a51f3a07405605569d562ffde90aae250c1d030fc2eee26093","observation_id":"d83c6c19-4989-49fa-9427-1bb37040006f","resolution":{"observed_at":"2026-08-07T12:30:06.748067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:06.853913Z","title":"Parseval networks: Improving robustness to adversarial examples","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:06.853913Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:25a40d3c60013f85a7a49de4474ad6e456dea2275293bf122ecaea9ce9922a53","observation_id":"6b097332-307f-4129-bb05-e3902a0bfb6e","resolution":{"observed_at":"2026-08-07T12:30:06.853913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:06.967288Z","title":"Hawq: Hessian aware quantization of neural networks with mixed-precision","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:06.967288Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:28b32c680db9613e3632e7e3bc335a3b5d14b7cf531f7ace36ec3df10bafb3af","observation_id":"edb10441-f4ed-4f3c-8c13-32250f7e9f16","resolution":{"observed_at":"2026-08-07T12:30:06.967288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:17.037332Z","title":"Improving generalization performance using double backpropagation","venue":null,"work_id":"50906a05-2de8-4e47-8e4c-119078538292","year":1992},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:07.030954Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:4303b82ea52a38542f38fcf4373cac07bc0a652c2da2714fe1782b878405096e","observation_id":"080d3db6-6746-4310-91d9-d5dd0b8f93d6","resolution":{"observed_at":"2026-08-07T12:30:17.159202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:16.896879Z","title":"The role of permutation invariance in linear mode connectivity of neural networks","venue":null,"work_id":"7beef09a-5c9f-40b5-bcbc-7a9029a5271b","year":2022},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:07.163063Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:1005e8354b8f6699f78708f35644eed692767ecc699c87e53c20d871bca3822f","observation_id":"bb6abfdf-2676-4375-b078-d8eb7938c0dc","resolution":{"observed_at":"2026-08-07T12:30:16.969197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:16.733316Z","title":"Neural scene representation and rendering.Science, 360(6394):1204–1210, 2018","venue":null,"work_id":"8ddf9d80-cc56-403b-87eb-114093114434","year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:07.302818Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:5d24923cee2766ccb85c46a2de72a0eccaf303eb11245549a1f221581e8e868d","observation_id":"6fbd3b2e-dc0a-4c48-8558-0e2c8c43a40e","resolution":{"observed_at":"2026-08-07T12:30:16.799934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:16.595466Z","title":"Many paths to equilibrium: Gans do not need to decrease a divergence at every step","venue":null,"work_id":"2629ef00-77a0-44f7-bb19-c0ed0563dc6c","year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:07.478679Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:124b1e85fedcebc0214855232093ba3927bafd65e9a7297c4fe565dbe0148ada","observation_id":"d6ceedb8-2b9f-4386-994e-6c4b5bd36f19","resolution":{"observed_at":"2026-08-07T12:30:16.661142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.01882","last_updated":"2019-03-05T15:07:29Z","snapshot_observed_at":"2026-07-06T07:37:13.112388Z","submitted_at":"2019-03-05T15:07:29Z","title":"Learning a smooth kernel regularizer for convolutional neural networks","version":1},"cited_work":{"arxiv_id":"1903.01882","doi":null,"metadata_source":"pith","pith_arxiv_id":"1903.01882","snapshot_observed_at":"2026-08-07T12:30:12.796135Z","title":"Learning a smooth kernel regularizer for convolutional neural networks","venue":"cs.CV","work_id":"6d9d3165-878f-41ef-ad1a-a85c0423b231","year":2019},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:07.615112Z"},"links":{"cited_paper":"/paper/1903.01882","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:be3f91222f53af191199ec830802dcc2974f8e3113221f042531df55c818ff79","observation_id":"119d68c9-b227-4c73-9f0f-a0b7b49cc789","resolution":{"observed_at":"2026-08-07T12:30:12.875128Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:07.675759Z","title":"The lottery ticket hypothesis: Finding sparse, trainable neural networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:07.675759Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:a1731a73bacdd87ebf79d7d0ef26458403bc536ea377833bb4e5c17204b77c09","observation_id":"0cb40509-e00a-4732-977e-8ae5cd3d3ce1","resolution":{"observed_at":"2026-08-07T12:30:07.675759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:07.763259Z","title":"Optimal brain compression: A framework for accurate post-training quantization and pruning.Advances in Neural Information Processing Systems, 35:4475–4488, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:07.763259Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:942aaf744675ff4ed9941bc43d9a3ab39363a8ca463e12abee8200335fb3abba","observation_id":"5fba65e3-ca99-4396-a793-423a4cf80f28","resolution":{"observed_at":"2026-08-07T12:30:07.763259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:07.886636Z","title":"Sparsegpt: Massive language models can be accurately pruned in one-shot","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:07.886636Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:1e188ecabc19aebbd03f12b633ddf1715dba639b523c1f0379f91f19f2e2f496","observation_id":"e017a3c4-a969-45c9-a433-255e8452f36d","resolution":{"observed_at":"2026-08-07T12:30:07.886636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:07.982926Z","title":"Born again neural networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:07.982926Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:0c319ed1196a326df58fd9c9b79c564653bc7a1d93465c602cd5889219add8c0","observation_id":"60eac7ac-ce5e-43d5-b768-28cf08beaf05","resolution":{"observed_at":"2026-08-07T12:30:07.982926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:16.476190Z","title":"Stochastic training is not necessary for generalization","venue":null,"work_id":"4194de92-dd9f-42f1-9d94-27ae5fbb9add","year":2022},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:08.070431Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:64d3f3bfe00122831b022844179363aa64e4bec8c29847dca1a11ab776295b71","observation_id":"1f1aeecc-5769-449f-835e-6efd1f155fb0","resolution":{"observed_at":"2026-08-07T12:30:16.505909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:08.161699Z","title":"Knowledge distillation: A survey","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:08.161699Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:c1fb587a7a869944d460a2f07a94a01f645032af7b957b1ccd4bf790b210538c","observation_id":"2805b455-d6d7-49a3-9e13-f1ab1a5be346","resolution":{"observed_at":"2026-08-07T12:30:08.161699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:16.363391Z","title":"Regularisation of neural networks by enforcing lipschitz continuity.Machine Learning, 110:393–416, 2021","venue":null,"work_id":"7580d707-1509-425e-9723-32d9e60a049a","year":2021},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:08.279348Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:22ca1fe06630b4d4544620cdc5e88d9361bbe31a8b1207362549bdd879c56dec","observation_id":"a85b16aa-c670-40c0-850e-ac7cac6d467d","resolution":{"observed_at":"2026-08-07T12:30:16.406220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:08.370851Z","title":"Improved training of wasserstein gans.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:08.370851Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:b56914c5cfd783b5172b7cd71870510ceef4c06028d3eb8c3688c0fa776efbb1","observation_id":"d2dce5cc-2ce6-425b-84a7-835126f0f7b8","resolution":{"observed_at":"2026-08-07T12:30:08.370851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:08.456628Z","title":"Learning both weights and connections for efficient neural network.Advances in neural information processing systems, 28, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:08.456628Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:354bc64c1f116ec5f91619e8b56b4d518a3dceb769c3b6cdc4dbd1b06ecf1d22","observation_id":"c2942940-5a6a-466a-83f4-1aeb25cb85c2","resolution":{"observed_at":"2026-08-07T12:30:08.456628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:08.519624Z","title":"Optimal brain surgeon and general network pruning","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:08.519624Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:5cfe02741c5fc03b60b0d75927e0e8206cd89c684a6433783fdf1dbe9148be74","observation_id":"f1558d3c-afb2-4b1c-94e7-b17ce02b5c89","resolution":{"observed_at":"2026-08-07T12:30:08.519624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:08.603463Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:08.603463Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:1827e595689b3b3c9a6251aaaa2fd4b947ff99554c5def83f53723d23c8f2b42","observation_id":"2e695d43-01b3-4361-bf83-7d4b7b6519fa","resolution":{"observed_at":"2026-08-07T12:30:08.603463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:08.717050Z","title":"Bag of tricks for image classification with convolutional neural networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:08.717050Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:7ed00e776775a7af5032d98b5df564d7959222a0b6490bf6837c4e9117dfedf0","observation_id":"edc6e669-d148-4204-8180-192acfadff02","resolution":{"observed_at":"2026-08-07T12:30:08.717050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:16.202138Z","title":"Multi-task zipping via layer-wise neuron sharing.Advances in Neural Information Processing Systems, 31, 2018","venue":null,"work_id":"b0beb80b-ebfe-4777-a4fd-9a6c9097b074","year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:08.788445Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:8d5f78ebef11ff81c64a7f7810ee1a326f08630bf0b05b48892b919ebe159cee","observation_id":"16a86be1-e712-4000-9912-a503f91ebcf2","resolution":{"observed_at":"2026-08-07T12:30:16.249679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:08.887893Z","title":"Channel pruning for accelerating very deep neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:08.887893Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:a5dee96623bc779b04bab6c1f409d03a8df2cf878aef53a4040588d6fcc62014","observation_id":"81fc4488-3194-48c1-814e-2622eb94e84a","resolution":{"observed_at":"2026-08-07T12:30:08.887893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-07T12:30:08.964381Z","title":"Distilling the knowledge in a neural network.arXiv preprint arXiv:1503.02531, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:08.964381Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:259c09a4e678cc5607fb036eb057fd8d9d60c69355933e0b8543ee1218bb8915","observation_id":"3ac37b63-8e69-40e8-a628-054d4803b5a6","resolution":{"observed_at":"2026-08-07T12:30:08.964381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.03250","last_updated":"2016-07-12T07:43:01Z","snapshot_observed_at":"2026-07-06T05:03:13.994105Z","submitted_at":"2016-07-12T07:43:01Z","title":"Network Trimming: A Data-Driven Neuron Pruning Approach towards Efficient Deep Architectures","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.03250","snapshot_observed_at":"2026-08-07T12:30:09.113034Z","title":"Network trimming: A data-driven neuron pruning approach towards efficient deep architectures.arXiv preprint arXiv:1607.03250, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:09.113034Z"},"links":{"cited_paper":"/paper/1607.03250","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:621f5e98a2823db32a452422b5750d40f9ccf206690c8c6ba24308deb1af50c2","observation_id":"278b3488-f7c5-4f7d-bbc2-e767d1ea16a7","resolution":{"observed_at":"2026-08-07T12:30:09.113034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:16.051652Z","title":"Quantized neural networks: Training neural networks with low precision weights and activations.journal of machine learning research, 18(187):1–30, 2018","venue":null,"work_id":"a77d4fd5-1e5a-49d8-847a-5e8ce9a53f4a","year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:09.212080Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:8d7ac45c1b8f8ef9d374e99fef4f0b01ffdc204dc1da9ffa78cb3772c824ba70","observation_id":"50306162-f995-4dc7-bcaf-c0e126f6d384","resolution":{"observed_at":"2026-08-07T12:30:16.100846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:09.296570Z","title":"Overcoming catastrophic forgetting in neural networks.Proceedings of the national academy of sciences, 114(13):3521–3526, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:09.296570Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:70c9c6d2269bc905e4d41a034e42f4bdcd8d4fb1f86d832e91610203597a7c6b","observation_id":"b1ddef33-b2ee-4d5b-a722-13c0aa012942","resolution":{"observed_at":"2026-08-07T12:30:09.296570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:15.899445Z","title":"Literature survey on low rank approximation of matrices.Linear and Multilinear Algebra, 65(11):2212–2244, 2017","venue":null,"work_id":"64ed2edd-ca01-4c53-819f-2a13904acf6b","year":2017},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:09.420155Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:2e530b4dedba0819103d49f478bdc86264c8de2a2061fe7a73fa58be81dc4c04","observation_id":"4c1e4203-a757-4b23-becf-199967b27638","resolution":{"observed_at":"2026-08-07T12:30:15.972351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.07215","last_updated":"2017-12-10T15:24:13Z","snapshot_observed_at":"2026-07-06T05:43:27.961693Z","submitted_at":"2017-05-19T22:41:56Z","title":"On Convergence and Stability of GANs","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.07215","snapshot_observed_at":"2026-08-07T12:30:09.537422Z","title":"On convergence and stability of gans.arXiv preprint arXiv:1705.07215, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:09.537422Z"},"links":{"cited_paper":"/paper/1705.07215","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:6e4e43cb39b68bc138e90187d4cab1520eb61f495790843438e862ce28901200","observation_id":"155468eb-1581-4e90-9792-e0ccacdf2cb1","resolution":{"observed_at":"2026-08-07T12:30:09.537422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.08342","last_updated":"2018-06-21T17:32:46Z","snapshot_observed_at":"2026-07-06T06:46:08.396066Z","submitted_at":"2018-06-21T17:32:46Z","title":"Quantizing deep convolutional networks for efficient inference: A whitepaper","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.08342","snapshot_observed_at":"2026-08-07T12:30:09.614186Z","title":"Quantizing deep convolutional networks for efficient inference: A whitepaper","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:09.614186Z"},"links":{"cited_paper":"/paper/1806.08342","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:0fd13def93d904965446e062e31ee427852874983b74edd118c7e3dcbcbaa4d6","observation_id":"20f82b6f-6b8e-4cb2-a990-f2829bcdd852","resolution":{"observed_at":"2026-08-07T12:30:09.614186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:09.697478Z","title":"Learning multiple layers of features from tiny images","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:09.697478Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:2460138e7b455b0e52c26520e909ee070b561e96762f30fa881e4014f93ebbf8","observation_id":"14a1decc-99dc-4827-847b-b161e63961b3","resolution":{"observed_at":"2026-08-07T12:30:09.697478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:15.757831Z","title":"A fast post-training pruning framework for transformers.Advances in Neural Information Processing Systems, 35:24101–24116, 2022","venue":null,"work_id":"4bfc6807-a753-4a64-8a89-6f33694c7921","year":2022},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:09.768607Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:49485de2db0a980aee9820f0bdbd26622343eba6717d9f9efabcd903c62755f4","observation_id":"9453502e-eab0-4fdf-9c83-20ba5658946e","resolution":{"observed_at":"2026-08-07T12:30:15.821019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:09.839494Z","title":"Optimal brain damage.Advances in neural information processing systems, 2, 1989","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:09.839494Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:8cbb894d1dae4554b9be6de66702ac3f65f319b5fc8957657f5c770d13366bba","observation_id":"0ecd77aa-0b9a-47fd-a1c3-7f7fc06bc0b6","resolution":{"observed_at":"2026-08-07T12:30:09.839494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.08710","last_updated":"2017-03-10T17:57:56Z","snapshot_observed_at":"2026-08-09T05:37:48.140401Z","submitted_at":"2016-08-31T02:29:59Z","title":"Pruning Filters for Efficient ConvNets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.08710","snapshot_observed_at":"2026-08-07T12:30:09.904070Z","title":"Pruning filters for efficient convnets.arXiv preprint arXiv:1608.08710, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:09.904070Z"},"links":{"cited_paper":"/paper/1608.08710","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:4339524131681e4c26ea50d4d7edac4b120e5587d0e62d46d89988d31b89d871","observation_id":"643916e0-bb91-444b-883a-d4957feedbe5","resolution":{"observed_at":"2026-08-07T12:30:09.904070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:09.971519Z","title":"Lightweight deep learning for resource-constrained environments: A survey.ACM Computing Surveys, 56(10):1–42, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:09.971519Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:4d923b8532690eda3788210fb3b65fae32801783afec7e7dbbcc12d231b64c7c","observation_id":"ab477372-9a03-4029-a903-ec9f3da9766a","resolution":{"observed_at":"2026-08-07T12:30:09.971519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-07T12:30:10.045463Z","title":"Decoupled weight decay regularization.arXiv preprint arXiv:1711.05101, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:10.045463Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:ac38e31909de33cde3fb87e94d5b18dd13539676f17621bd9abde10bebc2e164","observation_id":"fbe44390-9a28-497f-910c-3ca16038f2ce","resolution":{"observed_at":"2026-08-07T12:30:10.045463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:10.107195Z","title":"Thinet: A filter level pruning method for deep neural network compression","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:10.107195Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:5e55ca1ddd062e378685b59245903c34039882210096f61d068dc9e847362bd3","observation_id":"832dd1f2-c743-4925-84dd-7d6e71a558ca","resolution":{"observed_at":"2026-08-07T12:30:10.107195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:15.610015Z","title":"Shortgpt: Layers in large language models are more redundant than you expect.CoRR, 2024","venue":null,"work_id":"d81a41ec-7298-45f2-b0bf-3f9b96729277","year":2024},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:10.179658Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:597ead532fa3b7ef839d491e9d9dbd81a2d923eef4ccfc0447f39efbfdddd6f5","observation_id":"356f85e1-a875-4683-9288-d2d161d1c280","resolution":{"observed_at":"2026-08-07T12:30:15.668493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:10.243781Z","title":"Nerf: Representing scenes as neural radiance fields for view synthesis.Communications of the ACM, 65 (1):99–106, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:10.243781Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:7c9a5c616729ed1f6eda9b2aef9f3628e7bceb375f54ac855395d928a8e044ed","observation_id":"823245af-8343-4f3f-9163-65b24bdf3767","resolution":{"observed_at":"2026-08-07T12:30:10.243781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:15.419044Z","title":"Filter pruning using hierarchical group sparse regularization for deep convolutional neural networks","venue":null,"work_id":"8f0c49c5-f2e5-4cc4-a3db-f2f6b4c5e593","year":2021},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:10.329509Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:3464fe1a4fc0bce143b461be5d5a1fda8a7e07dd2b7dbce913cb16939992ca7f","observation_id":"5ce90e4c-571c-4785-820b-960ce7ef4a52","resolution":{"observed_at":"2026-08-07T12:30:15.502536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:10.415504Z","title":"Spectral normalization for generative adversarial networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:10.415504Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:4bf7f0c3b133d73345f8a7b0feec553e2121392adf97643a522f2a6e3b214f38","observation_id":"2c92017a-51b0-415a-9ebd-481e973f9008","resolution":{"observed_at":"2026-08-07T12:30:10.415504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:15.196459Z","title":"Sosp: Efficiently capturing global correlations by second-order structured pruning","venue":null,"work_id":"030849e9-5600-4e57-9f81-91462ad74fc2","year":2022},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:10.509063Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:9282f54888c72352321dc78000baadb5056c1661680e15d340c883079ed3f291","observation_id":"b09925d0-381a-4ccc-b075-b11cbf8355bf","resolution":{"observed_at":"2026-08-07T12:30:15.320874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:14.913536Z","title":"Collaborative channel pruning for deep networks","venue":null,"work_id":"c787a03c-b3cd-4112-9661-cd2ab418c455","year":2019},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:10.577087Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:f5f8f51157cad4d9f985cdf349e4ef861154ed6ca3772949ed328afeb8a9aa04","observation_id":"f700f187-793d-4c54-820f-ed92befaaf7e","resolution":{"observed_at":"2026-08-07T12:30:15.075082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6550","last_updated":"2015-03-27T11:52:28Z","snapshot_observed_at":"2026-07-06T04:04:16.777653Z","submitted_at":"2014-12-19T22:40:51Z","title":"FitNets: Hints for Thin Deep Nets","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6550","snapshot_observed_at":"2026-08-07T12:30:10.651644Z","title":"Fitnets: Hints for thin deep nets.arXiv preprint arXiv:1412.6550, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:10.651644Z"},"links":{"cited_paper":"/paper/1412.6550","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:cc2ddd97b984dc367a4906fd7146664cffe2a8eb6b0c4de0f0c87862bacc5a57","observation_id":"df3ca50e-f62b-46c6-b574-26bf41002eed","resolution":{"observed_at":"2026-08-07T12:30:10.651644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.06496","last_updated":"2021-02-12T12:55:42Z","snapshot_observed_at":"2026-07-06T10:40:47.631261Z","submitted_at":"2021-02-12T12:55:42Z","title":"Depthwise Separable Convolutions Allow for Fast and Memory-Efficient Spectral Normalization","version":1},"cited_work":{"arxiv_id":"2102.06496","doi":null,"metadata_source":"pith","pith_arxiv_id":"2102.06496","snapshot_observed_at":"2026-08-07T12:30:12.535019Z","title":"Depthwise Separable Convolutions Allow for Fast and Memory-Efficient Spectral Normalization","venue":"cs.LG","work_id":"f7951f37-ff19-4fe8-9212-caf6c44fc33d","year":2021},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:10.749971Z"},"links":{"cited_paper":"/paper/2102.06496","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:f0a13e47689a32b5991fb6b5a495e074fdc982c972088d2496130649d8f9cfc4","observation_id":"1cb00309-c50c-44c2-b89b-aa9e0bb36dc4","resolution":{"observed_at":"2026-08-07T12:30:12.603457Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:10.834505Z","title":"Wire: Wavelet implicit neural representations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:10.834505Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:c3ece7f2ba401a0b10a68b2a9546a93d4c7ddefedd1de7c022526fe3d8937217","observation_id":"29a03df0-35dd-4ba8-afda-e54c76cc33d4","resolution":{"observed_at":"2026-08-07T12:30:10.834505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:14.655567Z","title":"The singular values of convolutional layers","venue":null,"work_id":"a02997bc-e93e-4fbc-90e3-20b7f1fb19d5","year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:10.924553Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:13d0ac634944c3e83e26f76465fda4c3334292ff4ccc22d83b6ab9bfbafbea63","observation_id":"9b27811b-2589-4bc3-9c50-da7ab81a02b3","resolution":{"observed_at":"2026-08-07T12:30:14.791545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:11.011353Z","title":"Implicit neural representations with periodic activation functions.Advances in neural information processing systems, 33:7462–7473, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:11.011353Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:eb931746e2ab7460a4d975aafc4991f272aed459031db6c06e49a83c59b34292","observation_id":"dfea235f-af04-45ac-bab3-68399366dcc3","resolution":{"observed_at":"2026-08-07T12:30:11.011353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:14.392611Z","title":"Robust large margin deep neural networks.IEEE Transactions on Signal Processing, 65(16):4265–4280, 2017","venue":null,"work_id":"9e3e60e3-f1d3-4ced-bdfe-89a04d0b42b4","year":2017},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:11.128789Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:903361cfaaa93cac55182738a225c178f66b63b30a32693a4e01b28a91a736eb","observation_id":"07ecfab4-9f10-4b8c-a693-46d845415260","resolution":{"observed_at":"2026-08-07T12:30:14.502950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:11.233891Z","title":"Integral neural networks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:11.233891Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:46a3a43780656d9f1f437eafb9266a8c06cbafec427a929df9894aa55c41ecab","observation_id":"de6c4a04-eef4-4a70-a377-14e36edd5d61","resolution":{"observed_at":"2026-08-07T12:30:11.233891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:11.329093Z","title":"A simple and effective pruning approach for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:11.329093Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:a3b868b7bec0000b54e1db78f6244abf01f7f4930f79402b2b20a069b771e616","observation_id":"25b8250a-658a-4321-81c2-8639e06aadfb","resolution":{"observed_at":"2026-08-07T12:30:11.329093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:14.235853Z","title":"Towards meta-pruning via optimal transport","venue":null,"work_id":"4a3c2744-be42-48ed-863e-8b255c1d5c90","year":2024},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:11.423972Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:e5acfe260cfeb7f8ec86393b002be9906b86e7f2cb21bdc16c9b23a614f093dd","observation_id":"9c0e4e31-695c-4a2a-b375-1243bae04866","resolution":{"observed_at":"2026-08-07T12:30:14.289511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:11.525199Z","title":"Training data-efficient image transformers & distillation through attention","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:11.525199Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:dc1f97299e063bc53fd9e1033fe7a8d894d7d7ea008cae1b953128b45c0e5f8e","observation_id":"cd7281f9-c8a9-4bf1-8203-2d8381bd874d","resolution":{"observed_at":"2026-08-07T12:30:11.525199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:14.038427Z","title":"Lipschitz-margin training: Scalable certification of perturbation invariance for deep neural networks.Advances in neural information processing systems, 31, 2018","venue":null,"work_id":"a87fd914-e6d5-46ef-b16d-0950bac22176","year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:11.601716Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:a2ac939f030b2bcb75f9f1416ec61617bb1c9ef1dc6e29fa8bb57aa001e40578","observation_id":"ef627779-e12f-43a3-a798-80e9bbac1e99","resolution":{"observed_at":"2026-08-07T12:30:14.107705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:13.852200Z","title":"Forget the data and fine-tuning! just fold the network to compress","venue":null,"work_id":"7119b07b-10cf-4e1e-b0e6-a588d672aa86","year":2025},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:11.675562Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:7a45a3e04cae151296c55d9b76b5590a91bcaf5b79e78796f15d1a86dbcd8222","observation_id":"806788f4-8af9-4435-9ae4-2c1fc976bb1e","resolution":{"observed_at":"2026-08-07T12:30:13.951007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:11.753936Z","title":"Learning structured sparsity in deep neural networks.Advances in neural information processing systems, 29, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:11.753936Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:fbd68479ed52d245f5630d8bdac9f14ebe0a7bad39f340e52016548c62cec8e0","observation_id":"d4091609-2533-4788-9a25-fb0ca7063412","resolution":{"observed_at":"2026-08-07T12:30:11.753936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:13.607342Z","title":"Model pruning based on filter similarity for edge device deployment.Frontiers in Neurorobotics, 17:1132679, 2023","venue":null,"work_id":"38b0351b-1892-42ca-afd5-cb1aebdcc498","year":2023},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:11.835580Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:9aa5d1d693802129405b72c5ed874699e34ef03324679cb161ecd5a773df7e91","observation_id":"4ea15573-6496-4653-9c74-28f6bedf26cc","resolution":{"observed_at":"2026-08-07T12:30:13.662753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:13.472754Z","title":"Neural metamorphosis","venue":null,"work_id":"7819ae2d-288d-4581-b66a-dd2248fb1fcb","year":2024},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:11.906554Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:c5c0efe8381ac897975fd8dab309b52d2dd0c60cce6bf1b83b0e202164a9a756","observation_id":"d9e962da-cdbe-41c4-b307-6ebef71aa6a3","resolution":{"observed_at":"2026-08-07T12:30:13.538403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:13.317956Z","title":"Rethinking the smaller-norm-less-informative assumption in channel pruning of convolution layers","venue":null,"work_id":"b53859e1-a522-4e6b-8b33-83af8120ebe0","year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:11.978856Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:4a87fb69969c10c0104e91967ed97c93598ada186e44d75b1dce885b2a2969ad","observation_id":"ccb613b8-5cb5-40a6-b236-d6c3a3fa6b81","resolution":{"observed_at":"2026-08-07T12:30:13.400378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.10941","last_updated":"2017-05-31T04:56:25Z","snapshot_observed_at":"2026-08-05T12:22:57.956907Z","submitted_at":"2017-05-31T04:56:25Z","title":"Spectral Norm Regularization for Improving the Generalizability of Deep Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.10941","snapshot_observed_at":"2026-08-07T12:30:12.050286Z","title":"Spectral norm regularization for improving the generalizability of deep learning.arXiv preprint arXiv:1705.10941, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:12.050286Z"},"links":{"cited_paper":"/paper/1705.10941","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:cd3528481b0870fd302fa41547867a537ba349a82320cd839de22bd7f757a582","observation_id":"31d164b4-ec61-48b2-87a1-9bed53a19259","resolution":{"observed_at":"2026-08-07T12:30:12.050286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:13.171426Z","title":"Gate decorator: Global filter pruning method for accelerating deep convolutional neural networks.Advances in neural information processing systems, 32, 2019","venue":null,"work_id":"bf9621d3-8a8b-470a-95dd-e0798c562ca6","year":2019},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:12.121087Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:f4619d6d25b8badd3997c0c68d229474764f039fd511e261cad1155054005365","observation_id":"bbbf23a1-e817-406c-8b58-35470c7015ac","resolution":{"observed_at":"2026-08-07T12:30:13.252857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:13.002145Z","title":"On compressing deep models by low rank and sparse decomposition","venue":null,"work_id":"19ef7545-dcce-4b39-9ab8-fe5c3e683fea","year":2017},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:12.224939Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:263419bccde0489ab9d360fa1dc656ef4440b1b92b89def1c03662a42078cbfa","observation_id":"19c37776-a671-4ed0-9834-b4c32ed4a507","resolution":{"observed_at":"2026-08-07T12:30:13.076371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:12.323559Z","title":"Be your own teacher: Improve the performance of convolutional neural networks via self distillation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:12.323559Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:56b12b63d93a67f3fece1f07b84a47a979d57153502f1c7b52cf709702685a41","observation_id":"310d3b94-e89e-482a-b1fe-8a4fb9a189f9","resolution":{"observed_at":"2026-08-07T12:30:12.323559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06160","last_updated":"2018-02-02T01:43:54Z","snapshot_observed_at":"2026-07-06T05:00:35.763958Z","submitted_at":"2016-06-20T15:02:31Z","title":"DoReFa-Net: Training Low Bitwidth Convolutional Neural Networks with Low Bitwidth Gradients","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06160","snapshot_observed_at":"2026-08-07T12:30:12.402648Z","title":"layers.0.0.conv1","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:12.402648Z"},"links":{"cited_paper":"/paper/1606.06160","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:20116cee3a8f79d072655d715e5a6d2dcad510fdd2d2b7e35d41da4944a9c729","observation_id":"b59b0ab9-b085-4985-9e5d-5f5a6a4b91f7","resolution":{"observed_at":"2026-08-07T12:30:12.402648Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T08:39:51.141542Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":2,"verified_fuzzy":29},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 0 inbound Pith citation observations for arXiv:2505.24469."}