{"as_of":"2026-08-11T22:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5677c25bcd027a3c97977549cb6496240604052a5b8248e732cdd48f1f7b39a2","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T13:08:44.933146Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.13488/citation-record","integrity":"/paper/2412.13488/integrity","json":"/paper/2412.13488/citation-record.json","paper":"/paper/2412.13488"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:43.886538Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:43.886538Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:b8c390653b572867a07ffe56c0c61bc01e3306f620cd4a4c1c4bc0da28c6ccca","observation_id":"2159657d-2a9b-4b7a-ad0d-a983948562c1","resolution":{"observed_at":"2026-08-11T13:08:43.886538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:43.938551Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:43.938551Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:4b34c598f636fe9bd9cc23dc3f8ce5c90546e5ecf79c9ebeab4d6f5187e893dd","observation_id":"e1d587fa-b9d0-4244-bc37-87c0c2b8cddb","resolution":{"observed_at":"2026-08-11T13:08:43.938551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.802696Z","title":"https://www.amd.com/en/products/accelerators/instinct/mi300.html","venue":null,"work_id":"2dc772db-9cfa-45b8-824b-5f2c51052c46","year":2024},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:43.947420Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:75015b31ac8c88f4f9a1f644a0bb1aed7c6272e8009a6f976b6deeed89f7671c","observation_id":"3ba99d20-13bd-42d3-8870-bbedc79a649f","resolution":{"observed_at":"2026-08-11T13:08:46.811594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07560","last_updated":"2023-02-09T10:54:10Z","snapshot_observed_at":"2026-07-06T11:57:58.353688Z","submitted_at":"2021-10-14T17:27:29Z","title":"Composable Sparse Fine-Tuning for Cross-Lingual Transfer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07560","snapshot_observed_at":"2026-08-11T13:08:43.955299Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:43.955299Z"},"links":{"cited_paper":"/paper/2110.07560","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:e8126d80bf0b8b55bf2b81f9e708c2db9a7f02b6937e4a573f9ccb9c1b51b563","observation_id":"e9416622-6e64-4203-b7fa-15319359874e","resolution":{"observed_at":"2026-08-11T13:08:43.955299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-11T13:08:43.963206Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:43.963206Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:fa7c3a66525a541cb5802e956a8f1f41529115ccda9b9f6953ba480718a228d1","observation_id":"c3bb3309-b44d-42d7-bbcf-5355f24807fc","resolution":{"observed_at":"2026-08-11T13:08:43.963206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1308.3432","last_updated":"2013-08-15T15:19:34Z","snapshot_observed_at":"2026-08-11T05:54:56.124984Z","submitted_at":"2013-08-15T15:19:34Z","title":"Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1308.3432","snapshot_observed_at":"2026-08-11T13:08:43.970986Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:43.970986Z"},"links":{"cited_paper":"/paper/1308.3432","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:bdcfb4c17bfd895f3e68ed86ee56d965e0c5b455a854dbe57dd547d697b073a0","observation_id":"7d0aaeac-8a9c-4001-a27c-7a38def01a55","resolution":{"observed_at":"2026-08-11T13:08:43.970986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:43.977961Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:43.977961Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:e9c9c895a6614fe792ddb821673a06520bb8d589cc39547fffa6bb5426c00149","observation_id":"4e648c15-2cb4-45b1-b151-e25cc280dd6e","resolution":{"observed_at":"2026-08-11T13:08:43.977961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-11T13:08:43.986062Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:43.986062Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:348a4fa9fecfbf1ffb6ac40a6915023428cc56844deb194ef5333d0fdd6b4638","observation_id":"69ecb653-ba1f-4dc4-9f2e-8cbfcad26b45","resolution":{"observed_at":"2026-08-11T13:08:43.986062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.739633Z","title":null,"venue":null,"work_id":"98912ca3-5b4b-4628-a568-26aaa95f2b6a","year":2023},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:43.995613Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:ee24e6007a9c9ae2aabd7556a4a742db1fffa83a824fa990ee8b7da013fa2908","observation_id":"b25bd934-da3b-4f19-b27a-40ab274809f5","resolution":{"observed_at":"2026-08-11T13:08:46.757253Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.678788Z","title":null,"venue":null,"work_id":"942231fe-aab5-4df3-a065-d16d0a4d89ea","year":2021},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.007349Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:9bb8038843e10a4184010a5d042038a22fcc3c5c665a1cb7002661f335a24a97","observation_id":"0edb2456-eba7-49ec-8ecd-2d64f90deb80","resolution":{"observed_at":"2026-08-11T13:08:46.721649Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-11T13:08:44.036019Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.036019Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:56768bbe42aabaef82918233e92e865967ce7eff34037284292d33cb959c9440","observation_id":"fd6edc2e-fe9e-428c-9cf2-6665d341eda2","resolution":{"observed_at":"2026-08-11T13:08:44.036019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03748","last_updated":"2023-11-07T06:19:37Z","snapshot_observed_at":"2026-08-08T22:59:37.561433Z","submitted_at":"2023-11-07T06:19:37Z","title":"Unified Low-Resource Sequence Labeling by Sample-Aware Dynamic Sparse Finetuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03748","snapshot_observed_at":"2026-08-11T13:08:44.071767Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.071767Z"},"links":{"cited_paper":"/paper/2311.03748","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:aba7e29b7ea7e397f840a50e559af747dce210e60cd3ea6d012fc2b306b654dd","observation_id":"420d26a3-864e-42e0-a457-790519ffc06c","resolution":{"observed_at":"2026-08-11T13:08:44.071767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.644723Z","title":null,"venue":null,"work_id":"aaee56ed-9111-4e33-b66f-0954aebe2856","year":2021},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.108077Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:020015d3e80ba89a91bce9d283ff6fae76bc464c18657df1d18239d9635e15c9","observation_id":"f3a1b39a-7270-4d9a-9038-b09a97b483ee","resolution":{"observed_at":"2026-08-11T13:08:46.653130Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-11T13:08:44.158346Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.158346Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:c02d81a84dfa9fce7f01e3ae0823abfc43273e0f1f8785d0e4e50eeefa9102ac","observation_id":"c04fa806-6e6e-444e-b0c0-6fb759f623ee","resolution":{"observed_at":"2026-08-11T13:08:44.158346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:44.166495Z","title":"Dolan and Chris Brockett","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.166495Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:59853828a436261f505dbfe4eac8731a56906407cb80a99b4372beeaa717fcbe","observation_id":"1fd2b719-6ec1-43c6-b7c2-90e51135841d","resolution":{"observed_at":"2026-08-11T13:08:44.166495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.580224Z","title":null,"venue":null,"work_id":"c37acaad-f469-4e3c-877b-2419b90017f4","year":2019},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.175881Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:b1844313963a2d136309c276b417cb0bfddb24464b427dc5588d14c21bd15884","observation_id":"ae27d535-a7c8-409d-86d4-02e9b32d273e","resolution":{"observed_at":"2026-08-11T13:08:46.609238Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-11T13:08:44.184507Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.184507Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:4bc960e5204870762fe3a657319c8bafdab69949f432a4ff6697905e5c641675","observation_id":"40dbb497-8295-4922-bf2a-ea6f0e4f3507","resolution":{"observed_at":"2026-08-11T13:08:44.184507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07463","last_updated":"2021-06-09T14:39:17Z","snapshot_observed_at":"2026-08-10T10:06:48.397353Z","submitted_at":"2020-12-14T12:34:01Z","title":"Parameter-Efficient Transfer Learning with Diff Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07463","snapshot_observed_at":"2026-08-11T13:08:44.192819Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.192819Z"},"links":{"cited_paper":"/paper/2012.07463","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:92d1e9d9f8597aed0cff90a16c59faadb403f9b134154d86a96d0d3c01278d00","observation_id":"a786ad46-16c8-4aab-b800-be76e2c6ae7e","resolution":{"observed_at":"2026-08-11T13:08:44.192819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1510.00149","last_updated":"2016-02-15T06:25:40Z","snapshot_observed_at":"2026-08-04T16:59:47.843960Z","submitted_at":"2015-10-01T09:03:44Z","title":"Deep Compression: Compressing Deep Neural Networks with Pruning, Trained Quantization and Huffman Coding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.00149","snapshot_observed_at":"2026-08-11T13:08:44.201236Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.201236Z"},"links":{"cited_paper":"/paper/1510.00149","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:1827c004a6cbea2de2aea94bffcf08545b35a94151bedd7dfffa1aa5752f152c","observation_id":"a2b26195-4d31-46fb-aeb0-6b151242b7e6","resolution":{"observed_at":"2026-08-11T13:08:44.201236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-10T12:35:09.020030Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-11T13:08:44.270763Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.270763Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:b850ae26f98bca9bd41cb84e4023f14158974c08e2695a2740c6c6b0f2b957eb","observation_id":"d967add3-3c2a-4459-842e-f3a01dbe422e","resolution":{"observed_at":"2026-08-11T13:08:44.270763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-11T13:08:44.363545Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.363545Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:4b4be6d5648ac51ead181bd2b1d97bfe20e27dad6cea395dabbdb303b5c9ba72","observation_id":"b518c8b9-bde3-4890-91dd-8def499193bd","resolution":{"observed_at":"2026-08-11T13:08:44.363545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.462505Z","title":null,"venue":null,"work_id":"f915f083-02e5-42bb-ab11-861739f79f34","year":2016},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.409013Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:dada3c64031786bf3a0d5e8523f628ca1b88f2b24415bb0fccbacf72283ee072","observation_id":"595ee46e-efbe-49fc-a648-8f9ba8c9b334","resolution":{"observed_at":"2026-08-11T13:08:46.503029Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07327","last_updated":"2023-10-31T11:38:07Z","snapshot_observed_at":"2026-08-06T15:18:02.072435Z","submitted_at":"2023-04-14T18:01:29Z","title":"OpenAssistant Conversations -- Democratizing Large Language Model Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07327","snapshot_observed_at":"2026-08-11T13:08:44.417263Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.417263Z"},"links":{"cited_paper":"/paper/2304.07327","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:1a39975fa08046cdd8c51ad5bf3d2caf4273d9813a78ff298628860fa237f336","observation_id":"acee3235-c3ad-40ef-afc3-5377c8c3b31d","resolution":{"observed_at":"2026-08-11T13:08:44.417263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.11942","last_updated":"2020-02-09T03:00:18Z","snapshot_observed_at":"2026-07-06T08:24:44.631342Z","submitted_at":"2019-09-26T07:06:13Z","title":"ALBERT: A Lite BERT for Self-supervised Learning of Language Representations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.11942","snapshot_observed_at":"2026-08-11T13:08:44.425013Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.425013Z"},"links":{"cited_paper":"/paper/1909.11942","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:ceed9e67d9ee28b2be1ce83982a781c76e7e561ec698535bc0e53e0e16e0fe4d","observation_id":"fb5641c4-d03d-4304-af14-bcd851f47080","resolution":{"observed_at":"2026-08-11T13:08:44.425013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:44.432653Z","title":null,"venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.432653Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:ae591e55c98ca751cebe89e6db369ab366e4e0d9f2be86477bdf8b7b6b237df5","observation_id":"5a738634-c189-463c-a88b-7b4907c969b9","resolution":{"observed_at":"2026-08-11T13:08:44.432653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.413676Z","title":null,"venue":null,"work_id":"0cd85250-9d65-40d5-a55c-484c36c79a60","year":2019},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.440453Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:9730232abc2387e36b400e19f63130d09842e46d6d6d0cb8e5b5481db86ab4ac","observation_id":"b53dfac0-84e9-410e-a4b1-1d330fe4e6a2","resolution":{"observed_at":"2026-08-11T13:08:46.422270Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02340","last_updated":"2019-02-23T07:45:29Z","snapshot_observed_at":"2026-07-06T07:06:10.289386Z","submitted_at":"2018-10-04T17:39:58Z","title":"SNIP: Single-shot Network Pruning based on Connection Sensitivity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02340","snapshot_observed_at":"2026-08-11T13:08:44.446544Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.446544Z"},"links":{"cited_paper":"/paper/1810.02340","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:1ddad2c121cd52c5e7703f93c1de038195d280a38f7f792d0f4b0253efd52119","observation_id":"4c99056b-e021-49ba-ad84-7e59dcbae68b","resolution":{"observed_at":"2026-08-11T13:08:44.446544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.376808Z","title":null,"venue":null,"work_id":"7011d33b-4ce9-4aa6-97c3-3ed6ceafb0c7","year":2021},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.477140Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:c6aa912d326b962b7db25a08ab9dc12d1cbdbb6a476ccda63699e4abcbdd2fd8","observation_id":"c7bee93d-6b39-4f0c-9aef-4c15747b1c31","resolution":{"observed_at":"2026-08-11T13:08:46.386924Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-11T13:08:44.509912Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.509912Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:bbc39007cce859f20ad6e0ce32c888cc094eb7662811ae7f91118b17b3fe0184","observation_id":"d2deea00-573a-4069-aa60-eafd92701cf1","resolution":{"observed_at":"2026-08-11T13:08:44.509912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:44.547906Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.547906Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:e6d9b1ced21e2afb950b1d0e3b31e58817c4faf0987a3429fc388d88dbe33109","observation_id":"00258c3e-efe1-41b2-8911-359b6dcebd2e","resolution":{"observed_at":"2026-08-11T13:08:44.547906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02948","last_updated":"2025-04-09T06:54:20Z","snapshot_observed_at":"2026-08-09T04:47:57.368711Z","submitted_at":"2024-04-03T15:06:43Z","title":"PiSSA: Principal Singular Values and Singular Vectors Adaptation of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02948","snapshot_observed_at":"2026-08-11T13:08:44.553681Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.553681Z"},"links":{"cited_paper":"/paper/2404.02948","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:818ca9b2cde992e53156806d6f98355c0e47f83abcfd1c23f809d011336e2c88","observation_id":"c3c788a1-5430-4572-b765-0e934e9ff1a5","resolution":{"observed_at":"2026-08-11T13:08:44.553681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.237986Z","title":null,"venue":null,"work_id":"52718a54-4ca8-4bf1-b05a-ffd9745b88c1","year":2019},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.564056Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:575d5d1537f4390a8da3253d65b877397707545d11f34eba64f0c57dd1c5e9c4","observation_id":"2d5ab9d4-e75d-47bd-a4ef-fa270f7e0472","resolution":{"observed_at":"2026-08-11T13:08:46.291912Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.207761Z","title":null,"venue":null,"work_id":"04342a24-bedd-4d3f-8bad-54917ca53de1","year":2022},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.572093Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:a6ca1c041e033825e201922c1e39c07e8a7f22b6ed65fe79b4037521a9261269","observation_id":"6b1e9760-afd7-4679-b7b1-fae5cd176150","resolution":{"observed_at":"2026-08-11T13:08:46.216675Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.09777","last_updated":"2022-04-14T15:23:32Z","snapshot_observed_at":"2026-07-06T09:49:17.164814Z","submitted_at":"2020-08-22T08:15:52Z","title":"Surrogate NAS Benchmarks: Going Beyond the Limited Search Spaces of Tabular NAS Benchmarks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.09777","snapshot_observed_at":"2026-08-11T13:08:44.579420Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.579420Z"},"links":{"cited_paper":"/paper/2008.09777","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:3ff93decef6d9be3deac3ae4862e8080230806115591c1d3e12961acd44e29b1","observation_id":"3cde09d5-c9b7-43d6-8ea8-df87b14bdfce","resolution":{"observed_at":"2026-08-11T13:08:44.579420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.121645Z","title":null,"venue":null,"work_id":"450759b4-a7b8-498b-be94-cc16e8255ba0","year":2020},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.586290Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:6c2299bcd7a40f021a0a8c9ee3be4ce2cd738500ef722e226cb72a959b3f7bfa","observation_id":"96830ecd-fa77-4af8-944d-331b072010f3","resolution":{"observed_at":"2026-08-11T13:08:46.177611Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.094329Z","title":null,"venue":null,"work_id":"450c8641-732b-41b5-88e5-21789d5ce4ac","year":2021},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.595129Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:e2d9ae68c1bb9377503f3693bdf28321d1dc6a38df824d75a8fa64dc26b56d3a","observation_id":"751db91f-c272-4e1a-bc50-1052757f6980","resolution":{"observed_at":"2026-08-11T13:08:46.104909Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:46.057790Z","title":null,"venue":null,"work_id":"2301175a-e3aa-49e4-8ab5-600efda63ff1","year":2020},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.601629Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:ed8f38079b8389df48ffda0f4bee047db7ca44ce8f3c2c4d5867232e398632e3","observation_id":"6d460b70-7929-4360-923e-8754b63a4818","resolution":{"observed_at":"2026-08-11T13:08:46.064686Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:44.611155Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.611155Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:4826f27b50b638ade29335e7df63698ce7622b2b852b4bbe2fd8a118fd6fee89","observation_id":"dc6f652a-5ceb-49a6-832d-45f862509ebe","resolution":{"observed_at":"2026-08-11T13:08:44.611155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-11T13:08:44.711848Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.711848Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:3449238e9fa9b909affc9c6f9d5a40c493fbf5a9ade435e0681332525fb14a2b","observation_id":"cc2f1e2f-8ac5-46c9-99ca-917f3fc6c123","resolution":{"observed_at":"2026-08-11T13:08:44.711848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07461","last_updated":"2019-02-22T23:53:34Z","snapshot_observed_at":"2026-07-06T06:34:26.609892Z","submitted_at":"2018-04-20T06:35:04Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.07461","snapshot_observed_at":"2026-08-11T13:08:44.797442Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.797442Z"},"links":{"cited_paper":"/paper/1804.07461","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:b5e6479778a3f5da008b5129c1d4e5c5e137a6ad9e27baff72f23729abb6db99","observation_id":"bc2e8def-2054-4aac-a4f7-1044641597a2","resolution":{"observed_at":"2026-08-11T13:08:44.797442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:45.968991Z","title":null,"venue":null,"work_id":"2889f865-7f40-44af-adf6-b1e2030bd33a","year":2020},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.894327Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:0e376cb339bc57150c656189009c4fd14ebe0ea541ef4767c599df6dc7f0e600","observation_id":"669cd79e-7205-4e85-bd95-b36f437ce94c","resolution":{"observed_at":"2026-08-11T13:08:45.997279Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:08:44.902467Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.902467Z"},"links":{"citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:29e0b16ad5758bd175385c370e69ad376937ab7584f23e188255bfc127b64b8b","observation_id":"bcc2531d-3ab9-4ae3-b0be-86e76e8cd7ee","resolution":{"observed_at":"2026-08-11T13:08:44.902467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-11T13:08:44.910387Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.910387Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:faf32cbb48fb6e05faf02da153144f9e2e8d7992a5b99d4691771577b6bf101e","observation_id":"306d8cd4-1e53-47ee-8762-65966a468240","resolution":{"observed_at":"2026-08-11T13:08:44.910387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12284","last_updated":"2024-05-03T17:36:07Z","snapshot_observed_at":"2026-08-02T15:00:50.388422Z","submitted_at":"2023-09-21T17:45:42Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12284","snapshot_observed_at":"2026-08-11T13:08:44.917527Z","title":"Kwok, Zhenguo Li, Adrian Weller, and Weiyang Liu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.917527Z"},"links":{"cited_paper":"/paper/2309.12284","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:a3b0253bef0cbbe9a31d209b19471e31cf9baad50f1d721baaaa826ad337cf2f","observation_id":"2c5deaa6-980e-4f1e-be74-e6322fc5a8fe","resolution":{"observed_at":"2026-08-11T13:08:44.917527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-11T13:08:44.925209Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.925209Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:3f7f94f48b704e4de7b56bc8ee0b8b962aadc69620e0bfd5cb4cdc42befaa242","observation_id":"8c7f400d-ecd8-4e4f-bd07-7bd56adc46af","resolution":{"observed_at":"2026-08-11T13:08:44.925209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14658","last_updated":"2025-01-07T05:37:04Z","snapshot_observed_at":"2026-08-06T03:14:31.781649Z","submitted_at":"2024-02-22T16:06:23Z","title":"OpenCodeInterpreter: Integrating Code Generation with Execution and Refinement","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14658","snapshot_observed_at":"2026-08-11T13:08:44.933146Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:44.933146Z"},"links":{"cited_paper":"/paper/2402.14658","citing_paper":"/paper/2412.13488"},"observation_digest":"sha256:be7a55683527ef236f6cc5df2f53657dd7ab48b755fd44d9e7266be8ae03c487","observation_id":"dd6de7a9-09d4-4921-afa7-57ed09be6e0b","resolution":{"observed_at":"2026-08-11T13:08:44.933146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.13488","last_updated":"2025-06-27T12:34:59Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T13:02:55.661880Z","submitted_at":"2024-12-18T04:14:35Z","title":"Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 0 inbound Pith citation observations for arXiv:2412.13488."}