{"as_of":"2026-08-18T00:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:03294720ad5e524d9a4a8ec0dc5cc32347569fe64b6c7491a0563531b5b6bd68","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T11:56:59.870638Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.22349/citation-record","integrity":"/paper/2507.22349/integrity","json":"/paper/2507.22349/citation-record.json","paper":"/paper/2507.22349"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:57:00.197941Z","title":"Post train- ing 4-bit quantization of convolutional networks for rapid- deployment","venue":null,"work_id":"f76695b8-97e9-4ca4-bda5-588ddda4b94c","year":2019},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.761043Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:e0453d5b60920f01a9470767161978a29cd5bdf91b096b2c3422c7b2c1ff9048","observation_id":"2790afa1-04eb-4bb5-9f1f-2ebf7c315c2e","resolution":{"observed_at":"2026-08-06T11:57:00.201098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:57:00.189254Z","title":"Dory: Automatic end-to-end deployment of real-world dnns on low-cost iot mcus","venue":null,"work_id":"d3be271e-7454-4696-bc10-1c3c4ccaa9b5","year":2021},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.764720Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:4379b617c31eb3d53dfa6ff9d0e01ae27235b1309ec44b4df88a40d5e95e8589","observation_id":"47c6628a-a786-4314-b52a-779c2e6a15db","resolution":{"observed_at":"2026-08-06T11:57:00.192400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.06085","last_updated":"2018-07-17T07:33:19Z","snapshot_observed_at":"2026-08-17T06:12:39.940205Z","submitted_at":"2018-05-16T01:19:43Z","title":"PACT: Parameterized Clipping Activation for Quantized Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.06085","snapshot_observed_at":"2026-08-06T11:56:59.767955Z","title":"Pact: Parameterized clipping activa- tion for quantized neural networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.767955Z"},"links":{"cited_paper":"/paper/1805.06085","citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:01726cad9e63d607d02dbfd5c42fa92de52231aa45c693213cd0de359da59fdc","observation_id":"ce360dc3-cc38-406c-be8f-d7b66c5567a3","resolution":{"observed_at":"2026-08-06T11:56:59.767955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:56:59.771547Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.771547Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:130880ddbf2b05c92c2372c1a79ea22928180f2cd855228d5720e92f700af24a","observation_id":"5c3f5361-fa23-4a51-9d21-8bd570c9e763","resolution":{"observed_at":"2026-08-06T11:56:59.771547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:57:00.175263Z","title":"Hawq: Hessian aware quantization of neural networks with mixed-precision","venue":null,"work_id":"65cd21b8-ad5f-4326-8546-437f8d470950","year":2019},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.774577Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:eb64f092fe4a6ba7f7a55f9eab86c2c3cc43673ef57065910e867638b7f53b0b","observation_id":"76c8ebd0-f440-4a8e-b7ff-7c33b6d33f35","resolution":{"observed_at":"2026-08-06T11:57:00.178338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:57:00.167260Z","title":"Hawq-v2: Hessian aware trace-weighted quantization of neural networks","venue":null,"work_id":"24c54506-1799-42b3-b39d-e6d56ae31c61","year":2020},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.777588Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:f3a5143a6fa61486b06c8bf5f37909ba3fcb7e9c55a41c6a466a7eaeadfe5638","observation_id":"9f9bf3e4-9e2f-4072-a778-d767162d9ece","resolution":{"observed_at":"2026-08-06T11:57:00.170191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.08153","last_updated":"2020-05-07T03:30:49Z","snapshot_observed_at":"2026-08-14T17:13:05.593256Z","submitted_at":"2019-02-21T17:31:32Z","title":"Learned Step Size Quantization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.08153","snapshot_observed_at":"2026-08-06T11:56:59.780872Z","title":"Esser, John L","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.780872Z"},"links":{"cited_paper":"/paper/1902.08153","citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:e6fd922018e05369e2e581688a963f65a289a83f479b13864454fe689eacbf11","observation_id":"4a647b1d-9898-4422-b763-fdba6849a14c","resolution":{"observed_at":"2026-08-06T11:56:59.780872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.07471","last_updated":"2022-02-14T01:57:33Z","snapshot_observed_at":"2026-08-16T17:21:36.627060Z","submitted_at":"2022-02-14T01:57:33Z","title":"SQuant: On-the-Fly Data-Free Quantization via Diagonal Hessian Approximation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.07471","snapshot_observed_at":"2026-08-06T11:56:59.784156Z","title":"Squant: On-the-ﬂy data-free quantization via diagonal hes- sian approximation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.784156Z"},"links":{"cited_paper":"/paper/2202.07471","citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:8d181f7ea0c95d4a77c5976ff60e9efa4e4ab8d02158b8f6b1e12ce4b1b114c2","observation_id":"47810d93-d8ca-47eb-9113-4834c570388d","resolution":{"observed_at":"2026-08-06T11:56:59.784156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:57:00.159003Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"065ffecd-a1a7-43aa-816f-8bb7baf1766c","year":2016},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.787354Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:cb20da48cd7c73f70012bffaa79e5ef1639f0589d8f75ecc1c9fea6fb25ef65f","observation_id":"4e3ecd63-5772-4b95-9893-ae1b4f507cb3","resolution":{"observed_at":"2026-08-06T11:57:00.161977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:57:00.151141Z","title":"1.1 computing’s energy problem (and what we can do about it)","venue":null,"work_id":"45f25d80-55c5-4f92-bc60-dfe4c9f5af25","year":2014},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.790062Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:1884213dbf81a64d957add2c568eea9d1c2abca648bae772b872c86573742b58","observation_id":"808161fd-9c0a-42ba-a729-8985206dcd97","resolution":{"observed_at":"2026-08-06T11:57:00.154019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.02244","last_updated":"2019-11-20T17:26:40Z","snapshot_observed_at":"2026-08-17T11:57:08.807566Z","submitted_at":"2019-05-06T19:38:31Z","title":"Searching for MobileNetV3","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.02244","snapshot_observed_at":"2026-08-06T11:56:59.792872Z","title":"Le, and Hartwig Adam","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.792872Z"},"links":{"cited_paper":"/paper/1905.02244","citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:e4602c26d75e0350c5d0b2ac46b2f33e489bdb595eca2765ae1490e305a6a0d9","observation_id":"6e01ed75-1705-477f-8b6b-a0a776a1311f","resolution":{"observed_at":"2026-08-06T11:56:59.792872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:57:00.142992Z","title":"Squeeze-and-excitation net- works","venue":null,"work_id":"036d52f8-b055-4f91-9e08-ac885ced7bb6","year":2018},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.796280Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:dd97f616dfcbc5a1122f86be76acd4d4404da2e92aa51b09bfb562b59a492f4b","observation_id":"fd9daa6e-2588-42c5-81bb-d13199387411","resolution":{"observed_at":"2026-08-06T11:57:00.146062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:57:00.134664Z","title":"Learning multiple layers of features from tiny images","venue":null,"work_id":"30d3a189-4fae-405e-849a-3a8105fd8b42","year":2009},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.798968Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:64b3afb4bce372923b274399a384df216023588d250310523f8748575dace657","observation_id":"b3218a98-e628-41b8-ba1c-abb2d8740412","resolution":{"observed_at":"2026-08-06T11:57:00.137749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:57:00.126046Z","title":"Q-vit: Accurate and fully quantized low-bit vision transformer","venue":null,"work_id":"71a766fc-0a96-4225-ad9e-7bb9b3a29c2a","year":2022},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.801761Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:33b5a19ee7659811e07c3246e420083e912ba345b313b273337c93342a3773eb","observation_id":"29549d4d-8e09-4167-8a9d-d2789916b927","resolution":{"observed_at":"2026-08-06T11:57:00.129144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:57:00.117834Z","title":"Oscillation-free quantization for low-bit vision transformers","venue":null,"work_id":"3b9a3377-0501-4561-a3bb-d60875220c2c","year":2023},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.804436Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:c7a2d4c13f6fdf735942b9107dacf1094151c06871ba389fc139fc86d8e0118c","observation_id":"bbcc7037-aa21-4ae5-a958-affc13d0059a","resolution":{"observed_at":"2026-08-06T11:57:00.120945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:57:00.109362Z","title":"Noisyquant: Noisy bias-enhanced post-training activation quantization for vision transformers","venue":null,"work_id":"a2bd5261-4171-4037-a7b7-de0509861e9b","year":2023},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.807281Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:b8e0ee43e76b00833e5834eb0c0a45eade039712fe1cf84f420d64dcff3d9206","observation_id":"ba5a3269-f7db-4ff3-bfb0-56a0a33679b0","resolution":{"observed_at":"2026-08-06T11:57:00.112388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:57:00.101026Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":"cc164ef9-717e-4460-8523-3ba7913b6df8","year":2021},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.810033Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:d2af305cdbb2a610935ee534e88ecbe8146bf0e06df458f391ed14c44a28403b","observation_id":"8384dec6-3c63-46be-b8fc-a00b5bff3a9e","resolution":{"observed_at":"2026-08-06T11:57:00.104062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:57:00.092679Z","title":"Up or down? adap- tive rounding for post-training quantization","venue":null,"work_id":"fa13d713-678f-4681-82af-bb332795a3d6","year":2020},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.812665Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:c8db0fb22d5a37b6fc60cb28dd7e9bc29fd584aa2c6452fd9ec306ae20119cb3","observation_id":"94bae949-d196-43cb-8cb2-a264d3c52ca9","resolution":{"observed_at":"2026-08-06T11:57:00.095757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06357","last_updated":"2025-01-10T21:36:20Z","snapshot_observed_at":"2026-08-16T12:59:14.529017Z","submitted_at":"2025-01-10T21:36:20Z","title":"Mix-QViT: Mixed-Precision Vision Transformer Quantization Driven by Layer Importance and Quantization Sensitivity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.06357","snapshot_observed_at":"2026-08-06T11:56:59.815422Z","title":"Mix-qvit: Mixed- precision vision transformer quantization driven by layer importance and quantization sensitivity","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.815422Z"},"links":{"cited_paper":"/paper/2501.06357","citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:bade5b766c278b64dea26143e84fd015781c259cafeac13f742df422cd68327f","observation_id":"081af1ac-1832-47bb-9540-3aabfd51c68d","resolution":{"observed_at":"2026-08-06T11:56:59.815422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:57:00.084664Z","title":"Mobilenetv2: Inverted residuals and linear bottlenecks","venue":null,"work_id":"fff0f55a-0307-4799-b935-2fef968086fb","year":2018},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.818397Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:b26aae8842931a6db884be2e9419ec68cfb66d86361c1bf304273cf721b82592","observation_id":"650c7e64-a4b1-4618-ae85-ac729df13b16","resolution":{"observed_at":"2026-08-06T11:57:00.087726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:57:00.076291Z","title":"Winning the lottery with continuous sparsiﬁcation","venue":null,"work_id":"af7d6480-269c-4e3b-8797-46398c14ce0d","year":2020},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.821087Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:57b20123e4e2ca921135b90b9675f154c3db55de313386e467d9ff5f9692ccff","observation_id":"7b7da998-d387-48a2-b7ab-19195b0ccecb","resolution":{"observed_at":"2026-08-06T11:57:00.079483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:57:00.067894Z","title":"Training data-efﬁcient image transformers & distillation through at- tention","venue":null,"work_id":"084efdcd-c6f1-4f0a-8cd1-f8fb5cbfeeb4","year":2021},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.823905Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:32c684a78f798b059c8dcd4befba17d4c6189c31389ebde781e6bb936ee596c6","observation_id":"5b9bb181-16b9-4cec-9616-e0edcbfb5bf2","resolution":{"observed_at":"2026-08-06T11:57:00.070997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:57:00.059595Z","title":"Haq: Hardware-aware automated quantization with mixed precision","venue":null,"work_id":"ff0ddff3-bbf4-4c84-9e49-4b77480d2d75","year":2019},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.827793Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:3484912215ac14828b385a94b7655ee79b4476623edc478440bce2105bca2519","observation_id":"86430e71-926d-4670-b7e1-bbe6755ebf46","resolution":{"observed_at":"2026-08-06T11:57:00.062740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:57:00.050912Z","title":"Fbnet: Hardware-aware efﬁcient con- vnet design via differentiable neural architecture search","venue":null,"work_id":"5f793998-51e3-4ea1-a97e-043d4191729d","year":2019},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.831380Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:968817caa034c12ac396b5ea216c554390f0249ae4ed38a28b5ad16ee126f5f9","observation_id":"2d49307d-170e-496d-a9f6-71c882adda41","resolution":{"observed_at":"2026-08-06T11:57:00.054459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:57:00.042498Z","title":"Smoothquant: Accurate and efﬁ- cient post-training quantization for large language models","venue":null,"work_id":"69fea213-2780-4305-8202-168096a0f658","year":2023},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.834664Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:b350058d23b638cbc4b2a49d5a677f1f748b8b38cdbe1fca3ffa404f74ea291c","observation_id":"bf27856f-74e4-4df1-9fe6-0311da771d86","resolution":{"observed_at":"2026-08-06T11:57:00.045774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:57:00.033483Z","title":"Csq: Growing mixed-precision quantization scheme with bi-level continuous sparsiﬁcation","venue":null,"work_id":"ac99e591-9e89-43df-b8c1-159b348b5393","year":2023},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.837609Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:3c1352cf55eec6ed533971a1b7c58600c6de539662a9a670131701ce0f69b1c9","observation_id":"10ee9007-f191-4566-8039-e6a7e7e8bd6e","resolution":{"observed_at":"2026-08-06T11:57:00.036961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.10462","last_updated":"2021-02-20T22:37:41Z","snapshot_observed_at":"2026-08-16T18:44:11.232831Z","submitted_at":"2021-02-20T22:37:41Z","title":"BSQ: Exploring Bit-Level Sparsity for Mixed-Precision Neural Network Quantization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.10462","snapshot_observed_at":"2026-08-06T11:56:59.840476Z","title":"Bsq: Ex- ploring bit-level sparsity for mixed-precision neural network quantization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.840476Z"},"links":{"cited_paper":"/paper/2102.10462","citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:c73e484667b5fabf8bf7e954cf6286923dc65fcd5bcf533f365056075abbedf8","observation_id":"744569d2-cc5e-4c48-813c-de21f8ce02aa","resolution":{"observed_at":"2026-08-06T11:56:59.840476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:57:00.024370Z","title":"Quan- tization networks","venue":null,"work_id":"3b79a408-2caa-4871-9756-032fc4919977","year":2019},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.843927Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:e17af4588fabab4a6bbe869e9fca69e5bf129d93138abd4d0b57ea77f89e8851","observation_id":"c0ec9f73-919c-4e8d-ab08-afb9eb29b2c6","resolution":{"observed_at":"2026-08-06T11:57:00.027592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:57:00.015468Z","title":"Hawq-v3: Dyadic neural net- work quantization","venue":null,"work_id":"052b98e2-6b65-4a3f-91ca-0108c68533f9","year":2021},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.846577Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:8b502fea1d4b1f18a0a51e7326a35fe3ed1fe3706d41b6816275ff0c802f9b76","observation_id":"aa2ec4c9-1acd-4593-8fef-e5d9b1071b3a","resolution":{"observed_at":"2026-08-06T11:57:00.019049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:57:00.006609Z","title":"Lq-nets: Learned quantization for highly accurate and compact deep neural networks","venue":null,"work_id":"c2b7d633-e0ca-4f49-955f-e49820f5bfb6","year":2018},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.849488Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:47d3f36a71901939d7b618fdfa663b1a3ac5b5ebb60f09bf173d6e94a3375414","observation_id":"021655fa-a7af-457a-9ffc-ab57d1bf43c4","resolution":{"observed_at":"2026-08-06T11:57:00.010005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06160","last_updated":"2018-02-02T01:43:54Z","snapshot_observed_at":"2026-08-15T08:38:24.917341Z","submitted_at":"2016-06-20T15:02:31Z","title":"DoReFa-Net: Training Low Bitwidth Convolutional Neural Networks with Low Bitwidth Gradients","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06160","snapshot_observed_at":"2026-08-06T11:56:59.852287Z","title":"Dorefa-net: Training low bitwidth convo- lutional neural networks with low bitwidth gradients","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.852287Z"},"links":{"cited_paper":"/paper/1606.06160","citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:dc6949d320905eac9dc8879ce7e67cdcc7644e4a1fc7dd532468ed7ab18936fb","observation_id":"db63a2ab-4df5-4caf-9f49-528d89f05413","resolution":{"observed_at":"2026-08-06T11:56:59.852287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:56:59.997241Z","title":"1 illustrates how Omega values and bit precision change across layers during the training process of ResNet-","venue":null,"work_id":"66fea8b9-d7e9-4fef-80d9-59b0d7690a2b","year":null},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.855464Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:42aba1fe79bfa8d428e10680f34e11c3cb3ef3394dd0133b53357ae1f57d9fd1","observation_id":"d1378d23-072f-4e88-9548-6c426eb50988","resolution":{"observed_at":"2026-08-06T11:57:00.000613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:56:59.988239Z","title":"In the ﬁrst pruning step Fig","venue":null,"work_id":"93d1d8d6-d6b0-4463-a1ee-89465807aa4f","year":null},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.858481Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:377d1a84930ef6c8644086e458e7913fcaec2dc70f79a0e07ff77dc44a55a9f2","observation_id":"76675883-fafb-45bc-8dca-67f004316dde","resolution":{"observed_at":"2026-08-06T11:56:59.991254Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:56:59.979468Z","title":null,"venue":null,"work_id":"b4662da3-7d5c-49f1-879d-9d305e1a7354","year":null},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.861608Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:9fa2f977ba8f570bb78e8e4528e586c5959c58ad4957d5bc60a79ed8e4e4caed","observation_id":"ed913675-e685-4138-9457-e782ea88ec61","resolution":{"observed_at":"2026-08-06T11:56:59.982555Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:56:59.970548Z","title":"While the main pa- per presents results on compact vision transformers such as Table 1","venue":null,"work_id":"7d360c49-c31c-43d7-bb40-c62e68c475bd","year":null},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.864506Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:c14b7fc172032841b5ee328d5b3708de6ca2b22c510b0ed2dd443c8a4470d945","observation_id":"43b4ec91-7efd-48d0-bc91-747bea1acd12","resolution":{"observed_at":"2026-08-06T11:56:59.973706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:56:59.961105Z","title":"The pruning interval I is crucial for guiding LSB sparsiﬁcation and facil- itating accuracy recovery after pruning","venue":null,"work_id":"9bbe1f61-cb17-4ccb-9c60-59aae49c43c0","year":null},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.867664Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:3c24c90a463bdb91c0917b1261e7e8427f4e6f912ce1e1f620480a93863b54fc","observation_id":"d0a534d8-57b5-4f28-90d6-60bc46722eed","resolution":{"observed_at":"2026-08-06T11:56:59.964697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:56:59.949619Z","title":"Thus, it is essential to carefully tune λ and the pruning threshold α to balance sparsity and accuracy effec- tively","venue":null,"work_id":"19f1ff47-0f12-41a5-b4a2-148520aa7044","year":null},"citing_paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T11:56:59.870638Z"},"links":{"citing_paper":"/paper/2507.22349"},"observation_digest":"sha256:fe44096b973dd5614cf832183e6a7dc94cb237d148df40fe08ffa8feec94f04d","observation_id":"fef3cd38-4246-4668-bb30-678ca5247377","resolution":{"observed_at":"2026-08-06T11:56:59.954250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.22349","last_updated":"2025-07-30T03:21:29Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T11:06:56.411750Z","submitted_at":"2025-07-30T03:21:29Z","title":"MSQ: Memory-Efficient Bit Sparsification Quantization"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":0,"verified_fuzzy":27},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2507.22349."}