{"as_of":"2026-08-16T20:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cebf42c7c50c580e1208079ba3c22c0ef0e7e64ac8a9b259c011af56923a23f3","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T16:17:53.009786Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T03:44:09.156934Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T07:06:35.692628Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"cited_work":{"arxiv_id":"2412.10261","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.10261","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MVQ: Towards Efﬁcient DNN Compression and Acceleration with Masked Vector Quantization","venue":null,"work_id":"adc27753-6f1e-4256-869b-d2de3878f458","year":2025},"citing_paper":{"arxiv_id":"2605.09375","last_updated":"2026-05-10T06:58:06Z","snapshot_observed_at":"2026-08-16T08:16:29.413361Z","submitted_at":"2026-05-10T06:58:06Z","title":"31.1 A 14.08-to-135.69Token/s ReRAM-on-Logic Stacked Outlier-Free Large-Language-Model Accelerator with Block-Clustered Weight-Compression and Adaptive Parallel-Speculative-Decoding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-12T03:44:09.156934Z"},"links":{"cited_paper":"/paper/2412.10261","citing_paper":"/paper/2605.09375"},"observation_digest":"sha256:bc8569c659272b86d76336531b4f35e07c7d034703edc986c46c2d5ce6dd382c","observation_id":"0de6ade0-9d54-4cbb-a906-cdbddb5dc7fa","resolution":{"observed_at":"2026-05-12T07:06:35.697571Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.10261/citation-record","integrity":"/paper/2412.10261/integrity","json":"/paper/2412.10261/citation-record.json","paper":"/paper/2412.10261"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1706.05587","last_updated":"2017-12-05T18:06:21Z","snapshot_observed_at":"2026-08-16T09:04:18.586776Z","submitted_at":"2017-06-17T22:48:57Z","title":"Rethinking Atrous Convolution for Semantic Image Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05587","snapshot_observed_at":"2026-08-11T16:17:52.849425Z","title":"Rethinking atrous convolution for semantic image segmentation","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.849425Z"},"links":{"cited_paper":"/paper/1706.05587","citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:0a1fa825dd2b49f236a90a957e1b8d9731a1237d9dea0868efb7c752be4c73cc","observation_id":"a74d870f-90aa-46a6-84eb-18883a2b2f8e","resolution":{"observed_at":"2026-08-11T16:17:52.849425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:53.605209Z","title":"Towards convolutional neural networks compression via global&progressive product quanti- zation","venue":null,"work_id":"60981048-02b7-4aef-8257-605daf8aa26e","year":2020},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.854401Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:0351de2612d3bc89f1895062a75d9e954ce76b712b4e5ca87ae02a676003e51a","observation_id":"ed12547f-4897-4690-94a1-56f60a53be23","resolution":{"observed_at":"2026-08-11T16:17:53.609356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:53.592841Z","title":"Eyeriss: An energy-efficient reconfigurable accelerator for deep convolutional neural networks","venue":null,"work_id":"e1edb5b9-120b-400b-bcac-abda3ce582fb","year":2016},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.859348Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:929c729aaeb21b7242a4cbb3bd080a6317122728116d4c2502df004d1e0c3c2b","observation_id":"08bc2f73-c294-4f00-a9af-7aa35e6f5357","resolution":{"observed_at":"2026-08-11T16:17:53.597039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:53.578527Z","title":"Vahid, Saurabh Adya, and Mohammad Raste- gari","venue":null,"work_id":"1282fc5d-ab57-41b9-bf3c-3930da828265","year":2022},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.864919Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:845fa321bf8d81d8c0924c82a4fd594b66caf0dd86d9afdfc88b0216da2c2644","observation_id":"6fff42f6-e877-432c-a058-97c34a15504e","resolution":{"observed_at":"2026-08-11T16:17:53.583748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.08153","last_updated":"2020-05-07T03:30:49Z","snapshot_observed_at":"2026-08-14T17:13:05.593256Z","submitted_at":"2019-02-21T17:31:32Z","title":"Learned Step Size Quantization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.08153","snapshot_observed_at":"2026-08-11T16:17:52.870650Z","title":"Learned step size quantiza- tion","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.870650Z"},"links":{"cited_paper":"/paper/1902.08153","citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:3ec8212d93c063c5513c603063855b1b862978cc43124844acf4f51220252069","observation_id":"55aca96a-60ec-44dc-a677-63207520b89b","resolution":{"observed_at":"2026-08-11T16:17:52.870650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:52.875679Z","title":"The pascal visual object classes (voc) challenge","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.875679Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:27bacb7576e51ab0d9cf6da40ed41fa7bc26e3a7c93859f2a02581f854bb71df","observation_id":"82486fff-75c2-4d79-ba59-f77cd626f09e","resolution":{"observed_at":"2026-08-11T16:17:52.875679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:53.556433Z","title":"Gemmini: Enabling systematic deep-learning architecture evaluation via full-stack integration","venue":null,"work_id":"0949fc02-b22d-4c4c-b2ce-bcb97afde234","year":2021},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.880229Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:c9d855d9bec3a864c2ecec0fb63b677de2a8a47073887dd3345a22270e91a2a4","observation_id":"a67d587a-e19c-4872-b8ea-fc3e444e43d0","resolution":{"observed_at":"2026-08-11T16:17:53.561025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:53.543729Z","title":"Sparten: A sparse tensor accelerator for convolutional neural networks","venue":null,"work_id":"3be78568-8c16-4755-8763-439f28c78d82","year":2019},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.883912Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:d34ef3c12660d8ed1064d4c3b4e883c2a1512bf9d8f285c5b148ebd68c472254","observation_id":"29fbde60-6b91-49f8-8031-35cfb58bb6ea","resolution":{"observed_at":"2026-08-11T16:17:53.548581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6115","last_updated":"2014-12-18T21:09:01Z","snapshot_observed_at":"2026-08-14T23:06:53.533484Z","submitted_at":"2014-12-18T21:09:01Z","title":"Compressing Deep Convolutional Networks using Vector Quantization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6115","snapshot_observed_at":"2026-08-11T16:17:52.887716Z","title":"Compress- ing deep convolutional networks using vector quantization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.887716Z"},"links":{"cited_paper":"/paper/1412.6115","citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:bc7ffd379cb6e00dd5b59c7a7d6723c93b21d7e787b68c98b6a971c286764226","observation_id":"230a9ab1-8dcd-4295-857e-1c27738fb242","resolution":{"observed_at":"2026-08-11T16:17:52.887716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1510.00149","last_updated":"2016-02-15T06:25:40Z","snapshot_observed_at":"2026-08-04T16:59:47.843960Z","submitted_at":"2015-10-01T09:03:44Z","title":"Deep Compression: Compressing Deep Neural Networks with Pruning, Trained Quantization and Huffman Coding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.00149","snapshot_observed_at":"2026-08-11T16:17:52.892061Z","title":"Deep compression: Com- pressing deep neural networks with pruning, trained quantization and huffman coding","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.892061Z"},"links":{"cited_paper":"/paper/1510.00149","citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:3a4644d3bd77416e0693c99ed1e92ee0eaebdf4e331feae42e3c9ce8782f9487","observation_id":"4ebce0de-1984-4ebd-9ef8-cf717310c7ae","resolution":{"observed_at":"2026-08-11T16:17:52.892061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:53.530004Z","title":"Boosting the performance of cnn accelerators with dy- namic fine-grained channel gating","venue":null,"work_id":"7ab4a3d4-f904-4150-a2d8-941bbe59a45c","year":2019},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.896633Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:fd582bc59ce2d6683bd1108ee15347f2f31d0699075adebb9dcf6c0170d989e4","observation_id":"83fc48e4-4807-4e8f-b1ab-6510fe5631c8","resolution":{"observed_at":"2026-08-11T16:17:53.534505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:53.517311Z","title":"Sibia: Signed bit-slice architecture for dense dnn acceleration with slice-level sparsity exploitation","venue":null,"work_id":"8a6549b6-dfa9-426d-a609-975e10266773","year":2023},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.901748Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:8e45bdd810877ac54cb1547963e4cbc46f0df4d1b39a0d0081de33e2978b7b3f","observation_id":"81d489ad-54db-4c39-8e1c-3ff70d0c3b66","resolution":{"observed_at":"2026-08-11T16:17:53.521468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:53.504569Z","title":"Product quantiza- tion for nearest neighbor search","venue":null,"work_id":"c9e90eb0-8b26-45a5-95e3-5771ed1ce50f","year":2010},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.905554Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:d4d3920a56c27004d07fa4594b50c1f1ba88b52495982a284eaf40c6393d7b13","observation_id":"0c99698b-fc8d-4206-b7c0-b351e15bf762","resolution":{"observed_at":"2026-08-11T16:17:53.508878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:52.909399Z","title":"In-datacenter performance analysis of a tensor pro- cessing unit","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.909399Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:47948d63c139384daeba2d726b9ce63ff52542c15980ffe8c00eab0f57d32e4d","observation_id":"92173d48-dfd7-4044-a974-4bfa480b8bde","resolution":{"observed_at":"2026-08-11T16:17:52.909399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-14T18:51:16.666127Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-11T16:17:52.913987Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.913987Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:c04c248996cb26929d63de177174d1191cdc8fb6ed966944cbf2fd210fb25d80","observation_id":"5477ba97-74e8-4991-8ae6-8b437c84a9df","resolution":{"observed_at":"2026-08-11T16:17:52.913987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:53.483803Z","title":"Pruning vs quantization: Which is better?, 2023","venue":null,"work_id":"c76281ef-b855-4289-81dc-10ce6a54226d","year":2023},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.918370Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:cb62ecaa707ea086dfe31d56a77f8b015134196172d8c31674e771ced9c57f89","observation_id":"9f8e67a1-63f2-47b8-a4e8-8c2f86a22479","resolution":{"observed_at":"2026-08-11T16:17:53.488377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:53.472336Z","title":"Convolu- tional neural network accelerator with vector quantization","venue":null,"work_id":"7423cad3-28fb-458c-8927-7f5a97eee0ea","year":2019},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.922592Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:b3724b2db235a532f30dd2c67d0d5dbed821be235e0b159e1bb41784f694f5b7","observation_id":"35bcdd70-4a1e-4236-9896-4b6ae4f2d4db","resolution":{"observed_at":"2026-08-11T16:17:53.476317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1608.08710","last_updated":"2017-03-10T17:57:56Z","snapshot_observed_at":"2026-08-14T21:42:03.106939Z","submitted_at":"2016-08-31T02:29:59Z","title":"Pruning Filters for Efficient ConvNets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.08710","snapshot_observed_at":"2026-08-11T16:17:52.926533Z","title":"Pruning filters for efficient convnets","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.926533Z"},"links":{"cited_paper":"/paper/1608.08710","citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:729b9f8330b04cbe2fe4e48d50e1992697de3a320dcac6fc32c7a9e2e6fd6fd4","observation_id":"60cfa20b-e96e-4f5d-a3a2-b5885f75a431","resolution":{"observed_at":"2026-08-11T16:17:52.926533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:53.459827Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":"02d73b3d-11cc-4233-afbf-37fda4bc2dcd","year":2014},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.932851Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:aa55e82b74f415fb17552536d942d71c7c4af6463160eeb5e128c7e44415c2c6","observation_id":"f5b98827-4957-47fd-9673-5e2105e66a84","resolution":{"observed_at":"2026-08-11T16:17:53.464802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:53.448564Z","title":"Systolic tensor array: An efficient structured-sparse gemm accelerator for mo- bile cnn inference","venue":null,"work_id":"53f1d701-d715-4dcb-91d8-f65b004bb160","year":2020},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.937565Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:3c0cabc378ae888e2154a2e9f6ea71de73e61970dc8bf3e5d1224c75d89c7548","observation_id":"ffb9051a-9da9-4d83-989f-f3d7f465a5c0","resolution":{"observed_at":"2026-08-11T16:17:53.452500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:53.435654Z","title":"S2ta: Exploiting structured sparsity for energy-efficient mobile cnn ac- celeration","venue":null,"work_id":"9e0162c1-e835-4b6a-966a-aed7135624cc","year":2022},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.942061Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:0066e2ada5eff19e9739dd21685c1ba32a9c06ed8a5761d8ca1aa25b150de453","observation_id":"88468eaf-48f2-4733-82f6-780eda9bfe8e","resolution":{"observed_at":"2026-08-11T16:17:53.440973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.01312","last_updated":"2018-06-22T14:54:59Z","snapshot_observed_at":"2026-08-14T20:07:02.711956Z","submitted_at":"2017-12-04T19:20:27Z","title":"Learning Sparse Neural Networks through $L_0$ Regularization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.01312","snapshot_observed_at":"2026-08-11T16:17:52.945714Z","title":"Learning sparse neural networks through 𝑙_0 regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.945714Z"},"links":{"cited_paper":"/paper/1712.01312","citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:b108abfb8ec095e3d8d32956d1b533d2e19ecdc4c9b6905a579ce252dfea1651","observation_id":"9347173e-f707-405f-9ab9-4c1380aebcaf","resolution":{"observed_at":"2026-08-11T16:17:52.945714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:53.311476Z","title":"Permute, quantize, and fine-tune: Efficient compression of neural networks","venue":null,"work_id":"6a7c307a-e3d0-4c6d-8323-2613f5806274","year":2021},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.949550Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:592cd92b80fbcd0157fc3453ed133d204306fa59e4025c2d1a7d8a7338a6ea28","observation_id":"8f6a5f31-7cf4-4ad8-bfd4-4e6f1bde1157","resolution":{"observed_at":"2026-08-11T16:17:53.316015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08378","last_updated":"2021-04-16T21:27:32Z","snapshot_observed_at":"2026-08-16T18:30:58.242028Z","submitted_at":"2021-04-16T21:27:32Z","title":"Accelerating Sparse Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08378","snapshot_observed_at":"2026-08-11T16:17:52.953072Z","title":"Accel- erating sparse deep neural networks","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.953072Z"},"links":{"cited_paper":"/paper/2104.08378","citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:3c8a3b82344419e2363b34c7c905ff5d1734f0006e36c38e40c2b3824e950571","observation_id":"3b0b8964-19c5-47e9-af42-b02906057578","resolution":{"observed_at":"2026-08-11T16:17:52.953072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:53.299210Z","title":"Importance estimation for neural network pruning","venue":null,"work_id":"71a14ce3-e436-4293-967d-d8351a552879","year":2019},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.956977Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:0be7984a352ad2ca924fe5bd79ee787857558456e38b76c36b6ed647a9e33ed1","observation_id":"aa96e62b-d598-451a-9e98-6e144d800c0a","resolution":{"observed_at":"2026-08-11T16:17:53.303371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:53.283298Z","title":null,"venue":null,"work_id":"62e19f8a-4055-49de-81c4-46eee67e2522","year":1970},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.960971Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:363652e83d4cfb61b0a69a5d6533c3c24e95caf67411abccd0dee58ed90daff7","observation_id":"25386ead-8c18-45d7-85bc-ce4419ec443d","resolution":{"observed_at":"2026-08-11T16:17:53.290677Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.02389","last_updated":"2020-03-05T00:53:18Z","snapshot_observed_at":"2026-08-15T18:32:40.283183Z","submitted_at":"2020-03-05T00:53:18Z","title":"Comparing Rewinding and Fine-tuning in Neural Network Pruning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.02389","snapshot_observed_at":"2026-08-11T16:17:52.964812Z","title":"Comparing rewinding and fine-tuning in neural network pruning","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.964812Z"},"links":{"cited_paper":"/paper/2003.02389","citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:94cc2719eeef6ba26a7f5d8ee97ef2f43f8752f279849fcb6e70a8adc4b7a531","observation_id":"f9fd7d0c-b19c-47a5-9179-a198f3ba9bfa","resolution":{"observed_at":"2026-08-11T16:17:52.964812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:53.269737Z","title":"4.4 a 1.3 tops/w@ 32gops fully integrated 10-core soc for iot end-nodes with 1.7 𝜇w cognitive wake-up from mram-based state-retentive sleep mode","venue":null,"work_id":"8f787b58-3b57-4ade-b4bf-7471375509a9","year":2021},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.969114Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:0c4c68e642cc8841c5d7dabbc4f5d6857be041507c277ca4e7c5d1b230907c1e","observation_id":"6f9200f8-1d08-44c9-8e75-7640c859b6eb","resolution":{"observed_at":"2026-08-11T16:17:53.274572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:53.257445Z","title":"An energy-efficient deep convolutional neural network inference processor with enhanced output stationary dataflow in 65-nm cmos","venue":null,"work_id":"da28b0a5-bfa9-4881-a211-3a2b898a53af","year":2019},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.973089Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:bf715a25ea63a26c572c143148293781a9f2fc12b70307fd7d0d6b46a69795e5","observation_id":"4a639695-d1f6-47b5-90a7-4b767e8453da","resolution":{"observed_at":"2026-08-11T16:17:53.261772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:53.245434Z","title":"An accelerator for sparse convolutional neural networks leveraging systolic general matrix-matrix multiplication","venue":null,"work_id":"7f8b79f2-399f-4b3b-a72e-71d663966d7a","year":2022},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.977074Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:e398c22f621153b09bf7c876859e617475c4aae6dc2f67fcd3a2d42840dd6d79","observation_id":"2056092a-da0c-4d31-913b-c523d259ae24","resolution":{"observed_at":"2026-08-11T16:17:53.249555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:53.232731Z","title":"Clustering con- volutional kernels to compress deep neural networks","venue":null,"work_id":"95ae0b45-d97e-4495-b79b-e6073df20602","year":2018},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.981138Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:a95c9e03b550d882d5e0ee5e10e27efc237790220290348f7825324a339b8f1f","observation_id":"29cdace3-8835-4244-b216-7dea4f69b3f2","resolution":{"observed_at":"2026-08-11T16:17:53.237109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:53.219651Z","title":"Scaling equations for the accu- rate prediction of cmos device performance from 180 nm to 7 nm","venue":null,"work_id":"b717df00-b4b2-4d0c-944c-6a77879d1813","year":2017},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.985109Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:68fa37bfedfb17a6f0b560bbc1c0a167e6779a2a568947d0781844087a228741","observation_id":"8f87aea2-ca18-492d-95cf-983e0fa24f57","resolution":{"observed_at":"2026-08-11T16:17:53.224675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.05686","last_updated":"2020-11-09T10:11:15Z","snapshot_observed_at":"2026-08-14T16:06:26.545683Z","submitted_at":"2019-07-12T11:52:54Z","title":"And the Bit Goes Down: Revisiting the Quantization of Neural Networks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.05686","snapshot_observed_at":"2026-08-11T16:17:52.989129Z","title":"And the bit goes down: Revisiting the quantization of neural networks","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.989129Z"},"links":{"cited_paper":"/paper/1907.05686","citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:d96fdfbdd9179d1a5254a0c4becc15fab25e12b04a033bf829b4bbd89984d99e","observation_id":"2630ae3c-afa4-43c9-8d68-cad003903177","resolution":{"observed_at":"2026-08-11T16:17:52.989129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:53.206536Z","title":"Dominosearch: Find layer-wise fine-grained n: M sparse schemes from dense neural networks","venue":null,"work_id":"6db11384-2f11-4af6-af2d-60f571e2f0a7","year":2025},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.993387Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:b061fe8411b1dbfddd9e1a47d0104f065e99769d86f787303b289b09de00b0f0","observation_id":"a082972d-853a-488c-8147-b2ecc80aa2ef","resolution":{"observed_at":"2026-08-11T16:17:53.211754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:53.193181Z","title":"Ews: An energy-efficient cnn accelera- tor with enhanced weight stationary dataflow","venue":null,"work_id":"15686377-03b4-4e55-9809-a024d43a23b5","year":2024},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:52.998194Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:4ef3a4ef74ec9c6602ea7a88a3a7a969e5daeb147a974ba2259eebfed2d85c32","observation_id":"83fe967f-2423-45ce-81cb-51d8797ee996","resolution":{"observed_at":"2026-08-11T16:17:53.198831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:53.178640Z","title":"Quantized convolutional neural networks for mobile devices","venue":null,"work_id":"61f0a45d-7d72-49b1-be77-58aba3c9e7ad","year":2016},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:53.002383Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:1bb6c287853d6a246f9f408955ffbf9835f7e57b22a332dd3f55433abb11563c","observation_id":"b0d0b948-a248-4df6-bc6a-361748f8e0c8","resolution":{"observed_at":"2026-08-11T16:17:53.182963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:17:53.163190Z","title":"Accelerator design for vector quantized convolutional neural network","venue":null,"work_id":"81cf834b-a80d-466c-a24c-58bfd55935e1","year":2019},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:53.006352Z"},"links":{"citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:f97f5c07a564881ad26d9cd013ad9ab2ba11003fdf6b843369d81698a6e5ebd1","observation_id":"f2ae85e8-cc11-488a-8385-86a40012af19","resolution":{"observed_at":"2026-08-11T16:17:53.169891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.04010","last_updated":"2021-04-18T10:18:00Z","snapshot_observed_at":"2026-08-16T18:47:07.825085Z","submitted_at":"2021-02-08T05:55:47Z","title":"Learning N:M Fine-grained Structured Sparse Neural Networks From Scratch","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.04010","snapshot_observed_at":"2026-08-11T16:17:53.009786Z","title":"Learning n: m fine-grained structured sparse neural networks from scratch","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T16:17:53.009786Z"},"links":{"cited_paper":"/paper/2102.04010","citing_paper":"/paper/2412.10261"},"observation_digest":"sha256:5c176e64b85b0d1adbe58371583b077a67c60293dd4458c49332a5956ed42800","observation_id":"323986c3-0819-4a00-91eb-339ba1e7cd01","resolution":{"observed_at":"2026-08-11T16:17:53.009786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.10261","last_updated":"2024-12-16T08:54:43Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T06:43:28.094855Z","submitted_at":"2024-12-13T16:30:35Z","title":"MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":24},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 1 inbound Pith citation observation for arXiv:2412.10261."}