{"as_of":"2026-08-09T12:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b3bf00d00d686595ebe90fb1d5232907fb35e4addc185c041b44d932796732e7","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:57:56.534215Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.09616/citation-record","integrity":"/paper/2507.09616/integrity","json":"/paper/2507.09616/citation-record.json","paper":"/paper/2507.09616"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:06.338705Z","title":"Quantizable transformers: Removing outliers by helping attention heads do nothing","venue":null,"work_id":"ae2ab058-d707-442b-9dcb-6441e09d7763","year":null},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:50.017870Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:8362a9c98399a4647da0090d5afcf1f697508e2d20973153c9c6240b9352b020","observation_id":"2bc49f04-be9f-4097-9f02-39c10022f363","resolution":{"observed_at":"2026-08-06T17:58:06.384533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:06.236999Z","title":"Cascade r-cnn: Delving into high quality object detection","venue":null,"work_id":"9e0c85c9-f927-4153-9d54-a04737a1b199","year":2018},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:50.144100Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:1a034361023eafa62932a938bc51233e700c0610c74370b7986a9b9c4dd29aa9","observation_id":"0c5ce7f7-090c-458d-9910-b2b4bd63a6a3","resolution":{"observed_at":"2026-08-06T17:58:06.284599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:06.123833Z","title":"End- to-end object detection with transformers","venue":null,"work_id":"3b99ec13-6089-4d0b-bbdb-a5c3056e71e6","year":2020},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:50.281768Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:7bf0671a440d999a1024d27db006804af79eca0480cc5724bee7242b0228ffe3","observation_id":"9326d636-c85b-4cc5-813d-b1cd8c2a3cfe","resolution":{"observed_at":"2026-08-06T17:58:06.176376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:06.026211Z","title":"Exploiting linear structure within con- Figure 5","venue":null,"work_id":"8667d97a-6592-46fd-b0c0-23af88e76931","year":null},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:50.426936Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:8b1ca592f870a1d8845a895606ad2de3d36651f7dd626540d1b11a16dc5fe2f8","observation_id":"7a00937a-41ef-4055-8c5b-71dd34bef84a","resolution":{"observed_at":"2026-08-06T17:58:06.064657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:05.902660Z","title":"BERT: Pre-training of deep bidirectional trans- formers for language understanding","venue":null,"work_id":"da907ff2-c24d-4737-95b6-6ed3e5499d23","year":2019},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:50.562141Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:f9dbe1d5c79a13da621ae738f6829bc37e368e3cc8bfffdfd720d83e27ed475c","observation_id":"e67f56a4-1935-4fe0-8550-e3283bbfbebe","resolution":{"observed_at":"2026-08-06T17:58:05.969884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:05.773559Z","title":"Towards accurate post- training quantization for vision transformer","venue":null,"work_id":"8f5a6223-b252-4244-84f5-848cf0ff59e1","year":2022},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:50.715559Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:e41dc0e4395d4ee6d76273a2d04c8624d3cc9a872f03af2645ec9e74a99062ae","observation_id":"190e6d5b-0e05-40fe-979d-fd3e50e3ade3","resolution":{"observed_at":"2026-08-06T17:58:05.829161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:05.640134Z","title":"Learning to prune deep neural networks via layer-wise optimal brain surgeon","venue":null,"work_id":"3a199f61-844f-4897-9963-8f7afea9fb53","year":2017},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:50.810229Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:604a73b2e4530a96f152bbc408a1f3a1f7ad1fc223fd7584c99a9f37c6835151","observation_id":"48693c59-6409-4a9f-a27a-1411bcf7f460","resolution":{"observed_at":"2026-08-06T17:58:05.705454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:05.511668Z","title":"HAWQ: Hessian aware quanti- zation of neural networks with mixed-precision","venue":null,"work_id":"cf86c5f1-c070-4f14-becf-773cf9a20220","year":2019},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:50.944594Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:0b93237828f9f6692d77e13ef39fbc352882623e38a646db46d884cbbaa3309a","observation_id":"958ba43a-f6a8-4a85-8cfb-3c94deb429b0","resolution":{"observed_at":"2026-08-06T17:58:05.575397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:05.371549Z","title":"Hawq-v2: Hessian aware trace-weighted quantization of neural networks","venue":null,"work_id":"c3f65e71-8b43-4dc2-8efd-d4cc770c4b8e","year":2020},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:51.053499Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:866ca97e7801ada205bebb82ab8a371f2a7d53559e7b324808158d014f0de007","observation_id":"57f3748d-df36-4c3d-8527-bed830b13691","resolution":{"observed_at":"2026-08-06T17:58:05.431140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:51.124268Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:51.124268Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:20f19d08a8a0f6a4fcdb581484eac3099f70866c97b30ed9385109da81002fa6","observation_id":"fa2cd620-6067-4fc5-91cb-b7807f281cd6","resolution":{"observed_at":"2026-08-06T17:57:51.124268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:05.183449Z","title":"Optq: Accurate quantization for generative pre- trained transformers","venue":null,"work_id":"414d2b52-4bbc-45a1-b405-64c28eed7ce6","year":2022},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:51.206626Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:1a5ce80bdde7572551938d9e5f3bffb199a166061a9e51cc0e7a5d0036671c20","observation_id":"64a35166-2df6-4c9b-afab-7c78372ca436","resolution":{"observed_at":"2026-08-06T17:58:05.269845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:04.971821Z","title":"A survey of quan- tization methods for efficient neural network inference","venue":null,"work_id":"70e38075-1e05-4fd7-8ba6-35279a2ca84b","year":2022},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:51.295431Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:1c4fea78558b069efd7e6101f3779ac07acbe0c4f10e783cbf1cf7282b94dcf2","observation_id":"73094ec3-5b3a-495d-9803-4af694c41b65","resolution":{"observed_at":"2026-08-06T17:58:05.063758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:04.777387Z","title":"Singular value decom- position and least squares solutions","venue":null,"work_id":"603e7a24-5314-4a61-83d5-922460837c41","year":null},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:51.339408Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:645a80fa82de634ce3156d2609a7774cde36b96381d34fe0764f6a877ec0a467","observation_id":"f52a7b5c-5e36-4d3e-9435-32d12bae03e9","resolution":{"observed_at":"2026-08-06T17:58:04.868990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11531","last_updated":"2024-09-26T08:20:59Z","snapshot_observed_at":"2026-07-06T16:21:25.401345Z","submitted_at":"2023-09-20T10:50:28Z","title":"EPTQ: Enhanced Post-Training Quantization via Hessian-guided Network-wise Optimization","version":2},"cited_work":{"arxiv_id":"2309.11531","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.11531","snapshot_observed_at":"2026-08-06T17:57:56.792536Z","title":"EPTQ: Enhanced Post-Training Quantization via Hessian-guided Network-wise Optimization","venue":"cs.CV","work_id":"23629fdb-f93e-4cfa-8d98-ee5b2ba18278","year":2023},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:51.387831Z"},"links":{"cited_paper":"/paper/2309.11531","citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:900d88d2055c5d267de44d2abb8b5db59a79b98e72b2ba275c176f3a3683d6fd","observation_id":"aee0837f-f3ce-4821-8899-d3924f327830","resolution":{"observed_at":"2026-08-06T17:57:56.827309Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:04.551433Z","title":"Olive: Accelerating large language models via hardware- friendly outlier-victim pair quantization","venue":null,"work_id":"f2637f7a-7988-4b12-949d-e85982d3ce8a","year":2023},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:51.474326Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:3abeae0ba009a99c97c55e3c0ccb45974666e6051d317088ea2c37f033ba63e3","observation_id":"36c91d7c-9a7c-413b-a847-d9c05395f839","resolution":{"observed_at":"2026-08-06T17:58:04.645246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:04.378079Z","title":"Hmq: Hardware friendly mixed precision quantization block for cnns","venue":null,"work_id":"d10472f3-7e6e-4dcc-bf3a-167401c11d40","year":2020},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:51.528619Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:516d4fbbfe65f56b983154b5e210cce35e9f2a3b7159a5266ee31e796fc1d1e3","observation_id":"c914f25d-cd06-4598-a5a4-98ee54a32c64","resolution":{"observed_at":"2026-08-06T17:58:04.453842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:04.155784Z","title":"Mask r-cnn","venue":null,"work_id":"ca6a10ba-6060-40ee-bae5-551451697d00","year":2017},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:51.633761Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:99cb008982a0af4c88e1f8ef8871b9c8a2aad39d0ea943b717a12282f9772e00","observation_id":"ac2d280a-cd6d-4979-a965-d301c465f464","resolution":{"observed_at":"2026-08-06T17:58:04.266133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:04.015562Z","title":"Language model compression with weighted low-rank factorization","venue":null,"work_id":"334fc3f7-28dc-4304-8c71-4bea84f4f5d4","year":2022},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:51.788553Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:5c12991c3f75aa8644174f3c412fd4dfe78ce959d92fa78973079fb524bb613d","observation_id":"32d873e1-3e27-423a-9a6d-411b5f006b52","resolution":{"observed_at":"2026-08-06T17:58:04.079484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:03.833069Z","title":"Numerical optimizations for weighted low-rank estimation on language models","venue":null,"work_id":"be712633-7852-42b9-b581-8d90510e367c","year":2022},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:51.953461Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:76ef3d3d96a5c640ae0b43e97b935f554ca8011e0dfaaf4dbd18a38ec1c048dc","observation_id":"39f645b2-7ac0-4a62-98c3-ea5d1ee93da3","resolution":{"observed_at":"2026-08-06T17:58:03.921822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:03.616051Z","title":"Dynamic low-rank estimation for transformer-based language models","venue":null,"work_id":"d208aee1-7c0c-4ca7-a922-0ac4cea5a8aa","year":2023},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:52.120876Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:ce55b81e8fca057d1502c1acab26b37ad87486bddfa3cab510ce762c7e90cc75","observation_id":"0448a017-fb27-40df-9611-0a6c3d38faf3","resolution":{"observed_at":"2026-08-06T17:58:03.712370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:03.414087Z","title":"Complexity-aware layer-wise mixed-precision schemes with sqnr-based fast analysis","venue":null,"work_id":"f5e94995-3428-40ef-9c50-58bdad600170","year":null},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:52.324037Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:7532ae9f27bdc64ad0e1f9936fc8c906ed87124206b5e79b5744668782c70aa3","observation_id":"ebac63af-5b36-4e9c-b38e-198274b1891f","resolution":{"observed_at":"2026-08-06T17:58:03.517582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:03.171110Z","title":"One-shot model for mixed-precision quantization","venue":null,"work_id":"296959b2-5b41-40f7-84f9-910fcb5c3454","year":null},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:52.549888Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:4036edf89f634455bec214e8f5c96d48d12d5e28ac7e1636d62a9603eb55c34f","observation_id":"382876d7-e880-4ab3-aff7-36302f816d8c","resolution":{"observed_at":"2026-08-06T17:58:03.281557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.08342","last_updated":"2018-06-21T17:32:46Z","snapshot_observed_at":"2026-07-06T06:46:08.396066Z","submitted_at":"2018-06-21T17:32:46Z","title":"Quantizing deep convolutional networks for efficient inference: A whitepaper","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.08342","snapshot_observed_at":"2026-08-06T17:57:52.684694Z","title":"Quantizing deep convolu- tional networks for efficient inference: A whitepaper","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:52.684694Z"},"links":{"cited_paper":"/paper/1806.08342","citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:70a5a4051f5066d922f9aca1f918018f95076317c4015221ef04ed937eaeaf5a","observation_id":"54039bf7-20e5-41cf-afcb-e7c704a9eee1","resolution":{"observed_at":"2026-08-06T17:57:52.684694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:02.946076Z","title":"BRECQ: Push- ing the limit of post-training quantization by block recon- struction","venue":null,"work_id":"1767d871-871d-4b0a-9b6d-b3e757ccb37d","year":2021},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:52.818505Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:ba4356cf8b3c9df69f908b4bb2d4f0053682c9fc7652b771eb88dc973df3edd7","observation_id":"1f900107-0a20-4326-bc67-9dccb6816bf3","resolution":{"observed_at":"2026-08-06T17:58:03.051677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:02.695854Z","title":"Repq- vit: Scale reparameterization for post-training quantization of vision transformers","venue":null,"work_id":"b17667ba-8f47-4712-82fc-9c62022ac65a","year":2023},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:52.939727Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:3f1a13a281003fb503d9ccc72941afb6a6d4936a3394c03f57d1df5e64de29cc","observation_id":"6f39fbbe-d068-4470-9e6f-d9ef8cba5cbc","resolution":{"observed_at":"2026-08-06T17:58:02.793116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:02.419866Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":"db3dbcd7-d51f-48f9-addc-5e4a29f3d107","year":2014},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:53.053200Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:9baa78617c17e758b828d5a67f57453122e8d0c368faa066da5afc5e493ddb09","observation_id":"c507d71a-5f93-4c64-bd26-0fb45e1492c2","resolution":{"observed_at":"2026-08-06T17:58:02.553252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:02.184845Z","title":"Pd-quant: Post-training quantiza- tion based on prediction difference metric","venue":null,"work_id":"c6cd27d9-a44c-445b-8a17-fd7d3b998b77","year":2023},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:53.165222Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:396e776f8063b53d36aa92d70ebc128a1ab5f955ea6f382a70acfb4188b43ae8","observation_id":"aac99d73-7ae5-4bca-bb7d-41c860aa9826","resolution":{"observed_at":"2026-08-06T17:58:02.313589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:01.972090Z","title":"Noisyquant: Noisy bias-enhanced post-training activation quantization for vision transformers","venue":null,"work_id":"e862bcae-d210-4cf1-8da1-389546b705d8","year":2023},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:53.275481Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:ad1c50c6d218fe047d366705e133d6ac2d6f3bcf7e954aec699120e571734a2a","observation_id":"bacca9d1-8b7f-44a7-86b9-a2f4a86732ee","resolution":{"observed_at":"2026-08-06T17:58:02.078957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:53.397077Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:53.397077Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:45842dfa5eccb7c13724454a63851e304174fee04b6e26ec67d1c0d8a62290ae","observation_id":"d62957ab-4ac3-4c87-911c-c447cc661860","resolution":{"observed_at":"2026-08-06T17:57:53.397077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:01.697765Z","title":"Post-training quantization for vision trans- former","venue":null,"work_id":"c36511bf-7f45-43da-bba1-5ec021adf398","year":2021},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:53.533342Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:ad0de380d4e4079aeb4ea47c20f916e373c70813254dc7336c2a05f413956bda","observation_id":"1c9a2afb-5b33-47d1-bcbe-552392358879","resolution":{"observed_at":"2026-08-06T17:58:01.849974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:01.487898Z","title":"Up or down? adap- tive rounding for post-training quantization","venue":null,"work_id":"0d67fd18-5faf-4fe4-a7d0-4fe5b1557fa7","year":2020},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:53.613022Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:dbc7118bd54f6e6dc3cf25068658a961f09d672b82ba40b45a7c3fa78e0b62c6","observation_id":"74a35830-6ca5-4b25-b38c-ab1ab28dc51b","resolution":{"observed_at":"2026-08-06T17:58:01.580827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:01.281697Z","title":"Loss aware post-training quantization","venue":null,"work_id":"ca3a84bf-d5a7-4647-b7e3-1a72be90dbcc","year":2021},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:53.709871Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:1b96adeea28a19005ef455a8e204cabb75f192d024468416a6a3d9597cc67ade","observation_id":"fff28c53-f68b-4c13-b4b4-1910bd97dd2d","resolution":{"observed_at":"2026-08-06T17:58:01.381740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:01.053116Z","title":"Compressing pre- trained language models by matrix decomposition","venue":null,"work_id":"424503b6-fce6-413e-abf0-ea625ee2a503","year":2020},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:53.828878Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:5e573858667094fedf0726fb89f52b8aecf69cc7e623a41008730cb6e44c4345","observation_id":"e5982f35-10c0-4f11-8981-2fc841a11360","resolution":{"observed_at":"2026-08-06T17:58:01.148711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05397","last_updated":"2023-02-10T17:47:54Z","snapshot_observed_at":"2026-08-02T22:31:22.531484Z","submitted_at":"2023-02-10T17:47:54Z","title":"A Practical Mixed Precision Algorithm for Post-Training Quantization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05397","snapshot_observed_at":"2026-08-06T17:57:53.969669Z","title":"A practi- cal mixed precision algorithm for post-training quantization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:53.969669Z"},"links":{"cited_paper":"/paper/2302.05397","citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:24deb78f33b4241c9749189fc9e159bdef81ca05226151ca6f449a0e5c8667bb","observation_id":"c5fdc61c-1b55-40d7-859e-15b32cd48c45","resolution":{"observed_at":"2026-08-06T17:57:53.969669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:00.843749Z","title":"OR-Tools, 2024","venue":null,"work_id":"b823c908-2b09-4d1f-a5d3-733b87522588","year":2024},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:54.063780Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:c326beacb464a84162cf5712cd71b647e621be498365642e7704a4fc08ac94fa","observation_id":"9bbc7b22-1a39-4f60-8bc8-5984b830a58a","resolution":{"observed_at":"2026-08-06T17:58:00.959998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:00.562971Z","title":"Probabilistic weather forecasting with machine learn- ing","venue":null,"work_id":"c54c5a69-5f8d-44fd-8cf2-b20afae40668","year":2025},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:54.203549Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:62bf349a75e2637f5e5217e7bf60ad10bac2fa7476eafd69d3847f0faca4006b","observation_id":"d19a2c72-0439-46c6-8303-b0c1afe3200f","resolution":{"observed_at":"2026-08-06T17:58:00.666490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11243","last_updated":"2024-01-20T14:53:19Z","snapshot_observed_at":"2026-07-06T17:18:16.042313Z","submitted_at":"2024-01-20T14:53:19Z","title":"LRP-QViT: Mixed-Precision Vision Transformer Quantization via Layer-wise Relevance Propagation","version":1},"cited_work":{"arxiv_id":"2401.11243","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.11243","snapshot_observed_at":"2026-08-06T17:57:56.654489Z","title":"LRP-QViT: Mixed-Precision Vision Transformer Quantization via Layer-wise Relevance Propagation","venue":"cs.CV","work_id":"83a91b21-d702-41db-bda8-0aaf31d954cd","year":2024},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:54.290497Z"},"links":{"cited_paper":"/paper/2401.11243","citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:7a8761ca8299e1b3ef3757f8c94cc0582e8e51bbc54e80e66e4f66914c99ab45","observation_id":"0d0868c1-65fa-4f00-9701-aedebac066f1","resolution":{"observed_at":"2026-08-06T17:57:56.720638Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:00.352858Z","title":null,"venue":null,"work_id":"a2f0ec9b-3217-4a93-b159-9941aae62eb6","year":2024},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:54.375429Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:f6c38ddd7c5368221e4a94bd91f5d232fa71164fd6183d1db3565c041fc70b6d","observation_id":"9ca63a41-4de8-4c51-88e8-bf818884d5b8","resolution":{"observed_at":"2026-08-06T17:58:00.448331Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:00.171122Z","title":"Imagenet large scale visual recognition challenge","venue":null,"work_id":"294594b5-e998-4ee4-a450-f3c9e3428b09","year":2015},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:54.540170Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:9d0ee47da0d1e884d1d1236de59d1848ccaa7dd235158708cbea4698c267b1c6","observation_id":"49b5519a-de36-4d59-b68e-d34d044c106b","resolution":{"observed_at":"2026-08-06T17:58:00.245672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:59.959512Z","title":"Weighted low-rank ap- proximations","venue":null,"work_id":"92544bcf-e8a8-4595-a6db-66b8bb7d7d5a","year":2003},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:54.640071Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:9b6b5564174fa884cff281c594bed183d207a3338cfcb126acbad053dc9a6b8e","observation_id":"70ecd6f7-61ec-47e7-a7a7-5da3642b4412","resolution":{"observed_at":"2026-08-06T17:58:00.081230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:59.737832Z","title":"Amp-vit: Optimizing vision transformer efficiency with adaptive mixed-precision post- training quantization","venue":null,"work_id":"cb9de30e-e759-4a7b-8cc3-99956b86a83e","year":2025},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:54.770745Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:b91174e0a586b735ebf18a842849fc1435e1b9c655f38481b689f671df529541","observation_id":"5032eb93-9e85-449b-9433-d1dae40c3a14","resolution":{"observed_at":"2026-08-06T17:57:59.840379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:59.534875Z","title":"Training data-efficient image transformers & distillation through at- tention","venue":null,"work_id":"2612d620-7380-43cb-8f46-66b6f4506a72","year":2021},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:54.917890Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:27c81798738a93752014d816c781f06b27270dd48a771e6e7bb0d42d7631fdde","observation_id":"c8ea6b4a-5643-49dd-96ab-7fc658e480e8","resolution":{"observed_at":"2026-08-06T17:57:59.616398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:59.292403Z","title":"Mixed precision dnns: All you need is a good parametrization","venue":null,"work_id":"82122de0-58bd-4e39-bd87-88fd84b9df14","year":2020},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:55.014542Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:c2680ebe7f6309bd4586c6d859ea61cf97d2de8493ba7d1a0be9c52fa9050f08","observation_id":"08666285-f918-469f-b094-d2b8fe7d9d1f","resolution":{"observed_at":"2026-08-06T17:57:59.390554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:59.099133Z","title":"Attention is all you need","venue":null,"work_id":"bb21c1dc-1454-40e3-836a-7a8041b1f762","year":2017},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:55.157253Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:b04a5e25326d7d1f9a79440d8f90f5cbe5f1e77c75ae2673fd701195a08e7fcd","observation_id":"8e237831-8e26-44ca-9827-746bab21e338","resolution":{"observed_at":"2026-08-06T17:57:59.200386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:58.915957Z","title":"GLUE: A multi-task benchmark and analysis platform for natural language un- derstanding","venue":null,"work_id":"d21842c9-d96d-4f1f-8ffc-51608feb402b","year":2018},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:55.309559Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:84f971cb0113055e3674668ce0356b98017192ff3754ed2021f5d71cd25441c8","observation_id":"96e3aa5b-7408-46e7-9fbc-1c95f1565a17","resolution":{"observed_at":"2026-08-06T17:57:59.016518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:58.729119Z","title":"SVD- LLM: Truncation-aware singular value decomposition for large language model compression","venue":null,"work_id":"9a8ba179-9d93-4b86-a5e0-68ebd4c5d0c8","year":2025},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:55.446429Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:56423c6abf4ee0b9dac50f0e8a7b8fa1c2551c68c754700d6dc80510de982a2d","observation_id":"4bdfa9e1-909f-4ab1-83f6-219fd590df1c","resolution":{"observed_at":"2026-08-06T17:57:58.825439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:58.569989Z","title":"QDrop: Randomly dropping quantization for extremely low-bit post-training quantization","venue":null,"work_id":"eaedc476-8e60-4e4b-be70-ae9b566b015d","year":2021},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:55.544210Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:cc536d8e2300fa76ce2406e1e46c3b1531bb6278ba695aadeed0c80879303e18","observation_id":"5b2ab7ce-4735-4351-88e7-d83d18b9594c","resolution":{"observed_at":"2026-08-06T17:57:58.651727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:58.347592Z","title":"Outlier sup- pression+: Accurate quantization of large language models by equivalent and effective shifting and scaling","venue":null,"work_id":"d44cd16e-03ba-4db2-b736-df10bfe58426","year":2023},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:55.639793Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:abe152709f65dd27dfb200a167380408d6a60cf09088ee4dbbebe0dd0d70fb2c","observation_id":"4ed7f6cc-a8a6-43c8-93f4-ae97fdf5d9cd","resolution":{"observed_at":"2026-08-06T17:57:58.457105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:58.171371Z","title":"Pytorch image models","venue":null,"work_id":"8b96b1e2-4b48-48fa-a39a-0c396d26451e","year":2019},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:55.738099Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:a39768d011885ab93b280172819dbe9b569b367b3bbc1eb6a6b89c8350346e3a","observation_id":"5a8a6135-5aab-40c2-97bc-7edc411f9246","resolution":{"observed_at":"2026-08-06T17:57:58.272363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:57.950784Z","title":"Smoothquant: Accurate and ef- ficient post-training quantization for large language models","venue":null,"work_id":"f4372485-c78c-41b5-97b5-e2de506ba0d7","year":2023},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:55.829339Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:ba2d0c4c36a9e25f65bdeed026f16e895446d6210f66fe495a4516daa80099c5","observation_id":"9f6189f4-6960-4547-9d46-3948900d1179","resolution":{"observed_at":"2026-08-06T17:57:58.040160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:57.803156Z","title":"Patch- wise mixed-precision quantization of vision transformer","venue":null,"work_id":"77e7210e-2234-4459-89a4-fe5cdbd628e0","year":2023},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:55.950578Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:44b08bb75909351fbc58dee340d92c618ed050065b44b70215a6f3c0d90253c5","observation_id":"d25eb928-a8e1-41a0-894f-35d0f4323085","resolution":{"observed_at":"2026-08-06T17:57:57.880135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:57.598678Z","title":"Efficient low-rank back- propagation for vision transformer adaptation","venue":null,"work_id":"c57c7d4d-66eb-464f-bf4a-dde3a39a6081","year":2023},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:56.054469Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:63b4da835b77026fc32c180e11e2b52fb9a29648acca398157ffaad70c824155","observation_id":"7821308a-bc30-4af9-86f6-e092eecc344d","resolution":{"observed_at":"2026-08-06T17:57:57.697143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:57.449423Z","title":"Compressing transformers: fea- tures are low-rank, but weights are not! In Proceedings of the AAAI Conference on Artificial Intelligence, pages 11007– 11015, 2023","venue":null,"work_id":"363cf89e-a40e-4025-8246-dccf47aec284","year":2023},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:56.197425Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:a4832de54aa1843f4663c824920ca116a4fdf82f76d260844b93456725a158f3","observation_id":"0e554148-530c-445d-b33c-4374c99b78db","resolution":{"observed_at":"2026-08-06T17:57:57.509909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:57.298034Z","title":"Hessian- aware pruning and optimal neural implant","venue":null,"work_id":"0ef59738-1ac5-452f-8f1b-9f58db29662c","year":2022},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:56.286049Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:9e23ca9cc30c8827f9b4886e7a3c4d81b8e3655e0eb5e58a8bcaf771e472ae3f","observation_id":"bb927ecd-fcb4-44b6-bb32-f4c1bb2e1d36","resolution":{"observed_at":"2026-08-06T17:57:57.378613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:57.171244Z","title":"Ptq4vit: Post-training quantization for vi- sion transformers with twin uniform quantization","venue":null,"work_id":"49517a97-2a7c-42cf-b970-a1d7df0bfeaf","year":2022},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:56.343556Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:2fe3146cd46aaf0de7fd2ca9dffa14f5d8e5d64c2eac346353b892307bcf0b04","observation_id":"238b163c-1d14-4595-98ff-422a9cbb0e4a","resolution":{"observed_at":"2026-08-06T17:57:57.237453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:57.033059Z","title":"ERQ: Error reduction for post-training quanti- zation of vision transformers","venue":null,"work_id":"8f5e13ee-c624-48dd-a7e2-34ff530eb87c","year":null},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:56.408004Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:bdeaee285905c2c2f07958e1a33cb5a96b04dff510d007d25fcf691fd18639e7","observation_id":"b1a24dbb-21c8-4226-b023-9c8ce00167a9","resolution":{"observed_at":"2026-08-06T17:57:57.082436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:56.889144Z","title":"Towards accurate post-training quantization of vision transformers via error reduction","venue":null,"work_id":"4540706f-8d66-410a-a1bd-9c5ce916755c","year":2025},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:56.534215Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:f693d413bb80b9762b0e61eeb19043602099f95135bb58c08159539e02f5d3e8","observation_id":"4ed5ad3c-5949-4c67-a3bd-10938a35cdfa","resolution":{"observed_at":"2026-08-06T17:57:56.919924Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:56.960260Z","title":null,"venue":null,"work_id":"34f87390-cebb-493a-b918-b560beadb169","year":null},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:56.465479Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:42ce1809923474378314fab7d22a12c34bb9136b02d1a5108221eae0bfbb66e5","observation_id":"4683f16c-5aa0-43ad-9182-afa694e22af2","resolution":{"observed_at":"2026-08-06T17:57:56.991726Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":2,"verified_fuzzy":49},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 0 inbound Pith citation observations for arXiv:2507.09616."}