{"as_of":"2026-08-09T19:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:83aa4a2807a89cd6d84dc10f1a8497eb47c6bed1bbde981c89c1919a9ea7f926","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T21:51:04.339431Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.03804","last_updated":"2025-05-02T08:51:55Z","snapshot_observed_at":"2026-08-07T15:57:08.477835Z","submitted_at":"2025-05-02T08:51:55Z","title":"MoEQuant: Enhancing Quantization for Mixture-of-Experts Large Language Models via Expert-Balanced Sampling and Affinity Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03804","snapshot_observed_at":"2026-08-04T21:51:04.339431Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.07727","last_updated":"2025-09-09T13:28:41Z","snapshot_observed_at":"2026-08-09T18:16:28.980674Z","submitted_at":"2025-09-09T13:28:41Z","title":"MoE-Compression: How the Compression Error of Experts Affects the Inference Accuracy of MoE Model?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T21:51:04.339431Z"},"links":{"cited_paper":"/paper/2505.03804","citing_paper":"/paper/2509.07727"},"observation_digest":"sha256:a5a7f332a26f2a7377f137f663097d0e78b8898897cb22ab70be3356ed9fb873","observation_id":"c0dca862-5775-4453-8c67-54634e5cf498","resolution":{"observed_at":"2026-08-04T21:51:04.339431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03804","last_updated":"2025-05-02T08:51:55Z","snapshot_observed_at":"2026-08-07T15:57:08.477835Z","submitted_at":"2025-05-02T08:51:55Z","title":"MoEQuant: Enhancing Quantization for Mixture-of-Experts Large Language Models via Expert-Balanced Sampling and Affinity Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03804","snapshot_observed_at":"2026-08-03T23:41:52.868779Z","title":"Moequant: Enhancing quantization for mixture-of-experts large language models via expert-balanced sampling and affinity guidance, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.04805","last_updated":"2026-07-06T16:04:54Z","snapshot_observed_at":"2026-08-07T10:51:08.099986Z","submitted_at":"2025-11-06T20:53:02Z","title":"PuzzleMoE: Efficient Compression of Large Mixture-of-Experts Models via Sparse Expert Merging and Bit-packed inference","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-03T23:41:52.868779Z"},"links":{"cited_paper":"/paper/2505.03804","citing_paper":"/paper/2511.04805"},"observation_digest":"sha256:cf59e66da1a0a94554f07cbcf5e1b94f2ec99ded6fc5a2a409bb891ba1577114","observation_id":"8a063dfd-ee8a-45a6-869c-13db3188df59","resolution":{"observed_at":"2026-08-03T23:41:52.868779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03804","last_updated":"2025-05-02T08:51:55Z","snapshot_observed_at":"2026-08-07T15:57:08.477835Z","submitted_at":"2025-05-02T08:51:55Z","title":"MoEQuant: Enhancing Quantization for Mixture-of-Experts Large Language Models via Expert-Balanced Sampling and Affinity Guidance","version":1},"cited_work":{"arxiv_id":"2505.03804","doi":"10.48550/arxiv.2505.03804","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.03804","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Moequant: Enhancing quantiza- tion for mixture-of-experts large language models via expert-balanced sampling and affinity guidance.arXiv preprint arXiv:2505.03804","venue":"ArXiv.org","work_id":"f76671ee-fdd5-4d71-b593-da746650afac","year":2025},"citing_paper":{"arxiv_id":"2604.18556","last_updated":"2026-05-15T09:34:30Z","snapshot_observed_at":"2026-07-06T23:05:21.974248Z","submitted_at":"2026-04-20T17:45:47Z","title":"GSQ: Highly-Accurate Low-Precision Scalar Quantization for LLMs via Gumbel-Softmax Sampling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T05:29:51.182114Z"},"links":{"cited_paper":"/paper/2505.03804","citing_paper":"/paper/2604.18556"},"observation_digest":"sha256:de2fc3c685790d63e1fc592c380db87f39af80f2a20fa473121630ed1df3f9c4","observation_id":"d3bceaf8-4ca8-4521-ab13-a7ef3799b873","resolution":{"observed_at":"2026-05-10T06:11:20.904553Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03804","last_updated":"2025-05-02T08:51:55Z","snapshot_observed_at":"2026-08-07T15:57:08.477835Z","submitted_at":"2025-05-02T08:51:55Z","title":"MoEQuant: Enhancing Quantization for Mixture-of-Experts Large Language Models via Expert-Balanced Sampling and Affinity Guidance","version":1},"cited_work":{"arxiv_id":"2505.03804","doi":"10.48550/arxiv.2505.03804","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.03804","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Moequant: Enhancing quantiza- tion for mixture-of-experts large language models via expert-balanced sampling and affinity guidance.arXiv preprint arXiv:2505.03804","venue":"ArXiv.org","work_id":"f76671ee-fdd5-4d71-b593-da746650afac","year":2025},"citing_paper":{"arxiv_id":"2604.18556","last_updated":"2026-05-15T09:34:30Z","snapshot_observed_at":"2026-07-06T23:05:21.974248Z","submitted_at":"2026-04-20T17:45:47Z","title":"GSQ: Highly-Accurate Low-Precision Scalar Quantization for LLMs via Gumbel-Softmax Sampling","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-19T18:01:08.514022Z"},"links":{"cited_paper":"/paper/2505.03804","citing_paper":"/paper/2604.18556"},"observation_digest":"sha256:6f81a550ee59024155aaf041ffe6282e1dea943711dea6bcfd5a1924b87f15cc","observation_id":"2b31aa35-bdf1-4787-a728-e9362d439d05","resolution":{"observed_at":"2026-05-19T18:02:42.225016Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03804","last_updated":"2025-05-02T08:51:55Z","snapshot_observed_at":"2026-08-07T15:57:08.477835Z","submitted_at":"2025-05-02T08:51:55Z","title":"MoEQuant: Enhancing Quantization for Mixture-of-Experts Large Language Models via Expert-Balanced Sampling and Affinity Guidance","version":1},"cited_work":{"arxiv_id":"2505.03804","doi":"10.48550/arxiv.2505.03804","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.03804","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Moequant: Enhancing quantiza- tion for mixture-of-experts large language models via expert-balanced sampling and affinity guidance.arXiv preprint arXiv:2505.03804","venue":"ArXiv.org","work_id":"f76671ee-fdd5-4d71-b593-da746650afac","year":2025},"citing_paper":{"arxiv_id":"2605.07317","last_updated":"2026-05-08T06:27:04Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:27:04Z","title":"Amortized-Precision Quantization for Early-Exit Vision Transformers","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:33.718361Z"},"links":{"cited_paper":"/paper/2505.03804","citing_paper":"/paper/2605.07317"},"observation_digest":"sha256:8e220cf3b0aa68abdb1d0d9b157628a00a78eaf39b0e7a77555c7ecefe48297b","observation_id":"50c9523e-c994-408d-9796-7985c3ff7d82","resolution":{"observed_at":"2026-05-11T01:40:52.175251Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03804","last_updated":"2025-05-02T08:51:55Z","snapshot_observed_at":"2026-08-07T15:57:08.477835Z","submitted_at":"2025-05-02T08:51:55Z","title":"MoEQuant: Enhancing Quantization for Mixture-of-Experts Large Language Models via Expert-Balanced Sampling and Affinity Guidance","version":1},"cited_work":{"arxiv_id":"2505.03804","doi":"10.48550/arxiv.2505.03804","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.03804","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Moequant: Enhancing quantiza- tion for mixture-of-experts large language models via expert-balanced sampling and affinity guidance.arXiv preprint arXiv:2505.03804","venue":"ArXiv.org","work_id":"f76671ee-fdd5-4d71-b593-da746650afac","year":2025},"citing_paper":{"arxiv_id":"2605.19929","last_updated":"2026-05-19T14:49:57Z","snapshot_observed_at":"2026-08-02T05:44:37.705586Z","submitted_at":"2026-05-19T14:49:57Z","title":"Breaking Modality Heterogeneity in Low-Bit Quantization for Large Vision-Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-20T05:20:45.264341Z"},"links":{"cited_paper":"/paper/2505.03804","citing_paper":"/paper/2605.19929"},"observation_digest":"sha256:0f408d8f7e2414948db23c617e7f684ce1521f2823c2ce89b1a7f06a9c4191a0","observation_id":"d3452b8e-70d2-434d-b80f-64f043fffd61","resolution":{"observed_at":"2026-05-20T05:23:03.616046Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03804","last_updated":"2025-05-02T08:51:55Z","snapshot_observed_at":"2026-08-07T15:57:08.477835Z","submitted_at":"2025-05-02T08:51:55Z","title":"MoEQuant: Enhancing Quantization for Mixture-of-Experts Large Language Models via Expert-Balanced Sampling and Affinity Guidance","version":1},"cited_work":{"arxiv_id":"2505.03804","doi":"10.48550/arxiv.2505.03804","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.03804","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Moequant: Enhancing quantiza- tion for mixture-of-experts large language models via expert-balanced sampling and affinity guidance.arXiv preprint arXiv:2505.03804","venue":"ArXiv.org","work_id":"f76671ee-fdd5-4d71-b593-da746650afac","year":2025},"citing_paper":{"arxiv_id":"2605.23078","last_updated":"2026-05-21T22:23:38Z","snapshot_observed_at":"2026-08-02T10:30:48.658412Z","submitted_at":"2026-05-21T22:23:38Z","title":"GEMQ: Global Expert-Level Mixed-Precision Quantization for MoE LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-25T05:33:06.719954Z"},"links":{"cited_paper":"/paper/2505.03804","citing_paper":"/paper/2605.23078"},"observation_digest":"sha256:a30563b294d57d03d9e89afa3dcd9eadcfd67d16a89f58316ceaff546d47f445","observation_id":"37b9ee1f-bb1e-4595-93d9-4d4164c544d8","resolution":{"observed_at":"2026-05-25T05:36:39.891051Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03804","last_updated":"2025-05-02T08:51:55Z","snapshot_observed_at":"2026-08-07T15:57:08.477835Z","submitted_at":"2025-05-02T08:51:55Z","title":"MoEQuant: Enhancing Quantization for Mixture-of-Experts Large Language Models via Expert-Balanced Sampling and Affinity Guidance","version":1},"cited_work":{"arxiv_id":"2505.03804","doi":"10.48550/arxiv.2505.03804","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.03804","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Moequant: Enhancing quantiza- tion for mixture-of-experts large language models via expert-balanced sampling and affinity guidance.arXiv preprint arXiv:2505.03804","venue":"ArXiv.org","work_id":"f76671ee-fdd5-4d71-b593-da746650afac","year":2025},"citing_paper":{"arxiv_id":"2606.04980","last_updated":"2026-06-03T15:03:18Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:03:18Z","title":"AlphaQ: Calibration-Free Bit Allocation for Mixture-of-Experts Quantization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T07:06:32.220604Z"},"links":{"cited_paper":"/paper/2505.03804","citing_paper":"/paper/2606.04980"},"observation_digest":"sha256:656d106d705054330b3f27249c5e978ad8fc2c116fb0a0ee2c6b358b139ace71","observation_id":"d483f08d-5f88-4a15-804e-a0720eec1406","resolution":{"observed_at":"2026-07-02T07:06:44.743847Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03804","last_updated":"2025-05-02T08:51:55Z","snapshot_observed_at":"2026-08-07T15:57:08.477835Z","submitted_at":"2025-05-02T08:51:55Z","title":"MoEQuant: Enhancing Quantization for Mixture-of-Experts Large Language Models via Expert-Balanced Sampling and Affinity Guidance","version":1},"cited_work":{"arxiv_id":"2505.03804","doi":"10.48550/arxiv.2505.03804","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.03804","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Moequant: Enhancing quantiza- tion for mixture-of-experts large language models via expert-balanced sampling and affinity guidance.arXiv preprint arXiv:2505.03804","venue":"ArXiv.org","work_id":"f76671ee-fdd5-4d71-b593-da746650afac","year":2025},"citing_paper":{"arxiv_id":"2606.05688","last_updated":"2026-06-04T04:13:05Z","snapshot_observed_at":"2026-08-08T00:24:45.856188Z","submitted_at":"2026-06-04T04:13:05Z","title":"Value-and-Structure Alignment for Routing-Consistent Quantization of Mixture-of-Experts Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-28T01:29:20.772523Z"},"links":{"cited_paper":"/paper/2505.03804","citing_paper":"/paper/2606.05688"},"observation_digest":"sha256:341b389ed7ec2d2e8ae8a682607c657bf38f8914e6c677759cfb69b9d619928e","observation_id":"ba76e5e7-e125-4f63-a8de-437dd7cd8b23","resolution":{"observed_at":"2026-06-28T01:31:28.846184Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.03804/citation-record","integrity":"/paper/2505.03804/integrity","json":"/paper/2505.03804/citation-record.json","paper":"/paper/2505.03804"},"outbound":[],"paper":{"arxiv_id":"2505.03804","last_updated":"2025-05-02T08:51:55Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T15:57:08.477835Z","submitted_at":"2025-05-02T08:51:55Z","title":"MoEQuant: Enhancing Quantization for Mixture-of-Experts Large Language Models via Expert-Balanced Sampling and Affinity Guidance"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2505.03804."}