{"as_of":"2026-08-16T04:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ede37eed96a2df8e46fdb101468506b9c03891283aede04db93b73a934580ce7","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T16:41:32.175324Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.02512/citation-record","integrity":"/paper/2509.02512/integrity","json":"/paper/2509.02512/citation-record.json","paper":"/paper/2509.02512"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:32.612970Z","title":"Molmoe-1b-0924","venue":null,"work_id":"ca37bd4c-f5d7-466e-a963-6beea55b3002","year":2024},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:31.998458Z"},"links":{"citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:19e708731d9d2742e562a8b721393c5a8268397c23eddcaf6feaa3524d3c65a4","observation_id":"24040821-4b9b-4b4e-a1c3-c5be5cbc81ad","resolution":{"observed_at":"2026-08-15T16:41:32.616064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:32.603016Z","title":"Randomized algorithms for estimating the trace of an implicit symmetric positive semi- definite matrix","venue":null,"work_id":"39f235d0-74ef-4af5-84ca-9f0f7c3130ca","year":null},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.002532Z"},"links":{"citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:3b1b4c938507b0617ab7c80b39652d2a5129f2daf13fb868f6ef6c970c1d1c5f","observation_id":"19badd8f-86a3-4d32-bd63-a1ee945bda78","resolution":{"observed_at":"2026-08-15T16:41:32.606298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:32.006119Z","title":"Lan- guage models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.006119Z"},"links":{"citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:36aa058b65a9e740827d53ec45d14335054a7927d5c9579b8c696448ff2dcfdb","observation_id":"ea2cb83c-2cb9-4947-8f0e-c07deef69175","resolution":{"observed_at":"2026-08-15T16:41:32.006119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06204","last_updated":"2025-04-09T13:54:59Z","snapshot_observed_at":"2026-08-14T07:20:22.540923Z","submitted_at":"2024-06-26T16:34:33Z","title":"A Survey on Mixture of Experts in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06204","snapshot_observed_at":"2026-08-15T16:41:32.009599Z","title":"A survey on mixture of experts.arXiv preprint arXiv:2407.06204, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.009599Z"},"links":{"cited_paper":"/paper/2407.06204","citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:a71736df0150a1438d6b3df36432f204ad6e4b795b094abc5e4b3105573fb74c","observation_id":"b1a63551-bbe7-41cc-b42b-365f3254a05c","resolution":{"observed_at":"2026-08-15T16:41:32.009599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05516","last_updated":"2024-10-08T02:02:35Z","snapshot_observed_at":"2026-08-14T07:24:19.123306Z","submitted_at":"2023-09-11T14:58:23Z","title":"Optimize Weight Rounding via Signed Gradient Descent for the Quantization of LLMs","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05516","snapshot_observed_at":"2026-08-15T16:41:32.013229Z","title":"Optimize weight round- ing via signed gradient descent for the quantization of llms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.013229Z"},"links":{"cited_paper":"/paper/2309.05516","citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:3ef50a469339c49bd35534b72e7004e62560767c6c024f8da47e4610e16d60fa","observation_id":"f1641370-7172-43bf-94e4-474c384660ae","resolution":{"observed_at":"2026-08-15T16:41:32.013229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:32.021212Z","title":"Palm: Scaling language modeling with pathways","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.021212Z"},"links":{"citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:03df5ebc1c9d4325f38ac3bc1196bcefade0bea81342432781af4d1b43056b8d","observation_id":"eca98d07-cd4e-4b3c-924d-af7a21002fd8","resolution":{"observed_at":"2026-08-15T16:41:32.021212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06066","last_updated":"2024-01-11T17:31:42Z","snapshot_observed_at":"2026-08-13T15:18:04.411100Z","submitted_at":"2024-01-11T17:31:42Z","title":"DeepSeekMoE: Towards Ultimate Expert Specialization in Mixture-of-Experts Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06066","snapshot_observed_at":"2026-08-15T16:41:32.025478Z","title":"Deepseekmoe: Towards ultimate expert specialization in mixture-of-experts language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.025478Z"},"links":{"cited_paper":"/paper/2401.06066","citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:8c9fe81330932ef4fb9932342434a3270dde94133ea624ad7895d5394d4188a4","observation_id":"8a104721-1b4b-49b6-8953-6e7569ec6ebc","resolution":{"observed_at":"2026-08-15T16:41:32.025478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:32.580938Z","title":"Deepseek-vl2","venue":null,"work_id":"c4052837-3556-46a7-9556-3e59ec701c4d","year":2024},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.029237Z"},"links":{"citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:ecd22e465b6021df1b7f439441ae2abc3c55b6611f456db31221631c16fe7c2b","observation_id":"2ea871a8-0576-4dc9-8add-e0688f366342","resolution":{"observed_at":"2026-08-15T16:41:32.583930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:32.571218Z","title":"Deepseek-vl2 small","venue":null,"work_id":"52018841-0809-4a53-857c-39d31a3171d6","year":null},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.032209Z"},"links":{"citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:84e266c6d7d254d4ea134cebd9f8d35e360b342161c48f275d36aea6e2ee3666","observation_id":"9e15e2b3-5cdf-4096-ba21-e72f67acdbcd","resolution":{"observed_at":"2026-08-15T16:41:32.574452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:32.562008Z","title":"Deepseek-vl2 tiny","venue":null,"work_id":"241e99a6-f60c-4a08-adcf-abe31238cb4b","year":null},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.035294Z"},"links":{"citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:4ef82d83992a109430865c7fee501294c66a21bc00c58ad39a5fff71f1c0a3a1","observation_id":"6d47aade-fb48-427d-a9a5-cf742f7f9dea","resolution":{"observed_at":"2026-08-15T16:41:32.565012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17146","last_updated":"2024-12-05T14:28:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-25T17:59:51Z","title":"Molmo and PixMo: Open Weights and Open Data for State-of-the-Art Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.17146","snapshot_observed_at":"2026-08-15T16:41:32.038472Z","title":"Molmo and pixmo: Open weights and open data for state-of-the-art multimodal models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.038472Z"},"links":{"cited_paper":"/paper/2409.17146","citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:6aefc9a5c7926dabde4dbfa2deda289f0e9d969d1a471d1a28d40c36b408f88d","observation_id":"15e050cf-96a1-4d30-8149-15acf0baf607","resolution":{"observed_at":"2026-08-15T16:41:32.038472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:32.552670Z","title":"Hawq: Hessian aware quantization of neural networks with mixed-precision","venue":null,"work_id":"b0a42ab0-08e9-4c90-8437-424fc319295d","year":2019},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.042025Z"},"links":{"citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:c29fb74e00b1684a5a2ab02a81b4af275579c879ecb4a3fcaed4c3323cfb2954","observation_id":"32458c72-180d-44f6-aa5e-9a2c9404acd5","resolution":{"observed_at":"2026-08-15T16:41:32.555727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:32.045140Z","title":"Hawq-v2: Hessian aware trace-weighted quantization of neural networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.045140Z"},"links":{"citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:0c0f5ef36564dee44b8435b104faf7f48efacf0e1f9b1b0bbb55638da5076b5c","observation_id":"eedb48ca-184c-4a46-bde9-8443aa95c8eb","resolution":{"observed_at":"2026-08-15T16:41:32.045140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:32.536339Z","title":"Vlmevalkit: An open-source toolkit for evaluating large multi-modality models","venue":null,"work_id":"51982cef-c3ef-4aee-a7cb-c619451f0a01","year":2024},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.052570Z"},"links":{"citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:41a1c408b036c6863ec41a5772cde46ae7bf8ccbf5ca7d259183c61ace6ab866","observation_id":"3a67ce05-e79b-4bfb-a55e-c39a92bda0ae","resolution":{"observed_at":"2026-08-15T16:41:32.539821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-11T21:19:33.078277Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-15T16:41:32.055804Z","title":"Gptq: Accurate post-training quantization for generative pre-trained transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.055804Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:1d562d077643cb84cf4eae71e47aea5294d5575ea2bf7e2a77daac461ac9a5fd","observation_id":"173deb43-2a42-4cd2-896b-27970609d3f5","resolution":{"observed_at":"2026-08-15T16:41:32.055804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-08-15T16:41:32.058916Z","title":"Mme: A comprehensive evaluation bench- mark for multimodal large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.058916Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:ffe7861c75273b32e8ecb599cb6b46ad7770824eec419cbbb5aafa5106f51be2","observation_id":"271600e9-e5e9-4938-9c29-085b248a0c61","resolution":{"observed_at":"2026-08-15T16:41:32.058916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-15T16:41:32.062227Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.062227Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:c28dbc49022bd0c7ffd52163d2a469b45a1399404d64ec5c91c7982399fcb408","observation_id":"fcf34064-5c2e-473b-a4cf-360a5d0ba75f","resolution":{"observed_at":"2026-08-15T16:41:32.062227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06270","last_updated":"2025-02-22T06:19:05Z","snapshot_observed_at":"2026-08-12T22:27:55.012762Z","submitted_at":"2024-10-08T18:09:38Z","title":"Mixture Compressor for Mixture-of-Experts LLMs Gains More","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06270","snapshot_observed_at":"2026-08-15T16:41:32.065487Z","title":"Mc-moe: Mixture compressor for mixture-of-experts llms gains more","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.065487Z"},"links":{"cited_paper":"/paper/2410.06270","citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:68757d2299806c5ba7c40f41e1bfe903da5f7e0749b7463040516a28e258854c","observation_id":"b1f8362e-98ac-4b02-af34-6a6ad571a912","resolution":{"observed_at":"2026-08-15T16:41:32.065487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:32.525843Z","title":"A stochastic estimator of the trace of the influence matrix for laplacian smoothing splines","venue":null,"work_id":"a6fa9852-ac93-45d0-9558-d1edf701239f","year":1989},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.068626Z"},"links":{"citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:ffe64c8e125acc6b1779d5fb0e79d0f5502fcc34593917acf338d70255c4c580","observation_id":"1fccf869-d0eb-47ba-bc1e-7a97a0f3f063","resolution":{"observed_at":"2026-08-15T16:41:32.529113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:32.515021Z","title":"Intel autoround","venue":null,"work_id":"8eaefa80-6dc0-4b11-a7d3-f4297178e66e","year":null},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.071663Z"},"links":{"citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:8646edf748b22b59a310f21be0586511db88946b5e84fb56bd23e6a285c78201","observation_id":"2a0e092a-f86c-4d92-b9b6-cdeb6412df20","resolution":{"observed_at":"2026-08-15T16:41:32.519103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-13T19:43:49.936776Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-15T16:41:32.076337Z","title":"Mixtral of experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.076337Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:dd9da057e06abad56804236d7a6f32f6f70309e12baf9ec4c2ab923390869049","observation_id":"fb1e6bb7-d0ae-4a57-9e54-29450d93ffe9","resolution":{"observed_at":"2026-08-15T16:41:32.076337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:32.079898Z","title":"A diagram is worth a dozen images","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.079898Z"},"links":{"citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:ce86b5f773aabf307cbe549b209b815d764d4775e7c16a422f56af37db32dff7","observation_id":"5023d3d8-abe8-4059-ab90-30d8cc498f23","resolution":{"observed_at":"2026-08-15T16:41:32.079898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:32.499027Z","title":"Efficient memory management for large language model serving with pagedattention","venue":null,"work_id":"d6f0600a-ff6a-4b88-98fa-3702e2587530","year":2023},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.083012Z"},"links":{"citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:0932816ef125225209cb9f2d86acb32d27fcf3b5e9981b78278a36c560662122","observation_id":"6b9fa6e9-8ede-4b9c-96da-b25c551c53cd","resolution":{"observed_at":"2026-08-15T16:41:32.502776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08155","last_updated":"2025-02-25T18:29:54Z","snapshot_observed_at":"2026-08-12T23:44:38.250423Z","submitted_at":"2024-06-12T12:44:48Z","title":"QuantMoE-Bench: Examining Post-Training Quantization for Mixture-of-Experts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08155","snapshot_observed_at":"2026-08-15T16:41:32.086113Z","title":"Ex- amining post-training quantization for mixture-of-experts: A benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.086113Z"},"links":{"cited_paper":"/paper/2406.08155","citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:55f03f72274f77abc1ae760bcd0512f8d8bb0595c27ccb702933c5f72bee847b","observation_id":"760e1b72-90d1-4fc3-9f7d-0a099ebef168","resolution":{"observed_at":"2026-08-15T16:41:32.086113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15947","last_updated":"2024-12-23T08:05:14Z","snapshot_observed_at":"2026-08-06T02:31:58.372974Z","submitted_at":"2024-01-29T08:13:40Z","title":"MoE-LLaVA: Mixture of Experts for Large Vision-Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15947","snapshot_observed_at":"2026-08-15T16:41:32.089354Z","title":"Moe-llava: Mixture of experts for large vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.089354Z"},"links":{"cited_paper":"/paper/2401.15947","citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:07da37274c49589afd193789173c5849cb1586b54984215ca3f5cb9958b7ba4f","observation_id":"7efd16f1-9324-413f-a7af-23826f4ea0a0","resolution":{"observed_at":"2026-08-15T16:41:32.089354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:32.092558Z","title":"Awq: Activation-aware weight quantization for on-device llm compression and acceleration","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.092558Z"},"links":{"citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:9c31715f7e4fb125c8187796eca83324ae08a014cb767289748eccc0542739f8","observation_id":"446b3b4c-6dc1-43dc-b003-f9d583bfb87f","resolution":{"observed_at":"2026-08-15T16:41:32.092558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-08-15T16:41:32.095583Z","title":"Deepseek-v2: A strong, economical, and efficient mixture-of-experts language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.095583Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:3eef0027939b9d0179ed885a1de503fd780ead9b40002925c514fc62319bbe2c","observation_id":"e3fa15f0-d15f-47c9-94c0-ce2c06779c92","resolution":{"observed_at":"2026-08-15T16:41:32.095583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-15T17:27:11.980940Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-15T16:41:32.099051Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.099051Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:76aa9c2ae7032f7534b74d56bc57282ff7436f260bbf48f08b83e117dd6ecd6b","observation_id":"76e382de-9d50-47da-8221-2e306ebb3cde","resolution":{"observed_at":"2026-08-15T16:41:32.099051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14219","last_updated":"2025-01-22T03:33:25Z","snapshot_observed_at":"2026-08-13T23:36:29.207493Z","submitted_at":"2024-12-18T14:11:15Z","title":"A Survey on Inference Optimization Techniques for Mixture of Experts Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14219","snapshot_observed_at":"2026-08-15T16:41:32.103806Z","title":"A survey on inference optimization techniques for mixture of experts models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.103806Z"},"links":{"cited_paper":"/paper/2412.14219","citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:a5595c5b48d155a68df9d5056ef8bf838ded4699b93d004181506c9f7a97e0ae","observation_id":"7a15768f-cd61-47c5-aa42-83d95bffcd15","resolution":{"observed_at":"2026-08-15T16:41:32.103806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-13T11:30:33.812255Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-15T16:41:32.107361Z","title":"Llm-qat: Data-free quantization aware training for large language models.arXiv preprint arXiv:2305.17888, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.107361Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:f045fa9a7f967353b4a57f79f8c8110411490b8a69c02da644f898dca0f86a97","observation_id":"c6607214-15dd-42ce-b7f2-d63bba02e765","resolution":{"observed_at":"2026-08-15T16:41:32.107361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:32.110581Z","title":"Learn to explain: Multimodal reasoning via thought chains for science question answering","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.110581Z"},"links":{"citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:4b9ac7d01179ef04be7d53c3dc8451f947adc62bbd8b832ec142d7ac86f2a998","observation_id":"1f601a82-cb7b-4750-b5c5-342e8d979044","resolution":{"observed_at":"2026-08-15T16:41:32.110581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:32.113942Z","title":"Docvqa: A dataset for vqa on document images","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.113942Z"},"links":{"citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:32de5b8411869aab50ab85cf09975b6cc2800203e7713cf71024e90313b41698","observation_id":"bf9efe5f-5155-405b-8edd-38fb5a17c00a","resolution":{"observed_at":"2026-08-15T16:41:32.113942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:32.117328Z","title":"Infographicvqa","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.117328Z"},"links":{"citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:ca6ed4d2afbd5d95b04cd91bbf4cdddd4f366af9a7c1df303c3adf83e10d8744","observation_id":"ee25f440-f4ea-40a6-aa42-b50e7f80460f","resolution":{"observed_at":"2026-08-15T16:41:32.117328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02060","last_updated":"2025-03-03T01:25:46Z","snapshot_observed_at":"2026-08-15T00:07:51.079800Z","submitted_at":"2024-09-03T17:08:20Z","title":"OLMoE: Open Mixture-of-Experts Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02060","snapshot_observed_at":"2026-08-15T16:41:32.121506Z","title":"Olmoe: Open mixture-of-experts language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.121506Z"},"links":{"cited_paper":"/paper/2409.02060","citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:2427e1fcee52671ca8c6b223ba965b943ed3ac78d14b4c64ef09133366a375a5","observation_id":"53385fcc-1bc1-4689-9546-92c4219b206c","resolution":{"observed_at":"2026-08-15T16:41:32.121506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06538","last_updated":"2017-01-23T18:10:00Z","snapshot_observed_at":"2026-08-13T11:35:07.866136Z","submitted_at":"2017-01-23T18:10:00Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06538","snapshot_observed_at":"2026-08-15T16:41:32.124813Z","title":"Outra- geously large neural networks: The sparsely-gated mixture- of-experts layer","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.124813Z"},"links":{"cited_paper":"/paper/1701.06538","citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:af26122cfe0d4eb5425966359e67af549d37e0331db17f9c4cd0665861d56e0c","observation_id":"ff741dfd-f31f-42bc-a1df-c5678a7522e3","resolution":{"observed_at":"2026-08-15T16:41:32.124813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:32.128711Z","title":"Towards vqa models that can read","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.128711Z"},"links":{"citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:6e4990139c1474ffbd4e9967655b0cda75337f8b86010f1450e35d923e70adbd","observation_id":"675d8403-faa9-45fc-a1e6-575fb63afbc3","resolution":{"observed_at":"2026-08-15T16:41:32.128711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-15T16:41:32.134734Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.134734Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:c60b79b970942e89cee3c1f1840f1f29790606bbe46bf72b23aacae584e84c5a","observation_id":"8fe81e67-d0d6-4d61-9f77-4d52e0d07fff","resolution":{"observed_at":"2026-08-15T16:41:32.134734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-13T05:08:25.522951Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-15T16:41:32.138621Z","title":"Efficient large language models: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.138621Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:bf6abd4773758e3fb5ba3bfc4da170c4742151c3ebad9f8c5b3c75018d0be520","observation_id":"8b0e460f-5dae-4ac0-8dbf-aa6239e85eea","resolution":{"observed_at":"2026-08-15T16:41:32.138621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-08-15T16:41:32.142124Z","title":"Deepseek-vl2: Mixture-of- experts vision-language models for advanced multimodal understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.142124Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:15176763f045a4fae99c7d474040d9d6e389fe981765e3ad980dfa74a70f738b","observation_id":"16a44e97-b0db-4d09-8c5a-e6ef4282d0eb","resolution":{"observed_at":"2026-08-15T16:41:32.142124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:32.145492Z","title":"Smoothquant: Accurate and effi- cient post-training quantization for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.145492Z"},"links":{"citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:3ea487b47d01d86d918a49a6cbd1aa81d6a904c1ebe6e38165a82653af240dc8","observation_id":"4ed95c99-da27-4235-94f3-855fd23f9480","resolution":{"observed_at":"2026-08-15T16:41:32.145492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:32.157459Z","title":"Zeroquant: Ef- ficient and affordable post-training quantization for large- scale transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.157459Z"},"links":{"citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:3dfb6cfea86efedb25a9c66f5737a6cfea61126ff6203040f5d0f633a0c5e8bb","observation_id":"3f5668c7-57f4-4b93-81a4-ca1608fecbc4","resolution":{"observed_at":"2026-08-15T16:41:32.157459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13549","last_updated":"2024-11-29T15:51:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T15:21:52Z","title":"A Survey on Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13549","snapshot_observed_at":"2026-08-15T16:41:32.160814Z","title":"A survey on multimodal large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.160814Z"},"links":{"cited_paper":"/paper/2306.13549","citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:a456aebed4b360dc7ee8d1558d766ffcac99ceb335bf1827f22c7e87098dfc9a","observation_id":"e6cc9d12-ed6f-4f3f-b2bb-ac81e9da629b","resolution":{"observed_at":"2026-08-15T16:41:32.160814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:32.164733Z","title":"Mmmu: A massive multi-discipline multimodal understanding and reasoning benchmark for ex- pert agi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.164733Z"},"links":{"citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:c80790b0e83c93a427b9b1ddfefd62f680b067c3e9ae2012b56e8b67b536aaa6","observation_id":"282f8ba5-6beb-476a-af8b-cad8150c9514","resolution":{"observed_at":"2026-08-15T16:41:32.164733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:32.169207Z","title":"Vision-language models for vision tasks: A survey","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.169207Z"},"links":{"citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:3ce2d1e42ef6efa29d44943d133f534298346ae9aec1186d3ce3aa42fceb6ef8","observation_id":"57521fa1-9814-42f8-b5e9-774d7c3ac7dc","resolution":{"observed_at":"2026-08-15T16:41:32.169207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13257","last_updated":"2025-02-05T08:44:02Z","snapshot_observed_at":"2026-08-13T00:35:03.634903Z","submitted_at":"2024-08-23T17:59:51Z","title":"MME-RealWorld: Could Your Multimodal LLM Challenge High-Resolution Real-World Scenarios that are Difficult for Humans?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13257","snapshot_observed_at":"2026-08-15T16:41:32.172284Z","title":"Mme-realworld: Could your multimodal llm challenge high-resolution real-world scenarios that are difficult for humans? arXiv preprint arXiv:2408.13257, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.172284Z"},"links":{"cited_paper":"/paper/2408.13257","citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:2d0bc6de70c0742fd4aa186e86a52c1ced25f3c6980c127d52c9c9b0acbf6065","observation_id":"d93d5894-c246-404c-91a2-a11af72e3b90","resolution":{"observed_at":"2026-08-15T16:41:32.172284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:41:32.424321Z","title":"A survey on model compression for large language models","venue":null,"work_id":"1404d8ce-b120-4f24-9787-801243e7ebb6","year":2024},"citing_paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T16:41:32.175324Z"},"links":{"citing_paper":"/paper/2509.02512"},"observation_digest":"sha256:c4e8049bda2756d00626df8f795a15db7d8a550792b78195087af2f623627fe4","observation_id":"49f4e81a-8e4c-4175-8948-e0ce0c88e946","resolution":{"observed_at":"2026-08-15T16:41:32.429895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.02512","last_updated":"2025-09-02T17:04:59Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T16:35:30.431407Z","submitted_at":"2025-09-02T17:04:59Z","title":"MoPEQ: Mixture of Mixed Precision Quantized Experts"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 0 inbound Pith citation observations for arXiv:2509.02512."}