{"as_of":"2026-08-11T18:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:835a40f0c30fc58f6b501785929c588afe42c2dc53cf98c4d6d33e5ff18754b7","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T20:56:20.810881Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-17T04:17:31.955480Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-17T04:19:00.475622Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"cited_work":{"arxiv_id":"2501.07139","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.07139","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"32d0d095-2b11-4ca5-beef-31aa91cf6645","year":2025},"citing_paper":{"arxiv_id":"2511.22599","last_updated":"2026-04-08T14:04:20Z","snapshot_observed_at":"2026-08-03T23:42:45.825181Z","submitted_at":"2025-11-27T16:27:35Z","title":"DisCEdge: Distributed Context Management for Large Language Models at the Edge","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-17T04:17:31.955480Z"},"links":{"cited_paper":"/paper/2501.07139","citing_paper":"/paper/2511.22599"},"observation_digest":"sha256:55064d357c18a46b1dc2b4403baa2166c4269139c4bdb5e941efc3a036ce05fe","observation_id":"0838f317-4f68-4a38-ae21-73fa45d6e066","resolution":{"observed_at":"2026-05-17T04:19:00.478298Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.07139/citation-record","integrity":"/paper/2501.07139/integrity","json":"/paper/2501.07139/citation-record.json","paper":"/paper/2501.07139"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:21.355683Z","title":"Introducing Copilot+ PCs - The Official Microsoft Blog,","venue":null,"work_id":"0a03c1e2-1cb6-40db-ba27-f1c5c6e69e6c","year":2024},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.667250Z"},"links":{"citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:736c33ca708a8b0659cd2b9b2f34ac2aa6dc2e7dc1adfe819103fd407b660f6d","observation_id":"37c7d6ff-34c7-49e7-b52c-5a0ebe6f3219","resolution":{"observed_at":"2026-08-10T20:56:21.360789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:21.340046Z","title":"Introducing Apple Foundation Mod- els,","venue":null,"work_id":"7abe7d24-bcfb-4785-a44a-10dcf4bd3fa3","year":2024},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.671694Z"},"links":{"citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:b823098cb5757778a5921e718ad92268eb78c0344c6fb5077abc2f5b2eeffaa5","observation_id":"6819c35e-51d7-4078-8c6d-bb6366598d07","resolution":{"observed_at":"2026-08-10T20:56:21.345330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:21.325850Z","title":"Google AI Edge — Google AI for Developers,","venue":null,"work_id":"45e86bf2-4750-4898-a71a-86c754ba4507","year":2024},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.675820Z"},"links":{"citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:9d46bf7959d89fb2ca8466bd95e212207b7154749264eeafe7f639cd87568d62","observation_id":"706bae7c-9709-49e7-9ea2-afe0f7b3b1d3","resolution":{"observed_at":"2026-08-10T20:56:21.330585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:21.311352Z","title":"How to bring your AI Model to Android devices,","venue":null,"work_id":"803f0635-84ea-43af-af34-62cb64f96139","year":2024},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.680381Z"},"links":{"citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:084840e4d618bbed3b93a8774861d551d502d44adbb8cce6999fb852405d29af","observation_id":"9c01d506-a603-4c5f-ac76-59ed09b31fda","resolution":{"observed_at":"2026-08-10T20:56:21.316044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:21.297408Z","title":"Gemini Nano is now available on Android via ex- perimental access,","venue":null,"work_id":"6e33c0c5-8667-423f-88b3-b117f030f10a","year":2024},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.685448Z"},"links":{"citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:2834fa7c0bd16e1a9c5b22828b1a84e8af3b44297ec21498747e1b2dec180ba1","observation_id":"d638f7f6-3334-4ce2-84bb-6fe1e73cd18b","resolution":{"observed_at":"2026-08-10T20:56:21.301960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:21.283680Z","title":"Snapdragon X Elite Product Brief,","venue":null,"work_id":"99e9007e-7b9d-4792-a402-3891b8870674","year":2024},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.690520Z"},"links":{"citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:6547db3a6d85b4fdfb486adeb4c185d5a8cb059cd3f5f84909d310a0c07bfac0","observation_id":"c3eaed91-ec71-4584-b267-20d7e1f5a06b","resolution":{"observed_at":"2026-08-10T20:56:21.288269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:20.695514Z","title":"Retrieval- augmented generation for knowledge-intensive nlp tasks,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.695514Z"},"links":{"citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:496b906aae266b864281f34f75df2f19785b5a2ee1f39fbc5692e6545d1761bd","observation_id":"54156536-7bcb-4abe-87b6-e9b5165dc085","resolution":{"observed_at":"2026-08-10T20:56:20.695514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:21.260569Z","title":"NVIDIA Jetson AGX Orin — nvidia.com,","venue":null,"work_id":"adfd864c-259d-4e64-878c-188f16b0328f","year":2024},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.699709Z"},"links":{"citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:7ef3ee0dec36baadd3c69b6bceac3561b423d6845e6022af2b55be404ccd4144","observation_id":"e519b634-24c6-4c47-bacf-d9e753672af5","resolution":{"observed_at":"2026-08-10T20:56:21.265258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:21.246150Z","title":"Demystifying Unified Memory on Jetson — GTC Digital Spring 2022 — NVIDIA On-Demand — nvidia.com,","venue":null,"work_id":"80da0f77-9b5b-40a8-a07d-296264135455","year":2022},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.704048Z"},"links":{"citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:e4d5e3bcd299fa50d82bfa75121b63942a22875cb235d3e22915254462305101","observation_id":"564176d6-8754-46b2-b4f5-d6326e91656b","resolution":{"observed_at":"2026-08-10T20:56:21.251106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:21.231449Z","title":"Apple introduces M4 Pro and M4 Max,","venue":null,"work_id":"d786a714-40fc-4def-8e9f-9d1f058a9a9f","year":2024},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.708319Z"},"links":{"citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:bd5fc5a6ba39a02480e5e7ca0e450af6211f3c419baa10c5bda814b8a7b5f051","observation_id":"03543028-75fa-4e02-851c-8cc2b17ad8be","resolution":{"observed_at":"2026-08-10T20:56:21.235858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-07T08:38:54.025062Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-10T20:56:20.712515Z","title":"Gptq: Accurate post-training quantization for generative pre-trained transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.712515Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:c1b64bc36efcb2c4fed7c21fb39489d7908fac32f4ab66f6a40e510a7bc7f983","observation_id":"5be6e589-4917-4b06-bd1c-0b0b8230479d","resolution":{"observed_at":"2026-08-10T20:56:20.712515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:20.717321Z","title":"Smoothquant: Accurate and efficient post-training quantization for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.717321Z"},"links":{"citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:778960a194260fc9f5481d6631f472bed09b43e2ec6d61ef27be72cea136d643","observation_id":"d811b942-77ca-475f-9856-68d966711580","resolution":{"observed_at":"2026-08-10T20:56:20.717321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:21.208068Z","title":"Any-precision LLM: Low-cost deployment of multiple, different-sized LLMs,","venue":null,"work_id":"776484e5-7ba2-45b4-8130-bf2fb143738e","year":2024},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.722061Z"},"links":{"citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:02f51ed800a038037ae58f71f7d9f92b4bfdbdc604625bfc18d52c003f17838e","observation_id":"c36d3bce-e630-4e08-8f9b-165f0b5e7c4b","resolution":{"observed_at":"2026-08-10T20:56:21.212784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08659","last_updated":"2023-11-28T16:06:59Z","snapshot_observed_at":"2026-08-10T01:10:20.500227Z","submitted_at":"2023-10-12T18:34:08Z","title":"LoftQ: LoRA-Fine-Tuning-Aware Quantization for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08659","snapshot_observed_at":"2026-08-10T20:56:20.726481Z","title":"Loftq: Lora-fine-tuning-aware quantization for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.726481Z"},"links":{"cited_paper":"/paper/2310.08659","citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:f8544109547f12c17de184a38c826e83abc8ef828ef50a9b0c7280aaa5e2b966","observation_id":"f88a258f-7f1d-4def-a702-682ea89bb388","resolution":{"observed_at":"2026-08-10T20:56:20.726481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.08295","last_updated":"2021-06-15T17:12:42Z","snapshot_observed_at":"2026-08-02T11:19:40.664702Z","submitted_at":"2021-06-15T17:12:42Z","title":"A White Paper on Neural Network Quantization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.08295","snapshot_observed_at":"2026-08-10T20:56:20.731054Z","title":"A white paper on neural network quantization,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.731054Z"},"links":{"cited_paper":"/paper/2106.08295","citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:c32d60d4967cd955ec1594fa3dcc287f360a0557e4fe1431ce5a74acc2c5c09f","observation_id":"ee5dfc40-8b24-4f58-8226-8670d2f1dafe","resolution":{"observed_at":"2026-08-10T20:56:20.731054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-10T23:43:21.615256Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-08-10T20:56:20.735632Z","title":"Squeezellm: Dense-and-sparse quantization,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.735632Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:2fbf2c34db0630d3d9b12331c55de01010a84ff3c4ddd4b19cab000a738989e6","observation_id":"546c6e91-2378-4d7f-b935-d5c1767416df","resolution":{"observed_at":"2026-08-10T20:56:20.735632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:20.740219Z","title":"Awq: Activation-aware weight quanti- zation for on-device llm compression and acceleration,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.740219Z"},"links":{"citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:1478d18251d7e90972e3eb3ef9702f9fe59fb35d44a0a19f21b00664779e0135","observation_id":"c4403bb3-9a9e-4421-aa1d-80a13f6c9856","resolution":{"observed_at":"2026-08-10T20:56:20.740219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:20.744438Z","title":"Zeroquant: Efficient and affordable post-training quantization for large- scale transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.744438Z"},"links":{"citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:8702dbeac355518aa2260b452893a65922fb0c489892a39f4259eee738449195","observation_id":"c782a4b0-6513-479f-8bf3-09726e0b074c","resolution":{"observed_at":"2026-08-10T20:56:20.744438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03078","last_updated":"2023-06-05T17:53:28Z","snapshot_observed_at":"2026-08-08T23:08:43.190961Z","submitted_at":"2023-06-05T17:53:28Z","title":"SpQR: A Sparse-Quantized Representation for Near-Lossless LLM Weight Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03078","snapshot_observed_at":"2026-08-10T20:56:20.748730Z","title":"Spqr: A sparse- quantized representation for near-lossless llm weight compression,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.748730Z"},"links":{"cited_paper":"/paper/2306.03078","citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:79b329846a9e725a971e5c4df883acdd05a0ee63e73a4b0386ad2556ab54e8d6","observation_id":"d36ed694-b2e0-4676-89ce-ebe3d3c44740","resolution":{"observed_at":"2026-08-10T20:56:20.748730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:20.753205Z","title":"Up or down? adaptive rounding for post-training quantization,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.753205Z"},"links":{"citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:84329bb5e5e3f5457dd4650f4f91e3b5af7939b35cfe837a3a61686932b94419","observation_id":"d2eb4c64-5caf-4789-9677-c553051f6c73","resolution":{"observed_at":"2026-08-10T20:56:20.753205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:20.757593Z","title":"Elms: Elasticized large language models on mobile devices,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.757593Z"},"links":{"citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:bed6f5bb4c0a24111535ce95fa66d7bfa8ad3516160eb16721fd981de7107f5f","observation_id":"8a20c4e2-cf80-41e2-b488-1404a70921e6","resolution":{"observed_at":"2026-08-10T20:56:20.757593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11805","last_updated":"2024-03-18T14:03:23Z","snapshot_observed_at":"2026-07-06T17:46:20.935124Z","submitted_at":"2024-03-18T14:03:23Z","title":"LLM as a System Service on Mobile Devices","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11805","snapshot_observed_at":"2026-08-10T20:56:20.761697Z","title":"Llm as a system service on mobile devices,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.761697Z"},"links":{"cited_paper":"/paper/2403.11805","citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:edad3f0350d5d13061e7103e1745e044402f45db179e7e13e3b665f85e66024d","observation_id":"69ea1b72-5b66-412d-9575-b3ec151a9caf","resolution":{"observed_at":"2026-08-10T20:56:20.761697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:21.166469Z","title":"End the senseless killing: Improving memory management for mobile operating systems,","venue":null,"work_id":"e1b992b3-f898-4e77-92df-17976e05c916","year":2020},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.766677Z"},"links":{"citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:5b5ddba94090646c4889acc234dad3a66559470dd6f94bc42410158c3d1ca32d","observation_id":"d82262ca-2113-4b92-b520-e53c334a65bd","resolution":{"observed_at":"2026-08-10T20:56:21.171098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:21.151240Z","title":"Efficient selectivity and backup operators in monte-carlo tree search,","venue":null,"work_id":"4ee8e8f6-5629-4740-a984-29cc141f5240","year":2006},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.771181Z"},"links":{"citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:bb29814a1c7f5e45dbc320ee09403375532d99f972ede8c156b27697713ff460","observation_id":"6079c2ac-6ae7-40d0-972b-98df799e7405","resolution":{"observed_at":"2026-08-10T20:56:21.155984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-10T20:56:20.775086Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.775086Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:ea4e0904e041ab70c78888bae570ff1917ebbf5c979800240646ef1af29799d3","observation_id":"81d46128-713b-41f6-b7ee-fdd022e0937d","resolution":{"observed_at":"2026-08-10T20:56:20.775086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-10T20:56:20.778966Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.778966Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:6c34ec8f40774eee7381fa3cf03c4f2779e05568ef253b23216ebad60db4265f","observation_id":"40e8b55d-1d2d-4df4-bdc5-64460b1e5f45","resolution":{"observed_at":"2026-08-10T20:56:20.778966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-10T20:56:20.782845Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.782845Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:3b129d09c9ea7cf2cac0909ceaacb33f39a21e50cfbbe855900b72c970ed51e9","observation_id":"60521ace-9a35-4617-9d24-ffd19a8346b9","resolution":{"observed_at":"2026-08-10T20:56:20.782845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:20.786663Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.786663Z"},"links":{"citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:337f5e7f615b52bf378414450a8e6482e7f617f41015d04de4694de22c92dd89","observation_id":"8d65c04b-fb71-4696-9841-c56820dd5250","resolution":{"observed_at":"2026-08-10T20:56:20.786663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07843","last_updated":"2016-09-26T04:06:13Z","snapshot_observed_at":"2026-07-06T05:12:10.387914Z","submitted_at":"2016-09-26T04:06:13Z","title":"Pointer Sentinel Mixture Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07843","snapshot_observed_at":"2026-08-10T20:56:20.790669Z","title":"Pointer sentinel mixture models,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.790669Z"},"links":{"cited_paper":"/paper/1609.07843","citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:85a24b527975632c69184bdb380be02c263354fe0f3128ce1632322150c441ef","observation_id":"dbe3138e-03ad-4d87-abf6-750638a641c4","resolution":{"observed_at":"2026-08-10T20:56:20.790669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:21.127840Z","title":"Building a large annotated corpus of english: the penn treebank,","venue":null,"work_id":"03e89ba0-d6fe-4c48-9ec5-3da84c5dfa6b","year":1993},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.794835Z"},"links":{"citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:31564aaff8edf59441d9024d74c929b37a90ba572061e92ae3840bdbc26a9590","observation_id":"52b56e4f-9431-4edc-bddf-5a5ee2326879","resolution":{"observed_at":"2026-08-10T20:56:21.132258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-10T20:56:20.798690Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.798690Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:c5144b5438416c2dcedff1e41b39fff9590c6884caf40fb22cabef81bba58bfd","observation_id":"8394fd10-b35d-45d1-8d40-42cbdfa773d8","resolution":{"observed_at":"2026-08-10T20:56:20.798690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-08-10T16:18:23.994244Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-10T20:56:20.802554Z","title":"Hel- laswag: Can a machine really finish your sentence?","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.802554Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:5237aacfde109fc2be43b7ee40ff0c81dd4a0a4dc2eacdcd3f80171c11a91ef5","observation_id":"b16485a2-9063-4653-bb0b-6b946e1d778a","resolution":{"observed_at":"2026-08-10T20:56:20.802554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:21.110893Z","title":"Piqa: Reasoning about physical commonsense in natural language,","venue":null,"work_id":"2455a33d-bbf3-4c8c-a844-7da494687a9f","year":2020},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.806599Z"},"links":{"citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:f54285e5e3169f6b2eb9a424980eb29cbe7f20ccb5b0e8fabca22ea8c6012ad9","observation_id":"11e9d0d3-492d-4fa6-90a9-29444339f2a9","resolution":{"observed_at":"2026-08-10T20:56:21.117586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:56:20.810881Z","title":"Winogrande: An adversarial winograd schema challenge at scale,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T20:56:20.810881Z"},"links":{"citing_paper":"/paper/2501.07139"},"observation_digest":"sha256:6721031ceb48dc726a6a8025ad6dba71378dd381829c9506bd092f62eea1fa86","observation_id":"efcb28c3-a6cb-4b18-ae89-541cc8340ab6","resolution":{"observed_at":"2026-08-10T20:56:20.810881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.07139","last_updated":"2025-01-13T08:58:00Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-10T23:44:44.763612Z","submitted_at":"2025-01-13T08:58:00Z","title":"FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":0,"verified_fuzzy":14},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 1 inbound Pith citation observation for arXiv:2501.07139."}