{"as_of":"2026-08-21T13:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ff1d69c4b75c7b4d72e5cb960167534a8851bb0fcc240f73cd019b139ae065b6","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-10T13:26:41.210163Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.08029/citation-record","integrity":"/paper/2607.08029/integrity","json":"/paper/2607.08029/citation-record.json","paper":"/paper/2607.08029"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-17T13:26:10.378579Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2607.08029","last_updated":"2026-07-09T01:13:18Z","snapshot_observed_at":"2026-08-05T10:26:29.110651Z","submitted_at":"2026-07-09T01:13:18Z","title":"Rethinking Small VLM Quantization: From Component-Wise Analysis to Hardware-Aware Edge Deployment","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-10T13:26:41.210163Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.08029"},"observation_digest":"sha256:97a3ad3a0faece0f952cf436f453b33d1815eb1ace509c9a5154506eae2b57b6","observation_id":"46457b17-b3f5-4c31-a367-792737b18171","resolution":{"observed_at":"2026-07-10T13:27:05.564230Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16886","last_updated":"2023-12-30T04:59:21Z","snapshot_observed_at":"2026-08-21T10:53:34.016934Z","submitted_at":"2023-12-28T08:21:24Z","title":"MobileVLM : A Fast, Strong and Open Vision Language Assistant for Mobile Devices","version":2},"cited_work":{"arxiv_id":"2312.16886","doi":"10.48550/arxiv.2312.16886","metadata_source":"pith","pith_arxiv_id":"2312.16886","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MobileVLM : A Fast, Strong and Open Vision Language Assistant for Mobile Devices","venue":"cs.CV","work_id":"ef2b3279-e78f-44b7-abab-ed7d011dc1cf","year":2023},"citing_paper":{"arxiv_id":"2607.08029","last_updated":"2026-07-09T01:13:18Z","snapshot_observed_at":"2026-08-05T10:26:29.110651Z","submitted_at":"2026-07-09T01:13:18Z","title":"Rethinking Small VLM Quantization: From Component-Wise Analysis to Hardware-Aware Edge Deployment","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-10T13:26:41.210163Z"},"links":{"cited_paper":"/paper/2312.16886","citing_paper":"/paper/2607.08029"},"observation_digest":"sha256:e7cef5bc4d9b0df33730dcf6551b0f366756844a66fff832d811fb2d086c41c5","observation_id":"1e20b9f0-c704-43bf-9450-8ca3804dcc56","resolution":{"observed_at":"2026-07-10T13:27:05.578693Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16795","last_updated":"2023-10-25T17:24:53Z","snapshot_observed_at":"2026-08-20T13:06:10.546729Z","submitted_at":"2023-10-25T17:24:53Z","title":"QMoE: Practical Sub-1-Bit Compression of Trillion-Parameter Models","version":1},"cited_work":{"arxiv_id":"2310.16795","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.16795","snapshot_observed_at":"2026-07-10T13:27:05.571610Z","title":"and Alistarh, D","venue":"cs.LG","work_id":"ee979e9d-ea3e-4407-9017-8c9cb868aa08","year":2023},"citing_paper":{"arxiv_id":"2607.08029","last_updated":"2026-07-09T01:13:18Z","snapshot_observed_at":"2026-08-05T10:26:29.110651Z","submitted_at":"2026-07-09T01:13:18Z","title":"Rethinking Small VLM Quantization: From Component-Wise Analysis to Hardware-Aware Edge Deployment","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-10T13:26:41.210163Z"},"links":{"cited_paper":"/paper/2310.16795","citing_paper":"/paper/2607.08029"},"observation_digest":"sha256:acbebafaca2fe13eba110374ac3b39daafc8d0b2a0f60ec5694b718f68879a68","observation_id":"70fd5f1d-463f-4be0-bd47-6fbc7e29f6c5","resolution":{"observed_at":"2026-07-10T13:27:05.573119Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-16T07:57:19.216626Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":"2210.17323","doi":"10.48550/arxiv.2210.17323","metadata_source":"pith","pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","venue":"cs.LG","work_id":"19ed8c44-202a-48f6-8169-637d5a5f2408","year":2022},"citing_paper":{"arxiv_id":"2607.08029","last_updated":"2026-07-09T01:13:18Z","snapshot_observed_at":"2026-08-05T10:26:29.110651Z","submitted_at":"2026-07-09T01:13:18Z","title":"Rethinking Small VLM Quantization: From Component-Wise Analysis to Hardware-Aware Edge Deployment","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-10T13:26:41.210163Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2607.08029"},"observation_digest":"sha256:c9820ec333e54e5b8e821111d0bbd1554911b3ebbf9db9783b8e1ed332795ac3","observation_id":"684bf54b-097e-46a6-8050-23d72079b673","resolution":{"observed_at":"2026-07-10T13:27:05.575811Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-15T03:08:15.265514+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-15T03:08:15.265514+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":"2306.13394","doi":"10.48550/arxiv.2306.13394","metadata_source":"pith","pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-07-10T13:27:05.561984Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","venue":"cs.CV","work_id":"806d2e73-71b3-4d56-87e0-39d571cc15d6","year":2023},"citing_paper":{"arxiv_id":"2607.08029","last_updated":"2026-07-09T01:13:18Z","snapshot_observed_at":"2026-08-05T10:26:29.110651Z","submitted_at":"2026-07-09T01:13:18Z","title":"Rethinking Small VLM Quantization: From Component-Wise Analysis to Hardware-Aware Edge Deployment","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-10T13:26:41.210163Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2607.08029"},"observation_digest":"sha256:c9ec68dcfeab40c37699bf8615bd00c96b8acd8fa57df74382d0aca84d40a1df","observation_id":"105cba5b-1b32-4ce6-9d21-5e3c6e833507","resolution":{"observed_at":"2026-07-10T13:27:05.563338Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:17.033703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:17.033703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":"2410.21276","doi":"10.1177/15248380231178756","metadata_source":"pith","pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4o System Card","venue":"cs.CL","work_id":"f37bf1c7-4964-4e56-9762-d20da8d9009f","year":2024},"citing_paper":{"arxiv_id":"2607.08029","last_updated":"2026-07-09T01:13:18Z","snapshot_observed_at":"2026-08-05T10:26:29.110651Z","submitted_at":"2026-07-09T01:13:18Z","title":"Rethinking Small VLM Quantization: From Component-Wise Analysis to Hardware-Aware Edge Deployment","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-10T13:26:41.210163Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2607.08029"},"observation_digest":"sha256:3c8ec8d689bdd18bb6b84cf4b02434184bd59aadcc5d2288014bcf0c4a2b439f","observation_id":"beae562c-121e-4212-9aad-6cfa07ce33df","resolution":{"observed_at":"2026-07-10T13:27:05.578889Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T13:27:06.039589Z","title":"W., and Keutzer, K","venue":null,"work_id":"c061fc61-597a-4b0a-a71d-4482cf95f73e","year":2022},"citing_paper":{"arxiv_id":"2607.08029","last_updated":"2026-07-09T01:13:18Z","snapshot_observed_at":"2026-08-05T10:26:29.110651Z","submitted_at":"2026-07-09T01:13:18Z","title":"Rethinking Small VLM Quantization: From Component-Wise Analysis to Hardware-Aware Edge Deployment","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-10T13:26:41.210163Z"},"links":{"citing_paper":"/paper/2607.08029"},"observation_digest":"sha256:b825bec1eb0900d4ae6af8cceb3e987b745282b3f895c3b61e2643ecd8ae846d","observation_id":"64e43bcb-ab18-4ad6-873a-6f0388fc0439","resolution":{"observed_at":"2026-07-10T13:27:06.041079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11055","last_updated":"2025-06-04T01:15:49Z","snapshot_observed_at":"2026-08-16T13:17:53.186809Z","submitted_at":"2024-09-17T10:31:37Z","title":"Exploring the Trade-Offs: Quantization Methods, Task Difficulty, and Model Size in Large Language Models From Edge to Giant","version":6},"cited_work":{"arxiv_id":"2409.11055","doi":"10.48550/arxiv.2409.11055","metadata_source":"pith","pith_arxiv_id":"2409.11055","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"cs.CL","work_id":"210441da-b24b-4931-804f-88c8627068af","year":2024},"citing_paper":{"arxiv_id":"2607.08029","last_updated":"2026-07-09T01:13:18Z","snapshot_observed_at":"2026-08-05T10:26:29.110651Z","submitted_at":"2026-07-09T01:13:18Z","title":"Rethinking Small VLM Quantization: From Component-Wise Analysis to Hardware-Aware Edge Deployment","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-10T13:26:41.210163Z"},"links":{"cited_paper":"/paper/2409.11055","citing_paper":"/paper/2607.08029"},"observation_digest":"sha256:a2edac1fced594abf5ff170420faddccfd6d2cbcc6172c2e14ec0f74cfe33792","observation_id":"6be50f81-19f7-4863-b3df-b68e945b12fc","resolution":{"observed_at":"2026-07-10T13:27:05.550913Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-05-20T09:57:50.698733+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T09:57:50.698733+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-08-18T11:56:50.710310Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":"2408.03326","doi":"10.48550/arxiv.2408.03326","metadata_source":"pith","pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","venue":"cs.CV","work_id":"f5f2452b-f2a9-49ac-b38d-c76e18cdfe49","year":2024},"citing_paper":{"arxiv_id":"2607.08029","last_updated":"2026-07-09T01:13:18Z","snapshot_observed_at":"2026-08-05T10:26:29.110651Z","submitted_at":"2026-07-09T01:13:18Z","title":"Rethinking Small VLM Quantization: From Component-Wise Analysis to Hardware-Aware Edge Deployment","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-10T13:26:41.210163Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2607.08029"},"observation_digest":"sha256:d1f98037a232967dfee2d9506c0944f03183723f51535d6143ea7894c2adef77","observation_id":"f2c1fa96-858a-4dcf-b337-ef29bfb83609","resolution":{"observed_at":"2026-07-10T13:27:05.576101Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11419","last_updated":"2024-08-21T16:54:23Z","snapshot_observed_at":"2026-08-20T13:01:54.240181Z","submitted_at":"2023-09-20T15:50:08Z","title":"KOSMOS-2.5: A Multimodal Literate Model","version":2},"cited_work":{"arxiv_id":"2309.11419","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.11419","snapshot_observed_at":"2026-07-10T13:27:05.552868Z","title":"Kosmos-2.5: A multimodal literate model","venue":"cs.CL","work_id":"41248ce1-bc86-4ccc-a85b-bfa7bed6f719","year":2023},"citing_paper":{"arxiv_id":"2607.08029","last_updated":"2026-07-09T01:13:18Z","snapshot_observed_at":"2026-08-05T10:26:29.110651Z","submitted_at":"2026-07-09T01:13:18Z","title":"Rethinking Small VLM Quantization: From Component-Wise Analysis to Hardware-Aware Edge Deployment","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-10T13:26:41.210163Z"},"links":{"cited_paper":"/paper/2309.11419","citing_paper":"/paper/2607.08029"},"observation_digest":"sha256:9aa3470638d85221b998d456dbbde806eff04304fe6488c8ded29c5d34cb7cdd","observation_id":"9127f1fe-4245-49f1-9952-7e6a7468c280","resolution":{"observed_at":"2026-07-10T13:27:05.554903Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T13:27:06.043825Z","title":"OpenCompass","venue":null,"work_id":"3e9d6af8-924c-4cb2-b52f-ce1b9fe0120f","year":2026},"citing_paper":{"arxiv_id":"2607.08029","last_updated":"2026-07-09T01:13:18Z","snapshot_observed_at":"2026-08-05T10:26:29.110651Z","submitted_at":"2026-07-09T01:13:18Z","title":"Rethinking Small VLM Quantization: From Component-Wise Analysis to Hardware-Aware Edge Deployment","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-10T13:26:41.210163Z"},"links":{"citing_paper":"/paper/2607.08029"},"observation_digest":"sha256:99ab5770dcb81a681533009ac1822e962263d9068692fcfd46d606d47d89f937","observation_id":"43ed596a-f085-49c7-9780-be28f894ecb6","resolution":{"observed_at":"2026-07-10T13:27:06.044951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.07885","last_updated":"2026-08-07T02:40:27Z","snapshot_observed_at":"2026-08-15T13:29:16.605397Z","submitted_at":"2025-11-11T06:33:30Z","title":"Intelligence per Watt: Measuring Intelligence Efficiency of Local AI","version":5},"cited_work":{"arxiv_id":"2511.07885","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.07885","snapshot_observed_at":"2026-07-10T13:27:05.564501Z","title":"Available: https://arxiv.org/abs/2511.07885","venue":"cs.DC","work_id":"a2bbe5fb-e2cb-4e71-9ca4-4186db824c0c","year":2025},"citing_paper":{"arxiv_id":"2607.08029","last_updated":"2026-07-09T01:13:18Z","snapshot_observed_at":"2026-08-05T10:26:29.110651Z","submitted_at":"2026-07-09T01:13:18Z","title":"Rethinking Small VLM Quantization: From Component-Wise Analysis to Hardware-Aware Edge Deployment","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-10T13:26:41.210163Z"},"links":{"cited_paper":"/paper/2511.07885","citing_paper":"/paper/2607.08029"},"observation_digest":"sha256:7206e0d5dbad4a604de58b24c7c6cb1d8a43c456f12264d66bcfc064f7f075ae","observation_id":"bcdadf9e-5da8-4647-90ac-c73a8b26f86e","resolution":{"observed_at":"2026-07-10T13:27:05.565871Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03555","last_updated":"2024-12-04T18:50:42Z","snapshot_observed_at":"2026-07-06T20:01:45.826971Z","submitted_at":"2024-12-04T18:50:42Z","title":"PaliGemma 2: A Family of Versatile VLMs for Transfer","version":1},"cited_work":{"arxiv_id":"2412.03555","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.03555","snapshot_observed_at":"2026-07-10T13:27:05.580089Z","title":"PaliGemma 2: A Family of Versatile VLMs for Transfer","venue":"cs.CV","work_id":"dc984d60-8996-44cb-8163-88e7526073b7","year":2024},"citing_paper":{"arxiv_id":"2607.08029","last_updated":"2026-07-09T01:13:18Z","snapshot_observed_at":"2026-08-05T10:26:29.110651Z","submitted_at":"2026-07-09T01:13:18Z","title":"Rethinking Small VLM Quantization: From Component-Wise Analysis to Hardware-Aware Edge Deployment","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-10T13:26:41.210163Z"},"links":{"cited_paper":"/paper/2412.03555","citing_paper":"/paper/2607.08029"},"observation_digest":"sha256:1f78f18d866bd51b55573a0a3d0468b41934b0759d0fb0b0a4f310ddfe2f6d2e","observation_id":"886b1217-5517-48df-afbb-2a653e705e81","resolution":{"observed_at":"2026-07-10T13:27:05.581553Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":"2412.10302","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-07-10T13:27:05.559849Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","venue":"cs.CV","work_id":"0fa0432e-2510-462b-954d-436d3b669375","year":2024},"citing_paper":{"arxiv_id":"2607.08029","last_updated":"2026-07-09T01:13:18Z","snapshot_observed_at":"2026-08-05T10:26:29.110651Z","submitted_at":"2026-07-09T01:13:18Z","title":"Rethinking Small VLM Quantization: From Component-Wise Analysis to Hardware-Aware Edge Deployment","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-10T13:26:41.210163Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2607.08029"},"observation_digest":"sha256:f284244792fb5b43639a6fc750e61698b3034b0334fee107ca5bafd46d6bbad2","observation_id":"b0e2b32a-5d42-4fda-916b-070192322dad","resolution":{"observed_at":"2026-07-10T13:27:05.561580Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08092","last_updated":"2024-09-23T07:37:34Z","snapshot_observed_at":"2026-08-21T06:12:22.942026Z","submitted_at":"2024-01-16T03:35:26Z","title":"A Survey of Resource-efficient LLM and Multimodal Foundation Models","version":2},"cited_work":{"arxiv_id":"2401.08092","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.08092","snapshot_observed_at":"2026-07-10T13:27:05.570944Z","title":"arXiv preprint arXiv:2401.08092 (2024)","venue":"cs.LG","work_id":"7da2ed50-4bc8-425d-9dcb-b512ff4de828","year":2024},"citing_paper":{"arxiv_id":"2607.08029","last_updated":"2026-07-09T01:13:18Z","snapshot_observed_at":"2026-08-05T10:26:29.110651Z","submitted_at":"2026-07-09T01:13:18Z","title":"Rethinking Small VLM Quantization: From Component-Wise Analysis to Hardware-Aware Edge Deployment","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-10T13:26:41.210163Z"},"links":{"cited_paper":"/paper/2401.08092","citing_paper":"/paper/2607.08029"},"observation_digest":"sha256:ad3bd0414dd81566a42a3e5443fc71312c140cc473190f8eba65a31b6986e623","observation_id":"721c1a7a-956f-42f5-8d2e-0c63b726a54c","resolution":{"observed_at":"2026-07-10T13:27:05.572840Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.03351","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T13:27:05.580336Z","title":"Vlmq: Efficient post-training quantization for large vision- language models via hessian augmentation","venue":null,"work_id":"f2f17173-f267-448a-8f82-259a6da38568","year":2026},"citing_paper":{"arxiv_id":"2607.08029","last_updated":"2026-07-09T01:13:18Z","snapshot_observed_at":"2026-08-05T10:26:29.110651Z","submitted_at":"2026-07-09T01:13:18Z","title":"Rethinking Small VLM Quantization: From Component-Wise Analysis to Hardware-Aware Edge Deployment","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-10T13:26:41.210163Z"},"links":{"citing_paper":"/paper/2607.08029"},"observation_digest":"sha256:ec10fb4547a47867499cd9a427affd39efd92fd1f9967d902647504391dc3d40","observation_id":"97839c3f-ba97-4fc9-af7c-733255614867","resolution":{"observed_at":"2026-07-10T13:27:05.582238Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14289","last_updated":"2024-02-22T05:05:30Z","snapshot_observed_at":"2026-08-19T20:26:10.685439Z","submitted_at":"2024-02-22T05:05:30Z","title":"TinyLLaVA: A Framework of Small-scale Large Multimodal Models","version":1},"cited_work":{"arxiv_id":"2402.14289","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.14289","snapshot_observed_at":"2026-07-10T13:27:05.549640Z","title":"Tinyllava: A framework of small-scale large multimodal models","venue":"cs.LG","work_id":"02ba347c-0dd9-42f2-bbde-0392d315ae08","year":2024},"citing_paper":{"arxiv_id":"2607.08029","last_updated":"2026-07-09T01:13:18Z","snapshot_observed_at":"2026-08-05T10:26:29.110651Z","submitted_at":"2026-07-09T01:13:18Z","title":"Rethinking Small VLM Quantization: From Component-Wise Analysis to Hardware-Aware Edge Deployment","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-10T13:26:41.210163Z"},"links":{"cited_paper":"/paper/2402.14289","citing_paper":"/paper/2607.08029"},"observation_digest":"sha256:19fd1fc9312371ab301fee466c5425013df9ef113ab4e7ba79ad25d2f030cfb1","observation_id":"7b0b0011-cc95-45a8-a837-f7c06c98305a","resolution":{"observed_at":"2026-07-10T13:27:05.551431Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T13:27:06.035444Z","title":"Experimental Setup To support reproducibility, we report the generation hyperparameters used for each VLM wrapper","venue":null,"work_id":"845746eb-91ae-4920-a713-9dab91101bb9","year":2048},"citing_paper":{"arxiv_id":"2607.08029","last_updated":"2026-07-09T01:13:18Z","snapshot_observed_at":"2026-08-05T10:26:29.110651Z","submitted_at":"2026-07-09T01:13:18Z","title":"Rethinking Small VLM Quantization: From Component-Wise Analysis to Hardware-Aware Edge Deployment","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-10T13:26:41.210163Z"},"links":{"citing_paper":"/paper/2607.08029"},"observation_digest":"sha256:d8a0630662ec8864a69bb779c6fb9f5de7567c181e6d7dfed58b625bb8b9debb","observation_id":"52de01df-83e9-47be-a311-b25c42389415","resolution":{"observed_at":"2026-07-10T13:27:06.036912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T13:27:06.037622Z","title":null,"venue":null,"work_id":"7202243d-ccb4-4009-b04a-16e96ecd87e7","year":2021},"citing_paper":{"arxiv_id":"2607.08029","last_updated":"2026-07-09T01:13:18Z","snapshot_observed_at":"2026-08-05T10:26:29.110651Z","submitted_at":"2026-07-09T01:13:18Z","title":"Rethinking Small VLM Quantization: From Component-Wise Analysis to Hardware-Aware Edge Deployment","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-10T13:26:41.210163Z"},"links":{"citing_paper":"/paper/2607.08029"},"observation_digest":"sha256:a37b42fefbae570281e4b4084e34676733966b720544c9e827e3bf676c5a8d4a","observation_id":"3956c97d-303c-4b03-9bdc-09d1ed79af3a","resolution":{"observed_at":"2026-07-10T13:27:06.038985Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T13:27:06.041637Z","title":"Energy consumption generally scales with latency, and accuracy degradation under quantization varies substantially across model architectures and configuration types","venue":null,"work_id":"eeea98fd-c6c6-43b2-8737-2481179b50f2","year":2000},"citing_paper":{"arxiv_id":"2607.08029","last_updated":"2026-07-09T01:13:18Z","snapshot_observed_at":"2026-08-05T10:26:29.110651Z","submitted_at":"2026-07-09T01:13:18Z","title":"Rethinking Small VLM Quantization: From Component-Wise Analysis to Hardware-Aware Edge Deployment","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-10T13:26:41.210163Z"},"links":{"citing_paper":"/paper/2607.08029"},"observation_digest":"sha256:9e02a1911a31959d34239c06ba494a1759730b77983648a84b0bcd45b7b77021","observation_id":"713ec9e1-8bd3-47f0-aeb0-8dc48ca25cce","resolution":{"observed_at":"2026-07-10T13:27:06.043253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.08029","last_updated":"2026-07-09T01:13:18Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-05T10:26:29.110651Z","submitted_at":"2026-07-09T01:13:18Z","title":"Rethinking Small VLM Quantization: From Component-Wise Analysis to Hardware-Aware Edge Deployment"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":1,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":0,"verified_exact":11,"verified_fuzzy":4},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 0 inbound Pith citation observations for arXiv:2607.08029."}