{"as_of":"2026-08-09T21:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:86b424c14e95ddb7a4a4da6fb3988781979420f1af48b9d23b6b9f36265d1ab6","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T13:30:43.161888Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.20613/citation-record","integrity":"/paper/2507.20613/integrity","json":"/paper/2507.20613/citation-record.json","paper":"/paper/2507.20613"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-06T13:30:42.804887Z","title":"Mistral 7b,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:42.804887Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:9344d7c28d669ed9757ad93974309da384343aaff2685541f180b19eca9bbce6","observation_id":"cdf01905-5def-41d3-a335-98eb60a01886","resolution":{"observed_at":"2026-08-06T13:30:42.804887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T13:30:42.818922Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:42.818922Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:6145410a2e85e373dbbe0cf4e78f0ab9abee748054ac05b18a803911253562a6","observation_id":"ee72836e-d53f-44e3-8084-3344d37c347f","resolution":{"observed_at":"2026-08-06T13:30:42.818922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-06T13:30:42.830113Z","title":"Visual instruction tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:42.830113Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:7d395391638888d5dae0dbfd004ec63d29232457599a6f10f15cca372e323b3f","observation_id":"76e04a05-3988-4000-ad42-35a10a60b91f","resolution":{"observed_at":"2026-08-06T13:30:42.830113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-06T13:30:42.835441Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:42.835441Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:3d38c07e86224476d66401612163ced82889cbc4f7cf614a25d5c0538068e677","observation_id":"2b53ea00-5b6d-4bc8-a389-8fda88643ab1","resolution":{"observed_at":"2026-08-06T13:30:42.835441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:30:44.550129Z","title":"Detkds: Knowledge distillation search for object detectors,","venue":null,"work_id":"e917dbc4-fd9e-4a5b-b28f-7fa5c20c3c11","year":2024},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:42.848701Z"},"links":{"citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:37793ac330bd1b7bdf98d4d431ce711637cc308f00d0059e1000a033bb45d795","observation_id":"08a05469-5afa-4b1b-a210-d604c3ce094a","resolution":{"observed_at":"2026-08-06T13:30:44.564011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:30:44.497870Z","title":"Kd-zero: Evolving knowledge distiller for any teacher-student pairs,","venue":null,"work_id":"711c855a-c4fa-44b6-b0e3-695d719483bd","year":2024},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:42.859896Z"},"links":{"citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:1844e270a4d7c6130adf949dac8fe9745685a2a91b8d0f584948c3a079678402","observation_id":"b00d138d-d1e7-42b1-aa05-4f384ca7dda1","resolution":{"observed_at":"2026-08-06T13:30:44.504365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:30:44.474834Z","title":"Diswot: Student architecture search for distillation without training,","venue":null,"work_id":"bb07707a-a24c-4063-b086-0fcee9765095","year":2023},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:42.865792Z"},"links":{"citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:76b968d3879d9d9d17b5d7b8cc311f5987a5d37f2f6726a4d438399ec975a3ef","observation_id":"6bc3437b-95bd-4437-91f6-17a4d352250f","resolution":{"observed_at":"2026-08-06T13:30:44.481187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:30:44.449330Z","title":"Automated knowl- edge distillation via monte carlo tree search,","venue":null,"work_id":"fbc9e57e-aff3-40fd-80ba-dd7e137a8cb0","year":2023},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:42.881674Z"},"links":{"citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:430b489d6657e26496dd339422b02e8f19dc33346fc788263a6515c788644f66","observation_id":"5c3634d0-805f-40c1-9b16-7a142ce2564a","resolution":{"observed_at":"2026-08-06T13:30:44.458637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:30:44.413746Z","title":"Norm: Knowledge distillation via n-to-one representation matching,","venue":null,"work_id":"aa69e07b-8e29-4d2c-b0dc-6b212af90369","year":2023},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:42.888328Z"},"links":{"citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:c132152c0b14ab8cc5062096941968486c336a2c23f2fc17fb1848de1d1335a2","observation_id":"30a7d02f-3c98-4aa6-afc8-91d37284b4a4","resolution":{"observed_at":"2026-08-06T13:30:44.424740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:30:44.378997Z","title":"Self-regulated feature learning via teacher-free feature distillation,","venue":null,"work_id":"629da702-de9b-4b1d-8dd7-d4f378230268","year":2022},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:42.893891Z"},"links":{"citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:f0886f843b07e2807762ce6673e4d53018193497c3983af89d9aa1ae488b6b4b","observation_id":"44690b78-098d-483f-96e6-04a1cf32dd4c","resolution":{"observed_at":"2026-08-06T13:30:44.395837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:30:44.341563Z","title":"Attnzero: efficient attention discovery for vision transformers,","venue":null,"work_id":"820f4f6c-bc2a-49bd-aed2-938d8ccb88c1","year":2024},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:42.914276Z"},"links":{"citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:f8995eda3d9825efcc12e101f6f9d7db450996dfb503016bbefb07459fc65106","observation_id":"e5f5ec44-c517-427b-b91e-8cbfbd6d4253","resolution":{"observed_at":"2026-08-06T13:30:44.348391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:30:44.304576Z","title":"Auto-gas: Automated proxy discovery for training-free generative architecture search,","venue":null,"work_id":"d3b61a81-7055-4151-85bb-6de22b1e272e","year":2024},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:42.936291Z"},"links":{"citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:abbddbffb7864f51b67b82cbc67f8a2f56049249f90fd6db110a5b8c3c37a38f","observation_id":"af463892-66e4-4904-b57e-6206f954b3c3","resolution":{"observed_at":"2026-08-06T13:30:44.316113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:30:44.269841Z","title":"Discovering sparsity allocation for layer-wise pruning of large language models,","venue":null,"work_id":"f369ad02-dd9e-4e34-9bcf-4b804af5bf65","year":2024},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:42.947862Z"},"links":{"citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:ebd840ebd64129d0a80759992d52a3c8d758826be75d6f650104b3a852afccae","observation_id":"0bd06b3c-4571-4d1b-b54d-4eb843d0e6a3","resolution":{"observed_at":"2026-08-06T13:30:44.281817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:30:44.241580Z","title":"Als: Adaptive layer sparsity for large language models via activation correlation assessment,","venue":null,"work_id":"26f39397-fc2f-43de-8766-e41fde68e600","year":2024},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:42.964751Z"},"links":{"citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:d43c03bba107ab5c6a90682313b0532dce167d8bea4dcf4a1a410bc4e7d8997f","observation_id":"f973f67c-2c8f-42b1-9d52-217e93f28980","resolution":{"observed_at":"2026-08-06T13:30:44.250051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:30:44.202385Z","title":"Pruner-zero: Evolving symbolic pruning metric from scratch for large language models,","venue":null,"work_id":"45874d81-ed3c-4845-bda7-e91480337034","year":2024},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:42.979810Z"},"links":{"citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:fa150648c0b903bf0e9a2ef82f0a9c15df5a124d1d0d9b74455fe2c09124d618","observation_id":"59f1ad14-95a1-4808-9923-36e1529f45bc","resolution":{"observed_at":"2026-08-06T13:30:44.219538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:30:42.987883Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:42.987883Z"},"links":{"citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:09b391505ce3de3ba4689cf4d423b0acc006177767fb7e691b8c2cbe6db61bea","observation_id":"18b23f2f-8d47-4c27-bb43-70182d023917","resolution":{"observed_at":"2026-08-06T13:30:42.987883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13549","last_updated":"2024-11-29T15:51:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T15:21:52Z","title":"A Survey on Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13549","snapshot_observed_at":"2026-08-06T13:30:42.992956Z","title":"A survey on multimodal large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:42.992956Z"},"links":{"cited_paper":"/paper/2306.13549","citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:e0433f87d7a1ea479a28803cf38b9bd0f4922be7858d8e4da28ab793945b8a42","observation_id":"c0b3b97a-4dfd-4d33-90a9-d17ef05d05f3","resolution":{"observed_at":"2026-08-06T13:30:42.992956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13601","last_updated":"2024-05-28T05:36:23Z","snapshot_observed_at":"2026-08-09T14:50:09.702964Z","submitted_at":"2024-01-24T17:10:45Z","title":"MM-LLMs: Recent Advances in MultiModal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13601","snapshot_observed_at":"2026-08-06T13:30:42.998293Z","title":"Mm-llms: Recent advances in multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:42.998293Z"},"links":{"cited_paper":"/paper/2401.13601","citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:ddb06c083df07a775cf73e8fba3e4173da37fba75284194256d77ad4a9f643ff","observation_id":"bcd21370-34b8-465e-b48a-c9e6d7f23fde","resolution":{"observed_at":"2026-08-06T13:30:42.998293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00774","last_updated":"2023-03-22T12:33:46Z","snapshot_observed_at":"2026-08-06T23:32:44.248222Z","submitted_at":"2023-01-02T17:48:56Z","title":"SparseGPT: Massive Language Models Can Be Accurately Pruned in One-Shot","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00774","snapshot_observed_at":"2026-08-06T13:30:43.003466Z","title":"Sparsegpt: Massive language models can be accurately pruned in one-shot,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:43.003466Z"},"links":{"cited_paper":"/paper/2301.00774","citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:151bc36db546b14c6f2da06d6a6dacdd80e150a7d2924dabdf81b55c89d5d6e9","observation_id":"e9923c97-ad20-4ae3-82c5-2a9dab66f20f","resolution":{"observed_at":"2026-08-06T13:30:43.003466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:30:44.142648Z","title":"A simple and effective pruning approach for large language models,","venue":null,"work_id":"ad761ad5-3a46-4afd-8a9e-f408b7f779a9","year":2024},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:43.014745Z"},"links":{"citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:373b05290342c53af1beba0100f4b5617de3d345b0e65bf8600c87119cc956c8","observation_id":"0faf0ac8-3e2c-4cd0-9e9f-25b3603d3bec","resolution":{"observed_at":"2026-08-06T13:30:44.155052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11627","last_updated":"2023-09-28T03:59:27Z","snapshot_observed_at":"2026-07-06T15:29:39.466936Z","submitted_at":"2023-05-19T12:10:53Z","title":"LLM-Pruner: On the Structural Pruning of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11627","snapshot_observed_at":"2026-08-06T13:30:43.024746Z","title":"Llm-pruner: On the structural pruning of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:43.024746Z"},"links":{"cited_paper":"/paper/2305.11627","citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:e01b7f290f00c12de6419de596320d7e425d35a7b5cab88d7b81e901981033dd","observation_id":"f2d54b24-6f97-4cc4-8a80-9fbb479816d7","resolution":{"observed_at":"2026-08-06T13:30:43.024746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10554","last_updated":"2023-07-20T03:36:13Z","snapshot_observed_at":"2026-07-06T15:56:15.361460Z","submitted_at":"2023-07-20T03:36:13Z","title":"EMQ: Evolving Training-free Proxies for Automated Mixed Precision Quantization","version":1},"cited_work":{"arxiv_id":"2307.10554","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.10554","snapshot_observed_at":"2026-08-06T13:30:43.430203Z","title":"EMQ: Evolving Training-free Proxies for Automated Mixed Precision Quantization","venue":"cs.CV","work_id":"8064f7b9-8682-462c-b2d4-4d079203bc17","year":2023},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:43.040608Z"},"links":{"cited_paper":"/paper/2307.10554","citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:0399804232115924e6cdde6a8f167a25424a1db3ca96a788a0ab11aa93cb1a97","observation_id":"5b1e39e2-0511-4df5-baec-b541a4928c86","resolution":{"observed_at":"2026-08-06T13:30:43.438184Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:30:44.117691Z","title":"Stbllm: Breaking the 1-bit barrier with structured binary llms,","venue":null,"work_id":"2e26224a-5154-4bfc-b166-b1d43034263a","year":2025},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:43.049978Z"},"links":{"citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:615a99acf915afea71184f67d9d61a91cc962512254f099a45c9f9b4fb43d525","observation_id":"ac3a04cf-5ebe-4896-8822-7e0bd39d986d","resolution":{"observed_at":"2026-08-06T13:30:44.126834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:30:44.080149Z","title":"Quantization and training of neural networks for efficient integer- arithmetic-only inference,","venue":null,"work_id":"10690d1d-ea7b-4cff-b24b-ec0122d68a1e","year":2018},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:43.058548Z"},"links":{"citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:e1b20d80a140881e6cf848b19e79312e98025ab18f6d29943b10a2fbf5f2ea2d","observation_id":"d3fc8da3-71dd-4de2-9dad-c79de0617d28","resolution":{"observed_at":"2026-08-06T13:30:44.089521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11127","last_updated":"2026-05-31T18:23:52Z","snapshot_observed_at":"2026-07-06T15:18:30.127408Z","submitted_at":"2023-04-21T17:02:38Z","title":"Tree-Structured Parzen Estimator: Understanding Its Algorithm Components and Their Roles for Better Empirical Performance","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.11127","snapshot_observed_at":"2026-08-06T13:30:43.067164Z","title":"Tree-structured parzen estimator: Understanding its algorithm components and their roles for better empirical performance,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:43.067164Z"},"links":{"cited_paper":"/paper/2304.11127","citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:80dd4f76cc80b3addb959de55e83ec49fb94432fc6f13e87b32ce3cb4a0fb08a","observation_id":"e9a7c1fc-1d1d-4332-b169-efcceb261fe6","resolution":{"observed_at":"2026-08-06T13:30:43.067164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12597","last_updated":"2023-06-15T07:57:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-30T00:56:51Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12597","snapshot_observed_at":"2026-08-06T13:30:43.074900Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:43.074900Z"},"links":{"cited_paper":"/paper/2301.12597","citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:a397b01107da235064026de7574ce91e1f0ec1327f6a6547c178138da12ba7b4","observation_id":"3ab89baa-e06b-4dcd-b7ca-8de29aed7b1a","resolution":{"observed_at":"2026-08-06T13:30:43.074900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:30:44.042058Z","title":"Instructblip: Towards general-purpose vision-language models with instruction tuning,","venue":null,"work_id":"5e3acaaa-f896-4878-a757-21dfba977aeb","year":2023},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:43.084478Z"},"links":{"citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:547d7db123551600cb3c9690f9f2bdfe22aba519a6747c5e882ea4804962dddb","observation_id":"64d66b4e-b3d5-4e2a-82a3-153fa88c4895","resolution":{"observed_at":"2026-08-06T13:30:44.048696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15195","last_updated":"2023-07-03T16:08:00Z","snapshot_observed_at":"2026-07-06T15:47:07.545213Z","submitted_at":"2023-06-27T04:31:52Z","title":"Shikra: Unleashing Multimodal LLM's Referential Dialogue Magic","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15195","snapshot_observed_at":"2026-08-06T13:30:43.097201Z","title":"Shikra: Unleashing multimodal llm’s referential dialogue magic,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:43.097201Z"},"links":{"cited_paper":"/paper/2306.15195","citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:7bd58eea43ba1c616523592c03ee061e35c9268eeb5ee995b712da84f239312e","observation_id":"007fcc78-5189-4675-9292-a30cca02c11b","resolution":{"observed_at":"2026-08-06T13:30:43.097201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:30:44.012989Z","title":"Introducing idefics: An open reproduction of state-of-the-art visual language model,","venue":null,"work_id":"bf137f6d-c71e-467d-9816-5e87a1207a2b","year":2023},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:43.108585Z"},"links":{"citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:3a20ccbe3d3b9a3fe0146f47bdc01ebc5fc00716924e8638b74c8f70610bfffb","observation_id":"5131ace4-7dca-40ab-b163-ec079b984a33","resolution":{"observed_at":"2026-08-06T13:30:44.021511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-06T13:30:43.115817Z","title":"Qwen-vl: A frontier large vision-language model with versatile abilities,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:43.115817Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:3c2f9dd07be2362177a074fd9d170a1b042ed55cd35980cd33e81a0ed09ed459","observation_id":"35f1e5dc-0271-429a-982b-be695bf1c1d7","resolution":{"observed_at":"2026-08-06T13:30:43.115817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:30:43.953897Z","title":"Improved baselines with visual instruction tuning,","venue":null,"work_id":"0d4b93c7-373e-439e-909b-af9866360986","year":2023},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:43.124967Z"},"links":{"citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:a4c729f064239a5839804886a7018f7ec580129d626e45cab38301f178763810","observation_id":"09e0b65b-74cd-468f-8ae7-20dc420a63bd","resolution":{"observed_at":"2026-08-06T13:30:43.976289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:30:43.911950Z","title":"Making the v in vqa matter: Elevating the role of image understanding in visual question answering,","venue":null,"work_id":"66aca67e-c014-4959-b102-50725c11c815","year":2017},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:43.132206Z"},"links":{"citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:25806ce450f563f7c19fb7b1b091262dd2979c615b8b6079e583e8cb18497a7e","observation_id":"231d81d1-1a62-48dc-9187-53818ebfa90b","resolution":{"observed_at":"2026-08-06T13:30:43.930249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:30:43.877255Z","title":"Learn to explain: Multimodal reasoning via thought chains for science question answering,","venue":null,"work_id":"73fd9f8d-dd53-4696-b3c4-472555f43a04","year":2022},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:43.137596Z"},"links":{"citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:b4d8950cc311fbc7b979c86b331258f4563c222d8751feae5b3cfa8489d45664","observation_id":"4ddcab95-3a88-47f2-93e2-3e8e6f01496f","resolution":{"observed_at":"2026-08-06T13:30:43.884804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:30:43.843259Z","title":"Towards vqa models that can read,","venue":null,"work_id":"37c789d7-bfc5-43de-9f3d-673c2790615e","year":2019},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:43.148367Z"},"links":{"citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:57c436118a55d6f9ecfddbd02eec95c8cde6cc5a969f511b9240bf9a64ed793b","observation_id":"c0e2264f-066b-4b86-9a53-4fd91feaf5aa","resolution":{"observed_at":"2026-08-06T13:30:43.859286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10355","last_updated":"2023-10-26T02:52:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T16:34:01Z","title":"Evaluating Object Hallucination in Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10355","snapshot_observed_at":"2026-08-06T13:30:43.156497Z","title":"Evaluating object hallucination in large vision-language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:43.156497Z"},"links":{"cited_paper":"/paper/2305.10355","citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:82538230c233e76b7b3b68b5e2a5b1902075f07af02e85ee5d5f97a9d6e71f62","observation_id":"c43d2c17-4b78-4c1c-a36d-db4b97d7bb6d","resolution":{"observed_at":"2026-08-06T13:30:43.156497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:30:43.815428Z","title":"Pointer sentinel mixture models,","venue":null,"work_id":"07345eb6-e0ba-48ce-bfcb-40d51740a9ae","year":2016},"citing_paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T13:30:43.161888Z"},"links":{"citing_paper":"/paper/2507.20613"},"observation_digest":"sha256:e488123d830c21b680fb0dfa115848e27ce5f1052c33cd69a4624d4642f2d1d3","observation_id":"abfca8b3-18f9-4ca2-858c-8900646299d9","resolution":{"observed_at":"2026-08-06T13:30:43.822970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.20613","last_updated":"2025-07-28T08:27:40Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T14:15:15.059838Z","submitted_at":"2025-07-28T08:27:40Z","title":"Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":1,"verified_fuzzy":21},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2507.20613."}