{"as_of":"2026-08-16T17:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:21bdf30d2acfb4b4fd7d2658986fd50d36fc07c5d6d735f9a4bd7913999a4dc8","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":3,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":3,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:46:40.634003Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T14:26:17.425104Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.10742","last_updated":"2025-04-24T14:53:57Z","snapshot_observed_at":"2026-08-16T12:50:17.172323Z","submitted_at":"2025-03-13T17:47:52Z","title":"Keyframe-oriented Vision Token Pruning: Enhancing Efficiency of Large Vision Language Models on Long-Form Video Processing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10742","snapshot_observed_at":"2026-08-16T11:46:40.634003Z","title":"Keyframe-oriented vision token pruning: Enhancing efficiency of large vision language models on long-form video processing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.14693","last_updated":"2025-05-02T22:30:26Z","snapshot_observed_at":"2026-08-16T11:40:35.431346Z","submitted_at":"2025-04-20T17:58:46Z","title":"Video-MMLU: A Massive Multi-Discipline Lecture Understanding Benchmark","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-16T11:46:40.634003Z"},"links":{"cited_paper":"/paper/2503.10742","citing_paper":"/paper/2504.14693"},"observation_digest":"sha256:bd90b58929840d8fc9aa93b955318298ba2cad9bf76fd128bdcf8b795c60c4de","observation_id":"9076d24e-6443-43b6-b77b-68b867bead47","resolution":{"observed_at":"2026-08-16T11:46:40.634003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10742","last_updated":"2025-04-24T14:53:57Z","snapshot_observed_at":"2026-08-16T12:50:17.172323Z","submitted_at":"2025-03-13T17:47:52Z","title":"Keyframe-oriented Vision Token Pruning: Enhancing Efficiency of Large Vision Language Models on Long-Form Video Processing","version":2},"cited_work":{"arxiv_id":"2503.10742","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.10742","snapshot_observed_at":"2026-08-07T14:26:17.425104Z","title":"Keyframe-oriented Vision Token Pruning: Enhancing Efficiency of Large Vision Language Models on Long-Form Video Processing","venue":"cs.LG","work_id":"40e3dc88-ffda-407d-a468-4374eee165e8","year":2025},"citing_paper":{"arxiv_id":"2505.19235","last_updated":"2025-05-25T17:16:34Z","snapshot_observed_at":"2026-08-15T10:20:44.721421Z","submitted_at":"2025-05-25T17:16:34Z","title":"CoreMatching: A Co-adaptive Sparse Inference Framework with Token and Neuron Pruning for Comprehensive Acceleration of Vision-Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:26:17.230770Z"},"links":{"cited_paper":"/paper/2503.10742","citing_paper":"/paper/2505.19235"},"observation_digest":"sha256:f07d42a9c816ef75f280b9fc92bd349d31d2b68a0bdb735b040523269355c78d","observation_id":"847a243a-9c9c-4f22-89d6-eae1454cc240","resolution":{"observed_at":"2026-08-07T14:26:17.428918Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10742","last_updated":"2025-04-24T14:53:57Z","snapshot_observed_at":"2026-08-16T12:50:17.172323Z","submitted_at":"2025-03-13T17:47:52Z","title":"Keyframe-oriented Vision Token Pruning: Enhancing Efficiency of Large Vision Language Models on Long-Form Video Processing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10742","snapshot_observed_at":"2026-07-31T23:29:18.238729Z","title":"arXiv preprint arXiv:2503.10742 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23962","last_updated":"2026-07-27T03:20:08Z","snapshot_observed_at":"2026-08-13T20:53:33.123437Z","submitted_at":"2026-07-27T03:20:08Z","title":"Development of Vision-Language Model-based GNSS Spoofing Detection for Autonomous Vehicle Navigation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-31T23:29:18.238729Z"},"links":{"cited_paper":"/paper/2503.10742","citing_paper":"/paper/2607.23962"},"observation_digest":"sha256:f79163dea4dd050b784f115e2a7aca3c55fcf8ca435975dc4935f37ed3bd505b","observation_id":"36ab5eab-e8a1-4743-be8b-341464b3e9c5","resolution":{"observed_at":"2026-07-31T23:29:18.238729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2503.10742/citation-record","integrity":"/paper/2503.10742/integrity","json":"/paper/2503.10742/citation-record.json","paper":"/paper/2503.10742"},"outbound":[],"paper":{"arxiv_id":"2503.10742","last_updated":"2025-04-24T14:53:57Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T12:50:17.172323Z","submitted_at":"2025-03-13T17:47:52Z","title":"Keyframe-oriented Vision Token Pruning: Enhancing Efficiency of Large Vision Language Models on Long-Form Video Processing"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 3 inbound Pith citation observations for arXiv:2503.10742."}