{"as_of":"2026-08-10T23:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:de4414015fcb63d9912cebe040e8b83eab101beafa0de6e263cd003e46c87277","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T00:41:45.598802Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.25125/citation-record","integrity":"/paper/2607.25125/integrity","json":"/paper/2607.25125/citation-record.json","paper":"/paper/2607.25125"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-07-31T00:41:41.978502Z","title":"arXiv preprint arXiv:2502.13923 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:41.978502Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:39e52db812c2dab0f2ab4bb2cb572b7175f9d56857f3e821a9a3bca5ec900f0b","observation_id":"0bf5ea08-7b70-4cfd-a6f1-9471b9a52e11","resolution":{"observed_at":"2026-07-31T00:41:41.978502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:42.010624Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:42.010624Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:873cf0174d93e72271253cf30a9e8f7ca1597e3716896c701dee366af5765a82","observation_id":"4a5f09c9-8cf5-4a90-bb82-a65c7c22084a","resolution":{"observed_at":"2026-07-31T00:41:42.010624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11557","last_updated":"2025-03-14T16:26:11Z","snapshot_observed_at":"2026-08-07T17:03:29.182749Z","submitted_at":"2025-03-14T16:26:11Z","title":"VERIFY: A Benchmark of Visual Explanation and Reasoning for Investigating Multimodal Reasoning Fidelity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11557","snapshot_observed_at":"2026-07-31T00:41:42.065931Z","title":"arXiv preprint arXiv:2503.11557 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:42.065931Z"},"links":{"cited_paper":"/paper/2503.11557","citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:e4059d007caf8129a015a90832f1f9f5cf09ecdec7fc9d1c5715e9377c7d1dfe","observation_id":"a658caad-db84-460c-bd9b-363dcffe015d","resolution":{"observed_at":"2026-07-31T00:41:42.065931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:42.113652Z","title":"arXiv preprint arXiv:2504.03151 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:42.113652Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:091310974e561c88137602e6b73d79f7bf1e409f355a399380a9468c95efba4a","observation_id":"78fc7aaf-8708-4543-ad2d-6e5c81ec4788","resolution":{"observed_at":"2026-07-31T00:41:42.113652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:42.184517Z","title":"arXiv preprint arXiv:2510.20696 (2025) 16 C","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:42.184517Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:b4976e0b27e4ba98efb1f6d057fa4f9943077ec0e2a45a973ee882d37968a152","observation_id":"502410ac-fd68-4e94-99f8-449378372787","resolution":{"observed_at":"2026-07-31T00:41:42.184517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:42.214422Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:42.214422Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:8c4799481a38ed37f4bf3ab1faee6d6c7da9d96621dd3e929dc6f3199b12186f","observation_id":"f681ce77-74de-4d2b-99d1-18b2566fb279","resolution":{"observed_at":"2026-07-31T00:41:42.214422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:42.265372Z","title":"In: International Conference on Learning Representations (2025),https: //openreview.net/forum?id=wCXAlfvCy6","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:42.265372Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:accee3fc1d50c6dbbe14cf517dcdf2f1b745e7988bb6631c5fc67c8d4d37828b","observation_id":"79f29618-0939-4bb8-b572-b076a23f8f21","resolution":{"observed_at":"2026-07-31T00:41:42.265372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:42.314412Z","title":"In: International Conference on Machine Learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:42.314412Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:6097d6c2f2405820275a78110ec4e4ebed07ef0676de95f8d1cb9a5cdddf6be3","observation_id":"0a7abc4e-09f7-47fc-9794-a8776dcc0e66","resolution":{"observed_at":"2026-07-31T00:41:42.314412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07476","last_updated":"2024-10-30T06:49:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-11T17:22:23Z","title":"VideoLLaMA 2: Advancing Spatial-Temporal Modeling and Audio Understanding in Video-LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07476","snapshot_observed_at":"2026-07-31T00:41:42.338138Z","title":"arXiv preprint arXiv:2406.07476 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:42.338138Z"},"links":{"cited_paper":"/paper/2406.07476","citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:d78334f0a31b478180b3b60aaafe130b279e7154e05b510a3335b396c5053b55","observation_id":"6786cfc2-b04d-45e0-8a2e-bea94a6b9901","resolution":{"observed_at":"2026-07-31T00:41:42.338138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:42.377941Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:42.377941Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:1f6130bcc60b76e3bd96e1fe21ddd06b9d6771158132860c270ccdd062e1cb20","observation_id":"1658cdd3-d9ae-47ab-b437-280a80ff8448","resolution":{"observed_at":"2026-07-31T00:41:42.377941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:42.432243Z","title":"In: International Conference on Learning Representations (2024),https://openreview.net/forum?id=5Ca9sSzuDp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:42.432243Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:f24f31563919e915689c70123bbde470d761dad6a3d3f96002dd59d083cac243","observation_id":"fe7caba8-3fa1-47ff-97dd-f0e2360aa259","resolution":{"observed_at":"2026-07-31T00:41:42.432243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:42.480715Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence (4), 532–550 (1987)","venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:42.480715Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:9012dde6adf639a5d88aa4db8203d71a653b0b09907d416dd404935f6f56cd95","observation_id":"b287e8fe-1bc6-4462-b169-d990efca262e","resolution":{"observed_at":"2026-07-31T00:41:42.480715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:42.523241Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:42.523241Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:cf60b2300308f3eed23affb3a908d43ac400aef08619eee2ca87ba55017e483d","observation_id":"6152ed4e-b5d6-4f6b-9fc7-190422c0f7c8","resolution":{"observed_at":"2026-07-31T00:41:42.523241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:42.573580Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:42.573580Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:44df537507542e027ec7f6168af374d4a56a0af304f5aa3cdaa9d82bdc1a0ecf","observation_id":"456a767d-4384-49db-9f9e-48f6bb8b8628","resolution":{"observed_at":"2026-07-31T00:41:42.573580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:42.665191Z","title":"Transactions on Machine Learning Research (2025),https://openreview.net/forum?id=zKv8qULV6n","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:42.665191Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:df3c3bdff2da19f5fa461257eff10ca3a273beb015d3ed63c2da08ed47208080","observation_id":"db91eb54-1f48-4ac1-b1d3-ee4151bfb162","resolution":{"observed_at":"2026-07-31T00:41:42.665191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:42.705417Z","title":"In: International Conference on Machine Learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:42.705417Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:26e427d03c5063386d2be87b1c4911fa188abcfdcfa755c186bae86009477c32","observation_id":"521c5cc8-6fc7-4078-bb20-0ad55184218d","resolution":{"observed_at":"2026-07-31T00:41:42.705417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:42.762681Z","title":"In: Proceedings of the Conference on Empirical Methods in Natural Language Processing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:42.762681Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:f742f0818e3e53172c79ecf7d1f3c244bd27f7acfd04f06834ac8af2c821ad18","observation_id":"258f7411-0ba2-4c0f-80c4-57d1764bfd7e","resolution":{"observed_at":"2026-07-31T00:41:42.762681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:42.814784Z","title":"io/blog/2024-01-30-llava-next/","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:42.814784Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:a23a5a366eb32a139f7e7583cf7ea845f2cee500f04de083af5b92d641c6dfb5","observation_id":"3d71f0f6-e618-4fb5-a6c0-565afe814dd2","resolution":{"observed_at":"2026-07-31T00:41:42.814784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:42.883256Z","title":"Advances in Neural Information Processing Systems36, 34892–34916 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:42.883256Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:51376d78c1b951247b1f8e2f23c0edb8942760640f8d8420fe621c0404f1bdd3","observation_id":"354b67b6-435f-43f0-9a31-00393d762abd","resolution":{"observed_at":"2026-07-31T00:41:42.883256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:42.926294Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:42.926294Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:a2f22130209e06155965683dd7b2ac51cdae23e2dfc05cb9967ac91f994f7bda","observation_id":"baa05adb-22e5-4671-9fc1-2afb242f4e1c","resolution":{"observed_at":"2026-07-31T00:41:42.926294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:42.996928Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:42.996928Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:b510bd9ba44f376523523d33a4991b225f94c53f031ab364b288ef5ec0d64863","observation_id":"ec1c3ac7-911a-40b1-a9a7-58b645310da2","resolution":{"observed_at":"2026-07-31T00:41:42.996928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:43.037329Z","title":"In: Advances in Neural Information Processing Systems (2025), https://openreview.net/forum?id=QaZxGWlbgO","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:43.037329Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:944763925017dc4fd5f4986460b307e6ea7de14ccd7bf9ceae195539ecb7995a","observation_id":"58d956b6-350f-4fad-9180-911e6c19d2cf","resolution":{"observed_at":"2026-07-31T00:41:43.037329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:43.082470Z","title":"Advances in Neural Information Processing Systems36, 46212–46244 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:43.082470Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:a1564265047b73bd112c82fa679592f3494d27ac3c3b5a1d377dd5285a8a3d96","observation_id":"36b8c8d3-1d7a-47d9-a959-56520cd74efa","resolution":{"observed_at":"2026-07-31T00:41:43.082470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:43.120537Z","title":"In: Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:43.120537Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:8b81aa8c78cceaba60c25e46c331caa07775daf75ee0bddfe5b239edeb301fb8","observation_id":"8c3748e9-6466-4b06-b58c-90fc006a4d4d","resolution":{"observed_at":"2026-07-31T00:41:43.120537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:43.176911Z","title":"In: International Conference on Machine Learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:43.176911Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:6999e49272d78d138036e0cb21ee56ce813b8b074b9e895d540e7f2083fef42d","observation_id":"0ddb8fd3-e813-4c1e-ad46-4ea2ecf2df48","resolution":{"observed_at":"2026-07-31T00:41:43.176911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:43.222018Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:43.222018Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:28925bd27a9408f573455ce9b81b42fea6317ddb712530b03f811629d1760b0c","observation_id":"1ca41b6c-77f4-41b8-9b3b-7288fa3d62f7","resolution":{"observed_at":"2026-07-31T00:41:43.222018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:43.261841Z","title":"In: International Conference on Machine Learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:43.261841Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:3c5964b21307358e2fba7479fb63a226cc12d52e39fae75f8a44247fa29e7b56","observation_id":"641a8cc4-8fe7-475b-b195-1bd536bdb781","resolution":{"observed_at":"2026-07-31T00:41:43.261841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:43.294131Z","title":"In: International Conference on Machine Learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:43.294131Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:58a948a08ea74e1fcadee4fe2144f52d4227dcae715f1a90cb9d2cec9c1124b6","observation_id":"adf5f398-4c04-489b-a6ee-80eda0b5d52b","resolution":{"observed_at":"2026-07-31T00:41:43.294131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:43.332718Z","title":"In: Advances in Neural Information Processing Systems (2025),https://openreview.net/forum? id=5xPvWat3IX","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:43.332718Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:2ec03bbc1145d4d2671938552faf7e047acc236882755c563b7acb65cd790d4f","observation_id":"c03e3314-2109-4aa5-a944-892e0f3ece20","resolution":{"observed_at":"2026-07-31T00:41:43.332718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:43.402159Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:43.402159Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:a8c6a69839098d088a64bbacdae1630b17cf5ade18e89f72f937d86163c6ab71","observation_id":"04851062-e653-4146-b8fe-6e3d290c3b0a","resolution":{"observed_at":"2026-07-31T00:41:43.402159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:43.436644Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:43.436644Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:6d61d09a75f4b4ccb6b915ef88de2092b19819d463a890c795a6b4eca0297ae2","observation_id":"7c131345-5c48-49ae-af5c-898d4f795257","resolution":{"observed_at":"2026-07-31T00:41:43.436644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:43.485732Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:43.485732Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:a3d088846411ef9d088722d8ed7f9c30520eaf5d1655e6c06eac273c502ac0cc","observation_id":"bf07732b-8e23-46af-ac36-8e57d04510c0","resolution":{"observed_at":"2026-07-31T00:41:43.485732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:43.535044Z","title":"IEEE Transactions on Circuits and Systems for Video Technology (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:43.535044Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:099a96ff80c06edd3579c8f7c5e65d73ac41c19e469f8b0d9ebabae10812974e","observation_id":"29ac574e-7bdf-4acf-9701-a3c5159fa32f","resolution":{"observed_at":"2026-07-31T00:41:43.535044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01949","last_updated":"2025-07-02T17:57:28Z","snapshot_observed_at":"2026-08-06T20:37:19.866170Z","submitted_at":"2025-07-02T17:57:28Z","title":"Kwai Keye-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01949","snapshot_observed_at":"2026-07-31T00:41:43.585577Z","title":"arXiv preprint arXiv:2507.01949 (2025) 18 C","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:43.585577Z"},"links":{"cited_paper":"/paper/2507.01949","citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:be3e9c5cbcafceb53f33c358fffd728606f9c132bfff1c610bb3c5becad21bd0","observation_id":"02027fe2-c7a0-44ef-895c-b3b3600d5672","resolution":{"observed_at":"2026-07-31T00:41:43.585577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:43.772407Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:43.772407Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:1f00f7e26d536df4f621d2ecce5ff0c5de68641c35144880d0baa5868f22ff91","observation_id":"39b7c1b2-b415-4bed-81ec-f77b5c0ff6bb","resolution":{"observed_at":"2026-07-31T00:41:43.772407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:43.939220Z","title":"IEEE Transactions on Image Processing 13(4), 600–612 (2004)","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:43.939220Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:2b850952e94d476a61cfd55cf52d85467cd5af515ba486b7a7122bbe3cbce268","observation_id":"e8e15b16-160a-4f27-a220-73b4e3bdb962","resolution":{"observed_at":"2026-07-31T00:41:43.939220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:44.102157Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:44.102157Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:0e14a5f64ef947fd5797780ef4e58afdc896cc862bfcaa5a98a1d4f30dc070fa","observation_id":"19744b49-bec2-4365-b577-2fd1dc530b01","resolution":{"observed_at":"2026-07-31T00:41:44.102157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:44.220367Z","title":"Advances in Neural Information Processing Systems37, 28828–28857 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:44.220367Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:e87a828de90772c4ba65a1ea97366256d25c97baacdc134f32722e8e19f4e159","observation_id":"67ea58c6-f3f4-4443-9f96-dda3c066fad2","resolution":{"observed_at":"2026-07-31T00:41:44.220367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:44.332743Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:44.332743Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:3d6a801538fb85967f42531ed9f7bc5f5acc31b0e35c7e61446cecbc82d89237","observation_id":"642e9227-7949-48a7-b5ca-1a8cc5a9e924","resolution":{"observed_at":"2026-07-31T00:41:44.332743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:44.450922Z","title":"In: Conference on Language Modeling (2025),https://openreview.net/forum?id=L7jS3peM3w","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:44.450922Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:8b90f360d8e22941bc602915b6b991724235c17f00416cb3e691c2cb1cb6dfd8","observation_id":"325dcf66-6bda-40dd-94e2-68534eb91740","resolution":{"observed_at":"2026-07-31T00:41:44.450922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:44.595538Z","title":"net/forum?id=FDAI0PY9Qp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:44.595538Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:f1b9779277457ddaff7fa027c44eaa0d4f5e8afee02d303ea161eccc3affd318","observation_id":"e602a71f-a762-4519-9f19-f8f59b2aba24","resolution":{"observed_at":"2026-07-31T00:41:44.595538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:44.719443Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:44.719443Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:327a040ed5a4071af499d3bc5ffd3cbd27b12e5e10f7ef806b155acc9b65137f","observation_id":"ee17aef1-c48e-48d6-af6a-32821e332600","resolution":{"observed_at":"2026-07-31T00:41:44.719443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:44.817519Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:44.817519Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:8b94f949a20e67ff949faf46b17fe12f8e9739abcef086697099c1d12cdde8ba","observation_id":"49a12b48-b180-4b49-8c90-b20dee4f7359","resolution":{"observed_at":"2026-07-31T00:41:44.817519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:44.921773Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:44.921773Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:7c48458148b2e57475d04d523fb74cf75cc9c0de9b20da7f817b7203c447c6d2","observation_id":"4bf35ce9-d9d4-4bdf-b612-a4ad2d6a987a","resolution":{"observed_at":"2026-07-31T00:41:44.921773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:45.036699Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:45.036699Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:4c71880ed19c803766fd0e1a88d42054d8688f4c0296c9ae229fea34ee0a12eb","observation_id":"00e2c78b-96fb-4426-b296-e2f7c63a8012","resolution":{"observed_at":"2026-07-31T00:41:45.036699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:45.184019Z","title":"Advances in Neural Information Processing Systems36, 76749–76771 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:45.184019Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:dbc57f31b0568a84ba8399d8e7084b2f9eb3075aa19bf62046f560c0cb0017aa","observation_id":"71a5ae73-87e2-423a-aa00-750e4a42d298","resolution":{"observed_at":"2026-07-31T00:41:45.184019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:45.310234Z","title":"In: Proceed- ings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:45.310234Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:4c969c5d5fa5c7a22db32977e009e7ef409a143c95b0b21415b2616be4c6796f","observation_id":"ae6235a3-595d-468b-bef0-275581096ba2","resolution":{"observed_at":"2026-07-31T00:41:45.310234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:45.412255Z","title":"In: Proceedings of the Conference on Empirical Methods in Natural Language Processing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:45.412255Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:c411546a2b39b4f0cbde0270af0e7b31ec928012fed79e34f904adbafe05fa29","observation_id":"b158b3d5-8e51-49a6-ba20-3f3a03add85a","resolution":{"observed_at":"2026-07-31T00:41:45.412255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:45.554198Z","title":"LENS: Adaptive Spatio-Temporal Zooming in Long-Form Videos 19 Transactions on Machine Learning Research (2026),https://openreview.net/ forum?id=KZYhyilFnt","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:45.554198Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:c73bbb44c0156b4be99354109e4a70e9bfabc1b3828a9491cc65efdb306ad75b","observation_id":"8d3278e7-7469-4386-a131-d009bea4cb0d","resolution":{"observed_at":"2026-07-31T00:41:45.554198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:45.561413Z","title":"Advances in Neural Information Processing Systems37, 32111–32136 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:45.561413Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:d27b8e555a796284066115fdb63133dc1c279fe35a26729d544d809fa97c9368","observation_id":"2cd499cb-ffd8-4694-ba3e-e769a745b965","resolution":{"observed_at":"2026-07-31T00:41:45.561413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:45.564263Z","title":"In: The Thirteenth International Conference on Learning Representations (2025),https: //openreview.net/forum?id=tTBXePRKSx","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:45.564263Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:20f7bac5c015677eef3d42181b29322e5b2d75360b63b356426762f964ee9f35","observation_id":"36c6ec40-9aa8-4943-bcaf-2c43a9deb00e","resolution":{"observed_at":"2026-07-31T00:41:45.564263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.23898","last_updated":"2026-05-22T17:58:36Z","snapshot_observed_at":"2026-07-06T23:34:03.934151Z","submitted_at":"2026-05-22T17:58:36Z","title":"SPACENUM: Revisiting Spatial Numerical Understanding in VLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.23898","snapshot_observed_at":"2026-07-31T00:41:45.567400Z","title":"arXiv preprint arXiv:2605.23898 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:45.567400Z"},"links":{"cited_paper":"/paper/2605.23898","citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:33094b03487c8b1110dedcc8816cc2e4774d6c9e4990ca76fbdbdc1627209da6","observation_id":"952e2b08-1c03-4835-9f46-e45010e1aac8","resolution":{"observed_at":"2026-07-31T00:41:45.567400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.15224","last_updated":"2026-05-21T22:24:08Z","snapshot_observed_at":"2026-08-02T05:31:26.489605Z","submitted_at":"2026-01-21T17:56:59Z","title":"PROGRESSLM: Towards Progress Reasoning in Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.15224","snapshot_observed_at":"2026-07-31T00:41:45.571277Z","title":"arXiv preprint arXiv:2601.15224 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:45.571277Z"},"links":{"cited_paper":"/paper/2601.15224","citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:b228bba4e8973b62e533e6e97432e600d3bb780d85ad94bac776cc24b3008b87","observation_id":"f5c7874d-3819-44a8-89f1-4d66412f564d","resolution":{"observed_at":"2026-07-31T00:41:45.571277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:45.574584Z","title":"In: Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:45.574584Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:884928c9b9a9b5225aa693b771666a9b24b730f97cc13cd47d6d62d01d96e30d","observation_id":"f1a9ea98-08ac-4db7-a978-f3a6f87dda6d","resolution":{"observed_at":"2026-07-31T00:41:45.574584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:45.577475Z","title":"Transactions on Machine Learning Research (2025),https://openreview.net/forum?id=30RAWQVGlx","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:45.577475Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:522b49922a00d98e817ba136818a963e3bbf86e085d5e6e795798afa4dbe11e4","observation_id":"4695fe0f-5a11-421d-b571-2cb31cbcb2f7","resolution":{"observed_at":"2026-07-31T00:41:45.577475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:45.580319Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:45.580319Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:7618bbb7b6e2aaab3902d40c841c42aa46a057d3f7fadd40c2032cbb458be956","observation_id":"410a8cab-8446-4e85-994d-0b1884437b0e","resolution":{"observed_at":"2026-07-31T00:41:45.580319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:45.583754Z","title":"ACM Computing Surveys58(7), 1–36 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:45.583754Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:414809a86bf9735523b765c078eb3ddb396ad79d9ee85ce7336fb9b47d1ae701","observation_id":"7fee915e-aa35-450c-9915-372b4cc0758a","resolution":{"observed_at":"2026-07-31T00:41:45.583754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:45.586611Z","title":"Transactions on Machine Learning Research (2025),https://openreview.net/forum?id=EElFGvt39K","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:45.586611Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:e04b95f819018e447e14e8e4cfe9d52088d25e9b9e928e2824f8c6f2fb083d04","observation_id":"af5ad18f-f506-4be1-a564-71603509eeb1","resolution":{"observed_at":"2026-07-31T00:41:45.586611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:45.589701Z","title":"Advances in Neural Information Processing Systems16, 321–328 (2003)","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:45.589701Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:0c762a18ff8f0b49400a4826a5b02fdae6c4cf3ed1f5cf88a015ffa08f32ad35","observation_id":"80547fe7-96c1-4f54-9bff-2236f9d377b4","resolution":{"observed_at":"2026-07-31T00:41:45.589701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:45.592534Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:45.592534Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:6f43dfdc27f7843425058bc2f4a2e12f287e3f6cf07ef12404a4bcb618c8d24c","observation_id":"45b1b2ba-7dac-4d7b-8250-83e7760d659e","resolution":{"observed_at":"2026-07-31T00:41:45.592534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:45.595579Z","title":"In: International Conference on Learning Representations (2024),https://openreview.net/forum? id=1tZbq88f27","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:45.595579Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:c2c76d63591aeb3c7d6bce482da19b30d9ad27573eefc49a680b474e38f1bbd4","observation_id":"4468465c-8542-4c9f-bc08-f54b645b66f1","resolution":{"observed_at":"2026-07-31T00:41:45.595579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:41:45.598802Z","title":"What is the main idea of the video?","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-31T00:41:45.598802Z"},"links":{"citing_paper":"/paper/2607.25125"},"observation_digest":"sha256:e5af6bf8d1604e4300522b5e5fdf32b173a41cc0164badac5c8c26569e12afe6","observation_id":"ea7c5707-ca62-4885-ae24-4a8404197236","resolution":{"observed_at":"2026-07-31T00:41:45.598802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.25125","last_updated":"2026-07-27T22:36:33Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-03T17:54:51.329823Z","submitted_at":"2026-07-27T22:36:33Z","title":"LENS: Adaptive Spatio-Temporal Zooming for Keyframe Sampling in Long-Form Videos"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":62,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 0 inbound Pith citation observations for arXiv:2607.25125."}