{"as_of":"2026-08-19T17:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f261e6343a0bcac3824ce0b7e5d617693ad9e8f4fe59d4a62bc282c67d0cef72","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:31:40.869774Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01169/citation-record","integrity":"/paper/2608.01169/integrity","json":"/paper/2608.01169/citation-record.json","paper":"/paper/2608.01169"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:31:39.766617Z","title":"Feige, U","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01169","last_updated":"2026-08-02T11:44:51Z","snapshot_observed_at":"2026-08-19T08:44:40.555213Z","submitted_at":"2026-08-02T11:44:51Z","title":"Think in Sets for Streaming Video Token Compression","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T00:31:39.766617Z"},"links":{"citing_paper":"/paper/2608.01169"},"observation_digest":"sha256:c1dc2208b9a7aac0c3c5937c981e88090f0ccc8d6e56c12a1926d363a5e0ffa2","observation_id":"a5d372ed-84a9-4298-b130-3eafc0ad2260","resolution":{"observed_at":"2026-08-06T00:31:39.766617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:31:42.064352Z","title":"InICASSP 2026-2026 IEEE Interna- tional Conference on Acoustics, Speech and Signal Process- ing (ICASSP), 12147–12151","venue":null,"work_id":"e6f0c663-0921-4404-b376-efa052533da0","year":2026},"citing_paper":{"arxiv_id":"2608.01169","last_updated":"2026-08-02T11:44:51Z","snapshot_observed_at":"2026-08-19T08:44:40.555213Z","submitted_at":"2026-08-02T11:44:51Z","title":"Think in Sets for Streaming Video Token Compression","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T00:31:40.050765Z"},"links":{"citing_paper":"/paper/2608.01169"},"observation_digest":"sha256:3549d17f5e2419112a1a0116396e01233b756b4a29a9353bb8cec4a6394e4e92","observation_id":"c820a7ff-80a7-4b8e-a532-5ad41824e789","resolution":{"observed_at":"2026-08-06T00:31:42.179603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08646","last_updated":"2025-03-30T05:25:58Z","snapshot_observed_at":"2026-08-16T13:00:14.848164Z","submitted_at":"2024-12-11T18:59:54Z","title":"StreamChat: Chatting with Streaming Video","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08646","snapshot_observed_at":"2026-08-06T00:31:40.113571Z","title":"arXiv:2412.08646","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01169","last_updated":"2026-08-02T11:44:51Z","snapshot_observed_at":"2026-08-19T08:44:40.555213Z","submitted_at":"2026-08-02T11:44:51Z","title":"Think in Sets for Streaming Video Token Compression","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T00:31:40.113571Z"},"links":{"cited_paper":"/paper/2412.08646","citing_paper":"/paper/2608.01169"},"observation_digest":"sha256:74e8235ddaa0857d699b3574ae72ce678608a2eeb4f2ca75e732c05faf602b4c","observation_id":"d49abe4c-8398-4526-b529-33bf2889eb50","resolution":{"observed_at":"2026-08-06T00:31:40.113571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:31:41.937569Z","title":"InProceedingsofthe2025 ConferenceonEmpiricalMethodsinNaturalLanguagePro- cessing, 1910–1924","venue":null,"work_id":"6756b5f9-8247-479e-9f07-7a6b9bbed519","year":1910},"citing_paper":{"arxiv_id":"2608.01169","last_updated":"2026-08-02T11:44:51Z","snapshot_observed_at":"2026-08-19T08:44:40.555213Z","submitted_at":"2026-08-02T11:44:51Z","title":"Think in Sets for Streaming Video Token Compression","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T00:31:40.221854Z"},"links":{"citing_paper":"/paper/2608.01169"},"observation_digest":"sha256:dfb73aa2e72020fb205924efd77f27a9ed87b0e0f3774901185c6bb2bf0df958","observation_id":"3021d23c-a052-4835-b8f5-6f398ec8abfb","resolution":{"observed_at":"2026-08-06T00:31:42.032678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15269","last_updated":"2026-04-23T12:54:38Z","snapshot_observed_at":"2026-08-12T15:58:40.311449Z","submitted_at":"2025-05-21T08:47:15Z","title":"LiveVLM: Efficient Online Video Understanding via Streaming-Oriented KV Cache and Retrieval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15269","snapshot_observed_at":"2026-08-06T00:31:40.388286Z","title":"arXiv:2505.15269","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01169","last_updated":"2026-08-02T11:44:51Z","snapshot_observed_at":"2026-08-19T08:44:40.555213Z","submitted_at":"2026-08-02T11:44:51Z","title":"Think in Sets for Streaming Video Token Compression","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T00:31:40.388286Z"},"links":{"cited_paper":"/paper/2505.15269","citing_paper":"/paper/2608.01169"},"observation_digest":"sha256:6d164a5c2666e21d213a39029286f7a1c8e7fae8d944286bb765918255a27fa8","observation_id":"38dd63f1-5e84-4aa2-a60b-d5e7b1bf0f86","resolution":{"observed_at":"2026-08-06T00:31:40.388286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:31:41.506950Z","title":"Ren,S.;Chen,S.;Li,S.;Sun,X.;andHou,L.2023","venue":null,"work_id":"955be5b5-e024-4ed2-971a-4be0c5cc59bb","year":2023},"citing_paper":{"arxiv_id":"2608.01169","last_updated":"2026-08-02T11:44:51Z","snapshot_observed_at":"2026-08-19T08:44:40.555213Z","submitted_at":"2026-08-02T11:44:51Z","title":"Think in Sets for Streaming Video Token Compression","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T00:31:40.464213Z"},"links":{"citing_paper":"/paper/2608.01169"},"observation_digest":"sha256:604054a70144e5350588a26b739c70bacb86ee47927fbb7e1a8b88732170e086","observation_id":"8343e107-5362-41a2-8b14-543c887f05a3","resolution":{"observed_at":"2026-08-06T00:31:41.595601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05240","last_updated":"2026-07-09T06:53:43Z","snapshot_observed_at":"2026-08-18T02:14:46.902275Z","submitted_at":"2025-07-07T17:49:41Z","title":"StreamVLN: Streaming Vision-and-Language Navigation via SlowFast Context Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.05240","snapshot_observed_at":"2026-08-06T00:31:40.601037Z","title":"Xie, Y.; He, B.; Wang, J.; Zheng, X.; Ye, Z.; and Wu, Z","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01169","last_updated":"2026-08-02T11:44:51Z","snapshot_observed_at":"2026-08-19T08:44:40.555213Z","submitted_at":"2026-08-02T11:44:51Z","title":"Think in Sets for Streaming Video Token Compression","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T00:31:40.601037Z"},"links":{"cited_paper":"/paper/2507.05240","citing_paper":"/paper/2608.01169"},"observation_digest":"sha256:a15b138666c1138527cb9605528207decdca893e9b2d913871782ac44e3c6e7e","observation_id":"e8cc92f2-e08c-48c4-a469-0c38834bf70e","resolution":{"observed_at":"2026-08-06T00:31:40.601037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:31:40.688248Z","title":"Yang,S.;Chen,Y.;Tian,Z.;Wang,C.;Li,J.;Yu,B.;andJia, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01169","last_updated":"2026-08-02T11:44:51Z","snapshot_observed_at":"2026-08-19T08:44:40.555213Z","submitted_at":"2026-08-02T11:44:51Z","title":"Think in Sets for Streaming Video Token Compression","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T00:31:40.688248Z"},"links":{"citing_paper":"/paper/2608.01169"},"observation_digest":"sha256:688a449678a18c66e9f07bcec6f3d980edcbcf3bca797f38023d81925da74b6a","observation_id":"86841120-403d-4a15-9817-168607e12b99","resolution":{"observed_at":"2026-08-06T00:31:40.688248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13106","last_updated":"2025-06-03T03:33:14Z","snapshot_observed_at":"2026-08-13T11:53:19.464291Z","submitted_at":"2025-01-22T18:59:46Z","title":"VideoLLaMA 3: Frontier Multimodal Foundation Models for Image and Video Understanding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13106","snapshot_observed_at":"2026-08-06T00:31:40.780394Z","title":"InProceedings of the 33rd ACM International Conference on Multimedia, 10807–10816","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01169","last_updated":"2026-08-02T11:44:51Z","snapshot_observed_at":"2026-08-19T08:44:40.555213Z","submitted_at":"2026-08-02T11:44:51Z","title":"Think in Sets for Streaming Video Token Compression","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T00:31:40.780394Z"},"links":{"cited_paper":"/paper/2501.13106","citing_paper":"/paper/2608.01169"},"observation_digest":"sha256:90ef7a407bac92c4d54ecde9af64100ed177001c9aaebfe0874c2238f7a79fb8","observation_id":"4be5c251-8887-4fa8-8c21-c79ef554a716","resolution":{"observed_at":"2026-08-06T00:31:40.780394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02713","last_updated":"2025-08-01T16:40:14Z","snapshot_observed_at":"2026-08-19T14:11:01.412437Z","submitted_at":"2024-10-03T17:36:49Z","title":"LLaVA-Video: Video Instruction Tuning With Synthetic Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02713","snapshot_observed_at":"2026-08-06T00:31:40.869774Z","title":"arXiv:2410.02713","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01169","last_updated":"2026-08-02T11:44:51Z","snapshot_observed_at":"2026-08-19T08:44:40.555213Z","submitted_at":"2026-08-02T11:44:51Z","title":"Think in Sets for Streaming Video Token Compression","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T00:31:40.869774Z"},"links":{"cited_paper":"/paper/2410.02713","citing_paper":"/paper/2608.01169"},"observation_digest":"sha256:8285cbd408360127f4f11615bb473448e5fa96f9109b4447b61da02212390d10","observation_id":"e094ca18-d2e0-4d3e-8437-d653e139b5d3","resolution":{"observed_at":"2026-08-06T00:31:40.869774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:31:42.301175Z","title":null,"venue":null,"work_id":"08955066-b4e0-4856-ac20-1a5763e798d6","year":2025},"citing_paper":{"arxiv_id":"2608.01169","last_updated":"2026-08-02T11:44:51Z","snapshot_observed_at":"2026-08-19T08:44:40.555213Z","submitted_at":"2026-08-02T11:44:51Z","title":"Think in Sets for Streaming Video Token Compression","version":1},"reference_index":1998,"source":"pdf_text","source_observed_at":"2026-08-06T00:31:39.838004Z"},"links":{"citing_paper":"/paper/2608.01169"},"observation_digest":"sha256:01c41e85fe7b2703a33199c76fc547d979bb65b27de64264088615160d8a945a","observation_id":"90034daa-eba1-4fcb-976d-f84f935654c8","resolution":{"observed_at":"2026-08-06T00:31:42.452559Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12386","last_updated":"2025-07-13T18:57:17Z","snapshot_observed_at":"2026-08-06T07:17:05.291678Z","submitted_at":"2025-01-21T18:59:00Z","title":"InternVideo2.5: Empowering Video MLLMs with Long and Rich Context Modeling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12386","snapshot_observed_at":"2026-08-06T00:31:40.530514Z","title":"InProceedings of the 3rd ACM SIGPLAN InternationalWorkshoponMachineLearningandProgram- ming Languages (MAPL), 10–19","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01169","last_updated":"2026-08-02T11:44:51Z","snapshot_observed_at":"2026-08-19T08:44:40.555213Z","submitted_at":"2026-08-02T11:44:51Z","title":"Think in Sets for Streaming Video Token Compression","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T00:31:40.530514Z"},"links":{"cited_paper":"/paper/2501.12386","citing_paper":"/paper/2608.01169"},"observation_digest":"sha256:6de2661ac56fd3b4ecb541a396085196372a80e3bb51e5792f026a875c36c8cf","observation_id":"ac560be2-623d-42f1-83e5-80d01c5921d6","resolution":{"observed_at":"2026-08-06T00:31:40.530514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:31:41.676476Z","title":"Nemhauser,G.L.;Wolsey,L.A.;andFisher,M.L.1978","venue":null,"work_id":"4d2a2457-a9b3-4c58-8eff-27dfc5eb8719","year":1978},"citing_paper":{"arxiv_id":"2608.01169","last_updated":"2026-08-02T11:44:51Z","snapshot_observed_at":"2026-08-19T08:44:40.555213Z","submitted_at":"2026-08-02T11:44:51Z","title":"Think in Sets for Streaming Video Token Compression","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T00:31:40.288189Z"},"links":{"citing_paper":"/paper/2608.01169"},"observation_digest":"sha256:4bd0d1e1cbeaa3a86c047ebf42bbf91e1d1decc5530f828725bb362b6869e44b","observation_id":"3328c7ea-0883-4a95-833e-b9e1d93d4550","resolution":{"observed_at":"2026-08-06T00:31:41.815286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:31:39.647181Z","title":"InEuropean Conference on Computer Vision (ECCV), 19–35","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.01169","last_updated":"2026-08-02T11:44:51Z","snapshot_observed_at":"2026-08-19T08:44:40.555213Z","submitted_at":"2026-08-02T11:44:51Z","title":"Think in Sets for Streaming Video Token Compression","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T00:31:39.647181Z"},"links":{"citing_paper":"/paper/2608.01169"},"observation_digest":"sha256:d7727c380d65c5df1edf7d04627bd8a8eebe716b0fba38a0f52cc0ab65f3c307","observation_id":"93842de1-11d0-4924-ab15-a4af9ce683a7","resolution":{"observed_at":"2026-08-06T00:31:39.647181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-14T04:17:22.593941Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-06T00:31:39.567984Z","title":"arXiv:2502.13923","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01169","last_updated":"2026-08-02T11:44:51Z","snapshot_observed_at":"2026-08-19T08:44:40.555213Z","submitted_at":"2026-08-02T11:44:51Z","title":"Think in Sets for Streaming Video Token Compression","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T00:31:39.567984Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2608.01169"},"observation_digest":"sha256:eb56f6d8068bba42fa2d2b37c2ab01b4ae22cef5faaa978aa601886779d4353c","observation_id":"7a6dfe20-6b7d-4808-9ea1-bb9f7a6bb7c5","resolution":{"observed_at":"2026-08-06T00:31:39.567984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.18681","last_updated":"2026-07-24T13:07:03Z","snapshot_observed_at":"2026-08-13T14:53:15.391221Z","submitted_at":"2026-06-17T04:45:10Z","title":"Moving Beyond Diversity: Visual Token Pruning as Subspace Reconstruction for Efficient VLMs","version":2},"cited_work":{"arxiv_id":"2606.18681","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.18681","snapshot_observed_at":"2026-08-06T00:31:41.114062Z","title":"Moving Beyond Diversity: Visual Token Pruning as Subspace Reconstruction for Efficient VLMs","venue":"cs.CV","work_id":"4a9af8cd-20cd-4376-a29e-73bf55ea1281","year":2026},"citing_paper":{"arxiv_id":"2608.01169","last_updated":"2026-08-02T11:44:51Z","snapshot_observed_at":"2026-08-19T08:44:40.555213Z","submitted_at":"2026-08-02T11:44:51Z","title":"Think in Sets for Streaming Video Token Compression","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-06T00:31:39.923680Z"},"links":{"cited_paper":"/paper/2606.18681","citing_paper":"/paper/2608.01169"},"observation_digest":"sha256:24680b43805b53669c541a204483496e994909bf316f7b9cd2f17020bd13b11d","observation_id":"e6144178-5a93-448c-b4e6-19e8bdefe58d","resolution":{"observed_at":"2026-08-06T00:31:41.236232Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.01169","last_updated":"2026-08-02T11:44:51Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T08:44:40.555213Z","submitted_at":"2026-08-02T11:44:51Z","title":"Think in Sets for Streaming Video Token Compression"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 0 inbound Pith citation observations for arXiv:2608.01169."}