{"as_of":"2026-08-10T23:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:422de28903ceb9c52bec91ee1a8c80373b965b4dd00aedb81554c25d70ad4427","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:43:50.035955Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04866/citation-record","integrity":"/paper/2608.04866/integrity","json":"/paper/2608.04866/citation-record.json","paper":"/paper/2608.04866"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.929766Z","title":null,"venue":null,"work_id":"c99601be-bda7-41d5-b786-d056c6aa2560","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:44.621779Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:87bc51ba4b5b960ed509442fd864fd7f4923f5f8702089990ab7831019ff497a","observation_id":"ab6a0c98-1ca1-4d45-ab06-e0482924d440","resolution":{"observed_at":"2026-08-06T14:43:53.934169Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.914169Z","title":null,"venue":null,"work_id":"19c3c443-df15-48ac-ba04-ab36c44bf713","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:44.683935Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:b8af6054d82907cd4f3edeee7a34da72a7ca02754c9edea8466b12f05846c986","observation_id":"460741e8-d399-41ea-91ba-d5c84c9991f4","resolution":{"observed_at":"2026-08-06T14:43:53.918980Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.899581Z","title":null,"venue":null,"work_id":"79b3186d-c9e5-429e-bc82-df0e16f89120","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:44.796907Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:a1ca1ab51a7d08fa12f60c5c84ed6a98b0f19beb8e685d9383ce1bbdec30d589","observation_id":"aa5ed60e-394f-4ca0-a06c-2468a0dab98f","resolution":{"observed_at":"2026-08-06T14:43:53.903818Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.884258Z","title":null,"venue":null,"work_id":"70118527-055c-45d8-84d9-862ccf6e226c","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:44.901320Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:715d21e6ecfa2668c23a79b75486a4ae42bccbe49012611b196624c3c144d24a","observation_id":"d4044472-111d-4e1d-b67f-389f0f6e6d1e","resolution":{"observed_at":"2026-08-06T14:43:53.889089Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.868425Z","title":null,"venue":null,"work_id":"88eb8045-8ece-4ac9-be0d-b12fce658a80","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:45.003815Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:1088ac093d19c7b0d33cef54b8a3ea7bff96b0c3636b9ff94ff2a5c94048ee57","observation_id":"7264ded5-4efe-4ffd-8500-30e18833fa68","resolution":{"observed_at":"2026-08-06T14:43:53.872983Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:45.125565Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:45.125565Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:9f2699e79a85f779e2274a0999f85c857f924275d5840a385b26c5c952248f77","observation_id":"56e10586-c656-4aeb-a065-7a071e190dfa","resolution":{"observed_at":"2026-08-06T14:43:45.125565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.841642Z","title":"2024 , organization=","venue":null,"work_id":"df0a8a7d-251e-4364-a7a4-d8794c92c8b6","year":2024},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:45.227874Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:8be96d6683ac6711c528c97722e5918afaa8f04897ac9fbe983da11a1c74793b","observation_id":"8263accc-826f-48bd-b408-aedc3be93693","resolution":{"observed_at":"2026-08-06T14:43:53.846357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.826000Z","title":null,"venue":null,"work_id":"46dbc9d6-1525-4364-a808-885c3d63b638","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:45.334373Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:c6b00e4b2a25c62f5e96a91605e1a6b726aa97e8705a47f4a0600d9068f81d1d","observation_id":"e25cbddb-c10f-4a79-91a5-e0b8f08ef811","resolution":{"observed_at":"2026-08-06T14:43:53.830645Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.809066Z","title":"and Soran, Bilge and Krishnamoorthi, Raghuraman and Elhoseiny, Mohamed and Chandra, Vikas , booktitle=","venue":null,"work_id":"b463208a-3390-43d8-b6e0-dd7a99464aab","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:45.409409Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:51fa6c210c66ff8c14d418fc7486955aaa3bfbb00abaaf6eec5566450681409f","observation_id":"9fe9a487-5e3f-44c6-95c1-72141fa3d938","resolution":{"observed_at":"2026-08-06T14:43:53.814677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.792934Z","title":"Object-Centric Learning with","venue":null,"work_id":"acdbf1e9-57a5-4b02-b53b-f65216595c51","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:45.515315Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:5fcc2ae3bc89127efffe71416aca2ad06457bcb8a5ef5950f4d7c5c76eb012e5","observation_id":"11d9a447-e4f7-4454-a200-99d77b651f2d","resolution":{"observed_at":"2026-08-06T14:43:53.797693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.776867Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":"d48d2a9a-224c-4b3c-8d3f-b97c8cfdc854","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:45.585210Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:f144b0f6cf708204733c48c9dac8d3fd5a5f3af2333345782318d0b761a09507","observation_id":"73956562-9356-40af-bab9-5f52ff11e377","resolution":{"observed_at":"2026-08-06T14:43:53.781921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:45.687911Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:45.687911Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:a95cd370ea441eae1d22ee00bdced8e1641ca9522b0b804ff6e6942063d2c3dd","observation_id":"6359d21f-d7bb-49de-860a-c7a012f46e4e","resolution":{"observed_at":"2026-08-06T14:43:45.687911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.749173Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"1024f8fa-d810-4c1e-b390-7b692d50f7cc","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:45.779658Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:1476438f7d0d69b4ff5fecefe6a96ad957e08b0ceb087ef87da0f479f24a7b21","observation_id":"c96a3652-d7d1-4cff-a304-783382aeff11","resolution":{"observed_at":"2026-08-06T14:43:53.753856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.734052Z","title":"Proceedings of the Computer Vision and Pattern Recognition Conference , pages=","venue":null,"work_id":"f770f7e7-c492-401d-86e2-52b822a5c121","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:45.883721Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:de3422428d6d733afdc2582010f493b034f2b02814b0bda075563910ad3ed082","observation_id":"4a1b798a-75c6-419e-80de-0ab7eba70d99","resolution":{"observed_at":"2026-08-06T14:43:53.739012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.719081Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"d2112444-df0c-4b65-b2c7-274c9dd17606","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:45.967279Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:0a75bd828c5ed80a49e1f130915ee64a03280213a048d16957e403b58de63883","observation_id":"1922eee8-c2dd-476f-a302-bb0d35bbcc27","resolution":{"observed_at":"2026-08-06T14:43:53.723834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.704144Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages=","venue":null,"work_id":"5c353b94-6561-4fd1-806e-28f443eec201","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:46.094687Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:432ab68f0c881dd50914383a4337506761fe807de6291ee630a68c66ec659e8d","observation_id":"6a20213c-4d26-466a-9fcf-cd9e1dc8c62b","resolution":{"observed_at":"2026-08-06T14:43:53.708759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.687678Z","title":"Efficient Motion-Aware Video","venue":null,"work_id":"af8c395a-3fc4-4a4e-aa23-63e6ad7592ba","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:46.185525Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:76264b0567ba89ba66659ac066ece2b16163d40b2fe20c41c20f00b599776583","observation_id":"d1aaf68a-9088-4e22-a7b5-4a740767aa6b","resolution":{"observed_at":"2026-08-06T14:43:53.692665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.671290Z","title":null,"venue":null,"work_id":"7cbbc2d7-a4f4-4f82-ba96-2934db2eda9c","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:46.267473Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:924b45117e6bb4e59ed2a94602a60871c77fa33a24eeb904188d6e31c582ccb1","observation_id":"49e68a52-22b5-475f-ab86-6b1264251adb","resolution":{"observed_at":"2026-08-06T14:43:53.676078Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.655981Z","title":"Proceedings of the 25th ACM International Conference on Multimedia , pages=","venue":null,"work_id":"aad0108a-b0fe-4c9c-b24c-0574ea1c1247","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:46.369125Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:4b57bc31cd3cd1cbb18b5bbfb545cc760d10085be95295bf4241afdaea3bbff0","observation_id":"cbef60ac-46d3-4e0d-89ea-4cc2e9784b43","resolution":{"observed_at":"2026-08-06T14:43:53.660389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.641104Z","title":null,"venue":null,"work_id":"3247af93-7cbe-4fb5-ab1e-adb9b850a628","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:46.454013Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:a9027d94be2375834f1b965bb3824a909e7803cf29946f8eaaca56073060a0c8","observation_id":"16020611-fbf8-44ee-83a9-2c7b58b4256a","resolution":{"observed_at":"2026-08-06T14:43:53.645819Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.625820Z","title":null,"venue":null,"work_id":"f908e761-5fda-4fd6-9984-4b3ef4969485","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:46.583088Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:16c62b294df9169a296ede885d959510f8dde4aaa30fca1372b4df1dff26b358","observation_id":"16bd151a-00cf-4fbc-9690-f1db5cd3ffd7","resolution":{"observed_at":"2026-08-06T14:43:53.630562Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.611578Z","title":null,"venue":null,"work_id":"b48cb984-402c-46c6-9ef7-038bf4d30174","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:46.672773Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:91efecedea2c0635745cec0636fafe538920c4932b426214a91a4d029e2a8fec","observation_id":"4ecce88c-ed85-4838-b2da-ade653885f92","resolution":{"observed_at":"2026-08-06T14:43:53.615940Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:46.790742Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:46.790742Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:e9773a6c18dafc0c856df2299e30ab05686bf2ac454cad32a039a5b6531cf756","observation_id":"30de05bb-6f37-4b91-a66b-7306d8dbb459","resolution":{"observed_at":"2026-08-06T14:43:46.790742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:46.868901Z","title":"2023 , organization=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:46.868901Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:dbba0d3ab1fe0191f330c9c06d021fd18dadb0f6392edf66d20e1f7033500088","observation_id":"9cbb5765-1737-4cc5-ae8d-f01b496a32a4","resolution":{"observed_at":"2026-08-06T14:43:46.868901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.575301Z","title":null,"venue":null,"work_id":"a2a8eb2c-459b-4564-8c25-461b7e351272","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:46.982751Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:400766db6e8abf95b0106373a18c9bd248e45d6c48baa0bbd27d0373bac9dce7","observation_id":"c46aa8dc-6275-4be8-9685-6dca55d9c7ec","resolution":{"observed_at":"2026-08-06T14:43:53.579822Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.559288Z","title":null,"venue":null,"work_id":"f851165c-4a75-44bf-99b5-f3f7d50caa6e","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:47.057858Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:d2298943fa8c14de45cbfd36a80f1dbc4a7512cf2ca8d36323da04523248eb77","observation_id":"141bff49-71e0-4c83-b7a0-2f403e707ac7","resolution":{"observed_at":"2026-08-06T14:43:53.564624Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:47.179027Z","title":"Token Merging: Your","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:47.179027Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:acd6b5199bd273376b26b0aa30ee3bfd695afa7e56fede7484875263a0c82c94","observation_id":"377343d2-d7be-42a1-b411-61ec3716515b","resolution":{"observed_at":"2026-08-06T14:43:47.179027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.532675Z","title":null,"venue":null,"work_id":"202ff7d9-36c9-4b0d-8b55-c215c8346d1d","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:47.269390Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:122b4d51f6a919fa18bbc18d91a5972728c54fb354dd08351982009a9ceebeb7","observation_id":"76ef49a1-728f-4fec-bd96-b1fd9f8db26a","resolution":{"observed_at":"2026-08-06T14:43:53.537674Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.516076Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":"3e733561-4b79-4c1b-a6f1-1e5148b9d892","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:47.385200Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:148fddb552e2b7562044d185aadcbac2e5d47fa8bac762171b38dad71930c0e9","observation_id":"37691565-95d3-4321-bdf1-ab263a41837a","resolution":{"observed_at":"2026-08-06T14:43:53.521236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.499972Z","title":null,"venue":null,"work_id":"bea7095c-6512-4b3e-9833-4d4a9b5d6e04","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:47.524416Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:79d245e87352ba116dcc4e45ec882cd3a317c530f56dac18b0ca8dff7512642a","observation_id":"b7812c3b-fae6-406c-b1c0-7709fbf61d74","resolution":{"observed_at":"2026-08-06T14:43:53.504629Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.485127Z","title":null,"venue":null,"work_id":"47a24344-9ab3-480f-8c4c-02c3a458a368","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:47.603783Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:f1a0361078dc66b99e577599274059e44136e652285a874fff3f6fc9f179c8d1","observation_id":"a925443b-3183-486a-a3ba-4cdee798320d","resolution":{"observed_at":"2026-08-06T14:43:53.489629Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.468951Z","title":null,"venue":null,"work_id":"786ed0d4-6ab2-4850-ad54-0991436eb78c","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:47.765881Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:c797d3a0222b3fa42e795468639dd9c669b956178466a0176c16c183f531c6d8","observation_id":"98da2d9c-0407-434a-ab42-3afdcaf43f48","resolution":{"observed_at":"2026-08-06T14:43:53.473718Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.453493Z","title":"International Conference on Learning Representations , year =","venue":null,"work_id":"dd21876e-81d5-412b-a10c-62158869a1fd","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:47.888421Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:b3d13ed2341984908d33a9b103cca3cb54f465f1cbf13ce9dd6c362ac90e8735","observation_id":"456d27ad-8db0-4f45-9518-ce801b16eab0","resolution":{"observed_at":"2026-08-06T14:43:53.458239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.311673Z","title":null,"venue":null,"work_id":"ab3765c6-0594-467a-a2f7-b07d3bb6ce21","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:47.985495Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:62b45150e6efe1868c59f4c827957236f48b231460f2ef79d7ebc757b0007df4","observation_id":"fd7de6c5-dc2d-4ce4-889e-31bd130afdd0","resolution":{"observed_at":"2026-08-06T14:43:53.411731Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:48.084978Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:48.084978Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:1379bb622df15f68f1300ed21392de02f5a0c00c333615dbf1b0125874dac499","observation_id":"ba6bbfe4-297e-4edf-ad67-813f9446bd20","resolution":{"observed_at":"2026-08-06T14:43:48.084978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.182365Z","title":null,"venue":null,"work_id":"d07ba66e-15c0-4f97-9715-f0549e194cde","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:48.183004Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:e678fdb458e357a11db312f3347b596c3999baccbe06d9659bc915b5dd2bf900","observation_id":"f141fe54-a3d2-47fd-8264-da7a40748a71","resolution":{"observed_at":"2026-08-06T14:43:53.252240Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.031073Z","title":"European Conference on Computer Vision , pages=","venue":null,"work_id":"756b5940-c29f-4d8c-8df6-1d77aac04294","year":2024},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:48.313886Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:827cf65e24ba29c5a6f49b5e237e6539ae1a69ca322fdcbf30bf0dcdbb41b00f","observation_id":"5fff37d9-8962-45ce-af69-cacbdfe7280d","resolution":{"observed_at":"2026-08-06T14:43:53.095588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:52.871662Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision Workshops , pages=","venue":null,"work_id":"6714f23b-84f6-41cd-9e55-33ab0e91d01a","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:48.468535Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:62e85e45f8fd368f0ce69a929f3f0f45d8288e05d6f7f85c4c4d8fabcee8f750","observation_id":"f04d9cb9-6695-4075-8519-1ad56b88f68f","resolution":{"observed_at":"2026-08-06T14:43:52.941031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:52.769400Z","title":null,"venue":null,"work_id":"289bc980-2cce-4cc9-8fae-4af220473df6","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:48.577304Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:774288ab16b71320420e689c912de8913303c0d4eff5f73abea1839aff8a5878","observation_id":"30ed2180-5404-451a-bdcf-5e49faad1328","resolution":{"observed_at":"2026-08-06T14:43:52.812477Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.11390","last_updated":"2019-01-22T18:55:34Z","snapshot_observed_at":"2026-08-10T22:58:10.731624Z","submitted_at":"2019-01-22T18:55:34Z","title":"MONet: Unsupervised Scene Decomposition and Representation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.11390","snapshot_observed_at":"2026-08-06T14:43:48.662390Z","title":"arXiv preprint arXiv:1901.11390 , year=","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:48.662390Z"},"links":{"cited_paper":"/paper/1901.11390","citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:09fed188060b735404c9bb61283612fac8951724f946ea57bf6d0da66fbbdaf7","observation_id":"eb6eb139-f511-45ab-92c8-98431c69b6f1","resolution":{"observed_at":"2026-08-06T14:43:48.662390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:52.557836Z","title":"Proceedings of the 36th International Conference on Machine Learning , volume=","venue":null,"work_id":"e63037c6-e2fc-4688-afff-9bafe2391ef9","year":2019},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:48.773871Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:7f864cf5c7ddb14825442b07ff3f688a93d61284ea8a2d4c156578b5dc000941","observation_id":"48588e6f-ba8d-45cc-9b14-0065e9fc3d4d","resolution":{"observed_at":"2026-08-06T14:43:52.690520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:52.275745Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":"411012b3-b4f6-454d-8f27-2e7c787310bc","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:48.844200Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:a6c339511549b328879b39a51da41b0adf8a1f0efc4361a12b4c827871243c83","observation_id":"cb537fe9-0334-4174-b3ba-d1122707a6ab","resolution":{"observed_at":"2026-08-06T14:43:52.413524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:52.033904Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"0d8d36bf-4a8f-4ca9-90e2-476b4edb5985","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:48.923629Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:9f512c30552556ad621d2115f8add9e938460ffe6cae57f7bd9a659eb74d7cbd","observation_id":"641c5691-962d-4170-8966-20580f46c385","resolution":{"observed_at":"2026-08-06T14:43:52.170901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:51.723928Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"b19cbde4-caa9-41f8-b883-210d79a439cb","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:48.993970Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:ccfb21ffd0b3bd5319035590b3f39ed4b7a0bfdde530ef8fdafcf5862a84d020","observation_id":"e779b23a-d7b6-4145-9e3b-75921f4c98f5","resolution":{"observed_at":"2026-08-06T14:43:51.868024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:49.060712Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:49.060712Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:429bf9f0ba79af4c92abe496653104c2549512659bfd0aabb1c65788a6c7c7e0","observation_id":"2a66c2dd-0184-4758-868f-eb2f1f67df27","resolution":{"observed_at":"2026-08-06T14:43:49.060712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:51.513104Z","title":"and Ionescu, Radu Tudor , journal=","venue":null,"work_id":"824564a3-5003-4d87-b952-5a0881ce6d6b","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:49.196217Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:71412b6f4bd3080d5c587853cf0577ef711fb682a1cc4800e13fca288c68a634","observation_id":"38987ed4-b3ed-4561-b68d-f44574c0a63d","resolution":{"observed_at":"2026-08-06T14:43:51.615786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.12601","last_updated":"2026-06-10T19:00:47Z","snapshot_observed_at":"2026-08-06T04:22:12.456126Z","submitted_at":"2026-06-10T19:00:47Z","title":"Dual-State Slot Attention: Decoupling Appearance and Identity for Video Object-Centric Learning","version":1},"cited_work":{"arxiv_id":"2606.12601","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.12601","snapshot_observed_at":"2026-08-06T14:43:50.185915Z","title":"Dual-State Slot Attention: Decoupling Appearance and Identity for Video Object-Centric Learning","venue":"cs.CV","work_id":"f3176802-b538-4439-8c91-3cf985973ba8","year":2026},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:49.273507Z"},"links":{"cited_paper":"/paper/2606.12601","citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:336bcbf342eb13cc220a36d60b11b6fb2b889acb7b1c6b835a0228fd03a66851","observation_id":"e99b3254-d831-44fa-a4c6-2539fa418df5","resolution":{"observed_at":"2026-08-06T14:43:50.334258Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:51.321108Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages=","venue":null,"work_id":"cc030159-da21-43da-be90-7d6497955baa","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:49.367118Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:37d2f88618bea581b0665c9fb379056dacbd99bf94a7e86f9beedcfa2bc78ca5","observation_id":"0565e546-60f5-44f2-87dc-351ca47000c0","resolution":{"observed_at":"2026-08-06T14:43:51.403661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:51.095316Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":"e9abf289-9902-4e54-9814-f96e4d6c5810","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:49.509821Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:f73cc7a394d2ace8744280fe0441fd4f8c59e6d427ea918e9b8b07ed8f2fa0e1","observation_id":"7e803d03-281f-4800-a1f4-3afc4b5f13e3","resolution":{"observed_at":"2026-08-06T14:43:51.176220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:50.851084Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages=","venue":null,"work_id":"fe2b7535-b226-4ffb-a367-0176fdef9dcd","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:49.616783Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:820359e4f54461a03f4ede2134bc5e637fa64068aea965859e2893c2fc9691df","observation_id":"3dc4c40a-487b-49a0-b012-45dd0ac1e835","resolution":{"observed_at":"2026-08-06T14:43:50.947543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:50.649321Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":"537e0654-d4f8-4447-857a-99b3db478fe3","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:49.730447Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:d93eecf2096b3a28a3f0e437b397d75ed3431a02e08ed616a4de3806d1a53ed1","observation_id":"3987332d-8db1-4205-b84c-716f24bde5c2","resolution":{"observed_at":"2026-08-06T14:43:50.736480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-06T14:43:49.844800Z","title":"arXiv preprint arXiv:2407.10671 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:49.844800Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:8ad928d132399b3b53674595a4b82a31cb05e55d62d1990be8d34882c330de63","observation_id":"2da55dd4-1977-4c5a-9ba5-71f29764ec10","resolution":{"observed_at":"2026-08-06T14:43:49.844800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07798","last_updated":"2024-06-10T13:55:21Z","snapshot_observed_at":"2026-07-06T18:13:33.931286Z","submitted_at":"2024-05-13T14:42:13Z","title":"FreeVA: Offline MLLM as Training-Free Video Assistant","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07798","snapshot_observed_at":"2026-08-06T14:43:49.954944Z","title":"arXiv preprint arXiv:2405.07798 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:49.954944Z"},"links":{"cited_paper":"/paper/2405.07798","citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:08c7c5b889a078901d96e24f5e217c392ecf1b5c172c686b39499a5aa3af7afb","observation_id":"3105391f-0eb4-4e9c-a957-58b9b1c00b7e","resolution":{"observed_at":"2026-08-06T14:43:49.954944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:50.446006Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":"a3caf2df-c4b7-4d5d-a29c-66f3219f7546","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:50.035955Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:00030c8be162f3a4ac12e5ac2c296798e30d328f165d3725d2081049bdc41380","observation_id":"a6f449d7-a092-4a93-8a8f-5cbfa993be22","resolution":{"observed_at":"2026-08-06T14:43:50.526646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T22:58:23.696988Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":29,"verified_exact":0,"verified_fuzzy":24},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2608.04866."}