{"as_of":"2026-08-17T15:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:34673bc00b4e6a19c671dbfc9f282267cc0f8a29d19da63ab67c9804cb147a20","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:50:06.708410Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:13:08.790871Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T09:01:26.251127Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.03179","snapshot_observed_at":"2026-08-06T23:13:08.790871Z","title":"Vid-sme: Membership inference attacks against large video understanding models.arXiv preprint arXiv:2506.03179, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19225","last_updated":"2025-06-24T01:19:56Z","snapshot_observed_at":"2026-08-14T14:43:02.885779Z","submitted_at":"2025-06-24T01:19:56Z","title":"Video-XL-2: Towards Very Long-Video Understanding Through Task-Aware KV Sparsification","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:13:08.790871Z"},"links":{"cited_paper":"/paper/2506.03179","citing_paper":"/paper/2506.19225"},"observation_digest":"sha256:cad4d45cb7667d051cc8be9c846cf9b8ff47e71452f26504a62c48c9489d8ad1","observation_id":"cde2b3d5-766a-4eb8-98d8-c27cdfbdd032","resolution":{"observed_at":"2026-08-06T23:13:08.790871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"cited_work":{"arxiv_id":"2506.03179","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.03179","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2506.03179 (2025)","venue":null,"work_id":"53817525-c563-4f55-bfc8-866d08119aea","year":2025},"citing_paper":{"arxiv_id":"2604.27002","last_updated":"2026-04-29T04:21:21Z","snapshot_observed_at":"2026-08-14T04:59:16.580185Z","submitted_at":"2026-04-29T04:21:21Z","title":"Membership Inference Attacks Against Video Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-07T13:09:43.708043Z"},"links":{"cited_paper":"/paper/2506.03179","citing_paper":"/paper/2604.27002"},"observation_digest":"sha256:abb52e2c067ed4454cf7f1e57cd8e258ec944362ef83aaff34d13e9a2e58f344","observation_id":"113347f8-e615-4b6b-879c-4c4c2cd4cb73","resolution":{"observed_at":"2026-05-12T09:01:26.252984Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.03179/citation-record","integrity":"/paper/2506.03179/integrity","json":"/paper/2506.03179/citation-record.json","paper":"/paper/2506.03179"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T12:49:59.195327Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:59.195327Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:cfec3e52c70e0aad1789db66ca6833dc8775903ce16919b8309ea09b28c89880","observation_id":"7f4e4520-4d47-4e6c-9ad3-6aa286caff55","resolution":{"observed_at":"2026-08-07T12:49:59.195327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:11.662820Z","title":"Generalised information and entropy measures in physics","venue":null,"work_id":"d4d6cc7e-c500-4e3d-9ea0-f17dcb73eb74","year":2009},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:59.283118Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:c9f6ee80059e36eddadef8b07313525e316bdf88a90fb5871f814db5c75e5390","observation_id":"3e26e7d7-d90a-4b3a-80c8-4e65fed986f4","resolution":{"observed_at":"2026-08-07T12:50:11.806842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:11.448225Z","title":"Is space-time attention all you need for video understanding? In ICML, volume 2, page 4, 2021","venue":null,"work_id":"c19c68c3-425c-4791-b51a-0108401cc7ab","year":2021},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:59.497540Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:ae5fcba22d02f8325fcbe13de4a654406ca1ad39f80ea21984f062b050d50b08","observation_id":"66295b0f-1e58-4b10-b58a-04239842bd7b","resolution":{"observed_at":"2026-08-07T12:50:11.552437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:49:59.711450Z","title":"Membership inference attacks from first principles","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:59.711450Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:adf2c0db540b0b99d07890d52f6979f7872268643eb7e0734603d83d2f818d04","observation_id":"ca8023f6-ddb4-4782-8b0d-e3e4b92d85ee","resolution":{"observed_at":"2026-08-07T12:49:59.711450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:11.238699Z","title":"The secret sharer: Evaluating and testing unintended memorization in neural networks","venue":null,"work_id":"e1a1463d-8fce-4ade-8add-2d84cf8345c4","year":2019},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:59.847419Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:ecbbbbef0d200b284921f3e8ccbafdb6789ff6395bfc7dec820261904cd51544","observation_id":"7f7bbade-6c78-49e9-a16b-ea1612f1a136","resolution":{"observed_at":"2026-08-07T12:50:11.336760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:49:59.978144Z","title":"Extracting training data from large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:59.978144Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:82b93212fc1f2ea4c66830c0b5f0056b75597b7d56663bd82f3362e4c22929b2","observation_id":"49d8b062-eec5-49b1-b3d4-dddf34f31380","resolution":{"observed_at":"2026-08-07T12:49:59.978144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03051","last_updated":"2025-04-09T06:24:14Z","snapshot_observed_at":"2026-08-16T13:12:45.748381Z","submitted_at":"2024-10-04T00:13:54Z","title":"AuroraCap: Efficient, Performant Video Detailed Captioning and a New Benchmark","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03051","snapshot_observed_at":"2026-08-07T12:50:00.159271Z","title":"Auroracap: Efficient, performant video detailed captioning and a new benchmark","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:00.159271Z"},"links":{"cited_paper":"/paper/2410.03051","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:b4b06a549f0ca42ce90c0459a9433ecd5a9e299782a9491ead3dcc37ddea689e","observation_id":"14d775da-00a6-4a49-9a83-208061a1d3d8","resolution":{"observed_at":"2026-08-07T12:50:00.159271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:00.355209Z","title":"Conceptual 12m: Pushing web-scale image-text pre-training to recognize long-tail visual concepts","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:00.355209Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:d6fa2cc8d9bfcf8212038e40a3098eaea6620735de93538c98b815387cb08a68","observation_id":"1a926d2b-6c4a-42ad-b443-a274a01f0766","resolution":{"observed_at":"2026-08-07T12:50:00.355209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:11.023940Z","title":"A hierarchical variational neural uncertainty model for stochastic video prediction","venue":null,"work_id":"06256295-31f2-4f7f-a9c8-fb6f7d8ca36e","year":2021},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:00.490679Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:f10bd2610c2220f5e657d176df9d35badb691552b5a3de828507b2e9f4711b8f","observation_id":"5c524018-e614-41df-a7c8-69016aedef0b","resolution":{"observed_at":"2026-08-07T12:50:11.122114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:10.820174Z","title":"Gan-leaks: A taxonomy of member- ship inference attacks against generative models","venue":null,"work_id":"e0c85045-0ab0-4913-b27e-1863f445fc67","year":2020},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:00.603354Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:c3667d6e470793f8ff17134f535a578f233e2a0aaa69472d00df6b3ffaad12c9","observation_id":"208f3cfc-48b1-4ae0-9f88-27aaada04dd6","resolution":{"observed_at":"2026-08-07T12:50:10.941307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:00.716534Z","title":"Sharegpt4v: Improving large multi-modal models with better captions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:00.716534Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:20606f2145f0981002537ee9f006e1b3a8342b3317d57261194ef0b53b9adf5c","observation_id":"9699e74a-8253-45a0-8f46-374a6801760f","resolution":{"observed_at":"2026-08-07T12:50:00.716534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:00.824379Z","title":"Vicuna: An open-source chatbot impressing gpt-4 with 90%* chatgpt quality","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:00.824379Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:d2ff542b5893d376d96e76b7a7c1623958fde4d6793f352b33bb07b7c7d58a5a","observation_id":"9cdd9a72-425d-4abb-a4b3-13b24ef60617","resolution":{"observed_at":"2026-08-07T12:50:00.824379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:10.659321Z","title":"A summary on entropy statistics","venue":null,"work_id":"cae0a2c5-8161-4e38-a42d-467c0ecfee9f","year":1995},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:00.941444Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:9c43597dc2f9363c9cae85216789955617d93bbd6827da195e955425e3368f73","observation_id":"0a5ec603-2d6f-4143-aae6-6c7838428c5b","resolution":{"observed_at":"2026-08-07T12:50:10.729548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:10.460299Z","title":"Polynomial expansion for orientation and motion estimation","venue":null,"work_id":"1a85c75b-9d2e-4290-ba2a-3932be992909","year":2002},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:01.035208Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:02b7e4c393628a72bc7af8ed206c46b2d0a30047a8c68cdcea421a329c8594df","observation_id":"2d7dc7d5-f617-466d-8f08-ff42a8edeb92","resolution":{"observed_at":"2026-08-07T12:50:10.521864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:01.164509Z","title":"Dropout as a bayesian approximation: Representing model uncertainty in deep learning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:01.164509Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:6da52e39fe404badbbcd42fabed2e030d1874ad5d2243a36eb6d6e24a48fe0f8","observation_id":"b5ee8706-7825-40c1-ba9c-d76bb39cba8f","resolution":{"observed_at":"2026-08-07T12:50:01.164509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:01.258821Z","title":"Vision-language models for medical report generation and visual question answering: A review","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:01.258821Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:9c33647b93103a4550523ff21f268408aba4d26ef0adbca4e043e22f0162dff5","observation_id":"1891a455-834b-49b7-ab0c-58a0b7554027","resolution":{"observed_at":"2026-08-07T12:50:01.258821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.07663","last_updated":"2018-08-21T13:24:17Z","snapshot_observed_at":"2026-08-16T22:35:56.125619Z","submitted_at":"2017-05-22T11:05:06Z","title":"LOGAN: Membership Inference Attacks Against Generative Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.07663","snapshot_observed_at":"2026-08-07T12:50:01.377734Z","title":"Logan: Membership inference attacks against generative models","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:01.377734Z"},"links":{"cited_paper":"/paper/1705.07663","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:f4f52300f602eab27e01d26ff1bea05f0ea50a9abc5b259e18596679b789ede9","observation_id":"22f2957e-5b28-432c-9ea2-ae424f3c9fc6","resolution":{"observed_at":"2026-08-07T12:50:01.377734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:01.534322Z","title":"Bliva: A simple multimodal llm for better handling of text-rich visual questions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:01.534322Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:d3966200099a9e9820764f6773be0c4076d382259381bedf710e49cfc8e3d5f3","observation_id":"c1adcd16-e2b9-4071-9cd5-6a3412f44dcf","resolution":{"observed_at":"2026-08-07T12:50:01.534322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18624","last_updated":"2025-02-07T05:11:54Z","snapshot_observed_at":"2026-08-15T09:43:30.688135Z","submitted_at":"2025-01-27T05:44:58Z","title":"Membership Inference Attacks Against Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18624","snapshot_observed_at":"2026-08-07T12:50:01.646953Z","title":"Membership inference attacks against vision-language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:01.646953Z"},"links":{"cited_paper":"/paper/2501.18624","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:e3c09d480aa99afa14758ff8717deda0d8d343e43b24aa478d49e7c4e37914c4","observation_id":"d7f5e69c-d339-41f5-b5cc-32a5d117b1c6","resolution":{"observed_at":"2026-08-07T12:50:01.646953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:01.782739Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:01.782739Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:c5fa62ccfede7e8e91e6096a6e3ffad9555c437c8bbe210e0b376be4bb10c297","observation_id":"1ecb97f7-8d70-47be-b9e0-06a0c996837f","resolution":{"observed_at":"2026-08-07T12:50:01.782739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06355","last_updated":"2024-01-04T02:06:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-10T17:59:04Z","title":"VideoChat: Chat-Centric Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06355","snapshot_observed_at":"2026-08-07T12:50:01.880477Z","title":"Videochat: Chat-centric video understanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:01.880477Z"},"links":{"cited_paper":"/paper/2305.06355","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:42a4e57b216fdd68130512fe1259e16bb4d0bb09b3c0564d2cc54e36f3a77bf6","observation_id":"5affa91c-1097-4287-9971-fc2a790710a4","resolution":{"observed_at":"2026-08-07T12:50:01.880477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15796","last_updated":"2024-11-24T11:46:59Z","snapshot_observed_at":"2026-08-15T15:36:10.198068Z","submitted_at":"2024-11-24T11:46:59Z","title":"Data Lineage Inference: Uncovering Privacy Vulnerabilities of Dataset Pruning","version":1},"cited_work":{"arxiv_id":"2411.15796","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.15796","snapshot_observed_at":"2026-08-07T12:50:07.058242Z","title":"Data Lineage Inference: Uncovering Privacy Vulnerabilities of Dataset Pruning","venue":"cs.CR","work_id":"af92504b-a29c-4c42-831b-12e3c9c5ae91","year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:02.020835Z"},"links":{"cited_paper":"/paper/2411.15796","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:57270de79085baa402110ca6f54929d0fe62bff5ff49b73afce79f6d3c281edb","observation_id":"5da2f132-cbb0-4740-9dc6-055d0af091b1","resolution":{"observed_at":"2026-08-07T12:50:07.109278Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:02.148376Z","title":"Membership inference attacks against large vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:02.148376Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:3d7a05950a7ccdf4eb90a9c4dbbf16eb135670c4420e86d3da2373e9ec39e520","observation_id":"d7fcc0d1-d3d9-4499-99ba-d5bf76a85fa0","resolution":{"observed_at":"2026-08-07T12:50:02.148376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:10.145999Z","title":"Next-qa: Next phase of question answering to explaining tem- poral actions","venue":null,"work_id":"98ac3d90-0fed-4e17-ae1e-352e1b58cf86","year":2021},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:02.275954Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:ce6186b52d9d08620a713202c8608be0d3c433685ee087ed695dd470863e1e58","observation_id":"15b27c79-583b-4983-9629-be85bee2703c","resolution":{"observed_at":"2026-08-07T12:50:10.259861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:02.442463Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:02.442463Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:eb77651dae850866f7b96778be4c2f78d03e845b0f4b29e10442fa855f8edd75","observation_id":"b411a6af-f3a4-40e2-aef6-bbdf3f5a52a3","resolution":{"observed_at":"2026-08-07T12:50:02.442463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:02.525025Z","title":"Llava-next: Improved reasoning, ocr, and world knowledge, January 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:02.525025Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:0266805464542e50d362b163fb51c0bf6ddb716f3c7ad60b3653265aa7ceab91","observation_id":"ecb9d7da-ac86-42c7-b9aa-2e9c4884b68c","resolution":{"observed_at":"2026-08-07T12:50:02.525025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:09.967334Z","title":"St-llm: Large language models are effective temporal learners","venue":null,"work_id":"f0a4a853-4798-4c8a-ba37-4695ebf13779","year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:02.650138Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:d114cc3edd2ba1cdff15379716b230a150804cb6fb26e2b64d8c2ed98c6d1af0","observation_id":"c79afcb2-883b-4e35-98be-2d25af95dbe6","resolution":{"observed_at":"2026-08-07T12:50:10.065850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00476","last_updated":"2024-06-03T04:13:39Z","snapshot_observed_at":"2026-08-12T14:24:43.915700Z","submitted_at":"2024-03-01T12:02:19Z","title":"TempCompass: Do Video LLMs Really Understand Videos?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00476","snapshot_observed_at":"2026-08-07T12:50:02.767971Z","title":"Tempcompass: Do video llms really understand videos? arXiv preprint arXiv:2403.00476, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:02.767971Z"},"links":{"cited_paper":"/paper/2403.00476","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:e6c1319635b36f7b48824f200a03697e0a45c62f9a420bce9c83b2e4911d4762","observation_id":"a2044a25-f7d4-4fb3-9665-8c2f0ab4490f","resolution":{"observed_at":"2026-08-07T12:50:02.767971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14640","last_updated":"2025-05-20T17:26:32Z","snapshot_observed_at":"2026-08-13T16:34:59.517866Z","submitted_at":"2025-05-20T17:26:32Z","title":"VideoEval-Pro: Robust and Realistic Long Video Understanding Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14640","snapshot_observed_at":"2026-08-07T12:50:02.846860Z","title":"Videoeval-pro: Robust and realistic long video understanding evaluation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:02.846860Z"},"links":{"cited_paper":"/paper/2505.14640","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:eb47d9e55c60e46a5c7fbe27323f2f37ba0d091a5d2bfc19551fe06761a75115","observation_id":"a0e8be73-74c8-40ed-ac7e-74a5cf6f213b","resolution":{"observed_at":"2026-08-07T12:50:02.846860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.11384","last_updated":"2021-06-21T19:37:06Z","snapshot_observed_at":"2026-08-16T18:15:31.548160Z","submitted_at":"2021-06-21T19:37:06Z","title":"Membership Inference on Word Embedding and Beyond","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.11384","snapshot_observed_at":"2026-08-07T12:50:02.921582Z","title":"Membership inference on word embedding and beyond","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:02.921582Z"},"links":{"cited_paper":"/paper/2106.11384","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:4196db29aa1471c36cc120e62deee4e9a64e59965cc728aad649303268cec801","observation_id":"a5ebe86a-f4aa-45d0-8029-110c21ad2e9d","resolution":{"observed_at":"2026-08-07T12:50:02.921582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05424","last_updated":"2024-06-10T01:36:53Z","snapshot_observed_at":"2026-07-06T15:40:24.127663Z","submitted_at":"2023-06-08T17:59:56Z","title":"Video-ChatGPT: Towards Detailed Video Understanding via Large Vision and Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05424","snapshot_observed_at":"2026-08-07T12:50:02.944973Z","title":"Video-chatgpt: Towards detailed video understanding via large vision and language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:02.944973Z"},"links":{"cited_paper":"/paper/2306.05424","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:c9647e7ab2cac915d8a6fec50defcf6aaff1d5a9af6342d649e46f9b3f77cc1a","observation_id":"3bca8670-5e05-4c3b-8560-fd380795588a","resolution":{"observed_at":"2026-08-07T12:50:02.944973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:03.043359Z","title":"Expanding language-image pretrained models for general video recognition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:03.043359Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:300747f10349085daa508c8e7d9d30dc10b2d4d8cf8c18344ce0e6f7c2de4574","observation_id":"101ecbd6-fda6-4c6b-975c-f434139abf21","resolution":{"observed_at":"2026-08-07T12:50:03.043359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:09.769176Z","title":"Slowfocus: Enhancing fine-grained temporal understanding in video llm","venue":null,"work_id":"50053704-de78-454b-b2c2-492e77a50663","year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:03.201275Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:a082393363be566a5f6bb3f3a38e81a305d9f0c6bec694b852df3b6e6b323ad6","observation_id":"5be1f143-d460-424e-adde-14d4427f23cf","resolution":{"observed_at":"2026-08-07T12:50:09.857404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:09.571874Z","title":"Learning latent subevents in activity videos using temporal attention filters","venue":null,"work_id":"9b7b3a99-efda-499a-842c-471da2d31f4f","year":2017},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:03.285450Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:32923b3d4844f53c5888737e04b01ae3b5016db2d15d174505d95b8fc8f047b6","observation_id":"fd8a5bad-f8e3-47bf-bab1-f11070dce1b4","resolution":{"observed_at":"2026-08-07T12:50:09.666613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:09.395384Z","title":"Fine-tuned clip models are efficient video learners","venue":null,"work_id":"13e8d142-6eea-4d28-bb59-0be16482ecc1","year":2023},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:03.376117Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:d2302499a04bae63c938a40a6164c06344612c6426763b50a65bdfbffa109a32","observation_id":"190b3730-464f-4765-aa75-27356f97060b","resolution":{"observed_at":"2026-08-07T12:50:09.475271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08813","last_updated":"2024-10-21T03:08:08Z","snapshot_observed_at":"2026-08-17T14:14:30.066593Z","submitted_at":"2024-05-14T17:59:02Z","title":"CinePile: A Long Video Question Answering Dataset and Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.08813","snapshot_observed_at":"2026-08-07T12:50:03.465772Z","title":"Cinepile: A long video question answering dataset and benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:03.465772Z"},"links":{"cited_paper":"/paper/2405.08813","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:07afbc6b136680bf6f9d50b0e948b56c1eea23a444813b63e96a6e811f5ce1fa","observation_id":"b5a9eed2-063f-4369-83c6-f8cdb5c0e94f","resolution":{"observed_at":"2026-08-07T12:50:03.465772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:09.183036Z","title":"On measures of entropy and information","venue":null,"work_id":"0388688a-99a2-4f80-b2a3-e1829329fa29","year":1961},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:03.561224Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:2455eda286126ac3e764fbea655a455ab5d81fc41f448a5e1d8738349bf40589","observation_id":"26932e13-46af-4771-9da3-cfb109305d63","resolution":{"observed_at":"2026-08-07T12:50:09.290443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.01246","last_updated":"2018-12-14T19:39:43Z","snapshot_observed_at":"2026-08-17T05:42:15.030047Z","submitted_at":"2018-06-04T17:38:42Z","title":"ML-Leaks: Model and Data Independent Membership Inference Attacks and Defenses on Machine Learning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.01246","snapshot_observed_at":"2026-08-07T12:50:03.631859Z","title":"Ml-leaks: Model and data independent membership inference attacks and defenses on machine learning models","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:03.631859Z"},"links":{"cited_paper":"/paper/1806.01246","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:04cd6d46b144bd2a8336679399b86d0a744166fc15b5a9ff01647aa2a8fc667e","observation_id":"705e65bc-7f65-4da8-87d8-0dc7e92d5a44","resolution":{"observed_at":"2026-08-07T12:50:03.631859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02114","last_updated":"2021-11-03T10:16:39Z","snapshot_observed_at":"2026-08-02T08:12:49.547570Z","submitted_at":"2021-11-03T10:16:39Z","title":"LAION-400M: Open Dataset of CLIP-Filtered 400 Million Image-Text Pairs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02114","snapshot_observed_at":"2026-08-07T12:50:03.733468Z","title":"Laion-400m: Open dataset of clip-filtered 400 million image-text pairs","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:03.733468Z"},"links":{"cited_paper":"/paper/2111.02114","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:61cbb350dcfedbd34abc7692e456f6e7390cd8eecc20759002a2a9a648c50a89","observation_id":"be25302d-63d5-4bc9-b342-40a1639baf46","resolution":{"observed_at":"2026-08-07T12:50:03.733468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:03.803803Z","title":"A mathematical theory of communication","venue":null,"work_id":null,"year":1948},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:03.803803Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:5effe208a098c7e527531859084344c072826013880c0b0bf30e76f3ce9837c3","observation_id":"3a116c7b-1442-465e-b999-c4128a17f05a","resolution":{"observed_at":"2026-08-07T12:50:03.803803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:09.031619Z","title":"New non-additive measures of entropy for discrete probability distributions","venue":null,"work_id":"1014e721-c5cb-4098-aedf-d82a513b3842","year":1975},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:03.895255Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:72d398fc37111131716d9a3ad1911ef1bd0f0de593b3d91f5d605cf4ca5764cc","observation_id":"1e88c572-da1e-4a96-a1b2-e0fade9e3c6a","resolution":{"observed_at":"2026-08-07T12:50:09.105033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16789","last_updated":"2024-03-09T22:26:06Z","snapshot_observed_at":"2026-08-08T18:07:29.632928Z","submitted_at":"2023-10-25T17:21:23Z","title":"Detecting Pretraining Data from Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16789","snapshot_observed_at":"2026-08-07T12:50:03.989883Z","title":"Detecting pretraining data from large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:03.989883Z"},"links":{"cited_paper":"/paper/2310.16789","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:86a9f6aab738697d172d03b185bea0f1bf17a514cbf40b324a2e8da2999b5adc","observation_id":"aa40c5ee-0017-46be-99b5-092d1aa6f33f","resolution":{"observed_at":"2026-08-07T12:50:03.989883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:04.052538Z","title":"Membership inference attacks against machine learning models","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:04.052538Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:ebcd9315ae3d6f175fef1e2d90c50944dbe5392bf1577454709e87130ce598a5","observation_id":"0b9a2264-292f-44ec-a314-324191e1cc0b","resolution":{"observed_at":"2026-08-07T12:50:04.052538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21682","last_updated":"2025-06-05T18:59:02Z","snapshot_observed_at":"2026-08-16T04:53:52.439664Z","submitted_at":"2025-04-30T14:19:29Z","title":"Visual Text Processing: A Comprehensive Review and Unified Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21682","snapshot_observed_at":"2026-08-07T12:50:04.127536Z","title":"Visual text processing: A comprehensive review and unified evaluation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:04.127536Z"},"links":{"cited_paper":"/paper/2504.21682","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:a87fc0588a0150c67f601d84e458f01c6a9152163982f60507d01aded7f64920","observation_id":"4573f7fc-2348-47f0-8f17-e32ee76a36e2","resolution":{"observed_at":"2026-08-07T12:50:04.127536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14485","last_updated":"2024-12-10T12:45:31Z","snapshot_observed_at":"2026-08-16T13:16:29.857447Z","submitted_at":"2024-09-22T15:13:31Z","title":"Video-XL: Extra-Long Vision Language Model for Hour-Scale Video Understanding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.14485","snapshot_observed_at":"2026-08-07T12:50:04.246155Z","title":"Video-xl: Extra-long vision language model for hour-scale video understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:04.246155Z"},"links":{"cited_paper":"/paper/2409.14485","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:5470e99b80c7cc7b5935c5af22807a95b9f78e95b086790dedf94ba4be7ac383","observation_id":"c8017646-7848-455d-855d-be4096fd1aca","resolution":{"observed_at":"2026-08-07T12:50:04.246155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:04.343404Z","title":"Two-stream convolutional networks for action recognition in videos","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:04.343404Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:abf6f5d74b1a2d823a30790429f7840e5f390c9afe13a0f96e00bc1c091691f0","observation_id":"2e2d68cb-e4c0-4007-957b-597d2bcba0a6","resolution":{"observed_at":"2026-08-07T12:50:04.343404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:08.874150Z","title":"Information leakage in embedding models","venue":null,"work_id":"935bc873-9e84-493e-9147-02b24323d20b","year":2020},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:04.467494Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:fee3c35d0c07cc30c5a2eb6d7414a0f1cb4f03ac1bda0c7eb9931c4b943073b0","observation_id":"3e1c3333-340c-46ec-8aeb-59f5639704b8","resolution":{"observed_at":"2026-08-07T12:50:08.940596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:04.581764Z","title":"Machine learning models that remember too much","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:04.581764Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:790746ab78c7f5d8871378ee5d6d5b03c1ac10e13613a8bab59f6e37480c76b1","observation_id":"6e2ae5dc-8272-44cb-9f75-837c48bf77bb","resolution":{"observed_at":"2026-08-07T12:50:04.581764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:08.651900Z","title":"Systematic evaluation of privacy risks of machine learning models","venue":null,"work_id":"e03e2ddc-7cd4-4242-b12d-02d1f2677d6b","year":2021},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:04.718253Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:dd4097b8c2ad9e7e4570aa3177b940af6de783bb276db1bb0b07250903572be1","observation_id":"af2f5f85-d54b-4bb6-b43f-8c0e8f3bef2d","resolution":{"observed_at":"2026-08-07T12:50:08.767703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:08.479706Z","title":"Membership inference attacks against adversari- ally robust deep learning models","venue":null,"work_id":"8fb90e62-d402-4bd3-95a4-c9613bf08c4d","year":2019},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:04.873747Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:75f03ac45b16cc70c0cdcef8dee5981f98c8869902bc07a69ec4657076ce7990","observation_id":"f186be7a-2ab3-4ac5-8313-7f69beb88b20","resolution":{"observed_at":"2026-08-07T12:50:08.568425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:08.273862Z","title":"On generalized information measures and their applications","venue":null,"work_id":"64d32efa-aaae-4242-895d-5fa9e8eb2f7c","year":1989},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:04.999000Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:88d5c12c743fb8e0486fd62d9f6668f05bcfa84ee821506da1e85605df3f5ae7","observation_id":"6e6be34f-de80-4c2f-8990-3be96fac9342","resolution":{"observed_at":"2026-08-07T12:50:08.338855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T12:50:05.147168Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:05.147168Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:baae7a23a625d4796acec42611455199b14cdb4e6f26b895456a5157c61dd657","observation_id":"5d3dac5a-6b4e-497b-95e5-5ecde0569248","resolution":{"observed_at":"2026-08-07T12:50:05.147168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:08.060667Z","title":"Possible generalization of boltzmann-gibbs statistics","venue":null,"work_id":"b5383bee-8138-49f9-b14f-e986af54c673","year":1988},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:05.212429Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:0e0a1b5196bb8ef5bb473583202a0526547839f877224ef2da1812666cc5ab0c","observation_id":"a55d195b-e3c1-4842-a420-b368c67e69e8","resolution":{"observed_at":"2026-08-07T12:50:08.185744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12830","last_updated":"2024-04-30T23:20:41Z","snapshot_observed_at":"2026-08-16T14:08:21.114746Z","submitted_at":"2024-03-19T15:37:27Z","title":"Towards Lifecycle Unlearning Commitment Management: Measuring Sample-level Approximate Unlearning Completeness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12830","snapshot_observed_at":"2026-08-07T12:50:05.293392Z","title":"Towards lifecycle unlearn- ing commitment management: Measuring sample-level approximate unlearning completeness","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:05.293392Z"},"links":{"cited_paper":"/paper/2403.12830","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:866aa3d95b31abf3b90f42bdff1c911fe0c6b1acb1d96261d4bd04fcc8000e0c","observation_id":"e75b7c71-5106-4d83-bd6f-afcb7403748e","resolution":{"observed_at":"2026-08-07T12:50:05.293392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:05.379397Z","title":"Cogvlm: Visual expert for pretrained language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:05.379397Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:d017c1e78733399f171137d16891eb044c8cb21f80e1e9eb53ae6000b52c819d","observation_id":"d0600a01-95c9-4990-8fd2-14402013aeab","resolution":{"observed_at":"2026-08-07T12:50:05.379397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:07.842560Z","title":"Videoagent: Long-form video understanding with large language model as agent","venue":null,"work_id":"de496c45-4b23-4d2e-aa6d-78ea81d9373e","year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:05.500963Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:abff4bb1d1fd0e45c9f467eb206f67b50e1d2bb80af4e3a8e232ffecb60433ec","observation_id":"a5491a5e-aa1a-4870-b10c-98185536397c","resolution":{"observed_at":"2026-08-07T12:50:07.985051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19338","last_updated":"2025-08-31T10:28:19Z","snapshot_observed_at":"2026-08-16T12:47:06.946008Z","submitted_at":"2025-03-25T04:11:47Z","title":"Membership Inference Attacks on Large-Scale Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19338","snapshot_observed_at":"2026-08-07T12:50:05.586426Z","title":"Membership inference attacks on large-scale models: A survey","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:05.586426Z"},"links":{"cited_paper":"/paper/2503.19338","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:a42e947e24046ee70615671e7da3e6a7ddf4f4a96b17650de710e1bed57015a8","observation_id":"0ec80a0b-0802-449e-965a-9f21b2726c38","resolution":{"observed_at":"2026-08-07T12:50:05.586426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:07.571444Z","title":"Optimizing video prediction via video frame interpola- tion","venue":null,"work_id":"9294d0c2-9029-4bec-95f2-bb8bf2465b1a","year":2022},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:05.725361Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:94063a68b1a033178f4366482bbef3671929b7aea6b2f6bdf465485a9bd12bd6","observation_id":"a56eb976-f0d0-477e-9da7-70681236dcd4","resolution":{"observed_at":"2026-08-07T12:50:07.662811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:05.811536Z","title":"Privacy risk in machine learning: Analyzing the connection to overfitting","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:05.811536Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:91197f3411d54d727673ba2f3418d1d186c815427afe6423eb779bd472c5e8dd","observation_id":"7fd37cb5-b0a3-42f1-83bc-ce00b0bbe0f2","resolution":{"observed_at":"2026-08-07T12:50:05.811536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09149","last_updated":"2025-06-20T07:15:14Z","snapshot_observed_at":"2026-08-16T12:50:50.587212Z","submitted_at":"2025-03-12T08:23:32Z","title":"Memory-enhanced Retrieval Augmentation for Long Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09149","snapshot_observed_at":"2026-08-07T12:50:05.895161Z","title":"Memory-enhanced retrieval augmentation for long video understanding","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:05.895161Z"},"links":{"cited_paper":"/paper/2503.09149","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:261f6b7c54138d71192e4931bf65d0e2ff071fe533b995db73acba1416e326f4","observation_id":"bcff9749-0c0c-4a8e-955d-c8f53bf5c8f9","resolution":{"observed_at":"2026-08-07T12:50:05.895161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03262","last_updated":"2024-06-12T09:02:47Z","snapshot_observed_at":"2026-08-16T14:37:17.059686Z","submitted_at":"2023-12-06T03:18:49Z","title":"Low-Cost High-Power Membership Inference Attacks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03262","snapshot_observed_at":"2026-08-07T12:50:06.019851Z","title":"Low-cost high-power membership inference attacks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:06.019851Z"},"links":{"cited_paper":"/paper/2312.03262","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:e61e70b463a814e869f1a022fb7e12e0231b462564990fc0f41d701c39753ae6","observation_id":"a6cd3d11-bbff-4cdd-bc20-67b0f99bd391","resolution":{"observed_at":"2026-08-07T12:50:06.019851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:07.364576Z","title":"Understanding deep learning (still) requires rethinking generalization","venue":null,"work_id":"e3d2ad56-5e52-4f1f-80c9-76e3bf490aac","year":2021},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:06.095288Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:7b881e4250eed18ccd7d2406877346cd6f801d92209cd7259a220b22199fb609","observation_id":"0d9f2b91-34d5-47dc-81e4-2b7dbe25edbd","resolution":{"observed_at":"2026-08-07T12:50:07.453959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02936","last_updated":"2025-02-12T04:41:34Z","snapshot_observed_at":"2026-08-16T14:04:05.511198Z","submitted_at":"2024-04-03T04:25:01Z","title":"Min-K%++: Improved Baseline for Detecting Pre-Training Data from Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02936","snapshot_observed_at":"2026-08-07T12:50:06.177607Z","title":"Min-k%++: Improved baseline for detecting pre-training data from large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:06.177607Z"},"links":{"cited_paper":"/paper/2404.02936","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:3794b4dcd837574de8f3c9c63f3e18a5dd739d9427423f25b68f5d61c77d53a6","observation_id":"548de2d1-4350-4c21-b212-3e1c67f612a8","resolution":{"observed_at":"2026-08-07T12:50:06.177607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16852","last_updated":"2024-07-01T02:59:29Z","snapshot_observed_at":"2026-08-07T09:52:45.942315Z","submitted_at":"2024-06-24T17:58:06Z","title":"Long Context Transfer from Language to Vision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16852","snapshot_observed_at":"2026-08-07T12:50:06.285354Z","title":"Long context transfer from language to vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:06.285354Z"},"links":{"cited_paper":"/paper/2406.16852","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:86bf4634b24ac65c5f1f236fc75bba40336c0dbcee4c4b481734c48ac9c55eef","observation_id":"7090f9e5-e826-48d2-a982-117d9ec7574c","resolution":{"observed_at":"2026-08-07T12:50:06.285354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:06.350478Z","title":"Instruction tuning for large language models: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:06.350478Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:eb200e2abec461a4521b94e507bb943d1f4952da4eba10847a20c7f4901d1437","observation_id":"c28e97a8-b5e4-47bf-a37e-5b6f3c93033b","resolution":{"observed_at":"2026-08-07T12:50:06.350478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:06.454260Z","title":"Llava-next: A strong zero-shot video understanding model, April 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:06.454260Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:95101873bb5219cad67e20e727a3f40bfb1e7f2867ed002cca924409470e4cf5","observation_id":"34b4344b-0985-4f43-8c09-eb8538e5b39d","resolution":{"observed_at":"2026-08-07T12:50:06.454260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04264","last_updated":"2025-01-01T15:53:58Z","snapshot_observed_at":"2026-08-03T20:38:36.602554Z","submitted_at":"2024-06-06T17:09:32Z","title":"MLVU: Benchmarking Multi-task Long Video Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04264","snapshot_observed_at":"2026-08-07T12:50:06.526660Z","title":"Mlvu: A comprehensive benchmark for multi-task long video understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:06.526660Z"},"links":{"cited_paper":"/paper/2406.04264","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:84b6f22a927f55082ff18a6f51dcc058c419b2760e5bf749b659199c39a14e91","observation_id":"f2ccfd2b-e414-47d7-a3be-620b054f5142","resolution":{"observed_at":"2026-08-07T12:50:06.526660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:07.222048Z","title":"A survey on deep learning technique for video segmentation","venue":null,"work_id":"1582528c-0269-4a25-ad60-0c5113956a85","year":2022},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:06.708410Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:7ca2f6aafbbcbc370e3a424bf51be18ed9918d357dd680f27ef2df2364f5a6d0","observation_id":"0bcd2431-6ade-4903-811b-cce29a24883d","resolution":{"observed_at":"2026-08-07T12:50:07.275639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T10:08:46.994821Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":1,"verified_fuzzy":23},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 2 inbound Pith citation observations for arXiv:2506.03179."}